我可以帮您推荐合适的AI工具,有什么需要帮忙的吗?
2026年9月18日,智谱AI正式通过旗下BigModel平台推出GLM-5.3-FlashX大模型,配套API同步上线。该模型最高输出速度可达200tokens/s,主打智能、价格、速度三位一体竞争力,面向企业及开发者提供高吞吐、低延迟的推理服务。其前身GLM-5.3-Flash曾以Ox Alpha匿名亮相海外,已积累大量用户调用量。
作为GLM-5系列的推理优化版本,GLM-5.3-FlashX在保留原有智能水平、亲民定价的基础上,将最高生成速度提升至200tokens/s,针对高并发商用场景做了专门优化,进一步强化了其在大流量调用场景下的商用优势。
目前该模型的API已正式对外开放,技术开发者可通过官方API文档快速接入,非技术用户也可前往官方体验中心直接试用产品能力。
据披露,GLM-5.3-FlashX的前身GLM-5.3-Flash曾以“Ox Alpha”的匿名身份登陆海外市场,凭借同尺寸最强智能水平与极高性价比快速积累用户口碑,上线后调用量始终处于持续攀升状态。
为了承载快速增长的用户调用需求,智谱AI依托10万张国产芯片组成的算力底座,加大推理侧技术优化投入,最终推出了本次的提速版本。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。