AI小创

您好,我是AI助手

我可以帮您推荐合适的AI工具,有什么需要帮忙的吗?

我会根据您的需求,智能推荐站内收录的AI工具
猜您想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI助手: 我可以帮您推荐合适的AI工具,有什么需要帮忙的吗?

智谱AI发布GLM-5.3-FlashX大模型 推理速度达200tokens/s

2026年9月18日,智谱AI正式通过旗下BigModel平台推出GLM-5.3-FlashX大模型,配套API同步上线。该模型最高输出速度可达200tokens/s,主打智能、价格、速度三位一体竞争力,面向企业及开发者提供高吞吐、低延迟的推理服务。其前身GLM-5.3-Flash曾以Ox Alpha匿名亮相海外,已积累大量用户调用量。

核心性能与接入路径

作为GLM-5系列的推理优化版本,GLM-5.3-FlashX在保留原有智能水平、亲民定价的基础上,将最高生成速度提升至200tokens/s,针对高并发商用场景做了专门优化,进一步强化了其在大流量调用场景下的商用优势。

目前该模型的API已正式对外开放,技术开发者可通过官方API文档快速接入,非技术用户也可前往官方体验中心直接试用产品能力。

产品迭代背景

据披露,GLM-5.3-FlashX的前身GLM-5.3-Flash曾以“Ox Alpha”的匿名身份登陆海外市场,凭借同尺寸最强智能水平与极高性价比快速积累用户口碑,上线后调用量始终处于持续攀升状态。

为了承载快速增长的用户调用需求,智谱AI依托10万张国产芯片组成的算力底座,加大推理侧技术优化投入,最终推出了本次的提速版本。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。