OpenAI推出GPT-5.6 Sol UltraFast 速度最高达标准模式14倍

2026年8月,OpenAI正式面向企业用户推出GPT-5.6 Sol UltraFast超快模式预览,该模式算力由AI芯片厂商Cerebras提供支持,运行速度最高可达标准模式的14倍,每秒生成token量最高达750个,目前采用申请审核制,仅面向实时性要求高的特定业务场景开放。

配图

对于需要大模型实时响应的企业用户而言,延迟问题始终是阻碍生产级落地的核心瓶颈——此前GPT-5.6标准版在高负载下的响应延迟普遍超过2秒,无法满足语音交互、实时决策类场景的需求,这一痛点近日终于迎来了针对性解决方案。

此次OpenAI推出的超快模式,核心性能参数刷新了现有通用大模型商用版本的速度纪录:相比GPT-5.6标准模式,超快模式的推理速度最高提升14倍,峰值每秒可生成750个tokens,折算为中文内容约为每秒520字,几乎可以做到用户输入结束的同时同步输出完整回复,延迟感知降低到普通用户无法察觉的水平。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。