近日OpenAI正式推出专为大模型规模化推理设计的自研AI芯片Jalapeño,第三方机构Semianalysis的InferenceX基准测试结果显示,该芯片的单用户可生成token数量、每千瓦吞吐量两项核心指标均超过当前市售最优同类产品,有望大幅降低大模型推理成本,支撑GPT系列产品的后续服务扩容。

对于提供2C大模型服务的厂商而言,推理算力的成本和效率一直是决定盈利空间的核心指标:此前行业测算显示,ChatGPT每千万次用户查询的推理算力开销就超过100万美元,仅2025年OpenAI为采购GPU投入的资金就超过120亿美元,上游供应链的产能波动也多次导致GPT系列服务出现排队、限流情况。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录