2026年8月27日,阿里千问团队正式发布多模态MoE模型Qwen3.8-Flash,同步开源下一代底层架构Qwen3.8-Flash-Next(Qwen4系列雏形)。该模型总参数达125B,单token仅激活6B参数,原生支持26万token上下文可扩展至100万,训练成本仅为前代的1/9,API输入定价低至每百万token1元,实现效能双重突破。

大模型商业化落地的核心矛盾,始终绕不开性能与成本的平衡。过去一年,多模态大模型的参数规模不断攀升,但动辄数元每百万token的调用成本、不足10万的上下文窗口,始终限制了其在长文档处理、企业知识库接入等场景的普及。而阿里千问此次发布的新品,直接瞄准了这一行业痛点。
随着企业级用户对大模型的接受度持续提升,单纯的参数堆砌已经不再是行业竞争的核心指标。相反,能否在保持多模态理解、长上下文处理能力的前提下,进一步压低训练和调用成本,成为大模型厂商抢占市场的核心竞争力。此前多家机构的调研显示,超过6成的企业用户将“调用成本”列为选择大模型服务的首要考量因素,长文档处理、多模态内容生成的需求占比也突破了70%。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录