Qwen4已投入训练,阿里披露10万亿参数大模型演进路线

配图
9月22日,2026云栖大会在杭州开幕。阿里巴巴集团现场公布多项大模型进展:基于下一代架构的Qwen4已正式投入训练,Qwen4.5、Qwen5等后续模型参数规模计划扩展至5万亿至10万亿。与此同时,大模型递归自我改进(RSI)已进入模型训练、推理及芯片协同环节,Qwen3.8-Max在人类"零参与"情况下自主完成33轮有效迭代。Qwen LLM项目负责人刘大一恒表示,Scaling是迈向ASI的重要路径。

10万亿参数路线图浮出水面

在云栖大会主论坛上,阿里巴巴明确了大模型领域的战略布局。继Qwen3.8系列之后,基于下一代架构的Qwen4已经投入训练,而规划中的Qwen4.5、Qwen5等后续版本,参数规模将扩展至5万亿至10万亿。这一数字较当前主流模型提升了一个量级,显示出阿里在基座模型层面的长期投入决心。 阿里巴巴集团CEO吴泳铭在主旨演讲中将AI模型、AI芯片、AI云定位为"机器智能时代三大基石"。可以推断,10万亿参数级别的模型训练,将深度依赖其自研芯片与云计算基础设施的协同能力。

RSI技术实现"零人工"自主迭代

递归自我改进(RSI)是此次发布中技术含量最高的环节。阿里披露,Qwen3.8-Max发布后,在Artificial Analysis Agentic智能体、CodeArena前端编程等评测中位居前列。但更值得关注的是其自主迭代能力:该模型能够自主搭建训练流程、构造数据、设计实验并定位缺陷,在人类"零参与"的情况下持续迭代超过1个月,完成33轮有效迭代,使Artificial Analysis得分提升12.5%。 这一进展意味着大模型已具备一定程度的自我优化能力。目前RSI已初步进入模型训练、推理及芯片(芯模)协同环节。在平头哥新款GPU上,Qwen3.8-Max自主优化推理框架,吞吐量提升96%;仅凭总线模块规范自主完成芯片物理实现优化,面积减少42%、功耗降低59.5%。训练侧同样有显著突破——Qwen3.8-Flash通过注意力机制等创新,使训练成本骤降近90%。

多模态矩阵升级 视频生成模型定档11月

除基座模型与RSI技术外,阿里还宣布多模态模型矩阵全面升级。其中,下一代视频生成模型已确定将于11月发布。刘大一恒在主论坛演讲中将当前阶段定义为"智能体(Agent)时代",其演讲主题为"Qwen:迈向真实世界智能体"。从模型矩阵布局来看,视频生成能力的补全,正是为智能体在真实世界中的感知与交互提供基础设施。

开源生态持续扩容

在开源维度,千问系列全球下载量已超30亿次,衍生模型超30万个,官方累计开源460多款模型。仅Qwen3.8相关模型,一个月内下载量便超过5600万次。这些数据从侧面验证了Qwen系列在开发者社区中的渗透广度。从行业角度看,参数规模的跃升与RSI技术的落地,正在重新定义大模型竞争力的衡量标准——不再仅限于静态评测分数,而是涵盖模型自主进化能力与软硬协同效率的综合维度。

参考资料

  1. 阿里巴巴:下一代视频模型将于11月发布|Qwen 3|云栖大会|语言模型|大模型|编程_手机新浪网 - 新浪财经
  2. 阿里公布全模态模型新进展:Qwen4和下代视频模型均在训练中|HappyOyster|云栖大会|时代周报|阿里巴巴|语言模型_手机新浪网 - 新浪财经
  3. AI模型迈向RSI,未来将扩展至5-10T参数规模|Qwen 3|AI芯片|云栖大会|阿里巴巴|吴泳铭_手机新浪网 - 新浪财经
  4. 阿里发布全模态模型新进展,Qwen4及视频模型进入训练阶段_应用_技术_人工智能 - 手机搜狐网
  5. 阿里公布全模态模型新进展,Qwen4和下代视频模型均在训练中|每日经济新闻|云栖大会|阿里巴巴|大模型|世界模型_新浪新闻 - 手机新浪网
  6. Qwen4已投入训练,阿里公布10万亿参数模型演进路线_Scaling_Agentic_方面 - 手机搜狐网
  7. 2026云栖大会首页-阿里云 - 2025云栖大会
  8. 商学院杂志的微博 - 微博
  9. 阿里Qwen刘大一恒:坚持开源开放,实现AI普惠_新浪财经_新浪网 - 新浪财经
  10. 2026云栖大会 - 新浪财经
  11. 阿里大模型全面提速:Qwen4已在训练,下一代视频生成模型将于11月发布 - 网易新闻客户端
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。