通义千问开源Qwen3.8-Flash-Next 披露Qwen4架构核心技术路径

阿里通义千问团队2026年8月正式推出多模态MoE模型Qwen3.8-Flash-Next,作为Qwen4架构的早期预览版本,该模型总参数量达1250亿,搭配510亿参数N-gram嵌入表与40亿参数多token预测模块,单token实际激活参数量仅60亿,以极低计算开销实现越级性能表现,为下一代大模型落地完成核心技术验证。

配图

2026年开源大模型赛道的技术迭代速度正在不断突破行业预期,此前MoE(混合专家)架构普遍被认为是平衡大模型性能与推理成本的最优路线,而通义千问此次放出的过渡版本,直接把下一代架构的核心技术细节摆到了全球开发者面前。

近两年,全球大模型厂商都在密集推进下一代架构的研发,其中稀疏化MoE路线因为能在大幅提升模型总容量的同时控制推理成本,成了各家布局的核心方向。不同于闭源模型通常选择将技术迭代保密到正式发布的策略,通义千问此次选择以开源预览版的形式放出Qwen4架构的核心设计,本质是借助全球开发者的反馈快速迭代技术,同时抢占开源大模型生态的技术话语权。8月27日正式开源的Qwen3.8-Flash-Next,也是目前公开参数规模最大的开源多模态MoE预览模型。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。