DeepSeek V4.1 Flash正式发布 552B MoE架构性能超前代旗舰

2026年9月10日,国内AI厂商深度求索正式发布全新大模型产品DeepSeek V4.1 Flash。该模型采用552B参数MoE架构与Causal-Encoder-Decoder不对称结构,输入激活仅8B、输出激活16B,HBM需求较上一代降至1/4,在基准测试中全面超越前代旗舰DeepSeek V4 Pro,同时具备原生多模态视觉理解能力。

配图

当前全球大模型产业正陷入“性能升级-成本飙升”的共性痛点:为了提升智能表现,厂商纷纷向上冲击更大参数规模,但随之而来的HBM显存占用过高、推理时延过长、单卡吞吐不足等问题,直接推高了大模型的落地门槛,中小客户很难负担旗舰级大模型的调用成本,不少场景不得不牺牲性能选择更小参数的模型。深度求索本次推出的新架构模型,正是瞄准这一行业空白研发的解决方案。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。