DeepSeek V4.1 Flash发布 轻量多模态性能全面超越旗舰Pro版

2026年9月10日,AI企业深度求索正式推出轻量级多模态模型DeepSeek V4.1 Flash。该产品采用552B参数MoE架构,首创Causal-Encoder-Decoder结构,输入激活仅8B、输出激活16B,原生视觉理解能力及综合基准测试表现全面超越同系列旗舰DeepSeek V4 Pro,推理成本较同级别产品大幅降低。

配图

过去一年,多模态大模型的技术迭代始终在“堆参数提性能”和“降成本促落地”两个方向拉扯:旗舰模型性能不断突破但推理成本居高不下,轻量化模型大多通过压缩、剪枝实现,往往要牺牲30%以上的性能才能适配落地场景,二者的平衡一直是行业共同的难题。

随着电商图文客服、智能硬件交互、工业视觉质检等场景的AI改造需求爆发,市场对“旗舰级性能、轻量化成本”的多模态模型需求持续攀升,也倒逼厂商从架构层面而非单纯的参数压缩寻找解决方案。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。