2026年9月10日,AI企业深度求索正式推出轻量级多模态模型DeepSeek V4.1 Flash。该产品采用552B参数MoE架构,首创Causal-Encoder-Decoder结构,输入激活仅8B、输出激活16B,原生视觉理解能力及综合基准测试表现全面超越同系列旗舰DeepSeek V4 Pro,推理成本较同级别产品大幅降低。

过去一年,多模态大模型的技术迭代始终在“堆参数提性能”和“降成本促落地”两个方向拉扯:旗舰模型性能不断突破但推理成本居高不下,轻量化模型大多通过压缩、剪枝实现,往往要牺牲30%以上的性能才能适配落地场景,二者的平衡一直是行业共同的难题。
随着电商图文客服、智能硬件交互、工业视觉质检等场景的AI改造需求爆发,市场对“旗舰级性能、轻量化成本”的多模态模型需求持续攀升,也倒逼厂商从架构层面而非单纯的参数压缩寻找解决方案。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录