国内大模型厂商DeepSeek于2026年9月正式开源V4系列首个实验性多模态模型DeepSeek-V4-Flash-Vision-Exp,模型总参数量达3050亿,基于V4-Flash架构融合视觉模块,纯文本能力与前代产品持平,多模态综合表现接近行业顶尖水平,此次开源采用对商用友好的MIT协议,将进一步推动多模态大模型技术的普惠落地。9月1日DeepSeek官方开源仓库更新信息显示,这款带有“Exp”实验标识的多模态模型,是其V4-Flash产品线首次拓展视觉能力的尝试,此前DeepSeek V4系列模型均主打纯文本场景,在长文本处理、代码生成、智能体调度等任务上已经获得了大量开发者的认可。不同于不少厂商采用的“文本大模型+外挂视觉编码器”的拼接方案,该模型的视觉模块是在V4-Flash底层架构基础上联合训练而来,实现了文本与视觉模态的有机融合。3050亿的总参数量中,视觉模块与文本模块的权重配比经过多轮优化,既保留了原有V4-Flash的成熟文本能力,又新增了深度图像理解能力。 该模型除了能完成图像字幕生成、图表数据提取、手写内容识别等常规多模态任务,还可以联动搜索、代码执行等外部...