2026年8月20日,开源智能体工具DeepSeek Harness在发布仅7天后迎来重磅升级,正式上线全链路多模态支持,新增模型适配器原生图片请求能力,引发外界对DeepSeek V4视觉版模型即将发布的广泛猜想。本次更新同步优化交互逻辑与复杂工作流稳定性,多项核心功能实现图文混合调用,大幅降低开发者搭建多模态智能体的技术门槛。

2026年以来,国内大模型工具链的迭代速度明显加快,仅今年二季度就有超过12款开源智能体工具上线,但其功能大多集中在纯文本任务调度,多模态能力的缺失一直是开发者的核心痛点。不少中小团队反馈,要实现智能体的图片理解、图文混合调度功能,需要额外对接3-4个第三方工具模块,不仅开发周期长,后续的稳定性维护成本也居高不下。
本次DeepSeek Harness的更新,直接从底层补上了多模态支持的短板。模型适配器首次支持配置原生图片请求,开发者无需额外对接第三方视觉处理工具,即可直接调用图像理解能力。
交互层面的优化也更贴合开发者的实际使用场景:此前仅支持纯文本输入的/goal、/plan等核心调度命令,现在全面支持带图发送;@引用功能的覆盖范围也从单纯的本地文件,扩展到了历史会话内容,开发者单次提问即可同时挂载截图、本地文件与过往对话记录,省去了多次上传、上下文重复输入的麻烦。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录