AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

DeepSeek Harness上线多模态功能 疑似预告V4视觉模型即将发布

2026年8月20日,开源智能体工具DeepSeek Harness在发布仅7天后迎来重磅升级,正式上线全链路多模态支持,新增模型适配器原生图片请求能力,引发外界对DeepSeek V4视觉版模型即将发布的广泛猜想。本次更新同步优化交互逻辑与复杂工作流稳定性,多项核心功能实现图文混合调用,大幅降低开发者搭建多模态智能体的技术门槛。

配图

2026年以来,国内大模型工具链的迭代速度明显加快,仅今年二季度就有超过12款开源智能体工具上线,但其功能大多集中在纯文本任务调度,多模态能力的缺失一直是开发者的核心痛点。不少中小团队反馈,要实现智能体的图片理解、图文混合调度功能,需要额外对接3-4个第三方工具模块,不仅开发周期长,后续的稳定性维护成本也居高不下。

本次DeepSeek Harness的更新,直接从底层补上了多模态支持的短板。模型适配器首次支持配置原生图片请求,开发者无需额外对接第三方视觉处理工具,即可直接调用图像理解能力。

交互层面的优化也更贴合开发者的实际使用场景:此前仅支持纯文本输入的/goal、/plan等核心调度命令,现在全面支持带图发送;@引用功能的覆盖范围也从单纯的本地文件,扩展到了历史会话内容,开发者单次提问即可同时挂载截图、本地文件与过往对话记录,省去了多次上传、上下文重复输入的麻烦。

为了适配复杂工作流的运行需求,新版本还实现了MCP与ACP对持久化图片附件的支持,附件不会随单次调用结束而消失,同时修复了图片尺寸过大、多轮对话中历史图片累计载荷过高导致的请求失败问题,多模态任务的运行成功率提升了47%。

本次更新最受行业关注的点,无疑是原生图片请求能力的上线,这也引发了外界对DeepSeek自研V4视觉版大模型即将发布的猜想。

多位大模型行业从业者表示,工具链层面对原生图片请求的适配,往往是大模型正式上线前的前置铺垫——提前给开发者留出适配时间,避免模型上线后出现工具链断层的问题。此前DeepSeek对外披露的技术路线图中就曾提到,2026年四季度将推出新一代多模态大模型,此次Harness的更新,也被业内视为V4视觉版模型落地的明确信号。

如果V4视觉版模型如期上线,DeepSeek将补齐在多模态大模型赛道的短板,具备和GPT-4o、Claude 3系列等头部多模态模型正面竞争的能力。

对于普通开发者而言,本次更新的价值远不止于功能升级。随着工具链与底层模型的适配逐步完成,中小团队开发多模态智能体的周期将从此前的平均2周压缩至3天以内,相关的运维成本也将下降60%以上。

可以预见的是,随着DeepSeek等头部厂商逐步开放全链路的多模态工具能力,多模态智能体将快速从互联网、电商等行业,渗透到工业检测、医疗影像辅助诊断等传统场景,落地速度有望迎来翻倍增长。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。