开源智能体工具DeepSeek Harness的迭代速度,确实有点出乎意料——距离首个正式版发布不过一周,新版本就已火速推送。本次更新最核心的看点,是官方正式引入了增强型多模态支持。具体来说,DeepSeek模型适配器现在可以配置并启用原生图像请求能力。这一动作迅速点燃了社区猜测:DeepSeek自家的视觉模型,恐怕已经在路上了。
从底层架构的调整来看,这次更新在用户体验层面带来了几项非常实在的改进。此前/goal和/plan等指令仅支持纯文本传输,现在则完全支持图片与文字一同发送;与此同时,@引用的范围也从单纯的文件扩展,拓宽到了历史对话。这就意味着,开发者现在可以在一轮查询中,同时附带截图、本地文件以及上轮对话内容。为了保证复杂工作流的稳定性,新版本不仅让MCP和ACP都能持久化图片附件——单次调用结束后附件不会消失,还成功修复了因图片体积过大、多轮对话中历史图片产生的高额累积负载所引发的各种Bug。

除了多模态能力的升级,新版本在组件分发与架构优化上同样动作不小。Claude Code和Codex这两个组件不再随主产品一起分发,而是被拆解为可按需安装的Profile Bundles。其中Codex引入了两项新特性:其一,支持非交互权限模式,允许在无人值守的进程里顺畅运行;其二,支持多个命名实例,让多个不同配置和名称的Codex子智能体能够同时共存。与此同时,子智能体的“报告路径”也做了优化,reportDelivery现在可以及时反馈并唤醒父任务,彻底解决了父任务盲目等待子任务结束的老大难问题。

在其他功能优化方面,web_search新增了并发查询支持,Windows PTY终端正式加入持久化PowerShell会话能力,并且在极简模式下该功能默认开启。SQLite后端的读写性能和fork性能均有显著提升,存储体积也进一步压缩。另外官方确认,“DeepSeek Harness”已注册为商标,相关品牌使用指引业已更新。
从这一周的更新内容不难看出,DeepSeek团队对智能体工具的打磨正在从“能用”快速迈向“好用”。多模态支持的上线,不仅降低了开发者与AI交互时的信息损耗,更暗示着未来视觉模型接入后的生态想象空间。而组件拆分、子智能体报告机制的优化,则反映出团队对生产环境下工作流可靠性的深度思考。照这个节奏,下一版本很可能会释放更多关于视觉能力的重量级信息。