2026年8月20日凌晨,DeepSeek Harness发布v0.1.0-rc.8版本,距8月13日开启公测仅一周。这是DeepSeek Harness公测以来的首次重要版本更新,共带来14项调整,DeepSeek Harness多模态能力补齐和子代理编排体系完善成为最受开发者关注的两大变化。

一、多模态能力正式补齐:Agent有了"眼睛"
rc.8版本最重要的变化,是DeepSeek Harness正式补齐了多模态输入能力。DeepSeek模型适配器现在可以通过配置启用原生图片请求——对于具备视觉能力的模型,Harness可以直接把图片送进模型处理;/goal、/plan等核心命令也已支持图文混合输入。@菜单也迎来升级:新增文件和历史会话引用,用户可以直接把本地文件、已有对话上下文一起拉进当前任务。
更值得关注的是,即便调用的模型本身不具备图像输入能力,Harness也准备了一套工具层的"视觉"方案:先进行OCR文字识别,再统计图片中的颜色比例、扫描部分像素行,同时读取图片尺寸、色彩模式等元信息。这些结构化结果最终会被重新交给文本大模型,让模型根据OCR文本、颜色占比、像素位置等证据推断图像内容,实现真正的多模态任务处理。
二、Claude Code与Codex入局子代理体系
子代理协作是本次更新的另一重点。rc.8中,Claude Code和Codex都可以作为Profile Bundle(配置包)安装、按需启用,并作为子代理被Harness调用。Claude Code支持非交互权限模式,适合无人值守的自动化流程。Codex进一步支持多个命名实例,可以在同一任务中同时配置不同能力方向的Codex子代理并行工作,形成更复杂的协作工作流。
三、生态价值:从极客工具到行业级Agent平台
从8月13日公测到rc.8发布,短短一周内Harness已完成从"极客代码助手"到"行业级多模态Agent平台"的跨越。工具层的多模态兜底方案(OCR+像素统计+元信息提取)体现了DeepSeek一贯的务实风格——不追求模型本身具备视觉能力,而是通过工具链弥补短板,让任意模型都能参与视觉任务,降低了多模态Agent的门槛。


