DeepSeek Harness 更新:官方多模态支持
DeepSeek Harness 连续发布 v0.1.0-rc.7、v0.1.0-rc.8 和 v0.1.1-rc.1 三个版本,重点增强多模态能力(新增 DeepSeek-V4-Flash-Vision-Exp 模型支持图文输入)、子代理协作灵活性(Codex/Claude Code 接入 Job Panel)及稳定性(修复长会话、终端兼容等问题)。MCP/ACP 支持图片附件持久化,PTC Mode 支持转发嵌套图片。
自开发者预览版 v0.1.0-rc.6 首日发布以来,DeepSeek Harness 已连续完成三次版本更新:v0.1.0-rc.7、v0.1.0-rc.8,以及今天发布的 v0.1.1-rc.1。这三次更新主要围绕多模态能力、子代理协作、跨平台兼容和日常使用体验展开,同时修复了社区反馈的一系列问题。感谢每一位开发者的试用、反馈与共建。
多模态能力进一步增强
DeepSeek 模型适配器新增 DeepSeek-V4-Flash-Vision-Exp 多模态模型选项,并支持配置原生图片请求。/goal、/plan 等命令可接收图文输入,@ 菜单可引用文件和会话;MCP/ACP 同时支持图片附件持久化,PTC Mode 支持转发嵌套图片。
子代理与插件组合更加灵活
Codex 与 Claude Code 子代理接入 Job Panel,并支持作为 Profile Bundle 按需安装,并支持非交互权限模式和多个命名实例。插件也可以自行注册设置卡片,让能力扩展与任务管理更加便捷。
稳定性与使用体验持续提升
三次更新集中修复了长会话、终端兼容、模型请求与沙箱权限等问题,并优化了提问卡片、Markdown 表格、多行输入和会话切换等交互细节,让日常使用更加稳定、顺畅。

JOTO 企业落地观察
- 企业部署多模态智能体时,需评估 Vision 模型对图像理解的精度边界与沙箱环境对本地文件访问的权限策略,尤其在金融、医疗等强合规场景中,图文混合输入可能触发额外的数据出境或审计要求。
- 子代理按 Profile Bundle 按需安装的设计,降低了企业级智能体系统的初始部署复杂度,但命名实例与非交互权限模式的组合,要求团队在 RAG 知识工程阶段即明确各子代理的上下文隔离粒度与知识源绑定关系。
- MCP/ACP 对图片附件的持久化支持,使企业知识库可原生承载扫描件、流程图、架构图等非文本资产,但需同步构建图像元数据标注与语义检索链路,否则将导致多模态 RAG 的召回率显著低于纯文本场景。
- PTC Mode 下嵌套图片的转发能力,提升了跨系统协作效率,但企业在构建 AI 安全治理策略时,必须将图片内容识别(如 OCR、NSFW 检测)纳入默认流水线,避免未经审查的视觉信息在组织内传播。
立即咨询 JOTO
JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询
想把这些做法用到你的业务里?
留下你的场景和痛点,我们帮你判断从哪一步开始。
联系我们


