JOTO
Contact us
← AI 智库
开源模型

DeepSeek Harness 更新-v0.1.2-alpha.1:体验全面打磨,子代理也能"点菜"选模型

2026 年 8 月 28 日

DeepSeek Harness v0.1.2-alpha.1 版本实现能力与体验双升级:子代理首次支持按任务指定模型(含 Claude Code、Codex 等外部提供方),多模态图片回显与 Token 计入修复、持久终端等待状态精准识别、工程层统一 Remote 网关与 dsh profile 启动模式,并完成页面加载、会话交互、折叠导航等系统级体验优化。

子代理支持配置模型:给"外包小组"指定专属设备

之前子代理(主代理派生的辅助 Agent)只能继承主代理的默认模型。想让跑批任务的小弟用更省钱的模型、让代码审查的子代理用更强的模型,做不到;Claude Code、Codex 这类外部提供方更是钉死在固定配置上。

现在任务可按需指定提供方、模型、推理力度等配置,Claude Code 与 Codex 提供方同样支持配置模型。以 Claude Code 提供方为例,源码 packages/subagent/subagent-claude-code/src/run.ts 中,运行规格新增了可选 model 字段,注释写得很清楚:

/** Profile-selected native model; omitted to preserve Claude settings. */
readonly model?: string

组装官方 SDK 选项时用 ...spec.model === undefined ? {} : { model: spec.model }——没指定就不传,完全保留 Claude 原生设置,不越权干预。这种"可选注入、缺省不动"的写法,保证老配置零迁移成本。

通俗比喻:以前外包小组只能用公司统一配发的电脑,现在每个任务都能指定用哪台机器、什么档次的显卡——省钱的和干重活的各取所需。

DeepSeek Harness 子代理模型配置界面截图
子代理模型配置界面

体验大礼包:加载更快、传输更省、交互更顺

之前页面初始化慢、会话数据整包传输、持久化存储体积膨胀;长会话所有轮次挤在一起,没有折叠;切换会话时问答卡片的草稿直接丢失;/@ 菜单的标签呈现也不够清晰。

现在优化页面初始化加载性能、会话加载传输数据量与持久化存储体积;/@ 菜单与引用标签呈现优化,切换会话保留问答卡片草稿;支持自动折叠会话过程、调节宽度、展示每轮精细用量、轮次导航,流式输出时保持代码高亮,中英文间距也做了优化。

通俗比喻:以前是整箱搬运档案,现在按需取用、轻装上路;冗长会议记录自动折叠成大纲,想回看哪一轮点一下就到。

多模态:图片从"黑箱"变"透明"

之前上传图片没有即时回显;上下文压缩不把图像计入 Token,压缩后用量账对不上;轨迹视图里看不到图片附件,模型也定位不了自己刚上传的图;压缩耗时过长会卡住流程。

现在图像发送立即回显;上下文压缩计入图像 Token;轨迹视图支持展示图片附件;模型可直接定位已上传图片;压缩耗时过长问题一并修复。

通俗比喻:以前图片进了打印机就没人知道它在哪个环节,现在每一步都有回执,账目清晰、随时可查。

持久终端系列修复:分清"真等待"与"假等待"

之前 Linux 管道内部读取被误判为"等待输入",命令提前返回空输出;macOS/Linux 持久 PowerShell 启动误判、输出异常;Bash 派生大量子进程时宿主卡顿;Web 界面持久 Bash 结果卡片无法展开。

上述全部修复。核心逻辑在 packages/terminal/terminal-bash/src/session.ts:新增 initialForegroundLeftWait 状态与 acceptsStdinWait() 判定——只有进程组真正离开过等待状态之后,再次出现的 waiting 信号才被当作"在等输入";否则视为管道内部读取,不提前返回。注释点破了问题本质:"The same group may still expose the wait that existed before terminal.write."(同一个进程组可能还暴露着写入之前就存在的等待状态)。

通俗比喻:之前分不清"它真的在等你说话"和"它只是低头看文件",现在加了一道判断——先离开座位再回来,才算真的在等人。

DeepSeek Harness 持久终端等待状态修复对比图
持久终端等待状态修复对比

工程收敛:一把钥匙进所有门

之前 Python SDK、ACP 等应用各有各的启动入口;旧版 APIProxy 传输层与 Remote 网关并存;Headless 运行过程全程黑盒。

现在移除旧版 APIProxy 传输层,统一走 Remote 网关,网络访问启用一次性 Token 鉴权;Python SDK、ACP 启动模式收敛至 dsh profile,并新增 Python Windows x64 产物、补齐 ACP 自动化控制;pi-ai 升级至 0.84.2,模型列表更新提供方并支持 vLLM 思考预算等新参数;DeepSeek 模型适配器默认附带已启用插件包名与版本(可配置关闭),新增可选的会话日志增量上传(默认关闭);Headless 运行期间向 stderr 流式输出推理进度,stdout 仍只输出最终答案。以 headless 为例,packages/bundle/headless/src/index.tsstreamReasoning() 监听 assistant/chunk 事件,遇到 reasoning-delta 就向 stderr 写入 dsh: reasoning: 前缀加增量文本——进度与答案彻底分道。

通俗比喻:把所有门统一成一把钥匙(dsh profile),旧钥匙孔(APIProxy)拆掉;流水线进度写在旁边的告示牌上(stderr),不弄脏最终交付单(stdout)。

预设与工具调用的小修小补

之前 profile 配置的预设根目录启动时丢失;无法解析的预设没有提前标记,切换被拒也不解释原因;Minimal 预设里挂着用不上的 /goal 命令;文件编辑工具会拒绝带 null 占位值的字段;PTC 模式下 SDK 绑定可被 run_code 绕过。

现在预设根目录启动丢失修复;无法解析的预设提前标记,切换被拒时给出原因;Minimal 预设不再挂载 /goal 命令;文件编辑工具不再拒绝未使用字段的 null 占位值;PTC Mode 下 SDK 绑定不再被 run_code 直接调用绕过——安全边界收口。

一句总结

这是一次典型的"体验还债 + 能力增值"版本:子代理模型配置给了开发者新的控制维度,终端与多模态的修复拔掉了日常使用中最磨人的几根刺——alpha 阶段能打磨到这个程度,说明项目正加速向稳定期收敛。

JOTO 企业落地观察

  • 子代理模型动态配置能力,使企业可在同一智能体架构内混合部署不同成本/能力等级的模型,为 RAG 知识工程中的「查询路由」与「结果精排」环节提供了原生支持,无需额外封装调度层。
  • 持久终端对等待状态的精准识别,降低了企业将 CLI 工具链嵌入智能体工作流时的误触发风险,尤其利于 DevOps 场景下自动化脚本执行的稳定性保障。
  • 多模态图片 Token 显式计费与轨迹回显,为企业构建可审计的 AI 应用提供了关键基础——图像上下文不再“不可见”,便于后续做合规性检查与用量归因。
  • Remote 网关统一与一次性 Token 鉴权机制,简化了企业私有化部署时的安全策略收敛路径,避免因多传输层并存导致的权限配置碎片化问题。

立即咨询 JOTO

JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询

想把这些做法用到你的业务里?

留下你的场景和痛点,我们帮你判断从哪一步开始。

联系我们
Contact Us

Start your enterprise AI rollout

Tell us your industry, team, and current pain points. We'll get back to you within one business day to help you decide what to tackle first, what data to prepare, and which platform fits.

WeChat
Scan to add us for a 1:1 chat
JOTO WeChat consultation QR code

Tell us what you need

Once we receive your details, we'll be in touch within one business day.