DeepSeek Harness 更新-v0.1.2-alpha.1:体验全面打磨,子代理也能"点菜"选模型
DeepSeek Harness v0.1.2-alpha.1 版本实现能力与体验双升级:子代理首次支持按任务指定模型(含 Claude Code、Codex 等外部提供方),多模态图片回显与 Token 计入修复、持久终端等待状态精准识别、工程层统一 Remote 网关与 dsh profile 启动模式,并完成页面加载、会话交互、折叠导航等系统级体验优化。
子代理支持配置模型:给"外包小组"指定专属设备
之前子代理(主代理派生的辅助 Agent)只能继承主代理的默认模型。想让跑批任务的小弟用更省钱的模型、让代码审查的子代理用更强的模型,做不到;Claude Code、Codex 这类外部提供方更是钉死在固定配置上。
现在任务可按需指定提供方、模型、推理力度等配置,Claude Code 与 Codex 提供方同样支持配置模型。以 Claude Code 提供方为例,源码 packages/subagent/subagent-claude-code/src/run.ts 中,运行规格新增了可选 model 字段,注释写得很清楚:
/** Profile-selected native model; omitted to preserve Claude settings. */
readonly model?: string组装官方 SDK 选项时用 ...spec.model === undefined ? {} : { model: spec.model }——没指定就不传,完全保留 Claude 原生设置,不越权干预。这种"可选注入、缺省不动"的写法,保证老配置零迁移成本。
通俗比喻:以前外包小组只能用公司统一配发的电脑,现在每个任务都能指定用哪台机器、什么档次的显卡——省钱的和干重活的各取所需。

体验大礼包:加载更快、传输更省、交互更顺
之前页面初始化慢、会话数据整包传输、持久化存储体积膨胀;长会话所有轮次挤在一起,没有折叠;切换会话时问答卡片的草稿直接丢失;/ 与 @ 菜单的标签呈现也不够清晰。
现在优化页面初始化加载性能、会话加载传输数据量与持久化存储体积;/、@ 菜单与引用标签呈现优化,切换会话保留问答卡片草稿;支持自动折叠会话过程、调节宽度、展示每轮精细用量、轮次导航,流式输出时保持代码高亮,中英文间距也做了优化。
通俗比喻:以前是整箱搬运档案,现在按需取用、轻装上路;冗长会议记录自动折叠成大纲,想回看哪一轮点一下就到。
多模态:图片从"黑箱"变"透明"
之前上传图片没有即时回显;上下文压缩不把图像计入 Token,压缩后用量账对不上;轨迹视图里看不到图片附件,模型也定位不了自己刚上传的图;压缩耗时过长会卡住流程。
现在图像发送立即回显;上下文压缩计入图像 Token;轨迹视图支持展示图片附件;模型可直接定位已上传图片;压缩耗时过长问题一并修复。
通俗比喻:以前图片进了打印机就没人知道它在哪个环节,现在每一步都有回执,账目清晰、随时可查。
持久终端系列修复:分清"真等待"与"假等待"
之前 Linux 管道内部读取被误判为"等待输入",命令提前返回空输出;macOS/Linux 持久 PowerShell 启动误判、输出异常;Bash 派生大量子进程时宿主卡顿;Web 界面持久 Bash 结果卡片无法展开。
上述全部修复。核心逻辑在 packages/terminal/terminal-bash/src/session.ts:新增 initialForegroundLeftWait 状态与 acceptsStdinWait() 判定——只有进程组真正离开过等待状态之后,再次出现的 waiting 信号才被当作"在等输入";否则视为管道内部读取,不提前返回。注释点破了问题本质:"The same group may still expose the wait that existed before terminal.write."(同一个进程组可能还暴露着写入之前就存在的等待状态)。
通俗比喻:之前分不清"它真的在等你说话"和"它只是低头看文件",现在加了一道判断——先离开座位再回来,才算真的在等人。

工程收敛:一把钥匙进所有门
之前 Python SDK、ACP 等应用各有各的启动入口;旧版 APIProxy 传输层与 Remote 网关并存;Headless 运行过程全程黑盒。
现在移除旧版 APIProxy 传输层,统一走 Remote 网关,网络访问启用一次性 Token 鉴权;Python SDK、ACP 启动模式收敛至 dsh profile,并新增 Python Windows x64 产物、补齐 ACP 自动化控制;pi-ai 升级至 0.84.2,模型列表更新提供方并支持 vLLM 思考预算等新参数;DeepSeek 模型适配器默认附带已启用插件包名与版本(可配置关闭),新增可选的会话日志增量上传(默认关闭);Headless 运行期间向 stderr 流式输出推理进度,stdout 仍只输出最终答案。以 headless 为例,packages/bundle/headless/src/index.ts 的 streamReasoning() 监听 assistant/chunk 事件,遇到 reasoning-delta 就向 stderr 写入 dsh: reasoning: 前缀加增量文本——进度与答案彻底分道。
通俗比喻:把所有门统一成一把钥匙(dsh profile),旧钥匙孔(APIProxy)拆掉;流水线进度写在旁边的告示牌上(stderr),不弄脏最终交付单(stdout)。
预设与工具调用的小修小补
之前 profile 配置的预设根目录启动时丢失;无法解析的预设没有提前标记,切换被拒也不解释原因;Minimal 预设里挂着用不上的 /goal 命令;文件编辑工具会拒绝带 null 占位值的字段;PTC 模式下 SDK 绑定可被 run_code 绕过。
现在预设根目录启动丢失修复;无法解析的预设提前标记,切换被拒时给出原因;Minimal 预设不再挂载 /goal 命令;文件编辑工具不再拒绝未使用字段的 null 占位值;PTC Mode 下 SDK 绑定不再被 run_code 直接调用绕过——安全边界收口。
一句总结
这是一次典型的"体验还债 + 能力增值"版本:子代理模型配置给了开发者新的控制维度,终端与多模态的修复拔掉了日常使用中最磨人的几根刺——alpha 阶段能打磨到这个程度,说明项目正加速向稳定期收敛。
JOTO 企业落地观察
- 子代理模型动态配置能力,使企业可在同一智能体架构内混合部署不同成本/能力等级的模型,为 RAG 知识工程中的「查询路由」与「结果精排」环节提供了原生支持,无需额外封装调度层。
- 持久终端对等待状态的精准识别,降低了企业将 CLI 工具链嵌入智能体工作流时的误触发风险,尤其利于 DevOps 场景下自动化脚本执行的稳定性保障。
- 多模态图片 Token 显式计费与轨迹回显,为企业构建可审计的 AI 应用提供了关键基础——图像上下文不再“不可见”,便于后续做合规性检查与用量归因。
- Remote 网关统一与一次性 Token 鉴权机制,简化了企业私有化部署时的安全策略收敛路径,避免因多传输层并存导致的权限配置碎片化问题。
立即咨询 JOTO
JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询
想把这些做法用到你的业务里?
留下你的场景和痛点,我们帮你判断从哪一步开始。
联系我们


