DeepSeek harness的野心是 “Agent 操作系统(Agentic OS)”
文章对比Pi Agent与DeepSeek Harness(DSH)两条AI Agent技术路线:前者以极简主义实现99.93%前缀缓存命中率和单次任务仅$0.028的成本;后者提出Cordis元框架,通过可逆效应与响应式共效应实现物理副作用的数学可逆性。二者分别代表状态等价与算子等价范式,构成互补而非替代关系。
极致轻与极致重的双轨并行
2026年的AI Agent领域,出现了一个奇特的现象:
一头是极致的轻。Pi Agent的创作者Mario Zechner只给了用户4个基础工具——读文件、写文件、编辑文件、执行终端命令。没有复杂的Planning机制,没有多子Agent编排,甚至连系统提示词都短得可怜。但就是这么一个"简陋"的框架,在接入DeepSeek模型时,前缀缓存命中率飙到了99.93%,单次成功任务的平均成本低至$0.028。
另一头是极致的重。DeepSeek Harness(DSH)团队发表了一篇88页的论文《A Programming Paradigm for Spatiotemporal Composability》,提出了Cordis元框架。他们宣称"插件即一切"(Everything is a Plugin),将模型推理、工具调用、沙箱权限、内存持久化甚至Subagent编排全部打散为可追踪、可回滚、响应式的动态组件。
一个在做减法,一个在做乘法。但诡异的是,Mario Zechner本人对DSH的评价并非敌意,而是"生态上的良性互补"。
DeepSeek 开源的不仅仅是一个 Coding Agent,他们实际上是在尝试制定下一代 “Agent 操作系统(Agentic OS)” 的底层标准。在这个新世界里,模型不再是被禁锢在 API 里的文本生成器,而是一个能在严格数学法则保障下、在安全的虚拟空间里自由探索、自由修改代码、自由自我进化且随时能干净撤销的独立主体。


























Pi Agent:极简主义的"会话树哲学"
一、Pi Agent:极简主义的"会话树哲学"
1. "减法设计"的信仰
Mario Zechner是一个极度崇尚极简主义(Minimalism)的开发者。他公开批评很多现代Agent框架(如Claude Code)"过于繁重、缺乏透明度且过度封装"。
在Mario看来,Agent框架不应该是一个黑盒操作系统,而应该是一张透明的纸。Pi Agent默认只保留四项基础工具,将控制权与拓展权限完全交给用户。它不绑定任何单一模型,甚至不强行预设复杂的规划逻辑——LLM本身就是最好的规划器,何必再套一层?
2. 状态等价:Git Commit式的心智模型
Pi Agent的核心数据结构是一棵JSONL会话树(Conversation Tree)。
用户的每一次交互、Agent的每一个推理步骤,都被记录为树上的一个节点。当用户发现任务走偏时,不需要"撤销"任何物理操作,只需要像浏览Git历史一样,执行`/tree`查看分支,然后`/goto `跳转到任意历史节点。
这种设计的本质是什么?是状态等价(State-based Equivalence)。
Pi Agent认为:世界全都可以归结为"文本与消息(Messages)"。只要维持好纯粹的Prompt节点树,物理环境的变化可以交给外部工具(如Git)去处理。框架本身不承担"逆转物理副作用"的责任,它只负责让LLM的上下文永远干净、可回溯、可重来。
3. 极致性价比的密码
正是因为这种极简,Pi Agent在配合DeepSeek模型时展现出了惊人的经济性:
- 99.93%的前缀缓存命中率:没有冗余的框架代码和黑盒包装,上下文拼接极其纯粹,系统提示词和工具声明的顺序高度稳定。
- 单次任务0.028:仅为Claude Code等重型框架成本的几分之一。
Mario的观点得到了验证:"框架越简单透明,模型的发挥空间越大,Token浪费就越少。"
DeepSeek Harness:严密工程的"时空代数哲学"
如果说Pi Agent是在"文本的纯净世界"里做文章,那么DeepSeek Harness(DSH)则直面了一个血淋淋的现实:
LLM的消息机制是幂等的,但物理世界不是。
当你在Pi里Truncate掉最后3个Turn重新推理时,Prompt层面确实无损。但如果Agent在第2步执行了`rm -rf /tmp/data`,你把它回退到第1步重新决策,文件已经没了。这就是"消息回放"与"物理副作用"之间的断层。
DSH的Cordis框架,本质上是要给这个断层架起一座数学桥梁。
1. 可逆效应(Revertible Effects):给Agent装上"Ctrl+Z"
Cordis论文提出了一个核心机制:任何组件(插件)在修改环境时,必须同时向系统的Accumulator(累加器)提交一个显式逆函数。
打个比方:
你正在结算一个100元的订单,三个插件依次执行:税率插件(+10元→110元)、限时立减插件(-20元→90元)、积分赠送插件(基于90元送90积分)。
传统系统里,如果"限时立减插件"被热卸载,要么数据状态残留(不知道90元里哪些属于立减),要么必须重启整个计算流。
Cordis的做法是:立减插件在把数据从110改为90的同时,向累加器提交了一个逆操作(加回20元)。卸载时,系统自动执行逆操作,总价复原为110元,并通知积分插件更新为110积分。整个过程数据流不中断,上下文全保留。
这就是时间可组合性(Temporal Composability)——"我走后,我产生的所有副作用都能被干净地抹去,就像我从未存在过一样。"
2. 响应式共效应(Reactive Coeffects):依赖的自动开关网络
Cordis还引入了空间可组合性(Spatial Composability)。
系统里的每个插件都要显式声明自己依赖什么(Demand)和提供什么(Provision)。当共享上下文发生变化时,系统会自动判定依赖是激活、失活还是中性,并驱动组件的生命周期。
风控模块C依赖"地理位置"和"天气数据"。一开始只有地理位置,C保持静止(Inactive),绝不盲目读取导致报错。天气数据加载后,C自动激活入流。如果地理位置被卸载,系统会先通知C优雅停止,再安全移除数据,保证依赖网不会中途断裂。
3. 统一上下文Γ^∞:递归的自我相似结构
DeepSeek将整个Harness的底层架构归纳为一个递归上下文类型Γ^∞:
- Γ:当前的系统/模型运行状态
- Γ→Γ:累加器,保存所有已执行效应的反操作
- Σ:共效应上下文,记录全局所有组件注册的依赖项与服务
在这个框架下,没有硬编码的系统核心。模型推理、工具调用、沙箱权限、内存持久化,全部是被抽象为统一接口的组件:
C_Γ := D_Γ × P_Γ × E_Γ*(需求 × 供给 × 带逆函数的效应执行体)
这就是"插件即一切"的数学本质——不是简单的插件注册表,而是一套基于代数效应与共效应理论构建的运行时可逆元框架。
状态等价 vs 算子等价的对偶分野
把两套理论推演到用户真实操作级别,差异就像"版本控制工具中的Git Commit"与"重构工具中的Ctrl+Z / 热重载"。
| 维度 | Pi Agent(状态等价) | DeepSeek Harness(算子等价) |
|---|---|---|
| 心智模型 | 浏览器历史记录 / Git节点 | 乐高积木 / OS内核热插拔 |
| 回退机制 | 节点跳转(/goto),物理环境需手动重置 | LIFO逆序撤销,自动回滚文件/端口/变量 |
| 分支探索 | 树形剪枝,上下文相互隔离,极省Token | 依赖图隔离(isolate),同一进程内切换沙箱 |
| 插件更新 | 追加式进化(/reload),老代码留在历史里 | 事务性热替换(HMR),零停机无缝重构 |
| 多Agent协同 | 轻量自由,物理冲突依赖外部Git解决 | Relied保护锁+并发收敛定理,防死锁 |
| 最适合场景 | 个人开发者快速写代码、探索性Spike | 高度自治、24/7长程自演进Agent |
场景一:任务走偏后的"回退"
- Pi:用户敲`/goto `,leafId指针移动到旧节点。磁盘代码没变,需要手动`git checkout .`重置,或者让Agent在新分支重新覆盖写入。"时间线旅行",安全但不自动处理物理环境。
- DSH:用户点击"撤销",系统自动倒序执行逆操作链——删除临时文件→关闭8080端口→回滚数据库字段。"真正的物理Ctrl+Z"。
场景二:Agent自我进化
- Pi:用户对Agent说"你自己写个解析工具并挂载它"。Agent写入新文件后执行`/reload`,新工具定义拼接到System Prompt树的最新节点。追加式进化。
- DSH:Agent在后台自我修改核心插件代码,触发Transactional Reload。旧插件逆函数激活解绑,新插件毫秒级接管。如果报错,自动Rollback到上一版。"给飞行的飞机更换发动机"。
DSH的野心:这不是Agent,这是"Agentic OS"
理解了上述差异,就能明白为什么有人说:"DSH不是在写一个Agent应用,而是在为Agent搭建一座具备物理法则的新世界。"
1. 从"沙盒里的搬砖工"到"具备物理法则的虚拟宇宙"
传统Agent只是在应用程序的狭缝里打工——框架硬编码了哪些API能用,搞砸了只能try-catch或重启。
DSH塑造了一个有时间箭头与空间守恒的物理法则:
- 时间法则(可逆):Agent的任何动作都带着严格的代数逆函数。系统允许它去探索、去破坏,因为这个世界支持无限次无损的Ctrl+Z。
- 空间法则(共效应):Agent能触碰的边界被严格定义。缺什么能力,世界就响应式挂载;依赖掉线了,关联系统自动退场,永不死锁。
2. 从"单机脚本"到"自演进操作系统"
在DSH的世界里,Agent可以修改自己——这在传统框架里几乎是不可能的(自己改自己的运行代码会导致进程崩溃)。
但因为一切皆插件,Agent Loop本身也只是一枚积木。Agent可以一边执行任务,一边在线编写新工具插件,甚至重构自己的内部调度逻辑。DSH利用热重载与事务性降级,把旧模块擦除、新模块挂载上去,正在进行的对话上下文和任务状态全盘保留。
这使得Agent具备了生物学意义上的"新陈代谢"能力。
Mario Zechner的清醒:互补而非替代
面对DSH这套"重装甲",Mario的态度异常清醒。
他没有将DSH视为威胁,而是看作"生态上的良性补充":
"DeepSeek Harness提供了官方标准和全套微服务抽象,而Pi是一个轻量、透明、完全由开发者掌控的底层Harness替代品。两者不是零和博弈,而是分别代表了'官方原生扩展栈'与'极致轻量定制栈'。"
他甚至主动将DeepSeek模型作为Pi的顶级支持模型之一,因为在Pi这套极简Harness上运行DeepSeek,"效果和成本控制达到了极致"。
这揭示了一个更深层的事实:
Pi和DSH不是同一赛道的竞争对手,而是解决不同层面问题的两种最优解。
- Pi Agent回答的是:"怎么让上下文(Prompt)回退时不污染模型记忆?"
- DeepSeek Harness回答的是:"怎么让物理世界(环境/副作用)随着模型决策安全翻滚?"
两条路线,一个未来
Pi Agent与DeepSeek Harness的对决,是AI Agent发展史上最精彩的两条演进路线:
极简主义的"会话树哲学"认为:以LLM为绝对中心,世界全都可以归结为文本与消息。只要维持好纯粹的Prompt JSONL节点树,就能做到99.9%的前缀缓存与极低成本。它是最优雅的极简派。
严密工程的"时空代数哲学"认为:以现实系统与物理副作用为中心,承认真实世界是非幂等的、充满破坏性的。通过数学推导,在操作系统与Agent之间搭一层"代数防护罩",把非幂等的物理副作用强行包装成可逆的工程算子。它是最硬核的系统派。
未来的Agent生态,大概率不会是"谁吃掉谁",而是分层共存:
- 个人开发者、快速原型、探索性Coding,会用Pi这类轻量框架;
- 企业级部署、24/7长程自治、需要自演进能力的复杂系统,会基于DSH构建;
- 而像"DSH里嵌套Pi"或"Pi里调用DSH插件"的混搭架构,也将成为常态。
毕竟,Mario Zechner已经用行动证明了一件事:好的框架,从不需要垄断整个世界。它只需要在属于自己的那片土壤里,长到最极致。

JOTO 企业落地观察
- 企业若选择基于DSH构建长程自治系统,需重点评估其RAG知识工程与动态插件管理的耦合深度——知识更新是否触发插件热重载,插件变更又如何影响检索上下文一致性,这直接决定知识闭环的可靠性。
- 对于FDE驻场共创项目,Pi Agent的极简Prompt树结构天然适配快速迭代场景,但其物理环境重置依赖外部Git,意味着企业需提前规划CI/CD与沙箱环境的标准化对接方案,否则将放大运维摩擦。
- DSH的可逆效应机制虽强化了AI安全治理能力,但其逆函数需由插件开发者显式声明,这对企业内部工具开发团队提出了新的契约规范要求——安全不是事后审计,而是从插件设计阶段就必须内建的工程属性。
- 两类框架对智能体工程的启示在于:轻量框架的价值不在“能否跑通”,而在“能否被业务人员理解并参与调试”;重型框架的价值不在“功能多寡”,而在“能否让复杂系统在无人值守下持续收敛”。企业选型应匹配自身智能体成熟度曲线,而非技术先进性。
立即咨询 JOTO
JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询
想把这些做法用到你的业务里?
留下你的场景和痛点,我们帮你判断从哪一步开始。
联系我们


