如果一个企业 AI 项目已经做过 RAG,大概率会遇到一个很尴尬的问题。
一开始,效果看起来不错。
员工问制度,能答。
售后团队问知识库,能答。
销售问产品资料,能答。
但只要业务方继续往前推一步,问题就变了。

他不再问“这份资料里写了什么”,而是问:
这时候你会发现,RAG 能帮模型找到资料,但它没有天然告诉模型:
所以这篇文章先把一句话说清楚:
RAG 是 Agent 的资料检索层。Ontology 才是 Agent 的业务世界。
RAG 解决的是:模型应该看到哪些上下文。
Ontology 解决的是:企业里到底有哪些对象、关系、状态、动作、权限和业务逻辑。
如果没有这个业务世界,Agent 再会说话,也只能在文档片段里猜。
一、先别把 Ontology 翻译成“知识图谱”
先把这个词说清楚。
Ontology,中文常见翻译是 本体,也有人译成 本体论。
在哲学里,本体论讨论的是“世界上到底存在什么”。换句话说,它关心的不是某个句子怎么表达,而是一个世界里有哪些东西、这些东西是什么、彼此之间是什么关系。
到了 AI 和知识工程里,这个词变得更工程化。
Tom Gruber 对 ontology 有一个经典定义:它是对某个概念化的显式规格。用工程语言说,就是把一个领域里默认存在的对象、概念、关系和约束,用机器和人都能对齐的方式写清楚。
W3C 的 OWL,也就是 Web Ontology Language,做的也是类似的事:用来表示事物、事物集合,以及它们之间的关系。
所以,放到企业 Agent 里,Ontology 不应该被理解成一个玄学词。
它更像是 Agent 的 业务世界说明书。
这也是为什么最近国内外做 Agent、GraphRAG、Agent Memory、企业知识层的人,都重新开始讨论 ontology。
原因并不复杂:
所以这几年你会看到很多相关方向变热:GraphRAG、Knowledge Graph、Agent Memory、Ontology-driven RAG、AI agent world model。
它们背后都在回答同一个问题:
Agent 不能只读文本,它要有一个可查询、可约束、可更新的业务世界。
这里就回到了本体论最有价值的地方。
本体论听起来像哲学课,但它对架构师真正有用的地方很朴素:
它不是先问“系统怎么实现”,而是先问“这个系统承认哪些东西存在”。
如果一个 Agent 的世界里只有文档,那它最多只能围绕文档说话。
如果一个 Agent 的世界里有客户、设备、合同、订单、工单、库存、审批、状态和动作,它才有机会进入业务流程。
哲学问题到了工程现场,会变成下面这张表:
所以不要把本体论理解成“讲概念”。
放到企业 Agent 里,它关心的是一件非常现实的事:
业务世界怎样被机器看见、被模型理解、被系统约束、被人类回放。
这也是为什么国内外这条线都在升温,只是叫法不同。
国内很多时候不会直接说 Ontology,而是说 知识增强、知识图谱、企业知识库、Agent 平台、数据智能。
百度是这条路线里很典型的例子。
早在 ERNIE 3.0 的论文里,百度就把方向写成 Large-scale Knowledge Enhanced Pre-training。论文里明确说,传统大模型主要从 plain text 训练,没有显式引入 linguistic knowledge 和 world knowledge;ERNIE 3.0 则在 plain text 之外,引入 large-scale knowledge graph 做预训练。
这不是 Palantir 意义上的企业 Ontology。
但它说明百度长期在押一个判断:模型不能只吃文本,知识结构也要进入 AI 系统。
到现在的百度千帆,它的官方文档已经把平台定位成“以 Agent 为核心”的企业级服务,围绕 Agent 引擎、工具及 MCP、模型服务、企业级服务来做应用落地;Agent 引擎里也出现了自主规划、工作流、多智能体协同这些模式。再看 EICopilot 这类研究,已经把 LLM-driven agents 和大规模企业知识图谱放在一起,用自然语言查询、生成 Gremlin、探索企业关系。
这条国内路线,大致是这样走的:
国外更典型的代表是 Palantir。
Palantir 的说法更直接:它把 Ontology 放在 Foundry 和 AIP 的核心位置,不只把它当成知识图谱,而是当成企业的 operational layer。
AIP 的官方文档也很明确:AIP Logic、AIP Chatbot Studio、AIP Evals 这些工具,是在 Ontology 和开发工具链之上构建 production-ready 的 AI workflows、agents 和 functions。AIP 架构文档里还把 Ontology 描述成把 data、logic、action、security 统一到企业决策表示里的系统,并且强调它要建模 operational processes 里的 nouns 和 verbs。
这个区别很关键。
这三条线不完全相同。
不能把百度的知识增强,直接等同于 Palantir 的 Ontology。
也不能把开源 GraphRAG,直接等同于企业操作层。
但它们指向同一个趋势:
企业 Agent 的竞争,不会只停在模型层,而会进入业务世界层。
很多人一听 Ontology,会马上想到知识图谱。
这个理解不算错,但放到企业 Agent 里,太窄。
如果只是把文档里的实体和关系抽出来,画成一张图,那更接近 Knowledge Graph 或 GraphRAG。它对检索有帮助,但还没有进入企业 Agent 的核心。
企业 Agent 需要的 Ontology,至少不是一张“概念关系图”。
它更像一套业务操作模型。
Palantir 的官方文档里,对 Ontology 的描述很直接。
它不是把 Ontology 说成“知识图谱”,而是说它是组织的 operational layer。它把企业已经接入的平台数据、虚拟表、模型等数字资产,连接到现实世界里的对象,比如工厂、设备、产品、客户订单、金融交易。
更关键的是,Palantir 把 Ontology 拆成两类元素:
这组词很重要。
语义层只是 nouns,也就是名词:客户、订单、设备、合同、工单、库存。
但企业 Agent 真正进入生产,必须看到 verbs,也就是动词:创建工单、升级优先级、调整交期、冻结合同、提交审批、触发补货。
只有名词,没有动词,Agent 只能解释业务。
名词和动词都在受控模型里,Agent 才可能参与业务。
二、RAG 为什么撑不起企业级 Agent
RAG 很有价值。
这点不要误解。
没有 RAG,企业 AI 很难接触私有知识、产品文档、制度、历史案例、交付资料和行业语料。RAG 是很多企业 AI 的第一块地基。
但 RAG 的核心动作仍然是检索。
它通常回答的是:
这对知识问答足够。
但企业 Agent 的问题不是“能不能找到资料”。
它的问题是:
这就是很多企业 RAG 项目从 Demo 到生产时变形的原因。
Demo 阶段,用户问一句,模型答一句。只要回答像样,就觉得可以上线。
生产阶段,用户会要求它接系统、读状态、做判断、推流程、留记录。
这时,RAG 不会消失,但它会变成一个局部能力。
它负责知识和证据。
Ontology 负责业务世界。
Harness 负责运行控制。
Evals 和 Observability 负责验收和改进。
把这些东西都塞给 RAG,是架构上偷懒。
三、一个 Agent 如果没有对象层,会发生什么
沿用上一篇的机械制造售后场景。
客户可能说:
我们希望售后工单处理更智能一点,最好能根据设备状态和历史维修记录,自动给出处理建议。
如果只按 RAG 做,团队很容易做成这样:
这当然有用。
但它还不是企业 Agent。
因为真正的售后问题不是一段故障描述,而是一组业务对象正在变化。
RAG 可以告诉模型“这类故障一般怎么处理”。
Ontology 要告诉 Agent:
这就是 RAG 和 Ontology 的区别。
RAG 帮 Agent 读资料。
Ontology 让 Agent 认对象。
RAG 给上下文。
Ontology 给业务结构。
RAG 让回答更有依据。
Ontology 让动作有边界。
四、Ontology 不是把所有数据做成一张大图
这里也要避免另一个误区。
不是一说 Ontology,就要把全公司数据建成一张宏大的知识图谱。
那会把项目拖死。
企业 Agent 的 Ontology,应该从一个具体业务流开始。
比如售后工单,不需要一开始建完整企业模型。可以先建一条窄链路:
这已经足够支撑一个有限但可运行的 Agent。
架构师真正要问的不是“我们有没有企业级大 Ontology”。
而是:
如果这些问题没回答,所谓 Agent 其实只是在知识库外面包了一层对话。
它可以回答。
但它不能可靠地做事。
五、GraphRAG 是进步,但它不等于企业 Ontology
现在开源生态里,GraphRAG 很热。
这不是偶然。
因为大家已经发现,只靠向量相似度,很难处理复杂关系。
Microsoft 的 GraphRAG 项目,把自己描述成一套从非结构化文本中抽取有意义结构化数据的 pipeline 和 transformation suite,用 knowledge graph memory structures 增强 LLM 输出。它的 README 也提醒,GraphRAG indexing 可能很贵,要从小开始,还需要 prompt tuning。
Neo4j 的 GraphRAG Python 包,则把图检索、向量检索、图遍历、Text2Cypher 等能力放到 RAG 应用里。
LangChain 和 Neo4j 的文章也说得很清楚:图擅长表达异构、互联的信息;向量数据库擅长处理非结构化文本。更好的做法不是二选一,而是把结构化图数据和向量检索结合起来。
这些趋势说明了一件事:
RAG 正在从“找相似文本”走向“找结构化上下文”。
但 GraphRAG 仍然不是企业 Ontology。
二者的区别可以这样看:
GraphRAG 可以成为 Ontology 的一部分,或者成为 Ontology 之外的检索增强层。
但不要把它们混成一个词。
GraphRAG 让 Agent 更会找关系。
Ontology 让 Agent 处在一个可治理的业务世界里。

六、Agent 需要的不是更多 chunk,而是五类业务结构
企业 Agent 的上下文,不能只有文档片段。
至少要有五类结构。
把这五类结构写出来,Agent 的架构才会清楚。
否则你会在实现阶段不断临时补洞。
这些补丁短期能跑,长期会变成维护灾难。
因为业务结构没有被工程化,只是被 prompt、代码分支和人工兜底散落在系统里。
Ontology 的价值,是把这些结构显式化。
让 Agent 不靠猜。
让工程师不靠补丁。
让业务方知道系统到底按什么世界模型运行。

七、时间和来源,也是 Ontology 的一部分
还有一个问题,在企业里很容易被低估。
对象关系不是永远不变的。
客户等级会变。
合同条款会变。
设备状态会变。
经销商服务能力会变。
库存会变。
组织权限会变。
如果 Agent 只拿到一段旧文档,它很难判断“现在是否仍然成立”。
这也是为什么一些开源 Agent memory 项目开始往 temporal graph 方向走。
Graphiti 的 README 里把自己描述成给 AI agents 用的 temporal context graph engine。它强调 facts change over time,保留 provenance,支持 prescribed and learned ontology,还能把用户交互、结构化和非结构化企业数据、外部信息持续整合进一个可查询的 graph。
这对企业 Agent 很关键。
因为 Agent 不是做一次性问答。
Agent 会在持续变化的业务环境里运行。
所以企业 Ontology 不只是“对象表”。
它还要回答:
没有这些,Agent 就会用过期世界做当前决策。
这比回答错一段知识更危险。
八、Ontology 应该怎么从 SDD 里长出来
上一篇讲 SDD。
SDD 不是文档装饰,而是 Agent 的可执行规格。
那 Ontology 怎么接 SDD?
很简单:从 SDD 里抽对象。
比如 SDD 里有一句:
售后主管在工单后台查看高风险设备故障。Agent 读取设备遥测、历史维修、服务合同、备件库存和经销商服务能力,判断是否建议升级工单、请求备件或派发现场服务。高价值客户和合同例外必须人工确认,所有建议、采纳和修改写入审计记录。
这句话不是直接丢给模型。
它应该拆成下面这些东西:
这就是 SDD 到 Ontology 的转译。
SDD 负责把业务需求写到可执行。
Ontology 负责把可执行规格变成 Agent 可以读取、判断和调用的对象世界。
如果这一步跳过,后面所有框架都会变得很尴尬。
所以,Ontology 不应该等平台建设后期再补。
它应该从第一份 SDD 里长出来。
九、架构师可以用这张表判断:只做 RAG 够不够
不是所有企业 AI 场景都需要完整 Ontology。
如果只是制度问答、文档检索、材料总结,RAG 可能已经足够。
真正的问题是,不要把 RAG 场景包装成 Agent 项目。
可以用下面这张表判断。
如果右侧特征占多数,就不要再纠结“RAG 怎么调得更准”。
先把对象层建起来。
否则你会在错误的层上反复优化。
十、企业第一个 Ontology 不要大,从一个 Agent 场景开始
这篇不是建议企业先搞一个宏大的 Ontology 项目。
相反,第一版应该很小。
从一个 Agent 场景开始,按下面顺序做。
这不是多写文档。
这是在给 Agent 建运行环境。

如果团队已经有数据仓库、主数据、权限系统、流程引擎和业务系统,也不用全部推翻。
Ontology 可以先是一个薄层:
你不一定要一次建成一个大平台。
但必须先有对象层意识。
没有对象层,Agent 架构会一直退回聊天框。
十一、这篇的结论
RAG 是必要的。
但 RAG 不是企业 Agent 的架构终点。
如果一个 Agent 只是回答文档问题,它可以停在 RAG。
如果一个 Agent 要进入业务流程,它必须理解业务对象。
如果一个 Agent 要触发动作,它必须受到状态、权限、策略和审计约束。
所以,企业 AI 的下一层不是“更大的知识库”,而是更清楚的业务世界。
换成架构语言:
把 RAG 当全部,企业 AI 会停在知识助手。
把 Ontology 建起来,Agent 才开始拥有业务世界。

