T-RAG技术将 RAG 架构与开源的微调语言模型 (LLM) 和实体树向量数据库相结合的基础之上,用于支持语境检索。
背景介绍
数据隐私
技术亮点
T-RAG
实体树
首先,一个解析器模块会在用户的查询中扫描与组织内部实体名称相对应的关键字。
如果识别出一个或多个匹配项,会从实体树中提取关于每个匹配实体的详细信息。
这些细节被转化为文本语句,提供关于该实体及其在组织层级结构中位置的信息。
随后,这些信息会与从向量数据库中检索到的文档块相结合,以构建最终的语境。
通过这种方法,当用户提出关于特定实体的问题时,模型可以获取有关这些实体及其在组织中的层级位置的结构化知识。
除了获取相关的背景文档,系统还使用 spaCy 库以及自定义规则识别出组织内的命名实体。
如果查询中包含一个或多个这样的实体,那么系统会从实体树中提取出关于该实体层级位置的相关信息,并将其转化为文本语句。
这些语句随后与检索到的文档一起被整合为最终的语境。
值得注意的是,如果用户的查询中没有提及任何实体,那么系统将会跳过树搜索步骤,仅使用从检索文档中获取的语境。
