WeKnora 详解系列 · 第二章
各位数码圈的老铁们,叨叨数码又来了。
上一篇咱们把 WeKnora 是什么、怎么 5 分钟跑起来,扒了个底朝天。今天这篇才是真正的"重头戏":
怎么把公司那一堆乱七八糟的文档接进来?三种对话模式到底该用哪个?
这俩问题搞不明白,WeKnora 装上也是个花瓶。我尽量用"装机器"的姿势给你讲明白,看完你就能根据自己的场景对号入座。
一、先说文档:WeKnora 都能"啃"哪些格式?
先解决最基础的问题:你手里的文档,WeKnora 吃不吃得动?
答案是:基本上市面常见格式,它都吃。
总数 10+ 种,基本涵盖了企业内部 95% 的文档类型。
叨叨数码先泼盆冷水:支持归支持,效果天差地别。我们后面会聊到 v0.6.2 的"流程配置"黑科技,能让你针对不同文档调不同的"解析配方"。
二、知识库三种"机型":FAQ / 文档 / Wiki 怎么选?
光有文档不够,你得先搞清楚 WeKnora 把文档"装"到哪里——这就要说到三种知识库类型了。
叨叨数码用数码圈老规矩,给你类比成"三款机型":
机型 1:FAQ 知识库(轻便型,适合高频问题)
定位:标准 Q&A 对,类似"客服话术库"。
特点:
一问一答,答案固定 适合客服、售前、FAQ 文档 检索速度快,成本低
数码类比:相当于客服手里的"标准话术表"——客户问"保修期多久",直接对照回答,不绕弯子。
机型 2:文档知识库(主力机型,覆盖 80% 场景)
定位:把成型的文档(产品手册、规章制度、技术文档)丢进去,AI 帮你查、帮你答。
特点:
支持各种格式(PDF/Word/Excel/PPT...) 自动分块、向量化、检索 答案会带"引用源"——告诉你是从哪份文档第几页找到的
数码类比:相当于"随身带了一整个图书馆"——不管你问什么冷门问题,它都能从书里给你翻出来。
这是最常用的一类,企业内部知识库基本都用这个。
机型 3:Wiki 知识库(旗舰款,自动整理+知识图谱)
定位:v0.5 才 GA 的"旗舰机型"。Agent 自动把一堆零散文档整理成结构化、带交叉引用、带知识图谱的 Wiki。
特点:
Agent 自动生成目录、概念、链接 自带知识图谱可视化 新文档进来,自动更新 Wiki(不用人工维护) v0.5.2 扩到了 4 万文档规模
数码类比:相当于你有一台"自动整理文件的 NAS"——文件扔进去,它自动分类、命名、建索引、画关系图。
这是 WeKnora 真正的杀手锏,别的开源 RAG 框架基本没有。
三种机型怎么选?叨叨数码给你一张"选机指南":
当然,三种可以混着建。叨叨数码自己的用法是:FAQ 放常见问题、文档知识库放产品手册、Wiki 放"项目复盘资料库"。各司其职,不打架。
三、流程配置:v0.6.2 的"解析配方"黑科技
这一节是叨叨数码觉得最值得吹的功能——Per-Upload Process Config,v0.6.2 刚上的。
说人话:每次上传文档时,你可以单独配置"怎么解析它"。
这玩意儿解决了一个长期痛点——不同文档得用不同解析方式,但之前的 RAG 框架一刀切:
扫描版 PDF(图片)需要 OCR,但纯文字 PDF 不需要 长技术文档需要细粒度分块,短 FAQ 直接整段就行 研究资料需要抽取知识图谱,普通产品手册不需要
WeKnora 让你针对每一次上传,按下面 6 个维度独立配置:
| Parser(解析器) | ||
| Chunking(分块) | ||
| VLM(视觉语言) | ||
| ASR(语音识别) | ||
| Graph Extraction(图谱抽取) | ||
| Question Generation(问题生成) |
两种使用姿势:
- UI 党:上传时会弹个"确认对话框",勾勾选选就行
- 程序员:直接调
process_config API,批量上传时用脚本控制
更狠的是:解析错了可以重解析,用新配置再跑一遍——不用删了重传。
叨叨数码数码类比:这相当于相机的"场景模式"——拍人用肖像模式、拍夜景用夜景模式、拍美食用微距模式。一个机器搞定所有场景,不用换镜头。
四、数据源同步:飞书 / Notion / 语雀一键打通
很多公司文档不在本地,在云端协作文档里。WeKnora 直接做了连接器:
两种同步模式:
- 增量同步:只拉新文档/修改过的文档,省时省力
- 全量同步:一次性把所有历史文档拉过来
凭证安全也不马虎:AES-256-GCM 加密存储,你授权一次,WeKnora 自己刷 token 续期,不用你管。
叨叨数码类比:这相当于你的"云盘同步客户端"——登录一次,文件自动同步,本地访问速度还贼快。
官方说"more data sources coming soon",估计 Confluence、Slack、Google Docs 都在路上。
五、重头戏:三种对话模式怎么选?
叨叨数码直接说结论:这三种不是替代关系,是互补关系。不同问题用不同模式,效果差出十条街。
模式 1:RAG 快速问答(基础款,80% 场景用这个)
工作原理:你问问题 → 系统从知识库检索相关内容 → 丢给 LLM 生成答案。
优点:
速度快(秒级响应) 成本低(一次 LLM 调用) 答案带引用,可溯源
适合场景:
客服答疑:"保修期多久?""怎么退货?" 产品查询:"X 系列和 Y 系列的差别?" 制度查询:"年假怎么请?几天?"
数码类比:相当于"快捷指令"——一句话办一件事,不绕弯子。
模式 2:ReAct Agent(进阶款,复杂任务用这个)
工作原理:Agent 自主思考"下一步该干嘛",能调用 MCP 工具、能上网搜、能多次检索,直到问题解决。
核心能力:
🔧 工具调用:MCP 工具、网络搜索、SQL 查询 🔁 多步推理:拆解复杂任务,逐步执行 ⏱️ 可配置超时:每个 Agent 可设独立 LLM 超时,防卡死 🛡️ 人工审批:v0.5.2 引入 MCP human-in-the-loop,敏感操作需要人确认 🤔 思考模式:每个模型可配 thinking-mode
适合场景:
多步操作:"对比 Q3 和 Q4 销售数据,写份摘要" 跨知识库任务:"综合产品和财务两个库做个分析" 需要外部数据:"查一下行业最新动态 + 我们公司资料,给个建议"
数码类比:相当于"智能家居中枢"——一句话,它能联动扫地机器人、开空调、关窗帘,全自动编排。

▲ Agent 模式下的工具调用流程可视化(来源:官方 docs/images/agent-qa.png)
模式 3:Wiki 模式(旗舰款,知识管理用这个)
工作原理:Agent 把零散文档主动整理成结构化、互相链接的 Markdown Wiki + 知识图谱。
核心能力:
📚 自动生成目录、概念、链接 🕸️ 知识图谱可视化 🔄 新文档进来,自动更新 Wiki 📏 v0.5.2 扩到 4 万文档规模
适合场景:
项目复盘:把零散会议纪要整理成项目档案 行业研究:把几百篇报告整理成知识体系 产品规划:把用户反馈、需求文档、PRD 整理成"产品知识库"
数码类比:相当于"AI 整理收纳师"——你往家里扔一堆杂物,它自动分类、贴标签、建索引,下次找东西秒级定位。

▲ Wiki 模式自动生成的 Markdown 知识库(来源:官方 docs/images/wiki-browser.png)

▲ 自动生成的知识图谱(来源:官方 docs/images/wiki-graph.png)
叨叨数码的"选模式"秘籍
问自己三个问题:
- 问题答案在文档里能找到吗?
→ 能 → RAG - 问题需要拆解、需要查外部数据/工具?
→ 是 → ReAct Agent - 你想要的是"整理后的知识体系"?
→ 是 → Wiki 模式
这是叨叨数码用了几个版本总结出来的"三步决策法",基本能覆盖 95% 的场景。
六、对话设置:把这台"机器"调到最舒服
模式选好了还不够——你得会调设置。WeKnora 给了三个核心"调机旋钮":

▲ 对话设置界面:检索阈值、Prompt、模型参数都能调(来源:官方 docs/images/settings.png)
旋钮 1:在线编辑 Prompt
觉得 AI 回答得不对?想让它换个语气、加点要求?直接在线改 Prompt,不用重启服务。
叨叨数码类比:相当于你给手机语音助手"调教"——加几条规则,它下次就更懂你。
旋钮 2:检索阈值调优
这是个关键参数,直接决定答案质量:
- 阈值调高:检索更严格,只返回高相关内容 → 答案精确,但可能漏掉一些
- 阈值调低:检索更宽松,啥都返回 → 答案丰富,但可能跑偏
叨叨数码建议:先用默认值跑一遍,再根据实际问题微调。如果答案经常"答非所问"就调高,如果经常"找不到"就调低。
旋钮 3:多轮上下文感知
这个功能让 AI 记得你之前说过什么。比如:
你:X 系列和 Y 系列差别是啥?
AI:(列出 5 点)
你:Y 系列的电池呢?
AI:Y 系列电池是 5000mAh,续航比 X 系列多 2 小时。
看到了吗?第二个问题没提"Y 系列",AI 也知道你说的是哪个。这就是多轮上下文的威力。
叨叨数码类比:这相当于你和 Siri 聊天时,它不会每句话都失忆,而是记得你们聊过啥。
彩蛋:建议问题(Suggested Questions)
最后提一个贴心功能:建议问题。
系统会根据你刚上传的文档,自动生成 3-5 个推荐问题,展示在对话框上方。
这对 C 端用户特别有用——很多人不知道该问什么,有了建议问题,提问门槛直接砍半。
叨叨数码类比:相当于你打开外卖 App,它先推荐"附近热门",你不用从零开始选。
小结:这一期我们聊了啥
来,简单回顾一下:
- 文档格式
10+ 种,PDF/Word/PPT/Excel/图片/音频/CSV/Markdown 全支持 - 知识库三机型
FAQ(轻便型)/ 文档(主力)/ Wiki(旗舰) - 流程配置
v0.6.2 黑科技,6 个维度独立配置解析方式 - 数据源同步
飞书 / Notion / 语雀,增量 + 全量两种模式 - 对话三模式
RAG(基础)/ ReAct Agent(进阶)/ Wiki(旗舰),互补关系 - 三个旋钮
Prompt 在线编辑 / 检索阈值 / 多轮上下文
是不是感觉脑子里有了 WeKnora 的"使用说明书"了?
