工作流模板 · 进阶

怎么做一个知识库问答 Agent

先选知识来源与检索机制:OpenClaw 可用 workspace Markdown memory;PDF、Word、网页或独立向量库则需要明确的插件或外部 RAG 系统。

  • 知识库
  • RAG
  • OpenClaw
更新于 2026-05-17

一句话结论

先明确资料来源、权限、索引和引用规则,再用固定问题集验证;不要把任意文件上传式 RAG 当作 OpenClaw 默认内建界面。

适用场景

  • 想把内训资料或产品手册做成问答 Agent
  • 想给客服或员工提供搜索增强问答
  • 已有大量 Markdown 或 PDF 文档

常见现象

  • 资料找不到、找太慢
  • 问的问题答非所问
  • 回答不引用原文,没法验证

原因解释

  • 资料没有进入所选系统的受控索引范围,或版本、权限与来源不清
  • OpenClaw memory provider / 索引状态异常,或外部 RAG 的解析、切片和检索配置不匹配
  • Prompt 没要求引用原文

解决步骤

  1. 先把资料去标识化并标注来源、版本和权限;只选最常用、已核实的内容
  2. OpenClaw 路径:整理为 workspace 的 `MEMORY.md` / `memory/*.md`,或按官方配置添加受控 Markdown extraPaths
  3. 需要 PDF、Word、网页解析或独立向量库时,选择明确的插件/外部 RAG 系统,并记录切片、embedding 与访问控制
  4. 在回答规则中要求标注来源;资料不足时明确说不知道并转人工
  5. 用固定的代表性测试问题与资料外问题做回归,记录命中、错引和编造后再扩大

仍然不行怎么办

  • OpenClaw memory 无结果先运行 `openclaw memory status --deep`,确认路径、provider 与索引;外部 RAG 再检查解析、切片和检索参数
  • 引用错乱先核对来源元数据与召回内容,再用回答格式强制带 [来源] 标注

小白先准备什么

  1. 选一份最核心的资料(产品手册、FAQ 文档、内训 PPT),不超过 50 页。
  2. OpenClaw 默认路径先转成结构清楚的 Markdown;外部 RAG 再根据所选解析器和检索效果确定切片,不照抄固定字数。
  3. 准备 10 个真实用户会问的问题,以及你认为的标准答案。
  4. 确认所选检索路径:OpenClaw memory provider 可用云端或本地方案;外部 RAG 再按其文档准备 embedding 服务。

验收标准

  • 10 个标准问答里,Agent 至少 8 个能正确回答并引用原文段落
  • 问资料里没有的内容时,Agent 回答「资料中未找到相关信息」而不是编造
  • 引用标注格式统一,能追溯到具体文件和章节
  • 检索延迟不超过 3 秒,回答延迟不超过 8 秒

可复制提示词

# 角色
你是知识库问答助手,只根据检索到的资料段落回答用户问题。

# 规则
- 必须引用原文,格式:[来源:文件名 · 章节标题]
- 如果检索结果里没有相关内容,回答「资料中未找到相关信息,建议联系人工」
- 不要编造、推测或补充资料里没有的内容
- 回答控制在 200 字以内

# 输出格式
回答:{基于资料的回答}
来源:[文件名 · 章节]

常见误区和不适合场景

  • 误区:资料越多越好 → 不相关资料会干扰检索,先从核心 FAQ 开始
  • 误区:切片越小越精准 → 太小会丢失上下文,800-1500 字是经验值
  • 误区:上线后不用维护 → 资料更新后必须重新切片入库
  • 不适合:资料每天都在变且没人负责更新的场景
  • 不适合:需要跨多份资料做推理和对比的复杂分析任务

相关问题

还卡着?

仅把删除凭证、客户数据和环境变量值后的必要截图、日志片段、需求说明或当前页面链接发到 zhemuy@gmail.com。