一句话结论
先明确资料来源、权限、索引和引用规则,再用固定问题集验证;不要把任意文件上传式 RAG 当作 OpenClaw 默认内建界面。
适用场景
- 想把内训资料或产品手册做成问答 Agent
- 想给客服或员工提供搜索增强问答
- 已有大量 Markdown 或 PDF 文档
常见现象
- 资料找不到、找太慢
- 问的问题答非所问
- 回答不引用原文,没法验证
原因解释
- 资料没有进入所选系统的受控索引范围,或版本、权限与来源不清
- OpenClaw memory provider / 索引状态异常,或外部 RAG 的解析、切片和检索配置不匹配
- Prompt 没要求引用原文
解决步骤
- 先把资料去标识化并标注来源、版本和权限;只选最常用、已核实的内容
- OpenClaw 路径:整理为 workspace 的 `MEMORY.md` / `memory/*.md`,或按官方配置添加受控 Markdown extraPaths
- 需要 PDF、Word、网页解析或独立向量库时,选择明确的插件/外部 RAG 系统,并记录切片、embedding 与访问控制
- 在回答规则中要求标注来源;资料不足时明确说不知道并转人工
- 用固定的代表性测试问题与资料外问题做回归,记录命中、错引和编造后再扩大
仍然不行怎么办
- OpenClaw memory 无结果先运行 `openclaw memory status --deep`,确认路径、provider 与索引;外部 RAG 再检查解析、切片和检索参数
- 引用错乱先核对来源元数据与召回内容,再用回答格式强制带 [来源] 标注
小白先准备什么
- 选一份最核心的资料(产品手册、FAQ 文档、内训 PPT),不超过 50 页。
- OpenClaw 默认路径先转成结构清楚的 Markdown;外部 RAG 再根据所选解析器和检索效果确定切片,不照抄固定字数。
- 准备 10 个真实用户会问的问题,以及你认为的标准答案。
- 确认所选检索路径:OpenClaw memory provider 可用云端或本地方案;外部 RAG 再按其文档准备 embedding 服务。
验收标准
- 10 个标准问答里,Agent 至少 8 个能正确回答并引用原文段落
- 问资料里没有的内容时,Agent 回答「资料中未找到相关信息」而不是编造
- 引用标注格式统一,能追溯到具体文件和章节
- 检索延迟不超过 3 秒,回答延迟不超过 8 秒
可复制提示词
# 角色
你是知识库问答助手,只根据检索到的资料段落回答用户问题。
# 规则
- 必须引用原文,格式:[来源:文件名 · 章节标题]
- 如果检索结果里没有相关内容,回答「资料中未找到相关信息,建议联系人工」
- 不要编造、推测或补充资料里没有的内容
- 回答控制在 200 字以内
# 输出格式
回答:{基于资料的回答}
来源:[文件名 · 章节]
常见误区和不适合场景
- 误区:资料越多越好 → 不相关资料会干扰检索,先从核心 FAQ 开始
- 误区:切片越小越精准 → 太小会丢失上下文,800-1500 字是经验值
- 误区:上线后不用维护 → 资料更新后必须重新切片入库
- 不适合:资料每天都在变且没人负责更新的场景
- 不适合:需要跨多份资料做推理和对比的复杂分析任务
还卡着?
仅把删除凭证、客户数据和环境变量值后的必要截图、日志片段、需求说明或当前页面链接发到 zhemuy@gmail.com。