OpenClaw 教程 · 进阶

OpenClaw 的资料记忆与检索怎么配置

OpenClaw 默认从 workspace 的 Markdown memory 读取资料并建立检索索引;额外目录用 memory.search.extraPaths,通用文件上传式 RAG 需明确插件或外部系统。

  • OpenClaw
  • Memory
  • 检索
更新于 2026-07-26

一句话结论

先把可长期使用的事实整理为 workspace Markdown,用 `openclaw memory status` 检查索引,再用不含敏感信息的代表性问题验证;不要假设存在通用拖拽上传知识库。

适用场景

  • 想让 OpenClaw 记住产品规则、偏好、操作手册或 FAQ
  • workspace 已有 Markdown,但 `memory_search` 找不到相关内容
  • 想把另一个受控 Markdown 目录纳入检索

常见现象

  • `memory_search` 没有结果或只命中关键词
  • 资料存在但没有被写进默认 memory 路径或配置的 extraPaths
  • 陈旧、重复或互相冲突的笔记干扰回答

原因解释

  • OpenClaw 的默认记忆来源是 workspace 中的 `MEMORY.md` 与 `memory/*.md`,不是任意文件上传目录
  • 语义检索依赖 memory provider、索引状态和配置;只配文件但索引未就绪也不会命中
  • 资料缺少日期、来源和适用范围,或把原始聊天与长期事实混在一起

解决步骤

  1. 把精简、可验证的长期事实写入 `MEMORY.md`,把每日记录写入 `memory/YYYY-MM-DD.md`;保留来源、日期和适用范围
  2. 需要索引其他 Markdown 目录时按官方配置设置 `memory.search.extraPaths`;默认 memory 根仍只支持 Markdown
  3. 运行 `openclaw memory status --deep` 检查 provider、索引和检索状态;需要时再用 `openclaw memory index --force` 重建
  4. 用 10 个不含敏感信息的代表性问题和 5 个资料外问题测试召回、来源与“不知道”兜底
  5. 若需要 PDF、Word、网页上传、复杂切片或独立向量库,明确选择受审查的插件或外部 RAG 系统,不把它写成 OpenClaw 默认 UI 功能

仍然不行怎么办

  • 没有结果先运行 `openclaw memory status --deep`;确认文件路径、provider 和索引后再调整检索配置
  • 需要非 Markdown 文件或复杂权限隔离时,先选明确的插件/外部知识系统并做数据边界审查

小白先准备什么

  1. 先选 10-30 条最常用、已核实的事实或规则,不要把整个硬盘加入检索。
  2. 将需要默认记忆的内容整理为 Markdown,文件名和正文写清版本、日期、来源与适用范围。
  3. 准备 10 个不含个人或客户敏感信息的代表性问题,用来测试知识库能不能答到点上。
  4. 提前决定回答格式:是否必须引用来源、是否允许推断、资料不足时怎么转人工。

验收标准

  • 用固定问题集记录命中与失败项,不编造没有依据的百分比门槛。
  • 回答里能说出信息来自哪份资料,而不是只给一句泛泛总结。
  • 问资料里没有的问题时,Agent 会明确说资料里没有,而不是编答案。
  • 新增或替换资料后,会检查 memory status 并重跑同一组回归问题。

可复制提示词

你是知识库问答助手。只允许根据我提供的资料回答。

回答规则:
1. 先给一句话结论。
2. 再列 3-5 条步骤或依据。
3. 每条关键结论后标注来自哪份资料。
4. 如果资料里没有答案,直接说“资料里没有找到”,并告诉用户还需要补充什么资料。
5. 不要编造价格、链接、政策、时间。

常见误区和不适合场景

  • 误区一:OpenClaw 自带通用上传式知识库。默认记忆来源是 workspace Markdown;其他格式要明确插件或外部系统。
  • 误区二:只测能答的问题。必须测试资料里没有的问题,防止胡编。
  • 误区三:把原始聊天、客户数据和长期事实混在一起。应先去标识化、分层并限制访问。
  • 不适合:资料本身还没定稿、经常当天改当天用,又没有版本管理的场景。

相关问题

还卡着?

仅把删除凭证、客户数据和环境变量值后的必要截图、日志片段、需求说明或当前页面链接发到 zhemuy@gmail.com。