Agent Skills 技能库 · 进阶

Agent Reach:让 Agent 能搜索网页、Reddit、GitHub、小红书和视频

把 Agent Reach 当成全网读取脚手架,给 Claude Code、Codex、OpenClaw、Cursor 增加搜索、阅读和平台资料采集能力。

  • Agent Reach
  • 搜索技能
  • Reddit
  • 小红书
更新于 2026-05-19

一句话结论

Agent Reach 不替 Agent 思考,它负责把网页、GitHub、Reddit、YouTube、小红书、B站、公众号等入口装好,让 Agent 有资料可读。

适用场景

  • 想让 Agent 帮你搜索 X、Reddit、GitHub、YouTube、B站、小红书资料
  • 想把社区教程整理成静态站文章或知识库
  • OpenClaw / Claude Code / Codex 需要稳定的网页读取能力

常见现象

  • 直接抓 Reddit 或 X 经常 403 / 登录墙
  • 视频教程只有链接,Agent 看不到字幕和重点
  • 小红书、公众号、B站资料需要人工复制,效率很低

原因解释

  • 不同平台读取门槛不同,有的需要 Cookie,有的需要 CLI,有的需要浏览器自动化
  • Agent Reach 的思路是脚手架:安装并配置上游工具,再让 Agent 直接调用它们
  • OpenClaw 不应为了搜索而扩大默认或群聊 Agent 的全局权限;安装由真人在本机完成,运行时只给专用研究 Agent 必需的网页工具

解决步骤

  1. 先由真人在受控终端审阅 Agent Reach 的安装说明、依赖和数据去向,再完成安装;不要让群聊 Agent 自行安装。
  2. OpenClaw 新建独立 research Agent,使用单独 workspace 和 agent 级 sandbox,只额外允许 web_search、web_fetch;需要其他平台工具时逐个审阅后点名加入。
  3. 只把 research Agent 绑定到可信的私人操作入口,不要绑定公开群聊或默认入口。
  4. 由真人运行 agent-reach doctor,看每个平台通不通
  5. 按任务选择通道:网页用 Jina Reader,GitHub 用 gh CLI,视频用 yt-dlp,Reddit 用 rdt-cli,小红书用平台 CLI 或 MCP
  6. 把搜索结果整理成站内文章、FAQ、工作流模板,而不是只保存链接

可复制命令

// ~/.openclaw/openclaw.json:合并到 agents.list,不要覆盖现有配置
{
  agents: {
    list: [{
      id: "research",
      workspace: "~/.openclaw/workspace-research",
      sandbox: { mode: "all", scope: "agent" },
      tools: {
        profile: "minimal",
        alsoAllow: ["web_search", "web_fetch"],
        deny: ["group:fs", "group:runtime", "group:messaging", "browser"],
        sandbox: {
          tools: { alsoAllow: ["web_search", "web_fetch"] }
        }
      }
    }]
  }
}

// 保存后由真人验证;不要把 research Agent 绑定到公开群聊
// openclaw config validate
// openclaw agents list --bindings
// openclaw sandbox explain
// openclaw gateway restart
agent-reach doctor
curl -s "https://r.jina.ai/http://example.com"
gh repo view Panniantong/Agent-Reach
yt-dlp --write-sub --write-auto-sub --sub-lang "zh-Hans,zh,en" --skip-download -o "/tmp/%(id)s" "视频链接"

仍然不行怎么办

  • Reddit 被网络安全拦截时,改用 rdt-cli 登录认证或换搜索引擎查缓存
  • X / 小红书需要 Cookie 时,务必用专用小号,不要发主账号 Cookie
  • 服务器环境抓不到 B站或小红书时,优先由真人在本地电脑跑,再把严格去标识化的结果导入知识库
  • 若某个平台确实需要本地 CLI 或额外工具,不要改回全局 coding profile;先审阅该工具,再只给 research Agent 点名放行并重新检查 sandbox。

平台能力地图

  • 网页:Jina Reader 或类似网页转 Markdown 工具。
  • GitHub:gh CLI 读仓库、issue、PR、代码搜索。
  • Reddit:rdt-cli 或搜索引擎兜底,很多环境直接抓会 403。
  • YouTube / B站:yt-dlp 提取字幕,再让 Agent 总结。
  • 小红书 / 抖音:优先用专用小号和可控采集工具,注意平台规则和账号风险。
  • 公众号 / RSS:适合做长期教程源和行业动态源。

可复制给 Agent 的搜索任务模板

请用 Agent Reach 搜索并整理这个主题:{主题}\n要求:\n1. 先列出信息源:GitHub、Reddit、X、中文论坛、官方文档。\n2. 每个源只摘取和小白教程相关的做法,不要复制整篇文章。\n3. 输出:一句话结论、适用场景、操作步骤、风险提醒、可复制命令、参考链接。\n4. 如果某个平台因为登录或 403 读不到,明确说明,不要编造。

参考来源

相关问题

还卡着?

仅把删除凭证、客户数据和环境变量值后的必要截图、日志片段、需求说明或当前页面链接发到 zhemuy@gmail.com。