🤖HermesBlog
Hermes 功能详解 · 第47篇2026/8/9· Easy Understand Hermes Agent

第47篇:网络搜索与提取

Hermes 功能详解第47篇:Web Search & Extract。联网搜索、抓取网页。

这篇讲的是如何让 Hermes Agent 学会“上网冲浪”——既能搜索信息,又能抓取网页内容,而且全程不需要你手动复制粘贴。

两个核心技能

想象一下,Hermes Agent 是个能干的助手,它有两项看家本领:

  • web_search(搜索):像打开百度/Google 一样,输入关键词,返回排名结果。
  • web_extract(提取):像打开某个网页并“阅读全文”,把正文内容抓取下来。

这两项技能背后有多个“服务商”可选,就像你可以用 Chrome、Firefox 或 Safari 上网一样。默认推荐 Firecrawl(免费额度每月 500 次),如果你有 Nous Portal 付费订阅,甚至可以通过 Tool Gateway 免密钥使用。

第1步:选择你的“浏览器”

运行 hermes tools 命令,进入 Web Search & Extract 界面,按提示选择服务商并填入 API 密钥(密钥在对应官网注册获取)。

不想折腾? 直接选默认的 Firecrawl,在 ~/.hermes/.env 文件里加一行:

FIRECRAWL_API_KEY=fc-your-key-here

想省钱? 用 SearXNG(免费、自托管、注重隐私)。用 Docker 一条命令跑起来:

docker run -p 8888:8080 searxng/searxng:latest

然后修改配置启用 JSON 输出(否则 Hermes 读不了),最后在 config.yaml 里指定:

web:
  search_backend: "searxng"

第2步:按需搭配“搜索”和“提取”

搜索和提取可以分开选不同的服务商。比如用免费的 SearXNG 搜索,用 Firecrawl 提取网页内容:

web:
  search_backend: "searxng"
  extract_backend: "firecrawl"

这就像用免费的图书馆查资料,但请付费的翻译帮你精读——各取所长。

第3步:理解“长文截断”机制

网页内容可能很长(比如论坛帖子、新闻评论区)。Hermes 默认只保留 15,000 字符(约 7500 个汉字),超出部分会截断并提示 [TRUNCATED]。完整内容会存到本地文件,Agent 可以按需分页读取。

如果截断影响了你,可以调大限制:

web:
  extract_char_limit: 50000

或者改用 browser_navigate 工具直接操作浏览器,获取实时页面。

第4步:验证配置是否生效

配置好后,跑个测试搜索:

curl -s "http://localhost:8888/search?q=test&format=json" | python3 -c "import sys,json; d=json.load(sys.stdin); print(len(d['results']), 'results')"

看到 10 results 就说明 SearXNG 正常工作了。


总结一下:搜索和提取是 Agent 的“眼睛”,选对服务商、配好密钥、理解截断机制,就能让它帮你高效获取网络信息。

下篇预告:Agent 能“看”能“搜”了,下一步该学“动手”——敬请期待第48篇:浏览器自动化操作。

📖 官方文档

本文根据 Hermes Agent 官方文档编写,原文见:官方文档 › user-guide/web-search