🤖HermesBlog
Hermes 功能详解 · 第5篇2026/8/9· Easy Understand Hermes Agent

记忆后端——记忆存在哪里

Hermes 功能详解第5篇:记忆提供方。内置记忆、Honcho、各种记忆后端任你选。

hermes-feature-5-memory-providers

記憶後端——記憶存在哪裡

嘿,朋友們!前面幾篇我們聊了 Hermes 的記憶檔案(MEMORY.md 和 USER.md),那是它的「內建筆記本」。但今天要聊的是外掛記憶庫——當內建筆記本不夠用,你想讓 Agent 記住跨 session、甚至跨使用者的長久記憶時,就該請出這 8 位「外援」了。

一句話理解

內建記憶(MEMORY.md / USER.md)永遠在線,而外部記憶提供者是疊加上去的。同一時間只能啟用一個外部提供者,但內建的照常運作,互不干擾。

三秒上手

hermes memory setup      # 互動式選擇 + 設定
hermes memory status     # 查看目前啟用的是誰
hermes memory off        # 關閉外部提供者

不想敲指令?也可以去 hermes plugins → Provider Plugins → Memory Provider 裡點選。或者直接改設定檔 ~/.hermes/config.yaml

memory:
  provider: honcho   # 或 mem0, hindsight, holographic, retaindb, byterover, supermemory, openviking

啟用後會發生什麼?

一旦啟用,Hermes 會在背景自動做 6 件事:

  1. 注入上下文——把提供者知道的關於你的資訊塞進系統提示詞
  2. 預取記憶——每輪對話前,背景悄悄檢索相關記憶(不阻塞)
  3. 同步對話——每次回覆後,把對話內容同步給提供者
  4. 會話結束提取——支援的話,自動提煉長期記憶
  5. 鏡像寫入——內建記憶的寫入也會同步給外部提供者
  6. 新增專屬工具——Agent 可以主動搜尋、儲存、管理記憶

重點聊聊 Honcho

8 個提供者裡,Honcho 是文件裡著墨最多的,因為它有個很酷的「辯證法」機制——用 LLM 推理來生成使用者畫像,而不是簡單存文字。

它適合誰? 多 Agent 系統、需要跨 session 理解使用者、講究「人機對齊」的場景。

架構亮點:兩層上下文注入

  • 基礎層:會話摘要 + 使用者表徵 + 使用者卡片,按 contextCadence 重新整理
  • 辯證層:LLM 推理補充,按 dialecticCadence 觸發,深度由 dialecticDepth 控制(1-3 輪)

還有個聰明的小設計:查詢越長,推理越深(有上限 reasoningLevelCap),短問題不浪費算力,長問題深入分析。

三個獨立旋鈕,成本與深度分開調:

  • contextCadence:基礎層重新整理頻率(API 呼叫頻率)
  • dialecticCadence:辯證層 LLM 觸發頻率(1-5 推薦)
  • dialecticDepth:每次辯證的推理輪數(1-3)

無頭機器部署:SSH 遠端機器沒有瀏覽器?選 device 認證方式,CLI 會印出一個短碼和驗證連結,你在任何有瀏覽器的機器上開啟連結確認即可,不用複製貼上 API key。

設定檔位置(按優先級):$HERMES_HOME/honcho.json > ~/.hermes/honcho.json > ~/.honcho/config.json

小貼士

  • 舊指令 hermes honcho setup 還能用,但會重新導向到 hermes memory setup
  • 想控制上下文佔用的 token 量?設 contextTokens 上限,超了會在詞邊界截斷
  • recallMode 可以切換記憶呼叫方式:hybrid(注入+工具)、context(只注入)、tools(只用工具)

總結:外部記憶提供者 = 給 Agent 裝上一個「雲端大腦」。內建記憶是隨身筆記本,外部提供者是圖書館。選哪個?看你的場景——要跨 session 使用者建模,Honcho 很能打;要簡單持久化,其他幾個也各有千秋。先用 hermes memory setup 試試水,反正隨時可以 hermes memory off 關掉,不虧!


📖 官方文档

本文根据 Hermes Agent 官方文档编写,原文见:官方文档 › reference/cli-commands