第38篇:多模型混合——MoA 智能融合
Hermes 功能详解第38篇:Mixture of Agents。多个模型答案融合更准。
第38篇:多模型混合——MoA 智慧融合
嘿,朋友們!今天咱們來聊聊 Hermes 的「多模型混合」玩法。別被標題嚇到,其實說白了就是:讓不同的模型各司其職,幹自己最擅長的活。
兩種模型槽位
Hermes 把模型分成兩大類:
- 主模型(Main model):負責「思考」的那個。你發的每句話、工具呼叫迴圈、串流回應,全都走它。
- 輔助模型(Auxiliary models):幹雜活的小弟們。比如上下文壓縮、圖片分析、網頁摘要、審批打分、MCP 工具路由、會話標題生成、技能搜尋……一共 11 個任務槽位,每個都能單獨指定模型。
快速上手:Nous Portal
如果你不想一個個配 API Key,強烈推薦走 Nous Portal 這條路。一條指令搞定登入和設定:
hermes setup --portal
想看配了啥?跑一下:
hermes portal info
Portal 訂閱用戶還能享受token 計費提供商 9 折優惠,真香。
在儀表板裡配模型
開啟儀表板,點側邊欄的 Models,你會看到兩個區域:
- Model Settings —— 頂部面板,給各個槽位分配模型
- Usage analytics —— 使用統計卡片,顯示每個模型跑了多少 token、花了多少錢
主模型那一行,點 Change 就能開啟選擇器。左邊是已認證的提供商,右邊是精選模型清單(不是原始 API 的 400+ 模型大雜燴,而是 Hermes 推薦適合做 agent 的模型)。
選好模型點 Switch,設定就寫進 ~/.hermes/config.yaml 了。注意:這只對新會話生效。想熱切換當前聊天?用 /model 斜線指令。
中途切換的坑
在會話中途切模型,Hermes 會估算你的下一條訊息是否觸發上下文壓縮。如果會話已經接近新模型的壓縮閾值,切換時會收到警告。
⚠️ 重要提醒:中途切換會重設提示詞快取!因為快取是按模型綁定的,切換後下一條訊息得按全價重新讀一遍整個對話。長會話裡這一下可能比兩個模型的差價還貴。所以——要切換趁早,別聊到一半再換。
資料訓練分級
有些模型(比如 muse-spark-1.2-contributor)因為廠商可能拿你的資料訓練,所以價格打折。互動式選擇時會有確認彈窗,但無人值守任務(比如 Kanban worker、cron agent)沒法彈窗問,所以預設直接拒絕。
如果你能接受,可以記錄一個持久確認:
hermes config set security.allow_data_training_tiers_noninteractive true
想撤銷就:
hermes config unset security.allow_data_training_tiers_noninteractive
輔助模型怎麼配
點 Show auxiliary 展開 11 個任務槽位。每個預設都是 auto——意思是先用主模型試試,不行再走後備鏈。想省錢或提速?單獨覆蓋某個任務就行,比如讓圖片分析用個便宜的小模型。
小彩蛋:model: 設定的演變
新裝 Hermes 時,config.yaml 裡 model: 是個空字串(表示「還沒配」)。第一次跑 hermes setup 或 hermes model 後,它會自動升級成帶 provider、default、base_url、api_mode 的對映結構。如果你看到空字串,跑一下 hermes model 就自動修好了。
好啦,多模型混合的核心概念就這些。記住:主模型負責聰明,輔助模型負責省錢,各幹各的活,效率翻倍!下期見~
📖 官方文档
本文根据 Hermes Agent 官方文档编写,原文见:官方文档 › user-guide/configuring-models