🤖HermesBlog
Hermes 版本更新历史 · 第9篇2026/8/9· Easy Understand Hermes Agent

模型配置大扫盲:主模型和辅助模型到底怎么分?

Hermes v2026.7.1 更新解读:P0/P1清零、多模型混合推理与自验证完成

v2026.7.1 · 审判版

模型配置大扫盲:主模型和辅助模型到底怎么分?

各位 Hermes 的小伙伴们,今天咱们来聊聊一个特别实用的话题——模型配置。不管你是刚入门的新手,还是已经玩了一阵子的老手,搞懂这个都能让你的 Agent 跑得更顺溜。

先搞清楚:什么是主模型,什么是辅助模型?

简单来说,Hermes 把模型分成了两类:

  • 主模型(Main model):这是 Agent 的“大脑”,所有对话、工具调用、思考过程都靠它。你发的每一条消息,它都要过一遍。
  • 辅助模型(Auxiliary models):这些是“打杂”的小模型,负责一些边角料任务,比如压缩上下文、分析图片、总结网页、给会话起标题等等。一共有 11 个这样的任务槽位,每个都可以单独指定模型。

最快上手:用 Nous Portal 一把梭

如果你是第一次安装 Hermes,最省事的办法就是跑一下:

hermes setup --portal

这个命令会帮你登录 Nous Portal,然后自动把提供商配置好。Nous Portal 一个订阅就能用 300+ 模型,还送 10% 的 token 折扣,性价比拉满。

想看看当前配置了啥?用 hermes portal info 就能查。

在仪表盘里换模型

打开仪表盘,点侧边栏的 Models,你会看到两个区域:

  1. Model Settings:上面这块就是分配模型的地方
  2. Usage analytics:下面这块是使用统计,显示每个模型跑了多少 token、花了多少钱

主模型那一行点 Change,会弹出一个选择器:

  • 左边:已经认证过的提供商(没认证的先去 Keys 里加密钥)
  • 右边:该提供商下推荐的模型列表(不是原始 API 的全部模型,是 Hermes 精选过的)

选好模型点 Switch,配置就写进 ~/.hermes/config.yaml 了。注意:这只对新会话生效,已经打开的聊天窗口还是用原来的模型。想热切换当前对话,用 /model 命令。

中途换模型的坑

如果你在对话中途换模型(比如用 /model 命令),有两点要留意:

  1. 会触发上下文压缩:Hermes 会估算你的下一条消息是否需要对新模型做压缩,如果会话已经很长了,会给你个警告。
  2. 缓存会失效:换模型意味着 prompt 缓存要重新读一遍,长会话下这个一次性开销可能比模型差价还大。所以尽量在会话早期换模型,别拖到最后。

关于数据训练的“贡献者”模型

有些模型(比如 muse-spark-1.2-contributor)价格便宜,但代价是厂商可能会拿你的数据去训练。交互式选择时会有确认弹窗,但像 Kanban 工作进程、cron 定时任务这种无人值守的场景没法弹窗,所以默认是拒绝的。

如果你能接受,可以手动开一下:

hermes config set security.allow_data_training_tiers_noninteractive true

想撤销就用 unset。Hermes 每次无人值守启动时还是会打印完整的数据政策警告,日志里留了审计记录,这点做得挺贴心。

辅助模型:默认 auto 就够了?

辅助模型默认都是 auto,意思是直接用主模型来干这些活。但如果你觉得某些任务用便宜的小模型就够了,可以单独覆盖。

比如图片分析这种任务,完全可以用个轻量模型,没必要让旗舰模型来“杀鸡用牛刀”。点开 Show auxiliary 就能看到全部 11 个任务槽位,每个都能单独指定。

小结

模型配置的核心思路就是:主模型选强的,辅助模型选便宜的。主模型决定 Agent 的“智商”,辅助模型决定你的钱包厚度。多用 auto 兜底,按需覆盖,就能在效果和成本之间找到平衡点。

下期咱们聊聊 fallback 机制和 credential pool,敬请期待!

📖 官方文档

本文根据 Hermes Agent 官方文档编写,原文见:GitHub ›/releases/tag/v2026.7.1