更新速览:这次 Hermes 把“后台任务”和“模型切换”玩明白了
Hermes v2026.4.8 更新解读:后台任务自动通知、实时模型切换与自优化工具调用
更新速览:这次 Hermes 把“后台任务”和“模型切换”玩明白了
各位老铁,Hermes 又更新了!这次官方文档把模型配置这块彻底重写了,看完我只想说一句:早该这么干了。以前配模型总得翻配置文件,现在 Dashboard 上点两下就完事,而且后台那些“杂活”终于能单独指派模型了。
两种模型槽位,先搞明白
Hermes 现在把模型分成两类:
- 主模型(Main model):负责“思考”,你发的每条消息、工具调用循环、流式响应都走它。
- 辅助模型(Auxiliary models):负责“打杂”,比如上下文压缩、图像分析、网页摘要、审批打分、MCP 工具路由、会话标题生成、技能搜索等,一共 11 个独立槽位,每个都能单独覆盖。
默认情况下辅助任务都是 auto,也就是跟着主模型走。但如果你想让某个杂活用便宜的小模型跑,直接在面板里改就行。
最快路径:Nous Portal
新装环境跑一句 hermes setup --portal,登录后一条命令就把 Nous 设为供应商,300+ 模型随便挑。想看接入了啥,用 hermes portal info 查。Portal 订阅用户还能享受其他按量计费供应商 9 折,香。
主模型切换:新会话 vs 当前会话
Dashboard 的 Models 页面,点主模型行的 Change 按钮,弹出选择器:
- 左列:已认证的供应商(没 API key 的不会出现)
- 右列:该供应商的精选 agentic 模型列表(不是
/models那种 400+ 的原始大杂烩)
选完点 Switch,配置写入 ~/.hermes/config.yaml。注意:这只对新会话生效。想热切换当前聊天,用 /model 斜杠命令。
中途切模型的两个坑
- 上下文压缩预警:如果当前会话已经接近新模型的压缩阈值,切换时会收到警告。压缩会在切换后的第一条用户消息前执行。
- 提示缓存重置:切模型后,下一条消息会全价重读整个对话,没有缓存折扣(约 75-90% 优惠)。长会话里这一下可能比两个模型的差价还贵。建议尽早切,别聊到一半再换。
无人值守的数据训练授权
像 muse-spark-1.2-contributor 这类模型,供应商可能会拿你的数据训练。交互式选择时会弹确认框,但 Kanban worker、cron agent 这类无人值守场景没法问,所以默认拒绝。如果接受,执行:
hermes config set security.allow_data_training_tiers_noninteractive true
撤销用 hermes config unset ...。每次无人值守启动时,日志里仍会打印完整的数据政策警告和授权键,留作审计。
辅助模型:11 个槽位随便配
点 Show auxiliary 展开面板,每个任务默认 auto,也可以单独指定。当 auto 路线不可用或失败时,会依次走任务专属的 fallback_chain → 主 fallback_providers → 内置发现链。
小提示:model: 空字符串
全新安装的配置里 model: "" 是“未配置”的哨兵值。第一次跑 hermes setup 或 hermes model 时,会自动升级成带 provider、default、base_url、api_mode 的映射结构。如果你在 config.yaml 里看到空字符串,跑一下 hermes model 或点面板里的 Change 就行。
这次更新把模型管理从“配置文件手搓”变成了“面板可视化”,后台杂活也能精细分工,该省的钱省下来,该快的速度提上去。还没升级的朋友,赶紧 hermes update 试试吧!
📖 官方文档
本文根据 Hermes Agent 官方文档编写,原文见:GitHub ›/releases/tag/v2026.4.8