Урок 13: Как выбрать подходящую модель ИИ в Hermes
Pick the best model for your Hermes Agent — provider options and speed vs quality trade-offs, explained for beginners.

Урок 13: Как выбрать подходящую модель ИИ в Hermes
С возвращением в нашу серию о Hermes Agent! В этом уроке мы разберём одно из самых важных решений, которое вам предстоит принять: выбор правильной модели ИИ. Новичок вы или опытный профессионал — понимание того, как Hermes работает с моделями, поможет вам добиться максимальной производительности и выгоды.
Два вида слотов для моделей
Hermes использует два типа слотов:
- Основная модель — это «мозг» вашего агента. Каждое сообщение пользователя, каждый вызов инструмента и каждый потоковый ответ проходят через эту модель. Это рабочая лошадка.
- Вспомогательные модели — это небольшие второстепенные задачи, которые ваш агент делегирует. Думайте о них как о специализированных помощниках для таких задач, как сжатие контекста, анализ изображений, суммаризация веб-страниц, оценка одобрений, маршрутизация MCP-инструментов, генерация заголовков сессий и поиск навыков. У каждой из них есть свой слот, и каждую можно переопределить независимо.
Самый быстрый путь: Nous Portal
Прежде чем мы углубимся в детали, вот профессиональный совет. Nous Portal даёт вам доступ к 300+ моделям по одной подписке. При чистой установке просто выполните:
hermes setup --portal
Эта команда выполнит вход и настроит Nous в качестве провайдера одним махом. Проверить, что подключено, можно с помощью hermes portal info. Кроме того, подписчики Portal получают скидку 10% на провайдеров с оплатой за токены. Неплохо!
Понимание схемы model:
При совершенно новой установке ваш конфиг содержит model: "" (пустая строка, означающая «ещё не настроено»). При первом запуске hermes setup или hermes model этот ключ обновляется до структуры с под-ключами provider, default, base_url и api_mode. Если вы когда-нибудь увидите пустую строку в config.yaml, просто выполните hermes model (или нажмите Изменить в дашборде), и Hermes всё исправит за вас.
Страница моделей
Откройте дашборд и нажмите Модели на боковой панели. Вы увидите два раздела:
- Настройки моделей — верхняя панель, где вы назначаете модели слотам.
- Аналитика использования — ранжированные карточки, показывающие каждую модель, которая запускала сессию, с количеством токенов, стоимостью и бейджами возможностей.
Настройка основной модели
Нажмите Изменить в строке основной модели. В выборе две колонки:
- Слева — аутентифицированные провайдеры. Здесь отображаются только те провайдеры, которых вы настроили (API-ключ, OAuth или пользовательская конечная точка). Если провайдера нет, перейдите в Ключи и добавьте его учётные данные.
- Справа — курируемый список моделей для выбранного провайдера. Это агентные модели, которые рекомендует Hermes, а не сырой список
/models(который на OpenRouter включает 400+ моделей, включая TTS и генераторы изображений!).
Выберите модель, нажмите Переключить, и Hermes запишет её в ~/.hermes/config.yaml. Это применяется только к новым сессиям — любая уже открытая вкладка чата продолжает работать с той моделью, с которой была запущена. Чтобы мгновенно переключить текущий чат, используйте слэш-команду /model внутри него.
Переключение в середине сессии и предупреждения о контексте
Когда вы переключаете модели внутри активной сессии, Hermes оценивает, потребует ли ваше следующее сообщение выполнения предварительного сжатия контекста с учётом окна новой модели. Если сессия уже близка к порогу сжатия этой модели или превышает его, вы получите предупреждение. Переключение всё равно применяется немедленно; сжатие выполняется при первом сообщении пользователя после переключения.
Важно: Переключение модели в середине сессии сбрасывает кэш подсказок. Кэши подсказок привязаны к модели, обслуживающей запрос, поэтому любая смена модели в середине разговора означает, что следующее сообщение перечитает весь диалог по полной цене входных токенов вместо кэшированной (со скидкой ~75–90%). В длинной сессии это одноразовое перечитывание может перевесить разницу в цене за токен между двумя моделями. Переключайтесь, когда нужно, но лучше делайте это в начале разговора или сразу после начала новой сессии.
Уровни обучения на данных без присмотра
Некоторые модели (например, muse-spark-1.2-contributor) имеют скидку, потому что поставщик может обучаться на ваших данных. Интерактивный выбор модели всегда показывает запрос на подтверждение. Но неинтерактивные пути запуска, такие как Kanban-воркеры и cron-агенты, завершаются с ошибкой, поскольку не могут задать этот вопрос.
Если обучение на данных фоновой нагрузки приемлемо, запишите постоянное подтверждение:
hermes config set security.allow_data_training_tiers_noninteractive true
Hermes по-прежнему выводит полное предупреждение о политике данных при каждом фоновом запуске, поэтому в журналах воркеров сохраняется аудиторский след. Отменить можно так:
hermes config unset security.allow_data_training_tiers_noninteractive
Настройка вспомогательных моделей
Нажмите Показать вспомогательные, чтобы увидеть 11 слотов задач. Каждая вспомогательная задача по умолчанию имеет значение auto — это означает, что Hermes пробует использовать вашу основную модель и для этой задачи. Если этот путь недоступен или возникает ошибка типа перегрузки, auto следует по цепочке резервных вариантов для конкретной задачи, затем по основной цепочке резервных вариантов, а затем по встроенной цепочке обнаружения вспомогательных моделей Hermes. Переопределите конкретную задачу, когда вам нужна более дешёвая или быстрая модель для второстепенной работы.
Подводим итоги
Выбор правильной модели в Hermes — это понимание вашей рабочей нагрузки. Используйте основную модель для сложных задач и не бойтесь делегировать второстепенные задачи вспомогательным моделям. Начните с auto и переопределяйте, когда знаете лучше. И помните — переключайте модели в начале разговоров, чтобы избежать сброса кэша!
Удачного моделирования! 🚀
Официальные скриншоты



📖 Официальная документация
Эта статья основана на официальной документации Hermes Agent :Официальные документы › user-guide/configuring-models