Mixture of Agents — более умные ответы
Mixture of Agents — Smarter Answers — easy-to-understand guide based on official docs
Mixture of Agents — более умные ответы
С возвращением в нашу серию о том, как выжать максимум из Hermes Agent! Сегодня мы разберём тему, которая звучит сложно, но на самом деле довольно проста, когда увидишь её в деле: настройка моделей.
Представьте это так: ваш агент — это не один мозг. Это скорее небольшая команда. Есть главный мыслитель — модель, которая обрабатывает каждый разговор, каждый вызов инструмента, каждый ответ. А есть помощники — модели поменьше и побыстрее, которые занимаются второстепенными задачами: суммаризация веб-страниц, анализ изображений или сжатие длинных диалогов.
Самое приятное? Вы сами решаете, кто будет в вашей команде. Давайте разберёмся, как это работает.
Страница Models: ваш пульт управления
Откройте панель управления Hermes и нажмите Models на боковой панели. Вы увидите две вещи:
- Model Settings — верхняя панель, где вы назначаете модели на разные задачи.
- Usage Analytics — рейтинг всех моделей, которые запускали сессии, с количеством токенов и стоимостью.
Главная строка сверху показывает, какую модель агент будет использовать для новых сессий. Нажмите Change, чтобы открыть выбор.
Выбор главной модели
В окне выбора две колонки:
- Левая сторона: ваши аутентифицированные провайдеры. Здесь отображаются только те, которые вы настроили (с API-ключом или OAuth). Если кого-то не хватает — зайдите в Keys и добавьте.
- Правая сторона: курируемый список агентных моделей для этого провайдера. Это не полная выгрузка всех доступных моделей — только те, которые Hermes действительно рекомендует для работы агента.
Введите запрос в поле фильтра, чтобы искать по провайдеру, слагу или ID модели. Выберите нужную, нажмите Switch — и готово. Hermes автоматически запишет её в ваш конфигурационный файл.
Важно: это применяется только к новым сессиям. Если у вас уже открыта вкладка чата, она продолжит работать на той модели, с которой начиналась. Чтобы переключиться на лету, используйте слэш-команду /model.
Переключение в середине сессии: что нужно знать
Когда вы меняете модель внутри активной сессии, Hermes быстро проверяет: вызовет ли ваше следующее сообщение сжатие контекста с новой моделью? Если разговор уже длинный, вы увидите предупреждение. Переключение всё равно применяется сразу — просто сжатие запустится на первом же сообщении после переключения.
Вот в чём загвоздка: переключение в середине сессии сбрасывает кэш промптов. Кэш промптов привязан к модели, обслуживающей запрос. Так что если вы меняете модель посреди разговора, следующее сообщение перечитывает весь чат по полной цене вместо скидочной кэшированной ставки. На длинной сессии такое разовое перечитывание может стоить дороже, чем разница между двумя моделями. Переключайтесь, когда нужно, но лучше делать это в начале разговора.
Вопрос «обучения на ваших данных»
Некоторые модели дешевле, потому что провайдер может обучаться на ваших промптах. Когда вы выбираете такую модель вручную, Hermes всегда запрашивает подтверждение. А как насчёт автоматических задач — например, cron-задач или Kanban-воркеров, которые работают без вашего присмотра?
По умолчанию они отклоняются. Если вы согласны, можно записать постоянное подтверждение:
hermes config set security.allow_data_training_tiers_noninteractive true
Hermes по-прежнему выводит полное предупреждение о политике данных при каждом запуске, так что в логах остаётся аудиторский след. Отозвать разрешение можно в любой момент:
hermes config unset security.allow_data_training_tiers_noninteractive
Тонкая настройка помощников
Нажмите Show auxiliary, чтобы увидеть 11 слотов задач — сжатие контекста, зрение, суммаризация веб-страниц, оценка одобрений и многое другое.
Каждая вспомогательная задача по умолчанию имеет значение auto — это значит, что Hermes пробует вашу основную модель и для этой задачи. Если она не справляется, идёт перебор по цепочкам, специфичным для задачи, затем по вашим запасным провайдерам, а потом по встроенной цепочке обнаружения Hermes.
Переопределите конкретную задачу, когда хотите использовать более дешёвую или быструю модель для второстепенной работы. Например, можно взять большую дорогую модель для размышлений, а маленькую быструю — для суммаризации веб-страниц.
Самый быстрый путь: Nous Portal
Если хотите 300+ моделей по одной подписке, обратите внимание на Nous Portal. При свежей установке просто выполните:
hermes setup --portal
Это войдёт в систему и настроит Nous как вашего провайдера одной командой. Посмотреть, что подключено, можно через hermes portal info. Подписчики Portal также получают скидку 10% на провайдеров с оплатой за токены.
Последнее замечание
При совершенно новой установке в вашем конфиге стоит model: "" — пустая строка, означающая «ещё не настроено». При первом запуске hermes setup или hermes model это значение обновится до полноценного маппинга с провайдером, дефолтом, base_url и api_mode. Если когда-нибудь увидите пустую строку — просто запустите hermes model, и Hermes всё исправит.
Вот и всё! Теперь вы готовы собрать свою команду мечты из моделей. В следующий раз мы посмотрим, как сделать агента ещё умнее с помощью запасных провайдеров. Оставайтесь с нами!
📖 Официальная документация
Эта статья основана на официальной документации Hermes Agent :Официальные документы › user-guide/configuring-models