🤖HermesBlog
Hermes Official Tutorials · Parte 138/9/2026

Tutorial 13: Como Escolher o Modelo de IA Certo no Hermes

Pick the best model for your Hermes Agent — provider options and speed vs quality trade-offs, explained for beginners.

Hermes tutorial

Tutorial 13: Como Escolher o Modelo de IA Certo no Hermes

Bem-vindo de volta à nossa série sobre o Hermes Agent! Neste tutorial, vamos mergulhar em uma das decisões mais importantes que você vai tomar: escolher o modelo de IA certo. Seja você um iniciante ou um profissional experiente, entender como o Hermes lida com modelos vai ajudar você a obter o melhor desempenho e custo-benefício.

Dois Tipos de Slots de Modelo

O Hermes usa dois tipos de slots de modelo:

  • Modelo principal — Este é o “cérebro” do seu agente. Cada mensagem do usuário, cada chamada de ferramenta e cada resposta em streaming passa por este modelo. É o cavalo de batalha.
  • Modelos auxiliares — São tarefas secundárias menores que seu agente delega. Pense neles como assistentes especializados para tarefas como compressão de contexto, análise de imagens, resumo de páginas web, pontuação de aprovações, roteamento de ferramentas MCP, geração de títulos de sessão e busca de habilidades. Cada um tem seu próprio slot e pode ser substituído de forma independente.

O Caminho Mais Rápido: Nous Portal

Antes de entrarmos nos detalhes, aqui vai uma dica de profissional. O Nous Portal dá acesso a mais de 300 modelos com uma única assinatura. Em uma instalação nova, basta executar:

hermes setup --portal

Isso faz login e define a Nous como seu provedor em um único comando. Você pode verificar o que está configurado com hermes portal info. Além disso, assinantes do Portal ganham 10% de desconto em provedores cobrados por token. Nada mal!

Entendendo o Esquema model:

Em uma instalação nova, sua configuração tem model: "" (uma string vazia que significa “ainda não configurado”). Na primeira vez que você executa hermes setup ou hermes model, essa chave é atualizada para um mapeamento com as subchaves provider, default, base_url e api_mode. Se você vir uma string vazia no config.yaml, basta executar hermes model (ou clicar em Change no dashboard) e o Hermes vai corrigir isso para você.

A Página de Modelos

Abra o dashboard e clique em Models na barra lateral. Você verá duas seções:

  1. Model Settings — o painel superior onde você atribui modelos aos slots.
  2. Usage analytics — cartões classificados mostrando cada modelo que executou uma sessão, com contagens de tokens, custo e selos de capacidade.

Definindo o Modelo Principal

Clique em Change na linha do modelo principal. O seletor tem duas colunas:

  • Esquerda — provedores autenticados. Apenas provedores que você configurou (chave de API, OAuth ou endpoint personalizado) aparecem aqui. Se um provedor estiver faltando, vá até Keys e adicione a credencial.
  • Direita — a lista curada de modelos para o provedor selecionado. Estes são os modelos agênticos que o Hermes recomenda, não a lista bruta de /models (que no OpenRouter inclui mais de 400 modelos, incluindo geradores de TTS e imagens!).

Escolha um modelo, clique em Switch, e o Hermes grava no ~/.hermes/config.yaml. Isso se aplica apenas a novas sessões — qualquer aba de chat que você já tenha aberta continua rodando com o modelo com o qual começou. Para trocar rapidamente no chat atual, use o comando de barra /model dentro dele.

Trocas no Meio da Sessão e Avisos de Contexto

Quando você troca de modelo dentro de uma sessão ativa, o Hermes estima se sua próxima mensagem vai executar a compressão de contexto pré-flight contra a janela do novo modelo. Se a sessão já estiver perto ou acima do limite de compressão desse modelo, você receberá um aviso. A troca ainda é aplicada imediatamente; a compressão é executada na primeira mensagem do usuário após a troca.

Importante: Trocas no meio da sessão redefinem o cache de prompt. Os caches de prompt são vinculados ao modelo que atende a solicitação, então qualquer mudança de modelo no meio da conversa significa que a próxima mensagem relerá a conversa inteira ao preço total de tokens de entrada, em vez da taxa com desconto de cache (~75–90%). Em uma sessão longa, essa releitura única pode superar a diferença por token entre dois modelos. Troque quando precisar, mas prefira fazer isso no início de uma conversa ou logo após iniciar uma nova sessão.

Níveis de Treinamento de Dados sem Supervisão

Alguns modelos (como muse-spark-1.2-contributor) têm desconto porque o fornecedor pode treinar com seus dados. A seleção interativa de modelos sempre mostra um prompt de confirmação. Mas caminhos de inicialização não interativos, como workers do Kanban e agentes cron, falham de forma segura porque não podem fazer essa pergunta.

Se o treinamento com os dados da carga de trabalho não supervisionada for aceitável, registre uma confirmação persistente:

hermes config set security.allow_data_training_tiers_noninteractive true

O Hermes ainda imprime o aviso completo da política de dados em cada inicialização não supervisionada, então os logs dos workers mantêm uma trilha de auditoria. Revogue com:

hermes config unset security.allow_data_training_tiers_noninteractive

Definindo Modelos Auxiliares

Clique em Show auxiliary para revelar os 11 slots de tarefas. Toda tarefa auxiliar tem como padrão auto — o que significa que o Hermes tenta usar seu modelo principal para essa tarefa também. Se essa rota estiver indisponível ou encontrar uma falha do tipo capacidade, o auto segue qualquer cadeia de fallback específica da tarefa, depois a cadeia de fallback principal e, em seguida, a cadeia de descoberta auxiliar integrada do Hermes. Substitua uma tarefa específica quando quiser um modelo mais barato ou mais rápido para um trabalho secundário.

Concluindo

Escolher o modelo certo no Hermes é tudo sobre entender sua carga de trabalho. Use o modelo principal para pensamento pesado e não tenha medo de delegar tarefas secundárias para modelos auxiliares. Comece com auto e substitua quando você souber melhor. E lembre-se — troque de modelo no início das conversas para evitar aqueles redefinimentos de cache!

Bons modelos! 🚀

Capturas de tela oficiais

Official models page overview

Official model picker dialog

Official auxiliary panel expanded

Official Use as dropdown

📖 Documentação oficial

この記事は Hermes Agent のDocumentação oficialに基づいています:Documentação oficial › user-guide/configuring-models