🤖HermesBlog
Hermes Official Tutorials · Parte 288/9/2026

Tutorial 28: Provider Configuration

Tutorial 28: Provider Configuration — easy-to-understand guide based on official docs

Hermes tutorial

Tutorial 28: Configuração do Provedor

Bem-vindo de volta! Neste tutorial, vamos mergulhar em como o Hermes decide qual modelo de IA faz o quê. Se você já se perguntou por que algumas tarefas parecem mais rápidas que outras, ou como deixar seu agente mais barato de rodar, este tutorial é para você.

Dois Tipos de Slots de Modelo

Pense no Hermes como um time. Você tem seu modelo principal — o jogador estrela que lida com toda mensagem do usuário, toda chamada de ferramenta e toda resposta em streaming. Esse é o cérebro do seu agente.

Mas o jogador estrela não faz tudo. O Hermes transfere tarefas menores e repetitivas para os modelos auxiliares. Esses são os ajudantes: compressão de contexto, análise de imagens, resumo de páginas web, pontuação de aprovação, roteamento de ferramentas MCP, geração de títulos de sessão e busca de habilidades. Cada uma dessas 11 tarefas tem seu próprio slot, e você pode substituir cada uma delas de forma independente.

O Caminho Mais Rápido: Nous Portal

Antes de entrarmos nos detalhes, aqui vai um atalho. O Nous Portal dá acesso a mais de 300 modelos com uma única assinatura. Em uma instalação nova, basta rodar:

hermes setup --portal

Isso faz login e define a Nous como seu provedor em um único comando. Curioso para saber o que está configurado? Verifique com hermes portal info. Assinantes do Portal também ganham 10% de desconto em provedores cobrados por token, o que é um bônus bem-vindo.

A Página de Modelos

Abra seu painel e clique em Modelos na barra lateral. Você verá duas seções:

  1. Configurações de Modelo — o painel superior onde você atribui modelos aos slots.
  2. Analíticas de uso — cards ranqueados mostrando cada modelo que executou uma sessão, com contagem de tokens, custo e selos de capacidade.

A linha principal mostra o que seu agente usará para novas sessões. Clique em Alterar para abrir o seletor.

Definindo o Modelo Principal

O seletor tem duas colunas:

  • Esquerda — seus provedores autenticados. Apenas provedores que você configurou (chave de API, OAuth ou endpoint personalizado) aparecem aqui. Faltou algum? Vá em Chaves e adicione a credencial.
  • Direita — a lista curada de modelos para aquele provedor. Esses são os modelos agênticos que o Hermes recomenda, não a lista bruta de /models (que no OpenRouter inclui mais de 400 modelos, incluindo TTS e geradores de imagem).

Escolha um modelo, clique em Alternar, e o Hermes o grava em ~/.hermes/config.yaml. Importante: isso se aplica apenas a novas sessões. Suas abas de chat abertas continuam rodando com o modelo original. Para trocar o chat atual em tempo real, use o comando de barra /model dentro dele.

Trocas no Meio da Sessão: O Que Você Deve Saber

Trocando de modelo no meio da conversa? O Hermes estimará se sua próxima mensagem dispara compressão de contexto em relação à janela do novo modelo. Se você estiver perto do limite, verá um aviso — mas a troca ainda se aplica imediatamente.

Aviso importante: trocas no meio da sessão redefinem o cache de prompt. Os caches estão vinculados ao modelo que atende a requisição, então qualquer mudança significa que a próxima mensagem relerá toda a conversa ao preço integral de token de entrada, em vez da taxa com cache (~75–90% de desconto). Em uma sessão longa, essa releitura única pode custar mais do que a diferença por token entre os modelos. Troque quando precisar, mas prefira fazer isso no início de uma conversa.

Níveis de Treinamento de Dados Sem Supervisão

Alguns modelos (como muse-spark-1.2-contributor) têm desconto porque o fornecedor pode treinar com seus dados. A seleção interativa sempre mostra um prompt de confirmação. Mas caminhos não interativos — como workers do Kanban e agentes cron — falham por padrão, pois não conseguem perguntar.

Se você não se importa com isso para cargas de trabalho sem supervisão, registre uma confirmação persistente:

hermes config set security.allow_data_training_tiers_noninteractive true

O Hermes ainda imprime o aviso completo de política de dados em toda inicialização sem supervisão, então os logs mantêm uma trilha de auditoria. Revogue com:

hermes config unset security.allow_data_training_tiers_noninteractive

Definindo Modelos Auxiliares

Clique em Mostrar auxiliares para revelar os 11 slots de tarefas. Toda tarefa auxiliar usa auto como padrão — ou seja, o Hermes tenta usar seu modelo principal para aquela tarefa também. Se essa rota falhar, o auto segue cadeias de fallback específicas da tarefa, depois seus fallback_providers principais e, por fim, a cadeia de descoberta embutida do Hermes.

Substitua uma tarefa específica quando quiser um modelo mais barato ou mais rápido para um trabalho secundário. É uma ótima maneira de economizar tokens em tarefas repetitivas.

Uma Última Nota Sobre o Esquema model:

Em uma instalação nova, sua configuração tem model: "" — uma string vazia que significa “ainda não configurado”. Na primeira vez que você rodar hermes setup ou hermes model, essa chave é atualizada para um mapeamento com as subchaves provider, default, base_url e api_mode. Se você vir uma string vazia no config.yaml, basta rodar hermes model (ou clicar em Alterar no painel) e o Hermes gravará o formato de dicionário adequado para você.

É isso! Agora você sabe como configurar seus modelos principal e auxiliares. Na próxima, vamos explorar os provedores de fallback — para que seu agente nunca fique fora do ar.

📖 Documentação oficial

この記事は Hermes Agent のDocumentação oficialに基づいています:Documentação oficial › user-guide/configuring-models