Modelos: O Cérebro e os Ajudantes
Kanban — Multi-Agent Collaboration Board — easy-to-understand guide based on official docs
Modelos: O Cérebro e os Ajudantes
Pense no Hermes como um time. Há o modelo principal — o jogador estrela que faz todo o pensamento, a conversa e as chamadas de ferramentas. Depois há os modelos auxiliares — a equipe de apoio que cuida de tarefas paralelas, como resumir páginas da web, analisar imagens ou comprimir conversas longas.
Este post é sobre configurar esses modelos a partir do painel de controle. É mais fácil do que parece, e vamos passar por isso passo a passo.
A Página de Modelos
Abra seu painel do Hermes e clique em Models na barra lateral. Você verá duas seções principais:
- Configurações de modelo — o painel superior onde você atribui modelos a diferentes tarefas.
- Analíticas de uso — uma lista de cartões mostrando quais modelos executaram sessões, suas contagens de tokens e custos.
O cartão superior é onde a mágica acontece. Ele mostra o modelo principal que será usado para qualquer nova sessão de chat. Clique em Change para escolher um diferente.
Definindo o Modelo Principal
Quando você clica em Change, um diálogo de seleção abre com duas colunas:
- Lado esquerdo: Seus provedores autenticados. Apenas provedores que você configurou (com uma chave de API ou OAuth) aparecem aqui. Se você não vir nenhum, vá para Keys para adicioná-lo.
- Lado direito: Uma lista curada de modelos para aquele provedor. Não é um despejo bruto de todos os modelos — é uma lista selecionada manualmente de modelos agênticos que o Hermes recomenda.
Digite no campo de filtro para pesquisar por nome do provedor ou ID do modelo. Escolha um modelo, clique em Switch, e o Hermes salva na sua configuração.
Importante: Isso se aplica apenas a sessões novas. Qualquer chat que você já tenha aberto continua rodando com o modelo original. Para trocar no meio da conversa, use o comando de barra /model.
Trocando de Modelo no Meio da Sessão
Quando você troca de modelo dentro de uma sessão ativa, o Hermes faz uma verificação rápida: sua próxima mensagem vai disparar compressão de contexto? Se sua sessão já estiver longa e perto do limite do novo modelo, você verá um aviso. A troca ainda acontece imediatamente, mas a compressão será executada na sua primeira mensagem após a troca.
Uma pegadinha importante: Trocas no meio da sessão redefinem o cache de prompt. Os caches de prompt dão um grande desconto (75–90% off) na releitura da conversa. Mas os caches estão vinculados ao modelo específico. Então, trocar de modelo significa que a próxima mensagem relerá a conversa inteira pelo preço cheio. Em uma sessão longa, essa releitura única pode custar mais do que a diferença entre os dois modelos. Troque quando precisar, mas é mais inteligente fazer isso no início de uma conversa.
Níveis de Treinamento de Dados Não Supervisionado
Alguns modelos são mais baratos porque o fornecedor pode treinar com seus dados. Quando você escolhe esses modelos interativamente, o Hermes mostra um prompt de confirmação. Mas e quanto a cargas de trabalho não supervisionadas, como trabalhadores do Kanban ou agentes cron? Eles não podem fazer perguntas.
Se você estiver de acordo, pode registrar uma confirmação persistente:
hermes config set security.allow_data_training_tiers_noninteractive true
O Hermes ainda imprimirá o aviso completo de política de dados em cada inicialização, então os logs mantêm uma trilha de auditoria. Para revogar:
hermes config unset security.allow_data_training_tiers_noninteractive
Definindo Modelos Auxiliares
Clique em Show auxiliary para revelar 11 espaços de tarefas. Eles cuidam de tarefas paralelas como:
- Compressão de contexto
- Visão (análise de imagens)
- Resumo de páginas da web
- Pontuação de aprovação
- Roteamento de ferramentas MCP
- Geração de títulos de sessão
- Busca de habilidades
Cada tarefa auxiliar usa auto como padrão — ou seja, o Hermes tenta usar seu modelo principal para aquela tarefa também. Se falhar, ele segue uma cadeia de fallback. Substitua uma tarefa específica quando quiser um modelo mais barato ou mais rápido para aquela tarefa paralela em particular.
O Caminho Mais Rápido: Nous Portal
Se você quer 300+ modelos em uma única assinatura, confira o Nous Portal. Em uma instalação nova, basta rodar:
hermes setup --portal
Isso faz login e define Nous como seu provedor em um único comando. Inspecione o que está configurado com hermes portal info. Assinantes do Portal também ganham 10% de desconto em provedores cobrados por token.
Uma Nota sobre o Esquema model:
Em uma instalação totalmente nova, sua configuração tem model: "" — uma string vazia que significa “ainda não configurado”. Na primeira vez que você rodar hermes setup ou hermes model, essa chave é atualizada para um mapeamento adequado com provider, default, base_url e api_mode. Se você algum dia vir uma string vazia em config.yaml, basta rodar hermes model e ela se corrigirá.
É isso! Agora você sabe como configurar tanto o cérebro principal quanto a equipe de apoio. Vá em frente e monte seu time de agentes.
📖 Documentação oficial
この記事は Hermes Agent のDocumentação oficialに基づいています:Documentação oficial › user-guide/configuring-models