Models: The Brain and the Helpers
Kanban — Multi-Agent Collaboration Board — easy-to-understand guide based on official docs
Modelos: El Cerebro y los Ayudantes
Piensa en Hermes como un equipo. Está el modelo principal — la estrella que hace todo el pensamiento, los chats y las llamadas a herramientas. Luego están los modelos auxiliares — el equipo de apoyo que se encarga de tareas secundarias como resumir páginas web, analizar imágenes o comprimir conversaciones largas.
Este post trata sobre cómo configurar estos modelos desde el panel de control. Es más fácil de lo que parece, y lo veremos paso a paso.
La Página de Modelos
Abre tu panel de Hermes y haz clic en Modelos en la barra lateral. Verás dos secciones principales:
- Configuración de modelos — el panel superior donde asignas modelos a diferentes tareas.
- Analíticas de uso — una lista de tarjetas que muestra qué modelos ejecutaron sesiones, sus conteos de tokens y costos.
La tarjeta superior es donde ocurre la magia. Muestra el modelo principal que se usará para cualquier sesión de chat nueva. Haz clic en Cambiar para elegir uno diferente.
Configurando el Modelo Principal
Cuando haces clic en Cambiar, se abre un diálogo de selección con dos columnas:
- Lado izquierdo: Tus proveedores autenticados. Solo los proveedores que hayas configurado (con una clave API u OAuth) aparecen aquí. Si no ves ninguno, ve a Claves para añadirlo.
- Lado derecho: Una lista curada de modelos para ese proveedor. No es el volcado completo de todos los modelos — es una lista seleccionada a mano de modelos agénticos que Hermes recomienda.
Escribe en el cuadro de filtro para buscar por nombre de proveedor o ID de modelo. Elige un modelo, pulsa Cambiar, y Hermes lo guarda en tu archivo de configuración.
Importante: Esto solo aplica a sesiones nuevas. Cualquier chat que ya tengas abierto sigue ejecutando su modelo original. Para cambiar a mitad de conversación, usa el comando de barra /model.
Cambiando Modelos a Mitad de Sesión
Cuando cambias de modelo dentro de una sesión activa, Hermes hace una verificación rápida: ¿tu próximo mensaje activará la compresión de contexto? Si tu sesión ya es larga y está cerca del límite del nuevo modelo, verás una advertencia. El cambio ocurre de inmediato, pero la compresión se ejecutará en tu primer mensaje después del cambio.
Un gran detalle importante: Los cambios a mitad de sesión reinician la caché de prompt. Las cachés de prompt te dan un gran descuento (75–90% menos) al releer la conversación. Pero las cachés están vinculadas al modelo específico. Así que cambiar de modelo significa que el próximo mensaje releerá toda la conversación a precio completo. En una sesión larga, esa relectura única puede costar más que la diferencia entre los dos modelos. Cambia cuando lo necesites, pero es más inteligente hacerlo al inicio de una conversación.
Niveles de Entrenamiento de Datos sin Supervisión
Algunos modelos son más baratos porque el proveedor puede entrenar con tus datos. Cuando eliges estos de forma interactiva, Hermes muestra un aviso de confirmación. Pero, ¿qué pasa con las cargas de trabajo sin supervisión como los trabajadores de Kanban o los agentes cron? No pueden hacer preguntas.
Si te parece bien, puedes registrar un reconocimiento persistente:
hermes config set security.allow_data_training_tiers_noninteractive true
Hermes seguirá imprimiendo la advertencia completa de política de datos en cada inicio, para que los registros mantengan un rastro de auditoría. Para revocarlo:
hermes config unset security.allow_data_training_tiers_noninteractive
Configurando Modelos Auxiliares
Haz clic en Mostrar auxiliares para revelar 11 ranuras de tareas. Estas manejan trabajos secundarios como:
- Compresión de contexto
- Visión (análisis de imágenes)
- Resumen de páginas web
- Puntuación de aprobaciones
- Enrutamiento de herramientas MCP
- Generación de títulos de sesión
- Búsqueda de habilidades
Cada tarea auxiliar tiene como valor predeterminado auto — lo que significa que Hermes intenta usar tu modelo principal para esa tarea también. Si falla, sigue una cadena de respaldo. Sobrescribe una tarea específica cuando quieras un modelo más barato o más rápido para ese trabajo secundario en particular.
El Camino Más Rápido: Nous Portal
Si quieres más de 300 modelos con una sola suscripción, echa un vistazo a Nous Portal. En una instalación nueva, solo ejecuta:
hermes setup --portal
Esto te inicia sesión y configura Nous como tu proveedor en un solo comando. Inspecciona lo que está conectado con hermes portal info. Los suscriptores de Portal también obtienen un 10% de descuento en proveedores con facturación por tokens.
Una Nota sobre el Esquema model:
En una instalación completamente nueva, tu configuración tiene model: "" — una cadena vacía que significa “aún no configurado”. La primera vez que ejecutes hermes setup o hermes model, esa clave se actualiza a un mapeo adecuado con provider, default, base_url y api_mode. Si alguna vez ves una cadena vacía en config.yaml, solo ejecuta hermes model y se arreglará solo.
¡Eso es todo! Ahora sabes cómo configurar tanto el cerebro principal como el equipo de ayudantes. Ve y construye tu equipo de agentes.
📖 Documentación oficial
Este artículo se basa en la documentación oficial de Hermes Agent :Docs oficiales › user-guide/configuring-models