Tutorial 13: How to Choose the Right AI Model in Hermes
Pick the best model for your Hermes Agent — provider options and speed vs quality trade-offs, explained for beginners.
Tutorial 13: Cómo elegir el modelo de IA adecuado en Hermes
¡Bienvenido de nuevo a nuestra serie sobre el agente Hermes! En este tutorial, nos adentramos en una de las decisiones más importantes que tomarás: elegir el modelo de IA correcto. Tanto si eres principiante como un profesional experimentado, entender cómo gestiona Hermes los modelos te ayudará a obtener el mejor rendimiento y valor.
Dos tipos de ranuras para modelos
Hermes utiliza dos tipos de ranuras para modelos:
- Modelo principal — Es el “cerebro” de tu agente. Cada mensaje del usuario, cada llamada a herramienta y cada respuesta en streaming pasa por este modelo. Es el caballo de batalla.
- Modelos auxiliares — Son tareas secundarias más pequeñas que tu agente delega. Piénsalos como asistentes especializados para tareas como compresión de contexto, análisis de imágenes, resumen de páginas web, puntuación de aprobaciones, enrutamiento de herramientas MCP, generación de títulos de sesión y búsqueda de habilidades. Cada uno tiene su propia ranura y se puede sobrescribir de forma independiente.
El camino más rápido: Nous Portal
Antes de entrar en los detalles técnicos, aquí tienes un consejo de experto. Nous Portal te da acceso a más de 300 modelos con una sola suscripción. En una instalación nueva, solo tienes que ejecutar:
hermes setup --portal
Esto te inicia sesión y configura Nous como tu proveedor en un solo comando. Puedes comprobar lo que está conectado con hermes portal info. Además, los suscriptores de Portal obtienen un 10% de descuento en proveedores facturados por tokens. ¡Nada mal!
Entendiendo el esquema model:
En una instalación completamente nueva, tu configuración tiene model: "" (una cadena vacía que significa “aún no configurado”). La primera vez que ejecutes hermes setup o hermes model, esa clave se actualiza a un mapeo con las subclaves provider, default, base_url y api_mode. Si alguna vez ves una cadena vacía en config.yaml, simplemente ejecuta hermes model (o haz clic en Cambiar en el panel) y Hermes lo arreglará por ti.
La página de Modelos
Abre el panel y haz clic en Modelos en la barra lateral. Verás dos secciones:
- Configuración de modelos — el panel superior donde asignas modelos a las ranuras.
- Analíticas de uso — tarjetas clasificadas que muestran cada modelo que ha ejecutado una sesión, con recuentos de tokens, coste e insignias de capacidades.
Configurando el modelo principal
Haz clic en Cambiar en la fila del modelo principal. El selector tiene dos columnas:
- Izquierda — proveedores autenticados. Solo los proveedores que hayas configurado (clave API, OAuth o endpoint personalizado) aparecen aquí. Si falta un proveedor, ve a Claves y añade su credencial.
- Derecha — la lista de modelos seleccionados para el proveedor elegido. Estos son los modelos agénticos que Hermes recomienda, no el volcado completo de
/models(¡que en OpenRouter incluye más de 400 modelos, incluidos los de TTS y generación de imágenes!).
Elige un modelo, pulsa Cambiar y Hermes lo escribe en ~/.hermes/config.yaml. Esto solo se aplica a sesiones nuevas — cualquier pestaña de chat que ya tengas abierta seguirá ejecutando el modelo con el que empezó. Para cambiar al vuelo el chat actual, usa el comando de barra /model dentro de la conversación.
Cambios a mitad de sesión y advertencias de contexto
Cuando cambias de modelo dentro de una sesión activa, Hermes estima si tu siguiente mensaje ejecutará una compresión de contexto previa según la ventana del nuevo modelo. Si la sesión ya está cerca o por encima del umbral de compresión de ese modelo, recibirás una advertencia. El cambio se aplica de inmediato; la compresión se ejecuta en el primer mensaje de usuario después del cambio.
Importante: Los cambios a mitad de sesión restablecen la caché de prompt. Las cachés de prompt están vinculadas al modelo que atiende la solicitud, por lo que cualquier cambio de modelo a mitad de conversación significa que el siguiente mensaje relee toda la conversación al precio completo de tokens de entrada en lugar de la tarifa cacheada (con un descuento de ~75–90%). En una sesión larga, esta relectura única puede eclipsar la diferencia por token entre dos modelos. Cambia cuando lo necesites, pero prefiere hacerlo al principio de una conversación o justo después de iniciar una sesión nueva.
Niveles de entrenamiento de datos sin supervisión
Algunos modelos (como muse-spark-1.2-contributor) tienen descuento porque el proveedor puede entrenar con tus datos. La selección interactiva de modelos siempre muestra un aviso de confirmación. Pero las rutas de inicio no interactivas, como los trabajadores de Kanban y los agentes cron, fallan de forma segura porque no pueden hacer esa pregunta.
Si el entrenamiento con los datos de la carga de trabajo no supervisada es aceptable, registra un reconocimiento persistente:
hermes config set security.allow_data_training_tiers_noninteractive true
Hermes sigue imprimiendo la advertencia completa de política de datos en cada inicio no supervisado, por lo que los registros de los trabajadores conservan un rastro de auditoría. Revócalo con:
hermes config unset security.allow_data_training_tiers_noninteractive
Configurando modelos auxiliares
Haz clic en Mostrar auxiliares para revelar las 11 ranuras de tareas. Cada tarea auxiliar tiene como valor predeterminado auto — lo que significa que Hermes también intenta usar tu modelo principal para esa tarea. Si esa ruta no está disponible o falla por capacidad, auto sigue cualquier cadena de respaldo específica de la tarea, luego la cadena de respaldo principal y, finalmente, la cadena de descubrimiento auxiliar integrada de Hermes. Sobrescribe una tarea específica cuando quieras un modelo más barato o más rápido para una tarea secundaria.
Conclusión
Elegir el modelo adecuado en Hermes consiste en entender tu carga de trabajo. Usa el modelo principal para el pensamiento pesado y no tengas miedo de delegar tareas secundarias a los modelos auxiliares. Empieza con auto y sobrescribe cuando sepas más. Y recuerda: ¡cambia de modelo al principio de las conversaciones para evitar esos reinicios de caché!
¡Feliz modelado! 🚀
Capturas de pantalla oficiales




📖 Documentación oficial
Este artículo se basa en la documentación oficial de Hermes Agent :Docs oficiales › user-guide/configuring-models