🤖HermesBlog
Hermes Feature Guides · Parte 298/9/2026

Fallback Providers — AI Never Down

Fallback Providers — AI Never Down — easy-to-understand guide based on official docs

hermes-feature-29-fallback-providers

Proveedores de Respaldo — IA Que Nunca se Cae

¿Alguna vez has estado en medio de una gran conversación con tu asistente de IA y, de repente, deja de responder? Quizás el proveedor está teniendo una interrupción, o el modelo está sobrecargado. Con Hermes Agent, eso es cosa del pasado. Piensa en los proveedores de respaldo como la llanta de repuesto de tu coche: esperas no necesitarla nunca, pero cuando la necesitas, te salva el día.

¿Qué Son los Proveedores de Respaldo?

En términos simples, un proveedor de respaldo es un modelo de IA de reserva al que Hermes cambia automáticamente cuando tu modelo principal falla. Es como tener un Plan B, C y D listos. Si tu modelo principal se cae, Hermes no entra en pánico—simplemente cambia silenciosamente a la siguiente opción disponible.

Cómo Funciona

Hermes usa dos tipos de ranuras de modelo:

  • Modelo principal — el “cerebro” que piensa en cada mensaje, llamada de herramienta y respuesta.
  • Modelos auxiliares — acompañantes más pequeños que manejan tareas específicas como resumir páginas web, analizar imágenes o comprimir conversaciones largas.

Cuando configuras tu modelo principal, también puedes definir una cadena de respaldos. Si el modelo principal falla, Hermes automáticamente prueba el siguiente en la fila. Esta cadena se llama la cadena fallback_providers / fallback_model.

Configurando Tu Cadena de Respaldo

La forma más fácil de empezar es con Nous Portal. En una instalación nueva, solo ejecuta:

hermes setup --portal

Esto te inicia sesión y establece Nous como tu proveedor en un solo comando. Puedes verificar qué está configurado con:

hermes portal info

Los suscriptores de Portal también obtienen 10% de descuento en proveedores facturados por tokens—¡un buen extra!

La Página de Modelos

Abre el panel de control y haz clic en Modelos en la barra lateral. Verás dos secciones:

  1. Configuración de Modelos — donde asignas modelos a las ranuras.
  2. Analíticas de uso — tarjetas que muestran cada modelo que ejecutó una sesión, con conteos de tokens y costos.

La tarjeta superior es el panel de Configuración de Modelos. Haz clic en Cambiar en la fila del modelo principal para abrir el selector.

Eligiendo Tu Modelo Principal

El selector tiene dos columnas:

  • Izquierda — proveedores con los que ya te has autenticado (claves API configuradas, OAuth, o endpoints personalizados).
  • Derecha — la lista curada de modelos agénticos recomendados para ese proveedor.

Escribe en el cuadro de filtro para reducir las opciones. Elige un modelo, presiona Cambiar, y Hermes lo escribe en tu archivo de configuración.

Importante: Esto aplica solo a sesiones nuevas. Si quieres cambiar en caliente el chat actual, usa el comando de barra /model dentro de él.

Cambios a Mitad de Sesión y Advertencias de Contexto

Cuando cambias de modelo a mitad de conversación, Hermes verifica si tu próximo mensaje necesitará compresión de contexto. Si estás cerca del límite del nuevo modelo, recibirás una advertencia—pero el cambio se aplica de inmediato de todos modos.

Ojo: Cambiar de modelo a mitad de sesión reinicia la caché de prompt. Esto significa que el próximo mensaje relee toda la conversación a precio completo en lugar de la tarifa de caché con descuento. En una sesión larga, este costo único puede ser significativo. Así que cambia al inicio de una conversación, no a mitad de una discusión profunda.

Modelos Auxiliares: Los Acompañantes

Haz clic en Mostrar auxiliares para revelar 11 ranuras de tareas. Estas manejan:

  • Compresión de contexto
  • Visión (análisis de imágenes)
  • Resumen de páginas web
  • Puntuación de aprobaciones
  • Enrutamiento de herramientas MCP
  • Generación de títulos de sesión
  • Búsqueda de habilidades

Cada tarea auxiliar tiene como valor predeterminado auto—lo que significa que Hermes intenta usar tu modelo principal para esa tarea también. Si eso falla, sigue la cadena de respaldo específica de la tarea, luego la cadena de respaldo principal, y luego el descubrimiento integrado de Hermes.

Anula una tarea específica cuando quieras un modelo más barato o más rápido para un trabajo secundario. Por ejemplo, podrías usar un modelo pequeño y rápido para resumir páginas web mientras mantienes tu potente modelo principal para pensar.

Niveles de Entrenamiento de Datos No Supervisado

Algunos modelos con descuento permiten que el proveedor entrene con tus datos. Las sesiones interactivas siempre muestran un aviso de confirmación. Pero para cargas de trabajo no supervisadas (como agentes cron), Hermes falla de forma segura—no usará esos modelos a menos que lo permitas explícitamente.

Para habilitarlos:

hermes config set security.allow_data_training_tiers_noninteractive true

Revócalo en cualquier momento con:

hermes config unset security.allow_data_training_tiers_noninteractive

La Conclusión

Los proveedores de respaldo significan que tu IA nunca se cae. Ya sea una interrupción del proveedor, un límite de tasa, o un modelo que simplemente está teniendo un mal día, Hermes te cubre. Configura tu cadena, ajusta tus auxiliares, y disfruta de conversaciones de IA ininterrumpidas—sin importar lo que pase detrás de escena.


📖 Documentación oficial

Este artículo se basa en la documentación oficial de Hermes Agent :Docs oficiales › user-guide/configuring-models