🤖HermesBlog
Hermes Official Tutorials · Partie 138/9/2026

Tutoriel 13 : Comment choisir le bon modèle d'IA dans Hermes

Pick the best model for your Hermes Agent — provider options and speed vs quality trade-offs, explained for beginners.

Hermes tutorial

Tutoriel 13 : Comment choisir le bon modèle d’IA dans Hermes

Bon retour dans notre série Hermes Agent ! Dans ce tutoriel, nous abordons l’une des décisions les plus importantes que vous aurez à prendre : choisir le bon modèle d’IA. Que vous soyez débutant ou expert, comprendre comment Hermes gère les modèles vous aidera à obtenir les meilleures performances et le meilleur rapport qualité-prix.

Deux types d’emplacements de modèles

Hermes utilise deux types d’emplacements de modèles :

  • Modèle principal — C’est le « cerveau » de votre agent. Chaque message utilisateur, chaque appel d’outil et chaque réponse diffusée passe par ce modèle. C’est le cheval de trait.
  • Modèles auxiliaires — Ce sont des tâches secondaires plus légères que votre agent délègue. Considérez-les comme des assistants spécialisés pour des tâches comme la compression de contexte, l’analyse d’images, la synthèse de pages web, la notation d’approbation, le routage d’outils MCP, la génération de titres de session et la recherche de compétences. Chacun dispose de son propre emplacement et peut être remplacé indépendamment.

Le chemin le plus rapide : Nous Portal

Avant d’entrer dans le vif du sujet, voici un conseil de pro. Nous Portal vous donne accès à plus de 300 modèles avec un seul abonnement. Sur une installation fraîche, exécutez simplement :

hermes setup --portal

Cela vous connecte et définit Nous comme votre fournisseur en une seule commande. Vous pouvez vérifier la configuration avec hermes portal info. En plus, les abonnés Portal bénéficient de 10 % de réduction sur les fournisseurs facturés aux tokens. Pas mal !

Comprendre le schéma model:

Sur une toute nouvelle installation, votre configuration contient model: "" (une chaîne vide signifiant « pas encore configuré »). La première fois que vous exécutez hermes setup ou hermes model, cette clé est mise à niveau vers un mapping avec les sous-clés provider, default, base_url et api_mode. Si vous voyez une chaîne vide dans config.yaml, exécutez simplement hermes model (ou cliquez sur Modifier dans le tableau de bord) et Hermes s’en occupera pour vous.

La page Modèles

Ouvrez le tableau de bord et cliquez sur Modèles dans la barre latérale. Vous verrez deux sections :

  1. Paramètres des modèles — le panneau supérieur où vous assignez les modèles aux emplacements.
  2. Analytique d’utilisation — des cartes classées montrant chaque modèle qui a exécuté une session, avec les compteurs de tokens, les coûts et les badges de capacités.

Définir le modèle principal

Cliquez sur Modifier sur la ligne du modèle principal. Le sélecteur comporte deux colonnes :

  • Gauche — les fournisseurs authentifiés. Seuls les fournisseurs que vous avez configurés (clé API, OAuth ou point de terminaison personnalisé) apparaissent ici. Si un fournisseur manque, allez dans Clés et ajoutez ses identifiants.
  • Droite — la liste de modèles organisée pour le fournisseur sélectionné. Ce sont les modèles agentiques recommandés par Hermes, pas la liste brute /models (qui sur OpenRouter comprend plus de 400 modèles, y compris des TTS et des générateurs d’images !).

Choisissez un modèle, cliquez sur Changer, et Hermes l’écrit dans ~/.hermes/config.yaml. Cela ne s’applique qu’aux nouvelles sessions — tout onglet de discussion déjà ouvert continue de fonctionner avec le modèle avec lequel il a démarré. Pour changer à chaud la discussion en cours, utilisez la commande slash /model à l’intérieur de celle-ci.

Changements en cours de session et avertissements de contexte

Lorsque vous changez de modèle au sein d’une session active, Hermes estime si votre prochain message déclenchera une compression de contexte en amont par rapport à la fenêtre du nouveau modèle. Si la session est déjà proche ou au-dessus du seuil de compression de ce modèle, vous recevrez un avertissement. Le changement s’applique immédiatement ; la compression s’exécute sur le premier message utilisateur après le changement.

Important : Les changements en cours de session réinitialisent le cache de prompt. Les caches de prompt sont liés au modèle qui sert la requête, donc tout changement de modèle en pleine conversation signifie que le message suivant relit toute la conversation au prix plein des tokens d’entrée au lieu du tarif en cache (réduction d’environ 75 à 90 %). Sur une longue session, cette relecture unique peut éclipser la différence par token entre deux modèles. Changez quand vous en avez besoin, mais préférez le faire tôt dans une conversation ou juste après avoir démarré une nouvelle session.

Niveaux d’entraînement de données sans surveillance

Certains modèles (comme muse-spark-1.2-contributor) sont réduits parce que le fournisseur peut entraîner sur vos données. La sélection interactive de modèles affiche toujours une invite de confirmation. Mais les chemins de démarrage non interactifs comme les workers Kanban et les agents cron échouent par sécurité car ils ne peuvent pas poser cette question.

Si l’entraînement sur les données de la charge de travail sans surveillance est acceptable, enregistrez un accusé de réception persistant :

hermes config set security.allow_data_training_tiers_noninteractive true

Hermes affiche toujours l’avertissement complet sur la politique de données à chaque démarrage sans surveillance, afin que les journaux des workers conservent une piste d’audit. Révoquez-le avec :

hermes config unset security.allow_data_training_tiers_noninteractive

Définir les modèles auxiliaires

Cliquez sur Afficher les auxiliaires pour révéler les 11 emplacements de tâches. Chaque tâche auxiliaire est par défaut sur auto — ce qui signifie qu’Hermes essaie aussi votre modèle principal pour cette tâche. Si cette voie n’est pas disponible ou rencontre une erreur de type capacité, auto suit toute chaîne de repli spécifique à la tâche, puis la chaîne de repli principale, puis la chaîne de découverte auxiliaire intégrée d’Hermes. Remplacez une tâche spécifique lorsque vous voulez un modèle moins cher ou plus rapide pour une tâche secondaire.

Pour conclure

Choisir le bon modèle dans Hermes, c’est avant tout comprendre votre charge de travail. Utilisez le modèle principal pour la réflexion lourde, et n’hésitez pas à déléguer les tâches secondaires aux modèles auxiliaires. Commencez avec auto et remplacez quand vous en savez plus. Et rappelez-vous — changez de modèle tôt dans les conversations pour éviter ces réinitialisations de cache !

Bonne modélisation ! 🚀

Captures d’écran officielles

Official models page overview

Official model picker dialog

Official auxiliary panel expanded

Official Use as dropdown

📖 Documentation officielle

Cet article est basé sur la documentation officielle de Hermes Agent :Docs officiels › user-guide/configuring-models