🚀 Feuille de Route Officielle Hermes : Quoi de neuf ensuite ?
Feuille de route officielle d'Hermes : réactions aux messages, serveur API compatible OpenAI, prise en charge du streaming
Hermes Agent publie ouvertement ses plans de développement dans le répertoire .plans de GitHub, pour que vous puissiez toujours jeter un œil sous le capot et voir exactement ce que l’équipe prépare.
💬 Réactions aux messages : les “tapbacks” sur le bureau
De quoi s’agit-il ? Pensez à la fonction “double-tap pour aimer” sur Instagram ou iMessage. Vous touchez un message, et une petite émoticône (👍, ❤️, 😂, etc.) apparaît dessus. Hermes apporte cette même expérience à sa transcription de bureau. Actuellement, les réactions existent sur des plateformes comme Telegram, Slack et iMessage — mais l’application de bureau est le parent pauvre. Ce plan comble cette lacune.
Avantages pour les utilisateurs : Au lieu de taper “oui” ou “c’est drôle”, vous pouvez simplement toucher un message et réagir. C’est plus rapide, plus expressif et plus naturel. L’agent peut aussi réagir à vos messages, vous obtenez donc un rapide “compris” visuel ou un “👍” sans réponse textuelle complète. C’est un petit changement qui rend les conversations beaucoup plus humaines.
Progression actuelle : Les fondations sont solides. L’outil côté agent (send_message(action="react")) existe déjà, et la convention entrante pour lire les réactions est établie sur toutes les plateformes. Le côté bureau est la seule page blanche — le plan note explicitement qu’un grep -ri reaction dans l’application de bureau ne trouve que des cœurs d’overlay pour animaux de compagnie. La tuyauterie de base est donc prête ; le travail sur l’interface utilisateur vient ensuite.
🌐 Serveur API compatible OpenAI
De quoi s’agit-il ? Imaginez votre agent Hermes comme une prise électrique universelle. Ce plan ajoute une prise standard (une API REST compatible OpenAI) à laquelle n’importe quelle interface de chat peut se brancher. Au lieu d’être enfermé dans l’interface propre à Hermes, vous pouvez utiliser Open WebUI, LobeChat, LibreChat, ou n’importe laquelle des dizaines d’interfaces de chat populaires qui parlent le “langage OpenAI”.
Avantages pour les utilisateurs : Le choix et la familiarité. Si vous aimez l’apparence et la sensation d’Open WebUI, vous pouvez le pointer vers votre backend Hermes et continuer à utiliser cette interface. Vous obtenez la puissance d’Hermes (gestion des sessions, utilisation d’outils, support multiplateforme) enveloppée dans n’importe quelle interface que vous connaissez et aimez déjà. Cela rend également Hermes instantanément compatible avec un vaste écosystème d’outils et d’intégrations existants.
Progression actuelle : C’est encore en phase de conception. Le plan présente deux options d’architecture et recommande clairement l’option A : la construire comme un nouvel adaptateur de plateforme de passerelle. Cette approche réutilise toute l’infrastructure de passerelle existante (authentification, sessions, construction de contexte), ce qui signifie moins de code à maintenir et moins de bugs. Les points de terminaison sont définis (/v1/chat/completions, /v1/models, /health), mais aucun code n’a encore été écrit.
⚡ Réponses LLM en streaming
De quoi s’agit-il ? Avez-vous déjà regardé ChatGPT taper sa réponse mot par mot ? C’est ça, le streaming. Ce plan ajoute la même livraison token par token à Hermes sur toutes les plateformes — CLI, Telegram, Discord, et le futur serveur API. Au lieu de fixer un indicateur “réflexion…” pendant dix secondes, vous voyez la réponse se matérialiser en direct.
Avantages pour les utilisateurs : Rapidité perçue et retour d’information. Même si le temps de génération total est le même, regarder le texte apparaître semble dramatiquement plus rapide. Cela vous permet aussi de saisir la direction de l’agent tôt et de l’interrompre s’il part en vrille. Le plan est contrôlé par un drapeau de fonctionnalité (streaming.enabled: true dans la config), c’est donc facultatif — si vous préférez le comportement actuel, rien ne change pour vous.
Progression actuelle : L’architecture est bien définie : un système basé sur des callbacks où l’agent IA émet des deltas de texte dans une file d’attente thread-safe, et chaque plateforme (CLI, passerelle, serveur API) consomme cette file à sa manière. Le plan indique explicitement que le cœur de l’agent est indépendant de la plateforme, et une dégradation gracieuse est intégrée — si un fournisseur ne prend pas en charge le streaming, il retombe silencieusement sur le chemin non-streaming. C’est le plan qui semble le plus proche d’être prêt pour l’implémentation.
🔮 Ce que tout cela signifie
Ces trois plans brossent un tableau clair : Hermes passe d’un outil puissant mais de niche à une plateforme flexible et interopérable. Les réactions aux messages rendent les conversations plus humaines. L’API compatible OpenAI fait d’Hermes un backend plug-and-play pour tout l’écosystème d’interfaces de chat. Le streaming rend chaque interaction rapide et réactive.
Ensemble, ils abaissent la barrière à l’entrée et élèvent le plafond de ce que vous pouvez faire. Vous pourrez utiliser Hermes avec votre interface préférée, voir ses réponses se taper en temps réel, et réagir aux messages d’une simple touche — le tout sans apprendre une nouvelle interface.
La feuille de route est un document vivant. L’équipe publie ces plans publiquement, et ils évoluent en fonction des retours de la communauté et de l’utilisation réelle. Revenez donc souvent — ce qui est “à venir” aujourd’hui pourrait déjà être entre vos mains demain. Et si vous avez des idées, le répertoire .plans est public pour une raison : votre voix peut façonner ce qui y atterrira ensuite.
📖 Documentation officielle
Cet article est basé sur la documentation officielle de Hermes Agent :GitHub ›/tree/main/.plans