🚀 Roadmap Ufficiale di Hermes: Cosa Aspetta in Arrivo?
Roadmap ufficiale di Hermes: reazioni ai messaggi, API server compatibile con OpenAI, supporto allo streaming
Hermes Agent pubblica apertamente i suoi piani di sviluppo nella directory .plans su GitHub, così puoi sempre dare un’occhiata sotto il cofano e vedere esattamente cosa sta costruendo il team.
💬 Reazioni ai Messaggi: Tapbacks sul Desktop
Cos’è: Pensa alla funzione “doppio tocco per il cuore” di Instagram o iMessage. Tocchi un messaggio e una piccola emoji (👍, ❤️, 😂, ecc.) appare sopra. Hermes sta portando questa stessa esperienza nella trascrizione desktop. Al momento, le reazioni esistono su piattaforme come Telegram, Slack e iMessage — ma l’app desktop è l’eccezione. Questo piano colma questa lacuna.
Vantaggio per gli utenti: Invece di digitare “sì” o “che divertente”, puoi semplicemente toccare un messaggio e reagire. È più veloce, più espressivo e sembra naturale. L’agente può anche reagire ai tuoi messaggi, così ricevi un rapido “ricevuto” visivo o un “👍” senza una risposta testuale completa. È un piccolo cambiamento che rende le conversazioni molto più umane.
Progressi attuali: Le fondamenta sono solide. Lo strumento lato agente (send_message(action="react")) esiste già, e la convenzione in entrata per leggere le reazioni è stabilita su tutte le piattaforme. Il lato desktop è l’unico foglio bianco — il piano nota esplicitamente che grep -ri reaction nell’app desktop trova solo cuoricini di overlay per animali domestici. Quindi l’infrastruttura di base è pronta; il lavoro sull’interfaccia utente è il prossimo passo.
🌐 Server API Compatibile con OpenAI
Cos’è: Immagina il tuo agente Hermes come una presa di corrente universale. Questo piano aggiunge una presa standard (un’API REST compatibile con OpenAI) a cui qualsiasi frontend di chat può collegarsi. Invece di essere bloccato nell’interfaccia di Hermes, puoi usare Open WebUI, LobeChat, LibreChat o una qualsiasi delle dozzine di interfacce chat popolari che parlano il “linguaggio OpenAI”.
Vantaggio per gli utenti: Scelta e familiarità. Se ami l’aspetto di Open WebUI, puoi puntarlo al tuo backend Hermes e continuare a usare quell’interfaccia. Ottieni la potenza di Hermes (gestione delle sessioni, uso degli strumenti, supporto multi-piattaforma) avvolta in qualsiasi frontend che già conosci e ami. Rende anche Hermes immediatamente compatibile con un enorme ecosistema di strumenti e integrazioni esistenti.
Progressi attuali: Questa è ancora in fase di progettazione. Il piano delinea due opzioni di architettura e raccomanda chiaramente l’Opzione A: costruirla come un nuovo adattatore di piattaforma gateway. Questo approccio riutilizza tutta l’infrastruttura gateway esistente (autenticazione, sessioni, costruzione del contesto), il che significa meno codice da mantenere e meno bug. Gli endpoint sono definiti (/v1/chat/completions, /v1/models, /health), ma nessun codice è stato ancora scritto.
⚡ Streaming delle Risposte LLM
Cos’è: Hai mai visto ChatGPT digitare la sua risposta parola per parola? Questo è lo streaming. Questo piano aggiunge la stessa consegna token-per-token a Hermes su tutte le piattaforme — CLI, Telegram, Discord e il futuro server API. Invece di fissare uno spinner “pensando…” per dieci secondi, vedi la risposta materializzarsi dal vivo.
Vantaggio per gli utenti: Velocità percepita e feedback. Anche se il tempo di generazione totale è lo stesso, guardare il testo apparire sembra drammaticamente più veloce. Ti permette anche di cogliere la direzione dell’agente presto e interromperlo se sta andando fuori strada. Il piano è dietro un flag di funzionalità (streaming.enabled: true nella configurazione), quindi è opzionale — se preferisci il comportamento attuale, nulla cambia per te.
Progressi attuali: L’architettura è ben definita: un sistema basato su callback in cui l’agente AI emette delta di testo in una coda thread-safe, e ogni piattaforma (CLI, gateway, server API) consuma quella coda a modo suo. Il piano afferma esplicitamente che il core dell’agente è agnostico rispetto alla piattaforma, e il degrado graduale è integrato — se un provider non supporta lo streaming, torna silenziosamente al percorso non-streaming. Questo sembra il più vicino alla prontezza per l’implementazione.
🔮 Cosa Significa Tutto Questo
Questi tre piani dipingono un quadro chiaro: Hermes sta maturando da uno strumento potente ma di nicchia a una piattaforma flessibile e interoperabile. Le reazioni ai messaggi rendono le conversazioni più umane. L’API compatibile con OpenAI rende Hermes un backend plug-and-play per l’intero ecosistema di chat-UI. Lo streaming rende ogni interazione scattante e reattiva.
Insieme, abbassano la barriera all’ingresso e alzano il tetto di ciò che puoi fare. Potrai usare Hermes con il tuo frontend preferito, vedere le sue risposte digitare in tempo reale e reagire ai messaggi con un semplice tocco — tutto senza imparare una nuova interfaccia.
La roadmap è un documento vivo. Il team pubblica questi piani pubblicamente e si evolvono in base al feedback della community e all’uso nel mondo reale. Quindi torna spesso a controllare — ciò che è “in arrivo” oggi potrebbe già essere nelle tue mani domani. E se hai idee, la directory .plans è pubblica per un motivo: la tua voce può plasmare ciò che arriverà dopo.
📖 Documentazione ufficiale
この記事は Hermes Agent のDocumentazione ufficialeに基づいています:GitHub ›/tree/main/.plans