🚀 Roteiro Oficial do Hermes: O Que Vem a Seguir?
Roteiro oficial do Hermes: reações a mensagens, servidor de API compatível com OpenAI, suporte a streaming
O Hermes Agent publica seus planos de desenvolvimento abertamente no diretório .plans do GitHub, então você pode sempre dar uma espiada nos bastidores e ver exatamente o que o time está construindo em seguida.
💬 Reações a Mensagens: Tapbacks no Desktop
O que é: Pense no recurso de “duplo toque para curtir” do Instagram ou do iMessage. Você toca em uma mensagem e um emoji (👍, ❤️, 😂, etc.) aparece nela. O Hermes está trazendo essa mesma experiência para o seu histórico de conversas no desktop. Atualmente, reações existem em plataformas como Telegram, Slack e iMessage — mas o aplicativo desktop é o único de fora. Este plano fecha essa lacuna.
Benefício para os usuários: Em vez de digitar “sim” ou “que engraçado”, você pode simplesmente tocar em uma mensagem e reagir. É mais rápido, mais expressivo e parece natural. O agente também pode reagir às suas mensagens, então você recebe um “entendido” visual rápido ou um “👍” sem uma resposta de texto completa. É uma mudança pequena que torna as conversas muito mais humanas.
Progresso atual: A base está sólida. A ferramenta voltada para o agente (send_message(action="react")) já existe, e a convenção de entrada para ler reações está estabelecida em todas as plataformas. O lado do desktop é a única página em branco — o plano observa explicitamente que grep -ri reaction no aplicativo desktop encontra apenas corações de sobreposição de pets. Então, o encanamento principal está pronto; o trabalho de UI é o próximo passo.
🌐 Servidor de API Compatível com OpenAI
O que é: Imagine seu agente Hermes como uma tomada universal. Este plano adiciona um soquete padrão (uma API REST compatível com OpenAI) na qual qualquer frontend de chat pode se conectar. Em vez de ficar preso à interface do próprio Hermes, você pode usar Open WebUI, LobeChat, LibreChat ou qualquer uma das dezenas de interfaces de chat populares que falam a “língua OpenAI”.
Benefício para os usuários: Escolha e familiaridade. Se você adora a aparência do Open WebUI, pode apontá-lo para o seu backend Hermes e continuar usando essa interface. Você obtém o poder do Hermes (gerenciamento de sessões, uso de ferramentas, suporte multiplataforma) embrulhado em qualquer frontend que você já conhece e ama. Isso também torna o Hermes instantaneamente compatível com um ecossistema massivo de ferramentas e integrações existentes.
Progresso atual: Isso ainda está na fase de design. O plano apresenta duas opções de arquitetura e recomenda claramente a Opção A: construí-lo como um novo adaptador de plataforma de gateway. Essa abordagem reutiliza toda a infraestrutura de gateway existente (autenticação, sessões, construção de contexto), o que significa menos código para manter e menos bugs. Os endpoints estão definidos (/v1/chat/completions, /v1/models, /health), mas nenhum código foi escrito ainda.
⚡ Respostas de LLM em Streaming
O que é: Você já viu o ChatGPT digitar sua resposta palavra por palavra? Isso é streaming. Este plano adiciona a mesma entrega token por token ao Hermes em todas as plataformas — CLI, Telegram, Discord e o futuro servidor de API. Em vez de ficar olhando para um spinner de “pensando…” por dez segundos, você vê a resposta se materializar ao vivo.
Benefício para os usuários: Velocidade percebida e feedback. Mesmo que o tempo total de geração seja o mesmo, ver o texto aparecer parece drasticamente mais rápido. Também permite que você perceba a direção do agente cedo e interrompa se ele estiver saindo dos trilhos. O plano é controlado por feature flag (streaming.enabled: true na configuração), então é opcional — se você preferir o comportamento atual, nada muda para você.
Progresso atual: A arquitetura está bem definida: um sistema baseado em callbacks onde o agente de IA emite deltas de texto em uma fila thread-safe, e cada plataforma (CLI, gateway, servidor de API) consome essa fila à sua maneira. O plano afirma explicitamente que o núcleo do agente é agnóstico de plataforma, e a degradação graciosa é incorporada — se um provedor não suportar streaming, ele silenciosamente volta para o caminho sem streaming. Este parece o mais próximo de estar pronto para implementação.
🔮 O Que Tudo Isso Significa
Esses três planos pintam um quadro claro: o Hermes está amadurecendo de uma ferramenta poderosa, mas de nicho, para uma plataforma flexível e interoperável. Reações a mensagens tornam as conversas mais humanas. A API compatível com OpenAI torna o Hermes um backend plug-and-play para todo o ecossistema de interfaces de chat. O streaming faz cada interação parecer ágil e responsiva.
Juntos, eles diminuem a barreira de entrada e elevam o teto do que você pode fazer. Você poderá usar o Hermes com seu frontend favorito, ver suas respostas serem digitadas em tempo real e reagir a mensagens com um simples toque — tudo sem aprender uma nova interface.
O roteiro é um documento vivo. O time publica esses planos publicamente, e eles evoluem com base no feedback da comunidade e no uso no mundo real. Então, volte sempre — o que é “próximo” hoje pode já estar em suas mãos amanhã. E se você tiver ideias, o diretório .plans é público por um motivo: sua voz pode moldar o que virá a seguir.
📖 Documentação oficial
この記事は Hermes Agent のDocumentação oficialに基づいています:GitHub ›/tree/main/.plans