🚀 Hermes 公式ロードマップ: 次に何が来るのか?
Hermes 公式ロードマップ: メッセージリアクション、OpenAI互換APIサーバー、ストリーミングサポート
Hermes Agent は開発計画を GitHub の .plans ディレクトリで公開しています。いつでも内部を覗いて、チームが次に何を構築しているのかを正確に確認できます。
💬 メッセージリアクション:デスクトップ版タップバック
概要: Instagram や iMessage の「ダブルタップでハート」機能をイメージしてください。メッセージをタップすると、小さな絵文字(👍、❤️、😂 など)がそのメッセージにポップ表示されます。Hermes はこの同じ体験をデスクトップのトランスクリプトにも導入しようとしています。現在、リアクション機能は Telegram、Slack、iMessage などのプラットフォームには存在しますが、デスクトップアプリだけが取り残されています。この計画はそのギャップを埋めるものです。
ユーザーへのメリット: 「はい」や「それ面白い」とタイプする代わりに、メッセージをタップしてリアクションするだけです。より速く、より表現豊かで、自然な感覚です。エージェントもあなたのメッセージにリアクションできるので、完全なテキスト返信なしで、素早く視覚的な「了解」や「👍」を得られます。会話をはるかに人間らしく感じさせる小さな変化です。
現在の進捗状況: 基盤はしっかりしています。エージェント向けツール(send_message(action="react"))は既に存在し、リアクションを読み取るためのインバウンド規約も各プラットフォームで確立されています。デスクトップ側だけが空白の状態です。計画書には、デスクトップアプリ全体で grep -ri reaction を実行しても、ペットオーバーレイのハートしか見つからないと明記されています。つまり、コアとなる配管は準備完了で、次は UI 作業です。
🌐 OpenAI 互換 API サーバー
概要: Hermes エージェントを万能コンセントだと考えてみてください。この計画は、あらゆるチャットフロントエンドが接続できる標準ソケット(OpenAI 互換 REST API)を追加します。Hermes 独自のインターフェースに縛られる代わりに、Open WebUI、LobeChat、LibreChat、その他「OpenAI 言語」を話す数十の人気チャット UI を使用できます。
ユーザーへのメリット: 選択肢と親しみやすさです。Open WebUI のルックアンドフィールが気に入っているなら、それを Hermes バックエンドに接続して、そのインターフェースを使い続けることができます。Hermes のパワー(セッション管理、ツール使用、マルチプラットフォーム対応)を、既に知っていて愛用しているあらゆるフロントエンドで包んで利用できます。また、Hermes は既存の膨大なツールやインテグレーションのエコシステムと即座に互換性を持つようになります。
現在の進捗状況: これはまだ設計段階です。計画書では 2 つのアーキテクチャオプションが提示され、オプション A(新しいゲートウェイプラットフォームアダプタとして構築)を明確に推奨しています。このアプローチは、既存のゲートウェイインフラストラクチャ(認証、セッション、コンテキスト構築)をすべて再利用するため、保守するコードが減り、バグも少なくなります。エンドポイントは定義されています(/v1/chat/completions、/v1/models、/health)が、コードはまだ書かれていません。
⚡ LLM レスポンスのストリーミング
概要: ChatGPT が回答を単語ごとにタイプしていくのを見たことがありますか? あれがストリーミングです。この計画は、同じトークン単位の配信を CLI、Telegram、Discord、そして将来の API サーバーを含むすべてのプラットフォームの Hermes に追加します。10 秒間「考え中…」のスピナーを見つめる代わりに、レスポンスがライブで生成されていくのを見ることができます。
ユーザーへのメリット: 体感速度とフィードバックです。たとえ合計の生成時間が同じでも、テキストが表示されていくのを見るとはるかに速く感じます。また、エージェントの方向性を早い段階で把握し、軌道から外れている場合に中断することもできます。この計画はフィーチャーフラグ(設定で streaming.enabled: true)で管理されるため、オプトイン方式です。現在の動作を好む場合、何も変わりません。
現在の進捗状況: アーキテクチャは明確に定義されています。AI エージェントがテキストの差分をスレッドセーフなキューに出力し、各プラットフォーム(CLI、ゲートウェイ、API サーバー)がそのキューを独自の方法で消費する、コールバックベースのシステムです。計画書には、エージェントコアはプラットフォームに依存せず、グレースフルデグラデーション(段階的な機能低下)が組み込まれていると明記されています。プロバイダーがストリーミングをサポートしていない場合、静かに非ストリーミングパスにフォールバックします。これは実装準備が最も整っているように感じられます。
🔮 これが意味すること
これら 3 つの計画は明確な絵を描き出しています。Hermes は、強力だがニッチなツールから、柔軟で相互運用可能なプラットフォームへと成熟しています。メッセージリアクションは会話をより人間らしくします。OpenAI 互換 API は、Hermes をチャット UI エコシステム全体のドロップイン置き換え可能なバックエンドにします。ストリーミングは、すべてのインタラクションをキビキビとした応答性の高いものにします。
これらが一体となることで、参入障壁は低くなり、できることの上限は引き上げられます。お気に入りのフロントエンドで Hermes を使用し、その返信がリアルタイムで表示されるのを見て、シンプルなタップでメッセージにリアクションできるようになります。新しいインターフェースを学ぶ必要は一切ありません。
ロードマップは生きた文書です。チームはこれらの計画を公開しており、コミュニティのフィードバックや実際の使用状況に基づいて進化しています。ぜひ頻繁にチェックしてください。今日「次に来るもの」とされているものが、明日にはもう手元にあるかもしれません。そして、アイデアがあれば、.plans ディレクトリが公開されているのには理由があります。あなたの声が、次にそこに載るものを形作ることができるのです。
📖 公式ドキュメント
この記事は Hermes Agent の公式ドキュメントに基づいています:GitHub ›/tree/main/.plans