Mac でローカルLLMを動かす
Run Local LLMs on Mac — easy-to-understand guide based on official docs
Mac でローカルLLMを動かす
MacでHermes Agentを動かしていて、ローカルLLMの世界に飛び込む準備ができたあなた。素晴らしい選択です!でも、チャットを始める前に、Hermesがモデルをどう扱うかを理解しておく必要があります。キッチンをセットアップするイメージで考えてみてください。メインのシェフがいて、特定のタスク用に専門のヘルパーが何人かいる、そんな感じです。
2種類のモデルスロット
Hermesは2種類のモデルスロットを使います:
- メインモデル — こちらはヘッドシェフです。すべてのユーザーメッセージ、すべてのツール呼び出しループ、すべてのストリーミング応答がこのモデルを通ります。オペレーションの頭脳です。
- 補助モデル — こちらはスーシェフたちです。コンテキスト圧縮、ビジョン(画像解析)、Webページ要約、承認スコアリング、MCPツールルーティング、セッションタイトル生成、スキル検索といった小さなサイドジョブを担当します。それぞれに専用スロットがあり、独立して上書きできます。
はじめに:最短ルート
Hermesが初めてなら、モデルを設定する最速の方法はNous Portalです。1つのサブスクリプションで300以上のモデルにアクセスできます。新規インストールなら、次のコマンドを実行するだけ:
hermes setup --portal
これでログインが完了し、プロバイダーとしてNousが設定されます。hermes portal infoで設定内容を確認できます。さらに、ポータル加入者はトークン課金プロバイダーが10%オフになります。悪くないでしょ?
モデルページ
ダッシュボードを開いて、サイドバーのModelsをクリックします。2つのセクションが表示されます:
- Model Settings — モデルをスロットに割り当てる上部パネル。
- Usage analytics — セッションを実行したすべてのモデルを、トークン数・コスト・機能バッジ付きで表示するランキングカード。
一番上のカードがModel Settingsパネルです。メイン行には、エージェントが新しいセッションで起動するモデルが表示されます。Changeをクリックしてピッカーを開きます。
メインモデルの設定
ピッカーには2つの列があります:
- 左 — 認証済みプロバイダー。設定済みのプロバイダー(APIキー設定済み、OAuth済み、カスタムエンドポイントとして定義済み)だけがここに表示されます。プロバイダーが見つからない場合は、Keysに移動して認証情報を追加してください。
- 右 — 選択したプロバイダーの厳選モデルリスト。Hermesが推奨するエージェント向けモデルで、生の
/modelsダンプ(OpenRouterではTTS、画像生成、リランカーを含む400以上のモデルがある)ではありません。
フィルターボックスに入力して、プロバイダー名・スラッグ・モデルIDで絞り込めます。モデルを選んでSwitchをクリックすると、Hermesが~/.hermes/config.yamlに書き込みます。これは新しいセッションにのみ適用されます — すでに開いているチャットタブは、開始時のモデルのまま動作し続けます。現在のチャットをホットスワップするには、その中で/modelスラッシュコマンドを使います。
セッション途中の切り替え:注意点
アクティブなセッション内でモデルを切り替えると、Hermesは次のメッセージが新しいモデルのウィンドウに対してプリフライトコンテキスト圧縮を実行するかどうかを推定します。セッションがすでにそのモデルの圧縮しきい値に近いか上回っている場合、警告が表示されます。切り替えはすぐに適用されますが、圧縮は切り替え後の最初のユーザーメッセージで実行されます。
重要: セッション途中の切り替えはプロンプトキャッシュをリセットします。プロンプトキャッシュはリクエストを処理するモデルに紐づいているため、会話途中でモデルを変更すると、次のメッセージはキャッシュされた割引レート(約75〜90%オフ)ではなく、全入力トークン価格で会話全体を再読み込みすることになります。長いセッションでは、この一度きりの再読み込みが2つのモデル間のトークン単価差を上回る可能性があります。必要なときは切り替えても構いませんが、会話の早い段階で行うのがおすすめです。
無人データ学習ティア
muse-spark-1.2-contributorのような一部のモデルは、ベンダーがプロンプトと応答を学習に使用する可能性があるため割引価格になっています。インタラクティブなモデル選択では常に確認プロンプトが表示されます。しかし、非インタラクティブな起動パス(Kanbanワーカーやcronエージェントなど)は、その質問ができないため、フェイルクローズ(安全側に倒す)します。
無人ワークロードのデータ学習が許容できる場合は、永続的な承認を記録します:
hermes config set security.allow_data_training_tiers_noninteractive true
Hermesは無人起動のたびに完全なデータポリシー警告を表示し続けるため、ワーカーログには監査証跡が残ります。取り消すには:
hermes config unset security.allow_data_training_tiers_noninteractive
補助モデルの設定
Show auxiliaryをクリックすると、11のタスクスロットが表示されます。すべての補助タスクはデフォルトでautoになっています — つまり、Hermesはそのジョブにもメインモデルを試します。そのルートが利用できない場合、autoはタスク固有のフォールバックチェーン、次にメインフォールバックチェーン、そしてHermesの組み込み補助ディスカバリーチェーンの順に従います。サイドジョブに安価または高速なモデルを使いたい場合は、特定のタスクを上書きします。
model:スキーマについての注意
新品のインストールでは、バンドルされているデフォルト設定にmodel: ""(「未設定」を意味する空文字列センチネル)があります。初めてhermes setupまたはhermes modelを実行すると、そのキーはprovider、default、base_url、api_modeのサブキーを持つマッピングにその場でアップグレードされます。config.yamlに空文字列が表示された場合は、hermes modelを実行するか(またはダッシュボードでChangeをクリック)、Hermesが辞書形式を書き込んでくれます。
以上です!これであなたもプロのようにモデルを設定できます。楽しいチャットを!
📖 公式ドキュメント
この記事は Hermes Agent の公式ドキュメントに基づいています:公式ドキュメント › guides/local-llm-on-mac