Mixture of Agents – Cleverere Antworten
Mixture of Agents — Smarter Answers — easy-to-understand guide based on official docs
Mixture of Agents – Cleverere Antworten
Willkommen zurück zu unserer Serie darüber, wie du das Beste aus Hermes Agent herausholst! Heute tauchen wir in etwas ein, das kompliziert klingt, aber eigentlich ziemlich einfach ist, sobald du es in Aktion siehst: die Konfiguration deiner Modelle.
Stell es dir so vor: Dein Agent ist nicht nur ein Gehirn. Er ist eher wie ein kleines Team. Da ist der Hauptdenker – das Modell, das jede Konversation, jeden Tool-Aufruf und jede Antwort verarbeitet. Dann gibt es die Helfer – kleinere, schnellere Modelle, die Nebenaufgaben übernehmen, wie das Zusammenfassen von Webseiten, das Analysieren von Bildern oder das Komprimieren langer Gespräche.
Das Beste daran? Du entscheidest, wer in deinem Team ist. Lass uns durchgehen, wie das funktioniert.
Die Modell-Seite: Dein Kontrollzentrum
Öffne dein Hermes-Dashboard und klicke in der Seitenleiste auf Models. Du siehst zwei Dinge:
- Model Settings – das obere Panel, in dem du Modelle für verschiedene Aufgaben zuweist.
- Usage Analytics – eine Rangliste aller Modelle, die eine Sitzung ausgeführt haben, inklusive Token-Anzahl und Kosten.
Die Hauptzeile oben zeigt, was dein Agent für neue Sitzungen verwendet. Klicke auf Change, um den Auswahldialog zu öffnen.
Dein Hauptmodell auswählen
Der Auswahldialog hat zwei Spalten:
- Linke Seite: Deine authentifizierten Anbieter. Nur Anbieter, die du eingerichtet hast (mit einem API-Schlüssel oder OAuth), erscheinen hier. Wenn einer fehlt, gehe zu Keys, um ihn hinzuzufügen.
- Rechte Seite: Die kuratierte Liste der agentischen Modelle für diesen Anbieter. Das ist nicht die komplette Liste aller verfügbaren Modelle – nur die, die Hermes tatsächlich für Agentenarbeit empfiehlt.
Gib in das Filterfeld ein, um nach Anbieter, Slug oder Modell-ID zu suchen. Wähle eines aus, klicke auf Switch, und fertig. Hermes schreibt es automatisch in deine Konfigurationsdatei.
Wichtig: Das gilt nur für neue Sitzungen. Wenn du bereits einen Chat-Tab geöffnet hast, läuft dieser mit dem Modell weiter, mit dem er gestartet wurde. Für einen Wechsel mitten im Gespräch nutze den /model-Slash-Befehl.
Mitten in der Sitzung wechseln: Was du wissen solltest
Wenn du Modelle innerhalb einer aktiven Sitzung wechselst, führt Hermes eine schnelle Prüfung durch: Wird deine nächste Nachricht eine Kontextkomprimierung mit dem neuen Modell auslösen? Wenn dein Gespräch bereits lang ist, siehst du eine Warnung. Der Wechsel wird trotzdem sofort angewendet – die Komprimierung läuft einfach bei deiner ersten Nachricht nach dem Wechsel.
Hier ist der Haken: Wechsel mitten in der Sitzung setzen den Prompt-Cache zurück. Prompt-Caches sind an das Modell gebunden, das die Anfrage bedient. Wenn du also mitten im Gespräch das Modell wechselst, liest die nächste Nachricht den gesamten Chat zum vollen Preis erneut, statt zum vergünstigten Cache-Tarif. Bei einer langen Sitzung kann dieses einmalige Neulesen mehr kosten als der Unterschied zwischen den beiden Modellen. Wechsle, wenn du musst, aber bevorzugt früh in einem Gespräch.
Die Frage zum “Training mit deinen Daten”
Einige Modelle sind günstiger, weil der Anbieter möglicherweise mit deinen Prompts trainiert. Wenn du eines interaktiv auswählst, fragt Hermes immer zur Bestätigung. Aber was ist mit unbeaufsichtigten Aufgaben – wie Cron-Jobs oder Kanban-Workern, die ohne deine Aufsicht laufen?
Diese schlagen standardmäßig fehl (fail closed). Wenn du damit einverstanden bist, kannst du eine dauerhafte Bestätigung speichern:
hermes config set security.allow_data_training_tiers_noninteractive true
Hermes gibt trotzdem bei jedem Start die vollständige Datenrichtlinien-Warnung aus, sodass deine Logs einen Prüfpfad behalten. Widerrufe es jederzeit mit:
hermes config unset security.allow_data_training_tiers_noninteractive
Deine Helfer feinjustieren
Klicke auf Show auxiliary, um die 11 Aufgaben-Slots zu sehen – Dinge wie Kontextkomprimierung, Vision, Webseiten-Zusammenfassung, Genehmigungs-Scoring und mehr.
Jede Hilfsaufgabe ist standardmäßig auf auto gesetzt, was bedeutet, dass Hermes dein Hauptmodell auch für diese Aufgabe versucht. Wenn das fehlschlägt, greift es auf aufgabenspezifische Ketten zurück, dann auf deine Haupt-Fallback-Anbieter und schließlich auf die integrierte Discovery-Kette von Hermes.
Überschreibe eine bestimmte Aufgabe, wenn du ein günstigeres oder schnelleres Modell für eine Nebenaufgabe möchtest. Zum Beispiel könntest du ein großes, teures Modell für das Denken verwenden, aber ein kleines, schnelles für das Zusammenfassen von Webseiten.
Der schnellste Weg: Nous Portal
Wenn du 300+ Modelle unter einem Abonnement möchtest, schau dir das Nous Portal an. Bei einer frischen Installation führe einfach aus:
hermes setup --portal
Das meldet dich an und setzt Nous als deinen Anbieter in einem einzigen Befehl. Überprüfe, was eingerichtet ist, mit hermes portal info. Portal-Abonnenten erhalten außerdem 10 % Rabatt auf token-abgerechnete Anbieter.
Eine letzte Anmerkung
Bei einer brandneuen Installation enthält deine Konfiguration model: "" – ein leerer String, der bedeutet “noch nicht konfiguriert”. Beim ersten Ausführen von hermes setup oder hermes model wird das zu einem ordentlichen Mapping mit Anbieter, Standard, base_url und api_mode aktualisiert. Wenn du jemals einen leeren String siehst, führe einfach hermes model aus, und Hermes wird es für dich beheben.
Das war’s! Du bist jetzt ausgestattet, um dein Traumteam aus Modellen aufzubauen. Beim nächsten Mal schauen wir uns an, wie du deinen Agenten mit Fallback-Anbietern noch intelligenter machst. Bleib dran!
📖 Offizielle Dokumentation
この記事は Hermes Agent のOffizielle Dokumentationに基づいています:Offizielle Dokumentation › user-guide/configuring-models