Hermes Agent: Das Praxishandbuch (2026)
# Ein Praxishandbuch zu Hermes Agent, dem selbstoptimierenden Open-Source-KI-Agenten von Nous Research: Anbieter-Authentifizierung und OAuth, Konfigurationsdateien, das Skills-System und der Betrieb als plattformübergreifendes Messaging-Gateway.
Kurz gesagt: Hermes Agent ist ein Open-Source-, selbstverbessernder AI-Agent von Nous Research. Er läuft als CLI und als plattformübergreifendes Messaging-Gateway, speichert eine dauerhafte Identität und persistenten Speicher auf dem Datenträger, bündelt skills, die sich mit der Nutzung verbessern, und funktioniert mit jedem OpenAI-kompatiblen LLM-Provider — Nous Portal, OpenRouter, Anthropic, GitHub Copilot, z.ai, Kimi, MiniMax, DeepSeek, Qwen Cloud, Hugging Face, Google, xAI/SuperGrok oder Ihrem eigenen selbstgehosteten Endpoint.1219 Seit v0.14.0 (16. Mai 2026) ergänzt Hermes SuperGrok OAuth mit grok-4.3-1M-Kontext, einen OpenAI-kompatiblen lokalen Proxy für OAuth-Provider (
hermes proxy), erstklassigesx_search, PyPI-Installationsunterstützung (seit v0.19.0 veraltet — der Einzeilen-Installer ist der unterstützte Weg), verzögerte Abhängigkeitsinstallationen, 28 Messaging-Plattformen mit LINE und SimpleX Chat,/handoff, semantische LSP-Diagnosen nach Schreibvorgängen, einheitlichesvideo_generate,computer_useüber cua-driver für Nicht-Anthropic-Provider, native Windows-Beta und 12 P0-/50-P1-Abschlüsse.19 Der schwierigste Teil für die meisten neuen Benutzer ist die Provider-Authentifizierung: Hermes unterstützt etwa 20 erstklassige Provider sowie benutzerdefinierte Endpoints und drei unterschiedliche Authentifizierungspfade (API-Key in.env, OAuth überhermes modeloder benutzerdefinierter Endpoint inconfig.yaml). Das Authentifizierungsmodell sollten Sie zuerst lernen — alles andere hängt davon ab, welcher Provider aufgelöst wird.
Hermes Agent arbeitet als vollständige Agent-Runtime, nicht als Chat-Wrapper. Er liest Ihr Dateisystem, führt Befehle in sandboxed Backends aus, durchsucht das Web, startet Subagents, führt geplante cron-Jobs aus, kommuniziert von einem einzigen Gateway-Prozess aus mit Telegram/Discord/Slack/WhatsApp/Signal/E-Mail und erstellt eigene skills aus Erfahrung.1 Die CLI ist eine Terminal-UI, die auf einer Konversationsschleife in run_agent.py aufbaut; das Gateway ist ein langlebiger Prozess, der Nachrichten von Messaging-Plattformen durch dieselbe Konversationsschleife leitet.3
Der Unterschied zwischen gelegentlicher und professioneller Hermes-Nutzung liegt in fünf Systemen. Beherrschen Sie diese, wird Hermes zu einem Produktivitätsmultiplikator:
- Provider-Auflösung: wie Authentifizierungsflüsse auf API-Aufrufe abgebildet werden
- Konfigurationshierarchie:
config.yaml+.env+auth.json+SOUL.md+AGENTS.md - Tool- + toolset-System: was der Agent tun kann, je Plattform begrenzt
- Skills-System: prozeduraler Speicher, den der Agent erstellt und weiterentwickelt
- Gateway + cron + profiles: Hermes dort ausführen, wo Sie leben, nicht nur dort, wo Sie gerade sind
Wichtigste Erkenntnisse
- Die Provider-Authentifizierung kennt drei Pfade, nicht nur einen. API-Key in
.env, OAuth überhermes model/hermes authoder benutzerdefinierter Endpoint inconfig.yaml. Wählen Sie den Pfad, der zu Ihrem Provider passt, nicht den, der Ihnen vertraut erscheint. - Der Providerwechsel ist ein einzelner Befehl.
hermes modelführt Sie interaktiv durch jeden unterstützten Provider einschließlich OAuth-Logins, und/model provider:modelwechselt mitten in der Sitzung, ohne den Verlauf zu verlieren.2 - Zwei Dateien bilden die vom Benutzer bearbeitbare Konfigurationsoberfläche.
~/.hermes/config.yamlenthält Einstellungen und~/.hermes/.enventhält Geheimnisse.auth.json,SOUL.md,MEMORY.mdundskills/werden direkt von Hermes verwaltet — Sie könnenSOUL.mdmanuell bearbeiten, doch den Rest bearbeitet der Agent selbst.4 - Hermes ist der Nachfolger von OpenClaw. Wenn Sie migrieren, importiert
hermes claw migrateautomatisch über 30 Zustandskategorien.5 - Die Dienstqualität hängt von Ihrem Hilfsmodell ab. Vision, Web-Zusammenfassungen, Komprimierung und Speicherbereinigung verwenden jeweils ein separates Hilfs-LLM. Standardmäßig ist dies Gemini Flash über automatische Erkennung (OpenRouter → Nous → Codex) — wenn keines davon konfiguriert ist, verschlechtern sich diese Funktionen unbemerkt, bis Sie die Hilfsslots auf Ihren Hauptprovider verweisen.4
Was sich mit v0.14 ändert
Bei v0.14.0 geht es weniger um eine einzelne Schlagzeilenfunktion als darum, den Einrichtungsaufwand zu verringern und Hermes an mehr Orten lauffähig zu machen.19 Die wichtigsten betrieblichen Änderungen:
- Installation und Start sind schlanker.
pip install hermes-agentfunktioniert über PyPI, umfangreiche Adapter werden bei der ersten Nutzung verzögert installiert, und der Startpfad verschiebt ausreichend Arbeit, um den Kaltstart um ungefähr 19 Sekunden zu verkürzen. (v0.19.0 hat pip-Installationen inzwischen verworfen — siehe Installation.) - Abonnements können zu lokalen API-Endpoints werden.
hermes proxymacht OAuth-gestützte Provider wie Claude Pro, ChatGPT Pro und SuperGrok zu einem OpenAI-kompatiblen lokalen Endpoint für Tools wie Codex, Aider, Cline und Continue. - Die Gateway-Reichweite wächst. LINE und SimpleX Chat erhöhen die Plattformzahl auf 22, Microsoft Teams ist vollständig integriert, das Nachladen des Discord-Verlaufs ist standardmäßig aktiviert, und Telegram-/Discord-
clarify-Prompts verwenden nun native Schaltflächen. - Die Überprüfung beim Schreiben verbessert sich. Nach Bearbeitungen kann Hermes Zusammenfassungen der Dateimutationen pro Turn sowie semantische Diagnosen des Language Servers vor dem nächsten Turn anzeigen, wodurch es evidenzbasierter Agent-Arbeit näherkommt.
- Desktop- und Medien-Tooling werden breiter.
computer_usefunktioniert über cua-driver für Nicht-Anthropic-Provider,video_generateist hinter austauschbaren Backends vereinheitlicht, undvision_analyzesendet rohe Pixel an Modelle, die tatsächlich sehen können.
Jeder folgende Abschnitt basiert auf der Upstream-Dokumentation unter hermes-agent.nousresearch.com/docs und dem Quellbaum unter github.com/NousResearch/hermes-agent. Jede Tatsachenbehauptung enthält eine Fußnote, die auf die jeweilige spezifische Upstream-Seite verweist.
Wählen Sie Ihren Weg
| Was Sie benötigen | Hier entlang |
|---|---|
| Hermes installieren | Installation — Einzeilen-Installer oder manuelle Schritte |
| Bei einem Provider anmelden | Authentifizierung & Provider — der Abschnitt, für den Sie hierhergekommen sind |
| Modelle mitten in der Sitzung wechseln | Der Befehl hermes auth und Benutzerdefinierte & selbstgehostete Endpoints für die /model-Syntax |
| Ein lokales LLM ausführen | Benutzerdefinierte & selbstgehostete Endpoints — Ollama, vLLM, SGLang, llama.cpp, LM Studio |
| Messaging-Plattformen verbinden | Messaging-Gateway — Telegram, Discord, Slack, WhatsApp, Signal, Google Chat, LINE, SimpleX Chat (insgesamt 22) |
| Einen skill schreiben oder installieren | Skills-System — schrittweise Offenlegung + Skill-Hub |
| Tiefgehende Referenz für jeden CLI-Befehl | Lesen Sie weiter — und verlinken Sie direkt auf CLI-Befehle |
So funktioniert Hermes: Das mentale Modell
Hermes ist um eine einzige Konversationsschleife herum aufgebaut, die von jedem Einstiegspunkt aufgerufen werden kann. Zu den Einstiegspunkten gehören die CLI (cli.py), das Messaging-gateway (gateway/run.py), der ACP-Adapter für die Editorintegration, der Batch-Runner und ein API-Server.3 Sie alle rufen letztlich AIAgent.run_conversation() in run_agent.py auf. Diese Methode:
- Erstellt über
prompt_builder.pyden System-Prompt ausSOUL.md,MEMORY.md,USER.md, skills, Kontextdateien und Tool-Anweisungen3 - Ermittelt über
runtime_provider.pyden Laufzeitanbieter – in diesem Schritt werden Ihre Authentifizierung, die Basis-URL und der API-Modus ausgewählt3 - Ruft den Anbieter in einem von drei API-Modi auf:
chat_completions,codex_responsesoderanthropic_messages3 - Leitet alle zurückgegebenen Tool-Aufrufe über
model_tools.pyund die zentrale Tool-Registry (tools/registry.py) weiter3 - Wiederholt die Schleife, bis das Modell eine endgültige Antwort erzeugt, und speichert die Sitzung anschließend mit FTS5 in SQLite3
Diese Schleife zu verstehen ist wichtig, da jede Funktion – Persönlichkeiten, Gedächtnis, skills, Komprimierung und Fallback – an eine dieser Phasen anknüpft. Wenn Sie einen Konfigurationsschlüssel lesen und sich fragen, was er bewirkt, lautet die Antwort meist: „Er ist ein Stellhebel für Phase 1, 2, 3 oder 4 der obigen Schleife.“
Plattformunabhängiger Kern. Eine einzige AIAgent-Klasse bedient CLI, gateway, ACP, Batch und den API-Server. Plattformspezifische Unterschiede liegen im Einstiegspunkt, nicht im Agenten selbst.3 Deshalb funktionieren dieselben Slash-Befehle sowohl im Terminal als auch in Telegram – sie werden über eine gemeinsame COMMAND_REGISTRY in hermes_cli/commands.py weitergeleitet.6
Die Verzeichnisstruktur ist das System. Hermes speichert alles unter ~/.hermes/ (oder bei nicht standardmäßigen profiles unter $HERMES_HOME):4
~/.hermes/
├── config.yaml # Settings (model, terminal, TTS, compression, etc.)
├── .env # API keys and secrets
├── auth.json # OAuth provider credentials (Nous Portal, Codex, Anthropic)
├── SOUL.md # Primary agent identity (slot #1 in system prompt)
├── memories/ # Persistent memory (MEMORY.md, USER.md)
├── skills/ # Bundled + agent-created + hub-installed skills
├── cron/ # Scheduled jobs
├── sessions/ # Gateway session state
└── logs/ # agent.log, gateway.log, errors.log (secrets auto-redacted)
Jede der oben aufgeführten Dateien erfüllt eine bestimmte Aufgabe; ihre Zuständigkeiten überschneiden sich nicht. Wenn Sie wissen möchten, „wo Hermes X speichert“, finden Sie es an einer dieser Stellen.
Neuerungen in v0.20.0 (The Herald Release)
Hermes Agent v0.20.0 (Tag v2026.8.3, 3. August 2026) ist das aktuelle Funktionsrelease; v0.20.1 (13. August) und v0.20.2 (16. August) sind darauf aufbauende Stabilisierungsversionen. Mit v0.20.3 (Tag v2026.8.16.2, veröffentlicht am 17. August) und v0.20.4 (Tag v2026.8.18, 18. August) setzt sich die Folge der Sammelreleases fort, jeweils mit eigenen neuen Funktionen – weitere Informationen finden Sie im nachfolgenden Unterabschnitt. Der Zeitraum seit v0.19.0 umfasst etwa 3.650 Commits, 1.400 zusammengeführte PRs und 1.200 geschlossene Issues von mehr als 650 Mitwirkenden.24
Drei Änderungen machen die Anweisungen früherer Versionen dieses Leitfadens hinfällig. Lesen Sie diese Hinweise zuerst:
- Node 26 ist jetzt erforderlich. Das Installationsprogramm setzt
NODE_VERSION="26"fest und verweigert ältere Laufzeitumgebungen mit der Meldung „Node.js … is too old (Hermes requires Node >=26).“ Installationsprogramme,healundupgradesetzen diese Voraussetzung allesamt durch. Beachten Sie, dass auf der Installationsseite der Dokumentationswebsite noch Node v22 angegeben ist – das Installationsskript und die Versionshinweise sind die neueren, maßgeblichen Quellen.24 - pip und Homebrew wurden eingestellt und nicht lediglich als veraltet markiert. Wörtlich heißt es: „brew + pip/PyPI wheel channels retired (shell installer / Docker / Nix are the supported channels).“ Wenn Sie Hermes weiterhin über pip oder brew installiert haben, erhalten Sie über diesen Weg keine neuen Releases mehr.24
- Das standardmäßige Iterationslimit für Tool-Aufrufe wurde von 90 auf 500 erhöht. Lange autonome Ausführungen stoßen damit nicht mehr an eine künstliche Grenze, und alle nachfolgend aufgeführten Schwellenwerte für Budgetengpässe werden anhand des neuen Höchstwerts berechnet.
read_fileliest standardmäßig außerdem 2.000 statt 500 Zeilen.24
Weitere Neuerungen des Releases:
- Konversationsfähige Sprachausgabe. Streaming-TTS mit Unterbrechungsmöglichkeit und lokal auf dem Gerät erkannten Aktivierungswörtern.24
- A2A v1.0. Ein Plugin für das Agent-zu-Agent-Protokoll, das die seit Langem bestehende Anfrage aus Issue #514 erfüllt.24
- Signierte ausgehende Webhooks.
hermes webhookunterstützte zuvor nur eingehende Webhooks; v0.20.0 ergänzt HMAC-signierte ausgehende Lebenszyklus-Webhooks für Sitzungs-, Turn- und Tool-Ereignisse.24 - Quellenbasierte Zitate. Ein neuer skill mit einem Faktenprüfungsmodus.24
- Neue Funktionen für CLI-Power-User. Mit
!commandkönnen Sie einen Shell-Befehl sofort ausführen, ohne einen Modell-Turn zu verbrauchen;/initdurchsucht das Projekt und erstellt oder aktualisiert eineAGENTS.md;/diffzeigt von jeder Oberfläche aus bereitgestellte, sämtliche oder sitzungsbezogene Änderungen;/contextschlüsselt auf, womit das Kontextfenster belegt ist;/focusbietet eine Ansicht mit reduzierter Ausgabe, in der ausgeblendete Zeilen wieder eingeblendet werden können; mit Strg+S lässt sich ein halb fertig geschriebener Prompt zwischenspeichern.hermes import-agentmigriert eine Claude Code- oder Codex-CLI-Konfiguration mit einem einzigen Befehl.24 - Erweiterungen der Geheimnisverwaltung. Eine auf Hilfsbefehlen basierende Geheimnisquelle, die sich mit jedem Tresor kombinieren lässt, Token-Rotation mit einem einzigen Befehl und aussagekräftigen Startfehlern, ein optionaler verschlüsselter Notfall-Cache für Bitwarden, pro profile-Home begrenzte, vom Tresor eingespeiste Schlüssel sowie
${env:VAR}-SecretRef-Parität zwischenconfig.yamlund der MCP-Konfiguration. Das nachfolgend beschriebene Authentifizierungsmodell mit drei Pfaden bleibt unverändert.24 - Schnellerer Warmstart. Die Kaltstartzeit von
hermes -wsank von etwa 14 s auf 1,8 s.24 - Desktop wurde zu einer Plattform. Artefakte mit versionierten Karten und isolierter Live-Vorschau, ein Plugin-SDK mit Kanban als erstem Desktop-Plugin, ein globales Tastenkürzel für die Schnelleingabe, mehrere GUI-Fenster, ein SSH-Remote-Backend-Modus und eine native Anmeldung nach RFC 8252.24
Die Sammelreleases v0.20.3 und v0.20.4 (17.–18. August)
Nach v0.20.0 folgt das Projekt einem Rhythmus häufig getaggter Sammelreleases, wobei die beiden neuesten mehr als reine Stabilisierungsversionen sind. Beide weisen darauf hin, dass „full curated release notes for this window will ship with v0.21.0“ – die folgenden Zusammenfassungen beruhen daher auf den Beschreibungen der jeweiligen Release-Zeiträume und nicht auf einer kuratierten Funktionsliste.23
v0.20.3 (ca. 250 Commits, ca. 125 PRs seit v0.20.2):
- Migration auf MCP 2.x SDK mit Unterstützung des zustandslosen Protokolls vom 28. Juli 2026. Hermes wechselt zur aktuellen MCP-SDK-Generation und unterstützt die zustandslose Revision des Protokolls.23
- Bot Mode wird als gebündeltes Plugin ausgeliefert (
hermes-bots), das das zentrale Teamkollegenprotokoll enthält.23 - Ein CommandCode-Anbieter-Plugin ergänzt den Anbieterkatalog.23
- Cua Driver 0.20-Laufzeitverträge für die Computernutzung sowie eine gehärtete Laufzeitzuständigkeit für den Subprozess Python (Isolierung von PYTHONHOME/PYTHONPATH).23
- Zuverlässigkeit: Selbstheilung des cron-Schedulers (EMFILE-Wiederherstellung, Abgleich veralteter Ansprüche, erneute Aktivierung festgefahrener Aufgaben), Korrekturen gegen Datenverluste bei Sitzungsübergaben, selbstheilende Verbindungen zum Desktop-Remote-gateway sowie zahlreiche Verbesserungen im Ökosystem (Sicherheitsscans bei der Plugin-Installation,
/worktree, Beibehaltung manueller Änderungen bei/rollback, Lesen von UTF-16-Dateien).23
v0.20.4 (ca. 146 Commits, ca. 74 PRs seit v0.20.3):
- Die Glasoberfläche des Desktops: Arbeiten an Mattglas und Transparenz mit einem Frost-Auswahlwerkzeug und macOS-Vorauswahl.23
- Eine SESSIONS|BOTS-Seitenleiste mit Tabs und Optionen zum Aus- und Einblenden einzelner Bots sowie Korrekturen für Bot Mode-Gruppenchats (lang laufende Mitglieder-Turns, Markdown-Darstellung, computerübergreifendes Routing).23
- NVIDIA SkillEvaluator Tier 1-Hinweisscans bei der Installation von skills – bei der Installation eines skill werden Lizenz- und Sicherheitsprüfungen ausgeführt.23
- Härtung des Medienversands über cron (konfigurierbares Zeitlimit, Anhänge bei manueller Ausführung, Anzeige verpasster Ausführungen), Korrekturen an Event-Loop-Threads und bei Zugriffskonflikten in SessionDB, ehrliche Statusmeldungen von
hermes updatebei geparkten Branches sowie native Betriebssystembenachrichtigungen für Kanban.23
Die Aktualisierung erfolgt weiterhin unverändert: bei einer bestehenden Installation mit hermes update, bei einer Neuinstallation über das Shell-Installationsprogramm.23
Neu in v0.19.0 (The Quicksilver Release)
Hermes Agent v0.19.0 (Tag v2026.7.20, 20. Juli 2026) ist nach der Geschwindigkeit des Götterboten benannt: Das Rückgrat des Releases ist reine Reaktionsfähigkeit, mit einer Verkürzung der Time-to-First-Token in der ersten Runde um ~80 % auf allen Plattformen. Darum gruppieren sich Terminal-Abrechnung, Secret-Quellen aus Passwortmanagern, standardmäßig intelligente Genehmigungen, beobachtbare Subagents und absturzsichere Antwortzustellung. Das Zeitfenster seit v0.18.0 ist das bislang größte Projektfenster: ~2.245 Commits, ~1.065 zusammengeführte PRs, ~3.300 geschlossene Issues und über 450 Community-Mitwirkende.25
- ~80 % schneller zum ersten Token, überall. Das kalte Submit→Dispatch sank über CLI, gateway, TUI, Desktop und cron hinweg von ~4,3 s auf ~0,9 s — die Discord-Fähigkeitserkennung wurde aus dem kritischen Pfad entfernt, der Ollama-Probe wird bei bekannten Nicht-Ollama-Providern übersprungen, und blockierende Arbeit wurde aus der Agent-Initialisierung entfernt. Auch die wahrgenommene Latenz wurde verbessert: Reasoning-Modelle streamen ihre Überlegungen nun standardmäßig live (
display.show_reasoningist ON), und das Antwortfeld rendert pro Token statt pro Zeile.25 - Rendering-Welle für Desktop und TUI. Die Desktop-App erhielt eine Geschwindigkeitsüberholung mit ~20 PRs: 14× weniger CPU im Streaming-Markdown-Splitter durch inkrementelles Block-Lexing, virtualisierte Diffs im Review-Bereich, zügiger Sitzungswechsel bei großen Transkripten sowie keine erneuten Renders der Seitenleiste und Tool-Zeilen mehr pro Token. Die TUI rendert gestreamtes Markdown nun inkrementell pro Block.25
- pip- und Homebrew-Installationen sind veraltet. Beide Wege wurden als „unsupported legacy“-Installationen markiert, ihre Entfernung war geplant. Diese Entfernung ist inzwischen in v0.20.0 erfolgt — die brew- und pip/PyPI-Wheel-Kanäle wurden eingestellt; unterstützt bleiben der Shell-Installer, Docker und Nix.2524
- Secrets können aus Ihrem Passwortmanager stammen. Eine neue steckbare
SecretSource-Schnittstelle ruft Secrets beim Laden aus Bitwarden und 1Password (op://-Referenzen) ab, unterstützt mehrere Vaults gleichzeitig, deterministische Priorität, Konfliktwarnungen und die Herkunft jeder Variablen — API-Schlüssel müssen nicht länger in einer Klartext-.envliegen. Künftige Vault-Provider lassen sich als Plugins ergänzen.25 - Intelligente Genehmigungen sind jetzt Standard. Wenn Hermes einen markierten Befehl ausführen möchte, bewertet ein unabhängiger LLM-Reviewer ihn, statt Sie bei jedem einzelnen Befehl zu fragen — und jedes Urteil gilt nur für genau diesen Befehl. Benutzerdefinierte deny rules blockieren passende Befehle selbst im YOLO-Modus,
/deny <reason>übermittelt Ihren Ablehnungsgrund, damit der Agent seinen Kurs korrigiert, und die Plugin-Aktionpre_tool_callapprove (mit Rule-Keys wieder eingeführt) eskaliert einen Tool-Aufruf zu einer menschlichen Freigabe.25 - Terminal-Abrechnung:
/subscriptionund/topup. Verwalten Sie Ihren Nous Portal-Plan, ohne das Terminal zu verlassen — sehen Sie Ihren Plan und das verbleibende Kontingent, prüfen Sie exakt, was ein Upgrade kostet oder wann ein Downgrade wirksam wird, und wenden Sie es mit Rückgängig-Option an. Die Desktop-App erhält einen passenden Abrechnungs-Tab in den Einstellungen.25 - Beobachten Sie Subagents bei der Arbeit; verlieren Sie nie wieder eine fertige Antwort.
delegate_task-Dispatches liefern Live-Transkriptdateien zurück, die Sie mittail -fverfolgen können, sobald Subagents starten — jeder Tool-Aufruf, jedes Ergebnis und jede gestreamte Antwort, ein menschenlesbares Log pro Child. Abschlüsse von Hintergrunddelegierungen bleiben Neustarts überdauernd erhalten, und finale gateway-Antworten werden in einem delivery-obligation ledger instate.dberfasst und beim nächsten Start erneut zugestellt, falls das gateway während des Sendens ausfällt. Die Konfigurationsoptionmax_async_childrenist zugunsten einheitlicher Concurrency-Limits für Delegierungen veraltet.25 - Ein gateway, viele profile. Ein einzelnes multiplexed gateway, das einen Bot-Token teilt, kann bestimmte Guilds, Channels oder Threads an unterschiedliche profile weiterleiten — jeweils mit vollständig isolierter Konfiguration, skills, memory und secrets — mit einem
GATEWAY_MULTIPLEX_PROFILES-Override. Der Routing-Index wurde nachstate.dbverschoben;sessions.jsonist nun ein optionaler Legacy-Spiegel.25 - Provider- und Modell-Welle. Fireworks AI kommt als First-Class-Provider hinzu (Kostenschätzung, Platz 2 im Provider-Picker), ergänzt durch DeepInfra und Upstage Solar. Die Kataloge erhalten GPT-5.6 (Sol/Terra/Luna + Pro, Ende-zu-Ende verdrahtet), grok-4.5 (GA), kimi-k3 (kimi-k2.x eingestellt) und vollständig verdrahtetes Claude Sonnet 5. Ein
enabled: false-Flag pro Provider und die Konfigurationexcluded_providersentfernen ungenutzte Provider aus/model-Pickern und der Auflösung.25 - Reasoning effort wird zum Regler. Neue Effort-Stufen
maxundultrakommen auf allen Oberflächen hinzu, mit modellbezogenen Overrides in der Konfiguration, Effort pro Slot in MoA-Presets (Advisors denken intensiv nach, der Synthesizer bleibt schnell), taskbezogenem Effort für Hilfsmodelle und einem sitzungsbezogenen/reasoningin CLI.25 - CLI- und MCP-Oberfläche.
hermes sessions exportschreibt Markdown-, Quarto-, HTML-, Prompt-only- und Hugging-Face-Trace-Formate mit optionaler Bereinigung über--redact;/model --onceermöglicht einen Modell-Override für eine Runde; Slash-skill-Aufrufe lassen sich stapeln (/skill-a /skill-b do XYZ);--safe-modeunterstützt die Fehlerbehebung;hermes config get/unsetvervollständigen die Konfigurationsverwaltung;hermes servewird zu einem echten Headless-Backend; und MCP-Tools übernehmen die Namenskonventionmcp__server__tool.25
Wenn Sie von v0.18.x aktualisieren, verdienen zwei Änderungen vor allem anderen Aufmerksamkeit: Eine pip- oder Homebrew-Installation warnt nun als unsupported legacy (migrieren Sie zum Einzeilen-Installer), und max_async_children ist zugunsten der einheitlichen Concurrency-Limits für Delegierungen veraltet. Alles andere ist additiv — die wichtigsten Gründe für ein Upgrade sind die ~80%ige Verringerung der Latenz in der ersten Runde, intelligente Genehmigungen und das Delivery Ledger, das fertige Antworten absturzsicher macht.
Neu in v0.18.0 (The Judgment Release)
Hermes Agent v0.18.0 (Tag v2026.7.1, 1. Juli 2026) ist nach Urteilsvermögen benannt: Der Agent überprüft seine eigene Arbeit, anstatt Erfolg zu behaupten, und Ensemble Reasoning, das Sie tatsächlich prüfen können. Außerdem schließt es den gesamten P0/P1-Backlog — ungefähr 692 Aufgaben mit höchster Priorität wurden innerhalb von zwölf Tagen erledigt.22
- Mixture-of-Agents als First-Class-Modell. MoA ist nun wie jedes andere Modell über alle Oberflächen hinweg auswählbar, und Ensemble Reasoning ist sichtbar: Die vollständige Ausgabe jedes Referenzmodells wird als eigener beschrifteter Block mit Live-Antwortstreaming gerendert — Sie können dem Ensemble beim Denken zusehen, statt eine intransparente zusammengeführte Antwort zu erhalten.22
- Completion contracts für
/goal. Der Agent überprüft seine eigene Arbeit, indem er die Projektprüfungen ausführt, bevor er ein Ziel als abgeschlossen meldet, statt Erfolg zu behaupten — auf sich selbst angewandtes Urteilsvermögen.22 /learn— beschreiben Sie beliebige Vorgänge als skill. Verwandeln Sie einen Workflow in einen wiederverwendbaren skill, indem Sie ihn beschreiben; generierte skills entsprechen automatisch den CONTRIBUTING.md-Konventionen des Repositorys.22/journey-Timeline. Eine visuelle Historie von memory und skills im Zeitverlauf, inklusive Bearbeitung, sowie ein Memory-Graph auf dem Desktop.22- Fan-out von Hintergrund-Subagents. Delegieren Sie mehrere Aufgaben, die gleichzeitig ausgeführt werden, ohne die Unterhaltung zu blockieren — aus dem einzelnen Hintergrund-Subagent von v0.17.0 wird eine Flotte.22
- Desktop Projects. First-Class-Coding-Projects mit einem Organisationsmodell aus Projekt/Repository/Lane.22
- Scale-to-zero gateway. Gateways können bei Inaktivität ruhen und Drains für nahtlose Deployments koordinieren — relevant für alle, die Hermes als dauerhaft laufenden Dienst betreiben.22
- Google Vertex AI-Unterstützung. Gemini-Zugriff über GCP-Service-Accounts mit automatischer Aktualisierung des OAuth2-Tokens, ergänzt den Provider-Katalog.22
- Editor-Befehl
/prompt. Öffnet$EDITORzum Verfassen mehrzeiliger Prompts, statt mit der Eingabezeile zu kämpfen.22
Wenn Sie von v0.17.x aktualisieren, unterbricht hier nichts CLI. Die wichtigsten Gründe für ein Upgrade sind Completion contracts (Ziele, die sich selbst überprüfen), First-Class-MoA mit prüfbaren Ensembles und /learn zum Erfassen von skills.
Neuerungen in v0.17.0 (das Reach Release)
Hermes Agent v0.17.0 (Tag v2026.6.19, 19. Juni 2026) ist danach benannt, wie weit der Agent inzwischen reicht — neue Messaging-Kanäle, neue Modellanbieter sowie umfassendere Desktop- und Dashboard-Steuerung. Es ergänzt v0.16.x; die CLI-Oberfläche bleibt unverändert.21
- Neue Messaging-Kanäle. iMessage funktioniert jetzt ohne Mac-Relay über Photon Spectrum (Gerätecode-OAuth,
hermes photon login); die WhatsApp Business Cloud API ist ein offizieller Meta-Adapter, der die Anforderung eines Bridge-Prozesses ersetzt; SimpleX erhält Gruppen, native Anhänge, Text-Batching und automatische Annahme; außerdem kommt Raft als gebündeltes Plattform-Plugin mit einem datenschutzvertraglich gestalteten Wake-Channel hinzu.21 - Neue Modelle und Anbieter. Der Katalog ergänzt
z-ai/glm-5.2(1M Kontext),anthropic/claude-fable-5,laguna-m.1,nemotron-3-ultraundgrok-composer-2.5-fast(Cursors Modell über xAI OAuth, 200k Kontext). Der xAI-Standard wurde aufgrok-build-0.1umgestellt, und adaptive Anthropic-Modelle folgen nun dem modernen Thinking-Vertrag (sie senden niemals einreasoning-Feld).21 - Desktop und Dashboard. Der Desktop ergänzt Hintergrund-Subagents mit Live-Streaming delegierter Aktivitäten in „Watch Windows“ (
delegate_task(background=true)), eine Composer-Modellauswahl, neu belegbare Tastenkürzel, native Betriebssystembenachrichtigungen, Composer-Entwürfe pro Thread, Themes aus dem VS Code Marketplace sowie eine Benutzeroberfläche auf Japanisch und traditionellem Chinesisch. Das Dashboard ergänzt einen vollständigen Profile Builder (Modelle/Skills/MCPs ohne Bearbeitung vonconfig.yaml), einen globalen Profilumschalter, einen überarbeiteten Skills Hub mit Sicherheitsprüfung, Automation Blueprints (parametrisierte Vorlagen für Formulare, Slash Commands, Unterhaltungen und Dokumente) sowie einen sicheren Login, der hinter dem OAuth-Gate 401 zurückgibt.21 - Skills und Tools.
image_generatekann nun ein Quellbild bearbeiten und transformieren, statt nur eines von Grund auf zu erstellen — bei allen unterstützten Bildanbietern; dasmemory-Tool erhielt einoperations-Array für atomare Batch-Vorgänge zum Hinzufügen/Ersetzen/Entfernen in einem einzigen Aufruf; ein neuersimplify-code-Skill führt eine parallele Prüfung und Bereinigung durch drei Agents aus, die über eine Chesterton’s-Fence-Risikostufe gesteuert wird; und ein boolescheswrite_approvalersetzt das dreistufigewrite_mode.21 - Architektur. Hintergrund-Subagents geben sofort ein Handle zurück und führen ihr Ergebnis als neuen Turn wieder ein; ein MCP-Elicitation-Handler ermöglicht Bestätigungen während eines Tool-Aufrufs, und sich spät verbindende MCP-Tools werden zwischen Turns bereitgestellt (cache-sicher); cron wird zu einem pluggable CronScheduler mit einem Chronos-Managed-Cron-Anbieter; und ein neuer Managed Scope (
/etc/hermes) ermöglicht Administratoren, benutzerunveränderliche Konfiguration festzulegen — neben einem Gateway-Gateway-Relay für Multi-Gateway-Topologien.21 - Neue Befehle.
/version,/billing(interaktive Terminal-Abrechnung),hermes photon login(iMessage-Authentifizierung) undhermes curator run --consolidate— die Konsolidierung ist nun optional, sodass die reguläre Hintergrund-Kuration keine Tokens kostet.21 - Sicherheit. v0.17.0 schließt einen Bypass der Shell-Escape-Denylist, schlägt bei fehlenden Approval-Modulen und Gateway-Adaptern mit eigener Richtlinie sicher fehl, bereinigt die Umgebung für Cron-Job-Skript-Subprozesse, schwärzt Secrets in Request-Debug-Dumps, prüft MCP-Stdio-Konfigurationen auf Exfiltrationsmuster und aktualisiert urllib3 sowie PyJWT zur Behebung von CVEs.21
Wenn Sie von v0.16.x aktualisieren, beeinträchtigt nichts davon die CLI; es handelt sich um neue Kanäle, Modelle und Oberflächen rund um denselben Agenten. Die relayfreie iMessage-Integration, die offiziellen WhatsApp-Adapter und der administrative Managed Scope sind die wichtigsten Gründe für ein Upgrade.
Neuerungen in v0.16.0 (das Surface Release)
Hermes Agent v0.16.0 (Tag v2026.6.5, 5. Juni 2026) ist nach den neuen Oberflächen benannt, die es dem CLI-zentrierten Agenten voranstellt. Die wichtigste Neuerung: Hermes ist nicht länger auf das Terminal beschränkt.20
- Native Desktop-App. Hermes Desktop ist eine neue Electron-App für macOS, Linux und Windows mit Ein-Klick-Installation und Selbstaktualisierung in der App. Sie bietet Ihnen ein Chatfenster mit Streaming, Drag-and-drop-Dateien, Einfügen von Zwischenablagebildern, eine
Cmd+K-Palette, eine Sitzungsliste mit Archiv und Suche sowie eine Modellauswahl in der Statusleiste. Über ein sicheres WebSocket kann sie sich mit einem entfernten Hermes gateway verbinden und authentifiziert sich über OAuth oder Benutzername/Passwort; dabei stehen Remote-Hosts pro Profil und parallele Sitzungen mehrerer Profile zur Verfügung, die über profilübergreifende@session-Referenzen verbunden sind. Die Desktop-Benutzeroberfläche enthält außerdem eine vollständige Übersetzung ins vereinfachte Chinesisch (简体中文) über eine typisierte i18n-Schicht (display.language; Englisch bleibt die Standardsprache).20 - Browser-Admin-Panel. Das lokale Web-Dashboard entwickelte sich von einer Statusansicht zu einem vollständigen Administrationspanel: ein MCP-Katalog mit Ein-/Aus-Schaltern, Verwaltung von Zugangsdaten, Erstellung von Webhooks und Hooks, Speicherkonfiguration, Gateway-Steuerung und eine Systemseite mit Prüfung vor Updates sowie Debug Share per Klick. Eine neue Channels-Seite konfiguriert jede Gateway-Messaging-Plattform (Telegram, Discord, Slack und weitere) im Browser. Die Authentifizierung ist nun austauschbar: Login mit Benutzername/Passwort, ein generischer selbstgehosteter OIDC-Anbieter,
hermes dashboard registerfür einen selbstgehosteten OAuth-Client sowie Sitzungsrotation mittels Refresh Tokens.20 - Neue CLI und Slash Commands.
/undo [N]sichert die letzten N Benutzer-Turns mit vorausgefüllter Eingabe und Soft Delete und funktioniert in der CLI, der TUI sowie plattformübergreifend in Messaging-Diensten. Eine konfigurierbare Standardoberfläche (cligegenübertui) wird zusammen mit einer--cli-Überschreibung eingeführt; die TUI erhält einen einheitlichen/model-Befehl und ein Sessions-Overlay.hermes portalist ein menschenlesbarer Alias für den Nous Portal-Onboarding-Ablauf, mit neuen Erststartpfaden für Quick Setup gegenüber Full Setup; zudem kommen zwei Diagnosebefehle hinzu:hermes prompt-sizeundhermes sessions optimize.20 - Neue Modelle und Anbieter. Die Auswahl ergänzt
deepseek-v4-flash,MiniMax-M3(1M Kontext, native MiniMax-Anbieter),qwen3.7-plus(Nous + OpenRouter) undgemini-3.5-flash(Gemini OAuth + API Key). Ein erstklassiger xAI Grok OAuth-Anbieter kommt zum Desktop-Launcher hinzu, die Modellauswahl unterstützt nun unscharfe Suche auf allen Oberflächen, Anbieter mit mehreren Endpoints werden unter einer Zeile zusammengefasst und die Aktualisierung des Katalogs erfolgt statt täglich nun stündlich.20 - Schlankere Skills und Progressive Disclosure. Der Standard-Skillsatz entfernte redundante und ungenutzte Skills (Spotify wechselte zu einem nativen Plugin, Linear zu
hermes mcp install linear, und mehrere veraltete Einträge wurden entfernt), verlagerte weitere in optional und ergänzte einenvironments:-Frontmatter-Relevanz-Gate (kanban/docker/s6), das kontextspezifische Skills bis zur Anforderung aus dem Index heraushält.NVIDIA/skillsist nun neben OpenAI, Anthropic und HuggingFace eine standardmäßig vertrauenswürdige Skills-Hub-Quelle. MCP- und Plugin-Tools erhielten progressive (scoped) Tool Disclosure, und ein MCP-Fehler, der bei fehlendem Token fälschlich einen OAuth-Erfolg meldete, wurde behoben.20 - Sicherheit. v0.16.0 fixiert gepatchtes Starlette (≥1.0.1) für CVE-2026-48710 (BadHost), verlagert SSRF-URL-Prüfungen in asynchronen Pfaden aus der Event Loop, entfernt den Bedrock-Inference-Bearer-Token aus der Subprozessumgebung, fügt
bws_cache.jsonzum Dateisicherheits-Leseschutz hinzu, ergänztdocker restart/stop/killin der Liste gefährlicher Muster und bereinigt unsichtbares Unicode in geprüften Skill-Inhalten. Das Release schloss 2 P0- und 62 P1-Issues, davon waren 16 mit Security getaggt.20
Wenn Sie von v0.15.x aktualisieren, ist nichts davon eine inkompatible Änderung an der CLI selbst; es sind ergänzende Oberflächen und Anbieter rund um denselben Agenten. Die Desktop-App und das Admin-Panel sind der Grund für ein Upgrade, wenn Sie Hermes für Benutzer ohne Terminal einsetzen oder ein entferntes gateway über einen Browser verwalten möchten.
Installation
Der Einzeilen-Installer ist der unterstützte Installationsweg. Er übernimmt Python, uv, Node.js, ripgrep, ffmpeg, das Klonen des Repositorys, die virtuelle Umgebung und den globalen Befehl hermes.7
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
Installationen über pip und Homebrew sind seit v0.19.0 veraltet. Das mit v0.14.0 eingeführte PyPI-Paket (
pip install hermes-agent) und die Homebrew-Formel sind nun als Installationen mit „unsupported legacy“-Status gekennzeichnet — Hermes warnt überall davor (ohne die Nutzung zu blockieren), sobald eine davon erkannt wird; die Veröffentlichung über PyPI/Homebrew soll entfernt werden. Wenn Sie über pip oder brew installiert haben, migrieren Sie zum obigen Installer.25
Funktioniert unter Linux, macOS, WSL2 und Android/Termux (der Installer erkennt Termux automatisch und wechselt zu einem getesteten Android-Bundle).7 Native Windows-Unterstützung ist inzwischen eine Tier-1-Plattform statt der mit v0.14.0 ausgelieferten frühen Beta — installieren Sie sie mit iex (irm https://hermes-agent.nousresearch.com/install.ps1). Einen Vorbehalt nennen die Dokumente ausdrücklich: macOS wird nur auf Apple Silicon unterstützt; Intel-Macs werden nicht unterstützt.24 Historisch gesehen ergänzte v0.14.0 die native Windows-Unterstützung als frühe Beta über einen PowerShell-Installer, doch WSL2 bleibt für den produktiven Einsatz die sicherere Empfehlung, bis der Windows-Pfad ausgereift ist.19
Nach Abschluss:
source ~/.bashrc # or ~/.zshrc
hermes # Start chatting
Die einzige Voraussetzung ist git. Der Installer richtet Python 3.11 über uv automatisch ein (kein sudo erforderlich), außerdem Node.js 26 (für Browserautomatisierung und die WhatsApp-Bridge), ripgrep und ffmpeg. Node 26 ist seit v0.20.0 eine zwingende Mindestversion — der Installer lehnt alles Ältere ab und installiert stattdessen ein von Hermes verwaltetes Node.247
Installation überprüfen
hermes version # Check version
hermes doctor # Diagnose config/dependency issues
hermes status # Show current configuration + auth state
hermes dump # Copy-pasteable setup summary for debugging
hermes doctor zeigt Ihnen genau, was fehlt und wie Sie es beheben können.7 hermes dump ist der Diagnosebefehl, den Sie bei einer Hilfeanfrage in ein GitHub-Issue oder einen Discord-Thread einfügen sollten — er liefert eine Klartextzusammenfassung Ihrer gesamten Einrichtung, wobei Geheimnisse geschwärzt werden.8
Manuelle Installation
Wenn Sie vollständige Kontrolle benötigen — eine benutzerdefinierte Python-Version, bestimmte Extras oder Nix/NixOS-Integration — ist der manuelle Ablauf Schritt für Schritt im Upstream-Installationsleitfaden dokumentiert.7 Wichtige optionale Extras, die Sie mit uv pip install -e ".[<extras>]" kombinieren können:
| Extra | Was hinzugefügt wird |
|---|---|
all |
Alles unten Aufgeführte |
messaging |
Telegram- und Discord-gateway |
cron |
Parsing von Cron-Ausdrücken |
cli |
Terminal-Menüoberfläche für den Einrichtungsassistenten |
modal |
Modal-Cloud-Ausführungs-Backend |
voice |
CLI-Mikrofoneingabe und Audiowiedergabe |
tts-premium |
ElevenLabs-Premiumstimmen |
honcho |
KI-native Memory (Honcho-Integration) |
mcp |
Unterstützung für Model Context Protocol |
homeassistant |
Home-Assistant-Integration |
acp |
Unterstützung für die ACP-Editorintegration |
slack |
Slack-Messaging |
pty |
PTY-Terminalunterstützung (interaktive CLI-Tools) |
dev |
pytest- und Testwerkzeuge |
termux |
Getestetes Android-Bundle (enthält cron, cli, pty, mcp, honcho, acp) |
Der Termux-Installationsbefehl unterscheidet sich — er verwendet pip mit einer Constraints-Datei, nicht uv pip:
python -m pip install -e ".[termux]" -c constraints-termux.txt
Der Grund: .[all] zieht auf Android über das Extra voice faster-whisper nach, das von ctranslate2-Wheels abhängt, die nicht für Android veröffentlicht werden.7
Authentifizierung & Anbieter
Hermes unterstützt etwa 22 erstklassige Anbieter sowie benutzerdefinierte Endpunkte (v0.19.0 ergänzt Fireworks AI, DeepInfra und Upstage Solar) und drei unterschiedliche Authentifizierungswege. Hier finden Sie die gesamte Authentifizierungsoberfläche, nach Pfaden organisiert, damit Sie den passenden Weg für Ihre Voraussetzungen finden.
Die drei Authentifizierungspfade
Jeder Anbieter in Hermes folgt einem von drei Authentifizierungsmustern:
Pfad 1 — API-Schlüssel in .env. Hinterlegen Sie Ihren Schlüssel in ~/.hermes/.env; Hermes liest ihn beim Start ein. Verwendet für OpenRouter, AI Gateway, z.ai/GLM, Kimi/Moonshot, MiniMax (und MiniMax China), Alibaba Cloud/DashScope, Kilo Code, OpenCode Zen, OpenCode Go, DeepSeek, Hugging Face, Google/Gemini und die meisten Drittanbieter.2 Seit v0.19.0 muss der Schlüssel nicht mehr in einer Klartextdatei liegen: Eine einsteckbare SecretSource-Schnittstelle kann Geheimnisse beim Laden aus Bitwarden oder 1Password (op://-Referenzen) abrufen, wobei mehrere Tresore gleichzeitig aktiviert werden können, eine deterministische Priorität, Konfliktwarnungen und eine Herkunft pro Variable vorhanden sind — .env bleibt der Fallback. (Dies unterscheidet sich vom Bootstrap-Token des Bitwarden Secrets Manager aus v0.15.0, der Anbieterschlüssel hinter einem Token zusammenführte; SecretSource ersetzt die Klartextdatei selbst, und künftige Tresoranbieter lassen sich als Plugins hinzufügen.)25
Pfad 2 — OAuth über hermes model oder hermes auth. Startet einen Device-Code-Flow, öffnet einen Browser und speichert Anmeldedaten in ~/.hermes/auth.json (und kann vorhandene Anmeldedaten aus Tools wie Claude Code oder Codex CLI importieren). Verwendet für Nous Portal, OpenAI Codex (ChatGPT-Konto), GitHub Copilot und Anthropic (Claude Pro/Max).2
Pfad 3 — Benutzerdefinierter Endpunkt in config.yaml. Für jeden OpenAI-kompatiblen API — Ollama, vLLM, SGLang, llama.cpp, LM Studio, LiteLLM-Proxy, Together AI, Groq, Azure OpenAI oder Ihren eigenen selbstgehosteten Server. Einmalig über hermes model → Custom endpoint konfiguriert und anschließend in config.yaml gespeichert.2
Die vollständige Anbietermatrix
Dies ist die vollständige Liste erstklassiger Anbieter mit dem genauen Einrichtungsablauf für jeden einzelnen.2
| Anbieter | Authentifizierungspfad | Einrichtung |
|---|---|---|
| Nous Portal | OAuth | hermes model (OAuth-Anmeldung, abonnementbasiert) |
| OpenAI Codex | OAuth | hermes model (ChatGPT-Device-Code, verwendet Codex-Modelle) |
| GitHub Copilot | OAuth oder Token | hermes model (OAuth-Device-Code), oder COPILOT_GITHUB_TOKEN / GH_TOKEN / gh auth token |
| GitHub Copilot ACP | Lokaler Unterprozess | hermes model (erfordert copilot CLI in PATH + copilot login) |
| Anthropic | OAuth oder API-Schlüssel | hermes model (bevorzugt Claude Code-Anmeldedaten), oder ANTHROPIC_API_KEY, oder ANTHROPIC_TOKEN-Setup-Token |
| OpenRouter | API-Schlüssel | OPENROUTER_API_KEY in ~/.hermes/.env |
| AI Gateway (Vercel) | API-Schlüssel | AI_GATEWAY_API_KEY in ~/.hermes/.env (Anbieter: ai-gateway) |
| z.ai / GLM (ZhipuAI) | API-Schlüssel | GLM_API_KEY in ~/.hermes/.env (Anbieter: zai) |
| Kimi / Moonshot | API-Schlüssel | KIMI_API_KEY in ~/.hermes/.env (Anbieter: kimi-coding). v0.19.0 ergänzt kimi-k3 in den Katalogen (kimi-k2.x eingestellt).25 |
| MiniMax (global) | API-Schlüssel | MINIMAX_API_KEY in ~/.hermes/.env (Anbieter: minimax) |
| MiniMax China | API-Schlüssel | MINIMAX_CN_API_KEY in ~/.hermes/.env (Anbieter: minimax-cn) |
| Alibaba Cloud (Qwen) | API-Schlüssel | DASHSCOPE_API_KEY in ~/.hermes/.env (Anbieter: alibaba, Aliasse: dashscope, qwen) |
| Kilo Code | API-Schlüssel | KILOCODE_API_KEY in ~/.hermes/.env (Anbieter: kilocode) |
| OpenCode Zen | API-Schlüssel | OPENCODE_ZEN_API_KEY in ~/.hermes/.env (Anbieter: opencode-zen) |
| OpenCode Go | API-Schlüssel | OPENCODE_GO_API_KEY in ~/.hermes/.env (Anbieter: opencode-go) |
| DeepSeek | API-Schlüssel | DEEPSEEK_API_KEY in ~/.hermes/.env (Anbieter: deepseek) |
| Hugging Face | API-Schlüssel | HF_TOKEN in ~/.hermes/.env (Anbieter: huggingface, Alias: hf) |
| Google / Gemini | API-Schlüssel | GOOGLE_API_KEY oder GEMINI_API_KEY in ~/.hermes/.env (Anbieter: gemini) |
| Fireworks AI | API-Schlüssel | Erstklassiger Anbieter mit Kostenschätzung und zwischengespeicherten Preisspalten in der Modellauswahl; auf Position 2 in den Anbieterauswahlen vorgerückt. Neu in v0.19.0.25 |
| DeepInfra | API-Schlüssel | Erstklassiger Anbieter mit gehärteter Integration. Neu in v0.19.0.25 |
| Upstage Solar | API-Schlüssel | Erstklassiger Anbieter. Neu in v0.19.0.25 |
| xAI (Grok) | Nativer Anbieter / SuperGrok OAuth | Erstklassiger Anbieter mit direktem API-Zugang und Modellkatalog (v0.9.0+). v0.14.0 ergänzt SuperGrok OAuth und erhöht grok-4.3 für berechtigte Konten auf ein Kontextfenster von 1 Mio. Tokens.21619 v0.17.0 ergänzt grok-composer-2.5-fast (Cursors Modell über xAI OAuth, 200k Kontext) und setzt den xAI-Standard auf grok-build-0.1.21 v0.19.0 verschiebt grok-4.5 im Katalog in GA.25 |
| xAI Custom Voices | API-Schlüssel | TTS-Anbieter mit Stimmklonung. Neu in v0.13.0; unter tts: in config.yaml konfigurieren und den xAI-Schlüssel in .env hinterlegen.18 |
| Xiaomi MiMo | Nativer Anbieter | Erstklassiger Anbieter mit Einrichtungsassistent und Modellkatalog. Kostenloses MiMo v2 Pro auf Nous Portal für Nebenaufgaben (v0.9.0+).1615 |
| Google AI Studio | API-Schlüssel | GOOGLE_API_KEY oder GEMINI_API_KEY in ~/.hermes/.env. Direkter Gemini-Zugang mit automatisch erkannten Kontextlängen über die models.dev-Registry (v0.8.0+).15 |
| Qwen Cloud | OAuth | OAuth-Anbieter mit Unterstützung für Portal-Anfragen (v0.8.0+). Der Anbieter wurde in v0.14.0 von Alibaba Cloud in Qwen Cloud umbenannt; vorhandene Konfigurationsschlüssel funktionieren weiterhin.1519 |
| Benutzerdefinierter Endpunkt | config.yaml | hermes model → „Custom endpoint“ (in config.yaml gespeichert) |
Ab v0.19.0 können Sie außerdem nicht verwendete Anbieter ausblenden: Ein anbieterbezogenes Flag enabled: false sowie der Konfigurationsschlüssel excluded_providers entfernen sie aus /model-Auswahlen und der integrierten Anbieterauflösung.25
Anthropic: Drei Authentifizierungsmethoden
Anthropic erhält einen eigenen Abschnitt, weil Hermes drei unterschiedliche Wege zu Claude unterstützt und die richtige Wahl wichtig ist. Aus der Upstream-Dokumentation:2
# Method 1: API key (pay-per-token)
export ANTHROPIC_API_KEY=***
hermes chat --provider anthropic --model claude-sonnet-4-6
# Method 2: OAuth through hermes model (preferred)
# Uses Claude Code's credential store when available
hermes model
# Method 3: Manual setup-token (fallback/legacy)
export ANTHROPIC_TOKEN=***
hermes chat --provider anthropic
# Auto-detect Claude Code credentials
hermes chat --provider anthropic # reads Claude Code files automatically
Wenn Sie Anthropic OAuth über hermes model auswählen, bevorzugt Hermes den eigenen Anmeldedatenspeicher von Claude Code, statt das Token in ~/.hermes/.env zu kopieren. Dadurch bleiben aktualisierbare Claude-Anmeldedaten aktualisierbar.2 Falls Sie Claude Code bereits auf demselben Rechner verwenden, ist dies der sauberste Weg.
Um Anthropic dauerhaft in config.yaml festzulegen:
model:
provider: "anthropic"
default: "claude-sonnet-4-6"
--provider claude und --provider claude-code funktionieren ebenfalls als Kurzform für --provider anthropic.2
GitHub Copilot: Zwei Modi
Copilot wird in zwei Modi unterstützt: direkter Copilot-API (empfohlen) und Copilot ACP (startet den lokalen Copilot CLI als Unterprozess).2
# Direct Copilot API
hermes chat --provider copilot --model gpt-5.4
# Copilot ACP (requires the Copilot CLI in PATH + an existing copilot login)
hermes chat --provider copilot-acp --model copilot-acp
Die Authentifizierung wird laut Upstream-Dokumentation in dieser Reihenfolge geprüft:2
1. Umgebungsvariable COPILOT_GITHUB_TOKEN
2. Umgebungsvariable GH_TOKEN
3. Umgebungsvariable GITHUB_TOKEN
4. gh auth token CLI-Fallback
5. OAuth-Device-Code-Anmeldung über hermes model
Der Tokentyp ist entscheidend. Der Copilot-API unterstützt keine klassischen Personal Access Tokens (ghp_*). Unterstützte Typen sind OAuth-Tokens (gho_*), fein abgestufte PATs (github_pat_* mit der Berechtigung Copilot Requests) und GitHub-App-Tokens (ghu_*). Falls Ihr gh auth token ein ghp_*-Token zurückgibt, verwenden Sie stattdessen hermes model, um sich über OAuth zu authentifizieren.2
Chinesische AI-Anbieter (erstklassige Unterstützung)
Hermes bietet integrierte Unterstützung für z.ai/GLM, Kimi/Moonshot, MiniMax (globale + China-Endpunkte) und Alibaba Cloud mit dedizierten Anbieter-IDs.2
# z.ai / ZhipuAI GLM
hermes chat --provider zai --model glm-5 # Requires: GLM_API_KEY
# Kimi / Moonshot AI
hermes chat --provider kimi-coding --model kimi-for-coding # Requires: KIMI_API_KEY
# MiniMax (global)
hermes chat --provider minimax --model MiniMax-M2.7 # Requires: MINIMAX_API_KEY
# MiniMax (China)
hermes chat --provider minimax-cn --model MiniMax-M2.7 # Requires: MINIMAX_CN_API_KEY
# Alibaba Cloud / DashScope (Qwen)
hermes chat --provider alibaba --model qwen3.5-plus # Requires: DASHSCOPE_API_KEY
Basis-URLs können mit den Umgebungsvariablen GLM_BASE_URL, KIMI_BASE_URL, MINIMAX_BASE_URL, MINIMAX_CN_BASE_URL oder DASHSCOPE_BASE_URL überschrieben werden.2
Z.AI erkennt den Endpunkt automatisch. Bei Verwendung des z.ai/GLM-Anbieters prüft Hermes mehrere Endpunkte (globale, chinesische und Coding-Varianten), um einen zu finden, der Ihren API-Schlüssel akzeptiert. Der funktionierende Endpunkt wird automatisch zwischengespeichert — für die meisten Benutzer ist kein GLM_BASE_URL erforderlich.2
xAI (Grok) aktiviert Prompt-Caching automatisch. Wenn die Basis-URL x.ai enthält, sendet Hermes bei jeder Anfrage den Header x-grok-conv-id, um innerhalb einer Konversationssitzung auf denselben Server zu routen und zwischengespeicherte Systemprompts und den Verlauf wiederzuverwenden.2 Automatisch; keine Konfiguration erforderlich.
Der Befehl hermes auth
hermes auth ist der Befehl zur Verwaltung von Anmeldedaten für Pools und OAuth-Anmeldedaten.6
hermes auth # Interactive wizard
hermes auth list # Show all credential pools
hermes auth list openrouter # Show one provider's pool
hermes auth add openrouter --api-key sk-or-v1-xxx
hermes auth add anthropic --type oauth
hermes auth remove openrouter 2 # Remove by index
hermes auth reset openrouter # Clear cooldowns
Anmeldedatenpools ermöglichen die Rotation mehrerer API-Schlüssel oder OAuth-Tokens für denselben Anbieter — nützlich, um Ratenlimits über mehrere Schlüssel zu verteilen, ohne Code zu ändern.6 Die veralteten Befehle hermes login / hermes logout wurden entfernt; verwenden Sie stattdessen hermes auth.6
Benutzerdefinierte & selbstgehostete Endpunkte
Hermes funktioniert mit jedem OpenAI-kompatiblen API-Endpunkt. Wenn ein Server /v1/chat/completions implementiert, können Sie Hermes darauf verweisen.2
Interaktive Einrichtung (empfohlen):
hermes model
# Select "Custom endpoint (self-hosted / VLLM / etc.)"
# Enter: API base URL, API key, Model name
Manuelle config.yaml:
model:
default: your-model-name
provider: custom
base_url: http://localhost:8000/v1
api_key: your-key-or-leave-empty-for-local
Beide Ansätze werden in config.yaml gespeichert; dies ist die zentrale Quelle für Hauptmodell, Anbieter und Basis-URL.2 Die veralteten Umgebungsvariablen OPENAI_BASE_URL und LLM_MODEL werden nicht mehr für die Hauptmodellkonfiguration gelesen — verwenden Sie hermes model oder bearbeiten Sie config.yaml direkt.2 (OPENAI_BASE_URL + OPENAI_API_KEY werden weiterhin als Fallback für den zusätzlichen Routingpfad provider: "main" berücksichtigt; löschen Sie sie daher nicht unbedacht, falls Sie sie dort verwenden.)4
Benutzerdefinierte Endpunkte während einer Sitzung wechseln:
/model custom:qwen-2.5 # Custom endpoint with explicit model
/model custom # Auto-detect the model from the endpoint
/model custom:local:qwen-2.5 # Named custom provider "local"
/model custom:work:llama3 # Named custom provider "work"
/model openrouter:claude-sonnet-4 # Back to a cloud provider
/model custom (ohne Modellnamen) fragt den /v1/models API Ihres Endpunkts ab und wählt das Modell automatisch, wenn genau eines geladen ist — nützlich für lokale Server, auf denen ein einzelnes Modell läuft.2
Lokale LLM-Server (Einrichtungsvorlagen)
Die Upstream-Dokumentation enthält vollständige Einrichtungsanleitungen für Ollama, vLLM, SGLang, llama.cpp und LM Studio. Hier sind die zentralen Befehle, die Sie tatsächlich ausführen werden. Jeder ist darauf ausgelegt, einen funktionierenden Endpunkt bereitzustellen, auf den Hermes verweisen kann.2
Ollama — der einfachste lokale Weg, ohne Konfiguration:
ollama pull qwen2.5-coder:32b
OLLAMA_CONTEXT_LENGTH=32768 ollama serve # Raise from 4k default
hermes model # Custom endpoint → http://localhost:11434/v1 → qwen2.5-coder:32b
Wichtiger Ollama-Stolperstein: Ollama verwendet standardmäßig sehr geringe Kontextlängen (4.096 Tokens bei weniger als 24 GB VRAM). Sie müssen sie über OLLAMA_CONTEXT_LENGTH oder eine Modelfile erhöhen — der OpenAI-kompatible API akzeptiert keine Kontextlänge vom Client, sodass Hermes sie nicht für Sie festlegen kann.2 Für die Verwendung als Agent sollten Sie mindestens 16k–32k einstellen.
vLLM — leistungsstarkes GPU-Serving:
pip install vllm
vllm serve meta-llama/Llama-3.1-70B-Instruct \
--port 8000 \
--max-model-len 65536 \
--tensor-parallel-size 2 \
--enable-auto-tool-choice \
--tool-call-parser hermes
Tool-Aufrufe erfordern --enable-auto-tool-choice und --tool-call-parser <name>. Unterstützte Parser: hermes (Qwen 2.5, Hermes 2/3), llama3_json, mistral, deepseek_v3, deepseek_v31, xlam, pythonic. Ohne diese Flags werden Tool-Aufrufe als Klartext zurückgegeben.2
SGLang — schnelles Serving mit RadixAttention zur Wiederverwendung des KV-Cache:
pip install "sglang[all]"
python -m sglang.launch_server \
--model meta-llama/Llama-3.1-70B-Instruct \
--port 30000 \
--context-length 65536 \
--tp 2 \
--tool-call-parser qwen
SGLang-Stolperstein: Der Standardwert für max_tokens ist 128. Legen Sie auf dem Server --default-max-tokens fest oder konfigurieren Sie model.max_tokens in config.yaml, falls Antworten abgeschnitten werden.2
llama.cpp / llama-server — CPU und Apple Silicon Metal:
./build/bin/llama-server \
--jinja -fa \
-c 32768 \
-ngl 99 \
-m models/qwen2.5-coder-32b-instruct-Q4_K_M.gguf \
--port 8080 --host 0.0.0.0
--jinja ist für Tool-Aufrufe erforderlich. Ohne diese Option ignoriert llama-server den Parameter tools vollständig, und das Modell versucht, Tools durch Schreiben von JSON in seinem Antworttext aufzurufen — was Hermes nicht als tatsächliche Tool-Aufrufe analysieren kann.2
LM Studio — Desktop-App mit GUI:
Starten Sie den Server über die LM Studio-App (Tab „Developer“ → „Start Server“) oder über CLI: lms server start (startet auf Port 1234) und lms load qwen2.5-coder --context-length 32768.2 Verweisen Sie anschließend hermes model auf http://localhost:1234/v1.
Wichtiger LM Studio-Stolperstein: LM Studio liest die Kontextlänge aus den Modellmetadaten, doch viele GGUF-Modelle melden Standardwerte von 2048 oder 4096. Legen Sie die Kontextlänge in den LM Studio-Modelleinstellungen immer ausdrücklich fest — klicken Sie auf das Zahnradsymbol neben der Modellauswahl, setzen Sie „Context Length“ auf mindestens 16384 (vorzugsweise 32768) und laden Sie das Modell neu.2
Benannte benutzerdefinierte Anbieter
Falls Sie mit mehreren benutzerdefinierten Endpunkten arbeiten (beispielsweise einem lokalen Entwicklungsserver und einem entfernten GPU-Server), definieren Sie sie als benannte benutzerdefinierte Anbieter in config.yaml:2
custom_providers:
- name: local
base_url: http://localhost:8080/v1
# api_key omitted — Hermes uses "no-key-required" for keyless local servers
- name: work
base_url: https://gpu-server.internal.corp/v1
api_key: corp-api-key
api_mode: chat_completions # optional, auto-detected from URL
- name: anthropic-proxy
base_url: https://proxy.example.com/anthropic
api_key: proxy-key
api_mode: anthropic_messages # for Anthropic-compatible proxies
Wechseln Sie dann während einer Sitzung mit der Dreifachsyntax zwischen ihnen:
/model custom:local:qwen-2.5
/model custom:work:llama3-70b
/model custom:anthropic-proxy:claude-sonnet-4
Sie können benannte benutzerdefinierte Anbieter auch über das interaktive Menü hermes model auswählen.2
Einsteckbare Anbieterarchitektur (v0.13.0+)
v0.13.0 liefert eine ProviderProfile-ABC sowie ein Verzeichnis plugins/model-providers/, damit sich externe Inferenzanbieter ohne Änderungen am Kern hinzufügen lassen.18 Falls ein Anbieter einen OpenAI-, Anthropic- oder Codex-kompatiblen API-Modus unterstützt, können Sie eine ProviderProfile-Unterklasse implementieren, welche Authentifizierungspfad, Basis-URL, Modellkatalog und Caching-Header deklariert; Hermes löst sie über denselben runtime_provider.py-Pfad auf, den auch die integrierten Anbieter verwenden. Diese Architekturänderung steht hinter der Anbietererweiterung in v0.13.0: Statt den Kerncode zur Aufnahme eines Anbieters zu bearbeiten, liefern Sie ein Plugin aus.
OpenAI-kompatibler lokaler Proxy (v0.14.0+)
hermes proxy stellt einen OpenAI-kompatiblen lokalen Endpunkt bereit, der auf dem OAuth-Anbieter basiert, bei dem Hermes bereits angemeldet ist — Claude Pro, ChatGPT Pro, SuperGrok oder einem anderen kompatiblen konfigurierten Anbieter.19 Das bedeutet, dass Tools mit einem OpenAI-ähnlichen API, darunter Codex CLI, Aider, Cline, Continue oder benutzerdefinierte Skripte, Ihre abonnementbasierte Hermes-Authentifizierung ohne separaten API-Schlüssel wiederverwenden können. Behandeln Sie den Proxy als lokale Entwickler-Infrastruktur: Binden Sie ihn bewusst, machen Sie ihn nicht breit verfügbar und beachten Sie anbieterspezifische Bedingungen.
Erkennung der Kontextlänge
Laut Upstream-Dokumentation werden zwei Einstellungen ständig verwechselt:2
context_length— das gesamte Kontextfenster (kombiniertes Eingabe- + Ausgabe-Tokenbudget, z. B. 1.000.000 für Claude Opus 4.7 oder 200.000 für Sonnet 4.6). Hermes verwendet dies, um zu entscheiden, wann der Verlauf komprimiert werden soll.model.max_tokens— die Ausgabebegrenzung (maximale Anzahl Tokens, die das Modell in einer einzelnen Antwort erzeugen darf). Hat nichts mit der Verlaufslänge zu tun.
Legen Sie context_length fest, wenn die automatische Erkennung die Fenstergröße falsch bestimmt:
model:
default: "qwen3.5:9b"
base_url: "http://localhost:8080/v1"
context_length: 131072 # tokens
Hermes verwendet eine mehrstufige Auflösungskette zur Erkennung von Kontextfenstern: Konfigurationsüberschreibung → benutzerdefinierter Anbieter pro Modell → persistenter Cache → Endpunkt /models → Anthropic /v1/models → OpenRouter API → Nous Portal → models.dev (von der Community gepflegte Registry für mehr als 3800 Modelle) → Fallback-Standardwerte (128K).2 Das System ist anbieterbewusst, daher kann dasselbe Modell je nach bereitstellendem Anbieter unterschiedliche Kontextgrenzen haben (z. B. ist claude-opus-4.6 direkt bei Anthropic 1M, bei GitHub Copilot jedoch 128K).2
Intelligentes Modellrouting: Anbieterrotation & Fallback
Hermes bindet Sie nicht an ein Modell bei einem Anbieter. Intelligentes Modellrouting umfasst die Mechanismen, die entscheiden, welcher Anbieter und welches Modell eine bestimmte Anfrage tatsächlich bedient: Anmeldedatenpools verteilen die Last auf Schlüssel, ein konfigurierter Fallback übernimmt bei Ausfall des primären Modells, und die unten stehenden zusätzlichen Slots leiten Nebenaufgaben unabhängig von Ihrem Hauptmodell an günstigere Modelle weiter.26 Konfigurieren Sie diese drei gemeinsam — sie machen den Unterschied zwischen einem Agenten, der an einem Ratenlimit hängen bleibt, und einem, der weiterarbeitet.
Anmeldedatenpools. Wenn Sie mehrere API-Schlüssel für denselben Anbieter haben, konfigurieren Sie über hermes auth eine Rotationsstrategie. So verteilen Sie Ratenlimits auf mehrere Schlüssel.6
Fallback-Modell. Konfigurieren Sie ein Ersatz-provider:model, zu dem Hermes automatisch wechselt, wenn Ihr primäres Modell ausfällt (Ratenlimits, Serverfehler, Authentifizierungsfehler):2
fallback_model:
provider: openrouter # required
model: anthropic/claude-sonnet-4 # required
# base_url: http://localhost:8000/v1 # optional, for custom endpoints
# api_key_env: MY_CUSTOM_KEY # optional, env var name
Der Fallback wechselt Modell und Anbieter mitten in der Sitzung, ohne Ihre Konversation zu verlieren. Er wird höchstens einmal pro Sitzung ausgelöst.2 Unterstützte Anbieter für Fallbacks: openrouter, nous, openai-codex, copilot, copilot-acp, anthropic, huggingface, zai, kimi-coding, minimax, minimax-cn, deepseek, ai-gateway, opencode-zen, opencode-go, kilocode, alibaba, custom.2
Zusätzliche Modelle
Hermes verwendet schlanke „zusätzliche“ Modelle für Nebenaufgaben: Bildanalyse, Zusammenfassung von Webseiten, Analyse von Browser-Screenshots, Klassifizierung der Freigabe gefährlicher Befehle, Kontextkomprimierung, Zusammenfassung der Sitzungssuche, Skill-Abgleich, MCP-Tool-Dispatch und Memory-Flush.4 Standardmäßig verwenden diese Gemini Flash über die automatische Erkennung (OpenRouter → Nous → Codex).
Sie können konfigurieren, welches Modell und welcher Anbieter für jede zusätzliche Aufgabe verwendet wird. Jeder zusätzliche Slot verwendet dieselben drei Stellschrauben: provider, model, base_url.4
auxiliary:
vision:
provider: "auto" # "auto", "openrouter", "nous", "codex", "main", etc.
model: "" # e.g. "openai/gpt-4o", "google/gemini-2.5-flash"
base_url: "" # Custom OpenAI-compatible endpoint
api_key: "" # Falls back to OPENAI_API_KEY
timeout: 30
download_timeout: 30
web_extract:
provider: "auto"
model: ""
timeout: 360
approval:
provider: "auto"
model: ""
timeout: 30
compression:
timeout: 120
session_search: { provider: "auto", model: "", timeout: 30 }
skills_hub: { provider: "auto", model: "", timeout: 30 }
mcp: { provider: "auto", model: "", timeout: 30 }
flush_memories:{ provider: "auto", model: "", timeout: 30 }
Die Anbieteroption "main" bedeutet „den Anbieter verwenden, den mein Hauptagent nutzt“ — sie ist nur innerhalb der Konfigurationen auxiliary:, compression: und fallback_model: gültig. Für Ihre Einstellung model.provider auf oberster Ebene ist sie nicht gültig. Wenn Sie einen benutzerdefinierten OpenAI-kompatiblen Endpunkt als Hauptmodell verwenden, setzen Sie in Ihrem Abschnitt model: provider: custom.4
Warum das wichtig ist: Falls Sie nur Anthropic OAuth konfiguriert haben (ohne OpenRouter-Schlüssel), werden Ihre Bildverarbeitung, Webzusammenfassung und Komprimierung beeinträchtigt oder schlagen fehl, weil die standardmäßige zusätzliche Fallback-Kette zuerst OpenRouter versucht. Fügen Sie für zusätzliche Aufgaben einen OPENROUTER_API_KEY hinzu oder konfigurieren Sie jeden zusätzlichen Slot so um, dass er Ihren Hauptanbieter verwendet:
auxiliary:
vision:
provider: "main"
web_extract:
provider: "main"
Dies ist der häufigste Stolperstein für neue Hermes-Benutzer, bei dem „meine Funktionen funktionieren stillschweigend nicht“ auftritt.
Konfigurationssystem
Hermes verfügt über ein mehrschichtiges Konfigurationssystem. Die Rangfolge zu verstehen, ist entscheidend, da höhere Ebenen niedrigere überschreiben und eine der Ebenen eine globale Provider-Registry ist, die Sie in config.yaml nicht sehen können.
Aufbau der Konfigurationsdateien
Laut Upstream-Dokumentation gehören diese Dateien zu einer Hermes-Konfiguration:4
~/.hermes/
├── config.yaml # All settings (model, terminal, TTS, compression, memory, toolsets, ...)
├── .env # Secrets (API keys, bot tokens, passwords)
├── auth.json # OAuth provider credentials (Nous Portal, Codex, Anthropic)
├── SOUL.md # Primary agent identity (slot #1 in system prompt)
├── memories/ # Persistent memory (MEMORY.md, USER.md)
├── skills/ # Bundled + agent-created + hub-installed skills
├── cron/ # Scheduled jobs
├── sessions/ # Gateway session state
└── logs/ # agent.log, gateway.log, errors.log (secrets auto-redacted)
config.yaml gegenüber .env — wenn beide gesetzt sind, hat config.yaml bei nicht vertraulichen Einstellungen Vorrang.4 Die Regel lautet:
- Geheimnisse (API-Schlüssel, Bot-Tokens, Passwörter) → .env
- Alles andere (Modell, Terminal-Backend, Komprimierungseinstellungen, Speicherlimits, Toolsets) → config.yaml
Auf Geheimnisse kann in config.yaml mit Interpolation im Shell-Stil verwiesen werden:4
auxiliary:
vision:
api_key: ${GOOGLE_API_KEY}
base_url: ${CUSTOM_VISION_URL}
delegation:
api_key: ${DELEGATION_KEY}
Konfiguration verwalten
hermes config # View current configuration
hermes config show # Same as above
hermes config edit # Open config.yaml in your editor
hermes config set KEY VAL # Set a specific value
hermes config get KEY # Print a single value (v0.19.0+)
hermes config unset KEY # Remove a key so the default applies again (v0.19.0+)
hermes config path # Print the config file path
hermes config env-path # Print the .env file path
hermes config check # Check for missing options (after updates)
hermes config migrate # Interactively add missing options
Beispiele:4
hermes config set model anthropic/claude-opus-4
hermes config set terminal.backend docker
hermes config set OPENROUTER_API_KEY sk-or-... # Saves to .env
hermes config check und hermes config migrate sollten Sie nach jedem hermes update ausführen — sie erkennen neu hinzugefügte Konfigurationsoptionen, die Ihre Datei noch nicht enthält.6
Rangfolge der Konfiguration
Hermes lädt die Konfiguration aus mehreren Quellen. Wenn mehrere Quellen denselben Wert setzen, gewinnt die Quelle mit der höheren Priorität:4
- CLI-Argumente —
hermes chat --model anthropic/claude-sonnet-4(Überschreibung pro Aufruf) - Umgebungsvariablen — werden beim Prozessstart angewendet
config.yaml— die primäre Einstellungsdatei.env— nur Geheimnisse- Integrierte Standardwerte — werden angewendet, wenn keine andere Quelle einen Wert setzt
CLI-Flags haben bei diesem einzelnen Aufruf immer Vorrang. config.yaml ist die langfristige maßgebliche Quelle.
Lokalisierung (v0.13.0+)
v0.13.0 ergänzte 7 Gebietsschemata für CLI- und Gateway-Nachrichten: Chinesisch (vereinfacht), Japanisch, Deutsch, Spanisch, Französisch, Ukrainisch und Türkisch.18 v0.14.0 lokalisiert alle Gateway-Befehle und das Web-Dashboard, ergänzt 8 weitere Gebietsschemata und erhöht die Gesamtzahl auf 16.19 Die Dokumentation ist derzeit nur auf zh-Hans lokalisiert. Das Gebietsschema wird über die Umgebungsvariablen LC_ALL / LANG oder einen expliziten Schlüssel locale: in config.yaml bestimmt. Englisch bleibt die Standardsprache und die maßgebliche Quelle für jede Zeichenfolge, die von einer Übersetzung noch nicht abgedeckt ist.
Profile — Mehrere isolierte Hermes-Instanzen
Profile ermöglichen Ihnen mehrere isolierte Hermes-Instanzen, jeweils mit eigener Konfiguration, Sitzungen, Skills, Speicher und Gateway-PID. So können Sie „Hermes für die Arbeit“ und „persönliches Hermes“ parallel betreiben, ohne dass eine Instanz den Zustand der anderen sehen kann.6
hermes profile list
hermes profile create work --clone # Clone from current profile
hermes profile use work # Set sticky default
hermes profile alias work --name h-work # Create wrapper script
hermes profile export work -o work-backup.tar.gz
hermes profile import work-backup.tar.gz --name restored
hermes -p work chat -q "Hello from work profile" # One-off without switching
Jedes Profil erhält sein eigenes HERMES_HOME (standardmäßig ~/.hermes-<name>/), sodass mehrere Profile das Gateway gleichzeitig ausführen können, ohne sich gegenseitig zu beeinträchtigen.63
CLI-Befehle
Dieser Abschnitt ist das Praxisnachschlagewerk zu den übergeordneten CLI-Befehlen. Die maßgebliche, aus dem Code abgeleitete Referenz finden Sie in der CLI Commands Reference.6
Globale Optionen
hermes [global-options] <command> [subcommand/options]
| Option | Beschreibung |
|---|---|
--version, -V |
Version anzeigen und beenden |
--profile <name>, -p <name> |
Auswählen, welches Hermes profile verwendet werden soll |
--resume <session>, -r <session> |
Eine Sitzung anhand von ID oder Titel fortsetzen |
--continue [name], -c [name] |
Die zuletzt verwendete Sitzung fortsetzen (oder einen Titel abgleichen) |
--worktree, -w |
In einem isolierten git worktree starten |
--yolo |
Bestätigungsaufforderungen für gefährliche Befehle umgehen |
--safe-mode |
Fehlerbehebungsflag — Hermes in einem minimalen sicheren Modus starten, um Startprobleme einzugrenzen (v0.19.0+)25 |
--pass-session-id |
Die Sitzungs-ID in den Systemprompt des Agenten aufnehmen |
Übergeordnete Befehle
| Befehl | Zweck |
|---|---|
hermes chat |
Interaktiver oder einmaliger Chat |
hermes model |
Standardprovider und -modell interaktiv auswählen |
hermes gateway |
Das messaging gateway ausführen oder verwalten |
hermes setup |
Interaktiver Einrichtungsassistent |
hermes auth |
Zugangsdaten verwalten — hinzufügen, auflisten, entfernen, zurücksetzen, Strategie festlegen |
hermes status |
Agent-, Authentifizierungs- und Plattformstatus anzeigen |
hermes cron |
Den cron scheduler prüfen und auslösen |
hermes webhook |
Dynamische webhook subscriptions verwalten |
hermes doctor |
Konfigurations- und Abhängigkeitsprobleme diagnostizieren |
hermes dump |
Zusammenfassung der Einrichtung zum Kopieren und Einfügen für Support/Debugging |
hermes logs |
Agent-/gateway-/Fehlerprotokolle anzeigen, verfolgen und filtern |
hermes config |
Konfiguration anzeigen, bearbeiten, migrieren und abfragen |
hermes pairing |
Pairing-Codes für Messaging genehmigen oder widerrufen |
hermes skills |
skills durchsuchen, installieren, veröffentlichen und prüfen |
hermes honcho |
Honcho-Sitzungsübergreifenden Speicher verwalten |
hermes memory |
Externen Speicherprovider konfigurieren |
hermes acp |
Hermes als ACP server ausführen (Editorintegration) |
hermes mcp |
MCP-Serverkonfiguration verwalten; Hermes als MCP server ausführen |
hermes plugins |
plugins verwalten |
hermes tools |
Aktivierte tools je Plattform konfigurieren |
hermes sessions |
Sitzungen durchsuchen, exportieren, bereinigen und löschen. v0.19.0 erweitert hermes sessions export um Markdown-, Quarto-, HTML-, Prompt-only- und Hugging-Face-Trace-Formate sowie einen optionalen --redact-Durchlauf zum Bereinigen von Geheimnissen und Filter nach Alter, workspace und Plattform25 |
hermes insights |
Token-/Kosten-/Aktivitätsanalysen anzeigen |
hermes claw |
OpenClaw-Migrationshilfen |
hermes profile |
profile verwalten (mehrere isolierte Instanzen) |
hermes completion |
Shell-Vervollständigungsskripte ausgeben (bash/zsh) |
hermes whatsapp |
Die WhatsApp-bridge konfigurieren und pairen |
hermes version |
Versionsinformationen ausgeben |
hermes update |
Den neuesten Code abrufen und Abhängigkeiten neu installieren |
hermes uninstall |
Hermes vom System entfernen (--full löscht außerdem Konfiguration/Daten) |
hermes backup |
Vollständiges Backup von Konfiguration, Sitzungen, skills und Speicher (v0.9.0+)16 |
hermes import |
Aus einem Backup-Archiv wiederherstellen — zwischen Rechnern migrieren oder zurückrollen (v0.9.0+)16 |
hermes dashboard |
Das lokale web dashboard für die browserbasierte Agentenverwaltung starten (v0.9.0+)16 |
hermes serve |
Den Backend-API server headless ausführen — ab v0.19.0 erstellt oder mountet er die web UI nicht mehr25 |
hermes debug share |
Einen vollständigen Debugbericht zur Freigabe bei der Fehlerbehebung in eine Pastebin hochladen (v0.9.0+)16 |
hermes chat — Der wichtigste Einstiegspunkt
hermes ohne Argumente startet einen interaktiven Chat. hermes chat ist die explizite Form mit Optionen:6
hermes chat -q "Summarize the latest PRs" # One-shot, non-interactive
hermes chat --provider openrouter --model anthropic/claude-sonnet-4.6
hermes chat --toolsets web,terminal,skills # Enable specific toolsets
hermes chat --quiet -q "Return only JSON" # Programmatic mode
hermes chat --worktree -q "Review repo and open a PR"
Wichtige Optionen:
| Option | Beschreibung |
|---|---|
-q, --query "..." |
Einmaliger, nicht interaktiver Prompt |
-m, --model <model> |
Das Modell für diesen Lauf überschreiben |
-t, --toolsets <csv> |
Eine durch Kommas getrennte Menge von toolsets aktivieren |
--provider <provider> |
Einen Provider erzwingen (siehe vollständige Liste) |
-s, --skills <name> |
Einen oder mehrere skills für diese Sitzung vorladen |
-v, --verbose |
Ausführliche Ausgabe |
-Q, --quiet |
Programmatischer Modus (kein Banner, Spinner oder Vorschauen) |
--resume <session> |
Eine Sitzung direkt über chat fortsetzen |
--worktree |
Einen isolierten git worktree erstellen |
--checkpoints |
Dateisystem-checkpoints vor destruktiven Änderungen aktivieren |
--yolo |
Bestätigungsaufforderungen überspringen |
--source <tag> |
Quell-Tag der Sitzung (Standard: cli; für Integrationen tool verwenden) |
--max-turns <N> |
Maximale tool-calling-Iterationen pro Zug (Standard: 90) |
hermes setup — Vollständiger Assistent
Führt den vollständigen Einrichtungsassistenten aus oder springt direkt zu einem Abschnitt:6
hermes setup # Full wizard
hermes setup model # Provider and model only
hermes setup terminal # Terminal backend only
hermes setup gateway # Messaging platforms only
hermes setup tools # Tool enable/disable per platform
hermes setup agent # Agent behavior only
hermes setup --non-interactive
hermes setup --reset # Reset config to defaults before setup
hermes logs — Strukturierte Protokollabfragen
hermes logs ist leistungsfähiger als tail -f für die Protokolldateien, weil Sie gleichzeitig nach Ebene, Sitzungs-ID und Zeitraum filtern können.6
hermes logs # Last 50 lines of agent.log
hermes logs -f # Follow in real time
hermes logs gateway -n 100 # Last 100 lines of gateway.log
hermes logs --level WARNING --since 1h # Warnings from the last hour
hermes logs --session abc123 # Filter by session ID substring
hermes logs errors --since 30m -f # Follow errors.log from 30m ago
hermes logs list # List all log files with sizes
Die Protokolldateien befinden sich in ~/.hermes/logs/:6
- agent.log — sämtliche Agentenaktivitäten (API-Aufrufe, Tool-Dispatch, Sitzungslebenszyklus, INFO+)
- errors.log — nur Warnungen und Fehler (eine gefilterte Teilmenge von agent.log)
- gateway.log — Aktivitäten des messaging gateway (Plattformverbindungen, Dispatch, webhooks)
Die Rotation erfolgt automatisch über den RotatingFileHandler von Python — achten Sie auf agent.log.1, agent.log.2 usw.6
hermes doctor — Diagnose
hermes doctor [--fix] ist der erste Befehl, den Sie ausführen sollten, wenn etwas nicht funktioniert. Er prüft die Gültigkeit der Konfiguration, vorhandene Abhängigkeiten, die Verfügbarkeit des API-Schlüssels und den Servicestatus und kann mit --fix automatische Reparaturen versuchen.6
Um Diagnosedaten mit anderen zu teilen, verwenden Sie hermes dump — der Befehl erstellt eine kompakte Klartextzusammenfassung mit geschwärzten API-Schlüsseln, die Sie direkt in ein GitHub-Issue oder einen Discord-Thread einfügen können.6
Slash-Befehle
Slash-Befehle werden innerhalb einer aktiven Chat-Sitzung (CLI oder Messaging-Plattform) ausgeführt. Sie werden aus einer gemeinsamen COMMAND_REGISTRY in hermes_cli/commands.py bereitgestellt, weshalb die meisten Befehle auf allen Oberflächen identisch funktionieren.9
Sitzungssteuerung
| Befehl | Beschreibung |
|---|---|
/new (Alias /reset) |
Eine neue Sitzung starten |
/clear |
Bildschirm leeren + neue Sitzung starten |
/history |
Gesprächsverlauf anzeigen |
/save |
Aktuelles Gespräch speichern |
/retry |
Letzte Nachricht erneut versuchen |
/undo |
Letzten Benutzer-/Assistant-Austausch entfernen |
/title <name> |
Einen Titel für die aktuelle Sitzung festlegen |
/compress |
Gesprächskontext manuell komprimieren |
/rollback [number] |
Dateisystem-Checkpoints auflisten oder wiederherstellen |
/stop |
Alle laufenden Hintergrundprozesse beenden |
/queue <prompt> |
Einen Prompt für den nächsten Zug in die Warteschlange stellen. Achtung: /q wird sowohl von /queue als auch von /quit beansprucht; die letzte Registrierung gewinnt und /q wird in der Praxis zu /quit aufgelöst — geben Sie immer ausdrücklich /queue ein.9 |
/resume [name] |
Eine zuvor benannte Sitzung fortsetzen |
/statusbar (Alias /sb) |
Statusleiste für Kontext/Modell umschalten |
/background <prompt> (Alias /bg) |
Einen Prompt in einer separaten Hintergrundsitzung ausführen |
/btw <question> |
Flüchtige Nebenfrage (keine Tools, wird nicht gespeichert) |
/plan [request] |
Das gebündelte plan skill laden, um einen Plan zu schreiben, statt etwas auszuführen |
/branch [name] (Alias /fork) |
Die aktuelle Sitzung verzweigen |
/goal <target> |
Den Agenten auf ein Ziel festlegen, damit er über mehrere Züge hinweg bei der Aufgabe bleibt. Ralph-Loop-Muster als erstklassige Primitive. Konfigurierbares Zugbudget. Neu in v0.13.0.18 |
/subgoal <criterion> |
Erfolgskriterien zu einem aktiven /goal hinzufügen, ohne die Schleife neu zu starten. Neu in v0.14.0.19 |
/handoff <target> |
Die laufende Sitzung — Nachrichten, Tool-Aufrufe und Kontext — an ein anderes Modell, eine Persona oder ein Profil übergeben. Neu in v0.14.0.19 |
Konfiguration & Modell
| Befehl | Beschreibung |
|---|---|
/config |
Aktuelle Konfiguration anzeigen |
/model [model-name] |
Aktuelles Modell anzeigen oder ändern |
/provider |
Verfügbare Provider und den aktuellen Provider anzeigen |
/personality [name] |
Ein Persönlichkeits-Overlay festlegen |
/verbose |
Anzeige des Tool-Fortschritts durchschalten |
/reasoning |
Reasoning-Aufwand und -Anzeige verwalten. v0.19.0 fügt die Aufwandsstufen max und ultra hinzu und macht /reasoning sitzungsbezogen; zudem kommen Überschreibungen des Aufwands pro Modell und pro MoA-Slot in der Konfiguration hinzu.25 |
/skin |
Anzeigedesign/Theme anzeigen oder ändern |
/voice [on\|off\|tts\|status] |
Sprachmodus von CLI umschalten |
/yolo |
YOLO-Modus umschalten (Genehmigungsaufforderungen überspringen). Seit v0.19.0 blockieren benutzerdefinierte Deny-Regeln weiterhin passende Befehle, auch im YOLO-Modus.25 |
/fast |
Fast Mode umschalten — priorisierte Verarbeitung für OpenAI- und Anthropic-Modelle (v0.9.0+)16 |
/debug |
Schnelldiagnose auf allen Plattformen (v0.9.0+)16 |
/subscription |
Ihren Nous Portal-Plan über das Terminal verwalten — Plan und verbleibendes Kontingent, Kostenübersicht für Upgrade/Downgrade, Anwenden mit Rückgängig-Funktion (v0.19.0+)25 |
/topup |
Ihrem Nous Portal-Guthaben Kredit hinzufügen, ohne das Terminal zu verlassen (v0.19.0+)25 |
Der Befehl /model ist das zentrale Werkzeug, um den Provider während einer Sitzung zu wechseln:9
/model # Show current model and options
/model claude-sonnet-4 # Switch model (auto-detect provider)
/model zai:glm-5 # Switch provider:model
/model custom:qwen-2.5 # Use model on custom endpoint
/model custom # Auto-detect model from custom endpoint
/model custom:local:qwen-2.5 # Named custom provider
/model openrouter:anthropic/claude-sonnet-4 # Back to cloud
v0.19.0 fügt /model --once hinzu — eine Modellüberschreibung für einen Zug, die nach der Antwort automatisch wieder Ihr vorheriges Modell verwendet.25
Tools, Skills & Informationen
| Befehl | Beschreibung |
|---|---|
/tools [list\|disable\|enable] [name...] |
Tools für die aktuelle Sitzung verwalten |
/toolsets |
Verfügbare toolsets auflisten |
/browser [connect\|disconnect\|status] |
Lokale Chrome-CDP-Verbindung verwalten |
/skills |
Skills suchen, installieren, prüfen oder verwalten |
/cron |
Geplante Aufgaben verwalten |
/reload-mcp |
MCP-Server aus config.yaml neu laden |
/plugins |
Installierte Plugins auflisten |
/help |
Alle Befehle anzeigen |
/usage |
Token-Nutzung, Kosten und Dauer anzeigen |
/insights |
Nutzungsanalysen anzeigen (letzte 30 Tage) |
/platforms |
Status der Messaging-Plattformen anzeigen |
/profile |
Aktiven Profilnamen und Home anzeigen |
Dynamische Skill-Slash-Befehle
Jedes installierte skill wird automatisch als Slash-Befehl bereitgestellt:9
/gif-search funny cats
/axolotl help me fine-tune Llama 3 on my dataset
/github-pr-workflow create a PR for the auth refactor
/excalidraw # Just the skill name loads it and lets the agent ask what you need
Seit v0.19.0 werden Slash-skill-Aufrufe gestapelt: /skill-a /skill-b do XYZ lädt beide skills in der angegebenen Reihenfolge in einem einzelnen Zug, mit Autovervollständigung und Ghost-Text für die verketteten Namen.25
Sie können auch Schnellbefehle in config.yaml definieren, die einen kurzen Namen auf einen längeren Prompt abbilden:9
quick_commands:
review: "Review my latest git diff and suggest improvements"
deploy: "Run the deployment script at scripts/deploy.sh and verify the output"
morning: "Check my calendar, unread emails, and summarize today's priorities"
Geben Sie anschließend /review, /deploy oder /morning in CLI ein.
Präfixabgleich
Befehle unterstützen Präfixabgleich: Die Eingabe von /h wird zu /help aufgelöst, /mod zu /model. Ist ein Präfix mehrdeutig, gewinnt die erste Registrierung in der Registry-Reihenfolge. Vollständige Befehlsnamen und registrierte Aliasse haben stets Vorrang vor Präfixübereinstimmungen.9
Messaging-spezifische Befehle
Einige Befehle funktionieren nur auf Messaging-Plattformen (Telegram, Discord, Slack, WhatsApp, Signal, Email, Home Assistant):9
/status— Sitzungsinformationen anzeigen/sethome(Alias/set-home) — den aktuellen Chat als Plattform-Home markieren/approve [session|always]— einen ausstehenden gefährlichen Befehl genehmigen/deny [reason]— einen ausstehenden gefährlichen Befehl ablehnen. Seit v0.19.0 übermittelt/deny <reason>Ihren Ablehnungsgrund an den Agenten, damit er den Kurs korrigiert, statt blind erneut zu versuchen.25/update— Hermes Agent auf die neueste Version aktualisieren/commands [page]— alle Befehle und skills durchsuchen (paginierte Ansicht)
Einige sind ausschließlich für CLI verfügbar: /skin, /tools, /toolsets, /browser, /config, /cron, /skills, /platforms, /paste, /statusbar, /plugins.9
Tools & Toolsets
Hermes verfügt über eine umfangreiche integrierte Tool-Registry für Websuche, Browserautomatisierung, Terminalausführung, Dateibearbeitung, Speicher, Delegierung, RL-Training, Nachrichtenübermittlung, Home-Assistant-Integration und mehr.10 Tools sind in logischen toolsets organisiert, die pro Plattform aktiviert oder deaktiviert werden können.
Kategorien auf hoher Ebene
| Kategorie | Beispiele | Beschreibung |
|---|---|---|
| Web | web_search, web_extract |
Das Web durchsuchen und Seiteninhalte extrahieren |
| Terminal & Dateien | terminal, process, read_file, patch |
Befehle ausführen und Dateien bearbeiten |
| Browser | browser_navigate, browser_snapshot, browser_vision |
Interaktive Browserautomatisierung mit Text und visueller Analyse |
| Medien | vision_analyze, video_analyze, video_generate, image_generate, text_to_speech |
Multimodale Analyse und Generierung. video_analyze ist primär auf Gemini ausgelegt und bietet erweiterbare Unterstützung für kompatible multimodale Provider (v0.13.0+). v0.14.0 ergänzt ein einheitliches video_generate mit austauschbaren Provider-Backends und leitet rohe Pixel über vision_analyze weiter, wenn das aktive Modell visuelle Fähigkeiten besitzt.1819 |
| Agentenorchestrierung | todo, clarify, execute_code, delegate_task |
Planung, Klärung, Codeausführung, Delegierung an Subagenten |
| Computernutzung | computer_use |
Desktopsteuerung über das cua-driver-Backend; v0.14.0 ermöglicht dies mit visuellen Providern, die nicht Anthropic sind.19 |
| Speicher & Abruf | memory, session_search |
Persistenter Speicher + Sitzungssuche |
| Automatisierung & Zustellung | cronjob, send_message |
Geplante Aufgaben, ausgehende Nachrichten |
| Integrationen | ha_*, MCP tools, rl_* |
Home Assistant, MCP, RL-Training |
Zu den gängigen Toolset-Namen gehören web, terminal, file, browser, vision, image_gen, moa, skills, tts, todo, memory, session_search, cronjob, code_execution, delegation, clarify, homeassistant und rl.10
Tools verwalten
hermes chat --toolsets "web,terminal" # Use specific toolsets
hermes tools # Interactive per-platform tool config
hermes tools --summary # Print enabled-tools summary
Tools können während einer Sitzung auch über /tools disable <name> und /tools enable <name> umgeschaltet werden. Dadurch wird die Sitzung zurückgesetzt, damit das neue Toolset wirksam wird.9
Terminal-Backends
Das Terminal-Tool kann Befehle in sechs verschiedenen Umgebungen ausführen:10
| Backend | Anwendungsfall |
|---|---|
local |
Auf Ihrem Rechner ausführen (Standard) — Entwicklung, vertrauenswürdige Aufgaben |
docker |
Isolierte Container — Sicherheit, Reproduzierbarkeit |
ssh |
Remote-Server — Sandbox, Agenten von ihrem eigenen Code fernhalten |
singularity |
HPC-Container — Cluster-Computing, ohne Root-Rechte |
modal |
Serverlose Cloud-Ausführung |
daytona |
Cloud-Sandbox-Workspace — persistente Remote-Entwicklungsumgebung |
Wechseln Sie Backends mit hermes config set terminal.backend <name> oder in config.yaml:
terminal:
backend: docker # or: local, ssh, singularity, modal, daytona
cwd: "." # Working directory
timeout: 180 # Command timeout in seconds
SSH-Backend (aus Sicherheitsgründen empfohlen — der Agent kann seinen eigenen Code nicht ändern):10
terminal:
backend: ssh
# In ~/.hermes/.env
TERMINAL_SSH_HOST=my-server.example.com
TERMINAL_SSH_USER=myuser
TERMINAL_SSH_KEY=~/.ssh/id_rsa
Docker-Backend:
terminal:
backend: docker
docker_image: python:3.11-slim
Containerressourcen (gilt für docker, singularity, modal, daytona):10
terminal:
container_cpu: 1
container_memory: 5120 # MB (default 5GB)
container_disk: 51200 # MB (default 50GB)
container_persistent: true # Persist filesystem across sessions
Mit container_persistent: true bleiben installierte Pakete, Dateien und Konfigurationen sitzungsübergreifend erhalten.10
Alle Container-Backends werden mit Sicherheitsmaßnahmen ausgeführt: schreibgeschütztes Root-Dateisystem (Docker), alle Linux-Capabilities außer DAC_OVERRIDE, CHOWN und FOWNER entfernt, keine Rechteausweitung, PID-Limits (256 Prozesse), vollständige Namespace-Isolation, persistenter Workspace über Volumes.10
Hintergrundprozesse
Das Terminal-Tool unterstützt die Hintergrundausführung mit expliziter Prozessverwaltung:10
terminal(command="pytest -v tests/", background=true)
# Returns: {"session_id": "proc_abc123", "pid": 12345}
process(action="list") # Show all running processes
process(action="poll", session_id="proc_abc123") # Check status
process(action="wait", session_id="proc_abc123") # Block until done
process(action="log", session_id="proc_abc123") # Full output
process(action="kill", session_id="proc_abc123") # Terminate
process(action="write", session_id="proc_abc123", data="y") # Send input
Der PTY-Modus (pty=true) ermöglicht interaktive CLI-Tools wie Codex und Claude Code.10
Sudo
Wenn ein Befehl sudo benötigt, fragt Hermes nach Ihrem Passwort (für die Sitzung zwischengespeichert). Alternativ können Sie SUDO_PASSWORD in ~/.hermes/.env festlegen.10
Multi-Agent Kanban (v0.13.0+)
v0.13.0 macht die Zusammenarbeit mehrerer Agenten zu einem erstklassigen Grundbaustein: einem dauerhaften Kanban-Board, das Aufgaben, Status und Worker-Identität agenten- und neustartübergreifend verfolgt.18 Das Board sorgt dafür, dass ein Schwarm von Hermes-Workern Aufgaben tatsächlich abschließt, statt bei blockierten Übergaben stehenzubleiben.
| Mechanismus | Funktion |
|---|---|
| Heartbeats | Jeder Worker sendet Signale, solange er eine Aufgabe besitzt. Bleibt ein Heartbeat aus, wird der Worker als verdächtig markiert und die Aufgabe zur erneuten Übernahme freigegeben. |
| Reclaim | Ein anderer Worker kann eine aufgegebene Aufgabe mit vollständigem Aufgabenstatus und vorheriger Teilausgabe übernehmen. |
| Zombie-Erkennung | Worker, die beendet werden, ohne eine Aufgabe als abgeschlossen zu markieren, werden automatisch für die Übernahme neuer Arbeit gesperrt. So sammelt der Schwarm keine inaktiven Identitäten an. |
| Halluzinations-Gate | Eine Ausgabe, die das Gate nicht besteht, sendet die Aufgabe mit einem vermerkten Grund zurück an das Board, statt sie als erledigt zu markieren. |
max_retries pro Aufgabe |
Überschreiben Sie das Standardbudget für Wiederholungen bei einer Aufgabe, von der Sie wissen, dass sie anfällig ist. |
| Boards für mehrere Projekte | Ein Hermes-Home kann mehrere unabhängige Boards hosten. |
Das Kanban-Board passt auf der Zielseite natürlich zu /goal (Ralph-Schleife mit festgelegtem Ziel) und für die Spawn-Semantik zum bestehenden Tool delegate_task. Das Ergebnis ist ein Schwarmmuster, bei dem jeder Agent eine gemeinsame Quelle der Wahrheit dafür nutzt, was als Nächstes zu tun ist, wer daran arbeitet und was feststeckt.
Was ist ein Hermes-Schwarm?
Ein Schwarm besteht aus mehreren Hermes-Workern, die parallel mit einem gemeinsamen Kanban-Board arbeiten. Er ist kein separates Subsystem, das Sie aktivieren müssen – vielmehr ermöglicht ihn erst das Board. Das Board liefert das eine, was parallele Agenten nicht selbst bereitstellen können: eine einzige verbindliche Antwort auf Welche Aufgabe sollte ich als Nächstes übernehmen, und arbeitet bereits jemand daran?
v0.15.0 erhob dieses Muster zu einer unterstützten Topologie und ergänzte eine Schwarmtopologie für die Koordination paralleler Worker, die automatische Zerlegung eines übergeordneten Ziels in Teilaufgaben, Modellüberschreibungen pro Aufgabe, geplante Aufgaben und Worktree-Verwaltung, damit parallele Worker nicht im selben Checkout kollidieren.28
| Herausforderung bei einer naiven Multi-Agent-Einrichtung | Was das Board stattdessen macht |
|---|---|
| Zwei Worker greifen dieselbe Aufgabe auf | Die Aufgabeninhaberschaft wird beansprucht und mit der Worker-Identität erfasst |
| Ein Worker fällt mitten in der Aufgabe aus und die Arbeit verschwindet | Der Heartbeat läuft ab, die Aufgabe wird mit vorheriger Teilausgabe erneut übernommen |
| Ein abgestürzter Worker „hält“ Aufgaben dauerhaft fest | Die Zombie-Erkennung hindert ihn daran, neue Arbeit zu beanspruchen |
| Ein teures Modell für jede Teilaufgabe | Modellüberschreibungen pro Aufgabe – günstige Modelle für mechanische Teilaufgaben |
| Parallele Worker bearbeiten dieselben Dateien | Die Worktree-Verwaltung isoliert den Checkout jedes Workers |
Die praktische Form: Geben Sie dem Schwarm ein Ziel, lassen Sie die automatische Zerlegung daraus Board-Aufgaben erstellen,
und lassen Sie Worker die Aufgaben beanspruchen, ausführen und Ergebnisse zurückgeben. Das Wiederholungsbudget gilt pro Aufgabe (max_retries),
sodass eine anfällige Teilaufgabe nicht die Toleranz des gesamten Durchlaufs aufbraucht. Da das Board
dauerhaft ist, übersteht ein Schwarm Neustarts – Worker verbinden sich erneut und setzen die Arbeit mit demselben Status fort.
Ein Schwarm ist nur so gut wie seine Zerlegung. Das Board koordiniert Worker; es macht aus einem schlecht aufgeteilten Ziel kein gutes. Aufgaben mit gemeinsamem verborgenem Zustand werden weiterhin miteinander konkurrieren, unabhängig davon, ob Worktrees verwendet werden oder nicht.
Skills-System
Skills sind bei Bedarf ladbare Wissensdokumente, die der Agent bei Bedarf laden kann. Sie folgen dem Muster der progressiven Offenlegung, um den Tokenverbrauch zu minimieren, und sind mit dem offenen Standard von agentskills.io kompatibel.11
Alle Skills befinden sich in ~/.hermes/skills/ — dem primären Verzeichnis und der maßgeblichen Quelle. Bei einer Neuinstallation werden gebündelte Skills aus dem Repository kopiert. Über den Hub installierte und vom Agent erstellte Skills werden ebenfalls hier abgelegt.11
Progressive Offenlegung
Level 0: skills_list() → [{name, description, category}, ...] (~3k tokens)
Level 1: skill_view(name) → Full content + metadata (varies)
Level 2: skill_view(name, path) → Specific reference file (varies)
Der Agent lädt den vollständigen Skill-Inhalt nur, wenn er ihn tatsächlich benötigt.11
SKILL.md-Format
---
name: my-skill
description: Brief description of what this skill does
version: 1.0.0
platforms: [macos, linux] # Optional — restrict to OS platforms
metadata:
hermes:
tags: [python, automation]
category: devops
fallback_for_toolsets: [web] # Conditional activation
requires_toolsets: [terminal] # Conditional activation
config: # Config.yaml settings
- key: my.setting
description: "What this controls"
default: "value"
prompt: "Prompt for setup"
---
# Skill Title
## When to Use
Trigger conditions for this skill.
## Procedure
1. Step one
2. Step two
## Pitfalls
- Known failure modes and fixes
## Verification
How to confirm it worked.
Bedingte Aktivierung
Skills können sich je nach verfügbaren Tools ein- oder ausblenden. Das ist besonders für Fallback-Skills nützlich — kostenlose oder lokale Alternativen, die nur angezeigt werden sollen, wenn ein Premium-Tool nicht verfügbar ist:11
| Feld | Verhalten |
|---|---|
fallback_for_toolsets |
Skill wird ausgeblendet, wenn die aufgeführten toolsets verfügbar sind |
fallback_for_tools |
Dasselbe, prüft jedoch einzelne Tools |
requires_toolsets |
Skill wird ausgeblendet, wenn die aufgeführten toolsets nicht verfügbar sind |
requires_tools |
Dasselbe, prüft jedoch einzelne Tools |
Beispiel: Der integrierte Skill duckduckgo-search verwendet fallback_for_toolsets: [web]. Wenn Sie FIRECRAWL_API_KEY festgelegt haben, ist das Web-toolset verfügbar und der Agent verwendet web_search — der DuckDuckGo-Skill bleibt ausgeblendet. Ohne den API-Schlüssel erscheint der DuckDuckGo-Skill automatisch als Fallback.11
Vom Agent verwaltete Skills
Der Agent kann über das Tool skill_manage eigene Skills erstellen, aktualisieren und löschen. Das ist das prozedurale Gedächtnis des Agent — wenn er einen nicht trivialen Workflow herausfindet, speichert er den Ansatz als Skill für die spätere Wiederverwendung.11
Wann der Agent Skills erstellt:11 - Nach dem erfolgreichen Abschluss einer komplexen Aufgabe (mehr als 5 Tool-Aufrufe) - Wenn er auf Fehler oder Sackgassen stieß und den funktionierenden Weg fand - Wenn der Benutzer seinen Ansatz korrigierte - Wenn er einen nicht trivialen Workflow entdeckte
Aktionen:11
| Aktion | Verwendung |
|---|---|
create |
Neuen Skill von Grund auf erstellen |
patch |
Gezielte Korrekturen (bevorzugt — am effizientesten im Tokenverbrauch) |
edit |
Umfangreiche strukturelle Überarbeitungen |
delete |
Einen Skill vollständig entfernen |
write_file |
Unterstützende Dateien hinzufügen/aktualisieren |
remove_file |
Eine unterstützende Datei entfernen |
Skill Hub
Skills aus Online-Registrierungen durchsuchen, suchen, installieren und verwalten:611
hermes skills browse # Browse all hub skills
hermes skills browse --source official # Browse official optional skills
hermes skills search kubernetes # Search all sources
hermes skills search react --source skills-sh # Search skills.sh directory
hermes skills inspect openai/skills/k8s # Preview before installing
hermes skills install openai/skills/k8s # Install with security scan
hermes skills install skills-sh/anthropics/skills/pdf --force
hermes skills check # Check for upstream updates
hermes skills update # Reinstall changed hub skills
hermes skills audit # Re-scan installed hub skills
hermes skills uninstall k8s
hermes skills publish skills/my-skill --to github --repo owner/repo
hermes skills tap add myorg/skills-repo # Add custom GitHub source
Integrierte Hub-Quellen:11
| Quelle | Beispiel | Hinweise |
|---|---|---|
official |
official/security/1password |
Optionale, mit Hermes ausgelieferte Skills (integriertes Vertrauen) |
skills-sh |
skills-sh/vercel-labs/agent-skills/vercel-react-best-practices |
Öffentlicher Skills-Katalog von Vercel |
well-known |
well-known:https://mintlify.com/docs/.well-known/skills/mintlify |
URL-basierte Erkennung von Websites, die /.well-known/skills/index.json veröffentlichen |
github |
openai/skills/k8s |
Direkte Installationen aus GitHub-Repository/Pfad |
clawhub |
— | Marktplatz für Drittanbieter-Skills |
lobehub |
— | Konvertierung des LobeHub-Agent-Katalogs |
browse-sh |
— | Skills-Quelle von Browserbase |
Standard-GitHub-Quellen (ohne Einrichtung durchsuchbar): openai/skills, anthropics/skills, huggingface/skills, NVIDIA/skills, garrytan/gstack. Die Quelle claude-marketplace wurde in v0.20.0 entfernt; browse-sh ersetzte sie in der Quellenliste.1124
Sicherheitsprüfung
Alle über den Hub installierten Skills durchlaufen einen Sicherheitsscanner, der auf Datenexfiltration, Prompt Injection, destruktive Befehle, Signale in der Lieferkette und weitere Bedrohungen prüft.11
Vertrauensebenen:11
| Ebene | Quelle | Richtlinie |
|---|---|---|
builtin |
Wird mit Hermes ausgeliefert | Immer vertrauenswürdig |
official |
optional-skills/ im Repository |
Integriertes Vertrauen, keine Drittanbieterwarnung |
trusted |
Vertrauenswürdige Registrierungen (openai/skills, anthropics/skills) |
Freizügigere Richtlinie |
community |
Alles andere | Nicht gefährliche Befunde können mit --force überschrieben werden; dangerous-Bewertungen bleiben blockiert |
--force kann nicht gefährliche Richtlinienblockierungen für Community-Skills überschreiben. Eine dangerous-Bewertung des Scans wird dadurch nicht überschrieben.11
Externe Skill-Verzeichnisse
Sie können Hermes auf zusätzliche Skill-Verzeichnisse verweisen lassen, die zusammen mit dem lokalen Verzeichnis gescannt werden:11
skills:
external_dirs:
- ~/.agents/skills
- /home/shared/team-skills
- ${SKILLS_REPO}/skills
Pfade unterstützen die Erweiterung von ~ und die Ersetzung von Umgebungsvariablen ${VAR}. Externe Verzeichnisse sind schreibgeschützt — wenn der Agent einen Skill erstellt oder bearbeitet, schreibt er ihn immer nach ~/.hermes/skills/. Bei einem Skill-Namen an beiden Orten hat die lokale Version Vorrang.11
Persistenter Speicher
Hermes verfügt über einen begrenzten, kuratierten Speicher, der sitzungsübergreifend erhalten bleibt. Der Speicher des Agenten besteht aus zwei Dateien, die beide in ~/.hermes/memories/ gespeichert werden:12
| Datei | Zweck | Zeichenlimit |
|---|---|---|
MEMORY.md |
Persönliche Notizen des Agenten — Fakten zur Umgebung, Konventionen, Gelerntes | 2.200 Zeichen (~800 Token) |
USER.md |
Benutzerprofil — Präferenzen, Kommunikationsstil, Erwartungen | 1.375 Zeichen (~500 Token) |
Beide werden als eingefrorene Momentaufnahme beim Sitzungsstart in den System Prompt eingefügt. Der Agent verwaltet seinen eigenen Speicher über das Tool memory — add, replace oder remove.12
Muster der eingefrorenen Momentaufnahme: Die Einfügung in den System Prompt wird beim Sitzungsstart einmalig erfasst und ändert sich während der Sitzung nicht. Das ist beabsichtigt — so bleibt der Prefix Cache von LLM für eine bessere Leistung erhalten. Änderungen während einer Sitzung werden sofort auf der Festplatte gespeichert, erscheinen jedoch erst in der nächsten Sitzung im System Prompt.12
Was gespeichert werden sollte
Diese Informationen speichern (der Agent macht das proaktiv):12
- Benutzerpräferenzen: „Ich bevorzuge TypeScript gegenüber JavaScript“ → user
- Fakten zur Umgebung: „Dieser Server läuft mit Debian 12 und PostgreSQL 16“ → memory
- Korrekturen: „Verwenden Sie für Docker-Befehle kein sudo; der Benutzer gehört zur Docker-Gruppe“ → memory
- Konventionen: „Das Projekt verwendet Tabs, eine Zeilenbreite von 120 Zeichen und Docstrings im Google-Stil“ → memory
- Abgeschlossene Arbeiten: „Datenbank am 2026-01-15 von MySQL nach PostgreSQL migriert“ → memory
Diese Informationen überspringen:12 - Triviale oder offensichtliche Informationen - Fakten, die sich leicht erneut ermitteln lassen - Rohe Datendumps (zu groß für den Speicher) - Sitzungsspezifische Ephemera - Informationen, die bereits in Kontextdateien vorhanden sind
Sitzungssuche
Über MEMORY.md und USER.md hinaus kann der Agent mit dem Tool session_search seine vergangenen Unterhaltungen durchsuchen. Alle CLI- und Messaging-Sitzungen werden mit FTS5-Volltextsuche in SQLite (~/.hermes/state.db) gespeichert. Abfragen liefern relevante vergangene Unterhaltungen mit einer Zusammenfassung durch Gemini Flash.12
| Funktion | Persistenter Speicher | Sitzungssuche |
|---|---|---|
| Kapazität | Insgesamt ~1.300 Token | Unbegrenzt (alle Sitzungen) |
| Geschwindigkeit | Sofort (im System Prompt) | Erfordert Suche + Zusammenfassung durch LLM |
| Anwendungsfall | Wichtige Fakten sind immer verfügbar | Bestimmte vergangene Unterhaltungen finden |
| Verwaltung | Vom Agenten manuell kuratiert | Automatisch — alle Sitzungen werden gespeichert |
| Tokenkosten | Fest pro Sitzung (~1.300 Token) | Bei Bedarf |
Externe Speicheranbieter
Für einen umfangreicheren persistenten Speicher über MEMORY.md und USER.md hinaus bietet Hermes acht Plugins für externe Speicheranbieter: Honcho, OpenViking, Mem0, Hindsight, Holographic, RetainDB, ByteRover und Supermemory.12
Externe Anbieter laufen parallel zum integrierten Speicher (und ersetzen ihn nie) und ergänzen Funktionen wie Wissensgraphen, semantische Suche, automatische Faktenextraktion und sitzungsübergreifende Benutzermodellierung:612
hermes memory setup # Pick a provider and configure it
hermes memory status # Check what's active
hermes memory off # Disable external provider (built-in only)
Es kann immer nur ein externer Anbieter aktiv sein. Der integrierte Speicher ist stets aktiv.6
Automatische Sitzungsfortsetzung (v0.13.0+)
v0.13.0 macht Unterbrechungen mitten in der Agentenarbeit überlebbar. Der gateway setzt unterbrochene Sitzungen nach einem Neustart automatisch fort; Neustarts über /update bewahren den Sitzungsstatus während des Upgrades; das Neuladen von Quelldateien während der Entwicklung hält die aktive Sitzung am Leben, statt eine neue zu erzwingen.18 Praktisch bedeutet das: Lang laufende gateway-Arbeiten und cron-gesteuerte Jobs verlieren beim Neustart des Prozesses nicht mehr ihr Kontextfenster.
Checkpoints v2 (v0.13.0+)
Die Zustandsspeicherung wurde in v0.13.0 als Single-Store-Design mit echtem Pruning, Festplattenleitplanken und keinen verwaisten Shadow-Repos neu geschrieben.18 Das vorherige Checkpoint-System sammelte bei lang laufenden profiles Zustand auf der Festplatte an; der v2-Store setzt der lokalen Checkpoint-Speicherung eine harte Obergrenze und entfernt die doppelte Buchführung, die dieses Wachstum verursachte. Eine benutzerseitige Konfigurationsänderung ist nicht erforderlich; der nächste Checkpoint-Schreibvorgang verwendet den v2-Pfad.
Persönlichkeit & SOUL.md
SOUL.md ist die primäre Identität einer Hermes-Instanz. Sie belegt Slot Nr. 1 im System Prompt und ersetzt die fest codierte Standardidentität.13
Hermes erstellt automatisch eine Standarddatei SOUL.md unter ~/.hermes/SOUL.md (oder $HERMES_HOME/SOUL.md für benutzerdefinierte profiles). Vorhandene Benutzerdateien werden niemals überschrieben. Hermes lädt SOUL.md ausschließlich aus HERMES_HOME — das aktuelle Arbeitsverzeichnis wird nicht durchsucht. Dadurch bleibt die Persönlichkeit projektübergreifend vorhersehbar.13
Was in SOUL.md gehört
Verwenden Sie sie für dauerhafte Vorgaben zu Stimme und Persönlichkeit:13 - Tonfall - Kommunikationsstil - Grad der Direktheit - Standardinteraktionsstil - Stilistische Aspekte, die vermieden werden sollen - Umgang von Hermes mit Unsicherheit, Widerspruch und Mehrdeutigkeit
Weniger geeignet ist sie für:13 - Einmalige Projektanweisungen - Dateipfade - Repository-Konventionen - Temporäre Workflow-Details
Diese gehören in AGENTS.md, nicht in SOUL.md.
SOUL.md vs. AGENTS.md
Dies ist die wichtigste Unterscheidung bei der Identitätsverwaltung von Hermes:13
SOUL.md — Identität, Tonfall, Stil, Kommunikationsstandards und Verhalten auf Persönlichkeitsebene.
AGENTS.md — Projektarchitektur, Codierungskonventionen, Tool-Präferenzen, Repository-spezifische Workflows, Befehle, Ports, Pfade und Hinweise zur Bereitstellung.
Eine hilfreiche Regel: Wenn es Ihnen überall folgen soll, gehört es in SOUL.md. Gehört es zu einem Projekt, gehört es in AGENTS.md.13
Integrierte Persönlichkeiten
Hermes enthält integrierte Persönlichkeiten, zu denen Sie mit /personality wechseln können:13
| Name | Beschreibung |
|---|---|
helpful |
Freundlicher Assistent für allgemeine Zwecke |
concise |
Kurze, präzise Antworten |
technical |
Detaillierter, präziser technischer Experte |
creative |
Innovatives Denken außerhalb gewohnter Muster |
teacher |
Geduldiger Lehrender mit klaren Beispielen |
kawaii |
Niedliche Ausdrücke, Glitzer und Begeisterung |
catgirl |
Neko-chan mit katzenartigen Ausdrücken |
pirate |
Captain Hermes, technikversierter Freibeuter |
shakespeare |
Bardische Prosa mit dramatischem Flair |
surfer |
Entspannte Bro-Vibes |
noir |
Erzählstil eines hartgesottenen Detektivs |
uwu |
Maximal niedlich mit UwU-Sprache |
philosopher |
Tiefgründige Betrachtung jeder Anfrage |
hype |
MAXIMALE ENERGIE |
Benutzerdefinierte Persönlichkeiten in config.yaml:13
agent:
personalities:
codereviewer: >
You are a meticulous code reviewer. Identify bugs, security issues,
performance concerns, and unclear design choices. Be precise and constructive.
Wechseln Sie dann mit /personality codereviewer.
SOUL.md vs. /personality
SOUL.md ist die grundlegende Stimme. /personality ist eine Überlagerung auf Sitzungsebene.13 Behalten Sie eine pragmatische Standarddatei SOUL.md bei und verwenden Sie dann /personality teacher für eine Nachhilfesitzung oder /personality creative für ein Brainstorming.
Nous Tool Gateway (v0.10.0+)
Seit Hermes Agent v0.10.0 (2026-04-16) erhalten zahlende Nous Portal-Abonnenten über ihre bestehenden Portal-Zugangsdaten verwalteten Zugriff auf eine kuratierte Auswahl an Tools — ohne zusätzliche API-Schlüssel verwalten zu müssen.30 Der Hermes CLI selbst bleibt MIT-lizenziert und vollständig Open Source. Neu ist, dass Ihre Portal-Authentifizierung nun mehr als nur Modellinferenz freischaltet.
Was das Gateway umfasst
| Tool | Anbieter | Anwendungsfall |
|---|---|---|
| Websuche | Firecrawl | Informationsabruf für Agents, die aktuelle Informationen benötigen |
| Bildgenerierung | FAL / FLUX 2 Pro | Bilder direkt generieren, ohne einen FAL-Schlüssel konfigurieren zu müssen |
| Text-to-Speech | OpenAI TTS | Gesprochene Ausgabe auf Messaging-Gateways |
| Browserautomatisierung | Browser Use | Headless-Navigation und Scraping |
So funktioniert es
Das Gateway ist über ein neues Konfigurationsfeld use_gateway pro Tool optional aktivierbar. Wenn Sie Portal-Zugangsdaten in hermes auth hinterlegt und das Gateway für ein Tool aktiviert haben, werden die Aufrufe dieses Tools über Portal geleitet. Andernfalls wird Ihr direkter API-Schlüssel (falls vorhanden) verwendet.
# config.yaml — per-tool gateway opt-in
tools:
web_search:
provider: firecrawl
use_gateway: true # route via Nous Portal subscription
image_generation:
provider: fal
use_gateway: true
Laufzeitpriorität: Wenn das Gateway verfügbar ist und für ein Tool use_gateway: true gesetzt wurde, bevorzugt Hermes das Gateway, selbst wenn Sie zusätzlich einen direkten API-Schlüssel konfiguriert haben. Das ist für die Abrechnung relevant — Gateway-Aufrufe werden Ihrem Nous Portal-Abonnement belastet, nicht dem Guthaben Ihres direkten API-Schlüssels.
Das Gateway aktivieren
hermes model # select Nous Portal (OAuth flow)
hermes tools # per-platform tool picker integrates gateway tools
hermes status # confirms gateway/subscription detection
Das Abonnement wird automatisch anhand der Portal-OAuth-Zugangsdaten erkannt, die Sie bereits in hermes auth hinterlegt haben — ein separater Anmeldeschritt ist nicht erforderlich. Seit v0.19.0 können Sie das Abonnement auch innerhalb einer Sitzung verwalten: /subscription zeigt Ihren Tarif und das verbleibende Kontingent an, zeigt genau vorab, was ein Upgrade kostet oder wann ein Downgrade wirksam wird, und wendet die Änderung mit Hinweisen zu geplanten Änderungen und einer Rückgängig-Option an; /topup fügt Guthaben hinzu. Die Desktop-App verfügt über einen entsprechenden Tab für die Abrechnungseinstellungen.25
Preise und Zugriff
Preise und Tarifnamen werden auf der Nous Portal-Preisseite veröffentlicht (https://portal.nousresearch.com/pricing). Dieser Leitfaden führt keine Tarife auf, da sie in die Verantwortung des Portal-Produkts fallen, nicht des Hermes CLI, und sich unabhängig von Hermes-Releases ändern. Registrieren Sie sich unter https://portal.nousresearch.com/ und prüfen Sie die Preisseite auf aktuelle Tarife.
Hinweis zur Einstellung
- Die Umgebungsvariable
HERMES_ENABLE_NOUS_MANAGED_TOOLSwurde in v0.10.0 entfernt. Verwaltete Tools werden nun über das Konfigurationsfelduse_gatewaypro Tool aktiviert und durch den Status Ihres Portal-Abonnements gesteuert.30
Einordnung: Was dieses Release nicht ist
Der Hermes Agent CLI ist nicht an ein Abonnement gebunden. Das Projekt ist weiterhin MIT-lizenziert, und alle Kernfunktionen (CLI, skills, memory, Messaging-Gateway, cron, MCP, lokales Dashboard, BYOK für jeden Anbieter) funktionieren Ende zu Ende, ohne dass Sie jemanden bezahlen müssen. v0.10.0 fügt einen bequemen Weg für Benutzer hinzu, die bereits für Nous Portal zahlen — es entfernt nichts vom kostenlosen Weg.
Messaging-Gateway
Hermes kann als langlebiger Gateway-Prozess ausgeführt werden, der 28 Messaging-Plattformen über einen einzigen Gateway-Prozess verbindet: Telegram, Discord, Slack, WhatsApp, Signal, SMS, Email, Home Assistant, Mattermost, Matrix, DingTalk, Feishu/Lark, WeCom, Weixin (WeChat), BlueBubbles (iMessage), QQBot, Microsoft Teams, Tencent Yuanbao, Google Chat, LINE, SimpleX Chat und einen generischen Webhook-Adapter.329171819 v0.9.0 fügte iMessage über BlueBubbles hinzu (automatische Webhook-Registrierung, Einrichtungsassistent, Absturzresistenz) sowie native WeChat-Unterstützung über iLink Bot API mit WeCom-Callback-Modus für Unternehmens-Apps.16 v0.11.0 fügte QQBot hinzu.29 v0.12.0 fügte Microsoft Teams und Tencent Yuanbao hinzu.17 v0.13.0 fügte Google Chat als 20. Plattform hinzu, basierend auf derselben einsteckbaren Adapterarchitektur; IRC und Microsoft Teams wurden zudem auf das neue Adaptermuster mit generischen Plugin-Hooks env_enablement_fn / cron_deliver_env_var migriert.18 v0.14.0 fügt LINE und SimpleX Chat hinzu und vervollständigt den Microsoft-Teams-Stack Ende zu Ende mit Graph-Authentifizierung, Webhook-Listener, Pipeline-Laufzeit und ausgehender Zustellung.19 v0.17.0 (19. Juni 2026) fügt relay-freies iMessage über Photon Spectrum hinzu (Gerätecode-OAuth mit hermes photon login — kein Mac-/BlueBubbles-Relay erforderlich), den offiziellen WhatsApp Business Cloud API-Adapter (der die Anforderung eines Bridge-Prozesses ersetzt), SimpleX-Gruppen und native Anhänge sowie Raft als gebündeltes Plattform-Plugin.21
Einrichtung
hermes gateway setup # Interactive platform configuration
hermes gateway install # Install as user service (systemd/launchd)
hermes gateway start # Start the installed service
hermes gateway stop
hermes gateway restart
hermes gateway status
hermes gateway run # Run in foreground (debugging)
Die interaktive Einrichtung führt Sie durch die Verbindung jeder Plattform: API-Tokens, Bot-IDs, Kanalzuordnungen, Allowlists.6
Wie Nachrichten fließen
Aus der Upstream-Architekturdokumentation:3
Platform event → Adapter.on_message() → MessageEvent
→ GatewayRunner._handle_message()
→ authorize user
→ resolve session key
→ create AIAgent with session history
→ AIAgent.run_conversation()
→ deliver response back through adapter
Jede Messaging-Plattform durchläuft dieselbe AIAgent-Konversationsschleife wie der CLI. Deshalb funktionieren Slash-Befehle an beiden Stellen identisch und deshalb kann ein in Telegram geplanter Cron-Job seine Ausgabe an Discord senden — der Plattformunterschied besteht nur am Rand.3
v0.19.0 fügt profilbasierte Nachrichtenweiterleitung und dauerhafte Zustellung hinzu. Ein einzelnes multiplexiertes Gateway, das einen Bot-Token teilt, kann bestimmte Guilds, Kanäle oder Threads an unterschiedliche profile weiterleiten — jeweils mit vollständig isolierter Konfiguration, skills, memory und secrets — mit einer Überschreibung durch GATEWAY_MULTIPLEX_PROFILES; zudem sorgt eine Härtungswelle dafür, dass ein falsch konfiguriertes Profil nicht mehr das gesamte Gateway außer Betrieb setzen kann. Intern wurde der Routing-Index nach state.db verschoben (sessions.json ist nun ein optionaler Legacy-Spiegel), und endgültige Antworten werden in einem dauerhaften Zustellverpflichtungs-Ledger rund um das Senden an die Plattform erfasst — eine abgeschlossene Antwort, die auf einen Gateway-Absturz trifft, wird beim nächsten Start erneut zugestellt, statt unbemerkt verloren zu gehen.25
Benutzerautorisierung und Pairing
hermes pairing list # Show pending and approved users
hermes pairing approve <platform> <code>
hermes pairing revoke <platform> <user-id>
hermes pairing clear-pending
Pairing-Codes verhindern, dass beliebige Fremde mit Ihrem Gateway sprechen. Ein Benutzer sendet einen Pairing-Code über seine Messaging-Plattform; Sie genehmigen ihn mit hermes pairing approve; anschließend ist er autorisiert.6
Geplante Aufgaben (Cron)
Hermes verfügt über ein erstklassiges Cron-System, bei dem Jobs Agent-Aufgaben und keine Shell-Befehle sind. Jeder geplante Job wird mit einem neuen AIAgent, dem konfigurierten Prompt und optional angehängten skills ausgeführt und stellt Ergebnisse an jede Plattform zu:36
hermes cron list
hermes cron create --prompt "Check HN for AI news and summarize" --schedule "0 9 * * *" --deliver telegram
hermes cron edit <id>
hermes cron pause <id>
hermes cron resume <id>
hermes cron run <id> # Trigger now on the next tick
hermes cron remove <id>
hermes cron status # Check if scheduler is running
hermes cron tick # Run due jobs once and exit
Oder erstellen Sie einen direkt im Gespräch innerhalb eines Messaging-Chats:
Every morning at 9am, check Hacker News for AI news and send me a summary on Telegram.
Der Agent richtet den Cron-Job über seine Tools ein. Jobs werden in JSON gespeichert und überstehen Neustarts.3
MCP-Integration
Hermes unterstützt das Model Context Protocol sowohl als Client als auch als Server:6
Als Client — verbinden Sie Hermes mit externen MCP-Servern, um seine Tool-Oberfläche zu erweitern:
hermes mcp add <name> --url https://example.com/mcp
hermes mcp add <name> --command npx --args "-y,@modelcontextprotocol/server-github"
hermes mcp list
hermes mcp test <name>
hermes mcp remove <name>
hermes mcp configure <name> # Toggle individual tool selection
Oder manuell in config.yaml:14
mcp_servers:
github:
command: npx
args: ["-y", "@modelcontextprotocol/server-github"]
env:
GITHUB_PERSONAL_ACCESS_TOKEN: "ghp_xxx"
Seit v0.19.0 werden MCP-Tools dem Modell gemäß der Namenskonvention mcp__server__tool bereitgestellt — jeder Tool-Name enthält seinen Servernamen, sodass zwei Server, die dasselbe Tool bereitstellen, nicht länger kollidieren — und MCP-Server-Log-Benachrichtigungen werden in agent.log angezeigt.25
Als Server — stellen Sie Hermes-Konversationen anderen Agents bereit:
hermes mcp serve
hermes mcp serve -v # Verbose
Kontextkomprimierung
Hermes komprimiert lange Unterhaltungen automatisch, um innerhalb des Kontextfensters Ihres Modells zu bleiben. Der Komprimierungs-Zusammenfasser ist ein separater LLM-Aufruf — Sie können ihn auf jeden Provider oder Endpunkt verweisen.4
compression:
enabled: true
threshold: 0.50 # Compress at this % of context limit
target_ratio: 0.20 # Fraction to preserve as recent tail
protect_last_n: 20 # Min recent messages to keep uncompressed
summary_model: "google/gemini-3-flash-preview"
summary_provider: "auto" # "auto", "openrouter", "nous", "codex", "main", etc.
summary_base_url: null # Custom OpenAI-compatible endpoint
Provider-Optionen:4
summary_provider |
summary_base_url |
Ergebnis |
|---|---|---|
auto (Standard) |
nicht gesetzt | Besten verfügbaren Provider automatisch erkennen |
nous / openrouter / usw. |
nicht gesetzt | Diesen Provider erzwingen und dessen Authentifizierung verwenden |
| beliebig | gesetzt | Benutzerdefinierten Endpunkt direkt verwenden (Provider wird ignoriert) |
summary_model muss eine Kontextlänge unterstützen, die mindestens so groß ist wie die Ihres Hauptmodells, da es zur Komprimierung den gesamten mittleren Abschnitt der Unterhaltung erhält.4
Warnungen bei Budgetdruck
Wenn der Agent an einer komplexen Aufgabe mit vielen Tool-Aufrufen arbeitet, kann er sein Iterationsbudget aufbrauchen (Standard: 500 Runden seit v0.20.0, zuvor 90), ohne dies zu bemerken. Bei Budgetdruck wird das Modell automatisch gewarnt:4
| Schwellenwert | Stufe | Was das Modell sieht |
|---|---|---|
| 70% | Vorsicht | [BUDGET: 350/500. 150 iterations left. Start consolidating.] |
| 90% | Warnung | [BUDGET WARNING: 450/500. Only 50 left. Respond NOW.] |
Stream-Timeouts
Die Streaming-Verbindung von LLM verfügt über zwei Timeout-Ebenen, die sich für lokale Provider (localhost, LAN-IP-Adressen) automatisch anpassen:4
| Timeout | Standard | Lokale Provider | Umgebungsvariable |
|---|---|---|---|
| Socket-Lese-Timeout | 120s | Automatisch auf 1800s erhöht | HERMES_STREAM_READ_TIMEOUT |
| Erkennung inaktiver Streams | 180s | Automatisch deaktiviert | HERMES_STREAM_STALE_TIMEOUT |
| API-Aufruf (nicht streamend) | 1800s | Unverändert | HERMES_API_TIMEOUT |
Der Socket-Lese-Timeout wird für lokale Endpunkte auf 30 Minuten erhöht, weil lokale LLMs bei großen Kontexten vor der Ausgabe des ersten Tokens mehrere Minuten für das Prefill benötigen können.4
Lokales Web-Dashboard (v0.9.0+)
Ein browserbasiertes Dashboard zur lokalen Verwaltung Ihres Hermes Agent. Konfigurieren Sie Einstellungen, überwachen Sie Sitzungen, durchsuchen Sie skills und verwalten Sie Ihren gateway, ohne Konfigurationsdateien oder das Terminal zu verwenden.16 Starten Sie es mit hermes dashboard. Dies ist der einfachste Onboarding-Weg für neue Benutzer, die eine GUI bevorzugen.
Überwachung von Hintergrundprozessen (v0.9.0+)
Mit watch_patterns können Sie Muster festlegen, die in der Ausgabe von Hintergrundprozessen überwacht werden, und bei Übereinstimmung in Echtzeit benachrichtigt werden.16 Überwachen Sie Fehler, warten Sie auf bestimmte Ereignisse („listening on port“) oder verfolgen Sie Build-Protokolle — ganz ohne Polling. Zusammen mit notify_on_complete aus v0.8.0 (das über den Abschluss von Hintergrundaufgaben informiert) verfügt Hermes nun über eine vollständige Beobachtungsebene für Hintergrundprozesse.15
Austauschbare Context Engine (v0.9.0+)
Die Kontextverwaltung ist jetzt über hermes plugins als austauschbarer Slot verfügbar. Sie können benutzerdefinierte Context Engines einsetzen, die steuern, was der Agent in jeder Runde sieht — etwa durch Filterung, Zusammenfassung oder domänenspezifische Kontextinjektion.16 Dadurch wird die Kontextstrategie von der Kernschleife des Agenten entkoppelt und eine Kontextanpassung pro Projekt oder Domäne ermöglicht.
Backup & Wiederherstellung (v0.9.0+)
hermes backup erstellt ein vollständiges Archiv Ihrer Konfiguration, Sitzungen, skills und Erinnerungen. hermes import stellt diese aus einem Backup-Archiv wieder her.16 Nutzen Sie dies für Migrationen zwischen Geräten, Snapshots vor größeren Änderungen oder um eine bewährte Konfiguration mit Teammitgliedern zu teilen.
Termux- / Android-Unterstützung (v0.9.0+)
Hermes läuft nativ auf Android über Termux. Angepasste Installationspfade, TUI-Optimierungen für mobile Bildschirme, Unterstützung für Voice-Backends und der Befehl /image funktionieren direkt auf dem Gerät.16
Sicherheits-Härtung (v0.13.0+)
v0.13.0 hat 8 P0-Sicherheitsprobleme geschlossen und einen Standardwert zugunsten des Benutzers geändert.18 v0.14.0 folgt mit weiteren 12 P0- und 50 P1-Schließungen, darunter Härtungen gegen sudo-Brute-Force und sudo-stdin, Korrekturen für Umgehungen gefährlicher Befehle, Bereinigung von Tool-Fehlern vor ihrer erneuten Einspeisung in das Modell, Dashboard-Plugin-API-Authentifizierung, SSRF-Abdeckung für den skills-hub sowie das Scannen von Supply-Chain-Hinweisen während der Installation.19
| Korrektur | Was sich geändert hat |
|---|---|
| Standardmäßig aktivierte Geheimnis-Redaktion | Zuvor optional. Protokolle und Uploads über hermes debug share schwärzen Geheimnisse, sofern dies nicht ausdrücklich deaktiviert wurde. v0.12.0 hatte die Redaktion nach Berichten über beschädigte Payloads standardmäßig deaktiviert; v0.13.0 aktiviert sie wieder als sichereren Ausgangspunkt. |
| Discord-Cross-Guild-DM-Umgehung (CVSS 8.1) | Discord-Rollen-Allowlist sind jetzt auf guilds beschränkt. Damit ist ein Weg geschlossen, über den eine Benutzerrolle in einer guild DMs über alle guilds hinweg autorisieren konnte. |
| WhatsApp-Standardbeschränkungen | Der WhatsApp-Adapter weist Fremde standardmäßig ab und antwortet niemals in Selbst-Chats. |
| MCP-OAuth-TOCTOU-Fenster | Eine Race Condition beim Speichern von Zugangsdaten in MCP-OAuth-Abläufen wurde geschlossen. |
CLI-auth.json-TOCTOU |
Ein entsprechendes TOCTOU-Fenster im Zugangsdaten-Writer für den CLI-Authentifizierungsspeicher wurde geschlossen. |
| Browser-SSRF-Mindestschutz | Hybrid-Routing erzwingt einen SSRF-Mindestschutz gegen Cloud-Metadaten für Anfragen, die 169.254.169.254 und Entsprechungen erreichen wollen. |
| Scanning auf Prompt Injection bei cron | Zusammengestellte Prompts (einschließlich geladener skill-Inhalte) werden vor der Ausführung des cron-Jobs auf Prompt Injection geprüft. |
Redaktion bei hermes debug share |
Debug-Share-Uploads schwärzen Protokollinhalte beim Upload und nicht nur beim Schreiben. |
Wenn Sie eine Hermes-Bereitstellung betreiben, sollten Sie v0.13.0 und v0.14.0 als sicherheitsrelevante Upgrades und nicht nur als Funktionserweiterungen behandeln. v0.13.0 schließt die Discord-Cross-Guild-Umgehung und zwei TOCTOU-Fenster; v0.14.0 ergänzt eine weitere Härtungsrunde für die sudo-Behandlung, die erneute Einspeisung von Tool-Fehlern, Plugin-APIs, skills-hub-SSRF und Abhängigkeitswarnungen.
Architektur für Praktiker
Dieser Abschnitt richtet sich an Personen, die verstehen möchten, was unter der Haube passiert, damit sie Fehler beheben, Hermes erweitern oder die Performance einschätzen können. Er fasst die Upstream-Architekturdokumentation zusammen.3
Einstiegspunkte → AIAgent
Jeder Einstiegspunkt in Hermes ruft letztlich AIAgent.run_conversation() auf:
┌──────────────────────────────────────────────────────────────────┐
│ Entry Points │
│ │
│ CLI (cli.py) Gateway (gateway/run.py) ACP (acp_adapter/) │
│ Batch Runner API Server Python Library │
└──────────┬──────────────┬───────────────────────┬────────────────┘
│ │ │
▼ ▼ ▼
┌──────────────────────────────────────────────────────────────────┐
│ AIAgent (run_agent.py) │
│ │
│ ┌─────────────┐ ┌──────────────┐ ┌──────────────┐ │
│ │ Prompt │ │ Provider │ │ Tool │ │
│ │ Builder │ │ Resolution │ │ Dispatch │ │
│ └──────┬──────┘ └──────┬───────┘ └──────┬───────┘ │
│ │ │ │ │
│ ┌──────┴───────┐ ┌──────┴───────┐ ┌──────┴───────┐ │
│ │ Compression │ │ 3 API Modes │ │ Tool Registry│ │
│ │ & Caching │ │ chat_compl │ │ 47 tools │ │
│ │ │ │ codex_resp │ │ 20 toolsets │ │
│ │ │ │ anthropic │ │ │ │
│ └──────────────┘ └──────────────┘ └──────────────┘ │
└──────────────────────────────────────────────────────────────────┘
Diagramm nach der Upstream-Architekturdokumentation angepasst.3
„47 Tools / 20 toolsets“ vs. „28 Tools“ in Ihrem Banner. Die Zahl „47 Tools“ entspricht dem gesamten Tool-Register des Upstream-Repositorys — also jedem Tool, für das Hermes Quellcode bereitstellt, über alle toolsets hinweg. Ihr tatsächlich laufendes CLI zeigt in seinem Startbanner eine kleinere Zahl an (die Installation, anhand derer ich diesen Leitfaden überprüft habe, meldet 28 tools / 89 skills). Das ist kein Fehler. Viele toolsets sind optional und müssen in config.yaml unter toolsets: ausdrücklich aktiviert werden — Adapter für Messaging-Plattformen, Browserautomatisierung, umfangreichere Scraping-Tools usw. Die Gesamtzahl im Register zeigt, „was verfügbar ist“; die Zahl im Banner zeigt, „was in Ihrem aktuellen profile aktiviert ist“. Prüfen Sie mit hermes tools --list, welche toolsets aktiv sind, und aktivieren oder deaktivieren Sie einzelne toolsets über den Block toolsets: in ~/.hermes/config.yaml (oder innerhalb einer laufenden Sitzung mit /tools list / /tools enable <name> / /tools disable <name> — beim Entfernen eines Tools wird die Sitzung zurückgesetzt, damit der Agent sein Tool-Manifest neu erstellt).
Die drei API-Modi
Hermes abstrahiert Provider-Unterschiede in drei API-Modi, die zur Laufzeit automatisch ausgewählt werden:3
| API-Modus | Verwendet von |
|---|---|
chat_completions |
OpenRouter, z.ai, Kimi, MiniMax, DeepSeek, Alibaba, die meisten benutzerdefinierten Endpoints, jeder OpenAI-kompatible Server |
codex_responses |
OpenAI Codex (über ChatGPT OAuth) |
anthropic_messages |
Anthropic API (nativ), Anthropic OAuth, Anthropic-kompatible Proxys |
Der Resolver runtime_provider.py ordnet Tupel aus (provider, model) für mehr als 18 Provider (api_mode, api_key, base_url) zu und verarbeitet dabei OAuth-Abläufe, Credential-Pools und Aliasauflösung.3
Datenfluss durch eine CLI-Sitzung
User input → HermesCLI.process_input()
→ AIAgent.run_conversation()
→ prompt_builder.build_system_prompt()
→ runtime_provider.resolve_runtime_provider()
→ API call (chat_completions / codex_responses / anthropic_messages)
→ tool_calls? → model_tools.handle_function_call() → loop
→ final response → display → save to SessionDB
Aus der Upstream-Architekturseite.3
Reihenfolge der Prompt-Zusammenstellung
Der Prompt-Stack umfasst:13
SOUL.md(Agentenidentität — oder integrierter Fallback, falls nicht verfügbar)- Verhaltensempfehlungen mit Tool-Bezug
- Speicher-/Benutzerkontext (
MEMORY.md,USER.md) - Hinweise zu Skills
- Kontextdateien (
AGENTS.md,.cursorrules) - Zeitstempel
- Plattformspezifische Formatierungshinweise
- Optionale System-Prompt-Overlays wie
/personality
SOUL.md bildet die Grundlage — alles andere baut darauf auf.13
Sitzungsspeicherung
SQLite-basierte Sitzungsspeicherung mit FTS5-Volltextsuche. Sitzungen verfügen über Abstammungsverfolgung (Eltern-/Kindbeziehungen über Komprimierungen hinweg), Isolation pro Plattform sowie atomare Schreibvorgänge mit Behandlung von Zugriffskonflikten.3
Plugin-System
Drei Erkennungsquellen: ~/.hermes/plugins/ (Benutzer), .hermes/plugins/ (Projekt) und pip-Einstiegspunkte. Plugins registrieren Tools, Hooks und CLI-Befehle über einen Kontext-API. Speicher-Provider sind ein spezialisierter Plugin-Typ unter plugins/memory/.3
hermes plugins # Interactive enable/disable UI
hermes plugins install <repo> # Install from Git URL or owner/repo
hermes plugins enable <name>
hermes plugins disable <name>
hermes plugins list
Designprinzipien
Aus der Upstream-Architekturseite:3
| Prinzip | Bedeutung in der Praxis |
|---|---|
| Prompt-Stabilität | Der System-Prompt ändert sich nicht mitten in der Unterhaltung. Keine Cache-brechenden Mutationen außer durch ausdrückliche Benutzeraktionen (/model) |
| Beobachtbare Ausführung | Jeder Tool-Aufruf ist über Callbacks für den Benutzer sichtbar. Fortschrittsaktualisierungen in CLI (Spinner) und gateway (Chat-Nachrichten) |
| Unterbrechbar | API-Aufrufe und Tool-Ausführung können durch Benutzereingaben oder Signale während der Ausführung abgebrochen werden |
| Plattformunabhängiger Kern | Eine AIAgent-Klasse bedient CLI, gateway, ACP, Batch und API-Server. Plattformunterschiede befinden sich im Einstiegspunkt |
| Lose Kopplung | Optionale Subsysteme (MCP, Plugins, Speicher-Provider, RL-Umgebungen) verwenden Registry-Muster und check_fn-Gating statt harter Abhängigkeiten |
| Profile-Isolation | Jedes profile erhält sein eigenes HERMES_HOME, seine eigene Konfiguration, Speicher, Sitzungen und gateway-PID. Mehrere profile können gleichzeitig laufen |
Migration von OpenClaw
Hermes Agent ist der Nachfolger von OpenClaw. Falls Sie von einer bestehenden OpenClaw-Installation migrieren:65
hermes claw migrate --dry-run # Preview what would be migrated
hermes claw migrate --preset full # Full migration including API keys
hermes claw migrate --preset user-data --overwrite # User data only, no secrets
hermes claw migrate --source /custom/path # Non-default OpenClaw location
hermes claw migrate liest standardmäßig aus ~/.openclaw (erkennt außerdem automatisch die Legacy-Verzeichnisse ~/.clawdbot und ~/.moldbot) und schreibt nach ~/.hermes.6
Direkt importiert (mehr als 30 Kategorien): SOUL.md, MEMORY.md, USER.md, AGENTS.md, Skills aus 4 Quellverzeichnissen, Standardmodell, benutzerdefinierte Provider, MCP-Server, Tokens und Allowlists für Messaging-Plattformen (Telegram, Discord, Slack, WhatsApp, Signal, Matrix, Mattermost), Agent-Standardeinstellungen (Reasoning-Aufwand, Komprimierung, menschliche Verzögerung, Zeitzone, Sandbox), Richtlinien zum Zurücksetzen von Sitzungen, Genehmigungsregeln, TTS-Konfiguration, Browsereinstellungen, Tool-Einstellungen, exec-Timeout, Befehls-Allowlist, gateway-Konfiguration und API-Schlüssel aus 3 Quellen.6
Zur manuellen Prüfung archiviert: cron-Jobs, Plugins, Hooks/Webhooks, Speicher-Backend (QMD), Skills-Registry-Konfiguration, UI/Identität, Logging, Multi-Agent-Setup, Kanalbindungen, IDENTITY.md, TOOLS.md, HEARTBEAT.md, BOOTSTRAP.md.6
Die API-Schlüsselauflösung prüft drei Quellen in Prioritätsreihenfolge: Konfigurationswerte → ~/.openclaw/.env → auth-profiles.json.6
Fehlerbehebung
„No inference provider configured. Run ‘hermes model’ to choose a provider and model“
Der erste Fehler, auf den jede frische Installation stößt: Hermes hat noch keinen aufgelösten Provider. Das bedeutet genau, was dort steht — keiner der drei Authentifizierungspfade hat einen nutzbaren Provider hervorgebracht. Führen Sie Folgendes aus:
hermes model
Die interaktive Auswahl führt durch jeden unterstützten Provider, einschließlich der OAuth-Gerätecode-Flows (Nous Portal, GitHub Copilot, Anthropic, OpenAI Codex) und benutzerdefinierter Endpoints für selbst gehostete Server. Wenn Sie erwartet haben, dass bereits ein Provider konfiguriert ist, zeigt hermes doctor, welche Zugangsdaten Hermes tatsächlich sehen kann. Die üblichen Ursachen sind ein an der falschen Stelle hinterlegter API-Schlüssel (er gehört in .env oder wird über hermes config set gesetzt, nicht in Ihr Shell-Profil), abgelaufene OAuth-Zugangsdaten in ~/.hermes/auth.json oder ein benutzerdefinierter Endpoint in config.yaml, dessen base_url verloren gegangen ist. Die Authentifizierungspfade werden in Authentication & Providers ausführlich behandelt.27
„API key not set“
Führen Sie hermes model aus, um Ihren Provider interaktiv zu konfigurieren, oder hermes config set OPENROUTER_API_KEY your_key. Der Befehl hermes doctor zeigt Ihnen genau, welche Schlüssel fehlen.7
„Context limit: 2048 tokens“ beim Start (lokale Modelle)
Hermes erkennt die Kontextlänge automatisch über den /v1/models-Endpoint Ihres Servers, doch viele lokale Server melden niedrige Standardwerte. Legen Sie sie explizit in config.yaml fest:2
model:
default: your-model
provider: custom
base_url: http://localhost:11434/v1
context_length: 32768
Tool-Aufrufe erscheinen als Text, statt ausgeführt zu werden
Auf Ihrem Server ist Tool Calling nicht aktiviert, oder das Modell unterstützt es über die Implementierung des Servers nicht.2
| Server | Lösung |
|---|---|
| llama.cpp | Fügen Sie dem Startbefehl --jinja hinzu |
| vLLM | Fügen Sie --enable-auto-tool-choice --tool-call-parser hermes hinzu |
| SGLang | Fügen Sie --tool-call-parser qwen hinzu (oder einen passenden Parser) |
| Ollama | Tool Calling ist standardmäßig aktiviert — prüfen Sie mit ollama show <model>, ob Ihr Modell es unterstützt |
| LM Studio | Aktualisieren Sie auf 0.3.6+ und verwenden Sie ein Modell mit nativer Tool-Unterstützung |
Antworten werden mitten im Satz abgeschnitten
Dafür gibt es zwei mögliche Ursachen:2
- Niedrige Ausgabelimitierung (
max_tokens) auf dem Server — SGLang verwendet standardmäßig 128 Tokens pro Antwort. Setzen Sie--default-max-tokensauf dem Server oder konfigurieren Siemodel.max_tokensinconfig.yaml. - Kontexterschöpfung — Das Modell hat sein Kontextfenster gefüllt. Erhöhen Sie
model.context_lengthoder aktivieren Sie die Kontextkomprimierung in Hermes.
„Connection refused“ von WSL2 zu einem unter Windows gehosteten Modellserver
WSL2 verwendet einen virtuellen Netzwerkadapter mit eigenem Subnetz — localhost innerhalb von WSL2 verweist auf die Linux-VM, nicht auf den Windows-Host. Es gibt zwei Optionen:2
Gespiegelte Netzwerkverbindung (Windows 11 22H2+): Bearbeiten Sie %USERPROFILE%\.wslconfig:
[wsl2]
networkingMode=mirrored
Führen Sie anschließend wsl --shutdown aus und starten Sie neu. Danach funktioniert localhost bidirektional.
Fallback über die Host-IP (ältere Windows-Versionen): Ermitteln Sie innerhalb von WSL2 die IP des Windows-Hosts und verwenden Sie sie statt localhost:
ip route show | grep -i default | awk '{ print $3 }'
# Use that IP as the base_url host
Der Modellserver muss außerdem an 0.0.0.0 statt an 127.0.0.1 gebunden werden — setzen Sie für Ollama OLLAMA_HOST=0.0.0.0, fügen Sie für llama-server/SGLang --host 0.0.0.0 hinzu oder aktivieren Sie in LM Studio „Serve on Network“.2
Wo befindet sich alles?
hermes status und hermes dump helfen Ihnen hier weiter. hermes logs list zeigt alle Logdateien mit ihren Größen an. hermes config path gibt den Speicherort der Konfigurationsdatei aus. hermes config env-path gibt den Speicherort von .env aus.6
FAQ
Was ist der Unterschied zwischen Hermes Agent und Claude Code?
Claude Code ist der offizielle CLI von Anthropic, auf Anthropic-Modelle beschränkt. Hermes Agent ist ein Open-Source-Agent-Framework von Nous Research, das mit jedem OpenAI-kompatiblen Provider funktioniert — Nous Portal, OpenRouter, Anthropic, GitHub Copilot, z.ai, Kimi, MiniMax, DeepSeek, Hugging Face, Google oder Ihrem eigenen selbst gehosteten Endpoint.12 Hermes bringt zudem ein Messaging gateway für Telegram/Discord/Slack/WhatsApp/Signal mit, das Claude Code nicht bietet.
Kann ich Hermes mit einem Anthropic API-Schlüssel verwenden?
Ja. Auf drei Arten:2
- Setzen Sie
ANTHROPIC_API_KEYin~/.hermes/.envund führen Siehermes chat --provider anthropic --model claude-sonnet-4-6aus. - Führen Sie
hermes modelaus und wählen Sie Anthropic — Hermes verwendet, sofern verfügbar, den Zugangsdaten-Speicher von Claude Code. - Setzen Sie als Fallback einen manuellen
ANTHROPIC_TOKEN(Setup-Token oder OAuth-Token).
Option 2 ist vorzuziehen, wenn Sie Claude Code bereits auf demselben Rechner verwenden — dadurch bleiben aktualisierbare Claude-Zugangsdaten aktualisierbar.
Wie wechsle ich Provider, ohne meine Unterhaltung zu verlieren?
Verwenden Sie innerhalb einer Sitzung /model provider:model. Der Unterhaltungsverlauf, der Speicher und die skills werden vollständig übernommen:9
/model zai:glm-5
/model openrouter:anthropic/claude-sonnet-4
/model custom:local:qwen-2.5
Ich habe Anthropic konfiguriert, aber Vision/Web/Komprimierung funktionieren nicht
Sie stoßen auf den Fallback für Hilfsmodelle. Vision, Web-Zusammenfassungen, Komprimierung und andere Nebenaufgaben verwenden ein separates Hilfs-LLM — standardmäßig Gemini Flash über die automatische Erkennung (OpenRouter → Nous → Codex). Wenn keines davon konfiguriert ist und Sie nur Anthropic eingerichtet haben, verschlechtern sich diese Funktionen unbemerkt.4
Lösung: Fügen Sie entweder einen OPENROUTER_API_KEY für Hilfsaufgaben hinzu oder konfigurieren Sie die Hilfsslots neu, damit sie Ihren primären Provider verwenden. Beachten Sie, dass die Kontextkomprimierung in ihrem eigenen compression:-Block der obersten Ebene liegt und summary_provider erwartet, nicht auxiliary.compression.provider — der Slot auxiliary.compression stellt lediglich ein timeout bereit. Vollständige Lösung:
auxiliary:
vision: { provider: "main" }
web_extract: { provider: "main" }
compression:
summary_provider: "main"
Was ist der Unterschied zwischen SOUL.md und AGENTS.md?
SOUL.md ist die Identität Ihres Agenten — Ton, Stil und Standardvorgaben für die Kommunikation. Sie befindet sich in ~/.hermes/SOUL.md und begleitet Sie überallhin. AGENTS.md ist projektspezifisch — Architektur, Konventionen, Befehle, Pfade — und befindet sich in Ihrem Projektverzeichnis.13 Wenn es Sie überallhin begleiten soll, verwenden Sie SOUL.md. Gehört es zu einem Projekt, verwenden Sie AGENTS.md.
Wie führe ich mehrere Hermes-Instanzen parallel aus?
Profile. Jedes Profil erhält sein eigenes HERMES_HOME, seine eigene Konfiguration, seinen eigenen Speicher, eigene Sitzungen und eine eigene gateway-PID:6
hermes profile create work --clone
hermes profile use work # Sticky default
hermes -p work chat -q "..." # One-off without switching
hermes profile alias work --name h-work # Wrapper script
Unterstützt Hermes lokale LLMs?
Ja, über den Pfad für benutzerdefinierte Endpoints. Hermes funktioniert mit jedem OpenAI-kompatiblen Server: Ollama, vLLM, SGLang, llama.cpp/llama-server, LM Studio, LocalAI, Jan oder Ihrem eigenen.2 Eine serverbezogene Einrichtung finden Sie unter Custom & Self-Hosted Endpoints.
Warum zeigt mein Startbanner weniger Tools an, als laut Guide in Hermes enthalten sind?
Der Guide nennt 47 Tools / 20 toolsets aus der Upstream-Architekturregistrierung — das ist die Gesamtzahl der Tools, für die Hermes über alle toolsets hinweg Quellcode bereitstellt. Ihre laufende Installation zeigt im Banner eine kleinere Zahl an (die für diesen Guide verwendete Referenzinstallation meldet 28 Tools), weil Hermes beim Start nur die Standard-toolsets aktiviert. Viele toolsets sind optional: Messaging-gateway-Adapter, Browserautomatisierung, umfangreichere Scraping-Stacks und mehrere spezialisierte Integrationen müssen unter toolsets: in ~/.hermes/config.yaml ausdrücklich aufgeführt werden, bevor sie geladen werden. Gesamtzahl der Registrierung = „was verfügbar ist, wenn Sie es aktivieren.“ Gesamtzahl im Banner = „was Ihr aktuelles Profil tatsächlich geladen hat.“ Verwenden Sie hermes tools --list, um zu sehen, welche toolsets aktiv sind und welche verfügbar, aber deaktiviert sind. Schalten Sie einzelne toolsets zur Laufzeit mit /tools enable <name> und /tools disable <name> um (das Deaktivieren löst ein Zurücksetzen der Sitzung aus, damit der Agent sein Tool-Manifest mit der neuen Struktur neu erstellt).
Wie behandelt Hermes einen Modell-Fallback, wenn mein primärer Provider ausfällt?
Konfigurieren Sie einen fallback_model-Block in config.yaml:2
fallback_model:
provider: openrouter
model: anthropic/claude-sonnet-4
Wenn das primäre Modell ausfällt (Rate Limit, Serverfehler, Authentifizierungsfehler), wechselt Hermes mitten in der Sitzung zum Fallback, ohne den Unterhaltungsverlauf zu verlieren. Dies geschieht höchstens einmal pro Sitzung.
Kann der Agent seine eigenen skills mit der Zeit verbessern?
Ja — das ist der „selbstverbessernde“ Teil von Hermes Agent. Der Agent kann über das Tool skill_manage skills erstellen, aktualisieren und löschen. Wenn er einen nicht trivialen Workflow herausfindet, speichert er den Ansatz als skill für die spätere Wiederverwendung.11 Der Agent erstellt skills nach komplexen Aufgaben (5+ Tool-Aufrufe), wenn er auf Fehler stößt und den funktionierenden Weg findet, wenn Sie seinen Ansatz korrigieren oder wenn er einen nicht trivialen Workflow entdeckt.
Gibt es eine IDE-Integration?
Ja — Hermes kann als ACP-Server (Agent Client Protocol) für VS Code, Zed und JetBrains ausgeführt werden:6
pip install -e '.[acp]'
hermes acp
Änderungsprotokoll
| Datum | Änderung | Quelle |
|---|---|---|
| 2026-07-28 | Leitfaden v1.12: Anhand der Suchnachfrage ergänzte Themenabdeckung – für 2 gut konvertierende Themen fehlte eine passende Überschrift. Kein neues Release. Laut GSC konvertieren hermes swarm und hermes agent swarm bei Position ~8 mit 4,4–6,3 % und hermes smart model routing bei Position 6,7 mit 4,9 %, obwohl es zu keinem der Begriffe einen Abschnitt gab: Swarm kam nur im Fließtext innerhalb des Multi-Agent-Kanbans und in Änderungsprotokollzeilen vor; „smart model routing“ erschien ausschließlich in einer Fußnote. Unter Multi-Agent-Kanban wurde Was ist ein Hermes Swarm? ergänzt – der Abschnitt definiert einen Swarm als parallele Worker auf einem dauerhaften Board, dokumentiert die Swarm-Topologie von v0.15.0, automatische Zerlegung, modellspezifische Überschreibungen pro Aufgabe, geplante Aufgaben und Worktree-Verwaltung und zeigt tabellarisch, welchen Fehler jeder Mechanismus verhindert. Provider-Rotation und Fallback wurde in Smart Model Routing: Provider-Rotation und Fallback umbenannt und um eine Einleitung ergänzt, die Anmeldedatenpools, Fallback-Modell und Hilfsrouting als zusammenhängendes System beschreibt. Da intern kein Anker verlinkt war, beeinträchtigt die Umbenennung nichts. |
28 2 6 |
| 2026-08-20 | Leitfaden v1.13: v0.20.3 (Tag v2026.8.16.2, veröffentlicht am 17. August) und v0.20.4 (Tag v2026.8.18, 18. August). Neuer Unterabschnitt zum Herald Release: Die Rollup-Reihe enthält nun Funktionen und dient nicht mehr nur der Stabilisierung. v0.20.3 (~250 Commits/~125 PRs): Migration von MCP 2.x zu SDK mit Unterstützung des zustandslosen Protokolls vom 2026-07-28, gebündeltes Bot-Mode-Plugin (hermes-bots) mit zentralem Teamkollegenprotokoll, CommandCode-Provider-Plugin, Cua Driver 0.20 mit Laufzeitverträgen für Computernutzung, Härtung der Laufzeitverantwortung für Python, Selbstheilung des cron-Schedulers, Korrekturen gegen Datenverlust bei Sitzungsübergaben sowie Ökosystem-Portierungen (/worktree, Erhaltung manueller Änderungen bei /rollback, Sicherheitsprüfung bei Plugin-Installationen). v0.20.4 (~146 Commits/~74 PRs): Glas-/Transluzenzoberfläche für den Desktop mit Frost-Auswahl, SESSIONS|BOTS-Seitenleiste mit Tabs und Ein-/Ausblendung einzelner Bots, beratende Tier-1-Prüfung von Skill-Installationen durch NVIDIA SkillEvaluator (Lizenz und Sicherheit), gehärteter Medienversand per cron sowie ehrliche Statusmeldung von hermes update bei geparkten Branches. Beide Releases erklären, dass die vollständigen kuratierten Hinweise mit v0.21.0 erscheinen – die Zusammenfassungen beruhen auf den eigenen Fensterbeschreibungen der Releases. Einleitungssatz und Tag-Abfolge wurden aktualisiert. |
23 |
| 2026-08-16 | Leitfaden v1.12: v0.20.0 „The Herald Release“ (3. August, Tag v2026.8.3) sowie die stabilisierenden Tags v0.20.1 (13. August) und v0.20.2 (16. August). 3 Korrekturen beheben nicht mehr funktionierende Anweisungen: Node 26 ist erforderlich (das Installationsprogramm setzt NODE_VERSION="26" fest und lehnt ältere Laufzeiten ab – die Angabe Node v22 auf der Dokumentationswebsite ist veraltet, daher gelten Installationsprogramm und Release Notes), pip und Homebrew wurden eingestellt, nicht nur als veraltet markiert („Shell-Installationsprogramm/Docker/Nix sind die unterstützten Kanäle“), und das standardmäßige Iterationslimit wurde von 90 auf 500 erhöht, wodurch sämtliche Zahlen in der Tabelle zum Budgetdruck ungültig wurden. Der Installationsbefehl wurde auf die kanonische Adresse https://hermes-agent.nousresearch.com/install.sh korrigiert. Entfernte Oberfläche: Die skill-Quelle claude-marketplace existiert nicht mehr und wurde in der Quellliste durch browse-sh ersetzt; die standardmäßigen GitHub-Taps sind nun openai, anthropics, huggingface, NVIDIA und gstack. Das Messaging-gateway wurde durch direkte Aufzählung der Dokumentationsvergleichstabelle von 22 auf 28 Plattformen korrigiert (die Dokumentation nennt keine offizielle Gesamtzahl). Windows (nativ) gehört zu Tier 1 und ist keine frühe Beta; macOS unterstützt nur Apple Silicon. Ein neuer Abschnitt behandelt das Release selbst: dialogorientierte Sprache mit Unterbrechungsmöglichkeit, A2A v1.0, signierte ausgehende Lebenszyklus-Webhooks, Skill für belegte Zitate, die CLI-Welle mit !//init//diff//context//focus und hermes import-agent, Befehlshelfer als Secret-Quelle, Kaltstart von hermes -w von ~14 s auf ~1,8 s sowie Desktop-Artefakte und ein Plugin-SDK. Als unverändert verifiziert: die 3 Authentifizierungswege, die Struktur von ~/.hermes/, hermes update und die dokumentierte Tool-Liste. |
24 |
| 2026-07-21 | Leitfaden v1.11: v0.19.0 „The Quicksilver Release“ (20. Juli 2026, Tag v2026.7.20). Abschnitt „Neu in v0.19.0“ ergänzt: ~80 % kürzere TTFT beim ersten Turn (kalte Übermittlung bis Dispatch ~4,3 s → ~0,9 s über CLI/gateway/TUI/Desktop/cron hinweg), standardmäßig live gestreamtes Reasoning (display.show_reasoning EIN), Desktop-Beschleunigung über ~20 PRs (14-mal schnelleres Streaming-Markdown) plus inkrementelles Markdown in der TUI; pip-/Homebrew-Installationen als veraltet markiert (nur Warnung „nicht unterstütztes Altsystem“, Entfernung der PyPI-/Homebrew-Veröffentlichung geplant) – Installationsabschnitt und Kurzfassung auf das einzeilige Installationsprogramm korrigiert; austauschbare SecretSource mit Bitwarden- und 1Password-Providern (op://-Referenzen, mehrere Vaults, deterministische Priorität, Herkunft pro Variable); intelligente Genehmigungen als Standard (unabhängiger LLM-Prüfer je markiertem Befehl) plus benutzerdefinierte Ablehnungsregeln, die auch unter YOLO gelten, plus /deny <reason> und erneut integrierte Genehmigungsausweitung durch Plugin-pre_tool_call; Abrechnung im Terminal mit /subscription und /topup sowie Desktop-Abrechnungstab (die Behauptung, es gebe keinen eigenen Abonnementbefehl, wurde entfernt); Live-Transkripte von Subagents, dauerhafte Hintergrunddelegation und Verpflichtungsregister für Zustellungen in state.db; max_async_children zugunsten einheitlicher Parallelitätsgrenzen für Delegationen als veraltet markiert; profilbasiertes Nachrichtenrouting im gateway (1 gemultiplextes Bot-Token → isolierte profile, GATEWAY_MULTIPLEX_PROFILES, Routingindex in state.db, sessions.json als optionaler Altsystemspiegel); Provider/Modelle: Fireworks AI (Platz 2 in der Auswahl), DeepInfra, Upstage Solar, GPT-5.6 (Sol/Terra/Luna + Pro) durchgängig, grok-4.5 GA, kimi-k3 (kimi-k2.x eingestellt), Claude Sonnet 5 vollständig integriert, je Provider enabled: false plus excluded_providers, Reasoning-Stufen max/ultra mit Überschreibungen je Modell/MoA-Slot und sitzungsbezogenem /reasoning; CLI/MCP: hermes sessions export (Markdown/Quarto/HTML/nur Prompt/HF-Trace, --redact), /model --once, gestapelte Slash-skill-Aufrufe, --safe-mode, hermes config get/unset, echtes Headless-hermes serve, MCP-Benennung mcp__server__tool. Protokolliert außerdem die übersehenen Patch-Tags v0.18.1 (Tag v2026.7.7) und v0.18.2 (Tag v2026.7.7.2), 7.–8. Juli 2026 – Infrastruktur-Patch-Rollups; die wesentliche Korrektur von v0.18.2 hebt die feste WhatsApp-Baileys-Version zugunsten von 7.0.0-rc13 auf, damit Docker-Builds zuverlässig funktionieren. |
25 26 |
| 2026-07-16 | Ersten Eintrag zur Fehlerbehebung für den wörtlichen Startfehler ergänzt: „No inference provider configured. Run ‘hermes model’ to choose a provider and model“ – anhand der Suchnachfrage; verweist auf die interaktive Auswahl, hermes doctor und die 3 Authentifizierungswege. Keine Produktänderungen. |
2 7 |
| 2026-07-01 | Leitfaden v1.10: v0.18.0 „The Judgment Release“ (1. Juli 2026, Tag v2026.7.1). Abschnitt „Neu in v0.18.0“ ergänzt: vollständiger P0-/P1-Rückstand abgearbeitet (~692 Einträge); Mixture-of-Agents als erstklassige Funktion mit beschrifteter Ensemble-Ausgabe je Modell und Live-Streaming; Abschlussverträge – /goal prüft die eigene Arbeit durch Ausführung der Projektprüfungen; /learn (Arbeitsablauf beschreiben → wiederverwendbarer skill gemäß CONTRIBUTING.md); /journey-Zeitleiste für Speicher/skills plus Desktop-Speichergraph; Auffächerung von Subagents im Hintergrund (gleichzeitig delegierte Aufgaben); Desktop Projects (Projekt/Repository/Lane); auf null skalierbares gateway mit Drain-Koordination; Google Vertex AI (Gemini über GCP-Dienstkonten, automatische Aktualisierung von OAuth2); /prompt-Editor über \$EDITOR. Quelle: hermes-agent releases. |
22 |
| 2026-06-21 | Leitfaden v1.9: v0.17.0 „The Reach Release“ (19. Juni 2026, Tag v2026.6.19). Abschnitt „Neu in v0.17.0“ ergänzt. Messaging: iMessage ohne Relay über Photon Spectrum (hermes photon login, Gerätecode-OAuth), offizieller WhatsApp-Business-Cloud-Adapter für API (ohne Bridge), SimpleX-Gruppen und -Anhänge, Raft-Plattform-Plugin. Modelle: z-ai/glm-5.2 (1M), anthropic/claude-fable-5, laguna-m.1, nemotron-3-ultra, grok-composer-2.5-fast (xAI OAuth, 200k); xAI-Standard → grok-build-0.1; adaptive Anthropic-Modelle lassen das Feld reasoning entfallen. Desktop/Dashboard: Hintergrund-Subagents mit Live-Beobachtungsfenstern (delegate_task(background=true)), vollständiger profile-Builder, überarbeiteter Skills Hub, Automatisierungs-Blueprints, sichere 401-Anmeldung, Themes aus dem VS Code Marketplace, japanische und traditionell-chinesische Benutzeroberfläche. Skills/Tools: Bild-zu-Bild-Bearbeitung mit image_generate, atomarer operations-Batch für memory, skill simplify-code, boolesches write_approval (ersetzt write_mode). Architektur: MCP-Elicitation-Handler, austauschbarer CronScheduler plus Chronos, Managed-Bereich (/etc/hermes), Gateway-zu-Gateway-Relay. Befehle: /version, /billing, hermes curator run --consolidate (Opt-in). Sicherheit: Umgehung der Shell-Escape-Ablehnungsliste geschlossen, ausfallsicher ablehnende Genehmigungs-/gateway-Adapter, bereinigte cron-Umgebung, geschwärzte Secrets in Debug-Dumps, MCP-stdio-Prüfung auf Datenabfluss sowie CVE-Aktualisierungen für urllib3 und PyJWT. |
21 |
| 2026-06-08 | Leitfaden v1.8: v0.16.0 „The Surface Release“ (5. Juni 2026, Tag v2026.6.5). Leitfaden in v0.16 umbenannt und Abschnitt „Neu in v0.16.0“ ergänzt. Kernpunkt: Hermes ist nicht länger auf das Terminal beschränkt. Native Hermes-Desktop-App (Electron, macOS/Linux/Windows) mit Ein-Klick-Installation, Selbstaktualisierung innerhalb der App, Streaming-Chat, Drag-and-drop und Einfügen von Bildern aus der Zwischenablage, Cmd+K-Palette, Sitzungsarchiv/-suche, Modellauswahl in der Statusleiste, Verbindung mit entferntem gateway über sicheres WebSocket (OAuth oder Benutzername/Passwort, Hosts je profile, profile-übergreifende @session-Links) sowie vollständiger Übersetzung ins vereinfachte Chinesisch über typisiertes i18n. Browser-Verwaltungsoberfläche (Web-Dashboard → vollständige Administration): MCP-Katalog aktivieren/deaktivieren, Verwaltung von Anmeldedaten, Erstellung von Webhooks/Hooks, Speicherkonfiguration, gateway-Steuerung, Systemseite mit Prüfung vor Aktualisierung plus Debug Share, neue Channels-Seite und austauschbare Authentifizierung (Benutzername/Passwort, selbst gehostetes OIDC, hermes dashboard register). Neue Befehle: /undo [N] (CLI/TUI/Messaging), konfigurierbare Standardschnittstelle (cli/tui, --cli), einheitliches /model plus Sitzungs-Overlay in der TUI, hermes portal, hermes prompt-size, hermes sessions optimize. Neue Modelle: deepseek-v4-flash, MiniMax-M3 (1M Kontext), qwen3.7-plus, gemini-3.5-flash; erstklassiges xAI-Grok-OAuth im Desktop-Launcher; unscharfe Modellauswahl; stündliche Katalogaktualisierung. Skills: schlankerer Standardsatz (Spotify → natives Plugin, Linear → hermes mcp install linear, nicht mehr funktionierende skills entfernt), Relevanzfilter environments: (kanban/docker/s6), standardmäßig vertrauenswürdiger Tap NVIDIA/skills, progressive (begrenzte) Offenlegung von MCP-/Plugin-Tools. Sicherheit: CVE-2026-48710 (Starlette BadHost) auf ≥1.0.1 festgelegt; SSRF-Prüfungen aus dem Event-Loop verlagert; Bedrock-Bearer-Token aus der Subprozessumgebung entfernt; Lesezugriff auf bws_cache.json geschützt; docker restart/stop/kill den gefährlichen Mustern hinzugefügt; Bereinigung unsichtbarer Unicode-Zeichen. 2 P0- und 62 P1-Einträge geschlossen (16 mit Sicherheitskennzeichnung). |
20 |
| 2026-05-31 | Leitfaden v1.7.1: v0.15.1 (29. Mai 2026, 01:12 UTC) – Velocity-Patch. Hotfix am Tag nach Velocity; Tag-Zeile v2026.5.29 festgelegt. Behebt die 401-Neuladeschleife des Dashboards bei Bereitstellungen im Loopback-Modus. Docker behandelt --insecure nicht mehr implizit – setzen Sie ausdrücklich HERMES_DASHBOARD_INSECURE=1, um die Funktion wieder zu aktivieren. Unqualifizierte MCP-Befehle (npx, npm, node) werden in Docker-Containern wieder korrekt aufgelöst. Quellen-Badges und Kategorie-Seitenleiste der Skills-Seite werden gerendert. Kanban-Worker reagieren sauber auf SIGTERM, statt verwaiste Prozesse zu hinterlassen. Der Skills.sh-Katalog wurde durch Sitemap-Erkennung von 858 auf 19.932 Einträge erweitert. 28 Commits, 21 zusammengeführte PRs, 9 Mitwirkende. v0.15.2 (29. Mai 2026, 13:37 UTC) – Velocity-Paketierungs-Patch. Korrigiert Wheel- und sdist-Distributionen, sodass sie plugin.yaml-Manifeste enthalten und Installationen aus PyPI ohne seitliches Laden des Quellbaums funktionieren. Reiner Paketierungs-Hotfix, 4 Mitwirkende. |
27 |
| 2026-05-28 | Leitfaden v1.7: v0.15.0 (28. Mai 2026) – The Velocity Release (Tag v2026.5.28) ergänzt. Kernpunkt: umfassende Refaktorierung plus neue Orchestrierungsprimitive. Codebasis-Refaktorierung: run_agent.py um 76 % reduziert (16.083 → 3.821 Zeilen) und auf 14 zusammenhängende Module verteilt. Multi-Agent-Kanban v2: automatische Zerlegung übergeordneter Ziele in Teilaufgaben, Swarm-Topologie zur Koordination paralleler Worker, Modellüberschreibungen je Aufgabe, geplante Aufgaben und Worktree-Verwaltung. Leistung: 1 weitere Sekunde beim Kaltstart eingespart; 47 % weniger Funktionsaufrufe je Unterhaltung; session_search neu gestaltet und 4.500-mal schneller, wobei die LLM-Abhängigkeit und deren API-Kosten entfallen. Sicherheit: Promptware-Abwehr schützt an 3 Sicherheitsengpässen gegen Prompt-Injections der Brainworm-Klasse; die Integration von Bitwarden Secrets Manager ersetzt mehrere API-Schlüssel je Provider durch 1 Bootstrap-Token. Skill-Pakete: mehrere skills gleichzeitig mit 1 Slash-Befehl laden. TUI-Sitzungsorchestrator: mehrere Sitzungen in 1 Terminalfenster verwalten. Neue Provider: Krea 2 (Medium/Large) und FAL-Plugin-Unterstützung für Bilderzeugung; die xAI-Integrationsrunde ergänzt ein Websuch-Plugin, vorgeschaltetes OAuth, Erkennung eingestellter Modelle und natürliche TTS-Pausen. Statistik: 1.302 Commits, 747 zusammengeführte PRs, 321 Mitwirkende aus der Community. Laut GitHub-Release Notes behebt ein Patch am selben oder folgenden Tag die 401-Neuladeschleife des Dashboards, die explizite Umgebungsvariable für Docker --insecure, die Auflösung unqualifizierter MCP-Befehle in Docker (npx, npm, node), die Wiederherstellung der Skills-Seite, die SIGTERM-Behandlung der Kanban-Worker und den vollständigen Skills-Katalog mit 19.932 Einträgen über die Sitemap. |
28 |
| 2026-05-21 | Leitfaden v1.6: v0.14.0 (16. Mai 2026) – The Foundation Release ergänzt. Kernpunkt: schlankere Installations-/Laufzeitbasis sowie umfassendere Provider-, gateway-, Medien- und Prüfoberflächen. Ergänzt wurden SuperGrok-OAuth mit grok-4.3 und 1M Kontext, OpenAI-kompatibles hermes proxy für OAuth-Provider, erstklassiges x_search, pip install hermes-agent, verzögerte Installation von Abhängigkeiten, ~19 s schnellerer Start, 180-mal schnellere Browser-CDP-Aufrufe, LINE plus SimpleX Chat für 22 Messaging-Plattformen, durchgängige Microsoft-Teams-Unterstützung, /handoff, /subgoal, native Klärungsschaltflächen in Telegram/Discord, Discord-Verlaufsnachladung, vision_analyze für Rohpixel, Prüffußzeile je Turn für Dateiänderungen, semantische LSP-Diagnosen bei jedem Schreibvorgang, einheitliches video_generate, computer_use über cua-driver für Nicht-Anthropic-Provider, anklickbare OSC8-URLs, Unterstützung der Zed ACP Registry, OpenRouter Pareto Code Router, NovitaAI, Codex-App-Server-Laufzeit, vertrauenswürdiger Tap huggingface/skills, 9 optionale skills, Plugin-ctx.llm/tool_override, Brave-/DDGS-Websuche, Umbenennung von Qwen Cloud, native Windows-Beta und Schließung von 12 P0-/50 P1-Einträgen. |
19 |
| 2026-05-07 | Leitfaden v1.5: v0.13.0 (7. Mai 2026) – The Tenacity Release ergänzt. Kernpunkt: ein dauerhaftes Multi-Agent-Kanban-Board (Heartbeat, Rückgewinnung, Zombie-Erkennung, Halluzinationsfilter, max_retries je Aufgabe, Boards für mehrere Projekte), das Swarms von einem Delegationsmuster zu einem erstklassigen Primitiv macht. Der neue Befehl /goal bindet den Agent über mehrere Turns hinweg an ein Ziel (Ralph-Loop-Muster als Slash-Befehl). Neues Tool video_analyze, zuerst für Gemini und mit erweiterbarer Unterstützung kompatibler Modelle. xAI Custom Voices TTS als Provider mit Stimmenklonung. i18n für 7 Sprachen (zh-Hans, ja, de, es, fr, uk, tr) für CLI- und gateway-Nachrichten; Dokumentation nur auf zh-Hans. Google Chat als 20. Messaging-Plattform über das austauschbare Adaptermuster; IRC und Microsoft Teams wurden auf dasselbe Muster migriert. ProviderProfile ABC plus plugins/model-providers/ für austauschbare Drittanbieter-Provider ohne Änderungen am Kern. Automatische Sitzungsfortsetzung nach gateway-Neustart, /update und Neuladen von Quelldateien. Checkpoints v2 mit einheitlichem Speicher, echter Bereinigung und Schutzvorgaben für den Datenträger neu geschrieben. 8 geschlossene P0-Sicherheitslücken: standardmäßige Secret-Schwärzung, Discord-DM-Umgehung zwischen Guilds (CVSS 8.1), Ablehnung unbekannter WhatsApp-Absender plus Stummschaltung von Selbstchats, MCP-OAuth-TOCTOU, CLI-auth.json-TOCTOU, Browser-SSRF-Mindestschutz, Prüfung auf Prompt-Injection bei cron, Schwärzung durch hermes debug share. Linting nach Schreibvorgängen für Python/JSON/YAML/TOML, cron-Modus no_agent nur für Skripte, Plattform-Zulassungslisten für Slack/Telegram/Mattermost/Matrix/DingTalk, MCP-Erweiterungen (SSE-Transport, Weiterleitung von OAuth, MEDIA-Tags für Bilder). Statistik seit v0.12.0: 864 Commits, 588 zusammengeführte PRs, 829 geänderte Dateien, 295 Mitwirkende aus der Community, 282 geschlossene Issues (13 P0, 36 P1). |
18 |
| 2026-05-06 | Leitfaden v1.4: v0.12.0 (30. April 2026) – The Curator Release ergänzt. Kernpunkt: ein autonomer Curator im Hintergrund, der über den cron-Ticker des gateways läuft (standardmäßig alle 7 Tage), die skill-Bibliothek anhand eines Kriterienkatalogs bewertet, nicht mehr funktionierende skills entfernt, verwandte skills zusammenführt und Berichte je Durchlauf erstellt – Hermes wartet sich zwischen aktiven Sitzungen selbst. Die Selbstverbesserungsschleife erhielt kriterienbasierte Bewertung, Vorrang für aktive Aktualisierungen, korrekte Laufzeitvererbung und auf Speicher sowie skills begrenzte toolsets. 4 neue Inferenz-Provider: GMI Cloud, Azure AI Foundry, MiniMax OAuth und Tencent Tokenhub. LM Studio wurde zu einer erstklassigen Funktion aufgewertet. Entfernte Modellkatalogmanifeste aktualisieren sich nun automatisch ohne Releases. 2 neue Messaging-Plattformen: Microsoft Teams (19., über austauschbare gateway-Architektur) und Tencent Yuanbao (18., nativer Text plus Medien). Natives Spotify über PKCE-OAuth mit gebündeltem skill; Google-Meet-Plugin für Anrufe und Transkription; Piper Local TTS als Provider. ComfyUI v5 plus TouchDesigner-MCP wurden von optional auf standardmäßig gebündelt umgestellt. Neue skills: Humanizer, claude-design, design-md, airtable. Ergänzungen für CLI: Einmalmodus hermes -z, Vorprüfung hermes update --check, Slash-Befehl /reload-skills, austauschbare Stile für die Beschäftigt-Anzeige. Sichtbarer TUI-Kaltstart durch verzögerte Agent-Initialisierung und Importe um ~57 % verkürzt. Sicherheit: Secret-Schwärzung standardmäßig deaktiviert, um Beschädigung von Nutzdaten zu verhindern; strikte Sperrliste für nicht wiederherstellbare Befehle. Statistik: 1.096 Commits, 550 zusammengeführte PRs, 213 Mitwirkende aus der Community. |
17 |
| 2026-04-25 | Leitfaden v1.3: v0.11.0 (23. April 2026) – The Interface Release ergänzt. Vollständige React-/Ink-Neuentwicklung der interaktiven TUI mit einem Python-JSON-RPC-Backend (tui_gateway); fixierter Composer, Live-Streaming mit OSC-52-Zwischenablageunterstützung, stabile Auswahltasten, Statusleiste mit Stoppuhr je Turn und Git-Branch, Bestätigung für /clear, Voreinstellung für helles Theme, Beobachtungs-Overlay für gestartete Subagents. Austauschbare Transportarchitektur – Formatkonvertierung und HTTP-Transport wurden für eine übersichtlichere Provider-Anbindung nach agent/transports/ ausgelagert. Natives AWS Bedrock über API Converse. 5 neue Inferenzwege: NVIDIA NIM, Arcee AI, Step Plan, Google Gemini CLI OAuth und Vercel ai-gateway. GPT-5.5 über Codex OAuth – das neue OpenAI-Flaggschiff ist nun über ChatGPT Codex OAuth ohne separaten API-Schlüssel erreichbar. QQBot (17. Messaging-Plattform) mit Einrichtung per QR-Scan und Streaming. Erweiterte Plugin-Oberfläche: Slash-Befehle, Tool-Dispatch, Ausführungsblockierung, Ergebnistransformation. /steer <prompt> – Hinweise während eines Laufs, die dem laufenden Agent nach seinem nächsten Tool-Aufruf angezeigt werden, ohne den Turn zu unterbrechen oder den Prompt-Cache zu beschädigen. Shell-Hooks binden Skripte ohne Python-Plugins als Lebenszyklus-Hooks ein. Der Webhook-Modus für Direktzustellung leitet Nutzdaten unter Umgehung des Agent direkt an einen Plattformchat weiter, um sie aufzufächern. Intelligentere Delegation mit Orchestratorrollen, konfigurierbarer Starttiefe und Dateikoordination. Das Dashboard erhält ein Plugin-System, Live-Theme-Wechsel, i18n und mobile Anpassungsfähigkeit. Statistik seit v0.9.0: 1.556 Commits, 761 zusammengeführte PRs, 1.314 geänderte Dateien, 224.174 Einfügungen, 29 Mitwirkende aus der Community. |
29 |
| 2026-04-16 | Leitfaden v1.2: v0.10.0 – Nous Tool Gateway ergänzt. Zahlende Abonnenten von Nous Portal können nun ohne zusätzliche API-Schlüssel auf verwaltete Tools zugreifen (Firecrawl-Websuche, FAL-/FLUX-2-Pro-Bilderzeugung, OpenAI TTS, Browserautomatisierung mit Browser Use). Aktivierung je Tool über das neue Konfigurationsfeld use_gateway. Sind beide eingerichtet, bevorzugt die Laufzeit das gateway gegenüber direkten API-Schlüsseln. Umgebungsvariable HERMES_ENABLE_NOUS_MANAGED_TOOLS entfernt. Hermes Agent CLI bleibt MIT-lizenziert und vollständig kostenlos. |
30 |
| 2026-04-13 | Leitfaden v1.1: Funktionen aus v0.8.0 und v0.9.0 ergänzt. Lokales Web-Dashboard, /fast-Modus, Plattformen iMessage plus WeChat (insgesamt 16), Überwachung von Hintergrundprozessen (watch_patterns), austauschbare context engine, hermes backup/hermes import, Termux/Android, Provider xAI plus MiMo plus Google AI Studio plus Qwen, Befehl /debug, umfassende Sicherheitshärtung. |
15 16 |
| 2026-04-10 | Leitfaden v1.0: Erstveröffentlichung zu Hermes Agent v0.7.0. Provider-Authentifizierung, Konfiguration, CLI, Slash-Befehle, Tools, skills, Speicher, gateway, cron, MCP, Komprimierung, Architektur, OpenClaw-Migration, Fehlerbehebung, FAQ. |
Referenzen
-
Nous Research, Projekt-README zu “Hermes Agent” auf GitHub. Primärquelle für die Produktbeschreibung (selbstverbessernder Agent, mehrere Provider, Messaging-gateway, Terminal-Backends, skill-Weiterentwicklung, cron-Planer, Delegation) und den Einzeiler unter “Quick Install”. ↩↩↩
-
Nous Research, “AI Providers” in der Dokumentation zu Hermes Agent. Primärquelle für die vollständige Provider-Liste, die Authentifizierungsmethoden je Provider (Nous Portal OAuth, Codex-Gerätecode, GitHub Copilot-Token-Typen, die drei Authentifizierungsmethoden von Anthropic, chinesische KI-Provider, Hugging-Face-Routing, benutzerdefinierte Endpunkte), die drei Authentifizierungswege (API-Schlüssel in
.env, OAuth überhermes model, benutzerdefinierter Endpunkt inconfig.yaml), die Syntax des Slash-Befehls/model(einschließlichcustom:name:model), Einrichtungsvorlagen für Ollama/vLLM/SGLang/llama.cpp/LM Studio, WSL2-Netzwerkanweisungen, die Erkennungskette für die Kontextlänge, die Konfiguration von Fallback-Modellen, intelligentes Modell-Routing und benannte benutzerdefinierte Provider. Alle providerspezifischen Namen von Umgebungsvariablen, Token-Typen, Überschreibungen der Basis-URL und Modellkennungen in diesem Beitrag stammen von dieser Seite. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Nous Research, “Architecture” im Entwicklerhandbuch zu Hermes Agent. Primärquelle für das Diagramm zur Systemübersicht, die Verzeichnisstruktur, den Datenfluss durch CLI-Sitzungs- und gateway-Nachrichtenpfade, die drei API-Modi (
chat_completions,codex_responses,anthropic_messages), die Provider-Auflösung überruntime_provider.py, die Sitzungspersistenz über SQLite + FTS5, die Plattformliste des Messaging-gateway, die Erkennungsquellen des Plugin-Systems, die profile-Isolierung und die sechs Designprinzipien. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Nous Research, “Configuration” im Benutzerhandbuch zu Hermes Agent. Primärquelle für die Struktur des Konfigurationsverzeichnisses, die Regel für
config.yamlgegenüber.env(„config.yamlhat bei nicht geheimen Einstellungen Vorrang“), die Rangfolge der Konfiguration (CLI-Argumente → Umgebungsvariablen → config.yaml → .env → Standardwerte), die Einstellungen zur Kontextkomprimierung (compression.*-Block mitthreshold,target_ratio,protect_last_n,summary_model,summary_provider,summary_base_url), die Schwellenwerte für Budgetdruck (70 % Vorsicht, 90 % Warnung), Streaming-Zeitüberschreitungen mit automatischer Anpassung für lokale Provider und den vollständigen Konfigurationsblock für Hilfsmodelle (auxiliary:mit den Plätzenvision,web_extract,approval,compression,session_search,skills_hub,mcp,flush_memories). Auch die Beschränkung des Providers"main"auf Hilfs-, Komprimierungs- und Fallback-Plätze stammt von dieser Seite. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Nous Research, “Migrate from OpenClaw” in den Anleitungen zu Hermes Agent. Quelle für den Migrationsablauf von OpenClaw zu Hermes. ↩↩
-
Nous Research, “CLI Commands Reference” in der Referenzdokumentation zu Hermes Agent. Primärquelle für jeden in diesem Beitrag dokumentierten CLI-Befehl der obersten Ebene, darunter
hermes chat,hermes model,hermes gateway,hermes setup,hermes auth,hermes status,hermes cron,hermes webhook,hermes doctor,hermes dump,hermes logs,hermes config,hermes pairing,hermes skills,hermes honcho,hermes memory,hermes acp,hermes mcp,hermes plugins,hermes tools,hermes sessions,hermes insights,hermes claw,hermes profile,hermes completion,hermes updateundhermes uninstall. Alle Flags der Unterbefehle, Optionsbeschreibungen, Verhaltensweisen des Anmeldedaten-Pools, Syntax zur Protokollfilterung, Flags für die OpenClaw-Migration, Befehle zur profile-Verwaltung und Befehle zur Dienstinstallation in diesem Beitrag stammen von dieser Seite. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Nous Research, “Installation” in der Anleitung für die ersten Schritte mit Hermes Agent. Primärquelle für den Einzeiler zur Installation, das Verhalten des Installationsprogramms (Voraussetzungen, Plattformunterstützung, automatische Termux-Erkennung, Anforderungen für Windows/WSL2), die Tabelle der optionalen Erweiterungen, die Schritte zur manuellen Installation und die Überprüfungsbefehle. ↩↩↩↩↩↩↩↩↩
-
Nous Research, “CLI Commands Reference” — siehe insbesondere den Abschnitt zu
hermes dump, der das Ausgabeformat des Befehls (Kopfzeile, Umgebung, Identität, Modell, Terminal, API-Schlüssel, Funktionen, Dienste, Arbeitslast, Konfigurationsüberschreibungen) und seinen vorgesehenen Einsatz zum Teilen von Diagnosedaten beschreibt. ↩ -
Nous Research, “Slash Commands Reference” in der Referenzdokumentation zu Hermes Agent. Primärquelle für jeden in diesem Beitrag aufgeführten Slash-Befehl, die
COMMAND_REGISTRY-Architektur, die Trennung zwischen CLI und Messaging, dynamische skill-Slash-Befehle, Schnellbefehle inconfig.yaml, das Verhalten beim Präfixabgleich und die ausschließlich für Messaging verfügbaren Befehle (/status,/sethome,/approve,/deny,/update,/commands). ↩↩↩↩↩↩↩↩↩↩ -
Nous Research, “Tools & Toolsets” im Benutzerhandbuch zu Hermes Agent. Primärquelle für die Übersicht der Tool-Kategorien, Befehle zur Verwendung von toolset, die sechs Terminal-Backends (lokal, Docker, SSH, Singularity, Modal, Daytona), die Container-Konfiguration (CPU, Arbeitsspeicher, Speicherplatz, persistent), die Sicherheitshärtung für Container, die Verwaltung von Hintergrundprozessen API und die sudo-Unterstützung. ↩↩↩↩↩↩↩↩↩↩
-
Nous Research, “Skills System” im Benutzerhandbuch zu Hermes Agent. Primärquelle für die schrittweise Offenlegung, das
SKILL.md-Format, plattformspezifische skills, die bedingte Aktivierung (fallback_for_toolsets,requires_toolsets,fallback_for_tools,requires_tools), vom Agent verwaltete skills überskill_manage, die Befehle und Quellenliste des skill-Hubs (official,skills-sh,well-known,github,clawhub,claude-marketplace,lobehub), Sicherheitsprüfungen und Vertrauensstufen sowie externe skill-Verzeichnisse. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Nous Research, “Persistent Memory” im Benutzerhandbuch zu Hermes Agent. Primärquelle für die Zeichenbegrenzungen von
MEMORY.md/USER.md, das Muster eingefrorener Momentaufnahmen, Aktionen des Speicher-Tools (add,replace,remove), zu speichernde und auszulassende Inhalte, den Vergleich zwischen Speicher- und Sitzungssuche sowie die Liste der acht externen Speicher-Provider (Honcho, OpenViking, Mem0, Hindsight, Holographic, RetainDB, ByteRover, Supermemory). ↩↩↩↩↩↩↩↩ -
Nous Research, “Personality & SOUL.md” im Benutzerhandbuch zu Hermes Agent. Primärquelle für das Verhalten von
SOUL.md(befindet sich inHERMES_HOME, wird nie überschrieben, steht an Position 1 im System-Prompt und wird vor der Einbindung einer Sicherheitsprüfung unterzogen), die Unterscheidung zwischen SOUL.md und AGENTS.md, die Liste der integrierten Persönlichkeiten (14 Persönlichkeiten vonhelpfulbishype), benutzerdefinierte Persönlichkeiten inconfig.yaml, das Überlagerungsmuster von/personalityund die vollständige Reihenfolge beim Aufbau des Prompt-Stacks. ↩↩↩↩↩↩↩↩↩↩↩↩ -
Nous Research, “Use MCP with Hermes” und MCP Config Reference in den Anleitungen und der Referenz zu Hermes Agent. Quelle für das Konfigurationsformat
mcp_servers:inconfig.yamlmit den Felderncommand,argsundenv. ↩ -
Versionshinweise zu Hermes Agent v0.8.0. 8. April 2026. Automatische Benachrichtigungen für Hintergrundprozesse, kostenloses MiMo v2 Pro auf Nous Portal, Live-Wechsel mit
/modelauf allen Plattformen, nativer Provider für Google AI Studio, Qwen OAuth, inaktivitätsbasierte Zeitüberschreitungen, Genehmigungsschaltflächen in Slack/Telegram, MCP OAuth 2.1 PKCE, zentrale Protokollierung, Erweiterung des Plugin-Systems. ↩↩↩↩↩ -
Versionshinweise zu Hermes Agent v0.9.0. 13. April 2026. Lokales Web-Dashboard, Fast Mode (
/fast), iMessage über BlueBubbles, WeChat + WeCom, Termux/Android, Überwachung von Hintergrundprozessen (watch_patterns), native Provider für xAI + Xiaomi MiMo, austauschbare context engine, einheitliche Proxy-Unterstützung, Sicherheitshärtung (Behebung von Path-Traversal-, Shell-Injection-, SSRF- und RCE-Schwachstellen),hermes backup/hermes import,/debug+hermes debug share, 16 unterstützte Plattformen. 487 Commits, 269 zusammengeführte PRs, 24 Mitwirkende. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Versionshinweise zu Hermes Agent v0.12.0. 30. April 2026. „The Curator release.“ Autonomer Curator im Hintergrund, der die skill-Bibliothek standardmäßig alle 7 Tage über den cron-Ticker des gateway bewertet, bereinigt und konsolidiert. Verbesserte Selbstoptimierungsschleife: rubric-basierte Bewertung, Bevorzugung aktiver Aktualisierungen, korrekte Laufzeitvererbung sowie auf Speicher und skills beschränkte toolsets. Vier neue Inferenzanbieter: GMI Cloud, Azure AI Foundry, MiniMax OAuth, Tencent Tokenhub. LM Studio wurde zum vollwertigen Anbieter aufgewertet. Manifeste entfernter Modellkataloge werden ohne neue Releases automatisch aktualisiert. Zwei neue Messaging-Plattformen: Microsoft Teams (die 19., über die erweiterbare gateway-Architektur) und Tencent Yuanbao (die 18., mit nativer Text- und Medienunterstützung). Native Spotify-Integration über PKCE OAuth mit gebündeltem skill; Google-Meet-Plugin für Anrufe und Transkription; Piper als lokaler TTS-Anbieter. ComfyUI v5 + TouchDesigner-MCP sind standardmäßig enthalten. Neue skills: Humanizer, claude-design, design-md, airtable. CLI:
hermes -zals einmaliger Ausführungsmodus,hermes update --checkzur Vorabprüfung, Slash-Befehl/reload-skills, erweiterbare Stile für Aktivitätsanzeigen. Der Kaltstart der TUI wurde durch verzögerte Initialisierung um etwa 57 % verkürzt. Sicherheit: Die Schwärzung von Geheimnissen ist standardmäßig deaktiviert; strikte Sperrliste für nicht rückgängig zu machende Befehle. Statistik seit v0.11.0: 1.096 Commits, 550 zusammengeführte PRs, 213 Mitwirkende aus der Community. Siehe auch: Release-Tag v2026.4.30. ↩↩↩ -
Versionshinweise zu Hermes Agent v0.13.0. 7. Mai 2026. „The Tenacity release.“ Multi-Agent-Kanban-Board mit heartbeat, Rückforderung, Zombie-Erkennung, Halluzinationssperre, aufgabenspezifischem
max_retriesund projektübergreifenden Boards. Slash-Befehl/goalzum turn-übergreifenden Fixieren von Zielen (Ralph-Loop-Grundbaustein) mit konfigurierbarem turn-Budget. Toolvideo_analyze, vorrangig für Gemini und mit erweiterbarer Kompatibilität für multimodale Modelle. xAI Custom Voices als TTS-Anbieter mit Stimmklonung. Internationalisierung in 7 Sprachen: zh-Hans, ja, de, es, fr, uk, tr (CLI + gateway-Nachrichten; Dokumentation nur auf zh-Hans). Google Chat als 20. Messaging-Plattform über ein erweiterbares Adaptermuster mit generischen Plugin-Hooksenv_enablement_fn/cron_deliver_env_var; IRC und Microsoft Teams wurden auf dasselbe Muster migriert.ProviderProfileABC +plugins/model-providers/für erweiterbare Drittanbieter. Automatische Wiederaufnahme von Sitzungen nach einem Neustart des gateway,/updateund dem Neuladen von Quelldateien. Checkpoints v2 vollständig auf einen einzigen Speicher umgestellt, mit echter Bereinigung, Schutzmechanismen für den Datenträger und ohne verwaiste Schatten-Repositories. Acht geschlossene P0-Sicherheitslücken: standardmäßig aktivierte Schwärzung von Geheimnissen, Umgehung der serverübergreifenden Discord-DM-Beschränkung (CVSS 8,1; Rollen-Zulassungslisten auf einzelne Server beschränkt), WhatsApp lehnt unbekannte Personen standardmäßig ab und antwortet nie im Selbst-Chat, TOCTOU beim Speichern von MCP OAuth-Anmeldedaten, TOCTOU bei CLIauth.jsonin Komponenten zum Schreiben von Anmeldedaten, grundlegender SSRF-Schutz vor Cloud-Metadaten des Browsers beim Hybrid-Routing, Prüfung zusammengesetzter cron-Prompts einschließlich skill-Inhalten auf Prompt-Injection sowie Schwärzung von Protokollinhalten beim Hochladen mithermes debug share. Weitere erwähnenswerte Punkte: Linting nach Schreibvorgängen für Python/JSON/YAML/TOML, skriptbasierter cron-Watchdog-Modusno_agent, plattformweite Zulassungslisten für Slack/Telegram/Mattermost/Matrix/DingTalk, Verbesserungen an MCP (SSE-Transport, Weiterleitung von OAuth, Bildergebnisse als MEDIA-Tags). Statistik seit v0.12.0: 864 Commits, 588 zusammengeführte PRs, 829 geänderte Dateien, 295 Mitwirkende aus der Community und 282 geschlossene Issues (13 P0, 36 P1). ↩↩↩↩↩↩↩↩↩↩↩↩ -
Versionshinweise zu Hermes Agent v0.14.0. 16. Mai 2026. „The Foundation release.“ Seit v0.13.0: 808 Commits, 633 zusammengeführte PRs, 1.393 geänderte Dateien, 165.061 Einfügungen, 545 geschlossene Issues (12 P0, 50 P1) und 215 Mitwirkende aus der Community. Neu hinzugekommen sind SuperGrok OAuth mit grok-4.3 und einem Kontextfenster von 1 Mio. Tokens,
hermes proxy,x_search, PyPI-Paketierung, verzögert geladene Abhängigkeiten, ein sitzungsübergreifender Claude-Prompt-Cache für 1 Stunde, ein um etwa 19 Sekunden schnellerer Start, 180-mal schnellere Browser-CDP-Aufrufe, LINE und SimpleX Chat für nun insgesamt 22 Messaging-Plattformen,/handoff, native Schaltflächen für Rückfragen, das nachträgliche Laden des Discord-Verlaufs,vision_analyzefür rohe Pixeldaten, eine Prüfzeile für Dateiänderungen nach jedem turn, semantische LSP-Diagnosen, das vereinheitlichtevideo_generate,computer_useüber cua-driver, OSC8-Links, Unterstützung der Zed ACP Registry, der OpenRouter Pareto Code router, NovitaAI, die Codex app-server-Laufzeit,huggingface/skills, Plugin-ctx.llm,tool_override, die Suche mit Brave/DDGS, Schutzmaßnahmen gegen gefährliche Befehle,/subgoal, die Umbenennung von Qwen Cloud, eine native Windows-Beta, insgesamt 16 Gebietsschemata sowie umfassende Aktualisierungen der Dokumentation und Tests. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Versionshinweise zu Hermes Agent v0.16.0, „The Surface Release“, Tag
v2026.6.5, veröffentlicht am 06.06.2026 um 00:55:58 UTC (Datum des Release-Tags: 5. Juni 2026); neueste Version mit Stand vom 08.06.2026. Neues natives Hermes Desktop (Electron, macOS/Linux/Windows; Verbindung mit einem entfernten gateway über sicheres WebSocket mit OAuth oder Benutzername/Passwort; entfernte Hosts je profile; profile-übergreifende@session-Links; vereinfachte chinesische Benutzeroberfläche durch typisierte i18n unddisplay.language). Das Web-Dashboard wurde zu einem vollständigen Administrationsbereich ausgebaut (MCP-Katalogschalter, Anmeldedatenverwaltung, Erstellung von Webhooks/Hooks, Speicherkonfiguration, gateway-Steuerung, Systemseite mit Prüfung vor Aktualisierungen und Debug Share sowie Kanalseite; austauschbare Authentifizierung einschließlich selbst gehostetem OIDC undhermes dashboard register). Neue Befehle:/undo [N], konfigurierbare Standardschnittstelle (cli/tui,--cli), TUI-/modelmit Sitzungsübersicht,hermes portal,hermes prompt-size,hermes sessions optimize. Neue Modelle:deepseek-v4-flash,MiniMax-M3(1 Mio. Kontext),qwen3.7-plus,gemini-3.5-flash; xAI Grok OAuth; unscharfe Auswahl; stündliche Katalogaktualisierung. skills: schlankere Standardauswahl, Relevanzprüfung durchenvironments:, standardmäßig vertrauenswürdiger TapNVIDIA/skills, schrittweise Offenlegung von Tools, Korrektur für fälschlicherweise als erfolgreich gemeldete MCP-OAuth-Vorgänge. Sicherheit: CVE-2026-48710 (Starlette BadHost) auf ≥1.0.1 festgesetzt, SSRF-Prüfungen aus dem Event-Loop ausgelagert, Bedrock-Bearer-Token aus der Umgebung von Unterprozessen entfernt, Lesezugriff aufbws_cache.jsongeschützt,docker restart/stop/killzu den gefährlichen Mustern hinzugefügt, unsichtbare Unicode-Zeichen bereinigt; 2 P0- und 62 P1-Probleme geschlossen (16 davon mit Sicherheitskennzeichnung). Marketingformulierungen der Versionshinweise (Anzahl der PRs/Commits, „nichts davon existierte vor einer Woche“) wurden ausgeschlossen; erfasst sind ausschließlich konkrete, dem Tag zugeordnete Funktions- und Versionsangaben. In der aktuellen Sitzung am 8. Juni 2026 verifiziert. ↩↩↩↩↩↩↩↩ -
Versionshinweise zu Hermes Agent v0.17.0, „The Reach Release“, Tag
v2026.6.19, 19. Juni 2026; neueste Version mit Stand vom 21.06.2026. Nachrichtenplattformen: iMessage über Photon Spectrum (Gerätecode-OAuth,hermes photon login, kein Mac-Relay); offizieller API-Adapter für WhatsApp Business Cloud (ersetzt den Bridge-Prozess); SimpleX-Gruppen, native Anhänge, Textbündelung und automatische Annahme; gebündeltes Raft-Plattform-plugin. Modelle/Anbieter:z-ai/glm-5.2(1 Mio. Kontext),anthropic/claude-fable-5,laguna-m.1,nemotron-3-ultra,grok-composer-2.5-fast(xAI OAuth, 200.000 Kontext); xAI-Standard →grok-build-0.1; adaptive Anthropic-Modelle verwenden den modernen Denkvertrag (kein Feldreasoning). CLI/Slash-Befehle:/version,/billing,hermes photon login,hermes curator run --consolidate(optional), grafische Oberfläche fürhermes model, Klonen von profiles. Desktop: Beobachtungsfenster für Hintergrund-Subagenten (delegate_task(background=true)), Composer-Modellauswahl, neu belegbare Tastenkürzel, native Betriebssystembenachrichtigungen, Entwürfe je Thread, Themes aus dem VS Code Marketplace sowie japanische und traditionell chinesische Benutzeroberflächen. Dashboard: vollständiger profile-Builder, globaler profile-Umschalter, überarbeiteter Skills Hub mit Sicherheitsprüfung, Automation Blueprints, sichere Anmeldung (401 hinter OAuth). skills/Tools: Bild-zu-Bild-Bearbeitung mitimage_generatebei verschiedenen Anbietern, atomare Stapelverarbeitung mitmemoryundoperations,simplify-code-skill für parallele Prüfungen, boolescheswrite_approvalersetztwrite_mode. Architektur: Hintergrund-Subagenten (Handle wird sofort zurückgegeben, das Ergebnis fließt als neuer Turn wieder ein), MCP-Elicitation-Handler für Bestätigungen während eines Tool-Aufrufs, nachträglich verbundene MCP-Tools werden zwischen Turns bereitgestellt, austauschbarer CronScheduler mit verwaltetem cron über Chronos, Managed-Scope (/etc/hermesdurch Administrator festgelegt), Gateway-Gateway-Relay. Sicherheit: Umgehung der Sperrliste für Shell-Escapes geschlossen, Fail-Closed-Verhalten bei fehlendem Genehmigungsmodul und gateway-Adaptern mit eigener Richtlinie, Umgebung von cron-Auftragsskripten bereinigt, Geheimnisse in Debug-Dumps geschwärzt, Host-Metadaten aus dem öffentlichen Status entfernt, Prüfung von MCP-stdio auf Exfiltrationsmuster sowie Versionsanhebungen von urllib3 und PyJWT aufgrund von CVEs. Marketingformulierungen der Versionshinweise (Anzahl der Commits/PRs) wurden ausgeschlossen. In der aktuellen Sitzung am 21. Juni 2026 verifiziert. ↩↩↩↩↩↩↩↩↩↩↩ -
Versionshinweise zu Hermes Agent v0.18.0 (Tag
v2026.7.1), 1. Juli 2026 – „The Judgment Release“. Vorrangige Abarbeitung des Backlogs (alle P0-/P1-Probleme geschlossen, rund 692 Einträge innerhalb von zwölf Tagen); Mixture-of-Agents ist in sämtlichen Schnittstellen als vollwertiges Modell auswählbar, wobei die vollständige Ausgabe jedes Referenzmodells als eigener beschrifteter Block dargestellt und die endgültige Antwort live gestreamt wird; Abschlussverträge für/goal(der Agent überprüft seine eigene Arbeit, indem er die Projektprüfungen ausführt); Befehl/learn(durch eine Beschreibung lässt sich alles in einen wiederverwendbaren skill umwandeln, wobei CONTRIBUTING.md automatisch eingehalten wird);/journeybietet eine visuelle Zeitleiste für Speicher und skills mit Bearbeitungsfunktion sowie einen Speichergraphen in Desktop; Auffächerung von Hintergrund-Subagenten (mehrere gleichzeitig delegierte Aufgaben); Desktop Projects (Projekt-/Repository-/Lane-Modell); auf null skalierbares gateway mit Drain-Koordination; Unterstützung für Google Vertex AI (Gemini über GCP-Dienstkonten, automatische Aktualisierung von OAuth2-Tokens);/prompt-Befehl für $EDITOR. In der aktuellen Sitzung am 1. Juli 2026 (PST) anhand der GitHub-Versionsseite verifiziert; v0.18.0 ist die neueste Version. ↩↩↩↩↩↩↩↩↩↩↩ -
Versionshinweise zu Hermes Agent v0.20.3 (Tag
v2026.8.16.2, angegebenes Veröffentlichungsdatum 16. August, veröffentlicht am 17. August 2026) und Versionshinweise zu v0.20.4 (Tagv2026.8.18, 18. August 2026); beide am 20. August 2026 über die GitHub-API abgerufen (prerelease: false). Wortlaut zu v0.20.3: „die Migration auf MCP 2.x SDK und die Unterstützung des zustandslosen Protokolls vom 28.07.2026, das gebündelte Bot-Mode-plugin (hermes-bots) mit dem zentralen Teamkollegenprotokoll, das CommandCode-Anbieter-plugin, die Absicherung der Besitzverhältnisse der Python-Laufzeit in Unterprozessen (Isolierung von PYTHONHOME/PYTHONPATH), die Laufzeitverträge von Cua Driver 0.20 für die Computernutzung.“ Wortlaut zu v0.20.4: „die Arbeiten an Glas-/Transluzenzoberflächen in Desktop (mattes Glas, Frost-Auswahl, Vorauswahl unter macOS), die SESSIONS|BOTS-Seitenleiste mit Registerkarten und Ein-/Ausblendung je Bot, … beratende Tier-1-Prüfung durch NVIDIA SkillEvaluator bei der Installation von skills (Lizenz- und Sicherheitsprüfungen).“ Beide Versionen: „Die vollständigen kuratierten Versionshinweise für diesen Zeitraum werden mit v0.21.0 veröffentlicht.“ ↩↩↩↩↩↩↩↩↩↩↩↩ -
Versionshinweise zu Hermes Agent v0.20.0, „The Herald Release“, Tag
v2026.8.3, 3. August 2026, mit den Stabilisierungstags v2026.8.13 und v2026.8.16. Wortlaut der Veröffentlichung: „Node 26 ist für alle Installations-, Reparatur- und Aktualisierungsvorgänge erforderlich“; „die Vertriebskanäle brew und pip/PyPI-Wheel wurden eingestellt (Shell-Installer / Docker / Nix sind die unterstützten Kanäle)“; „Standardlimit für Iterationen 90 → 500“; „Quelle claude-marketplace entfernt“. Die Mindestversion von Node wurde unabhängig im Installer-Quellcode unter scripts/install.sh bestätigt –NODE_VERSION="26"und die Prüfung „Node.js $(node –version) ist zu alt (Hermes erfordert Node >=26)“ –, dessen Kopfkommentar außerdem den kanonischen Einzeilercurl -fsSL https://hermes-agent.nousresearch.com/install.sh | bashdokumentiert. Beachten Sie den Widerspruch: Auf der Installationsseite der Dokumentation wird weiterhin Node v22 genannt; gegenüber beiden Quellen ist diese Angabe veraltet. Plattformstufen aus der Dokumentation zur Plattformunterstützung; skill-Quellen und Standard-Taps aus der Dokumentation zu skills; die Anzahl von 28 Plattformen wurde durch Aufzählung der Vergleichstabelle unter Nachrichtenplattformen ermittelt, da dort keine offizielle Gesamtzahl veröffentlicht wird. Sämtliche Quellen wurden am 16.08.2026 abgerufen und verifiziert. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Versionshinweise zu Hermes Agent v0.19.0, „The Quicksilver Release“, Tag
v2026.7.20, 20. Juli 2026; Stand 21. Juli 2026 die neueste Version. Statistik seit v0.18.0: ca. 2.245 Commits, ca. 1.065 zusammengeführte PRs, ca. 3.300 geschlossene Issues, mehr als 450 Mitwirkende aus der Community. Zentrale Leistungsverbesserungen: TTFT beim ersten Turn um ca. 80 % verkürzt, kalte Übermittlung→Weiterleitung in CLI/gateway/TUI/Desktop/cron von ca. 4,3 s auf ca. 0,9 s beschleunigt (PR #59332); Reasoning wird standardmäßig live gestreamt, wobeidisplay.show_reasoningaktiviert ist und die Antwort Token für Token dargestellt wird (PR #59389); eine aus rund 20 PRs bestehende Geschwindigkeitswelle für den Desktop, darunter 14-mal schnelleres Streaming-Markdown; inkrementelles Markdown in der TUI. pip-/Homebrew-Installationen sind veraltet und geben nur noch die Warnung „unsupported legacy“ aus; die Veröffentlichung über PyPI/Homebrew soll eingestellt werden (PR #57225). ErweiterbareSecretSource-Schnittstelle mit Bitwarden- und 1Password-Anbietern,op://-Referenzen, Unterstützung mehrerer Vaults, deterministischer Prioritätsreihenfolge und Herkunftsnachweis pro Variable (PR #59498). Smart Approvals als Standard (unabhängiger LLM-Prüfer für jeden markierten Befehl), benutzerdefinierte Ablehnungsregeln, die auch im YOLO-Modus gelten, sowie/deny <reason>(PRs #62661, #59164, #54518); die Genehmigungseskalation überpre_tool_callin Plugins wurde erneut integriert (PR #60504). Abrechnung im Terminal über/subscriptionund/topupsowie Abrechnungsregisterkarte in der Desktop-Anwendung (PR #51639). Live-Transkriptdateien für Subagents und dauerhafte Hintergrunddelegation (PRs #67479, #63494); Verzeichnis der Zustellungsverpflichtungen instate.db(PR #67181);max_async_childrenzugunsten einheitlicher Nebenläufigkeitsgrenzen für die Delegation als veraltet markiert (PR #56955). Profilbasiertes gateway-Routing mitGATEWAY_MULTIPLEX_PROFILES; der Routingindex wurde nachstate.dbverschoben, währendsessions.jsonals optionaler Legacy-Spiegel dient (PRs #64835, #65700, #60589, #59203). Anbieter/Modelle: Fireworks AI als vollwertige Option auf Platz 2 der Auswahl (PR #62593), DeepInfra, Upstage Solar, durchgängige Unterstützung für GPT-5.6 Sol/Terra/Luna und Pro (PR #61616), grok-4.5 allgemein verfügbar, kimi-k3 (kimi-k2.x eingestellt), Claude Sonnet 5 vollständig integriert sowieenabled: falsepro Anbieter undexcluded_providers(PR #67971); Reasoning-Effort-Stufenmax/ultramit Überschreibungen pro Modell und pro MoA-Slot sowie sitzungsbezogenem/reasoning(PRs #62650, #64458). CLI/MCP:hermes sessions exportfür Markdown/Quarto/HTML/nur Prompts/HF-Traces mit--redact(PR #60186),/model --once(PR #67113), gestapelte Aufrufe von Slash-skills (PR #57987),--safe-mode,hermes config get/unset(PR #65540), echtes Headless-Verhalten fürhermes serve(PR #55923), Benennung nach dem Schema MCPmcp__server__tool(PR #52750). Marketingdarstellungen zur Veröffentlichung wurden ausgeschlossen; innerhalb des Zeitfensters zurückgenommene Elemente (iron-proxy-Egress-Firewall, dynamic-workflow-skill, Speicheranbieteraktionen) wurden bewusst nicht als ausgeliefert erfasst. In der aktuellen Sitzung am 21. Juli 2026 verifiziert. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Release-Tag von Hermes Agent v0.18.1 und Release-Tag von v0.18.2, 7.–8. Juli 2026. Zusammenfassende Infrastruktur-Patches für die v0.18-Reihe; der wesentliche Fix in v0.18.2 hebt die feste Versionsbindung von WhatsApp Baileys auf 7.0.0-rc13 auf, um zuverlässige Docker-Builds zu ermöglichen. Beide Patch-Zeitfenster sind in den Versionshinweisen zu v0.19.0 zusammengefasst und vollständig dokumentiert. ↩
-
Versionshinweise zu Hermes Agent v0.15.1 und Versionshinweise zu Hermes Agent v0.15.2. v0.15.1 (29. Mai 2026, 01:12 UTC) ist der noch am selben Tag veröffentlichte Velocity-Hotfix: Behebung der 401-Neuladeschleife im Dashboard bei Verwendung des Loopback-Modus; Docker erfordert nun ausdrücklich
HERMES_DASHBOARD_INSECURE=1; reine MCP-Befehle (npx,npm,node) werden in Docker-Containern aufgelöst; Quell-Badges und Kategorie-Seitenleiste der Skills-Seite wurden wiederhergestellt; Kanban-Worker reagieren auf SIGTERM; der Skills.sh-Katalog wurde mithilfe der Sitemap von 858 auf 19.932 Einträge erweitert. 28 Commits, 21 zusammengeführte PRs, 9 Mitwirkende. v0.15.2 (29. Mai 2026, 13:37 UTC) ist ein reiner Paketierungs-Hotfix, derplugin.yaml-Manifeste in Wheel- und sdist-Distributionen aufnimmt, damit PyPI-Installationen ohne seitliches Laden des Quellcodes funktionieren. 4 Mitwirkende. ↩ -
Versionshinweise zu Hermes Agent v0.15.0 und die Seite mit den Hermes Agent-Versionen. „The Velocity release“, Tag
v2026.5.28. Statistik: 1.302 Commits, 747 zusammengeführte PRs, 321 Mitwirkende aus der Community.run_agent.pywurde um 76 % refaktoriert (von 16.083 auf 3.821 Zeilen, verteilt auf 14 Module). Fügt die Multi-Agent-Kanban-Plattform hinzu (automatische Zerlegung, Schwarmtopologie, Modellüberschreibungen pro Aufgabe, geplante Aufgaben, Worktree-Verwaltung).session_searchwurde neu gestaltet, arbeitet 4.500-mal schneller und kommt ohne die LLM-Abhängigkeit aus. Promptware-Abwehr gegen Prompt-Injection der Brainworm-Klasse an drei sicherheitskritischen Kontrollpunkten. Die Integration von Bitwarden Secrets Manager ersetzt mehrere anbieterspezifische API-Schlüssel durch ein einziges Bootstrap-Token. Mit Skill-Bundles lassen sich mehrere skills über einen einzigen Slash-Befehl laden. TUI-Sitzungsorchestrator zur Verwaltung mehrerer Sitzungen in einem Terminalfenster. Unterstützung für Krea 2 (Medium/Large) und das FAL-Plugin zur Bilderzeugung. Eine weitere xAI-Integrationsrunde fügt ein Websuch-Plugin und OAuth-Upstream-Unterstützung hinzu, erkennt eingestellte Modelle und ermöglicht natürliche TTS-Pausen bei der Sprachausgabe. Eine auf GitHub referenzierte Patch-Version behebt die 401-Neuladeschleife im Dashboard, sorgt dafür, dass Docker--insecureausdrücklich die UmgebungsvariableHERMES_DASHBOARD_INSECURE=1erfordert, löst reine MCP-Befehle (npx,npm,node) in Docker auf und korrigiert die Darstellung der Skills-Seite, die SIGTERM-Verarbeitung der Kanban-Worker sowie den vollständigen Skills-Katalog mit 19.932 Einträgen über die Sitemap. Hinzu kommt eine kleine Gruppe von Korrekturen für die Auslieferung von.md-Dateien, die Sicherheit von gateway-Prüfungen, die Schwärzung von Web-URLs, die Bildverarbeitungsfähigkeit von Kanban-Workern und die Standardwerte für Hindsight-Beobachtungen. ↩↩↩ -
Versionshinweise zu Hermes Agent v0.11.0. 23. April 2026. „The Interface release“ — vollständige Neuentwicklung der interaktiven CLI mit React/Ink und einem Python JSON-RPC-Backend (
tui_gateway); erweiterbare Transportarchitektur (agent/transports/); native Unterstützung für AWS Bedrock über Converse API; fünf neue Inferenzpfade (NVIDIA NIM, Arcee AI, Step Plan, Google Gemini CLI OAuth, Vercel ai-gateway); GPT-5.5 über Codex OAuth; QQBot als 17. Messaging-Plattform mit Einrichtung per QR-Code-Scan; erweiterte Plugin-Oberfläche (Slash-Befehle, Tool-Weiterleitung, Ausführungsblockierung, Ergebnistransformation);/steer <prompt>für Hinweise an den laufenden Agent, die nach dem nächsten Tool-Aufruf Kontext einfügen, ohne den Prompt-Cache zu beeinträchtigen; Shell-Hooks für Lebenszyklusereignisse ohne Python-Plugins; direkter Webhook-Zustellungsmodus, der Payloads unmittelbar an einen Plattformchat weiterleitet; intelligentere Delegation mit Orchestrator-Rollen, konfigurierbarer Spawn-Tiefe und Dateikoordination; Dashboard-Plugin-System, Live-Designwechsel, i18n und mobile Anpassungsfähigkeit. Statistik seit v0.9.0: 1.556 Commits · 761 zusammengeführte PRs · 1.314 geänderte Dateien · 224.174 Einfügungen · 29 Mitwirkende aus der Community. Siehe auch: Release-Tag von Hermes Agent v0.11.0 auf GitHub. ↩↩↩ -
Hermes Agent v0.10.0 Release Notes. 16. April 2026. „The Tool Gateway Release.“ Integration des Nous Tool Gateway für zahlende Abonnenten von Nous Portal — verwalteter Zugriff auf die Websuche von Firecrawl, die Bildgenerierung mit FAL / FLUX 2 Pro, OpenAI TTS und die Browserautomatisierung mit Browser Use, ohne zusätzliche API-Schlüssel. Aktivierung für einzelne Tools über das neue Konfigurationsfeld
use_gateway. Sind sowohl das Gateway als auch direkte API-Schlüssel konfiguriert, bevorzugt die Laufzeitumgebung das Gateway. Vollständige Integration inhermes toolsundhermes status. Ersetzt die veraltete UmgebungsvariableHERMES_ENABLE_NOUS_MANAGED_TOOLS. Implementiert von @jquesnelle (emozilla). Der CLI von Hermes Agent bleibt MIT-lizenziert und vollständig quelloffen; das Gateway ist eine Integration in das bestehende Abonnementprodukt von Nous Portal und keine Bezahlschranke für den CLI. Siehe auch: Nous Portal für Abonnementpreise und Registrierung. ↩↩↩