hermes@agent:~/.hermes$ cat hermes.md

Hermes Agent: przewodnik praktyka (2026)

# Przewodnik praktyka po Hermes Agent — samodoskonalącym się agencie AI typu open source od Nous Research: uwierzytelnianie u dostawców i OAuth, pliki konfiguracyjne, system umiejętności oraz uruchamianie go jako wieloplatformowej bramy komunikacyjnej.

author: words: 20849 read_time: 79m updated: 2026-08-21 10:38
$ less hermes.md

TL;DR: Hermes Agent to otwartoźródłowy, samodoskonalący się agent AI od Nous Research. Działa jako CLI i jako wieloplatformowy gateway komunikacyjny, zapisuje na dysku trwałą tożsamość i trwałą pamięć, gromadzi skille ulepszające się w miarę użycia oraz współpracuje z dowolnym dostawcą LLM zgodnym z OpenAI — Nous Portal, OpenRouter, Anthropic, GitHub Copilot, z.ai, Kimi, MiniMax, DeepSeek, Qwen Cloud, Hugging Face, Google, xAI/SuperGrok lub własnym, samodzielnie hostowanym endpointem.1219 Od wersji v0.14.0 (16 maja 2026) Hermes dodaje SuperGrok OAuth z kontekstem grok-4.3 1M, lokalne proxy zgodne z OpenAI dla dostawców OAuth (hermes proxy), natywne x_search, obsługę instalacji z PyPI (wycofaną od v0.19.0 — obsługiwaną ścieżką jest instalator jednoliniowy), leniwą instalację zależności, 28 platform komunikacyjnych z LINE i SimpleX Chat, /handoff, semantyczną diagnostykę LSP po zapisach, ujednolicone video_generate, computer_use przez cua-driver dla dostawców innych niż Anthropic, natywną betę dla Windows oraz zamknięcie 12 problemów P0 / 50 P1.19 Najtrudniejszym elementem dla większości nowych użytkowników jest uwierzytelnianie dostawcy: Hermes obsługuje około 20 dostawców pierwszej klasy oraz niestandardowe endpointy, a także trzy odrębne ścieżki uwierzytelniania (klucz API w .env, OAuth przez hermes model lub niestandardowy endpoint w config.yaml). Model uwierzytelniania należy poznać najpierw — wszystko inne zależy od tego, który dostawca zostanie rozpoznany.

Hermes Agent działa jako pełne środowisko uruchomieniowe agenta, a nie nakładka do czatu. Odczytuje system plików, wykonuje polecenia w sandboxowanych backendach, przeszukuje internet, uruchamia subagentów, wykonuje zaplanowane zadania cron, komunikuje się z Telegram/Discord/Slack/WhatsApp/Signal/Email z jednego procesu gateway i tworzy własne skille na podstawie doświadczeń.1 CLI to terminalny interfejs użytkownika zbudowany na pętli konwersacji w run_agent.py; gateway to długo działający proces, który kieruje wiadomości z platform komunikacyjnych przez tę samą pętlę konwersacji.3

Różnicę między okazjonalnym a eksperckim użyciem Hermes wyznacza pięć systemów. Po opanowaniu ich Hermes staje się mnożnikiem produktywności:

  1. Rozpoznawanie dostawcy: sposób, w jaki przepływy uwierzytelniania są mapowane na wywołania API
  2. Hierarchia konfiguracji: config.yaml + .env + auth.json + SOUL.md + AGENTS.md
  3. System tool + toolset: co agent może zrobić, z ograniczeniami zależnymi od platformy
  4. System skilli: pamięć proceduralna, którą agent tworzy i rozwija
  5. Gateway + cron + profile: uruchamianie Hermes tam, gdzie się przebywa, a nie tylko tam, gdzie aktualnie się jest

Najważniejsze wnioski

  • Uwierzytelnianie dostawcy to trzy ścieżki, a nie jedna. Klucz API w .env, OAuth przez hermes model/hermes auth albo niestandardowy endpoint w config.yaml. Należy wybrać ścieżkę pasującą do dostawcy, a nie tę, która wydaje się znajoma.
  • Zmiana dostawców wymaga jednego polecenia. hermes model interaktywnie prowadzi przez wszystkich obsługiwanych dostawców, w tym logowania OAuth, a /model provider:model pozwala przełączyć się w trakcie sesji bez utraty historii.2
  • Dwa pliki stanowią powierzchnię konfiguracji edytowalną przez użytkownika. ~/.hermes/config.yaml zawiera ustawienia, a ~/.hermes/.env przechowuje sekrety. auth.json, SOUL.md, MEMORY.md i skills/ są zarządzane bezpośrednio przez Hermes — SOUL.md można edytować ręcznie, ale pozostałe elementy są modyfikowane przez samego agenta.4
  • Hermes jest następcą OpenClaw. Podczas migracji hermes claw migrate automatycznie importuje ponad 30 kategorii stanu.5
  • Jakość działania zależy od modelu pomocniczego. Wizja, podsumowywanie internetu, kompresja i opróżnianie pamięci korzystają z oddzielnego pomocniczego LLM. Domyślnie jest to Gemini Flash wykrywany automatycznie (OpenRouter → Nous → Codex) — jeśli żaden z nich nie jest skonfigurowany, te funkcje działają gorzej bez wyraźnego komunikatu, dopóki sloty pomocnicze nie zostaną skierowane na głównego dostawcę.4

Co zmienia v0.14

v0.14.0 koncentruje się mniej na jednej funkcji nagłówkowej, a bardziej na ograniczaniu tarcia podczas konfiguracji i poszerzaniu środowisk, w których Hermes może działać.19 Główne zmiany operacyjne:

  • Instalacja i uruchamianie są lżejsze. pip install hermes-agent działa z PyPI, ciężkie adaptery są instalowane leniwie przy pierwszym użyciu, a ścieżka uruchamiania odracza wystarczająco dużo pracy, by skrócić zimny start o około 19 sekund. (Od v0.19.0 instalacje przez pip zostały wycofane — zobacz Instalacja.)
  • Subskrypcje mogą stać się lokalnymi endpointami API. hermes proxy przekształca dostawców opartych na OAuth, takich jak Claude Pro, ChatGPT Pro i SuperGrok, w lokalny endpoint zgodny z OpenAI dla narzędzi takich jak Codex, Aider, Cline i Continue.
  • Zasięg gateway się poszerza. LINE i SimpleX Chat zwiększają liczbę platform do 22, Microsoft Teams jest podłączony od początku do końca, uzupełnianie historii Discord jest domyślnie włączone, a prompty clarify w Telegram/Discord używają teraz natywnych przycisków.
  • Weryfikacja podczas zapisu ulega poprawie. Po edycjach Hermes może wyświetlać podsumowania zmian plików dla każdej tury oraz semantyczną diagnostykę serwera językowego przed następną turą, co przybliża go do pracy agentowej opartej na dowodach.
  • Narzędzia desktopowe i multimedialne zyskują szerszy zakres. computer_use działa przez cua-driver dla dostawców innych niż Anthropic, video_generate jest ujednolicone za wymiennymi backendami, a vision_analyze wysyła surowe piksele do modeli, które faktycznie potrafią widzieć.

Każda poniższa sekcja opiera się na dokumentacji źródłowej dostępnej pod adresem hermes-agent.nousresearch.com/docs oraz na drzewie źródłowym github.com/NousResearch/hermes-agent. Każde stwierdzenie faktyczne ma przypis prowadzący do konkretnej strony źródłowej, z której pochodzi.

Wybierz ścieżkę

Czego potrzeba Przejdź tutaj
Zainstalować Hermes Instalacja — instalator jednoliniowy lub kroki ręczne
Zalogować się do dostawcy Uwierzytelnianie i dostawcy — sekcja, po którą tu przybyto
Zmienić modele w trakcie sesji Polecenie hermes auth oraz Niestandardowe i samodzielnie hostowane endpointy, aby poznać składnię /model
Uruchomić lokalny LLM Niestandardowe i samodzielnie hostowane endpointy — Ollama, vLLM, SGLang, llama.cpp, LM Studio
Podłączyć platformy komunikacyjne Messaging Gateway — Telegram, Discord, Slack, WhatsApp, Signal, Google Chat, LINE, SimpleX Chat (łącznie 22)
Napisać lub zainstalować skill System skilli — stopniowe ujawnianie + hub skilli
Szczegółowe odniesienie do każdego polecenia CLI Czytać dalej — oraz przejść bezpośrednio do Poleceń CLI

Jak działa Hermes: model mentalny

Struktura Hermes opiera się na pojedynczej pętli konwersacji, którą może wywołać dowolny punkt wejścia. Punktami wejścia są CLI (cli.py), gateway komunikacyjny (gateway/run.py), adapter ACP do integracji z edytorem, moduł uruchamiania wsadowego oraz serwer API.3 Wszystkie ostatecznie wywołują AIAgent.run_conversation() w run_agent.py, który:

  1. Buduje prompt systemowy z SOUL.md, MEMORY.md, USER.md, skills, plików kontekstowych oraz wskazówek dotyczących narzędzi za pośrednictwem prompt_builder.py3
  2. Ustala dostawcę środowiska wykonawczego za pośrednictwem runtime_provider.py — na tym etapie wybierane są uwierzytelnianie, bazowy URL i tryb API3
  3. Wywołuje dostawcę przy użyciu jednego z trzech trybów API: chat_completions, codex_responses lub anthropic_messages3
  4. Przekazuje wszystkie zwrócone wywołania narzędzi przez model_tools.py i centralny rejestr narzędzi (tools/registry.py)3
  5. Powtarza pętlę, dopóki model nie wygeneruje odpowiedzi końcowej, po czym zapisuje sesję w SQLite z FTS53

Zrozumienie tej pętli jest istotne, ponieważ każda funkcja — osobowości, pamięć, skills, kompresja i mechanizm rezerwowy — jest powiązana z jednym z tych etapów. Gdy podczas przeglądania klucza konfiguracji pojawia się pytanie o jego działanie, odpowiedź zwykle brzmi: „jest to parametr sterujący etapem 1, 2, 3 lub 4 powyższej pętli”.

Rdzeń niezależny od platformy. Jedna klasa AIAgent obsługuje CLI, gateway, ACP, tryb wsadowy i serwer API. Różnice między platformami znajdują się w punktach wejścia, a nie w samym agencie.3 Dlatego te same polecenia ukośnikowe działają zarówno w terminalu, jak i w Telegram — są obsługiwane przez wspólny COMMAND_REGISTRY w hermes_cli/commands.py.6

Struktura katalogów jest systemem. Hermes przechowuje wszystko w ~/.hermes/ (lub $HERMES_HOME w przypadku profili innych niż domyślny):4

~/.hermes/
├── config.yaml        # Settings (model, terminal, TTS, compression, etc.)
├── .env               # API keys and secrets
├── auth.json          # OAuth provider credentials (Nous Portal, Codex, Anthropic)
├── SOUL.md            # Primary agent identity (slot #1 in system prompt)
├── memories/          # Persistent memory (MEMORY.md, USER.md)
├── skills/            # Bundled + agent-created + hub-installed skills
├── cron/              # Scheduled jobs
├── sessions/          # Gateway session state
└── logs/              # agent.log, gateway.log, errors.log (secrets auto-redacted)

Każdy z powyższych plików pełni określoną rolę; żadne z nich się nie pokrywają. Jeśli trzeba ustalić, „gdzie Hermes przechowuje X”, odpowiedzią jest jeden z nich.


Co nowego w wersji v0.20.0 (wydanie The Herald)

Hermes Agent v0.20.0 (tag v2026.8.3, 3 sierpnia 2026) jest bieżącym wydaniem funkcjonalnym; v0.20.1 (13 sierpnia) i v0.20.2 (16 sierpnia) to kolejne tagi stabilizacyjne, natomiast v0.20.3 (tag v2026.8.16.2, opublikowany 17 sierpnia) i v0.20.4 (tag v2026.8.18, 18 sierpnia) podtrzymują serię wydań zbiorczych, wprowadzając własne zestawy funkcji — opisano je w podsekcji poniżej. Okres od wersji v0.19.0 obejmuje około 3 650 commitów, 1 400 scalonych PR-ów i 1 200 zamkniętych zgłoszeń, przy udziale ponad 650 współtwórców.24

Trzy zmiany unieważniają instrukcje podawane we wcześniejszych wersjach tego przewodnika. Warto zapoznać się z nimi w pierwszej kolejności:

  • Node 26 jest teraz wymagany. Instalator przypina NODE_VERSION="26" i odrzuca starsze środowiska wykonawcze, wyświetlając komunikat „Node.js … is too old (Hermes requires Node >=26)”. Instalatory, heal i upgrade bez wyjątku egzekwują ten wymóg. Warto zauważyć, że strona instalacyjna w dokumentacji nadal wskazuje Node v22 — skrypt instalacyjny oraz informacje o wydaniu są nowszymi i wiążącymi źródłami.24
  • pip i Homebrew zostały wycofane, a nie jedynie oznaczone jako przestarzałe. Dosłownie: „brew + pip/PyPI wheel channels retired (shell installer / Docker / Nix are the supported channels)”. Instalacje wykonane przez pip lub brew nie otrzymują już nowych wydań.24
  • Domyślny limit iteracji wywołań narzędzi zwiększono z 90 do 500. Długie autonomiczne przebiegi przestały napotykać sztuczną barierę, a wszystkie opisane poniżej progi presji na budżet są obliczane względem nowego limitu. read_file również domyślnie odczytuje teraz 2 000 wierszy zamiast 500.24

Pozostałe elementy wydania:

  • Głos konwersacyjny. Strumieniowe TTS z możliwością przerwania wypowiedzi oraz słowami wybudzającymi rozpoznawanymi na urządzeniu.24
  • A2A v1.0. Plugin protokołu komunikacji między agentami, realizujący długo oczekiwaną funkcję ze zgłoszenia nr 514.24
  • Podpisane wychodzące webhooki. Wcześniej hermes webhook obsługiwał wyłącznie ruch przychodzący; wersja v0.20.0 dodaje wychodzące webhooki cyklu życia, podpisywane za pomocą HMAC, dla zdarzeń sesji, tur i narzędzi.24
  • Cytowania oparte na źródłach. Nowy skill z trybem weryfikacji faktów.24
  • Fala funkcji CLI dla zaawansowanych użytkowników. !command natychmiast uruchamia polecenie powłoki bez zużywania tury modelu; /init skanuje projekt i tworzy lub aktualizuje AGENTS.md; /diff pokazuje z dowolnego interfejsu zmiany przygotowane do zatwierdzenia, wszystkie zmiany albo zmiany z sesji; /context przedstawia szczegółowo zawartość wypełniającą okno kontekstu; /focus zapewnia widok z ograniczoną ilością danych wyjściowych i możliwością przywracania ukrytych wierszy; Ctrl+S odkłada częściowo napisany prompt. hermes import-agent przenosi konfigurację Claude Code lub Codex CLI za pomocą jednego polecenia.24
  • Rozszerzenia interfejsu zarządzania sekretami. Źródło sekretów wykorzystujące pomocnicze polecenie i współpracujące z każdym sejfem, rotacja tokenów jednym poleceniem wraz z praktycznymi komunikatami o błędach podczas uruchamiania, opcjonalna szyfrowana awaryjna pamięć podręczna dla Bitwarden, klucze wstrzykiwane z sejfu i ograniczone do katalogu domowego danego profilu oraz zgodność SecretRef ${env:VAR} między config.yaml a konfiguracją MCP. Opisany poniżej trójścieżkowy model uwierzytelniania pozostaje bez zmian.24
  • Szybszy start po rozgrzaniu. Zimny start hermes -w skrócono z około 14 s do 1,8 s.24
  • Środowisko desktopowe stało się platformą. Artefakty z wersjonowanymi kartami i izolowanym podglądem na żywo, Plugin SDK z Kanban jako pierwszym pluginem desktopowym, globalny skrót klawiszowy szybkiego wprowadzania, wiele okien GUI, tryb zdalnego backendu SSH oraz natywne logowanie zgodne z RFC 8252.24

Wydania zbiorcze v0.20.3 i v0.20.4 (17–18 sierpnia)

Po wersji v0.20.0 projekt przyjął rytm częstych tagowanych wydań zbiorczych, a dwa najnowsze obejmują więcej niż samą stabilizację. W obu zaznaczono, że „full curated release notes for this window will ship with v0.21.0” — dlatego poniższe podsumowania pochodzą z opisów zakresu zamieszczonych w samych wydaniach, a nie z opracowanej listy funkcji.23

v0.20.3 (około 250 commitów i około 125 PR-ów od wersji v0.20.2):

  • Migracja SDK do MCP 2.x z obsługą bezstanowego protokołu z 2026-07-28. Hermes przechodzi na obecną generację MCP SDK i obsługuje bezstanową wersję protokołu.23
  • Bot Mode jest dostarczany jako dołączony plugin (hermes-bots) zawierający podstawowy protokół współpracy zespołowej.23
  • Plugin dostawcy CommandCode dołącza do katalogu dostawców.23
  • Kontrakty środowiska wykonawczego Cua Driver 0.20 do obsługi komputera, a także wzmocniona kontrola własności środowiska wykonawczego Python w podprocesach (izolacja PYTHONHOME/PYTHONPATH).23
  • Niezawodność: samonaprawiający się harmonogram cron (odzyskiwanie po EMFILE, uzgadnianie nieaktualnych przejęć, ponowne uruchamianie zablokowanych zadań), poprawki zapobiegające utracie danych podczas przekazywania sesji, samonaprawiające się połączenie desktopowe ze zdalnym gateway oraz fala przeniesionych funkcji ekosystemu (skanowanie bezpieczeństwa podczas instalacji pluginów, /worktree, zachowywanie ręcznych zmian przy /rollback, odczyt plików UTF-16).23

v0.20.4 (około 146 commitów i około 74 PR-y od wersji v0.20.3):

  • Szklana powierzchnia interfejsu desktopowego: matowe szkło i efekty przezroczystości z selektorem oszronienia oraz wstępnym wyborem dla macOS.23
  • Pasek boczny z kartami SESSIONS|BOTS i możliwością ukrywania oraz odkrywania poszczególnych botów, a także poprawki czatów grupowych Bot Mode (długotrwałe tury uczestników, renderowanie Markdown, trasowanie między maszynami).23
  • Doradcze skanowanie NVIDIA SkillEvaluator Tier 1 podczas instalowania skills — przy instalacji skill przeprowadzane są kontrole licencji i bezpieczeństwa.23
  • Wzmocnienie wysyłania multimediów przez cron (konfigurowalny limit czasu, załączniki przy ręcznym uruchomieniu, ujawnianie pominiętych wywołań), poprawki dotyczące wątku pętli zdarzeń i rywalizacji o zasoby w SessionDB, rzetelne informowanie o zaparkowanych gałęziach przez hermes update oraz natywne powiadomienia systemowe Kanban.23

Sposób aktualizacji pozostaje bez zmian: hermes update w istniejącej instalacji albo instalator powłokowy w przypadku nowych instalacji.23

Co nowego w v0.19.0 (wydanie Quicksilver)

Hermes Agent v0.19.0 (tag v2026.7.20, 20 lipca 2026) nosi nazwę na cześć szybkości samego boga posłańców: podstawą wydania jest czysta responsywność, z redukcją czasu do pierwszego tokena w pierwszej turze o ~80% na każdej platformie. Wokół tej podstawy znalazły się rozliczenia w terminalu, źródła sekretów z menedżerów haseł, inteligentne zatwierdzanie domyślnie, obserwowalne subagenty oraz odporne na awarie dostarczanie odpowiedzi. Okres od v0.18.0 jest jak dotąd największy w historii projektu: ~2 245 commitów, ~1 065 scalonych PR-ów, ~3 300 zamkniętych zgłoszeń i ponad 450 współtwórców ze społeczności.25

  • ~80% szybsze uzyskanie pierwszego tokena, wszędzie. Czas od zimnego wysłania do dyspozycji spadł z ~4,3 s do ~0,9 s w CLI, gateway, TUI, aplikacji desktopowej i cron — wykrywanie możliwości Discord usunięto ze ścieżki krytycznej, sprawdzanie Ollama jest pomijane dla znanych dostawców innych niż Ollama, a z inicjalizacji agenta usunięto blokujące operacje. Osobno dopracowano też odczuwalne opóźnienie: modele rozumujące domyślnie strumieniują teraz swoje rozumowanie na żywo (display.show_reasoning jest WŁĄCZONE), a pole odpowiedzi renderuje się na token, a nie na linię.25
  • Fala usprawnień renderowania w desktopie i TUI. Aplikacja desktopowa otrzymała przebudowę wydajnościową obejmującą ~20 PR-ów: 14× mniejsze użycie CPU przez dzielnik streamowanego Markdown dzięki przyrostowemu analizowaniu bloków, zwirtualizowane różnice w panelu przeglądu, szybkie przełączanie sesji w dużych transkrypcjach oraz brak ponownego renderowania paska bocznego i wierszy narzędzi dla każdego tokena. TUI renderuje teraz streamowany Markdown przyrostowo, blok po bloku.25
  • Instalacje przez pip i Homebrew są przestarzałe. Obie ścieżki oznaczono jako instalacje „nieobsługiwane, starszego typu”, z planowanym usunięciem. Usunięcie nastąpiło już w v0.20.0 — kanały brew oraz pip/PyPI wheel zostały wycofane, a obsługiwane pozostały instalator shell, Docker i Nix.2524
  • Sekrety mogą pochodzić z menedżera haseł. Nowy rozszerzalny interfejs SecretSource pobiera podczas ładowania sekrety z Bitwarden i 1Password (odwołania op://), obsługując jednocześnie wiele sejfów, deterministyczny priorytet, ostrzeżenia o konfliktach oraz informacje o pochodzeniu każdej zmiennej — klucze API nie muszą już znajdować się w jawnym pliku .env. Przyszłych dostawców sejfów można dodawać jako pluginy.25
  • Inteligentne zatwierdzanie jest teraz domyślne. Gdy Hermes chce uruchomić oznaczone polecenie, niezależny recenzent LLM ocenia je zamiast pytać o każde z osobna — a każdy werdykt obejmuje wyłącznie to dokładne polecenie. Zdefiniowane przez użytkownika reguły odmowy blokują pasujące polecenia nawet w trybie YOLO, /deny <reason> przekazuje powód odmowy, aby agent skorygował działanie, a akcja zatwierdzania pre_tool_call pluginu (ponownie wdrożona z kluczami reguł) eskaluje wywołanie narzędzia do zatwierdzenia przez człowieka.25
  • Rozliczenia w terminalu: /subscription i /topup. Planem Nous Portal można zarządzać bez opuszczania terminala — sprawdzać plan i pozostały limit, dokładnie podejrzeć koszt ulepszenia lub moment wejścia w życie obniżenia planu, a następnie zastosować zmianę z możliwością cofnięcia. Aplikacja desktopowa otrzymuje odpowiadającą temu kartę ustawień rozliczeń.25
  • Obserwuj pracę subagentów; nigdy nie trać gotowej odpowiedzi. Zwracane przez delegate_task dyspozycje zapisują transkrypcje na żywo, które można śledzić za pomocą tail -f natychmiast po uruchomieniu subagentów — każde wywołanie narzędzia, wynik i streamowana odpowiedź, po jednym czytelnym dla człowieka dzienniku na każde dziecko. Zakończenia delegacji w tle są trwałe po ponownym uruchomieniu, a końcowe odpowiedzi gateway są zapisywane w rejestrze obowiązków dostarczenia w state.db i dostarczane ponownie przy następnym uruchomieniu, jeśli gateway ulegnie awarii w trakcie wysyłania. Opcja konfiguracji max_async_children jest przestarzała na rzecz ujednoliconych limitów współbieżności delegacji.25
  • Jeden gateway, wiele profili. Pojedynczy multipleksowany gateway współdzielący jeden token bota może kierować konkretne gildie, kanały lub wątki do różnych profili — każdy z całkowicie odizolowaną konfiguracją, skillami, pamięcią i sekretami — z zastąpieniem GATEWAY_MULTIPLEX_PROFILES. Indeks routingu przeniesiono do state.db; sessions.json jest teraz opcjonalnym starszym lustrem.25
  • Fala dostawców i modeli. Fireworks AI zyskuje obsługę pierwszej klasy (szacowanie kosztów, pozycja nr 2 w selektorze dostawców), a dołączają DeepInfra oraz Upstage Solar. Katalogi wzbogacają się o GPT-5.6 (Sol/Terra/Luna + Pro, podłączone kompleksowo), grok-4.5 (GA), kimi-k3 (kimi-k2.x wycofano) oraz w pełni podłączony Claude Sonnet 5. Flaga enabled: false dla każdego dostawcy oraz konfiguracja excluded_providers usuwają nieużywanych dostawców z selektorów i rozwiązywania /model.25
  • Wysiłek rozumowania staje się pokrętłem. Nowe poziomy wysiłku max i ultra trafiają do każdego interfejsu, z zastąpieniami dla poszczególnych modeli w konfiguracji, wysiłkiem dla każdego slotu w ustawieniach MoA (doradcy intensywnie rozumują, syntezator pozostaje szybki), wysiłkiem dla pomocniczych modeli na zadanie oraz /reasoning w CLI ograniczonym do bieżącej sesji.25
  • Powierzchnia CLI i MCP. hermes sessions export zapisuje formaty Markdown, Quarto, HTML, zawierający wyłącznie prompt oraz ślad Hugging Face z opcjonalnym czyszczeniem --redact; /model --once zapewnia zastąpienie modelu na jedną turę; wywołania slash-skill można łączyć w stos (/skill-a /skill-b do XYZ); --safe-mode pomaga w rozwiązywaniu problemów; hermes config get/unset uzupełniają zarządzanie konfiguracją; hermes serve staje się prawdziwym backendem bez interfejsu; a narzędzia MCP przyjmują konwencję nazewnictwa mcp__server__tool.25

W przypadku aktualizacji z v0.18.x, przed wszystkim innym uwagi wymagają dwie zmiany: instalacja przez pip lub Homebrew jest teraz ostrzegana jako nieobsługiwana, starsza metoda (należy przejść na jednoliniowy instalator), a max_async_children jest przestarzałe na rzecz ujednoliconych limitów współbieżności delegacji. Wszystko pozostałe ma charakter addytywny — główne powody aktualizacji to redukcja opóźnienia pierwszej tury o ~80%, inteligentne zatwierdzanie oraz rejestr dostarczeń, który czyni gotowe odpowiedzi odpornymi na awarie.


Co nowego w v0.18.0 (wydanie Judgment)

Hermes Agent v0.18.0 (tag v2026.7.1, 1 lipca 2026) nosi nazwę na cześć osądu: agent weryfikuje własną pracę zamiast deklarować sukces, a rozumowanie zespołowe można faktycznie zbadać. Wydanie zamyka też cały backlog P0/P1 — około 692 elementy o najwyższym priorytecie rozwiązane w dwanaście dni.22

  • Mixture-of-Agents jako model pierwszej klasy. MoA można teraz wybierać jak każdy inny model we wszystkich interfejsach, a rozumowanie zespołowe jest widoczne: pełny wynik każdego modelu referencyjnego renderuje się jako własny opisany blok z odpowiedzią streamowaną na żywo — można obserwować myślenie zespołu zamiast otrzymywać nieprzejrzystą, scaloną odpowiedź.22
  • Kontrakty ukończenia dla /goal. Agent weryfikuje własną pracę, uruchamiając kontrole projektu przed zgłoszeniem ukończenia celu, zamiast deklarować sukces — osąd zastosowany wobec samego siebie.22
  • /learn — opisz dowolny proces jako skill. Proces pracy można przekształcić w wielokrotnie używany skill, opisując go; wygenerowane skille automatycznie przestrzegają konwencji CONTRIBUTING.md repozytorium.22
  • Oś czasu /journey. Wizualna historia pamięci i skilli w czasie, z możliwością edycji, oraz graf pamięci w aplikacji desktopowej.22
  • Rozproszenie zadań subagentów w tle. Można delegować wiele zadań wykonywanych równocześnie bez blokowania rozmowy — pojedynczy subagent działający w tle z v0.17.0 staje się całą flotą.22
  • Desktop Projects. Projekty programistyczne pierwszej klasy z modelem organizacji projekt/repozytorium/pas.22
  • Gateway skalowany do zera. Gateway może przechodzić w stan uśpienia podczas bezczynności i koordynować opróżnianie, aby wdrożenia przebiegały płynnie — istotne dla osób uruchamiających Hermes jako stale działającą usługę.22
  • Obsługa Google Vertex AI. Dostęp do Gemini przez konta usługi GCP z automatycznym odświeżaniem tokena OAuth2, dołączający do katalogu dostawców.22
  • Polecenie edytora /prompt. Otwiera $EDITOR do tworzenia wielowierszowych promptów zamiast zmagania się z linią wejściową.22

W przypadku aktualizacji z v0.17.x nic tutaj nie narusza CLI. Główne powody aktualizacji to kontrakty ukończenia (cele, które weryfikują się same), MoA pierwszej klasy z możliwymi do zbadania zespołami oraz /learn do przechwytywania skilli.


Co nowego w v0.17.0 (wydanie Reach)

Hermes Agent v0.17.0 (tag v2026.6.19, 19 czerwca 2026 r.) nazwano tak ze względu na to, jak daleko sięga teraz agent — nowe kanały komunikacji, nowi dostawcy modeli oraz głębsza kontrola nad aplikacją desktopową i dashboardem. To rozszerzenie względem v0.16.x; powierzchnia CLI pozostaje bez zmian.21

  • Nowe kanały komunikacji. iMessage działa teraz bez przekaźnika Mac za pośrednictwem Photon Spectrum (kod urządzenia OAuth, hermes photon login); WhatsApp Business Cloud API to oficjalny adapter Meta, który zastępuje wymóg procesu mostka; SimpleX zyskuje grupy, natywne załączniki, grupowanie tekstu i automatyczną akceptację; a Raft dołącza jako dołączona wtyczka platformy z kanałem wybudzania zaprojektowanym zgodnie z zasadą privacy-by-contract.21
  • Nowe modele i dostawcy. Katalog zyskuje z-ai/glm-5.2 (kontekst 1M), anthropic/claude-fable-5, laguna-m.1, nemotron-3-ultra oraz grok-composer-2.5-fast (model Cursor przez xAI OAuth, kontekst 200k). Domyślny model xAI zmieniono na grok-build-0.1, a adaptacyjne modele Anthropic stosują teraz nowoczesny kontrakt myślenia (nigdy nie wysyłają pola reasoning).21
  • Aplikacja desktopowa i dashboard. Aplikacja desktopowa dodaje subagentów w tle ze strumieniowaniem na żywo „watch-windows” delegowanej aktywności (delegate_task(background=true)), selektor modelu Composer, możliwość ponownego przypisywania skrótów klawiaturowych, natywne powiadomienia systemu operacyjnego, wersje robocze kompozytora dla poszczególnych wątków, motywy z VS Code Marketplace oraz interfejs po japońsku i tradycyjnym chińsku. Dashboard zyskuje pełny kreator profili (modele/skills/MCP bez edycji config.yaml), globalny przełącznik profili, przeprojektowany Skills Hub ze skanowaniem bezpieczeństwa, Automation Blueprints (sparametryzowane szablony dla formularzy, poleceń slash, rozmów i dokumentacji) oraz bezpieczne logowanie zwracające 401 za bramą OAuth.21
  • Skills i narzędzia. image_generate potrafi teraz edytować i przekształcać obraz źródłowy, a nie tylko tworzyć go od podstaw, u każdego obsługiwanego dostawcy obrazów; narzędzie memory zyskało tablicę operations do atomowego wsadowego dodawania/zastępowania/usuwania w jednym wywołaniu; nowy skill simplify-code uruchamia równoległy, trzyagentowy etap przeglądu i czyszczenia, kontrolowany przez poziom ryzyka Chesterton’s Fence; a wartość logiczna write_approval zastępuje trójstanowe write_mode.21
  • Architektura. Subagenci w tle natychmiast zwracają uchwyt, a następnie wprowadzają wynik ponownie jako nową turę; obsługa pozyskiwania danych MCP umożliwia potwierdzenie w trakcie wywołania narzędzia, a narzędzia MCP podłączające się z opóźnieniem są udostępniane między turami (bezpiecznie dla pamięci podręcznej); cron staje się wtyczkowym CronScheduler z dostawcą zarządzanego crona Chronos; a nowy zakres Managed (/etc/hermes) pozwala administratorowi przypinać konfigurację niezmienialną dla użytkownika, wraz z przekaźnikiem Gateway-Gateway dla topologii z wieloma gatewayami.21
  • Nowe polecenia. /version, /billing (interaktywne rozliczenia w terminalu), hermes photon login (uwierzytelnianie iMessage) oraz hermes curator run --consolidate — konsolidacja jest teraz opcjonalna, więc rutynowa kuracja w tle nie kosztuje żadnych tokenów.21
  • Bezpieczeństwo. v0.17.0 zamyka obejście denylisty sekwencji escape powłoki, bezpiecznie odmawia działania przy brakujących modułach zatwierdzania i adapterach gatewaya z własnymi zasadami, oczyszcza środowisko dla podprocesów skryptów zadań cron, redaguje sekrety w zrzutach debugowania żądań, sprawdza konfiguracje stdio MCP pod kątem wzorców eksfiltracji oraz aktualizuje urllib3 i PyJWT, aby usunąć CVE.21

W przypadku aktualizacji z v0.16.x nic tutaj nie psuje CLI; są to nowe kanały, modele i powierzchnie wokół tego samego agenta. Najważniejszymi powodami aktualizacji są iMessage bez przekaźnika, oficjalne adaptery WhatsApp oraz administratorski zakres Managed.


Co nowego w v0.16.0 (wydanie Surface)

Hermes Agent v0.16.0 (tag v2026.6.5, 5 czerwca 2026 r.) nazwano tak ze względu na nowe powierzchnie, które udostępnia przed agentem opartym przede wszystkim na CLI. Najważniejsza zmiana: Hermes nie jest już dostępny wyłącznie w terminalu.20

  • Natywna aplikacja desktopowa. Hermes Desktop to nowa aplikacja Electron dla macOS, Linux i Windows, z instalacją jednym kliknięciem oraz samodzielną aktualizacją w aplikacji. Udostępnia okno czatu ze strumieniowaniem, przeciąganie i upuszczanie plików, wklejanie obrazów ze schowka, paletę Cmd+K, listę sesji z archiwizacją i wyszukiwaniem oraz selektor modeli na pasku stanu. Może łączyć się ze zdalnym gatewayem Hermes przez bezpieczny WebSocket, uwierzytelniając się przez OAuth lub nazwę użytkownika i hasło, z hostami zdalnymi dla każdego profilu oraz równoczesnymi sesjami wielu profili połączonymi referencjami @session między profilami. Interfejs desktopowy zawiera również pełne tłumaczenie na uproszczony chiński (简体中文) przez typowaną warstwę i18n (display.language; angielski pozostaje językiem domyślnym).20
  • Panel administracyjny w przeglądarce. Lokalny dashboard webowy rozwinął się z widoku stanu w pełnoprawny panel administracyjny: katalog MCP z przełącznikami włączania/wyłączania, zarządzanie poświadczeniami, tworzenie webhooków i hooków, konfigurację pamięci, kontrolki gatewaya oraz stronę System ze sprawdzaniem przed aktualizacją i Debug Share jednym kliknięciem. Nowa strona Channels konfiguruje z poziomu przeglądarki każdą platformę komunikacyjną gatewaya (Telegram, Discord, Slack i pozostałe). Uwierzytelnianie jest teraz wtyczkowe: logowanie nazwą użytkownika i hasłem, ogólny samodzielnie hostowany dostawca OIDC, hermes dashboard register dla samodzielnie hostowanego klienta OAuth oraz rotacja sesji za pomocą refresh tokenów.20
  • Nowe CLI i polecenia slash. /undo [N] tworzy kopię zapasową ostatnich N tur użytkownika z uprzednim wypełnieniem i miękkim usunięciem oraz działa w CLI, TUI i na wszystkich platformach komunikacyjnych. Konfigurowalny domyślny interfejs (cli lub tui) pojawia się wraz z nadpisaniem --cli; TUI zyskuje ujednolicone polecenie /model i nakładkę Sessions. hermes portal to czytelny dla człowieka alias przepływu wdrażania Nous Portal, z nowymi ścieżkami pierwszego uruchomienia Quick Setup i Full Setup, a także dwoma narzędziami diagnostycznymi: hermes prompt-size i hermes sessions optimize.20
  • Nowe modele i dostawcy. Selektor zyskuje deepseek-v4-flash, MiniMax-M3 (kontekst 1M, natywni dostawcy MiniMax), qwen3.7-plus (Nous + OpenRouter) oraz gemini-3.5-flash (Gemini OAuth + klucz API). Pierwszorzędny dostawca xAI Grok OAuth dołącza do launchera desktopowego, selektor modeli otrzymuje wyszukiwanie przybliżone na każdej powierzchni, dostawcy z wieloma endpointami są grupowani w jednym wierszu, a odświeżanie katalogu zmieniono z codziennego na cogodzinne.20
  • Lżejsze skills i progresywne ujawnianie. Domyślny zestaw skills pozbył się redundantnych i martwych skills (Spotify przeniesiono do natywnej wtyczki, Linear do hermes mcp install linear, a kilka nieaktualnych pozycji usunięto), więcej przeniesiono do opcjonalnych i dodano bramę trafności environments: we frontmatterze (kanban/docker/s6), która utrzymuje zależne od kontekstu skills poza indeksem do czasu ich zażądania. NVIDIA/skills jest teraz domyślnym zaufanym źródłem Skills Hub obok OpenAI, Anthropic i HuggingFace. Narzędzia MCP i wtyczek zyskały progresywne (zakresowe) ujawnianie narzędzi, a błąd MCP, który zgłaszał fałszywy sukces OAuth, gdy nie uzyskano tokenu, został naprawiony.20
  • Bezpieczeństwo. v0.16.0 przypina poprawioną wersję Starlette (≥1.0.1) dla CVE-2026-48710 (BadHost), przenosi kontrole adresów URL SSRF poza pętlę zdarzeń w ścieżkach asynchronicznych, usuwa bearer token wnioskowania Bedrock ze środowiska podprocesu, dodaje bws_cache.json do zabezpieczenia odczytu plików, dodaje docker restart/stop/kill do listy niebezpiecznych wzorców oraz oczyszcza niewidoczny Unicode w sprawdzonej zawartości skills. Wydanie zamknęło 2 problemy P0 i 62 problemy P1, z czego 16 oznaczono jako związane z bezpieczeństwem.20

W przypadku aktualizacji z v0.15.x nic z tego nie stanowi zmiany niezgodnej w samym CLI; są to dodatkowe powierzchnie i dostawcy wokół tego samego agenta. Aplikacja desktopowa i panel administracyjny są powodem aktualizacji, jeśli Hermes ma obsługiwać użytkowników nieterminalowych lub jeśli zachodzi potrzeba administrowania zdalnym gatewayem z przeglądarki.

Instalacja

Jednolinijkowy instalator jest obsługiwaną ścieżką instalacji. Obsługuje Python, uv, Node.js, ripgrep, ffmpeg, klonowanie repozytorium, środowisko wirtualne i globalne polecenie hermes.7

curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

Instalacje przez pip i Homebrew są wycofane od wersji v0.19.0. Pakiet PyPI wprowadzony w v0.14.0 (pip install hermes-agent) oraz formuła Homebrew są teraz oznaczone jako instalacje „unsupported legacy” — każda powierzchnia wyświetla ostrzeżenie (bez blokowania), gdy Hermes wykryje jedną z nich, a zaprzestanie publikowania w PyPI/Homebrew jest planowane. W przypadku instalacji przez pip lub brew należy przejść na powyższy instalator.25

Działa w systemach Linux, macOS, WSL2 oraz Android/Termux (instalator automatycznie wykrywa Termux i przełącza się na przetestowany pakiet Android).7 Natywny Windows jest teraz platformą Tier 1, a nie wczesną betą dostarczoną w v0.14.0 — można go zainstalować przez iex (irm https://hermes-agent.nousresearch.com/install.ps1). Dokumentacja wyraźnie wskazuje jedno zastrzeżenie: obsługa macOS dotyczy wyłącznie Apple Silicon, a komputery Intel Mac nie są obsługiwane.24 Historycznie v0.14.0 dodała natywną obsługę Windowsa we wczesnej becie za pomocą instalatora PowerShell, ale WSL2 pozostaje bezpieczniejszą rekomendacją do zastosowań produkcyjnych, dopóki ścieżka dla Windowsa nie dojrzeje.19

Po zakończeniu:

source ~/.bashrc    # or ~/.zshrc
hermes              # Start chatting

Jedynym wymaganiem wstępnym jest git. Instalator automatycznie zapewnia Python 3.11 przez uv (bez potrzeby używania sudo), Node.js 26 (do automatyzacji przeglądarki i mostka WhatsApp), ripgrep oraz ffmpeg. Node 26 jest bezwzględnym minimum od v0.20.0 — instalator odrzuca każdą starszą wersję i instaluje Node zarządzany przez Hermes.247

Weryfikacja instalacji

hermes version      # Check version
hermes doctor       # Diagnose config/dependency issues
hermes status       # Show current configuration + auth state
hermes dump         # Copy-pasteable setup summary for debugging

hermes doctor dokładnie wskazuje, czego brakuje i jak to naprawić.7 hermes dump to polecenie diagnostyczne, które należy wkleić do zgłoszenia GitHub lub wątku na Discordzie podczas prośby o pomoc — jest to tekstowe podsumowanie całej konfiguracji z usuniętymi sekretami.8

Instalacja ręczna

Jeśli potrzebna jest pełna kontrola — własna wersja Python, określone dodatki, integracja z Nix/NixOS — ręczny proces opisano krok po kroku w nadrzędnym przewodniku instalacji.7 Najważniejsze opcjonalne dodatki, które można łączyć przez uv pip install -e ".[<extras>]":

Dodatek Co dodaje
all Wszystko poniżej
messaging gateway Telegram i Discord
cron Analizowanie wyrażeń cron
cli Terminalowy interfejs menu kreatora konfiguracji
modal Backend wykonywania w chmurze Modal
voice Wejście mikrofonowe CLI i odtwarzanie dźwięku
tts-premium Głosy premium ElevenLabs
honcho Pamięć natywna dla AI (integracja Honcho)
mcp Obsługa Model Context Protocol
homeassistant Integracja Home Assistant
acp Obsługa integracji edytora ACP
slack Wiadomości Slack
pty Obsługa terminala PTY (interaktywne narzędzia CLI)
dev pytest i narzędzia testowe
termux Przetestowany pakiet Android (obejmuje cron, cli, pty, mcp, honcho, acp)

Polecenie instalacji Termux jest inne — używa pip z plikiem ograniczeń, a nie uv pip:

python -m pip install -e ".[termux]" -c constraints-termux.txt

Wynika to z faktu, że .[all] w Androidzie pobiera faster-whisper przez dodatek voice, który zależy od pakietów ctranslate2 niepublikowanych dla Androida.7


Uwierzytelnianie i dostawcy

Hermes obsługuje około 22 dostawców pierwszej klasy oraz własne endpointy (v0.19.0 dodaje Fireworks AI, DeepInfra i Upstage Solar), a także trzy odrębne ścieżki uwierzytelniania. Poniżej przedstawiono cały obszar uwierzytelniania, uporządkowany według ścieżek, aby łatwo znaleźć tę odpowiadającą posiadanej konfiguracji.

Trzy ścieżki uwierzytelniania

Każdy dostawca w Hermes korzysta z jednego z trzech schematów uwierzytelniania:

Ścieżka 1 — klucz API w .env. Klucz należy umieścić w ~/.hermes/.env; Hermes odczyta go podczas uruchamiania. Ta metoda jest używana przez OpenRouter, AI Gateway, z.ai/GLM, Kimi/Moonshot, MiniMax (oraz MiniMax China), Alibaba Cloud/DashScope, Kilo Code, OpenCode Zen, OpenCode Go, DeepSeek, Hugging Face, Google/Gemini i większość dostawców zewnętrznych.2 Od v0.19.0 klucz nie musi już znajdować się w pliku tekstowym: rozszerzalny interfejs SecretSource może podczas ładowania pobierać sekrety z Bitwarden lub 1Password (odwołania op://), z równoczesną obsługą wielu sejfów, deterministycznym pierwszeństwem, ostrzeżeniami o konfliktach i pochodzeniem każdej zmiennej — .env pozostaje rozwiązaniem awaryjnym. (Różni się to od tokenu bootstrap Bitwarden Secrets Manager z v0.15.0, który konsolidował klucze dostawców za jednym tokenem; SecretSource zastępuje sam plik tekstowy, a przyszli dostawcy sejfów będą dodawani jako pluginy.)25

Ścieżka 2 — OAuth przez hermes model lub hermes auth. Uruchamia przepływ kodu urządzenia, otwiera przeglądarkę i zapisuje poświadczenia w ~/.hermes/auth.json (może również zaimportować istniejące poświadczenia z narzędzi takich jak Claude Code lub Codex CLI). Korzystają z niej Nous Portal, OpenAI Codex (konto ChatGPT), GitHub Copilot i Anthropic (Claude Pro/Max).2

Ścieżka 3 — własny endpoint w config.yaml. Dla każdego zgodnego z OpenAI API — Ollama, vLLM, SGLang, llama.cpp, LM Studio, proxy LiteLLM, Together AI, Groq, Azure OpenAI lub własnego serwera hostowanego samodzielnie. Konfigurowany jednokrotnie przez hermes model → Custom endpoint, a następnie utrwalany w config.yaml.2

Pełna macierz dostawców

Poniżej znajduje się kompletna lista dostawców pierwszej klasy wraz z dokładnym procesem konfiguracji każdego z nich.2

Dostawca Ścieżka uwierzytelniania Konfiguracja
Nous Portal OAuth hermes model (logowanie OAuth, oparte na subskrypcji)
OpenAI Codex OAuth hermes model (kod urządzenia ChatGPT, korzysta z modeli Codex)
GitHub Copilot OAuth lub token hermes model (kod urządzenia OAuth), albo COPILOT_GITHUB_TOKEN / GH_TOKEN / gh auth token
GitHub Copilot ACP Lokalny podproces hermes model (wymaga copilot CLI w PATH + copilot login)
Anthropic OAuth lub klucz API hermes model (preferuje poświadczenia Claude Code), albo ANTHROPIC_API_KEY, albo token konfiguracyjny ANTHROPIC_TOKEN
OpenRouter Klucz API OPENROUTER_API_KEY w ~/.hermes/.env
AI Gateway (Vercel) Klucz API AI_GATEWAY_API_KEY w ~/.hermes/.env (dostawca: ai-gateway)
z.ai / GLM (ZhipuAI) Klucz API GLM_API_KEY w ~/.hermes/.env (dostawca: zai)
Kimi / Moonshot Klucz API KIMI_API_KEY w ~/.hermes/.env (dostawca: kimi-coding). v0.19.0 dodaje kimi-k3 do katalogów (kimi-k2.x wycofano).25
MiniMax (globalny) Klucz API MINIMAX_API_KEY w ~/.hermes/.env (dostawca: minimax)
MiniMax China Klucz API MINIMAX_CN_API_KEY w ~/.hermes/.env (dostawca: minimax-cn)
Alibaba Cloud (Qwen) Klucz API DASHSCOPE_API_KEY w ~/.hermes/.env (dostawca: alibaba, aliasy: dashscope, qwen)
Kilo Code Klucz API KILOCODE_API_KEY w ~/.hermes/.env (dostawca: kilocode)
OpenCode Zen Klucz API OPENCODE_ZEN_API_KEY w ~/.hermes/.env (dostawca: opencode-zen)
OpenCode Go Klucz API OPENCODE_GO_API_KEY w ~/.hermes/.env (dostawca: opencode-go)
DeepSeek Klucz API DEEPSEEK_API_KEY w ~/.hermes/.env (dostawca: deepseek)
Hugging Face Klucz API HF_TOKEN w ~/.hermes/.env (dostawca: huggingface, alias: hf)
Google / Gemini Klucz API GOOGLE_API_KEY lub GEMINI_API_KEY w ~/.hermes/.env (dostawca: gemini)
Fireworks AI Klucz API Dostawca pierwszej klasy z szacowaniem kosztów i kolumnami cen z pamięci podręcznej w selektorze modeli; przesunięty na pozycję nr 2 w selektorach dostawców. Nowość w v0.19.0.25
DeepInfra Klucz API Dostawca pierwszej klasy z utwardzoną integracją. Nowość w v0.19.0.25
Upstage Solar Klucz API Dostawca pierwszej klasy. Nowość w v0.19.0.25
xAI (Grok) Natywny dostawca / SuperGrok OAuth Dostawca pierwszej klasy z bezpośrednim dostępem API i katalogiem modeli (v0.9.0+). v0.14.0 dodaje SuperGrok OAuth i zwiększa okno kontekstu grok-4.3 do 1M dla kont z uprawnieniami.21619 v0.17.0 dodaje grok-composer-2.5-fast (model Cursor przez xAI OAuth, kontekst 200k) i zmienia domyślny model xAI na grok-build-0.1.21 v0.19.0 przenosi grok-4.5 do GA w katalogu.25
xAI Custom Voices Klucz API Dostawca TTS z klonowaniem głosu. Nowość w v0.13.0; należy skonfigurować w sekcji tts: w config.yaml i podać klucz xAI w .env.18
Xiaomi MiMo Natywny dostawca Dostawca pierwszej klasy z kreatorem konfiguracji i katalogiem modeli. Bezpłatny MiMo v2 Pro w Nous Portal do zadań pomocniczych (v0.9.0+).1615
Google AI Studio Klucz API GOOGLE_API_KEY lub GEMINI_API_KEY w ~/.hermes/.env. Bezpośredni dostęp do Gemini z automatycznym wykrywaniem długości kontekstu przez rejestr models.dev (v0.8.0+).15
Qwen Cloud OAuth Dostawca OAuth z obsługą żądań portalu (v0.8.0+). W v0.14.0 nazwę dostawcy zmieniono z Alibaba Cloud na Qwen Cloud; istniejące klucze konfiguracji nadal działają.1519
Własny endpoint config.yaml hermes model → „Custom endpoint” (zapisywany w config.yaml)

Od v0.19.0 można także ukryć nieużywanych dostawców: flaga enabled: false dla każdego dostawcy oraz klucz konfiguracji excluded_providers usuwają ich z selektorów /model i wbudowanego rozpoznawania dostawców.25

Anthropic: trzy metody uwierzytelniania

Anthropic ma własną sekcję, ponieważ Hermes obsługuje trzy odrębne ścieżki do Claude, a wybór właściwej ma znaczenie. Z dokumentacji źródłowej:2

# Method 1: API key (pay-per-token)
export ANTHROPIC_API_KEY=***
hermes chat --provider anthropic --model claude-sonnet-4-6

# Method 2: OAuth through hermes model (preferred)
# Uses Claude Code's credential store when available
hermes model

# Method 3: Manual setup-token (fallback/legacy)
export ANTHROPIC_TOKEN=***
hermes chat --provider anthropic

# Auto-detect Claude Code credentials
hermes chat --provider anthropic   # reads Claude Code files automatically

Po wybraniu Anthropic OAuth przez hermes model, Hermes preferuje własny magazyn poświadczeń Claude Code zamiast kopiowania tokenu do ~/.hermes/.env. Dzięki temu odnawialne poświadczenia Claude pozostają odnawialne.2 Jeśli Claude Code jest już używany na tym samym komputerze, jest to najczystsza ścieżka.

Aby na stałe przypiąć Anthropic w config.yaml:

model:
  provider: "anthropic"
  default: "claude-sonnet-4-6"

--provider claude i --provider claude-code działają również jako skróty dla --provider anthropic.2

GitHub Copilot: dwa tryby

Copilot jest obsługiwany w dwóch trybach: bezpośredni Copilot API (zalecany) oraz Copilot ACP (który uruchamia lokalny Copilot CLI jako podproces).2

# Direct Copilot API
hermes chat --provider copilot --model gpt-5.4

# Copilot ACP (requires the Copilot CLI in PATH + an existing copilot login)
hermes chat --provider copilot-acp --model copilot-acp

Uwierzytelnianie jest sprawdzane w następującej kolejności, zgodnie z dokumentacją źródłową:2 1. Zmienna środowiskowa COPILOT_GITHUB_TOKEN 2. Zmienna środowiskowa GH_TOKEN 3. Zmienna środowiskowa GITHUB_TOKEN 4. Awaryjnie: CLI gh auth token 5. Logowanie kodem urządzenia OAuth przez hermes model

Typ tokenu ma znaczenie. Copilot API nie obsługuje klasycznych Personal Access Tokens (ghp_*). Obsługiwane są tokeny OAuth (gho_*), szczegółowe PAT-y (github_pat_* z uprawnieniem Copilot Requests) oraz tokeny aplikacji GitHub (ghu_*). Jeśli gh auth token zwraca token ghp_*, należy użyć hermes model, aby uwierzytelnić się przez OAuth.2

Chińscy dostawcy AI (obsługa pierwszej klasy)

Hermes ma wbudowaną obsługę z.ai/GLM, Kimi/Moonshot, MiniMax (endpointy globalne i China) oraz Alibaba Cloud z dedykowanymi identyfikatorami dostawców.2

# z.ai / ZhipuAI GLM
hermes chat --provider zai --model glm-5                 # Requires: GLM_API_KEY

# Kimi / Moonshot AI
hermes chat --provider kimi-coding --model kimi-for-coding   # Requires: KIMI_API_KEY

# MiniMax (global)
hermes chat --provider minimax --model MiniMax-M2.7          # Requires: MINIMAX_API_KEY

# MiniMax (China)
hermes chat --provider minimax-cn --model MiniMax-M2.7       # Requires: MINIMAX_CN_API_KEY

# Alibaba Cloud / DashScope (Qwen)
hermes chat --provider alibaba --model qwen3.5-plus          # Requires: DASHSCOPE_API_KEY

Bazowe URL-e można nadpisać za pomocą zmiennych środowiskowych GLM_BASE_URL, KIMI_BASE_URL, MINIMAX_BASE_URL, MINIMAX_CN_BASE_URL lub DASHSCOPE_BASE_URL.2

Z.AI automatycznie wykrywa endpoint. Podczas korzystania z dostawcy z.ai/GLM Hermes sonduje wiele endpointów (globalne, China i warianty coding), aby znaleźć taki, który akceptuje klucz API. Działający endpoint jest automatycznie zapisywany w pamięci podręcznej — dla większości użytkowników GLM_BASE_URL nie jest potrzebny.2

xAI (Grok) automatycznie włącza cache promptów. Gdy bazowy URL zawiera x.ai, Hermes wysyła nagłówek x-grok-conv-id z każdym żądaniem, aby kierować je do tego samego serwera w ramach sesji rozmowy i ponownie wykorzystywać cache promptów systemowych oraz historii.2 Działa automatycznie; konfiguracja nie jest wymagana.

Polecenie hermes auth

hermes auth to polecenie do zarządzania poświadczeniami dla pul i poświadczeniami OAuth.6

hermes auth                              # Interactive wizard
hermes auth list                         # Show all credential pools
hermes auth list openrouter              # Show one provider's pool
hermes auth add openrouter --api-key sk-or-v1-xxx
hermes auth add anthropic --type oauth
hermes auth remove openrouter 2          # Remove by index
hermes auth reset openrouter             # Clear cooldowns

Pule poświadczeń umożliwiają rotowanie wielu kluczy API lub tokenów OAuth dla tego samego dostawcy — jest to przydatne do rozkładania limitów szybkości między wiele kluczy bez zmiany kodu.6 Starsze polecenia hermes login / hermes logout zostały usunięte; należy używać zamiast nich hermes auth.6

Własne endpointy i endpointy hostowane samodzielnie

Hermes działa z każdym endpointem API zgodnym z OpenAI. Jeśli serwer implementuje /v1/chat/completions, można wskazać go Hermes.2

Konfiguracja interaktywna (zalecana):

hermes model
# Select "Custom endpoint (self-hosted / VLLM / etc.)"
# Enter: API base URL, API key, Model name

Ręczny config.yaml:

model:
  default: your-model-name
  provider: custom
  base_url: http://localhost:8000/v1
  api_key: your-key-or-leave-empty-for-local

Oba podejścia zapisują konfigurację w config.yaml, który jest pojedynczym źródłem prawdy dla głównego modelu, dostawcy i bazowego URL-a.2 Starsze zmienne środowiskowe OPENAI_BASE_URL i LLM_MODEL nie są już odczytywane do konfiguracji głównego modelu — należy użyć hermes model lub bezpośrednio edytować config.yaml.2 (OPENAI_BASE_URL + OPENAI_API_KEY są nadal respektowane jako rozwiązanie awaryjne dla pomocniczej ścieżki routingu provider: "main", dlatego nie należy usuwać ich bez zastanowienia, jeśli są tam używane.)4

Przełączanie własnych endpointów w trakcie sesji:

/model custom:qwen-2.5             # Custom endpoint with explicit model
/model custom                      # Auto-detect the model from the endpoint
/model custom:local:qwen-2.5       # Named custom provider "local"
/model custom:work:llama3          # Named custom provider "work"
/model openrouter:claude-sonnet-4  # Back to a cloud provider

/model custom (bez argumentu, bez nazwy modelu) odpytuje API /v1/models endpointu i automatycznie wybiera model, jeśli załadowano dokładnie jeden — przydatne dla lokalnych serwerów uruchamiających pojedynczy model.2

Lokalne serwery LLM (szablony konfiguracji)

Dokumentacja źródłowa zawiera kompletne przewodniki konfiguracji dla Ollama, vLLM, SGLang, llama.cpp i LM Studio. Poniżej znajdują się kluczowe polecenia, które rzeczywiście trzeba uruchomić. Każde z nich ma utworzyć działający endpoint, na który można wskazać Hermes.2

Ollama — najprostsza lokalna ścieżka, bez konfiguracji:

ollama pull qwen2.5-coder:32b
OLLAMA_CONTEXT_LENGTH=32768 ollama serve   # Raise from 4k default
hermes model   # Custom endpoint → http://localhost:11434/v1 → qwen2.5-coder:32b

Kluczowy problem z Ollama: Ollama domyślnie używa bardzo małych długości kontekstu (4096 tokenów przy mniej niż 24 GB VRAM). Należy je zwiększyć przez OLLAMA_CONTEXT_LENGTH lub Modelfile — zgodny z OpenAI API nie akceptuje długości kontekstu od klienta, więc Hermes nie może ustawić jej za użytkownika.2 Do pracy agentowej należy ustawić co najmniej 16k–32k.

vLLM — wysokowydajne serwowanie GPU:

pip install vllm
vllm serve meta-llama/Llama-3.1-70B-Instruct \
  --port 8000 \
  --max-model-len 65536 \
  --tensor-parallel-size 2 \
  --enable-auto-tool-choice \
  --tool-call-parser hermes

Wywoływanie narzędzi wymaga --enable-auto-tool-choice i --tool-call-parser <name>. Obsługiwane parsery: hermes (Qwen 2.5, Hermes 2/3), llama3_json, mistral, deepseek_v3, deepseek_v31, xlam, pythonic. Bez tych flag wywołania narzędzi będą zwracane jako zwykły tekst.2

SGLang — szybkie serwowanie z RadixAttention do ponownego używania cache KV:

pip install "sglang[all]"
python -m sglang.launch_server \
  --model meta-llama/Llama-3.1-70B-Instruct \
  --port 30000 \
  --context-length 65536 \
  --tp 2 \
  --tool-call-parser qwen

Problem z SGLang: domyślne max_tokens wynosi 128. Należy ustawić --default-max-tokens na serwerze lub skonfigurować model.max_tokens w config.yaml, jeśli odpowiedzi są obcinane.2

llama.cpp / llama-server — CPU i Apple Silicon Metal:

./build/bin/llama-server \
  --jinja -fa \
  -c 32768 \
  -ngl 99 \
  -m models/qwen2.5-coder-32b-instruct-Q4_K_M.gguf \
  --port 8080 --host 0.0.0.0

--jinja jest wymagane do wywoływania narzędzi. Bez tej flagi llama-server całkowicie ignoruje parametr tools, a model próbuje wywoływać narzędzia, zapisując JSON w tekście odpowiedzi — czego Hermes nie może zinterpretować jako rzeczywistych wywołań narzędzi.2

LM Studio — aplikacja desktopowa z GUI:

Serwer należy uruchomić z aplikacji LM Studio (karta Developer → Start Server) albo przez CLI: lms server start (uruchamia na porcie 1234) i lms load qwen2.5-coder --context-length 32768.2 Następnie należy wskazać hermes model na http://localhost:1234/v1.

Kluczowy problem z LM Studio: LM Studio odczytuje długość kontekstu z metadanych modelu, lecz wiele modeli GGUF zgłasza domyślne wartości 2048 lub 4096. Zawsze należy ustawić długość kontekstu jawnie w ustawieniach modelu LM Studio — kliknąć ikonę koła zębatego obok selektora modelu, ustawić „Context Length” na co najmniej 16384 (najlepiej 32768) i ponownie załadować model.2

Nazwane własne dostawcy

Jeśli pracuje się z wieloma własnymi endpointami (na przykład lokalnym serwerem deweloperskim i zdalnym serwerem GPU), należy zdefiniować je jako nazwanych własnych dostawców w config.yaml:2

custom_providers:
  - name: local
    base_url: http://localhost:8080/v1
    # api_key omitted — Hermes uses "no-key-required" for keyless local servers
  - name: work
    base_url: https://gpu-server.internal.corp/v1
    api_key: corp-api-key
    api_mode: chat_completions      # optional, auto-detected from URL
  - name: anthropic-proxy
    base_url: https://proxy.example.com/anthropic
    api_key: proxy-key
    api_mode: anthropic_messages    # for Anthropic-compatible proxies

Następnie można przełączać się między nimi w trakcie sesji za pomocą składni potrójnej:

/model custom:local:qwen-2.5
/model custom:work:llama3-70b
/model custom:anthropic-proxy:claude-sonnet-4

Nazwane własne dostawcy można również wybrać z interaktywnego menu hermes model.2

Architektura rozszerzalnych dostawców (v0.13.0+)

v0.13.0 dostarcza ABC ProviderProfile oraz katalog plugins/model-providers/, dzięki czemu zewnętrzni dostawcy inferencji mogą być dodawani bez modyfikacji rdzenia.18 Jeśli dostawca obsługuje tryb API zgodny z OpenAI, Anthropic lub Codex, można zaimplementować podklasę ProviderProfile, która deklaruje ścieżkę uwierzytelniania, bazowy URL, katalog modeli i nagłówki cache; Hermes rozpoznaje ją przez tę samą ścieżkę runtime_provider.py, której używają wbudowani dostawcy. To zmiana architektoniczna stojąca za rozszerzeniem dostawców w v0.13.0: zamiast edytować kod rdzenia, aby dodać dostawcę, dostarcza się plugin.

Lokalny proxy zgodny z OpenAI (v0.14.0+)

hermes proxy udostępnia lokalny endpoint zgodny z OpenAI, oparty na dostawcy OAuth, do którego Hermes jest już zalogowany — Claude Pro, ChatGPT Pro, SuperGrok lub innym zgodnym skonfigurowanym dostawcy.19 Oznacza to, że narzędzia oczekujące API w stylu OpenAI, w tym Codex CLI, Aider, Cline, Continue lub własne skrypty, mogą ponownie wykorzystywać uwierzytelnianie Hermes oparte na subskrypcji bez oddzielnego klucza API. Proxy należy traktować jako lokalną infrastrukturę deweloperską: wiązać go świadomie, nie udostępniać szeroko i pamiętać o warunkach specyficznych dla dostawcy.

Wykrywanie długości kontekstu

Zgodnie z dokumentacją źródłową stale mylone są dwa ustawienia:2

  • context_length — całkowite okno kontekstu (łączny budżet tokenów wejściowych i wyjściowych, np. 1 000 000 dla Claude Opus 4.7 lub 200 000 dla Sonnet 4.6). Hermes używa go, aby zdecydować, kiedy skompresować historię.
  • model.max_tokens — limit wyjścia (maksymalna liczba tokenów, które model może wygenerować w pojedynczej odpowiedzi). Nie ma związku z długością historii.

context_length należy ustawić, gdy automatyczne wykrywanie błędnie rozpoznaje rozmiar okna:

model:
  default: "qwen3.5:9b"
  base_url: "http://localhost:8080/v1"
  context_length: 131072      # tokens

Hermes używa wieloźródłowego łańcucha rozpoznawania okien kontekstu: nadpisanie konfiguracji → własny dostawca dla modelu → trwały cache → endpoint /models → Anthropic /v1/models → OpenRouter API → Nous Portal → models.dev (rejestr społecznościowy zawierający ponad 3800 modeli) → wartości awaryjne (128K).2 System uwzględnia dostawcę, dlatego ten sam model może mieć inne limity kontekstu zależnie od tego, kto go udostępnia (np. claude-opus-4.6 ma 1M bezpośrednio w Anthropic, lecz 128K w GitHub Copilot).2

Inteligentne routowanie modeli: rotacja dostawców i fallback

Hermes nie przypisuje użytkownika na stałe do jednego modelu u jednego dostawcy. Inteligentne routowanie modeli to zbiór mechanizmów decydujących, który dostawca i model faktycznie obsługuje dane żądanie: pule poświadczeń rozpraszają obciążenie między kluczami, skonfigurowany fallback przejmuje obsługę, gdy podstawowy model zawiedzie, a opisane niżej sloty pomocnicze niezależnie kierują zadania poboczne do tańszych modeli zamiast głównego modelu.26 Te trzy elementy należy skonfigurować razem — to różnica między agentem, który zatrzymuje się na limicie szybkości, a takim, który nadal pracuje.

Pule poświadczeń. Gdy dla tego samego dostawcy dostępnych jest wiele kluczy API, strategię rotacji należy skonfigurować za pomocą hermes auth. Tak rozkłada się limity szybkości między wiele kluczy.6

Model fallback. Należy skonfigurować zapasowe provider:model, na które Hermes automatycznie przełączy się, gdy podstawowy model zawiedzie (limity szybkości, błędy serwera, błędy uwierzytelniania):2

fallback_model:
  provider: openrouter            # required
  model: anthropic/claude-sonnet-4  # required
  # base_url: http://localhost:8000/v1    # optional, for custom endpoints
  # api_key_env: MY_CUSTOM_KEY           # optional, env var name

Fallback zmienia model i dostawcę w trakcie sesji bez utraty rozmowy. Uruchamia się najwyżej raz na sesję.2 Obsługiwani dostawcy fallback: openrouter, nous, openai-codex, copilot, copilot-acp, anthropic, huggingface, zai, kimi-coding, minimax, minimax-cn, deepseek, ai-gateway, opencode-zen, opencode-go, kilocode, alibaba, custom.2

Modele pomocnicze

Hermes używa lekkich modeli „pomocniczych” do zadań pobocznych: analizy obrazów, podsumowywania stron internetowych, analizy zrzutów ekranu przeglądarki, klasyfikacji zatwierdzania niebezpiecznych poleceń, kompresji kontekstu, podsumowywania wyszukiwania sesji, dopasowywania skillów, wysyłania narzędzi MCP oraz opróżniania pamięci.4 Domyślnie korzystają one z Gemini Flash przez automatyczne wykrywanie (OpenRouter → Nous → Codex).

Można skonfigurować model i dostawcę używane przez każde zadanie pomocnicze. Każdy slot pomocniczy korzysta z tych samych trzech parametrów: provider, model, base_url.4

auxiliary:
  vision:
    provider: "auto"                # "auto", "openrouter", "nous", "codex", "main", etc.
    model: ""                       # e.g. "openai/gpt-4o", "google/gemini-2.5-flash"
    base_url: ""                    # Custom OpenAI-compatible endpoint
    api_key: ""                     # Falls back to OPENAI_API_KEY
    timeout: 30
    download_timeout: 30
  web_extract:
    provider: "auto"
    model: ""
    timeout: 360
  approval:
    provider: "auto"
    model: ""
    timeout: 30
  compression:
    timeout: 120
  session_search: { provider: "auto", model: "", timeout: 30 }
  skills_hub:    { provider: "auto", model: "", timeout: 30 }
  mcp:           { provider: "auto", model: "", timeout: 30 }
  flush_memories:{ provider: "auto", model: "", timeout: 30 }

Opcja dostawcy "main" oznacza „użyj dostawcy mojego głównego agenta” — jest prawidłowa wyłącznie w konfiguracjach auxiliary:, compression: i fallback_model:. Nie jest prawidłowa dla ustawienia model.provider najwyższego poziomu. W przypadku używania własnego endpointu zgodnego z OpenAI jako głównego modelu należy ustawić provider: custom w sekcji model:.4

Dlaczego to ważne: jeśli skonfigurowano wyłącznie Anthropic OAuth (bez klucza OpenRouter), analiza obrazu, podsumowywanie sieci i kompresja ulegną pogorszeniu lub przestaną działać, ponieważ domyślny łańcuch fallback zadań pomocniczych najpierw próbuje OpenRouter. Należy dodać OPENROUTER_API_KEY dla zadań pomocniczych albo skonfigurować każdy slot pomocniczy tak, aby używał głównego dostawcy:

auxiliary:
  vision:
    provider: "main"
  web_extract:
    provider: "main"

To najczęstszy problem typu „moje funkcje po cichu nie działają” u nowych użytkowników Hermes.


System konfiguracji

Hermes ma warstwowy system konfiguracji. Zrozumienie kolejności pierwszeństwa jest niezbędne, ponieważ warstwy wyższe zastępują niższe, a jedną z warstw jest globalny rejestr dostawców, którego nie widać w config.yaml.

Układ plików konfiguracyjnych

Zgodnie z dokumentacją upstream są to pliki tworzące konfigurację Hermes:4

~/.hermes/
├── config.yaml       # All settings (model, terminal, TTS, compression, memory, toolsets, ...)
├── .env              # Secrets (API keys, bot tokens, passwords)
├── auth.json         # OAuth provider credentials (Nous Portal, Codex, Anthropic)
├── SOUL.md           # Primary agent identity (slot #1 in system prompt)
├── memories/         # Persistent memory (MEMORY.md, USER.md)
├── skills/           # Bundled + agent-created + hub-installed skills
├── cron/             # Scheduled jobs
├── sessions/         # Gateway session state
└── logs/             # agent.log, gateway.log, errors.log (secrets auto-redacted)

config.yaml a .env — gdy ustawiono oba, dla ustawień innych niż sekrety pierwszeństwo ma config.yaml.4 Zasada jest następująca: - Sekrety (klucze API, tokeny botów, hasła) → .env - Wszystko pozostałe (model, backend terminala, ustawienia kompresji, limity pamięci, toolsety) → config.yaml

Do sekretów można odwoływać się z poziomu config.yaml, używając interpolacji w stylu powłoki:4

auxiliary:
  vision:
    api_key: ${GOOGLE_API_KEY}
    base_url: ${CUSTOM_VISION_URL}
  delegation:
    api_key: ${DELEGATION_KEY}

Zarządzanie konfiguracją

hermes config                # View current configuration
hermes config show           # Same as above
hermes config edit           # Open config.yaml in your editor
hermes config set KEY VAL    # Set a specific value
hermes config get KEY        # Print a single value (v0.19.0+)
hermes config unset KEY      # Remove a key so the default applies again (v0.19.0+)
hermes config path           # Print the config file path
hermes config env-path       # Print the .env file path
hermes config check          # Check for missing options (after updates)
hermes config migrate        # Interactively add missing options

Przykłady:4

hermes config set model anthropic/claude-opus-4
hermes config set terminal.backend docker
hermes config set OPENROUTER_API_KEY sk-or-...   # Saves to .env

hermes config check i hermes config migrate to polecenia, które należy uruchamiać po każdej aktualizacji hermes update — wykrywają nowo dodane opcje konfiguracji, których plik jeszcze nie zawiera.6

Kolejność pierwszeństwa konfiguracji

Hermes ładuje konfigurację z kilku źródeł. Gdy wiele źródeł ustawia tę samą wartość, wygrywa źródło o wyższym priorytecie:4

  1. Argumenty CLIhermes chat --model anthropic/claude-sonnet-4 (nadpisanie dla pojedynczego wywołania)
  2. Zmienne środowiskowe — stosowane podczas uruchamiania procesu
  3. config.yaml — główny plik ustawień
  4. .env — wyłącznie sekrety
  5. Wbudowane wartości domyślne — stosowane, gdy żadne inne źródło nie ustawia wartości

Flagi CLI zawsze mają pierwszeństwo dla tego pojedynczego wywołania. config.yaml stanowi długoterminowe źródło prawdy.

Lokalizacja (v0.13.0+)

Wersja v0.13.0 dodała 7 lokalizacji dla komunikatów CLI i gateway: chińską (uproszczoną), japońską, niemiecką, hiszpańską, francuską, ukraińską i turecką.18 Wersja v0.14.0 lokalizuje wszystkie polecenia gateway i panel webowy, dodaje 8 kolejnych lokalizacji oraz zwiększa łączną liczbę do 16.19 Dokumentacja jest obecnie zlokalizowana wyłącznie w zh-Hans. Lokalizacja jest ustalana na podstawie zmiennych środowiskowych LC_ALL / LANG albo jawnego klucza locale: w config.yaml. Angielski pozostaje domyślnym językiem i źródłem prawdy dla każdego ciągu, którego tłumaczenie jeszcze nie obejmuje.

Profile — wiele odizolowanych instancji Hermes

Profile zapewniają wiele odizolowanych instancji Hermes, z których każda ma własną konfigurację, sesje, skille, pamięć oraz PID gateway. W ten sposób można uruchomić obok siebie „służbowy Hermes” i „prywatny Hermes”, bez możliwości wglądu każdej z nich w stan drugiej.6

hermes profile list
hermes profile create work --clone                  # Clone from current profile
hermes profile use work                             # Set sticky default
hermes profile alias work --name h-work             # Create wrapper script
hermes profile export work -o work-backup.tar.gz
hermes profile import work-backup.tar.gz --name restored
hermes -p work chat -q "Hello from work profile"    # One-off without switching

Każdy profil otrzymuje własny HERMES_HOME (domyślnie ~/.hermes-<name>/), dzięki czemu wiele profili może jednocześnie uruchamiać gateway, nie kolidując ze sobą.63


Polecenia CLI

Ta sekcja stanowi praktyczne kompendium poleceń CLI najwyższego poziomu. Autorytatywne odniesienie oparte na kodzie znajduje się w źródłowym dokumencie CLI Commands Reference.6

Opcje globalne

hermes [global-options] <command> [subcommand/options]
Opcja Opis
--version, -V Wyświetla wersję i kończy działanie
--profile <name>, -p <name> Wybiera profil Hermes do użycia
--resume <session>, -r <session> Wznawia sesję według ID lub tytułu
--continue [name], -c [name] Wznawia najnowszą sesję (lub dopasowuje tytuł)
--worktree, -w Uruchamia w izolowanym git worktree
--yolo Pomija monity o zatwierdzenie niebezpiecznych poleceń
--safe-mode Flaga rozwiązywania problemów — uruchamia Hermes w minimalnym bezpiecznym trybie, aby odizolować problemy ze startem (v0.19.0+)25
--pass-session-id Uwzględnia ID sesji w system prompt agenta

Polecenia najwyższego poziomu

Polecenie Cel
hermes chat Interaktywny czat lub czat jednorazowy
hermes model Interaktywny wybór domyślnego providera i modelu
hermes gateway Uruchamianie lub zarządzanie messaging gateway
hermes setup Interaktywny kreator konfiguracji
hermes auth Zarządzanie poświadczeniami — dodawanie, wyświetlanie, usuwanie, resetowanie, ustawianie strategii
hermes status Wyświetla stan agenta, uwierzytelniania i platform
hermes cron Sprawdzanie i uruchamianie cron scheduler
hermes webhook Zarządzanie dynamicznymi subskrypcjami webhook
hermes doctor Diagnozowanie problemów z konfiguracją i zależnościami
hermes dump Podsumowanie konfiguracji do skopiowania i wklejenia na potrzeby wsparcia/debugowania
hermes logs Wyświetlanie, śledzenie i filtrowanie logów agenta/gateway/błędów
hermes config Wyświetlanie, edytowanie, migrowanie i odpytywanie konfiguracji
hermes pairing Zatwierdzanie lub cofanie kodów parowania komunikatorów
hermes skills Przeglądanie, instalowanie, publikowanie i audytowanie skills
hermes honcho Zarządzanie pamięcią Honcho między sesjami
hermes memory Konfigurowanie zewnętrznego providera pamięci
hermes acp Uruchamianie Hermes jako serwera ACP (integracja z edytorem)
hermes mcp Zarządzanie konfiguracją serwera MCP; uruchamianie Hermes jako serwera MCP
hermes plugins Zarządzanie pluginami
hermes tools Konfigurowanie włączonych tools dla każdej platformy
hermes sessions Przeglądanie, eksportowanie, przycinanie i usuwanie sesji. Wersja v0.19.0 rozszerza hermes sessions export o formaty Markdown, Quarto, HTML, tylko prompt oraz ślad Hugging Face, z opcjonalnym przebiegiem czyszczenia sekretów --redact i filtrami wieku/workspace/platformy25
hermes insights Wyświetla analitykę tokenów/kosztów/aktywności
hermes claw Narzędzia pomocnicze do migracji OpenClaw
hermes profile Zarządzanie profilami (wieloma izolowanymi instancjami)
hermes completion Wypisuje skrypty uzupełniania powłoki (bash/zsh)
hermes whatsapp Konfigurowanie i parowanie mostu WhatsApp
hermes version Wypisuje informacje o wersji
hermes update Pobiera najnowszy kod i ponownie instaluje zależności
hermes uninstall Usuwa Hermes z systemu (--full usuwa również konfigurację/dane)
hermes backup Pełna kopia zapasowa konfiguracji, sesji, skills i pamięci (v0.9.0+)16
hermes import Przywracanie z archiwum kopii zapasowej — migracja między maszynami lub cofanie zmian (v0.9.0+)16
hermes dashboard Uruchamianie lokalnego web dashboard do zarządzania agentem w przeglądarce (v0.9.0+)16
hermes serve Uruchamianie backendowego serwera API bez interfejsu — od v0.19.0 nie buduje on już ani nie montuje web UI25
hermes debug share Przesyłanie pełnego raportu debugowania do pastebin, aby udostępnić go podczas rozwiązywania problemów (v0.9.0+)16

hermes chat — Główny punkt wejścia

hermes bez argumentów otwiera interaktywny czat. hermes chat to jawna forma z opcjami:6

hermes chat -q "Summarize the latest PRs"           # One-shot, non-interactive
hermes chat --provider openrouter --model anthropic/claude-sonnet-4.6
hermes chat --toolsets web,terminal,skills          # Enable specific toolsets
hermes chat --quiet -q "Return only JSON"           # Programmatic mode
hermes chat --worktree -q "Review repo and open a PR"

Najważniejsze opcje:

Opcja Opis
-q, --query "..." Prompt jednorazowy, nieinteraktywny
-m, --model <model> Zastępuje model dla tego uruchomienia
-t, --toolsets <csv> Włącza zestaw toolsets rozdzielonych przecinkami
--provider <provider> Wymusza providera (zob. pełną listę)
-s, --skills <name> Wstępnie ładuje jeden lub więcej skills dla tej sesji
-v, --verbose Szczegółowe wyjście
-Q, --quiet Tryb programowy (bez banera, spinnera i podglądów)
--resume <session> Wznawia sesję bezpośrednio z poziomu chat
--worktree Tworzy izolowany git worktree
--checkpoints Włącza checkpointy systemu plików przed destrukcyjnymi zmianami
--yolo Pomija monity o zatwierdzenie
--source <tag> Tag źródła sesji (domyślnie: cli; dla integracji należy użyć tool)
--max-turns <N> Maksymalna liczba iteracji wywoływania tools na turę (domyślnie: 90)

hermes setup — Pełny kreator

Uruchamia pełny kreator konfiguracji lub przechodzi bezpośrednio do jednej sekcji:6

hermes setup                 # Full wizard
hermes setup model           # Provider and model only
hermes setup terminal        # Terminal backend only
hermes setup gateway         # Messaging platforms only
hermes setup tools           # Tool enable/disable per platform
hermes setup agent           # Agent behavior only
hermes setup --non-interactive
hermes setup --reset         # Reset config to defaults before setup

hermes logs — Ustrukturyzowane zapytania do logów

hermes logs jest bardziej zaawansowane niż tail -f dla plików logów, ponieważ jednocześnie obsługuje filtrowanie według poziomu, ID sesji i zakresu czasu.6

hermes logs                          # Last 50 lines of agent.log
hermes logs -f                       # Follow in real time
hermes logs gateway -n 100           # Last 100 lines of gateway.log
hermes logs --level WARNING --since 1h   # Warnings from the last hour
hermes logs --session abc123         # Filter by session ID substring
hermes logs errors --since 30m -f    # Follow errors.log from 30m ago
hermes logs list                     # List all log files with sizes

Pliki logów znajdują się w ~/.hermes/logs/:6 - agent.log — cała aktywność agenta (wywołania API, wysyłanie tools, cykl życia sesji, INFO+) - errors.log — tylko ostrzeżenia i błędy (filtrowany podzbiór agent.log) - gateway.log — aktywność messaging gateway (połączenia z platformami, wysyłanie, webhooki)

Rotacja odbywa się automatycznie za pomocą RotatingFileHandler z Python — należy szukać plików agent.log.1, agent.log.2 itd.6

hermes doctor — Diagnostyka

hermes doctor [--fix] to pierwsze polecenie, które warto uruchomić, gdy coś nie działa. Sprawdza poprawność konfiguracji, obecność zależności, dostępność kluczy API, stan usługi i może próbować automatycznych napraw przy użyciu --fix.6

Aby udostępnić diagnostykę innej osobie, należy użyć hermes dump — generuje ono zwięzłe podsumowanie w postaci zwykłego tekstu z zredagowanymi kluczami API, gotowe do wklejenia do zgłoszenia GitHub lub wątku na Discord.6


Polecenia slash

Polecenia slash działają w aktywnej sesji czatu (CLI lub na platformie komunikacyjnej). Są obsługiwane przez wspólny COMMAND_REGISTRY w hermes_cli/commands.py, dlatego większość poleceń działa identycznie we wszystkich interfejsach.9

Sterowanie sesją

Polecenie Opis
/new (alias /reset) Rozpocznij nową sesję
/clear Wyczyść ekran i rozpocznij nową sesję
/history Pokaż historię rozmowy
/save Zapisz bieżącą rozmowę
/retry Ponów ostatnią wiadomość
/undo Usuń ostatnią wymianę użytkownik/asystent
/title <name> Ustaw tytuł bieżącej sesji
/compress Ręcznie skompresuj kontekst rozmowy
/rollback [number] Wyświetl lub przywróć checkpointy systemu plików
/stop Zakończ wszystkie działające procesy w tle
/queue <prompt> Dodaj prompt do kolejki na następną turę. Pułapka: /q jest przypisane zarówno do /queue, jak i /quit; wygrywa ostatnia rejestracja, więc w praktyce /q oznacza /quit — zawsze należy wpisywać wyraźnie /queue.9
/resume [name] Wznów wcześniej nazwaną sesję
/statusbar (alias /sb) Przełącz pasek stanu kontekstu/modelu
/background <prompt> (alias /bg) Uruchom prompt w oddzielnej sesji w tle
/btw <question> Krótkie pytanie poboczne (bez narzędzi, nie jest zapisywane)
/plan [request] Załaduj dołączony skill plan, aby napisać plan zamiast wykonywać działania
/branch [name] (alias /fork) Utwórz gałąź bieżącej sesji
/goal <target> Skup agenta na celu, aby pozostawał przy zadaniu między turami. Wzorzec pętli Ralph jako podstawowy mechanizm. Konfigurowalny budżet tur. Nowość w v0.13.0.18
/subgoal <criterion> Dodaj kryteria sukcesu do aktywnego /goal bez ponownego uruchamiania pętli. Nowość w v0.14.0.19
/handoff <target> Przekaż aktywną sesję — wiadomości, wywołania narzędzi i kontekst — innemu modelowi, personie lub profilowi. Nowość w v0.14.0.19

Konfiguracja i model

Polecenie Opis
/config Pokaż bieżącą konfigurację
/model [model-name] Pokaż lub zmień bieżący model
/provider Pokaż dostępnych providerów i bieżącego providera
/personality [name] Ustaw nakładkę osobowości
/verbose Przełącz widok postępu narzędzi
/reasoning Zarządzaj nakładem rozumowania i jego wyświetlaniem. v0.19.0 dodaje poziomy nakładu max i ultra oraz sprawia, że /reasoning działa w zakresie sesji, wraz z nadpisaniami nakładu dla poszczególnych modeli i slotów MoA w konfiguracji25
/skin Pokaż lub zmień skórkę/motyw wyświetlania
/voice [on\|off\|tts\|status] Przełącz tryb głosowy CLI
/yolo Przełącz tryb YOLO (pomijanie monitów o zatwierdzenie). Od v0.19.0 zdefiniowane przez użytkownika reguły blokowania nadal zatrzymują pasujące polecenia, nawet w trybie YOLO25
/fast Przełącz Fast Mode — przetwarzanie priorytetowe dla modeli OpenAI i Anthropic (v0.9.0+)16
/debug Szybka diagnostyka na wszystkich platformach (v0.9.0+)16
/subscription Zarządzaj planem Nous Portal z terminala — planem i pozostałym limitem, podglądem kosztu podwyższenia/obniżenia planu oraz zastosowaniem z możliwością cofnięcia (v0.19.0+)25
/topup Dodaj środki do salda Nous Portal bez opuszczania terminala (v0.19.0+)25

Polecenie /model stanowi podstawowe narzędzie do przełączania providerów w trakcie sesji:9

/model                              # Show current model and options
/model claude-sonnet-4              # Switch model (auto-detect provider)
/model zai:glm-5                    # Switch provider:model
/model custom:qwen-2.5              # Use model on custom endpoint
/model custom                       # Auto-detect model from custom endpoint
/model custom:local:qwen-2.5        # Named custom provider
/model openrouter:anthropic/claude-sonnet-4   # Back to cloud

v0.19.0 dodaje /model --once — jednorazowe nadpisanie modelu na jedną turę, które po odpowiedzi automatycznie przywraca poprzedni model.25

Narzędzia, skills i informacje

Polecenie Opis
/tools [list\|disable\|enable] [name...] Zarządzaj narzędziami bieżącej sesji
/toolsets Wyświetl dostępne toolsety
/browser [connect\|disconnect\|status] Zarządzaj lokalnym połączeniem Chrome CDP
/skills Wyszukuj, instaluj, sprawdzaj lub zarządzaj skills
/cron Zarządzaj zaplanowanymi zadaniami
/reload-mcp Ponownie załaduj serwery MCP z config.yaml
/plugins Wyświetl zainstalowane pluginy
/help Pokaż wszystkie polecenia
/usage Pokaż wykorzystanie tokenów, koszt i czas trwania
/insights Pokaż analitykę użycia (ostatnie 30 dni)
/platforms Pokaż status platform komunikacyjnych
/profile Pokaż nazwę aktywnego profilu i katalog domowy

Dynamiczne polecenia slash dla skills

Każdy zainstalowany skill jest automatycznie udostępniany jako polecenie slash:9

/gif-search funny cats
/axolotl help me fine-tune Llama 3 on my dataset
/github-pr-workflow create a PR for the auth refactor
/excalidraw       # Just the skill name loads it and lets the agent ask what you need

Od v0.19.0 wywołania slash-skill można łączyć: /skill-a /skill-b do XYZ ładuje oba skills w kolejności w jednej turze, z autouzupełnianiem i tekstem podpowiedzi dla połączonych nazw.25

Można również zdefiniować szybkie polecenia w config.yaml, które przypisują krótką nazwę do dłuższego promptu:9

quick_commands:
  review: "Review my latest git diff and suggest improvements"
  deploy: "Run the deployment script at scripts/deploy.sh and verify the output"
  morning: "Check my calendar, unread emails, and summarize today's priorities"

Następnie należy wpisać /review, /deploy lub /morning w CLI.

Dopasowywanie prefiksów

Polecenia obsługują dopasowywanie prefiksów: wpisanie /h oznacza /help, a /mod oznacza /model. Gdy prefiks jest niejednoznaczny, wygrywa pierwsza rejestracja zgodnie z kolejnością w rejestrze. Pełne nazwy poleceń i zarejestrowane aliasy zawsze mają pierwszeństwo przed dopasowaniami prefiksów.9

Polecenia specyficzne dla komunikatorów

Niektóre polecenia działają wyłącznie na platformach komunikacyjnych (Telegram, Discord, Slack, WhatsApp, Signal, Email, Home Assistant):9

  • /status — pokaż informacje o sesji
  • /sethome (alias /set-home) — oznacz bieżący czat jako katalog domowy platformy
  • /approve [session|always] — zatwierdź oczekujące niebezpieczne polecenie
  • /deny [reason] — odrzuć oczekujące niebezpieczne polecenie. Od v0.19.0 /deny <reason> przekazuje agentowi powód odmowy, aby skorygował działanie zamiast bezmyślnie ponawiać próbę25
  • /update — zaktualizuj Hermes Agent do najnowszej wersji
  • /commands [page] — przeglądaj wszystkie polecenia i skills (stronicowane)

Niektóre są dostępne wyłącznie w CLI: /skin, /tools, /toolsets, /browser, /config, /cron, /skills, /platforms, /paste, /statusbar, /plugins.9

Narzędzia i zestawy narzędzi

Hermes oferuje szeroki wbudowany rejestr narzędzi obejmujący wyszukiwanie w sieci, automatyzację przeglądarki, wykonywanie poleceń w terminalu, edycję plików, pamięć, delegowanie, trenowanie RL, wysyłanie wiadomości, integrację z Home Assistant i nie tylko.10 Narzędzia są zorganizowane w logiczne toolsets, które można włączać lub wyłączać dla każdej platformy.

Kategorie wysokiego poziomu

Kategoria Przykłady Opis
Sieć web_search, web_extract Przeszukiwanie sieci i wyodrębnianie zawartości stron
Terminal i pliki terminal, process, read_file, patch Wykonywanie poleceń i manipulowanie plikami
Przeglądarka browser_navigate, browser_snapshot, browser_vision Interaktywna automatyzacja przeglądarki z użyciem tekstu i obrazu
Multimedia vision_analyze, video_analyze, video_generate, image_generate, text_to_speech Analiza i generowanie multimodalne. video_analyze jest przede wszystkim przeznaczone dla Gemini, z rozszerzalną obsługą zgodnych dostawców multimodalnych (v0.13.0+). Wersja v0.14.0 dodaje ujednolicone video_generate z wymienialnymi backendami dostawców oraz przesyła surowe piksele przez vision_analyze, gdy aktywny model obsługuje obraz.1819
Orkiestracja agentów todo, clarify, execute_code, delegate_task Planowanie, doprecyzowanie, wykonywanie kodu, delegowanie do podagentów
Sterowanie komputerem computer_use Sterowanie pulpitem przez backend cua-driver; v0.14.0 umożliwia to również dostawcom obsługującym obraz innym niż Anthropic.19
Pamięć i odtwarzanie memory, session_search Trwała pamięć + wyszukiwanie sesji
Automatyzacja i dostarczanie cronjob, send_message Zadania zaplanowane, wysyłanie wiadomości wychodzących
Integracje ha_*, narzędzia MCP, rl_* Home Assistant, MCP, trenowanie RL

Typowe nazwy toolset obejmują web, terminal, file, browser, vision, image_gen, moa, skills, tts, todo, memory, session_search, cronjob, code_execution, delegation, clarify, homeassistant i rl.10

Zarządzanie narzędziami

hermes chat --toolsets "web,terminal"       # Use specific toolsets
hermes tools                                # Interactive per-platform tool config
hermes tools --summary                      # Print enabled-tools summary

Narzędzia można także przełączać w trakcie sesji za pomocą /tools disable <name> i /tools enable <name>, co resetuje sesję, aby nowy zestaw narzędzi zaczął obowiązywać.9

Backendy terminala

Narzędzie terminala może wykonywać polecenia w sześciu różnych środowiskach:10

Backend Przypadek użycia
local Uruchamianie na własnym komputerze (domyślnie) — programowanie, zaufane zadania
docker Izolowane kontenery — bezpieczeństwo, powtarzalność
ssh Zdalny serwer — sandbox, oddzielenie agenta od własnego kodu
singularity Kontenery HPC — obliczenia klastrowe, bez uprawnień roota
modal Bezserwerowe wykonywanie w chmurze
daytona Chmurowy obszar roboczy sandbox — trwałe zdalne środowisko programistyczne

Backendy można przełączać za pomocą hermes config set terminal.backend <name> albo w config.yaml:

terminal:
  backend: docker      # or: local, ssh, singularity, modal, daytona
  cwd: "."             # Working directory
  timeout: 180         # Command timeout in seconds

Backend SSH (zalecany ze względów bezpieczeństwa — agent nie może modyfikować własnego kodu):10

terminal:
  backend: ssh
# In ~/.hermes/.env
TERMINAL_SSH_HOST=my-server.example.com
TERMINAL_SSH_USER=myuser
TERMINAL_SSH_KEY=~/.ssh/id_rsa

Backend Docker:

terminal:
  backend: docker
  docker_image: python:3.11-slim

Zasoby kontenera (dotyczy docker, singularity, modal, daytona):10

terminal:
  container_cpu: 1
  container_memory: 5120          # MB (default 5GB)
  container_disk: 51200           # MB (default 50GB)
  container_persistent: true      # Persist filesystem across sessions

Przy ustawieniu container_persistent: true zainstalowane pakiety, pliki i konfiguracja pozostają zachowane między sesjami.10

Wszystkie backendy kontenerów działają z utwardzonymi zabezpieczeniami: system plików roota tylko do odczytu (Docker), usunięte wszystkie możliwości Linux poza DAC_OVERRIDE, CHOWN i FOWNER, brak eskalacji uprawnień, limity PID (256 procesów), pełna izolacja przestrzeni nazw, trwały obszar roboczy przez woluminy.10

Procesy w tle

Narzędzie terminala obsługuje wykonywanie w tle z jawnym zarządzaniem procesami:10

terminal(command="pytest -v tests/", background=true)
# Returns: {"session_id": "proc_abc123", "pid": 12345}

process(action="list")                            # Show all running processes
process(action="poll", session_id="proc_abc123")  # Check status
process(action="wait", session_id="proc_abc123")  # Block until done
process(action="log", session_id="proc_abc123")   # Full output
process(action="kill", session_id="proc_abc123")  # Terminate
process(action="write", session_id="proc_abc123", data="y")  # Send input

Tryb PTY (pty=true) umożliwia korzystanie z interaktywnych narzędzi CLI, takich jak Codex i Claude Code.10

Sudo

Jeśli polecenie wymaga sudo, Hermes poprosi o hasło (zapamiętane w pamięci podręcznej na czas sesji). Można też ustawić SUDO_PASSWORD w ~/.hermes/.env.10


Kanban dla wielu agentów (v0.13.0+)

Wersja v0.13.0 czyni współpracę wielu agentów prymitywem pierwszej klasy: trwałą tablicą Kanban, która śledzi zadania, status i tożsamość workerów między agentami oraz po restartach.18 To właśnie tablica sprawia, że rój workerów Hermes rzeczywiście kończy pracę, zamiast zatrzymywać się na zerwanych przekazaniach.

Mechanizm Działanie
Heartbeats Każdy worker wysyła sygnał, gdy jest właścicielem zadania. Brak sygnału oznacza workera jako podejrzanego i zwalnia zadanie do ponownego przejęcia.
Reclaim Inny worker może przejąć porzucone zadanie, wraz z pełnym stanem zadania i wcześniejszym częściowym wynikiem.
Zombie detection Workery, które kończą działanie bez oznaczenia zadania jako ukończonego, są automatycznie blokowane przed przejmowaniem nowej pracy, co zapobiega gromadzeniu się martwych tożsamości w roju.
Hallucination gate Wynik, który nie przejdzie bramki, odsyła zadanie z powrotem na tablicę z podaną przyczyną zamiast oznaczać je jako ukończone.
max_retries dla każdego zadania Zastępuje domyślny budżet ponownych prób dla zadania, o którym wiadomo, że jest podatne na błędy.
Tablice wielu projektów Jeden katalog domowy Hermes może obsługiwać kilka niezależnych tablic.

Tablica Kanban naturalnie współpracuje z /goal (pętlą Ralph z zablokowanym celem) po stronie celu oraz z istniejącym narzędziem delegate_task dla semantyki uruchamiania. Rezultatem jest wzorzec roju, w którym każdy agent współdzieli jedno źródło prawdy o tym, co zrobić dalej, kto się tym zajmuje i co utknęło.

Czym jest rój Hermes?

Rój to kilka workerów Hermes działających równolegle względem jednej współdzielonej tablicy Kanban. Nie jest to osobny podsystem, który należy włączyć — to właśnie tablica go umożliwia. Tablica zapewnia jedną rzecz, której równoległe agenty nie potrafią zapewnić samodzielnie: pojedynczą autorytatywną odpowiedź na pytanie: co należy przejąć jako następne i czy ktoś już nad tym pracuje?

Wersja v0.15.0 podniosła ten wzorzec do rangi wspieranej topologii, dodając topologię roju do koordynacji równoległych workerów, automatyczną dekompozycję celu wysokiego poziomu na podzadania, nadpisywanie modelu dla każdego zadania, zadania zaplanowane oraz zarządzanie worktree, aby równolegli workerzy nie kolidowali w tym samym checkout.28

Problem w naiwnym środowisku wielu agentów Co zamiast tego robi tablica
Dwóch workerów pobiera to samo zadanie Własność zadania jest przejmowana, a tożsamość workera zostaje zapisana
Worker kończy działanie w połowie zadania, a praca znika Heartbeat wygasa, zadanie zostaje przejęte wraz z wcześniejszym częściowym wynikiem
Awaryjnie zakończony worker stale „trzyma” zadania Zombie detection blokuje mu przejmowanie nowej pracy
Jeden kosztowny model dla każdego podzadania Nadpisywanie modelu dla każdego zadania — tańsze modele do mechanicznych podzadań
Równolegli workerzy edytują te same pliki Zarządzanie worktree izoluje checkout każdego workera

Praktyczny schemat jest taki: należy przekazać rojowi cel, pozwolić automatycznej dekompozycji podzielić go na zadania na tablicy, a następnie pozwolić workerom je przejmować, wykonywać i zwracać wyniki. Budżet ponownych prób jest ustalany dla każdego zadania (max_retries), więc jedno podatne na błędy podzadanie nie zużywa tolerancji całego uruchomienia. Ponieważ tablica jest trwała, rój przetrwa restarty — workery ponownie się dołączają i wznawiają działanie względem tego samego stanu.

Rój jest tylko tak dobry, jak jego dekompozycja. Tablica koordynuje workery; nie zamienia źle podzielonego celu w dobrze podzielony. Zadania współdzielące ukryty stan nadal będą ze sobą kolidować, niezależnie od worktree.

System skills

Skills to dokumenty wiedzy ładowane na żądanie, które agent może wczytać w razie potrzeby. Stosują wzorzec stopniowego ujawniania, aby minimalizować użycie tokenów, i są zgodne z otwartym standardem agentskills.io.11

Wszystkie skills znajdują się w ~/.hermes/skills/ — to główny katalog i źródło prawdy. Przy świeżej instalacji do tego miejsca kopiowane są dołączone skills z repozytorium. Trafiają tu również skills instalowane z Hub oraz tworzone przez agenta.11

Stopniowe ujawnianie

Level 0: skills_list()            [{name, description, category}, ...]   (~3k tokens)
Level 1: skill_view(name)         Full content + metadata                 (varies)
Level 2: skill_view(name, path)   Specific reference file                 (varies)

Agent wczytuje pełną zawartość skill dopiero wtedy, gdy rzeczywiście jej potrzebuje.11

Format SKILL.md

---
name: my-skill
description: Brief description of what this skill does
version: 1.0.0
platforms: [macos, linux]      # Optional — restrict to OS platforms
metadata:
  hermes:
    tags: [python, automation]
    category: devops
    fallback_for_toolsets: [web]     # Conditional activation
    requires_toolsets: [terminal]    # Conditional activation
    config:                          # Config.yaml settings
      - key: my.setting
        description: "What this controls"
        default: "value"
        prompt: "Prompt for setup"
---

# Skill Title

## When to Use
Trigger conditions for this skill.

## Procedure
1. Step one
2. Step two

## Pitfalls
- Known failure modes and fixes

## Verification
How to confirm it worked.

Aktywacja warunkowa

Skills mogą pokazywać się lub ukrywać w zależności od dostępnych narzędzi. Jest to najbardziej przydatne w przypadku fallback skills — bezpłatnych lub lokalnych alternatyw, które powinny pojawiać się tylko wtedy, gdy narzędzie premium jest niedostępne:11

Pole Działanie
fallback_for_toolsets Skill jest ukryty, gdy wymienione toolsets są dostępne
fallback_for_tools To samo, lecz sprawdzane są pojedyncze narzędzia
requires_toolsets Skill jest ukryty, gdy wymienione toolsets są niedostępne
requires_tools To samo, lecz sprawdzane są pojedyncze narzędzia

Przykład: wbudowany skill duckduckgo-search używa fallback_for_toolsets: [web]. Gdy ustawiono FIRECRAWL_API_KEY, toolset web jest dostępny i agent używa web_search — skill DuckDuckGo pozostaje ukryty. Bez klucza API skill DuckDuckGo automatycznie pojawia się jako rozwiązanie zapasowe.11

Skills zarządzane przez agenta

Agent może tworzyć, aktualizować i usuwać własne skills za pomocą narzędzia skill_manage. To pamięć proceduralna agenta — gdy odkryje nietrywialny przepływ pracy, zapisuje to podejście jako skill do ponownego wykorzystania w przyszłości.11

Kiedy agent tworzy skills:11 - Po pomyślnym ukończeniu złożonego zadania (ponad 5 wywołań narzędzi) - Gdy napotkał błędy lub ślepe zaułki i znalazł działającą ścieżkę - Gdy użytkownik skorygował jego podejście - Gdy odkrył nietrywialny przepływ pracy

Działania:11

Działanie Zastosowanie
create Nowy skill tworzony od podstaw
patch Ukierunkowane poprawki (zalecane — najbardziej oszczędne pod względem tokenów)
edit Znaczące przebudowy strukturalne
delete Całkowite usunięcie skill
write_file Dodawanie/aktualizowanie plików pomocniczych
remove_file Usuwanie pliku pomocniczego

Hub skills

Przeglądanie, wyszukiwanie, instalowanie i zarządzanie skills z rejestrów online:611

hermes skills browse                          # Browse all hub skills
hermes skills browse --source official        # Browse official optional skills
hermes skills search kubernetes               # Search all sources
hermes skills search react --source skills-sh # Search skills.sh directory
hermes skills inspect openai/skills/k8s       # Preview before installing
hermes skills install openai/skills/k8s       # Install with security scan
hermes skills install skills-sh/anthropics/skills/pdf --force
hermes skills check                           # Check for upstream updates
hermes skills update                          # Reinstall changed hub skills
hermes skills audit                           # Re-scan installed hub skills
hermes skills uninstall k8s
hermes skills publish skills/my-skill --to github --repo owner/repo
hermes skills tap add myorg/skills-repo       # Add custom GitHub source

Zintegrowane źródła Hub:11

Źródło Przykład Uwagi
official official/security/1password Opcjonalne skills dostarczane z Hermes (wbudowane zaufanie)
skills-sh skills-sh/vercel-labs/agent-skills/vercel-react-best-practices Publiczny katalog skills Vercel
well-known well-known:https://mintlify.com/docs/.well-known/skills/mintlify Wykrywanie oparte na URL z witryn publikujących /.well-known/skills/index.json
github openai/skills/k8s Bezpośrednia instalacja repozytorium/ścieżki GitHub
clawhub Zewnętrzny marketplace skills
lobehub Konwersja katalogu agentów LobeHub
browse-sh Źródło skills Browserbase

Domyślne źródła GitHub (możliwe do przeglądania bez konfiguracji): openai/skills, anthropics/skills, huggingface/skills, NVIDIA/skills, garrytan/gstack. Źródło claude-marketplace zostało usunięte w wersji v0.20.0; na liście źródeł zastąpiło je browse-sh.1124

Skanowanie bezpieczeństwa

Wszystkie skills instalowane z Hub przechodzą przez skaner bezpieczeństwa, który sprawdza eksfiltrację danych, prompt injection, destrukcyjne polecenia, sygnały dotyczące łańcucha dostaw oraz inne zagrożenia.11

Poziomy zaufania:11

Poziom Źródło Zasady
builtin Dostarczany z Hermes Zawsze zaufany
official optional-skills/ w repozytorium Wbudowane zaufanie, bez ostrzeżenia o źródle zewnętrznym
trusted Zaufane rejestry (openai/skills, anthropics/skills) Bardziej liberalne zasady
community Wszystko inne Niedangerous ustalenia można nadpisać za pomocą --force; werdykty dangerous pozostają zablokowane

--force może nadpisać niedangerous blokady zasad dla skills społecznościowych. Nie nadpisuje werdyktu skanowania dangerous.11

Zewnętrzne katalogi skills

Można wskazać Hermes dodatkowe katalogi skills skanowane wraz z katalogiem lokalnym:11

skills:
  external_dirs:
    - ~/.agents/skills
    - /home/shared/team-skills
    - ${SKILLS_REPO}/skills

Ścieżki obsługują rozwijanie ~ oraz podstawianie zmiennych środowiskowych ${VAR}. Zewnętrzne katalogi są tylko do odczytu — gdy agent tworzy lub edytuje skill, zawsze zapisuje go w ~/.hermes/skills/. W przypadku skill o tej samej nazwie w obu miejscach pierwszeństwo ma wersja lokalna.11


Trwała pamięć

Hermes ma ograniczoną, starannie dobraną pamięć, która jest zachowywana między sesjami. Na pamięć agenta składają się dwa pliki przechowywane w ~/.hermes/memories/:12

Plik Przeznaczenie Limit znaków
MEMORY.md Osobiste notatki agenta — informacje o środowisku, konwencje, zdobyta wiedza 2 200 znaków (~800 tokenów)
USER.md Profil użytkownika — preferencje, styl komunikacji, oczekiwania 1 375 znaków (~500 tokenów)

Oba pliki są wstrzykiwane do system prompt jako zamrożony snapshot na początku sesji. Agent zarządza własną pamięcią za pomocą narzędzia memoryadd, replace lub remove.12

Wzorzec zamrożonego snapshotu: zawartość wstrzykiwana do system prompt jest przechwytywana jednorazowo na początku sesji i nie zmienia się w jej trakcie. Jest to celowe — pozwala zachować cache prefiksu LLM dla wydajności. Zmiany wprowadzone podczas sesji są natychmiast zapisywane na dysku, lecz nie pojawiają się w system prompt aż do kolejnej sesji.12

Co zapisywać

Należy zapisywać następujące informacje (agent robi to proaktywnie):12 - Preferencje użytkownika: „Preferuję TypeScript zamiast JavaScript” → user - Informacje o środowisku: „Ten serwer działa na Debianie 12 z PostgreSQL 16” → memory - Korekty: „Nie używaj sudo do poleceń Docker, użytkownik należy do grupy docker” → memory - Konwencje: „Projekt używa tabulatorów, szerokości linii 120 znaków i docstringów w stylu Google” → memory - Ukończona praca: „Baza danych została zmigrowana z MySQL do PostgreSQL 2026-01-15” → memory

Należy pominąć:12 - Błahe lub oczywiste informacje - Fakty, które można łatwo ustalić ponownie - Surowe zrzuty danych (są zbyt duże dla pamięci) - Efemeryczne informacje dotyczące wyłącznie sesji - Informacje, które znajdują się już w plikach kontekstowych

Wyszukiwanie sesji

Poza MEMORY.md i USER.md agent może przeszukiwać swoje wcześniejsze rozmowy za pomocą narzędzia session_search. Wszystkie sesje CLI i sesje komunikatorów są przechowywane w SQLite (~/.hermes/state.db) z pełnotekstowym wyszukiwaniem FTS5. Zapytania zwracają odpowiednie wcześniejsze rozmowy wraz z podsumowaniem Gemini Flash.12

Funkcja Trwała pamięć Wyszukiwanie sesji
Pojemność Łącznie ~1 300 tokenów Nieograniczona (wszystkie sesje)
Szybkość Natychmiastowa (w system prompt) Wymaga wyszukiwania + podsumowania LLM
Zastosowanie Kluczowe fakty zawsze dostępne Znajdowanie konkretnych wcześniejszych rozmów
Zarządzanie Ręcznie kuratorowane przez agenta Automatyczne — przechowywane są wszystkie sesje
Koszt tokenów Stały na sesję (~1 300 tokenów) Na żądanie

Zewnętrzni dostawcy pamięci

Dla głębszej trwałej pamięci wykraczającej poza MEMORY.md i USER.md, Hermes zawiera osiem wtyczek zewnętrznych dostawców pamięci: Honcho, OpenViking, Mem0, Hindsight, Holographic, RetainDB, ByteRover i Supermemory.12

Zewnętrzni dostawcy działają równolegle z wbudowaną pamięcią (nigdy jej nie zastępują) i dodają możliwości takie jak grafy wiedzy, wyszukiwanie semantyczne, automatyczne wyodrębnianie faktów oraz modelowanie użytkownika między sesjami:612

hermes memory setup         # Pick a provider and configure it
hermes memory status        # Check what's active
hermes memory off           # Disable external provider (built-in only)

W danym momencie może być aktywny tylko jeden zewnętrzny dostawca. Wbudowana pamięć jest zawsze aktywna.6

Automatyczne wznawianie sesji (v0.13.0+)

v0.13.0 sprawia, że przerwania w trakcie działania agenta można przetrwać. Po restarcie gateway automatycznie wznawia przerwane sesje; restarty /update zachowują stan sesji podczas aktualizacji; przeładowania plików źródłowych w trakcie programowania utrzymują aktywną sesję zamiast wymuszać utworzenie nowej.18 W praktyce oznacza to, że długotrwała praca gateway i zadania uruchamiane przez cron nie resetują już okna kontekstowego po restarcie procesu.

Checkpointy v2 (v0.13.0+)

W v0.13.0 trwałość stanu została przepisana jako projekt pojedynczego magazynu z rzeczywistym usuwaniem niepotrzebnych danych, zabezpieczeniami dysku i bez osieroconych repozytoriów cieni.18 Poprzedni system checkpointów gromadził stan na dysku w profilach działających przez długi czas; magazyn v2 wprowadza twardy limit lokalnej przestrzeni na checkpointy i usuwa zduplikowane księgowanie, które powodowało ten wzrost. Nie jest wymagana żadna zmiana konfiguracji widoczna dla użytkownika; następny zapis checkpointu użyje ścieżki v2.


Osobowość i SOUL.md

SOUL.md stanowi podstawową tożsamość instancji Hermes. Zajmuje pozycję nr 1 w system prompt, zastępując zakodowaną na stałe domyślną tożsamość.13

Hermes automatycznie tworzy domyślny SOUL.md w ~/.hermes/SOUL.md (lub $HERMES_HOME/SOUL.md dla niestandardowych profili). Istniejące pliki użytkownika nigdy nie są nadpisywane. Hermes ładuje SOUL.md wyłącznie z HERMES_HOME — nie szuka go w bieżącym katalogu roboczym. Dzięki temu osobowość jest przewidywalna we wszystkich projektach.13

Co należy umieścić w SOUL.md

Należy używać go do trwałych wskazówek dotyczących głosu i osobowości:13 - ton - styl komunikacji - poziom bezpośredniości - domyślny styl interakcji - elementy, których należy unikać stylistycznie - sposób, w jaki Hermes powinien radzić sobie z niepewnością, niezgodą i niejednoznacznością

Rzadziej należy używać go do:13 - jednorazowych instrukcji projektowych - ścieżek plików - konwencji repozytorium - tymczasowych szczegółów przepływu pracy

Te informacje należą do AGENTS.md, a nie do SOUL.md.

SOUL.md a AGENTS.md

To najważniejsze rozróżnienie w zarządzaniu tożsamością Hermes:13

SOUL.md — tożsamość, ton, styl, domyślne zasady komunikacji, zachowanie na poziomie osobowości.

AGENTS.md — architektura projektu, konwencje programistyczne, preferencje narzędzi, przepływy pracy specyficzne dla repozytorium, polecenia, porty, ścieżki, uwagi dotyczące wdrożenia.

Przydatna zasada: jeśli dana informacja powinna towarzyszyć użytkownikowi wszędzie, należy umieścić ją w SOUL.md. Jeśli dotyczy projektu, należy umieścić ją w AGENTS.md.13

Wbudowane osobowości

Hermes zawiera wbudowane osobowości, na które można przełączyć się za pomocą /personality:13

Nazwa Opis
helpful Przyjazny asystent ogólnego przeznaczenia
concise Krótkie, rzeczowe odpowiedzi
technical Szczegółowy, precyzyjny ekspert techniczny
creative Innowacyjne myślenie nieszablonowe
teacher Cierpliwy nauczyciel z jasnymi przykładami
kawaii Urocze wyrażenia, iskierki, entuzjazm
catgirl Neko-chan z kocimi wyrażeniami
pirate Kapitan Hermes, obeznany z technologią korsarz
shakespeare Bardowska proza z dramatycznym rozmachem
surfer Wyluzowany klimat ziomka
noir Narracja w stylu twardego kryminału
uwu Maksymalna słodycz ze stylem uwu
philosopher Głęboka kontemplacja każdego zapytania
hype MAKSYMALNA ENERGIA

Niestandardowe osobowości w config.yaml:13

agent:
  personalities:
    codereviewer: >
      You are a meticulous code reviewer. Identify bugs, security issues,
      performance concerns, and unclear design choices. Be precise and constructive.

Następnie należy przełączyć się za pomocą /personality codereviewer.

SOUL.md a /personality

SOUL.md określa podstawowy głos. /personality to nakładka na poziomie sesji.13 Warto zachować pragmatyczny domyślny SOUL.md, a następnie użyć /personality teacher podczas rozmowy dydaktycznej lub /personality creative do burzy mózgów.


Nous Tool Gateway (v0.10.0+)

Od Hermes Agent v0.10.0 (16 kwietnia 2026 r.) płatni subskrybenci Nous Portal otrzymują zarządzany dostęp do wyselekcjonowanego zestawu narzędzi za pośrednictwem swoich dotychczasowych danych uwierzytelniających Portal — bez dodatkowych kluczy API do zarządzania.30 Sam CLI Hermes pozostaje objęty licencją MIT i w pełni open source. Zmieniło się to, że uwierzytelnianie w Portal odblokowuje teraz więcej niż tylko inferencję modeli.

Co obejmuje gateway

Narzędzie Dostawca Przypadek użycia
Wyszukiwanie w sieci Firecrawl Pobieranie informacji dla agentów potrzebujących aktualnych danych
Generowanie obrazów FAL / FLUX 2 Pro Generowanie obrazów bezpośrednio bez konfigurowania klucza FAL
Synteza mowy OpenAI TTS Mówione odpowiedzi w messaging gateways
Automatyzacja przeglądarki Browser Use Bezgłowa nawigacja i scrapowanie

Jak to działa

Gateway jest włączany opcjonalnie dla każdego narzędzia za pomocą nowego pola konfiguracji use_gateway. Jeśli dane uwierzytelniające Portal znajdują się w hermes auth i gateway jest włączony dla narzędzia, wywołania tego narzędzia są kierowane przez Portal. W przeciwnym razie używany jest bezpośredni klucz API (jeśli jest dostępny).

# config.yaml — per-tool gateway opt-in
tools:
  web_search:
    provider: firecrawl
    use_gateway: true          # route via Nous Portal subscription
  image_generation:
    provider: fal
    use_gateway: true

Pierwszeństwo w czasie wykonywania: gdy gateway jest dostępny i narzędzie ma ustawienie use_gateway: true, Hermes preferuje gateway, nawet jeśli skonfigurowano również bezpośredni klucz API. Ma to znaczenie dla rozliczeń — wywołania gateway wykorzystują subskrypcję Portal, a nie saldo bezpośredniego klucza API.

Włączanie gateway

hermes model                      # select Nous Portal (OAuth flow)
hermes tools                      # per-platform tool picker integrates gateway tools
hermes status                     # confirms gateway/subscription detection

Subskrypcja jest wykrywana automatycznie na podstawie danych uwierzytelniających Portal OAuth, które już znajdują się w hermes auth — nie ma osobnego kroku logowania. Od wersji v0.19.0 można także zarządzać samą subskrypcją w sesji: /subscription pokazuje plan i pozostały limit, precyzyjnie wskazuje koszt uaktualnienia lub moment wejścia w życie obniżenia planu oraz stosuje zmianę z banerami zaplanowanej zmiany i możliwością cofnięcia; /topup dodaje środki. Aplikacja desktopowa ma odpowiadającą temu kartę ustawień rozliczeń.25

Cennik i dostęp

Cennik oraz nazwy poziomów są publikowane na stronie cenowej Nous Portal (https://portal.nousresearch.com/pricing). Ten przewodnik nie wymienia poziomów, ponieważ należą one do produktu Portal, a nie do CLI Hermes, i zmieniają się niezależnie od wydań Hermes. Rejestracja jest dostępna pod adresem https://portal.nousresearch.com/; aktualne poziomy można sprawdzić na stronie cenowej.

Informacja o wycofaniu

  • Zmienna środowiskowa HERMES_ENABLE_NOUS_MANAGED_TOOLS została usunięta w v0.10.0. Narzędzia zarządzane są teraz włączane za pomocą pola konfiguracji use_gateway dla danego narzędzia i zależą od stanu subskrypcji Portal.30

Ujęcie: czym to wydanie nie jest

CLI Hermes Agent nie jest zablokowany za subskrypcją. Projekt nadal jest objęty licencją MIT, a wszystkie kluczowe funkcje (CLI, skills, pamięć, messaging gateway, cron, MCP, lokalny dashboard, BYOK dla każdego dostawcy) działają kompleksowo bez płacenia komukolwiek. v0.10.0 dodaje wygodną ścieżkę dla użytkowników, którzy już płacą za Nous Portal — nie usuwa niczego z bezpłatnej ścieżki.


Messaging Gateway

Hermes może działać jako długotrwały proces gateway, który z jednego procesu gateway łączy się z 28 platformami komunikacyjnymi: Telegram, Discord, Slack, WhatsApp, Signal, SMS, Email, Home Assistant, Mattermost, Matrix, DingTalk, Feishu/Lark, WeCom, Weixin (WeChat), BlueBubbles (iMessage), QQBot, Microsoft Teams, Tencent Yuanbao, Google Chat, LINE, SimpleX Chat oraz uniwersalnym adapterem Webhook.329171819 v0.9.0 dodał iMessage przez BlueBubbles (automatyczna rejestracja webhooka, kreator konfiguracji, odporność na awarie) oraz natywną obsługę WeChat przez iLink Bot API z trybem callback WeCom dla aplikacji korporacyjnych.16 v0.11.0 dodał QQBot.29 v0.12.0 dodał Microsoft Teams i Tencent Yuanbao.17 v0.13.0 dodał Google Chat jako 20. platformę, korzystając z tej samej architektury wtykowych adapterów; IRC i Microsoft Teams zostały także przeniesione na nowy wzorzec adapterów z ogólnymi hookami pluginów env_enablement_fn / cron_deliver_env_var.18 v0.14.0 dodaje LINE i SimpleX Chat oraz kompleksowo uzupełnia stos Microsoft Teams o uwierzytelnianie Graph, nasłuchiwanie webhooków, środowisko wykonawcze pipeline i dostarczanie wychodzące.19 v0.17.0 (19 czerwca 2026 r.) dodaje iMessage bez relay przez Photon Spectrum (kod urządzenia OAuth z hermes photon login — bez wymaganego relay Mac/BlueBubbles), oficjalny adapter WhatsApp Business Cloud API (zastępujący wymaganie procesu bridge), grupy SimpleX i natywne załączniki oraz Raft jako dołączony plugin platformy.21

Konfiguracja

hermes gateway setup                # Interactive platform configuration
hermes gateway install              # Install as user service (systemd/launchd)
hermes gateway start                # Start the installed service
hermes gateway stop
hermes gateway restart
hermes gateway status
hermes gateway run                  # Run in foreground (debugging)

Interaktywna konfiguracja prowadzi przez łączenie każdej platformy: tokeny API, identyfikatory botów, mapowania kanałów, listy dozwolonych użytkowników.6

Przepływ wiadomości

Z dokumentacji architektury upstream:3

Platform event → Adapter.on_message() → MessageEvent
  → GatewayRunner._handle_message()
    → authorize user
    → resolve session key
    → create AIAgent with session history
    → AIAgent.run_conversation()
    → deliver response back through adapter

Każda platforma komunikacyjna działa w tej samej pętli rozmowy AIAgent co CLI. Dlatego polecenia slash działają w obu miejscach identycznie, a zadanie cron zaplanowane w Telegram może dostarczyć wynik do Discord — różnica między platformami występuje wyłącznie na obrzeżu.3

v0.19.0 dodaje routing wiadomości oparty na profilach oraz trwałe dostarczanie. Pojedynczy multipleksowany gateway współdzielący jeden token bota może kierować określone guilds, kanały lub wątki do różnych profili — każdy z całkowicie odizolowaną konfiguracją, skills, pamięcią i sekretami — za pomocą nadpisania GATEWAY_MULTIPLEX_PROFILES; fala utwardzania sprawia też, że jeden błędnie skonfigurowany profil nie może już unieruchomić całego gateway. W warstwie wewnętrznej indeks routingu został przeniesiony do state.db (sessions.json jest teraz opcjonalnym starszym mirrorem), a końcowe odpowiedzi są rejestrowane w trwałym rejestrze obowiązków dostarczenia wokół wysyłki platformowej — ukończona odpowiedź, którą przerwie awaria gateway, zostanie dostarczona ponownie przy następnym uruchomieniu zamiast zostać po cichu utracona.25

Autoryzacja użytkowników i parowanie

hermes pairing list                    # Show pending and approved users
hermes pairing approve <platform> <code>
hermes pairing revoke <platform> <user-id>
hermes pairing clear-pending

Kody parowania zapobiegają komunikowaniu się przypadkowych osób z gateway. Użytkownik wysyła kod parowania z platformy komunikacyjnej; należy go zatwierdzić za pomocą hermes pairing approve; od tego momentu użytkownik jest autoryzowany.6


Zaplanowane zadania (Cron)

Hermes ma system cron jako funkcję pierwszej klasy, w którym zadania są zadaniami agenta, a nie poleceniami powłoki. Każde zaplanowane zadanie działa przez nowy AIAgent ze skonfigurowanym promptem, opcjonalnie dołączonymi skills, i dostarcza wyniki na dowolną platformę:36

hermes cron list
hermes cron create --prompt "Check HN for AI news and summarize" --schedule "0 9 * * *" --deliver telegram
hermes cron edit <id>
hermes cron pause <id>
hermes cron resume <id>
hermes cron run <id>         # Trigger now on the next tick
hermes cron remove <id>
hermes cron status           # Check if scheduler is running
hermes cron tick             # Run due jobs once and exit

Można też utworzyć zadanie konwersacyjnie w czacie komunikatora:

Every morning at 9am, check Hacker News for AI news and send me a summary on Telegram.

Agent skonfiguruje zadanie cron za pomocą swoich narzędzi. Zadania są przechowywane w JSON i przetrwają restarty.3


Integracja MCP

Hermes obsługuje Model Context Protocol zarówno jako klient, jak i serwer:6

Jako klient — połącz Hermes z zewnętrznymi serwerami MCP, aby rozszerzyć jego powierzchnię narzędzi:

hermes mcp add <name> --url https://example.com/mcp
hermes mcp add <name> --command npx --args "-y,@modelcontextprotocol/server-github"
hermes mcp list
hermes mcp test <name>
hermes mcp remove <name>
hermes mcp configure <name>   # Toggle individual tool selection

Lub ręcznie w config.yaml:14

mcp_servers:
  github:
    command: npx
    args: ["-y", "@modelcontextprotocol/server-github"]
    env:
      GITHUB_PERSONAL_ACCESS_TOKEN: "ghp_xxx"

Od v0.19.0 narzędzia MCP są udostępniane modelowi zgodnie z konwencją nazewnictwa mcp__server__tool — każda nazwa narzędzia zawiera nazwę serwera, dzięki czemu dwa serwery udostępniające to samo narzędzie nie kolidują już ze sobą — a powiadomienia z logów serwera MCP są wyświetlane w agent.log.25

Jako serwer — udostępnij rozmowy Hermes innym agentom:

hermes mcp serve
hermes mcp serve -v    # Verbose

Kompresja kontekstu

Hermes automatycznie kompresuje długie rozmowy, aby mieściły się w oknie kontekstu modelu. Podsumowujący proces kompresji to osobne wywołanie LLM — można skierować je do dowolnego providera lub endpointu.4

compression:
  enabled: true
  threshold: 0.50                           # Compress at this % of context limit
  target_ratio: 0.20                        # Fraction to preserve as recent tail
  protect_last_n: 20                        # Min recent messages to keep uncompressed
  summary_model: "google/gemini-3-flash-preview"
  summary_provider: "auto"                  # "auto", "openrouter", "nous", "codex", "main", etc.
  summary_base_url: null                    # Custom OpenAI-compatible endpoint

Opcje providera:4

summary_provider summary_base_url Rezultat
auto (domyślnie) nie ustawiono Automatycznie wykrywa najlepszy dostępny provider
nous / openrouter / itd. nie ustawiono Wymusza tego providera i używa jego uwierzytelniania
dowolny ustawiono Używa bezpośrednio niestandardowego endpointu (provider jest ignorowany)

summary_model musi obsługiwać długość kontekstu co najmniej tak dużą jak główny model, ponieważ do kompresji otrzymuje całą środkową część rozmowy.4

Ostrzeżenia o presji budżetowej

Gdy agent pracuje nad złożonym zadaniem z wieloma wywołaniami narzędzi, może zużyć budżet iteracji (domyślnie: 500 tur od v0.20.0, wcześniej 90), nie zdając sobie z tego sprawy. Presja budżetowa automatycznie ostrzega model:4

Próg Poziom Co widzi model
70% Ostrożność [BUDGET: 350/500. 150 iterations left. Start consolidating.]
90% Ostrzeżenie [BUDGET WARNING: 450/500. Only 50 left. Respond NOW.]

Limity czasu strumienia

Połączenie strumieniowe LLM ma dwie warstwy limitów czasu, które automatycznie dostosowują się do lokalnych providerów (localhost, adresy IP LAN):4

Limit czasu Domyślnie Lokalni providerzy Zmienna środowiskowa
Limit odczytu gniazda 120 s Automatycznie zwiększany do 1800 s HERMES_STREAM_READ_TIMEOUT
Wykrywanie nieaktywnego strumienia 180 s Automatycznie wyłączane HERMES_STREAM_STALE_TIMEOUT
Wywołanie API (bez strumieniowania) 1800 s Bez zmian HERMES_API_TIMEOUT

Limit odczytu gniazda jest zwiększany do 30 minut dla lokalnych endpointów, ponieważ lokalne LLM mogą potrzebować kilku minut na prefill dużych kontekstów, zanim wygenerują pierwszy token.4


Lokalny panel webowy (v0.9.0+)

Panel działający w przeglądarce do lokalnego zarządzania Hermes Agent. Umożliwia konfigurację ustawień, monitorowanie sesji, przeglądanie skills oraz zarządzanie gateway bez dotykania plików konfiguracyjnych ani terminala.16 Uruchom go za pomocą hermes dashboard. To najprostsza ścieżka wdrożenia dla nowych użytkowników preferujących GUI.

Monitorowanie procesów w tle (v0.9.0+)

watch_patterns pozwala ustawić wzorce monitorowane w danych wyjściowych procesów w tle i otrzymywać powiadomienia w czasie rzeczywistym, gdy zostaną dopasowane.16 Można monitorować błędy, oczekiwać na określone zdarzenia („listening on port”) lub obserwować logi kompilacji — bez odpytywania. W połączeniu z notify_on_complete z v0.8.0 (które powiadamia o zakończeniu zadania w tle) Hermes oferuje teraz pełną warstwę obserwowalności procesów w tle.15

Wymienny context engine (v0.9.0+)

Zarządzanie kontekstem jest teraz wymiennym slotem dostępnym przez hermes plugins. Można podłączać własne context engines, które kontrolują, co agent widzi w każdej turze — filtrowanie, podsumowywanie lub wstrzykiwanie kontekstu specyficznego dla domeny.16 Oddziela to strategię kontekstową od głównej pętli agenta, umożliwiając dostosowanie kontekstu dla każdego projektu lub domeny.

Kopia zapasowa i przywracanie (v0.9.0+)

hermes backup tworzy pełne archiwum konfiguracji, sesji, skills i pamięci. hermes import przywraca dane z archiwum kopii zapasowej.16 Można użyć tego do migracji między urządzeniami, tworzenia migawek przed większymi zmianami lub udostępniania współpracownikom sprawdzonej konfiguracji.

Obsługa Termux / Android (v0.9.0+)

Hermes działa natywnie na Androidzie przez Termux. Dostosowane ścieżki instalacji, optymalizacje TUI dla ekranów mobilnych, obsługa backendu głosowego oraz polecenie /image działają bezpośrednio na urządzeniu.16

Wzmacnianie zabezpieczeń (v0.13.0+)

Wersja v0.13.0 zamknęła 8 problemów bezpieczeństwa P0 i zmieniła jedno ustawienie domyślne na korzyść użytkownika.18 Wersja v0.14.0 zawiera kolejne 12 zamkniętych problemów P0 i 50 P1, w tym wzmocnienia ochrony przed brute force sudo / sudo-stdin, poprawki obejść niebezpiecznych poleceń, sanitizację błędów narzędzi przed ponownym wstrzyknięciem do modelu, uwierzytelnianie pluginów panelu API, ochronę skills-hub przed SSRF oraz skanowanie alertów łańcucha dostaw podczas instalacji.19

Poprawka Co się zmieniło
Domyślnie włączone maskowanie sekretów Wcześniej było opcjonalne. Logi i przesyłane dane hermes debug share maskują sekrety, chyba że zostanie to wyraźnie wyłączone. W v0.12.0 maskowanie było domyślnie wyłączone po zgłoszeniach o uszkodzeniu payloadów; v0.13.0 ponownie je włącza jako bezpieczniejszą wartość bazową.
Obejście DM między guildami Discord (CVSS 8.1) Listy dozwolonych ról Discord są teraz ograniczone do guild, co zamyka ścieżkę, w której rola użytkownika w jednej guild autoryzowała DM we wszystkich pozostałych.
Domyślne ograniczenia WhatsApp Adapter WhatsApp domyślnie odrzuca nieznajomych i nigdy nie odpowiada w self-chat.
Okno TOCTOU MCP OAuth Zamknięto warunek wyścigu podczas zapisywania poświadczeń w przepływach MCP OAuth.
TOCTOU auth.json CLI Zamknięto analogiczne okno TOCTOU w module zapisującym poświadczenia dla magazynu uwierzytelniania CLI.
Podstawowy poziom ochrony Browser SSRF Hybrydowe routowanie wymusza podstawową ochronę przed SSRF metadanych chmurowych dla żądań próbujących dotrzeć do 169.254.169.254 i odpowiedników.
Skanowanie prompt injection dla cron Złożone prompty (w tym załadowana treść skill) są skanowane pod kątem prompt injection przed uruchomieniem zadania cron.
Maskowanie w hermes debug share Przesyłane dane debug share maskują treść logów podczas wysyłania, a nie tylko w chwili zapisu.

Jeśli utrzymuje Pan/Pani wdrożenie Hermes, należy traktować v0.13.0 i v0.14.0 jako aktualizacje istotne dla bezpieczeństwa, a nie jedynie wydania funkcji. Wersja v0.13.0 zamyka obejście między guildami Discord oraz dwa okna TOCTOU; v0.14.0 dodaje kolejną warstwę wzmocnień w obsłudze sudo, ponownym wstrzykiwaniu błędów narzędzi, pluginach API, SSRF w skills-hub i alertach dotyczących zależności.

Architektura dla praktyków

Ta sekcja jest przeznaczona dla osób, które chcą zrozumieć, co dzieje się pod maską, aby móc to debugować, rozszerzać lub analizować wydajność. To synteza dokumentacji architektury projektu źródłowego.3

Punkty wejścia → AIAgent

Każdy punkt wejścia w Hermes ostatecznie wywołuje AIAgent.run_conversation():

┌──────────────────────────────────────────────────────────────────┐
                        Entry Points                              
                                                                  
  CLI (cli.py)    Gateway (gateway/run.py)    ACP (acp_adapter/)  
  Batch Runner    API Server                  Python Library     
└──────────┬──────────────┬───────────────────────┬────────────────┘
                                                
                                                
┌──────────────────────────────────────────────────────────────────┐
                     AIAgent (run_agent.py)                       
                                                                  
  ┌─────────────┐  ┌──────────────┐  ┌──────────────┐             
   Prompt         Provider        Tool                      
   Builder        Resolution      Dispatch                  
  └──────┬──────┘  └──────┬───────┘  └──────┬───────┘             
                                                              
  ┌──────┴───────┐ ┌──────┴───────┐  ┌──────┴───────┐             
   Compression    3 API Modes     Tool Registry             
   & Caching      chat_compl      47 tools                  
                  codex_resp      20 toolsets               
                  anthropic                                 
  └──────────────┘ └──────────────┘  └──────────────┘             
└──────────────────────────────────────────────────────────────────┘

Diagram zaadaptowany z dokumentacji architektury projektu źródłowego.3

„47 narzędzi / 20 toolsetów” vs „28 narzędzi” w banerze. Liczba „47 narzędzi” to całkowity rejestr narzędzi w repozytorium źródłowym — wszystkie narzędzia, dla których Hermes dostarcza kod źródłowy, we wszystkich toolsetach. Faktycznie uruchomiony CLI pokaże mniejszą liczbę w swoim banerze startowym (instalacja, na podstawie której zweryfikowano ten przewodnik, raportuje 28 tools / 89 skills). To nie jest błąd. Wiele toolsetów jest opcjonalnych i należy je jawnie włączyć w config.yaml w sekcji toolsets: — adaptery platform komunikacyjnych, automatyzacja przeglądarki, bardziej wymagające narzędzia do scrapingu itd. Łączna liczba w rejestrze oznacza „co jest dostępne”; liczba w banerze oznacza „co jest włączone w bieżącym profilu”. Aktywne toolsety można sprawdzić za pomocą hermes tools --list, a poszczególne toolsety włączać lub wyłączać blokiem toolsets: w ~/.hermes/config.yaml (albo za pomocą /tools list / /tools enable <name> / /tools disable <name> w uruchomionej sesji — usunięcie narzędzia powoduje reset sesji, aby agent mógł odbudować manifest narzędzi).

Trzy tryby API

Hermes abstrahuje różnice między providerami do trzech trybów API, wybieranych automatycznie w czasie działania:3

Tryb API Używany przez
chat_completions OpenRouter, z.ai, Kimi, MiniMax, DeepSeek, Alibaba, większość niestandardowych endpointów, każdy serwer kompatybilny z OpenAI
codex_responses OpenAI Codex (za pośrednictwem ChatGPT OAuth)
anthropic_messages Anthropic API (natywnie), Anthropic OAuth, proxy kompatybilne z Anthropic

Resolver runtime_provider.py mapuje krotki (provider, model) na (api_mode, api_key, base_url) dla ponad 18 providerów, obsługując przepływy OAuth, pule poświadczeń i rozwiązywanie aliasów.3

Przepływ danych przez sesję CLI

User input  HermesCLI.process_input()
   AIAgent.run_conversation()
     prompt_builder.build_system_prompt()
     runtime_provider.resolve_runtime_provider()
     API call (chat_completions / codex_responses / anthropic_messages)
     tool_calls?  model_tools.handle_function_call()  loop
     final response  display  save to SessionDB

Na podstawie strony architektury projektu źródłowego.3

Kolejność składania promptu

Stos promptów obejmuje:13

  1. SOUL.md (tożsamość agenta — lub wbudowany mechanizm zastępczy, jeśli plik jest niedostępny)
  2. Wskazówki dotyczące zachowania uwzględniającego narzędzia
  3. Kontekst pamięci/użytkownika (MEMORY.md, USER.md)
  4. Wskazówki dotyczące skills
  5. Pliki kontekstowe (AGENTS.md, .cursorrules)
  6. Znacznik czasu
  7. Wskazówki dotyczące formatowania właściwego dla platformy
  8. Opcjonalne nakładki promptu systemowego, takie jak /personality

SOUL.md jest fundamentem — wszystko inne jest na nim budowane.13

Przechowywanie sesji

Przechowywanie sesji oparte na SQLite z pełnotekstowym wyszukiwaniem FTS5. Sesje mają śledzenie pochodzenia (rodzic/dziecko między kompresjami), izolację według platformy oraz atomowe zapisy z obsługą rywalizacji o dostęp.3

System pluginów

Trzy źródła wykrywania: ~/.hermes/plugins/ (użytkownik), .hermes/plugins/ (projekt) oraz punkty wejścia pip. Pluginy rejestrują narzędzia, hooki i polecenia CLI za pośrednictwem kontekstu API. Providery pamięci są wyspecjalizowanym typem pluginu w plugins/memory/.3

hermes plugins                       # Interactive enable/disable UI
hermes plugins install <repo>        # Install from Git URL or owner/repo
hermes plugins enable <name>
hermes plugins disable <name>
hermes plugins list

Zasady projektowania

Na podstawie strony architektury projektu źródłowego:3

Zasada Co oznacza w praktyce
Stabilność promptu Prompt systemowy nie zmienia się w trakcie rozmowy. Brak mutacji psujących cache poza jawnymi działaniami użytkownika (/model)
Obserwowalne wykonanie Każde wywołanie narzędzia jest widoczne dla użytkownika za pośrednictwem callbacków. Aktualizacje postępu w CLI (spinner) i gateway (wiadomości czatu)
Możliwość przerwania Wywołania API i wykonywanie narzędzi można anulować w trakcie działania przez dane wejściowe użytkownika lub sygnały
Rdzeń niezależny od platformy Jedna klasa AIAgent obsługuje CLI, gateway, ACP, batch i serwer API. Różnice między platformami znajdują się w punkcie wejścia
Luźne powiązania Opcjonalne podsystemy (MCP, pluginy, providery pamięci, środowiska RL) używają wzorców rejestru i bramkowania check_fn, a nie twardych zależności
Izolacja profili Każdy profil otrzymuje własne HERMES_HOME, konfigurację, pamięć, sesje i PID gateway. Wiele profili działa równocześnie

Migracja z OpenClaw

Hermes Agent jest następcą OpenClaw. W przypadku migracji z istniejącej instalacji OpenClaw:65

hermes claw migrate --dry-run                    # Preview what would be migrated
hermes claw migrate --preset full                # Full migration including API keys
hermes claw migrate --preset user-data --overwrite   # User data only, no secrets
hermes claw migrate --source /custom/path        # Non-default OpenClaw location

hermes claw migrate domyślnie odczytuje dane z ~/.openclaw (automatycznie wykrywa także starsze katalogi ~/.clawdbot i ~/.moldbot) i zapisuje je w ~/.hermes.6

Importowane bezpośrednio (ponad 30 kategorii): SOUL.md, MEMORY.md, USER.md, AGENTS.md, skills z 4 katalogów źródłowych, domyślny model, niestandardowi providerzy, serwery MCP, tokeny i listy dozwolonych użytkowników platform komunikacyjnych (Telegram, Discord, Slack, WhatsApp, Signal, Matrix, Mattermost), ustawienia domyślne agenta (wysiłek rozumowania, kompresja, opóźnienie ludzkie, strefa czasowa, sandbox), zasady resetowania sesji, reguły zatwierdzania, konfiguracja TTS, ustawienia przeglądarki, ustawienia narzędzi, limit czasu exec, lista dozwolonych poleceń, konfiguracja gateway oraz klucze API z 3 źródeł.6

Zarchiwizowane do ręcznego przeglądu: zadania cron, pluginy, hooki/webhooki, backend pamięci (QMD), konfiguracja rejestru skills, UI/tożsamość, logowanie, konfiguracja wielu agentów, powiązania kanałów, IDENTITY.md, TOOLS.md, HEARTBEAT.md, BOOTSTRAP.md.6

Rozwiązywanie kluczy API sprawdza trzy źródła w kolejności priorytetów: wartości konfiguracji → ~/.openclaw/.envauth-profiles.json.6


Rozwiązywanie problemów

„Nie skonfigurowano dostawcy inferencji. Uruchom „hermes model”, aby wybrać dostawcę i model”

Pierwszy błąd pojawiający się przy każdej świeżej instalacji: Hermes nie ma jeszcze rozpoznanego dostawcy. Oznacza dokładnie to, co mówi — żadna z trzech ścieżek uwierzytelniania nie zapewniła użytecznego dostawcy. Uruchom:

hermes model

Interaktywny selektor przeprowadza przez wszystkich obsługiwanych dostawców, w tym przepływy kodu urządzenia OAuth (Nous Portal, GitHub Copilot, Anthropic, OpenAI Codex) oraz niestandardowe endpointy dla serwerów hostowanych samodzielnie. Jeśli dostawca miał być już skonfigurowany, hermes doctor pokaże, które poświadczenia Hermes faktycznie widzi; zwykle przyczyną jest klucz API ustawiony w niewłaściwym miejscu (powinien znajdować się w .env lub być ustawiony przez hermes config set, a nie w profilu powłoki), wygasłe poświadczenie OAuth w ~/.hermes/auth.json albo niestandardowy endpoint w config.yaml, który utracił base_url. Ścieżki uwierzytelniania szczegółowo opisano w Uwierzytelnianie i dostawcy.27

„Klucz API nie jest ustawiony”

Uruchom hermes model, aby interaktywnie skonfigurować dostawcę, lub hermes config set OPENROUTER_API_KEY your_key. Polecenie hermes doctor wskaże dokładnie, których kluczy brakuje.7

„Limit kontekstu: 2048 tokenów” podczas uruchamiania (modele lokalne)

Hermes automatycznie wykrywa długość kontekstu z endpointu /v1/models serwera, ale wiele lokalnych serwerów zgłasza niskie wartości domyślne. Należy ustawić ją jawnie w config.yaml:2

model:
  default: your-model
  provider: custom
  base_url: http://localhost:11434/v1
  context_length: 32768

Wywołania narzędzi wyświetlają się jako tekst zamiast być wykonywane

Na serwerze nie włączono wywoływania narzędzi albo model nie obsługuje go za pośrednictwem implementacji serwera.2

Serwer Rozwiązanie
llama.cpp Dodaj --jinja do polecenia uruchamiającego
vLLM Dodaj --enable-auto-tool-choice --tool-call-parser hermes
SGLang Dodaj --tool-call-parser qwen (lub odpowiedni parser)
Ollama Wywoływanie narzędzi jest domyślnie włączone — sprawdź, czy model je obsługuje za pomocą ollama show <model>
LM Studio Zaktualizuj do wersji 0.3.6+ i użyj modelu z natywną obsługą narzędzi

Odpowiedzi są ucinane w połowie zdania

Możliwe są dwie przyczyny:2

  1. Niski limit odpowiedzi (max_tokens) na serwerze — SGLang domyślnie ustawia 128 tokenów na odpowiedź. Ustaw --default-max-tokens na serwerze albo skonfiguruj model.max_tokens w config.yaml.
  2. Wyczerpanie kontekstu — Model zapełnił swoje okno kontekstowe. Zwiększ model.context_length lub włącz kompresję kontekstu w Hermes.

„Połączenie odrzucone” z WSL2 do serwera modelu hostowanego w Windows

WSL2 używa wirtualnego adaptera sieciowego z własną podsiecią — localhost wewnątrz WSL2 wskazuje maszynę wirtualną Linux, a nie host Windows. Dostępne są dwie opcje:2

Sieć lustrzana (Windows 11 22H2+): edytuj %USERPROFILE%\.wslconfig:

[wsl2]
networkingMode=mirrored

Następnie wykonaj wsl --shutdown i uruchom ponownie. localhost działa teraz dwukierunkowo.

Awaryjne użycie IP hosta (starsze wersje Windows): pobierz adres IP hosta Windows z wnętrza WSL2 i użyj go zamiast localhost:

ip route show | grep -i default | awk '{ print $3 }'
# Use that IP as the base_url host

Serwer modelu musi też nasłuchiwać na 0.0.0.0, a nie 127.0.0.1 — dla Ollama ustaw OLLAMA_HOST=0.0.0.0, dla llama-server/SGLang dodaj --host 0.0.0.0 albo w LM Studio włącz „Serve on Network”.2

Gdzie jest wszystko?

Pomocne będą tutaj hermes status i hermes dump. hermes logs list pokazuje wszystkie pliki dzienników wraz z ich rozmiarami. hermes config path wyświetla lokalizację pliku konfiguracji. hermes config env-path wyświetla lokalizację .env.6


FAQ

Jaka jest różnica między Hermes Agent a Claude Code?

Claude Code to oficjalny CLI firmy Anthropic, ograniczony do modeli Anthropic. Hermes Agent to framework agentów open source od Nous Research, który współpracuje z każdym dostawcą zgodnym z OpenAI — Nous Portal, OpenRouter, Anthropic, GitHub Copilot, z.ai, Kimi, MiniMax, DeepSeek, Hugging Face, Google lub własnym endpointem hostowanym samodzielnie.12 Hermes oferuje również gateway komunikatorów dla Telegram/Discord/Slack/WhatsApp/Signal, którego Claude Code nie ma.

Czy można używać Hermes z kluczem API Anthropic?

Tak. Są trzy sposoby:2

  1. Ustaw ANTHROPIC_API_KEY w ~/.hermes/.env i uruchom hermes chat --provider anthropic --model claude-sonnet-4-6
  2. Uruchom hermes model i wybierz Anthropic — Hermes użyje magazynu poświadczeń Claude Code, jeśli jest dostępny
  3. Ustaw ręcznie ANTHROPIC_TOKEN (token konfiguracyjny lub token OAuth) jako rozwiązanie awaryjne

Opcja 2 jest preferowana, jeśli Claude Code jest już używany na tym samym komputerze — dzięki temu odświeżalne poświadczenia Claude pozostają odświeżalne.

Jak zmienić dostawcę bez utraty rozmowy?

W sesji użyj /model provider:model. Historia rozmowy, pamięć i skille zostaną zachowane:9

/model zai:glm-5
/model openrouter:anthropic/claude-sonnet-4
/model custom:local:qwen-2.5

Skonfigurowano Anthropic, ale nie działają vision/web/compression

Używany jest awaryjny model pomocniczy. Vision, podsumowywanie stron internetowych, kompresja oraz inne zadania poboczne korzystają z osobnego pomocniczego LLM — domyślnie Gemini Flash przez automatyczne wykrywanie (OpenRouter → Nous → Codex). Jeśli żaden z nich nie jest skonfigurowany i ustawiono wyłącznie Anthropic, te funkcje działają w ograniczonym zakresie bez komunikatu.4

Rozwiązanie: należy dodać OPENROUTER_API_KEY dla zadań pomocniczych albo ponownie skonfigurować sloty pomocnicze tak, aby używały głównego dostawcy. Należy pamiętać, że kompresja kontekstu znajduje się we własnym blokiem najwyższego poziomu compression: i przyjmuje summary_provider, a nie auxiliary.compression.provider — slot auxiliary.compression udostępnia wyłącznie timeout. Pełne rozwiązanie:

auxiliary:
  vision:      { provider: "main" }
  web_extract: { provider: "main" }

compression:
  summary_provider: "main"

Jaka jest różnica między SOUL.md a AGENTS.md?

SOUL.md to tożsamość agenta — ton, styl i domyślne zasady komunikacji. Plik znajduje się w ~/.hermes/SOUL.md i towarzyszy wszędzie. AGENTS.md jest specyficzny dla projektu — opisuje architekturę, konwencje, polecenia i ścieżki — oraz znajduje się w katalogu projektu.13 Jeśli powinno to towarzyszyć wszędzie, należy użyć SOUL.md. Jeśli należy do projektu, należy użyć AGENTS.md.

Jak uruchomić wiele instancji Hermes obok siebie?

Profile. Każdy profil ma własne HERMES_HOME, konfigurację, pamięć, sesje i PID gateway:6

hermes profile create work --clone
hermes profile use work                 # Sticky default
hermes -p work chat -q "..."            # One-off without switching
hermes profile alias work --name h-work # Wrapper script

Czy Hermes obsługuje lokalne LLM?

Tak, przez ścieżkę niestandardowego endpointu. Hermes współpracuje z każdym serwerem zgodnym z OpenAI: Ollama, vLLM, SGLang, llama.cpp/llama-server, LM Studio, LocalAI, Jan lub własnym serwerem.2 Konfigurację dla poszczególnych serwerów opisano w Niestandardowe endpointy i endpointy hostowane samodzielnie.

Dlaczego baner uruchamiania pokazuje mniej narzędzi, niż według przewodnika ma Hermes?

Przewodnik wskazuje 47 narzędzi / 20 toolsetów z rejestru architektury upstream — jest to pełna liczba narzędzi, dla których Hermes dostarcza kod źródłowy we wszystkich toolsetach. Działająca instalacja pokazuje w banerze mniejszą liczbę (instalacja referencyjna użyta w tym przewodniku zgłasza 28 narzędzi), ponieważ Hermes podczas uruchamiania włącza tylko domyślny zestaw toolsetów. Wiele toolsetów jest opcjonalnych: adaptery gateway komunikatorów, automatyzacja przeglądarki, bardziej rozbudowane stosy scrapingu oraz kilka wyspecjalizowanych integracji trzeba jawnie wymienić pod toolsets: w ~/.hermes/config.yaml, zanim zostaną załadowane. Suma w rejestrze = „co jest dostępne po włączeniu”. Suma w banerze = „co faktycznie załadował bieżący profil”. Użyj hermes tools --list, aby sprawdzić, które toolsety są aktywne, a które dostępne, lecz wyłączone. Poszczególne toolsety można przełączać w czasie działania przez /tools enable <name> i /tools disable <name> (wyłączenie wywołuje reset sesji, aby agent odbudował manifest narzędzi o nowym kształcie).

Jak Hermes obsługuje awaryjne przełączanie modeli, gdy główny dostawca zawiedzie?

Skonfiguruj blok fallback_model w config.yaml:2

fallback_model:
  provider: openrouter
  model: anthropic/claude-sonnet-4

Gdy główny dostawca zawiedzie (limit szybkości, błąd serwera, błąd uwierzytelniania), Hermes przełącza się na model zapasowy w trakcie sesji bez utraty historii rozmowy. Dzieje się to najwyżej raz na sesję.

Czy agent może z czasem ulepszać własne skille?

Tak — na tym polega „samodoskonaląca” część Hermes Agent. Agent może tworzyć, aktualizować i usuwać skille przez narzędzie skill_manage. Gdy rozwiąże nietrywialny workflow, zapisuje podejście jako skill do ponownego użycia w przyszłości.11 Agent tworzy skille po złożonych zadaniach (ponad 5 wywołań narzędzi), gdy napotka błędy i znajdzie działającą ścieżkę, gdy zostanie skorygowane jego podejście lub gdy odkryje nietrywialny workflow.

Czy istnieje integracja z IDE?

Tak — Hermes może działać jako serwer ACP (Agent Client Protocol) dla VS Code, Zed i JetBrains:6

pip install -e '.[acp]'
hermes acp

Historia zmian

Data Zmiana Źródło
2026-07-28 Przewodnik v1.12: Rozszerzenie treści na podstawie popytu w wyszukiwarce — dwa tematy o wysokiej konwersji nie miały odpowiadających im nagłówków. Bez nowej wersji. Dane GSC pokazują, że zapytania hermes swarm i hermes agent swarm osiągają konwersję na poziomie 4,4–6,3% z pozycji ~8, a hermes smart model routing — 4,9% z pozycji 6,7, mimo że żadne z tych pojęć nie miało własnej sekcji: swarm występował wyłącznie w tekście dotyczącym Multi-Agent Kanban oraz we wpisach historii zmian, natomiast „smart model routing” pojawiał się jedynie w przypisie. W sekcji Multi-Agent Kanban dodano Czym jest Hermes Swarm? — swarm zdefiniowano jako równoległych workerów pracujących na jednej trwałej tablicy, opisano topologię swarm z v0.15.0, automatyczny podział zadań, nadpisywanie modelu dla poszczególnych zadań, zadania zaplanowane i zarządzanie worktree, a także zestawiono w tabeli awarie, którym zapobiega każdy z tych mechanizmów. Tytuł Rotacja dostawców i fallback zmieniono na Smart Model Routing: rotacja dostawców i fallback, dodając wprowadzenie przedstawiające pule danych uwierzytelniających, model fallback i routing pomocniczy jako jeden system. Do żadnej kotwicy nie prowadził link wewnętrzny, dlatego zmiana tytułu niczego nie psuje. 28 2 6
2026-08-20 Przewodnik v1.13: v0.20.3 (tag v2026.8.16.2, opublikowany 17 sierpnia) oraz v0.20.4 (tag v2026.8.18, 18 sierpnia). Nowa podsekcja w ramach Herald Release: seria wersji zbiorczych zawiera już nowe funkcje, a nie tylko poprawki stabilizacyjne. v0.20.3 (~250 commitów / ~125 PR-ów): migracja SDK MCP 2.x z obsługą protokołu bezstanowego z 2026-07-28, dołączony plugin Bot Mode (hermes-bots) z podstawowym protokołem współpracowników, plugin dostawcy CommandCode, kontrakty środowiska wykonawczego Cua Driver 0.20 do obsługi komputera, wzmocnienie własności środowiska wykonawczego Python, samonaprawiający się harmonogram cron, poprawki zapobiegające utracie danych podczas przekazywania sesji oraz porty z ekosystemu (/worktree, zachowanie ręcznych zmian przy /rollback, skanowanie bezpieczeństwa podczas instalacji pluginów). v0.20.4 (~146 commitów / ~74 PR-y): szklany/półprzezroczysty interfejs aplikacji desktopowej z selektorem efektu szronu, panel boczny SESSIONS|BOTS z kartami i możliwością ukrywania oraz odkrywania poszczególnych botów, doradcze skanowanie Tier 1 przez NVIDIA SkillEvaluator podczas instalowania skills (licencja + bezpieczeństwo), wzmocnienie wysyłania multimediów przez cron oraz rzetelne informowanie o zaparkowanej gałęzi przez hermes update. W informacjach o obu wersjach podano, że pełne, opracowane zestawienie zmian zostanie wydane wraz z v0.21.0 — podsumowania oparto na opisach zakresu pochodzących bezpośrednio z informacji o tych wersjach. Zaktualizowano zdanie nagłówkowe i ciąg tagów. 23
2026-08-16 Przewodnik v1.12: v0.20.0 „The Herald Release” (3 sierpnia, tag v2026.8.3) oraz stabilizacyjne tagi v0.20.1 (13 sierpnia) i v0.20.2 (16 sierpnia). Trzy poprawki dotyczą instrukcji, które przestały działać: wymagany jest Node 26 (instalator przypina NODE_VERSION="26" i odrzuca starsze środowiska wykonawcze — informacja o Node v22 w witrynie dokumentacji jest nieaktualna, dlatego rozstrzygające są instalator i informacje o wersji), pip i Homebrew zostały wycofane, a nie oznaczone jako przestarzałe („obsługiwane kanały to instalator powłoki / Docker / Nix”), natomiast domyślny limit iteracji zwiększono z 90 do 500, przez co wszystkie wartości w tabeli presji budżetowej stały się nieaktualne. Polecenie instalacji poprawiono na kanoniczny adres https://hermes-agent.nousresearch.com/install.sh. Usunięta powierzchnia: źródło skill claude-marketplace zniknęło i na liście źródeł zastąpiło je browse-sh; domyślne repozytoria GitHub to teraz openai, anthropics, huggingface, NVIDIA i gstack. Liczbę platform obsługiwanych przez messaging gateway przeliczono z 22 na 28, bezpośrednio wyliczając pozycje w tabeli porównawczej dokumentacji (dokumentacja nie podaje oficjalnej liczby). Natywny Windows należy do Tier 1, a nie do wczesnej wersji beta; macOS obsługuje wyłącznie Apple Silicon. Nowa sekcja opisuje samą wersję: konwersacyjny tryb głosowy z możliwością przerwania wypowiedzi, A2A v1.0, podpisane wychodzące webhooki cyklu życia, skill grounded-citations, serię CLI !//init//diff//context//focus oraz hermes import-agent, źródło sekretów command-helper, skrócenie zimnego startu hermes -w z ~14 s do ~1,8 s, a także artefakty aplikacji desktopowej i SDK pluginów. Zweryfikowano jako niezmienione: trzy ścieżki uwierzytelniania, układ ~/.hermes/, hermes update oraz udokumentowana lista narzędzi. 24
2026-07-21 Przewodnik v1.11: v0.19.0 „The Quicksilver Release” (20 lipca 2026, tag v2026.7.20). Dodano sekcję „Co nowego w v0.19.0”: skrócenie TTFT pierwszej tury o ~80% (od zimnego wysłania do przekazania: z ~4,3 s do ~0,9 s w CLI/gateway/TUI/aplikacji desktopowej/cron), domyślne strumieniowanie rozumowania na żywo (display.show_reasoning włączone), seria ~20 PR-ów przyspieszających aplikację desktopową (14-krotnie szybsze strumieniowanie Markdown) oraz przyrostowe renderowanie Markdown w TUI; instalacje pip/Homebrew oznaczono jako przestarzałe (wyłącznie ostrzeżenie „nieobsługiwany kanał starszego typu”, planowane usunięcie publikowania w PyPI/Homebrew) — sekcję Instalacja i TL;DR poprawiono tak, aby wskazywały jednowierszowy instalator; wymienny SecretSource z dostawcami Bitwarden i 1Password (odwołania op://, wiele sejfów, deterministyczna kolejność pierwszeństwa, pochodzenie każdej zmiennej); smart approvals jako ustawienie domyślne (niezależny recenzent LLM dla każdego oznaczonego polecenia) + definiowane przez użytkownika reguły odmowy, które obowiązują również w trybie YOLO + /deny <reason> + przywrócona eskalacja zatwierdzenia przez pre_tool_call pluginu; rozliczenia w terminalu przez /subscription + /topup + karta rozliczeń w aplikacji desktopowej (wycofano stwierdzenie „brak osobnego polecenia subskrypcji”); transkrypcje subagentów na żywo + trwałe delegowanie w tle + rejestr zobowiązań dotyczących dostarczenia w state.db; max_async_children oznaczono jako przestarzałe na rzecz ujednoliconych limitów współbieżności delegowania; routing wiadomości gateway oparty na profile (jeden multipleksowany token bota → odizolowane profile, GATEWAY_MULTIPLEX_PROFILES, indeks routingu w state.db, sessions.json jako opcjonalne lustro starszego typu); dostawcy/modele: Fireworks AI (2. pozycja w selektorze), DeepInfra, Upstage Solar, pełna obsługa GPT-5.6 (Sol/Terra/Luna + Pro), grok-4.5 GA, kimi-k3 (kimi-k2.x wycofany), w pełni zintegrowany Claude Sonnet 5, ustawienie enabled: false dla poszczególnych dostawców + excluded_providers, poziomy wysiłku rozumowania max/ultra z nadpisywaniem dla poszczególnych modeli/slotów MoA oraz ograniczonym do sesji /reasoning; CLI/MCP: hermes sessions export (Markdown/Quarto/HTML/tylko prompt/ślad HF, --redact), /model --once, łączone wywołania slash-skills, --safe-mode, hermes config get/unset, rzeczywiście bezinterfejsowy hermes serve, nazewnictwo MCP mcp__server__tool. Odnotowano również pominięte tagi poprawek v0.18.1 (tag v2026.7.7) i v0.18.2 (tag v2026.7.7.2) z 7–8 lipca 2026 — zbiorcze poprawki infrastruktury; istotna poprawka w v0.18.2 usuwa przypięcie WhatsApp Baileys do wersji 7.0.0-rc13, aby zapewnić niezawodne buildy Docker. 25 26
2026-07-16 Dodano pierwszy wpis dotyczący rozwiązywania problemów z dokładnie przytoczonym błędem uruchamiania „No inference provider configured. Run ‘hermes model’ to choose a provider and model” — na podstawie popytu w wyszukiwarce; wpis wskazuje interaktywny selektor, hermes doctor oraz trzy ścieżki uwierzytelniania. Bez zmian w produkcie. 2 7
2026-07-01 Przewodnik v1.10: v0.18.0 „The Judgment Release” (1 lipca 2026, tag v2026.7.1). Dodano sekcję „Co nowego w v0.18.0”: zamknięto cały backlog P0/P1 (~692 pozycje); pierwszorzędna obsługa Mixture-of-Agents z oznaczonymi wynikami zespołu poszczególnych modeli i strumieniowaniem na żywo; kontrakty ukończenia/goal weryfikuje własną pracę przez uruchomienie kontroli projektu; /learn (opis przepływu pracy → skill wielokrotnego użytku zgodny z CONTRIBUTING.md); /journey — oś czasu pamięci/skills + graf pamięci w aplikacji desktopowej; równoległe uruchamianie subagentów w tle (współbieżne zadania delegowane); Desktop Projects (projekt/repozytorium/ścieżka); gateway skalowany do zera z koordynacją wygaszania; Google Vertex AI (Gemini za pośrednictwem kont usług GCP, automatyczne odświeżanie OAuth2); edytor /prompt wykorzystujący \$EDITOR. Źródło: wersje hermes-agent. 22
2026-06-21 Przewodnik v1.9: v0.17.0 „The Reach Release” (19 czerwca 2026, tag v2026.6.19). Dodano sekcję „Co nowego w v0.17.0”. Wiadomości: iMessage bez pośrednika przez Photon Spectrum (hermes photon login, OAuth z kodem urządzenia), oficjalny adapter WhatsApp Business Cloud API (bez mostu), grupy i załączniki SimpleX, plugin platformy Raft. Modele: z-ai/glm-5.2 (1M), anthropic/claude-fable-5, laguna-m.1, nemotron-3-ultra, grok-composer-2.5-fast (OAuth xAI, 200k); domyślny model xAI → grok-build-0.1; modele adaptacyjne Anthropic pomijają pole reasoning. Aplikacja desktopowa/dashboard: subagenci w tle z oknami podglądu na żywo (delegate_task(background=true)), kompletny kreator profile, przebudowane Skills Hub, Automation Blueprints, bezpieczne logowanie 401, motywy z VS Code Marketplace, interfejs w języku japońskim i chińskim tradycyjnym. Skills/narzędzia: edycja obrazu na obraz przez image_generate, atomowa partia operations dla memory, skill simplify-code, wartość logiczna write_approval (zastępuje write_mode). Architektura: obsługa pozyskiwania danych MCP, wymienny CronScheduler + Chronos, zakres Managed (/etc/hermes), przekaźnik Gateway-Gateway. Polecenia: /version, /billing, hermes curator run --consolidate (opcjonalne). Bezpieczeństwo: zamknięto obejście listy zakazanych sekwencji ucieczki powłoki, adaptery zatwierdzania/gateway działają w trybie fail-closed, środowisko cron jest oczyszczane, sekrety są redagowane w zrzutach debugowania, kontrola wyprowadzania danych przez stdio MCP, aktualizacje urllib3 + PyJWT usuwające podatności CVE. 21
2026-06-08 Przewodnik v1.8: v0.16.0 „The Surface Release” (5 czerwca 2026, tag v2026.6.5). Zmieniono tytuł przewodnika na v0.16 i dodano sekcję „Co nowego w v0.16.0”. Najważniejsza zmiana: Hermes nie jest już dostępny wyłącznie w terminalu. Natywna aplikacja Hermes Desktop (Electron, macOS/Linux/Windows) z instalacją jednym kliknięciem, samoczynną aktualizacją w aplikacji, strumieniowym czatem, przeciąganiem i upuszczaniem oraz wklejaniem obrazów ze schowka, paletą Cmd+K, archiwum i wyszukiwaniem sesji, selektorem modelu na pasku stanu, połączeniem ze zdalnym gateway przez bezpieczny WebSocket (OAuth lub użytkownik/hasło, hosty dla poszczególnych profile, międzyprofilowe linki @session) oraz pełnym tłumaczeniem na chiński uproszczony za pośrednictwem typowanego i18n. Panel administracyjny w przeglądarce (webowy dashboard → pełny panel administracyjny): włączanie/wyłączanie katalogu MCP, zarządzanie danymi uwierzytelniającymi, tworzenie webhooków/hooków, konfiguracja pamięci, kontrolki gateway, strona System z kontrolą przed aktualizacją + Debug Share, nowa strona Channels oraz wymienne uwierzytelnianie (użytkownik/hasło, samodzielnie hostowany OIDC, hermes dashboard register). Nowe polecenia: /undo [N] (CLI/TUI/wiadomości), konfigurowalny interfejs domyślny (cli/tui, --cli), ujednolicony /model w TUI + nakładka Sessions, hermes portal, hermes prompt-size, hermes sessions optimize. Nowe modele: deepseek-v4-flash, MiniMax-M3 (kontekst 1M), qwen3.7-plus, gemini-3.5-flash; pierwszorzędna obsługa OAuth xAI Grok w programie uruchamiającym aplikację desktopową; selektor modeli z wyszukiwaniem rozmytym; odświeżanie katalogu co godzinę. Skills: odchudzony zestaw domyślny (Spotify → natywny plugin, Linear → hermes mcp install linear, usunięto nieaktywne skills), bramka trafności environments: (kanban/docker/s6), domyślne zaufane repozytorium NVIDIA/skills, progresywne ujawnianie narzędzi MCP/pluginu w odpowiednim zakresie. Bezpieczeństwo: CVE-2026-48710 (Starlette BadHost) — przypięcie wersji ≥1.0.1; kontrole SSRF poza pętlą zdarzeń; token okaziciela Bedrock usuwany ze środowiska podprocesu; zabezpieczony odczyt bws_cache.json; docker restart/stop/kill dodane do niebezpiecznych wzorców; oczyszczanie niewidocznych znaków Unicode. Zamknięto 2 problemy P0 + 62 problemy P1 (16 oznaczonych jako dotyczące bezpieczeństwa). 20
2026-05-31 Przewodnik v1.7.1: v0.15.1 (29 maja 2026, 01:12 UTC) — poprawka Velocity. Hotfix wydany tego samego dnia po Velocity; przypięty wiersz tagu v2026.5.29. Naprawia pętlę ponownego ładowania dashboardu z błędem 401, która dotyczyła wdrożeń w trybie loopback. Docker nie traktuje już --insecure jako ustawienia domyślnego — aby ponownie je włączyć, należy jawnie ustawić HERMES_DASHBOARD_INSECURE=1. Niezłożone polecenia MCP (npx, npm, node) ponownie są prawidłowo rozpoznawane wewnątrz kontenerów Docker. Prawidłowo renderują się etykiety źródeł i panel boczny kategorii na stronie Skills. Workery Kanban poprawnie reagują na SIGTERM, zamiast pozostawiać osierocone procesy. Katalog Skills.sh rozszerzono z 858 do 19 932 pozycji dzięki wykrywaniu za pośrednictwem mapy witryny. 28 commitów, 21 scalonych PR-ów, 9 współtwórców. v0.15.2 (29 maja 2026, 13:37 UTC) — poprawka pakietowania Velocity. Naprawia dystrybucje wheel i sdist tak, aby dołączały manifesty plugin.yaml, dzięki czemu instalacje z PyPI działają bez ręcznego dołączania drzewa źródłowego. Hotfix dotyczący wyłącznie pakietowania, 4 współtwórców. 27
2026-05-28 Przewodnik v1.7: Dodano v0.15.0 (28 maja 2026) — The Velocity release (tag v2026.5.28). Najważniejsze zmiany: rozległa refaktoryzacja + nowe mechanizmy orkiestracji. Refaktoryzacja bazy kodu: rozmiar run_agent.py zmniejszono o 76% (z 16 083 do 3 821 wierszy), rozdzielając kod na 14 spójnych modułów. Multi-agent Kanban v2: automatyczny podział celów wysokiego poziomu na podzadania, topologia swarm do koordynacji równoległych workerów, nadpisywanie modelu dla poszczególnych zadań, zadania zaplanowane i zarządzanie worktree. Wydajność: zimny start skrócony o kolejną sekundę; liczba wywołań funkcji na konwersację zmniejszona o 47%; session_search przeprojektowano tak, że działa 4 500 razy szybciej, usuwając zależność LLM (i związany z nią koszt API). Bezpieczeństwo: ochrona Promptware zabezpiecza przed wstrzykiwaniem promptów klasy Brainworm w trzech punktach kontroli bezpieczeństwa; integracja z Bitwarden Secrets Manager zastępuje wiele kluczy API dla poszczególnych dostawców jednym tokenem startowym. Pakiety skills: jednoczesne wczytywanie wielu skills jednym poleceniem slash. Orkiestrator sesji TUI: zarządzanie wieloma sesjami w jednym oknie terminala. Nowi dostawcy: Krea 2 (Medium/Large) oraz obsługa pluginu FAL do generowania obrazów; kolejny etap integracji xAI dodaje plugin wyszukiwania internetowego, nadrzędny OAuth, wykrywanie wycofanych modeli i naturalne pauzy TTS. Statystyki: 1 302 commity, 747 scalonych PR-ów, 321 współtwórców ze społeczności. Zgodnie z informacjami o wersji GitHub wydana tego samego lub następnego dnia poprawka usuwa pętlę ponownego ładowania dashboardu z błędem 401, wprowadza jawną zmienną środowiskową dla --insecure w Docker, przywraca rozpoznawanie niezłożonych poleceń MCP w Docker (npx, npm, node), odtwarza stronę Skills, poprawia obsługę SIGTERM przez workery Kanban i udostępnia pełny katalog Skills obejmujący 19 932 pozycje dzięki mapie witryny. 28
2026-05-21 Przewodnik v1.6: Dodano v0.14.0 (16 maja 2026) — The Foundation release. Najważniejsze zmiany: lżejsza podstawa instalacji i środowiska wykonawczego oraz szersza obsługa dostawców, gateway, multimediów i weryfikacji. Dodano OAuth SuperGrok z kontekstem grok-4.3 1M, zgodny z OpenAI hermes proxy dla dostawców OAuth, pierwszorzędne x_search, pip install hermes-agent, leniwe instalowanie zależności, uruchamianie szybsze o ~19 s, 180-krotnie szybsze wywołania CDP przeglądarki, LINE + SimpleX Chat — łącznie 22 platformy wiadomości, kompleksową obsługę Microsoft Teams, /handoff, /subgoal, natywne przyciski doprecyzowania w Telegram/Discord, uzupełnianie historii Discord, działające na surowych pikselach vision_analyze, stopkę weryfikującą zmiany plików po każdej turze, semantyczną diagnostykę LSP przy każdym zapisie, ujednolicone video_generate, computer_use przez cua-driver dla dostawców innych niż Anthropic, klikalne adresy URL OSC8, obsługę Zed ACP Registry, router OpenRouter Pareto Code, NovitaAI, środowisko wykonawcze Codex app-server, zaufane repozytorium huggingface/skills, 9 opcjonalnych skills, ctx.llm / tool_override pluginu, wyszukiwanie internetowe Brave/DDGS, zmianę nazwy Qwen Cloud, natywną wersję beta dla Windows oraz zamknięcie 12 problemów P0 / 50 problemów P1. 19
2026-05-07 Przewodnik v1.5: Dodano v0.13.0 (7 maja 2026) — The Tenacity release. Najważniejsza zmiana: trwała tablica multi-agent Kanban (heartbeat, odzyskiwanie zadań, wykrywanie zombie, bramka halucynacji, max_retries dla poszczególnych zadań, tablice wielu projektów), dzięki której swarms stały się pierwszorzędnym mechanizmem, a nie tylko wzorcem delegowania. Polecenie /goal utrzymuje koncentrację agenta na celu między turami (wzorzec pętli Ralph jako polecenie slash). Nowe narzędzie video_analyze, wykorzystujące przede wszystkim Gemini i obsługujące rozszerzenia o zgodne modele. Dostawca xAI Custom Voices TTS z klonowaniem głosu. i18n w 7 językach (zh-Hans, ja, de, es, fr, uk, tr) dla komunikatów CLI i gateway; dokumentacja wyłącznie w zh-Hans. Google Chat jako 20. platforma wiadomości za pośrednictwem wzorca wymiennych adapterów; IRC + Microsoft Teams przeniesiono do tego samego wzorca. ProviderProfile ABC + plugins/model-providers/ umożliwiają dołączanie zewnętrznych dostawców bez zmian w podstawowym kodzie. Automatyczne wznawianie sesji po ponownym uruchomieniu gateway, /update i przeładowaniu pliku źródłowego. Przepisane od podstaw checkpointy v2 z jednym magazynem, rzeczywistym oczyszczaniem i zabezpieczeniami miejsca na dysku. Zamknięto osiem problemów bezpieczeństwa P0: domyślne redagowanie sekretów, obejście ograniczeń wiadomości prywatnych między serwerami Discord (CVSS 8.1), odrzucanie nieznajomych + wyciszanie czatu z samym sobą w WhatsApp, TOCTOU OAuth w MCP, TOCTOU auth.json w CLI, podstawowe zabezpieczenie przeglądarki przed SSRF, skanowanie promptów cron pod kątem wstrzyknięć, redagowanie w hermes debug share. Linting po zapisie dla Python/JSON/YAML/TOML, tryb cron no_agent uruchamiający wyłącznie skrypt, listy dozwolonych użytkowników na platformach Slack/Telegram/Mattermost/Matrix/DingTalk, rozszerzenia MCP (transport SSE, przekazywanie OAuth, tagi MEDIA obrazów). Statystyki od v0.12.0: 864 commity, 588 scalonych PR-ów, 829 zmienionych plików, 295 współtwórców ze społeczności, 282 zamknięte problemy (13 P0, 36 P1). 18
2026-05-06 Przewodnik v1.4: Dodano v0.12.0 (30 kwietnia 2026) — The Curator release. Najważniejsza zmiana: autonomiczny Curator działający w tle zgodnie z zegarem cron gateway (domyślnie co 7 dni), który ocenia bibliotekę skills według kryteriów, usuwa martwe skills, konsoliduje powiązane skills i zapisuje raporty każdego uruchomienia — Hermes utrzymuje się sam między aktywnymi sesjami. Pętlę samodoskonalenia rozbudowano o ocenianie według kryteriów, preferowanie aktywnych aktualizacji, prawidłowe dziedziczenie środowiska wykonawczego oraz toolsets o zakresie ograniczonym do pamięci i skills. Czterech nowych dostawców inferencji: GMI Cloud, Azure AI Foundry, MiniMax OAuth oraz Tencent Tokenhub. LM Studio otrzymało pierwszorzędną obsługę. Zdalne manifesty katalogu modeli aktualizują się teraz automatycznie bez nowych wydań. Dwie nowe platformy wiadomości: Microsoft Teams (19., za pośrednictwem wymiennej architektury gateway) oraz Tencent Yuanbao (18., natywna obsługa tekstu + multimediów). Natywne Spotify za pośrednictwem OAuth PKCE z dołączonym skill; plugin Google Meet do rozmów i transkrypcji; dostawca Piper local TTS. ComfyUI v5 + TouchDesigner-MCP przeniesiono z opcjonalnych do domyślnie dołączanych. Nowe skills: Humanizer, claude-design, design-md, airtable. Dodatki do CLI: tryb pojedynczego wywołania hermes -z, kontrola wstępna hermes update --check, polecenie slash /reload-skills, wymienne style wskaźnika zajętości. Widoczny zimny start TUI skrócono o ~57% dzięki leniwej inicjalizacji agenta i leniwym importom. Bezpieczeństwo: domyślne redagowanie sekretów wyłączono, aby zapobiec uszkadzaniu ładunków; bezwzględna lista blokad dla nieodwracalnych poleceń. Statystyki: 1 096 commitów, 550 scalonych PR-ów, 213 współtwórców ze społeczności. 17
2026-04-25 Przewodnik v1.3: Dodano v0.11.0 (23 kwietnia 2026) — The Interface release. Kompletny przepisany w React/Ink interaktywny TUI z backendem Python JSON-RPC (tui_gateway); przyklejony edytor wiadomości, strumieniowanie na żywo z obsługą schowka OSC-52, stabilne klawisze selektorów, pasek stanu ze stoperem każdej tury i gałęzią git, potwierdzenie /clear, ustawienie wstępne jasnego motywu, nakładka obserwacji uruchamiania subagentów. Wymienna architektura transportu — konwersję formatów i transport HTTP wyodrębniono do agent/transports/, upraszczając obsługę dostawców. Natywne AWS Bedrock za pośrednictwem Converse API. Pięć nowych ścieżek inferencji: NVIDIA NIM, Arcee AI, Step Plan, Google Gemini CLI OAuth oraz Vercel ai-gateway. GPT-5.5 przez Codex OAuth — nowy flagowy model OpenAI jest dostępny przez ChatGPT Codex OAuth bez osobnego klucza API. QQBot (17. platforma wiadomości) z konfiguracją przez skanowanie kodu QR i strumieniowaniem. Rozszerzenie powierzchni pluginów: polecenia slash, przekazywanie narzędzi, blokowanie wykonania, przekształcanie wyników. /steer <prompt> — wskazówki dla agenta w trakcie działania, które wprowadzają notatkę widoczną dla działającego agenta po następnym wywołaniu narzędzia, bez przerywania tury ani naruszania pamięci podręcznej promptu. Hooki powłoki łączą skrypty jako hooki cyklu życia bez pluginów Python. Tryb bezpośredniego dostarczania webhooków przekazuje ładunki prosto do czatu na platformie, pomijając agenta podczas rozsyłania. Inteligentniejsze delegowanie z rolami orkiestratora, konfigurowalną głębokością uruchamiania i koordynacją plików. Dashboard otrzymuje system pluginów, przełączanie motywu na żywo, i18n i responsywność mobilną. Statystyki od v0.9.0: 1 556 commitów, 761 scalonych PR-ów, 1 314 zmienionych plików, 224 174 dodane wiersze, 29 współtwórców ze społeczności. 29
2026-04-16 Przewodnik v1.2: Dodano v0.10.0 — Nous Tool Gateway. Płatni subskrybenci Nous Portal otrzymują teraz dostęp do zarządzanych narzędzi (wyszukiwanie internetowe Firecrawl, generowanie obrazów FAL / FLUX 2 Pro, OpenAI TTS, automatyzacja przeglądarki Browser Use) bez dodatkowych kluczy API. Każde narzędzie można włączyć osobno za pomocą nowego pola konfiguracji use_gateway. Gdy skonfigurowano obie opcje, środowisko wykonawcze preferuje gateway zamiast bezpośrednich kluczy API. Usunięto zmienną środowiskową HERMES_ENABLE_NOUS_MANAGED_TOOLS. CLI Hermes Agent pozostaje objęty licencją MIT i całkowicie bezpłatny. 30
2026-04-13 Przewodnik v1.1: Dodano funkcje z v0.8.0 i v0.9.0. Lokalny webowy dashboard, tryb /fast, platformy iMessage + WeChat (łącznie 16), monitorowanie procesów w tle (watch_patterns), wymienny context engine, hermes backup/hermes import, Termux/Android, dostawcy xAI + MiMo + Google AI Studio + Qwen, polecenie /debug, kompleksowe wzmocnienie bezpieczeństwa. 15 16
2026-04-10 Przewodnik v1.0: Pierwsze wydanie dotyczące Hermes Agent v0.7.0. Uwierzytelnianie dostawców, konfiguracja, CLI, polecenia slash, narzędzia, skills, pamięć, gateway, cron, MCP, kompresja, architektura, migracja z OpenClaw, rozwiązywanie problemów, FAQ.

Materiały źródłowe


  1. Nous Research, plik README projektu „Hermes Agent” w serwisie GitHub. Główne źródło opisu produktu (samodoskonalący się agent, obsługa wielu dostawców, gateway komunikacyjny, backendy terminalowe, rozwój skill, harmonogram cron i delegowanie) oraz jednolinijkowego polecenia „Szybka instalacja”

  2. Nous Research, „Dostawcy AI” w dokumentacji Hermes Agent. Główne źródło pełnej listy dostawców, metod uwierzytelniania dla poszczególnych dostawców (Nous Portal OAuth, kod urządzenia Codex, typy tokenów Copilot w GitHub, trzy metody uwierzytelniania Anthropic, chińscy dostawcy AI, routing Hugging Face, niestandardowe endpointy), trzech ścieżek uwierzytelniania (klucz API w .env, OAuth przez hermes model, niestandardowy endpoint w config.yaml), składni polecenia ukośnikowego /model (w tym custom:name:model), szablonów konfiguracji Ollama/vLLM/SGLang/llama.cpp/LM Studio, instrukcji dotyczących sieci w WSL2, łańcucha wykrywania długości kontekstu, konfiguracji modelu zapasowego, inteligentnego routingu modeli oraz nazwanych niestandardowych dostawców. Z tej strony pochodzą wszystkie użyte w tym artykule nazwy zmiennych środowiskowych właściwe dla dostawców, typy tokenów, nadpisania bazowych adresów URL i identyfikatory modeli. 

  3. Nous Research, „Architektura” w przewodniku dla deweloperów Hermes Agent. Główne źródło diagramu ogólnego systemu, struktury katalogów, przepływu danych przez ścieżki sesji CLI i wiadomości gateway, trzech trybów API (chat_completions, codex_responses, anthropic_messages), rozpoznawania dostawców przez runtime_provider.py, trwałego przechowywania sesji za pomocą SQLite + FTS5, listy platform gateway komunikacyjnego, źródeł wykrywania systemu pluginów, izolacji profile oraz sześciu zasad projektowych. 

  4. Nous Research, „Konfiguracja” w podręczniku użytkownika Hermes Agent. Główne źródło struktury katalogu konfiguracyjnego, reguły dotyczącej config.yaml i .env („config.yaml ma pierwszeństwo w przypadku ustawień, które nie są poufne”), hierarchii pierwszeństwa konfiguracji (argumenty CLI → środowisko → config.yaml → .env → wartości domyślne), ustawień kompresji kontekstu (blok compression.* z polami threshold, target_ratio, protect_last_n, summary_model, summary_provider, summary_base_url), progów wykorzystania budżetu (ostrożność przy 70%, ostrzeżenie przy 90%), limitów czasu przesyłania strumieniowego z automatycznym dostosowaniem do lokalnego dostawcy oraz pełnego bloku konfiguracji modeli pomocniczych (auxiliary: z miejscami vision, web_extract, approval, compression, session_search, skills_hub, mcp, flush_memories). Z tej strony pochodzi również ograniczenie dostawcy "main" do miejsc przeznaczonych na modele pomocnicze, kompresję i modele zapasowe. 

  5. Nous Research, „Migracja z OpenClaw” w przewodnikach Hermes Agent. Źródło procesu migracji z OpenClaw do Hermes. 

  6. Nous Research, „Dokumentacja poleceń CLI” w dokumentacji referencyjnej Hermes Agent. Główne źródło informacji o wszystkich poleceniach najwyższego poziomu CLI opisanych w tym artykule, w tym hermes chat, hermes model, hermes gateway, hermes setup, hermes auth, hermes status, hermes cron, hermes webhook, hermes doctor, hermes dump, hermes logs, hermes config, hermes pairing, hermes skills, hermes honcho, hermes memory, hermes acp, hermes mcp, hermes plugins, hermes tools, hermes sessions, hermes insights, hermes claw, hermes profile, hermes completion, hermes update i hermes uninstall. Z tej strony pochodzą wszystkie użyte w tym artykule flagi podpoleceń, opisy opcji, zasady działania puli danych uwierzytelniających, składnia filtrowania logów, flagi migracji z OpenClaw, polecenia zarządzania profile oraz polecenia instalowania usług. 

  7. Nous Research, „Instalacja” w przewodniku wprowadzającym do Hermes Agent. Główne źródło jednolinijkowego polecenia instalacyjnego, opisu działania instalatora (wymagania wstępne, obsługiwane platformy, automatyczne wykrywanie Termux, wymagania dotyczące Windows/WSL2), tabeli opcjonalnych dodatków, instrukcji instalacji ręcznej oraz poleceń weryfikacyjnych. 

  8. Nous Research, „Dokumentacja poleceń CLI” — w szczególności sekcja hermes dump, opisująca format danych wyjściowych polecenia (nagłówek, środowisko, tożsamość, model, terminal, klucze API, funkcje, usługi, obciążenie i nadpisania konfiguracji) oraz jego przeznaczenie do udostępniania informacji diagnostycznych. 

  9. Nous Research, „Dokumentacja poleceń ukośnikowych” w dokumentacji referencyjnej Hermes Agent. Główne źródło informacji o wszystkich poleceniach ukośnikowych wymienionych w tym artykule, architekturze COMMAND_REGISTRY, podziale na CLI i komunikatory, dynamicznych poleceniach ukośnikowych skill, szybkich poleceniach w config.yaml, działaniu dopasowywania prefiksów oraz poleceniach dostępnych wyłącznie w komunikatorach (/status, /sethome, /approve, /deny, /update, /commands). 

  10. Nous Research, „Narzędzia i toolset” w podręczniku użytkownika Hermes Agent. Główne źródło przeglądu kategorii narzędzi, poleceń służących do korzystania z toolset, informacji o sześciu backendach terminalowych (lokalny, docker, ssh, singularity, modal, daytona), konfiguracji kontenerów (cpu, pamięć, dysk, trwałość), zabezpieczania kontenerów, zarządzania procesami w tle API oraz obsługi sudo. 

  11. Nous Research, „System skill” w podręczniku użytkownika Hermes Agent. Główne źródło informacji o stopniowym ujawnianiu, formacie SKILL.md, skill właściwych dla poszczególnych platform, aktywacji warunkowej (fallback_for_toolsets, requires_toolsets, fallback_for_tools, requires_tools), zarządzaniu skill przez agenta za pomocą skill_manage, poleceniach centrum skill i liście źródeł (official, skills-sh, well-known, github, clawhub, claude-marketplace, lobehub), skanowaniu zabezpieczeń, poziomach zaufania oraz zewnętrznych katalogach skill. 

  12. Nous Research, „Pamięć trwała” w podręczniku użytkownika Hermes Agent. Główne źródło informacji o limitach znaków w MEMORY.md / USER.md, wzorcu niezmiennego obrazu stanu, działaniach narzędzia pamięci (add, replace, remove), danych, które należy zapisywać lub pomijać, porównaniu pamięci z wyszukiwaniem sesji oraz liście ośmiu zewnętrznych dostawców pamięci (Honcho, OpenViking, Mem0, Hindsight, Holographic, RetainDB, ByteRover, Supermemory). 

  13. Nous Research, „Osobowość i SOUL.md” w podręczniku użytkownika Hermes Agent. Główne źródło informacji o działaniu SOUL.md (znajduje się w HERMES_HOME, nigdy nie jest nadpisywany, zajmuje miejsce nr 1 w systemowym prompcie i przed dołączeniem jest skanowany pod kątem bezpieczeństwa), różnicach między SOUL.md a AGENTS.md, liście wbudowanych osobowości (14 osobowości od helpful do hype), niestandardowych osobowościach w config.yaml, wzorcu nakładki /personality oraz pełnej kolejności składania stosu promptów. 

  14. Nous Research, „Korzystanie z MCP w Hermes” oraz dokumentacja konfiguracji MCP w przewodnikach i dokumentacji referencyjnej Hermes Agent. Źródło formatu konfiguracji mcp_servers: w config.yaml z polami command, args i env

  15. Informacje o wydaniu Hermes Agent v0.8.0. 8 kwietnia 2026. Automatyczne powiadomienia o procesach w tle, bezpłatny MiMo v2 Pro w Nous Portal, przełączanie /model na żywo między platformami, natywny dostawca Google AI Studio, Qwen OAuth, limity czasu oparte na nieaktywności, przyciski zatwierdzania w Slack/Telegram, MCP OAuth 2.1 PKCE, scentralizowane rejestrowanie logów, rozbudowa systemu pluginów. 

  16. Informacje o wydaniu Hermes Agent v0.9.0. 13 kwietnia 2026. Lokalny panel internetowy, tryb szybki (/fast), iMessage przez BlueBubbles, WeChat + WeCom, Termux/Android, monitorowanie procesów w tle (watch_patterns), natywni dostawcy xAI + Xiaomi MiMo, wymienny context engine, ujednolicona obsługa proxy, wzmocnienie zabezpieczeń (poprawki dotyczące path traversal, shell injection, SSRF i RCE), hermes backup/hermes import, /debug + hermes debug share, 16 obsługiwanych platform. 487 commitów, 269 scalonych PR-ów, 24 współtwórców. 

  17. Informacje o wydaniu Hermes Agent v0.12.0. 30 kwietnia 2026. „Wydanie Curator”. Autonomiczny działający w tle Curator, który ocenia, porządkuje i konsoliduje bibliotekę skill w domyślnym 7-dniowym cyklu uruchamianym przez mechanizm cron usługi gateway. Ulepszona pętla samodoskonalenia: ocenianie na podstawie kryteriów, preferowanie aktywnych aktualizacji, prawidłowe dziedziczenie środowiska wykonawczego oraz ograniczone toolset obejmujące wyłącznie pamięć i skill. Czterej nowi dostawcy inferencji: GMI Cloud, Azure AI Foundry, MiniMax OAuth, Tencent Tokenhub. LM Studio uzyskało status w pełni obsługiwanego rozwiązania. Zdalne manifesty katalogów modeli aktualizują się automatycznie bez konieczności publikowania nowych wydań. Dwie nowe platformy komunikacyjne: Microsoft Teams (19., za pośrednictwem modułowej architektury gateway) oraz Tencent Yuanbao (18., natywna obsługa tekstu i multimediów). Natywna integracja ze Spotify za pośrednictwem PKCE OAuth wraz z dołączonym skill; plugin Google Meet do połączeń i transkrypcji; Piper jako lokalny dostawca TTS. ComfyUI v5 + TouchDesigner-MCP dołączane domyślnie. Nowe skill: Humanizer, claude-design, design-md, airtable. CLI: tryb jednorazowy hermes -z, kontrola wstępna hermes update --check, polecenie ukośnikowe /reload-skills, modułowe style wskaźnika zajętości. Czas zimnego uruchomienia TUI skrócono o około 57% dzięki leniwej inicjalizacji. Bezpieczeństwo: redagowanie sekretów domyślnie wyłączone; bezwzględna lista blokad dla poleceń powodujących nieodwracalne skutki. Statystyki od wersji v0.11.0: 1 096 commitów, 550 scalonych PR-ów, 213 współtwórców ze społeczności. Zobacz również: tag wydania v2026.4.30

  18. Informacje o wydaniu Hermes Agent v0.13.0. 7 maja 2026. „Wydanie Tenacity”. Tablica Kanban dla wielu agentów z pulsem, odzyskiwaniem zadań, wykrywaniem procesów zombie, mechanizmem zapobiegającym halucynacjom, ustawieniem max_retries dla każdego zadania oraz obsługą tablic dla wielu projektów. Polecenie ukośnikowe /goal do blokowania celu między turami (podstawowy mechanizm pętli Ralph) z konfigurowalnym limitem tur. Narzędzie video_analyze, wykorzystujące w pierwszej kolejności Gemini i zapewniające rozszerzalność zgodną z innymi rozwiązaniami multimodalnymi. Dostawca TTS xAI Custom Voices z klonowaniem głosu. Internacjonalizacja obejmująca 7 języków: zh-Hans, ja, de, es, fr, uk, tr (CLI + komunikaty gateway; dokumentacja wyłącznie w zh-Hans). Google Chat jako 20. platforma komunikacyjna, obsługiwana za pośrednictwem modułowego wzorca adaptera z ogólnymi hookami pluginów env_enablement_fn / cron_deliver_env_var; IRC i Microsoft Teams przeniesiono do tego samego wzorca. ProviderProfile ABC + plugins/model-providers/ do obsługi modułowych dostawców zewnętrznych. Automatyczne wznawianie sesji po ponownym uruchomieniu gateway, wykonaniu /update oraz przeładowaniu plików źródłowych. Checkpoint v2 przepisane z wykorzystaniem jednego magazynu, z rzeczywistym porządkowaniem, zabezpieczeniami dotyczącymi miejsca na dysku i bez osieroconych repozytoriów pomocniczych. Usunięto osiem luk bezpieczeństwa P0: domyślnie włączone redagowanie sekretów, obejście ograniczeń wiadomości prywatnych między serwerami Discord (CVSS 8.1, listy dozwolonych ról ograniczone do serwera), domyślne odrzucanie wiadomości od nieznajomych w WhatsApp + brak odpowiedzi w czacie z samym sobą, błąd TOCTOU podczas zapisywania danych uwierzytelniających MCP OAuth, błąd TOCTOU dotyczący auth.json w mechanizmach zapisu danych uwierzytelniających CLI, podstawowe zabezpieczenie przed SSRF do metadanych chmurowych przeglądarki w routingu hybrydowym, skanowanie przez cron złożonych promptów (w tym zawartości skill) pod kątem wstrzykiwania promptów, redagowanie zawartości logów hermes debug share podczas przesyłania. Inne istotne elementy: lintowanie po zapisie dla Python/JSON/YAML/TOML, tryb watchdog no_agent w cron przeznaczony wyłącznie dla skryptów, listy dozwolonych elementów platformy w Slack/Telegram/Mattermost/Matrix/DingTalk, usprawnienia MCP (transport SSE, przekazywanie OAuth, wyniki obrazowe jako znaczniki MEDIA). Statystyki od wersji v0.12.0: 864 commity, 588 scalonych PR-ów, 829 zmienionych plików, 295 współtwórców ze społeczności, 282 zamknięte zgłoszenia (13 P0, 36 P1). 

  19. Informacje o wydaniu Hermes Agent v0.14.0. 16 maja 2026. „Wydanie Foundation”. Od wersji v0.13.0: 808 commitów, 633 scalone PR-y, 1 393 zmienione pliki, 165 061 dodanych wierszy, 545 zamkniętych zgłoszeń (12 P0, 50 P1) oraz 215 współtwórców ze społeczności. Dodano SuperGrok OAuth z grok-4.3 i kontekstem 1M, hermes proxy, x_search, pakiety PyPI, leniwe zależności, współdzieloną między sesjami pamięć podręczną promptów Claude przechowywaną przez 1 godz., uruchamianie szybsze o około 19 s, wywołania CDP przeglądarki szybsze 180-krotnie, LINE i SimpleX Chat zwiększające liczbę platform komunikacyjnych do 22, /handoff, natywne przyciski doprecyzowania, uzupełnianie historii Discord, analizę surowych pikseli vision_analyze, stopkę weryfikującą modyfikacje plików w każdej turze, diagnostykę semantyczną LSP, ujednolicone video_generate, computer_use sterownika cua-driver, łącza OSC8, obsługę Zed ACP Registry, router OpenRouter Pareto Code, NovitaAI, środowisko wykonawcze serwera aplikacji Codex, huggingface/skills, ctx.llm pluginu, tool_override, wyszukiwanie Brave/DDGS, wzmocnione zabezpieczenia przed niebezpiecznymi poleceniami, /subgoal, zmianę nazwy Qwen Cloud, natywną wersję beta dla Windows, łącznie 16 ustawień regionalnych oraz szeroko zakrojone aktualizacje dokumentacji i testów. 

  20. Informacje o wydaniu Hermes Agent v0.16.0, „The Surface Release”, tag v2026.6.5, opublikowane 2026-06-06T00:55:58Z (data tagu wydania: 5 czerwca 2026); najnowsze na 2026-06-08. Nowa natywna aplikacja Hermes Desktop (Electron, macOS/Linux/Windows; połączenie ze zdalnym gateway przez bezpieczne WebSocket z użyciem OAuth lub nazwy użytkownika i hasła; osobne hosty zdalne dla każdego profile; międzyprofilowe odnośniki @session; interfejs w uproszczonym języku chińskim dzięki typowanemu i18n, display.language). Panel internetowy rozbudowano do pełnego panelu administracyjnego (przełączniki katalogu MCP, zarządzanie poświadczeniami, tworzenie webhooków/hooków, konfiguracja pamięci, elementy sterujące gateway, strona System z kontrolą przed aktualizacją i funkcją Debug Share, strona Channels; wymienne mechanizmy uwierzytelniania, w tym samodzielnie hostowane OIDC oraz hermes dashboard register). Nowe polecenia: /undo [N], konfigurowalny domyślny interfejs (cli/tui, --cli), /model w TUI wraz z nakładką Sessions, hermes portal, hermes prompt-size, hermes sessions optimize. Nowe modele: deepseek-v4-flash, MiniMax-M3 (kontekst 1M), qwen3.7-plus, gemini-3.5-flash; xAI Grok OAuth; selektor z wyszukiwaniem przybliżonym; odświeżanie katalogu co godzinę. Skills: odchudzony zestaw domyślny, bramka trafności environments:, domyślnie zaufane źródło NVIDIA/skills, progresywne ujawnianie narzędzi, poprawka błędnego powodzenia MCP bez OAuth. Bezpieczeństwo: przypięcie Starlette do wersji ≥1.0.1 ze względu na CVE-2026-48710 (BadHost), kontrole SSRF przeniesione poza pętlę zdarzeń, usuwanie tokenu bearer Bedrock ze środowiska podprocesu, zabezpieczenie odczytu bws_cache.json, dodanie docker restart/stop/kill do wzorców niebezpiecznych poleceń, oczyszczanie niewidocznych znaków Unicode; zamknięto 2 zgłoszenia P0 i 62 zgłoszenia P1 (16 oznaczonych jako związane z bezpieczeństwem). Pominięto marketingową narrację informacji o wydaniu (liczby PR/commitów, „none of this existed a week ago”); odnotowano wyłącznie konkretne fakty dotyczące funkcji i wersji powiązane z tym tagiem. Weryfikacja w bieżącej sesji: 8 czerwca 2026. 

  21. Informacje o wydaniu Hermes Agent v0.17.0, „The Reach Release”, tag v2026.6.19, 19 czerwca 2026; najnowsze na 2026-06-21. Komunikatory: iMessage przez Photon Spectrum (OAuth z kodem urządzenia, hermes photon login, bez pośredniczącego komputera Mac); oficjalny adapter API WhatsApp Business Cloud (zastępuje proces pomostowy); grupy SimpleX, natywne załączniki, grupowanie tekstu i automatyczna akceptacja; dołączona wtyczka platformowa Raft. Modele/dostawcy: z-ai/glm-5.2 (kontekst 1M), anthropic/claude-fable-5, laguna-m.1, nemotron-3-ultra, grok-composer-2.5-fast (xAI OAuth, kontekst 200k); domyślny model xAI → grok-build-0.1; modele adaptacyjne Anthropic korzystają z nowoczesnego kontraktu rozumowania (bez pola reasoning). CLI/polecenia ukośnikowe: /version, /billing, hermes photon login, hermes curator run --consolidate (opcjonalne), graficzny interfejs hermes model, klonowanie profile. Desktop: okna obserwacji subagentów działających w tle (delegate_task(background=true)), selektor modelu Composer, skróty z możliwością zmiany przypisania, natywne powiadomienia systemowe, wersje robocze dla poszczególnych wątków, motywy z VS Code Marketplace, interfejs w języku japońskim i tradycyjnym chińskim. Dashboard: pełny kreator profile, globalny przełącznik profile, przebudowane Skills Hub ze skanowaniem bezpieczeństwa, Automation Blueprints, bezpieczne logowanie (401 za OAuth). Skills/narzędzia: edycja obrazu na podstawie obrazu za pomocą image_generate u różnych dostawców, atomowe operacje wsadowe operations narzędzia memory, skill równoległego przeglądu simplify-code, logiczne write_approval zastępuje write_mode. Architektura: subagenty działające w tle (uchwyt jest zwracany natychmiast, a wynik ponownie trafia do rozmowy jako kolejna tura), obsługa pozyskiwania danych MCP do potwierdzania w trakcie wywołania narzędzia, narzędzia MCP dołączające z opóźnieniem są udostępniane między turami, wymienny CronScheduler wraz z zarządzanym cronem Chronos, zakres Managed (/etc/hermes przypięte przez administratora), przekaźnik Gateway-Gateway. Bezpieczeństwo: usunięto możliwość obejścia listy zabronionych sekwencji ucieczki powłoki, wprowadzono bezpieczne odrzucanie w razie braku modułu zatwierdzania oraz dla adapterów gateway z własnymi zasadami, oczyszczono środowisko skryptów zadań cron, utajniono sekrety w zrzutach debugowania, ukryto metadane hosta w publicznym statusie, dodano wykrywanie wzorców eksfiltracji w MCP stdio oraz aktualizacje urllib3 i PyJWT usuwające podatności CVE. Pominięto marketingową narrację wydania (liczby commitów/PR). Weryfikacja w bieżącej sesji: 21 czerwca 2026. 

  22. Informacje o wydaniu Hermes Agent v0.18.0 (tag v2026.7.1), 1 lipca 2026 — „The Judgment Release”. Przegląd najważniejszych zaległości (zamknięto wszystkie zgłoszenia P0/P1, około 692 pozycji w ciągu 12 dni); Mixture-of-Agents dostępne jako pełnoprawny model we wszystkich interfejsach, z kompletnym wynikiem każdego modelu referencyjnego wyświetlanym w osobnym, opisanym bloku oraz strumieniowaniem odpowiedzi na żywo; kontrakty ukończenia dla /goal (agent weryfikuje własną pracę, uruchamiając testy projektu); polecenie /learn (umożliwia przekształcenie dowolnego elementu w skill wielokrotnego użytku na podstawie opisu, z automatycznym zachowaniem zgodności z CONTRIBUTING.md); /journey — wizualna oś czasu pamięci/skill z możliwością edycji oraz graf pamięci w aplikacji desktopowej; równoległe delegowanie zadań do subagentów działających w tle (wiele jednocześnie wykonywanych zadań); Desktop Projects (model projekt/repo/lane); gateway skalujący się do zera z koordynowanym wygaszaniem; obsługa Google Vertex AI (Gemini przez konta usług GCP, automatyczne odświeżanie tokenu OAuth2); polecenie /prompt korzystające z $EDITOR. Weryfikacja w bieżącej sesji: 1 lipca 2026 (PST) na stronie wydań GitHub; v0.18.0 jest najnowszym wydaniem. 

  23. Informacje o wydaniu Hermes Agent v0.20.3 (tag v2026.8.16.2, deklarowana data wydania: 16 sierpnia, opublikowane 17 sierpnia 2026) oraz informacje o wydaniu v0.20.4 (tag v2026.8.18, 18 sierpnia 2026); oba pobrano przez API GitHub 20 sierpnia 2026 (prerelease: false). Dosłownie z v0.20.3: „migracja SDK MCP 2.x i obsługa bezstanowego protokołu z 2026-07-28, dołączona wtyczka Bot Mode (hermes-bots) z podstawowym protokołem współpracy członków zespołu, wtyczka dostawcy CommandCode, wzmocnienie własności środowiska wykonawczego Python podprocesów (izolacja PYTHONHOME/PYTHONPATH), kontrakty środowiska wykonawczego Cua Driver 0.20 do obsługi komputera”. Dosłownie z v0.20.4: „prace nad efektem szkła/przezroczystości w aplikacji desktopowej (matowe szkło, selektor szronienia, wstępny wybór w macOS), panel boczny z kartami SESSIONS|BOTS i możliwością ukrywania/pokazywania poszczególnych botów, … doradcze skanowanie NVIDIA SkillEvaluator Tier 1 podczas instalowania skill (kontrola licencji i bezpieczeństwa)”. Oba wydania: „Pełne, opracowane informacje o wydaniach z tego okresu pojawią się wraz z v0.21.0”. 

  24. Informacje o wydaniu Hermes Agent v0.20.0, „The Herald Release”, tag v2026.8.3, 3 sierpnia 2026, wraz z tagami stabilizacyjnymi v2026.8.13 i v2026.8.16. Dosłownie z informacji o wydaniu: „Node 26 jest wymagany we wszystkich instalatorach oraz procesach naprawy i aktualizacji”; „kanały brew oraz wheel pip/PyPI zostały wycofane (obsługiwane kanały to instalator powłoki / Docker / Nix)”; „domyślny limit iteracji 90 → 500”; „usunięto źródło claude-marketplace”. Minimalną wersję Node niezależnie potwierdzono w kodzie źródłowym instalatora w scripts/install.shNODE_VERSION="26" oraz warunek „Node.js $(node –version) is too old (Hermes requires Node >=26)” — który w komentarzu nagłówkowym dokumentuje również kanoniczne jednowierszowe polecenie curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash. Należy zwrócić uwagę na rozbieżność: strona instalacji w dokumentacji nadal podaje Node v22 i jest nieaktualna względem obu tych źródeł. Poziomy obsługi platform pochodzą ze strony obsługi platform; źródła skills i domyślne taps — ze strony skills; liczbę 28 platform ustalono, wyliczając pozycje w tabeli porównawczej na stronie komunikatorów, która nie podaje oficjalnej łącznej liczby. Wszystkie materiały pobrano i zweryfikowano 2026-08-16. 

  25. Informacje o wydaniu Hermes Agent v0.19.0, „The Quicksilver Release”, tag v2026.7.20, 20 lipca 2026; najnowsze na dzień 21 lipca 2026. Statystyki od wersji v0.18.0: ok. 2 245 commitów, ok. 1 065 scalonych PR-ów, ok. 3 300 zamkniętych zgłoszeń, ponad 450 współtwórców ze społeczności. Najważniejsze usprawnienia wydajności: skrócenie TTFT przy pierwszej turze o ok. 80%, a czasu od zimnego wysłania do przekazania z ok. 4,3 s do ok. 0,9 s w CLI/gateway/TUI/aplikacji desktopowej/cron (PR #59332); domyślne przesyłanie rozumowania na żywo przy włączonym display.show_reasoning oraz renderowanie odpowiedzi token po tokenie (PR #59389); fala ok. 20 PR-ów przyspieszających aplikację desktopową, w tym 14-krotnie szybsze strumieniowanie Markdown; przyrostowe renderowanie Markdown w TUI. Instalacje przez pip/Homebrew oznaczono jako wycofywane i wyświetlają już tylko ostrzeżenie „nieobsługiwana metoda starszego typu”; planowane jest zakończenie publikowania w PyPI/Homebrew (PR #57225). Rozszerzalny interfejs SecretSource z dostawcami Bitwarden i 1Password, odwołaniami op://, obsługą wielu sejfów, deterministyczną kolejnością pierwszeństwa oraz informacją o pochodzeniu każdej zmiennej (PR #59498). Inteligentne zatwierdzanie jako ustawienie domyślne (niezależny recenzent LLM dla każdego oznaczonego polecenia), definiowane przez użytkownika reguły odmowy obowiązujące również w trybie YOLO, /deny <reason> (PR-y #62661, #59164, #54518); ponownie wdrożono eskalację zatwierdzenia przez pre_tool_call w pluginie (PR #60504). Rozliczenia w terminalu za pomocą /subscription i /topup oraz karta rozliczeń w aplikacji desktopowej (PR #51639). Pliki transkrypcji subagentów na żywo i trwałe delegowanie w tle (PR-y #67479, #63494); rejestr zobowiązań dotyczących dostarczenia wyników w state.db (PR #67181); max_async_children wycofano na rzecz ujednoliconych limitów współbieżności delegowania (PR #56955). Routing gateway oparty na profilach, GATEWAY_MULTIPLEX_PROFILES oraz indeks routingu przeniesiony do state.db; sessions.json pozostaje opcjonalną kopią lustrzaną starszego typu (PR-y #64835, #65700, #60589, #59203). Dostawcy/modele: Fireworks AI z natywną obsługą na pozycji nr 2 w selektorze (PR #62593), DeepInfra, Upstage Solar, pełna obsługa GPT-5.6 Sol/Terra/Luna oraz Pro (PR #61616), ogólna dostępność grok-4.5, kimi-k3 (wycofano kimi-k2.x), pełna integracja Claude Sonnet 5, ustawienie enabled: false dla poszczególnych dostawców oraz excluded_providers (PR #67971); poziomy intensywności rozumowania max/ultra z nadpisaniami dla poszczególnych modeli i slotów MoA oraz ograniczonym do sesji poleceniem /reasoning (PR-y #62650, #64458). CLI/MCP: eksport z hermes sessions export do Markdown/Quarto/HTML/formatu zawierającego wyłącznie prompt/śladu HF z opcją --redact (PR #60186), /model --once (PR #67113), zagnieżdżone wywołania slash-skill (PR #57987), --safe-mode, hermes config get/unset (PR #65540), prawdziwie bezinterfejsowy hermes serve (PR #55923), nazewnictwo MCP mcp__server__tool (PR #52750). Pominięto marketingową narrację wydania; elementów wycofanych w okresie objętym zestawieniem (zapora ruchu wychodzącego iron-proxy, skill dynamic-workflow, działania dostawcy pamięci) celowo nie odnotowano jako wydanych. Weryfikacja w bieżącej sesji: 21 lipca 2026. 

  26. Tag wydania Hermes Agent v0.18.1 oraz tag wydania v0.18.2, 7–8 lipca 2026. Zbiorcze poprawki infrastruktury w linii v0.18; zasadnicza poprawka w wersji v0.18.2 usuwa przypięcie WhatsApp Baileys do wersji 7.0.0-rc13, aby zapewnić niezawodne kompilacje Docker. Oba zestawy poprawek uwzględniono i w pełni udokumentowano w informacjach o wydaniu v0.19.0. 

  27. Informacje o wydaniu Hermes Agent v0.15.1 oraz informacje o wydaniu Hermes Agent v0.15.2. v0.15.1 (29 maja 2026, 01:12 UTC) to wydana tego samego dnia poprawka Velocity: usunięto pętlę ponownego ładowania dashboardu po błędzie 401 w trybie loopback; Docker wymaga teraz jawnego ustawienia HERMES_DASHBOARD_INSECURE=1; samodzielne polecenia MCP (npx, npm, node) są rozpoznawane w kontenerach Docker; przywrócono etykiety źródeł i boczny pasek kategorii na stronie Skills; procesy robocze Kanban reagują na SIGTERM; katalog Skills.sh powiększył się z 858 do 19 932 pozycji dzięki mapie witryny. 28 commitów, 21 scalonych PR-ów, 9 współtwórców. v0.15.2 (29 maja 2026, 13:37 UTC) to poprawka dotycząca wyłącznie pakietowania, która dołącza manifesty plugin.yaml do dystrybucji wheel i sdist, dzięki czemu instalacje z PyPI działają bez bocznego ładowania kodu źródłowego. 4 współtwórców. 

  28. Informacje o wydaniu Hermes Agent v0.15.0 oraz strona wydań Hermes Agent. „The Velocity release”, tag v2026.5.28. Statystyki: 1 302 commity, 747 scalonych PR-ów, 321 współtwórców ze społeczności. Refaktoryzacja zmniejsza run_agent.py o 76% (z 16 083 do 3 821 wierszy rozdzielonych między 14 modułów). Dodano wieloagentową platformę Kanban (automatyczny podział zadań, topologia roju, nadpisywanie modelu dla poszczególnych zadań, zadania zaplanowane, zarządzanie drzewami roboczymi). Przeprojektowane session_search działa 4 500 razy szybciej i nie wymaga już zależności LLM. Ochrona przed promptware zabezpiecza przed wstrzykiwaniem promptów klasy Brainworm w trzech krytycznych punktach kontroli bezpieczeństwa. Integracja z Bitwarden Secrets Manager zastępuje wiele kluczy API poszczególnych dostawców jednym tokenem inicjalizacyjnym. Pakiety skill umożliwiają ładowanie wielu skill za pomocą jednego polecenia ukośnikowego. Orkiestrator sesji TUI pozwala zarządzać wieloma sesjami w jednym oknie terminala. Obsługa Krea 2 (Medium/Large) i pluginu FAL do generowania obrazów. Kolejna runda integracji xAI dodaje plugin do wyszukiwania w internecie, nadrzędne OAuth, wykrywanie wycofanych modeli oraz naturalne pauzy TTS w generowanym głosie. Wydanie poprawkowe wskazane w GitHub rozwiązuje problemy z pętlą ponownego ładowania dashboardu po błędzie 401, wymaganiem jawnego ustawienia zmiennej środowiskowej HERMES_DASHBOARD_INSECURE=1 dla opcji --insecure w Docker, rozpoznawaniem samodzielnych poleceń MCP (npx, npm, node) w Docker, renderowaniem strony Skills, obsługą SIGTERM przez procesy robocze Kanban oraz pełnym katalogiem Skills obejmującym 19 932 pozycje dzięki mapie witryny; zawiera także niewielki zestaw zmian dotyczących dostarczania plików .md, bezpieczeństwa sond gateway, redagowania adresów URL, obsługi obrazu przez procesy robocze Kanban i domyślnych ustawień obserwacji retrospektywnych. 

  29. Informacje o wydaniu Hermes Agent v0.11.0. 23 kwietnia 2026. „The Interface release” — pełna przebudowa interaktywnego CLI z użyciem React/Ink i backendu Python JSON-RPC (tui_gateway); rozszerzalna architektura transportu (agent/transports/); natywna obsługa AWS Bedrock przez Converse API; pięć nowych ścieżek wnioskowania (NVIDIA NIM, Arcee AI, Step Plan, Google Gemini CLI OAuth, Vercel ai-gateway); GPT-5.5 przez Codex OAuth; QQBot jako 17. platforma komunikacyjna z konfiguracją przez skanowanie kodu QR; rozszerzony zakres pluginów (polecenia ukośnikowe, kierowanie wywołań narzędzi, blokowanie wykonania, przekształcanie wyników); /steer <prompt> do korygowania działania agenta w trakcie wykonywania — kontekst jest wstrzykiwany po następnym wywołaniu narzędzia bez naruszania pamięci podręcznej promptu; hooki powłoki obsługujące zdarzenia cyklu życia bez pluginów Python; tryb bezpośredniego dostarczania webhooków, który przekazuje payloady wprost do czatu na danej platformie; inteligentniejsze delegowanie z rolami orkiestratora, konfigurowalną głębokością tworzenia agentów i koordynacją plików; system pluginów dashboardu, przełączanie motywu na żywo, i18n i responsywność na urządzeniach mobilnych. Statystyki od wersji v0.9.0: 1 556 commitów · 761 scalonych PR-ów · 1 314 zmienionych plików · 224 174 dodane wiersze · 29 współtwórców ze społeczności. Zobacz również: tag wydania Hermes Agent v0.11.0 w GitHub

  30. Hermes Agent v0.10.0 Release Notes. 16 kwietnia 2026. „Wydanie Tool Gateway”. Integracja z Nous Tool Gateway dla płatnych subskrybentów Nous Portal — zarządzany dostęp do wyszukiwania internetowego Firecrawl, generowania obrazów FAL / FLUX 2 Pro, OpenAI TTS oraz automatyzacji przeglądarki Browser Use bez dodatkowych kluczy API. Aktywacja osobno dla każdego narzędzia za pomocą nowego pola konfiguracji use_gateway. Jeśli skonfigurowano zarówno gateway, jak i bezpośrednie klucze API, środowisko uruchomieniowe preferuje gateway. Pełna integracja z hermes tools i hermes status. Zastępuje przestarzałą zmienną środowiskową HERMES_ENABLE_NOUS_MANAGED_TOOLS. Implementacja autorstwa @jquesnelle (emozilla). CLI Hermes Agent pozostaje objęty licencją MIT i jest w pełni otwartoźródłowy; gateway stanowi integrację z istniejącym produktem subskrypcyjnym Portal, a nie płatną blokadę dostępu do CLI. Zob. również: Nous Portal — ceny subskrypcji i rejestracja. 

NORMAL hermes.md EOF