Hermes Agent: kompendium praktyka (2026)
# Kompendium praktyka poświęcone Hermes Agent — samodoskonalącemu się agentowi AI typu open source od Nous Research: uwierzytelnianie u dostawców i OAuth, pliki konfiguracyjne, system umiejętności oraz uruchamianie go jako wieloplatformowej bramy komunikacyjnej.
W skrócie: Hermes Agent to samodoskonalący się agent AI typu open source od Nous Research. Działa jako CLI oraz wieloplatformowy gateway komunikacyjny, przechowuje na dysku trwałą tożsamość i pamięć, gromadzi skille doskonalące się w miarę używania oraz współpracuje z dowolnym dostawcą LLM zgodnym z OpenAI — Nous Portal, OpenRouter, Anthropic, GitHub Copilot, z.ai, Kimi, MiniMax, DeepSeek, Qwen Cloud, Hugging Face, Google, xAI/SuperGrok lub własnym, samodzielnie hostowanym endpointem.1219 Od wersji v0.14.0 (16 maja 2026) Hermes oferuje OAuth SuperGrok z kontekstem 1M w grok-4.3, zgodny z OpenAI lokalny serwer proxy dla dostawców OAuth (
hermes proxy), pełnoprawnex_search, obsługę instalacji z PyPI (od wersji v0.19.0 uznaną za przestarzałą — wspieraną metodą jest instalator jednowierszowy), leniwe instalowanie zależności, 22 platformy komunikacyjne, w tym LINE i SimpleX Chat,/handoff, diagnostykę semantyczną LSP po zapisach, ujednoliconevideo_generate,computer_useza pośrednictwem cua-driver dla dostawców innych niż Anthropic, natywną wersję beta dla Windows oraz rozwiązania 12 problemów P0 i 50 problemów P1.19 Najtrudniejszym elementem dla większości nowych użytkowników jest uwierzytelnianie u dostawcy: Hermes obsługuje około 20 pełnoprawnych dostawców oraz niestandardowe endpointy, a także trzy odrębne ścieżki uwierzytelniania (klucz API w.env, OAuth przezhermes modelalbo niestandardowy endpoint wconfig.yaml). Najpierw należy poznać model uwierzytelniania — wszystko inne zależy od tego, który dostawca zostanie wybrany.
Hermes Agent działa jako kompletne środowisko uruchomieniowe agenta, a nie nakładka na czat. Odczytuje system plików, wykonuje polecenia w izolowanych backendach, pobiera dane z internetu, uruchamia subagentów i zaplanowane zadania cron, komunikuje się z Telegram/Discord/Slack/WhatsApp/Signal/Email z poziomu jednego procesu gateway oraz tworzy własne skille na podstawie zdobytych doświadczeń.1 CLI to terminalowy interfejs użytkownika zbudowany na pętli konwersacji w run_agent.py; gateway jest długotrwale działającym procesem, który przekazuje wiadomości z platform komunikacyjnych przez tę samą pętlę konwersacji.3
Różnica między okazjonalnym a eksperckim korzystaniem z Hermes sprowadza się do pięciu systemów. Ich opanowanie sprawia, że Hermes zwielokrotnia możliwości:
- Wybór dostawcy: sposób mapowania przepływów uwierzytelniania na wywołania API
- Hierarchia konfiguracji:
config.yaml+.env+auth.json+SOUL.md+AGENTS.md - System narzędzi i toolsetów: możliwości agenta ograniczane osobno dla każdej platformy
- System skilli: pamięć proceduralna tworzona i rozwijana przez agenta
- Gateway + cron + profile: uruchamianie Hermes tam, gdzie na co dzień korzysta się z komunikatorów, a nie tylko tam, gdzie aktualnie się przebywa
Najważniejsze informacje
- Uwierzytelnianie u dostawcy obejmuje trzy ścieżki, a nie jedną. Klucz API w
.env, OAuth przezhermes model/hermes authalbo niestandardowy endpoint wconfig.yaml. Należy wybrać ścieżkę odpowiadającą dostawcy, a nie tę, która wydaje się najbardziej znajoma. - Do zmiany dostawcy wystarczy jedno polecenie.
hermes modelinteraktywnie przeprowadza przez konfigurację każdego obsługiwanego dostawcy, w tym logowania OAuth, a/model provider:modelpozwala zmienić model w trakcie sesji bez utraty historii.2 - Konfigurację użytkownik edytuje w dwóch plikach.
~/.hermes/config.yamlzawiera ustawienia, a~/.hermes/.env— dane tajne. Plikamiauth.json,SOUL.md,MEMORY.mdoraz folderemskills/zarządza bezpośrednio Hermes —SOUL.mdmożna edytować ręcznie, natomiast pozostałe elementy modyfikuje sam agent.4 - Hermes jest następcą OpenClaw. Podczas migracji
hermes claw migrateautomatycznie importuje ponad 30 kategorii stanu.5 - Jakość działania zależy od modelu pomocniczego. Analiza obrazów, podsumowywanie treści z internetu, kompresja i zapis pamięci korzystają z osobnego pomocniczego LLM. Domyślnie jest nim Gemini Flash wybierany automatycznie (OpenRouter → Nous → Codex) — jeśli żaden z tych dostawców nie został skonfigurowany, funkcje te po cichu działają w ograniczonym zakresie, dopóki sloty pomocnicze nie zostaną skierowane do głównego dostawcy.4
Co zmienia v0.14
W wersji v0.14.0 nacisk położono nie tyle na jedną przełomową funkcję, ile na uproszczenie konfiguracji i rozszerzenie środowisk, w których można uruchomić Hermes.19 Najważniejsze zmiany operacyjne:
- Instalacja i uruchamianie są lżejsze.
pip install hermes-agentumożliwia instalację z PyPI, rozbudowane adaptery instalują się leniwie przy pierwszym użyciu, a ścieżka uruchamiania odracza wystarczająco dużo operacji, by skrócić zimny start o około 19 sekund. (Od wersji v0.19.0 instalacje przez pip są uznane za przestarzałe — patrz Instalacja.) - Subskrypcje mogą stać się lokalnymi endpointami API.
hermes proxyprzekształca dostawców korzystających z OAuth, takich jak Claude Pro, ChatGPT Pro i SuperGrok, w zgodny z OpenAI lokalny endpoint dla narzędzi takich jak Codex, Aider, Cline i Continue. - Gateway obsługuje więcej platform. LINE i SimpleX Chat zwiększają ich liczbę do 22, Microsoft Teams działa kompleksowo, domyślnie włączono uzupełnianie historii Discord, a monity
clarifyw Telegram/Discord korzystają teraz z natywnych przycisków. - Lepsza jest weryfikacja podczas zapisu. Po edycji Hermes może przed kolejną turą wyświetlić podsumowanie zmian w plikach wprowadzone w danej turze oraz diagnostykę semantyczną serwera językowego, co przybliża go do pracy agenta opartej na dowodach.
- Rozszerzono narzędzia komputerowe i multimedialne.
computer_usedziała za pośrednictwem cua-driver z dostawcami innymi niż Anthropic,video_generateujednolicono za wymiennymi backendami, avision_analyzeprzesyła nieprzetworzone piksele do modeli, które rzeczywiście potrafią analizować obrazy.
Każda poniższa sekcja opiera się na nadrzędnej dokumentacji dostępnej pod adresem hermes-agent.nousresearch.com/docs oraz drzewie źródłowym w repozytorium github.com/NousResearch/hermes-agent. Każde stwierdzenie dotyczące faktów zawiera przypis wskazujący konkretną stronę nadrzędnej dokumentacji, z której pochodzi.
Wybór ścieżki
| Czego potrzeba | Dokąd przejść |
|---|---|
| Zainstalować Hermes | Instalacja — instalator jednowierszowy lub ręczne kroki |
| Zalogować się u dostawcy | Uwierzytelnianie i dostawcy — sekcja, której Państwo szukają |
| Zmieniać modele w trakcie sesji | Polecenie hermes auth oraz Niestandardowe i samodzielnie hostowane endpointy, gdzie opisano składnię /model |
| Uruchomić lokalny LLM | Niestandardowe i samodzielnie hostowane endpointy — Ollama, vLLM, SGLang, llama.cpp, LM Studio |
| Połączyć platformy komunikacyjne | Gateway komunikacyjny — Telegram, Discord, Slack, WhatsApp, Signal, Google Chat, LINE, SimpleX Chat (łącznie 22) |
| Napisać lub zainstalować skill | System skilli — progresywne ujawnianie informacji + centrum skilli |
| Poznać szczegółowy opis każdego polecenia CLI | Proszę czytać dalej — można też przejść bezpośrednio do Poleceń CLI |
Jak działa Hermes: model mentalny
Struktura Hermes opiera się na jednej pętli konwersacji, którą może wywołać dowolny punkt wejścia. Punktami wejścia są CLI (cli.py), gateway komunikatorów (gateway/run.py), adapter ACP do integracji z edytorem, mechanizm przetwarzania wsadowego oraz serwer API.3 Wszystkie ostatecznie wywołują metodę AIAgent.run_conversation() w pliku run_agent.py, która:
- Buduje prompt systemowy z plików
SOUL.md,MEMORY.md,USER.md, skills, plików kontekstowych i wskazówek dotyczących narzędzi za pośrednictwemprompt_builder.py3 - Ustala dostawcę środowiska wykonawczego za pośrednictwem
runtime_provider.py— na tym etapie wybierane są uwierzytelnianie, bazowy adres URL oraz tryb API3 - Wywołuje dostawcę przy użyciu jednego z trzech trybów API:
chat_completions,codex_responseslubanthropic_messages3 - Przekazuje wszystkie zwrócone wywołania narzędzi do
model_tools.pyi centralnego rejestru narzędzi (tools/registry.py)3 - Powtarza pętlę, dopóki model nie wygeneruje ostatecznej odpowiedzi, po czym zapisuje sesję w bazie SQLite z FTS53
Zrozumienie tej pętli jest istotne, ponieważ każda funkcja — osobowości, pamięć, skills, kompresja i mechanizm awaryjny — wiąże się z jednym z tych etapów. Gdy analizuje się klucz konfiguracji i zastanawia nad jego działaniem, odpowiedź zwykle brzmi: „jest to parametr sterujący etapem 1, 2, 3 lub 4 powyższej pętli”.
Rdzeń niezależny od platformy. Jedna klasa AIAgent obsługuje CLI, gateway, ACP, przetwarzanie wsadowe oraz serwer API. Różnice między platformami znajdują się w punktach wejścia, a nie w samym agencie.3 Dlatego te same polecenia z ukośnikiem działają zarówno w terminalu, jak i w Telegram — są obsługiwane za pośrednictwem wspólnego rejestru COMMAND_REGISTRY w pliku hermes_cli/commands.py.6
Struktura katalogów jest systemem. Hermes przechowuje wszystko w ~/.hermes/ (lub $HERMES_HOME w przypadku profili innych niż domyślny):4
~/.hermes/
├── config.yaml # Settings (model, terminal, TTS, compression, etc.)
├── .env # API keys and secrets
├── auth.json # OAuth provider credentials (Nous Portal, Codex, Anthropic)
├── SOUL.md # Primary agent identity (slot #1 in system prompt)
├── memories/ # Persistent memory (MEMORY.md, USER.md)
├── skills/ # Bundled + agent-created + hub-installed skills
├── cron/ # Scheduled jobs
├── sessions/ # Gateway session state
└── logs/ # agent.log, gateway.log, errors.log (secrets auto-redacted)
Każdy z powyższych plików pełni określoną rolę; ich zakresy się nie pokrywają. Jeśli trzeba ustalić, „gdzie Hermes przechowuje X”, odpowiedzią jest jeden z nich.
Co nowego w wersji 0.19.0 (wydanie Quicksilver)
Nazwa Hermes Agent v0.19.0 (tag v2026.7.20, 20 lipca 2026) nawiązuje do szybkości samego boga posłańców: fundamentem tego wydania jest błyskawiczna responsywność, a czas do wygenerowania pierwszego tokenu w pierwszej turze skrócono o około 80% na każdej platformie. Wokół tego fundamentu skupiają się rozliczenia w terminalu, pobieranie sekretów z menedżerów haseł, domyślnie inteligentne zatwierdzanie, obserwowalne subagents oraz odporne na awarie dostarczanie odpowiedzi. Okres od wersji 0.18.0 jest dotychczas największym w historii projektu: około 2 245 commitów, około 1 065 scalonych PR-ów, około 3 300 zamkniętych zgłoszeń i ponad 450 współtwórców ze społeczności.23
- Około 80% krótszy czas do pierwszego tokenu — wszędzie. Czas od wysłania pierwszego żądania po zimnym starcie do jego przekazania spadł z około 4,3 s do około 0,9 s zarówno w CLI, gateway, TUI, aplikacji komputerowej, jak i cron — wykrywanie możliwości Discord przeniesiono poza ścieżkę krytyczną, test Ollama jest pomijany dla znanych dostawców innych niż Ollama, a z inicjalizacji agenta usunięto operacje blokujące. Zadbano również o odczuwalne opóźnienie: modele rozumujące domyślnie przesyłają teraz swój tok rozumowania na żywo (
display.show_reasoningjest WŁĄCZONE), a pole odpowiedzi jest odświeżane po każdym tokenie, zamiast po każdym wierszu.23 - Fala usprawnień renderowania w aplikacji komputerowej i TUI. Aplikacja komputerowa przeszła obejmującą około 20 PR-ów optymalizację szybkości: 14-krotnie zmniejszono użycie procesora przez moduł dzielący strumieniowy Markdown dzięki przyrostowej analizie bloków, zwirtualizowano różnice w panelu przeglądu, przyspieszono przełączanie sesji w obszernych transkrypcjach oraz wyeliminowano ponowne renderowanie paska bocznego i wierszy narzędzi po każdym tokenie. TUI renderuje teraz strumieniowy Markdown przyrostowo, blok po bloku.23
- Instalacje za pomocą pip i Homebrew są przestarzałe. Obie metody są teraz oznaczone jako „nieobsługiwane starsze instalacje” — ostrzeżenia pojawiają się we wszystkich interfejsach, ale nie blokują działania, a zaprzestanie publikowania w PyPI i Homebrew jest planowane. Obsługiwaną metodą jest instalator jednowierszowy; jeśli instalację wykonano za pomocą pip lub brew, należy już teraz zaplanować migrację.23
- Sekrety mogą pochodzić z menedżera haseł. Nowy, rozszerzalny interfejs
SecretSourcepobiera podczas wczytywania sekrety z Bitwarden i 1Password (odwołaniaop://), umożliwiając jednoczesne korzystanie z wielu sejfów, deterministyczne ustalanie pierwszeństwa, ostrzeżenia o konfliktach oraz śledzenie pochodzenia każdej zmiennej — klucze API nie muszą już znajdować się w zwykłym pliku tekstowym.env. Obsługę przyszłych dostawców sejfów będzie można dodawać w formie pluginów.23 - Inteligentne zatwierdzanie jest teraz domyślne. Gdy Hermes chce uruchomić oznaczone polecenie, zamiast pytać o każde z nich niezależny recenzent LLM dokonuje jego oceny — a każdy werdykt obejmuje wyłącznie to konkretne polecenie. Zdefiniowane przez użytkownika reguły odmowy blokują pasujące polecenia nawet w trybie YOLO,
/deny <reason>przekazuje powód odmowy, aby agent mógł skorygować swoje działanie, natomiast akcja zatwierdzającapre_tool_callpluginu (ponownie wprowadzona wraz z kluczami reguł) kieruje wywołanie narzędzia do zatwierdzenia przez człowieka.23 - Rozliczenia w terminalu:
/subscriptioni/topup. Planem Nous Portal można zarządzać bez opuszczania terminala — sprawdzać plan i pozostały limit, zobaczyć dokładny koszt podwyższenia planu lub termin wejścia w życie jego obniżenia, a następnie zastosować zmianę z możliwością jej cofnięcia. Aplikacja komputerowa otrzymała odpowiadającą temu kartę ustawień rozliczeń.23 - Można obserwować pracę subagents i nigdy nie utracić gotowej odpowiedzi. Wywołania
delegate_taskudostępniają transkrypcje na żywo w plikach, które można śledzić poleceniemtail -fnatychmiast po uruchomieniu subagents — każde wywołanie narzędzia, wynik i strumieniowana odpowiedź trafiają do jednego czytelnego dla człowieka dziennika na każde zadanie potomne. Wyniki delegowania w tle zachowują się po ponownym uruchomieniu, a końcowe odpowiedzi gateway są zapisywane w rejestrze zobowiązań dostarczenia wstate.dbi ponownie dostarczane przy następnym uruchomieniu, jeśli gateway ulegnie awarii podczas wysyłania. Opcja konfiguracjimax_async_childrenjest przestarzała — zastąpiły ją ujednolicone limity współbieżności delegowania.23 - Jeden gateway, wiele profili. Pojedynczy multipleksowany gateway, korzystający ze wspólnego tokenu bota, może kierować określone serwery, kanały lub wątki do różnych profili — każdy z całkowicie odizolowaną konfiguracją, skills, pamięcią i sekretami — z możliwością nadpisania za pomocą
GATEWAY_MULTIPLEX_PROFILES. Indeks routingu przeniesiono dostate.db;sessions.jsonjest teraz opcjonalną kopią zgodności ze starszymi wersjami.23 - Fala nowych dostawców i modeli. Fireworks AI otrzymuje pełnoprawną obsługę (szacowanie kosztów i 2. miejsce na liście wyboru dostawcy), a dołączają do niego DeepInfra i Upstage Solar. Katalogi wzbogacono o GPT-5.6 (Sol/Terra/Luna + Pro, z pełną integracją), grok-4.5 (GA), kimi-k3 (kimi-k2.x wycofano) oraz w pełni zintegrowany Claude Sonnet 5. Flaga
enabled: falsedla poszczególnych dostawców oraz konfiguracjaexcluded_providersusuwają nieużywanych dostawców z list wyboru/modeli procesu rozpoznawania.23 - Intensywność rozumowania staje się regulowanym parametrem. Nowe poziomy intensywności
maxiultratrafiają do wszystkich interfejsów, wraz z nadpisaniami dla poszczególnych modeli w konfiguracji, intensywnością dla poszczególnych miejsc w ustawieniach MoA (doradcy analizują dogłębnie, a syntezator zachowuje szybkość), intensywnością zależną od zadania dla modeli pomocniczych oraz ograniczonym do sesji poleceniem/reasoningw CLI.23 - Interfejsy CLI i MCP.
hermes sessions exportzapisuje dane w formatach Markdown, Quarto, HTML, wyłącznie promptów oraz śladów Hugging Face, z opcjonalnym oczyszczaniem--redact;/model --onceumożliwia jednorazowe nadpisanie modelu na jedną turę; wywołania slash-skill można łączyć (/skill-a /skill-b do XYZ);--safe-modepomaga w rozwiązywaniu problemów;hermes config get/unsetuzupełniają funkcje zarządzania konfiguracją;hermes servestaje się prawdziwym backendem bez interfejsu graficznego; a narzędzia MCP przyjmują konwencję nazewnictwamcp__server__tool.23
W przypadku aktualizacji z wersji 0.18.x dwie zmiany wymagają uwagi w pierwszej kolejności: instalacja za pomocą pip lub Homebrew wyświetla teraz ostrzeżenie o braku obsługi starszej metody (należy przejść na instalator jednowierszowy), a max_async_children jest przestarzałe na rzecz ujednoliconych limitów współbieżności delegowania. Wszystkie pozostałe zmiany mają charakter addytywny — najważniejsze powody aktualizacji to skrócenie opóźnienia pierwszej tury o około 80%, inteligentne zatwierdzanie oraz rejestr dostarczania, dzięki któremu gotowe odpowiedzi są odporne na awarie.
Co nowego w wersji v0.18.0 (wydanie Judgment)
Nazwa Hermes Agent v0.18.0 (tag v2026.7.1, 1 lipca 2026) nawiązuje do osądu: agent weryfikuje własną pracę, zamiast twierdzić, że zakończyła się sukcesem, a proces wnioskowania zespołowego można rzeczywiście prześledzić. Wydanie zamyka również cały rejestr zadań P0/P1 — w ciągu 12 dni rozwiązano około 692 spraw o najwyższym priorytecie.22
- Mixture-of-Agents jako pełnoprawny model. MoA można teraz wybrać tak samo jak każdy inny model we wszystkich interfejsach, a wnioskowanie zespołowe jest widoczne: pełne dane wyjściowe każdego modelu referencyjnego pojawiają się w osobnym, oznaczonym bloku wraz z przesyłaną na żywo odpowiedzią — można obserwować tok rozumowania zespołu zamiast otrzymywać nieprzejrzystą, scaloną odpowiedź.22
- Kontrakty ukończenia dla
/goal. Przed zgłoszeniem realizacji celu agent uruchamia mechanizmy kontrolne projektu, aby zweryfikować własną pracę, zamiast jedynie ogłaszać sukces — stosuje osąd również wobec siebie.22 /learn— przekształcanie dowolnego opisu w skill. Wystarczy opisać proces, aby przekształcić go w skill wielokrotnego użytku; wygenerowane skills automatycznie spełniają konwencje pliku CONTRIBUTING.md w repozytorium.22- Oś czasu
/journey. Wizualna, edytowalna historia pamięci i skills w czasie oraz graf pamięci w aplikacji komputerowej.22 - Równoległe uruchamianie subagentów w tle. Można delegować wiele zadań wykonywanych współbieżnie bez blokowania rozmowy — pojedynczy subagent działający w tle z wersji v0.17.0 zmienia się w całą flotę.22
- Projekty w aplikacji komputerowej. Pełnoprawne projekty programistyczne z modelem organizacyjnym opartym na projekcie, repozytorium i ścieżce pracy.22
- Gateway skalowany do zera. Gateways mogą przechodzić w stan uśpienia podczas bezczynności i koordynować opróżnianie, aby umożliwić płynne wdrożenia — ma to znaczenie dla każdej osoby korzystającej z Hermes jako stale działającej usługi.22
- Obsługa Google Vertex AI. Dostęp do Gemini za pośrednictwem kont usług GCP z automatycznym odświeżaniem tokenu OAuth2 dołącza do katalogu dostawców.22
- Polecenie edytora
/prompt. Otwiera$EDITOR, aby umożliwić tworzenie wielowierszowych promptów bez zmagania się z pojedynczym wierszem wprowadzania.22
Przejście z wersji v0.17.x nie powoduje żadnych zmian niezgodnych wstecznie w CLI. Najważniejszymi powodami aktualizacji są kontrakty ukończenia (cele, które weryfikują własną realizację), pełnoprawny MoA z możliwymi do prześledzenia zespołami modeli oraz /learn do zapisywania procesów jako skills.
Co nowego w wersji v0.17.0 (wydanie Reach)
Nazwa Hermes Agent v0.17.0 (tag v2026.6.19, 19 czerwca 2026) nawiązuje do poszerzonego zasięgu agenta — nowych kanałów komunikacji, nowych dostawców modeli oraz większych możliwości sterowania z aplikacji komputerowej i panelu. Jest to rozszerzenie wersji v0.16.x; powierzchnia CLI pozostaje bez zmian.21
- Nowe kanały komunikacji. iMessage działa teraz bez przekaźnika na komputerze Mac dzięki Photon Spectrum (OAuth z kodem urządzenia,
hermes photon login); WhatsApp Business Cloud API to oficjalny adapter Meta, który eliminuje konieczność korzystania z procesu pomostowego; SimpleX zyskuje grupy, natywne załączniki, grupowanie tekstu oraz automatyczne akceptowanie; natomiast Raft dołącza jako wbudowana wtyczka platformowa z prywatnym z założenia projektem kanału wybudzania.21 - Nowe modele i dostawcy. Do katalogu dodano
z-ai/glm-5.2(kontekst 1M),anthropic/claude-fable-5,laguna-m.1,nemotron-3-ultraorazgrok-composer-2.5-fast(model Cursor udostępniany przez xAI OAuth, kontekst 200k). Domyślny model xAI zmieniono nagrok-build-0.1, a adaptacyjne modele Anthropic przestrzegają teraz współczesnego kontraktu wnioskowania (nigdy nie wysyłają polareasoning).21 - Aplikacja komputerowa i panel. Aplikacja komputerowa zyskuje subagentów działających w tle z transmitującymi delegowane działania na żywo „oknami obserwacji” (
delegate_task(background=true)), selektor modelu Composer, konfigurowalne skróty klawiaturowe, natywne powiadomienia systemowe, wersje robocze pola tworzenia wiadomości dla poszczególnych wątków, motywy z VS Code Marketplace oraz interfejs w języku japońskim i chińskim tradycyjnym. Panel zyskuje kompletny kreator profili (modele/skills/MCPs bez edytowania plikuconfig.yaml), globalny przełącznik profili, przeprojektowany Skills Hub ze skanowaniem zabezpieczeń, Automation Blueprints (sparametryzowane szablony dla formularzy, poleceń slash, rozmów i dokumentacji) oraz bezpieczne logowanie, które za bramą OAuth zwraca kod 401.21 - Skills i narzędzia.
image_generatemoże teraz nie tylko tworzyć obraz od podstaw, lecz także edytować i przekształcać obraz źródłowy u każdego obsługiwanego dostawcy obrazów; narzędziememoryzyskało tablicęoperationsumożliwiającą atomowe, zbiorcze dodawanie, zastępowanie i usuwanie w jednym wywołaniu; nowy skillsimplify-codeuruchamia równoległy przegląd i porządkowanie przez 3 agentów, kontrolowane poziomem ryzyka opartym na zasadzie Chesterton’s Fence; trójstanowe ustawieniewrite_modezastąpiono natomiast wartością logicznąwrite_approval.21 - Architektura. Subagenty działające w tle natychmiast zwracają uchwyt, a ich wynik trafia do rozmowy jako nowa tura; procedura pozyskiwania danych MCP pozwala uzyskać potwierdzenie w trakcie wywołania narzędzia, a narzędzia MCP łączące się z opóźnieniem są udostępniane między turami (bez naruszania pamięci podręcznej); cron staje się wymiennym CronScheduler z dostawcą zarządzanego cron Chronos; ponadto nowy zakres Managed (
/etc/hermes) pozwala administratorowi przypinać konfigurację, której użytkownik nie może zmienić, a przekaźnik Gateway-Gateway umożliwia tworzenie topologii obejmujących wiele gateways.21 - Nowe polecenia.
/version,/billing(interaktywne rozliczenia w terminalu),hermes photon login(uwierzytelnianie iMessage) orazhermes curator run --consolidate— konsolidacja jest teraz opcjonalna, dzięki czemu rutynowa kuracja w tle nie zużywa żadnych tokenów.21 - Bezpieczeństwo. Wersja v0.17.0 usuwa możliwość obejścia listy blokad przez znaki ucieczki powłoki, domyślnie odrzuca operacje w razie braku modułów zatwierdzania i adapterów gateway z własnymi zasadami, oczyszcza środowisko podprocesów skryptów zadań cron, usuwa dane poufne ze zrzutów debugowania żądań, sprawdza konfiguracje stdio MCP pod kątem wzorców eksfiltracji oraz aktualizuje urllib3 i PyJWT, aby wyeliminować luki CVE.21
Przejście z wersji v0.16.x nie powoduje żadnych zmian niezgodnych wstecznie w CLI; wokół tego samego agenta pojawiają się jedynie nowe kanały, modele i powierzchnie. Najważniejszymi powodami aktualizacji są iMessage bez przekaźnika, oficjalne adaptery WhatsApp oraz administracyjny zakres Managed.
Co nowego w wersji v0.16.0 (wydanie Surface)
Nazwa Hermes Agent v0.16.0 (tag v2026.6.5, 5 czerwca 2026) nawiązuje do nowych powierzchni udostępnianych dla agenta, którego podstawą jest CLI. Najważniejsza zmiana: Hermes nie jest już ograniczony do terminala.20
- Natywna aplikacja komputerowa. Hermes Desktop to nowa aplikacja Electron dla systemów macOS, Linux i Windows, z instalacją jednym kliknięciem oraz automatyczną aktualizacją w aplikacji. Oferuje okno czatu z przesyłaniem odpowiedzi na żywo, przeciąganie i upuszczanie plików, wklejanie obrazów ze schowka, paletę
Cmd+K, listę sesji z archiwizacją i wyszukiwaniem oraz selektor modelu na pasku stanu. Może łączyć się ze zdalnym Hermes gateway przez bezpieczny WebSocket, korzystając z uwierzytelniania za pomocą OAuth albo nazwy użytkownika i hasła, ze zdalnymi hostami przypisanymi do poszczególnych profili oraz współbieżnymi sesjami wielu profili połączonymi odwołaniami@sessionmiędzy profilami. Interfejs aplikacji komputerowej zawiera również pełne tłumaczenie na uproszczony język chiński (简体中文), zaimplementowane za pomocą warstwy i18n z typami (display.language; domyślnym językiem pozostaje angielski).20 - Panel administracyjny w przeglądarce. Lokalny panel internetowy przekształcono z widoku stanu w pełny panel administracyjny: katalog MCP z przełącznikami włączania i wyłączania, zarządzanie danymi uwierzytelniającymi, tworzenie webhooków i hooków, konfiguracja pamięci, sterowanie gateway oraz strona System ze sprawdzaniem przed aktualizacją i funkcją Debug Share uruchamianą jednym kliknięciem. Nowa strona Channels umożliwia konfigurowanie w przeglądarce każdej platformy komunikacyjnej gateway (Telegram, Discord, Slack i pozostałych). Uwierzytelnianie jest teraz wymienne: logowanie nazwą użytkownika i hasłem, ogólny samodzielnie hostowany dostawca OIDC, polecenie
hermes dashboard registerdla samodzielnie hostowanego klienta OAuth oraz rotacja sesji za pomocą tokenu odświeżania.20 - Nowe polecenia CLI i polecenia slash.
/undo [N]cofa ostatnie N tur użytkownika z uzupełnieniem wstępnym i miękkim usuwaniem; działa w CLI, TUI oraz na wszystkich platformach komunikacyjnych. Pojawia się konfigurowalny interfejs domyślny (clilubtui) z możliwością zastąpienia go opcją--cli; TUI zyskuje ujednolicone polecenie/modeloraz nakładkę Sessions.hermes portaljest czytelnym dla człowieka aliasem procesu wdrożeniowego Nous Portal, który oferuje nowe ścieżki pierwszego uruchomienia Quick Setup i Full Setup. Dodano również 2 narzędzia diagnostyczne:hermes prompt-sizeorazhermes sessions optimize.20 - Nowe modele i dostawcy. Selektor zyskuje modele
deepseek-v4-flash,MiniMax-M3(kontekst 1M, natywni dostawcy MiniMax),qwen3.7-plus(Nous + OpenRouter) orazgemini-3.5-flash(Gemini OAuth + klucz API). Pełnoprawny dostawca xAI Grok OAuth dołącza do programu uruchamiającego aplikację komputerową, selektor modeli umożliwia teraz wyszukiwanie rozmyte na każdej powierzchni, dostawcy z wieloma punktami końcowymi są grupowani w jednym wierszu, a katalog jest odświeżany co godzinę zamiast raz dziennie.20 - Odchudzone skills i stopniowe ujawnianie. Z domyślnego zestawu skills usunięto zbędne i nieaktywne pozycje (Spotify przeniesiono do natywnej wtyczki, Linear do
hermes mcp install linear, a kilka nieaktualnych wpisów usunięto), więcej skills przeniesiono do opcjonalnych oraz dodano w metadanych frontmatter filtr istotnościenvironments:(kanban/docker/s6), który ukrywa w indeksie skills przeznaczone do określonego kontekstu, dopóki nie zostaną wywołane.NVIDIA/skillsjest teraz domyślnym zaufanym źródłem Skills Hub obok OpenAI, Anthropic i HuggingFace. Narzędzia MCP i wtyczek zyskały stopniowe (ograniczone zakresem) ujawnianie, a błąd MCP, który niepoprawnie zgłaszał powodzenie OAuth, gdy nie uzyskano tokenu, został naprawiony.20 - Bezpieczeństwo. Wersja v0.16.0 przypina poprawioną wersję Starlette (≥1.0.1) ze względu na lukę CVE-2026-48710 (BadHost), przenosi kontrole adresów URL pod kątem SSRF poza pętlę zdarzeń w ścieżkach asynchronicznych, usuwa token okaziciela wnioskowania Bedrock ze środowiska podprocesów, dodaje
bws_cache.jsondo zabezpieczenia odczytu plików, dodajedocker restart/stop/killdo listy niebezpiecznych wzorców oraz usuwa niewidoczne znaki Unicode ze sprawdzonej zawartości skills. Wydanie zamknęło 2 problemy P0 i 62 problemy P1, z których 16 oznaczono jako związane z bezpieczeństwem.20
Przejście z wersji v0.15.x nie powoduje żadnych zmian niezgodnych wstecznie w samym CLI; wokół tego samego agenta dodano jedynie nowe powierzchnie i nowych dostawców. Aplikacja komputerowa i panel administracyjny są głównymi powodami aktualizacji, jeśli Hermes ma służyć użytkownikom niekorzystającym z terminala albo zdalny gateway ma być administrowany z przeglądarki.
Instalacja
Jednowierszowy instalator jest oficjalnie obsługiwaną metodą instalacji. Obsługuje Python, uv, Node.js, ripgrep, ffmpeg, klonowanie repozytorium, środowisko wirtualne oraz globalne polecenie hermes.7
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash
Instalacje przez pip i Homebrew są przestarzałe od wersji v0.19.0. Pakiet PyPI wprowadzony w wersji v0.14.0 (
pip install hermes-agent) oraz formuła Homebrew są obecnie oznaczone jako „nieobsługiwane rozwiązania starszego typu” — po wykryciu takiej instalacji Hermes wyświetla ostrzeżenie w każdym interfejsie, ale nie blokuje działania. Planowane jest zaprzestanie publikowania w PyPI i Homebrew. Jeśli instalację przeprowadzono przez pip lub brew, należy przejść na instalator podany powyżej.23
Działa w systemach Linux, macOS, WSL2 oraz Android/Termux (instalator automatycznie wykrywa Termux i przełącza się na przetestowany pakiet dla systemu Android).7 Wersja v0.14.0 wprowadza natywną obsługę systemu Windows we wczesnej wersji beta za pomocą instalatora PowerShell, jednak do zastosowań produkcyjnych bezpieczniejszym wyborem pozostaje WSL2, dopóki obsługa natywnej instalacji w systemie Windows nie osiągnie większej dojrzałości.19
Po zakończeniu instalacji:
source ~/.bashrc # or ~/.zshrc
hermes # Start chatting
Jedynym wymaganiem wstępnym jest git. Instalator automatycznie instaluje Python 3.11 za pomocą uv (bez konieczności używania sudo), Node.js v22 (do automatyzacji przeglądarki i mostu WhatsApp), ripgrep oraz ffmpeg.7
Weryfikacja instalacji
hermes version # Check version
hermes doctor # Diagnose config/dependency issues
hermes status # Show current configuration + auth state
hermes dump # Copy-pasteable setup summary for debugging
hermes doctor precyzyjnie wskazuje brakujące elementy i sposób rozwiązania problemu.7 hermes dump to polecenie diagnostyczne, którego wynik można wkleić do zgłoszenia w GitHub lub wątku na Discordzie podczas zwracania się o pomoc — jest to tekstowe podsumowanie całej konfiguracji, z którego usunięto dane poufne.8
Instalacja ręczna
Jeśli potrzebna jest pełna kontrola — niestandardowa wersja Python, określone dodatki lub integracja z Nix/NixOS — ręczny proces opisano krok po kroku w oficjalnym przewodniku instalacji.7 Najważniejsze opcjonalne dodatki, które można łączyć z uv pip install -e ".[<extras>]":
| Dodatek | Co zapewnia |
|---|---|
all |
Wszystkie poniższe elementy |
messaging |
gateway dla Telegram i Discord |
cron |
Analizowanie wyrażeń cron |
cli |
Terminalowy interfejs menu kreatora konfiguracji |
modal |
Backend wykonywania zadań w chmurze Modal |
voice |
Wejście mikrofonowe CLI i odtwarzanie dźwięku |
tts-premium |
Głosy premium ElevenLabs |
honcho |
Pamięć natywna dla AI (integracja z Honcho) |
mcp |
Obsługa Model Context Protocol |
homeassistant |
Integracja z Home Assistant |
acp |
Obsługa integracji z edytorami ACP |
slack |
Obsługa wiadomości Slack |
pty |
Obsługa terminala PTY (interaktywne narzędzia CLI) |
dev |
pytest i narzędzia testowe |
termux |
Przetestowany pakiet dla systemu Android (zawiera cron, cli, pty, mcp, honcho, acp) |
Polecenie instalacji w Termux jest inne — używa pip z plikiem ograniczeń zamiast uv pip:
python -m pip install -e ".[termux]" -c constraints-termux.txt
Wynika to z faktu, że .[all] w systemie Android instaluje faster-whisper za pośrednictwem dodatku voice, który zależy od pakietów binarnych ctranslate2 niedostępnych dla systemu Android.7
Uwierzytelnianie i dostawcy
Hermes obsługuje około 22 natywnie zintegrowanych dostawców oraz niestandardowe endpointy (wersja 0.19.0 dodaje Fireworks AI, DeepInfra i Upstage Solar), a także 3 odrębne ścieżki uwierzytelniania. Poniżej przedstawiono pełny zakres opcji uwierzytelniania, uporządkowany według ścieżek, aby łatwo można było znaleźć rozwiązanie odpowiadające posiadanym zasobom.
3 ścieżki uwierzytelniania
Każdy dostawca w Hermes korzysta z jednego z 3 schematów uwierzytelniania:
Ścieżka 1 — klucz API w .env. Klucz należy umieścić w ~/.hermes/.env, a Hermes odczyta go podczas uruchamiania. Tej ścieżki używają OpenRouter, AI Gateway, z.ai/GLM, Kimi/Moonshot, MiniMax (w tym MiniMax China), Alibaba Cloud/DashScope, Kilo Code, OpenCode Zen, OpenCode Go, DeepSeek, Hugging Face, Google/Gemini oraz większość zewnętrznych dostawców.2 Od wersji 0.19.0 klucz nie musi już znajdować się w pliku tekstowym: rozszerzalny interfejs SecretSource może podczas wczytywania pobierać sekrety z Bitwarden lub 1Password (odwołania op://), obsługując jednocześnie wiele sejfów, deterministyczną kolejność pierwszeństwa, ostrzeżenia o konfliktach oraz informacje o pochodzeniu poszczególnych zmiennych — .env pozostaje rozwiązaniem rezerwowym. (Jest to rozwiązanie odmienne od tokenu inicjującego Bitwarden Secrets Manager z wersji 0.15.0, który konsolidował klucze dostawców za jednym tokenem; SecretSource zastępuje sam plik tekstowy, a przyszłych dostawców sejfów będzie można dodawać jako pluginy.)23
Ścieżka 2 — OAuth przez hermes model lub hermes auth. Uruchamia przepływ kodu urządzenia, otwiera przeglądarkę i zapisuje dane uwierzytelniające w ~/.hermes/auth.json (może też importować istniejące dane uwierzytelniające z narzędzi takich jak Claude Code lub Codex CLI). Tej ścieżki używają Nous Portal, OpenAI Codex (konto ChatGPT), GitHub Copilot oraz Anthropic (Claude Pro/Max).2
Ścieżka 3 — niestandardowy endpoint w config.yaml. Przeznaczona dla dowolnego endpointu API zgodnego z OpenAI — Ollama, vLLM, SGLang, llama.cpp, LM Studio, proxy LiteLLM, Together AI, Groq, Azure OpenAI lub własnego serwera utrzymywanego samodzielnie. Konfigurację przeprowadza się raz za pomocą hermes model → Custom endpoint, po czym zostaje ona zapisana w config.yaml.2
Pełna macierz dostawców
Poniżej znajduje się pełna lista natywnie zintegrowanych dostawców wraz z dokładnym procesem konfiguracji każdego z nich.2
| Dostawca | Ścieżka uwierzytelniania | Konfiguracja |
|---|---|---|
| Nous Portal | OAuth | hermes model (logowanie przez OAuth, na podstawie subskrypcji) |
| OpenAI Codex | OAuth | hermes model (kod urządzenia ChatGPT, korzysta z modeli Codex) |
| GitHub Copilot | OAuth lub token | hermes model (kod urządzenia OAuth) albo COPILOT_GITHUB_TOKEN / GH_TOKEN / gh auth token |
| GitHub Copilot ACP | Lokalny podproces | hermes model (wymaga CLI copilot w PATH oraz copilot login) |
| Anthropic | OAuth lub klucz API | hermes model (preferuje dane uwierzytelniające Claude Code) albo ANTHROPIC_API_KEY, albo token konfiguracyjny ANTHROPIC_TOKEN |
| OpenRouter | Klucz API | OPENROUTER_API_KEY w ~/.hermes/.env |
| AI Gateway (Vercel) | Klucz API | AI_GATEWAY_API_KEY w ~/.hermes/.env (dostawca: ai-gateway) |
| z.ai / GLM (ZhipuAI) | Klucz API | GLM_API_KEY w ~/.hermes/.env (dostawca: zai) |
| Kimi / Moonshot | Klucz API | KIMI_API_KEY w ~/.hermes/.env (dostawca: kimi-coding). Wersja 0.19.0 dodaje kimi-k3 do katalogów (modele kimi-k2.x wycofano).23 |
| MiniMax (globalny) | Klucz API | MINIMAX_API_KEY w ~/.hermes/.env (dostawca: minimax) |
| MiniMax China | Klucz API | MINIMAX_CN_API_KEY w ~/.hermes/.env (dostawca: minimax-cn) |
| Alibaba Cloud (Qwen) | Klucz API | DASHSCOPE_API_KEY w ~/.hermes/.env (dostawca: alibaba, aliasy: dashscope, qwen) |
| Kilo Code | Klucz API | KILOCODE_API_KEY w ~/.hermes/.env (dostawca: kilocode) |
| OpenCode Zen | Klucz API | OPENCODE_ZEN_API_KEY w ~/.hermes/.env (dostawca: opencode-zen) |
| OpenCode Go | Klucz API | OPENCODE_GO_API_KEY w ~/.hermes/.env (dostawca: opencode-go) |
| DeepSeek | Klucz API | DEEPSEEK_API_KEY w ~/.hermes/.env (dostawca: deepseek) |
| Hugging Face | Klucz API | HF_TOKEN w ~/.hermes/.env (dostawca: huggingface, alias: hf) |
| Google / Gemini | Klucz API | GOOGLE_API_KEY lub GEMINI_API_KEY w ~/.hermes/.env (dostawca: gemini) |
| Fireworks AI | Klucz API | Natywnie zintegrowany dostawca z szacowaniem kosztów i kolumnami cen z pamięci podręcznej w selektorze modeli; awansował na 2. pozycję w selektorach dostawców. Nowość w wersji 0.19.0.23 |
| DeepInfra | Klucz API | Natywnie zintegrowany dostawca ze wzmocnionym mechanizmem integracji. Nowość w wersji 0.19.0.23 |
| Upstage Solar | Klucz API | Natywnie zintegrowany dostawca. Nowość w wersji 0.19.0.23 |
| xAI (Grok) | Dostawca natywny / SuperGrok OAuth | Natywnie zintegrowany dostawca z bezpośrednim dostępem przez API i katalogiem modeli (od wersji 0.9.0). Wersja 0.14.0 dodaje SuperGrok OAuth i zwiększa okno kontekstu grok-4.3 do 1 mln dla uprawnionych kont.21619 Wersja 0.17.0 dodaje grok-composer-2.5-fast (model Cursor przez xAI OAuth, kontekst 200 tys.) i zmienia domyślny model xAI na grok-build-0.1.21 W wersji 0.19.0 grok-4.5 osiąga ogólną dostępność w katalogu.23 |
| xAI Custom Voices | Klucz API | Dostawca TTS z klonowaniem głosu. Nowość w wersji 0.13.0; należy skonfigurować go w sekcji tts: pliku config.yaml i podać klucz xAI w .env.18 |
| Xiaomi MiMo | Dostawca natywny | Natywnie zintegrowany dostawca z kreatorem konfiguracji i katalogiem modeli. Bezpłatny MiMo v2 Pro w Nous Portal do zadań pomocniczych (od wersji 0.9.0).1615 |
| Google AI Studio | Klucz API | GOOGLE_API_KEY lub GEMINI_API_KEY w ~/.hermes/.env. Bezpośredni dostęp do Gemini z automatycznym wykrywaniem długości kontekstu za pośrednictwem rejestru models.dev (od wersji 0.8.0).15 |
| Qwen Cloud | OAuth | Dostawca OAuth z obsługą żądań portalu (od wersji 0.8.0). W wersji 0.14.0 nazwa dostawcy została zmieniona z Alibaba Cloud na Qwen Cloud; istniejące klucze konfiguracyjne nadal działają.1519 |
| Niestandardowy endpoint | config.yaml | hermes model → “Custom endpoint” (zapisywany w config.yaml) |
Od wersji 0.19.0 można również ukrywać nieużywanych dostawców: flaga enabled: false ustawiana dla poszczególnych dostawców oraz klucz konfiguracyjny excluded_providers usuwają ich z selektorów /model i wbudowanego mechanizmu rozpoznawania dostawców.23
Anthropic: 3 metody uwierzytelniania
Anthropic wymaga osobnej sekcji, ponieważ Hermes obsługuje 3 różne ścieżki dostępu do Claude, a wybór właściwej ma znaczenie. Zgodnie z dokumentacją źródłową:2
# Method 1: API key (pay-per-token)
export ANTHROPIC_API_KEY=***
hermes chat --provider anthropic --model claude-sonnet-4-6
# Method 2: OAuth through hermes model (preferred)
# Uses Claude Code's credential store when available
hermes model
# Method 3: Manual setup-token (fallback/legacy)
export ANTHROPIC_TOKEN=***
hermes chat --provider anthropic
# Auto-detect Claude Code credentials
hermes chat --provider anthropic # reads Claude Code files automatically
Po wybraniu uwierzytelniania Anthropic przez OAuth za pomocą hermes model Hermes preferuje własny magazyn danych uwierzytelniających Claude Code, zamiast kopiować token do ~/.hermes/.env. Dzięki temu dane uwierzytelniające Claude, które można odświeżać, zachowują tę możliwość.2 Jeżeli na tym samym komputerze jest już używany Claude Code, jest to najprostsza ścieżka.
Aby na stałe ustawić Anthropic w config.yaml:
model:
provider: "anthropic"
default: "claude-sonnet-4-6"
--provider claude i --provider claude-code również działają jako skróty dla --provider anthropic.2
GitHub Copilot: 2 tryby
Copilot jest obsługiwany w 2 trybach: bezpośredni Copilot API (zalecany) oraz Copilot ACP (który uruchamia lokalny CLI Copilot jako podproces).2
# Direct Copilot API
hermes chat --provider copilot --model gpt-5.4
# Copilot ACP (requires the Copilot CLI in PATH + an existing copilot login)
hermes chat --provider copilot-acp --model copilot-acp
Zgodnie z dokumentacją źródłową uwierzytelnianie jest sprawdzane w następującej kolejności:2
1. Zmienna środowiskowa COPILOT_GITHUB_TOKEN
2. Zmienna środowiskowa GH_TOKEN
3. Zmienna środowiskowa GITHUB_TOKEN
4. Awaryjne użycie CLI gh auth token
5. Logowanie kodem urządzenia przez OAuth za pomocą hermes model
Typ tokenu ma znaczenie. Copilot API nie obsługuje klasycznych tokenów Personal Access Token (ghp_*). Obsługiwane są tokeny OAuth (gho_*), precyzyjnie ograniczone tokeny PAT (github_pat_* z uprawnieniem Copilot Requests) oraz tokeny GitHub App (ghu_*). Jeżeli gh auth token zwraca token ghp_*, zamiast tego należy użyć hermes model, aby uwierzytelnić się przez OAuth.2
Chińscy dostawcy AI (natywna obsługa)
Hermes ma wbudowaną obsługę z.ai/GLM, Kimi/Moonshot, MiniMax (endpointy globalne i chińskie) oraz Alibaba Cloud z dedykowanymi identyfikatorami dostawców.2
# z.ai / ZhipuAI GLM
hermes chat --provider zai --model glm-5 # Requires: GLM_API_KEY
# Kimi / Moonshot AI
hermes chat --provider kimi-coding --model kimi-for-coding # Requires: KIMI_API_KEY
# MiniMax (global)
hermes chat --provider minimax --model MiniMax-M2.7 # Requires: MINIMAX_API_KEY
# MiniMax (China)
hermes chat --provider minimax-cn --model MiniMax-M2.7 # Requires: MINIMAX_CN_API_KEY
# Alibaba Cloud / DashScope (Qwen)
hermes chat --provider alibaba --model qwen3.5-plus # Requires: DASHSCOPE_API_KEY
Bazowe adresy URL można zastąpić za pomocą zmiennych środowiskowych GLM_BASE_URL, KIMI_BASE_URL, MINIMAX_BASE_URL, MINIMAX_CN_BASE_URL lub DASHSCOPE_BASE_URL.2
Z.AI automatycznie wykrywa endpoint. Podczas korzystania z dostawcy z.ai/GLM Hermes testuje wiele endpointów (globalne, chińskie i warianty programistyczne), aby znaleźć taki, który akceptuje dany klucz API. Działający endpoint jest automatycznie zapisywany w pamięci podręcznej — większość użytkowników nie musi ustawiać GLM_BASE_URL.2
xAI (Grok) automatycznie włącza buforowanie promptów. Gdy bazowy adres URL zawiera x.ai, Hermes wysyła nagłówek x-grok-conv-id z każdym żądaniem, aby kierować je do tego samego serwera w ramach sesji konwersacji oraz ponownie wykorzystywać zapisane w pamięci podręcznej prompty systemowe i historię.2 Odbywa się to automatycznie i nie wymaga konfiguracji.
Polecenie hermes auth
hermes auth to polecenie służące do zarządzania pulami danych uwierzytelniających oraz danymi uwierzytelniającymi OAuth.6
hermes auth # Interactive wizard
hermes auth list # Show all credential pools
hermes auth list openrouter # Show one provider's pool
hermes auth add openrouter --api-key sk-or-v1-xxx
hermes auth add anthropic --type oauth
hermes auth remove openrouter 2 # Remove by index
hermes auth reset openrouter # Clear cooldowns
Pule danych uwierzytelniających umożliwiają rotację wielu kluczy API lub tokenów OAuth tego samego dostawcy — przydaje się to do rozdzielania limitów żądań między wiele kluczy bez zmiany kodu.6 Starsze polecenia hermes login / hermes logout zostały usunięte; zamiast nich należy używać hermes auth.6
Niestandardowe i samodzielnie utrzymywane endpointy
Hermes współpracuje z każdym endpointem API zgodnym z OpenAI. Jeżeli serwer implementuje /v1/chat/completions, można skierować do niego Hermes.2
Konfiguracja interaktywna (zalecana):
hermes model
# Select "Custom endpoint (self-hosted / VLLM / etc.)"
# Enter: API base URL, API key, Model name
Ręczna konfiguracja config.yaml:
model:
default: your-model-name
provider: custom
base_url: http://localhost:8000/v1
api_key: your-key-or-leave-empty-for-local
Oba podejścia zapisują ustawienia w config.yaml, który stanowi jedyne źródło prawdy dotyczące głównego modelu, dostawcy i bazowego adresu URL.2 Starsze zmienne środowiskowe OPENAI_BASE_URL oraz LLM_MODEL nie są już odczytywane podczas konfiguracji głównego modelu — należy użyć hermes model lub bezpośrednio edytować config.yaml.2 (OPENAI_BASE_URL i OPENAI_API_KEY są nadal respektowane jako rozwiązanie rezerwowe dla pomocniczej ścieżki routingu provider: "main", dlatego nie należy ich usuwać bez sprawdzenia, jeśli są tam używane.)4
Przełączanie niestandardowych endpointów w trakcie sesji:
/model custom:qwen-2.5 # Custom endpoint with explicit model
/model custom # Auto-detect the model from the endpoint
/model custom:local:qwen-2.5 # Named custom provider "local"
/model custom:work:llama3 # Named custom provider "work"
/model openrouter:claude-sonnet-4 # Back to a cloud provider
/model custom (bez nazwy modelu) wysyła zapytanie do API /v1/models danego endpointu i automatycznie wybiera model, jeżeli załadowano dokładnie 1 — jest to przydatne w przypadku lokalnych serwerów uruchamiających pojedynczy model.2
Lokalne serwery LLM (szablony konfiguracji)
Dokumentacja źródłowa zawiera kompletne przewodniki konfiguracji Ollama, vLLM, SGLang, llama.cpp i LM Studio. Poniżej przedstawiono najważniejsze polecenia, które rzeczywiście trzeba uruchomić. Każde z nich ma utworzyć działający endpoint, do którego można skierować Hermes.2
Ollama — najłatwiejsza ścieżka lokalna, bez konfiguracji:
ollama pull qwen2.5-coder:32b
OLLAMA_CONTEXT_LENGTH=32768 ollama serve # Raise from 4k default
hermes model # Custom endpoint → http://localhost:11434/v1 → qwen2.5-coder:32b
Istotna pułapka Ollama: domyślnie Ollama używa bardzo małych długości kontekstu (4096 tokenów przy mniej niż 24 GB VRAM). Należy je zwiększyć za pomocą OLLAMA_CONTEXT_LENGTH lub pliku Modelfile — zgodny z OpenAI API nie przyjmuje długości kontekstu od klienta, dlatego Hermes nie może ustawić jej automatycznie.2 Do zastosowań agentowych należy ustawić co najmniej 16–32 tys.
vLLM — wysokowydajne udostępnianie GPU:
pip install vllm
vllm serve meta-llama/Llama-3.1-70B-Instruct \
--port 8000 \
--max-model-len 65536 \
--tensor-parallel-size 2 \
--enable-auto-tool-choice \
--tool-call-parser hermes
Wywoływanie narzędzi wymaga --enable-auto-tool-choice oraz --tool-call-parser <name>. Obsługiwane parsery: hermes (Qwen 2.5, Hermes 2/3), llama3_json, mistral, deepseek_v3, deepseek_v31, xlam, pythonic. Bez tych flag wywołania narzędzi będą zwracane jako zwykły tekst.2
SGLang — szybkie udostępnianie z RadixAttention do ponownego używania pamięci podręcznej KV:
pip install "sglang[all]"
python -m sglang.launch_server \
--model meta-llama/Llama-3.1-70B-Instruct \
--port 30000 \
--context-length 65536 \
--tp 2 \
--tool-call-parser qwen
Pułapka SGLang: domyślna wartość max_tokens wynosi 128. Jeżeli odpowiedzi są ucinane, należy ustawić --default-max-tokens na serwerze lub skonfigurować model.max_tokens w config.yaml.2
llama.cpp / llama-server — procesory CPU i Metal na Apple Silicon:
./build/bin/llama-server \
--jinja -fa \
-c 32768 \
-ngl 99 \
-m models/qwen2.5-coder-32b-instruct-Q4_K_M.gguf \
--port 8080 --host 0.0.0.0
--jinja jest wymagane do wywoływania narzędzi. Bez tej opcji llama-server całkowicie ignoruje parametr tools, a model próbuje wywoływać narzędzia, zapisując JSON w treści odpowiedzi — Hermes nie potrafi jednak zinterpretować tego jako rzeczywistych wywołań narzędzi.2
LM Studio — aplikacja komputerowa z interfejsem graficznym:
Serwer należy uruchomić w aplikacji LM Studio (karta Developer → Start Server) lub za pomocą CLI: lms server start (uruchamia serwer na porcie 1234) oraz lms load qwen2.5-coder --context-length 32768.2 Następnie należy skierować hermes model do http://localhost:1234/v1.
Istotna pułapka LM Studio: LM Studio odczytuje długość kontekstu z metadanych modelu, lecz wiele modeli GGUF podaje domyślnie 2048 lub 4096. Długość kontekstu należy zawsze jawnie ustawić w ustawieniach modelu LM Studio — kliknąć ikonę koła zębatego obok selektora modelu, ustawić „Context Length” na co najmniej 16384 (najlepiej 32768), a następnie ponownie załadować model.2
Nazwani niestandardowi dostawcy
Jeżeli korzysta się z wielu niestandardowych endpointów (na przykład lokalnego serwera programistycznego i zdalnego serwera GPU), można zdefiniować je jako nazwanych niestandardowych dostawców w config.yaml:2
custom_providers:
- name: local
base_url: http://localhost:8080/v1
# api_key omitted — Hermes uses "no-key-required" for keyless local servers
- name: work
base_url: https://gpu-server.internal.corp/v1
api_key: corp-api-key
api_mode: chat_completions # optional, auto-detected from URL
- name: anthropic-proxy
base_url: https://proxy.example.com/anthropic
api_key: proxy-key
api_mode: anthropic_messages # for Anthropic-compatible proxies
Następnie można przełączać się między nimi w trakcie sesji za pomocą potrójnej składni:
/model custom:local:qwen-2.5
/model custom:work:llama3-70b
/model custom:anthropic-proxy:claude-sonnet-4
Nazwanych niestandardowych dostawców można również wybierać z interaktywnego menu hermes model.2
Rozszerzalna architektura dostawców (od wersji 0.13.0)
Wersja 0.13.0 wprowadza klasę abstrakcyjną ProviderProfile oraz folder plugins/model-providers/, dzięki którym zewnętrzni dostawcy inferencji mogą być dodawani bez modyfikowania głównego kodu.18 Jeżeli dostawca obsługuje tryb API zgodny z OpenAI, Anthropic lub Codex, można zaimplementować podklasę ProviderProfile, która deklaruje ścieżkę uwierzytelniania, bazowy adres URL, katalog modeli i nagłówki pamięci podręcznej; Hermes rozpoznaje ją za pośrednictwem tej samej ścieżki runtime_provider.py, z której korzystają wbudowani dostawcy. To właśnie ta zmiana architektoniczna umożliwiła rozszerzenie listy dostawców w wersji 0.13.0: zamiast edytować główny kod w celu dodania dostawcy, udostępnia się plugin.
Lokalne proxy zgodne z OpenAI (od wersji 0.14.0)
hermes proxy udostępnia lokalny endpoint zgodny z OpenAI, obsługiwany przez dostawcę OAuth, u którego Hermes jest już zalogowany — Claude Pro, ChatGPT Pro, SuperGrok lub innego zgodnego, skonfigurowanego dostawcę.19 Oznacza to, że narzędzia oczekujące API w stylu OpenAI, w tym Codex CLI, Aider, Cline, Continue czy niestandardowe skrypty, mogą ponownie wykorzystywać uwierzytelnianie Hermes oparte na subskrypcji bez osobnego klucza API. Proxy należy traktować jako lokalną infrastrukturę programistyczną: świadomie wybrać adres nasłuchiwania, nie udostępniać go szeroko i pamiętać o warunkach właściwych dla poszczególnych dostawców.
Wykrywanie długości kontekstu
Zgodnie z dokumentacją źródłową 2 ustawienia są stale ze sobą mylone:2
context_length— całe okno kontekstu (łączny budżet tokenów wejściowych i wyjściowych, np. 1 000 000 dla Claude Opus 4.7 lub 200 000 dla Sonnet 4.6). Hermes używa tej wartości, aby określić, kiedy skompresować historię.model.max_tokens— limit danych wyjściowych (maksymalna liczba tokenów, które model może wygenerować w pojedynczej odpowiedzi). Nie ma związku z długością historii.
Gdy automatyczne wykrywanie błędnie ustala rozmiar okna, należy ustawić context_length:
model:
default: "qwen3.5:9b"
base_url: "http://localhost:8080/v1"
context_length: 131072 # tokens
Do wykrywania okien kontekstu Hermes używa wieloźródłowego łańcucha rozpoznawania: nadpisanie w konfiguracji → ustawienie dla modelu u niestandardowego dostawcy → trwała pamięć podręczna → /models endpointu → Anthropic /v1/models → OpenRouter API → Nous Portal → models.dev (rejestr utrzymywany przez społeczność, obejmujący ponad 3800 modeli) → wartości domyślne (128K).2 System uwzględnia dostawcę, dlatego ten sam model może mieć różne limity kontekstu w zależności od tego, kto go udostępnia (np. claude-opus-4.6 ma 1 mln bezpośrednio w Anthropic, ale 128K w GitHub Copilot).2
Rotacja dostawców i rozwiązanie rezerwowe
Pule danych uwierzytelniających. Jeśli dostępnych jest wiele kluczy API tego samego dostawcy, strategię rotacji należy skonfigurować za pomocą hermes auth. W ten sposób można rozdzielić limity żądań między wiele kluczy.6
Model rezerwowy. Można skonfigurować zapasową parę provider:model, na którą Hermes automatycznie przełączy się w przypadku awarii modelu głównego (limity żądań, błędy serwera, błędy uwierzytelniania):2
fallback_model:
provider: openrouter # required
model: anthropic/claude-sonnet-4 # required
# base_url: http://localhost:8000/v1 # optional, for custom endpoints
# api_key_env: MY_CUSTOM_KEY # optional, env var name
Mechanizm rezerwowy zmienia model i dostawcę w trakcie sesji bez utraty konwersacji. Uruchamia się najwyżej raz na sesję.2 Dostawcy obsługujący mechanizm rezerwowy: openrouter, nous, openai-codex, copilot, copilot-acp, anthropic, huggingface, zai, kimi-coding, minimax, minimax-cn, deepseek, ai-gateway, opencode-zen, opencode-go, kilocode, alibaba, custom.2
Modele pomocnicze
Hermes używa lekkich modeli „pomocniczych” do zadań pobocznych: analizy obrazów, podsumowywania stron internetowych, analizy zrzutów ekranu z przeglądarki, klasyfikowania zatwierdzeń niebezpiecznych poleceń, kompresji kontekstu, podsumowywania wyników wyszukiwania sesji, dopasowywania skill, przekazywania zadań narzędziom MCP oraz zapisywania pamięci.4 Domyślnie zadania te wykorzystują Gemini Flash przez automatyczne wykrywanie (OpenRouter → Nous → Codex).
Można skonfigurować model i dostawcę używane przez każde zadanie pomocnicze. Każdy slot pomocniczy korzysta z tych samych 3 parametrów: provider, model, base_url.4
auxiliary:
vision:
provider: "auto" # "auto", "openrouter", "nous", "codex", "main", etc.
model: "" # e.g. "openai/gpt-4o", "google/gemini-2.5-flash"
base_url: "" # Custom OpenAI-compatible endpoint
api_key: "" # Falls back to OPENAI_API_KEY
timeout: 30
download_timeout: 30
web_extract:
provider: "auto"
model: ""
timeout: 360
approval:
provider: "auto"
model: ""
timeout: 30
compression:
timeout: 120
session_search: { provider: "auto", model: "", timeout: 30 }
skills_hub: { provider: "auto", model: "", timeout: 30 }
mcp: { provider: "auto", model: "", timeout: 30 }
flush_memories:{ provider: "auto", model: "", timeout: 30 }
Opcja dostawcy "main" oznacza „użyj dostawcy, z którego korzysta mój główny agent” — jest prawidłowa wyłącznie w konfiguracjach auxiliary:, compression: oraz fallback_model:. Nie można jej używać w ustawieniu model.provider najwyższego poziomu. Jeżeli jako model główny używany jest niestandardowy endpoint zgodny z OpenAI, w sekcji model: należy ustawić provider: custom.4
Dlaczego ma to znaczenie: jeśli skonfigurowano wyłącznie Anthropic OAuth (bez klucza OpenRouter), funkcje analizy obrazu, podsumowywania stron internetowych i kompresji będą działać gorzej lub przestaną działać, ponieważ domyślny łańcuch rezerwowy modeli pomocniczych najpierw próbuje użyć OpenRouter. Należy dodać OPENROUTER_API_KEY na potrzeby zadań pomocniczych albo skonfigurować każdy slot pomocniczy tak, aby korzystał z głównego dostawcy:
auxiliary:
vision:
provider: "main"
web_extract:
provider: "main"
To najczęstsza przyczyna problemu „moje funkcje po cichu nie działają” u nowych użytkowników Hermes.
System konfiguracji
Hermes korzysta z warstwowego systemu konfiguracji. Zrozumienie kolejności priorytetów jest kluczowe, ponieważ wyższe warstwy nadpisują niższe, a jedną z nich stanowi globalny rejestr dostawców, którego nie widać w pliku config.yaml.
Układ plików konfiguracyjnych
Zgodnie z dokumentacją projektu konfiguracja Hermes składa się z następujących plików:4
~/.hermes/
├── config.yaml # All settings (model, terminal, TTS, compression, memory, toolsets, ...)
├── .env # Secrets (API keys, bot tokens, passwords)
├── auth.json # OAuth provider credentials (Nous Portal, Codex, Anthropic)
├── SOUL.md # Primary agent identity (slot #1 in system prompt)
├── memories/ # Persistent memory (MEMORY.md, USER.md)
├── skills/ # Bundled + agent-created + hub-installed skills
├── cron/ # Scheduled jobs
├── sessions/ # Gateway session state
└── logs/ # agent.log, gateway.log, errors.log (secrets auto-redacted)
config.yaml a .env — jeśli ustawienie znajduje się w obu plikach, w przypadku ustawień innych niż dane poufne pierwszeństwo ma config.yaml.4 Obowiązuje następująca zasada:
- Dane poufne (klucze API, tokeny botów, hasła) → .env
- Wszystkie pozostałe ustawienia (model, backend terminala, ustawienia kompresji, limity pamięci, toolsets) → config.yaml
Do danych poufnych można odwoływać się w pliku config.yaml za pomocą interpolacji w stylu powłoki:4
auxiliary:
vision:
api_key: ${GOOGLE_API_KEY}
base_url: ${CUSTOM_VISION_URL}
delegation:
api_key: ${DELEGATION_KEY}
Zarządzanie konfiguracją
hermes config # View current configuration
hermes config show # Same as above
hermes config edit # Open config.yaml in your editor
hermes config set KEY VAL # Set a specific value
hermes config get KEY # Print a single value (v0.19.0+)
hermes config unset KEY # Remove a key so the default applies again (v0.19.0+)
hermes config path # Print the config file path
hermes config env-path # Print the .env file path
hermes config check # Check for missing options (after updates)
hermes config migrate # Interactively add missing options
Przykłady:4
hermes config set model anthropic/claude-opus-4
hermes config set terminal.backend docker
hermes config set OPENROUTER_API_KEY sk-or-... # Saves to .env
hermes config check i hermes config migrate to polecenia, które należy uruchamiać po każdym hermes update — wykrywają nowo dodane opcje konfiguracji, których jeszcze nie ma w używanym pliku.6
Kolejność priorytetów konfiguracji
Hermes wczytuje konfigurację z kilku źródeł. Jeśli to samo ustawienie zostanie zdefiniowane w wielu źródłach, pierwszeństwo ma źródło o wyższym priorytecie:4
- Argumenty CLI —
hermes chat --model anthropic/claude-sonnet-4(nadpisanie dla pojedynczego wywołania) - Zmienne środowiskowe — stosowane podczas uruchamiania procesu
config.yaml— główny plik ustawień.env— wyłącznie dane poufne- Wbudowane wartości domyślne — stosowane, gdy wartość nie została ustawiona w żadnym innym miejscu
Flagi CLI zawsze mają pierwszeństwo w ramach danego wywołania. Długoterminowym źródłem prawdy pozostaje config.yaml.
Lokalizacja (v0.13.0+)
W wersji v0.13.0 dodano 7 wersji językowych komunikatów CLI i gateway: chińską (uproszczoną), japońską, niemiecką, hiszpańską, francuską, ukraińską i turecką.18 Wersja v0.14.0 wprowadza lokalizację wszystkich poleceń gateway oraz panelu internetowego, dodaje 8 kolejnych wersji językowych i zwiększa ich łączną liczbę do 16.19 Dokumentacja jest obecnie dostępna w wersji zlokalizowanej wyłącznie dla zh-Hans. Wersja językowa jest ustalana na podstawie zmiennych środowiskowych LC_ALL / LANG albo jawnego klucza locale: w pliku config.yaml. Domyślną wersją i źródłem prawdy dla każdego tekstu, którego nie objęto jeszcze tłumaczeniem, pozostaje język angielski.
Profiles — wiele odizolowanych instancji Hermes
Profiles umożliwiają korzystanie z wielu odizolowanych instancji Hermes, z których każda ma własną konfigurację, sesje, skills, pamięć i PID gateway. W ten sposób można uruchomić obok siebie „służbową instancję Hermes” i „prywatną instancję Hermes”, bez wzajemnego dostępu do ich stanu.6
hermes profile list
hermes profile create work --clone # Clone from current profile
hermes profile use work # Set sticky default
hermes profile alias work --name h-work # Create wrapper script
hermes profile export work -o work-backup.tar.gz
hermes profile import work-backup.tar.gz --name restored
hermes -p work chat -q "Hello from work profile" # One-off without switching
Każdy profile otrzymuje własny katalog HERMES_HOME (domyślnie ~/.hermes-<name>/), dzięki czemu wiele profiles może jednocześnie uruchamiać gateway bez wzajemnych konfliktów.63
Polecenia CLI
Ta sekcja stanowi praktyczny przewodnik po poleceniach najwyższego poziomu CLI. Oficjalne informacje oparte na kodzie źródłowym zawiera dokumentacja nadrzędnego projektu Polecenia CLI.6
Opcje globalne
hermes [global-options] <command> [subcommand/options]
| Opcja | Opis |
|---|---|
--version, -V |
Wyświetla wersję i kończy działanie |
--profile <name>, -p <name> |
Wybiera używany profile Hermes |
--resume <session>, -r <session> |
Wznawia sesję na podstawie identyfikatora lub tytułu |
--continue [name], -c [name] |
Wznawia ostatnią sesję (lub sesję o pasującym tytule) |
--worktree, -w |
Uruchamia w odizolowanym git worktree |
--yolo |
Pomija monity o zatwierdzenie niebezpiecznych poleceń |
--safe-mode |
Flaga diagnostyczna — uruchamia Hermes w minimalnym trybie bezpiecznym, aby wyizolować problemy z uruchamianiem (v0.19.0+)23 |
--pass-session-id |
Dołącza identyfikator sesji do systemowego promptu agenta |
Polecenia najwyższego poziomu
| Polecenie | Przeznaczenie |
|---|---|
hermes chat |
Interaktywny lub jednorazowy czat |
hermes model |
Interaktywny wybór domyślnego dostawcy i modelu |
hermes gateway |
Uruchamianie lub zarządzanie gateway komunikatora |
hermes setup |
Interaktywny kreator konfiguracji |
hermes auth |
Zarządzanie danymi uwierzytelniającymi — dodawanie, wyświetlanie, usuwanie, resetowanie i ustawianie strategii |
hermes status |
Wyświetlanie stanu agenta, uwierzytelniania i platform |
hermes cron |
Sprawdzanie harmonogramu cron i ręczne uruchamianie jego cyklu |
hermes webhook |
Zarządzanie dynamicznymi subskrypcjami webhooków |
hermes doctor |
Diagnozowanie problemów z konfiguracją i zależnościami |
hermes dump |
Gotowe do skopiowania podsumowanie konfiguracji na potrzeby pomocy technicznej i debugowania |
hermes logs |
Wyświetlanie, śledzenie i filtrowanie dzienników agenta, gateway oraz błędów |
hermes config |
Wyświetlanie, edytowanie, migrowanie i przeszukiwanie konfiguracji |
hermes pairing |
Zatwierdzanie lub unieważnianie kodów parowania komunikatorów |
hermes skills |
Przeglądanie, instalowanie, publikowanie i audytowanie skills |
hermes honcho |
Zarządzanie pamięcią Honcho obejmującą wiele sesji |
hermes memory |
Konfigurowanie zewnętrznego dostawcy pamięci |
hermes acp |
Uruchamianie Hermes jako serwera ACP (integracja z edytorem) |
hermes mcp |
Zarządzanie konfiguracją serwera MCP; uruchamianie Hermes jako serwera MCP |
hermes plugins |
Zarządzanie wtyczkami |
hermes tools |
Konfigurowanie narzędzi włączonych na poszczególnych platformach |
hermes sessions |
Przeglądanie, eksportowanie, porządkowanie i usuwanie sesji. W wersji v0.19.0 polecenie hermes sessions export rozszerzono o formaty Markdown, Quarto, HTML, zawierający wyłącznie prompty oraz ślady Hugging Face, a także opcjonalne oczyszczanie poufnych danych za pomocą --redact i filtry wieku, obszaru roboczego oraz platformy23 |
hermes insights |
Wyświetlanie analiz dotyczących tokenów, kosztów i aktywności |
hermes claw |
Narzędzia pomocnicze do migracji z OpenClaw |
hermes profile |
Zarządzanie profiles (wieloma odizolowanymi instancjami) |
hermes completion |
Wyświetlanie skryptów automatycznego uzupełniania dla powłoki (bash/zsh) |
hermes whatsapp |
Konfigurowanie i parowanie mostu WhatsApp |
hermes version |
Wyświetlanie informacji o wersji |
hermes update |
Pobieranie najnowszego kodu i ponowne instalowanie zależności |
hermes uninstall |
Usuwanie Hermes z systemu (--full usuwa również konfigurację i dane) |
hermes backup |
Pełna kopia zapasowa konfiguracji, sesji, skills i pamięci (v0.9.0+)16 |
hermes import |
Przywracanie z archiwum kopii zapasowej — migracja między urządzeniami lub powrót do wcześniejszego stanu (v0.9.0+)16 |
hermes dashboard |
Uruchamianie lokalnego panelu internetowego do zarządzania agentem w przeglądarce (v0.9.0+)16 |
hermes serve |
Uruchamianie w tle backendowego serwera API — od wersji v0.19.0 nie kompiluje ani nie montuje on już internetowego interfejsu użytkownika23 |
hermes debug share |
Przesyłanie pełnego raportu diagnostycznego do serwisu pastebin w celu udostępnienia go podczas rozwiązywania problemów (v0.9.0+)16 |
hermes chat — główny punkt wejścia
Polecenie hermes bez argumentów uruchamia interaktywny czat. hermes chat jest jego jawną formą z opcjami:6
hermes chat -q "Summarize the latest PRs" # One-shot, non-interactive
hermes chat --provider openrouter --model anthropic/claude-sonnet-4.6
hermes chat --toolsets web,terminal,skills # Enable specific toolsets
hermes chat --quiet -q "Return only JSON" # Programmatic mode
hermes chat --worktree -q "Review repo and open a PR"
Najważniejsze opcje:
| Opcja | Opis |
|---|---|
-q, --query "..." |
Jednorazowy, nieinteraktywny prompt |
-m, --model <model> |
Zastępuje model na czas tego uruchomienia |
-t, --toolsets <csv> |
Włącza rozdzielony przecinkami zestaw toolsets |
--provider <provider> |
Wymusza dostawcę (zob. pełną listę) |
-s, --skills <name> |
Wstępnie ładuje co najmniej jeden skill dla tej sesji |
-v, --verbose |
Szczegółowe dane wyjściowe |
-Q, --quiet |
Tryb programistyczny (bez banera, wskaźnika postępu i podglądów) |
--resume <session> |
Wznawia sesję bezpośrednio z poziomu chat |
--worktree |
Tworzy odizolowany git worktree |
--checkpoints |
Włącza checkpoints systemu plików przed destrukcyjnymi zmianami |
--yolo |
Pomija monity o zatwierdzenie |
--source <tag> |
Znacznik źródła sesji (domyślnie: cli; w przypadku integracji należy użyć tool) |
--max-turns <N> |
Maksymalna liczba iteracji wywoływania narzędzi na turę (domyślnie: 90) |
hermes setup — pełny kreator
Uruchamia pełny kreator konfiguracji lub przechodzi bezpośrednio do jednej z jego sekcji:6
hermes setup # Full wizard
hermes setup model # Provider and model only
hermes setup terminal # Terminal backend only
hermes setup gateway # Messaging platforms only
hermes setup tools # Tool enable/disable per platform
hermes setup agent # Agent behavior only
hermes setup --non-interactive
hermes setup --reset # Reset config to defaults before setup
hermes logs — uporządkowane przeszukiwanie dzienników
Polecenie hermes logs oferuje więcej możliwości niż tail -f uruchomione na plikach dziennika, ponieważ pozwala jednocześnie filtrować według poziomu, identyfikatora sesji i zakresu czasu.6
hermes logs # Last 50 lines of agent.log
hermes logs -f # Follow in real time
hermes logs gateway -n 100 # Last 100 lines of gateway.log
hermes logs --level WARNING --since 1h # Warnings from the last hour
hermes logs --session abc123 # Filter by session ID substring
hermes logs errors --since 30m -f # Follow errors.log from 30m ago
hermes logs list # List all log files with sizes
Pliki dziennika znajdują się w ~/.hermes/logs/:6
- agent.log — cała aktywność agenta (wywołania API, przekazywanie zadań narzędziom, cykl życia sesji, poziom INFO i wyższe)
- errors.log — wyłącznie ostrzeżenia i błędy (odfiltrowany podzbiór pliku agent.log)
- gateway.log — aktywność gateway komunikatora (połączenia z platformami, przekazywanie zadań, webhooki)
Rotacja odbywa się automatycznie za pomocą RotatingFileHandler z biblioteki Python — należy szukać plików agent.log.1, agent.log.2 itd.6
hermes doctor — diagnostyka
W razie problemów jako pierwsze należy uruchomić polecenie hermes doctor [--fix]. Sprawdza ono poprawność konfiguracji, obecność zależności, dostępność klucza API i stan usług, a z opcją --fix może podjąć próbę automatycznej naprawy.6
Aby udostępnić diagnostykę innej osobie, należy użyć polecenia hermes dump — tworzy ono zwięzłe podsumowanie w postaci zwykłego tekstu, z ukrytymi kluczami API, gotowe do wklejenia w zgłoszeniu GitHub lub wątku na Discord.6
Polecenia slash
Polecenia slash działają w aktywnej sesji czatu (CLI lub na platformie komunikacyjnej). Są obsługiwane za pośrednictwem wspólnego rejestru COMMAND_REGISTRY w pliku hermes_cli/commands.py, dlatego większość poleceń działa identycznie we wszystkich interfejsach.9
Zarządzanie sesją
| Polecenie | Opis |
|---|---|
/new (alias /reset) |
Rozpoczęcie nowej sesji |
/clear |
Wyczyszczenie ekranu i rozpoczęcie nowej sesji |
/history |
Wyświetlenie historii rozmowy |
/save |
Zapisanie bieżącej rozmowy |
/retry |
Ponowienie ostatniej wiadomości |
/undo |
Usunięcie ostatniej wymiany wiadomości między użytkownikiem a asystentem |
/title <name> |
Ustawienie tytułu bieżącej sesji |
/compress |
Ręczna kompresja kontekstu rozmowy |
/rollback [number] |
Wyświetlenie lub przywrócenie checkpointów systemu plików |
/stop |
Zakończenie wszystkich działających procesów w tle |
/queue <prompt> |
Dodanie promptu do kolejki na następną turę. Uwaga: alias /q jest przypisany zarówno do /queue, jak i do /quit; obowiązuje ostatnia rejestracja, więc w praktyce /q wywołuje /quit — zawsze należy wpisywać pełne polecenie /queue.9 |
/resume [name] |
Wznowienie wcześniej nazwanej sesji |
/statusbar (alias /sb) |
Włączenie lub wyłączenie paska stanu kontekstu/modelu |
/background <prompt> (alias /bg) |
Uruchomienie promptu w osobnej sesji w tle |
/btw <question> |
Tymczasowe pytanie poboczne (bez narzędzi i bez zapisywania) |
/plan [request] |
Wczytanie dołączonego skill plan, aby utworzyć plan zamiast wykonywać działania |
/branch [name] (alias /fork) |
Utworzenie odgałęzienia bieżącej sesji |
/goal <target> |
Skoncentrowanie agenta na celu, aby realizował go konsekwentnie w kolejnych turach. Wzorzec pętli Ralph jako pełnoprawny mechanizm. Konfigurowalny limit tur. Nowość w wersji v0.13.0.18 |
/subgoal <criterion> |
Dodanie kryteriów sukcesu do aktywnego /goal bez ponownego uruchamiania pętli. Nowość w wersji v0.14.0.19 |
/handoff <target> |
Przekazanie aktywnej sesji — wiadomości, wywołań narzędzi i kontekstu — do innego modelu, persony lub profile. Nowość w wersji v0.14.0.19 |
Konfiguracja i model
| Polecenie | Opis |
|---|---|
/config |
Wyświetlenie bieżącej konfiguracji |
/model [model-name] |
Wyświetlenie lub zmiana bieżącego modelu |
/provider |
Wyświetlenie dostępnych dostawców i bieżącego dostawcy |
/personality [name] |
Ustawienie nakładki osobowości |
/verbose |
Przełączanie sposobu wyświetlania postępu działania narzędzi |
/reasoning |
Zarządzanie intensywnością i sposobem wyświetlania rozumowania. Wersja v0.19.0 dodaje poziomy intensywności max i ultra oraz ogranicza ustawienie /reasoning do bieżącej sesji, a także wprowadza w konfiguracji osobne ustawienia intensywności dla poszczególnych modeli i pozycji MoA23 |
/skin |
Wyświetlenie lub zmiana stylu/motywu interfejsu |
/voice [on\|off\|tts\|status] |
Włączenie lub wyłączenie trybu głosowego CLI |
/yolo |
Włączenie lub wyłączenie trybu YOLO (pomijanie próśb o zatwierdzenie). Od wersji v0.19.0 reguły odmowy zdefiniowane przez użytkownika nadal blokują pasujące polecenia, nawet w trybie YOLO23 |
/fast |
Włączenie lub wyłączenie Fast Mode — priorytetowego przetwarzania dla modeli OpenAI i Anthropic (v0.9.0+)16 |
/debug |
Szybka diagnostyka na wszystkich platformach (v0.9.0+)16 |
/subscription |
Zarządzanie planem Nous Portal z poziomu terminala — sprawdzenie planu i pozostałego limitu, podgląd kosztu przejścia na wyższy lub niższy plan oraz zastosowanie zmiany z możliwością cofnięcia (v0.19.0+)23 |
/topup |
Zasilenie salda Nous Portal bez opuszczania terminala (v0.19.0+)23 |
Polecenie /model jest podstawowym narzędziem do przełączania dostawców w trakcie sesji:9
/model # Show current model and options
/model claude-sonnet-4 # Switch model (auto-detect provider)
/model zai:glm-5 # Switch provider:model
/model custom:qwen-2.5 # Use model on custom endpoint
/model custom # Auto-detect model from custom endpoint
/model custom:local:qwen-2.5 # Named custom provider
/model openrouter:anthropic/claude-sonnet-4 # Back to cloud
Wersja v0.19.0 dodaje /model --once — jednorazowe zastąpienie modelu na 1 turę, po której odpowiedzi poprzedni model zostaje automatycznie przywrócony.23
Narzędzia, skills i informacje
| Polecenie | Opis |
|---|---|
/tools [list\|disable\|enable] [name...] |
Zarządzanie narzędziami w bieżącej sesji |
/toolsets |
Wyświetlenie dostępnych toolset |
/browser [connect\|disconnect\|status] |
Zarządzanie lokalnym połączeniem Chrome CDP |
/skills |
Wyszukiwanie, instalowanie, przeglądanie lub zarządzanie skills |
/cron |
Zarządzanie zaplanowanymi zadaniami |
/reload-mcp |
Ponowne wczytanie serwerów MCP z config.yaml |
/plugins |
Wyświetlenie zainstalowanych wtyczek |
/help |
Wyświetlenie wszystkich poleceń |
/usage |
Wyświetlenie użycia tokenów, kosztu i czasu trwania |
/insights |
Wyświetlenie analityki użycia (z ostatnich 30 dni) |
/platforms |
Wyświetlenie stanu platform komunikacyjnych |
/profile |
Wyświetlenie nazwy aktywnego profile i jego katalogu domowego |
Dynamiczne polecenia slash dla skills
Każdy zainstalowany skill jest automatycznie udostępniany jako polecenie slash:9
/gif-search funny cats
/axolotl help me fine-tune Llama 3 on my dataset
/github-pr-workflow create a PR for the auth refactor
/excalidraw # Just the skill name loads it and lets the agent ask what you need
Od wersji v0.19.0 wywołania skills za pomocą poleceń slash można łączyć: /skill-a /skill-b do XYZ wczytuje oba skills po kolei w ramach 1 tury, zapewniając autouzupełnianie i tekst podpowiedzi dla połączonych nazw.23
W config.yaml można również definiować szybkie polecenia, które przypisują krótką nazwę do dłuższego promptu:9
quick_commands:
review: "Review my latest git diff and suggest improvements"
deploy: "Run the deployment script at scripts/deploy.sh and verify the output"
morning: "Check my calendar, unread emails, and summarize today's priorities"
Następnie w CLI należy wpisać /review, /deploy lub /morning.
Dopasowywanie prefiksów
Polecenia obsługują dopasowywanie prefiksów: wpisanie /h wywołuje /help, a /mod — /model. Gdy prefiks jest niejednoznaczny, wybierana jest pierwsza pozycja zgodnie z kolejnością w rejestrze. Pełne nazwy poleceń i zarejestrowane aliasy zawsze mają pierwszeństwo przed dopasowaniami prefiksów.9
Polecenia specyficzne dla platform komunikacyjnych
Niektóre polecenia działają wyłącznie na platformach komunikacyjnych (Telegram, Discord, Slack, WhatsApp, Signal, Email, Home Assistant):9
/status— wyświetlenie informacji o sesji/sethome(alias/set-home) — oznaczenie bieżącego czatu jako platform home/approve [session|always]— zatwierdzenie oczekującego niebezpiecznego polecenia/deny [reason]— odrzucenie oczekującego niebezpiecznego polecenia. Od wersji v0.19.0 polecenie/deny <reason>przekazuje agentowi powód odmowy, aby mógł skorygować sposób działania, zamiast ponawiać próbę bez znajomości przyczyny23/update— zaktualizowanie Hermes Agent do najnowszej wersji/commands [page]— przeglądanie wszystkich poleceń i skills (z podziałem na strony)
Niektóre polecenia są natomiast dostępne wyłącznie w CLI: /skin, /tools, /toolsets, /browser, /config, /cron, /skills, /platforms, /paste, /statusbar, /plugins.9
Narzędzia i toolsets
Hermes jest wyposażony w rozbudowany, wbudowany rejestr narzędzi obejmujący wyszukiwanie w internecie, automatyzację przeglądarki, wykonywanie poleceń w terminalu, edycję plików, pamięć, delegowanie zadań, trenowanie RL, dostarczanie wiadomości, integrację z Home Assistant i inne funkcje.10 Narzędzia są zorganizowane w logiczne toolsets, które można włączać lub wyłączać osobno dla każdej platformy.
Kategorie wysokiego poziomu
| Kategoria | Przykłady | Opis |
|---|---|---|
| Internet | web_search, web_extract |
Wyszukiwanie w internecie i wyodrębnianie zawartości stron |
| Terminal i pliki | terminal, process, read_file, patch |
Wykonywanie poleceń i operacje na plikach |
| Przeglądarka | browser_navigate, browser_snapshot, browser_vision |
Interaktywna automatyzacja przeglądarki wykorzystująca tekst i obraz |
| Multimedia | vision_analyze, video_analyze, video_generate, image_generate, text_to_speech |
Analiza i generowanie multimodalne. video_analyze korzysta w pierwszej kolejności z Gemini, zapewniając rozszerzalną obsługę zgodnych dostawców rozwiązań multimodalnych (v0.13.0+). Wersja v0.14.0 dodaje ujednolicone narzędzie video_generate z wymiennymi backendami dostawców oraz przesyła nieprzetworzone piksele przez vision_analyze, gdy aktywny model obsługuje analizę obrazu.1819 |
| Orkiestracja agentów | todo, clarify, execute_code, delegate_task |
Planowanie, doprecyzowywanie, wykonywanie kodu i delegowanie zadań subagentom |
| Obsługa komputera | computer_use |
Sterowanie pulpitem za pośrednictwem backendu cua-driver; w wersji v0.14.0 funkcja działa również z dostawcami innymi niż Anthropic, których modele obsługują analizę obrazu.19 |
| Pamięć i przywoływanie informacji | memory, session_search |
Trwała pamięć i przeszukiwanie sesji |
| Automatyzacja i dostarczanie | cronjob, send_message |
Zaplanowane zadania i wysyłanie wiadomości |
| Integracje | ha_*, narzędzia MCP, rl_* |
Home Assistant, MCP, trenowanie RL |
Do często używanych nazw toolsets należą web, terminal, file, browser, vision, image_gen, moa, skills, tts, todo, memory, session_search, cronjob, code_execution, delegation, clarify, homeassistant oraz rl.10
Zarządzanie narzędziami
hermes chat --toolsets "web,terminal" # Use specific toolsets
hermes tools # Interactive per-platform tool config
hermes tools --summary # Print enabled-tools summary
Narzędzia można również przełączać w trakcie sesji za pomocą /tools disable <name> oraz /tools enable <name>. Powoduje to zresetowanie sesji, aby nowy zestaw narzędzi zaczął obowiązywać.9
Backendy terminala
Narzędzie terminala może wykonywać polecenia w 6 różnych środowiskach:10
| Backend | Zastosowanie |
|---|---|
local |
Uruchamianie na własnym komputerze (domyślnie) — programowanie i zaufane zadania |
docker |
Odizolowane kontenery — bezpieczeństwo i powtarzalność |
ssh |
Serwer zdalny — środowisko izolowane, oddzielenie agenta od jego własnego kodu |
singularity |
Kontenery HPC — obliczenia klastrowe bez uprawnień roota |
modal |
Bezserwerowe wykonywanie w chmurze |
daytona |
Izolowany obszar roboczy w chmurze — trwałe zdalne środowisko programistyczne |
Backendy można przełączać poleceniem hermes config set terminal.backend <name> lub w pliku config.yaml:
terminal:
backend: docker # or: local, ssh, singularity, modal, daytona
cwd: "." # Working directory
timeout: 180 # Command timeout in seconds
Backend SSH (zalecany ze względów bezpieczeństwa — agent nie może modyfikować własnego kodu):10
terminal:
backend: ssh
# In ~/.hermes/.env
TERMINAL_SSH_HOST=my-server.example.com
TERMINAL_SSH_USER=myuser
TERMINAL_SSH_KEY=~/.ssh/id_rsa
Backend Docker:
terminal:
backend: docker
docker_image: python:3.11-slim
Zasoby kontenera (dotyczy docker, singularity, modal i daytona):10
terminal:
container_cpu: 1
container_memory: 5120 # MB (default 5GB)
container_disk: 51200 # MB (default 50GB)
container_persistent: true # Persist filesystem across sessions
Przy ustawieniu container_persistent: true zainstalowane pakiety, pliki i konfiguracja są zachowywane między sesjami.10
Wszystkie backendy kontenerowe działają z dodatkowymi zabezpieczeniami: systemem plików katalogu głównego tylko do odczytu (Docker), odebranymi wszystkimi funkcjami Linux z wyjątkiem DAC_OVERRIDE, CHOWN i FOWNER, zablokowaną eskalacją uprawnień, limitami PID (256 procesów), pełną izolacją przestrzeni nazw oraz trwałym obszarem roboczym opartym na woluminach.10
Procesy działające w tle
Narzędzie terminala obsługuje wykonywanie zadań w tle z jawnym zarządzaniem procesami:10
terminal(command="pytest -v tests/", background=true)
# Returns: {"session_id": "proc_abc123", "pid": 12345}
process(action="list") # Show all running processes
process(action="poll", session_id="proc_abc123") # Check status
process(action="wait", session_id="proc_abc123") # Block until done
process(action="log", session_id="proc_abc123") # Full output
process(action="kill", session_id="proc_abc123") # Terminate
process(action="write", session_id="proc_abc123", data="y") # Send input
Tryb PTY (pty=true) umożliwia korzystanie z interaktywnych narzędzi CLI, takich jak Codex i Claude Code.10
Sudo
Jeśli polecenie wymaga sudo, Hermes poprosi o podanie hasła, które zostanie zapisane w pamięci podręcznej na czas sesji. Można również ustawić zmienną SUDO_PASSWORD w pliku ~/.hermes/.env.10
Wieloagentowa tablica Kanban (v0.13.0+)
W wersji v0.13.0 współpraca wielu agentów staje się mechanizmem pierwszej klasy: trwałą tablicą Kanban, która śledzi zadania, ich status oraz tożsamość wykonawców między agentami i po ponownych uruchomieniach.18 To właśnie dzięki tablicy rój wykonawców Hermes rzeczywiście kończy pracę, zamiast zatrzymywać się wskutek nieudanych przekazań zadań.
| Mechanizm | Działanie |
|---|---|
| Sygnały aktywności | Każdy wykonawca okresowo wysyła sygnał, dopóki jest właścicielem zadania. Brak sygnału powoduje oznaczenie wykonawcy jako podejrzanego i zwolnienie zadania, aby można było je przejąć. |
| Przejmowanie | Inny wykonawca może podjąć porzucone zadanie, otrzymując jego pełny stan i wcześniejsze częściowe wyniki. |
| Wykrywanie zombie | Wykonawcy, którzy zakończą pracę bez oznaczenia zadania jako ukończonego, są automatycznie blokowani przed podejmowaniem nowych zadań, co zapobiega gromadzeniu się w roju nieaktywnych tożsamości. |
| Brama wykrywania halucynacji | Wynik, który nie przejdzie kontroli, powoduje odesłanie zadania na tablicę wraz z podaną przyczyną zamiast oznaczenia go jako ukończonego. |
max_retries dla poszczególnych zadań |
Umożliwia zastąpienie domyślnego limitu ponownych prób w przypadku zadania, o którym wiadomo, że jest podatne na błędy. |
| Tablice dla wielu projektów | Jeden katalog domowy Hermes może obsługiwać kilka niezależnych tablic. |
Tablica Kanban naturalnie współpracuje z /goal (pętlą Ralph z zablokowanym celem) po stronie celu oraz z istniejącym narzędziem delegate_task w zakresie tworzenia wykonawców. Powstaje w ten sposób wzorzec roju, w którym każdy agent korzysta z jednego źródła prawdy określającego, co należy zrobić dalej, kto nad tym pracuje i gdzie wystąpiła blokada.
System skills
Skills to dokumenty wiedzy ładowane na żądanie, z których agent może korzystać w razie potrzeby. Działają zgodnie z modelem stopniowego ujawniania informacji, aby ograniczyć zużycie tokenów, i są zgodne z otwartym standardem agentskills.io.11
Wszystkie skills znajdują się w ~/.hermes/skills/ — jest to główny katalog i źródło prawdy. Przy nowej instalacji do tego katalogu kopiowane są skills dołączone do repozytorium. Trafiają tam również skills zainstalowane z hubu oraz utworzone przez agenta.11
Stopniowe ujawnianie informacji
Level 0: skills_list() → [{name, description, category}, ...] (~3k tokens)
Level 1: skill_view(name) → Full content + metadata (varies)
Level 2: skill_view(name, path) → Specific reference file (varies)
Agent ładuje pełną treść skill tylko wtedy, gdy rzeczywiście jej potrzebuje.11
Format SKILL.md
---
name: my-skill
description: Brief description of what this skill does
version: 1.0.0
platforms: [macos, linux] # Optional — restrict to OS platforms
metadata:
hermes:
tags: [python, automation]
category: devops
fallback_for_toolsets: [web] # Conditional activation
requires_toolsets: [terminal] # Conditional activation
config: # Config.yaml settings
- key: my.setting
description: "What this controls"
default: "value"
prompt: "Prompt for setup"
---
# Skill Title
## When to Use
Trigger conditions for this skill.
## Procedure
1. Step one
2. Step two
## Pitfalls
- Known failure modes and fixes
## Verification
How to confirm it worked.
Aktywacja warunkowa
Skills mogą być wyświetlane lub ukrywane zależnie od dostępności określonych narzędzi. Jest to szczególnie przydatne w przypadku skills zapasowych — bezpłatnych lub lokalnych alternatyw, które powinny pojawiać się tylko wtedy, gdy narzędzie premium jest niedostępne:11
| Pole | Działanie |
|---|---|
fallback_for_toolsets |
Skill jest ukryta, gdy wymienione toolsets są dostępne |
fallback_for_tools |
Działa tak samo, ale sprawdza poszczególne narzędzia |
requires_toolsets |
Skill jest ukryta, gdy wymienione toolsets są niedostępne |
requires_tools |
Działa tak samo, ale sprawdza poszczególne narzędzia |
Przykład: wbudowana skill duckduckgo-search używa ustawienia fallback_for_toolsets: [web]. Gdy ustawiono FIRECRAWL_API_KEY, toolset web jest dostępny i agent korzysta z web_search, a skill DuckDuckGo pozostaje ukryta. Bez klucza API skill DuckDuckGo automatycznie pojawia się jako rozwiązanie zapasowe.11
Skills zarządzane przez agenta
Agent może tworzyć, aktualizować i usuwać własne skills za pomocą narzędzia skill_manage. Stanowią one pamięć proceduralną agenta — gdy opracuje on nietrywialny przepływ pracy, zapisuje tę metodę jako skill do ponownego wykorzystania w przyszłości.11
Kiedy agent tworzy skills:11 - Po pomyślnym wykonaniu złożonego zadania (co najmniej 5 wywołań narzędzi) - Gdy napotkał błędy lub ślepe zaułki i znalazł skuteczne rozwiązanie - Gdy użytkownik skorygował jego podejście - Gdy odkrył nietrywialny przepływ pracy
Działania:11
| Działanie | Zastosowanie |
|---|---|
create |
Utworzenie nowej skill od podstaw |
patch |
Ukierunkowane poprawki (preferowane — najbardziej oszczędne pod względem tokenów) |
edit |
Znaczące zmiany strukturalne |
delete |
Całkowite usunięcie skill |
write_file |
Dodanie lub zaktualizowanie plików pomocniczych |
remove_file |
Usunięcie pliku pomocniczego |
Hub skills
Przeglądanie, wyszukiwanie, instalowanie i zarządzanie skills z rejestrów internetowych:611
hermes skills browse # Browse all hub skills
hermes skills browse --source official # Browse official optional skills
hermes skills search kubernetes # Search all sources
hermes skills search react --source skills-sh # Search skills.sh directory
hermes skills inspect openai/skills/k8s # Preview before installing
hermes skills install openai/skills/k8s # Install with security scan
hermes skills install skills-sh/anthropics/skills/pdf --force
hermes skills check # Check for upstream updates
hermes skills update # Reinstall changed hub skills
hermes skills audit # Re-scan installed hub skills
hermes skills uninstall k8s
hermes skills publish skills/my-skill --to github --repo owner/repo
hermes skills tap add myorg/skills-repo # Add custom GitHub source
Zintegrowane źródła hubu:11
| Źródło | Przykład | Uwagi |
|---|---|---|
official |
official/security/1password |
Opcjonalne skills dostarczane z Hermes (wbudowany poziom zaufania) |
skills-sh |
skills-sh/vercel-labs/agent-skills/vercel-react-best-practices |
Publiczny katalog skills firmy Vercel |
well-known |
well-known:https://mintlify.com/docs/.well-known/skills/mintlify |
Wykrywanie na podstawie adresów URL w witrynach publikujących /.well-known/skills/index.json |
github |
openai/skills/k8s |
Bezpośrednie instalacje z repozytorium lub ścieżki GitHub |
clawhub |
— | Zewnętrzna platforma handlowa ze skills |
claude-marketplace |
— | Manifesty pluginów i platform handlowych zgodne z Claude |
lobehub |
— | Konwersja katalogu agentów LobeHub |
Domyślne źródła GitHub (można je przeglądać bez konfiguracji): openai/skills, anthropics/skills, VoltAgent/awesome-agent-skills, garrytan/gstack.11
Skanowanie zabezpieczeń
Wszystkie skills instalowane z hubu przechodzą skanowanie zabezpieczeń pod kątem eksfiltracji danych, prompt injection, destrukcyjnych poleceń, sygnałów zagrożeń w łańcuchu dostaw oraz innych niebezpieczeństw.11
Poziomy zaufania:11
| Poziom | Źródło | Zasady |
|---|---|---|
builtin |
Dostarczane z Hermes | Zawsze zaufane |
official |
optional-skills/ w repozytorium |
Wbudowany poziom zaufania, bez ostrzeżenia o źródle zewnętrznym |
trusted |
Zaufane rejestry (openai/skills, anthropics/skills) |
Bardziej liberalne zasady |
community |
Wszystkie pozostałe źródła | Wyniki inne niż niebezpieczne można zastąpić za pomocą --force; werdykty dangerous pozostają zablokowane |
Opcja --force może zastąpić blokady wynikające z zasad dla skills społecznościowych, o ile nie dotyczą one zagrożeń sklasyfikowanych jako niebezpieczne. Nie zastępuje ona werdyktu skanowania dangerous.11
Zewnętrzne katalogi skills
Można wskazać Hermes dodatkowe katalogi skills, które będą skanowane razem z katalogiem lokalnym:11
skills:
external_dirs:
- ~/.agents/skills
- /home/shared/team-skills
- ${SKILLS_REPO}/skills
Ścieżki obsługują rozwijanie ~ oraz podstawianie zmiennych środowiskowych ${VAR}. Katalogi zewnętrzne są tylko do odczytu — gdy agent tworzy lub edytuje skill, zawsze zapisuje ją w ~/.hermes/skills/. Jeśli skill o tej samej nazwie istnieje w obu lokalizacjach, pierwszeństwo ma wersja lokalna.11
Pamięć trwała
Hermes ma ograniczoną, starannie selekcjonowaną pamięć, która jest zachowywana między sesjami. Pamięć agenta składa się z dwóch plików przechowywanych w ~/.hermes/memories/:12
| Plik | Przeznaczenie | Limit znaków |
|---|---|---|
MEMORY.md |
Osobiste notatki agenta — informacje o środowisku, konwencje, zdobyta wiedza | 2 200 znaków (ok. 800 tokenów) |
USER.md |
Profil użytkownika — preferencje, styl komunikacji, oczekiwania | 1 375 znaków (ok. 500 tokenów) |
Oba są wstawiane do promptu systemowego jako zamrożony obraz stanu z początku sesji. Agent zarządza własną pamięcią za pomocą narzędzia memory — add, replace lub remove.12
Wzorzec zamrożonego obrazu stanu: zawartość wstawiana do promptu systemowego jest rejestrowana tylko raz, na początku sesji, i nie zmienia się w jej trakcie. Jest to celowe — pozwala zachować pamięć podręczną prefiksu LLM, co zwiększa wydajność. Zmiany wprowadzone podczas sesji są natychmiast zapisywane na dysku, lecz pojawiają się w prompcie systemowym dopiero w następnej sesji.12
Co zapisywać
Należy zapisywać (agent robi to proaktywnie):12
- Preferencje użytkownika: „Wolę TypeScript od JavaScript” → user
- Informacje o środowisku: „Ten serwer działa na Debianie 12 z PostgreSQL 16” → memory
- Korekty: „Nie używać sudo w poleceniach Docker, użytkownik należy do grupy docker” → memory
- Konwencje: „Projekt używa tabulatorów, limitu 120 znaków w wierszu i docstringów w stylu Google” → memory
- Ukończone prace: „Przeprowadzono migrację bazy danych z MySQL do PostgreSQL 2026-01-15” → memory
Należy pomijać:12 - Błahe lub oczywiste informacje - Fakty, które można łatwo ustalić ponownie - Surowe zrzuty danych (są zbyt obszerne dla pamięci) - Tymczasowe informacje dotyczące konkretnej sesji - Informacje znajdujące się już w plikach kontekstowych
Przeszukiwanie sesji
Oprócz MEMORY.md i USER.md agent może przeszukiwać wcześniejsze rozmowy za pomocą narzędzia session_search. Wszystkie sesje CLI i komunikatorów są przechowywane w SQLite (~/.hermes/state.db) z pełnotekstowym wyszukiwaniem FTS5. Zapytania zwracają odpowiednie wcześniejsze rozmowy podsumowane przez Gemini Flash.12
| Funkcja | Pamięć trwała | Przeszukiwanie sesji |
|---|---|---|
| Pojemność | Łącznie ok. 1 300 tokenów | Nieograniczona (wszystkie sesje) |
| Szybkość | Natychmiastowa (w prompcie systemowym) | Wymaga wyszukania i podsumowania przez LLM |
| Zastosowanie | Kluczowe fakty są zawsze dostępne | Odnajdywanie konkretnych wcześniejszych rozmów |
| Zarządzanie | Ręcznie selekcjonowana przez agenta | Automatyczne — przechowywane są wszystkie sesje |
| Koszt tokenów | Stały dla każdej sesji (ok. 1 300 tokenów) | Naliczany na żądanie |
Zewnętrzni dostawcy pamięci
Do obsługi bardziej rozbudowanej pamięci trwałej, wykraczającej poza MEMORY.md i USER.md, Hermes zawiera osiem wtyczek zewnętrznych dostawców pamięci: Honcho, OpenViking, Mem0, Hindsight, Holographic, RetainDB, ByteRover i Supermemory.12
Zewnętrzni dostawcy działają równolegle z wbudowaną pamięcią (nigdy jej nie zastępują) i zapewniają między innymi grafy wiedzy, wyszukiwanie semantyczne, automatyczne wyodrębnianie faktów oraz modelowanie użytkownika między sesjami:612
hermes memory setup # Pick a provider and configure it
hermes memory status # Check what's active
hermes memory off # Disable external provider (built-in only)
Jednocześnie może być aktywny tylko jeden zewnętrzny dostawca. Wbudowana pamięć jest zawsze aktywna.6
Automatyczne wznawianie sesji (v0.13.0+)
W wersji v0.13.0 przerwanie pracy agenta nie powoduje już utraty sesji. Po ponownym uruchomieniu gateway automatycznie wznawia przerwane sesje; ponowne uruchomienia wykonywane przez /update zachowują stan sesji podczas aktualizacji; przeładowanie plików źródłowych w czasie programowania utrzymuje aktywną sesję zamiast wymuszać utworzenie nowej.18 W praktyce oznacza to, że długotrwałe zadania wykonywane przez gateway oraz zadania uruchamiane przez cron nie tracą już okna kontekstu po ponownym uruchomieniu procesu.
Checkpointy v2 (v0.13.0+)
W wersji v0.13.0 mechanizm utrwalania stanu został przepisany jako rozwiązanie oparte na jednym magazynie, z rzeczywistym usuwaniem zbędnych danych, zabezpieczeniami przestrzeni dyskowej i bez osieroconych repozytoriów pomocniczych.18 Poprzedni system checkpointów gromadził stan na dysku w długo działających profilach; magazyn v2 nakłada ścisły limit na lokalną przestrzeń zajmowaną przez checkpointy i usuwa powieloną ewidencję, która powodowała jej rozrost. Nie jest wymagana żadna zmiana konfiguracji po stronie użytkownika; kolejny zapis checkpointu użyje ścieżki v2.
Osobowość i SOUL.md
SOUL.md określa podstawową tożsamość instancji Hermes. Zajmuje pozycję nr 1 w prompcie systemowym, zastępując domyślną tożsamość zapisaną na stałe w kodzie.13
Hermes automatycznie tworzy domyślny plik SOUL.md w ~/.hermes/SOUL.md (lub $HERMES_HOME/SOUL.md w przypadku niestandardowych profili). Istniejące pliki użytkownika nigdy nie są nadpisywane. Hermes wczytuje SOUL.md wyłącznie z HERMES_HOME — nie szuka go w bieżącym katalogu roboczym. Dzięki temu osobowość pozostaje przewidywalna we wszystkich projektach.13
Co powinno znaleźć się w SOUL.md
Plik ten służy do definiowania trwałych wytycznych dotyczących sposobu wypowiadania się i osobowości:13 - ton - styl komunikacji - poziom bezpośredniości - domyślny styl interakcji - elementy stylistyczne, których należy unikać - sposób, w jaki Hermes powinien radzić sobie z niepewnością, różnicą zdań i niejednoznacznością
W mniejszym stopniu należy używać go do:13 - jednorazowych instrukcji projektowych - ścieżek plików - konwencji repozytorium - tymczasowych szczegółów przepływu pracy
Ich miejsce jest w AGENTS.md, a nie w SOUL.md.
SOUL.md a AGENTS.md
To najważniejsze rozróżnienie w zarządzaniu tożsamością Hermes:13
SOUL.md — tożsamość, ton, styl, domyślne zasady komunikacji i zachowanie wynikające z osobowości.
AGENTS.md — architektura projektu, konwencje programistyczne, preferencje dotyczące narzędzi, przepływy pracy właściwe dla repozytorium, polecenia, porty, ścieżki i uwagi dotyczące wdrażania.
Przydatna zasada: jeśli coś powinno towarzyszyć użytkownikowi wszędzie, należy umieścić to w SOUL.md. Jeśli dotyczy konkretnego projektu, należy umieścić to w AGENTS.md.13
Wbudowane osobowości
Hermes zawiera wbudowane osobowości, między którymi można się przełączać za pomocą /personality:13
| Nazwa | Opis |
|---|---|
helpful |
Przyjazny asystent ogólnego przeznaczenia |
concise |
Krótkie, rzeczowe odpowiedzi |
technical |
Szczegółowy i precyzyjny ekspert techniczny |
creative |
Innowacyjne, nieszablonowe myślenie |
teacher |
Cierpliwy nauczyciel podający jasne przykłady |
kawaii |
Urocze wyrażenia, iskierki i entuzjazm |
catgirl |
Neko-chan posługująca się kocimi wyrażeniami |
pirate |
Kapitan Hermes — obeznany z technologią korsarz |
shakespeare |
Poetycka proza o dramatycznym charakterze |
surfer |
Swobodny surferski klimat |
noir |
Narracja w stylu powieści noir |
uwu |
Maksymalna słodycz i język uwu |
philosopher |
Głęboka refleksja nad każdym zapytaniem |
hype |
MAKSIMUM ENERGII |
Niestandardowe osobowości w config.yaml:13
agent:
personalities:
codereviewer: >
You are a meticulous code reviewer. Identify bugs, security issues,
performance concerns, and unclear design choices. Be precise and constructive.
Następnie można się przełączyć za pomocą /personality codereviewer.
SOUL.md a /personality
SOUL.md określa bazowy sposób wypowiadania się. /personality stanowi nakładkę obowiązującą na poziomie sesji.13 Warto zachować pragmatyczny, domyślny plik SOUL.md, a następnie używać /personality teacher podczas nauki lub /personality creative podczas burzy mózgów.
Nous Tool Gateway (v0.10.0+)
Od wersji Hermes Agent v0.10.0 (2026-04-16) płatni subskrybenci Nous Portal uzyskują zarządzany dostęp do starannie dobranego zestawu narzędzi za pośrednictwem dotychczasowych danych uwierzytelniających Portal — bez konieczności zarządzania dodatkowymi kluczami API.28 Sam CLI Hermes pozostaje objęty licencją MIT i w pełni otwartoźródłowy. Zmiana polega na tym, że uwierzytelnianie w Portal odblokowuje teraz nie tylko wnioskowanie modeli.
Co zawiera gateway
| Narzędzie | Dostawca | Zastosowanie |
|---|---|---|
| Wyszukiwanie w internecie | Firecrawl | Pobieranie aktualnych informacji na potrzeby agentów |
| Generowanie obrazów | FAL / FLUX 2 Pro | Generowanie obrazów bezpośrednio w treści bez konfigurowania klucza FAL |
| Zamiana tekstu na mowę | OpenAI TTS | Odpowiedzi głosowe w gatewayach komunikacyjnych |
| Automatyzacja przeglądarki | Browser Use | Nawigacja i pozyskiwanie danych w trybie headless |
Jak to działa
Gateway jest włączany osobno dla każdego narzędzia za pomocą nowego pola konfiguracyjnego use_gateway. Jeśli dane uwierzytelniające Portal są zapisane w hermes auth, a gateway został włączony dla danego narzędzia, jego wywołania są kierowane przez Portal. W przeciwnym razie używany jest bezpośredni klucz API (jeśli go podano).
# config.yaml — per-tool gateway opt-in
tools:
web_search:
provider: firecrawl
use_gateway: true # route via Nous Portal subscription
image_generation:
provider: fal
use_gateway: true
Kolejność pierwszeństwa podczas działania: gdy gateway jest dostępny, a dla narzędzia ustawiono use_gateway: true, Hermes wybiera gateway nawet wtedy, gdy skonfigurowano również bezpośredni klucz API. Ma to znaczenie dla rozliczeń — wywołania przez gateway są pokrywane z subskrypcji Portal, a nie z salda bezpośredniego klucza API.
Włączanie gatewaya
hermes model # select Nous Portal (OAuth flow)
hermes tools # per-platform tool picker integrates gateway tools
hermes status # confirms gateway/subscription detection
Subskrypcja jest wykrywana automatycznie na podstawie danych uwierzytelniających OAuth Portal zapisanych już w hermes auth — osobne logowanie nie jest wymagane. Od wersji v0.19.0 samą subskrypcją można również zarządzać z poziomu sesji: /subscription wyświetla plan i pozostały limit, dokładnie informuje o koszcie przejścia na wyższy plan lub terminie wejścia w życie przejścia na niższy plan oraz wprowadza zmianę wraz z banerami dotyczącymi zaplanowanej zmiany i możliwością jej cofnięcia; /topup dodaje środki. Aplikacja komputerowa zawiera odpowiadającą tym funkcjom kartę ustawień rozliczeń.23
Ceny i dostęp
Ceny oraz nazwy poziomów są publikowane na stronie cennika Nous Portal (https://portal.nousresearch.com/pricing). W tym przewodniku nie wymieniono poziomów, ponieważ należą one do produktu Portal, a nie do CLI Hermes, i zmieniają się niezależnie od wydań Hermes. Rejestracja jest dostępna pod adresem https://portal.nousresearch.com/; aktualne poziomy można sprawdzić na stronie cennika.
Informacja o wycofaniu
- Zmienna środowiskowa
HERMES_ENABLE_NOUS_MANAGED_TOOLSzostała usunięta w wersji v0.10.0. Zarządzane narzędzia włącza się teraz osobno za pomocą pola konfiguracyjnegouse_gateway, a ich dostępność zależy od stanu subskrypcji Portal.28
Kontekst: czym to wydanie nie jest
CLI Hermes Agent nie wymaga subskrypcji. Projekt nadal jest objęty licencją MIT, a wszystkie podstawowe funkcje (CLI, skills, pamięć, gateway komunikacyjny, cron, MCP, lokalny panel, BYOK dla każdego dostawcy) działają kompleksowo bez żadnych opłat. Wersja v0.10.0 dodaje wygodną ścieżkę dla użytkowników, którzy już opłacają Nous Portal — nie usuwa niczego z bezpłatnej ścieżki.
Messaging Gateway
Hermes może działać jako długotrwale uruchomiony proces gateway, który z poziomu jednego procesu łączy się z 22 platformami komunikacyjnymi: Telegram, Discord, Slack, WhatsApp, Signal, SMS, Email, Home Assistant, Mattermost, Matrix, DingTalk, Feishu/Lark, WeCom, Weixin (WeChat), BlueBubbles (iMessage), QQBot, Microsoft Teams, Tencent Yuanbao, Google Chat, LINE, SimpleX Chat oraz ogólnym adapterem Webhook.327171819 Wersja v0.9.0 dodała obsługę iMessage za pośrednictwem BlueBubbles (automatyczną rejestrację webhooka, kreator konfiguracji i odporność na awarie) oraz natywną obsługę WeChat przez iLink Bot API, z trybem wywołań zwrotnych WeCom dla aplikacji firmowych.16 W wersji v0.11.0 dodano QQBot.27 Wersja v0.12.0 wprowadziła Microsoft Teams i Tencent Yuanbao.17 Wersja v0.13.0 dodała Google Chat jako 20. platformę, wykorzystując tę samą rozszerzalną architekturę adapterów; IRC i Microsoft Teams również przeniesiono do nowego wzorca adapterów z ogólnymi hookami wtyczek env_enablement_fn / cron_deliver_env_var.18 Wersja v0.14.0 dodaje LINE i SimpleX Chat oraz uzupełnia cały stos Microsoft Teams o uwierzytelnianie Graph, odbiornik webhooków, środowisko wykonawcze pipeline’u i dostarczanie wiadomości wychodzących.19 Wersja v0.17.0 (19 czerwca 2026) dodaje iMessage bez pośredniego serwera dzięki Photon Spectrum (uwierzytelnianie OAuth za pomocą kodu urządzenia i polecenia hermes photon login — bez konieczności używania Maca ani serwera pośredniego BlueBubbles), oficjalny adapter WhatsApp Business Cloud API (zastępujący wymóg korzystania z procesu mostu), grupy SimpleX i natywne załączniki oraz Raft jako dołączoną wtyczkę platformy.21
Konfiguracja
hermes gateway setup # Interactive platform configuration
hermes gateway install # Install as user service (systemd/launchd)
hermes gateway start # Start the installed service
hermes gateway stop
hermes gateway restart
hermes gateway status
hermes gateway run # Run in foreground (debugging)
Interaktywna konfiguracja prowadzi przez proces podłączania każdej platformy: tokeny API, identyfikatory botów, mapowania kanałów i listy dozwolonych użytkowników.6
Przepływ wiadomości
Zgodnie z dokumentacją architektury projektu źródłowego:3
Platform event → Adapter.on_message() → MessageEvent
→ GatewayRunner._handle_message()
→ authorize user
→ resolve session key
→ create AIAgent with session history
→ AIAgent.run_conversation()
→ deliver response back through adapter
Każda platforma komunikacyjna korzysta z tej samej pętli konwersacji AIAgent co CLI. Dlatego polecenia z ukośnikiem działają identycznie w obu miejscach, a zadanie cron zaplanowane w Telegram może dostarczyć wynik do Discord — różnica między platformami występuje wyłącznie na obrzeżu systemu.3
Wersja v0.19.0 dodaje routing wiadomości oparty na profilach oraz trwałe dostarczanie. Pojedynczy multipleksowany gateway korzystający z jednego tokenu bota może kierować określone serwery, kanały lub wątki do różnych profili — każdy z całkowicie odizolowaną konfiguracją, skills, pamięcią i sekretami — z możliwością nadpisania przez GATEWAY_MULTIPLEX_PROFILES. Dzięki wzmocnieniu odporności jeden nieprawidłowo skonfigurowany profil nie może już zatrzymać całego gatewaya. W warstwie wewnętrznej indeks routingu przeniesiono do state.db (sessions.json jest teraz opcjonalną starszą kopią), a końcowe odpowiedzi są zapisywane w trwałym rejestrze zobowiązań dostarczenia obejmującym operację wysyłania na platformę — jeśli gotowa odpowiedź nie zostanie dostarczona z powodu awarii gatewaya, po kolejnym uruchomieniu nastąpi ponowna próba zamiast jej bezpowrotnej utraty.23
Autoryzacja i parowanie użytkowników
hermes pairing list # Show pending and approved users
hermes pairing approve <platform> <code>
hermes pairing revoke <platform> <user-id>
hermes pairing clear-pending
Kody parowania uniemożliwiają przypadkowym osobom korzystanie z gatewaya. Użytkownik wysyła kod parowania ze swojej platformy komunikacyjnej; następnie należy go zatwierdzić poleceniem hermes pairing approve. Od tego momentu użytkownik jest autoryzowany.6
Zaplanowane zadania (Cron)
Hermes ma wbudowany system cron, w którym zadania są zadaniami agenta, a nie poleceniami powłoki. Każde zaplanowane zadanie jest wykonywane przez nową instancję AIAgent ze skonfigurowanym promptem i opcjonalnie dołączonymi skills, a wyniki mogą zostać dostarczone na dowolną platformę:36
hermes cron list
hermes cron create --prompt "Check HN for AI news and summarize" --schedule "0 9 * * *" --deliver telegram
hermes cron edit <id>
hermes cron pause <id>
hermes cron resume <id>
hermes cron run <id> # Trigger now on the next tick
hermes cron remove <id>
hermes cron status # Check if scheduler is running
hermes cron tick # Run due jobs once and exit
Zadanie można również utworzyć konwersacyjnie na czacie platformy komunikacyjnej:
Every morning at 9am, check Hacker News for AI news and send me a summary on Telegram.
Agent skonfiguruje zadanie cron za pomocą swoich narzędzi. Zadania są trwale zapisywane w JSON i pozostają dostępne po ponownym uruchomieniu.3
Integracja z MCP
Hermes obsługuje Model Context Protocol zarówno jako klient, jak i serwer:6
Jako klient — umożliwia połączenie Hermes z zewnętrznymi serwerami MCP w celu rozszerzenia zestawu jego narzędzi:
hermes mcp add <name> --url https://example.com/mcp
hermes mcp add <name> --command npx --args "-y,@modelcontextprotocol/server-github"
hermes mcp list
hermes mcp test <name>
hermes mcp remove <name>
hermes mcp configure <name> # Toggle individual tool selection
Można też skonfigurować je ręcznie w config.yaml:14
mcp_servers:
github:
command: npx
args: ["-y", "@modelcontextprotocol/server-github"]
env:
GITHUB_PERSONAL_ACCESS_TOKEN: "ghp_xxx"
Od wersji v0.19.0 narzędzia MCP są udostępniane modelowi zgodnie z konwencją nazewnictwa mcp__server__tool — każda nazwa narzędzia zawiera nazwę jego serwera, dzięki czemu narzędzia o tej samej nazwie udostępniane przez dwa serwery nie powodują już konfliktu — a powiadomienia z dzienników serwera MCP są zapisywane w agent.log.23
Jako serwer — umożliwia udostępnianie konwersacji Hermes innym agentom:
hermes mcp serve
hermes mcp serve -v # Verbose
Kompresja kontekstu
Hermes automatycznie kompresuje długie konwersacje, aby mieściły się w oknie kontekstowym modelu. Moduł podsumowujący kompresję wykonuje osobne wywołanie LLM — można skierować je do dowolnego dostawcy lub punktu końcowego.4
compression:
enabled: true
threshold: 0.50 # Compress at this % of context limit
target_ratio: 0.20 # Fraction to preserve as recent tail
protect_last_n: 20 # Min recent messages to keep uncompressed
summary_model: "google/gemini-3-flash-preview"
summary_provider: "auto" # "auto", "openrouter", "nous", "codex", "main", etc.
summary_base_url: null # Custom OpenAI-compatible endpoint
Opcje dostawcy:4
summary_provider |
summary_base_url |
Rezultat |
|---|---|---|
auto (domyślnie) |
nie ustawiono | Automatyczne wykrywanie najlepszego dostępnego dostawcy |
nous / openrouter / itd. |
nie ustawiono | Wymuszenie wskazanego dostawcy i użycie jego danych uwierzytelniających |
| dowolna wartość | ustawiono | Bezpośrednie użycie niestandardowego punktu końcowego (dostawca jest ignorowany) |
summary_model musi obsługiwać kontekst co najmniej tak długi jak model główny, ponieważ otrzymuje do kompresji całą środkową część konwersacji.4
Ostrzeżenia o wyczerpywaniu budżetu
Podczas wykonywania złożonego zadania wymagającego wielu wywołań narzędzi agent może wyczerpać budżet iteracji (domyślnie: 90 tur), nie zdając sobie z tego sprawy. Funkcja monitorowania budżetu automatycznie ostrzega model:4
| Próg | Poziom | Komunikat widoczny dla modelu |
|---|---|---|
| 70% | Ostrożność | [BUDGET: 63/90. 27 iterations left. Start consolidating.] |
| 90% | Ostrzeżenie | [BUDGET WARNING: 81/90. Only 9 left. Respond NOW.] |
Limity czasu strumienia
Połączenie strumieniowe LLM ma dwie warstwy limitów czasu, które automatycznie dostosowują się do lokalnych dostawców (localhost, adresy IP w sieci LAN):4
| Limit czasu | Domyślnie | Lokalni dostawcy | Zmienna środowiskowa |
|---|---|---|---|
| Limit czasu odczytu z gniazda | 120 s | Automatycznie zwiększany do 1800 s | HERMES_STREAM_READ_TIMEOUT |
| Wykrywanie nieaktywnego strumienia | 180 s | Automatycznie wyłączone | HERMES_STREAM_STALE_TIMEOUT |
| Wywołanie API (bez przesyłania strumieniowego) | 1800 s | Bez zmian | HERMES_API_TIMEOUT |
Limit czasu odczytu z gniazda jest zwiększany do 30 minut w przypadku lokalnych punktów końcowych, ponieważ przy dużych kontekstach lokalne LLM mogą potrzebować kilku minut na wstępne przetwarzanie, zanim wygenerują pierwszy token.4
Lokalny panel internetowy (v0.9.0+)
Panel działający w przeglądarce, który służy do lokalnego zarządzania Hermes Agent. Umożliwia konfigurowanie ustawień, monitorowanie sesji, przeglądanie skills oraz zarządzanie gateway bez modyfikowania plików konfiguracyjnych ani korzystania z terminala.16 Uruchamia się go poleceniem hermes dashboard. To najłatwiejszy sposób rozpoczęcia pracy dla nowych użytkowników preferujących interfejs graficzny.
Monitorowanie procesów w tle (v0.9.0+)
watch_patterns umożliwia określenie wzorców monitorowanych w danych wyjściowych procesów działających w tle oraz otrzymywanie powiadomień w czasie rzeczywistym po ich dopasowaniu.16 Można wykrywać błędy, oczekiwać na określone zdarzenia („listening on port”) lub śledzić logi kompilacji — bez odpytywania. W połączeniu z notify_on_complete z wersji v0.8.0 (funkcją powiadamiającą o ukończeniu zadania w tle) Hermes oferuje teraz kompletną warstwę obserwowalności procesów działających w tle.15
Wymienny context engine (v0.9.0+)
Zarządzanie kontekstem jest teraz wymiennym modułem dostępnym za pośrednictwem hermes plugins. Można podłączać niestandardowe context engines, które kontrolują informacje widoczne dla agenta w każdej turze — przez filtrowanie, podsumowywanie lub wstrzykiwanie kontekstu właściwego dla danej dziedziny.16 Oddziela to strategię zarządzania kontekstem od głównej pętli agenta, umożliwiając dostosowanie kontekstu do konkretnego projektu lub dziedziny.
Kopie zapasowe i przywracanie (v0.9.0+)
hermes backup tworzy pełne archiwum konfiguracji, sesji, skills i pamięci. hermes import przywraca dane z archiwum kopii zapasowej.16 Funkcje te służą do migracji między urządzeniami, tworzenia migawek przed istotnymi zmianami oraz udostępniania członkom zespołu sprawdzonej konfiguracji.
Obsługa Termux i systemu Android (v0.9.0+)
Hermes działa natywnie na urządzeniach z systemem Android za pośrednictwem Termux. Dostosowane ścieżki instalacji, optymalizacje TUI dla ekranów urządzeń mobilnych, obsługa backendu głosowego oraz polecenie /image działają bezpośrednio na urządzeniu.16
Wzmocnienie zabezpieczeń (v0.13.0+)
W wersji v0.13.0 usunięto 8 problemów bezpieczeństwa klasy P0 i zmieniono jedno ustawienie domyślne na korzystniejsze dla użytkownika.18 Wersja v0.14.0 usuwa kolejne 12 problemów klasy P0 i 50 problemów klasy P1, w tym wzmacnia ochronę przed atakami brute force na sudo i nadużywaniem sudo-stdin, eliminuje sposoby obchodzenia zabezpieczeń przed niebezpiecznymi poleceniami, oczyszcza błędy narzędzi przed ich ponownym wstrzyknięciem do modelu, dodaje uwierzytelnianie API wtyczek panelu, rozszerza ochronę skills-hub przed SSRF oraz wprowadza skanowanie ostrzeżeń dotyczących łańcucha dostaw podczas instalacji.19
| Poprawka | Co się zmieniło |
|---|---|
| Domyślne ukrywanie sekretów | Wcześniej wymagało włączenia. Sekrety w logach i danych przesyłanych przez hermes debug share są ukrywane, chyba że funkcję tę jawnie wyłączono. W wersji v0.12.0 ukrywanie było domyślnie wyłączone po zgłoszeniach dotyczących uszkadzania ładunków; v0.13.0 ponownie je włącza jako bezpieczniejsze ustawienie bazowe. |
| Obejście ograniczeń wiadomości prywatnych między serwerami Discord (CVSS 8.1) | Listy dozwolonych ról Discord są teraz ograniczone do konkretnego serwera, co zamyka lukę, przez którą rola użytkownika na jednym serwerze zezwalała na wiadomości prywatne na wszystkich serwerach. |
| Domyślne ograniczenia WhatsApp | Adapter WhatsApp domyślnie odrzuca wiadomości od nieznajomych i nigdy nie odpowiada na czacie z samym sobą. |
| Okno TOCTOU w MCP OAuth | Usunięto sytuację wyścigu podczas zapisywania danych uwierzytelniających w przepływach MCP OAuth. |
TOCTOU w pliku auth.json usługi CLI |
Usunięto analogiczne okno TOCTOU w mechanizmie zapisywania danych uwierzytelniających w magazynie uwierzytelniania CLI. |
| Podstawowa ochrona przeglądarki przed SSRF | Routing hybrydowy wymusza podstawową ochronę przed SSRF wymierzonym w metadane chmurowe, blokując żądania próbujące uzyskać dostęp do 169.254.169.254 i jego odpowiedników. |
| Skanowanie zadań cron pod kątem wstrzykiwania promptów | Przed uruchomieniem zadania cron złożone prompty (w tym wczytana zawartość skills) są skanowane pod kątem wstrzykiwania promptów. |
Ukrywanie danych przez hermes debug share |
Treść logów przesyłanych przez funkcję udostępniania danych debugowania jest ukrywana podczas wysyłania, a nie tylko podczas zapisu. |
W przypadku utrzymywania wdrożenia Hermes wersje v0.13.0 i v0.14.0 należy traktować jako aktualizacje istotne dla bezpieczeństwa, a nie wyłącznie wydania nowych funkcji. Wersja v0.13.0 usuwa lukę umożliwiającą obejście ograniczeń między serwerami Discord oraz dwa okna TOCTOU; v0.14.0 wprowadza kolejną serię wzmocnień w zakresie obsługi sudo, ponownego wstrzykiwania błędów narzędzi, API wtyczek, ochrony skills-hub przed SSRF oraz ostrzeżeń dotyczących zależności.
Architektura dla praktyków
Ta sekcja jest przeznaczona dla osób, które chcą zrozumieć mechanizmy działania systemu, aby móc go debugować, rozszerzać lub analizować jego wydajność. Stanowi syntezę dokumentacji architektury projektu źródłowego.3
Punkty wejścia → AIAgent
Każdy punkt wejścia w Hermes ostatecznie wywołuje AIAgent.run_conversation():
┌──────────────────────────────────────────────────────────────────┐
│ Entry Points │
│ │
│ CLI (cli.py) Gateway (gateway/run.py) ACP (acp_adapter/) │
│ Batch Runner API Server Python Library │
└──────────┬──────────────┬───────────────────────┬────────────────┘
│ │ │
▼ ▼ ▼
┌──────────────────────────────────────────────────────────────────┐
│ AIAgent (run_agent.py) │
│ │
│ ┌─────────────┐ ┌──────────────┐ ┌──────────────┐ │
│ │ Prompt │ │ Provider │ │ Tool │ │
│ │ Builder │ │ Resolution │ │ Dispatch │ │
│ └──────┬──────┘ └──────┬───────┘ └──────┬───────┘ │
│ │ │ │ │
│ ┌──────┴───────┐ ┌──────┴───────┐ ┌──────┴───────┐ │
│ │ Compression │ │ 3 API Modes │ │ Tool Registry│ │
│ │ & Caching │ │ chat_compl │ │ 47 tools │ │
│ │ │ │ codex_resp │ │ 20 toolsets │ │
│ │ │ │ anthropic │ │ │ │
│ └──────────────┘ └──────────────┘ └──────────────┘ │
└──────────────────────────────────────────────────────────────────┘
Diagram opracowano na podstawie dokumentacji architektury projektu źródłowego.3
„47 narzędzi / 20 toolsets” a „28 narzędzi” w banerze. Liczba „47 narzędzi” oznacza łączną liczbę narzędzi w rejestrze repozytorium źródłowego — obejmuje każde narzędzie, którego kod źródłowy jest dostarczany z Hermes, we wszystkich toolsets. Rzeczywiście uruchomiony CLI wyświetli w banerze startowym mniejszą liczbę (instalacja, na której zweryfikowano ten przewodnik, zgłasza 28 tools / 89 skills). Nie jest to błąd. Wiele toolsets jest opcjonalnych i wymaga jawnego włączenia w config.yaml w sekcji toolsets: — dotyczy to m.in. adapterów platform komunikacyjnych, automatyzacji przeglądarki oraz bardziej zaawansowanych narzędzi do pozyskiwania danych. Łączna liczba w rejestrze oznacza „to, co jest dostępne”, natomiast liczba w banerze — „to, co jest włączone w bieżącym profile”. Aktywne toolsets można sprawdzić za pomocą hermes tools --list, a poszczególne toolsets włączać lub wyłączać w bloku toolsets: w pliku ~/.hermes/config.yaml (albo za pomocą /tools list, /tools enable <name> i /tools disable <name> w uruchomionej sesji — usunięcie narzędzia powoduje zresetowanie sesji, aby agent mógł ponownie utworzyć swój manifest narzędzi).
Trzy tryby API
Hermes ujmuje różnice między dostawcami w postaci trzech trybów API, wybieranych automatycznie podczas działania:3
| Tryb API | Używany przez |
|---|---|
chat_completions |
OpenRouter, z.ai, Kimi, MiniMax, DeepSeek, Alibaba, większość niestandardowych punktów końcowych, dowolny serwer zgodny z OpenAI |
codex_responses |
OpenAI Codex (przez ChatGPT OAuth) |
anthropic_messages |
Anthropic API (natywny), Anthropic OAuth, serwery proxy zgodne z Anthropic |
Mechanizm rozpoznawania w runtime_provider.py mapuje krotki (provider, model) na (api_mode, api_key, base_url) dla ponad 18 dostawców, obsługując przepływy OAuth, pule danych uwierzytelniających oraz rozpoznawanie aliasów.3
Przepływ danych w sesji CLI
User input → HermesCLI.process_input()
→ AIAgent.run_conversation()
→ prompt_builder.build_system_prompt()
→ runtime_provider.resolve_runtime_provider()
→ API call (chat_completions / codex_responses / anthropic_messages)
→ tool_calls? → model_tools.handle_function_call() → loop
→ final response → display → save to SessionDB
Na podstawie strony poświęconej architekturze projektu źródłowego.3
Kolejność składania promptu
Stos promptu obejmuje:13
SOUL.md(tożsamość agenta — lub wbudowany wariant zastępczy, jeśli plik jest niedostępny)- Wskazówki dotyczące zachowania uwzględniającego dostępne narzędzia
- Pamięć i kontekst użytkownika (
MEMORY.md,USER.md) - Wskazówki dotyczące skills
- Pliki kontekstowe (
AGENTS.md,.cursorrules) - Znacznik czasu
- Wskazówki dotyczące formatowania właściwe dla danej platformy
- Opcjonalne nakładki na prompt systemowy, takie jak
/personality
SOUL.md stanowi fundament — wszystkie pozostałe elementy są na nim nadbudowywane.13
Przechowywanie sesji
Sesje są przechowywane w bazie SQLite z pełnotekstowym wyszukiwaniem FTS5. Obejmują śledzenie pochodzenia (relacje nadrzędne/podrzędne między kompresjami), izolację poszczególnych platform oraz niepodzielne operacje zapisu z obsługą konfliktów dostępu.3
System wtyczek
Dostępne są trzy źródła wykrywania: ~/.hermes/plugins/ (użytkownik), .hermes/plugins/ (projekt) oraz punkty wejścia pip. Wtyczki rejestrują narzędzia, haki i polecenia CLI za pośrednictwem kontekstowego API. Dostawcy pamięci stanowią wyspecjalizowany typ wtyczki w katalogu plugins/memory/.3
hermes plugins # Interactive enable/disable UI
hermes plugins install <repo> # Install from Git URL or owner/repo
hermes plugins enable <name>
hermes plugins disable <name>
hermes plugins list
Zasady projektowe
Na podstawie strony poświęconej architekturze projektu źródłowego:3
| Zasada | Znaczenie w praktyce |
|---|---|
| Stabilność promptu | Prompt systemowy nie zmienia się w trakcie rozmowy. Nie występują modyfikacje unieważniające cache, z wyjątkiem jawnych działań użytkownika (/model) |
| Obserwowalne wykonywanie | Każde wywołanie narzędzia jest widoczne dla użytkownika za pośrednictwem wywołań zwrotnych. Aktualizacje postępu w CLI (wskaźnik aktywności) oraz gateway (wiadomości na czacie) |
| Możliwość przerwania | Wywołania API i wykonywanie narzędzi można przerwać w trakcie działania za pomocą danych wprowadzonych przez użytkownika lub sygnałów |
| Rdzeń niezależny od platformy | Jedna klasa AIAgent obsługuje CLI, gateway, ACP, przetwarzanie wsadowe oraz serwer API. Różnice między platformami są obsługiwane w punkcie wejścia |
| Luźne powiązania | Opcjonalne podsystemy (MCP, wtyczki, dostawcy pamięci, środowiska RL) korzystają ze wzorców rejestru i warunkowania za pomocą check_fn, a nie ze sztywnych zależności |
| Izolacja profile | Każdy profile otrzymuje własne HERMES_HOME, konfigurację, pamięć, sesje oraz PID gateway. Wiele profiles może działać równocześnie |
Migracja z OpenClaw
Hermes Agent jest następcą OpenClaw. W przypadku migracji z istniejącej instalacji OpenClaw:65
hermes claw migrate --dry-run # Preview what would be migrated
hermes claw migrate --preset full # Full migration including API keys
hermes claw migrate --preset user-data --overwrite # User data only, no secrets
hermes claw migrate --source /custom/path # Non-default OpenClaw location
hermes claw migrate domyślnie odczytuje dane z ~/.openclaw (automatycznie wykrywa również starsze katalogi ~/.clawdbot i ~/.moldbot) oraz zapisuje je w ~/.hermes.6
Importowane bezpośrednio (ponad 30 kategorii): SOUL.md, MEMORY.md, USER.md, AGENTS.md, skills z 4 katalogów źródłowych, domyślny model, niestandardowi dostawcy, serwery MCP, tokeny i listy dozwolonych użytkowników platform komunikacyjnych (Telegram, Discord, Slack, WhatsApp, Signal, Matrix, Mattermost), ustawienia domyślne agenta (intensywność rozumowania, kompresja, opóźnienie imitujące człowieka, strefa czasowa, sandbox), zasady resetowania sesji, reguły zatwierdzania, konfiguracja TTS, ustawienia przeglądarki, ustawienia narzędzi, limit czasu wykonywania, lista dozwolonych poleceń, konfiguracja gateway oraz klucze API z 3 źródeł.6
Archiwizowane do ręcznego sprawdzenia: zadania cron, wtyczki, haki/webhooki, backend pamięci (QMD), konfiguracja rejestru skills, interfejs użytkownika/tożsamość, rejestrowanie zdarzeń, konfiguracja wielu agentów, powiązania kanałów, IDENTITY.md, TOOLS.md, HEARTBEAT.md, BOOTSTRAP.md.6
Klucze API są wyszukiwane w trzech źródłach według następującej kolejności priorytetów: wartości konfiguracji → ~/.openclaw/.env → auth-profiles.json.6
Rozwiązywanie problemów
„No inference provider configured. Run ‘hermes model’ to choose a provider and model”
Pierwszy błąd, który pojawia się po każdej nowej instalacji: Hermes nie ma jeszcze skonfigurowanego aktywnego dostawcy. Komunikat oznacza dokładnie to, co mówi — żadna z 3 ścieżek uwierzytelniania nie zapewniła działającego dostawcy. Należy uruchomić:
hermes model
Interaktywny selektor przeprowadza przez konfigurację każdego obsługiwanego dostawcy, w tym procesy z kodem urządzenia OAuth (Nous Portal, GitHub Copilot, Anthropic, OpenAI Codex) oraz niestandardowe endpointy serwerów hostowanych samodzielnie. Jeśli dostawca powinien być już skonfigurowany, polecenie hermes doctor pokaże, które dane uwierzytelniające Hermes rzeczywiście wykrywa. Najczęstsze przyczyny to klucz API zapisany w niewłaściwym miejscu (powinien znajdować się w .env lub zostać ustawiony za pomocą hermes config set, a nie w profilu powłoki), wygasłe dane uwierzytelniające OAuth w ~/.hermes/auth.json albo niestandardowy endpoint w config.yaml, w którym brakuje wartości base_url. Ścieżki uwierzytelniania szczegółowo opisano w sekcji Uwierzytelnianie i dostawcy.27
„Klucz API nie jest ustawiony”
Należy uruchomić hermes model, aby interaktywnie skonfigurować dostawcę, albo wykonać hermes config set OPENROUTER_API_KEY your_key. Polecenie hermes doctor wskaże dokładnie, których kluczy brakuje.7
„Context limit: 2048 tokens” podczas uruchamiania (modele lokalne)
Hermes automatycznie wykrywa długość kontekstu za pośrednictwem endpointu /v1/models serwera, ale wiele lokalnych serwerów zgłasza niskie wartości domyślne. Wartość tę należy ustawić jawnie w config.yaml:2
model:
default: your-model
provider: custom
base_url: http://localhost:11434/v1
context_length: 32768
Wywołania narzędzi są wyświetlane jako tekst zamiast wykonywane
Na serwerze nie włączono wywoływania narzędzi albo model nie obsługuje go za pośrednictwem implementacji danego serwera.2
| Serwer | Rozwiązanie |
|---|---|
| llama.cpp | Dodać --jinja do polecenia uruchamiającego |
| vLLM | Dodać --enable-auto-tool-choice --tool-call-parser hermes |
| SGLang | Dodać --tool-call-parser qwen (lub odpowiedni parser) |
| Ollama | Wywoływanie narzędzi jest domyślnie włączone — należy sprawdzić za pomocą ollama show <model>, czy model je obsługuje |
| LM Studio | Zaktualizować do wersji 0.3.6 lub nowszej i użyć modelu z natywną obsługą narzędzi |
Odpowiedzi urywają się w połowie zdania
Możliwe są 2 przyczyny:2
- Niski limit odpowiedzi (
max_tokens) na serwerze — domyślnie SGLang ogranicza odpowiedź do 128 tokenów. Należy ustawić--default-max-tokensna serwerze albo skonfigurowaćmodel.max_tokenswconfig.yaml. - Wyczerpanie kontekstu — model wypełnił całe okno kontekstu. Należy zwiększyć
model.context_lengthalbo włączyć kompresję kontekstu w Hermes.
„Connection refused” przy łączeniu się z WSL2 z serwerem modelu działającym w systemie Windows
WSL2 korzysta z wirtualnej karty sieciowej i własnej podsieci — localhost w WSL2 wskazuje maszynę wirtualną z systemem Linux, a nie hosta z systemem Windows. Dostępne są 2 rozwiązania:2
Sieć lustrzana (Windows 11 22H2 lub nowszy): należy edytować %USERPROFILE%\.wslconfig:
[wsl2]
networkingMode=mirrored
Następnie wykonać wsl --shutdown i uruchomić środowisko ponownie. localhost będzie teraz działać w obu kierunkach.
Awaryjne użycie adresu IP hosta (starsze wersje systemu Windows): należy pobrać adres IP hosta Windows z poziomu WSL2 i użyć go zamiast localhost:
ip route show | grep -i default | awk '{ print $3 }'
# Use that IP as the base_url host
Serwer modelu musi również nasłuchiwać na 0.0.0.0, a nie na 127.0.0.1 — w przypadku Ollama należy ustawić OLLAMA_HOST=0.0.0.0, w przypadku llama-server/SGLang dodać --host 0.0.0.0, a w LM Studio włączyć opcję „Serve on Network”.2
Gdzie znajdują się wszystkie pliki?
Pomocne będą tutaj polecenia hermes status i hermes dump. hermes logs list wyświetla wszystkie pliki dzienników wraz z ich rozmiarami. hermes config path wyświetla lokalizację pliku konfiguracyjnego. hermes config env-path wyświetla lokalizację pliku .env.6
Często zadawane pytania
Czym różni się Hermes Agent od Claude Code?
Claude Code to oficjalny CLI firmy Anthropic, ograniczony do modeli Anthropic. Hermes Agent to platforma agentowa typu open source opracowana przez Nous Research, która współpracuje z każdym dostawcą zgodnym z OpenAI — Nous Portal, OpenRouter, Anthropic, GitHub Copilot, z.ai, Kimi, MiniMax, DeepSeek, Hugging Face, Google lub własnym endpointem hostowanym samodzielnie.12 Hermes oferuje również gateway komunikacyjny dla Telegram/Discord/Slack/WhatsApp/Signal, którego Claude Code nie ma.
Czy można używać Hermes z kluczem API firmy Anthropic?
Tak. Dostępne są 3 sposoby:2
- Ustawić
ANTHROPIC_API_KEYw~/.hermes/.envi uruchomićhermes chat --provider anthropic --model claude-sonnet-4-6 - Uruchomić
hermes modeli wybrać Anthropic — Hermes użyje magazynu danych uwierzytelniających Claude Code, jeśli będzie dostępny - Ustawić ręcznie
ANTHROPIC_TOKEN(token konfiguracyjny lub token OAuth) jako rozwiązanie awaryjne
Opcja 2 jest zalecana, jeśli Claude Code jest już używany na tym samym komputerze — pozwala zachować możliwość odświeżania danych uwierzytelniających Claude.
Jak zmienić dostawcę bez utraty rozmowy?
W ramach sesji należy użyć /model provider:model. Historia rozmowy, pamięć i skills zostaną zachowane:9
/model zai:glm-5
/model openrouter:anthropic/claude-sonnet-4
/model custom:local:qwen-2.5
Skonfigurowano Anthropic, ale funkcje obrazu, sieci i kompresji nie działają
Przyczyną jest awaryjny model pomocniczy. Analiza obrazu, podsumowywanie treści internetowych, kompresja i inne zadania poboczne korzystają z osobnego pomocniczego LLM — domyślnie jest to Gemini Flash wybierany przez automatyczne wykrywanie (OpenRouter → Nous → Codex). Jeśli żaden z tych dostawców nie został skonfigurowany, a dostępny jest wyłącznie Anthropic, funkcje te ograniczają swoje działanie bez wyświetlania błędu.4
Rozwiązanie: dodać OPENROUTER_API_KEY na potrzeby zadań pomocniczych albo ponownie skonfigurować sloty pomocnicze tak, aby korzystały z głównego dostawcy. Warto pamiętać, że kompresja kontekstu znajduje się we własnym bloku najwyższego poziomu compression: i przyjmuje summary_provider, a nie auxiliary.compression.provider — slot auxiliary.compression udostępnia wyłącznie timeout. Pełne rozwiązanie:
auxiliary:
vision: { provider: "main" }
web_extract: { provider: "main" }
compression:
summary_provider: "main"
Czym różnią się SOUL.md i AGENTS.md?
SOUL.md definiuje tożsamość agenta — ton, styl i domyślne zasady komunikacji. Znajduje się w ~/.hermes/SOUL.md i obowiązuje wszędzie. AGENTS.md dotyczy konkretnego projektu — jego architektury, konwencji, poleceń i ścieżek — oraz znajduje się w katalogu projektu.13 Informacje, które powinny obowiązywać wszędzie, należy umieścić w SOUL.md. Informacje dotyczące konkretnego projektu powinny trafić do AGENTS.md.
Jak uruchomić obok siebie wiele instancji Hermes?
Należy użyć profiles. Każdy profile otrzymuje własne HERMES_HOME, konfigurację, pamięć, sesje oraz PID gateway:6
hermes profile create work --clone
hermes profile use work # Sticky default
hermes -p work chat -q "..." # One-off without switching
hermes profile alias work --name h-work # Wrapper script
Czy Hermes obsługuje lokalne LLMs?
Tak, za pośrednictwem ścieżki niestandardowego endpointu. Hermes współpracuje z każdym serwerem zgodnym z OpenAI: Ollama, vLLM, SGLang, llama.cpp/llama-server, LM Studio, LocalAI, Jan lub własnym rozwiązaniem.2 Instrukcje konfiguracji poszczególnych serwerów znajdują się w sekcji Niestandardowe endpointy i endpointy hostowane samodzielnie.
Dlaczego baner startowy pokazuje mniej narzędzi, niż podano w przewodniku?
W przewodniku podano 47 narzędzi / 20 toolsets na podstawie nadrzędnego rejestru architektury — jest to pełna liczba narzędzi, których kod źródłowy Hermes dostarcza we wszystkich toolsets. Działająca instalacja pokazuje w banerze mniejszą liczbę (instalacja referencyjna użyta w tym przewodniku zgłasza 28 narzędzi), ponieważ podczas uruchamiania Hermes włącza tylko domyślny zestaw toolsets. Wiele toolsets wymaga jawnego włączenia: adaptery gateway komunikacyjnego, automatyzacja przeglądarki, bardziej rozbudowane mechanizmy pobierania danych ze stron oraz kilka wyspecjalizowanych integracji muszą zostać wyraźnie wymienione w sekcji toolsets: pliku ~/.hermes/config.yaml, zanim zostaną załadowane. Łączna liczba w rejestrze = „co jest dostępne po włączeniu”. Łączna liczba w banerze = „co faktycznie załadowano w bieżącym profile”. Za pomocą hermes tools --list można sprawdzić, które toolsets są aktywne, a które są dostępne, lecz wyłączone. Poszczególne toolsets można przełączać podczas działania za pomocą /tools enable <name> i /tools disable <name> (wyłączenie powoduje zresetowanie sesji, aby agent przebudował manifest narzędzi zgodnie z nową konfiguracją).
Jak Hermes obsługuje awaryjną zmianę modelu, gdy główny dostawca przestaje działać?
Należy skonfigurować blok fallback_model w config.yaml:2
fallback_model:
provider: openrouter
model: anthropic/claude-sonnet-4
Gdy główny dostawca przestanie działać (z powodu limitu żądań, błędu serwera lub niepowodzenia uwierzytelniania), Hermes przełączy się na model awaryjny w trakcie sesji bez utraty historii rozmowy. Może to nastąpić najwyżej raz w każdej sesji.
Czy agent może z czasem ulepszać własne skills?
Tak — na tym polega „samodoskonalenie” Hermes Agent. Agent może tworzyć, aktualizować i usuwać skills za pomocą narzędzia skill_manage. Gdy opracuje nietrywialny przepływ pracy, zapisuje zastosowane podejście jako skill do ponownego wykorzystania w przyszłości.11 Agent tworzy skills po złożonych zadaniach (wymagających co najmniej 5 wywołań narzędzi), po napotkaniu błędów i znalezieniu działającego rozwiązania, po skorygowaniu jego podejścia przez użytkownika albo po odkryciu nietrywialnego przepływu pracy.
Czy dostępna jest integracja z IDE?
Tak — Hermes może działać jako serwer ACP (Agent Client Protocol) dla VS Code, Zed i JetBrains:6
pip install -e '.[acp]'
hermes acp
Dziennik zmian
| Data | Zmiana | Źródło |
|---|---|---|
| 2026-07-21 | Przewodnik v1.11: v0.19.0 „The Quicksilver Release” (20 lipca 2026, tag v2026.7.20). Dodano sekcję „Co nowego w v0.19.0”: skrócenie TTFT pierwszej tury o około 80% (zimny start od przesłania do wysłania: z około 4,3 s do około 0,9 s w CLI/gateway/TUI/aplikacji desktopowej/cron), domyślnie włączone strumieniowanie procesu rozumowania na żywo (display.show_reasoning ON), fala około 20 PR-ów przyspieszających aplikację desktopową (14-krotnie szybsze strumieniowanie Markdown) oraz przyrostowe renderowanie Markdown w TUI; instalacje przez pip/Homebrew uznano za przestarzałe (wyłącznie ostrzeżenie „unsupported legacy”, planowane usunięcie publikowania w PyPI/Homebrew) — poprawiono sekcję Instalacja i TL;DR, wskazując jednowierszowy instalator; wymienny SecretSource z dostawcami Bitwarden i 1Password (odwołania op://, wiele sejfów, deterministyczna kolejność pierwszeństwa, pochodzenie każdej zmiennej); domyślne inteligentne zatwierdzanie (niezależny recenzent LLM dla każdego oznaczonego polecenia) oraz definiowane przez użytkownika reguły odmowy, obowiązujące również w trybie YOLO, a także /deny <reason> i ponownie wdrożona eskalacja zatwierdzania pre_tool_call przez plugin; rozliczenia w terminalu przez /subscription i /topup oraz karta rozliczeń w aplikacji desktopowej (wycofano stwierdzenie o „braku osobnego polecenia subskrypcji”); transkrypcje subagentów na żywo, trwałe delegowanie w tle oraz rejestr zobowiązań dotyczących dostarczenia wyniku w state.db; max_async_children uznano za przestarzałe na rzecz ujednoliconych limitów współbieżności delegowania; routing wiadomości gateway oparty na profilach (jeden multipleksowany token bota → odizolowane profile, GATEWAY_MULTIPLEX_PROFILES, indeks routingu w state.db, sessions.json jako opcjonalna starsza kopia); dostawcy/modele: Fireworks AI (2. pozycja w selektorze), DeepInfra, Upstage Solar, kompleksowa obsługa GPT-5.6 (Sol/Terra/Luna + Pro), grok-4.5 GA, kimi-k3 (wycofano kimi-k2.x), pełna integracja Claude Sonnet 5, ustawienie enabled: false dla poszczególnych dostawców oraz excluded_providers, poziomy wysiłku rozumowania max/ultra z nadpisaniami dla poszczególnych modeli/slotów MoA i ograniczonym do sesji /reasoning; CLI/MCP: hermes sessions export (Markdown/Quarto/HTML/tylko prompt/ślad HF, --redact), /model --once, łączone wywołania slash-skill, --safe-mode, hermes config get/unset, prawdziwie bezinterfejsowy hermes serve, nazewnictwo MCP mcp__server__tool. Odnotowano również pominięte tagi poprawek v0.18.1 (tag v2026.7.7) i v0.18.2 (tag v2026.7.7.2) z 7–8 lipca 2026 — zbiorcze poprawki infrastruktury; najważniejsza poprawka v0.18.2 usuwa przypięcie WhatsApp Baileys do wersji 7.0.0-rc13, aby zapewnić niezawodne kompilacje Docker. |
23 24 |
| 2026-07-16 | Dodano pierwszy wpis dotyczący rozwiązywania problemów dla komunikatu błędu uruchamiania w jego dokładnym brzmieniu „No inference provider configured. Run ‘hermes model’ to choose a provider and model” — w odpowiedzi na zapotrzebowanie widoczne w wyszukiwaniach; wpis wskazuje interaktywny selektor, hermes doctor i 3 ścieżki uwierzytelniania. Bez zmian w produkcie. |
2 7 |
| 2026-07-01 | Przewodnik v1.10: v0.18.0 „The Judgment Release” (1 lipca 2026, tag v2026.7.1). Dodano sekcję „Co nowego w v0.18.0”: zamknięto cały backlog P0/P1 (około 692 pozycje); pełnoprawna obsługa Mixture-of-Agents z oznaczonymi wynikami zespołu poszczególnych modeli i strumieniowaniem na żywo; kontrakty ukończenia — /goal weryfikuje własną pracę, uruchamiając testy projektu; /learn (opis procesu pracy → skill wielokrotnego użytku, zgodny z CONTRIBUTING.md); /journey — oś czasu pamięci/skill oraz graf pamięci w aplikacji desktopowej; równoległe uruchamianie subagentów w tle (współbieżne zadania delegowane); Desktop Projects (projekt/repozytorium/ścieżka); gateway skalujący się do zera z koordynacją wygaszania; Google Vertex AI (Gemini przez konta usług GCP, automatyczne odświeżanie OAuth2); /prompt — edytor korzystający z \$EDITOR. Źródło: wydania hermes-agent. |
22 |
| 2026-06-21 | Przewodnik v1.9: v0.17.0 „The Reach Release” (19 czerwca 2026, tag v2026.6.19). Dodano sekcję „Co nowego w v0.17.0”. Komunikatory: iMessage bez przekaźnika przez Photon Spectrum (hermes photon login, kod urządzenia OAuth), oficjalny adapter WhatsApp Business Cloud API (bez mostu), grupy i załączniki SimpleX, plugin platformy Raft. Modele: z-ai/glm-5.2 (1M), anthropic/claude-fable-5, laguna-m.1, nemotron-3-ultra, grok-composer-2.5-fast (xAI OAuth, 200k); domyślny model xAI → grok-build-0.1; modele adaptacyjne Anthropic nie zawierają już pola reasoning. Aplikacja desktopowa/panel: subagenci w tle z oknami podglądu na żywo (delegate_task(background=true)), kompletny kreator profili, przebudowany Skills Hub, Automation Blueprints, bezpieczne logowanie 401, motywy z VS Code Marketplace, interfejs w języku japońskim i chińskim tradycyjnym. Skills/narzędzia: edycja obrazu na podstawie obrazu przez image_generate, atomowa partia operations w memory, skill simplify-code, wartość logiczna write_approval (zastępuje write_mode). Architektura: mechanizm elicitation MCP, wymienny CronScheduler + Chronos, zakres Managed (/etc/hermes), przekaźnik Gateway-Gateway. Polecenia: /version, /billing, hermes curator run --consolidate (opcjonalne). Bezpieczeństwo: usunięto możliwość obejścia listy zakazów przez użycie sekwencji ucieczki powłoki, zastosowano zatwierdzanie i adaptery gateway zamykające się bezpiecznie w razie błędu, oczyszczono środowisko cron, utajniono sekrety w zrzutach debugowania, dodano kontrolę eksfiltracji przez stdio w MCP, zaktualizowano urllib3 i PyJWT ze względu na CVE. |
21 |
| 2026-06-08 | Przewodnik v1.8: v0.16.0 „The Surface Release” (5 czerwca 2026, tag v2026.6.5). Zmieniono tytuł przewodnika na v0.16 i dodano sekcję „Co nowego w v0.16.0”. Najważniejsza wiadomość: Hermes nie jest już ograniczony do terminala. Natywna aplikacja Hermes Desktop (Electron, macOS/Linux/Windows) z instalacją jednym kliknięciem, automatyczną aktualizacją w aplikacji, strumieniowanym czatem, obsługą przeciągania i upuszczania oraz wklejania obrazów ze schowka, paletą Cmd+K, archiwum i wyszukiwaniem sesji, selektorem modelu na pasku stanu, połączeniem ze zdalnym gateway przez bezpieczny WebSocket (OAuth lub użytkownik/hasło, hosty dla poszczególnych profili, międzyprofilowe odnośniki @session) oraz pełnym tłumaczeniem na chiński uproszczony za pomocą typowanego i18n. Panel administracyjny w przeglądarce (panel internetowy → pełny panel administracyjny): włączanie/wyłączanie katalogu MCP, zarządzanie danymi uwierzytelniającymi, tworzenie webhooków/hooków, konfiguracja pamięci, sterowanie gateway, strona System ze sprawdzaniem przed aktualizacją i funkcją Debug Share, nowa strona Channels oraz wymienne uwierzytelnianie (użytkownik/hasło, samodzielnie hostowane OIDC, hermes dashboard register). Nowe polecenia: /undo [N] (CLI/TUI/komunikatory), konfigurowalny interfejs domyślny (cli/tui, --cli), ujednolicony /model w TUI i nakładka Sessions, hermes portal, hermes prompt-size, hermes sessions optimize. Nowe modele: deepseek-v4-flash, MiniMax-M3 (kontekst 1M), qwen3.7-plus, gemini-3.5-flash; pełnoprawna obsługa xAI Grok OAuth w programie uruchamiającym aplikację desktopową; selektor modeli z wyszukiwaniem przybliżonym; odświeżanie katalogu co godzinę. Skills: mniejszy zestaw domyślny (Spotify → natywny plugin, Linear → hermes mcp install linear, usunięto nieaktywne skills), warunek trafności environments: (kanban/docker/s6), domyślnie zaufane źródło NVIDIA/skills, progresywne (ograniczone zakresem) ujawnianie narzędzi MCP/plugin. Bezpieczeństwo: przypięto CVE-2026-48710 (Starlette BadHost) do wersji ≥1.0.1; kontrole SSRF przeniesiono poza pętlę zdarzeń; token bearer Bedrock usunięto ze środowiska podprocesów; plik bws_cache.json zabezpieczono przed odczytem; polecenia docker restart/stop/kill dodano do niebezpiecznych wzorców; dodano oczyszczanie z niewidocznych znaków Unicode. Zamknięto 2 problemy P0 i 62 problemy P1 (16 oznaczonych jako związane z bezpieczeństwem). |
20 |
| 2026-05-31 | Przewodnik v1.7.1: v0.15.1 (29 maja 2026, 01:12 UTC) — poprawka Velocity. Hotfix wydany tego samego dnia po Velocity; linia przypiętego tagu v2026.5.29. Naprawiono pętlę ponownego ładowania panelu po błędzie 401, która dotyczyła wdrożeń w trybie loopback. Docker nie traktuje już --insecure jako ustawienia domyślnego — aby świadomie je ponownie włączyć, należy jawnie ustawić HERMES_DASHBOARD_INSECURE=1. Samodzielne polecenia MCP (npx, npm, node) znów są prawidłowo rozpoznawane w kontenerach Docker. Prawidłowo renderowane są etykiety źródeł i boczny pasek kategorii na stronie Skills. Procesy robocze Kanban prawidłowo reagują na SIGTERM, zamiast pozostawiać osierocone procesy. Katalog Skills.sh rozszerzono z 858 do 19 932 pozycji dzięki wykrywaniu przez mapę witryny. 28 commitów, 21 scalonych PR-ów, 9 współtwórców. v0.15.2 (29 maja 2026, 13:37 UTC) — poprawka pakietowania Velocity. Naprawiono dystrybucje wheel i sdist, aby zawierały manifesty plugin.yaml, dzięki czemu instalacje z PyPI działają bez potrzeby bocznego dołączania drzewa źródłowego. Hotfix dotyczący wyłącznie pakietowania, 4 współtwórców. |
25 |
| 2026-05-28 | Przewodnik v1.7: Dodano v0.15.0 (28 maja 2026) — wydanie The Velocity (tag v2026.5.28). Najważniejsza wiadomość: gruntowna refaktoryzacja oraz nowe mechanizmy orkiestracji. Refaktoryzacja bazy kodu: objętość run_agent.py zmniejszono o 76% (z 16 083 do 3 821 wierszy), rozdzielając kod między 14 spójnych modułów. Wieloagentowy Kanban v2: automatyczny podział celów wysokiego poziomu na podzadania, topologia roju do równoległej koordynacji procesów roboczych, nadpisywanie modelu dla poszczególnych zadań, zadania zaplanowane, zarządzanie worktree. Wydajność: zimny start skrócono o kolejną sekundę; liczba wywołań funkcji na rozmowę spadła o 47%; session_search przeprojektowano tak, by działało 4 500 razy szybciej, usuwając zależność LLM (i związany z nią koszt API). Bezpieczeństwo: ochrona Promptware zabezpiecza przed wstrzykiwaniem promptów klasy Brainworm w 3 krytycznych punktach kontroli bezpieczeństwa; integracja z Bitwarden Secrets Manager zastępuje wiele kluczy API poszczególnych dostawców jednym tokenem startowym. Pakiety skills: możliwość jednoczesnego ładowania wielu skills za pomocą jednego polecenia slash. Orkiestrator sesji TUI: zarządzanie wieloma sesjami w jednym oknie terminala. Nowi dostawcy: Krea 2 (Medium/Large) oraz obsługa plugin FAL do generowania obrazów; kolejna runda integracji xAI dodaje plugin wyszukiwania internetowego, źródło OAuth, wykrywanie wycofanych modeli i naturalne pauzy TTS. Statystyki: 1 302 commity, 747 scalonych PR-ów, 321 współtwórców ze społeczności. Zgodnie z informacjami o wydaniu GitHub, poprawka wydana tego samego lub następnego dnia rozwiązuje problem pętli ponownego ładowania panelu po błędzie 401, wymusza jawne ustawienie zmiennej środowiskowej dla --insecure w Docker, naprawia rozpoznawanie samodzielnych poleceń MCP w Docker (npx, npm, node), przywraca stronę Skills, poprawia obsługę SIGTERM przez procesy robocze Kanban oraz udostępnia pełny katalog Skills obejmujący 19 932 pozycje dzięki mapie witryny. |
26 |
| 2026-05-21 | Przewodnik v1.6: Dodano v0.14.0 (16 maja 2026) — wydanie The Foundation. Najważniejsza wiadomość: lżejsza podstawa instalacji i środowiska uruchomieniowego oraz szersza obsługa dostawców, gateway, multimediów i weryfikacji. Dodano SuperGrok OAuth z modelem grok-4.3 i kontekstem 1M, zgodny z OpenAI hermes proxy dla dostawców OAuth, pełnoprawne x_search, pip install hermes-agent, leniwe instalowanie zależności, uruchamianie szybsze o około 19 s, 180-krotnie szybsze wywołania CDP przeglądarki, LINE i SimpleX Chat zwiększające liczbę platform komunikacyjnych do 22, kompleksową obsługę Microsoft Teams, /handoff, /subgoal, natywne przyciski doprecyzowania w Telegram/Discord, wsteczne uzupełnianie historii Discord, vision_analyze operujące na surowych pikselach, stopkę weryfikatora modyfikacji plików dla każdej tury, diagnostykę semantyczną LSP przy każdym zapisie, ujednolicone video_generate, computer_use przez cua-driver dla dostawców innych niż Anthropic, klikalne adresy URL OSC8, obsługę Zed ACP Registry, router OpenRouter Pareto Code, NovitaAI, środowisko uruchomieniowe Codex app-server, zaufane źródło huggingface/skills, 9 opcjonalnych skills, ctx.llm / tool_override dla plugin, wyszukiwanie internetowe Brave/DDGS, zmianę nazwy Qwen Cloud, natywną wersję beta dla Windows oraz zamknięcie 12 problemów P0 i 50 problemów P1. |
19 |
| 2026-05-07 | Przewodnik v1.5: Dodano v0.13.0 (7 maja 2026) — wydanie The Tenacity. Najważniejsza wiadomość: trwała wieloagentowa tablica Kanban (heartbeat, odzyskiwanie, wykrywanie zombie, blokada halucynacji, max_retries dla poszczególnych zadań, tablice wielu projektów), która czyni roje pełnoprawnym mechanizmem zamiast wzorca delegowania. Polecenie /goal utrzymuje skupienie agenta na celu przez wiele tur (wzorzec pętli Ralph jako polecenie slash). Nowe narzędzie video_analyze, w pierwszej kolejności wykorzystujące Gemini, z rozszerzalną obsługą zgodnych modeli. Dostawca xAI Custom Voices TTS z klonowaniem głosu. i18n w 7 językach (zh-Hans, ja, de, es, fr, uk, tr) dla komunikatów CLI i gateway; dokumentacja wyłącznie w zh-Hans. Google Chat jako 20. platforma komunikacyjna za pośrednictwem wymiennego wzorca adapterów; IRC i Microsoft Teams przeniesiono do tego samego wzorca. ProviderProfile ABC + plugins/model-providers/ umożliwiają wymiennych dostawców zewnętrznych bez zmian w rdzeniu. Automatyczne wznawianie sesji po ponownym uruchomieniu gateway, /update i przeładowaniu plików źródłowych. Przepisanie checkpoints v2 z pojedynczym magazynem, rzeczywistym przycinaniem i zabezpieczeniami miejsca na dysku. Zamknięto 8 problemów bezpieczeństwa P0: domyślne utajnianie sekretów, obejście zabezpieczeń między serwerami przez wiadomości prywatne Discord (CVSS 8.1), odrzucanie nieznajomych i wyciszanie czatu z samym sobą w WhatsApp, TOCTOU OAuth w MCP, TOCTOU pliku auth.json w CLI, bazowe zabezpieczenie przeglądarki przed SSRF, skanowanie promptów cron pod kątem wstrzyknięć, utajnianie w hermes debug share. Lintowanie po zapisie dla Python/JSON/YAML/TOML, tryb cron no_agent uruchamiający wyłącznie skrypt, listy dozwolonych elementów dla Slack/Telegram/Mattermost/Matrix/DingTalk, rozszerzenia MCP (transport SSE, przekazywanie OAuth, tagi MEDIA obrazów). Statystyki od v0.12.0: 864 commity, 588 scalonych PR-ów, 829 zmienionych plików, 295 współtwórców ze społeczności, 282 zamknięte zgłoszenia (13 P0, 36 P1). |
18 |
| 2026-05-06 | Przewodnik v1.4: Dodano v0.12.0 (30 kwietnia 2026) — wydanie The Curator. Najważniejsza wiadomość: autonomiczny Curator działający w tle na mechanizmie cron gateway (domyślny cykl 7-dniowy), który ocenia bibliotekę skill według kryteriów, usuwa nieaktywne skills, konsoliduje powiązane skills i zapisuje raporty z każdego uruchomienia — Hermes samodzielnie się utrzymuje między aktywnymi sesjami. Pętlę samodoskonalenia ulepszono o ocenianie według kryteriów, preferowanie aktywnych aktualizacji, prawidłowe dziedziczenie środowiska uruchomieniowego oraz ograniczone toolsets obejmujące wyłącznie pamięć i skills. 4 nowych dostawców wnioskowania: GMI Cloud, Azure AI Foundry, MiniMax OAuth i Tencent Tokenhub. LM Studio uzyskało status pełnoprawnej integracji. Zdalne manifesty katalogów modeli są teraz automatycznie aktualizowane bez wydawania nowych wersji. 2 nowe platformy komunikacyjne: Microsoft Teams (19., przez wymienną architekturę gateway) i Tencent Yuanbao (18., natywna obsługa tekstu i multimediów). Natywne Spotify przez PKCE OAuth z dołączonym skill; plugin Google Meet do połączeń i transkrypcji; dostawca Piper local TTS. ComfyUI v5 + TouchDesigner-MCP przeniesiono z opcjonalnych do domyślnie dołączonych. Nowe skills: Humanizer, claude-design, design-md, airtable. Dodatki do CLI: tryb jednorazowy hermes -z, kontrola wstępna hermes update --check, polecenie slash /reload-skills, wymienne style wskaźnika zajętości. Widoczny zimny start TUI skrócono o około 57% dzięki leniwej inicjalizacji agenta i leniwym importom. Bezpieczeństwo: domyślne utajnianie sekretów wyłączono, aby zapobiec uszkadzaniu ładunków; bezwzględna lista blokad dla nieodwracalnych poleceń. Statystyki: 1 096 commitów, 550 scalonych PR-ów, 213 współtwórców ze społeczności. |
17 |
| 2026-04-25 | Przewodnik v1.3: Dodano v0.11.0 (23 kwietnia 2026) — wydanie The Interface. Kompletny przepisany interaktywny TUI w React/Ink z backendem Python JSON-RPC (tui_gateway); przypięty edytor wiadomości, strumieniowanie na żywo z obsługą schowka OSC-52, stabilne klucze selektora, pasek stanu ze stoperem każdej tury i gałęzią git, potwierdzenie /clear, ustawienie motywu jasnego, nakładka obserwowania uruchamiania subagentów. Wymienna architektura transportu — konwersję formatów i transport HTTP wydzielono do agent/transports/, aby uprościć integrację dostawców. Natywna obsługa AWS Bedrock przez Converse API. 5 nowych ścieżek wnioskowania: NVIDIA NIM, Arcee AI, Step Plan, Google Gemini CLI OAuth i Vercel ai-gateway. GPT-5.5 przez Codex OAuth — nowy flagowy model OpenAI jest teraz dostępny przez ChatGPT Codex OAuth bez osobnego klucza API. QQBot (17. platforma komunikacyjna) z konfiguracją przez skanowanie kodu QR i strumieniowaniem. Rozszerzenie możliwości plugin: polecenia slash, wysyłanie narzędzi, blokowanie wykonywania, przekształcanie wyników. /steer <prompt> — wskazówki dla agenta podczas działania, które wstrzykują notatkę widoczną dla działającego agenta po kolejnym wywołaniu narzędzia, bez przerywania tury ani naruszania pamięci podręcznej promptu. Hooki powłoki łączą skrypty jako hooki cyklu życia bez plugin Python. Tryb bezpośredniego dostarczania webhooków przekazuje ładunki prosto do czatu na platformie, z pominięciem agenta podczas dystrybucji. Inteligentniejsze delegowanie z rolami orkiestratora, konfigurowalną głębokością uruchamiania i koordynacją plików. Panel zyskuje system plugin, przełączanie motywu na żywo, i18n i responsywność mobilną. Statystyki od v0.9.0: 1 556 commitów, 761 scalonych PR-ów, 1 314 zmienionych plików, 224 174 dodane wiersze, 29 współtwórców ze społeczności. |
27 |
| 2026-04-16 | Przewodnik v1.2: Dodano v0.10.0 — Nous Tool Gateway. Płatni subskrybenci Nous Portal uzyskują teraz dostęp do zarządzanych narzędzi (wyszukiwanie internetowe Firecrawl, generowanie obrazów FAL / FLUX 2 Pro, OpenAI TTS, automatyzacja przeglądarki Browser Use) bez dodatkowych kluczy API. Włączanie poszczególnych narzędzi przez nowe pole konfiguracji use_gateway. Gdy skonfigurowano oba rozwiązania, środowisko uruchomieniowe preferuje gateway zamiast bezpośrednich kluczy API. Usunięto zmienną środowiskową HERMES_ENABLE_NOUS_MANAGED_TOOLS. CLI Hermes Agent pozostaje objęty licencją MIT i całkowicie bezpłatny. |
28 |
| 2026-04-13 | Przewodnik v1.1: Dodano funkcje v0.8.0 i v0.9.0. Lokalny panel internetowy, tryb /fast, platformy iMessage i WeChat (łącznie 16), monitorowanie procesów w tle (watch_patterns), wymienny context engine, hermes backup/hermes import, Termux/Android, dostawcy xAI, MiMo, Google AI Studio i Qwen, polecenie /debug, kompleksowe wzmocnienie zabezpieczeń. |
15 16 |
| 2026-04-10 | Przewodnik v1.0: Pierwsze wydanie dotyczące Hermes Agent v0.7.0. Uwierzytelnianie dostawców, konfiguracja, CLI, polecenia slash, narzędzia, skills, pamięć, gateway, cron, MCP, kompresja, architektura, migracja z OpenClaw, rozwiązywanie problemów, FAQ. |
Źródła
-
Nous Research, plik README projektu „Hermes Agent” w serwisie GitHub. Główne źródło opisu produktu (samodoskonalący się agent, obsługa wielu dostawców, gateway komunikatorów, backendy terminalowe, rozwój skill, harmonogram cron i delegowanie) oraz jednolinijkowego polecenia „Szybka instalacja”. ↩↩↩
-
Nous Research, „Dostawcy AI” w dokumentacji Hermes Agent. Główne źródło pełnej listy dostawców, metod uwierzytelniania dla każdego z nich (Nous Portal OAuth, kod urządzenia Codex, typy tokenów Copilot w GitHub, trzy metody uwierzytelniania Anthropic, chińscy dostawcy AI, routing Hugging Face, niestandardowe endpointy), trzech ścieżek uwierzytelniania (klucz API w
.env, OAuth przezhermes model, niestandardowy endpoint wconfig.yaml), składni polecenia slash/model(w tymcustom:name:model), szablonów konfiguracji Ollama/vLLM/SGLang/llama.cpp/LM Studio, instrukcji dotyczących sieci w WSL2, łańcucha wykrywania długości kontekstu, konfiguracji modelu zapasowego, inteligentnego routingu modeli oraz nazwanych niestandardowych dostawców. Z tej strony pochodzą wszystkie użyte w tym artykule nazwy zmiennych środowiskowych właściwych dla dostawców, typy tokenów, nadpisania bazowych adresów URL i identyfikatory modeli. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Nous Research, „Architektura” w przewodniku dla programistów Hermes Agent. Główne źródło diagramu ogólnej architektury systemu, struktury katalogów, przepływu danych przez ścieżki sesji CLI i wiadomości gateway, trzech trybów API (
chat_completions,codex_responses,anthropic_messages), rozpoznawania dostawców przezruntime_provider.py, utrwalania sesji za pomocą SQLite + FTS5, listy platform obsługiwanych przez gateway komunikatorów, źródeł wykrywania systemu pluginów, izolacji profili oraz sześciu zasad projektowych. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Nous Research, „Konfiguracja” w podręczniku użytkownika Hermes Agent. Główne źródło struktury katalogu konfiguracyjnego, reguły dotyczącej
config.yamli.env(„config.yamlma pierwszeństwo w przypadku ustawień innych niż tajne”), łańcucha pierwszeństwa konfiguracji (argumenty CLI → zmienne środowiskowe → config.yaml → .env → wartości domyślne), ustawień kompresji kontekstu (blokcompression.*z polamithreshold,target_ratio,protect_last_n,summary_model,summary_provider,summary_base_url), progów wykorzystania budżetu (70% — ostrożność, 90% — ostrzeżenie), limitów czasu strumieniowania z automatycznym dostosowaniem do lokalnego dostawcy oraz pełnego bloku konfiguracji modeli pomocniczych (auxiliary:z miejscamivision,web_extract,approval,compression,session_search,skills_hub,mcp,flush_memories). Z tej strony pochodzi również ograniczenie dostawcy"main"do miejsc pomocniczych, kompresji i modelu zapasowego. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Nous Research, „Migracja z OpenClaw” w przewodnikach Hermes Agent. Źródło opisu procesu migracji OpenClaw → Hermes. ↩↩
-
Nous Research, „Dokumentacja poleceń CLI” w dokumentacji referencyjnej Hermes Agent. Główne źródło informacji o każdym poleceniu najwyższego poziomu CLI opisanym w tym artykule, w tym
hermes chat,hermes model,hermes gateway,hermes setup,hermes auth,hermes status,hermes cron,hermes webhook,hermes doctor,hermes dump,hermes logs,hermes config,hermes pairing,hermes skills,hermes honcho,hermes memory,hermes acp,hermes mcp,hermes plugins,hermes tools,hermes sessions,hermes insights,hermes claw,hermes profile,hermes completion,hermes updateihermes uninstall. Z tej strony pochodzą wszystkie użyte w artykule flagi podpoleceń, opisy opcji, zasady działania puli poświadczeń, składnia filtrowania dzienników, flagi migracji z OpenClaw, polecenia zarządzania profilami oraz polecenia instalowania usług. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Nous Research, „Instalacja” w przewodniku wprowadzającym do Hermes Agent. Główne źródło jednolinijkowego polecenia instalacyjnego, opisu działania instalatora (wymagania wstępne, obsługiwane platformy, automatyczne wykrywanie Termux, wymagania Windows/WSL2), tabeli opcjonalnych dodatków, kroków instalacji ręcznej oraz poleceń weryfikacyjnych. ↩↩↩↩↩↩↩↩↩
-
Nous Research, „Dokumentacja poleceń CLI” — w szczególności sekcja
hermes dump, opisująca format danych wyjściowych polecenia (nagłówek, środowisko, tożsamość, model, terminal, klucze API, funkcje, usługi, obciążenie i nadpisania konfiguracji) oraz jego przeznaczenie do udostępniania danych diagnostycznych. ↩ -
Nous Research, „Dokumentacja poleceń slash” w dokumentacji referencyjnej Hermes Agent. Główne źródło informacji o każdym poleceniu slash wymienionym w tym artykule, architekturze
COMMAND_REGISTRY, podziale na CLI i komunikatory, dynamicznych poleceniach slash dla skill, szybkich poleceniach wconfig.yaml, działaniu dopasowywania prefiksów oraz poleceniach dostępnych wyłącznie w komunikatorach (/status,/sethome,/approve,/deny,/update,/commands). ↩↩↩↩↩↩↩↩↩↩ -
Nous Research, „Narzędzia i toolset” w podręczniku użytkownika Hermes Agent. Główne źródło przeglądu kategorii narzędzi, poleceń użycia toolset, sześciu backendów terminalowych (local, docker, ssh, singularity, modal, daytona), konfiguracji kontenerów (procesor, pamięć, dysk, trwałość), zabezpieczania kontenerów, zarządzania procesami w tle API oraz obsługi sudo. ↩↩↩↩↩↩↩↩↩↩
-
Nous Research, „System skill” w podręczniku użytkownika Hermes Agent. Główne źródło informacji o stopniowym ujawnianiu, formacie
SKILL.md, skill właściwych dla poszczególnych platform, aktywacji warunkowej (fallback_for_toolsets,requires_toolsets,fallback_for_tools,requires_tools), skill zarządzanych przez agenta za pomocąskill_manage, poleceniach centrum skill i liście źródeł (official,skills-sh,well-known,github,clawhub,claude-marketplace,lobehub), skanowaniu zabezpieczeń i poziomach zaufania oraz zewnętrznych katalogach skill. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Nous Research, „Trwała pamięć” w podręczniku użytkownika Hermes Agent. Główne źródło limitów znaków w
MEMORY.md/USER.md, wzorca zamrożonej migawki, operacji narzędzia pamięci (add,replace,remove), zasad określających, co zapisywać, a co pomijać, porównania pamięci z wyszukiwaniem sesji oraz listy ośmiu zewnętrznych dostawców pamięci (Honcho, OpenViking, Mem0, Hindsight, Holographic, RetainDB, ByteRover, Supermemory). ↩↩↩↩↩↩↩↩ -
Nous Research, „Osobowość i SOUL.md” w podręczniku użytkownika Hermes Agent. Główne źródło informacji o działaniu
SOUL.md(znajduje się wHERMES_HOME, nigdy nie jest nadpisywany, zajmuje pozycję nr 1 w prompcie systemowym i przed dołączeniem jest skanowany pod kątem bezpieczeństwa), różnicy między SOUL.md a AGENTS.md, liście wbudowanych osobowości (14 osobowości, odhelpfuldohype), niestandardowych osobowościach wconfig.yaml, wzorcu nakładki/personalityoraz pełnej kolejności składania stosu promptów. ↩↩↩↩↩↩↩↩↩↩↩↩ -
Nous Research, „Korzystanie z MCP w Hermes” oraz „Dokumentacja konfiguracji MCP” w przewodnikach i dokumentacji referencyjnej Hermes Agent. Źródło formatu konfiguracji
mcp_servers:wconfig.yamlz polamicommand,argsienv. ↩ -
Informacje o wydaniu Hermes Agent v0.8.0. 8 kwietnia 2026. Automatyczne powiadomienia o procesach w tle, bezpłatny MiMo v2 Pro w Nous Portal, przełączanie
/modelna żywo na różnych platformach, natywny dostawca Google AI Studio, Qwen OAuth, limity czasu zależne od braku aktywności, przyciski zatwierdzania w Slack/Telegram, MCP OAuth 2.1 PKCE, scentralizowane rejestrowanie zdarzeń, rozszerzenie systemu pluginów. ↩↩↩↩↩ -
Informacje o wydaniu Hermes Agent v0.9.0. 13 kwietnia 2026. Lokalny panel internetowy, tryb Fast Mode (
/fast), iMessage przez BlueBubbles, WeChat + WeCom, Termux/Android, monitorowanie procesów w tle (watch_patterns), natywni dostawcy xAI + Xiaomi MiMo, wymienny context engine, ujednolicona obsługa proxy, wzmocnienie zabezpieczeń (poprawki dotyczące path traversal, shell injection, SSRF i RCE),hermes backup/hermes import,/debug+hermes debug share, 16 obsługiwanych platform. 487 commitów, 269 scalonych PR-ów, 24 współtwórców. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Informacje o wydaniu Hermes Agent v0.12.0. 30 kwietnia 2026. „Wydanie Curator”. Autonomiczny Curator działający w tle, który ocenia, porządkuje i konsoliduje bibliotekę skill w domyślnym cyklu 7-dniowym uruchamianym przez mechanizm cron gateway. Ulepszona pętla samodoskonalenia: ocena oparta na kryteriach, preferowanie aktywnych aktualizacji, prawidłowe dziedziczenie środowiska uruchomieniowego oraz toolset o ograniczonym zakresie, obejmującym wyłącznie pamięć i skill. Czterech nowych dostawców wnioskowania: GMI Cloud, Azure AI Foundry, MiniMax OAuth, Tencent Tokenhub. LM Studio uzyskuje status rozwiązania pierwszej klasy. Zdalne manifesty katalogów modeli aktualizują się automatycznie, bez nowych wydań. Dwie nowe platformy komunikacyjne: Microsoft Teams (19., przez wymienną architekturę gateway) oraz Tencent Yuanbao (18., natywna obsługa tekstu i multimediów). Natywna obsługa Spotify przez PKCE OAuth z dołączonym skill; plugin Google Meet do rozmów i transkrypcji; lokalny dostawca TTS Piper. ComfyUI v5 + TouchDesigner-MCP domyślnie w pakiecie. Nowe skill: Humanizer, claude-design, design-md, airtable. CLI: jednorazowy tryb
hermes -z, kontrola wstępnahermes update --check, polecenie slash/reload-skills, wymienne style wskaźnika zajętości. Skrócenie zimnego startu TUI o około 57% dzięki leniwej inicjalizacji. Bezpieczeństwo: maskowanie tajnych danych domyślnie wyłączone; bezwzględna lista blokująca nieodwracalne polecenia. Statystyki od v0.11.0: 1 096 commitów, 550 scalonych PR-ów, 213 współtwórców ze społeczności. Zobacz również: tag wydania v2026.4.30. ↩↩↩ -
Informacje o wydaniu Hermes Agent v0.13.0. 7 maja 2026. „Wydanie Tenacity”. Wieloagentowa tablica Kanban z mechanizmem heartbeat, odzyskiwaniem zadań, wykrywaniem procesów zombie, zabezpieczeniem przed halucynacjami, ustawieniem
max_retriesdla każdego zadania oraz obsługą wielu projektów. Polecenie slash/goaldo blokowania celu między turami (podstawa pętli Ralph) z konfigurowalnym budżetem tur. Narzędzievideo_analyze, wykorzystujące w pierwszej kolejności Gemini i umożliwiające rozszerzenie o zgodne rozwiązania multimodalne. Dostawca TTS xAI Custom Voices z klonowaniem głosu. i18n w 7 językach: zh-Hans, ja, de, es, fr, uk, tr (CLI + wiadomości gateway; dokumentacja wyłącznie w zh-Hans). Google Chat jako 20. platforma komunikacyjna, obsługiwana przez wzorzec wymiennego adaptera z ogólnymi hookami pluginówenv_enablement_fn/cron_deliver_env_var; IRC i Microsoft Teams przeniesiono do tego samego wzorca.ProviderProfileABC +plugins/model-providers/dla wymiennych dostawców zewnętrznych. Automatyczne wznawianie sesji po ponownym uruchomieniu gateway, użyciu/updatei przeładowaniu plików źródłowych. Checkpoint v2 przepisane z użyciem jednego magazynu, z rzeczywistym czyszczeniem, zabezpieczeniami dysku i bez osieroconych repozytoriów pomocniczych. Zamknięto osiem luk bezpieczeństwa P0: domyślnie włączone maskowanie tajnych danych, obejście ograniczeń wiadomości prywatnych między serwerami Discord (CVSS 8.1, listy dozwolonych ról ograniczone do serwera), domyślne odrzucanie wiadomości od nieznajomych w WhatsApp + zakaz odpowiadania we własnym czacie, TOCTOU przy zapisywaniu poświadczeń MCP OAuth, TOCTOU w plikuauth.jsonCLI w modułach zapisujących poświadczenia, minimalna ochrona przed SSRF metadanych chmurowych przeglądarki w routingu hybrydowym, skanowanie złożonych promptów cron (w tym zawartości skill) pod kątem prompt injection, maskowanie zawartości dzienników podczas wysyłania przezhermes debug share. Inne istotne elementy: linting po zapisie dla Python/JSON/YAML/TOML, tryb cronno_agentdla skryptowego watchdoga bez agenta, listy dozwolonych użytkowników na platformach Slack/Telegram/Mattermost/Matrix/DingTalk, ulepszenia MCP (transport SSE, przekazywanie OAuth, wyniki obrazowe jako znaczniki MEDIA). Statystyki od v0.12.0: 864 commity, 588 scalonych PR-ów, 829 zmienionych plików, 295 współtwórców ze społeczności, 282 zamknięte zgłoszenia (13 P0, 36 P1). ↩↩↩↩↩↩↩↩↩↩↩↩ -
Informacje o wydaniu Hermes Agent v0.14.0. 16 maja 2026. „Wydanie Foundation”. Od v0.13.0: 808 commitów, 633 scalone PR-y, 1 393 zmienione pliki, 165 061 dodanych wierszy, 545 zamkniętych zgłoszeń (12 P0, 50 P1) oraz 215 współtwórców ze społeczności. Dodano SuperGrok OAuth z grok-4.3 i kontekstem 1M,
hermes proxy,x_search, pakiet PyPI, leniwe zależności, współdzieloną między sesjami pamięć podręczną promptów Claude o czasie życia 1 godziny, uruchamianie szybsze o około 19 sekund, 180-krotnie szybsze wywołania CDP przeglądarki, LINE i SimpleX Chat — łącznie 22 platformy komunikacyjne,/handoff, natywne przyciski doprecyzowania, uzupełnianie historii Discord, analizęvision_analyzena surowych pikselach, stopkę weryfikującą modyfikacje plików w każdej turze, diagnostykę semantyczną LSP, ujednoliconevideo_generate,computer_usez cua-driver, łącza OSC8, obsługę Zed ACP Registry, router OpenRouter Pareto Code, NovitaAI, środowisko uruchomieniowe app-server Codex,huggingface/skills, pluginctx.llm,tool_override, wyszukiwanie Brave/DDGS, lepszą ochronę przed niebezpiecznymi poleceniami,/subgoal, zmianę nazwy Qwen Cloud, natywną wersję beta dla Windows, łącznie 16 wersji językowych oraz szeroko zakrojone aktualizacje dokumentacji i testów. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Informacje o wydaniu Hermes Agent v0.16.0, „Wydanie Surface”, tag
v2026.6.5, opublikowane 2026-06-06T00:55:58Z (data tagu wydania: 5 czerwca 2026); najnowsze na dzień 2026-06-08. Nowa natywna aplikacja Hermes Desktop (Electron, macOS/Linux/Windows; połączenie ze zdalnym gateway przez bezpieczny WebSocket z OAuth lub nazwą użytkownika i hasłem; zdalne hosty przypisane do profili; łącza@sessionmiędzy profilami; interfejs w języku chińskim uproszczonym dzięki typowanemu i18n,display.language). Panel internetowy rozbudowano do pełnego panelu administracyjnego (przełączniki katalogu MCP, zarządzanie poświadczeniami, tworzenie webhooków/hooków, konfiguracja pamięci, sterowanie gateway, strona System z kontrolą przed aktualizacją + Debug Share, strona Channels; wymienne uwierzytelnianie, w tym samodzielnie hostowane OIDC ihermes dashboard register). Nowe polecenia:/undo [N], konfigurowalny interfejs domyślny (cli/tui,--cli),/modelw TUI + nakładka Sessions,hermes portal,hermes prompt-size,hermes sessions optimize. Nowe modele:deepseek-v4-flash,MiniMax-M3(kontekst 1M),qwen3.7-plus,gemini-3.5-flash; xAI Grok OAuth; wyszukiwarka rozmyta; odświeżanie katalogu co godzinę. Skill: odchudzony zestaw domyślny, filtr trafnościenvironments:, domyślnie zaufane źródłoNVIDIA/skills, stopniowe ujawnianie narzędzi, poprawka fałszywego powodzenia OAuth w MCP. Bezpieczeństwo: przypięcie CVE-2026-48710 (Starlette BadHost) do wersji ≥1.0.1, kontrole SSRF przeniesione poza pętlę zdarzeń, usuwanie tokenu bearer Bedrock ze środowiska podprocesów, ochrona odczytubws_cache.json, dodaniedocker restart/stop/killdo wzorców niebezpiecznych poleceń, oczyszczanie niewidocznych znaków Unicode; zamknięto 2 zgłoszenia P0 + 62 P1 (16 oznaczonych jako związane z bezpieczeństwem). Pominięto marketingową narrację informacji o wydaniu (liczby PR-ów/commitów, „jeszcze tydzień temu nic z tego nie istniało”); odnotowano wyłącznie konkretne fakty dotyczące funkcji i wersji powiązane z tagiem. Weryfikacja w bieżącej sesji: 8 czerwca 2026. ↩↩↩↩↩↩↩↩ -
Informacje o wydaniu Hermes Agent v0.17.0, „Wydanie Reach”, tag
v2026.6.19, 19 czerwca 2026; najnowsze na dzień 2026-06-21. Komunikatory: iMessage przez Photon Spectrum (OAuth z kodem urządzenia,hermes photon login, bez przekaźnika na Macu); oficjalny adapter WhatsApp Business Cloud API (zastępuje proces pośredniczący); grupy SimpleX, natywne załączniki, grupowanie tekstu, automatyczne akceptowanie; platformowy plugin Raft w pakiecie. Modele/dostawcy:z-ai/glm-5.2(kontekst 1M),anthropic/claude-fable-5,laguna-m.1,nemotron-3-ultra,grok-composer-2.5-fast(xAI OAuth, kontekst 200k); domyślny model xAI →grok-build-0.1; adaptacyjne modele Anthropic korzystają z nowoczesnego kontraktu rozumowania (bez polareasoning). CLI/polecenia slash:/version,/billing,hermes photon login,hermes curator run --consolidate(opcjonalne), graficzny interfejshermes model, klonowanie profili. Desktop: okna obserwacji subagentów działających w tle (delegate_task(background=true)), selektor modeli Composer, skróty z możliwością ponownego przypisania, natywne powiadomienia systemowe, wersje robocze dla poszczególnych wątków, motywy z VS Code Marketplace, interfejs w języku japońskim i chińskim tradycyjnym. Dashboard: pełny kreator profili, globalny przełącznik profili, przebudowane centrum Skills Hub ze skanowaniem zabezpieczeń, Automation Blueprints, bezpieczne logowanie (401 za OAuth). Skill/narzędzia: edycja obrazu na podstawie obrazu wimage_generateu wielu dostawców, atomowe operacje wsadoweoperationswmemory, skillsimplify-codedo równoległego przeglądu, wartość logicznawrite_approvalzastępujewrite_mode. Architektura: subagenty działające w tle (natychmiastowy zwrot uchwytu, wynik wraca jako tura), procedura elicitation MCP do potwierdzania w trakcie wywołania narzędzia, narzędzia MCP łączące się z opóźnieniem udostępniane między turami, wymienny CronScheduler + zarządzany cron Chronos, zakres Managed (/etc/hermesprzypięty przez administratora), przekaźnik Gateway-Gateway. Bezpieczeństwo: usunięto możliwość obejścia listy blokującej za pomocą znaków ucieczki powłoki, wprowadzono zasadę fail-closed przy braku modułu zatwierdzania i dla adapterów gateway z własnymi zasadami, oczyszczanie środowiska skryptów zadań cron, maskowanie tajnych danych w zrzutach debugowania, ukrywanie metadanych hosta w publicznym statusie, wykrywanie wzorców eksfiltracji w stdio MCP, aktualizacje urllib3 + PyJWT eliminujące luki CVE. Pominięto marketingową narrację wydania (liczby commitów/PR-ów). Weryfikacja w bieżącej sesji: 21 czerwca 2026. ↩↩↩↩↩↩↩↩↩↩↩ -
Informacje o wydaniu Hermes Agent v0.18.0 (tag
v2026.7.1), 1 lipca 2026 — „Wydanie Judgment”. Uporządkowanie listy zadań priorytetowych (zamknięto wszystkie pozycje P0/P1, około 692 w ciągu 12 dni); Mixture-of-Agents jako pełnoprawny model dostępny we wszystkich interfejsach, z pełnymi wynikami każdego modelu referencyjnego wyświetlanymi w osobnym, opisanym bloku i strumieniowaniem odpowiedzi na żywo; kontrakty ukończenia dla/goal(agent weryfikuje własną pracę, uruchamiając kontrole projektu); polecenie/learn(przekształcanie dowolnego opisu w wielokrotnego użytku skill z automatyczną zgodnością z CONTRIBUTING.md);/journey— wizualna oś czasu pamięci/skill z możliwością edycji oraz graf pamięci w aplikacji desktopowej; rozdzielanie zadań między wiele subagentów działających równolegle w tle; Desktop Projects (model projekt/repozytorium/ścieżka); gateway skalowany do zera z koordynacją wygaszania; obsługa Google Vertex AI (Gemini przez konta usług GCP, automatyczne odświeżanie tokenu OAuth2); polecenie/promptwykorzystujące $EDITOR. Weryfikacja w bieżącej sesji 1 lipca 2026 (PST) na stronie wydań GitHub; v0.18.0 jest najnowszym wydaniem. ↩↩↩↩↩↩↩↩↩↩↩ -
Informacje o wydaniu Hermes Agent v0.19.0, „Wydanie Quicksilver”, tag
v2026.7.20, 20 lipca 2026; najnowsze na dzień 2026-07-21. Statystyki od v0.18.0: około 2 245 commitów, około 1 065 scalonych PR-ów, około 3 300 zamkniętych zgłoszeń, ponad 450 współtwórców ze społeczności. Fundament wydajnościowy: skrócenie TTFT pierwszej tury o około 80%, czas od zimnego wysłania do przekazania zadania skrócony z około 4,3 s do około 0,9 s w CLI/gateway/TUI/desktop/cron (PR #59332); domyślne strumieniowanie rozumowania na żywo przy włączonymdisplay.show_reasoningi renderowanie odpowiedzi po każdym tokenie (PR #59389); fala około 20 PR-ów przyspieszających aplikację desktopową, w tym 14-krotnie szybszy strumieniowany Markdown; przyrostowe renderowanie Markdown w TUI. Instalacje pip/Homebrew uznano za przestarzałe i wyświetlają wyłącznie ostrzeżenie „nieobsługiwane rozwiązanie starszego typu”; planowane jest zakończenie publikowania w PyPI/Homebrew (PR #57225). Wymienny interfejsSecretSourcez dostawcami Bitwarden + 1Password, odwołaniamiop://, obsługą wielu sejfów, deterministycznym pierwszeństwem i informacją o pochodzeniu każdej zmiennej (PR #59498). Domyślnie inteligentne zatwierdzanie (niezależny recenzent LLM dla każdego oznaczonego polecenia), definiowane przez użytkownika reguły odmowy obowiązujące także w trybie YOLO,/deny <reason>(PR-y #62661, #59164, #54518); przywrócono eskalację zatwierdzaniapre_tool_callw pluginie (PR #60504). Rozliczenia w terminalu przez/subscription+/topup+ karta rozliczeń w aplikacji desktopowej (PR #51639). Pliki transkrypcji subagentów na żywo + trwałe delegowanie w tle (PR-y #67479, #63494); rejestr zobowiązań dotyczących dostarczenia wyników wstate.db(PR #67181);max_async_childrenuznano za przestarzałe na rzecz ujednoliconych limitów współbieżności delegowania (PR #56955). Routing gateway oparty na profilach +GATEWAY_MULTIPLEX_PROFILES+ przeniesienie indeksu routingu dostate.db,sessions.jsonjako opcjonalne odzwierciedlenie starszego typu (PR-y #64835, #65700, #60589, #59203). Dostawcy/modele: Fireworks AI jako rozwiązanie pierwszej klasy na pozycji nr 2 w selektorze (PR #62593), DeepInfra, Upstage Solar, kompleksowa obsługa GPT-5.6 Sol/Terra/Luna + Pro (PR #61616), ogólna dostępność grok-4.5, kimi-k3 (wycofano kimi-k2.x), pełna obsługa Claude Sonnet 5, ustawienieenabled: falsedla poszczególnych dostawców +excluded_providers(PR #67971); poziomy intensywności rozumowaniamax/ultraz nadpisaniami dla poszczególnych modeli/miejsc MoA oraz/reasoningograniczone do sesji (PR-y #62650, #64458). CLI/MCP: eksporthermes sessions exportdo Markdown/Quarto/HTML/samego promptu/śladu HF z opcją--redact(PR #60186),/model --once(PR #67113), łączone wywołania skill przez polecenia slash (PR #57987),--safe-mode,hermes config get/unset(PR #65540), prawdziwie bezinterfejsowyhermes serve(PR #55923), nazewnictwo MCPmcp__server__tool(PR #52750). Pominięto marketingową narrację wydania; elementów wycofanych w tym okresie (zapora ruchu wychodzącego iron-proxy, skill dynamic-workflow, akcje dostawców pamięci) celowo nie odnotowano jako wydanych. Weryfikacja w bieżącej sesji: 21 lipca 2026. ↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩↩ -
Tag wydania Hermes Agent v0.18.1 oraz tag wydania v0.18.2, 7–8 lipca 2026. Zbiorcze poprawki infrastrukturalne w linii v0.18; najważniejsza poprawka v0.18.2 usuwa przypięcie WhatsApp Baileys do wersji 7.0.0-rc13, zapewniając niezawodne kompilacje Docker. Oba zestawy poprawek ujęto zbiorczo i w pełni udokumentowano w informacjach o wydaniu v0.19.0. ↩
-
Informacje o wydaniu Hermes Agent v0.15.1 oraz informacje o wydaniu Hermes Agent v0.15.2. v0.15.1 (29 maja 2026, 01:12 UTC) to wydana tego samego dnia poprawka Velocity: usunięcie pętli przeładowań z błędem 401 w panelu działającym w trybie loopback; Docker wymaga teraz jawnego ustawienia
HERMES_DASHBOARD_INSECURE=1; polecenia MCP bez ścieżki (npx,npm,node) są rozpoznawane w kontenerach Docker; przywrócono oznaczenia źródeł i boczny pasek kategorii na stronie Skills; procesy robocze Kanban reagują na SIGTERM; katalog Skills.sh powiększył się z 858 do 19 932 pozycji dzięki mapie witryny. 28 commitów, 21 scalonych PR-ów, 9 współtwórców. v0.15.2 (29 maja 2026, 13:37 UTC) to poprawka dotycząca wyłącznie pakowania, która dołącza manifestyplugin.yamldo dystrybucji wheel i sdist, dzięki czemu instalacje z PyPI działają bez dodatkowego ładowania kodu źródłowego. 4 współtwórców. ↩ -
Informacje o wydaniu Hermes Agent v0.15.0 oraz strona wydań Hermes Agent. „Wydanie Velocity”, tag
v2026.5.28. Statystyki: 1 302 commity, 747 scalonych PR-ów, 321 współtwórców ze społeczności. Refaktoryzacjarun_agent.pyo 76% (z 16 083 do 3 821 wierszy w 14 modułach). Dodano wieloagentową platformę Kanban (automatyczny podział zadań, topologia roju, nadpisania modeli dla poszczególnych zadań, zadania planowane, zarządzanie worktree).session_searchprzeprojektowano tak, aby działało 4 500 razy szybciej, usuwając zależność LLM. Ochrona przed promptware klasy Brainworm w trzech krytycznych punktach bezpieczeństwa. Integracja z Bitwarden Secrets Manager zastępuje wiele kluczy API właściwych dla dostawców jednym tokenem startowym. Pakiety skill umożliwiają wczytanie wielu skill jednym poleceniem slash. Orkiestrator sesji TUI do zarządzania wieloma sesjami w jednym oknie terminala. Obsługa Krea 2 (Medium/Large) i pluginu FAL do generowania obrazów. Kolejna runda integracji xAI dodaje plugin wyszukiwania internetowego, połączenie upstream OAuth, wykrywanie wycofanych modeli oraz naturalne pauzy TTS w komunikatach głosowych. Wydanie poprawkowe opisane w GitHub usuwa pętlę przeładowań z błędem 401 w panelu, wymaga jawnego ustawienia zmiennej środowiskowejHERMES_DASHBOARD_INSECURE=1dla opcji--insecurew Docker, poprawia rozpoznawanie poleceń MCP bez ścieżki (npx,npm,node) w Docker, renderowanie strony Skills, obsługę SIGTERM przez procesy robocze Kanban oraz udostępnia pełny katalog Skills z 19 932 pozycjami przez mapę witryny; zawiera też niewielki zestaw poprawek dotyczących dostarczania plików.md, bezpieczeństwa sond gateway, maskowania internetowych adresów URL, obsługi obrazu przez procesy robocze Kanban i domyślnych obserwacji Hindsight. ↩ -
Informacje o wydaniu Hermes Agent v0.11.0. 23 kwietnia 2026. „Wydanie Interface” — pełne przepisanie interaktywnego CLI przy użyciu React/Ink z backendem Python JSON-RPC (
tui_gateway); wymienna architektura transportu (agent/transports/); natywna obsługa AWS Bedrock przez Converse API; pięć nowych ścieżek wnioskowania (NVIDIA NIM, Arcee AI, Step Plan, Google Gemini CLI OAuth, Vercel ai-gateway); GPT-5.5 przez Codex OAuth; QQBot jako 17. platforma komunikacyjna z konfiguracją przez skanowanie kodu QR; rozszerzony zakres pluginów (polecenia slash, przekazywanie wywołań narzędzi, blokowanie wykonywania, przekształcanie wyników);/steer <prompt>do korygowania działania agenta w trakcie wykonywania — wstrzykuje kontekst po następnym wywołaniu narzędzia bez naruszania pamięci podręcznej promptów; hooki powłoki dla zdarzeń cyklu życia bez pluginów Python; tryb bezpośredniego dostarczania webhooków, przekazujący payload bezpośrednio do czatu na platformie; inteligentniejsze delegowanie z rolami orkiestratora + konfigurowalną głębokością tworzenia agentów + koordynacją plików; system pluginów panelu, przełączanie motywów na żywo, i18n, responsywność mobilna. Statystyki od v0.9.0: 1 556 commitów · 761 scalonych PR-ów · 1 314 zmienionych plików · 224 174 dodane wiersze · 29 współtwórców ze społeczności. Zobacz również: tag wydania Hermes Agent v0.11.0 w GitHub. ↩↩↩ -
Informacje o wydaniu Hermes Agent v0.10.0. 16 kwietnia 2026. „Wydanie Tool Gateway”. Integracja z Nous Tool Gateway dla płatnych subskrybentów Nous Portal — zarządzany dostęp do wyszukiwania internetowego Firecrawl, generowania obrazów FAL / FLUX 2 Pro, OpenAI TTS oraz automatyzacji przeglądarki Browser Use bez dodatkowych kluczy API. Osobne włączanie każdego narzędzia przez nowe pole konfiguracji
use_gateway. Gdy skonfigurowano oba rozwiązania, środowisko uruchomieniowe preferuje gateway zamiast bezpośrednich kluczy API. Pełna integracja zhermes toolsihermes status. Zastępuje przestarzałą zmienną środowiskowąHERMES_ENABLE_NOUS_MANAGED_TOOLS. Implementacja autorstwa @jquesnelle (emozilla). Hermes Agent CLI pozostaje oprogramowaniem w pełni otwartoźródłowym na licencji MIT; gateway stanowi integrację z istniejącym produktem subskrypcyjnym Portal, a nie płatną blokadę dostępu do CLI. Informacje o cenach subskrypcji i rejestracji: Nous Portal. ↩↩↩