hermes@agent:~/.hermes$ cat hermes.md

Hermes Agent: o guia de referência do profissional (2026)

# Um guia de referência para profissionais sobre o Hermes Agent, o agente de IA de código aberto e autoaprimorável da Nous Research: autenticação de provedores e OAuth, arquivos de configuração, sistema de skills e execução como gateway de mensagens multiplataforma.

author: words: 24568 read_time: 93m updated: 2026-08-21 10:45
$ less hermes.md

TL;DR: Hermes Agent é um agente de IA open-source e autoaperfeiçoável da Nous Research. Ele funciona como uma CLI e como um gateway de mensagens multiplataforma, armazena uma identidade durável e memória persistente no disco, reúne skills que melhoram com o uso e funciona com qualquer provedor LLM compatível com OpenAI — Nous Portal, OpenRouter, Anthropic, Copilot da GitHub, z.ai, Kimi, MiniMax, DeepSeek, Qwen Cloud, Hugging Face, Google, xAI/SuperGrok ou seu próprio endpoint self-hosted.1219 A partir da v0.14.0 (16 de maio de 2026), Hermes adiciona OAuth SuperGrok com contexto de 1M no grok-4.3, um proxy local compatível com OpenAI para provedores OAuth (hermes proxy), x_search nativo, suporte à instalação via PyPI (descontinuada na v0.19.0 — o instalador de uma linha é o caminho suportado), instalações de dependências sob demanda, 28 plataformas de mensagens com LINE e SimpleX Chat, /handoff, diagnósticos semânticos de LSP após escritas, video_generate unificado, computer_use via cua-driver para provedores que não são Anthropic, beta nativo para Windows e 12 fechamentos P0 / 50 P1.19 A parte mais difícil para a maioria dos novos usuários é a autenticação de provedores: Hermes oferece suporte a cerca de 20 provedores de primeira classe, além de endpoints personalizados, e a três caminhos distintos de autenticação (chave API em .env, OAuth via hermes model ou endpoint personalizado em config.yaml). O modelo de autenticação é a primeira coisa a aprender — todo o resto depende de qual provedor foi resolvido.

Hermes Agent opera como um runtime de agente completo, não como um wrapper de chat. Ele lê seu sistema de arquivos, executa comandos em backends isolados, extrai conteúdo da web, cria subagentes, executa jobs cron agendados, conversa com Telegram/Discord/Slack/WhatsApp/Signal/Email a partir de um único processo de gateway e cria suas próprias skills com base na experiência.1 A CLI é uma interface de terminal construída sobre um loop de conversa em run_agent.py; o gateway é um processo de longa duração que encaminha mensagens das plataformas de mensagens pelo mesmo loop de conversa.3

A diferença entre o uso casual e o uso avançado de Hermes se resume a cinco sistemas. Domine-os, e Hermes se tornará um multiplicador de força:

  1. Resolução de provedores: como os fluxos de autenticação são mapeados para chamadas API
  2. Hierarquia de configuração: config.yaml + .env + auth.json + SOUL.md + AGENTS.md
  3. Sistema de ferramentas + toolset: o que o agente pode fazer, controlado por plataforma
  4. Sistema de skills: memória procedural que o agente cria e desenvolve
  5. Gateway + cron + profiles: executar Hermes onde você vive, não apenas onde está

Principais conclusões

  • A autenticação de provedores tem três caminhos, não um. Chave API em .env, OAuth via hermes model/hermes auth ou endpoint personalizado em config.yaml. Escolha o caminho compatível com seu provedor, não o que parece familiar.
  • Trocar de provedor exige um único comando. hermes model guia você interativamente por todos os provedores compatíveis, incluindo logins OAuth, e /model provider:model troca no meio da sessão sem perder o histórico.2
  • Dois arquivos formam a superfície de configuração editável pelo usuário. ~/.hermes/config.yaml armazena as configurações e ~/.hermes/.env armazena os segredos. auth.json, SOUL.md, MEMORY.md e skills/ são gerenciados diretamente por Hermes — você pode editar SOUL.md manualmente, mas o restante é manipulado pelo próprio agente.4
  • Hermes é o sucessor do OpenClaw. Se você estiver migrando, hermes claw migrate importa automaticamente mais de 30 categorias de estado.5
  • A qualidade do serviço depende do seu modelo auxiliar. Visão, resumo da web, compressão e descarregamento de memória usam um LLM auxiliar separado. Por padrão, é o Gemini Flash por meio de detecção automática (OpenRouter → Nous → Codex) — se nenhum deles estiver configurado, esses recursos se degradam silenciosamente até que você aponte os slots auxiliares para seu provedor principal.4

O que muda na v0.14

A v0.14.0 é menos sobre um recurso de destaque e mais sobre reduzir o atrito de configuração enquanto amplia os lugares onde Hermes pode funcionar.19 As principais mudanças operacionais:

  • A instalação e a inicialização estão mais leves. pip install hermes-agent funciona via PyPI, adaptadores pesados são instalados sob demanda no primeiro uso, e o caminho de inicialização adia trabalho suficiente para reduzir a partida a frio em aproximadamente 19 segundos. (Desde então, a v0.19.0 descontinuou instalações via pip — consulte Instalação.)
  • Assinaturas podem se tornar endpoints API locais. hermes proxy transforma provedores respaldados por OAuth, como Claude Pro, ChatGPT Pro e SuperGrok, em um endpoint local compatível com OpenAI para ferramentas como Codex, Aider, Cline e Continue.
  • O alcance do gateway se expande. LINE e SimpleX Chat elevam a contagem de plataformas para 22, Microsoft Teams está conectado de ponta a ponta, o preenchimento de histórico do Discord vem ativado por padrão, e os prompts clarify do Telegram/Discord agora usam botões nativos.
  • A verificação no momento da escrita melhora. Após as edições, Hermes pode mostrar resumos por turno das mutações de arquivos e diagnósticos semânticos do servidor de linguagem antes do próximo turno, o que o aproxima do trabalho de agentes orientado por evidências.
  • As ferramentas de desktop e mídia se ampliam. computer_use funciona por meio do cua-driver para provedores que não são Anthropic, video_generate é unificado por trás de backends conectáveis, e vision_analyze envia pixels brutos a modelos que realmente conseguem enxergar.

Cada seção abaixo se baseia na documentação upstream em hermes-agent.nousresearch.com/docs e na árvore de código-fonte em github.com/NousResearch/hermes-agent. Cada afirmação factual tem uma nota de rodapé que aponta para a página upstream específica de onde ela veio.

Escolha seu caminho

O que você precisa Acesse aqui
Instalar Hermes Instalação — instalador de uma linha ou etapas manuais
Fazer login em um provedor Autenticação e provedores — a seção que trouxe você até aqui
Trocar de modelo no meio da sessão O comando hermes auth e Endpoints personalizados e self-hosted para a sintaxe de /model
Executar um LLM local Endpoints personalizados e self-hosted — Ollama, vLLM, SGLang, llama.cpp, LM Studio
Conectar plataformas de mensagens Gateway de mensagens — Telegram, Discord, Slack, WhatsApp, Signal, Google Chat, LINE, SimpleX Chat (22 no total)
Criar ou instalar uma skill Sistema de skills — divulgação progressiva + hub de skills
Referência detalhada de cada comando CLI Continue lendo — e acesse diretamente Comandos da CLI

Como o Hermes funciona: o modelo mental

O Hermes é estruturado em torno de um único loop de conversa que pode ser invocado por qualquer ponto de entrada. Os pontos de entrada são a CLI (cli.py), o gateway de mensagens (gateway/run.py), o adaptador ACP para integração com editores, o executor em lote e um servidor API.3 Todos eles acabam chamando AIAgent.run_conversation() em run_agent.py, que:

  1. Monta o prompt do sistema a partir de SOUL.md, MEMORY.md, USER.md, skills, arquivos de contexto e orientações sobre ferramentas por meio de prompt_builder.py3
  2. Resolve o provedor de runtime por meio de runtime_provider.py — esta é a etapa que escolhe sua autenticação, URL base e modo de API3
  3. Chama o provedor usando um dos três modos de API: chat_completions, codex_responses ou anthropic_messages3
  4. Encaminha todas as chamadas de ferramentas retornadas por meio de model_tools.py e do registro central de ferramentas (tools/registry.py)3
  5. Repete o loop até que o modelo produza uma resposta final e, depois, salva a sessão no SQLite com FTS53

Entender esse loop é importante porque todos os recursos — personalidades, memória, skills, compactação, fallback — se conectam a uma dessas etapas. Quando você lê uma chave de configuração e se pergunta o que ela faz, a resposta geralmente é: “ela ajusta a etapa 1, 2, 3 ou 4 do loop acima”.

Núcleo independente de plataforma. Uma única classe AIAgent atende à CLI, ao gateway, ao ACP, ao processamento em lote e ao servidor API. As diferenças entre plataformas ficam no ponto de entrada, não no próprio agente.3 É por isso que os mesmos comandos de barra funcionam no terminal e no Telegram — eles são encaminhados a partir de um COMMAND_REGISTRY compartilhado em hermes_cli/commands.py.6

A estrutura de diretórios é o sistema. O Hermes armazena tudo em ~/.hermes/ (ou em $HERMES_HOME para profiles que não sejam o padrão):4

~/.hermes/
├── config.yaml        # Settings (model, terminal, TTS, compression, etc.)
├── .env               # API keys and secrets
├── auth.json          # OAuth provider credentials (Nous Portal, Codex, Anthropic)
├── SOUL.md            # Primary agent identity (slot #1 in system prompt)
├── memories/          # Persistent memory (MEMORY.md, USER.md)
├── skills/            # Bundled + agent-created + hub-installed skills
├── cron/              # Scheduled jobs
├── sessions/          # Gateway session state
└── logs/              # agent.log, gateway.log, errors.log (secrets auto-redacted)

Cada arquivo acima tem uma função específica; não há sobreposição entre eles. Se você quer saber “onde o Hermes armazena X”, a resposta está entre esses arquivos.


Novidades da v0.20.0 (The Herald Release)

O Hermes Agent v0.20.0 (tag v2026.8.3, 3 de agosto de 2026) é a versão atual com novos recursos; a v0.20.1 (13 de agosto) e a v0.20.2 (16 de agosto) são tags de estabilização lançadas sobre ela, e a v0.20.3 (tag v2026.8.16.2, publicada em 17 de agosto) e a v0.20.4 (tag v2026.8.18, 18 de agosto) mantêm a sequência de rollups, cada uma com sua própria janela de novos recursos — consulte a subseção abaixo. A janela desde a v0.19.0 abrange aproximadamente 3.650 commits, 1.400 PRs mesclados e 1.200 issues encerradas, com a participação de mais de 650 colaboradores.24

Três mudanças invalidam as instruções das versões anteriores deste guia. Leia-as antes de todo o resto:

  • Agora, o Node 26 é obrigatório. O instalador fixa NODE_VERSION="26" e recusa runtimes mais antigos com a mensagem “Node.js … is too old (Hermes requires Node >=26).” Os instaladores, o heal e o upgrade aplicam essa exigência. Observe que a página de instalação do site de documentação ainda indica o Node v22 — o script do instalador e as notas de versão são as fontes mais recentes e confiáveis.24
  • pip e Homebrew foram descontinuados, não apenas marcados como obsoletos. Nas palavras da própria equipe: “brew + pip/PyPI wheel channels retired (shell installer / Docker / Nix are the supported channels).” Se você ainda usa uma instalação via pip ou brew, esse método não recebe mais atualizações.24
  • O limite padrão de iterações para chamadas de ferramentas passou de 90 para 500. Execuções autônomas longas deixaram de esbarrar em um limite artificial, e todos os limites de pressão de orçamento abaixo são calculados com base nesse novo teto. read_file também passou a usar 2.000 linhas por padrão, em vez de 500.24

O restante da versão:

  • Voz conversacional. TTS por streaming com interrupção por voz e palavras de ativação processadas no dispositivo.24
  • A2A v1.0. Um plugin de protocolo entre agentes, atendendo à antiga solicitação da issue nº 514.24
  • Webhooks de saída assinados. Antes, hermes webhook aceitava apenas entradas; a v0.20.0 adiciona webhooks de ciclo de vida de saída assinados com HMAC para eventos de sessão, turno e ferramenta.24
  • Citações fundamentadas. Uma nova skill com um modo de verificação de fatos.24
  • Onda de recursos avançados para CLI. !command executa um comando de shell imediatamente sem consumir um turno do modelo; /init examina o projeto e cria ou atualiza um AGENTS.md; /diff mostra alterações preparadas, todas as alterações ou as alterações da sessão em qualquer interface; /context detalha o que está ocupando a janela de contexto; /focus oferece uma visualização com menos conteúdo e permite recuperar linhas ocultas; Ctrl+S guarda um prompt escrito pela metade. hermes import-agent migra uma configuração de Claude Code ou Codex CLI com um único comando.24
  • Novidades na interface de secrets. Uma fonte de secrets baseada em comando auxiliar que pode ser combinada com qualquer cofre, rotação de tokens com um único comando e erros acionáveis na inicialização, um cache criptografado de emergência opcional para Bitwarden, chaves injetadas pelo cofre e limitadas ao diretório inicial de cada profile e paridade de SecretRef ${env:VAR} entre config.yaml e a configuração do MCP. O modelo de autenticação por três caminhos descrito abaixo permanece inalterado.24
  • Inicialização a quente mais rápida. O tempo de inicialização a frio de hermes -w caiu de aproximadamente 14s para 1,8s.24
  • O desktop virou uma plataforma. Artefatos com cartões versionados e visualização ao vivo em sandbox, um SDK de plugins com o Kanban como plugin inaugural para desktop, um atalho global para entrada rápida, várias janelas da GUI, modo de backend remoto SSH e login nativo conforme a RFC 8252.24

Os rollups v0.20.3 e v0.20.4 (17 e 18 de agosto)

Após a v0.20.0, o projeto adotou um ritmo de rollups com tags em alta frequência, e os dois mais recentes vão além da estabilização. Ambos afirmam que “full curated release notes for this window will ship with v0.21.0” — por isso, os resumos abaixo vêm das descrições das janelas nas próprias versões, e não de uma lista selecionada de recursos.23

v0.20.3 (aproximadamente 250 commits e 125 PRs desde a v0.20.2):

  • Migração para o SDK do MCP 2.x, com suporte ao protocolo sem estado de 28 de julho de 2026. O Hermes passa a usar a geração atual do SDK do MCP e se comunica pela revisão sem estado do protocolo.23
  • O Bot Mode é distribuído como um plugin integrado (hermes-bots) que inclui o protocolo central de colegas de equipe.23
  • Um plugin do provedor CommandCode passa a fazer parte do catálogo de provedores.23
  • Contratos de runtime do Cua Driver 0.20 para uso do computador, além do reforço da propriedade do runtime do subprocesso Python (isolamento de PYTHONHOME/PYTHONPATH).23
  • Confiabilidade: autorrecuperação do agendador cron (recuperação de EMFILE, reconciliação de reivindicações obsoletas e reativação de tarefas travadas), correções de perda de dados na transferência de sessões, autorrecuperação da conexão do desktop com o gateway remoto e uma leva de melhorias no ecossistema (verificação de segurança na instalação de plugins, /worktree, preservação de edições manuais no /rollback e leitura de arquivos UTF-16).23

v0.20.4 (aproximadamente 146 commits e 74 PRs desde a v0.20.3):

  • A superfície de vidro do desktop: trabalho com vidro fosco e translucidez, incluindo um seletor de efeito fosco e pré-seleção do macOS.23
  • Uma barra lateral SESSIONS|BOTS com abas, com opção de ocultar ou exibir cada bot, além de correções para conversas em grupo no Bot Mode (turnos prolongados dos participantes, renderização de Markdown e roteamento entre máquinas).23
  • Verificação consultiva Tier 1 do NVIDIA SkillEvaluator durante a instalação de skills — as verificações de licença e segurança são executadas quando você instala uma skill.23
  • Reforço do envio de mídia via cron (timeout configurável, anexos em execuções manuais e exibição de disparos perdidos), correções de thread do loop de eventos e de contenção no SessionDB, comunicação transparente do hermes update sobre branches estacionadas e notificações nativas do sistema operacional para o Kanban.23

O processo de atualização não mudou: use hermes update em uma instalação existente ou o instalador via shell para novas instalações.23

Novidades da v0.19.0 (A versão Quicksilver)

O Hermes Agent v0.19.0 (tag v2026.7.20, 20 de julho de 2026) recebeu esse nome pela velocidade do próprio deus mensageiro: a base da versão é a capacidade de resposta bruta, com uma redução de ~80% no tempo até o primeiro token do primeiro turno em todas as plataformas. Em torno disso estão faturamento no terminal, fontes de secrets de gerenciadores de senhas, aprovações inteligentes por padrão, subagentes observáveis e entrega de respostas à prova de falhas. O período desde a v0.18.0 é o maior do projeto até agora: ~2.245 commits, ~1.065 PRs mesclados, ~3.300 issues fechadas e mais de 450 contribuidores da comunidade.25

  • ~80% mais rápido até o primeiro token, em todos os lugares. O envio a frio→dispatch caiu de ~4,3s para ~0,9s no CLI, gateway, TUI, desktop e cron — a detecção de capacidade do Discord saiu do caminho crítico, a sondagem do Ollama é ignorada para providers conhecidos que não usam Ollama e o trabalho bloqueante foi removido da inicialização do agent. A latência percebida também recebeu atenção: modelos de reasoning agora fazem streaming do raciocínio ao vivo por padrão (display.show_reasoning está ON), e a caixa de resposta é renderizada por token, não por linha.25
  • Onda de renderização no desktop e na TUI. O app desktop recebeu uma reformulação de velocidade com ~20 PRs: 14× menos CPU no separador de streaming Markdown por meio de análise léxica incremental de blocos, diffs virtualizados no painel de revisão, troca ágil de sessão em transcrições grandes e fim das novas renderizações da barra lateral e das linhas de tools a cada token. A TUI agora renderiza Markdown em streaming incrementalmente por bloco.25
  • Instalações por pip e Homebrew foram descontinuadas. Ambos os caminhos foram marcados como instalações legadas “não compatíveis”, com remoção planejada. Essa remoção já ocorreu na v0.20.0 — os canais brew e pip/PyPI wheel foram aposentados, restando o instalador via shell, Docker e Nix como canais compatíveis.2524
  • Secrets podem vir do seu gerenciador de senhas. Uma nova interface plugável SecretSource busca secrets do Bitwarden e do 1Password (referências op://) no carregamento, com vários vaults ativados simultaneamente, precedência determinística, avisos de conflito e proveniência por variável — as chaves API não precisam mais ficar em um .env de texto simples. Providers de vault futuros entram como plugins.25
  • Aprovações inteligentes agora são o padrão. Quando Hermes quer executar um comando sinalizado, um revisor LLM independente o avalia em vez de solicitar sua confirmação para cada um — e cada veredito cobre somente aquele comando exato. As regras de negação definidas pelo usuário bloqueiam comandos correspondentes até mesmo no modo YOLO, /deny <reason> transmite seu motivo de recusa para que o agent corrija o rumo, e a ação de aprovação pre_tool_call do plugin (restabelecida com chaves de regra) eleva uma tool call para uma etapa de aprovação humana.25
  • Faturamento no terminal: /subscription e /topup. Gerencie seu plano do Nous Portal sem sair do terminal — veja seu plano e a franquia restante, visualize exatamente o custo de um upgrade ou quando um downgrade entra em vigor e aplique a alteração com opção de desfazer. O app desktop ganha uma aba correspondente de configurações de faturamento.25
  • Acompanhe o trabalho dos subagentes; nunca perca uma resposta concluída. Os dispatches de delegate_task retornam arquivos de transcrição ao vivo que você pode acompanhar com tail -f assim que os subagentes são iniciados — cada tool call, resultado e resposta em streaming, em um log legível por humanos para cada filho. As conclusões de delegações em segundo plano persistem após reinicializações, e as respostas finais do gateway são registradas em um ledger de obrigação de entrega em state.db e entregues novamente na próxima inicialização se o gateway falhar no meio do envio. A opção de configuração max_async_children está descontinuada em favor de limites unificados de concorrência de delegação.25
  • Um gateway, muitos profiles. Um único gateway multiplexado que compartilha um token de bot pode direcionar guilds, canais ou threads específicos para profiles diferentes — cada um com config, skills, memória e secrets totalmente isolados — com uma substituição GATEWAY_MULTIPLEX_PROFILES. O índice de roteamento foi movido para state.db; sessions.json agora é um espelho legado opcional.25
  • Onda de providers e modelos. Fireworks AI chega como opção de primeira classe (estimativa de custo, posição nº 2 no seletor de provider), acompanhado de DeepInfra e Upstage Solar. Os catálogos adicionam GPT-5.6 (Sol/Terra/Luna + Pro, conectado de ponta a ponta), grok-4.5 (GA), kimi-k3 (kimi-k2.x aposentado) e Claude Sonnet 5 totalmente conectado. Uma flag enabled: false por provider e a configuração excluded_providers removem providers não utilizados dos seletores e da resolução de /model.25
  • O esforço de reasoning vira um controle. Novos níveis de esforço max e ultra chegam a todas as superfícies, com substituições por modelo na config, esforço por slot nos presets de MoA (advisors pensam mais, o sintetizador permanece rápido), esforço por tarefa para modelos auxiliares e um /reasoning com escopo de sessão no CLI.25
  • Superfície de CLI e MCP. hermes sessions export grava formatos Markdown, Quarto, HTML, somente prompt e rastreamento do Hugging Face com limpeza opcional via --redact; /model --once fornece uma substituição de modelo para um turno; invocações de slash-skill são encadeadas (/skill-a /skill-b do XYZ); --safe-mode ajuda na solução de problemas; hermes config get/unset completam o gerenciamento de config; hermes serve se torna um backend verdadeiramente headless; e as tools MCP adotam a convenção de nomenclatura mcp__server__tool.25

Se você estiver fazendo upgrade da v0.18.x, duas mudanças merecem atenção antes de qualquer outra: uma instalação por pip ou Homebrew agora avisa que é um legado não compatível (migre para o instalador de uma linha), e max_async_children está descontinuado em favor dos limites unificados de concorrência de delegação. Todo o restante é aditivo — os principais motivos para fazer upgrade são a redução de ~80% na latência do primeiro turno, as aprovações inteligentes e o ledger de entrega que torna respostas concluídas resistentes a falhas.


Novidades da v0.18.0 (A versão Judgment)

O Hermes Agent v0.18.0 (tag v2026.7.1, 1º de julho de 2026) recebeu esse nome por causa do julgamento: o agent verificando seu próprio trabalho em vez de alegar sucesso, e ensemble reasoning que você realmente pode inspecionar. Ele também fecha todo o backlog P0/P1 — cerca de 692 itens de maior prioridade resolvidos em doze dias.22

  • Mixture-of-Agents como modelo de primeira classe. MoA agora pode ser selecionado como qualquer outro modelo em todas as interfaces, e o ensemble reasoning é visível: a saída completa de cada modelo de referência é renderizada como seu próprio bloco identificado, com streaming da resposta ao vivo — você pode observar o ensemble raciocinar em vez de receber uma resposta mesclada opaca.22
  • Contratos de conclusão para /goal. O agent verifica seu próprio trabalho executando as verificações do projeto antes de informar que um objetivo foi concluído, em vez de apenas alegar sucesso — julgamento aplicado a si mesmo.22
  • /learn — descreva qualquer coisa e transforme em uma skill. Transforme um fluxo de trabalho em uma skill reutilizável descrevendo-o; as skills geradas seguem automaticamente as convenções do CONTRIBUTING.md do repositório.22
  • Linha do tempo de /journey. Um histórico visual da memória e das skills ao longo do tempo, com edição, além de um grafo de memória no desktop.22
  • Expansão de subagentes em segundo plano. Delegue várias tarefas executadas simultaneamente sem bloquear a conversa — o único subagente em segundo plano da v0.17.0 se torna uma frota.22
  • Projects no desktop. Projects de programação de primeira classe com um modelo de organização por projeto/repositório/lane.22
  • Gateway com escalonamento para zero. Gateways podem ficar inativos quando ociosos e coordenar drains para deployments sem interrupções — relevante para qualquer pessoa que execute Hermes como um serviço sempre ativo.22
  • Suporte ao Google Vertex AI. Acesso ao Gemini por contas de serviço do GCP com atualização automática do token OAuth2, entrando no catálogo de providers.22
  • Comando de editor /prompt. Abre $EDITOR para compor prompts de várias linhas em vez de lutar com a linha de entrada.22

Se você estiver fazendo upgrade da v0.17.x, nada aqui quebra o CLI. Os principais motivos para fazer upgrade são contratos de conclusão (objetivos que se verificam), MoA de primeira classe com ensembles inspecionáveis e /learn para capturar skills.

Novidades na v0.17.0 (A versão Reach)

O Hermes Agent v0.17.0 (tag v2026.6.19, 19 de junho de 2026) recebeu esse nome pela abrangência que o agente agora alcança — novos canais de mensagens, novos provedores de modelos e controles mais profundos para desktop e dashboard. Ela é incremental em relação à v0.16.x; a superfície do CLI permanece inalterada.21

  • Novos canais de mensagens. O iMessage agora funciona sem um relay Mac por meio do Photon Spectrum (código de dispositivo OAuth, hermes photon login); o WhatsApp Business Cloud API é um adaptador oficial da Meta que elimina a necessidade de um processo de bridge; o SimpleX ganha grupos, anexos nativos, processamento de texto em lote e aceitação automática; e o Raft entra como um plugin de plataforma incluído, com um design de canal de ativação que garante privacidade por contrato.21
  • Novos modelos e provedores. O catálogo adiciona z-ai/glm-5.2 (contexto de 1M), anthropic/claude-fable-5, laguna-m.1, nemotron-3-ultra e grok-composer-2.5-fast (o modelo do Cursor via xAI OAuth, contexto de 200k). O padrão da xAI mudou para grok-build-0.1, e os modelos adaptativos Anthropic agora seguem o contrato moderno de thinking (eles nunca enviam um campo reasoning).21
  • Desktop e dashboard. O desktop adiciona subagentes em segundo plano com streaming ao vivo em “watch-windows” da atividade delegada (delegate_task(background=true)), um seletor de modelo Composer, atalhos de teclado reatribuíveis, notificações nativas do sistema operacional, rascunhos do composer por thread, temas do VS Code Marketplace e interface em japonês + chinês tradicional. O dashboard adiciona um criador completo de profiles (modelo/skills/MCPs sem editar config.yaml), um alternador global de profile, um Skills Hub reformulado com verificação de segurança, Automation Blueprints (templates parametrizados em formulário, slash command, conversa e documentação) e um login seguro que retorna 401 por trás do gate OAuth.21
  • Skills e tools. image_generate agora pode editar e transformar uma imagem de origem, não apenas criar uma do zero, em todos os provedores de imagem compatíveis; a tool memory ganhou um array operations para adicionar/substituir/remover em lote de forma atômica em uma única chamada; uma nova skill simplify-code executa uma etapa paralela de revisão e limpeza com três agentes, condicionada a um nível de risco da Chesterton’s Fence; e um write_approval booleano substitui o write_mode de três estados.21
  • Arquitetura. Subagentes em segundo plano retornam um handle imediatamente e inserem seu resultado como um novo turno; um manipulador de elicitação MCP permite confirmação durante uma chamada de tool, e tools MCP conectadas tardiamente são expostas entre turnos (seguro para cache); cron se torna um CronScheduler conectável com um provedor de cron gerenciado Chronos; e um novo escopo Managed (/etc/hermes) permite que um administrador fixe uma configuração imutável para o usuário, junto a um relay Gateway-Gateway para topologias com múltiplos gateways.21
  • Novos comandos. /version, /billing (faturamento interativo no terminal), hermes photon login (autenticação do iMessage) e hermes curator run --consolidate — a consolidação agora é opcional, então a curadoria rotineira em segundo plano não consome tokens.21
  • Segurança. A v0.17.0 corrige um bypass da denylist de escape de shell, falha de forma segura quando módulos de aprovação e adaptadores de gateway de política própria estão ausentes, sanitiza o ambiente para subprocessos de scripts de jobs cron, oculta secrets em dumps de depuração de solicitações, verifica configurações stdio MCP em busca de padrões de exfiltração e atualiza urllib3 e PyJWT para corrigir CVEs.21

Se você estiver atualizando da v0.16.x, nada aqui quebra o CLI; são novos canais, modelos e superfícies em torno do mesmo agente. Os adaptadores de iMessage sem relay e WhatsApp oficial, além do escopo Managed para administradores, são os principais motivos para atualizar.


Novidades na v0.16.0 (A versão Surface)

O Hermes Agent v0.16.0 (tag v2026.6.5, 5 de junho de 2026) recebeu esse nome pelas novas superfícies que coloca diante do agente com foco no CLI. O destaque é que o Hermes deixou de ser exclusivo do terminal.20

  • App desktop nativo. Hermes Desktop é um novo app Electron para macOS, Linux e Windows, com instalação em um clique e autoatualização no app. Ele oferece uma janela de chat com streaming, arquivos por arrastar e soltar, colagem de imagens da área de transferência, uma paleta Cmd+K, uma lista de sessões com arquivamento e busca e um seletor de modelo na barra de status. Ele pode se conectar a um gateway Hermes remoto por meio de um WebSocket seguro, autenticando via OAuth ou nome de usuário/senha, com hosts remotos por profile e sessões simultâneas de múltiplos profiles vinculadas por referências @session entre profiles. A interface desktop também inclui uma tradução completa para chinês simplificado (简体中文) por meio de uma camada i18n tipada (display.language; o inglês continua sendo o padrão).20
  • Painel de administração no navegador. O dashboard web local evoluiu de uma visualização de status para um painel de administração completo: um catálogo MCP com alternâncias para ativar/desativar, gerenciamento de credenciais, criação de webhooks e hooks, configuração de memória, controles de gateway e uma página System com verificação antes da atualização, além de Debug Share em um clique. Uma nova página Channels configura todas as plataformas de mensagens do gateway (Telegram, Discord, Slack e as demais) pelo navegador. A autenticação agora é conectável: login com nome de usuário/senha, um provedor OIDC genérico auto-hospedado, hermes dashboard register para um cliente OAuth auto-hospedado e rotação de sessão por refresh token.20
  • Novos comandos CLI e slash commands. /undo [N] faz backup dos últimos N turnos do usuário com prefill e exclusão reversível, e funciona no CLI, na TUI e em todas as plataformas de mensagens. Uma interface padrão configurável (cli vs tui) chega com uma substituição por --cli; a TUI ganha um comando /model unificado e uma sobreposição Sessions. hermes portal é um alias legível para humanos do fluxo de onboarding do Nous Portal, com novos caminhos de primeira execução Quick Setup e Full Setup, e chegam dois diagnósticos: hermes prompt-size e hermes sessions optimize.20
  • Novos modelos e provedores. O seletor adiciona deepseek-v4-flash, MiniMax-M3 (contexto de 1M, provedores MiniMax nativos), qwen3.7-plus (Nous + OpenRouter) e gemini-3.5-flash (Gemini OAuth + chave API). Um provedor xAI Grok OAuth de primeira classe entra no launcher desktop, o seletor de modelos passa a ter busca fuzzy em todas as superfícies, provedores com múltiplos endpoints são agrupados em uma linha, e a atualização do catálogo mudou de diária para horária.20
  • Skills mais enxutas e divulgação progressiva. O conjunto padrão de skills removeu skills redundantes e inativas (Spotify passou para um plugin nativo, Linear para hermes mcp install linear, e várias entradas desatualizadas foram removidas), transferiu mais itens para opcionais e adicionou um gate de relevância no frontmatter environments: (kanban/docker/s6) que mantém skills específicas de contexto fora do índice até serem solicitadas. NVIDIA/skills agora é uma fonte confiável padrão do Skills Hub, junto de OpenAI, Anthropic e HuggingFace. As tools MCP e de plugins ganharam divulgação progressiva (com escopo) de tools, e foi corrigido um bug MCP que relatava sucesso falso de OAuth quando nenhum token era obtido.20
  • Segurança. A v0.16.0 fixa a versão corrigida do Starlette (≥1.0.1) para CVE-2026-48710 (BadHost), retira as verificações de URL SSRF do event loop em caminhos assíncronos, remove o bearer token de inferência Bedrock do ambiente de subprocessos, adiciona bws_cache.json à proteção de leitura para segurança de arquivos, adiciona docker restart/stop/kill à lista de padrões perigosos e sanitiza Unicode invisível em conteúdo de skills analisado. A versão corrigiu 2 problemas P0 e 62 P1, 16 deles marcados como segurança.20

Se você estiver atualizando da v0.15.x, nada disso é uma mudança incompatível no próprio CLI; são superfícies e provedores incrementais em torno do mesmo agente. O app desktop e o painel de administração são o motivo para atualizar se você quiser executar o Hermes para usuários que não usam terminal ou administrar um gateway remoto pelo navegador.

Instalação

O instalador de uma linha é o método de instalação compatível. Ele instala Python, uv, Node.js, ripgrep, ffmpeg, o clone do repositório, o ambiente virtual e o comando global hermes.7

curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

As instalações via pip e Homebrew estão descontinuadas desde a v0.19.0. O pacote PyPI introduzido na v0.14.0 (pip install hermes-agent) e a fórmula do Homebrew agora são marcados como instalações “unsupported legacy” — todas as interfaces exibem um aviso (sem bloquear) quando Hermes detecta uma delas, e a remoção da publicação no PyPI/Homebrew está planejada. Se você instalou via pip ou brew, migre para o instalador acima.25

Funciona no Linux, macOS, WSL2 e Android/Termux (o instalador detecta automaticamente o Termux e muda para um pacote Android testado).7 O Windows nativo agora é uma plataforma Tier 1, em vez da versão beta inicial lançada na v0.14.0 — instale-o com iex (irm https://hermes-agent.nousresearch.com/install.ps1). Uma ressalva que a documentação deixa explícita: o suporte ao macOS é apenas para Apple Silicon, e Macs Intel não são compatíveis.24 Historicamente, a v0.14.0 adicionou suporte nativo ao Windows em beta inicial por meio de um instalador PowerShell, mas o WSL2 continua sendo a recomendação mais segura para uso em produção até que o caminho para Windows amadureça.19

Depois que ele terminar:

source ~/.bashrc    # or ~/.zshrc
hermes              # Start chatting

O único pré-requisito é git. O instalador provisiona automaticamente Python 3.11 via uv (sem necessidade de sudo), Node.js 26 (para automação de navegador e a ponte do WhatsApp), ripgrep e ffmpeg. O Node 26 é um requisito mínimo rígido desde a v0.20.0 — o instalador recusa qualquer versão anterior e instala uma versão do Node gerenciada pelo Hermes.247

Verifique a instalação

hermes version      # Check version
hermes doctor       # Diagnose config/dependency issues
hermes status       # Show current configuration + auth state
hermes dump         # Copy-pasteable setup summary for debugging

hermes doctor informa exatamente o que está faltando e como corrigir.7 hermes dump é o comando de diagnóstico para colar em uma issue do GitHub ou em uma thread do Discord ao pedir ajuda — ele fornece um resumo em texto simples de toda a sua configuração, com segredos ocultados.8

Instalação manual

Se você precisa de controle total — versão personalizada do Python, extras específicos, integração com Nix/NixOS — o fluxo manual está documentado passo a passo no guia de instalação upstream.7 Principais extras opcionais que você pode combinar com uv pip install -e ".[<extras>]":

Extra O que adiciona
all Tudo abaixo
messaging gateway para Telegram e Discord
cron Análise de expressões cron
cli Interface de menu no terminal para o assistente de configuração
modal Backend de execução na nuvem Modal
voice Entrada de microfone CLI e reprodução de áudio
tts-premium Vozes premium do ElevenLabs
honcho Memória nativa de IA (integração com Honcho)
mcp Suporte a Model Context Protocol
homeassistant Integração com Home Assistant
acp Suporte à integração com o editor ACP
slack Mensagens pelo Slack
pty Suporte a terminal PTY (ferramentas CLI interativas)
dev pytest e utilitários de teste
termux Pacote Android testado (inclui cron, cli, pty, mcp, honcho, acp)

O comando de instalação do Termux é diferente — ele usa pip com um arquivo de constraints, e não uv pip:

python -m pip install -e ".[termux]" -c constraints-termux.txt

Isso acontece porque .[all] no Android instala faster-whisper por meio do extra voice, que depende de wheels ctranslate2 não publicados para Android.7


Autenticação e provedores

Hermes oferece suporte a cerca de 22 provedores de primeira linha, além de endpoints personalizados (a v0.19.0 adiciona Fireworks AI, DeepInfra e Upstage Solar), e três caminhos distintos de autenticação. Aqui está toda a superfície de autenticação, organizada por caminho para que você encontre o que corresponde ao que tem.

Os três caminhos de autenticação

Todos os provedores no Hermes se encaixam em um destes três padrões de autenticação:

Caminho 1 — chave API em .env. Coloque sua chave em ~/.hermes/.env e o Hermes a lê na inicialização. Usado por OpenRouter, AI Gateway, z.ai/GLM, Kimi/Moonshot, MiniMax (e MiniMax China), Alibaba Cloud/DashScope, Kilo Code, OpenCode Zen, OpenCode Go, DeepSeek, Hugging Face, Google/Gemini e a maioria dos provedores de terceiros.2 Desde a v0.19.0, a chave não precisa mais ficar em um arquivo de texto simples: uma interface conectável SecretSource pode buscar segredos do Bitwarden ou 1Password (referências op://) durante o carregamento, com vários cofres ativados simultaneamente, precedência determinística, avisos de conflito e procedência por variável — .env continua sendo a alternativa de fallback. (Isso é diferente do token de bootstrap do Bitwarden Secrets Manager da v0.15.0, que consolidava as chaves de provedores por trás de um único token; SecretSource substitui o próprio arquivo de texto simples, e futuros provedores de cofre podem ser adicionados como plugins.)25

Caminho 2 — OAuth via hermes model ou hermes auth. Inicia um fluxo de código de dispositivo, abre um navegador, armazena as credenciais em ~/.hermes/auth.json (e pode importar credenciais existentes de ferramentas como Claude Code ou Codex CLI). Usado por Nous Portal, OpenAI Codex (conta do ChatGPT), GitHub Copilot e Anthropic (Claude Pro/Max).2

Caminho 3 — endpoint personalizado em config.yaml. Para qualquer API compatível com OpenAI — Ollama, vLLM, SGLang, llama.cpp, LM Studio, proxy LiteLLM, Together AI, Groq, Azure OpenAI ou seu próprio servidor hospedado por você. Configurado uma vez por hermes model → Custom endpoint e então persistido em config.yaml.2

A matriz completa de provedores

Esta é a lista completa de provedores de primeira linha, com o fluxo exato de configuração de cada um.2

Provedor Caminho de autenticação Configuração
Nous Portal OAuth hermes model (login OAuth, baseado em assinatura)
OpenAI Codex OAuth hermes model (código de dispositivo do ChatGPT, usa modelos Codex)
GitHub Copilot OAuth ou token hermes model (código de dispositivo OAuth), ou COPILOT_GITHUB_TOKEN / GH_TOKEN / gh auth token
GitHub Copilot ACP Subprocesso local hermes model (requer copilot CLI no PATH + copilot login)
Anthropic OAuth ou chave API hermes model (prefere credenciais do Claude Code), ou ANTHROPIC_API_KEY, ou token de configuração ANTHROPIC_TOKEN
OpenRouter Chave API OPENROUTER_API_KEY em ~/.hermes/.env
AI Gateway (Vercel) Chave API AI_GATEWAY_API_KEY em ~/.hermes/.env (provedor: ai-gateway)
z.ai / GLM (ZhipuAI) Chave API GLM_API_KEY em ~/.hermes/.env (provedor: zai)
Kimi / Moonshot Chave API KIMI_API_KEY em ~/.hermes/.env (provedor: kimi-coding). A v0.19.0 adiciona kimi-k3 aos catálogos (kimi-k2.x foi descontinuado).25
MiniMax (global) Chave API MINIMAX_API_KEY em ~/.hermes/.env (provedor: minimax)
MiniMax China Chave API MINIMAX_CN_API_KEY em ~/.hermes/.env (provedor: minimax-cn)
Alibaba Cloud (Qwen) Chave API DASHSCOPE_API_KEY em ~/.hermes/.env (provedor: alibaba, aliases: dashscope, qwen)
Kilo Code Chave API KILOCODE_API_KEY em ~/.hermes/.env (provedor: kilocode)
OpenCode Zen Chave API OPENCODE_ZEN_API_KEY em ~/.hermes/.env (provedor: opencode-zen)
OpenCode Go Chave API OPENCODE_GO_API_KEY em ~/.hermes/.env (provedor: opencode-go)
DeepSeek Chave API DEEPSEEK_API_KEY em ~/.hermes/.env (provedor: deepseek)
Hugging Face Chave API HF_TOKEN em ~/.hermes/.env (provedor: huggingface, alias: hf)
Google / Gemini Chave API GOOGLE_API_KEY ou GEMINI_API_KEY em ~/.hermes/.env (provedor: gemini)
Fireworks AI Chave API Provedor de primeira linha com estimativa de custo e colunas de preços em cache no seletor de modelos; promovido à posição nº 2 nos seletores de provedores. Novo na v0.19.0.25
DeepInfra Chave API Provedor de primeira linha com uma integração reforçada. Novo na v0.19.0.25
Upstage Solar Chave API Provedor de primeira linha. Novo na v0.19.0.25
xAI (Grok) Provedor nativo / SuperGrok OAuth Provedor de primeira linha com acesso API direto e catálogo de modelos (v0.9.0+). A v0.14.0 adiciona SuperGrok OAuth e aumenta grok-4.3 para uma janela de contexto de 1M em contas elegíveis.21619 A v0.17.0 adiciona grok-composer-2.5-fast (modelo do Cursor via xAI OAuth, contexto de 200k) e altera o padrão do xAI para grok-build-0.1.21 A v0.19.0 move grok-4.5 para GA no catálogo.25
xAI Custom Voices Chave API Provedor de TTS com clonagem de voz. Novo na v0.13.0; configure em tts: no config.yaml e forneça a chave xAI em .env.18
Xiaomi MiMo Provedor nativo Provedor de primeira linha com assistente de configuração e catálogo de modelos. MiMo v2 Pro gratuito no Nous Portal para tarefas auxiliares (v0.9.0+).1615
Google AI Studio Chave API GOOGLE_API_KEY ou GEMINI_API_KEY em ~/.hermes/.env. Acesso direto ao Gemini com comprimentos de contexto detectados automaticamente pelo registro models.dev (v0.8.0+).15
Qwen Cloud OAuth Provedor OAuth com suporte a solicitações no portal (v0.8.0+). O provedor foi renomeado de Alibaba Cloud para Qwen Cloud na v0.14.0; as chaves de configuração existentes continuam funcionando.1519
Endpoint personalizado config.yaml hermes model → “Custom endpoint” (salvo em config.yaml)

A partir da v0.19.0, você também pode remover os provedores que não usa: uma flag enabled: false por provedor e uma chave de configuração excluded_providers os removem dos seletores /model e da resolução de provedores integrada.25

Anthropic: três métodos de autenticação

Anthropic tem sua própria seção porque o Hermes oferece suporte a três caminhos distintos para Claude, e escolher o certo importa. Da documentação upstream:2

# Method 1: API key (pay-per-token)
export ANTHROPIC_API_KEY=***
hermes chat --provider anthropic --model claude-sonnet-4-6

# Method 2: OAuth through hermes model (preferred)
# Uses Claude Code's credential store when available
hermes model

# Method 3: Manual setup-token (fallback/legacy)
export ANTHROPIC_TOKEN=***
hermes chat --provider anthropic

# Auto-detect Claude Code credentials
hermes chat --provider anthropic   # reads Claude Code files automatically

Quando você escolhe Anthropic OAuth por meio de hermes model, o Hermes prefere o próprio armazenamento de credenciais do Claude Code em vez de copiar o token para ~/.hermes/.env. Isso mantém as credenciais atualizáveis do Claude atualizáveis.2 Se você já usa Claude Code na mesma máquina, este é o caminho mais limpo.

Para fixar Anthropic permanentemente em config.yaml:

model:
  provider: "anthropic"
  default: "claude-sonnet-4-6"

--provider claude e --provider claude-code também funcionam como atalhos para --provider anthropic.2

GitHub Copilot: dois modos

Copilot tem suporte em dois modos: API direto do Copilot (recomendado) e Copilot ACP (que inicia o CLI local do Copilot como subprocesso).2

# Direct Copilot API
hermes chat --provider copilot --model gpt-5.4

# Copilot ACP (requires the Copilot CLI in PATH + an existing copilot login)
hermes chat --provider copilot-acp --model copilot-acp

A autenticação é verificada nesta ordem, conforme a documentação upstream:2 1. Variável de ambiente COPILOT_GITHUB_TOKEN 2. Variável de ambiente GH_TOKEN 3. Variável de ambiente GITHUB_TOKEN 4. Fallback do CLI gh auth token 5. Login por código de dispositivo OAuth via hermes model

O tipo de token importa. O API do Copilot não oferece suporte a Personal Access Tokens clássicos (ghp_*). Os tipos aceitos são tokens OAuth (gho_*), PATs de granularidade fina (github_pat_* com a permissão Copilot Requests) e tokens de App GitHub (ghu_*). Se o seu gh auth token retornar um token ghp_*, use hermes model para autenticar via OAuth.2

Provedores chineses de AI (suporte de primeira linha)

Hermes tem suporte integrado para z.ai/GLM, Kimi/Moonshot, MiniMax (endpoints global + China) e Alibaba Cloud com IDs de provedor dedicados.2

# z.ai / ZhipuAI GLM
hermes chat --provider zai --model glm-5                 # Requires: GLM_API_KEY

# Kimi / Moonshot AI
hermes chat --provider kimi-coding --model kimi-for-coding   # Requires: KIMI_API_KEY

# MiniMax (global)
hermes chat --provider minimax --model MiniMax-M2.7          # Requires: MINIMAX_API_KEY

# MiniMax (China)
hermes chat --provider minimax-cn --model MiniMax-M2.7       # Requires: MINIMAX_CN_API_KEY

# Alibaba Cloud / DashScope (Qwen)
hermes chat --provider alibaba --model qwen3.5-plus          # Requires: DASHSCOPE_API_KEY

As URLs base podem ser substituídas pelas variáveis de ambiente GLM_BASE_URL, KIMI_BASE_URL, MINIMAX_BASE_URL, MINIMAX_CN_BASE_URL ou DASHSCOPE_BASE_URL.2

Z.AI detecta automaticamente o endpoint. Ao usar o provedor z.ai/GLM, Hermes testa vários endpoints (global, China e variantes para código) para encontrar um que aceite sua chave API. O endpoint funcional é armazenado automaticamente em cache — a maioria dos usuários não precisa de GLM_BASE_URL.2

xAI (Grok) ativa automaticamente o cache de prompt. Quando a URL base contém x.ai, Hermes envia o cabeçalho x-grok-conv-id em todas as solicitações para encaminhar à mesma instância do servidor durante uma sessão de conversa, reutilizando prompts de sistema e histórico em cache.2 É automático; nenhuma configuração é necessária.

O comando hermes auth

hermes auth é o comando de gerenciamento de credenciais para pools e credenciais OAuth.6

hermes auth                              # Interactive wizard
hermes auth list                         # Show all credential pools
hermes auth list openrouter              # Show one provider's pool
hermes auth add openrouter --api-key sk-or-v1-xxx
hermes auth add anthropic --type oauth
hermes auth remove openrouter 2          # Remove by index
hermes auth reset openrouter             # Clear cooldowns

Pools de credenciais permitem alternar entre várias chaves API ou tokens OAuth do mesmo provedor — útil para distribuir limites de taxa entre várias chaves sem alterar código.6 Os comandos legados hermes login / hermes logout foram removidos; use hermes auth em seu lugar.6

Endpoints personalizados e hospedados por você

Hermes funciona com qualquer endpoint API compatível com OpenAI. Se um servidor implementar /v1/chat/completions, você pode apontar o Hermes para ele.2

Configuração interativa (recomendada):

hermes model
# Select "Custom endpoint (self-hosted / VLLM / etc.)"
# Enter: API base URL, API key, Model name

config.yaml manual:

model:
  default: your-model-name
  provider: custom
  base_url: http://localhost:8000/v1
  api_key: your-key-or-leave-empty-for-local

Ambas as abordagens persistem em config.yaml, que é a fonte única da verdade para modelo principal, provedor e URL base.2 As variáveis de ambiente legadas OPENAI_BASE_URL e LLM_MODEL não são mais lidas para a configuração do modelo principal — use hermes model ou edite config.yaml diretamente.2 (OPENAI_BASE_URL + OPENAI_API_KEY ainda são respeitados como fallback para o caminho de roteamento auxiliar provider: "main", portanto não os exclua sem pensar se estiver usando-os nesse caso.)4

Alternando endpoints personalizados durante uma sessão:

/model custom:qwen-2.5             # Custom endpoint with explicit model
/model custom                      # Auto-detect the model from the endpoint
/model custom:local:qwen-2.5       # Named custom provider "local"
/model custom:work:llama3          # Named custom provider "work"
/model openrouter:claude-sonnet-4  # Back to a cloud provider

/model custom (sem nome de modelo) consulta o API /v1/models do seu endpoint e seleciona automaticamente o modelo se houver exatamente um carregado — útil para servidores locais que executam um único modelo.2

Servidores LLM locais (modelos de configuração)

A documentação upstream tem guias completos de configuração para Ollama, vLLM, SGLang, llama.cpp e LM Studio. Aqui estão os principais comandos que você realmente executará. Cada um foi projetado para produzir um endpoint funcional para o qual Hermes pode apontar.2

Ollama — caminho local mais fácil, sem configuração:

ollama pull qwen2.5-coder:32b
OLLAMA_CONTEXT_LENGTH=32768 ollama serve   # Raise from 4k default
hermes model   # Custom endpoint → http://localhost:11434/v1 → qwen2.5-coder:32b

Pegadinha crítica do Ollama: por padrão, o Ollama usa comprimentos de contexto muito baixos (4.096 tokens com menos de 24 GB de VRAM). Você precisa aumentá-lo por meio de OLLAMA_CONTEXT_LENGTH ou de um Modelfile — o API compatível com OpenAI não aceita comprimento de contexto do cliente, portanto o Hermes não pode defini-lo para você.2 Para uso com agentes, defina pelo menos 16k–32k.

vLLM — serving GPU de alto desempenho:

pip install vllm
vllm serve meta-llama/Llama-3.1-70B-Instruct \
  --port 8000 \
  --max-model-len 65536 \
  --tensor-parallel-size 2 \
  --enable-auto-tool-choice \
  --tool-call-parser hermes

A chamada de ferramentas requer --enable-auto-tool-choice e --tool-call-parser <name>. Parsers compatíveis: hermes (Qwen 2.5, Hermes 2/3), llama3_json, mistral, deepseek_v3, deepseek_v31, xlam, pythonic. Sem essas flags, as chamadas de ferramentas retornam como texto simples.2

SGLang — serving rápido com RadixAttention para reutilização do cache KV:

pip install "sglang[all]"
python -m sglang.launch_server \
  --model meta-llama/Llama-3.1-70B-Instruct \
  --port 30000 \
  --context-length 65536 \
  --tp 2 \
  --tool-call-parser qwen

Pegadinha do SGLang: o max_tokens padrão é 128. Defina --default-max-tokens no servidor ou configure model.max_tokens em config.yaml se as respostas forem cortadas.2

llama.cpp / llama-server — CPU e Metal do Apple Silicon:

./build/bin/llama-server \
  --jinja -fa \
  -c 32768 \
  -ngl 99 \
  -m models/qwen2.5-coder-32b-instruct-Q4_K_M.gguf \
  --port 8080 --host 0.0.0.0

--jinja é obrigatório para chamadas de ferramentas. Sem ele, llama-server ignora completamente o parâmetro tools e o modelo tenta chamar ferramentas escrevendo JSON no texto da resposta — algo que Hermes não consegue analisar como chamadas de ferramentas reais.2

LM Studio — aplicativo desktop com GUI:

Inicie o servidor pelo aplicativo LM Studio (aba Developer → Start Server) ou via CLI: lms server start (inicia na porta 1234) e lms load qwen2.5-coder --context-length 32768.2 Depois, aponte hermes model para http://localhost:1234/v1.

Pegadinha crítica do LM Studio: LM Studio lê o comprimento de contexto dos metadados do modelo, mas muitos modelos GGUF informam padrões de 2048 ou 4096. Sempre defina explicitamente o comprimento de contexto nas configurações do modelo do LM Studio — clique no ícone de engrenagem ao lado do seletor de modelos, defina “Context Length” como pelo menos 16384 (de preferência 32768) e recarregue o modelo.2

Provedores personalizados nomeados

Se você trabalha com vários endpoints personalizados (um servidor de desenvolvimento local e um servidor GPU remoto, por exemplo), defina-os como provedores personalizados nomeados em config.yaml:2

custom_providers:
  - name: local
    base_url: http://localhost:8080/v1
    # api_key omitted — Hermes uses "no-key-required" for keyless local servers
  - name: work
    base_url: https://gpu-server.internal.corp/v1
    api_key: corp-api-key
    api_mode: chat_completions      # optional, auto-detected from URL
  - name: anthropic-proxy
    base_url: https://proxy.example.com/anthropic
    api_key: proxy-key
    api_mode: anthropic_messages    # for Anthropic-compatible proxies

Depois, alterne entre eles durante uma sessão com a sintaxe tripla:

/model custom:local:qwen-2.5
/model custom:work:llama3-70b
/model custom:anthropic-proxy:claude-sonnet-4

Você também pode selecionar provedores personalizados nomeados no menu interativo hermes model.2

Arquitetura de provedores conectáveis (v0.13.0+)

A v0.13.0 inclui uma ABC ProviderProfile mais um diretório plugins/model-providers/, para que provedores de inferência de terceiros possam ser adicionados sem modificações no núcleo.18 Se um provedor falar um modo API compatível com OpenAI, Anthropic ou Codex, você pode implementar uma subclasse ProviderProfile que declara o caminho de autenticação, a URL base, o catálogo de modelos e os cabeçalhos de cache; Hermes a resolve pelo mesmo caminho runtime_provider.py usado pelos provedores integrados. Esta é a mudança arquitetural por trás da expansão de provedores da v0.13.0: em vez de editar o código central para adicionar um provedor, você fornece um plugin.

Proxy local compatível com OpenAI (v0.14.0+)

hermes proxy expõe um endpoint local compatível com OpenAI, sustentado pelo provedor OAuth no qual o Hermes já está autenticado — Claude Pro, ChatGPT Pro, SuperGrok ou outro provedor compatível configurado.19 Isso significa que ferramentas que esperam um API no estilo OpenAI, incluindo Codex CLI, Aider, Cline, Continue ou scripts personalizados, podem reutilizar sua autenticação do Hermes vinculada à assinatura sem uma chave API separada. Trate o proxy como infraestrutura local de desenvolvimento: faça o bind intencionalmente, não o exponha amplamente e tenha em mente os termos específicos de cada provedor.

Detecção de comprimento de contexto

Duas configurações são constantemente confundidas, conforme a documentação upstream:2

  • context_length — a janela total de contexto (orçamento combinado de tokens de entrada + saída, por exemplo, 1.000.000 para Claude Opus 4.7 ou 200.000 para Sonnet 4.6). Hermes usa isso para decidir quando compactar o histórico.
  • model.max_tokens — o limite de saída (máximo de tokens que o modelo pode gerar em uma única resposta). Não tem relação com o tamanho do histórico.

Defina context_length quando a detecção automática errar o tamanho da janela:

model:
  default: "qwen3.5:9b"
  base_url: "http://localhost:8080/v1"
  context_length: 131072      # tokens

Hermes usa uma cadeia de resolução de múltiplas fontes para detectar janelas de contexto: substituição de configuração → por modelo de provedor personalizado → cache persistente → endpoint /models → Anthropic /v1/models → API do OpenRouter → Nous Portal → models.dev (registro mantido pela comunidade para mais de 3.800 modelos) → padrões de fallback (128K).2 O sistema considera o provedor, portanto o mesmo modelo pode ter limites de contexto diferentes dependendo de quem o serve (por exemplo, claude-opus-4.6 é 1M no Anthropic direto, mas 128K no GitHub Copilot).2

Roteamento inteligente de modelos: rotação de provedores e fallback

Hermes não prende você a um único modelo em um único provedor. O roteamento inteligente de modelos é o conjunto de mecanismos que decide qual provedor e modelo realmente atende a uma determinada solicitação: pools de credenciais distribuem a carga entre chaves, um fallback configurado assume quando o principal falha, e os slots auxiliares abaixo direcionam tarefas paralelas para modelos mais baratos independentemente do seu modelo principal.26 Configure esses três juntos – eles são a diferença entre um agente que para em um limite de taxa e outro que continua trabalhando.

Pools de credenciais. Quando você tem várias chaves API para o mesmo provedor, configure uma estratégia de rotação via hermes auth. É assim que você distribui limites de taxa entre várias chaves.6

Modelo de fallback. Configure um provider:model de backup para o qual Hermes muda automaticamente quando seu modelo principal falha (limites de taxa, erros do servidor, falhas de autenticação):2

fallback_model:
  provider: openrouter            # required
  model: anthropic/claude-sonnet-4  # required
  # base_url: http://localhost:8000/v1    # optional, for custom endpoints
  # api_key_env: MY_CUSTOM_KEY           # optional, env var name

O fallback troca o modelo e o provedor no meio da sessão sem perder sua conversa. Ele é acionado no máximo uma vez por sessão.2 Provedores compatíveis com fallback: openrouter, nous, openai-codex, copilot, copilot-acp, anthropic, huggingface, zai, kimi-coding, minimax, minimax-cn, deepseek, ai-gateway, opencode-zen, opencode-go, kilocode, alibaba, custom.2

Modelos auxiliares

Hermes usa modelos leves “auxiliares” para tarefas paralelas: análise de imagens, resumo de páginas web, análise de capturas de tela do navegador, classificação de aprovação de comandos perigosos, compactação de contexto, resumo de busca de sessões, correspondência de skills, despacho da ferramenta MCP e flush de memória.4 Por padrão, eles usam Gemini Flash por meio da detecção automática (OpenRouter → Nous → Codex).

Você pode configurar qual modelo e provedor cada tarefa auxiliar usa. Todo slot auxiliar usa os mesmos três controles: provider, model, base_url.4

auxiliary:
  vision:
    provider: "auto"                # "auto", "openrouter", "nous", "codex", "main", etc.
    model: ""                       # e.g. "openai/gpt-4o", "google/gemini-2.5-flash"
    base_url: ""                    # Custom OpenAI-compatible endpoint
    api_key: ""                     # Falls back to OPENAI_API_KEY
    timeout: 30
    download_timeout: 30
  web_extract:
    provider: "auto"
    model: ""
    timeout: 360
  approval:
    provider: "auto"
    model: ""
    timeout: 30
  compression:
    timeout: 120
  session_search: { provider: "auto", model: "", timeout: 30 }
  skills_hub:    { provider: "auto", model: "", timeout: 30 }
  mcp:           { provider: "auto", model: "", timeout: 30 }
  flush_memories:{ provider: "auto", model: "", timeout: 30 }

A opção de provedor "main" significa “usar o provedor que meu agente principal usa” — válida somente dentro das configurações auxiliary:, compression: e fallback_model:. Ela não é válida para sua configuração de nível superior model.provider. Se você usar um endpoint personalizado compatível com OpenAI como modelo principal, defina provider: custom na sua seção model:.4

Por que isso importa: se você configurou apenas Anthropic OAuth (sem chave do OpenRouter), sua visão, resumo web e compactação vão degradar ou falhar porque a cadeia de fallback auxiliar padrão tenta o OpenRouter primeiro. Adicione um OPENROUTER_API_KEY para tarefas auxiliares ou reconfigure cada slot auxiliar para usar seu provedor principal:

auxiliary:
  vision:
    provider: "main"
  web_extract:
    provider: "main"

Esta é a pegadinha mais comum de “meus recursos não funcionam silenciosamente” para novos usuários do Hermes.

Sistema de configuração

Hermes tem um sistema de configuração em camadas. Entender a precedência é essencial, porque as camadas superiores substituem as inferiores, e uma delas é um registro global de providers que você não consegue ver em config.yaml.

Layout dos arquivos de configuração

Segundo a documentação upstream, estes são os arquivos que compõem uma configuração do Hermes:4

~/.hermes/
├── config.yaml       # All settings (model, terminal, TTS, compression, memory, toolsets, ...)
├── .env              # Secrets (API keys, bot tokens, passwords)
├── auth.json         # OAuth provider credentials (Nous Portal, Codex, Anthropic)
├── SOUL.md           # Primary agent identity (slot #1 in system prompt)
├── memories/         # Persistent memory (MEMORY.md, USER.md)
├── skills/           # Bundled + agent-created + hub-installed skills
├── cron/             # Scheduled jobs
├── sessions/         # Gateway session state
└── logs/             # agent.log, gateway.log, errors.log (secrets auto-redacted)

config.yaml vs .env — quando ambos estão definidos, config.yaml prevalece para configurações que não são secrets.4 A regra é: - Secrets (chaves API, tokens de bot, senhas) → .env - Todo o restante (model, backend do terminal, configurações de compressão, limites de memória, toolsets) → config.yaml

Você pode referenciar secrets de config.yaml usando interpolação no estilo shell:4

auxiliary:
  vision:
    api_key: ${GOOGLE_API_KEY}
    base_url: ${CUSTOM_VISION_URL}
  delegation:
    api_key: ${DELEGATION_KEY}

Gerenciando a configuração

hermes config                # View current configuration
hermes config show           # Same as above
hermes config edit           # Open config.yaml in your editor
hermes config set KEY VAL    # Set a specific value
hermes config get KEY        # Print a single value (v0.19.0+)
hermes config unset KEY      # Remove a key so the default applies again (v0.19.0+)
hermes config path           # Print the config file path
hermes config env-path       # Print the .env file path
hermes config check          # Check for missing options (after updates)
hermes config migrate        # Interactively add missing options

Exemplos:4

hermes config set model anthropic/claude-opus-4
hermes config set terminal.backend docker
hermes config set OPENROUTER_API_KEY sk-or-...   # Saves to .env

hermes config check e hermes config migrate são os comandos que você deve executar após cada hermes update — eles detectam opções de configuração recém-adicionadas que o seu arquivo ainda não tem.6

Precedência de configuração

Hermes carrega a configuração de várias fontes. Quando várias fontes definem o mesmo valor, a fonte de maior prioridade prevalece:4

  1. Argumentos CLIhermes chat --model anthropic/claude-sonnet-4 (substituição por execução)
  2. Variáveis de ambiente — aplicadas na inicialização do processo
  3. config.yaml — o arquivo principal de configurações
  4. .env — apenas secrets
  5. Padrões integrados — aplicados quando nenhuma outra fonte define um valor

As flags CLI sempre prevalecem naquela execução específica. config.yaml é a fonte de verdade de longo prazo.

Localização (v0.13.0+)

A v0.13.0 adicionou 7 locales para mensagens de CLI e do gateway: chinês (simplificado), japonês, alemão, espanhol, francês, ucraniano e turco.18 A v0.14.0 localiza todos os comandos do gateway e o dashboard web, adiciona mais 8 locales e eleva o total para 16.19 Atualmente, a documentação está localizada apenas em zh-Hans. O locale é resolvido pelas variáveis de ambiente LC_ALL / LANG ou por uma chave explícita locale: em config.yaml. O inglês continua sendo o padrão e a fonte de verdade para qualquer string que uma tradução ainda não tenha coberto.

Profiles — várias instâncias isoladas do Hermes

Profiles permitem que você tenha várias instâncias isoladas do Hermes, cada uma com sua própria configuração, sessões, skills, memória e PID do gateway. É assim que você executa o “Hermes de trabalho” e o “Hermes pessoal” lado a lado, sem que um veja o estado do outro.6

hermes profile list
hermes profile create work --clone                  # Clone from current profile
hermes profile use work                             # Set sticky default
hermes profile alias work --name h-work             # Create wrapper script
hermes profile export work -o work-backup.tar.gz
hermes profile import work-backup.tar.gz --name restored
hermes -p work chat -q "Hello from work profile"    # One-off without switching

Cada profile recebe seu próprio HERMES_HOME (~/.hermes-<name>/ por padrão), portanto vários profiles podem executar o gateway simultaneamente sem interferir uns nos outros.63


Comandos CLI

Esta seção é a referência prática para os comandos de nível superior do CLI. Para a referência oficial derivada do código, consulte a Referência de comandos CLI.6

Opções globais

hermes [global-options] <command> [subcommand/options]
Opção Descrição
--version, -V Mostra a versão e encerra
--profile <name>, -p <name> Seleciona qual profile Hermes usar
--resume <session>, -r <session> Retoma uma sessão por ID ou título
--continue [name], -c [name] Retoma a sessão mais recente (ou encontra um título correspondente)
--worktree, -w Inicia em um git worktree isolado
--yolo Ignora solicitações de aprovação de comandos perigosos
--safe-mode Flag de troubleshooting — inicia o Hermes em um modo seguro mínimo para isolar problemas de inicialização (v0.19.0+)25
--pass-session-id Inclui o ID da sessão no system prompt do agente

Comandos de nível superior

Comando Finalidade
hermes chat Chat interativo ou de uso único
hermes model Escolhe interativamente o provider e o modelo padrão
hermes gateway Executa ou gerencia o gateway de mensagens
hermes setup Assistente de configuração interativo
hermes auth Gerencia credenciais — adiciona, lista, remove, redefine e define a estratégia
hermes status Mostra o status do agente, da autenticação e das plataformas
hermes cron Inspeciona e executa ciclos do agendador cron
hermes webhook Gerencia assinaturas dinâmicas de webhook
hermes doctor Diagnostica problemas de configuração e dependências
hermes dump Resumo de configuração copiável para suporte/debugging
hermes logs Exibe, acompanha e filtra logs do agente/gateway/erros
hermes config Mostra, edita, migra e consulta a configuração
hermes pairing Aprova ou revoga códigos de pareamento de mensagens
hermes skills Navega, instala, publica e audita skills
hermes honcho Gerencia a memória entre sessões do Honcho
hermes memory Configura o provider de memória externa
hermes acp Executa o Hermes como um servidor ACP (integração com editor)
hermes mcp Gerencia a configuração do servidor MCP; executa o Hermes como servidor MCP
hermes plugins Gerencia plugins
hermes tools Configura as tools habilitadas por plataforma
hermes sessions Navega, exporta, limpa e exclui sessões. A v0.19.0 expande hermes sessions export para formatos Markdown, Quarto, HTML, somente prompt e rastros do Hugging Face, com uma etapa opcional de limpeza de segredos com --redact e filtros por idade/workspace/plataforma25
hermes insights Mostra análises de tokens/custo/atividade
hermes claw Auxiliares de migração do OpenClaw
hermes profile Gerencia profiles (várias instâncias isoladas)
hermes completion Exibe scripts de autocompletar do shell (bash/zsh)
hermes whatsapp Configura e pareia a bridge do WhatsApp
hermes version Exibe informações da versão
hermes update Baixa o código mais recente e reinstala as dependências
hermes uninstall Remove o Hermes do sistema (--full também exclui configuração/dados)
hermes backup Backup completo da configuração, sessões, skills e memória (v0.9.0+)16
hermes import Restaura a partir de um arquivo de backup — migra entre máquinas ou reverte alterações (v0.9.0+)16
hermes dashboard Inicia o dashboard web local para gerenciar o agente pelo navegador (v0.9.0+)16
hermes serve Executa o servidor API de backend sem interface — a partir da v0.19.0, ele não constrói nem monta mais a UI web25
hermes debug share Faz upload de um relatório completo de debug para um pastebin, para compartilhamento durante o troubleshooting (v0.9.0+)16

hermes chat — O principal ponto de entrada

hermes sem argumentos abre o chat interativo. hermes chat é a forma explícita com opções:6

hermes chat -q "Summarize the latest PRs"           # One-shot, non-interactive
hermes chat --provider openrouter --model anthropic/claude-sonnet-4.6
hermes chat --toolsets web,terminal,skills          # Enable specific toolsets
hermes chat --quiet -q "Return only JSON"           # Programmatic mode
hermes chat --worktree -q "Review repo and open a PR"

Opções principais:

Opção Descrição
-q, --query "..." Prompt de uso único, não interativo
-m, --model <model> Substitui o modelo nesta execução
-t, --toolsets <csv> Habilita um conjunto de toolsets separado por vírgulas
--provider <provider> Força um provider (consulte a lista completa)
-s, --skills <name> Pré-carrega uma ou mais skills para esta sessão
-v, --verbose Saída detalhada
-Q, --quiet Modo programático (sem banner, spinner ou prévias)
--resume <session> Retoma uma sessão diretamente a partir de chat
--worktree Cria um git worktree isolado
--checkpoints Habilita checkpoints do sistema de arquivos antes de alterações destrutivas
--yolo Ignora solicitações de aprovação
--source <tag> Tag de origem da sessão (padrão: cli; use tool para integrações)
--max-turns <N> Máximo de iterações de chamadas de tool por turno (padrão: 90)

hermes setup — Assistente completo

Executa o assistente completo de configuração ou vai diretamente para uma seção:6

hermes setup                 # Full wizard
hermes setup model           # Provider and model only
hermes setup terminal        # Terminal backend only
hermes setup gateway         # Messaging platforms only
hermes setup tools           # Tool enable/disable per platform
hermes setup agent           # Agent behavior only
hermes setup --non-interactive
hermes setup --reset         # Reset config to defaults before setup

hermes logs — Consulta estruturada de logs

hermes logs é mais poderoso do que usar tail -f nos arquivos de log, pois permite filtrar simultaneamente por nível, ID da sessão e intervalo de tempo.6

hermes logs                          # Last 50 lines of agent.log
hermes logs -f                       # Follow in real time
hermes logs gateway -n 100           # Last 100 lines of gateway.log
hermes logs --level WARNING --since 1h   # Warnings from the last hour
hermes logs --session abc123         # Filter by session ID substring
hermes logs errors --since 30m -f    # Follow errors.log from 30m ago
hermes logs list                     # List all log files with sizes

Os arquivos de log ficam em ~/.hermes/logs/:6 - agent.log — toda a atividade do agente (chamadas API, despacho de tools, ciclo de vida da sessão, INFO+) - errors.log — apenas avisos e erros (um subconjunto filtrado de agent.log) - gateway.log — atividade do gateway de mensagens (conexões de plataforma, despacho, webhooks)

A rotação é automática pelo RotatingFileHandler do Python — procure por agent.log.1, agent.log.2 etc.6

hermes doctor — Diagnóstico

hermes doctor [--fix] é o primeiro comando a executar quando algo está errado. Ele verifica a validade da configuração, a presença de dependências, a disponibilidade da chave API, o status do serviço e pode tentar reparos automáticos com --fix.6

Para compartilhar diagnósticos com outra pessoa, use hermes dump — ele gera um resumo compacto em texto simples com chaves API ocultadas, pronto para colar em uma issue do GitHub ou em uma thread do Discord.6


Comandos Slash

Os comandos slash são executados dentro de uma sessão de chat ativa (CLI ou plataforma de mensagens). Eles são encaminhados a partir de um COMMAND_REGISTRY compartilhado em hermes_cli/commands.py, por isso a maioria dos comandos funciona de forma idêntica em todas as interfaces.9

Controle da sessão

Comando Descrição
/new (alias /reset) Inicie uma nova sessão
/clear Limpe a tela + inicie uma nova sessão
/history Mostre o histórico da conversa
/save Salve a conversa atual
/retry Tente novamente a última mensagem
/undo Remova a última troca entre usuário/assistente
/title <name> Defina um título para a sessão atual
/compress Comprima manualmente o contexto da conversa
/rollback [number] Liste ou restaure checkpoints do sistema de arquivos
/stop Encerre todos os processos em segundo plano em execução
/queue <prompt> Coloque um prompt na fila para o próximo turno. Atenção: /q é reivindicado tanto por /queue quanto por /quit; o último registro vence e, na prática, /q é resolvido como /quit — sempre digite /queue explicitamente.9
/resume [name] Retome uma sessão nomeada anteriormente
/statusbar (alias /sb) Alterne a barra de status de contexto/modelo
/background <prompt> (alias /bg) Execute um prompt em uma sessão separada em segundo plano
/btw <question> Pergunta lateral efêmera (sem tools, não persistida)
/plan [request] Carregue a skill plan incluída para escrever um plano em vez de executar
/branch [name] (alias /fork) Crie uma ramificação da sessão atual
/goal <target> Mantenha o agente focado em um alvo para que ele continue na tarefa entre turnos. Padrão de loop Ralph como primitivo de primeira classe. Orçamento de turnos configurável. Novo na v0.13.0.18
/subgoal <criterion> Adicione critérios de sucesso a um /goal ativo sem reiniciar o loop. Novo na v0.14.0.19
/handoff <target> Transfira a sessão ativa — mensagens, chamadas de tools e contexto — para outro modelo, persona ou profile. Novo na v0.14.0.19

Configuração e modelo

Comando Descrição
/config Mostre a configuração atual
/model [model-name] Mostre ou altere o modelo atual
/provider Mostre os providers disponíveis e o provider atual
/personality [name] Defina uma sobreposição de personalidade
/verbose Alterne a exibição de progresso das tools
/reasoning Gerencie o esforço e a exibição de reasoning. A v0.19.0 adiciona os níveis de esforço max e ultra e torna /reasoning específico da sessão, junto com substituições de esforço por modelo e por slot de MoA na configuração25
/skin Mostre ou altere a skin/tema de exibição
/voice [on\|off\|tts\|status] Alterne o modo de voz do CLI
/yolo Alterne o modo YOLO (ignore prompts de aprovação). Desde a v0.19.0, regras de negação definidas pelo usuário ainda bloqueiam comandos correspondentes mesmo no modo YOLO25
/fast Alterne o Fast Mode — processamento prioritário para modelos OpenAI e Anthropic (v0.9.0+)16
/debug Diagnósticos rápidos em todas as plataformas (v0.9.0+)16
/subscription Gerencie seu plano Nous Portal pelo terminal — plano e franquia restante, prévia de custo de upgrade/downgrade, aplicação com desfazer (v0.19.0+)25
/topup Adicione crédito ao seu saldo Nous Portal sem sair do terminal (v0.19.0+)25

O comando /model é o principal recurso para alternar de provider no meio da sessão:9

/model                              # Show current model and options
/model claude-sonnet-4              # Switch model (auto-detect provider)
/model zai:glm-5                    # Switch provider:model
/model custom:qwen-2.5              # Use model on custom endpoint
/model custom                       # Auto-detect model from custom endpoint
/model custom:local:qwen-2.5        # Named custom provider
/model openrouter:anthropic/claude-sonnet-4   # Back to cloud

A v0.19.0 adiciona /model --once — uma substituição de modelo para um turno que volta automaticamente ao modelo anterior após a resposta.25

Tools, skills e informações

Comando Descrição
/tools [list\|disable\|enable] [name...] Gerencie as tools da sessão atual
/toolsets Liste os toolsets disponíveis
/browser [connect\|disconnect\|status] Gerencie a conexão local do Chrome CDP
/skills Pesquise, instale, inspecione ou gerencie skills
/cron Gerencie tarefas agendadas
/reload-mcp Recarregue os servidores MCP a partir de config.yaml
/plugins Liste os plugins instalados
/help Mostre todos os comandos
/usage Mostre uso de tokens, custo e duração
/insights Mostre análises de uso (últimos 30 dias)
/platforms Mostre o status das plataformas de mensagens
/profile Mostre o nome e o diretório home do profile ativo

Comandos slash dinâmicos de skills

Cada skill instalada é automaticamente exposta como um comando slash:9

/gif-search funny cats
/axolotl help me fine-tune Llama 3 on my dataset
/github-pr-workflow create a PR for the auth refactor
/excalidraw       # Just the skill name loads it and lets the agent ask what you need

Desde a v0.19.0, as invocações de skills via slash se acumulam: /skill-a /skill-b do XYZ carrega ambas as skills em ordem em um único turno, com autocomplete e ghost text para os nomes encadeados.25

Você também pode definir comandos rápidos em config.yaml que associam um nome curto a um prompt mais longo:9

quick_commands:
  review: "Review my latest git diff and suggest improvements"
  deploy: "Run the deployment script at scripts/deploy.sh and verify the output"
  morning: "Check my calendar, unread emails, and summarize today's priorities"

Depois, digite /review, /deploy ou /morning no CLI.

Correspondência por prefixo

Os comandos aceitam correspondência por prefixo: digitar /h é resolvido como /help, e /mod como /model. Quando um prefixo é ambíguo, o primeiro registro na ordem do registry vence. Nomes completos de comandos e aliases registrados sempre têm prioridade sobre correspondências por prefixo.9

Comandos específicos de mensagens

Alguns comandos funcionam apenas em plataformas de mensagens (Telegram, Discord, Slack, WhatsApp, Signal, Email, Home Assistant):9

  • /status — mostre informações da sessão
  • /sethome (alias /set-home) — marque o chat atual como home da plataforma
  • /approve [session|always] — aprove um comando perigoso pendente
  • /deny [reason] — rejeite um comando perigoso pendente. Desde a v0.19.0, /deny <reason> encaminha seu motivo de recusa ao agente para que ele corrija o rumo em vez de tentar novamente às cegas25
  • /update — atualize Hermes Agent para a versão mais recente
  • /commands [page] — navegue por todos os comandos e skills (paginado)

E alguns são exclusivos do CLI: /skin, /tools, /toolsets, /browser, /config, /cron, /skills, /platforms, /paste, /statusbar, /plugins.9


Ferramentas e toolsets

Hermes vem com um amplo registro de ferramentas integrado que abrange busca na web, automação de navegador, execução no terminal, edição de arquivos, memória, delegação, treinamento de RL, entrega de mensagens, integração com Home Assistant e muito mais.10 As ferramentas são organizadas em toolsets lógicos que podem ser ativados ou desativados por plataforma.

Categorias de alto nível

Categoria Exemplos Descrição
Web web_search, web_extract Pesquise na web e extraia o conteúdo de páginas
Terminal e arquivos terminal, process, read_file, patch Execute comandos e manipule arquivos
Navegador browser_navigate, browser_snapshot, browser_vision Automação interativa de navegador com texto e visão
Mídia vision_analyze, video_analyze, video_generate, image_generate, text_to_speech Análise e geração multimodais. video_analyze prioriza Gemini, com suporte extensível para provedores multimodais compatíveis (v0.13.0+). A v0.14.0 adiciona video_generate unificado com backends de provedores conectáveis e envia pixels brutos por vision_analyze quando o modelo ativo oferece suporte a visão.1819
Orquestração de agentes todo, clarify, execute_code, delegate_task Planejamento, esclarecimento, execução de código e delegação para subagentes
Uso do computador computer_use Controle do desktop pelo backend cua-driver; a v0.14.0 faz isso funcionar com provedores compatíveis com visão que não sejam Anthropic.19
Memória e recuperação memory, session_search Memória persistente + busca na sessão
Automação e entrega cronjob, send_message Tarefas agendadas e envio de mensagens
Integrações ha_*, ferramentas MCP, rl_* Home Assistant, MCP, treinamento de RL

Nomes comuns de toolsets incluem web, terminal, file, browser, vision, image_gen, moa, skills, tts, todo, memory, session_search, cronjob, code_execution, delegation, clarify, homeassistant e rl.10

Gerenciamento de ferramentas

hermes chat --toolsets "web,terminal"       # Use specific toolsets
hermes tools                                # Interactive per-platform tool config
hermes tools --summary                      # Print enabled-tools summary

As ferramentas também podem ser alternadas no meio da sessão com /tools disable <name> e /tools enable <name>, o que redefine a sessão para que o novo conjunto de ferramentas entre em vigor.9

Backends de terminal

A ferramenta de terminal pode executar comandos em seis ambientes diferentes:10

Backend Caso de uso
local Execute na sua máquina (padrão) — desenvolvimento e tarefas confiáveis
docker Containers isolados — segurança e reprodutibilidade
ssh Servidor remoto — sandbox, mantendo o agente longe do próprio código
singularity Containers de HPC — computação em cluster, sem root
modal Execução serverless na nuvem
daytona Espaço de trabalho sandbox na nuvem — ambiente remoto de desenvolvimento persistente

Alterne os backends com hermes config set terminal.backend <name> ou no config.yaml:

terminal:
  backend: docker      # or: local, ssh, singularity, modal, daytona
  cwd: "."             # Working directory
  timeout: 180         # Command timeout in seconds

Backend SSH (recomendado para segurança — o agente não consegue modificar o próprio código):10

terminal:
  backend: ssh
# In ~/.hermes/.env
TERMINAL_SSH_HOST=my-server.example.com
TERMINAL_SSH_USER=myuser
TERMINAL_SSH_KEY=~/.ssh/id_rsa

Backend Docker:

terminal:
  backend: docker
  docker_image: python:3.11-slim

Recursos de container (aplica-se a docker, singularity, modal e daytona):10

terminal:
  container_cpu: 1
  container_memory: 5120          # MB (default 5GB)
  container_disk: 51200           # MB (default 50GB)
  container_persistent: true      # Persist filesystem across sessions

Com container_persistent: true, os pacotes instalados, arquivos e configurações permanecem entre as sessões.10

Todos os backends de container são executados com reforço de segurança: sistema de arquivos raiz somente leitura (Docker), todos os recursos do Linux removidos, exceto DAC_OVERRIDE, CHOWN e FOWNER, sem escalonamento de privilégios, limites de PID (256 processos), isolamento completo de namespaces e espaço de trabalho persistente por volumes.10

Processos em segundo plano

A ferramenta de terminal oferece suporte à execução em segundo plano com gerenciamento explícito de processos:10

terminal(command="pytest -v tests/", background=true)
# Returns: {"session_id": "proc_abc123", "pid": 12345}

process(action="list")                            # Show all running processes
process(action="poll", session_id="proc_abc123")  # Check status
process(action="wait", session_id="proc_abc123")  # Block until done
process(action="log", session_id="proc_abc123")   # Full output
process(action="kill", session_id="proc_abc123")  # Terminate
process(action="write", session_id="proc_abc123", data="y")  # Send input

O modo PTY (pty=true) permite ferramentas interativas de CLI, como Codex e Claude Code.10

Sudo

Se um comando precisar de sudo, Hermes solicita sua senha (armazenada em cache durante a sessão). Ou defina SUDO_PASSWORD em ~/.hermes/.env.10


Kanban multiagente (v0.13.0+)

A v0.13.0 transforma a colaboração multiagente em um recurso fundamental: um quadro Kanban durável que acompanha tarefas, status e a identidade do worker entre agentes e após reinicializações.18 O quadro é o que faz um enxame de workers do Hermes realmente concluir o trabalho, em vez de travar em transferências sem continuidade.

Mecanismo O que faz
Heartbeats Cada worker envia pulsos enquanto é responsável por uma tarefa. Um heartbeat perdido marca o worker como suspeito e libera a tarefa para ser recuperada.
Recuperação Um worker diferente pode assumir uma tarefa abandonada, com todo o estado da tarefa e a saída parcial anterior.
Detecção de zombies Workers que encerram sem marcar uma tarefa como concluída são automaticamente impedidos de reivindicar novo trabalho, evitando que o enxame acumule identidades inativas.
Gate contra alucinações Uma saída que não passa pelo gate devolve a tarefa ao quadro com um motivo registrado, em vez de marcá-la como concluída.
max_retries por tarefa Substitua o orçamento padrão de tentativas em uma tarefa que você sabe ser frágil.
Quadros multiprojeto Uma instalação do Hermes pode hospedar vários quadros independentes.

O quadro Kanban combina naturalmente com /goal (loop Ralph de alvo bloqueado) para a parte do objetivo e com a ferramenta delegate_task existente para a semântica de spawn. O resultado é um padrão de enxame em que todos os agentes compartilham uma única fonte de verdade sobre o que fazer em seguida, quem está fazendo isso e o que está bloqueado.

O que é um enxame Hermes?

Um enxame é formado por vários workers do Hermes executados em paralelo em um único quadro Kanban compartilhado. Não é um subsistema separado que você ativa – é o que o quadro possibilita. O quadro fornece a única coisa que agentes paralelos não conseguem fornecer por conta própria: uma resposta única e autoritativa para o que devo assumir em seguida e alguém já está trabalhando nisso?

A v0.15.0 elevou isso de um padrão a uma topologia compatível, adicionando topologia de enxame para coordenação de workers em paralelo, decomposição automática de um objetivo de alto nível em subtarefas, substituições de modelo por tarefa, tarefas agendadas e gerenciamento de worktrees para que workers paralelos não entrem em conflito no mesmo checkout.28

Questão em uma configuração multiagente ingênua O que o quadro faz em vez disso
Dois workers assumem a mesma tarefa A responsabilidade pela tarefa é reivindicada, com a identidade do worker registrada
Um worker morre no meio da tarefa e o trabalho desaparece O heartbeat expira, e a tarefa é recuperada com a saída parcial anterior
Um worker que travou continua “segurando” tarefas para sempre A detecção de zombies impede que ele reivindique novo trabalho
Um modelo caro para cada subtarefa Substituições de modelo por tarefa – modelos baratos para subtarefas mecânicas
Workers paralelos editando os mesmos arquivos O gerenciamento de worktrees isola o checkout de cada worker

Na prática: dê um objetivo ao enxame, deixe a decomposição automática dividi-lo em tarefas no quadro e permita que os workers reivindiquem, executem e retornem resultados. O orçamento de tentativas é por tarefa (max_retries), portanto, uma subtarefa frágil não consome a tolerância de toda a execução. Como o quadro é durável, um enxame sobrevive a reinicializações – os workers se reconectam e retomam a partir do mesmo estado.

Um enxame é tão bom quanto sua decomposição. O quadro coordena os workers; ele não transforma um objetivo mal dividido em um bom objetivo. Tarefas que compartilham estado oculto ainda entrarão em conflito, com worktrees ou não.

Sistema de skills

Skills são documentos de conhecimento sob demanda que o agente pode carregar quando necessário. Elas seguem um padrão de divulgação progressiva para minimizar o uso de tokens e são compatíveis com o padrão aberto agentskills.io.11

Todas as skills ficam em ~/.hermes/skills/ — o diretório principal e fonte da verdade. Em uma instalação nova, as skills incluídas são copiadas do repositório. Skills instaladas pelo Hub e criadas pelo agente também ficam aqui.11

Divulgação progressiva

Level 0: skills_list()            [{name, description, category}, ...]   (~3k tokens)
Level 1: skill_view(name)         Full content + metadata                 (varies)
Level 2: skill_view(name, path)   Specific reference file                 (varies)

O agente só carrega o conteúdo completo da skill quando realmente precisa dele.11

Formato do SKILL.md

---
name: my-skill
description: Brief description of what this skill does
version: 1.0.0
platforms: [macos, linux]      # Optional — restrict to OS platforms
metadata:
  hermes:
    tags: [python, automation]
    category: devops
    fallback_for_toolsets: [web]     # Conditional activation
    requires_toolsets: [terminal]    # Conditional activation
    config:                          # Config.yaml settings
      - key: my.setting
        description: "What this controls"
        default: "value"
        prompt: "Prompt for setup"
---

# Skill Title

## When to Use
Trigger conditions for this skill.

## Procedure
1. Step one
2. Step two

## Pitfalls
- Known failure modes and fixes

## Verification
How to confirm it worked.

Ativação condicional

As skills podem se mostrar ou se ocultar com base nas ferramentas disponíveis. Isso é mais útil para skills de fallback — alternativas gratuitas ou locais que só devem aparecer quando uma ferramenta premium não estiver disponível:11

Campo Comportamento
fallback_for_toolsets A skill fica oculta quando os toolsets listados estão disponíveis
fallback_for_tools Igual, mas verifica ferramentas individuais
requires_toolsets A skill fica oculta quando os toolsets listados não estão disponíveis
requires_tools Igual, mas verifica ferramentas individuais

Exemplo: a skill integrada duckduckgo-search usa fallback_for_toolsets: [web]. Quando você tem FIRECRAWL_API_KEY definido, o toolset web está disponível e o agente usa web_search — a skill do DuckDuckGo permanece oculta. Sem a chave API, a skill do DuckDuckGo aparece automaticamente como fallback.11

Skills gerenciadas pelo agente

O agente pode criar, atualizar e excluir suas próprias skills por meio da ferramenta skill_manage. Esta é a memória procedural do agente — quando ele descobre um fluxo de trabalho não trivial, salva a abordagem como uma skill para reutilização futura.11

Quando o agente cria skills:11 - Após concluir uma tarefa complexa (mais de 5 chamadas de ferramentas) com sucesso - Quando encontrou erros ou becos sem saída e descobriu o caminho que funciona - Quando o usuário corrigiu sua abordagem - Quando descobriu um fluxo de trabalho não trivial

Ações:11

Ação Uso
create Nova skill criada do zero
patch Correções pontuais (preferencial — mais eficiente em tokens)
edit Reestruturações importantes
delete Remove uma skill por completo
write_file Adiciona/atualiza arquivos de suporte
remove_file Remove um arquivo de suporte

Skill Hub

Navegue, pesquise, instale e gerencie skills de registros online:611

hermes skills browse                          # Browse all hub skills
hermes skills browse --source official        # Browse official optional skills
hermes skills search kubernetes               # Search all sources
hermes skills search react --source skills-sh # Search skills.sh directory
hermes skills inspect openai/skills/k8s       # Preview before installing
hermes skills install openai/skills/k8s       # Install with security scan
hermes skills install skills-sh/anthropics/skills/pdf --force
hermes skills check                           # Check for upstream updates
hermes skills update                          # Reinstall changed hub skills
hermes skills audit                           # Re-scan installed hub skills
hermes skills uninstall k8s
hermes skills publish skills/my-skill --to github --repo owner/repo
hermes skills tap add myorg/skills-repo       # Add custom GitHub source

Fontes integradas do hub:11

Fonte Exemplo Observações
official official/security/1password Skills opcionais distribuídas com Hermes (confiança builtin)
skills-sh skills-sh/vercel-labs/agent-skills/vercel-react-best-practices Diretório público de skills da Vercel
well-known well-known:https://mintlify.com/docs/.well-known/skills/mintlify Descoberta baseada em URL de sites que publicam /.well-known/skills/index.json
github openai/skills/k8s Instalações diretas de repositório/caminho do GitHub
clawhub Marketplace de skills de terceiros
lobehub Conversão do catálogo de agentes LobeHub
browse-sh Fonte de skills do Browserbase

Fontes padrão do GitHub (navegáveis sem configuração): openai/skills, anthropics/skills, huggingface/skills, NVIDIA/skills, garrytan/gstack. A fonte claude-marketplace foi removida na v0.20.0; browse-sh a substituiu na lista de fontes.1124

Varredura de segurança

Todas as skills instaladas pelo hub passam por um scanner de segurança que verifica exfiltração de dados, prompt injection, comandos destrutivos, sinais da cadeia de suprimentos e outras ameaças.11

Níveis de confiança:11

Nível Fonte Política
builtin Distribuída com Hermes Sempre confiável
official optional-skills/ no repositório Confiança builtin, sem aviso de terceiros
trusted Registros confiáveis (openai/skills, anthropics/skills) Política mais permissiva
community Todo o restante Descobertas não perigosas podem ser ignoradas com --force; vereditos dangerous permanecem bloqueados

--force pode ignorar bloqueios de política não perigosos para skills da comunidade. Ele não ignora um veredito de varredura dangerous.11

Diretórios de skills externos

Você pode apontar Hermes para diretórios adicionais de skills, analisados junto com o diretório local:11

skills:
  external_dirs:
    - ~/.agents/skills
    - /home/shared/team-skills
    - ${SKILLS_REPO}/skills

Os caminhos oferecem suporte à expansão de ~ e à substituição de variáveis de ambiente ${VAR}. Diretórios externos são somente leitura — quando o agente cria ou edita uma skill, ele sempre grava em ~/.hermes/skills/. A precedência local vence se existir uma skill com o mesmo nome nos dois locais.11


Memória persistente

Hermes tem uma memória limitada e selecionada que persiste entre sessões. Dois arquivos compõem a memória do agente, ambos armazenados em ~/.hermes/memories/:12

Arquivo Finalidade Limite de caracteres
MEMORY.md Anotações pessoais do agente — fatos sobre o ambiente, convenções e aprendizados 2.200 caracteres (~800 tokens)
USER.md Perfil do usuário — preferências, estilo de comunicação e expectativas 1.375 caracteres (~500 tokens)

Ambos são inseridos no system prompt como um snapshot congelado no início da sessão. O agente gerencia sua própria memória com a ferramenta memoryadd, replace ou remove.12

Padrão de snapshot congelado: a inserção no system prompt é capturada uma vez no início da sessão e nunca muda durante a sessão. Isso é intencional — preserva o cache de prefixo do LLM para manter o desempenho. As alterações feitas durante uma sessão são persistidas no disco imediatamente, mas não aparecem no system prompt até a próxima sessão.12

O que salvar

Salve estes itens (o agente faz isso proativamente):12 - Preferências do usuário: “Prefiro TypeScript a JavaScript” → user - Fatos do ambiente: “Este servidor executa Debian 12 com PostgreSQL 16” → memory - Correções: “Não use sudo para comandos Docker, o usuário está no grupo docker” → memory - Convenções: “O projeto usa tabs, largura de linha de 120 caracteres e docstrings no estilo Google” → memory - Trabalho concluído: “Banco de dados migrado de MySQL para PostgreSQL em 2026-01-15” → memory

Ignore estes itens:12 - Informações triviais ou óbvias - Fatos que podem ser descobertos novamente com facilidade - Dumps de dados brutos (grandes demais para a memória) - Informações efêmeras específicas da sessão - Informações que já estão em arquivos de contexto

Busca de sessões

Além de MEMORY.md e USER.md, o agente pode buscar conversas anteriores usando a ferramenta session_search. Todas as sessões CLI e de mensagens são armazenadas no SQLite (~/.hermes/state.db) com busca de texto completo FTS5. As consultas retornam conversas anteriores relevantes com sumarização do Gemini Flash.12

Recurso Memória persistente Busca de sessões
Capacidade ~1.300 tokens no total Ilimitada (todas as sessões)
Velocidade Instantânea (no system prompt) Exige busca + sumarização do LLM
Caso de uso Fatos essenciais sempre disponíveis Encontrar conversas anteriores específicas
Gerenciamento Selecionada manualmente pelo agente Automático — todas as sessões são armazenadas
Custo de tokens Fixo por sessão (~1.300 tokens) Sob demanda

Provedores de memória externos

Para uma memória persistente mais profunda além de MEMORY.md e USER.md, Hermes inclui oito plugins de provedores de memória externos: Honcho, OpenViking, Mem0, Hindsight, Holographic, RetainDB, ByteRover e Supermemory.12

Os provedores externos funcionam junto da memória integrada (sem nunca substituí-la) e acrescentam recursos como grafos de conhecimento, busca semântica, extração automática de fatos e modelagem de usuários entre sessões:612

hermes memory setup         # Pick a provider and configure it
hermes memory status        # Check what's active
hermes memory off           # Disable external provider (built-in only)

Apenas um provedor externo pode estar ativo por vez. A memória integrada está sempre ativa.6

Retomada automática de sessão (v0.13.0+)

A v0.13.0 torna interrupções no meio da execução do agente recuperáveis. O gateway retoma automaticamente sessões interrompidas após uma reinicialização; reinicializações via /update preservam o estado da sessão durante a atualização; recarregamentos de arquivos-fonte durante o desenvolvimento mantêm a sessão ativa em vez de forçar uma nova.18 Na prática, trabalhos de gateway de longa duração e tarefas acionadas por cron não redefinem mais sua janela de contexto quando o processo é reiniciado.

Checkpoints v2 (v0.13.0+)

A persistência de estado foi reescrita na v0.13.0 como um design de armazenamento único com limpeza real, proteções de disco e nenhum repositório sombra órfão.18 O sistema anterior de checkpoints acumulava estado no disco em profiles de longa duração; o armazenamento v2 estabelece um limite rígido para o armazenamento local de checkpoints e remove o controle duplicado que causava esse crescimento. Nenhuma alteração de configuração voltada ao usuário é necessária; a próxima gravação de checkpoint usa o caminho v2.


Personalidade e SOUL.md

SOUL.md é a identidade principal de uma instância do Hermes. Ele ocupa o slot nº 1 no system prompt, substituindo a identidade padrão codificada.13

Hermes cria automaticamente um SOUL.md padrão em ~/.hermes/SOUL.md (ou $HERMES_HOME/SOUL.md para profiles personalizados). Arquivos existentes do usuário nunca são sobrescritos. Hermes só carrega SOUL.md de HERMES_HOME — ele não procura no diretório de trabalho atual. Isso torna a personalidade previsível entre projetos.13

O que pertence ao SOUL.md

Use-o para orientações duráveis de voz e personalidade:13 - tom - estilo de comunicação - nível de objetividade - estilo de interação padrão - o que evitar em termos de estilo - como Hermes deve lidar com incerteza, discordância e ambiguidade

Use-o menos para:13 - instruções pontuais de projeto - caminhos de arquivos - convenções do repositório - detalhes temporários do fluxo de trabalho

Esses itens pertencem ao AGENTS.md, não ao SOUL.md.

SOUL.md vs AGENTS.md

Esta é a distinção mais importante no gerenciamento de identidade do Hermes:13

SOUL.md — identidade, tom, estilo, padrões de comunicação e comportamento no nível da personalidade.

AGENTS.md — arquitetura do projeto, convenções de código, preferências de ferramentas, fluxos de trabalho específicos do repositório, comandos, portas, caminhos e notas de implantação.

Uma regra útil: se algo deve acompanhar você em todos os lugares, pertence ao SOUL.md. Se pertence a um projeto, pertence ao AGENTS.md.13

Personalidades integradas

Hermes inclui personalidades integradas que você pode alternar com /personality:13

Nome Descrição
helpful Assistente amigável e de uso geral
concise Respostas breves e diretas
technical Especialista técnico detalhista e preciso
creative Pensamento inovador e fora da caixa
teacher Educador paciente com exemplos claros
kawaii Expressões fofas, brilhos e entusiasmo
catgirl Neko-chan com expressões de gato
pirate Capitão Hermes, bucaneiro com conhecimento técnico
shakespeare Prosa de bardo com toque dramático
surfer Vibes tranquilas de surfista
noir Narração de detetive durão
uwu Fofura máxima com linguagem uwu
philosopher Contemplação profunda em cada consulta
hype ENERGIA MÁXIMA

Personalidades personalizadas em config.yaml:13

agent:
  personalities:
    codereviewer: >
      You are a meticulous code reviewer. Identify bugs, security issues,
      performance concerns, and unclear design choices. Be precise and constructive.

Depois, alterne com /personality codereviewer.

SOUL.md vs /personality

SOUL.md é a voz base. /personality é uma sobreposição no nível da sessão.13 Mantenha um SOUL.md padrão pragmático e use /personality teacher para uma conversa de tutoria ou /personality creative para brainstorming.

Nous Tool Gateway (v0.10.0+)

A partir do Hermes Agent v0.10.0 (16 de abril de 2026), assinantes pagos do Nous Portal têm acesso gerenciado a um conjunto selecionado de ferramentas por meio das credenciais existentes do Portal — sem chaves API extras para gerenciar.30 O próprio CLI do Hermes continua licenciado sob MIT e totalmente open source. O que mudou foi que sua autenticação no Portal agora libera mais do que inferência de modelo.

O que há no gateway

Ferramenta Provedor Caso de uso
Pesquisa na web Firecrawl Recuperação de informações para agentes que precisam de dados atualizados
Geração de imagens FAL / FLUX 2 Pro Gere imagens inline sem configurar uma chave da FAL
Conversão de texto em fala OpenAI TTS Saída falada em gateways de mensagens
Automação de navegador Browser Use Navegação headless e scraping

Como funciona

O gateway é opt-in por ferramenta por meio de um novo campo de configuração, use_gateway. Se você tiver credenciais do Portal em hermes auth e habilitar o gateway para uma ferramenta, as chamadas dessa ferramenta serão roteadas pelo Portal. Caso contrário, será usada sua chave API direta (se ela estiver presente).

# config.yaml — per-tool gateway opt-in
tools:
  web_search:
    provider: firecrawl
    use_gateway: true          # route via Nous Portal subscription
  image_generation:
    provider: fal
    use_gateway: true

Precedência em runtime: quando o gateway está disponível e uma ferramenta tem use_gateway: true, o Hermes prefere o gateway mesmo que você também tenha uma chave API direta configurada. Isso é importante para a cobrança — as chamadas ao gateway consomem sua assinatura do Portal, e não o saldo da sua chave API direta.

Habilitando o gateway

hermes model                      # select Nous Portal (OAuth flow)
hermes tools                      # per-platform tool picker integrates gateway tools
hermes status                     # confirms gateway/subscription detection

A assinatura é detectada automaticamente a partir das credenciais OAuth do Portal que você já tem em hermes auth — não há uma etapa de login separada. Desde a v0.19.0, você também pode gerenciar a própria assinatura dentro de uma sessão: /subscription mostra seu plano e a franquia restante, exibe exatamente quanto custa um upgrade ou quando um downgrade passa a valer, e aplica a alteração com avisos de mudança agendada e opção de desfazer; /topup adiciona crédito. O aplicativo desktop tem uma aba correspondente de configurações de cobrança.25

Preços e acesso

Os preços e nomes dos níveis são publicados na página de preços do Nous Portal (https://portal.nousresearch.com/pricing). Este guia não lista os níveis porque eles são responsabilidade do produto Portal, não do CLI do Hermes, e mudam independentemente das versões do Hermes. Cadastre-se em https://portal.nousresearch.com/ e consulte a página de preços para ver os níveis atuais.

Aviso de descontinuação

  • A variável de ambiente HERMES_ENABLE_NOUS_MANAGED_TOOLS foi removida na v0.10.0. As ferramentas gerenciadas agora são habilitadas pelo campo de configuração use_gateway de cada ferramenta e dependem do status da sua assinatura do Portal.30

Contexto: o que esta versão não é

O CLI do Hermes Agent não é bloqueado por uma assinatura. O projeto continua licenciado sob MIT, e todos os recursos principais (CLI, skills, memória, messaging gateway, cron, MCP, dashboard local, BYOK para todos os provedores) funcionam de ponta a ponta sem pagar ninguém. A v0.10.0 adiciona um caminho prático para usuários que já pagam pelo Nous Portal — ela não remove nada do caminho gratuito.


Gateway de mensagens

O Hermes pode ser executado como um processo de gateway de longa duração que se conecta a 28 plataformas de mensagens a partir de um único processo de gateway: Telegram, Discord, Slack, WhatsApp, Signal, SMS, Email, Home Assistant, Mattermost, Matrix, DingTalk, Feishu/Lark, WeCom, Weixin (WeChat), BlueBubbles (iMessage), QQBot, Microsoft Teams, Tencent Yuanbao, Google Chat, LINE, SimpleX Chat e um adaptador Webhook genérico.329171819 A v0.9.0 adicionou iMessage via BlueBubbles (registro automático de webhook, assistente de configuração, resiliência a falhas) e suporte nativo ao WeChat via iLink Bot API com modo de callback do WeCom para aplicativos empresariais.16 A v0.11.0 adicionou QQBot.29 A v0.12.0 adicionou Microsoft Teams e Tencent Yuanbao.17 A v0.13.0 adicionou o Google Chat como a 20ª plataforma, usando a mesma arquitetura de adaptadores plugáveis; IRC e Microsoft Teams também foram migrados para o novo padrão de adaptador com hooks genéricos de plugin env_enablement_fn / cron_deliver_env_var.18 A v0.14.0 adiciona LINE e SimpleX Chat e completa a stack do Microsoft Teams de ponta a ponta com autenticação Graph, listener de webhook, runtime de pipeline e entrega de saída.19 A v0.17.0 (19 de junho de 2026) adiciona iMessage sem relay via Photon Spectrum (autenticação de código de dispositivo OAuth com hermes photon login — sem necessidade de relay Mac/BlueBubbles), o adaptador oficial da WhatsApp Business Cloud API (substituindo a exigência de um processo de bridge), grupos e anexos nativos do SimpleX, e Raft como um plugin de plataforma incluído.21

Configuração

hermes gateway setup                # Interactive platform configuration
hermes gateway install              # Install as user service (systemd/launchd)
hermes gateway start                # Start the installed service
hermes gateway stop
hermes gateway restart
hermes gateway status
hermes gateway run                  # Run in foreground (debugging)

A configuração interativa orienta você na conexão de cada plataforma: tokens API, IDs de bot, mapeamentos de canais e allowlists.6

Como as mensagens fluem

Da documentação de arquitetura upstream:3

Platform event → Adapter.on_message() → MessageEvent
  → GatewayRunner._handle_message()
    → authorize user
    → resolve session key
    → create AIAgent with session history
    → AIAgent.run_conversation()
    → deliver response back through adapter

Todas as plataformas de mensagens passam pelo mesmo loop de conversa AIAgent que o CLI. É por isso que os comandos slash funcionam de forma idêntica nos dois lugares e que um trabalho cron agendado no Telegram pode entregar sua saída no Discord — a diferença entre plataformas está apenas na borda.3

A v0.19.0 adiciona roteamento de mensagens baseado em profile e entrega durável. Um único gateway multiplexado que compartilha um token de bot pode encaminhar guilds, canais ou threads específicos para profiles diferentes — cada um com configuração, skills, memória e segredos totalmente isolados — com uma substituição GATEWAY_MULTIPLEX_PROFILES, e uma série de reforços garante que um profile configurado incorretamente não possa mais derrubar todo o gateway. Internamente, o índice de roteamento foi movido para state.db (sessions.json agora é um espelho legado opcional), e as respostas finais são registradas em um ledger durável de obrigações de entrega em torno do envio pela plataforma — uma resposta concluída que encontra uma falha no gateway é reenviada na próxima inicialização, em vez de ser perdida silenciosamente.25

Autorização e pareamento de usuários

hermes pairing list                    # Show pending and approved users
hermes pairing approve <platform> <code>
hermes pairing revoke <platform> <user-id>
hermes pairing clear-pending

Os códigos de pareamento impedem que desconhecidos aleatórios conversem com seu gateway. Um usuário envia um código de pareamento pela plataforma de mensagens; você o aprova com hermes pairing approve; a partir de então, ele fica autorizado.6


Tarefas agendadas (Cron)

O Hermes tem um sistema cron de primeira classe em que os jobs são tarefas de agente, e não comandos shell. Cada job agendado é executado por um novo AIAgent com o prompt configurado, skills opcionais anexadas, e entrega os resultados em qualquer plataforma:36

hermes cron list
hermes cron create --prompt "Check HN for AI news and summarize" --schedule "0 9 * * *" --deliver telegram
hermes cron edit <id>
hermes cron pause <id>
hermes cron resume <id>
hermes cron run <id>         # Trigger now on the next tick
hermes cron remove <id>
hermes cron status           # Check if scheduler is running
hermes cron tick             # Run due jobs once and exit

Ou crie um conversacionalmente dentro de um chat de mensagens:

Every morning at 9am, check Hacker News for AI news and send me a summary on Telegram.

O agente configurará o job cron por meio de suas ferramentas. Os jobs persistem em JSON e sobrevivem a reinicializações.3


Integração com MCP

O Hermes oferece suporte ao Model Context Protocol tanto como cliente quanto como servidor:6

Como cliente — conecte o Hermes a servidores MCP externos para ampliar sua superfície de ferramentas:

hermes mcp add <name> --url https://example.com/mcp
hermes mcp add <name> --command npx --args "-y,@modelcontextprotocol/server-github"
hermes mcp list
hermes mcp test <name>
hermes mcp remove <name>
hermes mcp configure <name>   # Toggle individual tool selection

Ou manualmente em config.yaml:14

mcp_servers:
  github:
    command: npx
    args: ["-y", "@modelcontextprotocol/server-github"]
    env:
      GITHUB_PERSONAL_ACCESS_TOKEN: "ghp_xxx"

A partir da v0.19.0, as ferramentas MCP são expostas ao modelo seguindo a convenção de nomenclatura mcp__server__tool — cada nome de ferramenta inclui o nome do servidor, para que dois servidores que exponham a mesma ferramenta não entrem mais em conflito — e notificações de log do servidor MCP são exibidas em agent.log.25

Como servidor — exponha conversas do Hermes a outros agentes:

hermes mcp serve
hermes mcp serve -v    # Verbose

Compressão de contexto

Hermes comprime automaticamente conversas longas para se manter dentro da janela de contexto do seu modelo. O resumidor de compressão é uma chamada LLM separada — você pode direcioná-lo a qualquer provider ou endpoint.4

compression:
  enabled: true
  threshold: 0.50                           # Compress at this % of context limit
  target_ratio: 0.20                        # Fraction to preserve as recent tail
  protect_last_n: 20                        # Min recent messages to keep uncompressed
  summary_model: "google/gemini-3-flash-preview"
  summary_provider: "auto"                  # "auto", "openrouter", "nous", "codex", "main", etc.
  summary_base_url: null                    # Custom OpenAI-compatible endpoint

Opções de provider:4

summary_provider summary_base_url Resultado
auto (padrão) não definido Detecta automaticamente o melhor provider disponível
nous / openrouter / etc. não definido Força esse provider e usa sua autenticação
qualquer definido Usa o endpoint personalizado diretamente (o provider é ignorado)

summary_model precisa oferecer suporte a um comprimento de contexto pelo menos tão grande quanto o do seu modelo principal, pois recebe toda a seção intermediária da conversa para compressão.4

Avisos de pressão no orçamento

Quando o agente trabalha em uma tarefa complexa com muitas chamadas de ferramenta, ele pode esgotar seu orçamento de iterações (padrão: 500 turnos desde a v0.20.0, antes eram 90) sem perceber. A pressão no orçamento avisa automaticamente o modelo:4

Limite Nível O que o modelo vê
70% Cuidado [BUDGET: 350/500. 150 iterations left. Start consolidating.]
90% Aviso [BUDGET WARNING: 450/500. Only 50 left. Respond NOW.]

Timeouts de stream

A conexão de streaming LLM tem duas camadas de timeout que se ajustam automaticamente para providers locais (localhost, IPs de LAN):4

Timeout Padrão Providers locais Variável de ambiente
Timeout de leitura do socket 120s Aumentado automaticamente para 1800s HERMES_STREAM_READ_TIMEOUT
Detecção de stream inativo 180s Desativada automaticamente HERMES_STREAM_STALE_TIMEOUT
Chamada API (sem streaming) 1800s Sem alteração HERMES_API_TIMEOUT

O timeout de leitura do socket é aumentado para 30 minutos em endpoints locais, pois LLMs locais podem levar minutos no prefill de contextos grandes antes de produzir o primeiro token.4


Dashboard web local (v0.9.0+)

Um dashboard baseado em navegador para gerenciar seu Hermes Agent localmente. Configure as definições, monitore sessões, navegue por skills e gerencie seu gateway sem tocar em arquivos de configuração ou no terminal.16 Inicie com hermes dashboard. Este é o caminho de onboarding mais fácil para novos usuários que preferem uma GUI.

Monitoramento de processos em segundo plano (v0.9.0+)

watch_patterns permite definir padrões para monitorar a saída de processos em segundo plano e receber notificações em tempo real quando houver correspondência.16 Monitore erros, aguarde eventos específicos (“listening on port”) ou acompanhe logs de build — tudo sem polling. Combinado com notify_on_complete da v0.8.0 (que notifica quando uma tarefa em segundo plano é concluída), Hermes agora conta com uma camada completa de observabilidade de processos em segundo plano.15

Context engine conectável (v0.9.0+)

O gerenciamento de contexto agora é um slot conectável por meio de hermes plugins. Troque por context engines personalizadas que controlam o que o agente vê a cada turno — filtragem, sumarização ou injeção de contexto específica ao domínio.16 Isso desacopla a estratégia de contexto do loop principal do agente, permitindo a personalização de contexto por projeto ou domínio.

Backup e restauração (v0.9.0+)

hermes backup cria um arquivo completo das suas configurações, sessões, skills e memória. hermes import restaura a partir de um arquivo de backup.16 Use isso para migrar entre máquinas, criar snapshots antes de grandes mudanças ou compartilhar uma configuração comprovadamente funcional com colegas de equipe.

Suporte a Termux / Android (v0.9.0+)

Hermes é executado nativamente no Android via Termux. Caminhos de instalação adaptados, otimizações de TUI para telas móveis, suporte a backend de voz e o comando /image funcionam diretamente no dispositivo.16

Reforço de segurança (v0.13.0+)

A v0.13.0 corrigiu 8 problemas de segurança P0 e alterou um padrão em benefício do usuário.18 A v0.14.0 vem em seguida com mais 12 correções P0 e 50 P1, incluindo reforço contra força bruta em sudo / sudo-stdin, correções para contornar comandos perigosos, sanitização de erros de ferramentas antes da reinjeção no modelo, autenticação de API de plugins do dashboard, cobertura de SSRF no skills-hub e verificação de avisos da cadeia de suprimentos durante a instalação.19

Correção O que mudou
Redação de segredos ativada por padrão Antes era opcional. Logs e uploads de hermes debug share ocultam segredos, a menos que isso seja explicitamente desativado. A v0.12.0 tinha desativado a redação por padrão após relatos de corrupção de payload; a v0.13.0 a reativa como base mais segura.
Bypass de DM entre guilds no Discord (CVSS 8.1) As allowlists de funções do Discord agora têm escopo por guild, fechando um caminho em que uma função de usuário em uma guild autorizava DMs em todas elas.
Restrições padrão do WhatsApp O adaptador do WhatsApp rejeita desconhecidos por padrão e nunca responde em conversas consigo mesmo.
Janela TOCTOU de MCP OAuth Corrigida uma condição de corrida ao salvar credenciais nos fluxos de MCP OAuth.
TOCTOU de auth.json em CLI Corrigida uma janela TOCTOU análoga no gravador de credenciais do armazenamento de autenticação CLI.
Base de SSRF do navegador O roteamento híbrido impõe uma base de SSRF para metadados de cloud contra solicitações que tentam alcançar 169.254.169.254 e equivalentes.
Verificação de prompt injection em cron Os prompts montados (incluindo o conteúdo de skills carregadas) são verificados em busca de prompt injection antes da execução do job cron.
Redação no hermes debug share Os uploads de compartilhamento de debug ocultam o conteúdo dos logs no momento do upload, não apenas no momento da gravação.

Se você mantém uma implantação do Hermes, trate a v0.13.0 e a v0.14.0 como atualizações relevantes para a segurança, e não apenas como lançamentos de recursos. A v0.13.0 corrige o bypass entre guilds no Discord e duas janelas TOCTOU; a v0.14.0 adiciona outra etapa de reforço em todo o tratamento de sudo, reinjeção de erros de ferramentas, APIs de plugins, SSRF do skills-hub e avisos de dependências.

Arquitetura para profissionais

Esta seção é para pessoas que querem entender o que acontece por trás dos bastidores, para depurar, estender ou analisar o desempenho. É uma síntese da documentação de arquitetura upstream.3

Pontos de entrada → AIAgent

Todos os pontos de entrada no Hermes acabam chamando AIAgent.run_conversation():

┌──────────────────────────────────────────────────────────────────┐
                        Entry Points                              
                                                                  
  CLI (cli.py)    Gateway (gateway/run.py)    ACP (acp_adapter/)  
  Batch Runner    API Server                  Python Library     
└──────────┬──────────────┬───────────────────────┬────────────────┘
                                                
                                                
┌──────────────────────────────────────────────────────────────────┐
                     AIAgent (run_agent.py)                       
                                                                  
  ┌─────────────┐  ┌──────────────┐  ┌──────────────┐             
   Prompt         Provider        Tool                      
   Builder        Resolution      Dispatch                  
  └──────┬──────┘  └──────┬───────┘  └──────┬───────┘             
                                                              
  ┌──────┴───────┐ ┌──────┴───────┐  ┌──────┴───────┐             
   Compression    3 API Modes     Tool Registry             
   & Caching      chat_compl      47 tools                  
                  codex_resp      20 toolsets               
                  anthropic                                 
  └──────────────┘ └──────────────┘  └──────────────┘             
└──────────────────────────────────────────────────────────────────┘

Diagrama adaptado da documentação de arquitetura upstream.3

“47 tools / 20 toolsets” vs. “28 tools” no seu banner. A contagem de “47 tools” é o registro total de tools do repositório upstream — todas as tools para as quais o Hermes inclui código-fonte, em todos os toolsets. A sua instalação CLI em execução mostrará um número menor no banner de inicialização (a instalação em que verifiquei este guia informa 28 tools / 89 skills). Isso não é um bug. Muitos toolsets são opcionais e precisam ser ativados explicitamente em config.yaml, em toolsets: — adaptadores de plataformas de mensagens, automação de navegador, tools de scraping mais pesadas etc. O total do registro representa “o que está disponível”; o número do banner representa “o que está ativado no seu profile atual”. Veja quais toolsets estão ativos com hermes tools --list e ative ou desative toolsets individuais com o bloco toolsets: em ~/.hermes/config.yaml (ou /tools list / /tools enable <name> / /tools disable <name> em uma sessão em execução — remover uma tool dispara uma redefinição da sessão para que o agente reconstrua o manifesto de tools).

Os três modos API

O Hermes abstrai as diferenças entre providers em três modos API, selecionados automaticamente em tempo de execução:3

Modo API Usado por
chat_completions OpenRouter, z.ai, Kimi, MiniMax, DeepSeek, Alibaba, a maioria dos endpoints personalizados, qualquer servidor compatível com OpenAI
codex_responses OpenAI Codex (via ChatGPT OAuth)
anthropic_messages Anthropic API (nativo), Anthropic OAuth, proxies compatíveis com Anthropic

O resolvedor runtime_provider.py mapeia tuplas (provider, model) para (api_mode, api_key, base_url) para mais de 18 providers, lidando com fluxos de OAuth, pools de credenciais e resolução de aliases.3

Fluxo de dados em uma sessão CLI

User input  HermesCLI.process_input()
   AIAgent.run_conversation()
     prompt_builder.build_system_prompt()
     runtime_provider.resolve_runtime_provider()
     API call (chat_completions / codex_responses / anthropic_messages)
     tool_calls?  model_tools.handle_function_call()  loop
     final response  display  save to SessionDB

Da página de arquitetura upstream.3

Ordem de montagem do prompt

A pilha de prompts inclui:13

  1. SOUL.md (identidade do agente — ou fallback integrado se indisponível)
  2. Orientações de comportamento compatíveis com tools
  3. Contexto de memória/usuário (MEMORY.md, USER.md)
  4. Orientações de skills
  5. Arquivos de contexto (AGENTS.md, .cursorrules)
  6. Timestamp
  7. Dicas de formatação específicas da plataforma
  8. Sobreposições opcionais de system prompt, como /personality

SOUL.md é a base — todo o restante é construído sobre ele.13

Armazenamento de sessões

Armazenamento de sessões baseado em SQLite com busca de texto completo FTS5. As sessões têm rastreamento de linhagem (pai/filho entre compressões), isolamento por plataforma e gravações atômicas com tratamento de contenção.3

Sistema de plugins

Três fontes de descoberta: ~/.hermes/plugins/ (usuário), .hermes/plugins/ (projeto) e entry points do pip. Os plugins registram tools, hooks e comandos CLI por meio de um contexto API. Os providers de memória são um tipo especializado de plugin em plugins/memory/.3

hermes plugins                       # Interactive enable/disable UI
hermes plugins install <repo>        # Install from Git URL or owner/repo
hermes plugins enable <name>
hermes plugins disable <name>
hermes plugins list

Princípios de design

Da página de arquitetura upstream:3

Princípio O que significa na prática
Estabilidade do prompt O system prompt não muda no meio da conversa. Sem mutações que invalidem o cache, exceto ações explícitas do usuário (/model)
Execução observável Cada chamada de tool é visível ao usuário por meio de callbacks. Atualizações de progresso em CLI (spinner) e no gateway (mensagens de chat)
Interrompível Chamadas API e execução de tools podem ser canceladas durante a execução por entrada do usuário ou sinais
Núcleo independente de plataforma Uma classe AIAgent atende CLI, gateway, ACP, batch e servidor API. As diferenças entre plataformas ficam no ponto de entrada
Baixo acoplamento Subsistemas opcionais (MCP, plugins, providers de memória, ambientes de RL) usam padrões de registro e bloqueio por check_fn, não dependências rígidas
Isolamento de profiles Cada profile recebe seu próprio HERMES_HOME, config, memória, sessões e PID do gateway. Vários profiles são executados simultaneamente

Migração do OpenClaw

Hermes Agent é o sucessor do OpenClaw. Se você estiver migrando de uma instalação existente do OpenClaw:65

hermes claw migrate --dry-run                    # Preview what would be migrated
hermes claw migrate --preset full                # Full migration including API keys
hermes claw migrate --preset user-data --overwrite   # User data only, no secrets
hermes claw migrate --source /custom/path        # Non-default OpenClaw location

hermes claw migrate lê de ~/.openclaw por padrão (também detecta automaticamente os diretórios legados ~/.clawdbot e ~/.moldbot) e grava em ~/.hermes.6

Importado diretamente (mais de 30 categorias): SOUL.md, MEMORY.md, USER.md, AGENTS.md, skills de 4 diretórios de origem, modelo padrão, providers personalizados, servidores MCP, tokens e allowlists de plataformas de mensagens (Telegram, Discord, Slack, WhatsApp, Signal, Matrix, Mattermost), padrões do agente (esforço de raciocínio, compressão, atraso humano, fuso horário, sandbox), políticas de redefinição de sessão, regras de aprovação, configuração de TTS, configurações do navegador, configurações de tools, timeout de exec, allowlist de comandos, configuração do gateway e chaves API de 3 fontes.6

Arquivado para revisão manual: jobs de cron, plugins, hooks/webhooks, backend de memória (QMD), configuração do registro de skills, UI/identidade, logs, configuração multiagente, associações de canais, IDENTITY.md, TOOLS.md, HEARTBEAT.md, BOOTSTRAP.md.6

A resolução de chaves API verifica três fontes nesta ordem de prioridade: valores de config → ~/.openclaw/.envauth-profiles.json.6


Solução de problemas

“No inference provider configured. Run ‘hermes model’ to choose a provider and model”

O primeiro erro que toda instalação nova encontra: o Hermes ainda não tem um provider definido. Isso significa exatamente o que diz — nenhum dos três caminhos de autenticação produziu um provider utilizável. Execute:

hermes model

O seletor interativo percorre todos os providers compatíveis, incluindo os fluxos de device code do OAuth (Nous Portal, GitHub Copilot, Anthropic, OpenAI Codex) e endpoints personalizados para servidores auto-hospedados. Se você esperava que um provider já estivesse configurado, hermes doctor mostra quais credenciais o Hermes realmente consegue encontrar; as causas mais comuns são uma chave API definida no lugar errado (ela deve ficar em .env ou ser configurada com hermes config set, não no perfil do seu shell), uma credencial OAuth expirada em ~/.hermes/auth.json ou um endpoint personalizado em config.yaml que perdeu seu base_url. Os caminhos de autenticação são abordados em profundidade em Autenticação e providers.27

“Chave API não definida”

Execute hermes model para configurar seu provider de forma interativa ou hermes config set OPENROUTER_API_KEY your_key. O comando hermes doctor informará exatamente quais chaves estão ausentes.7

“Context limit: 2048 tokens” na inicialização (modelos locais)

O Hermes detecta automaticamente o tamanho do contexto pelo endpoint /v1/models do seu servidor, mas muitos servidores locais informam valores padrão baixos. Defina-o explicitamente em config.yaml:2

model:
  default: your-model
  provider: custom
  base_url: http://localhost:11434/v1
  context_length: 32768

Chamadas de tool aparecem como texto em vez de serem executadas

Seu servidor não tem tool calling ativado ou o modelo não oferece suporte a isso pela implementação do servidor.2

Servidor Correção
llama.cpp Adicione --jinja ao comando de inicialização
vLLM Adicione --enable-auto-tool-choice --tool-call-parser hermes
SGLang Adicione --tool-call-parser qwen (ou o parser apropriado)
Ollama Tool calling vem ativado por padrão — verifique se seu modelo oferece suporte com ollama show <model>
LM Studio Atualize para a versão 0.3.6+ e use um modelo com suporte nativo a tools

As respostas são cortadas no meio da frase

Há duas causas possíveis:2

  1. Limite baixo de saída (max_tokens) no servidor — o SGLang usa por padrão 128 tokens por resposta. Defina --default-max-tokens no servidor ou configure model.max_tokens em config.yaml.
  2. Esgotamento de contexto — o modelo preencheu sua janela de contexto. Aumente model.context_length ou ative a compressão de contexto no Hermes.

“Connection refused” do WSL2 para um servidor de modelo hospedado no Windows

O WSL2 usa um adaptador de rede virtual com sua própria sub-rede — localhost dentro do WSL2 se refere à VM Linux, não ao host Windows. Há duas opções:2

Rede espelhada (Windows 11 22H2+): edite %USERPROFILE%\.wslconfig:

[wsl2]
networkingMode=mirrored

Em seguida, execute wsl --shutdown e reinicie. Agora, localhost funciona bidirecionalmente.

Alternativa com IP do host (versões mais antigas do Windows): obtenha o IP do host Windows de dentro do WSL2 e use-o no lugar de localhost:

ip route show | grep -i default | awk '{ print $3 }'
# Use that IP as the base_url host

Também é necessário que o servidor de modelo faça bind em 0.0.0.0, não em 127.0.0.1 — defina OLLAMA_HOST=0.0.0.0 para o Ollama, adicione --host 0.0.0.0 para llama-server/SGLang ou ative “Serve on Network” no LM Studio.2

Onde está tudo?

hermes status e hermes dump são seus aliados aqui. hermes logs list mostra todos os arquivos de log com seus tamanhos. hermes config path exibe o local do arquivo de configuração. hermes config env-path exibe o local de .env.6


Perguntas frequentes

Qual é a diferença entre Hermes Agent e Claude Code?

Claude Code é o CLI oficial da Anthropic, restrito aos modelos da Anthropic. Hermes Agent é um framework de agente open-source da Nous Research que funciona com qualquer provider compatível com OpenAI — Nous Portal, OpenRouter, Anthropic, GitHub Copilot, z.ai, Kimi, MiniMax, DeepSeek, Hugging Face, Google ou seu próprio endpoint auto-hospedado.12 O Hermes também inclui um gateway de mensagens para Telegram/Discord/Slack/WhatsApp/Signal, algo que o Claude Code não oferece.

Posso usar o Hermes com uma chave API da Anthropic?

Sim. Há três formas:2

  1. Defina ANTHROPIC_API_KEY em ~/.hermes/.env e execute hermes chat --provider anthropic --model claude-sonnet-4-6
  2. Execute hermes model e selecione Anthropic — o Hermes usará o armazenamento de credenciais do Claude Code quando disponível
  3. Defina manualmente um ANTHROPIC_TOKEN (setup-token ou token OAuth) como alternativa

A opção 2 é preferível se você já usa Claude Code na mesma máquina — ela mantém as credenciais Claude renováveis.

Como alterno entre providers sem perder minha conversa?

Use /model provider:model dentro de uma sessão. O histórico da conversa, a memória e as skills são mantidos:9

/model zai:glm-5
/model openrouter:anthropic/claude-sonnet-4
/model custom:local:qwen-2.5

Configurei Anthropic, mas vision/web/compression não funcionam

Você está encontrando o fallback do modelo auxiliar. Vision, resumo da web, compressão e outras tarefas secundárias usam um LLM auxiliar separado — por padrão, Gemini Flash por autodetecção (OpenRouter → Nous → Codex). Se nenhum deles estiver configurado e você tiver apenas Anthropic configurado, esses recursos se degradam silenciosamente.4

Correção: adicione uma OPENROUTER_API_KEY para tarefas auxiliares ou reconfigure os slots auxiliares para usar seu provider principal. Observe que a compressão de contexto fica em seu próprio bloco de nível superior compression: e recebe summary_provider, não auxiliary.compression.provider — o slot auxiliary.compression expõe apenas um timeout. Correção completa:

auxiliary:
  vision:      { provider: "main" }
  web_extract: { provider: "main" }

compression:
  summary_provider: "main"

Qual é a diferença entre SOUL.md e AGENTS.md?

SOUL.md é a identidade do seu agente — tom, estilo e padrões de comunicação. Ele fica em ~/.hermes/SOUL.md e acompanha você em todos os lugares. AGENTS.md é específico do projeto — arquitetura, convenções, comandos e caminhos — e fica no diretório do seu projeto.13 Se deve acompanhar você em todos os lugares, use SOUL.md. Se pertence a um projeto, use AGENTS.md.

Como executo várias instâncias do Hermes lado a lado?

Profiles. Cada profile recebe seu próprio HERMES_HOME, configuração, memória, sessões e PID do gateway:6

hermes profile create work --clone
hermes profile use work                 # Sticky default
hermes -p work chat -q "..."            # One-off without switching
hermes profile alias work --name h-work # Wrapper script

O Hermes oferece suporte a LLMs locais?

Sim, pelo caminho de endpoint personalizado. O Hermes funciona com qualquer servidor compatível com OpenAI: Ollama, vLLM, SGLang, llama.cpp/llama-server, LM Studio, LocalAI, Jan ou o seu próprio.2 Consulte Endpoints personalizados e auto-hospedados para a configuração de cada servidor.

Por que meu banner de inicialização mostra menos tools do que o guia diz que o Hermes tem?

O guia cita 47 tools / 20 toolsets do registro de arquitetura upstream — essa é a contagem total de tools cujo código-fonte o Hermes inclui em todos os toolsets. Sua instalação em execução mostra um número menor no banner (a instalação de referência usada neste guia informa 28 tools), porque o Hermes ativa apenas o conjunto padrão de toolsets na inicialização. Muitos toolsets são opt-in: adaptadores de gateway de mensagens, automação de navegador, stacks de scraping mais pesadas e várias integrações especializadas precisam ser listados explicitamente em toolsets: no arquivo ~/.hermes/config.yaml antes de serem carregados. Total do registro = “o que está disponível se você ativar”. Total do banner = “o que seu profile atual realmente carregou”. Use hermes tools --list para ver quais toolsets estão ativos e quais estão disponíveis, mas desativados. Ative ou desative toolsets individuais em tempo de execução com /tools enable <name> e /tools disable <name> (desativar aciona uma redefinição de sessão para que o agente reconstrua seu manifesto de tools com a nova configuração).

Como o Hermes lida com fallback de modelo quando meu provider principal falha?

Configure um bloco fallback_model em config.yaml:2

fallback_model:
  provider: openrouter
  model: anthropic/claude-sonnet-4

Quando o principal falha (limite de taxa, erro do servidor ou falha de autenticação), o Hermes muda para o fallback no meio da sessão sem perder o histórico da conversa. Isso ocorre no máximo uma vez por sessão.

O agente pode melhorar suas próprias skills ao longo do tempo?

Sim — essa é a parte “autoaperfeiçoável” do Hermes Agent. O agente pode criar, atualizar e excluir skills pela tool skill_manage. Quando descobre um fluxo de trabalho não trivial, ele salva a abordagem como uma skill para reutilização futura.11 O agente cria skills após tarefas complexas (mais de 5 chamadas de tool), quando encontra erros e descobre o caminho que funciona, quando você corrige sua abordagem ou quando descobre um fluxo de trabalho não trivial.

Há integração com IDE?

Sim — o Hermes pode ser executado como um servidor ACP (Agent Client Protocol) para VS Code, Zed e JetBrains:6

pip install -e '.[acp]'
hermes acp

Registro de alterações

Data Alteração Fonte
2026-07-28 Guia v1.12: Revisão de cobertura orientada pela demanda de busca — dois tópicos com boa conversão não tinham um título para o qual direcionar os usuários. Nenhuma nova versão. O GSC mostra hermes swarm e hermes agent swarm convertendo entre 4,4% e 6,3% na posição ~8, e hermes smart model routing com 4,9% na posição 6,7, embora nenhum dos termos tivesse uma seção: swarm aparecia apenas como texto dentro de Multi-Agent Kanban e em linhas do registro de alterações, enquanto “smart model routing” só aparecia em uma nota de rodapé. Adicionada a seção O que é um Hermes Swarm? em Multi-Agent Kanban — define um swarm como workers paralelos em um único quadro durável, documenta a topologia de swarm da v0.15.0, decomposição automática, substituições de modelo por tarefa, tarefas agendadas e gerenciamento de worktrees, além de apresentar em uma tabela a falha que cada mecanismo evita. Rotação e fallback de provedores foi renomeada para Smart Model Routing: rotação e fallback de provedores, com uma introdução que reúne pools de credenciais, modelo de fallback e roteamento auxiliar em um único sistema. Nenhuma âncora tinha links internos, portanto a mudança de título não causa quebras. 28 2 6
2026-08-20 Guia v1.13: v0.20.3 (tag v2026.8.16.2, publicada em 17 de agosto) e v0.20.4 (tag v2026.8.18, 18 de agosto). Nova subseção em Herald Release: a sequência de rollups agora inclui recursos, não apenas estabilização. v0.20.3 (~250 commits/~125 PRs): migração do MCP 2.x para SDK, com suporte ao protocolo stateless de 28 de julho de 2026, plugin Bot Mode incluído (hermes-bots) com o protocolo central de teammates, plugin do provedor CommandCode, contratos de runtime para uso de computador do Cua Driver 0.20, reforço da propriedade do runtime de Python, autorrecuperação do agendador cron, correções de perda de dados na transferência de sessões e ports do ecossistema (/worktree, preservação de edições manuais no /rollback, verificação de segurança na instalação de plugins). v0.20.4 (~146 commits/~74 PRs): superfície de vidro/translucidez no desktop com seletor de efeito fosco, barra lateral SESSIONS|BOTS com abas e opção de ocultar/exibir cada bot, verificação consultiva Tier 1 do NVIDIA SkillEvaluator na instalação de skills (licença + segurança), reforço do envio de mídia pelo cron e transparência do hermes update sobre branches estacionadas. As duas versões informam que as notas completas e selecionadas serão lançadas com a v0.21.0 — resumos baseados nas descrições de janela das próprias versões. A frase do cabeçalho e a linhagem das tags foram atualizadas. 23
2026-08-16 Guia v1.12: v0.20.0 “The Herald Release” (3 de agosto, tag v2026.8.3), além das tags de estabilização v0.20.1 (13 de agosto) e v0.20.2 (16 de agosto). Três correções ajustam instruções que não funcionam mais: Node 26 é obrigatório (o instalador fixa NODE_VERSION="26" e rejeita runtimes anteriores — a indicação de Node v22 no site da documentação está desatualizada, portanto prevalecem o instalador e as notas da versão), pip e Homebrew foram descontinuados, não apenas depreciados (“instalador shell/Docker/Nix são os canais compatíveis”), e o limite padrão de iterações passou de 90 para 500, invalidando todos os números da tabela de pressão sobre o orçamento. O comando de instalação foi corrigido para o endereço canônico https://hermes-agent.nousresearch.com/install.sh. Superfície removida: a fonte de skills claude-marketplace não existe mais e foi substituída por browse-sh na lista de fontes; os taps padrão de GitHub agora são openai, anthropics, huggingface, NVIDIA e gstack. As plataformas do messaging gateway foram recontadas de 22 para 28 pela enumeração direta da tabela comparativa da documentação (a documentação não publica um total oficial). Windows (nativo) é Tier 1, não uma versão beta inicial; o macOS funciona somente em Apple Silicon. Uma nova seção aborda a própria versão: voz conversacional com interrupção da fala, A2A v1.0, webhooks de ciclo de vida de saída assinados, skill grounded-citations, a onda de CLI !//init//diff//context//focus e hermes import-agent, fonte de segredos command-helper, redução da inicialização a frio do hermes -w de ~14 s para ~1,8 s, além de artefatos para desktop e um SDK de plugins. Itens verificados como inalterados: os três caminhos de autenticação, a estrutura de ~/.hermes/, hermes update e a lista de ferramentas documentada. 24
2026-07-21 Guia v1.11: v0.19.0 “The Quicksilver Release” (20 de julho de 2026, tag v2026.7.20). Adicionada a seção “Novidades da v0.19.0”: redução de ~80% no TTFT do primeiro turno (envio a frio→despacho de ~4,3 s para ~0,9 s em CLI/gateway/TUI/desktop/cron), raciocínio transmitido ao vivo por padrão (display.show_reasoning ativado), onda de velocidade no desktop com ~20 PRs (streaming de Markdown 14× mais rápido) + Markdown incremental na TUI; instalações por pip/Homebrew depreciadas (apenas aviso de “legado sem suporte”, com remoção planejada da publicação no PyPI/Homebrew) — a seção Instalação e o Resumo foram corrigidos para usar o instalador de uma linha; SecretSource conectável, com provedores Bitwarden + 1Password (referências op://, vários cofres, precedência determinística e proveniência por variável); aprovações inteligentes por padrão (revisor LLM independente para cada comando sinalizado) + regras de negação definidas pelo usuário que continuam válidas no modo YOLO + /deny <reason> + reimplementação da escalada de aprovação pre_tool_call de plugins; cobrança no terminal com /subscription + /topup + aba de cobrança no desktop (a afirmação de que “não existe um comando separado de assinatura” foi removida); transcrições ao vivo de subagentes + delegação durável em segundo plano + registro de obrigações de entrega no state.db; max_async_children depreciado em favor de limites unificados de simultaneidade da delegação; roteamento de mensagens do gateway baseado em profile (um token de bot multiplexado → profiles isolados, GATEWAY_MULTIPLEX_PROFILES, índice de roteamento no state.db, sessions.json como espelho legado opcional); provedores/modelos: Fireworks AI (2ª posição no seletor), DeepInfra, Upstage Solar, GPT-5.6 (Sol/Terra/Luna + Pro) de ponta a ponta, grok-4.5 GA, kimi-k3 (kimi-k2.x descontinuado), Claude Sonnet 5 totalmente integrado, enabled: false por provedor + excluded_providers, níveis de esforço de raciocínio max/ultra com substituições por modelo/slot de MoA e /reasoning com escopo de sessão; CLI/MCP: hermes sessions export (Markdown/Quarto/HTML/somente prompt/trace do HF, --redact), /model --once, invocações empilhadas de slash-skills, --safe-mode, hermes config get/unset, hermes serve realmente headless e nomenclatura mcp__server__tool de MCP. Também registra as tags de patch que haviam passado despercebidas: v0.18.1 (tag v2026.7.7) e v0.18.2 (tag v2026.7.7.2), de 7 a 8 de julho de 2026 — rollups de patches de infraestrutura; a correção relevante da v0.18.2 remove a fixação do Baileys do WhatsApp para permitir a versão 7.0.0-rc13 e garantir builds confiáveis de Docker. 25 26
2026-07-16 Adicionada uma primeira entrada de solução de problemas para o erro literal de inicialização “No inference provider configured. Run ‘hermes model’ to choose a provider and model” — orientada pela demanda de busca; direciona para o seletor interativo, hermes doctor e os três caminhos de autenticação. Nenhuma alteração no produto. 2 7
2026-07-01 Guia v1.10: v0.18.0 “The Judgment Release” (1º de julho de 2026, tag v2026.7.1). Adicionada a seção “Novidades da v0.18.0”: todo o backlog P0/P1 foi concluído (~692 itens); Mixture-of-Agents como recurso de primeira classe, com saída do conjunto identificada por modelo e streaming ao vivo; contratos de conclusão/goal verifica o próprio trabalho executando as verificações do projeto; /learn (descreva um fluxo de trabalho → skill reutilizável e compatível com CONTRIBUTING.md); /journey para a linha do tempo de memória/skills + grafo de memória no desktop; fan-out de subagentes em segundo plano (tarefas delegadas simultâneas); Desktop Projects (projeto/repositório/lane); gateway com scale-to-zero e coordenação de drenagem; Google Vertex AI (Gemini por meio de contas de serviço do GCP, atualização automática de OAuth2); /prompt para composição no \$EDITOR. Fonte: versões do hermes-agent. 22
2026-06-21 Guia v1.9: v0.17.0 “The Reach Release” (19 de junho de 2026, tag v2026.6.19). Adicionada a seção “Novidades da v0.17.0”. Mensagens: iMessage sem relay por meio do Photon Spectrum (hermes photon login, OAuth com código do dispositivo), adaptador oficial da API do WhatsApp Business Cloud (sem bridge), grupos + anexos do SimpleX e plugin da plataforma Raft. Modelos: z-ai/glm-5.2 (1M), anthropic/claude-fable-5, laguna-m.1, nemotron-3-ultra, grok-composer-2.5-fast (OAuth da xAI, 200k); padrão da xAI → grok-build-0.1; modelos adaptativos de Anthropic removem o campo reasoning. Desktop/dashboard: subagentes em segundo plano com janelas de acompanhamento ao vivo (delegate_task(background=true)), criador completo de profiles, Skills Hub reformulado, Automation Blueprints, login 401 seguro, temas do VS Code Marketplace e interface em japonês + chinês tradicional. Skills/ferramentas: edição de imagem para imagem com image_generate, lote atômico de operations de memory, skill simplify-code, write_approval booleano (substitui write_mode). Arquitetura: manipulador de elicitação de MCP, CronScheduler conectável + Chronos, escopo Managed (/etc/hermes), relay entre gateways. Comandos: /version, /billing, hermes curator run --consolidate (opt-in). Segurança: falha de contorno da lista de bloqueio de escape de shell corrigida, adaptadores de aprovação/gateway com falha fechada, ambiente do cron sanitizado, segredos ocultados em dumps de debug, verificação de exfiltração por stdio de MCP e atualizações do urllib3 + PyJWT contra CVEs. 21
2026-06-08 Guia v1.8: v0.16.0 “The Surface Release” (5 de junho de 2026, tag v2026.6.5). O guia foi renomeado para v0.16 e recebeu a seção “Novidades da v0.16.0”. Destaque: Hermes não funciona mais apenas no terminal. Aplicativo nativo Hermes Desktop (Electron, macOS/Linux/Windows) com instalação em um clique, atualização automática no aplicativo, chat com streaming, arrastar e soltar + colar imagens da área de transferência, paleta Cmd+K, arquivo/pesquisa de sessões, seletor de modelos na barra de status, conexão a gateway remoto por WebSocket seguro (OAuth ou usuário/senha, hosts por profile e links @session entre profiles) e tradução completa para chinês simplificado por meio de i18n tipada. Painel administrativo no navegador (dashboard web → administração completa): habilitar/desabilitar o catálogo de MCP, gerenciamento de credenciais, criação de webhooks/hooks, configuração de memória, controles do gateway, página System com verificação antes da atualização + Debug Share, nova página Channels e autenticação conectável (usuário/senha, OIDC auto-hospedado, hermes dashboard register). Novos comandos: /undo [N] (CLI/TUI/mensagens), interface padrão configurável (cli/tui, --cli), /model unificado + sobreposição Sessions na TUI, hermes portal, hermes prompt-size, hermes sessions optimize. Novos modelos: deepseek-v4-flash, MiniMax-M3 (contexto de 1M), qwen3.7-plus, gemini-3.5-flash; OAuth do Grok da xAI como recurso de primeira classe no launcher do desktop; seletor de modelos com busca aproximada; atualização do catálogo a cada hora. Skills: conjunto padrão mais enxuto (Spotify → plugin nativo, Linear → hermes mcp install linear, skills inativas removidas), filtro de relevância environments: (kanban/docker/s6), tap confiável NVIDIA/skills por padrão e divulgação progressiva (com escopo) das ferramentas de MCP/plugins. Segurança: CVE-2026-48710 (Starlette BadHost) fixada em ≥1.0.1; verificações de SSRF fora do event loop; token bearer do Bedrock removido do ambiente de subprocessos; leitura de bws_cache.json protegida; docker restart/stop/kill adicionados aos padrões perigosos; sanitização de Unicode invisível. Resolvidos 2 P0 + 62 P1 (16 marcados como segurança). 20
2026-05-31 Guia v1.7.1: v0.15.1 (29 de maio de 2026, 01:12 UTC) — patch Velocity. Hotfix lançado no mesmo dia após o Velocity; linha da tag fixada v2026.5.29. Corrige o loop de recarregamento com erro 401 no dashboard que afetava implantações no modo loopback. Docker não trata mais --insecure como implícito — defina HERMES_DASHBOARD_INSECURE=1 explicitamente para reativá-lo. Comandos simples de MCP (npx, npm, node) voltam a ser resolvidos corretamente dentro de contêineres Docker. Os indicadores de origem e a barra lateral de categorias da página Skills voltam a ser renderizados. Workers do Kanban respondem corretamente ao SIGTERM, sem deixar processos órfãos. O catálogo do Skills.sh foi ampliado de 858 para 19.932 entradas por meio da descoberta via sitemap. 28 commits, 21 PRs mesclados, 9 colaboradores. v0.15.2 (29 de maio de 2026, 13:37 UTC) — patch de empacotamento do Velocity. Corrige as distribuições wheel e sdist para incluir manifestos plugin.yaml, permitindo que instalações pelo PyPI funcionem sem carregar a árvore de código-fonte separadamente. Hotfix exclusivo de empacotamento, 4 colaboradores. 27
2026-05-28 Guia v1.7: Adicionada a v0.15.0 (28 de maio de 2026) — The Velocity Release (tag v2026.5.28). Destaque: uma enorme rodada de refatoração + novos componentes de orquestração. Refatoração da base de código: run_agent.py foi reduzido em 76% (de 16.083 para 3.821 linhas), distribuídas entre 14 módulos coesos. Multi-agent Kanban v2: decomposição automática de objetivos de alto nível em subtarefas, topologia de swarm para coordenação de workers paralelos, substituições de modelo por tarefa, tarefas agendadas e gerenciamento de worktrees. Desempenho: mais 1 segundo economizado na inicialização a frio; redução de 47% nas chamadas de função por conversa; session_search reformulado para ser 4.500× mais rápido, com a dependência de LLM removida (eliminando também seu custo de API). Segurança: a defesa Promptware protege contra injeções de prompt da classe Brainworm em três pontos de controle de segurança; a integração com o Bitwarden Secrets Manager substitui várias chaves de API, uma por provedor, por um único token de bootstrap. Pacotes de skills: carregue várias skills simultaneamente com um único slash command. Orquestrador de sessões da TUI: gerenciamento de várias sessões em uma única janela de terminal. Novos provedores: Krea 2 (Medium/Large) e suporte ao plugin FAL para geração de imagens; a rodada de integração da xAI adiciona plugin de busca na web, upstream de OAuth, detecção de modelos descontinuados e pausas naturais no TTS. Estatísticas: 1.302 commits, 747 PRs mesclados, 321 colaboradores da comunidade. Segundo as notas da versão de GitHub, um patch lançado no mesmo dia ou no dia seguinte corrige o loop de recarregamento com erro 401 no dashboard, a variável de ambiente explícita de --insecure do Docker, a resolução de comandos simples de MCP no Docker (npx, npm, node), a restauração da página Skills, o tratamento de SIGTERM pelos workers do Kanban e o catálogo completo de 19.932 entradas de Skills por meio do sitemap. 28
2026-05-21 Guia v1.6: Adicionada a v0.14.0 (16 de maio de 2026) — The Foundation Release. Destaque: uma base mais leve de instalação/runtime, além de superfícies mais amplas de provedores, gateway, mídia e verificação. Adicionados OAuth do SuperGrok com contexto de 1M do grok-4.3, hermes proxy compatível com OpenAI para provedores de OAuth, x_search como recurso de primeira classe, pip install hermes-agent, instalações preguiçosas de dependências, inicialização ~19 s mais rápida, chamadas CDP do navegador 180× mais rápidas, LINE + SimpleX Chat para um total de 22 plataformas de mensagens, Microsoft Teams de ponta a ponta, /handoff, /subgoal, botões nativos de esclarecimento no Telegram/Discord, preenchimento retroativo do histórico do Discord, vision_analyze com pixels brutos, rodapé de verificação de alterações em arquivos por turno, diagnósticos semânticos de LSP a cada gravação, video_generate unificado, computer_use por meio do cua-driver para provedores que não sejam Anthropic, URLs clicáveis com OSC8, suporte ao Zed ACP Registry, roteador OpenRouter Pareto Code, NovitaAI, runtime do Codex app-server, tap confiável huggingface/skills, 9 skills opcionais, ctx.llm/tool_override para plugins, busca na web com Brave/DDGS, mudança de nome do Qwen Cloud, versão beta nativa para Windows e resolução de 12 P0/50 P1. 19
2026-05-07 Guia v1.5: Adicionada a v0.13.0 (7 de maio de 2026) — The Tenacity Release. Destaque: um quadro Multi-agent Kanban durável (heartbeat, recuperação, detecção de zumbis, bloqueio de alucinações, max_retries por tarefa e quadros para vários projetos) que transforma swarms em um componente de primeira classe, em vez de um padrão de delegação. O comando /goal mantém o agente concentrado em um objetivo entre turnos (padrão de loop Ralph como slash command). Nova ferramenta video_analyze, priorizando Gemini e com suporte extensível a modelos compatíveis. Provedor de TTS xAI Custom Voices com clonagem de voz. i18n em 7 idiomas (zh-Hans, ja, de, es, fr, uk, tr) para mensagens de CLI e gateway; documentação somente em zh-Hans. Google Chat como a 20ª plataforma de mensagens por meio do padrão de adaptadores conectáveis; IRC + Microsoft Teams migrados para o mesmo padrão. ProviderProfile ABC + plugins/model-providers/ para provedores conectáveis de terceiros sem alterações no núcleo. Retomada automática de sessões após reinicialização do gateway, /update e recarregamento de arquivos-fonte. Reescrita dos checkpoints v2 com armazenamento único, limpeza real e proteções de disco. Oito correções de segurança P0: ocultação de segredos ativada por padrão, contorno de DMs entre servidores no Discord (CVSS 8.1), rejeição de desconhecidos + silenciamento de conversas consigo mesmo no WhatsApp, TOCTOU do OAuth de MCP, TOCTOU do auth.json de CLI, proteção mínima contra SSRF no navegador, verificação de injeção de prompt no cron e ocultação de dados no hermes debug share. Lint após gravação para Python/JSON/YAML/TOML, modo no_agent do cron apenas para scripts, listas de permissões de plataformas no Slack/Telegram/Mattermost/Matrix/DingTalk e melhorias de MCP (transporte SSE, encaminhamento de OAuth, tags MEDIA para imagens). Estatísticas desde a v0.12.0: 864 commits, 588 PRs mesclados, 829 arquivos alterados, 295 colaboradores da comunidade e 282 problemas resolvidos (13 P0, 36 P1). 18
2026-05-06 Guia v1.4: Adicionada a v0.12.0 (30 de abril de 2026) — The Curator Release. Destaque: um Curator autônomo em segundo plano executado pelo ticker de cron do gateway (ciclo padrão de 7 dias), que avalia a biblioteca de skills com uma rubrica, remove skills inativas, consolida skills relacionadas e grava relatórios de cada execução — Hermes faz a própria manutenção entre sessões ativas. O loop de autoaperfeiçoamento foi atualizado com avaliação baseada em rubrica, preferência por atualizações ativas, herança correta de runtime e toolsets com escopo restrito à memória e às skills. Quatro novos provedores de inferência: GMI Cloud, Azure AI Foundry, OAuth do MiniMax e Tencent Tokenhub. LM Studio promovido a recurso de primeira classe. Os manifestos remotos do catálogo de modelos agora são atualizados automaticamente, sem novas versões. Duas novas plataformas de mensagens: Microsoft Teams (19ª, por meio da arquitetura conectável de gateway) e Tencent Yuanbao (18ª, com texto + mídia nativos). Spotify nativo por meio de OAuth com PKCE e skill incluída; plugin do Google Meet para chamadas e transcrição; provedor de TTS local Piper. ComfyUI v5 + TouchDesigner-MCP passaram de opcionais para incluídos por padrão. Novas skills: Humanizer, claude-design, design-md, airtable. Adições de CLI: modo de execução única hermes -z, verificação prévia hermes update --check, slash command /reload-skills e estilos conectáveis de indicador de ocupado. A inicialização a frio visível da TUI foi reduzida em ~57% por meio da inicialização preguiçosa do agente e de imports preguiçosos. Segurança: ocultação de segredos desativada por padrão para evitar corrupção de payloads; lista rígida de bloqueio para comandos irrecuperáveis. Estatísticas: 1.096 commits, 550 PRs mesclados, 213 colaboradores da comunidade. 17
2026-04-25 Guia v1.3: Adicionada a v0.11.0 (23 de abril de 2026) — The Interface Release. Reescrita completa da TUI interativa em React/Ink, com backend RPC de Python JSON (tui_gateway); área de composição fixa, streaming ao vivo com suporte à área de transferência OSC-52, chaves estáveis para seletores, barra de status com cronômetro por turno e branch do git, confirmação em /clear, preset de tema claro e sobreposição para observar a criação de subagentes. Arquitetura de transporte conectável — conversão de formato e transporte HTTP extraídos para agent/transports/, simplificando a integração de provedores. AWS Bedrock nativo por meio da API Converse. Cinco novos caminhos de inferência: NVIDIA NIM, Arcee AI, Step Plan, OAuth do CLI Google Gemini e Vercel ai-gateway. GPT-5.5 por meio do OAuth do Codex — o novo modelo principal da OpenAI agora pode ser acessado por meio do OAuth do ChatGPT Codex, sem uma chave de API separada. QQBot (17ª plataforma de mensagens) com configuração por leitura de QR code e streaming. Expansão da superfície de plugins: slash commands, despacho de ferramentas, bloqueio de execução e transformação de resultados. /steer <prompt> — orientações durante a execução que injetam uma nota vista pelo agente em execução após a próxima chamada de ferramenta, sem interromper o turno nem invalidar o cache do prompt. Hooks de shell conectam scripts como hooks de ciclo de vida sem plugins de Python. Modo de entrega direta por webhook encaminha payloads diretamente para uma conversa da plataforma, ignorando o agente para fazer fan-out. Delegação mais inteligente, com funções de orquestrador, profundidade de criação configurável e coordenação de arquivos. O dashboard recebe um sistema de plugins, troca de tema em tempo real, i18n e responsividade para dispositivos móveis. Estatísticas desde a v0.9.0: 1.556 commits, 761 PRs mesclados, 1.314 arquivos alterados, 224.174 inserções e 29 colaboradores da comunidade. 29
2026-04-16 Guia v1.2: Adicionada a v0.10.0 — Nous Tool Gateway. Assinantes pagos do Nous Portal agora podem acessar ferramentas gerenciadas (busca na web com Firecrawl, geração de imagens com FAL/FLUX 2 Pro, TTS da OpenAI e automação do navegador com Browser Use) sem chaves extras de API. Ativação opcional por ferramenta por meio do novo campo de configuração use_gateway. O runtime prioriza o gateway em vez de chaves diretas de API quando ambos estão configurados. A variável de ambiente HERMES_ENABLE_NOUS_MANAGED_TOOLS foi removida. O CLI do Hermes Agent continua licenciado sob a MIT e totalmente gratuito. 30
2026-04-13 Guia v1.1: Adicionados os recursos das versões v0.8.0 e v0.9.0. Dashboard web local, modo /fast, plataformas iMessage + WeChat (16 no total), monitoramento de processos em segundo plano (watch_patterns), context engine conectável, hermes backup/hermes import, Termux/Android, provedores xAI + MiMo + Google AI Studio + Qwen, comando /debug e amplo reforço de segurança. 15 16
2026-04-10 Guia v1.0: Versão inicial que abrange o Hermes Agent v0.7.0. Autenticação de provedores, configuração, CLI, slash commands, ferramentas, skills, memória, gateway, cron, MCP, compressão, arquitetura, migração do OpenClaw, solução de problemas e perguntas frequentes.

Referências


  1. Nous Research, README do projeto “Hermes Agent” no GitHub. Fonte primária da descrição do produto (agente que se aprimora sozinho, vários provedores, gateway de mensagens, backends de terminal, evolução de skills, agendador cron e delegação) e do comando de uma linha da “Instalação rápida”

  2. Nous Research, “Provedores de IA” na documentação do Hermes Agent. Fonte primária da lista completa de provedores, dos métodos de autenticação de cada provedor (Nous Portal OAuth, código de dispositivo do Codex, tipos de token do Copilot no GitHub, três métodos de autenticação do Anthropic, provedores chineses de IA, roteamento do Hugging Face e endpoints personalizados), dos três métodos de autenticação (chave API no .env, OAuth via hermes model e endpoint personalizado no config.yaml), da sintaxe do comando de barra /model (incluindo custom:name:model), dos modelos de configuração do Ollama/vLLM/SGLang/llama.cpp/LM Studio, das instruções de rede para WSL2, da cadeia de detecção do tamanho do contexto, da configuração do modelo de fallback, do roteamento inteligente de modelos e dos provedores personalizados nomeados. Todos os nomes de variáveis de ambiente específicas de provedores, tipos de token, substituições da URL base e identificadores de modelos desta publicação vêm dessa página. 

  3. Nous Research, “Arquitetura” no guia para desenvolvedores do Hermes Agent. Fonte primária do diagrama de visão geral do sistema, da estrutura de diretórios, do fluxo de dados pelos caminhos de sessão e mensagens do gateway CLI, dos três modos API (chat_completions, codex_responses, anthropic_messages), da resolução de provedores via runtime_provider.py, da persistência de sessões via SQLite + FTS5, da lista de plataformas do gateway de mensagens, das fontes de descoberta do sistema de plugins, do isolamento de profiles e dos seis princípios de design. 

  4. Nous Research, “Configuração” no guia do usuário do Hermes Agent. Fonte primária da estrutura do diretório de configuração, da regra entre config.yaml e .env (“config.yaml prevalece para configurações que não sejam secretas”), da cadeia de precedência das configurações (argumentos CLI → env → config.yaml → .env → padrões), das configurações de compactação de contexto (bloco compression.* com threshold, target_ratio, protect_last_n, summary_model, summary_provider, summary_base_url), dos limites de pressão do orçamento (cautela em 70%, alerta em 90%), dos timeouts de streaming com ajuste automático para provedores locais e do bloco completo de configuração de modelos auxiliares (auxiliary: com os slots vision, web_extract, approval, compression, session_search, skills_hub, mcp, flush_memories). A restrição do provedor "main" aos slots auxiliares, de compactação e de fallback também vem dessa página. 

  5. Nous Research, “Migrar do OpenClaw” nos guias do Hermes Agent. Fonte do fluxo de migração do OpenClaw → Hermes. 

  6. Nous Research, “Referência de comandos CLI” na documentação de referência do Hermes Agent. Fonte primária de todos os comandos CLI de nível superior documentados nesta publicação, incluindo hermes chat, hermes model, hermes gateway, hermes setup, hermes auth, hermes status, hermes cron, hermes webhook, hermes doctor, hermes dump, hermes logs, hermes config, hermes pairing, hermes skills, hermes honcho, hermes memory, hermes acp, hermes mcp, hermes plugins, hermes tools, hermes sessions, hermes insights, hermes claw, hermes profile, hermes completion, hermes update e hermes uninstall. Todas as flags de subcomandos, descrições de opções, comportamentos do pool de credenciais, sintaxe de filtragem de logs, flags de migração do OpenClaw, comandos de gerenciamento de profiles e comandos de instalação de serviços desta publicação vêm dessa página. 

  7. Nous Research, “Instalação” no guia de introdução do Hermes Agent. Fonte primária do comando de instalação de uma linha, do comportamento do instalador (pré-requisitos, suporte a plataformas, detecção automática do Termux e requisitos do Windows/WSL2), da tabela de extras opcionais, das etapas de instalação manual e dos comandos de verificação. 

  8. Nous Research, “Referência de comandos CLI” — consulte especificamente a seção hermes dump, que descreve o formato de saída do comando (cabeçalho, ambiente, identidade, modelo, terminal, chaves API, recursos, serviços, carga de trabalho e substituições de configuração) e seu uso para compartilhar diagnósticos. 

  9. Nous Research, “Referência de comandos de barra” na documentação de referência do Hermes Agent. Fonte primária de todos os comandos de barra listados nesta publicação, da arquitetura COMMAND_REGISTRY, da separação entre CLI e mensagens, dos comandos de barra dinâmicos de skills, dos comandos rápidos no config.yaml, do comportamento de correspondência por prefixo e dos comandos exclusivos de mensagens (/status, /sethome, /approve, /deny, /update, /commands). 

  10. Nous Research, “Ferramentas e toolsets” no guia do usuário do Hermes Agent. Fonte primária da visão geral das categorias de ferramentas, dos comandos de uso de toolsets, dos seis backends de terminal (local, docker, ssh, singularity, modal, daytona), da configuração de contêineres (cpu, memória, disco, persistente), do reforço de segurança para contêineres, do gerenciamento de processos em segundo plano API e do suporte a sudo. 

  11. Nous Research, “Sistema de skills” no guia do usuário do Hermes Agent. Fonte primária da divulgação progressiva, do formato SKILL.md, das skills específicas de cada plataforma, da ativação condicional (fallback_for_toolsets, requires_toolsets, fallback_for_tools, requires_tools), das skills gerenciadas pelo agente via skill_manage, dos comandos do hub de skills e da lista de fontes (official, skills-sh, well-known, github, clawhub, claude-marketplace, lobehub), da verificação de segurança e dos níveis de confiança, além dos diretórios externos de skills. 

  12. Nous Research, “Memória persistente” no guia do usuário do Hermes Agent. Fonte primária dos limites de caracteres de MEMORY.md / USER.md, do padrão de snapshot congelado, das ações da ferramenta de memória (add, replace, remove), do que salvar ou ignorar, da comparação entre memória e busca de sessões e da lista de oito provedores externos de memória (Honcho, OpenViking, Mem0, Hindsight, Holographic, RetainDB, ByteRover, Supermemory). 

  13. Nous Research, “Personalidade e SOUL.md” no guia do usuário do Hermes Agent. Fonte primária do comportamento do SOUL.md (fica em HERMES_HOME, nunca é sobrescrito, ocupa o slot nº 1 no prompt do sistema e passa por uma verificação de segurança antes da inclusão), da diferença entre SOUL.md e AGENTS.md, da lista de personalidades integradas (14 personalidades, de helpful a hype), das personalidades personalizadas no config.yaml, do padrão de sobreposição de /personality e da ordem completa de montagem da pilha de prompts. 

  14. Nous Research, “Usar MCP com o Hermes” e Referência de configuração do MCP nos guias e na referência do Hermes Agent. Fonte do formato de configuração mcp_servers: no config.yaml, com os campos command, args e env

  15. Notas da versão 0.8.0 do Hermes Agent. 8 de abril de 2026. Notificações automáticas de processos em segundo plano, MiMo v2 Pro gratuito no Nous Portal, troca dinâmica com /model entre plataformas, provedor nativo do Google AI Studio, Qwen OAuth, timeouts baseados em inatividade, botões de aprovação no Slack/Telegram, MCP OAuth 2.1 PKCE, logs centralizados e expansão do sistema de plugins. 

  16. Notas da versão 0.9.0 do Hermes Agent. 13 de abril de 2026. Dashboard web local, Fast Mode (/fast), iMessage via BlueBubbles, WeChat + WeCom, Termux/Android, monitoramento de processos em segundo plano (watch_patterns), provedores nativos xAI + Xiaomi MiMo, context engine conectável, suporte unificado a proxy, reforço de segurança (correções de path traversal, shell injection, SSRF e RCE), hermes backup/hermes import, /debug + hermes debug share, 16 plataformas compatíveis. 487 commits, 269 PRs mesclados, 24 colaboradores. 

  17. Notas de lançamento do Hermes Agent v0.12.0. 30 de abril de 2026. “A versão Curator.” Curator autônomo em segundo plano que avalia, remove e consolida a biblioteca de skills em um ciclo padrão de 7 dias executado pelo cron do gateway. Loop de autoaperfeiçoamento atualizado: avaliação baseada em rubricas, viés para atualizações ativas, herança adequada do ambiente de execução e toolsets com escopo restrito à memória e às skills. Quatro novos provedores de inferência: GMI Cloud, Azure AI Foundry, MiniMax OAuth, Tencent Tokenhub. LM Studio promovido a recurso de primeira classe. Manifestos remotos do catálogo de modelos são atualizados automaticamente sem novos lançamentos. Duas novas plataformas de mensagens: Microsoft Teams (19ª, por meio da arquitetura conectável do gateway) e Tencent Yuanbao (18ª, com texto e mídia nativos). Spotify nativo via PKCE OAuth com skill incluída; plugin do Google Meet para chamadas e transcrição; provedor local de TTS Piper. ComfyUI v5 + TouchDesigner-MCP incluídos por padrão. Novas skills: Humanizer, claude-design, design-md, airtable. CLI: modo de execução única hermes -z, verificação preliminar hermes update --check, comando de barra /reload-skills e estilos conectáveis de indicador de atividade. Inicialização a frio da TUI reduzida em cerca de 57% por meio da inicialização sob demanda. Segurança: ocultação de segredos desativada por padrão; lista rígida de bloqueio para comandos irrecuperáveis. Estatísticas desde a v0.11.0: 1.096 commits, 550 PRs mesclados e 213 colaboradores da comunidade. Veja também: tag de lançamento v2026.4.30

  18. Notas de lançamento do Hermes Agent v0.13.0. 7 de maio de 2026. “A versão Tenacity.” Quadro Kanban multiagente com heartbeat, recuperação de tarefas, detecção de processos zumbis, barreira contra alucinações, max_retries por tarefa e quadros para vários projetos. Comando de barra /goal para fixar metas entre turnos (primitiva do loop Ralph), com limite configurável de turnos. Ferramenta video_analyze, priorizando Gemini e com extensibilidade multimodal compatível. Provedor de TTS xAI Custom Voices com clonagem de voz. Internacionalização para 7 idiomas: zh-Hans, ja, de, es, fr, uk, tr (CLI + mensagens do gateway; documentação somente em zh-Hans). Google Chat como a 20ª plataforma de mensagens, usando um padrão de adaptadores conectáveis com hooks genéricos de plugin env_enablement_fn / cron_deliver_env_var; IRC e Microsoft Teams migrados para o mesmo padrão. Classe abstrata ProviderProfile + plugins/model-providers/ para provedores de terceiros conectáveis. Retomada automática da sessão após reinicialização do gateway, /update e recarregamento de arquivos-fonte. Reescrita dos checkpoints v2 com armazenamento único, limpeza efetiva, proteções de disco e sem repositórios sombra órfãos. Oito correções de segurança P0: ocultação de segredos ativada por padrão, contorno de DM entre servidores do Discord (CVSS 8.1, listas de permissões de funções restritas ao servidor), WhatsApp rejeitando desconhecidos por padrão + nunca responder na conversa consigo mesmo, condição TOCTOU ao salvar credenciais de MCP OAuth, condição TOCTOU em auth.json de CLI nos gravadores de credenciais, proteção mínima contra SSRF em metadados de nuvem do navegador no roteamento híbrido, verificação de prompts montados pelo cron (incluindo conteúdo de skills) contra injeção de prompt e ocultação do conteúdo dos logs de hermes debug share no momento do upload. Outros itens relevantes: lint após gravação para Python/JSON/YAML/TOML, modo watchdog no_agent do cron somente para scripts, listas de permissões de plataforma para Slack/Telegram/Mattermost/Matrix/DingTalk, melhorias em MCP (transporte SSE, encaminhamento de OAuth, resultados de imagens como tags MEDIA). Estatísticas desde a v0.12.0: 864 commits, 588 PRs mesclados, 829 arquivos alterados, 295 colaboradores da comunidade e 282 issues encerradas (13 P0, 36 P1). 

  19. Notas de lançamento do Hermes Agent v0.14.0. 16 de maio de 2026. “A versão Foundation.” Desde a v0.13.0: 808 commits, 633 PRs mesclados, 1.393 arquivos alterados, 165.061 inserções, 545 issues encerradas (12 P0, 50 P1) e 215 colaboradores da comunidade. Adiciona SuperGrok OAuth com contexto de 1 milhão do grok-4.3, hermes proxy, x_search, empacotamento para PyPI, dependências carregadas sob demanda, cache de prompt Claude de 1 hora entre sessões, inicialização cerca de 19 segundos mais rápida, chamadas CDP do navegador 180 vezes mais rápidas, LINE e SimpleX Chat, totalizando 22 plataformas de mensagens, /handoff, botões nativos de esclarecimento, preenchimento retroativo do histórico do Discord, vision_analyze com pixels brutos, rodapé verificador de alterações de arquivos a cada turno, diagnósticos semânticos via LSP, video_generate unificado, computer_use com cua-driver, links OSC8, suporte ao Zed ACP Registry, roteador OpenRouter Pareto Code, NovitaAI, ambiente de execução do app-server do Codex, huggingface/skills, ctx.llm de plugin, tool_override, pesquisa com Brave/DDGS, reforço contra comandos perigosos, /subgoal, renomeação do Qwen Cloud, beta nativo para Windows, 16 localidades no total e amplas atualizações na documentação e nos testes. 

  20. Notas da versão Hermes Agent v0.16.0, “The Surface Release”, tag v2026.6.5, publicada em 6 de junho de 2026 às 00:55:58 UTC (data do tag da versão: 5 de junho de 2026); mais recente em 8 de junho de 2026. Novo Hermes Desktop nativo (Electron, macOS/Linux/Windows; conexão com gateway remoto por WebSocket seguro com OAuth ou usuário/senha; hosts remotos por profile; links @session entre profiles; interface em chinês simplificado por meio de i18n tipada, display.language). O dashboard web foi expandido para um painel administrativo completo (controles de ativação do catálogo de MCP, gerenciamento de credenciais, criação de webhooks/hooks, configuração de memória, controles do gateway, página System com verificação antes de atualizações + Debug Share e página Channels; autenticação extensível, incluindo OIDC auto-hospedado e hermes dashboard register). Novos comandos: /undo [N], interface padrão configurável (cli/tui, --cli), /model da TUI + sobreposição Sessions, hermes portal, hermes prompt-size, hermes sessions optimize. Novos modelos: deepseek-v4-flash, MiniMax-M3 (contexto de 1M), qwen3.7-plus, gemini-3.5-flash; OAuth do xAI Grok; seletor com busca aproximada; atualização do catálogo a cada hora. Skills: conjunto padrão mais enxuto, filtro de relevância environments:, tap confiável padrão NVIDIA/skills, divulgação progressiva de ferramentas, correção de falso sucesso de OAuth de MCP. Segurança: CVE-2026-48710 (Starlette BadHost) fixada na versão ≥1.0.1, verificações de SSRF retiradas do event loop, token bearer do Bedrock removido do ambiente de subprocessos, leitura de bws_cache.json protegida, inclusão de docker restart/stop/kill nos padrões perigosos e sanitização de Unicode invisível; 2 itens P0 + 62 P1 encerrados (16 marcados como segurança). O discurso de marketing das notas da versão (contagens de PRs/commits, “nada disso existia há uma semana”) foi excluído; foram registrados apenas fatos concretos sobre recursos e versões vinculados ao tag. Verificação na sessão atual em 8 de junho de 2026. 

  21. Notas da versão Hermes Agent v0.17.0, “The Reach Release”, tag v2026.6.19, 19 de junho de 2026; mais recente em 21 de junho de 2026. Mensagens: iMessage por meio do Photon Spectrum (OAuth por código de dispositivo, hermes photon login, sem retransmissão por Mac); adaptador oficial da API do WhatsApp Business Cloud (substitui o processo de bridge); grupos do SimpleX, anexos nativos, agrupamento de textos e aceitação automática; plugin de plataforma Raft incluído. Modelos/provedores: z-ai/glm-5.2 (contexto de 1M), anthropic/claude-fable-5, laguna-m.1, nemotron-3-ultra, grok-composer-2.5-fast (OAuth da xAI, contexto de 200k); padrão da xAI → grok-build-0.1; modelos adaptativos de Anthropic usam o contrato moderno de raciocínio (sem o campo reasoning). CLI/comandos slash: /version, /billing, hermes photon login, hermes curator run --consolidate (opcional), interface gráfica de hermes model, clonagem de profiles. Desktop: janelas de acompanhamento de subagentes em segundo plano (delegate_task(background=true)), seletor de modelo do Composer, atalhos reconfiguráveis, notificações nativas do sistema operacional, rascunhos por thread, temas do VS Code Marketplace e interface em japonês + chinês tradicional. Dashboard: construtor completo de profiles, seletor global de profile, reformulação do Skills Hub com verificação de segurança, Automation Blueprints e login seguro (401 protegido por OAuth). Skills/ferramentas: edição de imagem para imagem com image_generate em vários provedores, lote atômico de operations da memory, skill simplify-code para revisão paralela, write_approval booleano substitui write_mode. Arquitetura: subagentes em segundo plano (o identificador é retornado imediatamente e o resultado volta como um turno), manipulador de elicitação de MCP para confirmação durante a chamada de ferramenta, ferramentas de MCP conectadas tardiamente expostas entre turnos, CronScheduler extensível + cron gerenciado pelo Chronos, escopo Managed (/etc/hermes fixado pelo administrador), retransmissão Gateway-Gateway. Segurança: brecha na lista de bloqueio de escapes do shell corrigida, falha segura na ausência do módulo de aprovação e em adaptadores de gateway com política própria, ambiente de scripts de jobs cron sanitizado, segredos ocultados em dumps de debug, metadados do host omitidos do status público, verificação de padrões de exfiltração no stdio de MCP, atualizações de urllib3 + PyJWT contra CVEs. O discurso de marketing da versão (contagens de commits/PRs) foi excluído. Verificação na sessão atual em 21 de junho de 2026. 

  22. Notas da versão Hermes Agent v0.18.0 (tag v2026.7.1), 1º de julho de 2026 — “The Judgment Release”. Revisão das pendências prioritárias (todos os itens P0/P1 encerrados, cerca de 692 itens em 12 dias); Mixture-of-Agents selecionável como modelo de primeira classe em todas as interfaces, com a saída completa de cada modelo de referência renderizada em seu próprio bloco identificado e transmissão ao vivo da resposta; contratos de conclusão para /goal (o agente verifica o próprio trabalho executando as verificações do projeto); comando /learn (transforma qualquer coisa em uma skill reutilizável por meio de uma descrição, com conformidade automática com CONTRIBUTING.md); linha do tempo visual /journey de memória/skills com edição e um grafo de memória no desktop; distribuição de subagentes em segundo plano (várias tarefas delegadas simultâneas); Desktop Projects (modelo de projeto/repositório/lane); gateway com escalonamento a zero e coordenação de drenagem; suporte ao Google Vertex AI (Gemini por meio de contas de serviço do GCP, com atualização automática do token OAuth2); comando /prompt para $EDITOR. Verificação na sessão atual em 1º de julho de 2026 (PST) na página de versões do GitHub; a v0.18.0 é a versão mais recente. 

  23. Notas da versão Hermes Agent v0.20.3 (tag v2026.8.16.2, data declarada da versão: 16 de agosto; publicada em 17 de agosto de 2026) e notas da versão v0.20.4 (tag v2026.8.18, 18 de agosto de 2026); ambas obtidas por meio da API do GitHub em 20 de agosto de 2026 (pré-lançamento: falso). Texto literal da v0.20.3: “a migração do SDK de MCP 2.x e o suporte ao protocolo sem estado de 28 de julho de 2026, o plugin Bot Mode (hermes-bots) incluído com o protocolo principal de colegas de equipe, o plugin do provedor CommandCode, o reforço da propriedade do runtime de Python em subprocessos (isolamento de PYTHONHOME/PYTHONPATH), contratos de runtime do Cua Driver 0.20 para uso do computador”. Texto literal da v0.20.4: “o trabalho de superfícies com vidro/translucidez no desktop (vidro fosco, seletor de efeito frost, pré-seleção no macOS), a barra lateral com abas SESSIONS|BOTS e a opção de ocultar/exibir cada bot, … verificação consultiva NVIDIA SkillEvaluator Tier 1 na instalação de skills (verificações de licença + segurança)”. Ambas as versões: “As notas completas e selecionadas das versões deste período serão publicadas com a v0.21.0”. 

  24. Notas da versão Hermes Agent v0.20.0, “The Herald Release”, tag v2026.8.3, 3 de agosto de 2026, com os tags de estabilização v2026.8.13 e v2026.8.16. Texto literal da versão: “Node 26 obrigatório em instaladores/heal/upgrade”; “canais brew + wheel pip/PyPI descontinuados (instalador shell / Docker / Nix são os canais compatíveis)”; “limite padrão de iterações 90 → 500”; “fonte claude-marketplace removida”. A versão mínima do Node foi confirmada de forma independente no código-fonte do instalador em scripts/install.shNODE_VERSION="26" e a verificação “Node.js $(node –version) é antigo demais (Hermes requer Node >=26)” —, que também documenta o comando canônico de uma linha curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash no comentário do cabeçalho. Observe o conflito: a página de instalação da documentação ainda informa Node v22 e está desatualizada em relação a ambos. Níveis de plataforma obtidos em suporte a plataformas; fontes das skills e taps padrão obtidos em skills; a contagem de 28 plataformas foi obtida enumerando a tabela comparativa em mensagens, que não publica um total oficial. Todo o conteúdo foi obtido e verificado em 16 de agosto de 2026. 

  25. Notas de lançamento do Hermes Agent v0.19.0, “The Quicksilver Release”, tag v2026.7.20, 20 de julho de 2026; versão mais recente em 21 de julho de 2026. Estatísticas desde a v0.18.0: cerca de 2.245 commits, cerca de 1.065 PRs mesclados, cerca de 3.300 issues encerradas e mais de 450 colaboradores da comunidade. Eixo de desempenho: redução de cerca de 80% no TTFT do primeiro turno, com o tempo a frio entre envio e despacho caindo de cerca de 4,3 s para cerca de 0,9 s em CLI/gateway/TUI/desktop/cron (PR nº 59332); raciocínio transmitido ao vivo por padrão, com display.show_reasoning ativado e renderização da resposta token por token (PR nº 59389); onda de desempenho no desktop com cerca de 20 PRs, incluindo renderização de Markdown em streaming 14 vezes mais rápida; Markdown incremental na TUI. Instalações via pip/Homebrew foram descontinuadas e agora exibem apenas o aviso “unsupported legacy”, com a remoção da publicação no PyPI/Homebrew planejada (PR nº 57225). Interface SecretSource extensível com provedores Bitwarden e 1Password, referências op://, múltiplos cofres, precedência determinística e procedência por variável (PR nº 59498). Aprovações inteligentes por padrão (revisor LLM independente para cada comando sinalizado), regras de negação definidas pelo usuário que continuam valendo no modo YOLO e /deny <reason> (PRs nº 62661, nº 59164, nº 54518); escalonamento de aprovação por pre_tool_call de plugins reintroduzido (PR nº 60504). Cobrança pelo terminal com /subscription + /topup + aba de cobrança no desktop (PR nº 51639). Arquivos de transcrição ao vivo de subagentes + delegação durável em segundo plano (PRs nº 67479, nº 63494); registro de obrigações de entrega no state.db (PR nº 67181); max_async_children descontinuado em favor de limites unificados de simultaneidade da delegação (PR nº 56955). Roteamento do gateway baseado em profile + GATEWAY_MULTIPLEX_PROFILES + índice de roteamento movido para state.db, com sessions.json como espelho legado opcional (PRs nº 64835, nº 65700, nº 60589, nº 59203). Provedores/modelos: suporte nativo ao Fireworks AI, na posição nº 2 do seletor (PR nº 62593), DeepInfra, Upstage Solar, GPT-5.6 Sol/Terra/Luna + Pro de ponta a ponta (PR nº 61616), grok-4.5 em disponibilidade geral, kimi-k3 (kimi-k2.x descontinuado), Claude Sonnet 5 totalmente integrado, enabled: false por provedor + excluded_providers (PR nº 67971); níveis max/ultra de esforço de raciocínio, com substituições por modelo/slot de MoA e /reasoning com escopo de sessão (PRs nº 62650, nº 64458). CLI/MCP: hermes sessions export para Markdown/Quarto/HTML/somente prompt/HF-trace com --redact (PR nº 60186), /model --once (PR nº 67113), invocações empilhadas de slash-skills (PR nº 57987), --safe-mode, hermes config get/unset (PR nº 65540), hermes serve realmente headless (PR nº 55923), nomenclatura MCP mcp__server__tool (PR nº 52750). O enquadramento de marketing do lançamento foi excluído; itens revertidos durante o período (firewall de saída iron-proxy, skill dynamic-workflow e ações de provedor de memória) não foram deliberadamente registrados como entregues. Verificação na sessão atual em 21 de julho de 2026. 

  26. Tag de lançamento do Hermes Agent v0.18.1 e tag de lançamento da v0.18.2, 7–8 de julho de 2026. Compilações cumulativas de patches de infraestrutura na linha v0.18; a correção relevante da v0.18.2 remove a fixação da versão do WhatsApp Baileys para usar a 7.0.0-rc13 e garantir builds Docker confiáveis. As duas janelas de patches foram incorporadas às notas de lançamento da v0.19.0 e estão totalmente documentadas nelas. 

  27. Notas de lançamento do Hermes Agent v0.15.1 e notas de lançamento do Hermes Agent v0.15.2. A v0.15.1 (29 de maio de 2026, 01:12 UTC) é o hotfix Velocity lançado no mesmo dia: correção do loop de recarregamento com erro 401 no dashboard em modo loopback; Docker agora exige HERMES_DASHBOARD_INSECURE=1 explicitamente; comandos MCP sem caminho (npx, npm, node) são resolvidos em contêineres Docker; os indicadores de origem e a barra lateral de categorias da página Skills foram restaurados; workers Kanban respondem a SIGTERM; o catálogo Skills.sh cresceu de 858 para 19.932 entradas por meio do sitemap. 28 commits, 21 PRs mesclados e 9 colaboradores. A v0.15.2 (29 de maio de 2026, 13:37 UTC) é um hotfix exclusivo de empacotamento que inclui manifestos plugin.yaml nas distribuições wheel e sdist para que instalações via PyPI funcionem sem carregar o código-fonte separadamente. 4 colaboradores. 

  28. Notas de lançamento do Hermes Agent v0.15.0 e a página de lançamentos do Hermes Agent. “The Velocity release”, tag v2026.5.28. Estatísticas: 1.302 commits, 747 PRs mesclados e 321 colaboradores da comunidade. Refatora 76% de run_agent.py (de 16.083 para 3.821 linhas, distribuídas entre 14 módulos). Adiciona a plataforma Kanban multiagente (decomposição automática, topologia de swarm, substituições de modelo por tarefa, tarefas agendadas e gerenciamento de worktrees). session_search foi reformulado e ficou 4.500 vezes mais rápido, com a dependência LLM removida. Defesa contra promptware para injeções de prompt da classe Brainworm em três pontos críticos de segurança. A integração com o Bitwarden Secrets Manager substitui várias chaves API específicas de cada provedor por um único token de bootstrap. Pacotes de skills permitem carregar várias skills com um único comando slash. Orquestrador de sessões na TUI para gerenciar várias sessões em uma única janela do terminal. Suporte ao Krea 2 (Medium/Large) e ao plugin FAL para geração de imagens. Uma rodada de integração com xAI adiciona um plugin de pesquisa na web, OAuth upstream, detecção de modelos descontinuados e pausas naturais de TTS na saída de voz. Uma versão de patch mencionada em GitHub corrige o loop de recarregamento com erro 401 no dashboard, a exigência da variável de ambiente HERMES_DASHBOARD_INSECURE=1 explícita para usar --insecure em Docker, a resolução de comandos MCP sem caminho (npx, npm, node) em Docker, a renderização da página Skills, o tratamento de SIGTERM pelos workers Kanban, o catálogo completo de Skills com 19.932 entradas por meio do sitemap e um pequeno conjunto de ajustes na entrega de arquivos .md, na segurança das sondagens do gateway, na ocultação de URLs da web, no recurso de visão do kanban-worker e nos padrões de observação hindsight. 

  29. Notas de lançamento do Hermes Agent v0.11.0. 23 de abril de 2026. “The Interface release” — reformulação completa do CLI interativo com React/Ink e um backend Python JSON-RPC (tui_gateway); arquitetura de transporte extensível (agent/transports/); suporte nativo ao AWS Bedrock pela API Converse; cinco novos caminhos de inferência (NVIDIA NIM, Arcee AI, Step Plan, Google Gemini CLI OAuth, Vercel ai-gateway); GPT-5.5 via Codex OAuth; QQBot como a 17ª plataforma de mensagens, com configuração por leitura de código QR; superfície de plugins ampliada (comandos slash, despacho de ferramentas, bloqueio de execução e transformação de resultados); /steer <prompt> para orientar o agente durante a execução, injetando contexto após a próxima chamada de ferramenta sem invalidar o cache do prompt; hooks de shell para eventos do ciclo de vida sem plugins Python; modo de entrega direta por webhook que encaminha payloads diretamente a um chat da plataforma; delegação mais inteligente, com funções de orquestrador + profundidade de criação configurável + coordenação de arquivos; sistema de plugins do dashboard, troca de tema em tempo real, i18n e responsividade para dispositivos móveis. Estatísticas desde a v0.9.0: 1.556 commits · 761 PRs mesclados · 1.314 arquivos alterados · 224.174 inserções · 29 colaboradores da comunidade. Veja também: tag de lançamento GitHub do Hermes Agent v0.11.0

  30. Notas de lançamento do Hermes Agent v0.10.0. 16 de abril de 2026. “O lançamento do Tool Gateway.” Integração com o Nous Tool Gateway para assinantes pagos do Nous Portal — acesso gerenciado à pesquisa na web do Firecrawl, à geração de imagens do FAL / FLUX 2 Pro, ao TTS da OpenAI e à automação de navegador do Browser Use, sem chaves API adicionais. Ativação individual por ferramenta por meio do novo campo de configuração use_gateway. Durante a execução, o gateway tem prioridade sobre as chaves API diretas quando ambos estão configurados. Integração completa com hermes tools e hermes status. Substitui a variável de ambiente obsoleta HERMES_ENABLE_NOUS_MANAGED_TOOLS. Implementação de @jquesnelle (emozilla). O CLI do Hermes Agent continua licenciado sob a licença MIT e é totalmente open source; o gateway é uma integração com o produto de assinatura Portal já existente, não um paywall para o CLI. Veja também: Nous Portal para consultar os preços das assinaturas e fazer o cadastro. 

NORMAL hermes.md EOF