Skip to main content
PromptQuorum
Início/LLMs locais avançados/Hermes Agent 2026: agente de IA auto-hospedado
Local AI Agents & Tool Use

Hermes Agent 2026: agente de IA auto-hospedado

·12 min de leitura·Por Hans Kuepper · Fundador do PromptQuorum, ferramenta de despacho multi-modelo de IA · PromptQuorum

Hermes Agent é um agente de IA autônomo de código aberto e auto-hospedável criado pela Nous Research (github.com/NousResearch/hermes-agent, licença MIT, lançado em fevereiro de 2026). Roda localmente com Hermes 4.3 via Ollama ou Hugging Face, ou com mais de 200 modelos do OpenRouter, e pode ser acessado por terminal, Telegram, Discord, Slack, WhatsApp, Signal ou e-mail.

Hermes Agent é um agente de IA pessoal autônomo de código aberto da Nous Research, lançado em fevereiro de 2026 sob licença MIT (confirmado pelo arquivo LICENSE em github.com/NousResearch/hermes-agent). Ele roda localmente com o modelo Hermes 4.3 da Nous Research via Ollama ou Hugging Face, ou com mais de 200 modelos hospedados via OpenRouter, e pode ser acessado por terminal ou por plataformas de mensagens como Telegram, Discord, Slack, WhatsApp, Signal e e-mail.

Hermes Agent 2026: agente de IA auto-hospedado

Principais conclusões

  • Criado pela Nous Research, lançado em fevereiro de 2026, licença MIT (github.com/NousResearch/hermes-agent)
  • Dois caminhos de modelo: Hermes 4.3 local via Ollama/Hugging Face, ou 200+ modelos via OpenRouter (Claude, GPT-4, Gemini, Qwen e DeepSeek confirmados como compatíveis)
  • Loop de habilidades autoaperfeiçoável: o agente cria e refina suas próprias habilidades a partir da experiência, em vez de depender apenas de um conjunto fixo de ferramentas
  • Memória persistente de longo prazo entre sessões, não apenas dentro de uma única janela de conversa
  • Pontos de acesso: terminal, Telegram, Discord, Slack, WhatsApp, Signal, e-mail
  • Faixa de auto-hospedagem: de um VPS de $5/mês até um cluster de GPU, além de opções serverless (Daytona, Modal)
  • Site oficial: hermes-agent.org. Não existe programa de afiliados para o Hermes Agent neste site — cada link abaixo é um link simples e declarado.

📍 Em uma frase

Hermes Agent é o agente pessoal autônomo da Nous Research, licenciado sob MIT e auto-hospedável, que combina um loop de habilidades autoaperfeiçoável e memória persistente de longo prazo com a opção de inferência local (Hermes 4.3 via Ollama ou Hugging Face) ou mais de 200 modelos hospedados via OpenRouter, acessível por terminal ou por Telegram, Discord, Slack, WhatsApp, Signal e e-mail.

💬 Em termos simples

É um programa que você roda no próprio servidor e que age como um assistente pessoal: ele lembra de conversas passadas, escreve e refina suas próprias rotinas reutilizáveis ("habilidades") conforme trabalha, e você pode mandar mensagem para ele como manda para uma pessoa — pelo Telegram ou Discord, não só em uma janela de terminal.

📌Note: Segundo a TechCrunch, a Nous Research estaria em conversas para uma nova rodada de investimento com avaliação de US$ 1,5 bi em julho de 2026. "Em conversas" não é uma rodada fechada — trate isso como contexto sobre a empresa, não como confirmação de que o investimento aconteceu.

O que é o Hermes Agent?

Hermes Agent é o agente de IA pessoal autônomo de código aberto da Nous Research, publicado no GitHub em github.com/NousResearch/hermes-agent e lançado em fevereiro de 2026 sob licença MIT. Diferente de uma interface de chat acessada pelo navegador, o Hermes Agent é um software que você instala e roda continuamente na sua própria máquina ou servidor, onde ele pode manter contexto entre sessões e agir sobre tarefas sem que você precise reexplicar o histórico toda vez.

  • Ideia central: um processo de agente persistente, não uma sessão de chat pontual — ele continua rodando e mantém sua memória entre interações
  • Independente de modelo: funciona com o modelo Hermes 4.3 da Nous Research localmente, ou com qualquer um dos 200+ modelos disponíveis via OpenRouter
  • Modelos em nuvem confirmados como compatíveis via OpenRouter: Claude, GPT-4, Gemini, Qwen e DeepSeek
  • Duas capacidades distintivas o diferenciam de um chatbot comum: um loop de habilidades autoaperfeiçoável e memória persistente de longo prazo (ambas cobertas na próxima seção)
  • Distribuído sob licença MIT — permissiva, sem restrição para uso comercial ou modificação, confirmado ao ler diretamente o arquivo LICENSE do repositório

Como funciona o loop de habilidades autoaperfeiçoável?

O Hermes Agent cria e refina suas próprias "habilidades" a partir da experiência, em vez de vir apenas com um conjunto fixo e codificado manualmente de ferramentas. Uma habilidade, nesse contexto, é uma rotina reutilizável que o agente constrói depois de realizar uma tarefa, para não precisar rederivar a abordagem do zero na próxima vez.

  • O agente observa o resultado das próprias ações e pode escrever uma nova habilidade, ou revisar uma existente, com base no que funcionou ou falhou
  • Isso é combinado com memória persistente de longo prazo — o agente retém informações entre sessões em vez de começar com contexto vazio a cada mensagem
  • Efeito prático: solicitações repetidas ou semelhantes devem ser tratadas com mais rapidez e consistência ao longo do tempo, porque o agente não resolve o mesmo problema do zero em cada execução

📌Note: Este site não mediu de forma independente a rapidez com que o loop de habilidades do Hermes Agent melhora a precisão ou a velocidade em uma tarefa específica, e nenhum número desse tipo está publicado como benchmark de terceiros verificado até o momento. Trate "autoaperfeiçoável" como um comportamento arquitetural descrito, não como uma afirmação de desempenho medido, até testar você mesmo na sua carga de trabalho.

Como rodar o Hermes Agent localmente com Ollama

O Hermes Agent suporta dois backends de modelo: um caminho local via Ollama ou Hugging Face com o modelo Hermes 4.3 da Nous Research, e um caminho hospedado via OpenRouter. Rodar totalmente offline significa usar o caminho local tanto para as chamadas de modelo do agente quanto para qualquer armazenamento de memória necessário.

  1. 1
    Clone o repositório em github.com/NousResearch/hermes-agent e leia diretamente o README e o arquivo LICENSE — passos exatos de instalação, flags de CLI e nomes atuais de arquivos de configuração podem mudar entre versões; este artigo não substitui as instruções do próprio repositório.
  2. 2
    Instale o Ollama (ou configure um endpoint servido via Hugging Face) e baixe o modelo Hermes 4.3 para que o agente tenha um modelo local a chamar.
  3. 3
    Configure o backend de modelo do Hermes Agent para apontar para o seu endpoint local do Ollama ou Hugging Face em vez de uma chave de API do OpenRouter, se o objetivo for uma configuração totalmente offline.
  4. 4
    Se em vez disso você quiser acesso a mais de 200 modelos hospedados (Claude, GPT-4, Gemini, Qwen, DeepSeek e outros) em vez de apenas o Hermes 4.3, configure uma chave de API do OpenRouter no lugar do backend local, ou junto com ele.
  5. 5
    Decida onde o agente vai rodar continuamente — veja a seção de auto-hospedagem abaixo para a faixa que vai de um VPS de baixo custo até um cluster de GPU ou uma plataforma serverless.
  6. 6
    Conecte um canal de mensagens (Telegram, Discord, Slack, WhatsApp, Signal ou e-mail) se quiser acessar o agente fora de uma sessão de terminal — cada canal exige suas próprias credenciais/configuração de bot conforme o processo padrão daquela plataforma.
  7. 7
    Supervisione de perto as primeiras execuções. Um agente com loop de habilidades autoaperfeiçoável e memória persistente acumula, por design, um estado que você ainda não revisou — verifique quais habilidades e entradas de memória ele escreveu antes de confiar a ele tarefas sensíveis sem supervisão.

O Hermes Agent precisa de GPU para rodar localmente?

Rodar o Hermes 4.3 localmente via Ollama tem a mesma dependência geral de hardware de qualquer LLM local: uma GPU capaz acelera bastante a inferência, e a inferência só em CPU é possível, mas mais lenta. O próprio repositório do Hermes Agent é a fonte autorizada para qualquer orientação de VRAM específica do modelo — consulte-o antes de assumir um número de hardware específico.

O Hermes Agent pode rodar sem nenhuma conexão com a internet?

Sim, se configurado para usar um endpoint local do Ollama ou Hugging Face para suas chamadas de modelo em vez do OpenRouter. Usar o OpenRouter como backend exige conexão com a internet e gera os custos de API por token do próprio OpenRouter, separados do fato de o Hermes Agent em si ser software gratuito.

Onde é possível auto-hospedar o Hermes Agent?

O Hermes Agent foi projetado para rodar na infraestrutura que você escolher, de um VPS de baixo custo até um cluster de GPU ou uma plataforma serverless. Qual opção faz sentido depende principalmente do backend de modelo usado — um deployment local do Hermes 4.3 tem requisitos reais de GPU/VRAM, enquanto um deployment baseado em OpenRouter só precisa de poder computacional suficiente para o processo do próprio agente.

VPS de $5/mês

Para que serve:
Agente baseado em OpenRouter (sem modelo local); processo leve e sempre ativo para acesso por canais de mensagens

Sua própria workstation/servidor

Para que serve:
Hermes 4.3 local via Ollama ou Hugging Face, quando você já tem hardware de GPU para inferência local

Cluster de GPU

Para que serve:
Cargas de inferência local mais pesadas ou várias instâncias simultâneas de agente contra o Hermes 4.3

Serverless (Daytona, Modal)

Para que serve:
Cargas sob demanda ou irregulares em que você não quer manter um servidor rodando continuamente

Custo e passos de configuração de cada opção variam por provedor e mudam com o tempo — confirme os preços atuais diretamente com o provedor de VPS, com a Daytona ou com a Modal, em vez de confiar em um número fixo indicado aqui.

Por quais plataformas de mensagens dá para acessar o Hermes Agent?

O Hermes Agent é acessível por terminal ou por seis plataformas de mensagens: Telegram, Discord, Slack, WhatsApp, Signal e e-mail. Essa é uma diferença relevante em relação à maioria dos projetos de agentes auto-hospedados, que costumam se limitar ao terminal ou a uma única integração de chat.

  • Terminal: a interface básica para interação direta e local
  • Telegram, Discord, Slack: integrações de bot para plataformas de chat
  • WhatsApp, Signal: integrações com apps de mensagens
  • E-mail: alcançar o agente enviando uma mensagem

Sob qual licença o Hermes Agent é publicado?

O Hermes Agent é publicado sob licença MIT — uma licença de código aberto permissiva, sem restrição para uso comercial, modificação ou redistribuição. Isso foi confirmado ao ler diretamente o arquivo LICENSE no repositório github.com/NousResearch/hermes-agent.

📌Note: Esta seção é um resumo em linguagem simples, não aconselhamento jurídico. Leia você mesmo o arquivo LICENSE em github.com/NousResearch/hermes-agent antes de tomar uma decisão que dependa dos termos exatos da licença.

Quais são as expectativas realistas ao rodar o Hermes Agent?

Um agente autônomo com memória persistente e loop de habilidades autoaperfeiçoável precisa de supervisão mais próxima do que um chatbot sem estado, porque seu comportamento se acumula ao longo do tempo em vez de reiniciar a cada sessão.

  • Memória persistente significa que erros ou suposições ruins do agente podem persistir e se acumular entre sessões se não forem revisados — verifique periodicamente o que ele armazenou
  • Habilidades autoescritas são, por definição, código ou rotinas produzidos pelo próprio agente; revise as habilidades que ele cria antes de deixá-lo rodar sem supervisão em tarefas sensíveis, da mesma forma que você revisaria qualquer automação que não escreveu à mão
  • O acesso por plataformas de mensagens amplia a superfície de ataque em comparação com uma ferramenta só de terminal — trate tokens de bot e credenciais de API do Telegram, Discord, Slack, WhatsApp, Signal e e-mail com o mesmo cuidado que qualquer outra credencial que dê acesso a um processo automatizado
  • A escolha do modelo afeta custo e privacidade: uma configuração totalmente local com Hermes 4.3 mantém os dados na sua própria infraestrutura, enquanto uma configuração baseada em OpenRouter envia solicitações ao provedor terceirizado escolhido, sujeitas aos termos de tratamento de dados desse provedor
  • Este site não realizou seu próprio teste de longa duração do comportamento do loop de habilidades ou da memória do Hermes Agent até o momento; os pontos acima descrevem a arquitetura conforme documentada, não resultados de testes independentes

Para quem vale a pena auto-hospedar o Hermes Agent?

A escolha certa depende de você querer um agente pessoal persistente e autoaperfeiçoável sob seu próprio controle, ou uma ferramenta mais simples ou mais supervisionada.

Hermes Agent vs. alternativas

O Hermes Agent compete mais diretamente com outros projetos de agentes autônomos generalistas e auto-hospedáveis do que com assistentes de codificação delimitados.

FerramentaBackend de modeloLicençaMemória/habilidadesAcesso por mensagens
Hermes AgentHermes 4.3 local ou 200+ via OpenRouterMITMemória persistente + habilidades autoaperfeiçoáveisTelegram/Discord/Slack/WhatsApp/Signal/e-mail
AutoGPT (classic)Local via Ollama (URL genérica compatível com OpenAI)MITLoop de planejamento limitado à sessãoSó terminal
BabyAGIVaria conforme o forkMITLoop de lista de tarefas, persistência limitadaSó terminal
Cline + OllamaLocalApache 2.0Limitado a uma sessão de codificaçãoSó IDE

Esta tabela compara recursos documentados publicamente, não desempenho medido de forma independente. Verifique as capacidades atuais de cada projeto diretamente no repositório antes de escolher entre eles.

Erros comuns ao avaliar o Hermes Agent

Boa parte da confusão sobre o Hermes Agent vem de compará-lo a um chatbot sem estado ou a um agente de codificação delimitado, quando ele não foi projetado para ser nenhum dos dois.

Perguntas frequentes

O que é o Hermes Agent?

Hermes Agent é um agente de IA pessoal autônomo de código aberto e auto-hospedável criado pela Nous Research, lançado em fevereiro de 2026 sob licença MIT (github.com/NousResearch/hermes-agent). Ele combina um loop de habilidades autoaperfeiçoável, memória persistente de longo prazo e acesso por terminal ou plataformas de mensagens.

O Hermes Agent é gratuito?

O software em si é gratuito e licenciado sob MIT. Rodá-lo ainda pode gerar custos dependendo da sua configuração: hospedagem de servidor/VPS ou cluster de GPU, e custos de API do OpenRouter caso você use o backend de modelos hospedados em vez de um totalmente local.

O Hermes Agent funciona com Ollama?

Sim. O Hermes Agent suporta rodar o modelo Hermes 4.3 da Nous Research localmente via Ollama, assim como via Hugging Face, como alternativa ao uso dos modelos hospedados do OpenRouter.

O Hermes Agent pode usar modelos além do Hermes 4.3?

Sim. Através do OpenRouter, o Hermes Agent pode rodar com mais de 200 modelos, incluindo opções confirmadas como compatíveis como Claude, GPT-4, Gemini, Qwen e DeepSeek, além do backend local padrão Hermes 4.3.

Quais plataformas de mensagens dá para usar para falar com o Hermes Agent?

Telegram, Discord, Slack, WhatsApp, Signal e e-mail, além de uma interface de terminal. Cada canal precisa do próprio token de bot ou conjunto de credenciais de API, configurado conforme o processo padrão daquela plataforma.

Quanto custa auto-hospedar o Hermes Agent?

O software é gratuito; o custo de hospedagem depende de onde você o roda. A Nous Research documenta opções que vão de um VPS de cerca de $5/mês até um cluster de GPU ou plataformas serverless como Daytona ou Modal — o preço real depende do provedor escolhido e muda com o tempo, então confirme as tarifas atuais diretamente com esse provedor.

O Hermes Agent é a mesma coisa que o AutoGPT?

Não. Ambos são projetos de agentes autônomos licenciados sob MIT e auto-hospedáveis, mas o Hermes Agent é criado pela Nous Research com uma arquitetura de memória persistente e habilidades autoaperfeiçoáveis, além de acesso multiplataforma de mensagens, enquanto o AutoGPT clássico é um agente de loop de planejamento não delimitado, com acesso só por terminal e sem sistema embutido de memória persistente ou criação de habilidades.

Quem desenvolve o Hermes Agent?

A Nous Research, organização também responsável pela família de modelos Hermes (incluindo o Hermes 4.3) e pelo site oficial hermes-agent.org. Segundo a TechCrunch, a Nous Research estaria em conversas para um investimento com avaliação de US$ 1,5 bi em julho de 2026, embora isso descreva conversas, não uma rodada confirmada e fechada.

O Hermes Agent pode rodar completamente sem acesso à internet?

Sim, se configurado para usar um backend de modelo local (Ollama ou Hugging Face com Hermes 4.3) em vez do OpenRouter, que precisa de conexão com a internet para acessar seus modelos hospedados.

É seguro dar ao Hermes Agent acesso à minha conta do Telegram, Discord ou e-mail?

Isso depende de quão cuidadosamente você gerencia as credenciais e de quão de perto supervisiona a memória e as habilidades autoescritas do agente. Como o Hermes Agent mantém estado ao longo do tempo e pode modificar suas próprias habilidades, verifique o que ele armazenou e trate as credenciais de seus canais de mensagens com a mesma cautela que aplicaria a qualquer automação com acesso amplo a uma conta.

Fontes

← Voltar para LLMs locais avançados