Skip to main content
PromptQuorum
/고급 로컬 LLM/Hermes Agent 리뷰 2026: 셀프 호스팅 AI 에이전트
Local AI Agents & Tool Use

Hermes Agent 리뷰 2026: 셀프 호스팅 AI 에이전트

·읽는 시간 12분·Hans Kuepper 저 · PromptQuorum 창립자, 멀티 모델 AI 디스패치 도구 · PromptQuorum

Hermes Agent는 Nous Research가 만든 오픈소스이자 셀프 호스팅 가능한 자율형 AI 에이전트다(github.com/NousResearch/hermes-agent, MIT 라이선스, 2026년 2월 출시). Ollama나 Hugging Face를 통해 Hermes 4.3을 로컬에서 실행하거나 OpenRouter의 200개 이상 모델을 사용할 수 있으며, 터미널, Telegram, Discord, Slack, WhatsApp, Signal, 이메일로 접근할 수 있다.

Hermes Agent는 Nous Research가 개발한 오픈소스 자율형 개인 AI 에이전트로, 2026년 2월 MIT 라이선스로 출시되었다(github.com/NousResearch/hermes-agent의 LICENSE 파일로 확인). Ollama나 Hugging Face를 통해 Nous Research의 자체 모델 Hermes 4.3을 로컬에서 실행하거나, OpenRouter를 통해 200개 이상의 호스팅 모델을 사용할 수 있으며, 터미널뿐 아니라 Telegram, Discord, Slack, WhatsApp, Signal, 이메일 같은 메시징 플랫폼으로도 접근할 수 있다.

Hermes Agent 리뷰 2026: 셀프 호스팅 AI 에이전트

핵심 요점

  • Nous Research가 개발, 2026년 2월 출시, MIT 라이선스(github.com/NousResearch/hermes-agent)
  • 두 가지 모델 경로: Ollama/Hugging Face를 통한 로컬 Hermes 4.3, 또는 OpenRouter를 통한 200개 이상 모델(Claude, GPT-4, Gemini, Qwen, DeepSeek 호환 확인됨)
  • 자기개선형 스킬 루프: 고정된 도구 세트에만 의존하지 않고 경험을 통해 자체 스킬을 만들고 다듬는다
  • 세션 간 유지되는 영구적인 장기 메모리, 단일 대화 창에만 국한되지 않음
  • 접근 지점: 터미널, Telegram, Discord, Slack, WhatsApp, Signal, 이메일
  • 셀프 호스팅 범위: 월 5달러 VPS부터 GPU 클러스터까지, 서버리스(Daytona, Modal) 옵션도 포함
  • 공식 사이트: hermes-agent.org. 이 사이트에는 Hermes Agent 제휴 프로그램이 없다 — 아래 모든 링크는 단순히 공개된 링크다.

📍 한 문장으로

Hermes Agent는 Nous Research가 만든 MIT 라이선스의 셀프 호스팅 가능한 자율형 개인 에이전트로, 자기개선형 스킬 루프와 영구적인 장기 메모리를 갖추고 있으며, 로컬 추론(Ollama 또는 Hugging Face를 통한 Hermes 4.3)이나 OpenRouter를 통한 200개 이상의 호스팅 모델 중에서 선택할 수 있고, 터미널이나 Telegram, Discord, Slack, WhatsApp, Signal, 이메일로 접근할 수 있다.

💬 쉽게 말하면

자신의 서버에서 실행하는 프로그램으로, 개인 비서처럼 작동한다. 과거 대화를 기억하고, 작업하면서 재사용 가능한 자체 루틴("스킬")을 직접 작성하고 다듬으며, 사람에게 메시지를 보내듯 Telegram이나 Discord로 말을 걸 수 있다 — 터미널 창에만 국한되지 않는다.

📌Note: TechCrunch에 따르면 Nous Research는 2026년 7월 기준 15억 달러 밸류에이션으로 신규 투자 유치를 협의 중인 것으로 보도되었다. "협의 중"은 완료된 투자 라운드가 아니다 — 이는 회사에 관한 배경 정보로만 취급하고, 투자가 실제로 성사되었다는 확인으로 받아들이지 말 것.

Hermes Agent란?

Hermes Agent는 Nous Research가 개발한 오픈소스 자율형 개인 AI 에이전트로, github.com/NousResearch/hermes-agent에 GitHub로 공개되었으며 2026년 2월 MIT 라이선스로 출시되었다. 브라우저에서 접속하는 채팅 인터페이스와 달리, Hermes Agent는 자신의 컴퓨터나 서버에 설치해 계속 실행하는 소프트웨어로, 세션 간 컨텍스트를 유지하며 매번 배경을 다시 설명하지 않아도 작업을 수행할 수 있다.

  • 핵심 개념: 일회성 채팅 세션이 아니라 지속적으로 실행되는 에이전트 프로세스 — 계속 실행되며 상호작용 사이에도 메모리를 유지한다
  • 모델에 구애받지 않음: Nous Research 자체 모델 Hermes 4.3을 로컬에서 실행하거나, OpenRouter를 통해 이용 가능한 200개 이상 모델 중 어느 것이든 사용 가능
  • OpenRouter를 통해 호환이 확인된 클라우드 모델: Claude, GPT-4, Gemini, Qwen, DeepSeek
  • 일반적인 챗봇 래퍼와 구별되는 두 가지 핵심 기능: 자기개선형 스킬 루프와 영구적인 장기 메모리(다음 섹션에서 다룸)
  • MIT 라이선스로 배포 — 상업적 사용이나 수정에 제한이 없는 관대한 라이선스로, 리포지토리의 LICENSE 파일을 직접 읽어 확인함

자기개선형 스킬 루프는 어떻게 작동하나?

Hermes Agent는 고정되고 수작업으로 코딩된 도구 세트만 제공받는 대신, 경험을 통해 자체 "스킬"을 만들고 다듬는다. 여기서 스킬이란 에이전트가 작업을 수행한 후 구축하는 재사용 가능한 루틴으로, 다음에 비슷한 작업이 오면 처음부터 접근 방식을 다시 유도할 필요가 없게 해준다.

  • 에이전트는 자신의 행동 결과를 관찰하고, 무엇이 통했고 무엇이 실패했는지에 따라 새 스킬을 작성하거나 기존 스킬을 수정할 수 있다
  • 이는 영구적인 장기 메모리와 결합된다 — 에이전트는 매 메시지마다 빈 컨텍스트에서 시작하는 대신 세션 간 정보를 유지한다
  • 실질적 효과: 에이전트가 매 실행마다 같은 문제를 처음부터 다시 풀지 않기 때문에, 반복되거나 유사한 요청은 시간이 지날수록 더 빠르고 일관되게 처리될 것으로 기대된다

📌Note: 이 사이트는 Hermes Agent의 스킬 루프가 특정 작업에서 정확도나 속도를 얼마나 빠르게 개선하는지 독자적으로 측정하지 않았으며, 작성 시점 기준으로 그런 수치가 검증된 제3자 벤치마크로 공개되어 있지도 않다. 자신의 워크로드에서 직접 테스트하기 전까지는 "자기개선"을 측정된 성능 주장이 아니라 서술된 아키텍처 동작으로 취급할 것.

Ollama로 Hermes Agent를 로컬에서 실행하는 방법

Hermes Agent는 두 가지 모델 백엔드를 지원한다: Nous Research의 Hermes 4.3 모델을 사용하는 Ollama 또는 Hugging Face를 통한 로컬 경로, 그리고 OpenRouter를 통한 호스팅 경로다. 완전히 오프라인으로 작동한다는 것은 에이전트의 모델 호출과 필요한 메모리 저장 모두에 로컬 경로를 사용한다는 의미다.

  1. 1
    github.com/NousResearch/hermes-agent에서 리포지토리를 클론하고 README와 LICENSE 파일을 직접 읽을 것 — 정확한 설치 단계, CLI 플래그, 현재 설정 파일 이름은 릴리스마다 달라질 수 있으며, 이 글이 리포지토리 자체 안내를 대체하지는 않는다.
  2. 2
    Ollama를 설치하거나(또는 Hugging Face로 제공되는 엔드포인트를 설정하거나) Hermes 4.3 모델을 받아 에이전트가 호출할 로컬 모델을 준비한다.
  3. 3
    완전한 오프라인 설정이 목표라면, Hermes Agent의 모델 설정을 OpenRouter API 키 대신 로컬 Ollama 또는 Hugging Face 엔드포인트로 지정한다.
  4. 4
    Hermes 4.3만이 아니라 200개 이상의 호스팅 모델(Claude, GPT-4, Gemini, Qwen, DeepSeek 등)에 접근하고 싶다면, 로컬 백엔드 대신 또는 함께 OpenRouter API 키를 설정한다.
  5. 5
    에이전트를 어디서 계속 실행할지 결정한다 — 저비용 VPS부터 GPU 클러스터나 서버리스 플랫폼까지의 범위는 아래 셀프 호스팅 섹션을 참고할 것.
  6. 6
    터미널 세션 밖에서 에이전트에 접근하고 싶다면 메시징 채널(Telegram, Discord, Slack, WhatsApp, Signal, 이메일)을 연결한다 — 각 채널은 해당 플랫폼의 표준 절차에 따른 자체 자격 증명/봇 설정이 필요하다.
  7. 7
    초기 실행은 면밀히 감독할 것. 자기개선형 스킬 루프와 영구 메모리를 가진 에이전트는 설계상 아직 검토하지 않은 상태를 계속 축적한다 — 민감한 작업을 무감독으로 맡기기 전에 에이전트가 어떤 스킬과 메모리 항목을 작성했는지 확인할 것.

Hermes Agent를 로컬에서 실행하려면 GPU가 필요한가요?

Ollama로 Hermes 4.3을 로컬 실행하는 것은 다른 모든 로컬 LLM과 동일한 일반적인 하드웨어 의존성을 가진다: 성능 좋은 GPU는 추론 속도를 크게 높이며, CPU만으로도 추론은 가능하지만 더 느리다. 모델별 VRAM 지침에 대해서는 Hermes Agent 리포지토리 자체가 권위 있는 출처이므로, 특정 하드웨어 수치를 가정하기 전에 확인할 것.

Hermes Agent는 인터넷 연결 없이 실행할 수 있나요?

가능하다. 모델 호출에 OpenRouter 대신 로컬 Ollama 또는 Hugging Face 엔드포인트를 사용하도록 설정한 경우에 한한다. OpenRouter를 백엔드로 사용하려면 인터넷 연결이 필요하며, Hermes Agent 자체가 무료 소프트웨어인 것과는 별개로 OpenRouter 자체의 토큰당 API 비용이 발생한다.

Hermes Agent를 어디에 셀프 호스팅할 수 있나?

Hermes Agent는 저비용 VPS부터 GPU 클러스터나 서버리스 플랫폼까지, 사용자가 선택한 인프라에서 실행되도록 설계되었다. 어떤 옵션이 적합한지는 주로 사용하는 모델 백엔드에 달려 있다 — 로컬 Hermes 4.3 배포는 실제 GPU/VRAM 요구 사항이 있는 반면, OpenRouter 기반 배포는 에이전트 프로세스 자체를 실행할 만큼의 컴퓨팅 자원만 있으면 된다.

월 5달러 VPS

적합한 경우:
OpenRouter 기반 에이전트(로컬 모델 없음); 메시징 채널 접근을 위한 가볍고 상시 가동되는 프로세스

자체 워크스테이션/서버

적합한 경우:
로컬 추론용 GPU 하드웨어를 이미 보유한 경우, Ollama 또는 Hugging Face를 통한 로컬 Hermes 4.3

GPU 클러스터

적합한 경우:
더 무거운 로컬 추론 워크로드, 또는 Hermes 4.3에 대한 여러 동시 에이전트 인스턴스

서버리스(Daytona, Modal)

적합한 경우:
서버를 계속 가동해 두고 싶지 않은 온디맨드 또는 불규칙한 워크로드

각 옵션의 비용과 설정 절차는 제공업체마다 다르며 시간이 지나면서 변한다 — 여기 표시된 고정된 수치에 의존하지 말고 VPS 제공업체, Daytona, Modal에 직접 현재 가격을 확인할 것.

어떤 메시징 플랫폼으로 Hermes Agent에 접근할 수 있나?

Hermes Agent는 터미널 또는 여섯 개의 메시징 플랫폼(Telegram, Discord, Slack, WhatsApp, Signal, 이메일)으로 접근할 수 있다. 이는 보통 터미널 전용이거나 단일 채팅 연동에 그치는 대부분의 셀프 호스팅 에이전트 프로젝트와 뚜렷이 다른 점이다.

  • 터미널: 직접적이고 로컬한 상호작용을 위한 기본 인터페이스
  • Telegram, Discord, Slack: 채팅 플랫폼용 봇 연동
  • WhatsApp, Signal: 메시징 앱 연동
  • 이메일: 메시지를 보내 에이전트에 접근

Hermes Agent는 어떤 라이선스로 배포되나?

Hermes Agent는 MIT 라이선스로 배포된다 — 상업적 사용, 수정, 재배포에 제한이 없는 관대한 오픈소스 라이선스다. 이는 github.com/NousResearch/hermes-agent 리포지토리의 LICENSE 파일을 직접 읽어 확인했다.

📌Note: 이 섹션은 쉬운 언어로 정리한 요약이며 법률 자문이 아니다. 라이선스의 정확한 조건에 좌우되는 결정을 내리기 전에 github.com/NousResearch/hermes-agent의 LICENSE 파일을 직접 읽을 것.

Hermes Agent를 운영할 때 현실적인 기대치는 무엇인가?

영구 메모리와 자기개선형 스킬 루프를 가진 자율형 에이전트는, 세션마다 초기화되는 상태 없는 챗봇보다 더 밀접한 감독이 필요하다. 행동이 시간이 지나며 초기화되지 않고 누적되기 때문이다.

  • 영구 메모리는 에이전트의 실수나 잘못된 가정이 검토되지 않으면 세션 간 지속되고 누적될 수 있다는 뜻이다 — 무엇이 저장되었는지 주기적으로 확인할 것
  • 스스로 작성한 스킬은 정의상 에이전트 자신이 만들어낸 코드나 루틴이다; 직접 작성하지 않은 자동화를 검토하는 것과 마찬가지로, 민감한 작업을 무감독으로 맡기기 전에 에이전트가 만든 스킬을 검토할 것
  • 메시징 플랫폼을 통한 접근은 터미널 전용 도구에 비해 공격 표면을 넓힌다 — Telegram, Discord, Slack, WhatsApp, Signal, 이메일의 봇 토큰과 API 자격 증명은 자동화 프로세스에 대한 접근 권한을 부여하는 다른 모든 자격 증명과 동일한 주의로 다룰 것
  • 모델 선택은 비용과 프라이버시 모두에 영향을 미친다: 완전 로컬 Hermes 4.3 설정은 데이터를 자체 인프라에 유지하는 반면, OpenRouter 기반 설정은 선택한 타사 모델 제공업체로 요청을 보내며 그 제공업체 자체의 데이터 처리 조건이 적용된다
  • 이 사이트는 작성 시점 기준으로 Hermes Agent의 스킬 루프나 메모리 동작에 대한 자체 장기 테스트를 실시하지 않았다; 위 내용은 문서화된 아키텍처를 설명한 것이지 독립적인 테스트 결과가 아니다

누구에게 Hermes Agent 셀프 호스팅이 적합한가?

올바른 선택은 자신이 통제하는 영구적이고 자기개선형인 개인 에이전트를 원하는지, 아니면 더 단순하거나 더 감독되는 도구를 원하는지에 달려 있다.

Hermes Agent 대 대안

Hermes Agent는 범위가 한정된 코딩 어시스턴트보다는 다른 셀프 호스팅 가능한 범용 자율형 에이전트 프로젝트와 더 직접적으로 경쟁한다.

도구모델 백엔드라이선스메모리/스킬메시징 접근
Hermes Agent로컬 Hermes 4.3 또는 OpenRouter로 200개 이상MIT영구 메모리 + 자기개선형 스킬Telegram/Discord/Slack/WhatsApp/Signal/이메일
AutoGPT(classic)Ollama를 통한 로컬(범용 OpenAI 호환 URL)MIT세션에 한정된 계획 루프터미널만
BabyAGI포크에 따라 다름MIT작업 목록 루프, 제한적 지속성터미널만
Cline + Ollama로컬Apache 2.0하나의 코딩 세션에 한정IDE만

이 표는 공개적으로 문서화된 기능을 비교한 것이지, 독립적으로 측정된 성능이 아니다. 선택하기 전에 각 프로젝트의 최신 기능을 해당 리포지토리에서 직접 확인할 것.

Hermes Agent를 평가할 때 흔한 오해

Hermes Agent를 둘러싼 대부분의 혼란은 그것을 상태 없는 챗봇이나 범위가 한정된 코딩 에이전트 중 하나와 동일시하는 데서 비롯되지만, 실제로는 둘 다로 설계되지 않았다.

자주 묻는 질문

Hermes Agent란 무엇인가요?

Hermes Agent는 Nous Research가 만든 오픈소스이자 셀프 호스팅 가능한 자율형 개인 AI 에이전트로, 2026년 2월 MIT 라이선스로 출시되었다(github.com/NousResearch/hermes-agent). 자기개선형 스킬 루프, 영구적인 장기 메모리, 그리고 터미널이나 메시징 플랫폼을 통한 접근을 결합한다.

Hermes Agent는 무료인가요?

소프트웨어 자체는 무료이며 MIT 라이선스다. 다만 설정에 따라 운영 비용이 발생할 수 있다: 서버/VPS 또는 GPU 클러스터 호스팅 비용, 그리고 완전 로컬 대신 호스팅 모델 백엔드를 사용하는 경우 OpenRouter API 비용이다.

Hermes Agent는 Ollama와 함께 작동하나요?

그렇다. Hermes Agent는 OpenRouter의 호스팅 모델을 사용하는 대신, Ollama뿐 아니라 Hugging Face를 통해서도 Nous Research의 Hermes 4.3 모델을 로컬에서 실행하는 것을 지원한다.

Hermes Agent는 Hermes 4.3 외의 모델도 사용할 수 있나요?

그렇다. OpenRouter를 통해 Hermes Agent는 기본 로컬 백엔드인 Hermes 4.3 외에도 Claude, GPT-4, Gemini, Qwen, DeepSeek처럼 호환이 확인된 옵션을 포함해 200개 이상의 모델로 작동할 수 있다.

Hermes Agent와 대화할 수 있는 메시징 플랫폼은 무엇인가요?

터미널 인터페이스 외에도 Telegram, Discord, Slack, WhatsApp, Signal, 이메일을 사용할 수 있다. 각 채널은 해당 플랫폼의 표준 절차에 따라 설정한 자체 봇 토큰이나 API 자격 증명 세트가 필요하다.

Hermes Agent를 셀프 호스팅하는 데 비용이 얼마나 드나요?

소프트웨어는 무료이며, 호스팅 비용은 어디서 실행하느냐에 달려 있다. Nous Research는 월 약 5달러의 VPS 호스팅부터 GPU 클러스터, Daytona나 Modal 같은 서버리스 플랫폼까지의 옵션을 문서화하고 있다 — 실제 가격은 선택한 제공업체에 따라 다르고 시간이 지나며 변하므로, 그 제공업체에 직접 현재 요금을 확인할 것.

Hermes Agent는 AutoGPT와 같은 것인가요?

아니다. 둘 다 MIT 라이선스로 셀프 호스팅 가능한 자율형 에이전트 프로젝트이지만, Hermes Agent는 영구 메모리와 자기개선형 스킬 아키텍처, 다중 메시징 플랫폼 접근을 갖춘 Nous Research 제품인 반면, 클래식 AutoGPT는 범위가 한정되지 않은 계획 루프 에이전트로 터미널 접근만 가능하고 내장된 영구 메모리나 스킬 작성 시스템이 없다.

Hermes Agent는 누가 만드나요?

Nous Research로, Hermes 모델 패밀리(Hermes 4.3 포함)와 공식 사이트 hermes-agent.org도 함께 만드는 조직이다. TechCrunch에 따르면 Nous Research는 2026년 7월 기준 15억 달러 밸류에이션의 투자를 협의 중인 것으로 보도되었으나, 이는 협의 단계를 설명할 뿐 확정되고 성사된 라운드는 아니다.

Hermes Agent는 인터넷 접근이 전혀 없이 완전히 작동할 수 있나요?

그렇다. 호스팅 모델에 접근하기 위해 인터넷 연결이 필요한 OpenRouter 대신, 로컬 모델 백엔드(Hermes 4.3을 사용하는 Ollama 또는 Hugging Face)를 사용하도록 설정한 경우에 한한다.

Hermes Agent에 내 Telegram, Discord, 이메일 계정 접근 권한을 주는 것이 안전한가요?

이는 자격 증명을 얼마나 신중하게 관리하는지, 에이전트의 메모리와 스스로 작성한 스킬을 얼마나 면밀히 감독하는지에 달려 있다. Hermes Agent는 시간이 지나며 상태를 유지하고 자신의 스킬을 수정할 수 있으므로, 무엇이 저장되었는지 확인하고, 광범위한 계정 접근 권한을 가진 다른 모든 자동화와 동일한 주의로 메시징 채널의 자격 증명을 다룰 것.

출처

← 고급 로컬 LLM으로 돌아가기