Skip to main content
PromptQuorum
/고급 로컬 LLM/dograh 리뷰: 셀프 호스팅 오픈소스 음성 AI 에이전트 플랫폼
Voice, Speech & Multimodal

dograh 리뷰: 셀프 호스팅 오픈소스 음성 AI 에이전트 플랫폼

·10분 읽기·Hans Kuepper 저 · PromptQuorum 창립자, 멀티 모델 AI 디스패치 도구 · PromptQuorum

dograh는 Docker로 셀프 호스팅하는 음성 AI 에이전트 — 전화 또는 웹 기반 대화형 봇 — 를 구축하고 운영하기 위한 무료 오픈소스(BSD-2-Clause 라이선스) 플랫폼입니다. 개발사 스스로 Vapi, Retell 같은 호스팅 플랫폼에 대한 온프레미스 대안으로 자리매김하고 있습니다. 대화 흐름을 설계하는 비주얼 워크플로 빌더, 내장된 텔레포니 연동(Twilio, Vonage, Telnyx, Plivo 등), 그리고 LLM·음성 인식(STT)·음성 합성(TTS)에 대한 "직접 제공자 선택(bring your own provider)" 아키텍처를 제공합니다 — 클라우드 API 키뿐 아니라 로컬 셀프 호스팅 옵션도 포함합니다. 셀프 호스팅은 영구 무료이며, app.dograh.com의 별도 관리형 클라우드 버전은 분당 $0.01에 연결된 LLM/STT/TTS 제공자 사용료가 추가로 부과됩니다.

dograh(dograh.com, 소스 코드는 github.com/dograh-hq/dograh)는 전화를 받아 듣고 판단하여 실시간으로 응답하는 "음성 에이전트"를 구축하기 위한 오픈소스 플랫폼으로, 폐쇄형 호스팅 업체에서 빌리는 대신 Docker를 통해 직접 배포합니다. GitHub 자체 설명에 따르면 Vapi 및 Retell 같은 호스팅 음성 에이전트 플랫폼에 대한 "온프레미스, BYOK(자체 키 사용)" 대안으로 자리매김하고 있습니다. 이 리뷰는 로컬 LLM 소프트웨어 디렉터리에 있는 dograh 항목의 심화판으로, dograh가 실제로 무엇인지, 셀프 호스팅 방법, 로컬 모델 지원 여부, 라이선스, 그리고 Voxa, Jarvis for Mac 같은 다른 음성 도구와의 비교를 다룹니다.

dograh 리뷰: 셀프 호스팅 오픈소스 음성 AI 에이전트 플랫폼

핵심 요점

  • Docker로 셀프 호스팅, 영구 무료; 저장소 자체 LICENSE 파일에 따르면 BSD-2-Clause 라이선스이며 저작권자는 Zansat Technologies Private Limited
  • 대화의 각 턴에서 음성 에이전트가 무엇을 말하고 행동할지 설계하는 노드 기반 비주얼 워크플로 빌더
  • dograh 자체 문서에 따른 내장 텔레포니 연동: Twilio, Vonage, Telnyx, Plivo, Cloudonix, Exotel, Vobiz
  • dograh 자체 LLM 설정 문서에 따르면 OllamavLLM을 명시적으로 포함한 모든 OpenAI 호환 엔드포인트를 통한 로컬 LLM 추론
  • dograh가 음성전사 문서에서 직접 명시하는 OpenAI API 호환 서버 Speaches를 통한 로컬·셀프 호스팅 STT/TTS; Speaches 자체는 자체 프로젝트 페이지에 따르면 전사에 faster-whisper, 음성 생성에 Piper/Kokoro를 사용
  • 셀프 호스팅보다 관리형 모델을 선호하는 팀을 위해 OpenAI, Deepgram, ElevenLabs, Cartesia, AssemblyAI 등 수십 개의 클라우드 제공자에도 자체 API 키로 연결 가능
  • GitHub API로 2026년 9월 12일 확인한 GitHub 스타 5,636개, 포크 1,398개; 최신 태그 릴리스는 v1.46.0, 날짜는 2026년 9월 3일
  • app.dograh.com의 별도 관리형 클라우드 옵션은 분당 $0.01에 연결된 LLM/STT/TTS 제공자 사용료가 추가됨

📍 한 문장으로

dograh는 Docker로 셀프 호스팅하는 음성 AI 에이전트 구축용 무료 오픈소스(BSD-2-Clause) 플랫폼으로, Ollama/vLLM을 통한 로컬 LLM 추론과 Speaches를 통한 로컬 음성 인식/합성을 지원하며, 자체 키로 사용할 수 있는 수십 개의 클라우드 제공자도 함께 제공합니다.

💬 쉽게 말하면

Vapi나 Retell 같은 호스팅 업체에 AI 전화 응대 봇 사용료를 분 단위로 지불하는 대신, dograh를 사용하면 워크플로 빌더, 텔레포니, 연결된 AI 모델까지 모두 자체 서버에서 운영할 수 있으며, 어떤 대화 데이터도 인프라 밖으로 내보내고 싶지 않다면 완전히 로컬인 음성 및 언어 모델도 사용할 수 있습니다.

📌참고: 이 리뷰는 로컬 LLM 소프트웨어 디렉터리에 있는 dograh 항목의 심화판입니다 — dograh가 수십 개의 다른 로컬 AI 도구와 비교해 어떤 위치에 있는지는 해당 페이지에서 한눈에 확인할 수 있습니다.

dograh란 무엇인가

dograh는 전화를 받거나 걸고(또는 웹 기반 음성 세션을 처리하고), 발신자가 하는 말을 듣고, 무엇을 할지 결정하고, 실시간으로 음성으로 응답하는 AI 시스템인 "음성 에이전트"를 구축하기 위한 플랫폼입니다. 자체 GitHub 저장소는 이를 VapiRetell 같은 플랫폼에 대한 오픈소스 셀프 호스팅 대안으로 설명하며, 대화 오디오와 전사 내용을 기본적으로 제3자 업체에 넘기지 않고 동일한 카테고리의 제품을 원하는 팀을 대상으로 합니다.

  • 핵심 기능: 텔레포니 제공자와 LLM/STT/TTS 제공자를 양쪽에 연결하는, 여러 턴의 음성 대화를 설계하는 비주얼 워크플로 빌더
  • 배포 모델: 직접 운영하는 Docker Compose 스택 — 개발용으로는 노트북에서, 프로덕션용으로는 서버에서(dograh 자체 문서는 원격 배포에 최소 8GB RAM과 4 vCPU를 명시)
  • 제공자 아키텍처: "직접 제공자 선택(bring your own)" 방식의 LLM, STT, TTS — 워크플로별로 클라우드 API 키, 로컬 OpenAI 호환 엔드포인트, 또는 dograh 자체 관리형 모델 중 하나를 설정
  • 개발사: GitHub의 dograh-hq; 저장소 LICENSE 파일은 Zansat Technologies Private Limited를 저작권자로 명시
  • 정식 저장소: github.com/dograh-hq/dograh, GitHub 자체 메타데이터에 따르면 2025년 9월 생성

dograh 설치: 셀프 호스팅 Docker 배포

dograh는 자체 배포 문서에 따르면 한 줄짜리 설치 스크립트를 사용한 Docker Compose로 배포됩니다. 다운로드할 수 있는 패키지형 데스크톱 설치 프로그램은 없습니다 — 셀프 호스팅이란 이 스크립트를 자신의 머신이나 서버에서 실행하는 것을 의미합니다.

  • dograh 문서에 따르면 로컬/개발용 설치는 컨테이너 시작이 완료되면 http://localhost:3010에서 앱이 열림
  • 같은 문서 페이지에 따르면 Windows는 동일한 방식으로 가져오는 대응 PowerShell 스크립트(start_docker.ps1)를 사용
  • 별도의 setup_remote.sh 스크립트는 프로덕션 서버 배포를 대상으로 하며, root/sudo 접근 권한과 사전 설치된 Docker 및 Docker Compose가 필요
  • dograh 문서는 원격 서버 배포에 최소 8GB RAM과 4 vCPU, 그리고 인바운드 TCP 포트 80, 443, 3478, 5349와 텔레포니(WebRTC/SIP) 트래픽용 UDP 포트 3478, 5349, 49152–49200이 필요하다고 명시
  • 더 높은 처리량을 위해 nginx 뒤에서 여러 FastAPI 워커를 실행하는 방법은 dograh의 확장 가이드에 별도로 문서화되어 있음
bash
curl -o docker-compose.yaml https://raw.githubusercontent.com/dograh-hq/dograh/main/docker-compose.yaml && curl -o start_docker.sh https://raw.githubusercontent.com/dograh-hq/dograh/main/scripts/start_docker.sh && chmod +x start_docker.sh && ./start_docker.sh

로컬 모델 지원: LLM, STT, TTS

dograh는 클라우드 AI 제공자를 필수로 요구하지 않습니다 — 셀프 호스팅 배포는 LLM, 음성 인식, 음성 합성을 완전히 자체 하드웨어에서 실행할 수 있지만, 호스팅된 API 키를 입력하는 것보다는 약간 더 많은 설정이 필요합니다. dograh 자체 문서는 이 작동 방식을 구체적으로 설명하고 있으며, PromptQuorum은 아래 문서화된 범위를 넘어서는 로컬 지원 주장을 발견하지 못했습니다 — 이는 기본적으로 "모든 것을 지원하는" 플랫폼이 아닙니다.

dograh로 무엇을 구축할 수 있는가

dograh의 기능 세트는 음성 에이전트가 처음부터 끝까지 필요로 하는 파이프라인, 즉 전화가 걸려오고, 음성이 전사되고, LLM이 무엇을 말할지 결정하고, 음성이 합성되고, 통화가 전달되거나 종료되는 과정을 중심으로 구성되며, 그 사이의 로직은 비주얼 빌더로 설계합니다. dograh 자체 GitHub README문서에 따른 내용입니다.

  • 비주얼 워크플로 빌더 — 상태 머신 전체를 직접 작성하지 않고도 여러 턴의 대화 로직(에이전트가 무엇을 묻고 답변에 따라 어떻게 분기하는지)을 설계
  • 텔레포니 연동 — dograh의 연동 문서에 따르면 Twilio, Vonage, Telnyx, Plivo, Cloudonix, Exotel, Vobiz, Asterisk ARI용 내장 커넥터
  • 직접 제공자 선택(bring-your-own) LLM/STT/TTS — 워크플로별로 제공자를 설정하고, 필요에 따라 클라우드와 로컬/셀프 호스팅 구성 요소를 혼합
  • 음성 대 음성 모드 — dograh 설정 문서에 따르면, 기반 제공자가 지원하는 경우 별도의 STT/LLM/TTS 단계를 건너뛰고 단일 음성 대 음성 모델을 사용하는 대체 경로
  • 통화 처리 결과 추적 — v1.46.0 릴리스부터 dograh는 대화에서 직접 구조화된 통화 처리 결과(예: "해결됨", "전달됨", "무응답")를 추론할 수 있음
  • 상담원에게 원활한 전환 — 대화 도중 통화를 사람 상담원에게 넘기며, 전환 성공 후 처리 결과를 구성 가능
  • MCP 네이티브 도구 사용 — dograh 자체 저장소 설명에 따르면, 통화 중 에이전트를 외부 도구에 연결
  • 셀프 호스팅용 인증 및 커스텀 도메인 — dograh 자체 배포 문서는 관리형 클라우드 제품과 별개로 셀프 호스팅 인스턴스의 로그인 및 SSL 설정을 다룸

dograh 요금제: 무료 셀프 호스팅 vs. 관리형 클라우드

Docker로 dograh를 셀프 호스팅하는 것은 BSD-2-Clause 라이선스 하에 무료이며, PromptQuorum이 오픈소스 저장소에서 발견한 기능 제한은 없습니다. 자체 서버를 운영하고 싶지 않은 팀을 위해 app.dograh.com에서 별도의 관리형 클라우드 제품이 제공됩니다.

옵션
비용
포함 내용
셀프 호스팅(Docker)무료완전한 오픈소스 플랫폼; BSD-2-Clause; 서버와 필요한 제공자 API 키/로컬 모델은 직접 제공
관리형 클라우드(app.dograh.com)$0.01/분 + 제공자 사용료호스팅 인프라; LLM/STT/TTS/텔레포니 사용료는 계속 별도로 청구됨

분당 $0.01이라는 수치와 "셀프 호스팅은 영구 무료"라는 포지셔닝은 dograh 자체 디렉터리 등재 정보와 공개 자료에서 나온 것입니다 — 사용량 기반 요금은 신생 제품의 경우 변경될 수 있으므로 예산을 세우기 전에 app.dograh.com에서 현재 관리형 클라우드 요금을 직접 확인하세요. Ollama/vLLM과 Speaches를 통해 완전히 로컬인 모델을 사용하지 않는 한, 제공자 비용(별도로 청구되는 클라우드 LLM, STT, TTS, 텔레포니 제공자)은 두 방식 모두에 적용됩니다.

사용 예시

다음은 위에서 문서화된 dograh의 기능으로 구성한 워크플로이며, 가상의 사용 사례가 아닙니다.

dograh는 누구에게 적합한가

dograh가 적합한지는 셀프 호스팅 가능한 음성 에이전트 플랫폼이 특별히 필요한지, 그리고 팀이 Docker 배포를 운영하는 데 익숙한지에 따라 달라집니다.

dograh와 다른 음성 에이전트·음성 도구 비교

dograh는 실시간 음성 에이전트 세그먼트에 속하며, 완전한 통화 처리 플랫폼보다는 음성 입출력에 초점을 맞춘 도구들과 나란히 있습니다. PromptQuorum이 다루는 다른 옵션과 어떻게 비교되는지는 다음과 같습니다 — 전체 카탈로그는 로컬 LLM 소프트웨어 디렉터리를 참조하세요.

  • Voxa — 전화 통화 처리보다 개인/데스크톱 사용에 초점을 맞춘 실시간 음성 비서; 전화 에이전트 빌더가 아니라 대화형 음성 비서를 원한다면 Voxa 리뷰를 참조하세요.
  • Jarvis for Mac — macOS 네이티브 음성 비서; 서버에 배포되어 텔레포니에 중점을 둔 dograh의 플랫폼에 대한 데스크톱 우선 대안으로 Jarvis 리뷰를 참조하세요.
  • faster-whisper — Speaches(dograh가 문서화한 로컬 STT/TTS 옵션) 자체가 기반으로 하는 전사 엔진; 완전한 에이전트 플랫폼이 아니라 로컬 음성 인식만 필요하다면 faster-whisper 리뷰를 참조하세요.
  • Whisper.cpp — 또 다른 로컬·셀프 호스팅 음성 인식 엔진; dograh의 전체 스택을 배포하는 것보다 가벼운 전사 전용 옵션으로 Whisper.cpp 리뷰를 참조하세요.

dograh 평가 시 흔한 오해

dograh에 대한 대부분의 혼란은 이를 다운로드 가능한 앱으로 취급하거나, 아무런 설정 없이 완전히 오프라인으로 작동한다고 가정하는 데서 비롯됩니다.

자주 묻는 질문

dograh란 무엇입니까?

dograh(dograh.com, 소스 코드는 github.com/dograh-hq/dograh)는 전화 또는 웹 기반 대화형 봇인 음성 AI 에이전트를 구축하기 위한 오픈소스 셀프 호스팅 플랫폼으로, Vapi 및 Retell 같은 호스팅 플랫폼에 대한 대안으로 자리매김하고 있습니다.

dograh는 무료입니까?

Docker로 dograh를 셀프 호스팅하는 것은 BSD-2-Clause 라이선스 하에 무료입니다. app.dograh.com의 별도 관리형 클라우드 제품은 분당 $0.01에 연결된 LLM/STT/TTS 제공자 사용료가 추가로 부과됩니다.

dograh는 오픈소스입니까? 어떤 라이선스를 사용합니까?

예. 저장소 자체 LICENSE 파일은 BSD 2-Clause "Simplified" 라이선스이며, 저작권자는 Zansat Technologies Private Limited입니다.

dograh는 로컬·오프라인 AI 모델을 지원합니까?

예. LLM 구성 요소의 경우, dograh는 자체 문서에 따르면 Ollama와 vLLM을 명시적으로 포함한 모든 로컬 OpenAI 호환 엔드포인트에 연결됩니다. 로컬 음성 인식 및 음성 합성의 경우, dograh는 Speaches와 통합되며, Speaches 자체는 전사에 faster-whisper, 음성 생성에 Piper/Kokoro를 사용하는 오픈소스 로컬 서버입니다.

dograh는 어떻게 설치합니까?

터미널에서 공식 한 줄짜리 Docker Compose 설치 스크립트를 실행하세요: curl -o docker-compose.yaml https://raw.githubusercontent.com/dograh-hq/dograh/main/docker-compose.yaml && curl -o start_docker.sh https://raw.githubusercontent.com/dograh-hq/dograh/main/scripts/start_docker.sh && chmod +x start_docker.sh && ./start_docker.sh. 로컬 배포는 http://localhost:3010에서 열립니다.

dograh는 어떤 텔레포니 제공자를 지원합니까?

dograh 자체 연동 문서에 따르면 Twilio, Vonage, Telnyx, Plivo, Cloudonix, Exotel, Vobiz, Asterisk ARI에 대한 내장 연동을 지원합니다.

dograh의 GitHub 스타 수는 얼마입니까?

dograh는 2026년 9월 12일 GitHub API로 확인한 기준으로 GitHub 스타 5,636개, 포크 1,398개를 보유했습니다. 스타 수는 계속 변동하므로 현재 수치는 실시간 저장소를 확인하세요.

dograh의 최신 릴리스는 무엇입니까?

2026년 9월 12일 기준, GitHub의 최신 태그 릴리스는 2026년 9월 3일자 v1.46.0이었으며, 대화 내용에서 통화 처리 결과를 추론하는 기능과 Cartesia의 Sonic-3.6 TTS 모델 등이 추가되었습니다 — 현재 버전은 GitHub Releases를 확인하세요.

dograh를 셀프 호스팅하기 위한 최소 서버 요구 사항은 무엇입니까?

dograh 자체 배포 문서는 원격 서버 배포에 최소 8GB RAM과 4 vCPU, 그리고 인바운드 TCP 포트 80, 443, 3478, 5349와 텔레포니 트래픽용 UDP 포트 3478, 5349, 49152–49200을 명시합니다.

dograh는 누가 개발합니까?

dograh는 GitHub의 dograh-hq가 개발합니다; 저장소 LICENSE 파일은 Zansat Technologies Private Limited를 저작권자로 명시합니다. 저장소는 GitHub 자체 메타데이터에 따르면 2025년 9월에 생성되었습니다.

출처

← 고급 로컬 LLM으로 돌아가기