Skip to main content
PromptQuorum
Accueil/LLM locaux avancés/dograh Review : plateforme open source d'agents vocaux auto-hébergée
Voice, Speech & Multimodal

dograh Review : plateforme open source d'agents vocaux auto-hébergée

·10 min de lecture·Par Hans Kuepper · Fondateur de PromptQuorum, outil de dispatch multi-modèle · PromptQuorum

dograh est une plateforme gratuite et open source (licence BSD-2-Clause) pour construire et exploiter des agents vocaux — des bots conversationnels téléphoniques ou web — que vous auto-hébergez via Docker, positionnée par ses propres développeurs comme une alternative on-premises aux plateformes hébergées telles que Vapi et Retell. Elle propose un constructeur de workflow visuel pour concevoir les échanges, des intégrations téléphoniques intégrées (Twilio, Vonage, Telnyx, Plivo, et d'autres), et une architecture « bring your own provider » pour le LLM, la reconnaissance vocale (STT) et la synthèse vocale (TTS) — y compris des options locales et auto-hébergées, pas seulement des clés API cloud. L'auto-hébergement est gratuit pour toujours ; une version cloud gérée distincte sur app.dograh.com facture 0,01 $/minute plus l'usage des fournisseurs LLM/STT/TTS connectés.

dograh (dograh.com, code source sur github.com/dograh-hq/dograh) est une plateforme open source pour construire des « voice agents » — des bots qui répondent au téléphone, écoutent, raisonnent et répondent en temps réel — que vous déployez vous-même via Docker plutôt que de louer chez un fournisseur hébergé fermé. Elle se positionne, selon sa propre description GitHub, comme une alternative « on-prem, bring-your-own-key » aux plateformes hébergées comme Vapi et Retell. Cette review est le complément de la fiche de dograh dans le répertoire des logiciels d'IA locale et couvre ce qu'est réellement dograh, comment l'auto-héberger, son support des modèles locaux, sa licence, et sa place face à d'autres outils vocaux comme Voxa et Jarvis pour Mac.

dograh Review : plateforme open source d'agents vocaux auto-hébergée

Points clés

  • Auto-hébergé via Docker, gratuit pour toujours ; licence BSD-2-Clause selon le fichier LICENSE du dépôt, copyright Zansat Technologies Private Limited
  • Un constructeur de workflow visuel, à base de nœuds, pour concevoir ce qu'un agent vocal dit et fait à chaque étape d'une conversation
  • Intégrations téléphoniques intégrées, selon la documentation de dograh : Twilio, Vonage, Telnyx, Plivo, Cloudonix, Exotel et Vobiz
  • Inférence LLM locale via tout point de terminaison compatible OpenAI, incluant explicitement Ollama et vLLM, selon la documentation LLM de dograh
  • STT et TTS locaux et auto-hébergés via Speaches, un serveur compatible API OpenAI que dograh nomme directement dans sa documentation voix et transcription ; Speaches repose lui-même, selon sa propre page de projet, sur faster-whisper pour la transcription et Piper/Kokoro pour la synthèse vocale
  • Se connecte aussi à des dizaines de fournisseurs cloud avec vos propres clés API — OpenAI, Deepgram, ElevenLabs, Cartesia, AssemblyAI et plus — pour les équipes qui préfèrent des modèles gérés plutôt qu'auto-hébergés
  • 5 636 étoiles et 1 398 forks sur GitHub, vérifié via l'API GitHub le 12/09/2026 ; dernière version taguée v1.46.0, datée du 3 septembre 2026
  • Une option cloud gérée distincte sur app.dograh.com coûte 0,01 $/minute plus l'usage des fournisseurs LLM/STT/TTS connectés

📍 En une phrase

dograh est une plateforme gratuite et open source (BSD-2-Clause) pour construire des agents vocaux que vous auto-hébergez via Docker, avec une inférence LLM locale via Ollama/vLLM et une reconnaissance/synthèse vocale locale via Speaches, aux côtés de dizaines de fournisseurs cloud avec vos propres clés.

💬 En termes simples

Plutôt que de payer un fournisseur hébergé comme Vapi ou Retell à la minute pour un bot téléphonique IA, dograh vous permet d'exploiter l'ensemble — le constructeur de workflow, la téléphonie et les modèles IA connectés — sur votre propre serveur, y compris des modèles vocaux et de langage entièrement locaux si vous ne voulez faire sortir aucune donnée de conversation de votre infrastructure.

📌Remarque: Cette review est le complément de la fiche de dograh dans le répertoire des logiciels d'IA locale — consultez cette page pour voir en un coup d'œil comment dograh se compare à des dizaines d'autres outils d'IA locale.

Qu'est-ce que dograh ?

dograh est une plateforme pour construire des « voice agents » — des systèmes d'IA qui répondent ou passent des appels téléphoniques (ou gèrent des sessions vocales web), écoutent ce que dit un interlocuteur, décident quoi faire, et répondent vocalement en temps réel. Son propre dépôt GitHub la décrit comme une alternative open source et auto-hébergée à des plateformes comme Vapi et Retell, destinée aux équipes qui veulent le même type de produit sans confier par défaut l'audio et les transcriptions des conversations à un fournisseur tiers.

  • Fonction principale : un constructeur de workflow visuel pour concevoir des conversations vocales à plusieurs tours, relié à un fournisseur de téléphonie d'un côté et à des fournisseurs LLM/STT/TTS de l'autre
  • Modèle de déploiement : une pile Docker Compose que vous exploitez vous-même, sur un ordinateur portable pour le développement ou sur un serveur (la documentation de dograh indique un minimum de 8 Go de RAM et 4 vCPU pour un déploiement distant) pour la production
  • Architecture fournisseurs : « bring your own » LLM, STT et TTS — configurez une clé API cloud, un point de terminaison local compatible OpenAI, ou l'un des modèles gérés propres de dograh, par workflow
  • Développeur : dograh-hq sur GitHub ; le fichier LICENSE du dépôt indique Zansat Technologies Private Limited comme titulaire des droits d'auteur
  • Dépôt canonique : github.com/dograh-hq/dograh, créé en septembre 2025 selon les métadonnées propres de GitHub

Installer dograh : déploiement Docker auto-hébergé

dograh se déploie avec Docker Compose via un script d'installation en une ligne, selon sa propre documentation de déploiement. Il n'y a pas d'installeur de bureau packagé à télécharger — l'auto-hébergement consiste à exécuter ce script sur votre propre machine ou serveur.

  • L'installation locale/de développement ouvre l'application sur http://localhost:3010 une fois les conteneurs démarrés, selon la documentation de dograh
  • Windows utilise un script PowerShell équivalent (start_docker.ps1), récupéré de la même manière, selon la même page de documentation
  • Un script setup_remote.sh distinct cible un déploiement sur serveur de production et nécessite un accès root/sudo, ainsi que Docker et Docker Compose déjà installés
  • La documentation de dograh indique qu'un déploiement sur serveur distant nécessite un minimum de 8 Go de RAM et 4 vCPU, ainsi que les ports TCP entrants 80, 443, 3478 et 5349, et les ports UDP 3478, 5349 et 49152–49200 pour le trafic de téléphonie (WebRTC/SIP)
  • L'exécution de plusieurs workers FastAPI derrière nginx pour un débit plus élevé est documentée séparément dans le guide de scaling de dograh
bash
curl -o docker-compose.yaml https://raw.githubusercontent.com/dograh-hq/dograh/main/docker-compose.yaml && curl -o start_docker.sh https://raw.githubusercontent.com/dograh-hq/dograh/main/scripts/start_docker.sh && chmod +x start_docker.sh && ./start_docker.sh

Support des modèles locaux : LLM, STT et TTS

dograh ne nécessite aucun fournisseur d'IA cloud — un déploiement auto-hébergé peut exécuter entièrement son LLM, sa reconnaissance vocale et sa synthèse vocale sur votre propre matériel, même si cela demande un peu plus de configuration qu'une simple clé API hébergée. La documentation propre de dograh est précise sur ce fonctionnement, et PromptQuorum n'a trouvé aucune revendication de support local au-delà de ce qui est documenté ci-dessous — ce n'est pas une plateforme qui « supporte tout » d'emblée.

Que pouvez-vous construire avec dograh ?

Les fonctionnalités de dograh se concentrent sur le pipeline dont un agent vocal a besoin de bout en bout : un appel arrive, la voix est transcrite, un LLM décide quoi dire, la voix est synthétisée, et l'appel est transféré ou terminé — avec un constructeur visuel pour la logique intermédiaire. Selon le README GitHub et la documentation propres de dograh.

  • Constructeur de workflow visuel — concevoir une logique conversationnelle à plusieurs tours (ce que demande l'agent, comment il se ramifie selon la réponse) sans écrire à la main une machine à états complète
  • Intégrations téléphoniques — connecteurs intégrés pour Twilio, Vonage, Telnyx, Plivo, Cloudonix, Exotel, Vobiz et Asterisk ARI, selon la documentation d'intégration de dograh
  • Bring-your-own LLM/STT/TTS — configurer les fournisseurs par workflow, en mélangeant des composants cloud et locaux/auto-hébergés selon les besoins
  • Mode speech-to-speech — selon la documentation de configuration de dograh, un chemin alternatif qui saute les étapes STT/LLM/TTS séparées au profit d'un modèle speech-to-speech unique, lorsque le fournisseur sous-jacent le supporte
  • Suivi de disposition d'appel — depuis la version v1.46.0, dograh peut déduire une disposition d'appel structurée (par ex. « résolu », « transféré », « sans réponse ») directement à partir de la conversation
  • Transfert assisté vers un humain — transmettre un appel à un agent humain en cours de conversation, avec des dispositions configurables après un transfert réussi
  • Utilisation d'outils native MCP, selon la description propre du dépôt de dograh, pour connecter un agent à des outils externes pendant un appel
  • Authentification et domaines personnalisés en auto-hébergement — la documentation de déploiement propre de dograh couvre la configuration de la connexion et du SSL pour une instance auto-hébergée, distincte du produit cloud géré

Tarifs dograh : auto-hébergement gratuit vs. cloud géré

Auto-héberger dograh via Docker est gratuit, sous licence BSD-2-Clause, sans qu'aucune fonctionnalité verrouillée n'ait été trouvée par PromptQuorum dans le dépôt open source. Un produit cloud géré distinct sur app.dograh.com existe pour les équipes qui veulent le même logiciel sans exploiter leur propre serveur.

Option
Coût
Ce qui est inclus
Auto-hébergé (Docker)GratuitPlateforme complète ; BSD-2-Clause ; serveur + clés API/modèles à votre charge
Cloud géré (app.dograh.com)0,01 $/min + usage fournisseursInfrastructure hébergée ; l'usage LLM/STT/TTS/téléphonie reste facturé séparément

Le montant de 0,01 $/minute et le positionnement « auto-hébergement gratuit pour toujours » proviennent de la fiche répertoire et des supports publics propres de dograh — vérifiez les tarifs actuels du cloud géré directement sur app.dograh.com avant de budgétiser, les tarifs à l'usage d'un produit jeune pouvant changer. Les coûts des fournisseurs (un fournisseur cloud LLM, STT, TTS ou téléphonie facturé séparément) s'appliquent aux deux formules, sauf en cas d'utilisation de modèles entièrement locaux via Ollama/vLLM et Speaches.

Exemples d'usage

Voici des workflows construits à partir des fonctionnalités documentées de dograh ci-dessus, pas des cas d'usage hypothétiques.

Pour qui dograh est-il fait ?

Le fait que dograh convienne dépend de si vous avez besoin spécifiquement d'une plateforme d'agents vocaux auto-hébergeable, et de si votre équipe est à l'aise pour exploiter un déploiement Docker.

dograh face aux autres outils vocaux

dograh se positionne dans le segment des agents vocaux en temps réel, aux côtés d'outils centrés sur l'entrée/sortie vocale plutôt que sur des plateformes complètes de gestion d'appels. Voici comment il se compare à d'autres options couvertes par PromptQuorum — voir le répertoire des logiciels d'IA locale pour le catalogue complet.

  • Voxa — un assistant vocal en temps réel centré sur l'usage personnel/de bureau plutôt que sur la gestion d'appels téléphoniques ; voir la review Voxa si vous voulez un assistant vocal conversationnel, pas un constructeur d'agents téléphoniques.
  • Jarvis pour Mac — un assistant vocal natif macOS ; voir la review Jarvis pour une alternative axée bureau à la plateforme de dograh, déployée sur serveur et orientée téléphonie.
  • faster-whisper — le moteur de transcription sur lequel Speaches (l'option STT/TTS locale documentée de dograh) repose lui-même ; voir la review faster-whisper si vous n'avez besoin que de reconnaissance vocale locale, pas d'une plateforme d'agents complète.
  • Whisper.cpp — un autre moteur de reconnaissance vocale local et auto-hébergé ; voir la review Whisper.cpp pour une option de transcription seule, plus légère que le déploiement de la pile complète de dograh.

Erreurs courantes lors de l'évaluation de dograh

La plupart des confusions autour de dograh viennent du fait de le traiter comme une application téléchargeable, ou de supposer qu'il fonctionne entièrement hors ligne sans aucune configuration.

Questions fréquemment posées

Qu'est-ce que dograh ?

dograh (dograh.com, code source sur github.com/dograh-hq/dograh) est une plateforme open source et auto-hébergée pour construire des agents vocaux — des bots conversationnels téléphoniques ou web —, positionnée comme une alternative aux plateformes hébergées telles que Vapi et Retell.

dograh est-il gratuit ?

Auto-héberger dograh via Docker est gratuit, sous licence BSD-2-Clause. Un produit cloud géré distinct sur app.dograh.com facture 0,01 $/minute plus l'usage des fournisseurs LLM/STT/TTS connectés.

dograh est-il open source ? Quelle licence utilise-t-il ?

Oui. Le fichier LICENSE propre du dépôt est la licence BSD 2-Clause « Simplified », copyright Zansat Technologies Private Limited.

dograh prend-il en charge des modèles d'IA locaux, hors ligne ?

Oui, pour le composant LLM, dograh se connecte selon sa propre documentation à tout point de terminaison local compatible OpenAI, incluant explicitement Ollama et vLLM. Pour la reconnaissance et la synthèse vocale locales, dograh s'intègre à Speaches, un serveur local open source qui repose lui-même sur faster-whisper pour la transcription et Piper/Kokoro pour la synthèse vocale.

Comment installer dograh ?

Exécutez le script d'installation Docker Compose officiel en une ligne depuis un terminal : curl -o docker-compose.yaml https://raw.githubusercontent.com/dograh-hq/dograh/main/docker-compose.yaml && curl -o start_docker.sh https://raw.githubusercontent.com/dograh-hq/dograh/main/scripts/start_docker.sh && chmod +x start_docker.sh && ./start_docker.sh. Le déploiement local s'ouvre sur http://localhost:3010.

Quels fournisseurs de téléphonie dograh prend-il en charge ?

Des intégrations intégrées pour Twilio, Vonage, Telnyx, Plivo, Cloudonix, Exotel, Vobiz et Asterisk ARI, selon la documentation d'intégration propre de dograh.

Combien d'étoiles GitHub dograh a-t-il ?

dograh comptait 5 636 étoiles et 1 398 forks sur GitHub, vérifié via l'API GitHub le 12/09/2026. Consultez le dépôt en direct pour le nombre actuel, ce chiffre évoluant en continu.

Quelle est la dernière version de dograh ?

Au 12/09/2026, la dernière version taguée sur GitHub était v1.46.0, datée du 3 septembre 2026, qui a ajouté la déduction de la disposition d'appel à partir du contenu de la conversation et le modèle TTS Sonic-3.6 de Cartesia, entre autres changements — consultez GitHub Releases pour la version actuelle.

Quelles sont les exigences serveur minimales pour auto-héberger dograh ?

La documentation de déploiement propre de dograh indique un minimum de 8 Go de RAM et 4 vCPU pour un déploiement sur serveur distant, ainsi que les ports TCP entrants 80, 443, 3478 et 5349, et les ports UDP 3478, 5349 et 49152–49200 pour le trafic de téléphonie.

Qui développe dograh ?

dograh est développé par dograh-hq sur GitHub ; le fichier LICENSE du dépôt indique Zansat Technologies Private Limited comme titulaire des droits d'auteur. Le dépôt a été créé en septembre 2025, selon les métadonnées propres de GitHub.

Sources

← Retour aux LLM locaux avancés