Skip to main content
PromptQuorum
Accueil/LLM locaux avancés/Voxa : avis 2026 sur l'assistant vocal privé pour bureau
Voice, Speech & Multimodal

Voxa : avis 2026 sur l'assistant vocal privé pour bureau

·9 min de lecture·Par Hans Kuepper · Fondateur de PromptQuorum, outil de dispatch multi-modèle · PromptQuorum

Voxa est un assistant vocal de bureau open source sous licence MIT (Tauri v2) qui se présente sous forme d'orbe flottant, toujours au premier plan — le toucher pour démarrer une conversation vocale en temps réel. Il n'est pas exclusivement local : il peut utiliser des modèles vocaux temps réel cloud (Gemini Live ou OpenAI Realtime) ou un démon local auto-hébergé que vous configurez vous-même, et il enregistre les notes sous forme de fichiers Markdown en clair sur votre propre machine.

Voxa, disponible sur askvoxa.dev, est un assistant vocal de bureau open source qui se présente sous la forme d'un orbe sans bordure, toujours au premier plan, que l'on touche pour démarrer une conversation vocale en temps réel. Il est construit avec Tauri v2 et publié sous licence MIT, et il recherche et enregistre les notes locales sous forme de fichiers Markdown en clair sur votre machine. Voxa est hybride plutôt qu'exclusivement local : il peut acheminer les conversations via des modèles vocaux temps réel cloud (Google Gemini Live ou OpenAI Realtime) ou via un démon local auto-hébergé que vous configurez vous-même.

Voxa : avis 2026 sur l'assistant vocal privé pour bureau

Points clés

  • Construit avec Tauri v2, publié sous licence MIT — aucun logiciel backend propriétaire requis pour faire tourner l'application elle-même
  • Interface : un orbe sans bordure, toujours au premier plan, plutôt qu'une fenêtre classique ou un onglet de navigateur
  • Backend hybride : voix temps réel cloud (Google Gemini Live ou OpenAI Realtime) ou démon local auto-hébergé que l'on configure soi-même
  • Les notes et résultats de recherche sont enregistrés en fichiers Markdown en clair sur le système de fichiers local, pas dans une base de données propriétaire
  • Configuration, données et clés API sont stockées sur la machine de l'utilisateur
  • Disponible pour Windows (WebView2), macOS (WKWebView) et Linux (WebKitGTK 4.1)
  • Site officiel : askvoxa.dev

📍 En une phrase

Voxa est un assistant vocal de bureau open source sous licence MIT, construit avec Tauri v2, qui se présente comme un orbe flottant toujours au premier plan, prend en charge la conversation vocale en temps réel via un fournisseur cloud (Gemini Live ou OpenAI Realtime) ou un démon local auto-hébergé, et enregistre les notes en fichiers Markdown en clair sur la machine de l'utilisateur.

💬 En termes simples

Au lieu d'ouvrir un onglet de navigateur ou une fenêtre d'application, on obtient un petit cercle flottant qui reste au-dessus des autres fenêtres. On le touche et on parle : il peut utiliser un service vocal cloud ou, si on le configure soi-même, un modèle vocal tournant sur son propre ordinateur, et il écrit les notes sous forme de fichiers texte que l'on peut ouvrir dans n'importe quel éditeur.

📌Remarque: Voxa n'est pas un outil exclusivement local. Le backend cloud (Gemini Live ou OpenAI Realtime) est la voie la plus simple et dépend de l'API de ce fournisseur et d'une connexion internet ; une configuration entièrement locale exige de faire pointer Voxa vers son propre démon auto-hébergé. Voir « Voxa est-il vraiment local ? » ci-dessous avant de supposer qu'il s'agit d'un outil local sans cloud ni configuration.

Qu'est-ce que Voxa ?

Voxa est un assistant vocal de bureau open source, publié sur askvoxa.dev et construit avec Tauri v2, un framework pour créer des applications de bureau multiplateformes légères avec une interface web enveloppée dans une coque native. Voxa est publié sous licence MIT.

  • Modèle d'interaction principal : un orbe sans bordure, toujours au premier plan, qui flotte au-dessus des autres fenêtres — le toucher démarre une conversation vocale en temps réel, plutôt que d'ouvrir une fenêtre de chat séparée ou un onglet de navigateur
  • Le backend de modèle est configurable, pas figé sur un seul fournisseur : modèles vocaux temps réel cloud (Google Gemini Live ou OpenAI Realtime) ou démon local auto-hébergé
  • Construit avec Tauri v2, qui affiche l'interface via le moteur web du système d'exploitation (WebView2 sous Windows, WKWebView sous macOS, WebKitGTK 4.1 sous Linux) au lieu d'embarquer un moteur de navigateur séparé comme le fait Electron
  • Les notes et informations que l'assistant recherche ou est chargé d'enregistrer sont écrites en fichiers Markdown en clair sur le système de fichiers local
  • Aucun serveur backend propriétaire exploité par Voxa lui-même — la configuration, les données et les clés API de l'application restent sur votre machine ; les appels cloud vont directement au fournisseur de modèle configuré (Google ou OpenAI), pas à un serveur exploité par Voxa

Quelles sont les fonctionnalités clés de Voxa ?

Les trois caractéristiques déterminantes de Voxa sont l'orbe vocal toujours au premier plan, le stockage des notes en Markdown et sa base open source Tauri v2. Chacune façonne le comportement de l'application par rapport à un assistant vocal cloud dans le navigateur ou par abonnement.

Voxa est-il vraiment local ?

Voxa est une application hybride, pas exclusivement locale — il faut être clair sur cette distinction avant de le choisir comme outil « IA locale ». Il prend en charge deux voies de backend distinctes pour le modèle vocal, et une seule maintient l'inférence sur votre propre matériel.

  • Modèles vocaux temps réel cloud — Voxa peut acheminer la conversation vocale en temps réel via Google Gemini Live ou OpenAI Realtime. Cette voie nécessite une connexion internet et vos propres identifiants/accès API chez ce fournisseur ; le modèle vocal lui-même tourne sur les serveurs de ce fournisseur, pas sur votre appareil.
  • Démon local auto-hébergé — Voxa peut à la place pointer vers un démon local que vous configurez et faites tourner vous-même, gardant l'inférence du modèle vocal sur votre propre machine ou réseau plutôt que d'envoyer l'audio à un fournisseur cloud. C'est cette voie qui fait de Voxa un outil d'IA locale, mais c'est une configuration facultative à faire soi-même, pas le comportement par défaut sans configuration.

📌Remarque: Ce qui reste local quel que soit le backend choisi : la configuration propre de l'application, vos notes (enregistrées en fichiers Markdown en clair) et vos clés API — stockées sur votre machine, pas sur un serveur exploité par Voxa. Ce qui ne reste pas local par défaut : le modèle vocal temps réel lui-même, sauf si la voie du démon local auto-hébergé a été configurée.

Voxa sur Windows, macOS et Linux

Windows

À quoi s'attendre:
Voxa affiche son interface via WebView2, le moteur web basé sur Chromium que Microsoft fournit avec les versions modernes de Windows. Un runtime WebView2 à jour est nécessaire pour que l'interface de l'orbe et l'interface vocale s'affichent correctement.

macOS

À quoi s'attendre:
Voxa utilise WKWebView, le moteur de rendu web intégré d'Apple, pour son interface. Tauri s'appuyant sur le moteur fourni par le système plutôt que d'en embarquer un, le comportement suit la version de WKWebView livrée avec votre version de macOS.

Linux

À quoi s'attendre:
Voxa utilise WebKitGTK 4.1 pour son interface sous Linux. Il s'agit d'une version précise de WebKitGTK, pas d'« un build WebKit quelconque » — vérifiez que votre distribution empaquette WebKitGTK 4.1 (ou une version compatible) avant l'installation, car les versions plus anciennes des paquets de distribution peuvent ne pas correspondre.

Tauri v2 affichant l'interface via le moteur web propre à chaque système d'exploitation plutôt qu'un moteur de navigateur embarqué, la version minimale exacte d'OS/moteur pour chaque plateforme ne peut pas être fixée ici comme un chiffre permanent — vérifiez les exigences de plateforme actuelles directement sur askvoxa.dev avant l'installation.

Qui devrait utiliser Voxa ?

Le bon choix dépend de la question de savoir si un orbe vocal toujours visible et des notes en Markdown correspondent à la façon dont on souhaite parler à un assistant, et si l'on est prêt à configurer un démon local si l'inférence entièrement locale est importante.

Erreurs courantes à propos de Voxa

La plupart des confusions à propos de Voxa viennent du fait de supposer qu'il se comporte soit comme une application purement locale, soit comme une application purement cloud, alors qu'il est conçu comme un hybride configurable des deux.

Questions fréquentes

Qu'est-ce que Voxa ?

Voxa est un assistant vocal de bureau open source sous licence MIT, construit avec Tauri v2, disponible sur askvoxa.dev. Il se présente sous forme d'orbe sans bordure, toujours au premier plan, que l'on touche pour démarrer une conversation vocale en temps réel, et peut utiliser comme backend un modèle vocal temps réel cloud ou un démon local auto-hébergé.

Voxa est-il gratuit ?

Le code de l'application Voxa lui-même est open source sous licence MIT. En cas d'utilisation du backend vocal temps réel cloud (Gemini Live ou OpenAI Realtime), les tarifs et conditions API propres à ce fournisseur s'appliquent, indépendamment de Voxa lui-même. Vérifiez les tarifs actuels de Gemini Live ou OpenAI Realtime directement auprès de Google ou d'OpenAI.

Voxa fonctionne-t-il entièrement hors ligne ?

Seulement si la voie du démon local auto-hébergé est configurée. Par défaut, Voxa est configuré pour utiliser un fournisseur vocal temps réel cloud (Gemini Live ou OpenAI Realtime), ce qui nécessite une connexion internet. Une configuration entièrement hors ligne est possible mais exige de faire tourner son propre démon local et d'y faire pointer Voxa.

Quelles plateformes Voxa prend-il en charge ?

Windows (avec le moteur WebView2), macOS (avec WKWebView) et Linux (avec WebKitGTK 4.1). Voxa est une application de bureau construite avec Tauri v2, pas une application mobile pour iOS ou Android.

Où Voxa stocke-t-il mes notes ?

Sous forme de fichiers Markdown en clair sur le système de fichiers local, pas dans une base de données propriétaire ou un format exclusivement cloud. Les notes restent donc lisibles et modifiables dans n'importe quel éditeur de texte, que Voxa soit installé ou en cours d'exécution.

Voxa envoie-t-il mes clés API ou mes données quelque part ?

La configuration, les données et les clés API sont stockées sur votre propre machine. En cas d'utilisation du backend vocal temps réel cloud, l'audio et les données de conversation sont envoyés au fournisseur configuré (Google Gemini Live ou OpenAI Realtime), selon les conditions de traitement des données propres à ce fournisseur — pas à un serveur séparé exploité par Voxa.

Quelle est la différence entre le backend cloud et le backend démon local dans Voxa ?

Le backend cloud (Gemini Live ou OpenAI Realtime) achemine le modèle vocal temps réel via les serveurs de ce fournisseur et nécessite une connexion internet et un accès API chez ce fournisseur. Le backend démon local auto-hébergé garde l'inférence du modèle vocal sur du matériel que vous contrôlez, mais il faut configurer et faire tourner ce démon soi-même — il n'est pas préconfiguré.

Voxa est-il open source ?

Oui. Voxa est construit avec Tauri v2 et publié sous licence MIT, une licence permissive qui autorise la consultation, la modification et la redistribution du code source sans restriction sur l'usage commercial.

Puis-je utiliser Voxa sans connexion internet ?

Seulement si le démon local auto-hébergé est configuré et en cours d'exécution comme backend de modèle vocal. La voie vocale temps réel cloud (Gemini Live ou OpenAI Realtime) nécessite une connexion pour fonctionner.

Voxa nécessite-t-il un moteur de navigateur précis sur mon système ?

Oui, indirectement — étant construit avec Tauri v2, Voxa affiche son interface via le moteur web propre au système d'exploitation : WebView2 sous Windows, WKWebView sous macOS et WebKitGTK 4.1 sous Linux. Assurez-vous que le moteur concerné est présent et à jour sur votre système avant l'installation.

Sources

← Retour aux LLM locaux avancés