Skip to main content
PromptQuorumBuilt for humans. Structured for AI.
Accueil/LLM locaux avancés/Ollama Local AI : Avis — Exécuteur de LLM Android et Proxy d'API sur le LAN
Mobile & Edge LLMs

Ollama Local AI : Avis — Exécuteur de LLM Android et Proxy d'API sur le LAN

·8 min de lecture·Par Hans Kuepper · Fondateur de PromptQuorum, outil de dispatch multi-modèle · PromptQuorum

Ollama Local AI est une application Android tierce indépendante (paquet Google Play com.llmproxy, développeur répertorié sous le nom FreeRouter Team) qui exécute des modèles GGUF sur l'appareil via llama.cpp et sert une API compatible OpenAI aux autres appareils de votre Wi-Fi. Elle peut aussi transmettre des requêtes à un serveur Ollama auto-hébergé, à un serveur llama.cpp ou à des API cloud comme OpenAI et Anthropic, mais se connecter à un serveur Ollama ne la rend pas partie d'Ollama : la fiche indique elle-même que l'application n'est pas affiliée au projet Ollama. Aucune licence, aucun code source ni aucun numéro de version n'est publié dans la fiche ; il convient donc de la traiter comme un utilitaire non audité jusqu'à nouvel ordre du développeur.

Ollama Local AI est une application Android tierce indépendante qui exécute des modèles d'IA locaux sur le téléphone et peut se connecter à des serveurs Ollama. Ce n'est pas le logiciel Ollama et elle n'est pas créée par le projet Ollama. Google Play indique FreeRouter Team comme développeur. L'application remplit deux fonctions : elle exécute des modèles de langage GGUF sur le téléphone grâce à un moteur llama.cpp embarqué, et elle expose une API compatible OpenAI sur votre Wi-Fi afin que des outils comme Cursor, des extensions VS Code et Windsurf puissent utiliser le téléphone comme point de terminaison de modèle. Elle est gratuite à installer avec des achats intégrés. Cet avis se fonde uniquement sur la fiche Google Play de l'application, consultée le 2 octobre 2026, car aucun dépôt de code source public, site web de développeur ni documentation détaillée du développeur n'a été identifié à partir de cette fiche, et PromptQuorum n'a pas testé l'application en pratique.

Ollama Local AI : Avis — Exécuteur de LLM Android et Proxy d'API sur le LAN

Points clés

  • Développeur : Google Play identifie FreeRouter Team comme développeur (catégorie Productivité) et fournit des coordonnées de contact du développeur ; aucun dépôt de code source public, site web de développeur ni documentation détaillée du développeur n'a été identifié à partir de la fiche.
  • Prix : gratuite à installer, avec des achats intégrés dont le contenu n'est pas décrit.
  • Modèles sur l'appareil : des fichiers GGUF exécutés par un moteur llama.cpp embarqué ; la fiche cite Llama 3, Mistral, Phi, Gemma et Qwen comme exemples.
  • Passerelle LAN : expose des points de terminaison de type OpenAI aux autres appareils de votre Wi-Fi et peut router vers des modèles locaux, Ollama auto-hébergé, des serveurs llama.cpp, OpenAI, Anthropic, NVIDIA NIM et Hugging Face.
  • Indicateurs de la boutique, consultés le 2 octobre 2026 : plus de 10 000 téléchargements, 4,2 étoiles sur 267 avis, dernière mise à jour le 1er octobre 2026.

📍 En une phrase

Ollama Local AI est une application Android de FreeRouter Team qui exécute des modèles GGUF sur l'appareil via llama.cpp et sert une API compatible OpenAI sur votre réseau local, et elle n'est pas affiliée au projet Ollama.

💬 En termes simples

On l'installe sur un téléphone Android, on charge un modèle ou on ajoute ses clés d'API cloud, on appuie sur « Start Server », puis on dirige des outils comme Cursor ou VS Code vers l'adresse locale du téléphone au lieu d'OpenAI — c'est donc le téléphone qui fait le travail, ou qui relaie la requête, à la place de votre ordinateur.

📌Remarque: Avertissement d'entité : bien qu'elle utilise « Ollama » dans son nom de produit, Ollama Local AI est une application Android tierce indépendante. Elle n'est ni créée, ni affiliée, ni sponsorisée, ni approuvée par le projet Ollama. L'application peut se connecter à des serveurs Ollama, mais Ollama Local AI n'est pas elle-même le logiciel Ollama.

📌Remarque: Cet avis se fonde uniquement sur la fiche Google Play, consultée le 2 octobre 2026. PromptQuorum n'a identifié ni dépôt de code source public, ni licence indiquée, ni numéro de version, ni documentation détaillée du développeur, et n'a ni testé ni évalué par benchmark l'application.

Qu'est-ce qu'Ollama Local AI ?

Ollama Local AI est une application Android qui combine un exécuteur de modèles sur l'appareil et une passerelle d'API pour réseau local. Selon sa fiche Google Play, elle exécute des modèles GGUF quantifiés directement sur le CPU ou le GPU du téléphone grâce à un moteur llama.cpp embarqué, et peut aussi servir de routeur qui transmet les requêtes à d'autres backends que vous configurez.

Le nom est la principale source de confusion. L'avertissement final de la fiche indique que l'application est un utilitaire de développeur indépendant, non affilié, non sponsorisé et non approuvé par Ollama, OpenAI, Anthropic ni aucun fournisseur mentionné. L'application peut se connecter à un serveur Ollama que vous hébergez ailleurs, mais se connecter à un serveur Ollama n'établit aucune affiliation et, selon la fiche, l'application exécute son propre moteur llama.cpp embarqué plutôt qu'Ollama. Les résultats de recherche et le nom de paquet Play (com.llmproxy) désignent la même application.

Trois termes sont employés strictement dans cet avis : Ollama désigne le projet open source distinct et son logiciel ; Ollama Local AI désigne l'application Android indépendante présentée ici ; un serveur Ollama est une installation d'Ollama que vous exploitez vous-même et à laquelle l'application peut se connecter.

Où la télécharger

Le seul canal de téléchargement vers lequel la fiche renvoie est Google Play ; aucune version iOS, aucune version de bureau, aucun miroir d'APK ni aucune release GitHub n'est lié.

Plateforme
Où la trouver
AndroidGoogle Play
iOS / bureauNon proposée, selon la fiche

Cette page est un complément à l'entrée de l'application dans le Local LLM Software Directory. Aucun numéro de version n'apparaît dans le texte de la fiche que PromptQuorum a pu lire ; il n'en est donc indiqué aucun ici — consultez la page Play pour la version actuelle.

Connecter votre IDE via le Wi-Fi

Le démarrage rapide de la fiche comporte quatre étapes, toutes réalisées sur le téléphone et sur le même réseau privé. PromptQuorum n'a pas exécuté ces étapes.

  1. 1
    Lancer le serveur
    Why it matters: Ouvrez l'application, choisissez un modèle GGUF local ou saisissez des clés de fournisseurs cloud, puis appuyez sur « Start Server ».
  2. 2
    Noter le point de terminaison
    Why it matters: L'application affiche l'IP locale et le port du téléphone, par exemple http://192.168.1.50:8080/v1 dans l'exemple de la fiche elle-même.
  3. 3
    Diriger votre outil vers lui
    Why it matters: Dans Cursor, saisissez n'importe quelle valeur factice comme clé OpenAI et remplacez l'URL de base. Dans les extensions VS Code comme Continue, Cline ou Roo Code, réglez le type de fournisseur sur openai et apiBase ou baseUrl sur l'adresse du téléphone. Dans Windsurf, dirigez les points de terminaison de modèles OpenAI personnalisés vers lui.
  4. 4
    Commencer à coder
    Why it matters: Les requêtes et les boucles d'agent de l'outil de bureau sont alors traitées par le téléphone, soit par le modèle sur l'appareil, soit par le fournisseur vers lequel il route.

Fonctions confirmées par la fiche

Chaque élément ci-dessous provient de la description Play du développeur ; aucun n'a été testé de façon indépendante.

  • Points de terminaison de type OpenAI. /v1/chat/completions, /v1/models et /health, accessibles depuis toute machine du même Wi-Fi ou sous-réseau LAN.
  • Routage multi-fournisseurs. Bascule entre modèles sur l'appareil, instances Ollama auto-hébergées, serveurs llama.cpp et API cloud directes (OpenAI, Anthropic Claude, NVIDIA NIM, Hugging Face).
  • Contrôles du proxy. Files de requêtes, délais d'expiration par fournisseur, limitation de débit, basculement automatique et répartition en round-robin.
  • Clustering LAN Master/Worker. Associez plusieurs appareils Android d'un même réseau pour mutualiser mémoire et puissance de calcul en un cluster d'inférence.
  • WebUI multi-appareils. Une interface de chat et une console de gestion du serveur accessibles depuis le navigateur d'un PC ou d'une tablette sur le même réseau.
  • WebX Live Canvas. Génère et prévisualise du HTML, du Tailwind CSS et du JavaScript directement dans le chat.
  • Traffic Observatory. Vitesse de génération de tokens, métriques de latence et contenus des requêtes affichés comme diagnostics du proxy.
  • Clients compatibles cités. Cursor, VS Code, Windsurf, JetBrains, LangChain, LlamaIndex, LiteLLM, AutoGen, CrewAI, Continue.dev, Cline, Roo Code, Aider et Open WebUI.

Confidentialité et sécurité des données

La section Sécurité des données de Google Play de l'application déclare qu'aucune donnée n'est collectée et qu'aucune n'est partagée avec des tiers. Il s'agit d'une déclaration du développeur, non d'un résultat d'audit, et PromptQuorum n'a inspecté ni le trafic réseau ni le code de l'application.

La description ajoute des affirmations précises : les identifiants des fournisseurs sont stockés sur l'appareil avec AES-256 EncryptedSharedPreferences, et les requêtes vers des points de terminaison cloud personnalisés vont directement du téléphone au fournisseur, sans serveur intermédiaire. Le tableau de la confidentialité dépend aussi du routage : une requête envoyée à OpenAI, Anthropic ou un autre fournisseur cloud quitte votre réseau et relève des conditions de ce fournisseur, quelle que soit la déclaration de l'application. Seules les requêtes traitées par un modèle sur l'appareil restent sur le téléphone.

📌Remarque: Aucun code source public de l'application n'a été identifié, de sorte que les affirmations ci-dessus ne peuvent pas être vérifiées par rapport au code. Quiconque traite des données réglementées ou confidentielles doit vérifier lui-même le comportement avant de s'y fier.

Compromis : avantages et limites

Téléphone comme point de terminaison d'API

En pratique:
Les outils de codage de bureau peuvent utiliser le modèle ou les routes du téléphone sans serveur distinct.
Limite / réserve:
La vitesse est limitée par le matériel du téléphone, et la fiche ne donne aucun benchmark.

Modèles GGUF sur l'appareil

En pratique:
Les conversations avec des modèles locaux ne nécessitent aucune connexion internet, selon la fiche.
Limite / réserve:
La taille de modèle utilisable dépend de la RAM du téléphone ; la fiche n'indique aucun minimum.

Une passerelle, plusieurs backends

En pratique:
Modèles locaux, Ollama, serveurs llama.cpp et API cloud sont regroupés derrière une seule adresse.
Limite / réserve:
Les requêtes routées vers le cloud quittent votre réseau et suivent les conditions de données du fournisseur.

Gratuite à installer

En pratique:
Vous pouvez essayer le flux principal sans payer d'abord.
Limite / réserve:
Des achats intégrés existent et leur contenu n'est pas décrit dans la fiche.

À qui elle convient

  • Développeurs disposant d'un téléphone Android de rechange. Le démarrage rapide avec Cursor, VS Code et Windsurf est le cas d'usage central de l'application, et le téléphone décharge le PC principal.
  • Utilisateurs qui veulent une seule adresse de type OpenAI devant plusieurs backends. Les contrôles de routage, de basculement et de limitation de débit visent cette configuration.
  • Utilisateurs de home lab à l'aise pour tester un utilitaire non audité sur un réseau privé. Une installation gratuite rend l'essai peu coûteux.

Ce que nous n'avons pas pu vérifier

  • Licence et code source. Licence : non indiquée dans la fiche Google Play, et aucun dépôt de code source public n'a été identifié. Toute licence du projet Ollama, distinct, ne dit rien de cette application. Les lecteurs qui ont besoin d'un code auditable devraient choisir une application open source parmi les alternatives ci-dessous.
  • Numéro de version. Le texte de la fiche que PromptQuorum a pu lire n'indique aucune version ; cette page ne peut donc pas rattacher ses affirmations à une build précise.
  • Achats intégrés. La fiche indique qu'ils existent, mais pas ce qu'ils débloquent ni ce qu'ils coûtent.
  • Matériel minimal et performances. Aucune RAM minimale, version d'Android ni chiffre de vitesse n'est publié.
  • Identité du développeur et possibilité de vérification. Google Play identifie FreeRouter Team comme développeur et fournit des coordonnées de contact du développeur. En revanche, aucun site web de développeur, dépôt de code source public ni documentation détaillée du développeur n'a été identifié à partir de la fiche ; le comportement de l'application ne peut donc pas être vérifié au-delà de ce que la fiche indique.
  • Pas pour les utilisateurs d'iOS ou de bureau. L'application est réservée à Android.

Concurrents et alternatives

PocketPal AI

Plateformes:
Android, iOS
Prix / licence:
Gratuite / MIT
Différence clé:
Client de chat open source sur l'appareil

Maid

Plateformes:
Android
Prix / licence:
Gratuite / MIT
Différence clé:
Application de chat open source pour GGUF local ou fournisseurs distants

RikkaHub

Plateformes:
Android
Prix / licence:
Gratuite / open source
Différence clé:
Client de chat multi-fournisseurs

Layla

Plateformes:
Android, iOS
Prix / licence:
Payante / code source fermé
Différence clé:
Orientée compagnon et jeu de rôle, avec un mode cloud optionnel

Les détails des concurrents changent souvent ; vérifiez le prix et la licence actuels de chaque application sur sa propre fiche.

Questions fréquentes

Ollama Local AI est-elle créée par l'équipe Ollama ?

Non. L'avertissement de la fiche indique que l'application est indépendante et non affiliée ni approuvée par Ollama. Elle peut se connecter à un serveur Ollama que vous exploitez vous-même, mais elle embarque son propre moteur llama.cpp.

Qui crée Ollama Local AI, et le développeur a-t-il un site web ?

Google Play identifie FreeRouter Team comme développeur et fournit des coordonnées de contact du développeur. Aucun site web de développeur, dépôt de code source public ni documentation détaillée du développeur n'a été identifié à partir de la fiche, et le développeur n'est pas présenté comme le développeur d'Ollama.

Quel est le nom de paquet sur Google Play ?

L'identifiant du paquet est com.llmproxy, ce qui explique que l'application apparaisse dans les recherches « LLM Proxy » alors que son nom dans la boutique est Ollama Local AI.

Fonctionne-t-elle sur iPhone ou sur ordinateur ?

Pas d'après la fiche : Google Play est le seul canal qu'elle indique, et aucune version iOS ou de bureau n'est mentionnée.

Quels modèles peut-elle exécuter sur le téléphone ?

Des modèles au format GGUF via llama.cpp. La fiche cite Llama 3, Mistral, Phi, Gemma et Qwen comme exemples ; les tailles qui conviennent dépendent de la RAM de votre téléphone, que la fiche ne précise pas.

Puis-je l'utiliser avec Cursor ou VS Code ?

La fiche décrit exactement cela : démarrer le serveur sur le téléphone, puis régler l'URL de base OpenAI de l'outil sur l'adresse locale du téléphone. PromptQuorum n'a pas testé ces étapes.

Mes données restent-elles sur le téléphone ?

Seulement pour les requêtes traitées par un modèle sur l'appareil. Les requêtes routées vers OpenAI, Anthropic, NVIDIA NIM ou Hugging Face vont chez ces fournisseurs, et la déclaration de non-collecte de données du développeur n'est pas auditée.

Est-elle open source ?

Licence : non indiquée dans la fiche Google Play, et aucun dépôt de code source public n'a été identifié ; PromptQuorum ne peut donc pas confirmer que l'application est open source. Si le développeur publie une licence ou le code source, cet avis sera mis à jour.

Que débloquent les achats intégrés ?

La fiche ne le dit pas. Vérifiez dans l'application avant d'acheter, et utilisez le délai de remboursement de Google Play si le résultat ne correspond pas à vos attentes.

Verdict

Ollama Local AI répond à un besoin étroit mais réel : utiliser un téléphone Android comme point de terminaison compatible OpenAI pour des outils de codage de bureau, tout en exécutant des modèles GGUF sur l'appareil. La fiche Play décrit un ensemble de fonctions qui va au-delà du simple chat sur l'appareil — service LAN, routage multi-fournisseurs, basculement, clustering et diagnostics de trafic — et les indicateurs de la boutique au 2 octobre 2026 (plus de 10 000 téléchargements, une note de 4,2) laissent penser à un usage réel. En face, l'application est un utilitaire non audité : Google Play identifie FreeRouter Team comme développeur et fournit des coordonnées de contact, mais aucun site web de développeur ni dépôt de code source public n'a été identifié, sa version, sa licence, son matériel minimal et la portée des achats ne sont pas indiqués dans la fiche, et son nom prête à confusion avec le projet Ollama, distinct, auquel elle n'est pas affiliée. Elle convient aux développeurs qui veulent expérimenter une configuration téléphone-passerelle sur un réseau privé ; les lecteurs qui ont besoin d'un code auditable ou d'une prise en charge d'iOS devraient commencer par PocketPal AI ou Maid.

Sources

  • Ollama Local AI sur Google Play — description, nom du développeur et coordonnées de contact, déclaration de sécurité des données, nombre de téléchargements, note et date de dernière mise à jour, consultés le 2 octobre 2026.

← Retour aux LLM locaux avancés