Wichtigste Erkenntnisse
- Entwickler: Google Play nennt FreeRouter Team als Entwickler (Kategorie Produktivität) und gibt Kontaktdaten des Entwicklers an; anhand des Eintrags wurden weder ein öffentliches Quellcode-Repository noch eine Entwickler-Website oder eine ausführliche Entwicklerdokumentation ermittelt.
- Preis: kostenlos installierbar, mit In-App-Käufen, deren Inhalt nicht beschrieben ist.
- Modelle auf dem Gerät: GGUF-Dateien, ausgeführt über eine eingebettete llama.cpp-Engine; der Eintrag nennt Llama 3, Mistral, Phi, Gemma und Qwen als Beispiele.
- LAN-Gateway: stellt anderen Geräten in Ihrem WLAN OpenAI-artige Endpunkte bereit und kann an lokale Modelle, selbst gehostetes Ollama, llama.cpp-Server, OpenAI, Anthropic, NVIDIA NIM und Hugging Face weiterleiten.
- Store-Signale, Stand der Prüfung am 2. Oktober 2026: 10K+ Downloads, 4,2 Sterne aus 267 Rezensionen, Eintrag zuletzt am 1. Oktober 2026 aktualisiert.
📍 In einem Satz
Ollama Local AI ist eine Android-App des FreeRouter Team, die GGUF-Modelle über llama.cpp auf dem Gerät ausführt und in Ihrem lokalen Netzwerk eine OpenAI-kompatible API bereitstellt; sie steht in keiner Verbindung zum Ollama-Projekt.
💬 In einfachen Worten
Sie installieren die App auf einem Android-Smartphone, laden ein Modell oder hinterlegen Ihre Cloud-API-Schlüssel, tippen auf „Start Server“ und richten dann Tools wie Cursor oder VS Code statt auf OpenAI auf die lokale Adresse des Smartphones — das Smartphone erledigt also die Arbeit oder leitet die Anfrage weiter, statt Ihres Computers.
📌Hinweis: Entitätshinweis: Trotz „Ollama“ im Produktnamen ist Ollama Local AI eine unabhängige Android-Anwendung eines Drittanbieters. Sie wird nicht vom Ollama-Projekt hergestellt und ist weder mit diesem verbunden noch wird sie von ihm gesponsert oder unterstützt. Die App kann sich mit Ollama-Servern verbinden, aber Ollama Local AI selbst ist nicht die Ollama-Software.
📌Hinweis: Dieser Test stützt sich ausschließlich auf den Google-Play-Eintrag, geprüft am 2. Oktober 2026. PromptQuorum hat weder ein öffentliches Quellcode-Repository noch eine angegebene Lizenz, eine Versionsnummer oder eine ausführliche Entwicklerdokumentation ermittelt und die App weder getestet noch einem Benchmark unterzogen.
Was ist Ollama Local AI?
Ollama Local AI ist eine Android-App, die einen Modell-Runner auf dem Gerät mit einem API-Gateway im lokalen Netzwerk verbindet. Laut ihrem Google-Play-Eintrag führt sie quantisierte GGUF-Modelle direkt auf der CPU oder GPU des Smartphones über eine eingebettete llama.cpp-Engine aus und kann zusätzlich als Router arbeiten, der Anfragen an andere von Ihnen konfigurierte Backends weiterleitet.
Der Name ist die Hauptquelle von Verwechslungen. Der abschließende Haftungsausschluss des Eintrags besagt, dass die App ein unabhängiges Hilfsprogramm eines Entwicklers ist und nicht mit Ollama, OpenAI, Anthropic oder einem erwähnten Anbieter verbunden ist und von diesen weder gesponsert noch unterstützt wird. Die App kann eine Verbindung zu einem Ollama-Server herstellen, den Sie anderswo hosten, doch die Verbindung zu einem Ollama-Server begründet keinerlei Zugehörigkeit, und laut Eintrag nutzt die App ihre eigene eingebettete llama.cpp-Engine statt Ollama. Suchergebnisse und der Play-Paketname (com.llmproxy) beziehen sich auf dieselbe App.
Drei Begriffe werden in diesem Test streng unterschieden: Ollama ist das eigenständige Open-Source-Projekt und seine Software; Ollama Local AI ist die hier getestete unabhängige Android-App; ein Ollama-Server ist eine Ollama-Installation, die Sie selbst betreiben und mit der sich die App verbinden kann.
Bezugsquelle
Der einzige Download-Kanal, auf den der Eintrag verweist, ist Google Play; weder eine iOS-Version noch eine Desktop-Version, ein APK-Mirror oder ein GitHub-Release ist verlinkt.
Plattform | Bezugsquelle |
|---|---|
| Android | Google Play |
| iOS / Desktop | Laut Eintrag nicht angeboten |
Diese Seite ist Begleitmaterial zum Eintrag der App im Local LLM Software Directory. Im Eintragstext, den PromptQuorum lesen konnte, ist keine Versionsnummer angegeben, daher wird hier keine genannt; den zum Zeitpunkt Ihres Besuchs verfügbaren Build finden Sie im Play-Eintrag.
So verbinden Sie Ihre IDE über WLAN
Die eigene Kurzanleitung des Eintrags umfasst vier Schritte, die alle auf dem Smartphone und im selben privaten Netzwerk erfolgen. PromptQuorum hat diese Schritte nicht ausgeführt.
- 1Server starten
Why it matters: Öffnen Sie die App, wählen Sie ein lokales GGUF-Modell oder geben Sie Schlüssel von Cloud-Anbietern ein und tippen Sie auf „Start Server“. - 2Endpunkt notieren
Why it matters: Die App zeigt die lokale IP-Adresse und den Port des Smartphones an, im Beispiel des Eintrags etwa http://192.168.1.50:8080/v1. - 3Ihr Tool darauf richten
Why it matters: Geben Sie in Cursor einen beliebigen Platzhalter als OpenAI-Schlüssel ein und überschreiben Sie die Basis-URL. Setzen Sie in VS-Code-Erweiterungen wie Continue, Cline oder Roo Code den Anbietertyp auf openai und apiBase bzw. baseUrl auf die Adresse des Smartphones. Richten Sie in Windsurf benutzerdefinierte OpenAI-Modell-Endpunkte darauf. - 4Mit dem Programmieren beginnen
Why it matters: Anfragen und Agenten-Schleifen des Desktop-Tools werden dann vom Smartphone bearbeitet, entweder vom Modell auf dem Gerät oder von dem Anbieter, an den es weiterleitet.
Vom Eintrag bestätigte Funktionen
Jeder der folgenden Punkte stammt aus der Play-Beschreibung des Entwicklers selbst; keiner wurde unabhängig getestet.
- OpenAI-artige Endpunkte. /v1/chat/completions, /v1/models und /health, erreichbar von jedem Rechner im selben WLAN oder LAN-Subnetz.
- Routing über mehrere Anbieter. Umschalten zwischen Modellen auf dem Gerät, selbst gehosteten Ollama-Instanzen, llama.cpp-Servern und direkten Cloud-APIs (OpenAI, Anthropic Claude, NVIDIA NIM, Hugging Face).
- Proxy-Steuerung. Anfragepools, Anbieter-Timeouts, Ratenbegrenzung, automatisches Failover und Round-Robin-Verteilung.
- LAN-Master/Worker-Clustering. Mehrere Android-Geräte in einem Netzwerk koppeln, um Speicher und Rechenleistung zu einem Inferenz-Cluster zu bündeln.
- Geräteübergreifende WebUI. Eine Chat-Oberfläche und Server-Verwaltungskonsole, erreichbar über den Browser eines PCs oder Tablets im selben Netzwerk.
- WebX Live Canvas. HTML, Tailwind CSS und JavaScript im Chat erzeugen und in der Vorschau ansehen.
- Traffic Observatory. Token-Generierungsgeschwindigkeit, Latenzmetriken und Anfrage-Payloads als Proxy-Diagnose.
- Genannte kompatible Clients. Cursor, VS Code, Windsurf, JetBrains, LangChain, LlamaIndex, LiteLLM, AutoGen, CrewAI, Continue.dev, Cline, Roo Code, Aider und Open WebUI.
Datenschutz und Datensicherheit
Der Abschnitt „Datensicherheit“ im Google-Play-Eintrag der App gibt an, dass keine Daten erhoben und keine Daten an Dritte weitergegeben werden. Das ist eine Selbstauskunft des Entwicklers, kein Prüfergebnis, und PromptQuorum hat weder den Netzwerkverkehr noch den Code der App untersucht.
Die Beschreibung ergänzt konkrete Angaben: Zugangsdaten von Anbietern werden auf dem Gerät mit AES-256 EncryptedSharedPreferences gespeichert, und Anfragen an benutzerdefinierte Cloud-Endpunkte gehen direkt vom Smartphone zum Anbieter, ohne zwischengeschalteten Server. Das Datenschutzbild hängt außerdem vom Routing ab: Eine Anfrage an OpenAI, Anthropic oder einen anderen Cloud-Anbieter verlässt Ihr Netzwerk und unterliegt den Bedingungen dieses Anbieters, unabhängig von der Erklärung der App selbst. Nur Anfragen, die ein Modell auf dem Gerät beantwortet, bleiben auf dem Smartphone.
📌Hinweis: Es wurde kein öffentlicher Quellcode der App ermittelt, sodass sich die obigen Angaben nicht am Code überprüfen lassen. Wer regulierte oder vertrauliche Daten verarbeitet, sollte das Verhalten selbst verifizieren, bevor er sich darauf verlässt.
Abwägungen: Vorteile vs. Einschränkungen
Smartphone als API-Endpunkt
- Bedeutung in der Praxis:
- Desktop-Coding-Tools können das Modell oder die Routen des Smartphones ohne separaten Server nutzen.
- Einschränkung / Hinweis:
- Die Geschwindigkeit ist durch die Smartphone-Hardware begrenzt, und der Eintrag nennt keine Benchmarks.
GGUF-Modelle auf dem Gerät
- Bedeutung in der Praxis:
- Chats mit lokalen Modellen benötigen laut Eintrag keine Internetverbindung.
- Einschränkung / Hinweis:
- Die nutzbare Modellgröße hängt vom RAM des Smartphones ab; der Eintrag nennt kein Minimum.
Ein Gateway, viele Backends
- Bedeutung in der Praxis:
- Lokale Modelle, Ollama, llama.cpp-Server und Cloud-APIs liegen hinter einer Adresse.
- Einschränkung / Hinweis:
- Über die Cloud geleitete Anfragen verlassen Ihr Netzwerk und unterliegen den Datenbedingungen des Anbieters.
Kostenlos installierbar
- Bedeutung in der Praxis:
- Sie können den Kernablauf ausprobieren, ohne vorher zu zahlen.
- Einschränkung / Hinweis:
- In-App-Käufe existieren, und ihr Inhalt wird im Eintrag nicht beschrieben.
Für wen sich die App eignet
- Entwickler mit einem übrigen Android-Smartphone. Die Kurzanleitung für Cursor, VS Code und Windsurf ist der zentrale Anwendungsfall der App, und das Smartphone entlastet den Haupt-PC.
- Nutzer, die eine OpenAI-artige Adresse vor mehreren Backends wollen. Die Steuerung für Routing, Failover und Ratenbegrenzung zielt auf genau diesen Aufbau.
- Home-Lab-Nutzer, die ein ungeprüftes Hilfsprogramm in einem privaten Netzwerk testen möchten. Die kostenlose Installation macht einen Versuch günstig.
Was wir nicht überprüfen konnten
- Lizenz und Quellcode. Lizenz: im Google-Play-Eintrag nicht angegeben, und es wurde kein öffentliches Quellcode-Repository ermittelt. Eine Lizenz des eigenständigen Ollama-Projekts sagt nichts über diese App aus. Leser, die prüfbaren Code benötigen, sollten sich für eine Open-Source-App aus den unten genannten Alternativen entscheiden.
- Versionsnummer. Der Eintragstext, den PromptQuorum lesen konnte, zeigt keine Version, daher kann diese Seite ihre Aussagen keinem bestimmten Build zuordnen.
- In-App-Käufe. Der Eintrag besagt, dass sie existieren, aber nicht, was sie freischalten oder was sie kosten.
- Hardware-Untergrenze und Leistung. Es werden weder ein Mindest-RAM noch eine Mindest-Android-Version noch Geschwindigkeitswerte veröffentlicht.
- Identität des Entwicklers versus Überprüfbarkeit. Google Play nennt FreeRouter Team als Entwickler und gibt Kontaktdaten des Entwicklers an. Anhand des Eintrags wurden jedoch weder eine Entwickler-Website noch ein öffentliches Quellcode-Repository noch eine ausführliche Entwicklerdokumentation ermittelt, sodass sich das Verhalten der App nicht über die Angaben des Eintrags hinaus überprüfen lässt.
- Nicht für iOS- oder Desktop-Nutzer. Die App ist nur für Android verfügbar.
Wettbewerber und Alternativen
PocketPal AI
- Plattformen:
- Android, iOS
- Preis / Lizenz:
- Kostenlos / MIT
- Wesentlicher Unterschied:
- Quelloffener Chat-Client auf dem Gerät
Maid
- Plattformen:
- Android
- Preis / Lizenz:
- Kostenlos / MIT
- Wesentlicher Unterschied:
- Quelloffene Chat-App für lokale GGUF-Modelle oder Remote-Anbieter
RikkaHub
- Plattformen:
- Android
- Preis / Lizenz:
- Kostenlos / Open Source
- Wesentlicher Unterschied:
- Multi-Provider-Chat-Client
Layla
- Plattformen:
- Android, iOS
- Preis / Lizenz:
- Kostenpflichtig / Closed Source
- Wesentlicher Unterschied:
- Fokus auf Begleiter und Rollenspiel mit optionalem Cloud-Modus
Details zu Wettbewerbern ändern sich häufig; prüfen Sie aktuellen Preis und Lizenz jeder App in ihrem eigenen Eintrag.
Häufig gestellte Fragen
Stammt Ollama Local AI vom Ollama-Team?
Nein. Der Haftungsausschluss des Eintrags besagt, dass die App unabhängig ist und nicht mit Ollama verbunden ist oder von Ollama unterstützt wird. Sie kann sich mit einem Ollama-Server verbinden, den Sie selbst betreiben, bringt aber ihre eigene llama.cpp-Engine mit.
Wer steckt hinter Ollama Local AI, und hat der Entwickler eine Website?
Google Play nennt FreeRouter Team als Entwickler und gibt Kontaktdaten des Entwicklers an. Anhand des Eintrags wurden weder eine Entwickler-Website noch ein öffentliches Quellcode-Repository noch eine ausführliche Entwicklerdokumentation ermittelt, und der Entwickler wird nicht als Entwickler von Ollama dargestellt.
Wie lautet der Google-Play-Paketname?
Die Paket-ID lautet com.llmproxy, weshalb die App bei Suchen nach „LLM Proxy“ auftaucht, obwohl ihr Store-Name Ollama Local AI ist.
Funktioniert sie auf dem iPhone oder dem Desktop?
Laut Eintrag nicht: Google Play ist der einzige verlinkte Kanal, und weder eine iOS- noch eine Desktop-Version wird erwähnt.
Welche Modelle kann sie auf dem Smartphone ausführen?
Modelle im GGUF-Format über llama.cpp. Der Eintrag nennt Llama 3, Mistral, Phi, Gemma und Qwen als Beispiele; welche Größen passen, hängt vom RAM Ihres Smartphones ab, den der Eintrag nicht angibt.
Kann ich sie mit Cursor oder VS Code nutzen?
Der Eintrag beschreibt genau das: den Server auf dem Smartphone starten und dann die OpenAI-Basis-URL des Tools auf die lokale Adresse des Smartphones setzen. PromptQuorum hat die Schritte nicht getestet.
Bleiben meine Daten auf dem Smartphone?
Nur bei Anfragen, die ein Modell auf dem Gerät beantwortet. Anfragen, die an OpenAI, Anthropic, NVIDIA NIM oder Hugging Face geleitet werden, gehen an diese Anbieter, und die Erklärung des Entwicklers, keine Daten zu erheben, ist ungeprüft.
Ist sie Open Source?
Lizenz: im Google-Play-Eintrag nicht angegeben, und es wurde kein öffentliches Quellcode-Repository ermittelt; PromptQuorum kann daher nicht bestätigen, dass die App Open Source ist. Sollte der Entwickler eine Lizenz oder den Quellcode veröffentlichen, wird dieser Test aktualisiert.
Was schalten die In-App-Käufe frei?
Der Eintrag sagt es nicht. Prüfen Sie es in der App, bevor Sie kaufen, und nutzen Sie das Rückgabefenster von Google Play, falls das Ergebnis nicht Ihren Erwartungen entspricht.
Fazit
Ollama Local AI adressiert einen engen, realen Bedarf: ein Android-Smartphone als OpenAI-kompatiblen Endpunkt für Desktop-Coding-Tools zu nutzen und zugleich GGUF-Modelle auf dem Gerät auszuführen. Der Play-Eintrag beschreibt einen Funktionsumfang, der über reinen Chat auf dem Gerät hinausgeht — LAN-Serving, Routing über mehrere Anbieter, Failover, Clustering und Traffic-Diagnose —, und Store-Signale mit Stand 2. Oktober 2026 (10K+ Downloads, eine Bewertung von 4,2) deuten auf reale Nutzung hin. Dem steht gegenüber, dass die App ein ungeprüftes Hilfsprogramm ist: Google Play nennt FreeRouter Team als Entwickler und gibt Kontaktdaten an, doch es wurden weder eine Entwickler-Website noch ein öffentliches Quellcode-Repository ermittelt, Version, Lizenz, Hardware-Untergrenze und Umfang der Käufe sind im Eintrag nicht angegeben, und ihr Name lädt zur Verwechslung mit dem eigenständigen Ollama-Projekt ein, mit dem sie nicht verbunden ist. Sie eignet sich für Entwickler, die in einem privaten Netzwerk mit einem Smartphone-als-Gateway-Aufbau experimentieren möchten; Leser, die prüfbaren Code oder iOS-Unterstützung benötigen, sollten mit PocketPal AI oder Maid beginnen.
Quellen
- Ollama Local AI bei Google Play — Beschreibung, Entwicklername und Kontaktdaten, Erklärung zur Datensicherheit, Download-Zahl, Bewertung und Datum der letzten Aktualisierung, geprüft am 2. Oktober 2026.
