Skip to main content
PromptQuorumBuilt for humans. Structured for AI.
Inicio/LLM locales avanzados/Análisis de Ollama Local AI: ejecutor de LLM y proxy de API en la LAN para Android
Mobile & Edge LLMs

Análisis de Ollama Local AI: ejecutor de LLM y proxy de API en la LAN para Android

·8 min de lectura·Por Hans Kuepper · Fundador de PromptQuorum, herramienta de despacho multi-modelo · PromptQuorum

Ollama Local AI es una app de Android independiente de terceros (paquete de Google Play com.llmproxy, desarrollador indicado como FreeRouter Team) que ejecuta modelos GGUF en el dispositivo mediante llama.cpp y sirve una API compatible con OpenAI a otros dispositivos de tu Wi-Fi. También puede reenviar solicitudes a un servidor Ollama autoalojado, a un servidor llama.cpp o a APIs en la nube como OpenAI y Anthropic, pero conectarse a un servidor Ollama no la convierte en parte de Ollama: la propia ficha indica que la app no está afiliada al proyecto Ollama. La ficha no publica ninguna licencia, código fuente ni número de versión, por lo que conviene tratarla como una utilidad sin auditar hasta que el desarrollador diga lo contrario.

Ollama Local AI es una app de Android independiente de terceros que ejecuta modelos de IA locales en el teléfono y puede conectarse a servidores Ollama. No es el software Ollama ni la ha creado el proyecto Ollama. Google Play indica a FreeRouter Team como desarrollador. La app cumple dos funciones: ejecuta modelos de lenguaje GGUF en el teléfono mediante un motor llama.cpp integrado, y expone una API compatible con OpenAI en tu Wi-Fi para que herramientas como Cursor, extensiones de VS Code y Windsurf puedan usar el teléfono como su punto de acceso a modelos. Es gratis de instalar con compras dentro de la app. Este análisis se basa únicamente en la ficha de Google Play de la app, consultada el 2 de octubre de 2026, porque a partir de esa ficha no se identificó ningún repositorio de código fuente público, sitio web del desarrollador ni documentación detallada del desarrollador, y PromptQuorum no ha probado la app de forma práctica.

Análisis de Ollama Local AI: ejecutor de LLM y proxy de API en la LAN para Android

Conclusiones clave

  • Desarrollador: Google Play identifica a FreeRouter Team como desarrollador (categoría Productividad) y facilita información de contacto del desarrollador; a partir de la ficha no se identificó ningún repositorio de código fuente público, sitio web del desarrollador ni documentación detallada del desarrollador.
  • Precio: gratis de instalar, con compras dentro de la app cuyo contenido no se describe.
  • Modelos en el dispositivo: archivos GGUF ejecutados mediante un motor llama.cpp integrado; la ficha menciona Llama 3, Mistral, Phi, Gemma y Qwen como ejemplos.
  • Pasarela LAN: expone endpoints de estilo OpenAI a otros dispositivos de tu Wi-Fi y puede enrutar a modelos locales, Ollama autoalojado, servidores llama.cpp, OpenAI, Anthropic, NVIDIA NIM y Hugging Face.
  • Indicadores de la tienda según la consulta del 2 de octubre de 2026: más de 10 mil descargas, 4.2 estrellas con 267 reseñas, ficha actualizada por última vez el 1 de octubre de 2026.

📍 En una frase

Ollama Local AI es una app de Android de FreeRouter Team que ejecuta modelos GGUF en el dispositivo mediante llama.cpp y sirve una API compatible con OpenAI en tu red local, y no está afiliada al proyecto Ollama.

💬 En términos simples

La instalas en un teléfono Android, cargas un modelo o añades tus claves de API en la nube, pulsas Start Server y luego apuntas herramientas como Cursor o VS Code a la dirección local del teléfono en lugar de a OpenAI: así el teléfono hace el trabajo, o retransmite la solicitud, en lugar de tu ordenador.

📌Nota: Advertencia sobre la entidad: aunque usa «Ollama» en el nombre de su producto, Ollama Local AI es una aplicación de Android independiente de terceros. No ha sido creada por el proyecto Ollama, ni está afiliada, patrocinada o respaldada por él. La app puede conectarse a servidores Ollama, pero Ollama Local AI en sí no es el software Ollama.

📌Nota: Este análisis se basa únicamente en la ficha de Google Play, consultada el 2 de octubre de 2026. PromptQuorum no identificó un repositorio de código fuente público, una licencia indicada, un número de versión ni documentación detallada del desarrollador, y no ha probado ni evaluado con pruebas comparativas la app.

¿Qué es Ollama Local AI?

Ollama Local AI es una app de Android que combina un ejecutor de modelos en el dispositivo con una pasarela de API para la red local. Según su ficha de Google Play, ejecuta modelos GGUF cuantizados directamente en la CPU o GPU del teléfono mediante un motor llama.cpp integrado, y también puede actuar como enrutador que reenvía solicitudes a otros backends que configures.

El nombre es la principal fuente de confusión. El aviso final de la ficha indica que la app es una utilidad de un desarrollador independiente y que no está afiliada, patrocinada ni respaldada por Ollama, OpenAI, Anthropic ni ningún proveedor mencionado. La app puede conectarse a un servidor Ollama que alojes en otro lugar, pero conectarse a un servidor Ollama no establece ninguna afiliación y, según la ficha, la app ejecuta su propio motor llama.cpp integrado en lugar de Ollama. Los resultados de búsqueda y el nombre de paquete de Play (com.llmproxy) se refieren a la misma app.

En este análisis se usan tres términos de forma estricta: Ollama es el proyecto de código abierto independiente y su software; Ollama Local AI es la app de Android independiente que se analiza aquí; un servidor Ollama es una instalación de Ollama que ejecutas tú mismo y a la que la app puede conectarse.

Cómo obtenerla

El único canal de descarga al que apunta la ficha es Google Play; no se enlaza ninguna versión para iOS ni de escritorio, ningún espejo de APK ni ninguna publicación de GitHub.

Plataforma
Dónde obtenerla
AndroidGoogle Play
iOS / escritorioNo disponible, según la ficha

Esta página es material complementario de la entrada de la app en el Local LLM Software Directory. En el texto de la ficha que PromptQuorum pudo leer no aparece ningún número de versión, por lo que aquí no se indica ninguno; consulta la página de Play para ver la compilación disponible cuando leas esto.

Cómo conectar tu IDE por Wi-Fi

El inicio rápido de la propia ficha tiene cuatro pasos, todos realizados en el teléfono y en la misma red privada. PromptQuorum no ha ejecutado estos pasos.

  1. 1
    Iniciar el servidor
    Why it matters: Abre la app, elige un modelo GGUF local o introduce claves de proveedores en la nube y pulsa "Start Server".
  2. 2
    Anotar el endpoint
    Why it matters: La app muestra la IP local y el puerto del teléfono, por ejemplo http://192.168.1.50:8080/v1 en el ejemplo de la propia ficha.
  3. 3
    Apuntar tu herramienta al teléfono
    Why it matters: En Cursor, introduce cualquier valor de relleno como clave de OpenAI y sustituye la URL base. En extensiones de VS Code como Continue, Cline o Roo Code, establece el tipo de proveedor en openai y apiBase o baseUrl en la dirección del teléfono. En Windsurf, apunta los endpoints personalizados de modelos OpenAI hacia ella.
  4. 4
    Empezar a programar
    Why it matters: Las solicitudes y los bucles de agente de la herramienta de escritorio los gestiona entonces el teléfono, ya sea con el modelo del dispositivo o con el proveedor al que enruta.

Funciones confirmadas por la ficha

Todo lo que figura a continuación proviene de la propia descripción de Play del desarrollador; nada se ha probado de forma independiente.

  • Endpoints de estilo OpenAI. /v1/chat/completions, /v1/models y /health, accesibles desde cualquier equipo de la misma subred Wi-Fi o LAN.
  • Enrutamiento multiproveedor. Cambia entre modelos en el dispositivo, instancias de Ollama autoalojadas, servidores llama.cpp y APIs directas en la nube (OpenAI, Anthropic Claude, NVIDIA NIM, Hugging Face).
  • Controles de proxy. Pools de solicitudes, tiempos de espera por proveedor, limitación de tasa, conmutación por error automática y distribución round-robin.
  • Clústeres LAN Master/Worker. Empareja varios dispositivos Android de una misma red para sumar memoria y capacidad de cálculo en un clúster de inferencia.
  • WebUI entre dispositivos. Una interfaz de chat y una consola de gestión del servidor accesibles desde el navegador de un PC o una tableta de la misma red.
  • WebX Live Canvas. Genera y previsualiza HTML, Tailwind CSS y JavaScript dentro del chat.
  • Traffic Observatory. Velocidad de generación de tokens, métricas de latencia y contenido de las solicitudes mostrados como diagnósticos del proxy.
  • Clientes compatibles citados. Cursor, VS Code, Windsurf, JetBrains, LangChain, LlamaIndex, LiteLLM, AutoGen, CrewAI, Continue.dev, Cline, Roo Code, Aider y Open WebUI.

Privacidad y seguridad de los datos

La sección Seguridad de los datos de Google Play de la app declara que no se recopilan datos ni se comparten con terceros. Es una autodeclaración del desarrollador, no el resultado de una auditoría, y PromptQuorum no ha inspeccionado el tráfico de red ni el código de la app.

La descripción añade afirmaciones concretas: las credenciales de los proveedores se almacenan en el dispositivo con AES-256 EncryptedSharedPreferences, y las solicitudes a endpoints personalizados en la nube viajan directamente del teléfono al proveedor, sin servidor intermediario. El panorama de privacidad también depende del enrutamiento: una solicitud enviada a OpenAI, Anthropic u otro proveedor en la nube sale de tu red y se rige por los términos de ese proveedor, con independencia de la declaración de la propia app. Solo las solicitudes respondidas por un modelo en el dispositivo permanecen en el teléfono.

📌Nota: No se identificó ningún código fuente público de la app, por lo que las afirmaciones anteriores no pueden contrastarse con el código. Quien maneje datos regulados o confidenciales debería verificar el comportamiento por su cuenta antes de confiar en ellas.

Ventajas y limitaciones

El teléfono como endpoint de API

Uso real:
Las herramientas de programación de escritorio pueden usar el modelo o las rutas del teléfono sin un servidor aparte.
Limitación / advertencia:
La velocidad está limitada por el hardware del teléfono y la ficha no ofrece pruebas comparativas.

Modelos GGUF en el dispositivo

Uso real:
Los chats con modelos locales no necesitan conexión a internet, según la ficha.
Limitación / advertencia:
El tamaño de modelo utilizable depende de la RAM del teléfono; la ficha no indica ningún mínimo.

Una pasarela, muchos backends

Uso real:
Modelos locales, Ollama, servidores llama.cpp y APIs en la nube quedan tras una sola dirección.
Limitación / advertencia:
Las solicitudes enrutadas a la nube salen de tu red y siguen los términos de datos del proveedor.

Gratis de instalar

Uso real:
Puedes probar el flujo principal sin pagar primero.
Limitación / advertencia:
Existen compras dentro de la app y la ficha no describe su contenido.

Para quién es

  • Desarrolladores con un teléfono Android de sobra. El inicio rápido con Cursor, VS Code y Windsurf es el caso de uso central de la app, y el teléfono descarga trabajo del PC principal.
  • Usuarios que quieren una única dirección estilo OpenAI frente a varios backends. Los controles de enrutamiento, conmutación por error y límite de tasa apuntan a esa configuración.
  • Usuarios de laboratorio doméstico que se sienten cómodos probando una utilidad sin auditar en una red privada. Una instalación gratuita hace que la prueba sea barata.

Lo que no pudimos verificar

  • Licencia y código fuente. Licencia: no indicada en la ficha de Google Play, y no se identificó ningún repositorio de código fuente público. Cualquier licencia del proyecto Ollama, que es independiente, no dice nada sobre esta app. Quienes necesiten código auditable deberían elegir una app de código abierto de las alternativas siguientes.
  • Número de versión. El texto de la ficha que PromptQuorum pudo leer no muestra ninguna versión, por lo que esta página no puede vincular sus afirmaciones a una compilación concreta.
  • Compras dentro de la app. La ficha dice que existen, pero no qué desbloquean ni cuánto cuestan.
  • Requisitos de hardware y rendimiento. No se publica ninguna RAM mínima, versión de Android ni cifras de velocidad.
  • Identidad del desarrollador frente a verificabilidad. Google Play identifica a FreeRouter Team como desarrollador y facilita información de contacto del desarrollador. Sin embargo, a partir de la ficha no se identificó ningún sitio web del desarrollador, repositorio de código fuente público ni documentación detallada del desarrollador, por lo que el comportamiento de la app no puede comprobarse más allá de lo que indica la ficha.
  • No es para usuarios de iOS ni de escritorio. La app es solo para Android.

Competidores y alternativas

PocketPal AI

Plataformas:
Android, iOS
Precio / licencia:
Gratis / MIT
Diferencia clave:
Cliente de chat de código abierto en el dispositivo

Maid

Plataformas:
Android
Precio / licencia:
Gratis / MIT
Diferencia clave:
App de chat de código abierto para GGUF locales o proveedores remotos

RikkaHub

Plataformas:
Android
Precio / licencia:
Gratis / código abierto
Diferencia clave:
Cliente de chat multiproveedor

Layla

Plataformas:
Android, iOS
Precio / licencia:
De pago / código cerrado
Diferencia clave:
Enfoque en compañero y rol, con un modo en la nube opcional

Los detalles de los competidores cambian a menudo; confirma el precio y la licencia actuales de cada app en su propia ficha.

Preguntas frecuentes

¿Ollama Local AI está hecha por el equipo de Ollama?

No. El aviso de la ficha indica que la app es independiente y que no está afiliada ni respaldada por Ollama. Puede conectarse a un servidor Ollama que ejecutes tú mismo, pero incluye su propio motor llama.cpp.

¿Quién hace Ollama Local AI y tiene el desarrollador un sitio web?

Google Play identifica a FreeRouter Team como desarrollador y facilita información de contacto del desarrollador. A partir de la ficha no se identificó ningún sitio web del desarrollador, repositorio de código fuente público ni documentación detallada del desarrollador, y el desarrollador no se presenta como desarrollador de Ollama.

¿Cuál es el nombre de paquete en Google Play?

El ID del paquete es com.llmproxy, por lo que la app aparece en búsquedas de "LLM Proxy" aunque su nombre en la tienda sea Ollama Local AI.

¿Funciona en iPhone o en escritorio?

No según la ficha: Google Play es el único canal que enlaza y no se menciona ninguna versión para iOS ni de escritorio.

¿Qué modelos puede ejecutar en el teléfono?

Modelos en formato GGUF mediante llama.cpp. La ficha menciona Llama 3, Mistral, Phi, Gemma y Qwen como ejemplos; los tamaños que caben dependen de la RAM de tu teléfono, algo que la ficha no especifica.

¿Puedo usarla con Cursor o VS Code?

La ficha describe exactamente eso: inicia el servidor en el teléfono y luego establece la URL base de OpenAI de la herramienta en la dirección local del teléfono. PromptQuorum no ha probado los pasos.

¿Mis datos permanecen en el teléfono?

Solo en el caso de las solicitudes respondidas por un modelo en el dispositivo. Las solicitudes enrutadas a OpenAI, Anthropic, NVIDIA NIM o Hugging Face van a esos proveedores, y la declaración del desarrollador de que no recopila datos no está auditada.

¿Es de código abierto?

Licencia: no indicada en la ficha de Google Play, y no se identificó ningún repositorio de código fuente público, por lo que PromptQuorum no puede confirmar que la app sea de código abierto. Si el desarrollador publica una licencia o el código fuente, este análisis se actualizará.

¿Qué desbloquean las compras dentro de la app?

La ficha no lo indica. Compruébalo dentro de la app antes de comprar y usa el plazo de reembolso de Google Play si el resultado no es el esperado.

Veredicto

Ollama Local AI responde a una necesidad concreta y real: usar un teléfono Android como endpoint compatible con OpenAI para herramientas de programación de escritorio y, a la vez, ejecutar modelos GGUF en el dispositivo. La ficha de Play describe un conjunto de funciones que va más allá del chat básico en el dispositivo —servicio en la LAN, enrutamiento multiproveedor, conmutación por error, clústeres y diagnósticos de tráfico—, y los indicadores de la tienda a fecha del 2 de octubre de 2026 (más de 10 mil descargas, una calificación de 4.2) sugieren un uso real. En contra, la app es una utilidad sin auditar: Google Play identifica a FreeRouter Team como desarrollador y facilita información de contacto, pero no se identificó ningún sitio web del desarrollador ni repositorio de código fuente público, la ficha no indica su versión, licencia, requisitos de hardware ni alcance de las compras, y su nombre invita a confundirla con el proyecto Ollama, que es independiente y con el que no está afiliada. Es adecuada para desarrolladores que quieran experimentar con una configuración de teléfono como pasarela en una red privada; quienes necesiten código auditable o compatibilidad con iOS deberían empezar por PocketPal AI o Maid.

Fuentes

  • Ollama Local AI en Google Play — descripción, nombre e información de contacto del desarrollador, declaración de Seguridad de los datos, número de descargas, calificación y fecha de última actualización, consultados el 2 de octubre de 2026.

← Volver a LLM locales avanzados