Principais conclusões
- Desenvolvedor: o Google Play identifica a FreeRouter Team como desenvolvedora (categoria Produtividade) e fornece informações de contato do desenvolvedor; a partir da ficha, não foram identificados repositório de código-fonte público, site do desenvolvedor nem documentação detalhada do desenvolvedor.
- Preço: instalação gratuita, com compras dentro do app cujo conteúdo não é descrito.
- Modelos no dispositivo: arquivos GGUF executados por um motor llama.cpp embutido; a ficha cita Llama 3, Mistral, Phi, Gemma e Qwen como exemplos.
- Gateway na LAN: expõe endpoints no estilo OpenAI para outros dispositivos no seu Wi-Fi e pode encaminhar para modelos locais, Ollama próprio, servidores llama.cpp, OpenAI, Anthropic, NVIDIA NIM e Hugging Face.
- Sinais da loja conforme consultados em 2 de outubro de 2026: mais de 10 mil downloads, 4,2 estrelas em 267 avaliações, última atualização da ficha em 1º de outubro de 2026.
📍 Em uma frase
O Ollama Local AI é um app Android da FreeRouter Team que roda modelos GGUF no dispositivo via llama.cpp e serve uma API compatível com a OpenAI na sua rede local, e não é afiliado ao projeto Ollama.
💬 Em termos simples
Você instala o app em um celular Android, carrega um modelo ou adiciona suas chaves de API na nuvem, toca em Start Server e então aponta ferramentas como Cursor ou VS Code para o endereço local do celular em vez da OpenAI — assim, o celular faz o trabalho, ou repassa a solicitação, no lugar do seu computador.
📌Nota: Aviso de entidade: apesar de usar "Ollama" no nome do produto, o Ollama Local AI é um aplicativo Android independente, de terceiros. Ele não é criado, afiliado, patrocinado nem endossado pelo projeto Ollama. O app pode se conectar a servidores Ollama, mas o Ollama Local AI em si não é o software Ollama.
📌Nota: Esta análise se baseia somente na ficha do Google Play, consultada em 2 de outubro de 2026. A PromptQuorum não identificou repositório de código-fonte público, licença declarada, número de versão nem documentação detalhada do desenvolvedor, e não testou nem fez benchmarks do app.
O que é o Ollama Local AI?
O Ollama Local AI é um app Android que combina um executor de modelos no dispositivo com um gateway de API para a rede local. Segundo sua ficha no Google Play, ele roda modelos GGUF quantizados diretamente na CPU ou na GPU do celular por meio de um motor llama.cpp embutido, e também pode atuar como roteador que encaminha solicitações para outros backends que você configurar.
O nome é a principal fonte de confusão. O aviso final da ficha diz que o app é um utilitário de desenvolvedor independente e não é afiliado, patrocinado nem endossado pelo Ollama, pela OpenAI, pela Anthropic ou por qualquer provedor mencionado. O app pode se conectar a um servidor Ollama que você hospede em outro lugar, mas conectar-se a um servidor Ollama não estabelece nenhuma afiliação, e, segundo a ficha, o app executa seu próprio motor llama.cpp embutido em vez do Ollama. Os resultados de busca e o nome do pacote no Play (com.llmproxy) se referem ao mesmo app.
Três termos são usados de forma estrita nesta análise: Ollama é o projeto de código aberto separado e o seu software; Ollama Local AI é o app Android independente analisado aqui; um servidor Ollama é uma instalação do Ollama que você mesmo executa e à qual o app pode se conectar.
Como obter
O único canal de download indicado pela ficha é o Google Play; não há link para versão de iOS, versão para desktop, espelho de APK nem release no GitHub.
Plataforma | Onde obter |
|---|---|
| Android | Google Play |
| iOS / desktop | Não oferecido, segundo a ficha |
Esta página é material complementar à entrada do app no Local LLM Software Directory. O texto da ficha que a PromptQuorum conseguiu ler não mostra número de versão, então nenhum é informado aqui; confira a página do Play para ver a build disponível quando você ler isto.
Como conectar sua IDE pelo Wi-Fi
O guia rápido da própria ficha tem quatro passos, todos feitos no celular e na mesma rede privada. A PromptQuorum não executou esses passos.
- 1Iniciar o servidor
Why it matters: Abra o app, escolha um modelo GGUF local ou informe chaves de provedores na nuvem e toque em "Start Server". - 2Anotar o endpoint
Why it matters: O app exibe o IP local e a porta do celular, por exemplo http://192.168.1.50:8080/v1 no exemplo da própria ficha. - 3Apontar sua ferramenta para ele
Why it matters: No Cursor, informe qualquer valor provisório como chave da OpenAI e substitua a URL base. Em extensões do VS Code como Continue, Cline ou Roo Code, defina o tipo de provedor como openai e o apiBase ou baseUrl como o endereço do celular. No Windsurf, aponte os endpoints personalizados de modelos OpenAI para ele. - 4Começar a programar
Why it matters: As solicitações e os loops de agente da ferramenta do desktop passam então a ser tratados pelo celular, seja pelo modelo no dispositivo, seja pelo provedor para o qual ele encaminha.
Recursos confirmados pela ficha
Todos os itens abaixo vêm da própria descrição do desenvolvedor no Play; nenhum foi testado de forma independente.
- Endpoints no estilo OpenAI. /v1/chat/completions, /v1/models e /health, acessíveis por qualquer máquina no mesmo Wi-Fi ou sub-rede da LAN.
- Roteamento entre vários provedores. Alterne entre modelos no dispositivo, instâncias próprias do Ollama, servidores llama.cpp e APIs diretas na nuvem (OpenAI, Anthropic Claude, NVIDIA NIM, Hugging Face).
- Controles de proxy. Pools de solicitações, timeouts por provedor, limitação de taxa, failover automático e distribuição round-robin.
- Clustering Master/Worker na LAN. Pareie vários dispositivos Android na mesma rede para reunir memória e capacidade de processamento em um cluster de inferência.
- WebUI entre dispositivos. Uma interface de chat e um console de gerenciamento do servidor acessíveis pelo navegador de um PC ou tablet na mesma rede.
- WebX Live Canvas. Gere e visualize HTML, Tailwind CSS e JavaScript dentro do chat.
- Traffic Observatory. Velocidade de geração de tokens, métricas de latência e payloads de solicitações exibidos como diagnósticos do proxy.
- Clientes compatíveis citados. Cursor, VS Code, Windsurf, JetBrains, LangChain, LlamaIndex, LiteLLM, AutoGen, CrewAI, Continue.dev, Cline, Roo Code, Aider e Open WebUI.
Privacidade e segurança dos dados
A seção Segurança dos dados do app no Google Play declara que nenhum dado é coletado e nenhum dado é compartilhado com terceiros. Isso é uma autodeclaração do desenvolvedor, não o resultado de uma auditoria, e a PromptQuorum não inspecionou o tráfego de rede nem o código do app.
A descrição acrescenta afirmações específicas: as credenciais dos provedores são armazenadas no dispositivo com AES-256 EncryptedSharedPreferences, e as solicitações para endpoints personalizados na nuvem vão diretamente do celular para o provedor, sem servidor intermediário. O quadro de privacidade também depende do roteamento: uma solicitação enviada à OpenAI, à Anthropic ou a outro provedor na nuvem sai da sua rede e passa a ser regida pelos termos desse provedor, independentemente da declaração do próprio app. Somente as solicitações respondidas por um modelo no dispositivo permanecem no celular.
📌Nota: Nenhum código-fonte público do app foi identificado, então as afirmações acima não podem ser conferidas no código. Quem lida com dados regulados ou confidenciais deve verificar o comportamento por conta própria antes de confiar nelas.
Prós e contras: benefícios vs. limitações
Celular como endpoint de API
- Na prática:
- Ferramentas de programação do desktop podem usar o modelo ou as rotas do celular sem um servidor separado.
- Limitação / ressalva:
- A velocidade é limitada pelo hardware do celular, e a ficha não traz benchmarks.
Modelos GGUF no dispositivo
- Na prática:
- Conversas com modelos locais não precisam de conexão com a internet, segundo a ficha.
- Limitação / ressalva:
- O tamanho de modelo utilizável depende da RAM do celular; a ficha não informa mínimo.
Um gateway, vários backends
- Na prática:
- Modelos locais, Ollama, servidores llama.cpp e APIs na nuvem ficam atrás de um único endereço.
- Limitação / ressalva:
- Solicitações roteadas para a nuvem saem da sua rede e seguem os termos de dados do provedor.
Instalação gratuita
- Na prática:
- Você pode testar o fluxo principal sem pagar antes.
- Limitação / ressalva:
- Existem compras dentro do app e o conteúdo delas não é descrito na ficha.
Para quem é indicado
- Desenvolvedores com um celular Android sobrando. O guia rápido para Cursor, VS Code e Windsurf é o caso de uso central do app, e o celular tira carga do PC principal.
- Usuários que querem um único endereço no estilo OpenAI na frente de vários backends. Os controles de roteamento, failover e limite de taxa visam esse cenário.
- Usuários de home lab à vontade para testar um utilitário não auditado em uma rede privada. Como a instalação é gratuita, experimentar sai barato.
O que não conseguimos verificar
- Licença e código-fonte. Licença: não informada na ficha do Google Play, e nenhum repositório de código-fonte público foi identificado. Qualquer licença do projeto Ollama, que é separado, não diz nada sobre este app. Quem precisa de código auditável deve escolher um app de código aberto entre as alternativas abaixo.
- Número da versão. O texto da ficha que a PromptQuorum conseguiu ler não mostra versão, então esta página não pode vincular suas afirmações a uma build específica.
- Compras dentro do app. A ficha diz que existem, mas não o que liberam nem quanto custam.
- Requisitos de hardware e desempenho. Não há mínimo de RAM, versão do Android nem números de velocidade publicados.
- Identidade do desenvolvedor versus verificabilidade. O Google Play identifica a FreeRouter Team como desenvolvedora e fornece informações de contato do desenvolvedor. No entanto, a partir da ficha, não foram identificados site do desenvolvedor, repositório de código-fonte público nem documentação detalhada do desenvolvedor, então o comportamento do app não pode ser verificado além do que a ficha informa.
- Não é para usuários de iOS ou desktop. O app é exclusivo para Android.
Concorrentes e alternativas
PocketPal AI
- Plataformas:
- Android, iOS
- Preço / licença:
- Grátis / MIT
- Principal diferença:
- Cliente de chat de código aberto no dispositivo
Maid
- Plataformas:
- Android
- Preço / licença:
- Grátis / MIT
- Principal diferença:
- App de chat de código aberto para GGUF local ou provedores remotos
RikkaHub
- Plataformas:
- Android
- Preço / licença:
- Grátis / código aberto
- Principal diferença:
- Cliente de chat com vários provedores
Layla
- Plataformas:
- Android, iOS
- Preço / licença:
- Pago / código fechado
- Principal diferença:
- Foco em companheiro e roleplay, com modo opcional na nuvem
Os detalhes dos concorrentes mudam com frequência; confirme o preço e a licença atuais de cada app na própria ficha.
Perguntas frequentes
O Ollama Local AI é feito pela equipe do Ollama?
Não. O aviso da ficha diz que o app é independente e não é afiliado nem endossado pelo Ollama. Ele pode se conectar a um servidor Ollama que você mesmo executa, mas traz o seu próprio motor llama.cpp.
Quem faz o Ollama Local AI, e o desenvolvedor tem um site?
O Google Play identifica a FreeRouter Team como desenvolvedora e fornece informações de contato do desenvolvedor. A partir da ficha, não foram identificados site do desenvolvedor, repositório de código-fonte público nem documentação detalhada do desenvolvedor, e a desenvolvedora não é apresentada como desenvolvedora do Ollama.
Qual é o nome do pacote no Google Play?
O ID do pacote é com.llmproxy, e por isso o app aparece em buscas por "LLM Proxy", embora o nome na loja seja Ollama Local AI.
Funciona no iPhone ou no desktop?
Não, segundo a ficha: o Google Play é o único canal que ela indica, e não há menção a versão para iOS ou desktop.
Quais modelos ele consegue rodar no celular?
Modelos no formato GGUF por meio do llama.cpp. A ficha cita Llama 3, Mistral, Phi, Gemma e Qwen como exemplos; os tamanhos que cabem dependem da RAM do seu celular, que a ficha não especifica.
Posso usá-lo com o Cursor ou o VS Code?
A ficha descreve exatamente isso: inicie o servidor no celular e depois defina a URL base da OpenAI da ferramenta como o endereço local do celular. A PromptQuorum não testou esses passos.
Meus dados ficam no celular?
Somente nas solicitações respondidas por um modelo no dispositivo. As solicitações roteadas para OpenAI, Anthropic, NVIDIA NIM ou Hugging Face vão para esses provedores, e a declaração do desenvolvedor de que não coleta dados não foi auditada.
É de código aberto?
Licença: não informada na ficha do Google Play, e nenhum repositório de código-fonte público foi identificado, então a PromptQuorum não pode confirmar que o app é de código aberto. Se o desenvolvedor publicar uma licença ou o código-fonte, esta análise será atualizada.
O que as compras dentro do app liberam?
A ficha não diz. Confira dentro do app antes de comprar e use a janela de reembolso do Google Play se o resultado não for o esperado.
Veredito
O Ollama Local AI atende a uma necessidade estreita e real: usar um celular Android como endpoint compatível com a OpenAI para ferramentas de programação do desktop, ao mesmo tempo em que roda modelos GGUF no próprio dispositivo. A ficha do Play descreve um conjunto de recursos que vai além do chat básico no dispositivo — serviço na LAN, roteamento entre vários provedores, failover, clustering e diagnósticos de tráfego —, e os sinais da loja em 2 de outubro de 2026 (mais de 10 mil downloads, nota 4,2) sugerem uso real. Em contrapartida, o app é um utilitário não auditado: o Google Play identifica a FreeRouter Team como desenvolvedora e fornece informações de contato, mas não foram identificados site do desenvolvedor nem repositório de código-fonte público; sua versão, licença, requisitos de hardware e escopo das compras não são informados na ficha; e o nome convida à confusão com o projeto Ollama, que é separado e com o qual ele não é afiliado. Ele serve a desenvolvedores que querem experimentar uma configuração de celular como gateway em uma rede privada; quem precisa de código auditável ou de suporte a iOS deve começar pelo PocketPal AI ou pelo Maid.
Fontes
- Ollama Local AI no Google Play — descrição, nome e informações de contato do desenvolvedor, declaração de Segurança dos dados, número de downloads, nota e data da última atualização, consultados em 2 de outubro de 2026.
