Skip to main content
PromptQuorum
Início/LLMs locais avançados/Análise do ToolNeuron (2026): app Android de código aberto para IA criptografada no dispositivo
Mobile & Edge LLMs

Análise do ToolNeuron (2026): app Android de código aberto para IA criptografada no dispositivo

·9 min de leitura·Por Hans Kuepper · Fundador do PromptQuorum, ferramenta de despacho multi-modelo de IA · PromptQuorum

O ToolNeuron é um app Android gratuito e de código aberto (MIT) que executa modelos de linguagem GGUF totalmente no dispositivo via llama.cpp, com RAG de documentos, entrada/saída de voz e um servidor HTTP local compatível com OpenAI — sem componente na nuvem, sem telemetria, segundo o próprio README do projeto. Criado por Siddhesh Sonar, o app protege seu armazenamento local com criptografia AES-256-GCM apoiada no Android Keystore e autenticação Argon2id, e exige Android 12 (API 31) ou mais recente. Leitores que buscam um ponto de comparação também podem ler a análise do Layla ou a análise do RikkaHub.

O ToolNeuron, desenvolvido por Siddhesh Sonar e publicado como código aberto sob a licença MIT, é um app Android gratuito que executa modelos de linguagem no formato GGUF no próprio dispositivo via llama.cpp, com RAG de documentos, entrada/saída de voz, um servidor HTTP local compatível com OpenAI e um sistema de plugins. Segundo o próprio README do projeto, o objetivo central de design é "nenhum serviço do Google Play, nenhuma telemetria, nenhuma nuvem", reforçado com criptografia AES-256-GCM baseada no Android Keystore e autenticação Argon2id para os dados armazenados. Esta análise aborda o que o app faz, o que ele exige e como se posiciona diante de outros apps de chat Android no dispositivo, como Layla e RikkaHub, com base no repositório público do GitHub do projeto e na ficha da Play Store, não em testes práticos independentes.

Análise do ToolNeuron (2026): app Android de código aberto para IA criptografada no dispositivo

Principais conclusões

  • Preço: gratuito para baixar e usar; código aberto sob a licença MIT, sem compras no app documentadas no repositório.
  • Desenvolvedor: Siddhesh Sonar.
  • Motor: llama.cpp para modelos de chat GGUF, além de sherpa-onnx para voz, tudo executado totalmente no dispositivo.
  • Recursos além do chat: RAG de documentos (PDF, DOCX, XLSX, PPTX, EPUB e mais), entrada/saída de voz, um servidor HTTP local compatível com OpenAI, um navegador de modelos do Hugging Face e um sistema de plugins isolado (sandbox), segundo o README do projeto.
  • Segurança: os dados locais são criptografados com Android Keystore AES-256-GCM e autenticação Argon2id, segundo a documentação do próprio projeto.
  • Requisito: Android 12 (API 31) ou mais recente, em hardware arm64-v8a ou x86_64, segundo a configuração de build do projeto.
  • Status de código aberto: licença MIT, código-fonte publicado no GitHub — auditável de forma independente, ao contrário de alternativas de código fechado.
  • Distribuição: disponível no Google Play e como downloads diretos de APK no GitHub Releases.

📍 Em uma frase

O ToolNeuron é um app Android gratuito e de código aberto (MIT) do desenvolvedor Siddhesh Sonar que executa modelos de linguagem GGUF no dispositivo via llama.cpp, somando armazenamento local criptografado, RAG de documentos, entrada/saída de voz, um servidor HTTP local compatível com OpenAI e um sistema de plugins, sem componente de nuvem ou telemetria, segundo o próprio README do projeto.

💬 Em termos simples

Pense nele como um app de chat Android gratuito e de código aberto que também permite conversar com seus próprios documentos e usar voz, tudo rodando no seu celular com a criptografia que se esperaria de um projeto preocupado com segurança — não um simples invólucro sobre uma API na nuvem.

Como obter o ToolNeuron

O ToolNeuron está disponível no Google Play ou como download direto de APK na página do GitHub Releases. Ambos os canais de distribuição oferecem o mesmo app de código aberto.

Esta análise complementa o Diretório de Software LLM Local da PromptQuorum, que cataloga ferramentas de IA local em várias plataformas, incluindo a própria entrada do ToolNeuron.

Canal
Como obter
Google PlayToolNeuron no Google Play
GitHub (APK)Releases do ToolNeuron no GitHub

O app é gratuito de qualquer forma — o GitHub também hospeda o código-fonte completo para leitores que queiram auditá-lo ou compilá-lo eles mesmos.

O que é o ToolNeuron

O ToolNeuron é um app Android que executa modelos de linguagem no formato GGUF diretamente no dispositivo via llama.cpp, sem componente do lado do servidor. Segundo a própria descrição do projeto, o objetivo é ser "IA no dispositivo para Android. Sem serviços do Google Play, sem telemetria, sem nuvem" — modelos, chats, documentos usados na busca e o material das chaves de criptografia são todos projetados para permanecer no celular.

Além do chat simples, o app reúne recuperação de documentos (RAG) em formatos de arquivo comuns, entrada e saída de voz pelo mecanismo de voz sherpa-onnx, um servidor HTTP local que expõe uma API compatível com OpenAI para outros apps se conectarem, um navegador de modelos do Hugging Face integrado e um sistema de plugins isolado (sandbox) para instalar recursos adicionais.

Esta análise se baseia no repositório público do GitHub do projeto — seu README, arquivo de licença e metadados do repositório — e na ficha do Google Play, não em uma auditoria de código independente ou testes de desempenho práticos.

Quem criou o ToolNeuron

O ToolNeuron é criado e mantido pelo desenvolvedor Siddhesh Sonar, que publica o projeto abertamente no GitHub sob a licença MIT. O repositório mostra desenvolvimento ativo e detalhado: uma arquitetura de segurança documentada, uma base de código modular dividida em componentes de app, inferência, criptografia e rede, e uma comunidade pública no Discord para usuários e colaboradores.

Como o código-fonte é publicado, e não fechado, as afirmações sobre o que o app faz — e não faz — com os dados locais podem ser verificadas diretamente no código, em vez de depender apenas da descrição do desenvolvedor.

Como começar

Configurar o ToolNeuron leva poucos passos e não exige criação de conta. O processo completo, da instalação à primeira resposta offline, leva alguns minutos mais o tempo que o modelo escolhido levar para baixar.

  1. 1
    Instalar o app
    Why it matters: Obtenha o [ToolNeuron no Google Play](https://play.google.com/store/apps/details?id=com.dark.tool_neuron), ou baixe a APK diretamente do [GitHub Releases](https://github.com/Siddhesh2377/ToolNeuron/releases). O app em si é gratuito de qualquer forma.
  2. 2
    Configurar a criptografia local
    Why it matters: O app configura sua criptografia apoiada no Android Keystore e um PIN de 6 dígitos na primeira execução, segundo a documentação de segurança do projeto, antes de os dados do chat serem armazenados.
  3. 3
    Explorar e baixar um modelo GGUF
    Why it matters: Use o navegador integrado do Hugging Face para encontrar um modelo GGUF compatível, ou forneça o seu próprio. Essa etapa exige conexão à internet; o chat depois não exige.
  4. 4
    Conversar, ou adicionar documentos para RAG
    Why it matters: Depois de um modelo ser baixado, o chat roda totalmente no dispositivo via llama.cpp. Anexe um documento suportado (PDF, DOCX e outros) a uma conversa para que o modelo responda com base nele.
  5. 5
    Opcional: ativar voz ou o servidor de API local
    Why it matters: Entrada/saída de voz e o servidor HTTP local compatível com OpenAI são recursos opcionais adicionados ao chat simples — nenhum dos dois é necessário para usar o app.

Modelos e recursos suportados

O ToolNeuron executa qualquer modelo compatível no formato GGUF, incluindo famílias comuns como Llama, Mistral e Gemma, via llama.cpp. Um navegador do Hugging Face integrado permite que os leitores filtrem os modelos disponíveis por tag de pipeline, número de parâmetros, quantização e licença antes de baixar.

Além do chat, o próprio README do projeto lista: RAG de documentos em PDF, DOCX, XLSX, PPTX, ODT, EPUB, RTF, Markdown, HTML, JSON, XML, CSV e texto simples; entrada e saída de voz pelo mecanismo sherpa-onnx (vozes VITS, Piper e Whisper); geração de imagens local, adicionada ao app em maio de 2026 segundo as notas de changelog do projeto; um servidor HTTP local que expõe uma API compatível com OpenAI com interface web própria; e um sistema de plugins isolado (sandbox) para instalar extensões criadas pela comunidade.

É um conjunto de recursos mais amplo do que um cliente de chat de propósito único, e cada recurso passa pelo mesmo mecanismo no dispositivo em vez de acionar um serviço na nuvem, segundo a documentação do projeto.

Requisitos

O ToolNeuron exige Android 12 (nível de API 31) ou mais recente, em hardware arm64-v8a ou x86_64, segundo a configuração de build pública do projeto. Como em qualquer app de LLM no dispositivo, o piso prático de hardware depende mais de qual modelo GGUF é carregado — seu número de parâmetros e sua quantização — do que de uma especificação fixa única; um modelo pequeno quantizado precisa de muito menos memória do que um grande.

Leitores com versões mais antigas do Android ou dispositivos exclusivamente de 32 bits devem esperar que o app não se instale, já que os filtros de SDK mínimo e ABI são aplicados pelo próprio pacote Android, não apenas como uma recomendação branda.

Privacidade e segurança

O objetivo de design declarado do ToolNeuron é evitar qualquer dependência de nuvem: nenhum serviço do Google Play exigido, nenhuma telemetria e nenhum componente do lado do servidor para seus recursos principais de chat e RAG, segundo o próprio README do projeto. Isso é reforçado por uma arquitetura de segurança documentada publicamente de forma incomumente detalhada, em vez de uma afirmação de privacidade de uma linha só.

Os dados locais — incluindo o próprio material das chaves de criptografia — são protegidos com uma chave AES-256-GCM apoiada no Android Keystore (com preferência por StrongBox quando o dispositivo suporta) e autenticação por PIN baseada em Argon2id, segundo a documentação de segurança do projeto. A mesma documentação descreve um mecanismo de bloqueio que se intensifica após tentativas de PIN incorretas repetidas, e um recurso opcional de PIN de pânico que apaga os dados locais do app.

  • Nenhuma conta necessária. O app pode ser instalado e usado sem criar um perfil ou fazer login.
  • Nenhum componente de nuvem para os recursos principais. Chat, RAG e voz são todos projetados para rodar no dispositivo, segundo o README do projeto.
  • Armazenamento local criptografado. Chats, documentos e chaves de criptografia são protegidos com Android Keystore AES-256-GCM e autenticação Argon2id, segundo a documentação do projeto.
  • Código aberto. Como o código-fonte do app é publicado sob a licença MIT, suas afirmações de arquitetura e manuseio de dados podem ser verificadas diretamente no código, em vez de depender apenas das declarações do desenvolvedor.

Prós e contras: vantagens vs. limitações

Gratuito e de código aberto (MIT)

O que isso significa na prática:
Sem custo, e o código-fonte completo está disponível para auditoria no GitHub.
Limitação / ressalva:
Ser de código aberto não garante, por si só, que uma auditoria de segurança independente tenha sido realizada.

Conjunto de recursos mais amplo do que o chat simples

O que isso significa na prática:
RAG de documentos, voz, um servidor de API local e plugins vêm todos embutidos, não são apps separados para gerenciar.
Limitação / ressalva:
Mais partes móveis do que um app de chat de propósito único; esta análise não verificou de forma independente a confiabilidade de cada recurso.

Modelo de segurança detalhado e documentado

O que isso significa na prática:
O armazenamento local criptografado e a autenticação por PIN protegem os dados se o celular for perdido ou acessado por outra pessoa.
Limitação / ressalva:
A documentação de segurança é do próprio projeto; esta análise não submeteu o app a um teste de invasão independente.

Nenhuma dependência de nuvem para os recursos principais

O que isso significa na prática:
Chat, RAG e voz funcionam todos offline depois que um modelo é baixado, segundo o README do projeto.
Limitação / ressalva:
Somente Android — não existe versão para iPhone, desktop ou web.

ToolNeuron vs. alternativas

ToolNeuron

Plataformas:
Somente Android
Preço:
Gratuito, código aberto (MIT)
Flexibilidade de modelos:
Qualquer modelo GGUF via navegador do Hugging Face integrado
Diferença principal:
Conjunto de recursos mais amplo aqui — RAG, voz, servidor de API local e plugins além do chat
Artigos sobre ToolNeuron (2)

Layla

Plataformas:
Android e iOS
Preço:
US$ 19,99 de compra única, mais níveis dentro do app
Flexibilidade de modelos:
Motores de modelos GGUF, LiteRT-LM e PTE
Diferença principal:
Foco em personas e interpretação de papéis, com modo de nuvem opcional; código fechado

RikkaHub

Plataformas:
Somente Android
Preço:
Gratuito, código aberto
Flexibilidade de modelos:
Modelos GGUF, segundo sua própria ficha
Diferença principal:
Outra opção Android gratuita e de código aberto — compare diretamente a profundidade dos recursos

Maid

Plataformas:
Android e iOS
Preço:
Gratuito, código aberto
Flexibilidade de modelos:
Modelos GGUF via llama.cpp
Diferença principal:
Multiplataforma (também iOS), cliente de chat de propósito único mais simples

Os detalhes de plataforma, preço e recursos de apps de terceiros mudam com frequência — verifique as informações atuais na ficha de cada app antes de decidir.

Quem deveria usar o ToolNeuron

  • Usuários Android que querem um app de IA gratuito, de código aberto e no dispositivo. O código-fonte completo é público, e não há custo para instalar ou usar.
  • Leitores que querem mais do que um chat simples. RAG de documentos, entrada/saída de voz e um servidor de API local vêm embutidos em vez de exigir apps separados.
  • Usuários preocupados com privacidade que valorizam um modelo de segurança documentado. O armazenamento local criptografado e a autenticação por PIN vão além de uma simples declaração de política de privacidade.
  • Desenvolvedores que querem estender o app. O sistema de plugins e a base de código aberto permitem personalização direta, diferente de uma alternativa de código fechado.

Quem não deveria usar o ToolNeuron

  • Usuários de iPhone, desktop ou web. O ToolNeuron é exclusivo para Android; não existe versão para iOS, Mac, Windows, Linux ou baseada em navegador.
  • Donos de dispositivos com Android 11 ou anterior, ou hardware exclusivamente de 32 bits. O app exige Android 12 (API 31) ou mais recente em arm64-v8a ou x86_64.
  • Leitores que precisam de um histórico consolidado antes de confiar em um app. O ToolNeuron é mais novo e tem um histórico público menor do que algumas alternativas mais estabelecidas.
  • Leitores que querem um único app de chat simples, sem mais nada. O conjunto de recursos mais amplo (RAG, voz, plugins, um servidor local) é uma vantagem para alguns leitores e complexidade desnecessária para outros.

Perguntas frequentes

O ToolNeuron é gratuito?

Sim. O ToolNeuron é gratuito para instalar e usar, e de código aberto sob a licença MIT, segundo seu repositório no GitHub.

Quem desenvolve o ToolNeuron?

O ToolNeuron é criado e mantido pelo desenvolvedor Siddhesh Sonar.

Quais modelos o ToolNeuron suporta?

Qualquer modelo compatível no formato GGUF, incluindo famílias comuns como Llama, Mistral e Gemma, executados via llama.cpp. Um navegador do Hugging Face integrado ajuda a encontrar e baixar modelos.

O ToolNeuron funciona sem conexão com a internet?

Sim, para seus recursos principais. O README do projeto declara que o app não tem componente de nuvem nem telemetria; a conexão com a internet só é necessária para baixar um modelo ou uma atualização do app.

Qual versão do Android o ToolNeuron precisa?

Android 12 (nível de API 31) ou mais recente, em hardware arm64-v8a ou x86_64, segundo a configuração de build pública do projeto.

O ToolNeuron é de código aberto?

Sim. O app é publicado no GitHub sob a licença MIT, e o código-fonte pode ser auditado ou compilado diretamente.

Quais recursos extras o ToolNeuron tem além do chat?

RAG de documentos em formatos de arquivo comuns, entrada e saída de voz via sherpa-onnx, um servidor HTTP local compatível com OpenAI, um navegador de modelos do Hugging Face e um sistema de plugins isolado (sandbox), segundo o README do projeto.

Como o ToolNeuron se compara ao Layla ou ao RikkaHub?

O ToolNeuron é gratuito e de código aberto, com um conjunto de recursos embutidos mais amplo (RAG, voz, um servidor de API local, plugins). O Layla é um app pago e de código fechado de US$ 19,99 para Android e iOS, com foco em personas/interpretação de papéis e modo de nuvem opcional. O RikkaHub é outro app de chat Android gratuito e de código aberto. Escolha com base em valorizar mais o conjunto de recursos mais amplo do ToolNeuron, o foco multiplataforma em interpretação de papéis do Layla, ou um cliente mais simples de propósito único.

Veredito

O ToolNeuron entrega um app de IA no dispositivo genuinamente amplo, gratuito e de código aberto para Android: chat GGUF via llama.cpp, RAG de documentos, entrada/saída de voz, um servidor de API local compatível com OpenAI e um sistema de plugins, tudo apoiado por uma arquitetura de segurança documentada e voltada à criptografia, em vez de uma vaga promessa de privacidade.

O código-fonte publicado sob licença MIT é uma vantagem significativa em relação a alternativas Android de código fechado — leitores que se importam em verificar o que um app realmente faz com os dados locais podem checar o código diretamente, em vez de confiar apenas em uma ficha.

O que mantém esta análise moderada em vez de incondicionalmente entusiasmada é a relativa juventude do app e a ausência de testes de desempenho práticos e independentes de seus muitos recursos feitos especificamente pela PromptQuorum; leitores com necessidades críticas de desempenho devem testar o app em seu próprio dispositivo antes de depender muito dele.

Usuários Android que querem um app gratuito, de código aberto e focado em privacidade com mais do que um chat simples devem experimentá-lo; leitores que querem um app para iPhone, um cliente de propósito único mais simples ou um histórico mais consolidado devem considerar em vez disso Layla ou RikkaHub.

Fontes

← Voltar para LLMs locais avançados