Skip to main content
PromptQuorum
Início/LLMs locais avançados/Avaliação do claude-code-local 2026: Rode o Claude Code em um Modelo Local
Coding Assistants

Avaliação do claude-code-local 2026: Rode o Claude Code em um Modelo Local

·12 min de leitura·Por Hans Kuepper · Fundador do PromptQuorum, ferramenta de despacho multi-modelo de IA · PromptQuorum

O claude-code-local (github.com/nicedreamzapp/claude-code-local) é um projeto gratuito, open source, não oficial e de terceiros — ele não é feito pela Anthropic e não tem afiliação oficial nem endosso da Anthropic. Ele roda um servidor local nativo em MLX no Apple Silicon que imita o formato da API da Anthropic que o Claude Code espera, de forma que você pode apontar a CLI oficial claude da Anthropic para a sua própria máquina (via ANTHROPIC_BASE_URL) e ter um modelo open-weight diferente, hospedado localmente — como Gemma, Qwen, Llama ou DeepSeek — respondendo no lugar do modelo Claude hospedado na nuvem da Anthropic. Ele não roda o Claude em si offline; ele reaproveita o cliente do Claude Code para conversar com um modelo local através de uma interface compatível. O projeto é licenciado sob MIT, gratuito, exige um Mac com Apple Silicon (M1 ou mais recente), e é construído e mantido por um único desenvolvedor independente, Matt Macosko, sem nenhuma empresa ou investidor por trás.

O claude-code-local (github.com/nicedreamzapp/claude-code-local) é um projeto gratuito, open source e não oficial que permite continuar usando a ferramenta de linha de comando Claude Code da Anthropic enquanto um modelo open-weight rodando localmente, no seu próprio Mac, responde no lugar da API na nuvem da Anthropic. Ele não é feito pela Anthropic, não tem afiliação oficial nem endosso da Anthropic, e não roda o modelo Claude real da Anthropic offline — ele executa um servidor nativo em MLX que fala o mesmo formato de API que o Claude Code espera, de forma que a CLI pode ser redirecionada para um modelo diferente, hospedado localmente (Gemma, Qwen, Llama, DeepSeek e outros), através de uma camada de compatibilidade de API. Esta avaliação cobre o que o projeto realmente faz, como instalá-lo, seus requisitos reais de hardware e onde ele se encaixa entre outras configurações de assistente de código local.

Principais conclusões

  • Gratuito e open source sob a Licença MIT
  • Projeto não oficial, de terceiros — não é feito pela Anthropic, não tem afiliação nem endosso da Anthropic, e não roda o modelo Claude real da Anthropic
  • Roda um servidor nativo em MLX, compatível com a API da Anthropic, para que a CLI oficial claude possa ser apontada para um modelo local via ANTHROPIC_BASE_URL
  • Exige um Mac com Apple Silicon (M1 ou mais recente), Python 3.12, e a CLI do Claude Code da Anthropic instalada separadamente
  • Suporta vários modelos open-weight dimensionados de acordo com a memória unificada do seu Mac, do Hermes 4 14B em máquinas com 16 GB até o Qwen 3.5 122B em máquinas com 96 GB ou mais
  • Um release v0.1.0 (maio de 2026) corrigiu um bug em que configurações anteriores vazavam telemetria e tráfego de fundo para os servidores da Anthropic, mesmo com uma URL base local configurada — verifique se você está em uma versão atual, se privacidade/uso air-gapped for seu objetivo
  • Construído e mantido por um único desenvolvedor independente, Matt Macosko, baseado em Arcata, Califórnia — sem nenhuma empresa ou investidor por trás do projeto
  • O repositório no GitHub (github.com/nicedreamzapp/claude-code-local) mostra 3.314 estrelas e 625 forks em setembro de 2026

📍 Em uma frase

O claude-code-local é um servidor MLX gratuito, open source e não oficial que permite que a CLI do Claude Code da Anthropic rode contra um modelo open-weight hospedado localmente no Apple Silicon, em vez do modelo Claude real da Anthropic ou da sua API na nuvem.

💬 Em termos simples

Ele não coloca o modelo Claude da Anthropic no seu computador. Em vez disso, faz o seu Mac se passar pela nuvem da Anthropic, para que o comando claude continue funcionando exatamente como você conhece, mas um modelo de IA diferente, open-weight, rodando no seu próprio hardware, responde às suas perguntas — sem conta, sem cobrança por token, e sem envio de dados para os servidores da Anthropic nessas requisições.

📌Nota: Esta avaliação é o complemento aprofundado da entrada do claude-code-local no Diretório de Softwares de LLM Local — veja essa página para comparar o projeto rapidamente com dezenas de outras ferramentas de IA local.

📌Nota: Nota sobre o nome: "claude-code-local" reaproveita o cliente/CLI Claude Code da Anthropic para conversar com um modelo open-weight diferente, hospedado localmente. Não é um produto da Anthropic, e não faz o modelo Claude da Anthropic rodar offline.

O Que É o claude-code-local?

O claude-code-local é um servidor local, não um aplicativo de chat nem uma IDE. Ele fica entre a CLI oficial do Claude Code da Anthropic e um modelo open-weight rodando localmente, traduzindo as requisições do Claude Code, no formato da API da Anthropic, para um formato que um modelo local hospedado em MLX consegue responder, e traduzindo a resposta de volta. A própria descrição no GitHub resume o projeto como algo que permite "Run Claude Code 100% on-device with local AI on Apple Silicon", através de um "MLX-native Anthropic-API server".

  • Função principal: um servidor local compatível com a API da Anthropic (proxy/server.py), para o qual o Claude Code pode ser apontado em vez de api.anthropic.com, via as variáveis de ambiente ANTHROPIC_BASE_URL e ANTHROPIC_API_KEY
  • Mecanismo de inferência: MLX, o framework de computação em array da Apple para Apple Silicon, via o pacote mlx-lm — por isso o projeto é exclusivo para Mac e exige um chip da série M
  • O que ele não é: ele não baixa, não roda e não expõe de forma alguma o modelo Claude real da Anthropic. "Claude Code" no nome do projeto se refere ao cliente CLI da Anthropic, que este projeto reaproveita para conversar com um modelo diferente, hospedado localmente
  • Desenvolvedor: um único desenvolvedor independente, Matt Macosko, baseado em Arcata, Califórnia, segundo o rodapé do README no GitHub — o README afirma explicitamente "one person, no team, no investors"
  • Repositório canônico: github.com/nicedreamzapp/claude-code-local — o projeto original e ativo; existe um fork de mesmo nome, jinzaizhichi/claude-code-local, no GitHub, com zero estrelas, que não é um projeto independente separado

Histórico do Projeto e Marcos de Versão

O repositório no GitHub foi criado em 26 de março de 2026. O desenvolvimento tem sido acelerado, mas o projeto manteve suas tags formais de versão em apenas três releases até agora, cada um reunindo uma correção ou funcionalidade significativa, em vez de lançar tags para cada commit.

  1. 1
    v0.1.0 — 8 de maio de 2026: Correção de offline verificado e suporte a Macs de 16 GB
    Why it matters: Um colaborador descobriu, via `lsof`, que o Claude Code 2.1 ainda alcançava `api.anthropic.com` na inicialização para telemetria, feature flags, auto-instalação do marketplace e atualizações automáticas, mesmo com uma `ANTHROPIC_BASE_URL` local configurada — ou seja, configurações anteriores que seguiam o README antigo não estavam de fato totalmente offline. Este release corrigiu isso desativando esse tráfego de fundo através de quatro variáveis de ambiente documentadas, e trocou o modelo padrão para Macs de 16 GB (que vinha travando no modelo padrão anterior) por um modelo menor e funcional.
  2. 2
    v0.2.0 — 5 de agosto de 2026: Correção de integridade do cache de prompt
    Why it matters: Corrigiu um bug em que o cache de prompt compartilhado ficava corrompido após a primeira sessão em um servidor de longa duração, causando, segundo as notas de release, respostas de sessões posteriores baseadas no estado em cache de uma conversa anterior e não relacionada. A medição própria do projeto, antes/depois em um servidor de longa duração, foi de 1 resposta correta em 8 para 8 em 8 depois da correção.
  3. 3
    v0.3.0 — 22 de agosto de 2026: Lançamento do benchmark Agent-12 e suporte ao Qwen 3.8 27B em precisão total
    Why it matters: Introduziu o próprio conjunto de benchmarks de agente open source do desenvolvedor ("Agent-12") para ajudar os usuários a escolher um modelo, e adicionou suporte em precisão total (não quantizado) para um modelo de 27B usando decodificação especulativa, com uma aceleração alegada de aproximadamente 3-4x. Esses números de desempenho e benchmark são medições autorreportadas pelo próprio desenvolvedor — esta avaliação não conseguiu verificá-los de forma independente, então trate números específicos como um ponto de partida, não como garantia para o seu próprio hardware.

O Que Você Pode Fazer com o claude-code-local?

O conjunto de recursos do projeto gira em torno de fazer o Claude Code funcionar contra um modelo local com o mínimo de atrito, além de vários modos adicionais local-first construídos sobre o mesmo servidor. Veja o que cada parte realmente faz, segundo o próprio README no GitHub do projeto.

  • Claude Code, redirecionado localmente — o caso de uso principal: continue usando a CLI claude exatamente como de costume, mas com respostas de um modelo rodando no seu próprio Mac, em vez da nuvem da Anthropic
  • Fallback "Keep going" — um comando de shell que permite continuar uma conversa existente do Claude Code com um modelo diferente (um modelo gratuito na nuvem via OpenRouter, ou um modelo local) quando você atinge o limite de uso da própria Anthropic, sem perder a conversa
  • Modo Native Engine — um agente mais leve, embutido no próprio projeto, oferecido como alternativa mais rápida a encaminhar cada requisição pelo cliente completo do Claude Code
  • Modo Browser Agent — um modo opcional em que o modelo rodando localmente pode operar uma janela de navegador real, documentado separadamente no guia de browser-agent do projeto
  • Modo de voz — um modo opcional para conversar com o modelo local de mãos livres e ouvir uma resposta falada, documentado no guia de modo de voz do projeto
  • Controle por celular — um modo opcional para enviar comandos ao servidor hospedado no Mac a partir de um celular, documentado no guia de controle por celular do projeto
  • Isolamento de tráfego — define quatro das próprias variáveis de ambiente documentadas do Claude Code para desativar chamadas de rede de fundo não essenciais (telemetria, atualização automática, auto-instalação do marketplace, tarefas em segundo plano), verificável por você mesmo via lsof -p $(pgrep -f claude)

Exemplos de Uso: Três Formas de Usar o claude-code-local

Estes são fluxos de trabalho concretos, construídos a partir dos recursos documentados do projeto acima — não são casos de uso hipotéticos.

Preço e Licenciamento: É Realmente Gratuito?

Sim — o claude-code-local em si é gratuito e open source, sob a Licença MIT, confirmada pelo selo de licença do repositório e pelo arquivo LICENSE. Não há assinatura, conta nem limite de uso impostos pelo próprio projeto.

  • O servidor, o instalador e os launchers são gratuitos e licenciados sob MIT, sem plano pago
  • Modelos locais rodam sem custo por token, usando o hardware e a energia elétrica do seu próprio Mac
  • O projeto ainda exige a CLI oficial do Claude Code da Anthropic, que é gratuita para instalar; manter ou não uma assinatura separada da Anthropic é uma escolha sua, independente do uso deste projeto
  • Um fallback opcional em nuvem, o "keep going", pode usar modelos de camada gratuita do OpenRouter com sua própria chave de API gratuita — isso é opcional e não é necessário para o fluxo de trabalho local principal

Requisitos de Hardware e Escolha de Modelo

Os requisitos de hardware escalam diretamente com o modelo que você escolhe rodar, já que o claude-code-local não tem um mínimo fixo próprio além de Apple Silicon e macOS. O próprio script de setup do projeto recomenda uma faixa de modelo com base na memória unificada total do seu Mac.

Memória unificada
Modelo recomendado
16 GB (ex.: MacBook Air, modelos base)Hermes 4 14B
32–48 GB (faixa Pro)Gemma 4 12B
64–95 GB (faixa Max)Gemma 4 31B
96 GB ou mais (faixa Max/Ultra)Qwen 3.5 122B, com espaço para rodar o Llama 3.3 70B e outros junto

O projeto também documenta várias opções adicionais de modelo além da recomendação padrão por faixa, incluindo o Qwen 3.8 27B em precisão total e uma build autodescrita como "abliterated" (com recusas de segurança reduzidas) de um modelo de 30B chamado Muse-Glimmer. Uma observação sobre modelos "abliterated": o próprio README do projeto avisa que esses modelos têm suas recusas de segurança embutidas reduzidas e afirma claramente que "each model's own license still applies" e para "use them responsibly" — essa é uma diferença real de capacidade em relação a um modelo padrão ajustado por instrução, e a responsabilidade por como você usa um desses recai sobre você. Os números de benchmark e velocidade para modelos específicos ao longo do README (incluindo o ranking do Agent-12) são medições autorreportadas pelo próprio desenvolvedor, não verificadas de forma independente pela PromptQuorum.

Quem Deveria Usar o claude-code-local?

Este projeto ser adequado ou não depende de você querer especificamente manter o fluxo de trabalho da CLI do Claude Code enquanto troca por um modelo local, e de você ter o hardware Apple Silicon que ele exige.

claude-code-local vs. Outras Configurações de Assistente de Código Local

O claude-code-local é uma entre várias formas de rodar assistência de código com IA contra um modelo local, em vez de uma API na nuvem. Veja como ele se posiciona ao lado de outras opções nesse espaço — confira o Diretório de Softwares de LLM Local para o catálogo completo.

  • oMLX — um servidor de inferência MLX de propósito geral para Apple Silicon, com cache de modelo baseado em SSD; ao contrário do claude-code-local, não é construído especificamente em torno do formato de API do Claude Code, mas é a comparação mais próxima para quem escolhe um backend local baseado em MLX em um Mac. Veja a avaliação do oMLX.
  • Aider — uma ferramenta de programação em par com IA baseada em terminal, agnóstica de modelo, que funciona com modelos locais através de qualquer endpoint compatível com a API da OpenAI, integrada ao git por design; uma boa comparação se você quer uma CLI de código construída local-first desde o início, em vez de uma camada de compatibilidade na frente do cliente da Anthropic. Veja a avaliação do Aider.
  • Cline — um agente de código autônomo open source, baseado no VS Code, que também suporta modelos locais através de endpoints compatíveis com a API da OpenAI; uma boa comparação se você prefere um agente embutido na IDE em vez de um fluxo de trabalho voltado a terminal. Veja a avaliação do Cline.

Erros Comuns ao Avaliar o claude-code-local

A maior parte da confusão sobre este projeto vem do seu nome sugerir uma oferta oficial da Anthropic, ou de assumir que qualquer versão é automaticamente totalmente offline.

Perguntas Frequentes

O que é o claude-code-local?

O claude-code-local (github.com/nicedreamzapp/claude-code-local) é um servidor MLX gratuito, open source e não oficial para Macs com Apple Silicon, que permite que a CLI do Claude Code da Anthropic se conecte a um modelo open-weight rodando localmente, em vez da API na nuvem da Anthropic.

O claude-code-local é feito pela Anthropic?

Não. É um projeto independente, de terceiros, construído pela comunidade. Ele não é feito pela Anthropic e não tem afiliação oficial nem endosso da Anthropic de nenhuma forma.

O claude-code-local roda o modelo Claude real da Anthropic offline?

Não. Ele não baixa, não hospeda e não roda o modelo Claude da Anthropic de forma alguma. Ele roda um modelo open-weight diferente, hospedado localmente (como Gemma, Qwen, Llama ou DeepSeek), e faz com que ele responda através de um servidor que fala o mesmo formato de API que o cliente Claude Code espera.

O claude-code-local é gratuito?

Sim. É open source sob a Licença MIT, sem plano pago. Você ainda precisa da CLI gratuita do Claude Code da Anthropic instalada como dependência, mas o projeto em si não cobra nada.

Que hardware o claude-code-local exige?

Um Mac com Apple Silicon (M1 ou mais recente) e Python 3.12, já que o projeto roda inferência local através do framework MLX da Apple. Não há suporte para Windows, Linux ou Intel Mac. Ele funciona em um Mac de 16 GB, segundo os próprios testes do projeto, com Macs de maior memória unificada conseguindo rodar modelos maiores e mais capazes.

O claude-code-local mantém meu código totalmente offline?

Pode manter, mas apenas a partir da v0.1.0. Um bug anterior fazia com que o próprio Claude Code alcançasse os servidores da Anthropic para telemetria e tarefas de fundo, mesmo com uma URL base local configurada; a v0.1.0 (maio de 2026) corrigiu isso desativando esse tráfego. Verifique sua própria configuração com lsof -p $(pgrep -f claude) em vez de assumir.

Como instalo o claude-code-local?

O instalador documentado em um comando é curl -fsSL https://raw.githubusercontent.com/nicedreamzapp/claude-code-local/main/install.sh | bash. Também está documentada uma alternativa manual — clonar o repositório e rodar bash setup.sh depois de ler o script — para quem prefere não enviar um script remoto diretamente para o bash.

Quais modelos o claude-code-local consegue rodar?

O projeto documenta vários modelos open-weight dimensionados pela memória unificada do seu Mac, do Hermes 4 14B (16 GB) até o Qwen 3.5 122B (96 GB ou mais), além de opções adicionais como Gemma 4, Llama 3.3 70B, e uma build do Qwen 3.8 27B em precisão total. A escolha e a qualidade do modelo variam conforme qual você escolhe e seu hardware.

Quem desenvolve o claude-code-local?

É construído e mantido por um único desenvolvedor independente, Matt Macosko, baseado em Arcata, Califórnia. O próprio README do projeto afirma isso explicitamente: "one person, no team, no investors".

Quando o claude-code-local foi lançado pela primeira vez?

O repositório no GitHub foi criado em 26 de março de 2026. A primeira tag formal de versão, v0.1.0, veio em 8 de maio de 2026, seguida pela v0.2.0 (5 de agosto de 2026) e pela v0.3.0 (22 de agosto de 2026) — veja a página oficial de Releases para qualquer coisa lançada após a data de publicação desta avaliação.

Fontes

← Voltar para LLMs locais avançados