Principais conclusões
- Continue.dev foi adquirido pela Cursor (junho de 2026) — a v2.0.0-vscode é a versão final, repositório somente leitura, dados na nuvem excluídos após 15 de julho de 2026; ainda roda localmente com Ollama, mas sem manutenção
- Cline é agora a melhor alternativa gratuita (BYOK) mantida ativamente: VS Code + toda a família JetBrains (PyCharm, Rider, CLion, GoLand, WebStorm, RustRover), edição agêntica de arquivos, ferramentas MCP, mais de 5M de instalações
- O Bodega One Code é uma IDE independente local-first gratuita para uso pessoal, com agente de codificação integrado e suporte a bring-your-own-LLM (BYOL) — operação completa offline/air-gap, sem assinatura forçada
- Tabby roda seu próprio servidor de inferência (modelos de 1–3B) — menor latência de autocompletar para times, self-hosted sob Apache 2.0
- Aider é a opção terminal-first — com reconhecimento de commits git, reescritas multiarquivo, mais de 44 mil estrelas no GitHub
- Cursor (Hobby gratuito / Pro $20 / Pro+ $60 / Ultra $200 por mês) adquiriu tanto o Supermaven quanto o Continue.dev; a SpaceX concluiu a aquisição da Cursor por $60 bilhões em agosto de 2026
- Todas as ferramentas funcionam totalmente offline contra um backend local (Ollama, LM Studio ou um servidor auto-hospedado); apenas o Cursor exige um app conectado à nuvem mesmo ao usar modelos locais
Compare os seis rapidamente
Cada plugin aqui se conecta a um modelo local — a diferença está no tipo de codificação que você faz e em quanto ecossistema comercial você quer ao redor.
| Plugin | Melhor para | Backend local | Preço | Obter |
|---|---|---|---|---|
| Cline | A maioria / tarefas agênticas | Ollama, LM Studio, 30+ APIs | Gratuito (BYOK) / a partir de $9,99/mês | Instalar grátis → |
| Bodega One Code | Offline / air-gap / conformidade | Ollama, LM Studio, llama.cpp, 10+ | Gratuito (pessoal) / $39 único | Testar grátis → |
| Continue (legado) | Só para usuários já existentes | Ollama, LM Studio, llama.cpp | Gratuito (sem manutenção) | Continue.dev → |
| Tabby | Autocompletar self-hosted + rápido | Servidor de inferência próprio (1–3B) | Gratuito, open-source | Self-hostear grátis → |
| Aider | Terminal + fluxo de trabalho git | Ollama, LM Studio, compat. OpenAI | Gratuito, open-source | Instalar grátis → |
| Cursor | IDE polida, mix nuvem + local | Ollama, LM Studio (Custom API) | Hobby grátis / $20–$200/mês | Começar grátis → |
Pule os seis se você ainda não tem um modelo local rodando — escolha primeiro o hardware e um backend (Ollama ou LM Studio), e depois volte para esta tabela. Cada link acima é um link de produto comum, sem relação de afiliação atual — veja o aviso de divulgação no topo desta página.
Comece com o Cline: instalado nos próximos 2 minutos
O Cline é a recomendação padrão desta página. Veja por quê e como instalá-lo agora mesmo.
- Gratuito e open-source — traga sua própria chave ou aponte para um endpoint local, sem assinatura forçada (o ClinePass, a partir de $9,99/mês, é opcional, para roteamento gerenciado sem sua própria chave de API).
- Funciona no VS Code e em toda a família JetBrains — IntelliJ IDEA, PyCharm, WebStorm, PhpStorm, GoLand, Rider, CLion, RustRover, RubyMine e DataGrip.
- Conecta-se nativamente ao Ollama e ao LM Studio — além de mais de 30 outros provedores compatíveis com OpenAI, sem exigir dependência de nuvem.
- Realmente agêntico — lê/escreve arquivos, executa comandos de terminal e usa ferramentas MCP, não apenas autocompletar inline.
- Limitação: tarefas agênticas confiáveis de múltiplos passos exigem um modelo local de classe 32B (24 GB+ de VRAM); modelos de 14B lidam com edições simples, mas têm dificuldade em refatorações multiarquivo complexas.
Qual você deve usar?
Associe sua prioridade a um plugin — os seis são detalhados mais abaixo nesta página.
- Mais fácil, quer funcionando hoje → Cline — gratuito, agêntico, VS Code + JetBrains.
- Totalmente offline, air-gapped ou sob exigência de conformidade → Bodega One Code — IDE independente sem nenhum componente em nuvem.
- Autocompletar mais rápido para um time, self-hosted → Tabby — servidor de inferência próprio, completions abaixo de 200ms.
- Fluxo terminal-first, com reconhecimento de git → Aider — edições multiarquivo, auto-commits.
- Quer uma IDE comercial polida com opção local ocasional → Cursor — cloud-first por design, modelos locais via Ollama/LM Studio na configuração Custom API.
- Já usa o Continue → ainda instala e roda (Ollama, BYO-LLM), mas o projeto está sem manutenção desde a aquisição pela Cursor em junho de 2026 — planeje migrar para o Cline quando for conveniente, sem urgência.
Melhores plugins de IDE para LLMs locais — Classificação
📍 Em uma frase
Cline é o melhor plugin de IDE para LLMs locais em 2026 porque suporta o Ollama nativamente, funciona tanto no VS Code quanto no JetBrains e adiciona edição agêntica de arquivos e ferramentas MCP sem nenhuma dependência da nuvem — o Continue, antigo #1, foi adquirido pela Cursor em junho de 2026 e não recebe mais desenvolvimento ativo.
💬 Em termos simples
Um plugin de IDE para LLMs locais conecta seu editor de código (VS Code, IntelliJ) a um modelo executando na sua própria máquina (via Ollama, LM Studio ou llama.cpp). O modelo vê seu código e responde — nenhum código sai do seu computador, sem taxas de API, sem limites de uso.

Cline — Melhor opção geral (gratuito, código aberto, mantido ativamente)
Cline (anteriormente Claude Dev) é o plugin de codificação agêntica mais bem mantido para LLMs locais em 2026 — assumiu o primeiro lugar depois que o Continue foi adquirido pela Cursor em junho de 2026. Ele lê e escreve arquivos, executa comandos de terminal, navega na web (via ferramenta de navegador) e usa servidores MCP. Com Ollama + Qwen3-Coder 32B, o Cline consegue implementar funcionalidades inteiras a partir de um prompt. Limitações: modelos de 32B são necessários para tarefas agênticas confiáveis de múltiplos passos; modelos de 14B funcionam para tarefas simples. Preços: gratuito (BYOK — traga sua própria chave de API da Anthropic, OpenAI ou mais de 30 provedores); ClinePass a $9,99/mês (introdutório a $4,99 no primeiro mês) para roteamento gerenciado sem necessidade de chave de API; Teams a $20/usuário/mês (primeiras 10 vagas gratuitas). VS Code e toda a família JetBrains: IntelliJ IDEA, PyCharm, WebStorm, PhpStorm, GoLand, Rider, CLion, RustRover, RubyMine e DataGrip. Backends compatíveis: Ollama, LM Studio, proxy LiteLLM e mais de 30 provedores em nuvem. Mais de 5M de instalações somando VS Code, JetBrains e outros editores.
Bodega One Code — Melhor IDE local-first gratuita com agente de codificação integrado
O Bodega One Code é uma IDE de IA local-first, construída desde o início ao redor de um agente de codificação, em vez de ser um assistente adicionado a um editor já existente. Ele oferece suporte a bring-your-own-LLM (BYOL) em mais de 10 backends, incluindo Ollama, LM Studio, llama.cpp, LocalAI, KoboldCpp, GPT4All e MLX para modelos locais, além de provedores de nuvem diretos se você quiser: aponte para qualquer backend e o agente executa o planejamento, a edição e a execução inteiramente com base nesse modelo, sem prender você a um único provedor. O aplicativo inteiro roda no seu computador, incluindo um modo offline e air-gap completo que bloqueia conexões de rede de saída, para que nenhuma telemetria ou chamada de modelo saia da máquina — por isso funciona em ambientes isolados de rede onde ferramentas conectadas à nuvem, como Cursor ou GitHub Copilot, simplesmente não podem ser usadas. Preços: gratuito para uso pessoal durante a beta aberta atual, incluindo direitos de uso comercial por enquanto; um nível Pro pago, de pagamento único (preço ainda não anunciado), está planejado para o lançamento completo, adicionando direitos de uso comercial permanentes, workspaces ilimitados e uma segunda máquina, mas ainda não está disponível para compra. Não há assinatura nem medição de uso para uso de modelos locais. Isso o torna uma boa opção para setores regulados, contratantes governamentais e de defesa, e qualquer equipe cuja política de segurança proíba enviar código para um servidor de terceiros — exatamente o público que busca inferência local em primeiro lugar. Comparado ao Cline, que é um plugin adicionado ao VS Code, o Bodega One Code é uma IDE independente projetada em torno do agente desde o início; equipes que já usam VS Code vão achar o Cline a adição mais simples, enquanto equipes começando do zero ou que precisam garantir operação offline têm no Bodega One Code um ambiente construído especificamente para isso.
Continue — Ainda funcional, sem manutenção [Adquirido pela Cursor em junho de 2026 — versão final v2.0.0-vscode]
O Continue era o principal assistente de codificação de IA open-source para LLMs locais antes de sua aquisição pela Cursor em junho de 2026. Conecta-se ao Ollama, LM Studio, llama.cpp e a qualquer API compatível com OpenAI. Recursos: chat inline (Cmd+L), autocompletar (Tab), ferramentas de protocolo de contexto de modelo (MCP), indexação de codebase e comandos slash personalizados. A extensão do VS Code tem mais de 2M de instalações. O plugin do JetBrains funciona no IntelliJ IDEA, PyCharm, GoLand, WebStorm e Rider — não cobre CLion nem RustRover. Melhores modelos locais: Qwen3-Coder 14B (codificação), Llama 3.1 8B (chat). Configuração: instale a extensão, defina o provedor como Ollama, escolha o modelo — pronto em 2 minutos. Nota (junho de 2026): o Continue foi adquirido pela Cursor. A versão 2.0.0-vscode, lançada em 19 de junho de 2026, é a última; o repositório do GitHub agora é somente leitura, e os dados na nuvem hospedados pelo Continue foram excluídos após 15 de julho de 2026. A extensão continua instalando e funcionando totalmente offline com Ollama e BYO-LLM — mas sem mais desenvolvimento da equipe original. Forks da comunidade estão ativos.
Tabby — Melhor servidor de autocompletar self-hosted
Tabby é um assistente de codificação self-hosted, construído em Rust sob a licença Apache 2.0, que roda seu próprio servidor de inferência (separado do Ollama). Ele usa modelos pequenos e especializados de completar código (1–3B parâmetros) treinados especificamente para autocompletar fill-in-the-middle (FIM) — significativamente mais rápido do que usar um modelo 7B de uso geral. A versão estável atual é a v0.32.0, com cerca de 33 mil estrelas no GitHub. Existem extensões de IDE do Tabby para VS Code, JetBrains, Vim/Neovim e Emacs. Ideal para: times de 5 a 50 desenvolvedores, especialmente equipes reguladas ou sensíveis à propriedade intelectual que querem autocompletar rápido (<200ms) sem enviar código para a nuvem. Requer um servidor dedicado ou uma máquina desktop potente — gratuito para self-hostear com usuários ilimitados, sem taxa por assento.
Aider — Melhor codificação de IA nativa de terminal
Aider é um par de programação de IA baseado em terminal que se integra ao git. Ele entende a estrutura completa do seu repositório, faz edições multiarquivo e faz commit das mudanças automaticamente. Funciona com Ollama (via --model ollama/qwen2.5-coder:14b), LM Studio ou qualquer API compatível com OpenAI. Melhores modelos locais: Qwen3-Coder 32B (modo arquiteto) + Qwen3-Coder 7B (modo editor). O Aider usa uma abordagem de dois modelos: um modelo grande planeja as mudanças, um modelo pequeno as implementa. Mais de 44 mil estrelas no GitHub. Custo: gratuito e open-source. Nota: o Aider ainda está na versão 0.x em 2026, então as flags da CLI e o formato do .aider.conf.yml mudam ocasionalmente entre versões menores — confira o changelog após atualizar.
Cursor — Melhor opção comercial com suporte a modelos locais
Cursor é um fork do VS Code com recursos de IA integrados. O Cursor suporta modelos locais via Ollama e LM Studio em sua configuração "Custom API". No entanto, os recursos mais poderosos do Cursor (modo Agent com busca na web, reconhecimento completo do codebase) exigem modelos na nuvem. A integração de modelos locais funciona para chat e completions simples, mas fica atrás do Cline em fluxos de trabalho focados em privacidade, já que o próprio Cursor continua sendo um aplicativo conectado à nuvem mesmo quando a inferência roda localmente. Preços: Hobby (gratuito, inclui uso de modelos locais); Pro a $20/mês ($16/mês na cobrança anual, inclui um pool de créditos de IA de $20/mês para modelos fronteira; o modo Auto é ilimitado sem custo de créditos); Pro+ a $60/mês (3x os créditos de uso); Ultra a $200/mês (20x o uso); Teams a $40/usuário/mês com faturamento centralizado e SSO. Nota: Cursor adquiriu o Supermaven (2024) e o Continue.dev (junho de 2026). A SpaceX concluiu a aquisição de $60 bilhões do Cursor em agosto de 2026, dias após o próprio IPO da SpaceX — a receita anualizada do Cursor teria crescido de cerca de $100 milhões no início de 2025 para mais de $4 bilhões até junho de 2026, segundo relatos. Essa consolidação torna o Cursor a força comercial dominante em ferramentas de codificação com IA — mas levanta questões de longo prazo sobre as alternativas open-source.
Vantagens
- +Fork do VS Code polido e familiar — curva de aprendizado quase nula para usuários já habituados ao VS Code
- +Modelos locais via Ollama ou LM Studio através da configuração Custom API
- +O nível Hobby gratuito inclui uso de modelos locais, não apenas um teste
Desvantagens
- –Os recursos mais fortes (modo Agent, reconhecimento completo do codebase) exigem modelos na nuvem/fronteira, não locais
- –Agora pertence à SpaceX/xAI — um perfil de fornecedor bem diferente de uma ferramenta open-source independente
Configuração rápida: Cline + Ollama no VS Code
Pronto para instalar o Cline? → Instalar o Cline grátis. Siga estes passos para conectá-lo ao Ollama — a forma mais rápida de começar a programar com LLM local usando a atual escolha #1:
- 1Instale o Ollama:
curl -fsSL https://ollama.com/install.sh | sh - 2Baixe um modelo de codificação:
ollama pull qwen2.5-coder:14b(ouqwen3-coder:32bpara tarefas agênticas) - 3No VS Code, instale o Cline pelo marketplace de extensões
- 4Abra a barra lateral do Cline e clique no ícone de engrenagem de configurações
- 5Defina o provedor de API como "Ollama", a URL base como
http://localhost:11434e o Model ID como o modelo baixado - 6Reinicie o VS Code — o ícone do Cline aparece na barra lateral
- 7Digite uma tarefa no painel de chat do Cline — ele consegue ler/escrever arquivos e executar comandos de terminal diretamente
Configuração rápida: Aider + Ollama (terminal)
Pronto para instalar o Aider? → Instalar o Aider grátis. Para codificação de IA nativa de terminal, com reconhecimento de git — documentação oficial do Aider: aider.chat/docs/llms/ollama.html
- 1Instale o Ollama e baixe um modelo:
ollama pull qwen2.5-coder:32b - 2Instale o Aider:
python -m pip install aider-install && aider-install - 3Defina a base da API do Ollama:
export OLLAMA_API_BASE=http://127.0.0.1:11434 - 4Execute o Aider apontando para seu modelo local:
aider --model ollama/qwen2.5-coder:32b - 5Para a configuração de dois modelos (arquiteto/editor), adicione
--architect-model ollama/qwen2.5-coder:32b --editor-model ollama/qwen2.5-coder:7b - 6O Aider faz commit automático de cada mudança no git — revise com
git logougit diff HEAD~1
Melhores modelos locais por plugin e tarefa
| Plugin | Melhor modelo de codificação (local) | Melhor modelo de chat (local) | VRAM mínima |
|---|---|---|---|
| Cline | Qwen3-Coder 32B Q4 | Qwen3 32B Q4 | 24 GB |
| Bodega One Code | Qualquer modelo local (BYOL) | Qualquer modelo local (BYOL) | Depende do modelo escolhido |
| Continue (legado) | Qwen3-Coder 14B Q8 | Llama 3.1 8B Q4 | 16 GB |
| Tabby | StarCoder2-7B (integrado) | N/A (apenas código) | 8 GB |
| Aider | Qwen3-Coder 14B (editor) | Qwen3-Coder 32B (arquiteto) | 16–24 GB |
| Cursor | DeepSeek-Coder-V2 (via Ollama) | Qwen3 14B | 16 GB |
Precisa de hardware para esses modelos? 8 GB de VRAM cobrem os modelos pequenos de completion do Tabby; 16 GB dão conta da maioria dos modelos de codificação de 14B (Continue, modo editor do Aider, opção local do Cursor); 24 GB+ é o mínimo realista para trabalho agêntico confiável de 32B com Cline ou o modo arquiteto do Aider. Veja Melhores GPUs para LLMs locais para a seleção completa, ou Melhores GPUs econômicas para LLMs locais se você está começando com menos de 16 GB.

Melhores plugins do LM Studio (não é o mesmo que plugins de IDE)
Esta é uma pergunta diferente de "qual extensão de IDE se conecta ao LM Studio" (abordada acima) — e vale a pena responder diretamente, já que o LM Studio é um dos dois backends aos quais todo plugin deste guia se conecta. O LM Studio tem seu próprio sistema de plugins desde o fim de 2024: os plugins rodam dentro do próprio LM Studio — atualmente como código TypeScript/JavaScript sobre Node.js em um worker isolado (sandbox), com suporte a Python ainda em desenvolvimento — e podem interceptar requisições de inferência, adicionar processadores de prompt, conectar backends de chamada de ferramentas ou adicionar novos painéis de interface. Instale-os no marketplace curado em lmstudio.ai/plugins; cada plugin declara previamente as permissões necessárias (acesso à rede, leitura do sistema de arquivos), e você pode revogá-las depois em Configurações sem desinstalar. Categorias comuns em 2026: plugins de busca na web, pré-processadores de RAG/recuperação de documentos, pré-processadores de OCR, plugins de conjunto de ferramentas agênticas, ferramentas de acesso a shell/arquivos e plugins de memória.
- Plugins de busca na web: permitem que um modelo local no LM Studio traga resultados da web ao vivo para o contexto — útil já que modelos locais não têm acesso nativo à internet.
- Plugins de RAG / documentos: indexam uma pasta local de PDFs ou arquivos de texto e recuperam trechos relevantes automaticamente a cada consulta.
- Plugins de conjunto de ferramentas agênticas: dão ao modelo acesso a shell, leitura/escrita de arquivos ou execução de tarefas multi-etapas diretamente na interface de chat do próprio LM Studio — a mesma categoria de capacidade que o Cline oferece para o VS Code, mas rodando dentro do LM Studio em vez de um editor.
- Plugins de memória: mantêm o contexto entre sessões de chat em vez de começar do zero a cada vez.
O Continue pode substituir completamente o GitHub Copilot para uso local?
A partir de junho de 2026, o Continue foi adquirido pela Cursor e a v2.0.0 é a versão final (o repositório é somente leitura). A extensão continua funcionando com Ollama e BYO-LLM, mas não recebe mais desenvolvimento da equipe original. Para uma alternativa open-source mantida ativamente, o Cline é a substituição recomendada — oferece o mesmo modelo BYOK, funciona no VS Code e no JetBrains e adiciona edição agêntica de arquivos. O GitHub Copilot Pro custa $10/mês com $15/mês em créditos de IA; o Cline é gratuito com sua própria chave de API.
Qual plugin funciona melhor para refatoração multiarquivo?
Cline ou Aider. Ambos conseguem ler vários arquivos, entender dependências e fazer edições coordenadas em um codebase. O Cline funciona dentro do VS Code (melhor para feedback visual); o Aider funciona no terminal (melhor para integração CI/CD e commits com reconhecimento de git). Para modelos de 30B+ com 24 GB de VRAM, o Cline com Qwen3-Coder 32B lida com refatorações complexas de forma confiável.
O Tabby funciona sem GPU?
Sim — o Tabby pode rodar em CPU com modelos pequenos (1–3B). No entanto, a latência de autocompletar em CPU é de 500ms–2s, o que parece lento comparado ao objetivo de <200ms para uma codificação fluida. Para máquinas apenas com CPU, Cline + Ollama com um modelo rápido de 1B ou 3B oferece melhor controle de latência.
Posso usar esses plugins com o LM Studio em vez do Ollama?
Sim. O LM Studio expõe uma API compatível com OpenAI na porta 1234 por padrão. Defina o provedor do seu plugin como "openai" com a URL base http://localhost:1234/v1 e use qualquer nome de modelo da sua biblioteca do LM Studio. Cline, Continue e Aider suportam essa configuração. Note que isso é diferente do sistema de plugins próprio do LM Studio (veja a seção Melhores plugins do LM Studio acima) — aquele serve para estender o próprio LM Studio, não para conectar uma IDE externa a ele.
Quais IDEs JetBrains suportam plugins de LLM local?
Cline e Continue oferecem plugins JetBrains. O Cline cobre toda a família: IntelliJ IDEA, PyCharm, PhpStorm, WebStorm, GoLand, Rider, CLion, RustRover, RubyMine e DataGrip. O Continue cobre apenas IntelliJ IDEA, PyCharm, PhpStorm, WebStorm, GoLand e Rider. Instale pelo JetBrains Marketplace (não pelo VS Code Marketplace) e configure as mesmas definições de provedor Ollama/LM Studio da versão para VS Code. O Tabby também tem suporte JetBrains apenas para autocompletar.
O Cline funciona no PyCharm, Rider, GoLand, WebStorm, CLion e RustRover?
Sim — o plugin JetBrains do Cline, instalado pelo JetBrains Marketplace, suporta toda a família JetBrains: IntelliJ IDEA, PyCharm, WebStorm, PhpStorm, GoLand, Rider, CLion, RustRover, RubyMine e DataGrip. Configure as mesmas definições de provedor Ollama ou LM Studio da versão para VS Code. O plugin JetBrains do Continue (sem manutenção desde a aquisição pela Cursor em junho de 2026) cobre um conjunto mais restrito — IntelliJ IDEA, PyCharm, GoLand, WebStorm e Rider — mas não CLion nem RustRover.
Quais dessas ferramentas funcionam totalmente offline para GDPR, HIPAA ou ambientes air-gapped?
O Bodega One Code foi feito especificamente para isso: operação totalmente offline com modelos locais, além de um modo air-gap que bloqueia todas as conexões de rede de saída, para que nenhuma telemetria ou chamada de modelo saia da máquina. Cline, Continue, Tabby e Aider também funcionam totalmente offline, desde que você os aponte para um backend local (Ollama, LM Studio ou um servidor Tabby auto-hospedado) em vez de uma API na nuvem — nenhum deles "liga para casa" nessa configuração. O suporte a modelos locais do Cursor (via sua configuração Custom API) ainda roda dentro de um aplicativo conectado à nuvem, então não é adequado para ambientes isolados de rede.
O que é o Bodega One Code, e como ele difere do Cline?
O Bodega One Code é uma IDE de IA independente e local-first com um agente de codificação integrado, gratuita para uso pessoal durante sua beta aberta atual — diferente do Cline, que é um plugin adicionado ao VS Code ou JetBrains, o Bodega One Code é uma IDE completa construída ao redor do agente desde o início. Ele oferece suporte a bring-your-own-LLM (BYOL) em mais de 10 backends, e roda inteiramente offline com suporte a air-gap. Um nível Pro pago, de pagamento único, para uso comercial está planejado mas ainda não disponível para compra. É uma boa opção para ambientes regulados ou isolados de rede onde um editor conectado à nuvem simplesmente não pode ser usado.
Minhas recomendações para 2026
Seis ferramentas, uma página — aqui está a versão curta se você só quer a resposta:
- Melhor no geral → Cline — gratuito, agêntico, VS Code + toda a família JetBrains. Instale primeiro.
- Melhor totalmente offline / conformidade → Bodega One Code — IDE independente, sem componente em nuvem.
- Melhor autocompletar → Tabby — self-hosted, abaixo de 200ms.
- Melhor fluxo de terminal → Aider — com reconhecimento de git, multiarquivo.
- Melhor IDE comercial → Cursor — comece grátis no nível Hobby, adicione modelos locais via Ollama/LM Studio.
