Points clés
- Continue.dev a été racheté par Cursor (juin 2026) — v2.0.0 est la dernière publication, le dépôt est désormais en lecture seule ; fonctionne toujours avec Ollama mais n'est plus maintenu
- Cline est désormais la meilleure alternative gratuite (BYOK) activement maintenue : VS Code + JetBrains, édition de fichiers agentique, outils MCP, 5M+ installations
- Bodega One Code est un IDE local-first gratuit avec agent de codage intégré et bring-your-own-LLM (BYOL) — fonctionnement hors ligne/air-gap complet, aucun abonnement requis
- Tabby tourne avec son propre serveur d'inférence (modèles 1–3B) — latence d'autocomplétion la plus faible pour les équipes
- Aider est l'option terminal-first — conscient des commits git, réécriture multi-fichiers, 44K étoiles GitHub
- Cursor (20 $/mois Pro, basé sur des crédits) a racheté Supermaven et Continue.dev ; SpaceX a accepté de racheter Cursor pour 60 milliards de dollars en juin 2026
- Tous les outils fonctionnent avec Ollama ; seul Tabby nécessite son propre serveur backend
Meilleurs plugins IDE pour LLMs locaux — Classement
📍 En une phrase
Cline est le meilleur plugin IDE pour les LLMs locaux en 2026 car il supporte Ollama nativement, fonctionne dans VS Code et JetBrains, et ajoute l'édition de fichiers agentique et les outils MCP sans dépendance cloud — Continue, l'ancien n°1, a été racheté par Cursor en juin 2026 et n'est plus développé activement.
💬 En termes simples
Un plugin IDE pour LLMs locaux connecte votre éditeur de code (VS Code, IntelliJ) à un modèle tournant sur votre propre machine (via Ollama, LM Studio ou llama.cpp). Le modèle voit votre code et répond — aucun code ne quitte votre ordinateur, pas de frais d'API, pas de limites d'utilisation.

Cline — Meilleur choix global (gratuit, open-source, activement maintenu)
Cline (anciennement Claude Dev) est en 2026 le plugin de codage agentique le mieux maintenu pour les LLMs locaux — il a pris la première place après le rachat de Continue par Cursor en juin 2026. Il lit et écrit des fichiers, exécute des commandes terminal, navigue sur le web (via un outil navigateur) et utilise des serveurs MCP. Avec Ollama + Qwen3-Coder 32B, Cline peut implémenter des fonctionnalités complètes à partir d'une invite. Limites : les modèles 32B sont requis pour des tâches agentiques multi-étapes fiables ; les modèles 14B suffisent pour des tâches simples. Tarifs : gratuit (BYOK — apportez votre propre clé API d'Anthropic, OpenAI ou 30+ fournisseurs) ; ClinePass à 9,99 $/mois pour un routage géré sans clé API requise ; Teams à 20 $/utilisateur/mois (10 premiers sièges gratuits). VS Code et JetBrains (IntelliJ, PyCharm, PhpStorm, WebStorm, GoLand, Rider, et plus). Backends compatibles : Ollama, LM Studio, proxy LiteLLM et 30+ fournisseurs cloud. 8M+ développeurs.
Bodega One Code — Meilleur IDE local-first gratuit avec agent de codage intégré
Bodega One Code est un IDE IA gratuit et local-first, conçu dès le départ autour d'un agent de codage plutôt qu'ajouté à un éditeur existant. Il prend en charge le bring-your-own-LLM (BYOL) : vous le connectez à n'importe quel backend de modèle local, et l'agent exécute intégralement la planification, l'édition et l'exécution face à ce modèle, sans dépendance à un fournisseur unique. L'application entière tourne sur votre machine, avec une prise en charge complète du mode hors ligne et air-gap — elle fonctionne donc dans des environnements isolés du réseau où des outils connectés au cloud comme Cursor ou GitHub Copilot ne peuvent pas s'exécuter du tout. Aucun abonnement n'est requis : Bodega One Code est gratuit, et en l'absence de composant cloud, il n'y a ni comptage d'usage ni système de crédits à gérer. Cela en fait un bon choix pour les secteurs réglementés, les prestataires gouvernementaux et de défense, et toute équipe dont la politique de sécurité interdit l'envoi de code vers un serveur tiers — le public même qui recherche l'inférence locale. Par rapport à Cline, qui est un plugin ajouté à VS Code, Bodega One Code est un IDE autonome conçu autour de l'agent dès le départ ; les équipes déjà engagées sur VS Code trouveront en Cline l'ajout le plus simple, tandis que celles qui démarrent de zéro ou ont besoin d'un fonctionnement hors ligne garanti disposent avec Bodega One Code d'un environnement conçu à cet effet.
Continue — Toujours fonctionnel, plus maintenu [Racheté par Cursor, juin 2026 — Version finale v2.0.0]
Continue était le principal assistant de codage IA open-source pour les LLMs locaux avant son rachat par Cursor en juin 2026. Il se connecte à Ollama, LM Studio, llama.cpp et toute API OpenAI-compatible. Fonctionnalités : chat inline (Cmd+L), autocomplétion (Tab), outils du protocole de contexte de modèle (MCP), indexation de codebase et commandes slash personnalisées. L'extension VS Code compte 2M+ installations. Le plugin JetBrains fonctionne dans IntelliJ, PyCharm, GoLand, WebStorm et Rider. Meilleurs modèles locaux : Qwen3-Coder 14B (codage), Llama 3.3 8B (chat). Installation : installer l'extension, définir le provider sur Ollama, choisir un modèle — terminé en 2 minutes. Note (juin 2026) : Continue a été racheté par Cursor. La version 2.0.0 est la dernière publication ; le dépôt GitHub est désormais en lecture seule. L'extension continue de s'installer et de fonctionner pleinement avec Ollama et le BYO-LLM — mais sans développement ultérieur de la part de l'équipe d'origine. Des forks communautaires restent actifs.
Tabby — Meilleure autocomplétion self-hosted
Tabby est un assistant de codage self-hosted qui tourne son propre serveur d'inférence. Il utilise des petits modèles spécialisés (1–3B paramètres) entraînés pour le fill-in-the-middle (FIM) — nettement plus rapide qu'un modèle 7B généraliste. Extensions IDE pour VS Code, JetBrains, Vim/Neovim et Emacs.
Aider — Meilleur outil terminal pour le codage IA
Aider est un pair-programmeur IA en terminal qui s'intègre avec git. Il comprend la structure complète du dépôt, fait des modifications multi-fichiers et commit automatiquement. Fonctionne avec Ollama, LM Studio ou toute API OpenAI-compatible. Gratuit et open-source.
Cursor — Meilleure option commerciale avec support modèles locaux
Cursor est un fork VS Code avec des fonctionnalités IA intégrées. Cursor supporte les modèles locaux via Ollama et LM Studio dans son paramètre "Custom API". Les fonctionnalités les plus puissantes (mode Agent avec recherche web) nécessitent des modèles cloud. Tarifs : Hobby (gratuit) ; Pro à 20 €/mois (inclut 20 € de crédits IA pour modèles frontière ; mode Auto illimité sans coût) ; Pro+ à 60 €/mois ; Ultra à 200 €/mois. Modèles locaux : tier Hobby. Note : Cursor a acquis Supermaven (2024) et Continue.dev (juin 2026) ; SpaceX a annoncé l'acquisition de Cursor pour 60 milliards de dollars en juin 2026 (clôture prévue T3 2026).
Configuration rapide : Cline + Ollama dans VS Code
Le moyen le plus rapide de démarrer le codage local avec le pick n°1 actuel :
- 1Installer Ollama :
curl -fsSL https://ollama.com/install.sh | sh - 2Télécharger un modèle de codage :
ollama pull qwen2.5-coder:14b(ouqwen3-coder:32bpour les tâches agentiques) - 3Dans VS Code, installer Cline depuis le marketplace des extensions
- 4Ouvrir la barre latérale Cline et cliquer sur l'icône des paramètres (engrenage)
- 5Définir le fournisseur API sur "Ollama", l'URL de base sur
http://localhost:11434, et l'ID du modèle sur celui téléchargé - 6Redémarrer VS Code — l'icône Cline apparaît dans la barre latérale
- 7Saisir une tâche dans le panneau de chat Cline — il peut lire/écrire des fichiers et exécuter des commandes terminal directement
Configuration rapide : Aider + Ollama (Terminal)
Pour un codage IA terminal-natif et conscient de git — documentation officielle d'Aider : aider.chat/docs/llms/ollama.html
- 1Installer Ollama et télécharger un modèle :
ollama pull qwen2.5-coder:32b - 2Installer Aider :
python -m pip install aider-install && aider-install - 3Définir la base de l'API Ollama :
export OLLAMA_API_BASE=http://127.0.0.1:11434 - 4Lancer Aider avec le modèle local :
aider --model ollama/qwen2.5-coder:32b - 5Pour la configuration à deux modèles (architecte/éditeur), ajouter
--architect-model ollama/qwen2.5-coder:32b --editor-model ollama/qwen2.5-coder:7b - 6Aider commit automatiquement chaque changement dans git — vérifiez avec
git logougit diff HEAD~1
Meilleurs modèles locaux par plugin et tâche
| Plugin | Meilleur modèle de codage (local) | Meilleur modèle de chat (local) | VRAM min. |
|---|---|---|---|
| Cline | Qwen3-Coder 32B Q4 | Qwen3 32B Q4 | 24 Go |
| Bodega One Code | Tout modèle local (BYOL) | Tout modèle local (BYOL) | Selon le modèle choisi |
| Continue (héritage) | Qwen3-Coder 14B Q8 | Llama 3.3 8B Q4 | 16 Go |
| Tabby | StarCoder2-7B (intégré) | N/A (code uniquement) | 8 Go |
| Aider | Qwen3-Coder 14B (éditeur) | Qwen3-Coder 32B (architecte) | 16–24 Go |
| Cursor | DeepSeek-Coder-V2 (via Ollama) | Qwen3 14B | 16 Go |

Meilleurs plugins LM Studio (ce n'est pas la même chose que les plugins IDE)
C'est une question différente de « quelle extension IDE se connecte à LM Studio » (traitée ci-dessus). LM Studio dispose de son propre système de plugins depuis fin 2024 : les plugins s'exécutent à l'intérieur de LM Studio lui-même — sous forme de code TypeScript ou Python dans un worker sandboxé — et peuvent intercepter les requêtes d'inférence, ajouter des processeurs de prompts, brancher des backends d'appel d'outils, ou ajouter de nouveaux panneaux d'interface. Installez-les depuis la marketplace organisée sur lmstudio.ai/plugins ; chaque plugin déclare au préalable les permissions requises (accès réseau, lecture du système de fichiers), que vous pouvez révoquer ultérieurement depuis les Paramètres sans désinstaller le plugin. Catégories courantes en 2026 : plugins de recherche web, préprocesseurs RAG/récupération de documents, préprocesseurs OCR, plugins de boîte à outils agentique, outils shell/accès fichiers, et plugins de mémoire.
- Plugins de recherche web : permettent à un modèle local dans LM Studio d'intégrer des résultats web en direct à son contexte — utile car les modèles locaux n'ont pas d'accès internet intégré.
- Plugins RAG / documents : indexent un dossier local de PDF ou de fichiers texte et récupèrent automatiquement les extraits pertinents à chaque requête.
- Plugins de boîte à outils agentique : donnent au modèle un accès shell, la lecture/écriture de fichiers, ou l'exécution de tâches multi-étapes directement dans l'interface de chat de LM Studio — la même catégorie de capacité que Cline apporte à VS Code, mais s'exécutant dans LM Studio plutôt qu'un éditeur.
- Plugins de mémoire : conservent le contexte entre les sessions de chat au lieu de repartir de zéro à chaque fois.
Continue peut-il remplacer entièrement GitHub Copilot pour un usage local ?
Depuis juin 2026, Continue a été racheté par Cursor et la version 2.0.0 en est la dernière publication (le dépôt est en lecture seule). L'extension continue de fonctionner avec Ollama et le BYO-LLM, mais ne reçoit plus de développement de l'équipe d'origine. Comme alternative open-source maintenue, Cline est le remplacement recommandé — il offre le même modèle BYOK, fonctionne dans VS Code et JetBrains, et ajoute l'édition de fichiers agentique. GitHub Copilot Pro coûte 10 $/mois avec 15 $/mois de crédits IA ; Cline est gratuit avec votre propre clé API.
Quel plugin est le meilleur pour le refactoring multi-fichiers ?
Cline ou Aider. Les deux lisent plusieurs fichiers, comprennent les dépendances et font des modifications coordonnées. Cline fonctionne dans VS Code (meilleur retour visuel) ; Aider fonctionne dans le terminal (meilleur pour l'intégration CI/CD et les commits git-aware). Pour des modèles 30B+ avec 24 Go de VRAM, Cline avec Qwen3-Coder 32B gère le refactoring complexe de manière fiable.
Tabby fonctionne-t-il sans GPU ?
Oui — Tabby peut tourner sur CPU avec de petits modèles (1–3B). Toutefois, la latence d'autocomplétion sur CPU est de 500 ms à 2 s, ce qui semble lent par rapport à l'objectif de <200 ms pour un codage fluide. Sur des machines sans GPU, Cline + Ollama avec un modèle rapide de 1B ou 3B offre un meilleur contrôle de la latence.
Puis-je utiliser ces plugins avec LM Studio plutôt qu'Ollama ?
Oui. LM Studio expose une API OpenAI-compatible sur le port 1234 par défaut. Définissez le provider du plugin sur "openai" avec l'URL de base http://localhost:1234/v1 et utilisez n'importe quel nom de modèle de votre bibliothèque LM Studio. Cline, Continue et Aider supportent tous cette configuration. Notez que ceci est différent du système de plugins propre à LM Studio (voir la section Plugins LM Studio ci-dessus) — celui-ci sert à étendre LM Studio lui-même, pas à connecter un IDE externe.
Quels IDE JetBrains supportent les plugins LLM locaux ?
Cline et Continue proposent tous deux des plugins JetBrains couvrant l'ensemble de la famille JetBrains : IntelliJ IDEA, PyCharm, PhpStorm, WebStorm, GoLand et Rider. Installez-les depuis le JetBrains Marketplace (et non le VS Code Marketplace) et configurez les mêmes paramètres de fournisseur Ollama/LM Studio que la version VS Code.
Qu'est-ce que Bodega One Code, et en quoi diffère-t-il de Cline ?
Bodega One Code est un IDE IA autonome, gratuit et local-first, avec un agent de codage intégré — contrairement à Cline, qui est un plugin ajouté à VS Code ou JetBrains, Bodega One Code est un IDE complet conçu autour de l'agent dès le départ. Il prend en charge le bring-your-own-LLM (BYOL), ce qui signifie que vous le connectez à n'importe quel backend de modèle local ; il fonctionne entièrement hors ligne avec prise en charge air-gap, et ne nécessite aucun abonnement. Il convient bien aux environnements réglementés ou isolés du réseau où un éditeur connecté au cloud ne peut tout simplement pas être utilisé.
