Wichtigste Erkenntnisse
- Continue.dev wurde von Cursor übernommen (Juni 2026) — v2.0.0 ist die letzte Veröffentlichung, das Repository ist schreibgeschützt; läuft weiterhin mit Ollama, wird aber nicht mehr gepflegt
- Cline ist jetzt die am besten gepflegte kostenlose BYOK-Alternative: VS Code + JetBrains, agentische Datei-Bearbeitung, MCP-Tools, 5M+ Installs
- Bodega One Code ist eine kostenlose, lokal-first IDE mit integriertem Coding-Agenten und Bring-your-own-LLM (BYOL) — vollständiger Offline-/Air-Gap-Betrieb, kein Abonnement erforderlich
- Tabby läuft mit eigenem Inferenz-Server (1–3B-Modelle) — niedrigste Autocomplete-Latenz für Teams
- Aider ist die Terminal-Option — git-commit-bewusst, Multi-Datei-Umschreibungen, 44K GitHub-Sterne
- Cursor (20 $/Monat Pro, guthabenbasiert) übernahm sowohl Supermaven als auch Continue.dev; SpaceX einigte sich im Juni 2026 auf eine Übernahme von Cursor für 60 Mrd. USD
- Alle Tools funktionieren mit Ollama; nur Tabby benötigt einen eigenen Backend-Server
Beste IDE-Plugins für lokale LLMs — Ranking
📍 In einem Satz
Cline ist 2026 das beste IDE-Plugin für lokale LLMs, da es Ollama nativ unterstützt, in VS Code und JetBrains funktioniert und agentische Datei-Bearbeitung sowie MCP-Tools ohne Cloud-Abhängigkeit bietet — Continue, der frühere Spitzenreiter, wurde im Juni 2026 von Cursor übernommen und wird nicht mehr aktiv weiterentwickelt.
💬 In einfachen Worten
Ein IDE-Plugin für lokale LLMs verbindet deinen Code-Editor (VS Code, IntelliJ) mit einem Modell auf deinem eigenen Rechner (über Ollama oder LM Studio). Das Modell sieht deinen Code und antwortet — kein Code verlässt deinen Computer, keine API-Gebühren.

Cline — Bestes Gesamtpaket (kostenlos, Open-Source, aktiv gepflegt)
Cline (früher Claude Dev) ist 2026 das am besten gepflegte agentische Coding-Plugin für lokale LLMs — es übernahm die Spitzenposition, nachdem Continue im Juni 2026 von Cursor übernommen wurde. Es liest und schreibt Dateien, führt Terminal-Befehle aus, durchsucht das Web (über ein Browser-Tool) und nutzt MCP-Server. Mit Ollama + Qwen3-Coder 32B kann Cline komplette Features aus einem Prompt implementieren. Einschränkungen: 32B-Modelle sind für zuverlässige Multi-Schritt-Agenten nötig; 14B-Modelle reichen für einfache Aufgaben. Preise: kostenlos (BYOK — eigener API-Schlüssel von Anthropic, OpenAI oder 30+ Anbietern); ClinePass für 9,99 $/Monat für verwaltetes Routing ohne eigenen API-Schlüssel; Teams für 20 $/Nutzer/Monat (erste 10 Plätze kostenlos). VS Code und JetBrains (IntelliJ, PyCharm, PhpStorm, WebStorm, GoLand, Rider und mehr). Kompatible Backends: Ollama, LM Studio, LiteLLM-Proxy und 30+ Cloud-Anbieter. 8M+ Entwickler.
Bodega One Code — Bestes kostenloses lokal-first IDE mit integriertem Coding-Agenten
Bodega One Code ist eine kostenlose, lokal-first KI-IDE, die von Grund auf um einen Coding-Agenten herum aufgebaut ist — nicht als nachträglich in einen bestehenden Editor eingebauter Assistent. Sie unterstützt Bring-your-own-LLM (BYOL): Nutzer verbinden ein beliebiges lokales Modell-Backend, und der Agent führt Planung, Bearbeitung und Ausführung vollständig gegen dieses Modell aus, ohne Bindung an einen einzelnen Anbieter. Die gesamte Anwendung läuft auf dem eigenen Rechner, inklusive vollständiger Offline- und Air-Gap-Unterstützung — sie funktioniert damit auch in netzwerkisolierten Umgebungen, in denen cloudgebundene Tools wie Cursor oder GitHub Copilot gar nicht einsetzbar sind. Es gibt kein Abonnement: Bodega One Code ist kostenlos nutzbar, und da keine Cloud-Komponente existiert, entfällt auch jede Nutzungsmessung oder Guthabenverwaltung. Das macht es zu einer guten Wahl für regulierte Branchen, Behörden- und Verteidigungsauftragnehmer sowie Teams, deren Sicherheitsrichtlinien das Senden von Code an Server Dritter untersagen — genau die Zielgruppe, die überhaupt lokale Inferenz sucht. Im Vergleich zu Cline, einem Plugin für VS Code, ist Bodega One Code eine eigenständige IDE, die von Anfang an um den Agenten herum entworfen wurde; Teams, die bereits auf VS Code setzen, finden in Cline die einfachere Ergänzung, während Teams, die neu starten oder garantierten Offline-Betrieb benötigen, mit Bodega One Code eine dafür gebaute Umgebung erhalten.
Continue — Noch funktionsfähig, aber nicht mehr gepflegt [Von Cursor übernommen, Juni 2026 — Finale Version v2.0.0]
Continue war der führende Open-Source-KI-Coding-Assistent für lokale LLMs vor seiner Übernahme durch Cursor im Juni 2026. Er verbindet sich mit Ollama, LM Studio, llama.cpp und jeder OpenAI-kompatiblen API. Features: Inline-Chat (Cmd+L), Autocomplete (Tab), Model-Context-Protocol(MCP)-Tools, Codebase-Indexierung und benutzerdefinierte Slash-Befehle. VS-Code-Extension hat 2M+ Installs. JetBrains-Plugin läuft in IntelliJ, PyCharm, GoLand, WebStorm und Rider. Beste lokale Modelle: Qwen3-Coder 14B (Coding), Llama 3.3 8B (Chat). Setup: Extension installieren, Provider auf Ollama setzen, Modell wählen — in 2 Minuten erledigt. Hinweis (Juni 2026): Continue wurde von Cursor übernommen. Version 2.0.0 ist die letzte Veröffentlichung; das GitHub-Repository ist nun schreibgeschützt. Die Extension läuft weiterhin vollständig mit Ollama und BYO-LLM — jedoch ohne weitere Entwicklung durch das ursprüngliche Team. Community-Forks sind aktiv.
Tabby — Bestes Self-Hosted-Autocomplete
Tabby ist ein Self-Hosted-Coding-Assistent mit eigenem Inferenz-Server. Er nutzt kleine, spezialisierte Code-Completion-Modelle (1–3B Parameter) für Fill-in-the-Middle (FIM) Autocomplete — deutlich schneller als ein allgemeines 7B-Modell. IDE-Erweiterungen für VS Code, JetBrains, Vim/Neovim und Emacs verfügbar.
Aider — Bestes Terminal-Tool für KI-Coding
Aider ist ein terminal-basierter KI-Pair-Programmer mit Git-Integration. Er versteht die Struktur des gesamten Repositories, macht Multi-Datei-Änderungen und committed automatisch. Funktioniert mit Ollama (--model ollama/qwen2.5-coder:14b), LM Studio oder jeder OpenAI-kompatiblen API. Kostenlos und Open-Source.
Cursor — Beste kommerzielle Option mit lokalem Modell-Support
Cursor ist ein VS-Code-Fork mit integrierten KI-Funktionen. Cursor unterstützt lokale Modelle über Ollama und LM Studio in der "Custom API"-Einstellung. Die mächtigsten Cursor-Features (Agent-Modus mit Websuche) erfordern aber Cloud-Modelle. Preise: Hobby (kostenlos); Pro 20 €/Monat (beinhaltet 20 € KI-Guthaben für Frontier-Modelle; Auto-Modus unbegrenzt kostenlos); Pro+ 60 €/Monat; Ultra 200 €/Monat. Lokale Modell-Nutzung: Hobby-Tier. Hinweis: Cursor übernahm Supermaven (2024) und Continue.dev (Juni 2026); SpaceX einigten sich im Juni 2026 auf eine Übernahme von Cursor für 60 Mrd. USD (Abschluss erwartet Q3 2026).
Schnellanleitung: Cline + Ollama in VS Code
Der schnellste Weg, um mit dem aktuellen Spitzenreiter lokal zu coden:
- 1Ollama installieren:
curl -fsSL https://ollama.com/install.sh | sh - 2Ein Coding-Modell laden:
ollama pull qwen2.5-coder:14b(oderqwen3-coder:32bfür agentische Aufgaben) - 3In VS Code Cline aus dem Extensions-Marketplace installieren
- 4Die Cline-Seitenleiste öffnen und auf das Zahnrad-Symbol klicken
- 5API-Provider auf "Ollama" setzen, Basis-URL auf
http://localhost:11434und Modell-ID auf das geladene Modell - 6VS Code neu starten — das Cline-Symbol erscheint in der Seitenleiste
- 7Eine Aufgabe im Cline-Chat-Panel eingeben — es kann direkt Dateien lesen/schreiben und Terminal-Befehle ausführen
Schnellanleitung: Aider + Ollama (Terminal)
Für terminal-natives, git-bewusstes KI-Coding — offizielle Aider-Dokumentation: aider.chat/docs/llms/ollama.html
- 1Ollama installieren und ein Modell laden:
ollama pull qwen2.5-coder:32b - 2Aider installieren:
python -m pip install aider-install && aider-install - 3Die Ollama-API-Basis setzen:
export OLLAMA_API_BASE=http://127.0.0.1:11434 - 4Aider mit dem lokalen Modell starten:
aider --model ollama/qwen2.5-coder:32b - 5Für das Zwei-Modell-Setup (Architekt/Editor) hinzufügen:
--architect-model ollama/qwen2.5-coder:32b --editor-model ollama/qwen2.5-coder:7b - 6Aider committed jede Änderung automatisch zu git — mit
git logodergit diff HEAD~1überprüfen
Beste lokale Modelle nach Plugin und Aufgabe
| Plugin | Bestes Coding-Modell (lokal) | Bestes Chat-Modell (lokal) | Min. VRAM |
|---|---|---|---|
| Cline | Qwen3-Coder 32B Q4 | Qwen3 32B Q4 | 24 GB |
| Bodega One Code | Beliebiges lokales Modell (BYOL) | Beliebiges lokales Modell (BYOL) | Abhängig vom gewählten Modell |
| Continue (Legacy) | Qwen3-Coder 14B Q8 | Llama 3.3 8B Q4 | 16 GB |
| Tabby | StarCoder2-7B (integriert) | N/A (nur Code) | 8 GB |
| Aider | Qwen3-Coder 14B (Editor) | Qwen3-Coder 32B (Architekt) | 16–24 GB |
| Cursor | DeepSeek-Coder-V2 (via Ollama) | Qwen3 14B | 16 GB |

Beste LM-Studio-Plugins (nicht dasselbe wie IDE-Plugins)
Das ist eine andere Frage als "welche IDE-Erweiterung verbindet sich mit LM Studio" (oben behandelt). LM Studio hat seit Ende 2024 ein eigenes Plugin-System: Plugins laufen innerhalb von LM Studio selbst — als TypeScript- oder Python-Code in einem sandboxed Worker — und können Inferenz-Anfragen abfangen, Prompt-Prozessoren hinzufügen, Tool-Calling-Backends anbinden oder neue UI-Panels ergänzen. Installiert werden sie über den kuratierten Marktplatz unter lmstudio.ai/plugins; jedes Plugin gibt vorab die benötigten Berechtigungen an (Netzwerkzugriff, Dateisystem-Lesezugriff), die später jederzeit in den Einstellungen widerrufen werden können, ohne das Plugin zu deinstallieren. Häufige Kategorien im Jahr 2026: Websuche-Plugins, RAG-/Dokumenten-Retrieval-Präprozessoren, OCR-Präprozessoren, agentische Toolset-Plugins, Shell-/Dateizugriffs-Tools und Memory-Plugins.
- Websuche-Plugins: lassen ein lokales Modell in LM Studio aktuelle Web-Ergebnisse in seinen Kontext einbeziehen — nützlich, da lokale Modelle keinen eingebauten Internetzugang haben.
- RAG-/Dokumenten-Plugins: indexieren einen lokalen Ordner mit PDFs oder Textdateien und rufen relevante Abschnitte automatisch pro Anfrage ab.
- Agentische Toolset-Plugins: geben dem Modell Shell-Zugriff, Datei-Lese-/Schreibrechte oder Multi-Schritt-Aufgabenausführung direkt in der Chat-Oberfläche von LM Studio — dieselbe Fähigkeitskategorie, die Cline für VS Code bietet, aber innerhalb von LM Studio statt eines Editors.
- Memory-Plugins: speichern den Kontext über Chat-Sitzungen hinweg, statt jedes Mal neu zu beginnen.
Kann Continue GitHub Copilot vollständig für lokale Nutzung ersetzen?
Seit Juni 2026 wurde Continue von Cursor übernommen; Version 2.0.0 ist die letzte Veröffentlichung (das Repository ist schreibgeschützt). Die Extension läuft weiterhin mit Ollama und BYO-LLM, erhält aber keine weitere Entwicklung durch das ursprüngliche Team. Als gepflegte Open-Source-Alternative wird Cline empfohlen — es bietet dasselbe BYOK-Modell, funktioniert in VS Code und JetBrains und ergänzt agentische Datei-Bearbeitung. GitHub Copilot Pro kostet 10 $/Monat mit 15 $/Monat an KI-Guthaben; Cline ist mit eigenem API-Schlüssel kostenlos.
Welches Plugin funktioniert am besten für Multi-Datei-Refactoring?
Cline oder Aider. Beide lesen mehrere Dateien, verstehen Abhängigkeiten und machen koordinierte Änderungen. Cline ist besser für visuelle Rückmeldung; Aider besser für Git-bewusstes Committen. Für komplexes Refactoring mit lokalen Modellen werden 30B+ (24 GB VRAM) empfohlen.
Kann ich diese Plugins mit LM Studio statt Ollama nutzen?
Ja. LM Studio stellt standardmäßig eine OpenAI-kompatible API auf Port 1234 bereit. Setze den Plugin-Provider auf "openai" mit Basis-URL http://localhost:1234/v1 und verwende beliebige Modellnamen aus deiner LM-Studio-Bibliothek. Cline, Continue und Aider unterstützen diese Konfiguration alle. Hinweis: Das unterscheidet sich vom eigenen Plugin-System von LM Studio (siehe Abschnitt "Beste LM-Studio-Plugins" oben) — jenes dient der Erweiterung von LM Studio selbst, nicht der Anbindung einer externen IDE.
Welche JetBrains-IDEs unterstützen lokale LLM-Plugins?
Cline und Continue bieten beide JetBrains-Plugins, die die gesamte JetBrains-Familie abdecken: IntelliJ IDEA, PyCharm, PhpStorm, WebStorm, GoLand und Rider. Installation über den JetBrains Marketplace (nicht den VS Code Marketplace), mit denselben Ollama-/LM-Studio-Provider-Einstellungen wie bei der VS-Code-Version.
Was ist Bodega One Code, und wie unterscheidet es sich von Cline?
Bodega One Code ist eine kostenlose, eigenständige lokal-first KI-IDE mit integriertem Coding-Agenten — im Gegensatz zu Cline, das als Plugin zu VS Code oder JetBrains hinzugefügt wird, ist Bodega One Code eine vollständige IDE, die von Anfang an um den Agenten herum aufgebaut ist. Sie unterstützt Bring-your-own-LLM (BYOL), lässt sich also mit einem beliebigen lokalen Modell-Backend verbinden, läuft vollständig offline mit Air-Gap-Unterstützung und erfordert kein Abonnement. Sie eignet sich gut für regulierte oder netzwerkisolierte Umgebungen, in denen ein cloudgebundener Editor gar nicht genutzt werden kann.
