Skip to main content
PromptQuorum
Startseite/Lokale LLMs Pro/Beste IDE-Plugins für lokale LLMs 2026 (VS Code & JetBrains)
Coding Assistants

Beste IDE-Plugins für lokale LLMs 2026 (VS Code & JetBrains)

··Von Hans Kuepper · Gründer von PromptQuorum, Multi-Model-AI-Dispatch-Tool · PromptQuorum

Cline (VS Code + JetBrains) ist Mitte 2026 das beste kostenlose IDE-Plugin für lokale LLMs: native Verbindung zu Ollama und beliebigen OpenAI-kompatiblen APIs, agentische Datei-Bearbeitung, Terminal-Befehle und MCP-Tools, vollständig auf eigener Hardware. Hinweis: Continue.dev (zuvor Platz 1) wurde im Juni 2026 von Cursor übernommen — Version 2.0.0 ist die letzte Veröffentlichung.

Diese Seite enthält Verweislinks zu Produkten von Drittanbietern. PromptQuorum ist an keinem Partnerprogramm beteiligt — es sind reine Referenzlinks, die keine Provision erzielen. Das Anklicken von Links und Ihre nächsten Schritte liegen in Ihrer eigenen Verantwortung. Diese Links stellen keine Billigung oder Verifizierung durch PromptQuorum dar.

Beste IDE-Plugins für lokale LLMs 2026 (VS Code & JetBrains)

Wichtigste Erkenntnisse

  • Continue.dev wurde von Cursor übernommen (Juni 2026) — v2.0.0 ist die letzte Veröffentlichung, das Repository ist schreibgeschützt; läuft weiterhin mit Ollama, wird aber nicht mehr gepflegt
  • Cline ist jetzt die am besten gepflegte kostenlose BYOK-Alternative: VS Code + JetBrains, agentische Datei-Bearbeitung, MCP-Tools, 5M+ Installs
  • Bodega One Code ist eine kostenlose, lokal-first IDE mit integriertem Coding-Agenten und Bring-your-own-LLM (BYOL) — vollständiger Offline-/Air-Gap-Betrieb, kein Abonnement erforderlich
  • Tabby läuft mit eigenem Inferenz-Server (1–3B-Modelle) — niedrigste Autocomplete-Latenz für Teams
  • Aider ist die Terminal-Option — git-commit-bewusst, Multi-Datei-Umschreibungen, 44K GitHub-Sterne
  • Cursor (20 $/Monat Pro, guthabenbasiert) übernahm sowohl Supermaven als auch Continue.dev; SpaceX einigte sich im Juni 2026 auf eine Übernahme von Cursor für 60 Mrd. USD
  • Alle Tools funktionieren mit Ollama; nur Tabby benötigt einen eigenen Backend-Server

Beste IDE-Plugins für lokale LLMs — Ranking

📍 In einem Satz

Cline ist 2026 das beste IDE-Plugin für lokale LLMs, da es Ollama nativ unterstützt, in VS Code und JetBrains funktioniert und agentische Datei-Bearbeitung sowie MCP-Tools ohne Cloud-Abhängigkeit bietet — Continue, der frühere Spitzenreiter, wurde im Juni 2026 von Cursor übernommen und wird nicht mehr aktiv weiterentwickelt.

💬 In einfachen Worten

Ein IDE-Plugin für lokale LLMs verbindet deinen Code-Editor (VS Code, IntelliJ) mit einem Modell auf deinem eigenen Rechner (über Ollama oder LM Studio). Das Modell sieht deinen Code und antwortet — kein Code verlässt deinen Computer, keine API-Gebühren.

Beste IDE-Plugins für Lokale LLMs, Rangliste -- Rangliste 2026
Beste IDE-Plugins für Lokale LLMs, Rangliste -- Rangliste 2026
1

Cline — Bestes Gesamtpaket (kostenlos, Open-Source, aktiv gepflegt)

Cline (früher Claude Dev) ist 2026 das am besten gepflegte agentische Coding-Plugin für lokale LLMs — es übernahm die Spitzenposition, nachdem Continue im Juni 2026 von Cursor übernommen wurde. Es liest und schreibt Dateien, führt Terminal-Befehle aus, durchsucht das Web (über ein Browser-Tool) und nutzt MCP-Server. Mit Ollama + Qwen3-Coder 32B kann Cline komplette Features aus einem Prompt implementieren. Einschränkungen: 32B-Modelle sind für zuverlässige Multi-Schritt-Agenten nötig; 14B-Modelle reichen für einfache Aufgaben. Preise: kostenlos (BYOK — eigener API-Schlüssel von Anthropic, OpenAI oder 30+ Anbietern); ClinePass für 9,99 $/Monat für verwaltetes Routing ohne eigenen API-Schlüssel; Teams für 20 $/Nutzer/Monat (erste 10 Plätze kostenlos). VS Code und JetBrains (IntelliJ, PyCharm, PhpStorm, WebStorm, GoLand, Rider und mehr). Kompatible Backends: Ollama, LM Studio, LiteLLM-Proxy und 30+ Cloud-Anbieter. 8M+ Entwickler.

2

Bodega One Code — Bestes kostenloses lokal-first IDE mit integriertem Coding-Agenten

Bodega One Code ist eine kostenlose, lokal-first KI-IDE, die von Grund auf um einen Coding-Agenten herum aufgebaut ist — nicht als nachträglich in einen bestehenden Editor eingebauter Assistent. Sie unterstützt Bring-your-own-LLM (BYOL): Nutzer verbinden ein beliebiges lokales Modell-Backend, und der Agent führt Planung, Bearbeitung und Ausführung vollständig gegen dieses Modell aus, ohne Bindung an einen einzelnen Anbieter. Die gesamte Anwendung läuft auf dem eigenen Rechner, inklusive vollständiger Offline- und Air-Gap-Unterstützung — sie funktioniert damit auch in netzwerkisolierten Umgebungen, in denen cloudgebundene Tools wie Cursor oder GitHub Copilot gar nicht einsetzbar sind. Es gibt kein Abonnement: Bodega One Code ist kostenlos nutzbar, und da keine Cloud-Komponente existiert, entfällt auch jede Nutzungsmessung oder Guthabenverwaltung. Das macht es zu einer guten Wahl für regulierte Branchen, Behörden- und Verteidigungsauftragnehmer sowie Teams, deren Sicherheitsrichtlinien das Senden von Code an Server Dritter untersagen — genau die Zielgruppe, die überhaupt lokale Inferenz sucht. Im Vergleich zu Cline, einem Plugin für VS Code, ist Bodega One Code eine eigenständige IDE, die von Anfang an um den Agenten herum entworfen wurde; Teams, die bereits auf VS Code setzen, finden in Cline die einfachere Ergänzung, während Teams, die neu starten oder garantierten Offline-Betrieb benötigen, mit Bodega One Code eine dafür gebaute Umgebung erhalten.

3

Continue — Noch funktionsfähig, aber nicht mehr gepflegt [Von Cursor übernommen, Juni 2026 — Finale Version v2.0.0]

Continue war der führende Open-Source-KI-Coding-Assistent für lokale LLMs vor seiner Übernahme durch Cursor im Juni 2026. Er verbindet sich mit Ollama, LM Studio, llama.cpp und jeder OpenAI-kompatiblen API. Features: Inline-Chat (Cmd+L), Autocomplete (Tab), Model-Context-Protocol(MCP)-Tools, Codebase-Indexierung und benutzerdefinierte Slash-Befehle. VS-Code-Extension hat 2M+ Installs. JetBrains-Plugin läuft in IntelliJ, PyCharm, GoLand, WebStorm und Rider. Beste lokale Modelle: Qwen3-Coder 14B (Coding), Llama 3.3 8B (Chat). Setup: Extension installieren, Provider auf Ollama setzen, Modell wählen — in 2 Minuten erledigt. Hinweis (Juni 2026): Continue wurde von Cursor übernommen. Version 2.0.0 ist die letzte Veröffentlichung; das GitHub-Repository ist nun schreibgeschützt. Die Extension läuft weiterhin vollständig mit Ollama und BYO-LLM — jedoch ohne weitere Entwicklung durch das ursprüngliche Team. Community-Forks sind aktiv.

4

Tabby — Bestes Self-Hosted-Autocomplete

Tabby ist ein Self-Hosted-Coding-Assistent mit eigenem Inferenz-Server. Er nutzt kleine, spezialisierte Code-Completion-Modelle (1–3B Parameter) für Fill-in-the-Middle (FIM) Autocomplete — deutlich schneller als ein allgemeines 7B-Modell. IDE-Erweiterungen für VS Code, JetBrains, Vim/Neovim und Emacs verfügbar.

5

Aider — Bestes Terminal-Tool für KI-Coding

Aider ist ein terminal-basierter KI-Pair-Programmer mit Git-Integration. Er versteht die Struktur des gesamten Repositories, macht Multi-Datei-Änderungen und committed automatisch. Funktioniert mit Ollama (--model ollama/qwen2.5-coder:14b), LM Studio oder jeder OpenAI-kompatiblen API. Kostenlos und Open-Source.

Aider auf GitHub (Open-Source)Produktlink · offengelegt
6

Cursor — Beste kommerzielle Option mit lokalem Modell-Support

Cursor ist ein VS-Code-Fork mit integrierten KI-Funktionen. Cursor unterstützt lokale Modelle über Ollama und LM Studio in der "Custom API"-Einstellung. Die mächtigsten Cursor-Features (Agent-Modus mit Websuche) erfordern aber Cloud-Modelle. Preise: Hobby (kostenlos); Pro 20 €/Monat (beinhaltet 20 € KI-Guthaben für Frontier-Modelle; Auto-Modus unbegrenzt kostenlos); Pro+ 60 €/Monat; Ultra 200 €/Monat. Lokale Modell-Nutzung: Hobby-Tier. Hinweis: Cursor übernahm Supermaven (2024) und Continue.dev (Juni 2026); SpaceX einigten sich im Juni 2026 auf eine Übernahme von Cursor für 60 Mrd. USD (Abschluss erwartet Q3 2026).

Cursor Pro AbonnementProduktlink · offengelegt

Schnellanleitung: Cline + Ollama in VS Code

Der schnellste Weg, um mit dem aktuellen Spitzenreiter lokal zu coden:

  1. 1
    Ollama installieren: curl -fsSL https://ollama.com/install.sh | sh
  2. 2
    Ein Coding-Modell laden: ollama pull qwen2.5-coder:14b (oder qwen3-coder:32b für agentische Aufgaben)
  3. 3
    In VS Code Cline aus dem Extensions-Marketplace installieren
  4. 4
    Die Cline-Seitenleiste öffnen und auf das Zahnrad-Symbol klicken
  5. 5
    API-Provider auf "Ollama" setzen, Basis-URL auf http://localhost:11434 und Modell-ID auf das geladene Modell
  6. 6
    VS Code neu starten — das Cline-Symbol erscheint in der Seitenleiste
  7. 7
    Eine Aufgabe im Cline-Chat-Panel eingeben — es kann direkt Dateien lesen/schreiben und Terminal-Befehle ausführen

Schnellanleitung: Aider + Ollama (Terminal)

Für terminal-natives, git-bewusstes KI-Coding — offizielle Aider-Dokumentation: aider.chat/docs/llms/ollama.html

  1. 1
    Ollama installieren und ein Modell laden: ollama pull qwen2.5-coder:32b
  2. 2
    Aider installieren: python -m pip install aider-install && aider-install
  3. 3
    Die Ollama-API-Basis setzen: export OLLAMA_API_BASE=http://127.0.0.1:11434
  4. 4
    Aider mit dem lokalen Modell starten: aider --model ollama/qwen2.5-coder:32b
  5. 5
    Für das Zwei-Modell-Setup (Architekt/Editor) hinzufügen: --architect-model ollama/qwen2.5-coder:32b --editor-model ollama/qwen2.5-coder:7b
  6. 6
    Aider committed jede Änderung automatisch zu git — mit git log oder git diff HEAD~1 überprüfen

Beste lokale Modelle nach Plugin und Aufgabe

PluginBestes Coding-Modell (lokal)Bestes Chat-Modell (lokal)Min. VRAM
ClineQwen3-Coder 32B Q4Qwen3 32B Q424 GB
Bodega One CodeBeliebiges lokales Modell (BYOL)Beliebiges lokales Modell (BYOL)Abhängig vom gewählten Modell
Continue (Legacy)Qwen3-Coder 14B Q8Llama 3.3 8B Q416 GB
TabbyStarCoder2-7B (integriert)N/A (nur Code)8 GB
AiderQwen3-Coder 14B (Editor)Qwen3-Coder 32B (Architekt)16–24 GB
CursorDeepSeek-Coder-V2 (via Ollama)Qwen3 14B16 GB
Beste Lokale Modelle nach IDE-Plugin -- Coding-Modell und Mindest-VRAM
Beste Lokale Modelle nach IDE-Plugin -- Coding-Modell und Mindest-VRAM

Beste LM-Studio-Plugins (nicht dasselbe wie IDE-Plugins)

Das ist eine andere Frage als "welche IDE-Erweiterung verbindet sich mit LM Studio" (oben behandelt). LM Studio hat seit Ende 2024 ein eigenes Plugin-System: Plugins laufen innerhalb von LM Studio selbst — als TypeScript- oder Python-Code in einem sandboxed Worker — und können Inferenz-Anfragen abfangen, Prompt-Prozessoren hinzufügen, Tool-Calling-Backends anbinden oder neue UI-Panels ergänzen. Installiert werden sie über den kuratierten Marktplatz unter lmstudio.ai/plugins; jedes Plugin gibt vorab die benötigten Berechtigungen an (Netzwerkzugriff, Dateisystem-Lesezugriff), die später jederzeit in den Einstellungen widerrufen werden können, ohne das Plugin zu deinstallieren. Häufige Kategorien im Jahr 2026: Websuche-Plugins, RAG-/Dokumenten-Retrieval-Präprozessoren, OCR-Präprozessoren, agentische Toolset-Plugins, Shell-/Dateizugriffs-Tools und Memory-Plugins.

  • Websuche-Plugins: lassen ein lokales Modell in LM Studio aktuelle Web-Ergebnisse in seinen Kontext einbeziehen — nützlich, da lokale Modelle keinen eingebauten Internetzugang haben.
  • RAG-/Dokumenten-Plugins: indexieren einen lokalen Ordner mit PDFs oder Textdateien und rufen relevante Abschnitte automatisch pro Anfrage ab.
  • Agentische Toolset-Plugins: geben dem Modell Shell-Zugriff, Datei-Lese-/Schreibrechte oder Multi-Schritt-Aufgabenausführung direkt in der Chat-Oberfläche von LM Studio — dieselbe Fähigkeitskategorie, die Cline für VS Code bietet, aber innerhalb von LM Studio statt eines Editors.
  • Memory-Plugins: speichern den Kontext über Chat-Sitzungen hinweg, statt jedes Mal neu zu beginnen.

Kann Continue GitHub Copilot vollständig für lokale Nutzung ersetzen?

Seit Juni 2026 wurde Continue von Cursor übernommen; Version 2.0.0 ist die letzte Veröffentlichung (das Repository ist schreibgeschützt). Die Extension läuft weiterhin mit Ollama und BYO-LLM, erhält aber keine weitere Entwicklung durch das ursprüngliche Team. Als gepflegte Open-Source-Alternative wird Cline empfohlen — es bietet dasselbe BYOK-Modell, funktioniert in VS Code und JetBrains und ergänzt agentische Datei-Bearbeitung. GitHub Copilot Pro kostet 10 $/Monat mit 15 $/Monat an KI-Guthaben; Cline ist mit eigenem API-Schlüssel kostenlos.

Welches Plugin funktioniert am besten für Multi-Datei-Refactoring?

Cline oder Aider. Beide lesen mehrere Dateien, verstehen Abhängigkeiten und machen koordinierte Änderungen. Cline ist besser für visuelle Rückmeldung; Aider besser für Git-bewusstes Committen. Für komplexes Refactoring mit lokalen Modellen werden 30B+ (24 GB VRAM) empfohlen.

Kann ich diese Plugins mit LM Studio statt Ollama nutzen?

Ja. LM Studio stellt standardmäßig eine OpenAI-kompatible API auf Port 1234 bereit. Setze den Plugin-Provider auf "openai" mit Basis-URL http://localhost:1234/v1 und verwende beliebige Modellnamen aus deiner LM-Studio-Bibliothek. Cline, Continue und Aider unterstützen diese Konfiguration alle. Hinweis: Das unterscheidet sich vom eigenen Plugin-System von LM Studio (siehe Abschnitt "Beste LM-Studio-Plugins" oben) — jenes dient der Erweiterung von LM Studio selbst, nicht der Anbindung einer externen IDE.

Welche JetBrains-IDEs unterstützen lokale LLM-Plugins?

Cline und Continue bieten beide JetBrains-Plugins, die die gesamte JetBrains-Familie abdecken: IntelliJ IDEA, PyCharm, PhpStorm, WebStorm, GoLand und Rider. Installation über den JetBrains Marketplace (nicht den VS Code Marketplace), mit denselben Ollama-/LM-Studio-Provider-Einstellungen wie bei der VS-Code-Version.

Was ist Bodega One Code, und wie unterscheidet es sich von Cline?

Bodega One Code ist eine kostenlose, eigenständige lokal-first KI-IDE mit integriertem Coding-Agenten — im Gegensatz zu Cline, das als Plugin zu VS Code oder JetBrains hinzugefügt wird, ist Bodega One Code eine vollständige IDE, die von Anfang an um den Agenten herum aufgebaut ist. Sie unterstützt Bring-your-own-LLM (BYOL), lässt sich also mit einem beliebigen lokalen Modell-Backend verbinden, läuft vollständig offline mit Air-Gap-Unterstützung und erfordert kein Abonnement. Sie eignet sich gut für regulierte oder netzwerkisolierte Umgebungen, in denen ein cloudgebundener Editor gar nicht genutzt werden kann.

← Zurück zu Lokale LLMs Pro