Skip to main content
PromptQuorum
Startseite/Lokale LLMs Pro/claude-code-local Review 2026: Claude Code auf einem lokalen Modell betreiben
Coding Assistants

claude-code-local Review 2026: Claude Code auf einem lokalen Modell betreiben

·12 Min. Lesezeit·Von Hans Kuepper · Gründer von PromptQuorum, Multi-Model-AI-Dispatch-Tool · PromptQuorum

claude-code-local (github.com/nicedreamzapp/claude-code-local) ist ein kostenloses, quelloffenes, inoffizielles Drittanbieter-Projekt — es ist nicht von Anthropic entwickelt und nicht offiziell mit Anthropic verbunden oder von Anthropic unterstützt. Es betreibt einen lokalen, MLX-nativen Server auf Apple Silicon, der das von Claude Code erwartete Anthropic-API-Format nachbildet, sodass Sie Anthropics offizielle claude-CLI auf Ihren eigenen Rechner verweisen können (über ANTHROPIC_BASE_URL) und ein anderes, lokal gehostetes offenes Modell — etwa Gemma, Qwen, Llama oder DeepSeek — statt Anthropics Cloud-gehostetem Claude-Modell antworten lassen können. Es führt Claude selbst nicht offline aus; es nutzt den Claude-Code-Client um, damit dieser über eine kompatible Schnittstelle mit einem lokalen Modell spricht. Das Projekt steht unter der MIT-Lizenz, ist kostenlos, erfordert einen Mac mit Apple Silicon (M1 oder neuer) und wird von einem einzelnen unabhängigen Entwickler, Matt Macosko, entwickelt und gepflegt — ohne Unternehmen oder Investor im Hintergrund.

claude-code-local (github.com/nicedreamzapp/claude-code-local) ist ein kostenloses, quelloffenes, inoffizielles Projekt, mit dem Sie weiterhin Anthropics Claude-Code-Kommandozeilen-Tool nutzen können, während ein lokal laufendes, offenes Modell auf Ihrem eigenen Mac antwortet — statt Anthropics Cloud-API. Es ist nicht von Anthropic entwickelt, nicht offiziell mit Anthropic verbunden oder von Anthropic unterstützt, und es führt nicht Anthropics tatsächliches Claude-Modell offline aus — es betreibt einen MLX-nativen Server, der dasselbe API-Format spricht, das Claude Code erwartet, sodass die CLI über einen API-kompatiblen Shim auf ein anderes, lokal gehostetes Modell (Gemma, Qwen, Llama, DeepSeek und weitere) umgeleitet werden kann. Diese Review behandelt, was das Projekt tatsächlich leistet, wie Sie es installieren, welche Hardware-Anforderungen wirklich gelten und wo es im Vergleich zu anderen lokalen Coding-Assistant-Setups steht.

Wichtigste Erkenntnisse

  • Kostenlos und quelloffen unter der MIT-Lizenz
  • Inoffizielles Drittanbieter-Projekt — nicht von Anthropic entwickelt, nicht mit Anthropic verbunden oder von Anthropic unterstützt, und es führt nicht Anthropics tatsächliches Claude-Modell aus
  • Betreibt einen MLX-nativen, Anthropic-API-kompatiblen Server, sodass die offizielle claude-CLI über ANTHROPIC_BASE_URL auf ein lokales Modell verwiesen werden kann
  • Erfordert einen Mac mit Apple Silicon (M1 oder neuer), Python 3.12 sowie Anthropics separat installierte Claude-Code-CLI
  • Unterstützt mehrere offene Modelle, dimensioniert nach dem vereinheitlichten Arbeitsspeicher Ihres Macs — von Hermes 4 14B auf 16-GB-Maschinen bis zu Qwen 3.5 122B auf Maschinen mit 96 GB und mehr
  • Ein v0.1.0-Release (Mai 2026) behob einen Fehler, bei dem frühere Setups trotz konfigurierter lokaler Basis-URL weiterhin Telemetrie- und Hintergrundverkehr an Anthropics Server sendeten — prüfen Sie, ob Sie eine aktuelle Version verwenden, falls Datenschutz/Air-Gap-Nutzung Ihr Ziel ist
  • Entwickelt und gepflegt von einem einzelnen unabhängigen Entwickler, Matt Macosko, ansässig in Arcata, Kalifornien — kein Unternehmen oder Investor hinter dem Projekt
  • Das GitHub-Repository (github.com/nicedreamzapp/claude-code-local) zeigt mit Stand September 2026 3.314 Sterne und 625 Forks

📍 In einem Satz

claude-code-local ist ein kostenloser, quelloffener, inoffizieller MLX-Server, mit dem Anthropics Claude-Code-CLI gegen ein lokal gehostetes offenes Modell auf Apple Silicon läuft — statt gegen Anthropics tatsächliches Claude-Modell oder dessen Cloud-API.

💬 In einfachen Worten

Es installiert nicht Anthropics Claude-Modell auf Ihrem Rechner. Stattdessen lässt es Ihren Mac so tun, als wäre er Anthropics Cloud, sodass der claude-Befehl genau wie gewohnt funktioniert — aber ein anderes, offenes KI-Modell, das auf Ihrer eigenen Hardware läuft, beantwortet Ihre Anfragen: kein Konto, keine Abrechnung pro Token und für diese Anfragen werden keine Daten an Anthropics Server gesendet.

📌Hinweis: Diese Review ist der ausführliche Begleittext zum Eintrag von claude-code-local im Local LLM Software Directory — dort finden Sie einen Überblick, wie es im Vergleich zu Dutzenden anderer lokaler KI-Tools abschneidet.

📌Hinweis: Hinweis zur Namensgebung: „claude-code-local" nutzt Anthropics Claude-Code-Client/CLI um, damit dieser mit einem anderen, lokal gehosteten offenen Modell spricht. Es ist kein Anthropic-Produkt und lässt Anthropics Claude-Modell nicht offline laufen.

Was ist claude-code-local?

claude-code-local ist ein lokaler Server, keine Chat-App und keine IDE. Es sitzt zwischen Anthropics offizieller Claude-Code-CLI und einem lokal laufenden offenen Modell, übersetzt die Anfragen von Claude Code im Anthropic-API-Format in ein Format, das ein MLX-gehostetes lokales Modell beantworten kann, und übersetzt die Antwort zurück. Die eigene GitHub-Beschreibung fasst es so zusammen, dass sie es ermöglicht, „Run Claude Code 100% on-device with local AI on Apple Silicon" über einen „MLX-native Anthropic-API server".

  • Kernfunktion: ein Anthropic-API-kompatibler lokaler Server (proxy/server.py), auf den Claude Code statt auf api.anthropic.com verwiesen werden kann, über die Umgebungsvariablen ANTHROPIC_BASE_URL und ANTHROPIC_API_KEY
  • Inferenz-Engine: MLX, Apples Framework für Array-Berechnungen auf Apple Silicon, über das Paket mlx-lm — deshalb ist das Projekt nur für Mac verfügbar und erfordert einen Chip der M-Serie
  • Was es nicht ist: Es lädt, betreibt oder gibt in keiner Weise Zugriff auf Anthropics tatsächliches Claude-Modell. „Claude Code" im Namen des Projekts bezieht sich auf Anthropics CLI-Client, den dieses Projekt umnutzt, damit er mit einem anderen, lokal gehosteten Modell spricht
  • Entwickler: ein einzelner unabhängiger Entwickler, Matt Macosko, ansässig in Arcata, Kalifornien, laut der Fußzeile des GitHub-READMEs — das README stellt ausdrücklich fest: „one person, no team, no investors"
  • Kanonisches Repository: github.com/nicedreamzapp/claude-code-local — das originale, aktive Projekt; ein gleichnamiger Fork, jinzaizhichi/claude-code-local, existiert auf GitHub mit null Sternen und ist kein eigenständiges unabhängiges Projekt

Projektgeschichte und Versions-Meilensteine

Das GitHub-Repository wurde am 26. März 2026 erstellt. Die Entwicklung verlief zügig, doch das Projekt hat seine formalen Versions-Tags bisher auf drei Releases beschränkt, von denen jeder einen bedeutenden Fix oder eine bedeutende Funktion bündelt, statt für jeden Commit einen eigenen Tag zu vergeben.

  1. 1
    v0.1.0 — 8. Mai 2026: Verifizierter Offline-Fix und Unterstützung für 16-GB-Macs
    Why it matters: Ein Mitwirkender stellte über `lsof` fest, dass Claude Code 2.1 beim Start weiterhin `api.anthropic.com` für Telemetrie, Feature-Flags, Marketplace-Auto-Installation und Auto-Updates erreichte — selbst mit gesetzter lokaler `ANTHROPIC_BASE_URL`. Das bedeutet, frühere Setups nach der alten README-Anleitung waren tatsächlich nicht vollständig offline. Dieses Release behob dies, indem es diesen Hintergrundverkehr über vier dokumentierte Umgebungsvariablen deaktivierte, und wechselte das Standardmodell für 16-GB-Macs (das beim vorherigen Standard abgestürzt war) zu einem kleineren, funktionierenden Modell.
  2. 2
    v0.2.0 — 5. August 2026: Korrektur der Prompt-Cache-Korrektheit
    Why it matters: Behob einen Fehler, bei dem der gemeinsam genutzte Prompt-Cache nach der ersten Sitzung auf einem dauerhaft laufenden Server beschädigt wurde — laut den Release Notes führte dies dazu, dass spätere Sitzungen aus dem zwischengespeicherten Zustand eines früheren, unabhängigen Gesprächs antworteten. Die projekteigene Vorher/Nachher-Messung auf einem langlebigen Server verbesserte sich von 1 korrekter Antwort von 8 auf 8 von 8 nach dem Fix.
  3. 3
    v0.3.0 — 22. August 2026: Start des Agent-12-Benchmarks und Unterstützung für Qwen 3.8 27B in voller Präzision
    Why it matters: Führte die eigene, quelloffene Agenten-Benchmark-Suite des Entwicklers („Agent-12") ein, um Nutzern bei der Modellwahl zu helfen, und ergänzte Unterstützung für ein 27B-Modell in voller Präzision (nicht quantisiert) mit spekulativer Dekodierung für eine behauptete Beschleunigung um etwa das 3- bis 4-fache. Diese Leistungs- und Benchmark-Zahlen sind selbst berichtete Messungen des Entwicklers — diese Review konnte sie nicht unabhängig verifizieren, betrachten Sie konkrete Zahlen daher als Ausgangspunkt und nicht als Garantie für Ihre eigene Hardware.

Was können Sie mit claude-code-local tun?

Der Funktionsumfang des Projekts konzentriert sich darauf, Claude Code mit minimaler Reibung gegen ein lokales Modell arbeiten zu lassen, plus mehrere zusätzliche local-first Modi, die auf demselben zugrunde liegenden Server aufbauen. Hier ist, was jeder Teil tatsächlich leistet, laut dem eigenen GitHub-README des Projekts.

  • Claude Code, lokal umgeleitet — der zentrale Anwendungsfall: nutzen Sie die claude-CLI genau wie gewohnt weiter, lassen Sie sie aber von einem Modell antworten, das auf Ihrem eigenen Mac läuft, statt von Anthropics Cloud
  • „Keep going"-Fallback — ein Shell-Befehl, mit dem Sie ein bestehendes Claude-Code-Gespräch mit einem anderen Modell fortsetzen können (einem kostenlosen OpenRouter-Cloud-Modell oder einem lokalen), wenn Sie Anthropics eigenes Nutzungslimit erreichen, ohne das Gespräch zu verlieren
  • Native-Engine-Modus — ein leichtgewichtiger, direkt im Projekt eingebauter Agent, angeboten als schnellere Alternative dazu, jede Anfrage durch den vollständigen Claude-Code-Client zu leiten
  • Browser-Agent-Modus — ein optionaler Modus, in dem das lokal laufende Modell ein echtes Browserfenster steuern kann, separat dokumentiert im Browser-Agent-Guide des Projekts
  • Sprachmodus — ein optionaler freihändiger Modus, um mit dem lokalen Modell zu sprechen und eine gesprochene Antwort zu erhalten, dokumentiert im Sprachmodus-Guide des Projekts
  • Telefonsteuerung — ein optionaler Modus, um Befehle von einem Telefon an den auf dem Mac gehosteten Server zu senden, dokumentiert im Telefonsteuerungs-Guide des Projekts
  • Traffic-Isolation — setzt vier von Claude Codes eigenen dokumentierten Umgebungsvariablen, um nicht wesentliche Hintergrund-Netzwerkaufrufe zu deaktivieren (Telemetrie, Auto-Update, Marketplace-Auto-Installation, Hintergrundaufgaben), selbst überprüfbar über lsof -p $(pgrep -f claude)

Anwendungsbeispiele: Drei Wege, claude-code-local zu nutzen

Dies sind konkrete Workflows, die auf den oben dokumentierten Funktionen des Projekts basieren — keine hypothetischen Anwendungsfälle.

Preise und Lizenzierung: Ist es wirklich kostenlos?

Ja — claude-code-local selbst ist kostenlos und quelloffen, unter der MIT-Lizenz, bestätigt über das Lizenz-Badge und die LICENSE-Datei des Repositorys. Es gibt kein Abonnement, kein Konto und kein vom Projekt selbst auferlegtes Nutzungslimit.

  • Der Server, der Installer und die Launcher sind kostenlos und MIT-lizenziert, ohne kostenpflichtige Stufe
  • Lokale Modelle laufen ohne Kosten pro Token, unter Nutzung der eigenen Mac-Hardware und des eigenen Stroms
  • Das Projekt erfordert weiterhin Anthropics offizielle Claude-Code-CLI, die kostenlos installierbar ist; ob Sie zusätzlich ein Anthropic-Abonnement unterhalten, liegt bei Ihnen und ist unabhängig von der Nutzung dieses Projekts
  • Ein optionaler „Keep going"-Cloud-Fallback kann kostenlose OpenRouter-Modelle mit Ihrem eigenen kostenlosen API-Schlüssel nutzen — dies ist optional und für den zentralen lokalen Workflow nicht erforderlich

Hardware-Anforderungen und Modellwahl

Die Hardware-Anforderungen skalieren direkt mit dem gewählten Modell, da claude-code-local über Apple Silicon und macOS hinaus keine eigene feste Mindestanforderung hat. Das eigene Setup-Skript des Projekts empfiehlt eine Modellstufe basierend auf dem gesamten vereinheitlichten Arbeitsspeicher Ihres Macs.

Vereinheitlichter Arbeitsspeicher
Empfohlenes Modell
16 GB (z. B. MacBook Air, Basismodelle)Hermes 4 14B
32–48 GB (Pro-Stufe)Gemma 4 12B
64–95 GB (Max-Stufe)Gemma 4 31B
96 GB und mehr (Max-/Ultra-Stufe)Qwen 3.5 122B, mit Raum für Llama 3.3 70B und weitere daneben

Das Projekt dokumentiert zusätzlich mehrere weitere Modelloptionen über die Standardempfehlung je Stufe hinaus, darunter Qwen 3.8 27B in voller Präzision und einen selbst beschriebenen „abliterierten" (mit reduzierten Verweigerungen) Build eines 30B-Modells namens Muse-Glimmer. Ein Hinweis zu abliterierten Modellen: Das projekteigene README weist darauf hin, dass bei diesen die eingebauten Sicherheits-Verweigerungen heruntergedreht sind, und stellt ausdrücklich fest, dass „each model's own license still applies" und man sie „responsibly" nutzen solle — das ist ein realer Fähigkeitsunterschied zu einem standardmäßig instruktionsfeinabgestimmten Modell, und die Verantwortung für die Nutzung liegt bei Ihnen. Benchmark- und Geschwindigkeitswerte für einzelne Modelle im gesamten README (einschließlich des Agent-12-Leaderboards) sind selbst berichtete Messungen des Entwicklers, nicht unabhängig von PromptQuorum verifiziert.

Für wen eignet sich claude-code-local?

Ob dieses Projekt zu Ihnen passt, hängt davon ab, ob Sie gezielt den Claude-Code-CLI-Workflow beibehalten und dabei ein lokales Modell einsetzen möchten, und ob Sie über die dafür erforderliche Apple-Silicon-Hardware verfügen.

claude-code-local im Vergleich zu anderen lokalen Coding-Assistant-Setups

claude-code-local ist einer von mehreren Wegen, KI-Coding-Unterstützung gegen ein lokales Modell statt gegen eine Cloud-API laufen zu lassen. Hier sehen Sie, wie es im Vergleich zu anderen Optionen in diesem Bereich steht — den vollständigen Katalog finden Sie im Local LLM Software Directory.

  • oMLX — ein universeller MLX-Inferenzserver für Apple Silicon mit SSD-gestütztem Modell-Caching; anders als claude-code-local nicht speziell um das API-Format von Claude Code herum aufgebaut, aber der nächstliegende Vergleich für alle, die ein MLX-basiertes lokales Backend auf einem Mac wählen. Siehe die oMLX-Review.
  • Aider — ein terminalbasiertes, modellunabhängiges KI-Pair-Programming-Tool, das über jeden OpenAI-kompatiblen Endpunkt mit lokalen Modellen funktioniert und von Haus aus Git-integriert ist; ein guter Vergleich, wenn Sie eine von Anfang an local-first aufgebaute Coding-CLI möchten statt eines Shims vor Anthropics Client. Siehe die Aider-Review.
  • Cline — ein quelloffener, auf VS Code basierender autonomer Coding-Agent, der ebenfalls lokale Modelle über OpenAI-kompatible Endpunkte unterstützt; ein guter Vergleich, wenn Sie einen in die IDE eingebetteten Agenten einem terminal-first-Workflow vorziehen. Siehe die Cline-Review.

Häufige Fehler bei der Bewertung von claude-code-local

Die meiste Verwirrung rund um dieses Projekt entsteht durch seinen Namen, der ein offizielles Anthropic-Angebot suggeriert, oder durch die Annahme, jede Version sei automatisch vollständig offline.

Häufig gestellte Fragen

Was ist claude-code-local?

claude-code-local (github.com/nicedreamzapp/claude-code-local) ist ein kostenloser, quelloffener, inoffizieller MLX-Server für Macs mit Apple Silicon, der Anthropics Claude-Code-CLI erlaubt, sich mit einem lokal laufenden offenen Modell statt mit Anthropics Cloud-API zu verbinden.

Ist claude-code-local von Anthropic entwickelt?

Nein. Es ist ein unabhängiges, community-entwickeltes Drittanbieter-Projekt. Es ist nicht von Anthropic entwickelt und in keiner Weise offiziell mit Anthropic verbunden oder von Anthropic unterstützt.

Führt claude-code-local Anthropics tatsächliches Claude-Modell offline aus?

Nein. Es lädt, hostet oder betreibt Anthropics Claude-Modell überhaupt nicht. Es betreibt ein anderes, lokal gehostetes offenes Modell (etwa Gemma, Qwen, Llama oder DeepSeek) und lässt es über einen Server antworten, der dasselbe API-Format spricht, das der Claude-Code-Client erwartet.

Ist claude-code-local kostenlos?

Ja. Es ist quelloffen unter der MIT-Lizenz, ohne kostenpflichtige Stufe. Anthropics kostenlose Claude-Code-CLI wird weiterhin als Abhängigkeit benötigt, aber das Projekt selbst berechnet nichts.

Welche Hardware benötigt claude-code-local?

Einen Mac mit Apple Silicon (M1 oder neuer) und Python 3.12, da das Projekt lokale Inferenz über Apples MLX-Framework ausführt. Es gibt keine Unterstützung für Windows, Linux oder Intel-Mac. Laut den eigenen Tests des Projekts funktioniert es auf einem 16-GB-Mac, wobei Macs mit größerem vereinheitlichtem Arbeitsspeicher größere, leistungsfähigere Modelle betreiben können.

Bleibt mein Code mit claude-code-local vollständig offline?

Das ist möglich, aber erst ab v0.1.0. Ein früherer Fehler führte dazu, dass Claude Code selbst Anthropics Server für Telemetrie und Hintergrundaufgaben erreichte — selbst mit konfigurierter lokaler Basis-URL; v0.1.0 (Mai 2026) behob dies, indem dieser Verkehr deaktiviert wurde. Verifizieren Sie Ihr eigenes Setup mit lsof -p $(pgrep -f claude), statt es anzunehmen.

Wie installiere ich claude-code-local?

Der dokumentierte Ein-Befehl-Installer lautet curl -fsSL https://raw.githubusercontent.com/nicedreamzapp/claude-code-local/main/install.sh | bash. Eine manuelle Alternative — das Repository klonen und nach dem Lesen bash setup.sh ausführen — ist ebenfalls dokumentiert, für alle, die kein Remote-Skript direkt in bash leiten möchten.

Welche Modelle kann claude-code-local betreiben?

Das Projekt dokumentiert mehrere offene Modelle, dimensioniert nach dem vereinheitlichten Arbeitsspeicher Ihres Macs, von Hermes 4 14B (16 GB) bis zu Qwen 3.5 122B (96 GB und mehr), plus weitere Optionen wie Gemma 4, Llama 3.3 70B und einen Build von Qwen 3.8 27B in voller Präzision. Modellwahl und Qualität variieren je nach gewählter Variante und Hardware.

Wer entwickelt claude-code-local?

Es wird von einem einzelnen unabhängigen Entwickler, Matt Macosko, ansässig in Arcata, Kalifornien, entwickelt und gepflegt. Das projekteigene README stellt es ausdrücklich fest: „one person, no team, no investors".

Wann wurde claude-code-local erstmals veröffentlicht?

Das GitHub-Repository wurde am 26. März 2026 erstellt. Der erste formale Versions-Tag, v0.1.0, folgte am 8. Mai 2026, mit v0.2.0 (5. August 2026) und v0.3.0 (22. August 2026) seitdem — siehe die offizielle Releases-Seite für alles, was nach dem Veröffentlichungsdatum dieser Review erschienen ist.

Muss ich bei der Verwendung von claude-code-local die DSGVO beachten?

Da claude-code-local selbst keine Daten an einen Cloud-Anbieter überträgt — die Anfragen von Claude Code werden an einen lokalen Server auf Ihrem eigenen Mac umgeleitet und dort von einem lokal laufenden offenen Modell beantwortet —, entstehen aus der reinen Nutzung des Projekts keine zusätzlichen DSGVO-Pflichten im Sinne von Art. 28 DSGVO, da kein externer Auftragsverarbeiter beteiligt ist. Das gilt jedoch nur, solange Sie ausschließlich den lokalen Pfad nutzen; sobald Sie den optionalen „Keep going"-Fallback mit einem Cloud-Modell (etwa über OpenRouter) aktivieren, werden Daten an diesen Anbieter übertragen, und dessen eigene Datenschutzbedingungen sind zu prüfen. Der lokale Betrieb selbst entspricht dem Grundgedanken der BSI-Grundschutz-Kataloge zur Datenminimierung, ersetzt aber keine eigene Prüfung, da claude-code-local ein inoffizielles Community-Projekt ohne Herstellergarantie ist.

Ist claude-code-local für den deutschen Mittelstand geeignet?

Für kleine und mittlere Unternehmen mit vorhandener Apple-Silicon-Hardware und bestehender Erfahrung mit Anthropics Claude-Code-CLI kann claude-code-local eine Möglichkeit sein, Coding-Unterstützung ohne laufende API-Kosten oder mit strengeren Anforderungen an Datenlokalität zu testen. Da es sich um ein von einer einzelnen Person gepflegtes, inoffizielles Projekt ohne SLA oder Hersteller-Support handelt, sollten Mittelstandsunternehmen mit hohen Anforderungen an IT-Sicherheit (etwa nach BSI-Grundschutz) den Community-Support-Charakter, die Installation über ein Shell-Skript und die fehlende Anthropic-Affiliation vor einem produktiven Einsatz sorgfältig gegen die eigenen Compliance- und Verfügbarkeitsanforderungen abwägen.

Quellen

← Zurück zu Lokale LLMs Pro