Skip to main content
PromptQuorum
Accueil/LLM locaux avancés/claude-code-local : avis 2026 sur l'exécution de Claude Code en local
Coding Assistants

claude-code-local : avis 2026 sur l'exécution de Claude Code en local

·11 min de lecture·Par Hans Kuepper · Fondateur de PromptQuorum, outil de dispatch multi-modèle · PromptQuorum

claude-code-local (github.com/nicedreamzapp/claude-code-local) est un projet gratuit, open source, non officiel et tiers — il n'est pas réalisé par Anthropic et n'est pas officiellement affilié à Anthropic ni approuvé par Anthropic. Il exécute un serveur natif MLX local sur Apple Silicon qui imite le format d'API Anthropic attendu par Claude Code, ce qui permet de diriger la CLI officielle claude d'Anthropic vers votre propre machine (via ANTHROPIC_BASE_URL) et de faire répondre un modèle ouvert différent, hébergé localement — comme Gemma, Qwen, Llama ou DeepSeek — à la place du modèle Claude hébergé sur le cloud d'Anthropic. Il ne fait pas fonctionner Claude lui-même hors ligne ; il détourne le client Claude Code pour dialoguer avec un modèle local via une interface compatible. Le projet est sous licence MIT, gratuit, nécessite un Mac Apple Silicon (M1 ou plus récent), et est développé et maintenu par un seul développeur indépendant, Matt Macosko, sans entreprise ni investisseur derrière lui.

claude-code-local (github.com/nicedreamzapp/claude-code-local) est un projet gratuit, open source et non officiel qui permet de continuer à utiliser l'outil en ligne de commande Claude Code d'Anthropic tout en faisant répondre un modèle ouvert exécuté localement sur votre Mac, à la place de l'API cloud d'Anthropic. Ce projet n'est pas réalisé par Anthropic, n'est pas officiellement affilié à Anthropic ni approuvé par Anthropic, et il ne fait pas fonctionner le véritable modèle Claude d'Anthropic hors ligne — il exécute un serveur natif MLX qui reproduit le même format d'API attendu par Claude Code, permettant ainsi de rediriger la CLI vers un modèle différent, hébergé localement (Gemma, Qwen, Llama, DeepSeek et d'autres), via une couche de compatibilité API. Cet avis détaille ce que fait réellement le projet, comment l'installer, ses véritables exigences matérielles, et sa place face aux autres configurations d'assistants de codage locaux.

Points clés

  • Gratuit et open source sous licence MIT
  • Projet non officiel et tiers — ni réalisé par, ni affilié à, ni approuvé par Anthropic, et il ne fait pas fonctionner le véritable modèle Claude d'Anthropic
  • Exécute un serveur natif MLX compatible avec l'API Anthropic, permettant de diriger la CLI officielle claude vers un modèle local via ANTHROPIC_BASE_URL
  • Nécessite un Mac Apple Silicon (M1 ou plus récent), Python 3.12, et la CLI Claude Code d'Anthropic installée séparément
  • Prend en charge plusieurs modèles ouverts dimensionnés selon la mémoire unifiée de votre Mac, de Hermes 4 14B sur les machines de 16 Go jusqu'à Qwen 3.5 122B sur celles de 96 Go et plus
  • Une version v0.1.0 (mai 2026) a corrigé un bug où les configurations précédentes laissaient fuir de la télémétrie et du trafic en arrière-plan vers les serveurs d'Anthropic, même avec une URL de base locale configurée — vérifiez que vous êtes sur une version à jour si la confidentialité ou l'usage air-gapped est votre objectif
  • Développé et maintenu par un seul développeur indépendant, Matt Macosko, basé à Arcata, en Californie — aucune entreprise ni investisseur derrière le projet
  • Le dépôt GitHub (github.com/nicedreamzapp/claude-code-local) affiche 3 314 étoiles et 625 forks en septembre 2026

📍 En une phrase

claude-code-local est un serveur MLX gratuit, open source et non officiel qui permet à la CLI Claude Code d'Anthropic de fonctionner avec un modèle ouvert hébergé localement sur Apple Silicon, à la place du véritable modèle Claude ou de l'API cloud d'Anthropic.

💬 En termes simples

Il ne place pas le modèle Claude d'Anthropic sur votre ordinateur. Il fait plutôt en sorte que votre Mac se fasse passer pour le cloud d'Anthropic, de sorte que la commande claude fonctionne exactement comme d'habitude, mais c'est un modèle d'IA ouvert différent, exécuté sur votre propre matériel, qui répond à vos questions — sans compte, sans facturation au jeton, et sans envoi de données aux serveurs d'Anthropic pour ces requêtes.

📌Remarque: Cet avis est le complément approfondi de la fiche de claude-code-local dans le répertoire des logiciels LLM locaux — consultez cette page pour comparer le projet en un coup d'œil à des dizaines d'autres outils d'IA locale.

📌Remarque: Remarque sur le nom : « claude-code-local » détourne le client/CLI Claude Code d'Anthropic pour dialoguer avec un modèle ouvert différent, hébergé localement. Ce n'est pas un produit Anthropic, et cela ne fait pas fonctionner le modèle Claude d'Anthropic hors ligne.

Qu'est-ce que claude-code-local ?

claude-code-local est un serveur local, pas une application de discussion ni un IDE. Il s'intercale entre la CLI officielle Claude Code d'Anthropic et un modèle ouvert exécuté localement, traduisant les requêtes au format API Anthropic de Claude Code vers un format qu'un modèle local hébergé par MLX peut traiter, puis traduisant la réponse en retour. Sa propre description GitHub la résume ainsi : elle permet de « Run Claude Code 100% on-device with local AI on Apple Silicon » via un « MLX-native Anthropic-API server ».

  • Fonction principale : un serveur local compatible avec l'API Anthropic (proxy/server.py) vers lequel Claude Code peut être dirigé à la place de api.anthropic.com, via les variables d'environnement ANTHROPIC_BASE_URL et ANTHROPIC_API_KEY
  • Moteur d'inférence : MLX, le framework de calcul matriciel d'Apple pour Apple Silicon, via le paquet mlx-lm — c'est pourquoi le projet est réservé au Mac et nécessite une puce de la série M
  • Ce que ce n'est pas : le projet ne télécharge, n'exécute ni n'expose d'aucune façon le véritable modèle Claude d'Anthropic. « Claude Code » dans le nom du projet désigne le client CLI d'Anthropic, que ce projet détourne pour dialoguer avec un modèle différent, hébergé localement
  • Développeur : un seul développeur indépendant, Matt Macosko, basé à Arcata, en Californie, selon le pied de page du README GitHub — le README indique explicitement « one person, no team, no investors »
  • Dépôt canonique : github.com/nicedreamzapp/claude-code-local — le projet d'origine, actif ; un fork du même nom, jinzaizhichi/claude-code-local, existe sur GitHub avec zéro étoile et n'est pas un projet indépendant distinct

Historique du projet et jalons de versions

Le dépôt GitHub a été créé le 26 mars 2026. Le développement est rapide, mais le projet n'a encore formellement tagué que trois versions, chacune regroupant un correctif ou une fonctionnalité majeure plutôt que de taguer chaque commit.

  1. 1
    v0.1.0 — 8 mai 2026 : correctif hors ligne vérifié et support des Mac 16 Go
    Why it matters: Un contributeur a découvert via `lsof` que Claude Code 2.1 continuait de contacter `api.anthropic.com` au démarrage pour la télémétrie, les feature flags, l'installation automatique du marketplace et les mises à jour automatiques, même avec une `ANTHROPIC_BASE_URL` locale configurée — ce qui signifie que les configurations précédentes suivant l'ancien README n'étaient en réalité pas entièrement hors ligne. Cette version a corrigé le problème en désactivant ce trafic en arrière-plan via quatre variables d'environnement documentées, et a changé le modèle par défaut pour les Mac 16 Go (qui plantait avec le précédent modèle par défaut) vers un modèle plus petit et fonctionnel.
  2. 2
    v0.2.0 — 5 août 2026 : correction de l'exactitude du cache de prompts
    Why it matters: Correction d'un bug où le cache de prompts partagé se corrompait après la première session sur un serveur longue durée, provoquant, selon les notes de version, des réponses de sessions ultérieures issues du cache d'une conversation précédente et sans rapport. La mesure avant/après du projet lui-même, sur un serveur de longue durée, est passée de 1 bonne réponse sur 8 à 8 sur 8 après le correctif.
  3. 3
    v0.3.0 — 22 août 2026 : lancement du benchmark Agent-12 et support Qwen 3.8 27B en pleine précision
    Why it matters: Introduction de la propre suite de benchmark open source du développeur (« Agent-12 ») pour aider les utilisateurs à choisir un modèle, et ajout du support en pleine précision (non quantifié) pour un modèle de 27B avec décodage spéculatif, pour une accélération revendiquée d'environ 3 à 4 fois. Ces chiffres de performance et de benchmark sont des mesures auto-déclarées par le développeur — cet avis n'a pas pu les vérifier de manière indépendante, il convient donc de considérer les chiffres précis comme un point de départ plutôt qu'une garantie pour votre propre matériel.

Que peut-on faire avec claude-code-local ?

L'ensemble des fonctionnalités du projet vise à faire fonctionner Claude Code avec un modèle local avec un minimum de friction, ainsi que plusieurs modes locaux supplémentaires construits sur le même serveur sous-jacent. Voici ce que chaque élément fait réellement, selon le propre README GitHub du projet.

  • Claude Code, redirigé en local — le cas d'usage principal : continuer à utiliser la CLI claude exactement comme d'habitude, mais en la faisant répondre par un modèle exécuté sur votre propre Mac plutôt que par le cloud d'Anthropic
  • Solution de repli « Keep going » — une commande shell permettant de poursuivre une conversation Claude Code existante avec un modèle différent (un modèle cloud gratuit OpenRouter, ou un modèle local) lorsque vous atteignez la limite d'usage propre à Anthropic, sans perdre la conversation
  • Mode Native Engine — un agent plus léger intégré au projet lui-même, proposé comme alternative plus rapide au routage de chaque requête via le client Claude Code complet
  • Mode Browser Agent — un mode optionnel où le modèle exécuté localement peut piloter une véritable fenêtre de navigateur, documenté séparément dans le guide Browser Agent du projet
  • Mode vocal — un mode optionnel mains libres pour parler au modèle local et entendre une réponse vocale, documenté dans le guide du mode vocal du projet
  • Contrôle depuis un téléphone — un mode optionnel pour envoyer des commandes au serveur hébergé sur le Mac depuis un téléphone, documenté dans le guide de contrôle téléphonique du projet
  • Isolation du trafic — définit quatre variables d'environnement propres à Claude Code et documentées, pour désactiver les appels réseau non essentiels en arrière-plan (télémétrie, mise à jour automatique, installation automatique du marketplace, tâches en arrière-plan), vérifiable soi-même via lsof -p $(pgrep -f claude)

Exemples d'utilisation : trois façons d'utiliser claude-code-local

Voici des scénarios concrets construits à partir des fonctionnalités documentées du projet ci-dessus — pas des cas d'usage hypothétiques.

Tarifs et licence : est-ce vraiment gratuit ?

Oui — claude-code-local lui-même est gratuit et open source, sous licence MIT, confirmée par le badge de licence et le fichier LICENSE du dépôt. Aucun abonnement, compte ou limite d'usage n'est imposé par le projet lui-même.

  • Le serveur, l'installateur et les lanceurs sont gratuits et sous licence MIT, sans offre payante
  • Les modèles locaux fonctionnent sans coût par jeton, en utilisant le matériel et l'électricité de votre propre Mac
  • Le projet nécessite toujours la CLI officielle Claude Code d'Anthropic, gratuite à installer ; le fait de maintenir par ailleurs un abonnement Anthropic vous appartient et est indépendant de l'usage de ce projet
  • Une solution de repli cloud « keep going » optionnelle peut utiliser des modèles OpenRouter du niveau gratuit avec votre propre clé API gratuite — c'est optionnel et non requis pour le workflow local principal

Exigences matérielles et choix de modèles

Les exigences matérielles varient directement selon le modèle choisi, car claude-code-local n'a pas de minimum fixe propre au-delà d'Apple Silicon et macOS. Le propre script de configuration du projet recommande un niveau de modèle selon la mémoire unifiée totale de votre Mac.

Mémoire unifiée
Modèle recommandé
16 Go (ex. MacBook Air, modèles de base)Hermes 4 14B
32–48 Go (niveau Pro)Gemma 4 12B
64–95 Go (niveau Max)Gemma 4 31B
96 Go et plus (niveau Max/Ultra)Qwen 3.5 122B, avec de la marge pour Llama 3.3 70B et d'autres en parallèle

Le projet documente aussi plusieurs options de modèles supplémentaires au-delà de la recommandation par défaut par niveau, dont Qwen 3.8 27B en pleine précision et une version « abliterated » (refus de sécurité réduits), auto-qualifiée ainsi, d'un modèle de 30B nommé Muse-Glimmer. Une remarque sur les modèles « abliterated » : le propre README du projet signale que ces modèles ont leurs refus de sécurité intégrés atténués et indique clairement que « each model's own license still applies » et qu'il faut « use them responsibly » — il s'agit d'une réelle différence de capacité par rapport à un modèle instruit standard, et la responsabilité de l'usage vous incombe. Les chiffres de benchmark et de vitesse pour des modèles spécifiques dans le README (y compris le classement Agent-12) sont des mesures auto-déclarées par le développeur, non vérifiées de manière indépendante par PromptQuorum.

À qui s'adresse claude-code-local ?

La pertinence de ce projet dépend de si vous voulez spécifiquement conserver le workflow de la CLI Claude Code tout en y substituant un modèle local, et de si vous disposez du matériel Apple Silicon requis.

claude-code-local face aux autres configurations d'assistants de codage locaux

claude-code-local est l'une des nombreuses façons de faire fonctionner une assistance IA au codage avec un modèle local plutôt qu'une API cloud. Voici sa place face aux autres options dans ce domaine — consultez le répertoire des logiciels LLM locaux pour le catalogue complet.

  • oMLX — un serveur d'inférence MLX généraliste pour Apple Silicon avec mise en cache de modèles sur SSD ; contrairement à claude-code-local, il n'est pas construit spécifiquement autour du format d'API de Claude Code, mais reste la comparaison la plus proche pour quiconque choisit un backend local basé sur MLX sur Mac. Voir l'avis oMLX.
  • Aider — un outil de programmation en binôme IA en terminal, agnostique du modèle, qui fonctionne avec des modèles locaux via tout point de terminaison compatible OpenAI, intégré à git par conception ; une bonne comparaison si vous voulez une CLI de codage conçue local en premier lieu plutôt qu'une couche de compatibilité devant le client d'Anthropic. Voir l'avis Aider.
  • Cline — un agent de codage autonome open source basé sur VS Code, qui prend aussi en charge les modèles locaux via des points de terminaison compatibles OpenAI ; une bonne comparaison si vous préférez un agent intégré à l'IDE plutôt qu'un workflow centré sur le terminal. Voir l'avis Cline.

Erreurs fréquentes lors de l'évaluation de claude-code-local

La plupart des confusions autour de ce projet viennent de son nom, qui laisse croire à une offre officielle d'Anthropic, ou de l'hypothèse que toute version serait automatiquement entièrement hors ligne.

Questions fréquentes

Qu'est-ce que claude-code-local ?

claude-code-local (github.com/nicedreamzapp/claude-code-local) est un serveur MLX gratuit, open source et non officiel pour Mac Apple Silicon, qui permet à la CLI Claude Code d'Anthropic de se connecter à un modèle ouvert exécuté localement, à la place de l'API cloud d'Anthropic.

claude-code-local est-il réalisé par Anthropic ?

Non. Il s'agit d'un projet indépendant, tiers, construit par la communauté. Il n'est pas réalisé par Anthropic et n'est en aucune façon officiellement affilié à Anthropic ni approuvé par Anthropic.

claude-code-local fait-il fonctionner le véritable modèle Claude d'Anthropic hors ligne ?

Non. Il ne télécharge, n'héberge ni n'exécute en aucune façon le modèle Claude d'Anthropic. Il fait fonctionner un modèle ouvert différent, hébergé localement (comme Gemma, Qwen, Llama ou DeepSeek), et le fait répondre via un serveur qui reproduit le même format d'API attendu par le client Claude Code.

claude-code-local est-il gratuit ?

Oui. Il est open source sous licence MIT, sans offre payante. La CLI gratuite Claude Code d'Anthropic reste nécessaire comme dépendance, mais le projet lui-même ne facture rien.

Quel matériel claude-code-local nécessite-t-il ?

Un Mac Apple Silicon (M1 ou plus récent) et Python 3.12, car le projet exécute l'inférence locale via le framework MLX d'Apple. Il n'existe aucun support Windows, Linux ou Mac Intel. Il fonctionne sur un Mac de 16 Go, selon les propres tests du projet, les Mac à plus grande mémoire unifiée pouvant exécuter des modèles plus grands et plus performants.

claude-code-local garde-t-il mon code entièrement hors ligne ?

Oui, mais seulement à partir de la v0.1.0. Un bug antérieur faisait que Claude Code lui-même contactait les serveurs d'Anthropic pour la télémétrie et des tâches en arrière-plan, même avec une URL de base locale configurée ; la v0.1.0 (mai 2026) a corrigé cela en désactivant ce trafic. Vérifiez votre propre configuration avec lsof -p $(pgrep -f claude) plutôt que de le supposer.

Comment installer claude-code-local ?

L'installateur en une commande documenté est curl -fsSL https://raw.githubusercontent.com/nicedreamzapp/claude-code-local/main/install.sh | bash. Une alternative manuelle — cloner le dépôt et exécuter bash setup.sh après l'avoir lu — est aussi documentée pour ceux qui préfèrent ne pas transmettre directement un script distant à bash.

Quels modèles claude-code-local peut-il exécuter ?

Le projet documente plusieurs modèles ouverts dimensionnés selon la mémoire unifiée de votre Mac, de Hermes 4 14B (16 Go) jusqu'à Qwen 3.5 122B (96 Go et plus), ainsi que d'autres options comme Gemma 4, Llama 3.3 70B et une version Qwen 3.8 27B en pleine précision. Le choix et la qualité du modèle varient selon celui choisi et votre matériel.

Qui développe claude-code-local ?

Le projet est développé et maintenu par un seul développeur indépendant, Matt Macosko, basé à Arcata, en Californie. Le propre README du projet l'indique explicitement : « one person, no team, no investors ».

Quand claude-code-local a-t-il été publié pour la première fois ?

Le dépôt GitHub a été créé le 26 mars 2026. Le premier tag de version formel, v0.1.0, a suivi le 8 mai 2026, avec la v0.2.0 (5 août 2026) et la v0.3.0 (22 août 2026) depuis — consultez la page officielle des Releases pour tout ce qui a été publié depuis la date de publication de cet avis.

Sources

← Retour aux LLM locaux avancés