Skip to main content
PromptQuorum
Inicio/LLM locales avanzados/claude-code-local Review 2026: ejecuta Claude Code con un modelo local
Coding Assistants

claude-code-local Review 2026: ejecuta Claude Code con un modelo local

·12 min de lectura·Por Hans Kuepper · Fundador de PromptQuorum, herramienta de despacho multi-modelo · PromptQuorum

claude-code-local (github.com/nicedreamzapp/claude-code-local) es un proyecto gratuito, de código abierto, no oficial y de terceros — no está hecho por Anthropic ni está afiliado ni respaldado oficialmente por Anthropic. Ejecuta un servidor local nativo de MLX en Apple Silicon que imita el formato de la API de Anthropic que espera Claude Code, de modo que puedes apuntar la CLI oficial claude de Anthropic hacia tu propia máquina (mediante ANTHROPIC_BASE_URL) y hacer que un modelo distinto, de peso abierto y alojado localmente —como Gemma, Qwen, Llama o DeepSeek— responda en lugar del modelo Claude alojado en la nube de Anthropic. No ejecuta el propio Claude sin conexión; reutiliza el cliente de Claude Code para comunicarse con un modelo local mediante una interfaz compatible. El proyecto tiene licencia MIT, es gratuito, requiere una Mac con Apple Silicon (M1 o posterior), y está construido y mantenido por un desarrollador independiente, Matt Macosko, sin ninguna empresa ni inversor detrás.

claude-code-local (github.com/nicedreamzapp/claude-code-local) es un proyecto gratuito, de código abierto y no oficial que te permite seguir usando la herramienta de línea de comandos Claude Code de Anthropic mientras un modelo de peso abierto, que se ejecuta localmente en tu propia Mac, responde en lugar de la API en la nube de Anthropic. No está hecho por Anthropic ni está afiliado ni respaldado oficialmente por Anthropic, y no ejecuta el modelo Claude real de Anthropic sin conexión — ejecuta un servidor nativo de MLX que habla el mismo formato de API que espera Claude Code, de modo que la CLI puede redirigirse a un modelo distinto, alojado localmente (Gemma, Qwen, Llama, DeepSeek y otros), mediante una capa de compatibilidad de API. Esta reseña cubre qué hace realmente el proyecto, cómo instalarlo, sus requisitos reales de hardware y dónde se ubica frente a otras configuraciones locales de asistente de programación.

Conclusiones clave

  • Gratuito y de código abierto bajo la licencia MIT
  • Proyecto no oficial y de terceros — no está hecho por Anthropic, ni afiliado a Anthropic, ni respaldado por Anthropic, y no ejecuta el modelo Claude real de Anthropic
  • Ejecuta un servidor nativo de MLX compatible con la API de Anthropic, de modo que la CLI oficial claude puede apuntarse a un modelo local mediante ANTHROPIC_BASE_URL
  • Requiere una Mac con Apple Silicon (M1 o posterior), Python 3.12, y la CLI de Claude Code de Anthropic instalada por separado
  • Soporta varios modelos de peso abierto dimensionados según la memoria unificada de tu Mac, desde Hermes 4 14B en máquinas de 16 GB hasta Qwen 3.5 122B en máquinas de 96 GB o más
  • Una versión v0.1.0 (mayo de 2026) corrigió un error por el que las configuraciones anteriores filtraban telemetría y tráfico en segundo plano a los servidores de Anthropic incluso con una URL base local configurada — verifica que usas una versión actual si tu objetivo es privacidad o uso con air-gap
  • Construido y mantenido por un desarrollador independiente, Matt Macosko, con sede en Arcata, California — sin ninguna empresa ni inversor detrás del proyecto
  • El repositorio de GitHub (github.com/nicedreamzapp/claude-code-local) muestra 3.314 estrellas y 625 forks a septiembre de 2026

📍 En una frase

claude-code-local es un servidor MLX gratuito, de código abierto y no oficial que permite que la CLI de Claude Code de Anthropic funcione con un modelo de peso abierto alojado localmente en Apple Silicon, en lugar del modelo Claude real o la API en la nube de Anthropic.

💬 En términos simples

No pone el modelo Claude de Anthropic en tu computadora. En cambio, hace que tu Mac finja ser la nube de Anthropic, de modo que el comando claude sigue funcionando exactamente como lo conoces, pero es un modelo de IA distinto, de peso abierto, que se ejecuta en tu propio hardware el que responde a tus preguntas — sin cuenta, sin factura por token, y sin que se envíen datos a los servidores de Anthropic para esas solicitudes.

📌Nota: Esta reseña es el análisis en profundidad complementario a la entrada de claude-code-local en el directorio de software de LLM local — consulta esa página para ver cómo se compara, de un vistazo, con docenas de otras herramientas de IA local.

📌Nota: Nota sobre el nombre: "claude-code-local" reutiliza el cliente/CLI Claude Code de Anthropic para comunicarse con un modelo distinto, de peso abierto y alojado localmente. No es un producto de Anthropic, y no hace que el modelo Claude de Anthropic se ejecute sin conexión.

¿Qué es claude-code-local?

claude-code-local es un servidor local, no una app de chat ni un IDE. Se sitúa entre la CLI oficial Claude Code de Anthropic y un modelo de peso abierto que se ejecuta localmente, traduciendo las solicitudes de Claude Code en formato de API de Anthropic a un formato que un modelo local alojado con MLX puede responder, y traduciendo la respuesta de vuelta. Su propia descripción en GitHub la resume como permitir "Run Claude Code 100% on-device with local AI on Apple Silicon" mediante un "MLX-native Anthropic-API server".

  • Función principal: un servidor local compatible con la API de Anthropic (proxy/server.py) hacia el que se puede apuntar Claude Code en lugar de api.anthropic.com, mediante las variables de entorno ANTHROPIC_BASE_URL y ANTHROPIC_API_KEY
  • Motor de inferencia: MLX, el framework de computación con arreglos de Apple para Apple Silicon, mediante el paquete mlx-lm — por eso el proyecto es exclusivo de Mac y requiere un chip serie M
  • Lo que no es: no descarga, ejecuta ni expone de ninguna forma el modelo Claude real de Anthropic. "Claude Code" en el nombre del proyecto se refiere al cliente CLI de Anthropic, que este proyecto reutiliza para comunicarse con un modelo distinto, alojado localmente
  • Desarrollador: un desarrollador independiente, Matt Macosko, con sede en Arcata, California, según el pie del README de GitHub — el README afirma explícitamente "one person, no team, no investors"
  • Repositorio canónico: github.com/nicedreamzapp/claude-code-local — el proyecto original y activo; existe en GitHub un fork con el mismo nombre, jinzaizhichi/claude-code-local, con cero estrellas, que no es un proyecto independiente aparte

Historia del proyecto e hitos de versiones

El repositorio de GitHub se creó el 26 de marzo de 2026. El desarrollo ha sido rápido, pero el proyecto ha mantenido sus etiquetas de versión formales en solo tres versiones hasta ahora, cada una agrupando una corrección o función importante en lugar de etiquetar cada commit.

  1. 1
    v0.1.0 — 8 de mayo de 2026: corrección de la verificación sin conexión y soporte para Mac de 16 GB
    Why it matters: Un colaborador descubrió, mediante `lsof`, que Claude Code 2.1 seguía contactando `api.anthropic.com` al iniciar para telemetría, indicadores de funciones, instalación automática de marketplace y actualizaciones automáticas, incluso con una `ANTHROPIC_BASE_URL` local configurada — lo que significaba que las configuraciones anteriores que seguían el README antiguo no estaban realmente del todo sin conexión. Esta versión lo corrigió desactivando ese tráfico en segundo plano mediante cuatro variables de entorno documentadas, y cambió el modelo predeterminado para Mac de 16 GB (que fallaba con el modelo predeterminado anterior) por uno más pequeño y funcional.
  2. 2
    v0.2.0 — 5 de agosto de 2026: corrección de la exactitud de la caché de prompts
    Why it matters: Corrigió un error por el que la caché de prompts compartida se corrompía después de la primera sesión en un servidor de larga duración, lo que, según las notas de la versión, hacía que sesiones posteriores respondieran con el estado en caché de una conversación anterior y no relacionada. La propia medición de antes/después del proyecto en un servidor de larga duración pasó de 1 respuesta correcta de 8 a 8 de 8 tras la corrección.
  3. 3
    v0.3.0 — 22 de agosto de 2026: lanzamiento del benchmark Agent-12 y soporte de Qwen 3.8 27B en precisión completa
    Why it matters: Introdujo el conjunto de benchmarks de agentes de código abierto propio del desarrollador ("Agent-12") para ayudar a los usuarios a elegir un modelo, y añadió soporte en precisión completa (sin cuantizar) para un modelo de 27B usando decodificación especulativa, con una aceleración reclamada de aproximadamente 3-4x. Estas cifras de rendimiento y benchmark son mediciones autorreportadas por el propio desarrollador — esta reseña no pudo verificarlas de forma independiente, así que trata las cifras concretas como un punto de partida y no como una garantía para tu propio hardware.

¿Qué puedes hacer con claude-code-local?

El conjunto de funciones del proyecto se centra en hacer que Claude Code funcione con un modelo local con la mínima fricción, además de varios modos locales adicionales construidos sobre el mismo servidor subyacente. Esto es lo que hace realmente cada parte, según el propio README de GitHub del proyecto.

  • Claude Code, redirigido localmente — el caso de uso principal: sigue usando la CLI claude exactamente como siempre, pero haz que responda desde un modelo que se ejecuta en tu propia Mac en lugar de la nube de Anthropic
  • Alternativa "keep going" — un comando de shell que te permite continuar una conversación existente de Claude Code con un modelo distinto (un modelo en la nube gratuito de OpenRouter, o uno local) cuando alcanzas el límite de uso propio de Anthropic, sin perder la conversación
  • Modo Native Engine — un agente más ligero integrado en el propio proyecto, ofrecido como alternativa más rápida a dirigir cada solicitud a través del cliente completo de Claude Code
  • Modo Browser Agent — un modo opcional en el que el modelo que se ejecuta localmente puede manejar una ventana de navegador real, documentado por separado en la guía de browser-agent del proyecto
  • Modo de voz — un modo opcional manos libres para hablar con el modelo local y escuchar una respuesta hablada, documentado en la guía de modo de voz del proyecto
  • Control por teléfono — un modo opcional para enviar comandos al servidor alojado en la Mac desde un teléfono, documentado en la guía de control por teléfono del proyecto
  • Aislamiento de tráfico — establece cuatro de las variables de entorno documentadas del propio Claude Code para desactivar llamadas de red en segundo plano no esenciales (telemetría, actualización automática, instalación automática de marketplace, tareas en segundo plano), verificable tú mismo mediante lsof -p $(pgrep -f claude)

Ejemplos de uso: tres formas de usar claude-code-local

Estos son flujos de trabajo concretos construidos a partir de las funciones documentadas del proyecto descritas arriba — no son casos de uso hipotéticos.

Precio y licencia: ¿es realmente gratis?

Sí — claude-code-local en sí es gratuito y de código abierto, bajo la licencia MIT, confirmado mediante la insignia de licencia del repositorio y el archivo LICENSE. No hay suscripción, cuenta ni límite de uso impuesto por el propio proyecto.

  • El servidor, el instalador y los lanzadores son gratuitos y tienen licencia MIT, sin ningún nivel de pago
  • Los modelos locales se ejecutan sin costo por token, usando el hardware y la electricidad de tu propia Mac
  • El proyecto sigue requiriendo la CLI oficial de Claude Code de Anthropic, que es gratuita de instalar; si mantienes o no una suscripción a Anthropic por separado depende de ti y es independiente del uso de este proyecto
  • Una alternativa opcional en la nube "keep going" puede usar modelos de nivel gratuito de OpenRouter con tu propia clave de API gratuita — esto es opcional y no es necesario para el flujo de trabajo local principal

Requisitos de hardware y elección de modelo

Los requisitos de hardware escalan directamente según el modelo que elijas ejecutar, ya que claude-code-local no tiene un mínimo fijo propio más allá de Apple Silicon y macOS. El propio script de configuración del proyecto recomienda un nivel de modelo según la memoria unificada total de tu Mac.

Memoria unificada
Modelo recomendado
16 GB (p. ej., MacBook Air, modelos base)Hermes 4 14B
32-48 GB (nivel Pro)Gemma 4 12B
64-95 GB (nivel Max)Gemma 4 31B
96 GB en adelante (nivel Max/Ultra)Qwen 3.5 122B, con espacio para Llama 3.3 70B y otros en paralelo

El proyecto también documenta varias opciones de modelo adicionales más allá de la recomendación predeterminada por nivel, incluido Qwen 3.8 27B en precisión completa y una compilación autodenominada "abliterated" (con las negativas reducidas) de un modelo de 30B llamado Muse-Glimmer. Una nota sobre los modelos abliterated: el propio README del proyecto señala que estos tienen sus negativas de seguridad integradas reducidas, y afirma claramente que "each model's own license still applies" y que hay que "use them responsibly" — esta es una diferencia de capacidad real frente a un modelo estándar ajustado por instrucciones, y la responsabilidad de cómo uses uno de ellos recae en ti. Las cifras de benchmark y velocidad de modelos concretos a lo largo del README (incluida la tabla de clasificación de Agent-12) son mediciones autorreportadas por el desarrollador, no verificadas de forma independiente por PromptQuorum.

¿Quién debería usar claude-code-local?

Que este proyecto te resulte útil depende de si específicamente quieres mantener el flujo de trabajo de la CLI de Claude Code mientras cambias a un modelo local, y de si tienes el hardware Apple Silicon que requiere.

claude-code-local frente a otras configuraciones locales de asistente de programación

claude-code-local es una de varias formas de obtener asistencia de programación con IA funcionando contra un modelo local en lugar de una API en la nube. Así se ubica junto a otras opciones en ese espacio — consulta el directorio de software de LLM local para ver el catálogo completo.

  • oMLX — un servidor de inferencia MLX de propósito general para Apple Silicon con caché de modelos respaldada por SSD; a diferencia de claude-code-local, no está construido específicamente alrededor del formato de API de Claude Code, pero es la comparación más cercana para quien elija un backend local basado en MLX en una Mac. Consulta la reseña de oMLX.
  • Aider — una herramienta de programación en pareja con IA, basada en terminal y agnóstica de modelo, que funciona con modelos locales mediante cualquier endpoint compatible con OpenAI, integrada con git por diseño; una buena comparación si quieres una CLI de programación construida local-first desde el inicio, en lugar de una capa de compatibilidad frente al cliente de Anthropic. Consulta la reseña de Aider.
  • Cline — un agente de programación autónomo de código abierto, basado en VS Code, que también soporta modelos locales mediante endpoints compatibles con OpenAI; una buena comparación si prefieres un agente integrado en el IDE en lugar de un flujo de trabajo centrado en la terminal. Consulta la reseña de Cline.

Errores comunes al evaluar claude-code-local

La mayor parte de la confusión sobre este proyecto viene de que su nombre sugiere una oferta oficial de Anthropic, o de asumir que cualquier versión es automáticamente sin conexión por completo.

Preguntas frecuentes

¿Qué es claude-code-local?

claude-code-local (github.com/nicedreamzapp/claude-code-local) es un servidor MLX gratuito, de código abierto y no oficial para Mac con Apple Silicon que permite que la CLI de Claude Code de Anthropic se conecte a un modelo de peso abierto que se ejecuta localmente, en lugar de la API en la nube de Anthropic.

¿claude-code-local está hecho por Anthropic?

No. Es un proyecto independiente, de terceros, construido por la comunidad. No está hecho por Anthropic y no está afiliado ni respaldado oficialmente por Anthropic de ninguna forma.

¿claude-code-local ejecuta el modelo Claude real de Anthropic sin conexión?

No. No descarga, aloja ni ejecuta el modelo Claude de Anthropic en absoluto. Ejecuta un modelo distinto, de peso abierto y alojado localmente (como Gemma, Qwen, Llama o DeepSeek), y hace que responda mediante un servidor que habla el mismo formato de API que espera el cliente de Claude Code.

¿Es gratis claude-code-local?

Sí. Es de código abierto bajo la licencia MIT, sin ningún nivel de pago. Sigues necesitando la CLI gratuita de Claude Code de Anthropic instalada como dependencia, pero el proyecto en sí no cobra nada.

¿Qué hardware requiere claude-code-local?

Una Mac con Apple Silicon (M1 o posterior) y Python 3.12, ya que el proyecto ejecuta la inferencia local mediante el framework MLX de Apple. No hay soporte para Windows, Linux ni Mac Intel. Funciona en una Mac de 16 GB, según las propias pruebas del proyecto, y las Mac con más memoria unificada pueden ejecutar modelos más grandes y capaces.

¿claude-code-local mantiene mi código totalmente sin conexión?

Puede hacerlo, pero solo desde la v0.1.0 en adelante. Un error anterior hacía que el propio Claude Code contactara los servidores de Anthropic para telemetría y tareas en segundo plano, incluso con una URL base local configurada; la v0.1.0 (mayo de 2026) lo corrigió desactivando ese tráfico. Verifica tu propia configuración con lsof -p $(pgrep -f claude) en lugar de darlo por hecho.

¿Cómo instalo claude-code-local?

El instalador de un solo comando documentado es curl -fsSL https://raw.githubusercontent.com/nicedreamzapp/claude-code-local/main/install.sh | bash. También está documentada una alternativa manual —clonar el repositorio y ejecutar bash setup.sh después de leerlo— para quien prefiera no canalizar un script remoto directamente hacia bash.

¿Qué modelos puede ejecutar claude-code-local?

El proyecto documenta varios modelos de peso abierto dimensionados según la memoria unificada de tu Mac, desde Hermes 4 14B (16 GB) hasta Qwen 3.5 122B (96 GB en adelante), además de opciones adicionales como Gemma 4, Llama 3.3 70B y una compilación de Qwen 3.8 27B en precisión completa. La elección de modelo y la calidad varían según cuál elijas y tu nivel de hardware.

¿Quién desarrolla claude-code-local?

Está construido y mantenido por un desarrollador independiente, Matt Macosko, con sede en Arcata, California. El propio README del proyecto lo afirma explícitamente: "one person, no team, no investors".

¿Cuándo se lanzó claude-code-local por primera vez?

El repositorio de GitHub se creó el 26 de marzo de 2026. La primera etiqueta de versión formal, v0.1.0, llegó el 8 de mayo de 2026, seguida de v0.2.0 (5 de agosto de 2026) y v0.3.0 (22 de agosto de 2026) — consulta la página oficial de Releases para ver cualquier novedad publicada después de la fecha de esta reseña.

Fuentes

← Volver a LLM locales avanzados