Skip to main content
PromptQuorum
主页/本地LLM进阶/claude-code-local 评测 2026:在本地模型上运行 Claude Code
Coding Assistants

claude-code-local 评测 2026:在本地模型上运行 Claude Code

·阅读约12分钟·Hans Kuepper 作者 · PromptQuorum创始人,多模型AI调度工具 · PromptQuorum

claude-code-local(github.com/nicedreamzapp/claude-code-local)是一个免费、开源、非官方的第三方项目——它并非由 Anthropic 制作,也未获得 Anthropic 的官方关联或认可。 它在 Apple Silicon 上运行一个本地的 MLX 原生服务器,模拟 Claude Code 所需的 Anthropic API 格式,因此你可以让 Anthropic 官方的 claude CLI 指向自己的机器(通过 ANTHROPIC_BASE_URL),并让另一个本地托管的开源权重模型——例如 Gemma、Qwen、Llama 或 DeepSeek——来回答,而不是由 Anthropic 云端托管的 Claude 模型回答。它并不会让 Claude 本身离线运行;它是把 Claude Code 客户端重新利用,通过一个兼容接口与本地模型对话。该项目采用 MIT 许可证,免费使用,需要一台配备 Apple Silicon(M1 或更新型号)的 Mac,由独立开发者 Matt Macosko 一人构建和维护,背后没有公司或投资方。

claude-code-local(github.com/nicedreamzapp/claude-code-local)是一个免费、开源、非官方的项目,让你可以继续使用 Anthropic 的 Claude Code 命令行工具,同时让运行在你自己 Mac 上的本地开源权重模型来回答,而不是使用 Anthropic 的云端 API。它并非由 Anthropic 制作,也未获得 Anthropic 的官方关联或认可,并且不会让 Anthropic 真正的 Claude 模型离线运行——它运行的是一个 MLX 原生服务器,模拟 Claude Code 所需的相同 API 格式,从而使该 CLI 可以通过一个 API 兼容的适配层,被重定向到另一个本地托管的模型(Gemma、Qwen、Llama、DeepSeek 等)。本评测介绍该项目的实际功能、安装方法、真实硬件需求,以及它在其他本地编程助手方案中的定位。

关键要点

  • MIT 许可证下免费开源
  • 非官方第三方项目——并非由 Anthropic 制作、关联或认可,也不会运行 Anthropic 真正的 Claude 模型
  • 运行一个 MLX 原生、与 Anthropic API 兼容的服务器,使官方 claude CLI 可以通过 ANTHROPIC_BASE_URL 指向本地模型
  • 需要一台配备 Apple Silicon(M1 或更新型号)的 Mac、Python 3.12,以及单独安装的 Anthropic Claude Code CLI
  • 支持多款按 Mac 统一内存大小分级的开源权重模型,从 16 GB 机型上的 Hermes 4 14B,到 96 GB 及以上机型上的 Qwen 3.5 122B
  • v0.1.0 版本(2026 年 5 月)修复了一个漏洞:此前即使配置了本地 base URL,早期的设置仍会向 Anthropic 服务器泄露遥测和后台流量——如果你的目标是隐私保护或 air-gap(物理隔离)使用,请确认自己使用的是当前版本
  • 由独立开发者 Matt Macosko 一人构建和维护,常驻美国加州阿凯塔(Arcata)——项目背后没有公司或投资方
  • GitHub 仓库(github.com/nicedreamzapp/claude-code-local)截至 2026 年 9 月显示 3,314 颗星和 625 次分叉

📍 简单一句话

claude-code-local 是一个免费、开源、非官方的 MLX 服务器,可以让 Anthropic 的 Claude Code CLI 在 Apple Silicon 上运行本地托管的开源权重模型,而不是 Anthropic 真正的 Claude 模型或云端 API。

💬 简单来说

它不会把 Anthropic 的 Claude 模型装进你的电脑。相反,它让你的 Mac"假装"成 Anthropic 的云端,使 claude 命令的使用方式和以前完全一样,但实际回答问题的是另一个运行在你自己硬件上的开源权重 AI 模型——无需账户、没有按次计费,这些请求也不会发送到 Anthropic 的服务器。

📌: 本评测是 claude-code-local 在本地 LLM 软件目录条目的深度补充版——该页面展示了它与数十款其他本地 AI 工具的横向对比。

📌: 命名说明:"claude-code-local"重新利用了 Anthropic 的 Claude Code 客户端/CLI,使其与另一个本地托管的开源权重模型对话。它不是 Anthropic 的产品,也不会让 Anthropic 的 Claude 模型离线运行。

claude-code-local 是什么?

claude-code-local 是一个本地服务器,而不是聊天应用或 IDE。 它位于 Anthropic 官方 Claude Code CLI 与本地运行的开源权重模型之间,把 Claude Code 发出的 Anthropic API 格式请求,转换成一个由 MLX 托管的本地模型能够理解的格式,并把回答转换回来。其 GitHub 项目介绍 将其概括为通过"MLX 原生 Anthropic API 服务器",让你"在 Apple Silicon 上百分之百在设备端运行 Claude Code 和本地 AI"。

  • 核心功能:一个与 Anthropic API 兼容的本地服务器(proxy/server.py),可以让 Claude Code 通过 ANTHROPIC_BASE_URLANTHROPIC_API_KEY 环境变量指向它,而不是指向 api.anthropic.com
  • 推理引擎MLX,Apple 面向 Apple Silicon 的数组计算框架,通过 mlx-lm 软件包实现——这也是该项目仅支持 Mac、且需要 M 系列芯片的原因
  • 它不是什么:它不会下载、运行或以任何方式暴露 Anthropic 真正的 Claude 模型。项目名称中的"Claude Code"指的是 Anthropic 的 CLI 客户端,该项目只是把这个客户端重新利用,使其与另一个本地托管的模型对话
  • 开发者:独立开发者 Matt Macosko 一人,常驻美国加州阿凯塔(Arcata),据 GitHub README 的页脚说明——README 中明确写道"一个人,没有团队,没有投资方"
  • 规范仓库github.com/nicedreamzapp/claude-code-local——原始且活跃维护的项目;GitHub 上还存在一个同名分支 jinzaizhichi/claude-code-local,星标数为零,并非独立的项目

项目历史与版本里程碑

该 GitHub 仓库创建于 2026 年 3 月 26 日。项目开发节奏很快,但截至目前正式打上版本标记的发布只有三次,每次都对应一项重要修复或功能,而不是为每次提交都打标记。

  1. 1
    v0.1.0 — 2026年5月8日:离线验证修复与 16 GB Mac 支持
    Why it matters: 一位贡献者通过 `lsof` 发现,即使配置了本地 `ANTHROPIC_BASE_URL`,Claude Code 2.1 在启动时仍会因遥测、功能开关、应用市场自动安装和自动更新等原因访问 `api.anthropic.com`——这意味着按照旧版 README 搭建的早期配置实际上并未完全离线。此版本通过四个明确记录的环境变量禁用了这些后台流量来修复该问题,并将 16 GB Mac(此前用默认模型会崩溃)的默认模型换成了一个更小、可正常运行的模型。
  2. 2
    v0.2.0 — 2026年8月5日:提示缓存正确性修复
    Why it matters: 根据发布说明,此版本修复了一个漏洞:在长时间运行的服务器上,共享的提示缓存在第一次会话后会被破坏,导致后续会话根据之前无关对话的缓存状态作答。该项目自己在一台长期运行的服务器上做的修复前后对比测试显示,正确率从 8 次中 1 次正确提升到修复后的 8 次全部正确。
  3. 3
    v0.3.0 — 2026年8月22日:Agent-12 基准测试上线,并支持全精度 Qwen 3.8 27B
    Why it matters: 引入了开发者自制的开源智能体基准测试套件("Agent-12"),帮助用户选择模型,并借助推测解码(speculative decoding)为一款 27B 模型增加了全精度(非量化)支持,据称速度可提升约 3-4 倍。这些性能和基准数据均为开发者自行测量并公布的结果——本评测无法独立核实,请将具体数字视为参考起点,而非你自己硬件上的性能保证。

用 claude-code-local 能做什么?

该项目的功能集中在以最小摩擦让 Claude Code 对接本地模型,此外基于同一底层服务器还提供了若干额外的本地优先模式。以下是根据该项目自己的 GitHub README 整理的各部分实际作用。

  • Claude Code 本地重定向——核心使用场景:照常使用 claude CLI,但让它由运行在你自己 Mac 上的模型作答,而不是 Anthropic 云端
  • "继续对话"回退机制——一条 shell 命令,可以在你达到 Anthropic 自身的使用限额时,用另一个模型(免费的 OpenRouter 云端模型,或本地模型)继续现有的 Claude Code 对话,而不会丢失上下文
  • 原生引擎模式(Native Engine mode)——该项目内置的一个更轻量的智能体,作为将每个请求都通过完整 Claude Code 客户端路由的更快替代方案
  • 浏览器智能体模式(Browser Agent mode)——一个可选模式,让本地运行的模型可以操控真实的浏览器窗口,该项目在独立的浏览器智能体指南中另行说明
  • 语音模式(Voice mode)——一个可选的免手动模式,可以对本地模型说话并听到语音回答,该项目在其语音模式指南中另行说明
  • 手机控制(Phone control)——一个可选模式,可以从手机向 Mac 上托管的服务器发送指令,该项目在其手机控制指南中另行说明
  • 流量隔离——设置 Claude Code 自身记录在案的四个环境变量,禁用非必要的后台网络请求(遥测、自动更新、应用市场自动安装、后台任务),你可以通过 lsof -p $(pgrep -f claude) 自行验证

使用示例:三种使用 claude-code-local 的方式

以下是基于该项目上文所述已有功能构建的具体工作流程,而非假设性的使用场景。

价格与许可:真的免费吗?

是的——claude-code-local 本身免费且开源,采用 MIT 许可证,已通过仓库的许可证徽章和 LICENSE 文件核实。该项目本身不设订阅、账户或使用限制。

  • 服务器、安装程序和启动器均免费,采用 MIT 许可证,没有付费层级
  • 本地模型运行没有单次调用成本,只需使用你自己 Mac 的硬件和电力
  • 该项目仍需要安装 Anthropic 官方的 Claude Code CLI,该 CLI 本身可免费安装;你是否单独维持 Anthropic 订阅由你自行决定,与使用本项目无关
  • 一个可选的"继续对话"云端回退功能可以用你自己的免费 API 密钥调用 OpenRouter 的免费层级模型——这是可选功能,核心的本地工作流并不需要它

硬件需求与模型选择

硬件需求直接取决于你选择运行哪个模型,因为除了要求 Apple Silicon 和 macOS 之外,claude-code-local 本身没有固定的最低硬件门槛。该项目自带的安装脚本会根据你 Mac 的统一内存总量推荐一个模型档位。

统一内存
推荐模型
16 GB(例如 MacBook Air 基础型号)Hermes 4 14B
32–48 GB(Pro 档位)Gemma 4 12B
64–95 GB(Max 档位)Gemma 4 31B
96 GB 及以上(Max/Ultra 档位)Qwen 3.5 122B,同时还有余量运行 Llama 3.3 70B 等其他模型

该项目还在默认档位推荐之外记录了若干额外的模型选项,包括全精度的 Qwen 3.8 27B,以及一个自称为"abliterated"(削弱拒答倾向)的 30B 模型 Muse-Glimmer 构建版本。关于 abliterated 模型的说明: 该项目自己的 README 指出,这类模型内置的安全拒答机制被调低了,并明确写道"各模型自身的许可证依然适用",并提醒用户"负责任地使用"——这与标准的指令微调模型相比是一项真实的能力差异,如何使用这类模型的责任在于用户本人。README 全文中(包括 Agent-12 排行榜)针对具体模型给出的基准测试和速度数据,均为开发者自行测量并公布的结果,未经 PromptQuorum 独立核实。

谁适合使用 claude-code-local?

这个项目是否适合你,取决于你是否特别希望在换用本地模型的同时,保留 Claude Code CLI 的工作流程,以及你是否具备它所需的 Apple Silicon 硬件。

claude-code-local 与其他本地编程助手方案对比

claude-code-local 是让 AI 编程辅助功能在本地模型而非云端 API 上运行的多种方式之一。以下是它与该领域其他选项的对比情况——完整目录请参见本地 LLM 软件目录

  • oMLX——一款通用的 Apple Silicon MLX 推理服务器,带有基于 SSD 的模型缓存;与 claude-code-local 不同,它并非专门围绕 Claude Code 的 API 格式构建,但对于想在 Mac 上选择基于 MLX 的本地后端的用户来说,它是最接近的对比对象。参见 oMLX 评测
  • Aider——一款基于终端、与模型无关的 AI 结对编程工具,可通过任意 OpenAI 兼容端点使用本地模型,并从设计上集成了 git;如果你想要一款从一开始就以本地优先构建的编程 CLI,而不是套在 Anthropic 客户端外面的适配层,它是很好的对比对象。参见 Aider 评测
  • Cline——一款开源、基于 VS Code 的自主编程智能体,同样支持通过 OpenAI 兼容端点使用本地模型;如果你更喜欢嵌入 IDE 的智能体,而不是以终端为先的工作流,它是很好的对比对象。参见 Cline 评测

评估 claude-code-local 时的常见误区

关于该项目的大多数困惑,都源于它的名称容易让人误以为是 Anthropic 官方产品,或是误以为任何版本都自动完全离线。

常见问题

claude-code-local 是什么?

claude-code-local(github.com/nicedreamzapp/claude-code-local)是一个面向 Apple Silicon Mac 的免费、开源、非官方 MLX 服务器,可以让 Anthropic 的 Claude Code CLI 连接到本地运行的开源权重模型,而不是 Anthropic 的云端 API。

claude-code-local 是 Anthropic 制作的吗?

不是。它是一个独立的第三方社区项目。它并非由 Anthropic 制作,也未以任何方式获得 Anthropic 的官方关联或认可。

claude-code-local 会让 Anthropic 真正的 Claude 离线运行吗?

不会。它完全不会下载、托管或运行 Anthropic 的 Claude 模型。它运行的是另一个本地托管的开源权重模型(例如 Gemma、Qwen、Llama 或 DeepSeek),并通过一个模拟 Claude Code 客户端所需 API 格式的服务器,让该模型来作答。

claude-code-local 免费吗?

是的。它在 MIT 许可证下开源,没有付费层级。你仍需要安装 Anthropic 免费的 Claude Code CLI 作为依赖项,但该项目本身不收取任何费用。

claude-code-local 需要什么硬件?

一台配备 Apple Silicon(M1 或更新型号)的 Mac,以及 Python 3.12,因为该项目通过 Apple 的 MLX 框架运行本地推理。不支持 Windows、Linux 或 Intel Mac。根据该项目自己的测试,它可以在 16 GB 的 Mac 上运行,统一内存更大的 Mac 则可以运行更大、能力更强的模型。

claude-code-local 能让我的代码完全离线吗?

可以,但仅限于 v0.1.0 及之后的版本。此前的一个漏洞导致即使配置了本地 base URL,Claude Code 本身仍会因遥测和后台任务访问 Anthropic 的服务器;v0.1.0(2026 年 5 月)通过禁用这些流量修复了该问题。请用 lsof -p $(pgrep -f claude) 自行验证你的配置,而不要想当然地认为如此。

如何安装 claude-code-local?

文档记录的一键安装命令是 curl -fsSL https://raw.githubusercontent.com/nicedreamzapp/claude-code-local/main/install.sh | bash。对于不想直接把远程脚本传给 bash 的用户,也提供了一种手动替代方式——克隆仓库,先阅读后再运行 bash setup.sh

claude-code-local 可以运行哪些模型?

该项目记录了多款按 Mac 统一内存分级的开源权重模型,从 Hermes 4 14B(16 GB)到 Qwen 3.5 122B(96 GB 及以上),此外还有 Gemma 4、Llama 3.3 70B,以及全精度的 Qwen 3.8 27B 构建版本等其他选项。模型选择和质量会因你所选模型和硬件档位而异。

谁开发了 claude-code-local?

它由独立开发者 Matt Macosko 一人构建和维护,常驻美国加州阿凯塔(Arcata)。该项目的 README 明确写道:"一个人,没有团队,没有投资方。"

claude-code-local 何时首次发布?

该 GitHub 仓库创建于 2026 年 3 月 26 日。首个正式版本标记 v0.1.0 于 2026 年 5 月 8 日发布,此后又发布了 v0.2.0(2026 年 8 月 5 日)和 v0.3.0(2026 年 8 月 22 日)——如需了解本评测发布日期之后的任何更新,请查看官方 Releases 页面

Sources

← 返回 本地LLM进阶