Skip to main content
PromptQuorumBuilt for humans. Structured for AI.
主页/本地LLM进阶/2026年本地LLM最佳IDE插件推荐(VS Code、JetBrains与LM Studio)
Coding Assistants

2026年本地LLM最佳IDE插件推荐(VS Code、JetBrains与LM Studio)

··Hans Kuepper 作者 · PromptQuorum创始人 · 开放权重与开源AI发现引擎

Cline(VS Code + JetBrains)是2026年本地LLM最佳免费IDE:原生连接Ollama和LM Studio(以及任何OpenAI兼容API),支持智能体文件编辑、终端命令和MCP工具,完全在本地硬件上运行。注意:此前排名第1的Continue.dev已于2026年6月被Cursor收购——v2.0.0-vscode是其最终版本,仓库现为只读状态。

本页包含指向第三方产品的参考链接。PromptQuorum 未加入任何联盟计划——这些是不产生佣金的普通链接。点击链接和后续步骤由您自行承担责任。这些链接不代表 PromptQuorum 的任何认可或验证。

2026年本地LLM最佳IDE插件推荐(VS Code、JetBrains与LM Studio)

关键要点

  • Continue.dev于2026年6月被Cursor收购——v2.0.0-vscode为最终版本,仓库现为只读状态,云端数据已于2026年7月15日后删除;仍可在本地与Ollama配合运行,但已不再维护
  • Cline目前是维护最完善的免费BYOK替代方案:VS Code + 整个JetBrains系列(PyCharm、Rider、CLion、GoLand、WebStorm、RustRover),智能体文件编辑,MCP工具,安装量超500万
  • Bodega One Code是一款个人使用免费的本地优先独立IDE,内置编程智能体并支持BYOL(自带LLM)——完整离线/物理隔离运行,无强制订阅
  • Tabby运行自有推理服务器(1–3B模型)——为团队提供延迟最低的代码补全,基于Apache 2.0自托管
  • Aider是终端优先选项——git提交感知,多文件重写,GitHub星标4.4万以上
  • Cursor(免费Hobby / Pro $20 / Pro+ $60 / Ultra $200每月)已收购Supermaven和Continue.dev;SpaceX已于2026年8月完成以600亿美元收购Cursor
  • 所有工具均可针对本地后端(Ollama、LM Studio或自托管服务器)完全离线运行;只有Cursor即便使用本地模型也需要连接云端的应用程序

六款插件一览对比

这里的每款插件都能连接本地模型——区别在于你做的是哪类编程工作,以及你希望围绕它拥有多大的商业生态。

插件
最适合
本地后端
价格
获取方式
Cline大多数用户/智能体任务Ollama、LM Studio、30+ API免费(BYOK)/起价$9.99/月免费安装 →
Bodega One Code离线/物理隔离/合规Ollama、LM Studio、llama.cpp等10+免费(个人)/一次性$39免费试用 →
Continue(旧版)仅限现有Continue用户Ollama、LM Studio、llama.cpp免费(已停止维护)Continue.dev →
Tabby最快的自托管代码补全自有推理服务器(1–3B)免费、开源免费自托管 →
Aider终端+git工作流Ollama、LM Studio、OpenAI兼容免费、开源免费安装 →
Cursor精致IDE,云端+本地混合Ollama、LM Studio(Custom API)免费Hobby/$20–$200/月免费开始 →

如果你还没有运行任何本地模型,可以先跳过这六款——先选定硬件和后端(Ollama或LM Studio),再回到这张表。上面每个链接都是普通产品链接,目前没有联盟合作关系——详见本页顶部的披露说明。

从Cline开始:接下来2分钟内完成安装

Cline是本页的默认推荐。以下是原因,以及现在就安装它的方法。

  • 免费开源 — 自带密钥或指向本地端点,无强制订阅(起价$9.99/月的ClinePass是可选项,用于无需自有API密钥的托管路由)。
  • 支持VS Code和整个JetBrains系列 — IntelliJ IDEA、PyCharm、WebStorm、PhpStorm、GoLand、Rider、CLion、RustRover、RubyMine和DataGrip。
  • 原生连接Ollama和LM Studio — 另支持30多家OpenAI兼容提供商,无需依赖云端。
  • 真正的智能体能力 — 读写文件、执行终端命令、使用MCP工具,而不仅仅是内联代码补全。
  • 限制:可靠的多步骤智能体任务需要32B级本地模型(24 GB以上显存);14B模型能处理简单编辑,但在复杂的多文件重构上表现吃力。

应该选择哪一款?

把你的优先需求对应到某款插件——这六款插件的详细内容都在本页更下方。

  • 最简单,今天就要用起来 → Cline — 免费、智能体能力、VS Code + JetBrains。
  • 完全离线、物理隔离或有合规要求 → Bodega One Code — 完全没有云端组件的独立IDE。
  • 团队最快的自托管代码补全 → Tabby — 自有推理服务器,200毫秒以内的补全。
  • 终端优先、git感知的工作流 → Aider — 多文件编辑,自动提交。
  • 想要精致的商业IDE,偶尔使用本地选项 → Cursor — 设计上以云端为先,在其Custom API设置中可通过Ollama/LM Studio使用本地模型。
  • 已经在使用Continue → 仍可安装运行(Ollama、自带LLM),但自2026年6月被Cursor收购后已停止维护——不必着急,方便时再规划迁移到Cline。

本地LLM IDE插件排名

📍 简单一句话

Cline是2026年本地LLM最佳IDE插件,因为它原生支持Ollama,在VS Code和JetBrains中都能运行,并在无需云依赖的情况下提供智能体文件编辑和MCP工具——此前排名第1的Continue已于2026年6月被Cursor收购,不再积极开发。

💬 简单来说

本地LLM的IDE插件将你的代码编辑器(VS Code、IntelliJ)连接到在本机运行的模型(通过Ollama、LM Studio或llama.cpp)。模型看到你的代码并响应——代码不离开你的电脑,无API费用,无使用限制。

本地LLM最佳IDE插件排行榜 -- 2026年排名
本地LLM最佳IDE插件排行榜 -- 2026年排名
1

Cline — 综合最佳(免费、开源、持续维护)

Cline(原名Claude Dev)是2026年本地LLM中维护最完善的智能体编程插件——在2026年6月Continue被Cursor收购后登顶第一。它可以读写文件、运行终端命令、浏览网页(通过浏览器工具)、使用MCP服务器。配合Ollama + Qwen2.5-Coder 32B,Cline能从一个提示词实现完整功能。限制:可靠的多步骤智能体任务需要32B模型(14B模型可处理简单任务)。定价:免费(BYOK——自带来自Anthropic、OpenAI或30多家提供商的API密钥);ClinePass每月$9.99(首月优惠价$4.99),提供无需API密钥的托管路由;Teams每用户每月$20(前10个席位免费)。支持VS Code和整个JetBrains系列:IntelliJ IDEA、PyCharm、WebStorm、PhpStorm、GoLand、Rider、CLion、RustRover、RubyMine和DataGrip。兼容后端:Ollama、LM Studio、LiteLLM代理及30多家云服务商。在VS Code、JetBrains及其他编辑器上安装量合计超500万。

2

Bodega One Code — 最佳免费本地优先IDE,内置编程智能体

Bodega One Code是一款本地优先AI IDE,从一开始就围绕编程智能体构建,而不是后期加装到现有编辑器上的助手。它在10多种后端上支持BYOL(自带LLM),包括面向本地模型的Ollama、LM Studio、llama.cpp、LocalAI、KoboldCpp、GPT4All和MLX,如需要也可直接连接云服务商:指向任意后端后,智能体的规划、编辑和执行整个流程都针对该模型运行,不绑定单一供应商。整个应用在本机运行,具备完整的离线和物理隔离(air-gap)模式,会阻止一切对外网络连接,因此没有遥测数据或模型调用会离开这台机器——所以可在Cursor、GitHub Copilot等云端连接工具完全无法使用的网络隔离环境中运行。定价:当前开放测试期间个人使用免费,暂时包含商业使用权;正式发布时计划推出一次性付费的Pro层级(价格尚未公布),届时将提供永久商业使用权、无限工作区和第二台设备授权,但目前尚未开放购买。没有订阅,本地模型使用也没有用量计量。这使它非常适合受监管行业、政府与国防承包商,以及安全策略禁止将代码发送到第三方服务器的团队——而这正是本地推理的目标用户群体。与作为VS Code插件的Cline相比,Bodega One Code是一款从一开始就围绕智能体设计的独立IDE;已经在使用VS Code的团队会觉得Cline更易于加装,而从零开始或需要保证离线运行的团队,则可以从Bodega One Code获得专为此目的打造的环境。

3

Continue — 仍可使用但已停止维护 [已于2026年6月被Cursor收购 — 最终版本v2.0.0-vscode]

在2026年6月被Cursor收购之前,Continue是本地LLM领先的开源AI编程助手。连接Ollama、LM Studio、llama.cpp和所有OpenAI兼容API。功能:内联对话(Cmd+L)、代码补全(Tab)、MCP工具、代码库索引、自定义斜杠命令。VS Code扩展已有200万以上安装量。JetBrains插件支持IntelliJ IDEA、PyCharm、GoLand、WebStorm和Rider——不包括CLion和RustRover。推荐本地模型:Qwen2.5-Coder 14B(编程)、Llama 3.1 8B(对话)。设置:安装扩展,将提供商设为Ollama,选择模型——2分钟内完成。注意(2026年6月):Continue已被Cursor收购。2026年6月19日发布的v2.0.0-vscode为最终版本,GitHub仓库现为只读状态,Continue托管的云端数据已于2026年7月15日后删除。插件仍可与Ollama及自带模型完全离线正常运行,但原团队已停止开发。社区分支仍然活跃。

4

Tabby — 最佳自托管代码补全服务器

Tabby是用Rust编写、基于Apache 2.0协议的自托管编程助手,运行自有推理服务器(独立于Ollama)。使用专门为填充中间(FIM)代码补全训练的小型模型(1–3B参数)——比通用7B模型快得多。当前稳定版本为v0.32.0,GitHub星标约3.3万。支持VS Code、JetBrains、Vim/Neovim和Emacs的IDE扩展。适合对象:5–50名开发者的团队,尤其是希望在不将代码发往云端的情况下获得快速(<200ms)代码补全的受监管或知识产权敏感团队。需要专用服务器或高性能桌面机器——可免费自托管、用户数不限,无按席位收费。

5

Aider — 最佳终端原生AI编程工具

Aider是集成git的终端AI配对程序员。理解整个代码库结构,进行多文件编辑,自动提交更改。支持Ollama(--model ollama/qwen2.5-coder:14b)、LM Studio或任何OpenAI兼容API。推荐本地模型:Qwen2.5-Coder 32B(架构模式)+ Qwen2.5-Coder 7B(编辑模式)。Aider采用双模型方案:大模型负责规划变更,小模型负责实现。GitHub星标4.4万以上。费用:免费开源。注意:截至2026年,Aider仍处于0.x版本阶段,CLI参数和.aider.conf.yml格式在次要版本之间偶有变动——升级后请查看更新日志。

Aider在GitHub上查看(开源)产品链接 · 已披露
6

Cursor — 支持本地模型的最佳商业选择

Cursor是内置AI功能的VS Code分支。Cursor在"Custom API"设置中通过Ollama和LM Studio支持本地模型。但Cursor最强大的功能(带网络搜索的Agent模式、完整代码库感知)仍需要云端模型。本地模型集成对聊天和简单补全可用,但在注重隐私的工作流中不如Cline,因为即便推理在本地运行,Cursor本身仍是一款连接云端的应用。定价:Hobby(免费,包含本地模型使用);Pro $20/月(按年付费为$16/月,含每月$20的前沿模型AI积分池;Auto模式不消耗积分,无限制);Pro+ $60/月(3倍使用积分);Ultra $200/月(20倍用量);Teams每用户$40/月,支持集中计费和SSO。注:Cursor收购了Supermaven(2024年)和Continue.dev(2026年6月)。SpaceX在自身IPO几天后,于2026年8月完成了对Cursor的600亿美元收购——据报道,Cursor的年化收入从2025年初的约1亿美元增长到2026年6月时的超过40亿美元。这一整合让Cursor成为AI编程工具领域的主导商业力量——但也让开源替代方案的长期走向存在疑问。

优点

  • +精致、熟悉的VS Code分支——对现有VS Code用户几乎零学习成本
  • +可通过Custom API设置使用Ollama或LM Studio的本地模型
  • +免费Hobby层包含本地模型使用,而不仅仅是试用

缺点

  • –最强大的功能(Agent模式、完整代码库感知)需要云端/前沿模型,而非本地模型
  • –现归SpaceX/xAI所有——供应商属性与独立开源工具有本质区别
从Cursor Hobby免费开始产品链接 · 已披露

快速设置:在VS Code中使用Cline + Ollama

准备好安装Cline了吗? → 免费安装Cline。按以下步骤将其连接到Ollama——用当前排名第1的插件开始本地LLM编程的最快方式:

  1. 1
    安装Ollama:curl -fsSL https://ollama.com/install.sh | sh
  2. 2
    拉取一个编程模型:ollama pull qwen2.5-coder:14b(智能体任务推荐qwen3-coder:32b)
  3. 3
    在VS Code的扩展市场中安装Cline
  4. 4
    打开Cline侧边栏,点击设置齿轮图标
  5. 5
    将API提供商设为"Ollama",基础URL设为http://localhost:11434,模型ID设为已拉取的模型
  6. 6
    重启VS Code——Cline图标会出现在侧边栏
  7. 7
    在Cline聊天面板中输入任务——它可以直接读写文件并运行终端命令

快速设置:Aider + Ollama(终端)

准备好安装Aider了吗? → 免费安装Aider。适合终端原生、git感知的AI编程——Aider官方文档:aider.chat/docs/llms/ollama.html

  1. 1
    安装Ollama并拉取模型:ollama pull qwen2.5-coder:32b
  2. 2
    安装Aider:python -m pip install aider-install && aider-install
  3. 3
    设置Ollama API基础地址:export OLLAMA_API_BASE=http://127.0.0.1:11434
  4. 4
    运行Aider并指向本地模型:aider --model ollama/qwen2.5-coder:32b
  5. 5
    若需双模型架构(architect/editor)设置,添加--architect-model ollama/qwen2.5-coder:32b --editor-model ollama/qwen2.5-coder:7b
  6. 6
    Aider会自动将每次变更提交到git——用git log或git diff HEAD~1查看

按插件与任务划分的最佳本地模型

插件
最佳编程模型(本地)
最佳对话模型(本地)
最低显存
ClineQwen2.5-Coder 32B Q4Qwen3 32B Q424 GB
Bodega One Code任意本地模型(BYOL)任意本地模型(BYOL)取决于所选模型
Continue(旧版)Qwen2.5-Coder 14B Q8Llama 3.1 8B Q416 GB
TabbyStarCoder2-7B(内置)N/A(仅代码)8 GB
AiderQwen2.5-Coder 14B(编辑模式)Qwen2.5-Coder 32B(架构模式)16–24 GB
CursorDeepSeek-Coder-V2(通过Ollama)Qwen3 14B16 GB

需要为这些模型准备硬件吗?8 GB显存足以支撑Tabby的小型补全模型;16 GB可运行大多数14B编程模型(Continue、Aider编辑模式、Cursor的本地选项);24 GB以上是配合Cline或Aider架构模式可靠完成32B智能体任务的现实最低门槛。完整推荐请见本地LLM最佳GPU,若预算低于16 GB显存则参考本地LLM高性价比GPU推荐。

各IDE插件的最佳本地模型 -- 编程模型与最低显存要求
各IDE插件的最佳本地模型 -- 编程模型与最低显存要求

最佳LM Studio插件(与IDE插件不是同一回事)

这与"哪款IDE扩展能连接LM Studio"(上文已介绍)是不同的问题——而且值得直接解答,因为LM Studio正是本指南中每款插件所连接的两大后端之一。LM Studio自2024年底起就拥有自己的插件系统:插件在LM Studio内部运行——目前以沙盒化worker中运行在Node.js上的TypeScript/JavaScript代码形式,Python支持仍在开发中——可以拦截推理请求、添加提示处理器、接入工具调用后端,或增加新的UI面板。可从lmstudio.ai/plugins的精选市场安装;每个插件都会预先声明所需权限(网络访问、文件系统读取),你也可以之后在设置中撤销权限而无需卸载插件。截至2026年常见类别包括:网页搜索插件、RAG/文档检索预处理器、OCR预处理器、智能体工具集插件、Shell/文件访问工具,以及记忆插件。

  • 网页搜索插件:让LM Studio中的本地模型将实时网页搜索结果拉入上下文——由于本地模型没有内置的互联网访问能力,这很有用。
  • RAG/文档插件:为本地文件夹中的PDF或文本文件建立索引,并按查询自动检索相关片段。
  • 智能体工具集插件:直接在LM Studio自己的聊天界面中赋予模型Shell访问权限、文件读写能力或多步骤任务执行能力——与Cline为VS Code提供的能力属于同一类别,区别在于运行环境是LM Studio而非代码编辑器。
  • 记忆插件:让上下文在多次聊天会话间保留,而不是每次都从零开始。

Continue能完全替代GitHub Copilot用于本地使用吗?

截至2026年6月,Continue已被Cursor收购,v2.0.0为最终版本(仓库现为只读状态)。扩展仍可与Ollama和自带模型正常运行,但不再获得原团队的后续开发。推荐的维护中开源替代方案是Cline——提供同样的BYOK模式,支持VS Code和JetBrains,并新增了智能体文件编辑能力。GitHub Copilot Pro每月$10(含每月$15的AI积分);Cline在使用自己的API密钥时免费。

哪个插件最适合多文件重构?

Cline或Aider。两者都能读取多个文件、理解依赖关系并在代码库间进行协调更改。Cline在VS Code内提供更好的可视化反馈;Aider在终端中运行,更适合CI/CD集成和git感知提交。配合30B以上模型(24GB显存),Cline + Qwen2.5-Coder 32B可以可靠地处理复杂重构。

Tabby在没有GPU的情况下能运行吗?

可以——Tabby可以在CPU上运行小型模型(1–3B)。但CPU上的补全延迟为500ms–2秒,相比流畅编程所需的<200ms目标会感觉明显迟滞。对于纯CPU机器,使用Cline + Ollama配合快速的1B或3B模型能获得更好的延迟控制。

能否用LM Studio代替Ollama使用这些插件?

可以。LM Studio默认在1234端口暴露OpenAI兼容API。将插件提供商设为"openai",基础URL设为http://localhost:1234/v1,使用LM Studio库中的任意模型名称。Cline、Continue和Aider都支持这种配置。请注意,这与上文"最佳LM Studio插件"一节所述的LM Studio自有插件系统不同——那部分内容是关于扩展LM Studio本身,而不是让外部IDE连接到它。

哪些JetBrains IDE支持本地LLM插件?

Cline和Continue都提供JetBrains插件。Cline覆盖整个系列:IntelliJ IDEA、PyCharm、PhpStorm、WebStorm、GoLand、Rider、CLion、RustRover、RubyMine和DataGrip。Continue仅覆盖IntelliJ IDEA、PyCharm、PhpStorm、WebStorm、GoLand和Rider。从JetBrains Marketplace(而非VS Code Marketplace)安装,并使用与VS Code版本相同的Ollama/LM Studio提供商设置。Tabby也支持JetBrains,但仅限代码补全功能。

Cline能在PyCharm、Rider、GoLand、WebStorm、CLion和RustRover中使用吗?

可以——通过JetBrains Marketplace安装的Cline JetBrains插件支持整个JetBrains系列:IntelliJ IDEA、PyCharm、WebStorm、PhpStorm、GoLand、Rider、CLion、RustRover、RubyMine和DataGrip。配置与VS Code版本相同的Ollama或LM Studio提供商设置即可。Continue的JetBrains插件(自2026年6月被Cursor收购后已停止维护)覆盖范围更窄——仅限IntelliJ IDEA、PyCharm、GoLand、WebStorm和Rider——不包括CLion或RustRover。

这些工具中哪些能在GDPR、HIPAA或物理隔离环境中完全离线运行?

Bodega One Code正是为此而设计:使用本地模型完全离线运行,还配备会阻止一切对外网络连接的物理隔离模式,确保没有遥测数据或模型调用离开这台机器。Cline、Continue、Tabby和Aider只要指向本地后端(Ollama、LM Studio或自托管的Tabby服务器)而非云端API,同样能完全离线运行——在此配置下它们都不会"回传"数据。Cursor的本地模型支持(通过其Custom API设置)仍在一款连接云端的应用程序内运行,因此不适合网络隔离环境。

Bodega One Code是什么?它与Cline有何不同?

Bodega One Code是一款独立的本地优先AI IDE,内置编程智能体,在当前开放测试期间个人使用免费——与作为VS Code或JetBrains插件的Cline不同,Bodega One Code是一款从一开始就围绕智能体设计的完整IDE。它在10多种后端上支持BYOL(自带LLM),完全离线运行并支持物理隔离(air-gap)。面向商业用途的一次性付费Pro层级已在计划中,但尚未开放购买。它非常适合云端连接编辑器完全无法使用的受监管或网络隔离环境。

2026年推荐总结

六款工具,一页看完——如果你只想要答案,这是精简版:

  • 综合最佳 → Cline — 免费、智能体能力、VS Code + 整个JetBrains系列。优先安装它。
  • 完全离线/合规最佳 → Bodega One Code — 独立IDE,无云端组件。
  • 代码补全最佳 → Tabby — 自托管,200毫秒以内。
  • 终端工作流最佳 → Aider — git感知,多文件。
  • 商业IDE最佳 → Cursor — 从免费Hobby层开始,再通过Ollama/LM Studio添加本地模型。

← 返回 本地LLM进阶