关键要点
- Continue.dev于2026年6月被Cursor收购——v2.0.0为最终版本,仓库现为只读状态;仍可与Ollama配合运行,但已不再维护
- Cline目前是维护最完善的免费BYOK替代方案:VS Code + JetBrains,智能体文件编辑,MCP工具,安装量超500万
- Bodega One Code是一款免费的本地优先IDE,内置编程智能体并支持BYOL(自带LLM)——完整离线/物理隔离运行,无需订阅
- Tabby运行自有推理服务器(1–3B模型)——为团队提供延迟最低的代码补全
- Aider是终端优先选项——git提交感知,多文件重写,GitHub星标4.4万
- Cursor(Pro版$20/月,积分制)已收购Supermaven和Continue.dev;SpaceX于2026年6月同意以600亿美元收购Cursor
- 所有工具均可与Ollama配合使用;仅Tabby需要自有后端服务器
本地LLM IDE插件排名
📍 简单一句话
Cline是2026年本地LLM最佳IDE插件,因为它原生支持Ollama,在VS Code和JetBrains中都能运行,并在无需云依赖的情况下提供智能体文件编辑和MCP工具——此前排名第1的Continue已于2026年6月被Cursor收购,不再积极开发。
💬 简单来说
本地LLM的IDE插件将你的代码编辑器(VS Code、IntelliJ)连接到在本机运行的模型(通过Ollama、LM Studio或llama.cpp)。模型看到你的代码并响应——代码不离开你的电脑,无API费用,无使用限制。

Cline — 综合最佳(免费、开源、持续维护)
Cline(原名Claude Dev)是2026年本地LLM中维护最完善的智能体编程插件——在2026年6月Continue被Cursor收购后登顶第一。它可以读写文件、运行终端命令、浏览网页(通过浏览器工具)、使用MCP服务器。配合Ollama + Qwen3-Coder 32B,Cline能从一个提示词实现完整功能。限制:可靠的多步骤智能体任务需要32B模型(14B模型可处理简单任务)。定价:免费(BYOK——自带来自Anthropic、OpenAI或30多家提供商的API密钥);ClinePass每月$9.99,提供无需API密钥的托管路由;Teams每用户每月$20(前10个席位免费)。支持VS Code和JetBrains(IntelliJ、PyCharm、PhpStorm、WebStorm、GoLand、Rider等)。兼容后端:Ollama、LM Studio、LiteLLM代理及30多家云服务商。开发者超800万人。
Bodega One Code — 最佳免费本地优先IDE,内置编程智能体
Bodega One Code是一款免费的本地优先AI IDE,从一开始就围绕编程智能体构建,而不是后期加装到现有编辑器上的助手。它支持BYOL(自带LLM):连接任意本地模型后端后,智能体的规划、编辑和执行整个流程都针对该模型运行,不绑定单一供应商。整个应用在本机运行,具备完整的离线和物理隔离(air-gap)支持——因此可在Cursor、GitHub Copilot等云端连接工具完全无法使用的网络隔离环境中运行。无需订阅:Bodega One Code免费使用,且由于没有云端组件,也就没有用量计量或积分管理。这使它非常适合受监管行业、政府与国防承包商,以及安全策略禁止将代码发送到第三方服务器的团队——而这正是本地推理的目标用户群体。与作为VS Code插件的Cline相比,Bodega One Code是一款从一开始就围绕智能体设计的独立IDE;已经在使用VS Code的团队会觉得Cline更易于加装,而从零开始或需要保证离线运行的团队,则可以从Bodega One Code获得专为此目的打造的环境。
Continue — 仍可使用但已停止维护 [已于2026年6月被Cursor收购 — 最终版本v2.0.0]
在2026年6月被Cursor收购之前,Continue是本地LLM领先的开源AI编程助手。连接Ollama、LM Studio、llama.cpp和所有OpenAI兼容API。功能:内联对话(Cmd+L)、代码补全(Tab)、MCP工具、代码库索引、自定义斜杠命令。VS Code扩展已有200万以上安装量。JetBrains插件支持IntelliJ、PyCharm、GoLand、WebStorm和Rider。推荐本地模型:Qwen3-Coder 14B(编程)、Llama 3.3 8B(对话)。设置:安装扩展,将提供商设为Ollama,选择模型——2分钟内完成。注意(2026年6月):Continue已被Cursor收购。v2.0.0为最终版本,GitHub仓库现为只读状态。插件仍可与Ollama及自带模型完全正常运行,但原团队已停止开发。社区分支仍然活跃。
Tabby — 最佳自托管代码补全服务器
Tabby是运行自有推理服务器(独立于Ollama)的自托管编程助手。使用专门为填充中间(FIM)代码补全训练的小型模型(1–3B参数)——比通用7B模型快得多。支持VS Code、JetBrains、Vim/Neovim和Emacs的IDE扩展。适合对象:希望在不依赖云端的情况下获得快速(<200ms)代码补全的团队。需要专用服务器或高性能桌面机器。
Aider — 最佳终端原生AI编程工具
Aider是集成git的终端AI配对程序员。理解整个代码库结构,进行多文件编辑,自动提交更改。支持Ollama(--model ollama/qwen2.5-coder:14b)、LM Studio或任何OpenAI兼容API。推荐本地模型:Qwen3-Coder 32B(架构模式)+ Qwen3-Coder 7B(编辑模式)。Aider采用双模型方案:大模型负责规划变更,小模型负责实现。费用:免费开源。
Cursor — 支持本地模型的最佳商业选择
Cursor是内置AI功能的VS Code分支。截至2026年7月,Cursor在"Custom API"设置中通过Ollama和LM Studio支持本地模型。但Cursor最强大的功能(带网络搜索的Agent模式、完整代码库感知)仍需要云端模型。本地模型集成对聊天和简单补全可用,但在注重隐私的工作流中不如Cline。定价:Hobby(免费);Pro $20/月(含$20/月AI积分用于前沿模型;Auto模式不消耗积分,无限制);Pro+ $60/月;Ultra $200/月。本地模型使用在免费Hobby层即可获得。注:Cursor收购了Supermaven(2024年)和Continue.dev(2026年6月);SpaceX于2026年6月同意以600亿美元收购Cursor本身(预计2026年第三季度完成)。这一整合让Cursor成为AI编程工具领域的主导力量——但也让开源替代方案的长期走向存在疑问。
快速设置:在VS Code中使用Cline + Ollama
用当前排名第1的插件开始本地LLM编程的最快方式:
- 1安装Ollama:
curl -fsSL https://ollama.com/install.sh | sh - 2拉取一个编程模型:
ollama pull qwen2.5-coder:14b(智能体任务推荐qwen3-coder:32b) - 3在VS Code的扩展市场中安装Cline
- 4打开Cline侧边栏,点击设置齿轮图标
- 5将API提供商设为"Ollama",基础URL设为
http://localhost:11434,模型ID设为已拉取的模型 - 6重启VS Code——Cline图标会出现在侧边栏
- 7在Cline聊天面板中输入任务——它可以直接读写文件并运行终端命令
快速设置:Aider + Ollama(终端)
适合终端原生、git感知的AI编程——Aider官方文档:aider.chat/docs/llms/ollama.html
- 1安装Ollama并拉取模型:
ollama pull qwen2.5-coder:32b - 2安装Aider:
python -m pip install aider-install && aider-install - 3设置Ollama API基础地址:
export OLLAMA_API_BASE=http://127.0.0.1:11434 - 4运行Aider并指向本地模型:
aider --model ollama/qwen2.5-coder:32b - 5若需双模型架构(architect/editor)设置,添加
--architect-model ollama/qwen2.5-coder:32b --editor-model ollama/qwen2.5-coder:7b - 6Aider会自动将每次变更提交到git——用
git log或git diff HEAD~1查看
按插件与任务划分的最佳本地模型
| 插件 | 最佳编程模型(本地) | 最佳对话模型(本地) | 最低显存 |
|---|---|---|---|
| Cline | Qwen3-Coder 32B Q4 | Qwen3 32B Q4 | 24 GB |
| Bodega One Code | 任意本地模型(BYOL) | 任意本地模型(BYOL) | 取决于所选模型 |
| Continue(旧版) | Qwen3-Coder 14B Q8 | Llama 3.3 8B Q4 | 16 GB |
| Tabby | StarCoder2-7B(内置) | N/A(仅代码) | 8 GB |
| Aider | Qwen3-Coder 14B(编辑模式) | Qwen3-Coder 32B(架构模式) | 16–24 GB |
| Cursor | DeepSeek-Coder-V2(通过Ollama) | Qwen3 14B | 16 GB |

最佳LM Studio插件(与IDE插件不是同一回事)
这与"哪款IDE扩展能连接LM Studio"(上文已介绍)是不同的问题。LM Studio自2024年底起就拥有自己的插件系统:插件在LM Studio内部运行——以沙盒化worker中的TypeScript或Python代码形式——可以拦截推理请求、添加提示处理器、接入工具调用后端,或增加新的UI面板。可从lmstudio.ai/plugins的精选市场安装;每个插件都会预先声明所需权限(网络访问、文件系统读取),你也可以之后在设置中撤销权限而无需卸载插件。截至2026年常见类别包括:网页搜索插件、RAG/文档检索预处理器、OCR预处理器、智能体工具集插件、Shell/文件访问工具,以及记忆插件。
- 网页搜索插件:让LM Studio中的本地模型将实时网页搜索结果拉入上下文——由于本地模型没有内置的互联网访问能力,这很有用。
- RAG/文档插件:为本地文件夹中的PDF或文本文件建立索引,并按查询自动检索相关片段。
- 智能体工具集插件:直接在LM Studio自己的聊天界面中赋予模型Shell访问权限、文件读写能力或多步骤任务执行能力——与Cline为VS Code提供的能力属于同一类别,区别在于运行环境是LM Studio而非代码编辑器。
- 记忆插件:让上下文在多次聊天会话间保留,而不是每次都从零开始。
Continue能完全替代GitHub Copilot用于本地使用吗?
截至2026年6月,Continue已被Cursor收购,v2.0.0为最终版本(仓库现为只读状态)。扩展仍可与Ollama和自带模型正常运行,但不再获得原团队的后续开发。推荐的维护中开源替代方案是Cline——提供同样的BYOK模式,支持VS Code和JetBrains,并新增了智能体文件编辑能力。GitHub Copilot Pro每月$10(含每月$15的AI积分);Cline在使用自己的API密钥时免费。
哪个插件最适合多文件重构?
Cline或Aider。两者都能读取多个文件、理解依赖关系并在代码库间进行协调更改。Cline在VS Code内提供更好的可视化反馈;Aider在终端中运行,更适合CI/CD集成和git感知提交。配合30B以上模型(24GB显存),Cline + Qwen3-Coder 32B可以可靠地处理复杂重构。
Tabby在没有GPU的情况下能运行吗?
可以——Tabby可以在CPU上运行小型模型(1–3B)。但CPU上的补全延迟为500ms–2秒,相比流畅编程所需的<200ms目标会感觉明显迟滞。对于纯CPU机器,使用Cline + Ollama配合快速的1B或3B模型能获得更好的延迟控制。
能否用LM Studio代替Ollama使用这些插件?
可以。LM Studio默认在1234端口暴露OpenAI兼容API。将插件提供商设为"openai",基础URL设为http://localhost:1234/v1,使用LM Studio库中的任意模型名称。Cline、Continue和Aider都支持这种配置。请注意,这与上文"最佳LM Studio插件"一节所述的LM Studio自有插件系统不同——那部分内容是关于扩展LM Studio本身,而不是让外部IDE连接到它。
哪些JetBrains IDE支持本地LLM插件?
Cline和Continue都提供覆盖整个JetBrains系列的插件:IntelliJ IDEA、PyCharm、PhpStorm、WebStorm、GoLand和Rider。从JetBrains Marketplace(而非VS Code Marketplace)安装,并使用与VS Code版本相同的Ollama/LM Studio提供商设置。Tabby也支持JetBrains,但仅限代码补全功能。
Bodega One Code是什么?它与Cline有何不同?
Bodega One Code是一款免费的独立本地优先AI IDE,内置编程智能体——与作为VS Code或JetBrains插件的Cline不同,Bodega One Code是一款从一开始就围绕智能体设计的完整IDE。它支持BYOL(自带LLM),可连接任意本地模型后端,完全离线运行并支持物理隔离(air-gap),且无需订阅。它非常适合云端连接编辑器完全无法使用的受监管或网络隔离环境。
