Skip to main content
PromptQuorum
主页/本地LLM/2026年最佳向量数据库:Qdrant、Pinecone、Weaviate 还是 Chroma
Tools & Interfaces

2026年最佳向量数据库:Qdrant、Pinecone、Weaviate 还是 Chroma

·约 15 分钟阅读·Hans Kuepper 作者 · PromptQuorum创始人,多模型AI调度工具 · PromptQuorum

本页包含指向第三方产品的参考链接。PromptQuorum 未加入任何联盟计划——这些是不产生佣金的普通链接。点击链接和后续步骤由您自行承担责任。这些链接不代表 PromptQuorum 的任何认可或验证。

对多数团队而言,Qdrant 是最好的默认选择:GitHub 星标 34,242,Apache-2.0 许可,开源引擎中资源占用最低,且云层级永久免费。如果你想要零基础设施工作并愿意为此付费,Pinecone 是正确答案,Builder 每月 20 美元起。如果混合检索是核心,就选 Weaviate。Chroma 是通往可用原型的最短路径,因为它在进程内运行。这个品类里最过时的说法是「只有部分产品有免费层级」:自 2026 年 6 月起四者都有,包括把 14 天到期沙箱换成真正免费、不过期方案的 Weaviate。

关键要点

  • Qdrant——GitHub 星标 34,242,Apache-2.0,用 Rust 编写。Qdrant Cloud 有永久免费层级,含 0.5 vCPU、1 GB 内存与 4 GB 磁盘;Standard 按用量计费,承诺 99.5% 可用性,且不收固定平台费;Premium 增加 SSO 与私有 VPC 链路,承诺 99.9% 并设有最低消费。
  • Pinecone——设计上仅限云端,完全没有自托管版本。Starter 免费,含 2 GB 存储、每月 200 万写入单元与 100 万读取单元。Builder 每月 20 美元固定价,含 10 GB、500 万写入与 200 万读取。Standard 从每月最低 50 美元起后按用量计费,Enterprise 从每月最低 500 美元起,增加 99.95% 可用性承诺、BYOC、HIPAA 与审计日志。
  • Weaviate——16,758 星标,BSD-3-Clause,用 Go 编写。本页最重要的更正: Weaviate Cloud 已不再是 14 天沙箱。2026 年 6 月 17 日,它推出了真正免费的层级,免信用卡、不过期:10 万个对象、1 GB 内存与 10 GB 磁盘。那些仍在建议读者从第一天起预留每月 45 美元的对比文章,正把人送去为如今免费的东西付费。
  • Weaviate 的付费价格也变了。 现行定价页列出的是 Flex 每月 45 美元起、Premium 每月 400 美元起。2025 年 10 月定价更新中宣布的每月 280 美元 Plus 层级已不在页面上,因此请引用 Flex 与 Premium,而不是旧的三层结构。
  • Chroma——29,174 星标,Apache-2.0,如今是 Rust 内核,而非起步时的 Python 引擎。它是四者中唯一无需服务器、在进程内运行的,这也正是它在原型开发上胜出的原因。
  • Chroma Cloud 同样存在,这一点多数同类对比完全遗漏:Starter 每月 0 美元加用量,附 5 美元初始额度;Team 每月 250 美元加用量;用量计价为每写入 1 GiB 2.50 美元、每存储 1 GiB 每月 0.33 美元、每查询 1 TiB 0.0075 美元、每返回 1 GiB 0.09 美元。因此这里有四个托管选项,而非三个。
  • 四者现在都有免费层级,这在一年前还不成立,也是判断你正在读的对比是否更新过的最快方法。
  • 一句需要直说的披露: Pinecone 确实为内容创作者运营着联盟计划,其合作伙伴页面可以佐证。PromptQuorum 未加入该计划,也不从本页任何链接中获得收益。这是本系列中唯一存在此类计划的品类,而这恰恰是上面推荐 Qdrant 而非 Pinecone 的原因。

🏆 适合你的最佳选择

结构性的问题是:你自己运维引擎,还是租用它?这取决于你稀缺的是工程小时还是预算。 从上往下读,停在第一条符合你情况的。

  • 你有一些运维余力,且想要最好的性价比 → Qdrant,自托管或用 Qdrant Cloud。开源引擎中资源占用最低,也是三者中社区最大的。
  • 你想要零基础设施工作,并愿意为此付费 → Pinecone。最成熟的无服务器产品,而每月 20 美元固定价的 Builder 是一个真正的方案,不是试用。
  • 召回精度取决于字面匹配与语义匹配的结合 → Weaviate。原生的 BM25 加向量是这里最成熟的混合实现,而且免费层级如今评估起来分文不花。
  • 你在 notebook 里做原型,不想要服务器 → Chroma。它在你的 Python 进程中运行,因此在检索跑通之前没有任何东西需要预置。
  • 数据必须留在你自己掌控的硬件上 → 自托管 Qdrant、Weaviate 或 Chroma。Pinecone 没有自托管版本,因此在 BYOC 的 Enterprise 之外无法满足硬性的数据驻留要求。
  • 你的向量少于约 1 万条 → 一个都不用。Postgres 上的 pgvector 足以覆盖这一规模,既不必多运维一个服务,也省得为一个用不上的负载去学新的查询 API。
Qdrant——查看价格产品链接 · 已披露Pinecone——查看价格产品链接 · 已披露

向量数据库到底是什么

向量数据库存储嵌入模型生成的高维数值向量,并对其回答最近邻查询,而这正是任何 RAG 流水线核心的检索环节。 你交给它一个查询向量,它返回距离最近的已存向量,通常还附带原文与元数据。

普通数据库技术上也能做,但一到规模就撑不住,因为对数百万条高维向量做精确最近邻搜索代价高昂。这些引擎使用近似索引——四者都是 HNSW——用一点召回率换取极大的提速。这个取舍就是这个品类存在的全部理由。

实际后果是,这四者之间有意思的差别不是「能不能找到相似向量」——它们都能。差别在于元数据过滤与向量索引的配合程度、混合检索的成熟度、在你的量级上要花多少钱,以及你能否自己运行它。关于围绕它的整条流水线,见构建本地 RAG

📍 简单一句话

向量数据库存储嵌入模型生成的高维向量,并对其回答最近邻查询,这正是 RAG 流水线核心的检索环节。

💬 简单来说

它是搜索含义而非词语的引擎。你给它一段转成数字的文本,它返回数字最接近的那些已存条目——实际上就是意思大致相同的段落。

Qdrant、Pinecone、Weaviate 与 Chroma 对比

四者优化的是不同的约束——资源占用、运维简单度、检索质量或首次查询的时间——而不是逐项功能对拼。 价格于 2026 年 8 月 28 日从各厂商定价页读取,仓库数据同日取自 GitHub API。

维度QdrantPineconeWeaviateChroma
GitHub 星标34,242非开源16,75829,174
许可证Apache-2.0专有BSD-3-ClauseApache-2.0
实现语言Rust未公开GoRust 内核
可自托管可以,免费不可,仅云端可以,免费可以,免费
进程内运行否,服务端否,托管否,服务端
云端免费层级0.5 vCPU、1 GB、4 GB2 GB、200万写、100万读10万对象、1 GB、10 GB每月 0 美元加 5 美元额度
付费起点按用量,无固定费Builder 每月 20 美元固定Flex 每月 45 美元起Team 每月 250 美元加用量
混合检索原生,稀疏加稠密支持原生 BM25,最成熟较新,完整度较低
入门层级 SLAStandard 99.5%仅 Enterprise,99.95%Flex 99.5%Enterprise 以下未公布
联盟计划未发现有,我们未参与未发现未发现

⚠️Warning: 这里有两行与多数仍在流传的对比相抵触。自 2026 年 6 月 17 日起,Weaviate 拥有不过期的免费层级,而非 14 天沙箱。并且 Chroma 有托管云产品,因此这个品类有四个托管选项,而不是通常列出的三个。

自托管还是托管云

自托管给你成本控制与数据驻留,同时把可用性、备份与扩容交到你手上;托管云再把这些卖回给你。 坦率地说,金钱上的差距比多数团队预想的小,时间上的差距则更大。

一台普通机器上的单节点 Qdrant 或 Weaviate,跑一百万条向量的基础设施成本约为每月 40 到 80 美元。同等规模下,托管版本落在相近区间。真正把两者分开的,是每月有人花在打补丁、监控、从失败部署中恢复、以及磁盘写满时被叫醒上的两到五个小时。按你团队真实的时薪计价,这个比较通常会反转。

自托管明显胜出的场景,主要不是钱的问题。它们是数据驻留、隔离或本地部署的要求,以及高到让按量计费超过固定机器的用量。托管明显胜出的场景,是没有富余工程师的小团队——在那里,不付费的替代方案不是省钱,而是更晚上线。

💡Tip: Pinecone 是这里唯一没有自托管退路的选项,这是迁移层面的考量而非缺陷。离开 Weaviate 或 Qdrant Cloud 只是改变同一个引擎的运行位置;离开 Pinecone 则意味着更换引擎并重写查询。

Qdrant:默认之选

把 Qdrant 推荐给多数团队,是因为它在开源引擎中资源占用最低、社区在三者中最大,而且云层级是无限期免费而非试用窗口。 它对你如何组织数据的意见也最少。

1

Qdrant——综合最优

34,242 星标,Apache-2.0,Rust,永久免费云层级

Qdrant 用 Rust 编写,这表现为在同等负载下内存与 CPU 占用小于源自 Go 和 Python 的替代品,而这份占用正是它在单节点上能走得更远的实际原因。它的过滤是这里最强的:元数据条件在 HNSW 遍历过程中施加,而不是事后再过滤结果,因此重度过滤的查询不会悄悄退化成扫描。混合检索通过与稠密向量并列的稀疏向量原生支持。云端定价是四者中最清爽的:一个含 0.5 vCPU、1 GB 内存与 4 GB 磁盘的免费层级,永久有效而非限时;一个按 vCPU、内存与存储的实际消耗计费的 Standard 层级,承诺 99.5% 可用性,且上面不再叠加固定平台费;以及一个增加 SSO 与私有 VPC 链路的 Premium 层级,承诺 99.9% 并设有最低消费。没有平台费正是它成为成本敏感之选的原因:你为资源付钱,而不是为「成为客户」这件事付钱。

优点

  • +开源引擎中资源占用最低,单节点因此能走得更远
  • +过滤在索引遍历过程中施加而非事后进行,带过滤的查询依然快
  • +永久免费的云层级而非试用,Standard 按用量计费且无固定费
  • +Apache-2.0,34,242 星标是这里最大的社区,自托管与托管是同一个引擎

缺点

  • 使用自有查询语言而非 SQL 或 GraphQL,因此存在学习曲线
  • 内置的向量化模块比 Weaviate 少——嵌入流水线要你自己带
  • 占用再小,自托管仍意味着要运行并监控一台服务器
Qdrant——查看价格产品链接 · 已披露

Pinecone:零运维之选

Pinecone 是这里最成熟的托管产品,也是唯一完全没有自托管版本的,这既是它最强的特性,也是最大的绑定。 你买的是「不存在运维工作」这件事。

1

Pinecone——想要零基础设施工作时最优

仅云端的无服务器,Starter 免费,Builder 每月 20 美元固定价

Pinecone 从一开始就是托管产品,而不是给开源引擎加挂托管,这一点在上手时就能看出来:没有容量规划,没有索引尺寸设定,首次查询之前没有任何东西需要预置。对于没有向量数据库经验的团队,这是真实的优势而非营销说辞。方案包括:Starter 免费,含 2 GB 存储、每月 200 万写入单元与 100 万读取单元,外加 1 GB 出站;Builder 每月 20 美元固定价,含 10 GB、500 万写入、200 万读取与 10 GB 出站;Standard 从每月最低 50 美元起后按量计费,增加专用读节点、备份与恢复、RBAC 与 SAML 单点登录;Enterprise 从每月最低 500 美元起,增加 99.95% 可用性承诺、自带云、私有端点、客户自管加密密钥、审计日志、SCIM 与 HIPAA 合规。Builder 值得单独一提,因为在这个品类里,一个带有真实额度的 20 美元固定方案并不常见,也消除了个人项目上对 Pinecone 的主要顾虑。

优点

  • +这里最成熟的无服务器体验,没有东西需要预置或设定尺寸
  • +Builder 每月 20 美元固定价是一次真正很小的投入,额度也够用
  • +Enterprise 的合规能力是实打实的:HIPAA、BYOC、客户自管密钥、审计日志与 SCIM
  • +超出最低额后按量计费,低流量应用因此保持便宜

缺点

  • 没有自托管版本,离开意味着更换引擎而不是搬迁一套部署
  • 硬性的数据驻留要求只能通过每月 500 美元起的 Enterprise 与 BYOC 满足
  • 读写单元的消耗容易低估,账单可能出乎意料
Pinecone——查看价格产品链接 · 已披露

Weaviate:混合检索之选

Weaviate 拥有四者中最成熟的混合检索,而且自 2026 年 6 月起还有一个不过期的免费层级——这让多数对比至今给出的建议失效。 如果检索质量是你的瓶颈,先看这里。

1

Weaviate——混合检索要紧时最优

16,758 星标,BSD-3-Clause,Go,自 2026 年 6 月起免费层级不过期

Weaviate 在查询 API 中原生地把 BM25 关键词打分与向量相似度结合起来,而且做这件事的时间比其他产品都长,这体现在你对混合方式能有多少控制上。这比听起来更重要:纯语义检索会稳定地漏掉精确的产品编码、型号、错误串与缩写,因为这些词元的含义就是其字面形式。Weaviate 还附带向量化模块,可代你调用嵌入服务商,于是嵌入由数据库承担而不是你的应用。在价格方面,重要的事实是新近的:2026 年 6 月 17 日,Weaviate 推出了免信用卡、不过期的免费层级,提供 10 万个对象、1 GB 内存与 10 GB 磁盘。它取代了对比文章仍在描述的 14 天沙箱。现行页面上的付费方案是按量付费、承诺 99.5% 可用性的 Flex 每月 45 美元起,以及共享或专属部署的 Premium 每月 400 美元起;2025 年 10 月公告中每月 280 美元的 Plus 层级已不在其上。

优点

  • +这里最成熟的混合检索,对关键词与向量的配比有真正的控制
  • +自 2026 年 6 月起免费层级不过期且免信用卡:10 万对象、1 GB 内存、10 GB 磁盘
  • +内置的向量化模块让数据库而非应用来承担嵌入
  • +自托管与托管是同一个引擎,因此双向都有迁移路径

缺点

  • 需要预先定义 schema,是三个开源引擎中搭建最重的一个
  • 同等负载下资源占用高于 Qdrant
  • 价格在不到一年里变了两次,因此请核对当前页面而不要相信某篇对比
Weaviate——查看价格产品链接 · 已披露

Chroma:原型开发之选

Chroma 是四者中唯一无需服务器、在你的 Python 进程内运行的,因此它是从零到检索跑通的最短路径。 它按设计比其他三者窄,并且对此很坦诚。

1

Chroma——原型开发与中小负载最优

29,174 星标,Apache-2.0,Rust 内核,`pip install chromadb` 即可运行

Chroma 用 pip 安装并以嵌入方式运行,因此一个 notebook 可以用几行代码就拥有可用的语义检索,不需要容器、端口或配置。这一条特性就解释了它为何主导教程与原型,而这是真实的工程优势而非新手拐杖:能在没有基础设施的情况下测试检索逻辑,会明显缩短迭代循环。引擎内核已用 Rust 重写,因此性能表现好于它的 Python 出身所暗示的,尽管元数据过滤仍比 Qdrant 简单,混合检索也更新、更不完整。Chroma Cloud 同样存在,而多数同类对比略过了它:Starter 每月 0 美元加用量,附 5 美元额度与 10 个数据库;Team 每月 250 美元加用量,含 100 个数据库与专属 Slack 支持;Enterprise 增加单租户或自带云集群。用量计价为每写入 1 GiB 2.50 美元、每存储 1 GiB 每月 0.33 美元、每查询 1 TiB 0.0075 美元、每返回 1 GiB 0.09 美元。

优点

  • +无需服务器、在进程内运行,因此开始时没有东西需要预置
  • +四者中最容易上手,也是教程与示例中最常见的
  • +如今是 Rust 内核,性能好于其 Python 出身所暗示的
  • +Chroma Cloud 从每月 0 美元加用量起步,转向托管不必一步跨到月费

缺点

  • 元数据过滤比 Qdrant 简单,混合检索是这里完整度最低的
  • 不是用来扩到数千万向量的引擎——要在那之前迁移,而不是之后
  • 让它易用的嵌入式模型,也意味着它默认不是多租户服务端
Chroma——查看价格产品链接 · 已披露

四者现在都有免费层级

自 2026 年 6 月起,四家厂商都提供了以零成本运行真实负载的途径,这也是判断你正在读的对比今年是否更新过的最快方法。 一篇告诉你 Weaviate 只给 14 天沙箱的指南,描述的是 2026 年 6 月 17 日就已结束的世界。

这四份免费方案在形态上确实不同,而这比「它们存在」这件事更重要。Qdrant Cloud 给你一个持久的单节点集群,含 0.5 vCPU、1 GB 内存与 4 GB 磁盘,永久免费——一台留在你手上的小机器。Pinecone Starter 免费,含 2 GB 存储以及每月 200 万写入单元与 100 万读取单元的计量额度——容量加上吞吐预算。Weaviate 的免费方案给出 10 万个对象、1 GB 内存与 10 GB 磁盘,免信用卡且不过期——磁盘上最慷慨的一份。Chroma Cloud Starter 每月 0 美元加用量并附 5 美元额度,那是余额而非常设额度,在负载之下终会用尽。

请对照你的负载来读,而不是互相比较。如果你存得多、查得少,Weaviate 的 10 GB 是这里最强的一份。如果你对着一个小语料不停查询,Pinecone 的读取单元额度就比谁的磁盘数字都更要紧。

⚠️Warning: Chroma Cloud 的「每月 0 美元」与其他三者的免费不是一回事。它是一个附带 5 美元初始额度的按量计价方案,因此是用完额度之前免费,而非持续免费。另外三者都有会重置或长期保持的常设额度。

100 万向量的 12 个月成本

对于一百万条 1,536 维向量——大致相当于 OpenAI 嵌入规模的语料——自托管与托管的基础设施成本足够接近,以至于决定权落在运维时间上。 下面的数字假设在一台每月 40 到 80 美元、4 vCPU 与 16 GB 内存的机器上做单节点部署,对比各厂商能从容承载同等负载的最低层级。

方案每月基础设施每月运维小时运维成本(75 美元/小时)12 个月合计
Qdrant 自托管约 60 美元2–4150–300 美元约 2,520–4,320 美元
Weaviate 自托管约 60 美元3–5225–375 美元约 3,420–5,220 美元
Chroma 自托管约 40 美元2–3150–225 美元约 2,280–3,180 美元
Pinecone Standard最低 50 美元加用量0.5–138–75 美元约 1,060–1,500 美元
Weaviate Cloud Flex最低 45 美元加用量0.5–138–75 美元约 996–1,440 美元
Qdrant Cloud Standard估计 40–70 美元0.5–138–75 美元约 936–1,740 美元

在一百万向量的量级上,通常是运维那一行决定结果,而非标价。当驻留或用量提出要求时就自托管;否则一旦把自己的工时诚实计价,托管层级会更便宜。

📌Note: 这些是依据 2026 年 8 月 28 日常见的机器价格与厂商标价建模的估算,不是实测的生产账单。Pinecone、Qdrant Cloud 与 Chroma Cloud 的按量成本随查询量浮动,因此在做决定前,请把你预期的读写量放进各厂商的计算器跑一遍。

谁该用哪一个

决定这件事的是团队规模、运维余力与驻留要求,而不是基准测试表格。 六种画像基本覆盖了大多数读者。

  • 独立开发者或个人 RAG 项目 → 嵌入式 Chroma。没有服务器,没有月费,检索与你的应用跑在同一个进程里。
  • 尚未招运维、跑得很快的小团队 → 每月 20 美元的 Pinecone Builder,或者如果你预计以后要自托管,就用 Qdrant Cloud 的免费层级。
  • 有运维余力、要在规模上优化成本的团队 → Qdrant,自托管或用 Standard。按用量计费且无平台费,坦白说是最便宜的路。
  • 技术语料上检索质量是瓶颈的团队 → Weaviate,在如今免费的层级上评估,看中的是它混合检索的成熟度。
  • 隐私优先或受监管、有驻留要求的团队 → 自托管 Qdrant 或 Weaviate。Pinecone 只能通过每月 500 美元起的 Enterprise 与 BYOC 来满足。
  • 低于约 1 万条向量 → Postgres 上的 pgvector。在这里加一个专门引擎,是在没有检索收益的情况下增加运维成本。

欧盟、日本与中国的向量数据库

向量存储里装着你源文档的嵌入,而且在几乎任何部署中,原文本身也作为负载一并存入。这让「托管还是自托管」在三个重要市场变成了数据保护问题。

这些情况可以跳过

如果你的向量少于约 1 万条,就跳过这四个,改用 Postgres 上的 pgvector。 在这个规模上,精确最近邻的全量扫描在毫秒内就能完成,因此那个用来正当化专门引擎的近似索引,解决的是你没有的问题。如果你本来就在跑 Postgres,pgvector 增加的是一个列类型和一个索引,而不是一个服务,并且你的向量与它们所描述的行处在同一个事务里——这悄悄消除了一整类「索引与源数据不一致」的问题。

对于完全没有数据库服务端的应用,配合 `sqlite-vec` 的 SQLite 覆盖同样的范围。而如果你的嵌入是静态且很少变动的,一个提交进仓库的 FAISS 索引比上面这一切都简单:没有服务,没有 schema,没有迁移。

值得等待的门槛很具体:数十万量级的向量、顺序扫描已经掩盖不住的查询延迟,或者需要与相似度检索相配合而非在其之后运行的元数据过滤。在那之前就搭起专门引擎,等于为一个现有数据库已经能处理的问题去运维一个服务。

💡Tip: 一个有用的触发点:当一次检索查询第一次慢到用户能察觉时,或者当你第一次需要带过滤的相似度检索、而现有搭配逼你在过滤与排序之间二选一时,就换到专门引擎。

挑选向量数据库时的常见误区

  1. 1
    以为 Weaviate 只提供 14 天沙箱
    Why it matters: Weaviate 于 2026 年 6 月 17 日推出了免信用卡、不过期的免费层级,含 10 万个对象、1 GB 内存与 10 GB 磁盘。仍在建议从第一天起预留每月 45 美元的对比文章,正把读者送去为如今免费的东西付费,而这是目前这个品类里最常见的过时说法。
  2. 2
    把 Chroma 当作只能嵌入式使用,从而错过 Chroma Cloud
    Why it matters: Chroma Cloud 有每月 0 美元加用量并附 5 美元额度的 Starter,以及每月 250 美元的 Team。多数对比在实有四个托管选项时只列出三个,这会让那些喜欢 Chroma 模式、却以为「转向托管就等于离开它」的团队得出扭曲的结论。
  3. 3
    因为名字最常被提到就选 Pinecone
    Why it matters: Pinecone 是这个品类里推广力度最大的选项,并且为内容创作者运营着真实的联盟计划,这意味着推荐它的内容体量与商业激励并非无关。作为零运维选项它确实最好;但它并不自动是最好或最便宜的匹配,而且是唯一你无法自托管的。
  4. 4
    只拿机器费用来核算自托管
    Why it matters: 团队把一台 60 美元的机器与 50 美元的托管方案相比,得出自托管更便宜的结论,却忽略了每月两到五小时的打补丁、监控与备份校验。按任何现实的工程费率计算,这段时间都超过价格差——这正是上面十二个月的表格会反转朴素比较的原因。
  5. 5
    为不足 1 万条向量的项目搭起专门引擎
    Why it matters: 在这个规模上,你现有 Postgres 里的 pgvector 就能回答同样的查询,不必新增任何服务,还能让向量与其描述的行在事务上保持一致。在这里加一个专门引擎,买到的是运维成本和一套新的查询 API,却没有任何检索上的收益。

常见问题

什么是向量数据库?

向量数据库存储嵌入模型生成的高维数值向量,并对其回答最近邻查询,这正是 RAG 流水线核心的检索环节。普通数据库并未针对数百万条高维向量的相似度检索做优化,因此才有 Qdrant、Pinecone、Weaviate 与 Chroma 这类专门引擎:它们使用近似索引,用一点召回率换取极大的提速。

哪些向量数据库有免费层级?

到 2026 年四者都有,这在一年前还不成立。Qdrant Cloud 有永久免费节点,含 0.5 vCPU、1 GB 内存与 4 GB 磁盘。Pinecone Starter 免费,含 2 GB 存储、每月 200 万写入单元与 100 万读取单元。Weaviate 于 2026 年 6 月 17 日推出免信用卡、不过期的免费层级,含 10 万个对象、1 GB 内存与 10 GB 磁盘。Chroma Cloud Starter 每月 0 美元加用量并附 5 美元额度,那是余额而非常设额度。

做 RAG 时 Pinecone 比 Weaviate 更好吗?

两者都不是普遍更好。Pinecone 拥有更成熟的托管无服务器产品且没有自托管版本,因此选择它意味着对该引擎的承诺。Weaviate 在自托管与托管上提供同一个引擎,为你留下双向的迁移路径,并且混合检索更成熟。如果你买的是运维简单,选 Pinecone;如果技术内容上的检索质量要紧,或者你想保留日后转向自有硬件的选项,选 Weaviate。

100 万条向量的向量数据库要花多少钱?

按 2026 年 8 月的标价,在这个规模上托管层级在超额之前通常约为每月 45 到 70 美元,而在一台小机器上自托管的基础设施成本为每月 40 到 60 美元,外加每月两到五小时的运维时间。一旦按现实的工程费率给这些小时计价,十二个月下来托管通常更便宜——见上文完整的对比表。

Qdrant 和 Weaviate 是一回事吗?

不是。它们是架构与查询接口都不同的两个独立开源项目。Qdrant 用 Rust 编写,在 REST 与 gRPC 之上有自己的 API;Weaviate 用 Go 编写,以其 GraphQL 接口著称。两者都支持混合检索,也都能自托管或托管运行,但为其中一个写的查询不经重写无法移植到另一个。Qdrant 占用更小、过滤更强;Weaviate 混合检索更成熟,并内置向量化模块。

如何从 Chroma 迁移到 Qdrant?

用 Chroma 的 Python 客户端通过 `collection.get(include=["embeddings","metadatas","documents"])` 导出集合,然后用 Qdrant 客户端的 `upsert` 方法把向量与负载批量写入新的 Qdrant 集合,并确保两边的距离度量一致——余弦、点积或欧氏。如果你构建在 LangChain 或 LlamaIndex 之上,两者都对向量存储做了抽象,因此更换后端在很大程度上就是改配置加一次重建索引。

这些厂商有联盟计划吗?

Pinecone 有。其合作伙伴页面列出了面向内容创作者与教育者的联盟计划,他们可因展示 Pinecone 的内容获得佣金,与技术、解决方案、推荐三类伙伴并列。我们没有找到 Qdrant、Weaviate 或 Chroma 的同类公开计划,它们列出的是面向企业的技术与经销合作。PromptQuorum 未加入 Pinecone 的计划,也不从本页任何链接中获得收益——这值得直说,因为这是唯一存在此类计划的品类,而它并不是我们首先推荐的选项。

Chroma 能用于生产,还是只适合做原型?

它被用于中小型 RAG 应用的生产环境,而其 Rust 内核让这个选择比它的 Python 出身所暗示的更为合理。约束在于规模:请在深入数百万向量之前规划迁移到 Qdrant 或 Weaviate,而不是在延迟事故之后。如果你想要同样的模式但由别人托管,Chroma Cloud 也在,从每月 0 美元加用量起步。

最终结论

  • 选 Qdrant,如果你想要最好的性价比,以及一个自托管或托管都能跑的引擎——下一步:从永久免费的云层级开始,等 4 GB 不够用时再升到 Standard,而不是先去开一台机器。
  • 选 Pinecone,如果你想要零基础设施工作并接受被引擎绑定——下一步:从每月 20 美元的 Builder 开始,升到 Standard 之前先测算读写单元用量。
  • 选 Weaviate,如果混合检索是检索的核心——下一步:在免费层级上评估,自 2026 年 6 月起它分文不花且不会过期。
  • 选 Chroma,如果你在做原型且想今天就让检索跑起来——下一步:`pip install chromadb`,并按自己的节奏规划迁移到 Qdrant 或 Weaviate。
  • 四个都跳过,如果你的向量少于约 1 万条——下一步:用你已经在跑的 Postgres 里的 pgvector,等延迟或带过滤的检索真正逼你出手时再重新评估。

资料来源

关于第三方事实的说明

本文引用了第三方AI模型、基准测试、价格和许可证。AI领域变化迅速。基准分数、许可条款、模型名称和API价格可能在写作时间和您阅读时之间发生变化。在根据本文做出部署或合规决策之前,请在每个提供商的官方来源核实当前数据:Hugging Face模型卡用于许可证和基准测试,提供商网站用于API定价,EUR-Lex用于当前GDPR和EU AI法案文本。

使用本地LLM、您自己的API密钥或两者运行PromptQuorum — 您来决定使用哪个后端。

下载 PromptQuorum 测试版 →

← 返回本地LLM