关键要点
- Qdrant——GitHub 星标 34,242,Apache-2.0,用 Rust 编写。Qdrant Cloud 有永久免费层级,含 0.5 vCPU、1 GB 内存与 4 GB 磁盘;Standard 按用量计费,承诺 99.5% 可用性,且不收固定平台费;Premium 增加 SSO 与私有 VPC 链路,承诺 99.9% 并设有最低消费。
- Pinecone——设计上仅限云端,完全没有自托管版本。Starter 免费,含 2 GB 存储、每月 200 万写入单元与 100 万读取单元。Builder 每月 20 美元固定价,含 10 GB、500 万写入与 200 万读取。Standard 从每月最低 50 美元起后按用量计费,Enterprise 从每月最低 500 美元起,增加 99.95% 可用性承诺、BYOC、HIPAA 与审计日志。
- Weaviate——16,758 星标,BSD-3-Clause,用 Go 编写。本页最重要的更正: Weaviate Cloud 已不再是 14 天沙箱。2026 年 6 月 17 日,它推出了真正免费的层级,免信用卡、不过期:10 万个对象、1 GB 内存与 10 GB 磁盘。那些仍在建议读者从第一天起预留每月 45 美元的对比文章,正把人送去为如今免费的东西付费。
- Weaviate 的付费价格也变了。 现行定价页列出的是 Flex 每月 45 美元起、Premium 每月 400 美元起。2025 年 10 月定价更新中宣布的每月 280 美元 Plus 层级已不在页面上,因此请引用 Flex 与 Premium,而不是旧的三层结构。
- Chroma——29,174 星标,Apache-2.0,如今是 Rust 内核,而非起步时的 Python 引擎。它是四者中唯一无需服务器、在进程内运行的,这也正是它在原型开发上胜出的原因。
- Chroma Cloud 同样存在,这一点多数同类对比完全遗漏:Starter 每月 0 美元加用量,附 5 美元初始额度;Team 每月 250 美元加用量;用量计价为每写入 1 GiB 2.50 美元、每存储 1 GiB 每月 0.33 美元、每查询 1 TiB 0.0075 美元、每返回 1 GiB 0.09 美元。因此这里有四个托管选项,而非三个。
- 四者现在都有免费层级,这在一年前还不成立,也是判断你正在读的对比是否更新过的最快方法。
- 一句需要直说的披露: Pinecone 确实为内容创作者运营着联盟计划,其合作伙伴页面可以佐证。PromptQuorum 未加入该计划,也不从本页任何链接中获得收益。这是本系列中唯一存在此类计划的品类,而这恰恰是上面推荐 Qdrant 而非 Pinecone 的原因。
🏆 适合你的最佳选择
结构性的问题是:你自己运维引擎,还是租用它?这取决于你稀缺的是工程小时还是预算。 从上往下读,停在第一条符合你情况的。
- 你有一些运维余力,且想要最好的性价比 → Qdrant,自托管或用 Qdrant Cloud。开源引擎中资源占用最低,也是三者中社区最大的。
- 你想要零基础设施工作,并愿意为此付费 → Pinecone。最成熟的无服务器产品,而每月 20 美元固定价的 Builder 是一个真正的方案,不是试用。
- 召回精度取决于字面匹配与语义匹配的结合 → Weaviate。原生的 BM25 加向量是这里最成熟的混合实现,而且免费层级如今评估起来分文不花。
- 你在 notebook 里做原型,不想要服务器 → Chroma。它在你的 Python 进程中运行,因此在检索跑通之前没有任何东西需要预置。
- 数据必须留在你自己掌控的硬件上 → 自托管 Qdrant、Weaviate 或 Chroma。Pinecone 没有自托管版本,因此在 BYOC 的 Enterprise 之外无法满足硬性的数据驻留要求。
- 你的向量少于约 1 万条 → 一个都不用。Postgres 上的 pgvector 足以覆盖这一规模,既不必多运维一个服务,也省得为一个用不上的负载去学新的查询 API。
向量数据库到底是什么
向量数据库存储嵌入模型生成的高维数值向量,并对其回答最近邻查询,而这正是任何 RAG 流水线核心的检索环节。 你交给它一个查询向量,它返回距离最近的已存向量,通常还附带原文与元数据。
普通数据库技术上也能做,但一到规模就撑不住,因为对数百万条高维向量做精确最近邻搜索代价高昂。这些引擎使用近似索引——四者都是 HNSW——用一点召回率换取极大的提速。这个取舍就是这个品类存在的全部理由。
实际后果是,这四者之间有意思的差别不是「能不能找到相似向量」——它们都能。差别在于元数据过滤与向量索引的配合程度、混合检索的成熟度、在你的量级上要花多少钱,以及你能否自己运行它。关于围绕它的整条流水线,见构建本地 RAG。
📍 简单一句话
向量数据库存储嵌入模型生成的高维向量,并对其回答最近邻查询,这正是 RAG 流水线核心的检索环节。
💬 简单来说
它是搜索含义而非词语的引擎。你给它一段转成数字的文本,它返回数字最接近的那些已存条目——实际上就是意思大致相同的段落。
Qdrant、Pinecone、Weaviate 与 Chroma 对比
四者优化的是不同的约束——资源占用、运维简单度、检索质量或首次查询的时间——而不是逐项功能对拼。 价格于 2026 年 8 月 28 日从各厂商定价页读取,仓库数据同日取自 GitHub API。
| 维度 | Qdrant | Pinecone | Weaviate | Chroma |
|---|---|---|---|---|
| GitHub 星标 | 34,242 | 非开源 | 16,758 | 29,174 |
| 许可证 | Apache-2.0 | 专有 | BSD-3-Clause | Apache-2.0 |
| 实现语言 | Rust | 未公开 | Go | Rust 内核 |
| 可自托管 | 可以,免费 | 不可,仅云端 | 可以,免费 | 可以,免费 |
| 进程内运行 | 否,服务端 | 否,托管 | 否,服务端 | 是 |
| 云端免费层级 | 0.5 vCPU、1 GB、4 GB | 2 GB、200万写、100万读 | 10万对象、1 GB、10 GB | 每月 0 美元加 5 美元额度 |
| 付费起点 | 按用量,无固定费 | Builder 每月 20 美元固定 | Flex 每月 45 美元起 | Team 每月 250 美元加用量 |
| 混合检索 | 原生,稀疏加稠密 | 支持 | 原生 BM25,最成熟 | 较新,完整度较低 |
| 入门层级 SLA | Standard 99.5% | 仅 Enterprise,99.95% | Flex 99.5% | Enterprise 以下未公布 |
| 联盟计划 | 未发现 | 有,我们未参与 | 未发现 | 未发现 |
⚠️Warning: 这里有两行与多数仍在流传的对比相抵触。自 2026 年 6 月 17 日起,Weaviate 拥有不过期的免费层级,而非 14 天沙箱。并且 Chroma 有托管云产品,因此这个品类有四个托管选项,而不是通常列出的三个。
自托管还是托管云
自托管给你成本控制与数据驻留,同时把可用性、备份与扩容交到你手上;托管云再把这些卖回给你。 坦率地说,金钱上的差距比多数团队预想的小,时间上的差距则更大。
一台普通机器上的单节点 Qdrant 或 Weaviate,跑一百万条向量的基础设施成本约为每月 40 到 80 美元。同等规模下,托管版本落在相近区间。真正把两者分开的,是每月有人花在打补丁、监控、从失败部署中恢复、以及磁盘写满时被叫醒上的两到五个小时。按你团队真实的时薪计价,这个比较通常会反转。
自托管明显胜出的场景,主要不是钱的问题。它们是数据驻留、隔离或本地部署的要求,以及高到让按量计费超过固定机器的用量。托管明显胜出的场景,是没有富余工程师的小团队——在那里,不付费的替代方案不是省钱,而是更晚上线。
💡Tip: Pinecone 是这里唯一没有自托管退路的选项,这是迁移层面的考量而非缺陷。离开 Weaviate 或 Qdrant Cloud 只是改变同一个引擎的运行位置;离开 Pinecone 则意味着更换引擎并重写查询。
Qdrant:默认之选
把 Qdrant 推荐给多数团队,是因为它在开源引擎中资源占用最低、社区在三者中最大,而且云层级是无限期免费而非试用窗口。 它对你如何组织数据的意见也最少。
Qdrant——综合最优
34,242 星标,Apache-2.0,Rust,永久免费云层级
Qdrant 用 Rust 编写,这表现为在同等负载下内存与 CPU 占用小于源自 Go 和 Python 的替代品,而这份占用正是它在单节点上能走得更远的实际原因。它的过滤是这里最强的:元数据条件在 HNSW 遍历过程中施加,而不是事后再过滤结果,因此重度过滤的查询不会悄悄退化成扫描。混合检索通过与稠密向量并列的稀疏向量原生支持。云端定价是四者中最清爽的:一个含 0.5 vCPU、1 GB 内存与 4 GB 磁盘的免费层级,永久有效而非限时;一个按 vCPU、内存与存储的实际消耗计费的 Standard 层级,承诺 99.5% 可用性,且上面不再叠加固定平台费;以及一个增加 SSO 与私有 VPC 链路的 Premium 层级,承诺 99.9% 并设有最低消费。没有平台费正是它成为成本敏感之选的原因:你为资源付钱,而不是为「成为客户」这件事付钱。
优点
- +开源引擎中资源占用最低,单节点因此能走得更远
- +过滤在索引遍历过程中施加而非事后进行,带过滤的查询依然快
- +永久免费的云层级而非试用,Standard 按用量计费且无固定费
- +Apache-2.0,34,242 星标是这里最大的社区,自托管与托管是同一个引擎
缺点
- –使用自有查询语言而非 SQL 或 GraphQL,因此存在学习曲线
- –内置的向量化模块比 Weaviate 少——嵌入流水线要你自己带
- –占用再小,自托管仍意味着要运行并监控一台服务器
Pinecone:零运维之选
Pinecone 是这里最成熟的托管产品,也是唯一完全没有自托管版本的,这既是它最强的特性,也是最大的绑定。 你买的是「不存在运维工作」这件事。
Pinecone——想要零基础设施工作时最优
仅云端的无服务器,Starter 免费,Builder 每月 20 美元固定价
Pinecone 从一开始就是托管产品,而不是给开源引擎加挂托管,这一点在上手时就能看出来:没有容量规划,没有索引尺寸设定,首次查询之前没有任何东西需要预置。对于没有向量数据库经验的团队,这是真实的优势而非营销说辞。方案包括:Starter 免费,含 2 GB 存储、每月 200 万写入单元与 100 万读取单元,外加 1 GB 出站;Builder 每月 20 美元固定价,含 10 GB、500 万写入、200 万读取与 10 GB 出站;Standard 从每月最低 50 美元起后按量计费,增加专用读节点、备份与恢复、RBAC 与 SAML 单点登录;Enterprise 从每月最低 500 美元起,增加 99.95% 可用性承诺、自带云、私有端点、客户自管加密密钥、审计日志、SCIM 与 HIPAA 合规。Builder 值得单独一提,因为在这个品类里,一个带有真实额度的 20 美元固定方案并不常见,也消除了个人项目上对 Pinecone 的主要顾虑。
优点
- +这里最成熟的无服务器体验,没有东西需要预置或设定尺寸
- +Builder 每月 20 美元固定价是一次真正很小的投入,额度也够用
- +Enterprise 的合规能力是实打实的:HIPAA、BYOC、客户自管密钥、审计日志与 SCIM
- +超出最低额后按量计费,低流量应用因此保持便宜
缺点
- –没有自托管版本,离开意味着更换引擎而不是搬迁一套部署
- –硬性的数据驻留要求只能通过每月 500 美元起的 Enterprise 与 BYOC 满足
- –读写单元的消耗容易低估,账单可能出乎意料
Weaviate:混合检索之选
Weaviate 拥有四者中最成熟的混合检索,而且自 2026 年 6 月起还有一个不过期的免费层级——这让多数对比至今给出的建议失效。 如果检索质量是你的瓶颈,先看这里。
Weaviate——混合检索要紧时最优
16,758 星标,BSD-3-Clause,Go,自 2026 年 6 月起免费层级不过期
Weaviate 在查询 API 中原生地把 BM25 关键词打分与向量相似度结合起来,而且做这件事的时间比其他产品都长,这体现在你对混合方式能有多少控制上。这比听起来更重要:纯语义检索会稳定地漏掉精确的产品编码、型号、错误串与缩写,因为这些词元的含义就是其字面形式。Weaviate 还附带向量化模块,可代你调用嵌入服务商,于是嵌入由数据库承担而不是你的应用。在价格方面,重要的事实是新近的:2026 年 6 月 17 日,Weaviate 推出了免信用卡、不过期的免费层级,提供 10 万个对象、1 GB 内存与 10 GB 磁盘。它取代了对比文章仍在描述的 14 天沙箱。现行页面上的付费方案是按量付费、承诺 99.5% 可用性的 Flex 每月 45 美元起,以及共享或专属部署的 Premium 每月 400 美元起;2025 年 10 月公告中每月 280 美元的 Plus 层级已不在其上。
优点
- +这里最成熟的混合检索,对关键词与向量的配比有真正的控制
- +自 2026 年 6 月起免费层级不过期且免信用卡:10 万对象、1 GB 内存、10 GB 磁盘
- +内置的向量化模块让数据库而非应用来承担嵌入
- +自托管与托管是同一个引擎,因此双向都有迁移路径
缺点
- –需要预先定义 schema,是三个开源引擎中搭建最重的一个
- –同等负载下资源占用高于 Qdrant
- –价格在不到一年里变了两次,因此请核对当前页面而不要相信某篇对比
Chroma:原型开发之选
Chroma 是四者中唯一无需服务器、在你的 Python 进程内运行的,因此它是从零到检索跑通的最短路径。 它按设计比其他三者窄,并且对此很坦诚。
Chroma——原型开发与中小负载最优
29,174 星标,Apache-2.0,Rust 内核,`pip install chromadb` 即可运行
Chroma 用 pip 安装并以嵌入方式运行,因此一个 notebook 可以用几行代码就拥有可用的语义检索,不需要容器、端口或配置。这一条特性就解释了它为何主导教程与原型,而这是真实的工程优势而非新手拐杖:能在没有基础设施的情况下测试检索逻辑,会明显缩短迭代循环。引擎内核已用 Rust 重写,因此性能表现好于它的 Python 出身所暗示的,尽管元数据过滤仍比 Qdrant 简单,混合检索也更新、更不完整。Chroma Cloud 同样存在,而多数同类对比略过了它:Starter 每月 0 美元加用量,附 5 美元额度与 10 个数据库;Team 每月 250 美元加用量,含 100 个数据库与专属 Slack 支持;Enterprise 增加单租户或自带云集群。用量计价为每写入 1 GiB 2.50 美元、每存储 1 GiB 每月 0.33 美元、每查询 1 TiB 0.0075 美元、每返回 1 GiB 0.09 美元。
优点
- +无需服务器、在进程内运行,因此开始时没有东西需要预置
- +四者中最容易上手,也是教程与示例中最常见的
- +如今是 Rust 内核,性能好于其 Python 出身所暗示的
- +Chroma Cloud 从每月 0 美元加用量起步,转向托管不必一步跨到月费
缺点
- –元数据过滤比 Qdrant 简单,混合检索是这里完整度最低的
- –不是用来扩到数千万向量的引擎——要在那之前迁移,而不是之后
- –让它易用的嵌入式模型,也意味着它默认不是多租户服务端
四者现在都有免费层级
自 2026 年 6 月起,四家厂商都提供了以零成本运行真实负载的途径,这也是判断你正在读的对比今年是否更新过的最快方法。 一篇告诉你 Weaviate 只给 14 天沙箱的指南,描述的是 2026 年 6 月 17 日就已结束的世界。
这四份免费方案在形态上确实不同,而这比「它们存在」这件事更重要。Qdrant Cloud 给你一个持久的单节点集群,含 0.5 vCPU、1 GB 内存与 4 GB 磁盘,永久免费——一台留在你手上的小机器。Pinecone Starter 免费,含 2 GB 存储以及每月 200 万写入单元与 100 万读取单元的计量额度——容量加上吞吐预算。Weaviate 的免费方案给出 10 万个对象、1 GB 内存与 10 GB 磁盘,免信用卡且不过期——磁盘上最慷慨的一份。Chroma Cloud Starter 每月 0 美元加用量并附 5 美元额度,那是余额而非常设额度,在负载之下终会用尽。
请对照你的负载来读,而不是互相比较。如果你存得多、查得少,Weaviate 的 10 GB 是这里最强的一份。如果你对着一个小语料不停查询,Pinecone 的读取单元额度就比谁的磁盘数字都更要紧。
⚠️Warning: Chroma Cloud 的「每月 0 美元」与其他三者的免费不是一回事。它是一个附带 5 美元初始额度的按量计价方案,因此是用完额度之前免费,而非持续免费。另外三者都有会重置或长期保持的常设额度。
100 万向量的 12 个月成本
对于一百万条 1,536 维向量——大致相当于 OpenAI 嵌入规模的语料——自托管与托管的基础设施成本足够接近,以至于决定权落在运维时间上。 下面的数字假设在一台每月 40 到 80 美元、4 vCPU 与 16 GB 内存的机器上做单节点部署,对比各厂商能从容承载同等负载的最低层级。
| 方案 | 每月基础设施 | 每月运维小时 | 运维成本(75 美元/小时) | 12 个月合计 |
|---|---|---|---|---|
| Qdrant 自托管 | 约 60 美元 | 2–4 | 150–300 美元 | 约 2,520–4,320 美元 |
| Weaviate 自托管 | 约 60 美元 | 3–5 | 225–375 美元 | 约 3,420–5,220 美元 |
| Chroma 自托管 | 约 40 美元 | 2–3 | 150–225 美元 | 约 2,280–3,180 美元 |
| Pinecone Standard | 最低 50 美元加用量 | 0.5–1 | 38–75 美元 | 约 1,060–1,500 美元 |
| Weaviate Cloud Flex | 最低 45 美元加用量 | 0.5–1 | 38–75 美元 | 约 996–1,440 美元 |
| Qdrant Cloud Standard | 估计 40–70 美元 | 0.5–1 | 38–75 美元 | 约 936–1,740 美元 |
在一百万向量的量级上,通常是运维那一行决定结果,而非标价。当驻留或用量提出要求时就自托管;否则一旦把自己的工时诚实计价,托管层级会更便宜。
📌Note: 这些是依据 2026 年 8 月 28 日常见的机器价格与厂商标价建模的估算,不是实测的生产账单。Pinecone、Qdrant Cloud 与 Chroma Cloud 的按量成本随查询量浮动,因此在做决定前,请把你预期的读写量放进各厂商的计算器跑一遍。
混合检索与框架支持
四者都能接入 LangChain 与 LlamaIndex,因此框架问题基本已定;真正拉开差距的是混合检索。 混合检索把通常为 BM25 的关键词打分与向量相似度混合起来,它之所以存在,是因为纯语义检索有一个具体且可预测的失效模式。
这个失效模式就是精确词元。产品编码、型号、错误串、版本标识与缩写的含义就是其字面形式,而「ERR_4021」的嵌入会更靠近其他错误串的嵌入,而不是记载这一条的那段文字。关键词匹配轻松就能命中,语义检索则不然——这也是为何把两者混合,对技术语料检索精度的提升,远大于去调嵌入模型。
Weaviate 的实现最成熟,BM25 与向量打分在查询 API 中结合,并对权重有真正的控制。Qdrant 通过与稠密向量并列的原生稀疏向量支持达到同一位置,在架构上更干净,能力也大致相当。Pinecone 在其稀疏与稠密索引类型上支持这一点。Chroma 的实现最新也最不完整,是在把它放进上线关键路径之前,需要拿你自己的查询去衡量的那一个。
谁该用哪一个
决定这件事的是团队规模、运维余力与驻留要求,而不是基准测试表格。 六种画像基本覆盖了大多数读者。
- 独立开发者或个人 RAG 项目 → 嵌入式 Chroma。没有服务器,没有月费,检索与你的应用跑在同一个进程里。
- 尚未招运维、跑得很快的小团队 → 每月 20 美元的 Pinecone Builder,或者如果你预计以后要自托管,就用 Qdrant Cloud 的免费层级。
- 有运维余力、要在规模上优化成本的团队 → Qdrant,自托管或用 Standard。按用量计费且无平台费,坦白说是最便宜的路。
- 技术语料上检索质量是瓶颈的团队 → Weaviate,在如今免费的层级上评估,看中的是它混合检索的成熟度。
- 隐私优先或受监管、有驻留要求的团队 → 自托管 Qdrant 或 Weaviate。Pinecone 只能通过每月 500 美元起的 Enterprise 与 BYOC 来满足。
- 低于约 1 万条向量 → Postgres 上的 pgvector。在这里加一个专门引擎,是在没有检索收益的情况下增加运维成本。
欧盟、日本与中国的向量数据库
向量存储里装着你源文档的嵌入,而且在几乎任何部署中,原文本身也作为负载一并存入。这让「托管还是自托管」在三个重要市场变成了数据保护问题。
这些情况可以跳过
如果你的向量少于约 1 万条,就跳过这四个,改用 Postgres 上的 pgvector。 在这个规模上,精确最近邻的全量扫描在毫秒内就能完成,因此那个用来正当化专门引擎的近似索引,解决的是你没有的问题。如果你本来就在跑 Postgres,pgvector 增加的是一个列类型和一个索引,而不是一个服务,并且你的向量与它们所描述的行处在同一个事务里——这悄悄消除了一整类「索引与源数据不一致」的问题。
对于完全没有数据库服务端的应用,配合 `sqlite-vec` 的 SQLite 覆盖同样的范围。而如果你的嵌入是静态且很少变动的,一个提交进仓库的 FAISS 索引比上面这一切都简单:没有服务,没有 schema,没有迁移。
值得等待的门槛很具体:数十万量级的向量、顺序扫描已经掩盖不住的查询延迟,或者需要与相似度检索相配合而非在其之后运行的元数据过滤。在那之前就搭起专门引擎,等于为一个现有数据库已经能处理的问题去运维一个服务。
💡Tip: 一个有用的触发点:当一次检索查询第一次慢到用户能察觉时,或者当你第一次需要带过滤的相似度检索、而现有搭配逼你在过滤与排序之间二选一时,就换到专门引擎。
挑选向量数据库时的常见误区
- 1以为 Weaviate 只提供 14 天沙箱
Why it matters: Weaviate 于 2026 年 6 月 17 日推出了免信用卡、不过期的免费层级,含 10 万个对象、1 GB 内存与 10 GB 磁盘。仍在建议从第一天起预留每月 45 美元的对比文章,正把读者送去为如今免费的东西付费,而这是目前这个品类里最常见的过时说法。 - 2把 Chroma 当作只能嵌入式使用,从而错过 Chroma Cloud
Why it matters: Chroma Cloud 有每月 0 美元加用量并附 5 美元额度的 Starter,以及每月 250 美元的 Team。多数对比在实有四个托管选项时只列出三个,这会让那些喜欢 Chroma 模式、却以为「转向托管就等于离开它」的团队得出扭曲的结论。 - 3因为名字最常被提到就选 Pinecone
Why it matters: Pinecone 是这个品类里推广力度最大的选项,并且为内容创作者运营着真实的联盟计划,这意味着推荐它的内容体量与商业激励并非无关。作为零运维选项它确实最好;但它并不自动是最好或最便宜的匹配,而且是唯一你无法自托管的。 - 4只拿机器费用来核算自托管
Why it matters: 团队把一台 60 美元的机器与 50 美元的托管方案相比,得出自托管更便宜的结论,却忽略了每月两到五小时的打补丁、监控与备份校验。按任何现实的工程费率计算,这段时间都超过价格差——这正是上面十二个月的表格会反转朴素比较的原因。 - 5为不足 1 万条向量的项目搭起专门引擎
Why it matters: 在这个规模上,你现有 Postgres 里的 pgvector 就能回答同样的查询,不必新增任何服务,还能让向量与其描述的行在事务上保持一致。在这里加一个专门引擎,买到的是运维成本和一套新的查询 API,却没有任何检索上的收益。
常见问题
什么是向量数据库?
向量数据库存储嵌入模型生成的高维数值向量,并对其回答最近邻查询,这正是 RAG 流水线核心的检索环节。普通数据库并未针对数百万条高维向量的相似度检索做优化,因此才有 Qdrant、Pinecone、Weaviate 与 Chroma 这类专门引擎:它们使用近似索引,用一点召回率换取极大的提速。
哪些向量数据库有免费层级?
到 2026 年四者都有,这在一年前还不成立。Qdrant Cloud 有永久免费节点,含 0.5 vCPU、1 GB 内存与 4 GB 磁盘。Pinecone Starter 免费,含 2 GB 存储、每月 200 万写入单元与 100 万读取单元。Weaviate 于 2026 年 6 月 17 日推出免信用卡、不过期的免费层级,含 10 万个对象、1 GB 内存与 10 GB 磁盘。Chroma Cloud Starter 每月 0 美元加用量并附 5 美元额度,那是余额而非常设额度。
做 RAG 时 Pinecone 比 Weaviate 更好吗?
两者都不是普遍更好。Pinecone 拥有更成熟的托管无服务器产品且没有自托管版本,因此选择它意味着对该引擎的承诺。Weaviate 在自托管与托管上提供同一个引擎,为你留下双向的迁移路径,并且混合检索更成熟。如果你买的是运维简单,选 Pinecone;如果技术内容上的检索质量要紧,或者你想保留日后转向自有硬件的选项,选 Weaviate。
100 万条向量的向量数据库要花多少钱?
按 2026 年 8 月的标价,在这个规模上托管层级在超额之前通常约为每月 45 到 70 美元,而在一台小机器上自托管的基础设施成本为每月 40 到 60 美元,外加每月两到五小时的运维时间。一旦按现实的工程费率给这些小时计价,十二个月下来托管通常更便宜——见上文完整的对比表。
Qdrant 和 Weaviate 是一回事吗?
不是。它们是架构与查询接口都不同的两个独立开源项目。Qdrant 用 Rust 编写,在 REST 与 gRPC 之上有自己的 API;Weaviate 用 Go 编写,以其 GraphQL 接口著称。两者都支持混合检索,也都能自托管或托管运行,但为其中一个写的查询不经重写无法移植到另一个。Qdrant 占用更小、过滤更强;Weaviate 混合检索更成熟,并内置向量化模块。
如何从 Chroma 迁移到 Qdrant?
用 Chroma 的 Python 客户端通过 `collection.get(include=["embeddings","metadatas","documents"])` 导出集合,然后用 Qdrant 客户端的 `upsert` 方法把向量与负载批量写入新的 Qdrant 集合,并确保两边的距离度量一致——余弦、点积或欧氏。如果你构建在 LangChain 或 LlamaIndex 之上,两者都对向量存储做了抽象,因此更换后端在很大程度上就是改配置加一次重建索引。
这些厂商有联盟计划吗?
Pinecone 有。其合作伙伴页面列出了面向内容创作者与教育者的联盟计划,他们可因展示 Pinecone 的内容获得佣金,与技术、解决方案、推荐三类伙伴并列。我们没有找到 Qdrant、Weaviate 或 Chroma 的同类公开计划,它们列出的是面向企业的技术与经销合作。PromptQuorum 未加入 Pinecone 的计划,也不从本页任何链接中获得收益——这值得直说,因为这是唯一存在此类计划的品类,而它并不是我们首先推荐的选项。
Chroma 能用于生产,还是只适合做原型?
它被用于中小型 RAG 应用的生产环境,而其 Rust 内核让这个选择比它的 Python 出身所暗示的更为合理。约束在于规模:请在深入数百万向量之前规划迁移到 Qdrant 或 Weaviate,而不是在延迟事故之后。如果你想要同样的模式但由别人托管,Chroma Cloud 也在,从每月 0 美元加用量起步。
最终结论
- 选 Qdrant,如果你想要最好的性价比,以及一个自托管或托管都能跑的引擎——下一步:从永久免费的云层级开始,等 4 GB 不够用时再升到 Standard,而不是先去开一台机器。
- 选 Pinecone,如果你想要零基础设施工作并接受被引擎绑定——下一步:从每月 20 美元的 Builder 开始,升到 Standard 之前先测算读写单元用量。
- 选 Weaviate,如果混合检索是检索的核心——下一步:在免费层级上评估,自 2026 年 6 月起它分文不花且不会过期。
- 选 Chroma,如果你在做原型且想今天就让检索跑起来——下一步:`pip install chromadb`,并按自己的节奏规划迁移到 Qdrant 或 Weaviate。
- 四个都跳过,如果你的向量少于约 1 万条——下一步:用你已经在跑的 Postgres 里的 pgvector,等延迟或带过滤的检索真正逼你出手时再重新评估。