Key Takeaways
- Qdrant — GitHub 스타 34,242개, Apache-2.0, Rust로 작성. Qdrant Cloud에는 0.5 vCPU, 1GB RAM, 4GB 디스크의 영구 무료 등급이 있습니다. Standard는 실사용량 기준으로 과금되며 99.5% 가동률을 보장하고 정액 플랫폼 요금이 없습니다. Premium은 SSO와 프라이빗 VPC 링크를 더해 99.9%와 최소 지출액이 붙습니다.
- Pinecone — 설계상 클라우드 전용이며 자체 호스팅 버전이 전혀 없습니다. Starter는 무료로 스토리지 2GB, 월 200만 쓰기 단위와 100만 읽기 단위를 제공합니다. Builder는 월 20달러 정액에 10GB, 쓰기 500만, 읽기 200만입니다. Standard는 월 최소 50달러에서 시작해 이후 사용량 과금이며, Enterprise는 월 최소 500달러로 99.95% 가동률 보장, BYOC, HIPAA, 감사 로그가 더해집니다.
- Weaviate — 스타 16,758개, BSD-3-Clause, Go로 작성. 이 페이지에서 가장 중요한 정정: Weaviate Cloud는 더 이상 14일 샌드박스가 아닙니다. 2026년 6월 17일, 신용카드 없이 만료도 없는 진짜 무료 등급이 출시됐습니다. 객체 10만 개, 메모리 1GB, 디스크 10GB입니다. 여전히 첫날부터 월 45달러를 잡아두라고 조언하는 비교 글은, 이제 무료인 것에 독자가 돈을 내게 만들고 있습니다.
- Weaviate의 유료 가격도 바뀌었습니다. 현행 요금 페이지는 Flex 월 45달러부터, Premium 월 400달러부터를 싣고 있습니다. 2025년 10월 가격 개편에서 발표된 월 280달러 Plus 등급은 그곳에 더 이상 없으므로, 예전 3단 구조 대신 Flex와 Premium을 인용하세요.
- Chroma — 스타 29,174개, Apache-2.0, 그리고 출발점이던 파이썬 엔진이 아니라 이제 Rust 코어입니다. 넷 중 유일하게 서버 없이 프로세스 안에서 돌아가며, 프로토타이핑에서 이기는 이유가 바로 그것입니다.
- Chroma Cloud도 있습니다. 이 분야 비교 글 대부분이 통째로 놓치는 부분입니다. Starter는 월 0달러에 사용량 과금이며 초기 크레딧 5달러가 붙고, Team은 월 250달러에 사용량 과금이며, 사용량은 쓰기 1GiB당 2.50달러, 저장 1GiB당 월 0.33달러, 조회 1TiB당 0.0075달러, 반환 1GiB당 0.09달러입니다. 즉 여기 매니지드 선택지는 셋이 아니라 넷입니다.
- 이제 넷 다 무료 등급이 있습니다. 1년 전에는 사실이 아니었고, 지금 읽고 있는 비교 글이 갱신됐는지 확인하는 가장 빠른 방법이기도 합니다.
- 분명히 밝혀둘 것: Pinecone은 실제로 콘텐츠 제작자를 위한 제휴 프로그램을 운영하며, 자사 파트너 페이지에서 확인됩니다. PromptQuorum은 여기에 가입하지 않았고 이 페이지의 어떤 링크로도 수익을 얻지 않습니다. 이 시리즈에서 그런 프로그램이 존재하는 유일한 분야이며, 바로 그래서 위의 추천이 Pinecone이 아니라 Qdrant입니다.
🏆 상황별 최적의 선택
구조적인 질문은 엔진을 직접 운영할 것인가 빌릴 것인가이며, 이는 무엇이 희소한지 — 엔지니어링 시간인지 예산인지 — 에 달려 있습니다. 위에서부터 읽다가 자신에게 해당하는 첫 줄에서 멈추세요.
- 운영 여력이 조금 있고 비용 대비 성능이 가장 좋길 원한다 → Qdrant. 자체 호스팅이든 Qdrant Cloud든. 오픈소스 엔진 중 리소스 사용량이 가장 적고, 셋 중 커뮤니티가 가장 큽니다.
- 인프라 작업을 0으로 만들고 그 대가를 낼 생각이다 → Pinecone. 가장 성숙한 서버리스 제품이며, 월 20달러 정액의 Builder는 체험판이 아니라 진짜 요금제입니다.
- 검색 정확도가 글자 그대로의 일치와 의미적 일치의 결합에 달려 있다 → Weaviate. BM25와 벡터의 네이티브 결합은 여기서 가장 성숙한 하이브리드 구현이며, 무료 등급이라 평가에 돈이 들지 않습니다.
- 노트북에서 프로토타입 중이고 서버를 두고 싶지 않다 → Chroma. 파이썬 프로세스 안에서 돌아가므로 검색이 동작하기 전에 준비할 것이 없습니다.
- 데이터가 내가 통제하는 하드웨어에 있어야 한다 → Qdrant, Weaviate, Chroma 중 하나를 자체 호스팅. Pinecone은 자체 호스팅 버전이 없어 BYOC의 Enterprise가 아니면 엄격한 데이터 소재지 요건을 충족할 수 없습니다.
- 벡터가 약 1만 개 미만이다 → 넷 다 필요 없습니다. Postgres의 pgvector가 그 규모를 감당하며, 운영할 서비스를 늘리지 않아도 되고 필요 없는 새 쿼리 API를 배우지 않아도 됩니다.
벡터 데이터베이스란 무엇인가
벡터 데이터베이스는 임베딩 모델이 만들어내는 고차원 수치 임베딩을 저장하고 그에 대한 최근접 이웃 질의에 답합니다. 이것이 모든 RAG 파이프라인의 중심에 있는 검색 단계입니다. 질의 벡터를 건네면 가장 가까운 저장 벡터들이 돌아오며, 보통 원문과 메타데이터가 함께 붙어 옵니다.
일반 데이터베이스도 원리상 가능하지만 규모가 커지면 무너집니다. 수백만 개의 고차원 벡터에 대한 정확한 최근접 이웃 탐색은 비싸기 때문입니다. 이 엔진들은 근사 인덱스 — 넷 다 HNSW — 를 써서 약간의 재현율과 아주 큰 속도를 맞바꿉니다. 이 맞교환이 이 분야가 존재하는 이유 전부입니다.
실무적 귀결은, 넷 사이의 흥미로운 차이가 "비슷한 벡터를 찾을 수 있는가"가 아니라는 점입니다. 그건 넷 다 합니다. 차이는 메타데이터 필터링이 벡터 인덱스와 얼마나 잘 맞물리는지, 하이브리드 검색이 얼마나 성숙했는지, 당신의 규모에서 얼마가 드는지, 그리고 직접 운영할 수 있는지입니다. 이를 둘러싼 파이프라인은 로컬 RAG 구축하기를 보세요.
벡터 데이터베이스는 임베딩 모델이 만들어내는 고차원 임베딩을 저장하고 그에 대한 최근접 이웃 질의에 답하며, 이것이 RAG 파이프라인의 중심에 있는 검색 단계입니다.
단어가 아니라 의미를 찾는 검색 엔진입니다. 숫자로 바꾼 텍스트를 주면 숫자가 가장 가까운 저장 항목들을 돌려주는데, 실제로는 대략 같은 뜻인 문단들이 돌아온다는 뜻입니다.
Qdrant, Pinecone, Weaviate, Chroma 비교
넷은 기능을 정면으로 겨루기보다 리소스 사용량, 운영의 단순함, 검색 품질, 첫 질의까지의 시간이라는 서로 다른 제약을 최적화합니다. 가격은 2026년 8월 28일 각 사 요금 페이지에서 확인했고, 저장소 수치는 같은 날 GitHub API에서 가져왔습니다.
| 항목 | Qdrant | Pinecone | Weaviate | Chroma |
|---|---|---|---|---|
| GitHub 스타 | 34,242 | 오픈소스 아님 | 16,758 | 29,174 |
| 라이선스 | Apache-2.0 | 독점 | BSD-3-Clause | Apache-2.0 |
| 구현 언어 | Rust | 비공개 | Go | 코어는 Rust |
| 자체 호스팅 | 가능, 무료 | 불가, 클라우드 전용 | 가능, 무료 | 가능, 무료 |
| 프로세스 내 실행 | 불가, 서버형 | 불가, 호스팅형 | 불가, 서버형 | 가능 |
| 클라우드 무료 등급 | 0.5 vCPU, 1GB, 4GB | 2GB, 쓰기 200만, 읽기 100만 | 객체 10만, 1GB, 10GB | 월 0달러+크레딧 5달러 |
| 유료 시작가 | 사용량 과금, 정액 없음 | Builder 월 20달러 정액 | Flex 월 45달러부터 | Team 월 250달러+사용량 |
| 하이브리드 검색 | 네이티브, 희소+조밀 | 지원 | BM25 네이티브, 가장 성숙 | 더 최근, 완성도 낮음 |
| 기본 등급 SLA | Standard 99.5% | Enterprise만 99.95% | Flex 99.5% | Enterprise 미만 비공개 |
| 제휴 프로그램 | 확인되지 않음 | 있음, 당사는 미가입 | 확인되지 않음 | 확인되지 않음 |
⚠️Warning: 여기 두 줄은 아직 돌아다니는 대부분의 비교와 어긋납니다. Weaviate는 2026년 6월 17일부터 만료 없는 무료 등급을 갖고 있으며 14일 샌드박스가 아닙니다. 그리고 Chroma에는 매니지드 클라우드 제품이 있어, 이 분야의 매니지드 선택지는 흔히 나열되는 셋이 아니라 넷입니다.
자체 호스팅과 매니지드
자체 호스팅은 비용 통제와 데이터 소재지를 주는 대신 가용성, 백업, 확장을 당신에게 넘깁니다. 매니지드 클라우드는 그것을 되팔죠. 솔직히 말하면 금액 차이는 대부분의 팀이 예상하는 것보다 작고, 시간 차이는 더 큽니다.
평범한 머신 한 대 위의 단일 노드 Qdrant나 Weaviate는 100만 벡터를 인프라 비용 월 40~80달러 정도로 굴립니다. 같은 규모에서 매니지드 쪽도 비슷한 구간에 들어옵니다. 실제로 둘을 가르는 건, 누군가 매달 패치와 모니터링, 잘못된 배포에서의 복구, 디스크가 찼을 때의 호출에 쓰는 2~5시간입니다. 여기에 팀의 실제 시급을 매기면 비교는 대체로 뒤집힙니다.
자체 호스팅이 명확히 이기는 경우는 주로 돈 문제가 아닙니다. 데이터 소재지, 망 분리나 온프레미스 요건, 그리고 사용량 과금이 고정 머신을 앞지를 만큼 높은 트래픽입니다. 매니지드가 명확히 이기는 경우는 여유 엔지니어가 없는 작은 팀이며, 거기서 돈을 안 내는 선택지는 절약이 아니라 늦게 출시하는 것입니다.
💡Tip: Pinecone은 여기서 유일하게 자체 호스팅이라는 퇴로가 없는 선택지이며, 이는 결함이라기보다 이전(移轉)의 문제입니다. Weaviate나 Qdrant Cloud를 떠나는 것은 같은 엔진이 도는 위치를 바꾸는 일이지만, Pinecone을 떠나는 것은 엔진을 바꾸고 쿼리를 다시 쓰는 일입니다.
Qdrant: 기본 선택
대부분의 팀에게 Qdrant를 권하는 이유는 오픈소스 엔진 중 리소스 사용량이 가장 적고, 셋 중 커뮤니티가 가장 크며, 클라우드 등급이 체험 기간이 아니라 무기한 무료이기 때문입니다. 데이터를 어떻게 구성할지에 대한 주장도 가장 적습니다.
Qdrant — 종합 최고
스타 34,242개, Apache-2.0, Rust, 영구 무료 클라우드 등급
Qdrant는 Rust로 작성돼 있고, 이는 같은 부하에서 Go와 파이썬 계보의 대안보다 메모리와 CPU 사용량이 적다는 형태로 드러납니다. 그 사용량이 단일 노드에서 더 멀리 가는 실질적인 이유입니다. 필터링은 여기서 가장 강력한데, 메타데이터 조건을 결과에 사후 적용하는 대신 HNSW 탐색 도중에 적용합니다. 그래서 필터가 강한 질의가 조용히 전체 스캔으로 퇴화하지 않습니다. 하이브리드 검색은 조밀 벡터와 나란한 희소 벡터를 통해 네이티브로 지원됩니다. 클라우드 가격은 넷 중 가장 깔끔합니다. 0.5 vCPU, 1GB RAM, 4GB 디스크의 무료 등급은 기간 제한이 아니라 영구입니다. Standard는 실제 vCPU·메모리·스토리지 소비량 기준으로 과금되고 99.5% 가동률을 보장하며 그 위에 정액 플랫폼 요금이 붙지 않습니다. Premium은 SSO와 프라이빗 VPC 링크를 더해 99.9%와 최소 지출액이 붙습니다. 플랫폼 요금이 없다는 점이 비용에 민감한 선택지가 되는 이유입니다. 고객이라는 자격이 아니라 리소스에 돈을 냅니다.
장점
- +오픈소스 엔진 중 리소스 사용량이 가장 적어 단일 노드가 더 멀리 갑니다
- +필터링을 사후가 아니라 인덱스 탐색 중에 적용하므로 필터링된 질의도 빠릅니다
- +체험이 아니라 영구 무료인 클라우드 등급, Standard는 정액 없이 사용량 과금
- +Apache-2.0에 스타 34,242개로 여기서 가장 큰 커뮤니티, 자체 호스팅과 매니지드가 같은 엔진
단점
- –SQL도 GraphQL도 아닌 자체 쿼리 언어라 학습 곡선이 있습니다
- –Weaviate보다 내장 벡터화 모듈이 적어 임베딩 파이프라인은 직접 가져와야 합니다
- –사용량이 적어도 자체 호스팅인 이상 서버를 운영하고 모니터링해야 합니다
Pinecone: 운영 없는 선택
Pinecone은 여기서 가장 성숙한 매니지드 제품이자 자체 호스팅 버전이 전혀 없는 유일한 제품이며, 이는 최대 강점인 동시에 가장 큰 고정입니다. 당신이 사는 것은 운영 작업이 없다는 사실입니다.
Pinecone — 인프라 작업을 0으로 만들고 싶을 때 최적
클라우드 전용 서버리스, Starter 무료, Builder 월 20달러 정액
Pinecone은 오픈소스 엔진에 호스팅을 덧붙인 것이 아니라 처음부터 매니지드 제품이었고, 그 점이 도입에서 드러납니다. 용량 계획도, 인덱스 크기 산정도, 첫 질의 전에 준비할 것도 없습니다. 벡터 데이터베이스 경험이 없는 팀에게 이것은 마케팅이 아니라 실질적인 이점입니다. 요금제는 이렇습니다. Starter는 무료로 스토리지 2GB, 월 200만 쓰기 단위와 100만 읽기 단위에 아웃바운드 1GB. Builder는 월 20달러 정액에 10GB, 쓰기 500만, 읽기 200만, 아웃바운드 10GB. Standard는 월 최소 50달러에서 시작해 이후 사용량 과금이며 전용 읽기 노드, 백업과 복구, RBAC, SAML SSO가 더해집니다. Enterprise는 월 최소 500달러로 99.95% 가동률 보장, 자체 클라우드 사용, 프라이빗 엔드포인트, 고객 관리 암호화 키, 감사 로그, SCIM, HIPAA 준수가 더해집니다. Builder는 따로 언급할 만합니다. 실사용 가능한 한도를 갖춘 20달러 정액제는 이 분야에서 드물고, 사이드 프로젝트에서 Pinecone에 대한 주된 반론을 없애기 때문입니다.
장점
- +여기서 가장 성숙한 서버리스 경험이며, 준비하거나 크기를 정할 것이 없습니다
- +월 20달러 정액의 Builder는 정말 작은 결단이면서 한도도 쓸 만합니다
- +Enterprise의 컴플라이언스 기능은 실속 있습니다: HIPAA, BYOC, 고객 관리 키, 감사 로그, SCIM
- +최소 금액을 넘는 부분은 사용량 과금이라 트래픽이 적은 앱은 계속 저렴합니다
단점
- –자체 호스팅 버전이 없어 떠나는 것은 배포를 옮기는 게 아니라 엔진을 바꾸는 일입니다
- –엄격한 소재지 요건은 월 500달러부터인 Enterprise와 BYOC로만 충족됩니다
- –읽기·쓰기 단위 소비는 과소평가하기 쉬워 청구서가 예상을 벗어날 수 있습니다
Weaviate: 하이브리드 검색을 위한 선택
Weaviate는 넷 중 가장 성숙한 하이브리드 검색을 갖췄고, 2026년 6월부터는 만료되지 않는 무료 등급도 있습니다. 이는 대부분의 비교 글이 아직도 하고 있는 조언을 무효로 만듭니다. 검색 품질이 병목이라면 여기부터 보세요.
Weaviate — 하이브리드 검색이 중요할 때 최적
스타 16,758개, BSD-3-Clause, Go, 2026년 6월부터 만료 없는 무료 등급
Weaviate는 BM25 키워드 점수와 벡터 유사도를 쿼리 API 안에서 네이티브로 결합하며, 다른 제품들보다 오래 그렇게 해왔습니다. 그 점은 배합을 얼마나 통제할 수 있는지에서 드러납니다. 이는 들리는 것보다 중요합니다. 순수 의미 검색은 제품 코드, 모델 번호, 오류 문자열, 약어 같은 정확한 표현을 안정적으로 놓칩니다. 그런 토큰의 의미는 글자 그대로의 형태이기 때문입니다. Weaviate는 임베딩 제공자를 대신 호출해 주는 벡터화 모듈도 함께 제공해, 애플리케이션이 아니라 데이터베이스가 임베딩을 맡을 수 있습니다. 가격에서 중요한 사실은 최근의 것입니다. 2026년 6월 17일 Weaviate는 신용카드 없이 만료도 없는 무료 등급을 내놨고, 객체 10만 개, 메모리 1GB, 디스크 10GB를 제공합니다. 이것이 비교 글들이 아직 서술하는 14일 샌드박스를 대체했습니다. 현행 페이지의 유료 요금제는 사용량 과금에 99.5% 가동률을 보장하는 Flex가 월 45달러부터, 공유 또는 전용 배포의 Premium이 월 400달러부터입니다. 2025년 10월 발표의 월 280달러 Plus 등급은 그곳에 더 이상 없습니다.
장점
- +여기서 가장 성숙한 하이브리드 검색이며, 키워드와 벡터의 배합을 실제로 통제할 수 있습니다
- +2026년 6월부터 카드 없이 만료도 없는 무료 등급: 객체 10만, 메모리 1GB, 디스크 10GB
- +내장 벡터화 모듈 덕에 앱이 아니라 데이터베이스가 임베딩을 맡을 수 있습니다
- +자체 호스팅과 매니지드가 같은 엔진이라 양방향 이전 경로가 있습니다
단점
- –스키마를 미리 정의해야 해서 오픈소스 세 엔진 중 준비가 가장 무겁습니다
- –비슷한 부하에서 Qdrant보다 리소스 사용량이 큽니다
- –1년도 안 되어 가격이 두 번 바뀌었으니 비교 글을 믿지 말고 현재 페이지를 확인하세요
Chroma: 프로토타이핑을 위한 선택
Chroma는 넷 중 유일하게 서버 없이 파이썬 프로세스 안에서 돌아가며, 그래서 아무것도 없는 상태에서 동작하는 검색까지가 가장 빠릅니다. 의도적으로 다른 셋보다 좁고, 그 점을 솔직하게 밝힙니다.
Chroma — 프로토타이핑과 중소 규모 부하에 최적
스타 29,174개, Apache-2.0, Rust 코어, `pip install chromadb` 하면 동작
Chroma는 pip으로 설치되고 임베디드로 돌아가므로, 노트북이 컨테이너도 포트도 설정도 없이 몇 줄만으로 동작하는 의미 검색을 가질 수 있습니다. 이 한 가지 성질이 튜토리얼과 프로토타입에서의 지배력을 설명하며, 이는 초보자용 보조바퀴가 아니라 실질적인 엔지니어링 이점입니다. 인프라 없이 검색 로직을 시험할 수 있다는 것은 반복 주기를 상당히 줄여 줍니다. 엔진 코어는 Rust로 다시 쓰였기 때문에 성능 이야기는 파이썬 출신이 시사하는 것보다 낫습니다. 다만 메타데이터 필터링은 여전히 Qdrant보다 단순하고, 하이브리드 검색은 더 최근이며 완성도가 낮습니다. Chroma Cloud도 있는데 이 분야 비교 글 대부분이 빠뜨립니다. Starter는 월 0달러에 사용량 과금이며 크레딧 5달러와 데이터베이스 10개, Team은 월 250달러에 사용량 과금이며 데이터베이스 100개와 전용 Slack 지원, Enterprise는 단일 테넌트 또는 자체 클라우드 클러스터가 더해집니다. 사용량은 쓰기 1GiB당 2.50달러, 저장 1GiB당 월 0.33달러, 조회 1TiB당 0.0075달러, 반환 1GiB당 0.09달러입니다.
장점
- +서버 없이 프로세스 안에서 돌아가므로 시작하는 데 준비할 것이 없습니다
- +넷 중 배우기 가장 쉽고 튜토리얼과 예제에서 가장 흔합니다
- +이제 코어가 Rust라 성능이 파이썬 계보가 시사하는 것보다 낫습니다
- +Chroma Cloud가 월 0달러+사용량부터 시작해, 매니지드로 가는 데 월정액으로 뛸 필요가 없습니다
단점
- –메타데이터 필터링이 Qdrant보다 단순하고 하이브리드 검색은 여기서 완성도가 가장 낮습니다
- –수천만 벡터까지 키울 엔진은 아닙니다. 그 전에 옮기세요, 그 후가 아니라
- –쉽게 만들어 주는 임베디드 모델은, 기본적으로 멀티테넌트 서버가 아니라는 뜻이기도 합니다
이제 넷 다 무료 등급이 있습니다
2026년 6월부터 네 업체 모두 실제 부하를 비용 0으로 돌릴 방법을 제공하며, 이는 지금 읽는 비교 글이 올해 갱신됐는지 알아내는 가장 빠른 방법입니다. Weaviate가 14일 샌드박스만 준다고 말하는 가이드는 2026년 6월 17일에 끝난 세계를 서술하고 있는 것입니다.
네 무료 제공은 형태가 확실히 다르고, 존재한다는 사실보다 그 차이가 더 중요합니다. Qdrant Cloud는 0.5 vCPU, 1GB RAM, 4GB 디스크의 지속적인 단일 노드 클러스터를 영구 무료로 줍니다. 손에 남는 작은 머신입니다. Pinecone Starter는 무료로 스토리지 2GB와 월 200만 쓰기 단위·100만 읽기 단위라는 계측된 한도를 줍니다. 용량에 처리량 예산이 더해진 형태입니다. Weaviate의 무료 요금제는 객체 10만 개, 메모리 1GB, 디스크 10GB를 카드 없이 만료 없이 주며, 디스크에서는 가장 후합니다. Chroma Cloud Starter는 월 0달러에 사용량 과금과 크레딧 5달러인데, 이는 상시 한도가 아니라 잔액이며 부하가 걸리면 결국 소진됩니다.
서로 비교하지 말고 자신의 부하에 비추어 읽으세요. 많이 저장하고 드물게 조회한다면 Weaviate의 10GB가 여기서 가장 강한 제안입니다. 작은 말뭉치에 끊임없이 조회한다면 누구의 디스크 수치보다 Pinecone의 읽기 단위 한도가 더 중요합니다.
⚠️Warning: Chroma Cloud의 "월 0달러"는 다른 셋과 같은 종류의 무료가 아닙니다. 초기 크레딧 5달러가 붙은 사용량 과금 요금제이므로, 상시 무료가 아니라 크레딧을 다 쓸 때까지 무료입니다. 다른 셋에는 갱신되거나 유지되는 상시 한도가 있습니다.
100만 벡터의 12개월 비용
1,536차원 벡터 100만 개 — 대략 OpenAI 임베딩 규모의 말뭉치 — 에서는 자체 호스팅과 매니지드의 인프라 비용이 충분히 가까워서 운영 시간이 결정을 짓습니다. 아래 수치는 4 vCPU와 16GB RAM을 갖춘 월 40~80달러 머신에서의 단일 노드 배포를, 같은 부하를 여유롭게 담는 각 사의 최하위 등급과 견준 것입니다.
| 방식 | 월 인프라 비용 | 월 운영 시간 | 운영 비용(시간당 75달러) | 12개월 합계 |
|---|---|---|---|---|
| Qdrant 자체 호스팅 | 약 60달러 | 2~4시간 | 150~300달러 | 약 2,520~4,320달러 |
| Weaviate 자체 호스팅 | 약 60달러 | 3~5시간 | 225~375달러 | 약 3,420~5,220달러 |
| Chroma 자체 호스팅 | 약 40달러 | 2~3시간 | 150~225달러 | 약 2,280~3,180달러 |
| Pinecone Standard | 최소 50달러+사용량 | 0.5~1시간 | 38~75달러 | 약 1,060~1,500달러 |
| Weaviate Cloud Flex | 최소 45달러+사용량 | 0.5~1시간 | 38~75달러 | 약 996~1,440달러 |
| Qdrant Cloud Standard | 추정 40~70달러 | 0.5~1시간 | 38~75달러 | 약 936~1,740달러 |
100만 벡터에서는 대개 정가가 아니라 운영 항목이 결정을 짓습니다. 소재지나 사용량이 요구하면 자체 호스팅하고, 그렇지 않다면 자기 시간을 정직하게 값 매긴 순간 매니지드 등급이 더 쌉니다.
📌Note: 이 수치는 2026년 8월 28일 기준 일반적인 머신 가격과 각 사 정가로 모델링한 추정치이며, 실측된 프로덕션 청구서가 아닙니다. Pinecone, Qdrant Cloud, Chroma Cloud의 사용량 비용은 질의량에 따라 달라지므로, 결정 전에 예상 읽기·쓰기 양을 각 사 계산기에 넣어 보세요.
하이브리드 검색과 프레임워크 지원
넷 다 LangChain과 LlamaIndex에 연동되므로 프레임워크 문제는 거의 정리됐습니다. 진짜로 갈리는 곳은 하이브리드 검색입니다. 하이브리드 검색은 보통 BM25인 키워드 점수와 벡터 유사도를 섞는 것이며, 순수 의미 검색에 구체적이고 예측 가능한 실패 양상이 있기 때문에 존재합니다.
그 실패 양상은 정확한 토큰입니다. 제품 코드, 모델 번호, 오류 문자열, 버전 식별자, 약어는 글자 그대로의 형태가 곧 의미이며, "ERR_4021"의 임베딩은 바로 그것을 설명하는 문단보다 다른 오류 문자열의 임베딩 근처에 놓입니다. 키워드 매칭은 이를 쉽게 잡고 의미 검색은 못 잡습니다. 그래서 둘을 섞는 것이 기술 문서 말뭉치에서 임베딩 모델을 손보는 것보다 검색 정확도를 훨씬 크게 끌어올립니다.
Weaviate가 가장 성숙한 구현을 갖고 있으며, BM25와 벡터 점수를 쿼리 API 안에서 결합하고 가중치를 실제로 통제할 수 있습니다. Qdrant는 조밀 벡터와 나란한 네이티브 희소 벡터 지원으로 같은 지점에 도달하는데, 구조적으로 더 깔끔하고 역량도 대체로 비슷합니다. Pinecone은 희소·조밀 인덱스 유형에서 이를 지원합니다. Chroma의 것은 가장 새롭고 완성도가 가장 낮으므로, 출시에 직결되는 경로에서 의존하기 전에 자신의 질의로 측정해 봐야 할 대상입니다.
누가 무엇을 써야 하나
이를 결정하는 것은 벤치마크 표가 아니라 팀 규모, 운영 여력, 소재지 요건입니다. 여섯 유형이면 대부분의 독자를 포괄합니다.
- 1인 개발자나 취미 RAG 프로젝트 → 임베디드 Chroma. 서버도 월 비용도 없고, 검색이 애플리케이션과 같은 프로세스에서 돕니다.
- 운영 인력 없이 빠르게 움직이는 작은 스타트업 팀 → 월 20달러 Pinecone Builder, 또는 나중에 자체 호스팅할 생각이면 Qdrant Cloud 무료 등급.
- 운영 여력이 있고 규모에 맞춰 비용을 최적화하는 팀 → Qdrant. 자체 호스팅이든 Standard든. 사용량 과금에 플랫폼 요금이 없다는 점이 솔직히 가장 싼 길입니다.
- 기술 문서 말뭉치에서 검색 품질이 병목인 팀 → Weaviate. 하이브리드 검색의 성숙도 때문이며, 이제 무료가 된 등급에서 평가하세요.
- 프라이버시 우선이거나 규제를 받으며 소재지 요건이 있는 팀 → Qdrant나 Weaviate 자체 호스팅. Pinecone은 월 500달러부터인 Enterprise와 BYOC로만 이를 충족합니다.
- 약 1만 벡터 미만 → Postgres의 pgvector. 여기서 전용 엔진을 더하는 것은 검색상의 이득 없이 운영 비용만 늘리는 일입니다.
EU, 일본, 중국에서의 벡터 데이터베이스
벡터 저장소에는 원본 문서의 임베딩이 들어가고, 거의 모든 배포에서 원문 자체도 페이로드로 함께 들어갑니다. 그래서 호스팅형이냐 자체 호스팅이냐의 선택이 주요 세 시장에서 데이터 보호 문제가 됩니다.
이런 경우엔 건너뛰세요
벡터가 약 1만 개 미만이라면 넷 다 건너뛰고 Postgres의 pgvector를 쓰세요. 그 규모에서는 정확한 최근접 이웃 전수 탐색이 밀리초 안에 끝나므로, 전용 엔진을 정당화하는 근사 인덱스는 당신에게 없는 문제를 풀고 있는 셈입니다. 이미 Postgres를 돌리고 있다면 pgvector는 서비스가 아니라 컬럼 타입과 인덱스를 더하는 것이고, 벡터가 그것을 설명하는 행과 같은 트랜잭션 안에 놓입니다. 이는 인덱스와 원본 데이터가 어긋나는 정합성 버그 한 부류를 조용히 없애 줍니다.
데이터베이스 서버가 아예 없는 애플리케이션이라면 `sqlite-vec`을 쓴 SQLite가 같은 영역을 덮습니다. 그리고 임베딩이 정적이고 거의 바뀌지 않는다면, 저장소에 커밋한 FAISS 인덱스가 이 모든 것보다 간단합니다. 서비스도 스키마도 마이그레이션도 없습니다.
기다릴 만한 문턱은 구체적입니다. 수십만 개 규모의 벡터, 순차 스캔으로는 더 이상 감출 수 없는 질의 지연, 또는 유사도 검색 뒤에 도는 것이 아니라 그와 맞물리는 메타데이터 필터링이 필요해질 때입니다. 그전에 전용 엔진을 세우는 것은 지금 데이터베이스가 이미 감당하는 문제를 위해 서비스를 하나 더 운영하는 일입니다.
💡Tip: 유용한 신호가 있습니다. 검색 질의가 사용자가 알아챌 만큼 느려진 첫 순간, 또는 필터링된 유사도 검색이 필요해졌는데 지금 구성이 필터와 순위 중 하나를 고르라고 강요하는 첫 순간에 전용 엔진으로 옮기세요.
벡터 데이터베이스를 고를 때 흔한 오해
- 1Weaviate가 14일 샌드박스만 준다고 믿는 것
Why it matters: Weaviate는 2026년 6월 17일 신용카드 없이 만료도 없는 무료 등급을 내놨고, 객체 10만 개, 메모리 1GB, 디스크 10GB를 제공합니다. 여전히 첫날부터 월 45달러를 잡아두라고 조언하는 비교 글은 이제 무료인 것에 독자가 돈을 내게 만들고 있으며, 현재 이 분야에서 가장 흔한 낡은 주장입니다. - 2Chroma를 임베디드 전용으로 여겨 Chroma Cloud를 놓치는 것
Why it matters: Chroma Cloud에는 월 0달러+사용량에 크레딧 5달러인 Starter와 월 250달러인 Team이 있습니다. 대부분의 비교는 매니지드 선택지가 넷인데 셋만 나열하며, 이는 Chroma의 방식을 좋아하면서 "매니지드로 간다는 건 Chroma를 떠나는 것"이라고 여기는 팀의 결론을 왜곡합니다. - 3이름을 가장 많이 들어서 Pinecone을 고르는 것
Why it matters: Pinecone은 이 분야에서 가장 많이 홍보되는 선택지이며 콘텐츠 제작자를 위한 실제 제휴 프로그램을 운영합니다. 즉 그것을 추천하는 콘텐츠의 양은 상업적 유인과 무관하지 않습니다. 운영 없는 선택지로는 진짜 최고이지만, 자동으로 최선이거나 가장 저렴한 것은 아니며, 유일하게 자체 호스팅할 수 없는 제품이기도 합니다. - 4자체 호스팅을 머신 비용만으로 계산하는 것
Why it matters: 팀은 60달러 머신과 50달러 매니지드 요금제를 견주어 자체 호스팅이 싸다고 결론 내리면서, 매달 2~5시간의 패치·모니터링·백업 검증을 무시합니다. 현실적인 엔지니어링 단가라면 그 시간이 가격 차이를 넘어서며, 위의 12개월 표가 순진한 비교를 뒤집는 이유가 그것입니다. - 51만 벡터 미만 프로젝트에 전용 엔진을 세우는 것
Why it matters: 그 규모라면 이미 있는 Postgres 안의 pgvector가 같은 질의에 답하며, 새로 운영할 서비스가 없고, 벡터를 그것이 설명하는 행과 트랜잭션적으로 일관되게 유지합니다. 여기서 전용 엔진을 더하면 검색상의 이득 없이 운영 비용과 새 쿼리 API를 사는 셈입니다.
자주 묻는 질문
벡터 데이터베이스란 무엇인가요?
벡터 데이터베이스는 임베딩 모델이 만들어내는 고차원 수치 임베딩을 저장하고 그에 대한 최근접 이웃 질의에 답하며, 이것이 RAG 파이프라인의 중심에 있는 검색 단계입니다. 일반 데이터베이스는 수백만 개의 고차원 벡터에 대한 유사도 검색에 최적화돼 있지 않아 Qdrant, Pinecone, Weaviate, Chroma 같은 전용 엔진이 존재합니다. 이들은 약간의 재현율과 아주 큰 속도를 맞바꾸는 근사 인덱스를 씁니다.
무료 등급이 있는 벡터 데이터베이스는 무엇인가요?
2026년 기준 넷 다 있으며, 1년 전에는 사실이 아니었습니다. Qdrant Cloud는 0.5 vCPU, 1GB RAM, 4GB 디스크의 영구 무료 노드를 제공합니다. Pinecone Starter는 무료로 스토리지 2GB, 월 200만 쓰기 단위와 100만 읽기 단위를 줍니다. Weaviate는 2026년 6월 17일 카드 없이 만료도 없는 무료 등급을 내놓아 객체 10만 개, 메모리 1GB, 디스크 10GB를 제공합니다. Chroma Cloud Starter는 월 0달러에 사용량 과금과 크레딧 5달러이며, 이는 상시 한도가 아니라 잔액입니다.
RAG에는 Pinecone이 Weaviate보다 나은가요?
어느 쪽도 보편적으로 낫지는 않습니다. Pinecone은 더 성숙한 매니지드 서버리스 제품을 갖췄고 자체 호스팅 버전이 없으므로, 선택은 그 엔진에 대한 약속입니다. Weaviate는 자체 호스팅과 매니지드에서 같은 엔진을 제공해 양방향 이전 경로를 남기며, 하이브리드 검색이 더 성숙합니다. 사는 것이 운영의 단순함이라면 Pinecone을, 기술 콘텐츠에서의 검색 품질이 중요하거나 나중에 자체 하드웨어로 옮길 선택지를 남기고 싶다면 Weaviate를 고르세요.
100만 벡터의 벡터 데이터베이스는 비용이 얼마인가요?
2026년 8월 정가 기준으로 그 규모의 매니지드 등급은 초과분 전에 대략 월 45~70달러이고, 작은 머신에서의 자체 호스팅은 인프라 월 40~60달러에 월 2~5시간의 운영 시간이 더해집니다. 그 시간을 현실적인 엔지니어링 단가로 값 매기면 12개월 기준으로는 대개 매니지드가 더 쌉니다. 위의 전체 비교표를 보세요.
Qdrant와 Weaviate는 같은 것인가요?
아닙니다. 아키텍처와 쿼리 인터페이스가 다른 별개의 오픈소스 프로젝트입니다. Qdrant는 Rust로 작성돼 REST와 gRPC 위에 자체 API를 갖고, Weaviate는 Go로 작성돼 GraphQL 인터페이스로 알려져 있습니다. 둘 다 하이브리드 검색을 지원하고 자체 호스팅이나 매니지드로 돌지만, 한쪽으로 쓴 쿼리는 다시 쓰지 않으면 옮길 수 없습니다. Qdrant는 사용량이 적고 필터링이 강하며, Weaviate는 하이브리드 검색이 더 성숙하고 벡터화 모듈을 내장합니다.
Chroma에서 Qdrant로 어떻게 옮기나요?
Chroma의 파이썬 클라이언트로 `collection.get(include=["embeddings","metadatas","documents"])`를 써서 컬렉션을 내보낸 뒤, Qdrant 클라이언트의 `upsert` 메서드로 벡터와 페이로드를 새 Qdrant 컬렉션에 일괄 넣습니다. 이때 거리 척도 — 코사인, 내적, 유클리드 — 를 양쪽에서 맞추세요. LangChain이나 LlamaIndex 위에 만들었다면 둘 다 벡터 저장소를 추상화하므로, 백엔드 교체는 대체로 설정 변경과 재색인이면 됩니다.
이 업체들에 제휴 프로그램이 있나요?
Pinecone에는 있습니다. 파트너 페이지에 Pinecone을 소개하는 콘텐츠로 수수료를 받는 콘텐츠 제작자·교육자 대상 제휴 프로그램이, 기술·솔루션·추천 파트너 범주와 나란히 실려 있습니다. Qdrant, Weaviate, Chroma에서는 동등한 공개 프로그램을 찾지 못했고, 대신 기업 대상 기술 및 리셀러 제휴가 나열돼 있습니다. PromptQuorum은 Pinecone 프로그램에 가입하지 않았고 이 페이지의 어떤 링크로도 수익을 얻지 않습니다. 그런 프로그램이 존재하는 유일한 분야이고 우리가 먼저 추천하는 선택지도 아니므로, 분명히 밝혀둘 가치가 있습니다.
Chroma를 프로덕션에서 쓸 수 있나요, 아니면 프로토타입 전용인가요?
중소 규모 RAG 애플리케이션의 프로덕션에서 쓰이고 있으며, Rust 코어 덕에 파이썬 출신이 시사하는 것보다 합리적인 선택이 됩니다. 제약은 규모입니다. 지연 사고가 난 뒤가 아니라 수백만 벡터 영역에 깊이 들어가기 전에 Qdrant나 Weaviate로의 이전을 계획하세요. 같은 방식을 매니지드로 쓰고 싶다면 Chroma Cloud도 있고 월 0달러+사용량부터 시작합니다.
최종 결론
- Qdrant를 고르세요. 비용 대비 성능이 가장 좋고 자체 호스팅이든 매니지드든 도는 엔진을 원한다면. 다음 단계: 영구 무료 클라우드 등급에서 시작하고, 머신부터 준비하는 대신 4GB가 부족해질 때 Standard로 옮기세요.
- Pinecone을 고르세요. 인프라 작업을 0으로 만들고 엔진 고정을 받아들인다면. 다음 단계: 월 20달러 Builder에서 시작하고, Standard로 옮기기 전에 읽기·쓰기 단위 사용량을 계산하세요.
- Weaviate를 고르세요. 검색에서 하이브리드 검색이 핵심이라면. 다음 단계: 무료 등급에서 평가하세요. 2026년 6월부터 비용이 들지 않고 만료도 없습니다.
- Chroma를 고르세요. 프로토타입 중이고 오늘 검색을 돌려 보고 싶다면. 다음 단계: `pip install chromadb`, 그리고 Qdrant나 Weaviate로의 이전은 본인 일정에 맞춰 계획하세요.
- 넷 다 건너뛰세요. 벡터가 약 1만 개 미만이라면. 다음 단계: 이미 돌리는 Postgres 안의 pgvector를 쓰고, 지연이나 필터링 검색이 실제로 문제를 강요할 때 다시 검토하세요.