Skip to main content
PromptQuorum
Startseite/Lokale LLMs/Beste Vektordatenbank 2026: Qdrant, Pinecone, Weaviate oder Chroma
Tools & Interfaces

Beste Vektordatenbank 2026: Qdrant, Pinecone, Weaviate oder Chroma

·15 Min. Lesezeit·Von Hans Kuepper · Gründer von PromptQuorum, Multi-Model-AI-Dispatch-Tool · PromptQuorum

Diese Seite enthält Verweislinks zu Produkten von Drittanbietern. PromptQuorum ist an keinem Partnerprogramm beteiligt — es sind reine Referenzlinks, die keine Provision erzielen. Das Anklicken von Links und Ihre nächsten Schritte liegen in Ihrer eigenen Verantwortung. Diese Links stellen keine Billigung oder Verifizierung durch PromptQuorum dar.

Qdrant ist für die meisten Teams die beste Standardwahl: 34.242 GitHub-Sterne, Apache-2.0, der geringste Ressourcenbedarf unter den quelloffenen Engines und eine dauerhaft kostenlose Cloud-Stufe. Pinecone ist richtig, wenn Sie keinerlei Infrastrukturarbeit wollen und dafür zahlen — ab 20 $/Monat mit Builder. Weaviate ist die Wahl, wenn hybride Suche im Mittelpunkt steht. Chroma führt am schnellsten zu einem funktionierenden Prototyp, weil es im Prozess läuft. Die veraltetste Behauptung in dieser Kategorie lautet, nur einige davon hätten eine Gratisstufe: Seit Juni 2026 haben alle vier eine, auch Weaviate, das seine ablaufende 14-Tage-Sandbox durch einen wirklich kostenlosen, unbefristeten Tarif ersetzt hat.

Wichtigste Erkenntnisse

  • Qdrant — 34.242 GitHub-Sterne, Apache-2.0, in Rust geschrieben. Qdrant Cloud hat eine dauerhaft kostenlose Stufe mit 0,5 vCPU, 1 GB RAM und 4 GB Speicher; Standard rechnet nutzungsabhängig ab, mit 99,5 % Verfügbarkeitszusage und ohne pauschale Plattformgebühr; Premium ergänzt SSO und private VPC-Links mit 99,9 % und einem Mindestumsatz.
  • Pinecone — von Grund auf reine Cloud, ohne jede selbst betriebene Variante. Starter ist kostenlos mit 2 GB Speicher, 2 Mio. Write Units und 1 Mio. Read Units im Monat. Builder kostet pauschal 20 $/Monat mit 10 GB, 5 Mio. Writes und 2 Mio. Reads. Standard beginnt bei 50 $/Monat und rechnet darüber nutzungsabhängig ab; Enterprise liegt bei mindestens 500 $/Monat und ergänzt 99,95 % Verfügbarkeit, BYOC, HIPAA und Audit-Logs.
  • Weaviate — 16.758 Sterne, BSD-3-Clause, in Go geschrieben. Die wichtigste Korrektur auf dieser Seite: Weaviate Cloud ist keine 14-Tage-Sandbox mehr. Am 17. Juni 2026 wurde eine wirklich kostenlose Stufe ohne Kreditkarte und ohne zeitliche Befristung eingeführt — 100.000 Objekte, 1 GB Arbeitsspeicher und 10 GB Festplatte. Vergleiche, die weiterhin raten, ab Tag eins 45 $/Monat einzuplanen, schicken Leserinnen und Leser dazu, für etwas zu zahlen, das inzwischen kostenlos ist.
  • Auch die bezahlten Weaviate-Tarife haben sich verschoben. Die aktuelle Preisseite führt Flex ab 45 $/Monat und Premium ab 400 $/Monat. Die im Oktober 2025 angekündigte Plus-Stufe zu 280 $/Monat erscheint dort nicht mehr, nennen Sie also Flex und Premium statt der älteren dreistufigen Struktur.
  • Chroma — 29.174 Sterne, Apache-2.0, und inzwischen ein Kern in Rust statt der Python-Engine, mit der es begann. Es ist das einzige der vier, das ohne Server im Prozess läuft, und genau deshalb gewinnt es beim Prototypisieren.
  • Auch Chroma Cloud gibt es, was die meisten Vergleiche dieser Kategorie völlig übersehen: Starter kostet 0 $/Monat plus Nutzung mit 5 $ Startguthaben, Team 250 $/Monat plus Nutzung, und die Nutzung wird mit 2,50 $ je geschriebenem GiB, 0,33 $ je gespeichertem GiB und Monat, 0,0075 $ je abgefragtem TiB und 0,09 $ je zurückgegebenem GiB berechnet. Es gibt hier also vier verwaltete Optionen, nicht drei.
  • Alle vier haben inzwischen eine Gratisstufe, was vor einem Jahr noch nicht galt und der schnellste Weg ist zu prüfen, ob ein Vergleich, den Sie lesen, aktualisiert wurde.
  • Ein Hinweis, der klar gesagt gehört: Pinecone betreibt tatsächlich ein Affiliate-Programm für Content-Ersteller, bestätigt auf der eigenen Partnerseite. PromptQuorum ist dort nicht angemeldet und verdient an keinem Link hier etwas. Dies ist die einzige Kategorie dieser Reihe, in der ein solches Programm existiert — und genau deshalb lautet die Empfehlung oben Qdrant und nicht Pinecone.

🏆 Die beste Wahl für Ihre Situation

Die strukturelle Frage lautet, ob Sie die Engine betreiben oder mieten, und das hängt daran, ob Entwicklungsstunden oder Budget knapper sind. Lesen Sie von oben und halten Sie bei der ersten Zeile inne, die auf Sie zutrifft.

  • Sie haben etwas Betriebskapazität und wollen das beste Verhältnis von Kosten zu Leistung → Qdrant, selbst betrieben oder in Qdrant Cloud. Geringster Ressourcenbedarf der quelloffenen Engines und die größte Community der drei.
  • Sie wollen null Infrastrukturarbeit und zahlen dafür → Pinecone. Das ausgereifteste Serverless-Produkt, und Builder zu pauschal 20 $/Monat ist ein echter Tarif und keine Testphase.
  • Die Trefferqualität hängt daran, Stichwort- und Bedeutungssuche zu verbinden → Weaviate. BM25 plus Vektor nativ ist die reifste hybride Umsetzung hier, und die Gratisstufe kostet inzwischen nichts zum Ausprobieren.
  • Sie prototypisieren im Notebook und wollen keinen Server → Chroma. Es läuft in Ihrem Python-Prozess, es gibt also nichts bereitzustellen, bevor die Suche funktioniert.
  • Ihre Daten müssen auf eigener Hardware bleiben → Qdrant, Weaviate oder Chroma selbst betrieben. Pinecone hat keine selbst betriebene Variante und kann eine harte Residenzanforderung außerhalb der BYOC-Enterprise-Stufe nicht erfüllen.
  • Sie haben unter rund 10.000 Vektoren → keine davon. pgvector auf Postgres deckt diese Größenordnung ab, ohne einen Dienst zu betreiben, und Sie sparen sich eine neue Abfrage-API für eine Last, die sie nicht braucht.
Qdrant — Preise ansehenProduktlink · offengelegtPinecone — Preise ansehenProduktlink · offengelegt

Was eine Vektordatenbank tatsächlich ist

Eine Vektordatenbank speichert die hochdimensionalen numerischen Embeddings, die ein Embedding-Modell erzeugt, und beantwortet darauf Nearest-Neighbour-Abfragen — genau der Abrufschritt, der im Zentrum jeder RAG-Pipeline steht. Sie übergeben einen Abfragevektor und erhalten die gespeicherten Vektoren zurück, die ihm am nächsten liegen, üblicherweise samt Originaltext und Metadaten.

Gewöhnliche Datenbanken können das prinzipiell auch und gehen dabei in die Knie, denn exakte Nearest-Neighbour-Suche über Millionen hochdimensionaler Vektoren ist teuer. Diese Engines nutzen approximative Indizes — in allen vier Fällen HNSW —, die etwas Trefferquote gegen sehr viel Geschwindigkeit tauschen. Dieser Tausch ist der ganze Grund, warum es die Kategorie gibt.

Die praktische Folge: Die interessanten Unterschiede sind nicht, ob ähnliche Vektoren gefunden werden — das können alle vier. Es geht darum, wie gut Metadatenfilterung mit dem Vektorindex zusammenspielt, wie reif die hybride Suche ist, was es bei Ihrem Volumen kostet und ob Sie es selbst betreiben können. Zur Pipeline drumherum siehe lokales RAG aufbauen.

📍 In einem Satz

Eine Vektordatenbank speichert hochdimensionale Embeddings aus einem Embedding-Modell und beantwortet darauf Nearest-Neighbour-Abfragen — der Abrufschritt im Zentrum einer RAG-Pipeline.

💬 In einfachen Worten

Es ist eine Suchmaschine für Bedeutung statt für Wörter. Sie geben einen in Zahlen übersetzten Text hinein und erhalten die gespeicherten Einträge zurück, deren Zahlen am nächsten liegen — praktisch also die Passagen, die ungefähr dasselbe bedeuten.

Qdrant, Pinecone, Weaviate und Chroma im Vergleich

Jede dieser Engines optimiert eine andere Beschränkung — Ressourcenbedarf, Betriebseinfachheit, Trefferqualität oder Zeit bis zur ersten Abfrage — statt Funktion gegen Funktion anzutreten. Die Preise stammen von den Preisseiten der Anbieter vom 28. August 2026, die Repository-Zahlen vom selben Tag aus der GitHub-API.

KriteriumQdrantPineconeWeaviateChroma
GitHub-Sterne34.242Nicht quelloffen16.75829.174
LizenzApache-2.0ProprietärBSD-3-ClauseApache-2.0
Geschrieben inRustNicht offengelegtGoKern in Rust
Selbst betreibbarJa, kostenlosNein, nur CloudJa, kostenlosJa, kostenlos
Läuft im ProzessNein, ServerNein, gehostetNein, ServerJa
Kostenlose Cloud-Stufe0,5 vCPU, 1 GB, 4 GB2 GB, 2 Mio. Writes, 1 Mio. Reads100.000 Objekte, 1 GB, 10 GB0 $/Monat plus 5 $ Guthaben
Bezahlter EinstiegNutzungsabhängig, keine PauschaleBuilder pauschal 20 $/MonatFlex ab 45 $/MonatTeam 250 $/Monat plus Nutzung
Hybride SucheNativ, sparse plus denseJaNativ BM25, am reifstenNeuer, weniger vollständig
Zusage Einstiegsstufe99,5 % bei StandardNur Enterprise, 99,95 %99,5 % bei FlexUnter Enterprise nicht genannt
Affiliate-ProgrammKeines gefundenJa, wir sind nicht dabeiKeines gefundenKeines gefunden

⚠️Warning: Zwei Zeilen hier widersprechen den meisten noch kursierenden Vergleichen. Weaviate hat seit dem 17. Juni 2026 eine Gratisstufe ohne Ablauf, keine 14-Tage-Sandbox. Und Chroma hat ein verwaltetes Cloud-Produkt, womit diese Kategorie vier verwaltete Optionen hat statt der üblicherweise genannten drei.

Selbst betreiben oder Managed Cloud

Selbstbetrieb gibt Ihnen Kostenkontrolle und Datenresidenz und überträgt Ihnen Verfügbarkeit, Backups und Skalierung; die Managed Cloud verkauft Ihnen das zurück. Ehrlich betrachtet ist der Geldunterschied kleiner, als die meisten Teams erwarten, und der Zeitunterschied größer.

Ein Qdrant oder Weaviate auf einem einzelnen bescheidenen Server bringt eine Million Vektoren für rund 40 bis 80 $ Infrastruktur im Monat unter. Die verwalteten Gegenstücke landen in dieser Größenordnung ähnlich. Was sie tatsächlich trennt, sind die zwei bis fünf Stunden im Monat, in denen jemand patcht, überwacht, nach einem misslungenen Deploy zurückspielt und geweckt wird, wenn eine Platte volläuft. Setzen Sie dafür den realen Stundensatz an, und der Vergleich kippt meist.

Die Fälle, in denen Selbstbetrieb klar gewinnt, drehen sich nicht primär ums Geld. Es sind Datenresidenz, eine Anforderung nach Abschottung oder Betrieb im eigenen Rechenzentrum, und ein Volumen, das hoch genug ist, dass nutzungsabhängige Abrechnung einen festen Server überholt. Klar gewinnt Managed dort, wo ein kleines Team keine freie Entwicklungskraft hat und die Alternative zum Zahlen nicht Sparen heißt, sondern später ausliefern.

💡Tip: Pinecone ist die einzige Option hier ohne selbst betriebene Rückfallebene, und das ist eine Frage der Migration, kein Mangel. Der Wechsel weg von Weaviate oder Qdrant Cloud verändert nur, wo dieselbe Engine läuft; der Wechsel weg von Pinecone bedeutet eine andere Engine und neu geschriebene Abfragen.

Qdrant: die Standardwahl

Qdrant ist die Empfehlung für die meisten Teams, weil es den geringsten Ressourcenbedarf der quelloffenen Engines hat, die größte Community der drei und eine Cloud-Stufe, die dauerhaft kostenlos ist statt für ein Testfenster. Es macht Ihnen zudem die wenigsten Vorgaben, wie Sie Ihre Daten strukturieren.

1

Qdrant — insgesamt am besten

34.242 Sterne, Apache-2.0, Rust, dauerhaft kostenlose Cloud-Stufe

Qdrant ist in Rust geschrieben, was sich in einem kleineren Speicher- und CPU-Bedarf bei gleicher Last niederschlägt als bei den Alternativen aus Go und Python-Herkunft, und dieser Bedarf ist der praktische Grund, warum es auf einem einzelnen Knoten weiter reicht. Die Filterung ist die stärkste hier: Metadatenbedingungen werden während der HNSW-Traversierung angewandt statt nachträglich auf die Ergebnisse, sodass eine stark gefilterte Abfrage nicht still in einen Scan abgleitet. Hybride Suche ist über sparse Vektoren neben dichten nativ vorhanden. Die Cloud-Preise sind die klarsten der vier: eine kostenlose Stufe mit 0,5 vCPU, 1 GB RAM und 4 GB Speicher, dauerhaft statt zeitlich begrenzt; eine Standard-Stufe, die nach tatsächlichem vCPU-, Speicher- und Plattenverbrauch abrechnet, mit 99,5 % Verfügbarkeitszusage und ohne pauschale Plattformgebühr obendrauf; und eine Premium-Stufe mit SSO und privaten VPC-Links, 99,9 % und einem Mindestumsatz. Das Fehlen einer Plattformgebühr macht es zur kostenbewussten Wahl: Sie zahlen für Ressourcen, nicht für das Privileg, Kunde zu sein.

Vorteile

  • +Geringster Ressourcenbedarf der quelloffenen Engines, ein einzelner Knoten reicht weiter
  • +Filterung während der Indextraversierung statt danach, gefilterte Abfragen bleiben schnell
  • +Dauerhaft kostenlose Cloud-Stufe statt Testphase, und nutzungsabhängiges Standard ohne Pauschale
  • +Apache-2.0 mit der größten Community hier bei 34.242 Sternen, dieselbe Engine selbst betrieben wie verwaltet

Nachteile

  • Eine eigene Abfragesprache statt SQL oder GraphQL, es gibt also eine Lernkurve
  • Weniger eingebaute Vektorisierungsmodule als Weaviate — die Embedding-Pipeline bringen Sie mit
  • Selbstbetrieb heißt trotz des geringen Bedarfs weiterhin, einen Server zu betreiben und zu überwachen
Qdrant — Preise ansehenProduktlink · offengelegt

Pinecone: die Wahl ohne Betrieb

Pinecone ist das ausgereifteste verwaltete Produkt hier und das einzige ohne jede selbst betriebene Variante — zugleich seine stärkste Eigenschaft und die größte Festlegung. Sie kaufen die Abwesenheit von Betriebsarbeit.

1

Pinecone — am besten, wenn Sie null Infrastrukturarbeit wollen

Reines Serverless in der Cloud, Starter kostenlos, Builder pauschal 20 $/Monat

Pinecone war von Anfang an ein verwaltetes Produkt statt einer quelloffenen Engine mit angeflanschtem Hosting, und das zeigt sich beim Einstieg: keine Kapazitätsplanung, keine Indexdimensionierung, nichts bereitzustellen vor der ersten Abfrage. Für ein Team ohne Erfahrung mit Vektordatenbanken ist das ein echter und kein werblicher Vorteil. Die Tarife: Starter kostenlos mit 2 GB Speicher, 2 Mio. Write Units und 1 Mio. Read Units im Monat sowie 1 GB Egress; Builder pauschal 20 $/Monat mit 10 GB, 5 Mio. Writes, 2 Mio. Reads und 10 GB Egress; Standard ab 50 $/Monat und darüber nutzungsabhängig, mit dedizierten Read Nodes, Backup und Restore, RBAC und SAML-SSO; und Enterprise ab 500 $/Monat mit 99,95 % Verfügbarkeitszusage, Bring-your-own-Cloud, privaten Endpunkten, kundenverwalteten Schlüsseln, Audit-Logs, SCIM und HIPAA-Konformität. Builder verdient eine eigene Erwähnung, weil ein Pauschaltarif zu 20 $ mit echten Kontingenten in dieser Kategorie ungewöhnlich ist und den Haupteinwand gegen Pinecone für Nebenprojekte ausräumt.

Vorteile

  • +Die ausgereifteste Serverless-Erfahrung hier, ohne etwas bereitzustellen oder zu dimensionieren
  • +Builder zu pauschal 20 $/Monat ist eine wirklich kleine Festlegung mit brauchbaren Kontingenten
  • +Die Compliance-Funktionen sind bei Enterprise real: HIPAA, BYOC, kundenverwaltete Schlüssel, Audit-Logs und SCIM
  • +Nutzungsabhängige Abrechnung über dem Minimum hält Anwendungen mit wenig Verkehr günstig

Nachteile

  • Keine selbst betriebene Variante, ein Wegzug bedeutet Engine-Wechsel statt Verlagerung eines Deployments
  • Eine harte Residenzanforderung ist nur über Enterprise-BYOC ab 500 $/Monat erfüllbar
  • Der Verbrauch an Read und Write Units wird leicht unterschätzt, Rechnungen können überraschen
Pinecone — Preise ansehenProduktlink · offengelegt

Weaviate: die Wahl für hybride Suche

Weaviate hat die reifste hybride Suche der vier, und seit Juni 2026 auch eine Gratisstufe, die nicht abläuft — was den Rat entwertet, den die meisten Vergleiche dazu noch geben. Wenn die Trefferqualität Ihr Engpass ist, schauen Sie hier zuerst.

1

Weaviate — am besten, wenn hybride Suche zählt

16.758 Sterne, BSD-3-Clause, Go, seit Juni 2026 Gratisstufe ohne Ablauf

Weaviate verbindet BM25-Stichwortbewertung und Vektorähnlichkeit nativ in der Abfrage-API und tut das länger als die anderen, was sich daran zeigt, wie viel Kontrolle Sie über die Mischung haben. Das zählt mehr, als es klingt: Reine Bedeutungssuche verfehlt verlässlich exakte Artikelnummern, Modellbezeichnungen, Fehlerstrings und Abkürzungen, denn deren Bedeutung ist ihre wörtliche Form. Weaviate liefert außerdem Vektorisierungsmodule mit, die Embedding-Anbieter für Sie aufrufen, sodass die Datenbank das Embedding übernimmt statt Ihrer Anwendung. Bei den Preisen ist die wichtige Tatsache neu: Am 17. Juni 2026 führte Weaviate eine Gratisstufe ohne Kreditkarte und ohne zeitliche Befristung ein, mit 100.000 Objekten, 1 GB Arbeitsspeicher und 10 GB Festplatte. Sie ersetzt die 14-Tage-Sandbox, die in Vergleichen weiterhin beschrieben wird. Die bezahlten Tarife auf der aktuellen Preisseite sind Flex ab 45 $/Monat, nutzungsabhängig mit 99,5 % Verfügbarkeitszusage, und Premium ab 400 $/Monat für geteilte oder dedizierte Bereitstellung; die Plus-Stufe zu 280 $/Monat aus der Ankündigung vom Oktober 2025 erscheint dort nicht mehr.

Vorteile

  • +Die reifste hybride Suche hier, mit echter Kontrolle über die Mischung aus Stichwort und Vektor
  • +Gratisstufe ohne Ablauf und ohne Kreditkarte seit Juni 2026 — 100.000 Objekte, 1 GB RAM, 10 GB Platte
  • +Eingebaute Vektorisierungsmodule, sodass die Datenbank das Embedding übernehmen kann statt Ihrer Anwendung
  • +Dieselbe Engine selbst betrieben wie verwaltet, ein Migrationspfad besteht in beide Richtungen

Nachteile

  • Vorab zu definierende Schemata machen es zur aufwendigsten Einrichtung der drei quelloffenen Engines
  • Höherer Ressourcenbedarf als Qdrant bei vergleichbarer Last
  • Die Preise haben sich binnen eines Jahres zweimal geändert, prüfen Sie die aktuelle Seite statt einem Vergleich zu vertrauen
Weaviate — Preise ansehenProduktlink · offengelegt

Chroma: die Wahl zum Prototypisieren

Chroma ist das einzige der vier, das ohne Server in Ihrem Python-Prozess läuft, und damit der schnellste Weg von nichts zu funktionierendem Abruf. Es ist bewusst schmaler als die anderen und geht damit offen um.

1

Chroma — am besten zum Prototypisieren und für kleine bis mittlere Lasten

29.174 Sterne, Apache-2.0, Kern in Rust, `pip install chromadb` und es läuft

Chroma installiert sich per pip und läuft eingebettet, sodass ein Notebook in wenigen Zeilen funktionierende semantische Suche hat — ohne Container, ohne Port, ohne Konfiguration. Genau diese Eigenschaft erklärt seine Dominanz in Tutorials und Prototypen, und sie ist ein echter technischer Vorteil statt einer Anfängerkrücke: Abrufslogik ohne Infrastruktur testen zu können, verkürzt die Schleife erheblich. Der Kern wurde in Rust neu geschrieben, die Leistungsgeschichte ist also besser, als die Python-Herkunft vermuten lässt, auch wenn die Metadatenfilterung einfacher bleibt als bei Qdrant und die hybride Suche neuer und weniger vollständig ist. Auch Chroma Cloud existiert, was die meisten Vergleiche dieser Kategorie auslassen: Starter kostet 0 $/Monat plus Nutzung mit 5 $ Startguthaben und 10 Datenbanken, Team 250 $/Monat plus Nutzung mit 100 Datenbanken und eigenem Slack-Support, und Enterprise ergänzt Single-Tenant- oder BYOC-Cluster. Die Nutzung wird mit 2,50 $ je geschriebenem GiB, 0,33 $ je gespeichertem GiB und Monat, 0,0075 $ je abgefragtem TiB und 0,09 $ je zurückgegebenem GiB berechnet.

Vorteile

  • +Läuft ohne Server im Prozess, es gibt nichts bereitzustellen, um anzufangen
  • +Am leichtesten zu lernen von den vieren und am häufigsten in Tutorials und Beispielen
  • +Inzwischen Kern in Rust, die Leistung ist besser, als die Python-Herkunft nahelegt
  • +Chroma Cloud beginnt bei 0 $/Monat plus Nutzung, der Weg in die Verwaltung erfordert also keinen Sprung auf eine Monatsgebühr

Nachteile

  • Metadatenfilterung ist einfacher als bei Qdrant, und die hybride Suche ist hier die am wenigsten vollständige
  • Nicht die Engine, um in zweistellige Millionen an Vektoren zu wachsen — migrieren Sie vorher, nicht danach
  • Das eingebettete Modell, das die Einfachheit bringt, heißt zugleich, dass es standardmäßig kein mandantenfähiger Server ist
Chroma — Preise ansehenProduktlink · offengelegt

Alle vier haben inzwischen eine Gratisstufe

Seit Juni 2026 bietet jeder der vier Anbieter einen Weg, eine echte Last zu null Kosten zu betreiben, und das ist der schnellste Test, ob ein Vergleich, den Sie lesen, dieses Jahr aktualisiert wurde. Ein Ratgeber, der Ihnen sagt, Weaviate gebe Ihnen nur eine 14-Tage-Sandbox, beschreibt einen Zustand, der am 17. Juni 2026 endete.

Die vier Gratisangebote haben sehr unterschiedliche Zuschnitte, und das zählt mehr als die bloße Tatsache, dass es sie gibt. Qdrant Cloud gibt Ihnen einen dauerhaften Ein-Knoten-Cluster mit 0,5 vCPU, 1 GB RAM und 4 GB Speicher, dauerhaft kostenlos — eine kleine Maschine, die Ihnen bleibt. Pinecone Starter ist kostenlos mit 2 GB Speicher und gemessenen Kontingenten von 2 Mio. Write Units und 1 Mio. Read Units im Monat — Kapazität plus Durchsatzbudget. Weaviates Gratistarif bietet 100.000 Objekte, 1 GB Arbeitsspeicher und 10 GB Platte ohne Kreditkarte und ohne Ablauf — beim Speicher das großzügigste. Chroma Cloud Starter kostet 0 $ im Monat plus Nutzung mit 5 $ Guthaben, was ein Guthabenstand ist und kein laufendes Kontingent, und unter Last irgendwann aufgebraucht sein wird.

Lesen Sie das gegen Ihre Last, nicht gegeneinander. Wenn Sie viel speichern und selten abfragen, sind Weaviates 10 GB hier das stärkste Angebot. Wenn Sie ständig gegen einen kleinen Korpus abfragen, zählt Pinecones Read-Unit-Kontingent mehr als jede Plattenangabe.

⚠️Warning: Die „0 $/Monat" von Chroma Cloud sind nicht dieselbe Art kostenlos wie bei den anderen dreien. Es ist ein nutzungsbepreister Tarif mit 5 $ Startguthaben, also kostenlos bis zum Aufbrauchen des Guthabens statt fortlaufend kostenlos. Die anderen drei haben feste Kontingente, die sich zurücksetzen oder bestehen bleiben.

Was 1 Mio. Vektoren über 12 Monate kosten

Bei einer Million Vektoren mit 1.536 Dimensionen — etwa die Größe eines OpenAI-Embedding-Korpus — liegen die Infrastrukturkosten von Selbstbetrieb und Managed so nah beieinander, dass die Betriebszeit entscheidet. Die Zahlen unten setzen einen Ein-Knoten-Betrieb auf einem Server für 40 bis 80 $ im Monat mit 4 vCPU und 16 GB RAM gegen die jeweils günstigste Stufe, die dieselbe Last bequem trägt.

AnsatzInfrastruktur/MonatBetriebsstunden/MonatBetriebskosten bei 75 $/Std.Summe 12 Monate
Qdrant selbst betrieben~60 $2–4150–300 $~2.520–4.320 $
Weaviate selbst betrieben~60 $3–5225–375 $~3.420–5.220 $
Chroma selbst betrieben~40 $2–3150–225 $~2.280–3.180 $
Pinecone Standard50 $ min. plus Nutzung0,5–138–75 $~1.060–1.500 $
Weaviate Cloud Flex45 $ min. plus Nutzung0,5–138–75 $~996–1.440 $
Qdrant Cloud Standardgeschätzt 40–70 $0,5–138–75 $~936–1.740 $

Bei einer Million Vektoren entscheidet üblicherweise die Betriebszeile, nicht der Listenpreis. Betreiben Sie selbst, wenn Residenz oder Volumen es verlangen; sonst sind die verwalteten Stufen günstiger, sobald die eigenen Stunden ehrlich bepreist sind.

📌Note: Das sind modellierte Schätzungen aus üblichen Serverpreisen und Listenpreisen der Anbieter vom 28. August 2026, keine gemessenen Produktivrechnungen. Nutzungsabhängige Kosten bei Pinecone, Qdrant Cloud und Chroma Cloud schwanken mit dem Abfragevolumen, rechnen Sie Ihr erwartetes Lese- und Schreibvolumen daher vorher durch die Kalkulatoren der Anbieter.

Wer sollte was nutzen?

Teamgröße, Betriebskapazität und Residenzanforderungen entscheiden das, nicht Benchmark-Tabellen. Sechs Profile decken die meisten Leserinnen und Leser ab.

  • Einzelentwicklerin oder Hobby-RAG-Projekt → Chroma eingebettet. Kein Server, keine Monatskosten, und der Abruf läuft im selben Prozess wie die Anwendung.
  • Kleines Startup-Team ohne Betriebspersonal → Pinecone Builder zu 20 $/Monat, oder die kostenlose Stufe von Qdrant Cloud, wenn Sie später selbst hosten wollen.
  • Team mit Betriebskapazität, das die Kosten im Wachstum optimiert → Qdrant, selbst betrieben oder auf Standard. Nutzungsabhängig ohne Plattformgebühr ist der günstigste ehrliche Weg.
  • Die Trefferqualität ist der Engpass auf einem technischen Korpus → Weaviate, geprüft auf der nun kostenlosen Stufe, wegen der Reife der hybriden Suche.
  • Datenschutzorientiertes oder reguliertes Team mit Residenzanforderung → Qdrant oder Weaviate selbst betrieben. Pinecone kann das nur über Enterprise-BYOC ab 500 $/Monat erfüllen.
  • Unter rund 10.000 Vektoren → pgvector auf Postgres. Eine eigene Engine ist hier Betriebsaufwand ohne Gewinn beim Abruf.

Vektordatenbanken in der EU, in Japan und in China

Ein Vektorspeicher enthält Embeddings Ihrer Quelldokumente und in nahezu jedem Aufbau auch den Originaltext als Payload. Damit wird die Wahl zwischen gehostet und selbst betrieben in drei wichtigen Märkten zur Datenschutzfrage.

Überspringen Sie das, wenn…

Wenn Sie unter rund 10.000 Vektoren haben, überspringen Sie alle vier und nutzen Sie pgvector auf Postgres. In dieser Größenordnung ist ein exakter Nearest-Neighbour-Scan in Millisekunden fertig, der approximative Index, der eine eigene Engine rechtfertigt, löst also ein Problem, das Sie nicht haben. Wenn Sie ohnehin Postgres betreiben, ergänzt pgvector einen Spaltentyp und einen Index statt eines Dienstes, und Ihre Vektoren liegen in derselben Transaktion wie die Zeilen, die sie beschreiben — womit eine ganze Klasse von Konsistenzfehlern entfällt, bei denen Index und Quelldaten auseinanderlaufen.

SQLite mit `sqlite-vec` deckt dasselbe für Anwendungen ganz ohne Datenbankserver ab. Und wenn Ihre Embeddings statisch sind und sich selten ändern, ist ein ins Repository eingecheckter FAISS-Index einfacher als all das: kein Dienst, kein Schema, keine Migration.

Die Schwelle, auf die zu warten sich lohnt, ist konkret: Vektorzahlen im hohen sechsstelligen Bereich, Abfragelatenz, die ein sequentieller Scan nicht mehr verbergen kann, oder Bedarf an Metadatenfilterung, die mit der Ähnlichkeitssuche zusammenspielt statt danach zu laufen. Eine eigene Engine davor aufzusetzen heißt, einen Dienst zu betreiben für ein Problem, das Ihre bestehende Datenbank schon löst.

💡Tip: Ein nützlicher Auslöser: Wechseln Sie zu einer eigenen Engine, wenn eine Abfrage zum ersten Mal langsam genug ist, dass Nutzende es merken, oder wenn Sie zum ersten Mal gefilterte Ähnlichkeitssuche brauchen und Ihr aktueller Aufbau Sie zwingt, sich zwischen Filter und Rangfolge zu entscheiden.

Häufige Fehler bei der Wahl einer Vektordatenbank

  1. 1
    Glauben, Weaviate biete nur eine 14-Tage-Sandbox
    Why it matters: Weaviate hat am 17. Juni 2026 eine Gratisstufe ohne Kreditkarte und ohne Ablauf eingeführt, mit 100.000 Objekten, 1 GB Arbeitsspeicher und 10 GB Platte. Vergleiche, die weiterhin raten, ab Tag eins 45 $/Monat einzuplanen, schicken Leserinnen und Leser dazu, für etwas zu zahlen, das inzwischen kostenlos ist — derzeit die häufigste veraltete Behauptung der Kategorie.
  2. 2
    Chroma als rein eingebettet betrachten und Chroma Cloud übersehen
    Why it matters: Chroma Cloud hat einen Starter-Tarif zu 0 $/Monat plus Nutzung mit 5 $ Guthaben und einen Team-Tarif zu 250 $/Monat. Die meisten Vergleiche nennen drei verwaltete Optionen, wo es vier gibt, was das Ergebnis für Teams verzerrt, denen Chromas Modell gefällt und die annehmen, verwaltet hieße es zu verlassen.
  3. 3
    Pinecone wählen, weil der Name am häufigsten fällt
    Why it matters: Pinecone ist die am stärksten beworbene Option dieser Kategorie und betreibt ein echtes Affiliate-Programm für Content-Ersteller, sodass die Menge der Berichterstattung, die es empfiehlt, nicht unabhängig vom kommerziellen Anreiz ist. Es ist wirklich die beste Wahl ohne Betriebsarbeit; es ist nicht automatisch die beste oder günstigste Passung, und es ist das einzige, das Sie nicht selbst betreiben können.
  4. 4
    Selbstbetrieb allein gegen die Serverkosten rechnen
    Why it matters: Teams vergleichen einen 60-$-Server mit einem 50-$-Managed-Tarif und schließen, Selbstbetrieb sei günstiger — und ignorieren die zwei bis fünf Stunden im Monat für Patchen, Überwachen und Prüfen der Backups. Bei jedem realistischen Entwicklersatz ist diese Zeit größer als die Preisdifferenz, weshalb die Zwölf-Monats-Tabelle oben den naiven Vergleich umkehrt.
  5. 5
    Für ein Projekt unter 10.000 Vektoren eine eigene Engine aufsetzen
    Why it matters: In dieser Größenordnung beantwortet pgvector im vorhandenen Postgres dieselben Abfragen ohne neuen Dienst und hält Vektoren transaktional konsistent mit den Zeilen, die sie beschreiben. Eine eigene Engine bringt hier Betriebsaufwand und eine neue Abfrage-API ohne Gewinn beim Abruf.

Häufig gestellte Fragen

Was ist eine Vektordatenbank?

Eine Vektordatenbank speichert die hochdimensionalen numerischen Embeddings, die ein Embedding-Modell erzeugt, und beantwortet darauf Nearest-Neighbour-Abfragen — der Abrufschritt im Zentrum einer RAG-Pipeline. Gewöhnliche Datenbanken sind nicht für Ähnlichkeitssuche über Millionen hochdimensionaler Vektoren ausgelegt, weshalb es eigene Engines wie Qdrant, Pinecone, Weaviate und Chroma gibt: Sie nutzen approximative Indizes, die etwas Trefferquote gegen sehr viel Geschwindigkeit tauschen.

Welche Vektordatenbank hat eine Gratisstufe?

Seit 2026 alle vier, was vor einem Jahr noch nicht galt. Qdrant Cloud hat einen dauerhaft kostenlosen Einzelknoten mit 0,5 vCPU, 1 GB RAM und 4 GB Speicher. Pinecone Starter ist kostenlos mit 2 GB Speicher, 2 Mio. Write Units und 1 Mio. Read Units im Monat. Weaviate führte am 17. Juni 2026 eine Gratisstufe ohne Kreditkarte und ohne Ablauf mit 100.000 Objekten, 1 GB Arbeitsspeicher und 10 GB Platte ein. Chroma Cloud Starter kostet 0 $ im Monat plus Nutzung mit 5 $ Guthaben, was ein Guthabenstand ist und kein laufendes Kontingent.

Ist Pinecone besser als Weaviate für RAG?

Keines ist allgemein besser. Pinecone hat das ausgereiftere verwaltete Serverless-Produkt und keine selbst betriebene Variante, die Wahl ist also eine Festlegung auf diese Engine. Weaviate bietet dieselbe Engine selbst betrieben und verwaltet, gibt Ihnen damit einen Migrationspfad in beide Richtungen und hat die reifere hybride Suche. Wählen Sie Pinecone, wenn Sie Betriebseinfachheit kaufen; wählen Sie Weaviate, wenn Trefferqualität auf technischen Inhalten zählt oder Sie sich die Option auf eigene Hardware offenhalten wollen.

Was kostet eine Vektordatenbank für 1 Million Vektoren?

Nach den Listenpreisen von August 2026 kostet eine verwaltete Stufe in dieser Größenordnung typischerweise rund 45 bis 70 $ im Monat vor Mehrverbrauch, während Selbstbetrieb auf einem kleinen Server 40 bis 60 $ Infrastruktur plus zwei bis fünf Stunden Betriebszeit im Monat kostet. Sobald diese Stunden zu einem realistischen Entwicklersatz bepreist sind, liegt Managed über zwölf Monate meist günstiger — siehe die vollständige Vergleichstabelle oben.

Ist Qdrant dasselbe wie Weaviate?

Nein. Es sind getrennte quelloffene Projekte mit unterschiedlicher Architektur und Abfrageschnittstelle. Qdrant ist in Rust geschrieben und hat eine eigene Abfrage-API über REST und gRPC; Weaviate ist in Go geschrieben und für seine GraphQL-Schnittstelle bekannt. Beide unterstützen hybride Suche und laufen selbst betrieben wie verwaltet, doch für eines geschriebene Abfragen sind ohne Umschreiben nicht auf das andere übertragbar. Qdrant hat den kleineren Ressourcenbedarf und die stärkere Filterung, Weaviate die reifere hybride Suche und eingebaute Vektorisierungsmodule.

Wie migriere ich von Chroma zu Qdrant?

Exportieren Sie die Collection aus Chroma mit dem Python-Client über `collection.get(include=["embeddings","metadatas","documents"])` und schreiben Sie Vektoren und Payloads dann per `upsert` des Qdrant-Clients gebündelt in eine neue Qdrant-Collection, wobei das Distanzmaß zwischen beiden übereinstimmen muss — Kosinus, Skalarprodukt oder euklidisch. Wenn Sie auf LangChain oder LlamaIndex gebaut haben, abstrahieren beide den Vektorspeicher, sodass der Wechsel des Backends weitgehend eine Konfigurationsänderung plus Neuindizierung ist.

Haben diese Anbieter Affiliate-Programme?

Pinecone ja. Die Partnerseite führt ein Affiliate-Programm für Content-Ersteller und Lehrende, die für Inhalte über Pinecone eine Provision erhalten, neben den Kategorien Technologie-, Lösungs- und Empfehlungspartner. Für Qdrant, Weaviate und Chroma haben wir kein vergleichbares öffentliches Affiliate-Programm gefunden; sie führen stattdessen unternehmensbezogene Technologie- und Reseller-Partnerschaften. PromptQuorum ist in Pinecones Programm nicht angemeldet und verdient an keinem Link auf dieser Seite etwas — das gehört klar gesagt, denn dies ist die einzige Kategorie mit einem solchen Programm, und es ist nicht die Option, die wir zuerst empfehlen.

Kann ich Chroma produktiv nutzen oder ist es nur zum Prototypisieren?

Es wird produktiv für kleine bis mittlere RAG-Anwendungen genutzt, und der Rust-Kern macht das zu einer vernünftigeren Wahl, als die Python-Herkunft nahelegt. Die Beschränkung ist die Größe: Planen Sie die Migration zu Qdrant oder Weaviate, bevor Sie tief in den Millionen von Vektoren stecken, und nicht nach einem Latenzvorfall. Auch Chroma Cloud gibt es, falls Sie dasselbe Modell verwaltet wollen, ab 0 $ im Monat plus Nutzung.

Wie steht es um die DSGVO, wenn ein Vektorindex Kundendaten enthält?

Embeddings sind aus Ihren Dokumenten abgeleitet und die Payload enthält den Originaltext meist wortgetreu, ein Index über Kundendaten ist also personenbezogene Verarbeitung wie jede andere. Sie brauchen einen Auftragsverarbeitungsvertrag nach Artikel 28 mit der Plattform und bei einem US-Anbieter eine tragfähige Übermittlungsgrundlage nach den Artikeln 44 bis 49. Besonders zu prüfen ist das Löschen: Ein Löschbegehren muss auch die zugehörigen Vektoren erfassen, nicht nur die Quellzeile. Vergewissern Sie sich vorab, dass Ihre Engine das Löschen per Metadatenfilter unterstützt. Der Selbstbetrieb von Qdrant oder Weaviate in der EU ist der deutlich einfachere Weg, weil der Index Ihre Infrastruktur nie verlässt.

Was passt zu einem Mittelständler ohne eigenes Plattformteam?

In den meisten Fällen Qdrant Cloud oder Pinecone Builder zu 20 $ im Monat, denn beide kommen ohne betreuten Server aus — für ein Team ohne Plattformzuständigkeit ist das der entscheidende Punkt. Qdrant Cloud hat den Vorteil, dass Sie dieselbe Engine später auf eigene Hardware holen können, falls Datenresidenz zur Anforderung wird, was bei Pinecone einen Engine-Wechsel bedeuten würde. Den Selbstbetrieb sollten Sie nur wählen, wenn jemand dauerhaft einen Server betreuen kann; andernfalls sparen Sie Lizenzkosten und zahlen mit Betriebsrisiko.

Fazit

  • Nutzen Sie Qdrant, wenn Sie das beste Verhältnis von Kosten zu Leistung wollen und eine Engine, die selbst betrieben wie verwaltet funktioniert — nächster Schritt: auf der dauerhaft kostenlosen Cloud-Stufe beginnen und auf Standard wechseln, wenn 4 GB nicht mehr reichen, statt zuerst einen Server bereitzustellen.
  • Nutzen Sie Pinecone, wenn Sie null Infrastrukturarbeit wollen und die Bindung an die Engine akzeptieren — nächster Schritt: mit Builder zu 20 $/Monat starten und das Volumen an Read und Write Units durchrechnen, bevor Sie auf Standard wechseln.
  • Nutzen Sie Weaviate, wenn hybride Suche für den Abruf zentral ist — nächster Schritt: auf der Gratisstufe prüfen, die seit Juni 2026 nichts kostet und nicht abläuft.
  • Nutzen Sie Chroma, wenn Sie prototypisieren und den Abruf heute zum Laufen bringen wollen — nächster Schritt: `pip install chromadb`, und die Migration zu Qdrant oder Weaviate nach eigenem Zeitplan einplanen.
  • Überspringen Sie alle vier, wenn Sie unter rund 10.000 Vektoren haben — nächster Schritt: pgvector im vorhandenen Postgres nutzen und erneut prüfen, wenn Abfragelatenz oder gefilterte Suche es wirklich erzwingen.

Quellen

Hinweis zu Drittanbieter-Fakten

Dieser Artikel referenziert KI-Modelle, Benchmarks, Preise und Lizenzen von Drittanbietern. Die KI-Landschaft verändert sich schnell. Benchmark-Werte, Lizenzbedingungen, Modellnamen und API-Preise können sich zwischen dem Zeitpunkt der Erstellung und dem Zeitpunkt ändern, zu dem Sie dies lesen. Bevor Sie Bereitstellungs- oder Compliance-Entscheidungen auf Basis dieses Artikels treffen, überprüfen Sie aktuelle Zahlen bei der offiziellen Quelle jedes Anbieters: Hugging-Face-Modellkarten für Lizenzen und Benchmarks, Anbieter-Websites für API-Preise und EUR-Lex für den aktuellen DSGVO- und EU-KI-Gesetz-Text.

Nutzen Sie PromptQuorum mit einem lokalen LLM, eigenen API-Schlüsseln oder beidem — Sie wählen das Backend.

PromptQuorum-Beta herunterladen →

← Zurück zu Lokale LLMs