Points clés
- Qdrant — 34 242 etoiles sur GitHub, Apache-2.0, ecrit en Rust. Qdrant Cloud propose un palier gratuit a vie avec 0,5 vCPU, 1 Go de RAM et 4 Go de disque ; Standard facture a la consommation avec un engagement de 99,5 % et sans frais fixes de plateforme ; Premium ajoute le SSO et des liens VPC prives avec 99,9 % et une depense minimale.
- Pinecone — cloud uniquement par conception, sans aucune version auto-hebergee. Starter est gratuit avec 2 Go de stockage, 2 M d unites d ecriture et 1 M de lecture par mois. Builder coute 20 $/mois forfaitaires avec 10 Go, 5 M d ecritures et 2 M de lectures. Standard part d un minimum de 50 $/mois puis facture a l usage, et Enterprise d un minimum de 500 $/mois en ajoutant un engagement de 99,95 %, le BYOC, HIPAA et les journaux d audit.
- Weaviate — 16 758 etoiles, BSD-3-Clause, ecrit en Go. La correction la plus importante de cette page : Weaviate Cloud n est plus un bac a sable de 14 jours. Le 17 juin 2026, un palier reellement gratuit sans carte bancaire et sans expiration a ete lance : 100 000 objets, 1 Go de memoire et 10 Go de disque. Les comparatifs qui conseillent encore de budgeter 45 $/mois des le premier jour envoient les lecteurs payer pour quelque chose de desormais gratuit.
- Les tarifs payants de Weaviate ont aussi bouge. La page tarifaire en vigueur liste Flex a partir de 45 $/mois et Premium a partir de 400 $/mois. Le palier Plus a 280 $/mois annonce lors de la mise a jour d octobre 2025 n y figure plus : citez donc Flex et Premium plutot que l ancienne structure a trois niveaux.
- Chroma — 29 174 etoiles, Apache-2.0, et desormais un coeur en Rust plutot que le moteur Python de ses debuts. C est le seul des quatre a tourner dans le processus sans serveur, et c est precisement pourquoi il l emporte pour le prototypage.
- Chroma Cloud existe aussi, ce que la plupart des comparatifs de cette categorie omettent completement : Starter coute 0 $/mois plus la consommation avec 5 $ de credits, Team 250 $/mois plus la consommation, et l usage est facture 2,50 $ par Gio ecrit, 0,33 $ par Gio stocke et par mois, 0,0075 $ par Tio interroge et 0,09 $ par Gio renvoye. Il y a donc quatre options gerees ici, et non trois.
- Les quatre ont desormais un palier gratuit, ce qui n etait pas vrai il y a un an et constitue le moyen le plus rapide de verifier si un comparatif que vous lisez a ete actualise.
- Une precision a dire clairement : Pinecone anime bien un programme d affiliation destine aux createurs de contenu, confirme sur sa page partenaires. PromptQuorum n y est pas inscrit et ne gagne rien sur aucun lien ici. C est la seule categorie de cette serie ou un tel programme existe, et c est precisement pour cela que la recommandation ci-dessus est Qdrant et non Pinecone.
🏆 Le meilleur choix selon votre cas
La question structurelle est de savoir si vous exploitez le moteur ou si vous le louez, et cela depend de votre ressource rare : les heures d ingenierie ou le budget. Lisez vers le bas et arretez-vous a la premiere ligne qui vous decrit.
- Vous avez un peu de capacite d exploitation et voulez le meilleur rapport cout-performance → Qdrant, auto-heberge ou sur Qdrant Cloud. La plus faible empreinte des moteurs open source et la plus grande communaute des trois.
- Vous voulez zero travail d infrastructure et acceptez de payer → Pinecone. Le produit serverless le plus mature, et Builder a 20 $/mois forfaitaires est une vraie offre, pas un essai.
- La precision de la recherche depend du melange entre correspondance litterale et semantique → Weaviate. BM25 plus vecteur en natif est l implementation hybride la plus mature ici, et le palier gratuit ne coute plus rien pour l evaluer.
- Vous prototypez dans un notebook et ne voulez pas de serveur → Chroma. Il tourne dans votre processus Python, il n y a donc rien a provisionner avant d avoir une recherche fonctionnelle.
- Vos donnees doivent rester sur du materiel que vous controlez → Qdrant, Weaviate ou Chroma auto-heberges. Pinecone n a pas de version auto-hebergee et ne peut donc satisfaire une exigence stricte de residence en dehors de son palier Enterprise avec BYOC.
- Vous avez moins d environ 10 000 vecteurs → aucune d elles. pgvector sur Postgres couvre cette echelle sans ajouter un service a exploiter, et vous evitez d apprendre une nouvelle API pour une charge qui n en a pas besoin.
Ce qu est reellement une base vectorielle
Une base de donnees vectorielle stocke les plongements numeriques en haute dimension produits par un modele d embeddings et repond a des requetes de plus proches voisins, ce qui constitue l etape de recuperation au coeur de toute chaine RAG. Vous lui transmettez un vecteur de requete et elle renvoie les vecteurs stockes les plus proches, generalement accompagnes du texte d origine et des metadonnees.
Les bases classiques peuvent techniquement le faire et s effondrent a l echelle, car la recherche exacte des plus proches voisins sur des millions de vecteurs en haute dimension coute cher. Ces moteurs utilisent des index approximatifs — HNSW dans les quatre cas — qui echangent un peu de rappel contre une acceleration considerable. Cet echange est toute la raison d etre de la categorie.
La consequence pratique est que les differences interessantes entre ces quatre ne portent pas sur « sait-il trouver des vecteurs similaires » : tous le savent. Elles portent sur la facon dont le filtrage par metadonnees se combine a l index vectoriel, sur la maturite de la recherche hybride, sur le cout a votre volume et sur la possibilite de l exploiter vous-meme. Pour la chaine qui entoure tout cela, voyez construire un RAG local.
📍 En une phrase
Une base de donnees vectorielle stocke des plongements en haute dimension produits par un modele d embeddings et repond a des requetes de plus proches voisins, ce qui constitue l etape de recuperation au coeur d une chaine RAG.
💬 En termes simples
C est un moteur de recherche du sens plutot que des mots. Vous lui donnez un texte transforme en nombres et il renvoie les elements stockes dont les nombres sont les plus proches, c est-a-dire en pratique les passages qui veulent dire a peu pres la meme chose.
Qdrant, Pinecone, Weaviate et Chroma compares
Chacun optimise une contrainte differente — empreinte, simplicite d exploitation, qualite de recherche ou delai avant la premiere requete — plutot que de rivaliser fonctionnalite par fonctionnalite. Les tarifs ont ete releves sur les pages des editeurs le 28 aout 2026, et les chiffres des depots proviennent de l API GitHub le meme jour.
| Critere | Qdrant | Pinecone | Weaviate | Chroma |
|---|---|---|---|---|
| Etoiles GitHub | 34 242 | Non open source | 16 758 | 29 174 |
| Licence | Apache-2.0 | Proprietaire | BSD-3-Clause | Apache-2.0 |
| Ecrit en | Rust | Non communique | Go | Coeur en Rust |
| Auto-hebergeable | Oui, gratuit | Non, cloud seulement | Oui, gratuit | Oui, gratuit |
| Tourne dans le processus | Non, serveur | Non, heberge | Non, serveur | Oui |
| Palier cloud gratuit | 0,5 vCPU, 1 Go, 4 Go | 2 Go, 2M ecritures, 1M lectures | 100 000 objets, 1 Go, 10 Go | 0 $/mois plus 5 $ de credits |
| Entree payante | A la consommation, sans forfait | Builder 20 $/mois forfaitaires | Flex des 45 $/mois | Team 250 $/mois plus usage |
| Recherche hybride | Native, creuse et dense | Oui | BM25 natif, la plus mature | Plus recente, moins complete |
| Engagement palier d entree | 99,5 % sur Standard | Enterprise seulement, 99,95 % | 99,5 % sur Flex | Non publie sous Enterprise |
| Programme d affiliation | Aucun trouve | Oui, nous n y sommes pas | Aucun trouve | Aucun trouve |
⚠️Warning: Deux lignes ici contredisent la plupart des comparatifs encore en circulation. Weaviate dispose d un palier gratuit sans expiration depuis le 17 juin 2026, et non d un bac a sable de 14 jours. Et Chroma dispose d un produit cloud gere, si bien que cette categorie compte quatre options gerees plutot que les trois habituellement listees.
Auto-heberger ou cloud gere
L auto-hebergement vous donne la maitrise des couts et la residence des donnees, et vous confie la disponibilite, les sauvegardes et la mise a l echelle ; le cloud gere vous les revend. Dit honnetement, l ecart d argent est plus faible que la plupart des equipes ne l imaginent, et l ecart de temps plus grand.
Un Qdrant ou un Weaviate mononoeud sur une machine modeste fera tourner un million de vecteurs pour environ 40 a 80 dollars d infrastructure par mois. Les equivalents geres se situent dans une fourchette voisine a cette echelle. Ce qui les separe vraiment, ce sont les deux a cinq heures par mois que quelqu un consacre aux correctifs, a la supervision, a la restauration apres un deploiement rate et aux alertes quand un disque se remplit. Valorisez cela au taux horaire reel de votre equipe et la comparaison s inverse le plus souvent.
Les cas ou l auto-hebergement l emporte nettement ne relevent pas d abord de l argent. Ce sont la residence des donnees, une exigence d isolement ou d installation sur site, et un volume assez eleve pour que la facturation a l usage depasse une machine fixe. Le cas ou le gere l emporte nettement, c est une petite equipe sans ingenieur disponible, ou l alternative a payer n est pas d economiser mais de livrer plus tard.
💡Tip: Pinecone est la seule option ici sans repli auto-heberge, et c est une consideration de migration plutot qu un defaut. Quitter Weaviate ou Qdrant Cloud change l endroit ou tourne le meme moteur ; quitter Pinecone signifie changer de moteur et reecrire vos requetes.
Qdrant : le choix par defaut
Qdrant est la recommandation pour la plupart des equipes parce qu il a la plus faible empreinte de ressources des moteurs open source, la plus grande communaute des trois, et un palier cloud gratuit indefiniment plutot que le temps d un essai. C est aussi le moins prescriptif sur la facon de structurer vos donnees.
Qdrant — meilleur globalement
34 242 etoiles, Apache-2.0, Rust, palier cloud gratuit a vie
Qdrant est ecrit en Rust, ce qui se traduit par une empreinte memoire et processeur plus faible a charge egale que les alternatives issues de Go et de Python, et cette empreinte est la raison pratique pour laquelle il va plus loin sur un seul noeud. Son filtrage est le plus solide ici : il applique les conditions sur les metadonnees pendant le parcours de l index HNSW plutot qu apres coup sur les resultats, si bien qu une requete fortement filtree ne degenere pas silencieusement en balayage. La recherche hybride est native grace aux vecteurs creux aux cotes des vecteurs denses. Les tarifs cloud sont les plus lisibles des quatre : un palier gratuit avec 0,5 vCPU, 1 Go de RAM et 4 Go de disque, gratuit a vie plutot que limite dans le temps ; un palier Standard facture sur la consommation reelle de vCPU, de memoire et de stockage, avec un engagement de 99,5 % et sans frais fixes de plateforme par-dessus ; et un palier Premium ajoutant le SSO et des liens VPC prives avec 99,9 % et une depense minimale. L absence de frais de plateforme en fait le choix attentif aux couts : vous payez des ressources, pas le privilege d etre client.
Avantages
- +La plus faible empreinte des moteurs open source, un seul noeud va donc plus loin
- +Filtrage applique pendant le parcours de l index et non apres, les requetes filtrees restent rapides
- +Palier cloud gratuit a vie plutot qu un essai, et Standard a la consommation sans frais fixes
- +Apache-2.0 avec la plus grande communaute ici, 34 242 etoiles, et le meme moteur auto-heberge ou gere
Inconvénients
- –Un langage de requete propre plutot que SQL ou GraphQL, il y a donc une courbe d apprentissage
- –Moins de modules de vectorisation integres que Weaviate : vous apportez votre chaine d embeddings
- –L auto-hebergement reste l exploitation et la supervision d un serveur, aussi legere soit l empreinte
Pinecone : le choix sans exploitation
Pinecone est le produit gere le plus mature ici et le seul sans aucune version auto-hebergee, ce qui est a la fois sa plus grande force et son plus grand engagement. Ce que vous achetez, c est l absence de travail d exploitation.
Pinecone — meilleur quand vous voulez zero travail d infrastructure
Serverless en cloud uniquement, Starter gratuit, Builder 20 $/mois forfaitaires
Pinecone est un produit gere depuis l origine plutot qu un moteur open source auquel on a greffe de l hebergement, et cela se voit a la prise en main : pas de planification de capacite, pas de dimensionnement d index, rien a provisionner avant votre premiere requete. Pour une equipe sans experience des bases vectorielles, c est un avantage reel et non un argument marketing. Les offres sont Starter gratuit avec 2 Go de stockage, 2 M d unites d ecriture et 1 M de lecture par mois plus 1 Go de sortie ; Builder a 20 $/mois forfaitaires avec 10 Go, 5 M d ecritures, 2 M de lectures et 10 Go de sortie ; Standard a partir d un minimum de 50 $/mois puis a l usage, avec des noeuds de lecture dedies, la sauvegarde et la restauration, le RBAC et le SSO SAML ; et Enterprise a partir d un minimum de 500 $/mois, ajoutant un engagement de 99,95 %, le cloud propre, des points de terminaison prives, des cles de chiffrement gerees par le client, les journaux d audit, SCIM et la conformite HIPAA. Builder merite une mention a part, car une offre forfaitaire a 20 $ avec de vraies limites est inhabituelle dans cette categorie et leve la principale objection a Pinecone pour les projets personnels.
Avantages
- +L experience serverless la plus mature ici, sans rien a provisionner ni a dimensionner
- +Builder a 20 $/mois forfaitaires est un engagement vraiment faible avec des limites utilisables
- +Les fonctions de conformite sont reelles en Enterprise : HIPAA, BYOC, cles gerees, journaux d audit et SCIM
- +La facturation a l usage au-dessus du minimum garde les applications peu sollicitees bon marche
Inconvénients
- –Pas de version auto-hebergee : partir signifie changer de moteur et non deplacer un deploiement
- –Une exigence stricte de residence ne peut etre satisfaite que via Enterprise et BYOC des 500 $/mois
- –La consommation d unites de lecture et d ecriture est facile a sous-estimer, les factures peuvent surprendre
Weaviate : le choix recherche hybride
Weaviate possede la recherche hybride la plus mature des quatre et, depuis juin 2026, un palier gratuit qui n expire pas — ce qui invalide le conseil que la plupart des comparatifs donnent encore a son sujet. Si la qualite de recherche est votre goulet d etranglement, regardez ici en premier.
Weaviate — meilleur quand la recherche hybride compte
16 758 etoiles, BSD-3-Clause, Go, palier gratuit sans expiration depuis juin 2026
Weaviate combine nativement le score BM25 sur les mots-cles et la similarite vectorielle dans son API de requete, et le fait depuis plus longtemps que les autres, ce qui se voit au controle dont vous disposez sur le melange. Cela compte plus qu il n y parait : la recherche purement semantique manque systematiquement les references produit, numeros de modele, chaines d erreur et acronymes exacts, car le sens de ces jetons est leur forme litterale. Weaviate fournit en outre des modules de vectorisation qui appellent les fournisseurs d embeddings pour vous, si bien que la base prend en charge le plongement a la place de votre application. Cote tarifs, le fait important est recent : le 17 juin 2026, Weaviate a lance un palier gratuit sans carte bancaire et sans expiration, offrant 100 000 objets, 1 Go de memoire et 10 Go de disque. Il remplace le bac a sable de 14 jours que les comparatifs decrivent encore. Les offres payantes sur la page en vigueur sont Flex a partir de 45 $/mois, a l usage avec un engagement de 99,5 %, et Premium a partir de 400 $/mois en deploiement partage ou dedie ; le palier Plus a 280 $/mois de l annonce d octobre 2025 n y figure plus.
Avantages
- +La recherche hybride la plus mature ici, avec un controle reel sur le melange mot-cle et vecteur
- +Palier gratuit sans expiration ni carte depuis juin 2026 : 100 000 objets, 1 Go de memoire, 10 Go de disque
- +Les modules de vectorisation integres permettent a la base de prendre en charge le plongement a la place de l application
- +Le meme moteur auto-heberge et gere, il existe donc un chemin de migration dans les deux sens
Inconvénients
- –La definition prealable du schema en fait le plus lourd a mettre en place des trois moteurs open source
- –Empreinte de ressources superieure a celle de Qdrant a charge comparable
- –Les tarifs ont change deux fois en moins d un an : verifiez la page actuelle plutot que de vous fier a un comparatif
Chroma : le choix prototypage
Chroma est le seul des quatre a tourner dans votre processus Python sans serveur, ce qui en fait le chemin le plus rapide de rien a une recherche fonctionnelle. Il est plus etroit que les autres par choix, et l assume.
Chroma — meilleur pour prototyper et pour les charges petites a moyennes
29 174 etoiles, Apache-2.0, coeur en Rust, `pip install chromadb` et ca tourne
Chroma s installe avec pip et tourne en embarque, si bien qu un notebook peut disposer d une recherche semantique fonctionnelle en quelques lignes, sans conteneur, sans port et sans configuration. Cette seule propriete explique sa domination dans les tutoriels et les prototypes, et c est un avantage d ingenierie reel plutot qu une bequille pour debutants : pouvoir tester la logique de recuperation sans infrastructure raccourcit nettement la boucle. Le coeur du moteur a ete reecrit en Rust, la question des performances se pose donc mieux que ses origines Python ne le laissent penser, meme si le filtrage par metadonnees reste plus simple que celui de Qdrant et la recherche hybride plus recente et moins complete. Chroma Cloud existe egalement, ce que la plupart des comparatifs de cette categorie omettent : Starter coute 0 $/mois plus la consommation avec 5 $ de credits et 10 bases, Team 250 $/mois plus la consommation avec 100 bases et un support Slack dedie, et Enterprise ajoute des grappes mono-locataire ou BYOC. L usage est facture 2,50 $ par Gio ecrit, 0,33 $ par Gio stocke et par mois, 0,0075 $ par Tio interroge et 0,09 $ par Gio renvoye.
Avantages
- +Tourne dans le processus sans serveur, il n y a donc rien a provisionner pour commencer
- +Le plus simple a apprendre des quatre et le plus courant dans les tutoriels et les exemples
- +Coeur desormais en Rust, les performances sont donc meilleures que ne le suggere son heritage Python
- +Chroma Cloud demarre a 0 $/mois plus la consommation : passer au gere n impose donc pas de sauter a un abonnement mensuel
Inconvénients
- –Le filtrage par metadonnees est plus simple que celui de Qdrant et la recherche hybride est la moins complete ici
- –Ce n est pas le moteur avec lequel monter a des dizaines de millions de vecteurs : migrez avant, pas apres
- –Le modele embarque qui fait sa simplicite signifie aussi qu il n est pas un serveur multi-locataire par defaut
Toutes ont desormais un palier gratuit
Depuis juin 2026, les quatre editeurs offrent un moyen d executer une charge reelle a cout nul, et c est le moyen le plus rapide de savoir si le comparatif que vous lisez a ete actualise cette annee. Un guide qui vous dit que Weaviate ne vous donne qu un bac a sable de 14 jours decrit un etat du monde qui a pris fin le 17 juin 2026.
Les quatre offres gratuites ont des formes reellement differentes, et cela compte plus que le simple fait qu elles existent. Qdrant Cloud vous donne une grappe mononoeud persistante avec 0,5 vCPU, 1 Go de RAM et 4 Go de disque, gratuite a vie : une petite machine que vous conservez. Pinecone Starter est gratuit avec 2 Go de stockage et des quotas mesures de 2 M d unites d ecriture et 1 M de lecture par mois : de la capacite plus un budget de debit. L offre gratuite de Weaviate donne 100 000 objets, 1 Go de memoire et 10 Go de disque sans carte et sans expiration : la plus genereuse en disque. Chroma Cloud Starter coute 0 $ par mois plus la consommation avec 5 $ de credits, ce qui est un solde et non un quota permanent, et finira par s epuiser sous charge.
Lisez cela au regard de votre charge, et non les unes contre les autres. Si vous stockez beaucoup et interrogez peu, les 10 Go de Weaviate sont l offre la plus forte ici. Si vous interrogez sans cesse un petit corpus, le quota d unites de lecture de Pinecone compte davantage que le chiffre de disque de qui que ce soit.
⚠️Warning: Le « 0 $/mois » de Chroma Cloud n est pas le meme type de gratuite que chez les trois autres. C est une offre facturee a l usage avec 5 $ de credits initiaux : elle est donc gratuite jusqu a epuisement des credits et non de facon continue. Les trois autres ont des quotas permanents qui se renouvellent ou perdurent.
Ce que coute 1 M de vecteurs sur 12 mois
Pour un million de vecteurs en 1 536 dimensions — soit un corpus a la taille des plongements OpenAI — les couts d infrastructure sont assez proches entre auto-heberge et gere pour que le temps d exploitation tranche. Les chiffres ci-dessous supposent un deploiement mononoeud sur une machine a 40 a 80 dollars par mois avec 4 vCPU et 16 Go de RAM, face au palier le plus bas de chaque editeur couvrant confortablement la meme charge.
| Approche | Infra mensuelle | Heures expl./mois | Cout expl. a 75 $/h | Total 12 mois |
|---|---|---|---|---|
| Qdrant auto-heberge | ~60 $ | 2–4 | 150–300 $ | ~2 520–4 320 $ |
| Weaviate auto-heberge | ~60 $ | 3–5 | 225–375 $ | ~3 420–5 220 $ |
| Chroma auto-heberge | ~40 $ | 2–3 | 150–225 $ | ~2 280–3 180 $ |
| Pinecone Standard | 50 $ min. plus usage | 0,5–1 | 38–75 $ | ~1 060–1 500 $ |
| Weaviate Cloud Flex | 45 $ min. plus usage | 0,5–1 | 38–75 $ | ~996–1 440 $ |
| Qdrant Cloud Standard | est. 40–70 $ | 0,5–1 | 38–75 $ | ~936–1 740 $ |
A un million de vecteurs, c est generalement la ligne exploitation qui tranche, pas le prix affiche. Auto-hebergez quand la residence ou le volume l exigent ; sinon les paliers geres reviennent moins cher des lors que vos propres heures sont valorisees honnetement.
📌Note: Ce sont des estimations modelisees a partir des prix habituels de machines et des tarifs publics des editeurs au 28 aout 2026, et non des factures de production mesurees. Les couts a l usage chez Pinecone, Qdrant Cloud et Chroma Cloud varient avec le volume de requetes : passez votre volume attendu de lectures et d ecritures dans le calculateur de chaque editeur avant de vous engager.
Recherche hybride et support des frameworks
Les quatre s integrent a LangChain et LlamaIndex, la question du framework est donc largement reglee ; c est sur la recherche hybride qu ils different vraiment. La recherche hybride melange le score par mots-cles, generalement BM25, et la similarite vectorielle, et elle existe parce que la recherche purement semantique a un mode de defaillance precis et previsible.
Ce mode de defaillance, ce sont les jetons exacts. References produit, numeros de modele, chaines d erreur, identifiants de version et acronymes signifient leur forme litterale, et le plongement de « ERR_4021 » se situe pres des plongements d autres chaines d erreur plutot que pres du passage qui documente celle-ci precisement. La correspondance par mot-cle les capte trivialement, la recherche semantique non : c est pourquoi melanger les deux ameliore la precision sur les corpus techniques bien plus que d affiner le modele d embeddings.
Weaviate possede l implementation la plus mature, avec le score BM25 et le score vectoriel combines dans l API de requete et un controle reel sur la ponderation. Qdrant arrive au meme resultat grace au support natif des vecteurs creux aux cotes des denses, ce qui est architecturalement plus propre et a peu pres aussi capable. Pinecone le prend en charge via ses types d index creux et dense. Celle de Chroma est la plus recente et la moins complete, et c est celle qu il faut mesurer sur vos propres requetes avant d en dependre dans un chemin critique de lancement.
Qui devrait utiliser laquelle
La taille de l equipe, la capacite d exploitation et les exigences de residence tranchent, pas les tableaux de benchmarks. Six profils couvrent la majorite des lecteurs.
- Developpeur seul ou projet RAG personnel → Chroma embarque. Pas de serveur, pas de cout mensuel, et la recherche fonctionne dans le meme processus que votre application.
- Petite equipe rapide sans recrutement en exploitation → Pinecone Builder a 20 $/mois, ou le palier gratuit de Qdrant Cloud si vous comptez auto-heberger plus tard.
- Equipe avec capacite d exploitation optimisant le cout a l echelle → Qdrant, auto-heberge ou en Standard. A la consommation et sans frais de plateforme, c est le chemin le moins cher en toute honnetete.
- La qualite de recherche est le goulet d etranglement sur un corpus technique → Weaviate, evalue sur le palier desormais gratuit, pour la maturite de sa recherche hybride.
- Equipe soucieuse de confidentialite ou reglementee avec exigence de residence → Qdrant ou Weaviate auto-heberges. Pinecone ne peut y repondre que via Enterprise et BYOC des 500 $/mois.
- Moins d environ 10 000 vecteurs → pgvector sur Postgres. Ajouter ici un moteur dedie, c est du cout d exploitation sans gain de recherche.
Bases vectorielles dans l UE, au Japon et en Chine
Un magasin vectoriel contient les plongements de vos documents sources et, dans presque tous les deploiements, le texte d origine en charge utile. Cela transforme le choix entre heberge et auto-heberge en question de protection des donnees sur trois marches importants.
Passez votre chemin si…
Si vous avez moins d environ 10 000 vecteurs, passez les quatre et utilisez pgvector sur Postgres. A cette echelle, un balayage exact des plus proches voisins s acheve en quelques millisecondes : l index approximatif qui justifie un moteur dedie resout donc un probleme que vous n avez pas. Si vous exploitez deja Postgres, pgvector ajoute un type de colonne et un index plutot qu un service, et vos vecteurs vivent dans la meme transaction que les lignes qu ils decrivent, ce qui elimine discretement toute une classe de bogues de coherence ou l index et les donnees sources divergent.
SQLite avec `sqlite-vec` couvre le meme terrain pour des applications sans aucun serveur de base de donnees. Et si vos plongements sont statiques et changent rarement, un index FAISS versionne dans votre depot est plus simple que tout cela : pas de service, pas de schema, pas de migration.
Le seuil qui vaut la peine d etre attendu est concret : des centaines de milliers de vecteurs, une latence de requete qu un balayage sequentiel ne peut plus masquer, ou un besoin de filtrage par metadonnees qui se compose avec la recherche par similarite plutot que de s executer apres elle. Monter un moteur dedie avant cela revient a exploiter un service pour resoudre un probleme que votre base actuelle traite deja.
💡Tip: Un declencheur utile : passez a un moteur dedie la premiere fois qu une requete de recuperation est assez lente pour qu un utilisateur le remarque, ou la premiere fois que vous avez besoin d une recherche par similarite filtree et que votre installation actuelle vous oblige a choisir entre le filtre et le classement.
Erreurs frequentes au moment de choisir une base vectorielle
- 1Croire que Weaviate n offre qu un bac a sable de 14 jours
Why it matters: Weaviate a lance le 17 juin 2026 un palier gratuit sans carte bancaire et sans expiration, offrant 100 000 objets, 1 Go de memoire et 10 Go de disque. Les comparatifs qui conseillent encore de budgeter 45 $/mois des le premier jour envoient les lecteurs payer pour quelque chose de desormais gratuit : c est actuellement l affirmation perimee la plus repandue de la categorie. - 2Traiter Chroma comme purement embarque et manquer Chroma Cloud
Why it matters: Chroma Cloud propose une offre Starter a 0 $/mois plus la consommation avec 5 $ de credits et une offre Team a 250 $/mois. La plupart des comparatifs listent trois options gerees alors qu il y en a quatre, ce qui fausse la conclusion pour les equipes qui apprecient le modele de Chroma et supposent que passer au gere implique de le quitter. - 3Choisir Pinecone parce que c est le nom le plus cite
Why it matters: Pinecone est l option la plus promue de cette categorie et anime un veritable programme d affiliation pour les createurs de contenu, si bien que le volume de publications qui le recommandent n est pas independant de l incitation commerciale. C est reellement le meilleur choix sans exploitation ; ce n est pas automatiquement le meilleur ni le moins cher, et c est le seul que vous ne pouvez pas auto-heberger. - 4Chiffrer l auto-hebergement au seul cout de la machine
Why it matters: Les equipes comparent une machine a 60 $ a une offre geree a 50 $ et concluent que l auto-hebergement revient moins cher, en ignorant les deux a cinq heures mensuelles de correctifs, de supervision et de verification des sauvegardes. A tout taux d ingenierie realiste, ce temps depasse l ecart de prix : c est pourquoi le tableau sur douze mois ci-dessus inverse la comparaison naive. - 5Monter un moteur dedie pour un projet de moins de 10 000 vecteurs
Why it matters: A cette echelle, pgvector dans le Postgres que vous avez deja repond aux memes requetes sans nouveau service a exploiter, et garde les vecteurs coherents transactionnellement avec les lignes qu ils decrivent. Ajouter ici un moteur dedie achete du cout d exploitation et une nouvelle API sans aucun gain de recherche.
Questions frequentes
Qu est-ce qu une base de donnees vectorielle ?
Une base de donnees vectorielle stocke les plongements numeriques en haute dimension produits par un modele d embeddings et repond a des requetes de plus proches voisins, ce qui constitue l etape de recuperation au coeur d une chaine RAG. Les bases classiques ne sont pas optimisees pour la recherche par similarite sur des millions de vecteurs en haute dimension, d ou l existence de moteurs dedies comme Qdrant, Pinecone, Weaviate et Chroma : ils utilisent des index approximatifs qui echangent un peu de rappel contre une acceleration considerable.
Quelle base vectorielle dispose d un palier gratuit ?
Les quatre en 2026, ce qui n etait pas vrai il y a un an. Qdrant Cloud propose un noeud gratuit a vie avec 0,5 vCPU, 1 Go de RAM et 4 Go de disque. Pinecone Starter est gratuit avec 2 Go de stockage, 2 M d unites d ecriture et 1 M de lecture par mois. Weaviate a lance le 17 juin 2026 un palier gratuit sans carte et sans expiration avec 100 000 objets, 1 Go de memoire et 10 Go de disque. Chroma Cloud Starter coute 0 $ par mois plus la consommation avec 5 $ de credits, ce qui est un solde et non un quota permanent.
Pinecone est-il meilleur que Weaviate pour le RAG ?
Aucun n est universellement meilleur. Pinecone a le produit gere serverless le plus mature et aucune version auto-hebergee : le choisir revient donc a s engager sur ce moteur. Weaviate propose le meme moteur auto-heberge et gere, ce qui vous laisse un chemin de migration dans les deux sens, et possede la recherche hybride la plus mature. Choisissez Pinecone si ce que vous achetez est la simplicite d exploitation ; choisissez Weaviate si la qualite de recherche sur du contenu technique compte ou si vous voulez garder l option d un materiel a vous plus tard.
Combien coute une base vectorielle pour 1 million de vecteurs ?
Aux tarifs publics d aout 2026, un palier gere revient a environ 45 a 70 dollars par mois a cette echelle avant depassements, tandis que l auto-hebergement sur une petite machine coute 40 a 60 dollars par mois d infrastructure plus deux a cinq heures mensuelles d exploitation. Une fois ces heures valorisees a un taux d ingenierie realiste, le gere revient generalement moins cher sur douze mois — voyez le tableau comparatif complet ci-dessus.
Qdrant est-il la meme chose que Weaviate ?
Non. Ce sont des projets open source distincts, aux architectures et aux interfaces de requete differentes. Qdrant est ecrit en Rust avec sa propre API sur REST et gRPC ; Weaviate est ecrit en Go et est connu pour son interface GraphQL. Les deux prennent en charge la recherche hybride et fonctionnent auto-heberges ou geres, mais les requetes ecrites pour l un ne sont pas portables vers l autre sans reecriture. Qdrant a l empreinte la plus faible et le filtrage le plus solide ; Weaviate a la recherche hybride la plus mature et des modules de vectorisation integres.
Comment migrer de Chroma vers Qdrant ?
Exportez la collection depuis Chroma avec son client Python via `collection.get(include=["embeddings","metadatas","documents"])`, puis inserez par lots les vecteurs et les charges utiles dans une nouvelle collection Qdrant avec la methode `upsert` du client, en veillant a ce que la metrique de distance corresponde entre les deux : cosinus, produit scalaire ou euclidienne. Si vous avez construit sur LangChain ou LlamaIndex, tous deux abstraient le magasin vectoriel : changer de backend releve donc surtout d un changement de configuration et d une reindexation.
Ces editeurs ont-ils des programmes d affiliation ?
Pinecone oui. Sa page partenaires liste un programme d affiliation destine aux createurs de contenu et aux formateurs qui percoivent une commission pour du contenu mettant en avant Pinecone, aux cotes des categories partenaires technologiques, solutions et prescripteurs. Nous n avons trouve aucun programme public equivalent pour Qdrant, Weaviate ou Chroma, qui listent plutot des partenariats technologiques et de revente destines aux entreprises. PromptQuorum n est pas inscrit au programme de Pinecone et ne gagne rien sur aucun lien de cette page — cela merite d etre dit clairement, car c est la seule categorie ou un tel programme existe et ce n est pas l option que nous recommandons en premier.
Puis-je utiliser Chroma en production ou seulement pour prototyper ?
Il est utilise en production pour des applications RAG petites a moyennes, et son coeur en Rust en fait un choix plus raisonnable que ses origines Python ne le suggerent. La contrainte est l echelle : planifiez la migration vers Qdrant ou Weaviate avant d etre bien engage dans les millions de vecteurs, et non apres un incident de latence. Chroma Cloud existe aussi si vous voulez le meme modele en gere, a partir de 0 $ par mois plus la consommation.
Verdict final
- Utilisez Qdrant si vous voulez le meilleur rapport cout-performance et un moteur qui fonctionne auto-heberge ou gere — etape suivante : demarrez sur le palier cloud gratuit a vie et passez a Standard quand 4 Go ne suffisent plus, plutot que de provisionner d abord une machine.
- Utilisez Pinecone si vous voulez zero travail d infrastructure et acceptez la dependance au moteur — etape suivante : demarrez sur Builder a 20 $/mois et modelisez votre volume d unites de lecture et d ecriture avant de passer a Standard.
- Utilisez Weaviate si la recherche hybride est centrale pour la recuperation — etape suivante : evaluez-le sur le palier gratuit, qui depuis juin 2026 ne coute rien et n expire pas.
- Utilisez Chroma si vous prototypez et voulez une recherche fonctionnelle aujourd hui — etape suivante : `pip install chromadb`, et planifiez la migration vers Qdrant ou Weaviate a votre rythme.
- Passez les quatre si vous avez moins d environ 10 000 vecteurs — etape suivante : utilisez pgvector dans le Postgres que vous exploitez deja, et reevaluez quand la latence ou la recherche filtree l imposera vraiment.