[{"data":1,"prerenderedAt":703},["ShallowReactive",2],{"tool-qdrant-de":3},{"slug":4,"published":5,"minutes":6,"category":7,"tags":8,"keywords":14,"about":22,"sources":32,"cover":72,"og":73,"expertise":74,"locales":75,"lang":77,"title":79,"description":80,"coverAlt":81,"url":82,"pricing":83,"kind":24,"metaTitle":84,"takeaways":85,"faq":91,"toc":104,"blocks":129,"others":512},"qdrant","2026-05-26",10,"rag",[9,10,11,12,13],"Vector search","HNSW","Quantisation","Hybrid search","Filtering",[4,15,16,17,18,19,20,21],"qdrant vs pinecone","vector database comparison","hnsw index","filtered vector search","vector quantisation","hybrid search rrf","rag vector store",[23,26,29],{"name":24,"url":25},"Vector database","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FVector_database",{"name":27,"url":28},"Nearest neighbor search","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FNearest_neighbor_search",{"name":30,"url":31},"Retrieval-augmented generation","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FRetrieval-augmented_generation",[33,36,39,42,45,48,51,54,57,60,63,66,69],{"title":34,"url":35},"Qdrant documentation","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002F",{"title":37,"url":38},"Qdrant: points","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fmanage-data\u002Fpoints\u002F",{"title":40,"url":41},"Qdrant: collections","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fconcepts\u002Fcollections\u002F",{"title":43,"url":44},"Qdrant: indexing","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fmanage-data\u002Findexing\u002F",{"title":46,"url":47},"Qdrant: quantisation","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fmanage-data\u002Fquantization\u002F",{"title":49,"url":50},"Qdrant: capacity planning","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fcapacity-planning\u002F",{"title":52,"url":53},"Qdrant: optimise performance","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fops-optimization\u002Foptimize\u002F",{"title":55,"url":56},"Qdrant: hybrid and multi-stage queries","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fconcepts\u002Fhybrid-queries\u002F",{"title":58,"url":59},"Qdrant: filtering","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fconcepts\u002Ffiltering\u002F",{"title":61,"url":62},"Qdrant: security and access control","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fsecurity\u002F",{"title":64,"url":65},"Qdrant pricing","https:\u002F\u002Fqdrant.tech\u002Fpricing\u002F",{"title":67,"url":68},"Qdrant on GitHub","https:\u002F\u002Fgithub.com\u002Fqdrant\u002Fqdrant",{"title":70,"url":71},"Qdrant vector search benchmarks","https:\u002F\u002Fqdrant.tech\u002Fbenchmarks\u002F","\u002Fimages\u002Fblog\u002Fqdrant\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fqdrant\u002Fog.jpg","ai-engineer",[76,77,78],"en","de","hu","Qdrant: eine Vektordatenbank, gebaut um Filtern","Qdrant im Test: filterbares HNSW, vier Quantisierungsmethoden, die Memory-Tier in Version 1.19 und der Betrieb, den niemand mehr publiziert.","Titelbild zum Qdrant-Test: eine Anfrage durch einen filterbaren HNSW-Graphen in eine Sammlung von Punkten","https:\u002F\u002Fqdrant.tech","Apache-2.0 · Cloud from $25 per month","Qdrant im Test: die filter-zuerst-Datenbank · Balázs Csorba",[86,87,88,89,90],"Die aktuelle Version ist 1.19.2 vom 5. Oktober 2026; der Memory-Tier-Parameter, der jede Größenplanung bestimmt, kam mit 1.19.","Filtern ist das Argument für das Produkt: Ein Payload-Index steuert die HNSW-Traversierung, er muss aber vor dem Import existieren, sonst wird der Graph neu gebaut.","TurboQuant komprimiert bis zu 32-fach, arbeitet standardmäßig asymmetrisch und bewertet die Top-k gegen Vektoren in voller Präzision neu – ein Latenzpreis bei jeder Anfrage.","Eine selbst gehostete Instanz ist für jedes Netzwerkinterface offen und unauthentifiziert, bis API-Schlüssel, TLS und Netzwerkbindung von Hand konfiguriert sind.","Die Benchmark-Seite des Herstellers zeigt noch Läufe aus Januar und Juni 2024; ihre Vergleichszahlen tragen 2026 keine Kaufentscheidung mehr.",[92,95,98,101],{"q":93,"a":94},"Ist Qdrant im Produktivbetrieb kostenlos?","Ja. Der Server steht unter Apache-2.0, und selbst gehostet gibt es keine Lizenzgebühr, keine Feature-Schranke und keinen Telemetrie-Zwang. Der Preis sind die Betriebsaufgaben: Authentifizierung, TLS, Backups, Shard-Rebalancing und Updates liegen bei Ihnen. Qdrant Cloud ist die verwaltete Alternative, mit einem kostenlosen Tier von einem Knoten, 1 GB RAM und 4 GB Platte.",{"q":96,"a":97},"Qdrant oder pgvector?","Unter einigen Millionen Vektoren, auf einer Datenbank, die Sie ohnehin betreiben, gewinnt pgvector auf allen Feldern außer Durchsatz: eine Erweiterung statt eines Dienstes, den jemand bereuen muss. Qdrant verdient seine Existenz, wenn auf jeder Anfrage ein Metadatenfilter liegt, weil er diesen Filter in die HNSW-Traversierung speisen kann, statt Kandidaten zu holen und wegzuwerfen.",{"q":99,"a":100},"Was kostet Qdrant Cloud?","Der Hersteller veröffentlicht keinen Einstiegspreis. Die Preisseite beschreibt stundenweise Abrechnung nach vCPU, Arbeitsspeicher, Speicher, Backup-Speicher und Inferenz-Token und verweist auf einen Rechner; das kostenlose Tier umfasst 1 GB RAM und 4 GB Platte, Standard bringt ein 99,5-Prozent-Uptime-SLA, Premium ergänzt SSO, private VPC-Links und 99,9 Prozent. Die oft zitierten rund 25 Dollar im Monat für den kleinsten bezahlten Cluster sind eine Schätzung Dritter, kein veröffentlichter Preis.",{"q":102,"a":103},"Was passiert beim Aktivieren der Quantisierung?","Die komprimierten Vektoren liegen neben den Originalen, es geht also nichts verloren und die Quantisierung lässt sich abschalten. Das Neubewerten der Top-k gegen die Originale ist standardmäßig an für binäre Quantisierung und für TurboQuant mit 1, 1,5 und 2 Bit, aus für skalare und Produktquantisierung. Die Produktions-Checkliste verlangt, die Retrieval-Qualität danach neu zu messen, weil manche Embedding-Modelle schlecht quantisieren.",[105,108,111,114,117,120,123,126],{"id":106,"title":107},"what-it-is","Was es ist",{"id":109,"title":110},"how-it-works","Wie eine Anfrage tatsächlich läuft",{"id":112,"title":113},"getting-started","Erste Schritte",{"id":115,"title":116},"memory-and-quantisation","Speicher und Quantisierung",{"id":118,"title":119},"self-hosting-and-security","Selbst hosten und Sicherheit",{"id":121,"title":122},"where-it-weakens","Wo es schwächelt",{"id":124,"title":125},"verdict","Fazit",{"id":127,"title":128},"sources","Quellen",[130,134,137,140,143,178,179,182,191,194,195,198,200,207,229,230,233,290,306,316,317,320,332,337,338,341,353,420,423,435,436,439,452,456,457],{"type":131,"content":132},"paragraph",[133],"Qdrant ist eine in Rust geschriebene Vektordatenbank unter Apache-2.0, gebaut um eine Entscheidung, die die meisten Wettbewerber als Nebensache behandeln: Ein Metadatenfilter ist nichts, was man nach dem Retrieval anwendet, sondern etwas, mit dem der Index durchlaufen wird. Heraus kommt das überzeugendste Bild für gefilterte Suche in der Open-Source-Welt, und eine wirklich einfache Betriebsgeschichte – ein Container, eine REST- und gRPC-Schnittstelle, offizielle Clients in sechs Sprachen. Der Preis dieser Fokussierung: Für die dichte Suche gibt es genau eine Indeximplementierung, HNSW, und das verwaltete Angebot rechnet nach Verbrauch statt nach veröffentlichtem Preis. Empfehlung für filterlastige Suche, weniger als Allzweckspeicher.",{"type":131,"content":135},[136],"Es liegt in derselben Schicht wie pgvector, Milvus, Weaviate und Pinecone, aber das Versprechen unterscheidt sich. Weaviate verkauft einen integrierten KI-Speicher mit eingebauter hybrider Suche und Modulen; Milvus verkauft horizontale Skalierung in die Milliarden; Pinecone verkauft null Betrieb. Qdrant verkauft Speichereffizienz und Filterdurchsatz auf einem einzelnen Knoten – ein engeres und leichter haltbares Versprechen.",{"type":138,"level":139,"id":106,"text":107},"heading",2,{"type":131,"content":141},[142],"Das Datenmodell ist absichtlich klein. Ein Punkt ist ein Datensatz mit einem Vektor und einem optionalen JSON-Payload. Eine Collection ist eine benannte Menge von Punkten mit gemeinsamer Dimension und Distanzmetrik. Benannte Vektoren erlauben mehrere Vektoren pro Punkt mit eigener Dimension und Metrik – so wird hybride Suche ausgedrückt. Alles Übrige im Produkt ist Maschinerie, um den nächsten Nachbarn schneller zu finden, ohne zu scannen.",{"type":144,"ordered":145,"items":146},"list",false,[147,149,156,158,168,170,176],[148],"Lizenz Apache-2.0, in Rust geschrieben, ein Repository mit rund 35.000 Sternen und 7.100 Commits.",[150,151,155],"Aktuelle Version 1.19.2 vom 5. Oktober 2026; die Version 1.19 brachte die ",{"tag":152,"children":153},"code",[154],"memory","-Tiers, die bestimmen, wo Vektoren, Indizes und Payloads liegen.",[157],"Distanzmetriken sind Dot Product, Cosine, euklidisch und Manhattan; Cosine ist als Dot Product über normalisierte Vektoren implementiert, normalisiert beim Upload.",[159,160,163,164,167],"Für die dichte Suche wird ausschließlich HNSW verwendet, mit ",{"tag":152,"children":161},[162],"m"," standardmäßig 16 und ",{"tag":152,"children":165},[166],"ef_construct"," 100, beides pro Collection und benanntem Vektor überschreibbar.",[169],"Payload-Index-Typen sind keyword, integer, float, bool, geo, datetime, text und uuid, jeweils vor dem Import angelegt, damit das filterbare HNSW sie nutzen kann.",[171,172,175],"Hybride und mehrstufige Suche kam mit 1.10 über die Query API: ",{"tag":152,"children":173},[174],"prefetch","-Unterabfragen, verschmolzen mit RRF oder DBSF, wobei Prefetches verschachtelt sein können.",[177],"Offizielle Clients gibt es für Python, TypeScript, Rust, Go, Java und .NET über REST auf 6333 und gRPC auf 6334.",{"type":138,"level":139,"id":109,"text":110},{"type":131,"content":180},[181],"Die interessante Technik steckt im Query-Planer, und sie zerfällt in drei Fälle. Ein so enger Filter, dass kaum Daten passen, ist mit einem Vollscan besser bedient als mit einem Graphendurchlauf. Ein so weiter Filter, dass fast die ganze Collection passt, kann das HNSW unverändert nutzen. Alles dazwischen – wo mandanten- und sprachbezogene Suche wohnt – ist der Fall, den ein reiner Vektorindex mit Nachfilterung schlecht beherrscht, und der Fall, für den das filterbare HNSW gebaut wurde.",{"type":183,"attrs":184,"inner":188,"caption":189},"diagram",{"viewBox":185,"role":186,"aria-labelledby":187},"0 0 720 372","img","d-qd-t d-qd-d","\u003Ctitle id=\"d-qd-t\">Three paths a filtered query can take through Qdrant\u003C\u002Ftitle>\u003Cdesc id=\"d-qd-d\">A query carrying a vector and a filter enters at the top and splits three ways. Left: the filter is strict and few points match, so the payload index is used for a full scan and the HNSW graph is skipped; the default full scan threshold is 10,000 kilobytes, where one kilobyte is one vector of size 256. Middle: the filter is weak and most points match, so the HNSW graph is used as it is and filtering happens afterwards. Right: the filter is in the middle, the case that matters in production, so the payload index feeds the HNSW walk, and the payload indexes have to exist before the data is ingested or the graph has to be rebuilt. A band below: with quantisation enabled the graph is walked over compressed vectors and the top candidates are rescored against the originals, with rescore and oversampling as per-query settings.\u003C\u002Fdesc>\u003Ctext x=\"20\" y=\"26\" class=\"d-title\">Three paths a filtered query can take\u003C\u002Ftext>\u003Ctext x=\"700\" y=\"26\" text-anchor=\"end\" class=\"d-label\">decided by the filter, not the vector\u003C\u002Ftext>\u003Crect x=\"270\" y=\"44\" width=\"180\" height=\"50\" rx=\"10\" class=\"d-accent\" \u002F>\u003Ctext x=\"360\" y=\"66\" text-anchor=\"middle\" class=\"d-text\">Query\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"84\" text-anchor=\"middle\" class=\"d-small\">vector + filter\u003C\u002Ftext>\u003Cpath d=\"M126 100 V112 H360 V124\" class=\"d-line\" \u002F>\u003Cpath d=\"M360 100 V124\" class=\"d-line\" \u002F>\u003Cpath d=\"M594 100 V112 H360\" class=\"d-line\" \u002F>\u003Crect x=\"20\" y=\"124\" width=\"213\" height=\"132\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"126\" y=\"150\" text-anchor=\"middle\" class=\"d-text\">Strict filter\u003C\u002Ftext>\u003Ctext x=\"126\" y=\"176\" text-anchor=\"middle\" class=\"d-small\">payload index\u003C\u002Ftext>\u003Ctext x=\"126\" y=\"198\" text-anchor=\"middle\" class=\"d-small\">plus a full scan\u003C\u002Ftext>\u003Ctext x=\"126\" y=\"220\" text-anchor=\"middle\" class=\"d-small\">no graph walk\u003C\u002Ftext>\u003Ctext x=\"126\" y=\"242\" text-anchor=\"middle\" class=\"d-small\">default 10,000 KB\u003C\u002Ftext>\u003Crect x=\"253\" y=\"124\" width=\"214\" height=\"132\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"360\" y=\"150\" text-anchor=\"middle\" class=\"d-text\">Weak filter\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"176\" text-anchor=\"middle\" class=\"d-small\">HNSW as it is\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"198\" text-anchor=\"middle\" class=\"d-small\">filter afterwards\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"220\" text-anchor=\"middle\" class=\"d-small\">cheap, broad\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"242\" text-anchor=\"middle\" class=\"d-small\">the easy case\u003C\u002Ftext>\u003Crect x=\"486\" y=\"124\" width=\"213\" height=\"132\" rx=\"10\" class=\"d-gold\" \u002F>\u003Ctext x=\"592\" y=\"150\" text-anchor=\"middle\" class=\"d-text\">Middle ground\u003C\u002Ftext>\u003Ctext x=\"592\" y=\"176\" text-anchor=\"middle\" class=\"d-small\">filterable HNSW\u003C\u002Ftext>\u003Ctext x=\"592\" y=\"198\" text-anchor=\"middle\" class=\"d-small\">index feeds the walk\u003C\u002Ftext>\u003Ctext x=\"592\" y=\"220\" text-anchor=\"middle\" class=\"d-small\">tenants, languages\u003C\u002Ftext>\u003Ctext x=\"592\" y=\"242\" text-anchor=\"middle\" class=\"d-small\">index before ingest\u003C\u002Ftext>\u003Crect x=\"20\" y=\"280\" width=\"679\" height=\"72\" rx=\"10\" class=\"d-box d-dash\" \u002F>\u003Ctext x=\"40\" y=\"308\" class=\"d-text\">With quantisation on\u003C\u002Ftext>\u003Ctext x=\"40\" y=\"332\" class=\"d-small\">the walk runs over compressed vectors and the top candidates are rescored against the originals;\u003C\u002Ftext>\u003Ctext x=\"40\" y=\"350\" class=\"d-small\">rescore and oversampling are per-query settings, so the recall and latency trade is tunable at query time\u003C\u002Ftext>",[190],"Der Filter entscheidet über den Ausführungspfad, und die Standardschwellen sind Konfiguration, die man übernimmt statt wählt.",{"type":131,"content":192},[193],"Ein Betriebsdetail aus der mittleren Spalte verursacht mehr Ausfallzeit als jedes Query-Tuning: Payload-Indizes helfen dem HNSW-Graphen nur, wenn sie vor den Daten existierten. Ein Tenant-Feld zu einer bestehenden Collection hinzuzufügen heißt, den Graphen neu bauen zu lassen, damit er filterbewusst wird – bei großen Collections in Stunden gemessen. Das Payload-Schema gehört vor den ersten Upsert geplant, nicht nach dem ersten Vorfall.",{"type":138,"level":139,"id":112,"text":113},{"type":131,"content":196},[197],"Ein Container auf 6333 ohne Authentifizierung reicht zum Start, und das ist zugleich das Wichtigste, was vor dem Verlassen des Laptops zu reparieren ist. Die Konfiguration unten legt eine Collection mit TurboQuant auf einem Bit an, indiziert das Tenant-Feld vor dem Import und führt eine gefilterte Anfrage über die Query API aus:",{"type":152,"code":199},"from qdrant_client import QdrantClient, models\n\nclient = QdrantClient(url=\"http:\u002F\u002Flocalhost:6333\")\n\nclient.create_collection(\n    collection_name=\"chunks\",\n    vectors_config=models.VectorParams(size=1024, distance=models.Distance.COSINE),\n    quantization_config=models.TurboQuantization(\n        turbo=models.TurboQuantQuantizationConfig(bits=models.TurboQuantBitSize.BITS1),\n    ),\n)\n\n# Before ingestion: the HNSW graph can only be filter-aware for\n# fields that already have a payload index.\nclient.create_payload_index(\n    collection_name=\"chunks\",\n    field_name=\"tenant\",\n    field_schema=models.PayloadSchemaType.KEYWORD,\n)\n\nclient.upsert(\n    collection_name=\"chunks\",\n    points=[models.PointStruct(id=1, vector=[0.1] * 1024, payload={\"tenant\": \"acme\"})],\n)\n\nhits = client.query_points(\n    collection_name=\"chunks\",\n    query=[0.1] * 1024,\n    query_filter=models.Filter(\n        must=[models.FieldCondition(key=\"tenant\", match=models.MatchValue(value=\"acme\"))],\n    ),\n    limit=10,\n    search_params=models.SearchParams(quantization=models.QuantizationSearchParams(oversampling=2.0)),\n).points\n",{"type":131,"content":201},[202,203,206],"Zwei Dinge in diesem Snippet lohnen sich. Die Quantisierung ist eine Collection-Einstellung, die beim Indexieren angewendet wird, und die komprimierten Vektoren liegen neben den Originalen – die Originale bleiben also für ein Rescore vorhanden. Der Parameter ",{"tag":152,"children":204},[205],"oversampling"," verlangt das Doppelte an Kandidaten aus dem quantisierten Index, bevor neu bewertet wird. Das ist der Hebel, wenn die komprimierte Suche Ergebnisse verliert, die eigentlich drin sein müssten.",{"type":208,"variant":209,"title":210,"body":211},"callout","note","Die Kapazitätsseite vor dem ersten Knoten lesen",[212],[213,214,217,218,221,222,224,225,228],"Die Größenregeln des Herstellers sind kurz genug zum Auswendiglernen. Vektoren und HNSW-Indizes stehen standardmäßig auf ",{"tag":152,"children":215},[216],"cached",", sind also vorbeladen, aber verdrängbar; ",{"tag":152,"children":219},[220],"cold"," legt sie auf die Platte. Payloads stehen standardmäßig auf ",{"tag":152,"children":223},[220],", Payload-Indizes und quantisierte Vektoren auf ",{"tag":152,"children":226},[227],"pinned",". Für Payload-Indizes das Doppelte der indizierten Felder veranschlagen, für die Payload-Speicherung den Faktor 1,5 obendrauf.",{"type":138,"level":139,"id":115,"text":116},{"type":131,"content":231},[232],"Quantisierung ist die wirksamste Einzelmaßnahme vor dem Produktivbetrieb, und Qdrant bietet inzwischen vier Methoden mit wirklich unterschiedlichen Zielkonflikten statt eines einzelnen Binärschalters. Die Produktions-Checkliste führt sie neben einer ehrlichen RAM-Planung und der Indizierung der gefilterten Felder zu den drei Dingen, die man zuerst tun sollte.",{"type":234,"head":235,"rows":246},"table",[236,238,240,242,244],[237],"Methode",[239],"Kompression",[241],"Rewertet Standard",[243],"Wo sie passt",[245],"Preis",[247,258,269,280],[248,250,252,254,256],[249],"TurboQuant",[251],"Bis 32-fach, von 4 Bit bis 1 Bit",[253],"Ja, bei 1, 1,5 und 2 Bit",[255],"Standardwahl seit 1.18",[257],"Asymmetrisch, Anfragen bleiben in voller Präzision",[259,261,263,265,267],[260],"Skalar",[262],"4-fach, float32 zu int8",[264],"Nein",[266],"Kompression mit dem geringsten Risiko",[268],"Braucht ein Quantil für Ausreißer",[270,272,274,276,278],[271],"Binär",[273],"Bis 32-fach, 1 bis 2 Bit je Komponente",[275],"Ja",[277],"Hochdimensionale, zentrierte Embeddings",[279],"Versagt bei fremden Verteilungen",[281,283,285,286,288],[282],"Produkt",[284],"Bis 64-fach, 256 Zentroide je Abschnitt",[264],[287],"Wenn nur Speicher zählt",[289],"Größter Genauigkeitsverlust der vier",{"type":131,"content":291},[292,293,295,296,298,299,302,303,305],"Über die Methode hinaus hat 1.19 einen Memory-Tier-Parameter für die quantisierte Kopie eingeführt, und der macht die Quantisierung als RAM-Reduktion brauchbar statt nur als Geschwindigkeitstrick. Die Originale in den Tier ",{"tag":152,"children":294},[220]," und die quantisierten Vektoren in ",{"tag":152,"children":297},[227]," legen, dann greift die Suche nur beim Neubewerten der besten Kandidaten auf die Platte zu. Der Datentyp ",{"tag":152,"children":300},[301],"turbo4",", der jede Dimension auf der Platte mit vier statt 32 Bit speichert, verkleinert die Plattseite weiter und kostet Recall. Inline-Storage im HNSW-Index, verfügbar seit 1.16, senkt die I\u002FO-Zugriffe weiter, zahlt sich aber nur aus, wenn Vektoren und Index im Tier ",{"tag":152,"children":304},[220]," liegen und die Quantisierung aktiv ist; bei höchstens vier Bit je Dimension gehalten, sonst bläht der Index auf.",{"type":208,"variant":307,"title":308,"body":309},"warn","Quantisierung ist eine Recall-Entscheidung, keine Speicherentscheidung",[310],[311,312,315],"Die Dokumentation sagt ausdrücklich, dass sich manche Embedding-Modelle nicht effizient quantisieren lassen, und die Produktions-Checkliste verlangt, die Retrieval-Qualität danach neu zu messen, statt das anzunehmen. Behandeln Sie Recall als Abnahmekriterium mit einer Zahl, und lassen Sie eine Möglichkeit, die Quantisierung pro Anfrage abzuschalten – der Suchparameter ",{"tag":152,"children":313},[314],"ignore"," tut genau das ohne Neuaufbau der Collection.",{"type":138,"level":139,"id":118,"text":119},{"type":131,"content":318},[319],"Die Sicherheitsdokumentation beginnt mit dem Satz, selbst gehostete Open-Source-Installationen seien standardmäßig nicht sicher und nicht produktionsreif, und eine Standardinstanz sei für alle Netzwerkinterfaces ohne konfigurierte Authentifizierung offen. Das ist eine ehrlichere Sicherheitsseite als bei den meisten Datenbankherstellern, und sie kommt mit einer konkreten Checkliste.",{"type":144,"ordered":145,"items":321},[322,324,326,328,330],[323],"Drei Typen von API-Schlüsseln: Admin, Read-only für reine Abfragedienste und granulare Schlüssel mit Lese- oder Schreibrechten je Collection.",[325],"TLS für den Verkehr in beide Richtungen, dazu eine Netzwerkbindung an ein privates Interface; lokal an 127.0.0.1 binden.",[327],"Audit-Logging der API-Operationen in eine Datei, für Forensik und Nachweispflichten statt für Erkenntnisse.",[329],"Auf Qdrant Cloud funktioniert all das genauso, dort sind die Kontrollen standardmäßig aktiv – das ist das eigentliche Argument für das verwaltete Angebot.",[331],"Die Support-Tiers Community, Standard und Premium unterscheiden sich in der Reaktionszeit (vier Stunden bei einem Totalausfall im kostenlosen Tier, eine Stunde in Standard), nicht im Funktionsumfang.",{"type":208,"variant":209,"title":333,"body":334},"Migration ist ein behauptetes Nicht-Thema, meistens",[335],[336],"Das Unternehmen nennt ein Migrationstool und Dokumentation für den Weg von einer selbst gehosteten Installation zu Qdrant Cloud; in die andere Richtung reicht laut Anbieter der Container. Für die Vektoren stimmt das. Für alles, was Sie drumherum gebaut haben, nicht: Die Fusionsstrategien der Query API und Ihr HNSW-Tuning sind die Teile, die man aufschreiben sollte, bevor man umzieht.",{"type":138,"level":139,"id":121,"text":122},{"type":131,"content":339},[340],"Fünf Schwächen sind klar zu benennen, denn sie sind es, die dagegen entscheiden.",{"type":144,"ordered":145,"items":342},[343,345,347,349,351],[344],"Ein dichter Index. Die Dokumentation sagt, Qdrant nutze für dichte Vektoren ausschließlich HNSW. Es gibt kein IVF, keinen Graphen auf Platte und keinen GPU-Index; ein Korpus, der nicht in den Arbeitsspeicher einer Maschine passt, braucht einen Architekturwechsel statt einer Einstellung.",[346],"Payload-Indizes entstehen vor dem Import oder gar nicht. Die Wirksamkeit der Optimierung hängt von einer Migration ab, die man zu terminieren vergisst.",[348],"Horizontale Skalierung gibt es, aber nicht umsonst. Shards, Replikationsfaktoren und shard-key-bewusste Lesezugriffe sind Konfiguration, die stimmen muss, und die Kapazitätsseite verlangt, all das vor der Provisionierung zu entscheiden.",[350],"Das verwaltete Angebot veröffentlicht keinen Preis. Es wird stundenweise nach vCPU, Arbeitsspeicher, Speicher, Backups und Inferenz-Token abgerechnet, mit einem Rechner statt einer Preisliste, und Serverless steht weiterhin als kommend in der Navigation.",[352],"Der öffentliche Benchmark ist veraltet. Die Vergleichsseite des Herstellers trägt Januar und Juni 2024; ihr Fazit, Qdrant führe bei Durchsatz und Latenz, beschreibt Software von vor zwei Jahren.",{"type":234,"head":354,"rows":365},[355,357,359,361,363],[356],"Engine",[358],"Lizenz",[360],"Optionen für dichte Indizes",[362],"Wo gefiltert wird",[364],"Betriebsform",[366,377,388,398,409],[367,369,371,373,375],[368],"Qdrant",[370],"Apache-2.0",[372],"Nur HNSW, filterbar",[374],"Payload-Index speist den Graphendurchlauf",[376],"Ein Container oder verwaltete Cloud",[378,380,382,384,386],[379],"pgvector",[381],"PostgreSQL-Lizenz",[383],"HNSW, IVFFlat",[385],"SQL WHERE auf derselben Tabelle",[387],"Erweiterung in einer vorhandenen Datenbank",[389,391,392,394,396],[390],"Milvus",[370],[393],"HNSW, IVF, DiskANN, SCANN, GPU",[395],"Skalarer Index in der Engine",[397],"Verteilte Dienste, aufwendig zu betreiben",[399,401,403,405,407],[400],"Weaviate",[402],"BSD-3-Clause",[404],"HNSW, flat, dynamic",[406],"Invertierter Index, native BM25-Hybridsuche",[408],"Eine Binary, optionaler Cluster",[410,412,414,416,418],[411],"Pinecone",[413],"Proprietär, nur verwaltet",[415],"Proprietärer Serverless-Index",[417],"Serverseitiges Filtern beim Dienst",[419],"Nichts zu betreiben, Abrechnung pro Anfrage",{"type":131,"content":421},[422],"Die Kurzfassung: pgvector, wenn Sie bereits Postgres betreiben und der Korpus hineinpasst; Weaviate, wenn native hybride Suche die Anforderung ist; Milvus, wenn die Zahlen wirklich in die Hunderten von Millionen gehen; Pinecone, wenn niemand etwas betreiben will. Qdrant ist die Wahl dazwischen, wo ein Metadatenfilter bei jeder Anfrage wichtiger ist als die Obergrenze.",{"type":208,"variant":307,"title":424,"body":425},"Messen Sie Ihren eigenen Recall",[426],[427,428,431,432,434],"Jeder Vergleich in diesem Umfeld ist ein Hersteller, der seine eigene Testumgebung fährt. Der nützliche Wert ist deshalb der, den Sie selbst erzeugen: der Anteil der wirklich nächsten Nachbarn, die bei Ihrem ",{"tag":152,"children":429},[430],"ef"," und Ihrem ",{"tag":152,"children":433},[162]," zurückkommen, mit und ohne Quantisierung. Die Such-API kennt dafür einen exakten Modus, und ein Lauf gegen Ihre eigenen Embeddings kostet einen Nachmittag und klärt die Debatte.",{"type":138,"level":139,"id":124,"text":125},{"type":131,"content":437},[438],"Qdrant ist die beste Open-Source-Antwort auf gefilterte Vektorsuche, und ihre Schwächen liegen alle in Bereichen, in denen es nicht gewinnen will. Steht auf praktisch jeder Anfrage ein Tenant, eine Sprache oder ein Datum – in Produktion fast immer –, ist das filterbare HNSW ein echter Architekturvorteil und kein Häkchen in einer Feature-Liste. Wählen Sie es wissend, dass die dichte Suche genau einen Index hat, das Payload-Schema an Tag eins stimmen muss und Sie die Sicherheits-Checkliste selbst abarbeiten.",{"type":144,"ordered":440,"items":441},true,[442,444,446,448,450],[443],"Wählen, wenn auf praktisch jeder Anfrage ein Metadatenfilter liegt und der Korpus auf eine Maschine passt, mit Reserve.",[445],"Wählen, wenn Sie keine Lizenzverhandlung wollen: Apache-2.0, keine Feature-Schranke, kein Telemetrie-Zwang, keine Nutzungsberichte.",[447],"Wählen, wenn Ihr Team API-Schlüssel, TLS-Zertifikat, Backup-Zeitplan und Versions-Upgrade selbst verantwortet.",[449],"Nicht wählen, wenn der Korpus den Arbeitsspeicher sprengen wird und niemand Lust auf eine Migration zu einer verteilten Engine hat.",[451],"Nicht auf Basis eines Benchmarks wählen. Prüfen Sie den Recall im exakten Modus an Ihren eigenen Embeddings, dann entscheiden Sie.",{"type":453,"content":454},"quote",[455],"Selbst gehostete Open-Source-Installationen sind standardmäßig nicht sicher und nicht produktionsreif. Alle selbst aufgesetzten Qdrant-Instanzen sind standardmäßig für alle Netzwerkinterfaces offen und haben keine konfigurierte Authentifizierung.",{"type":138,"level":139,"id":127,"text":128},{"type":144,"ordered":440,"items":458},[459,464,468,472,476,480,484,488,492,496,500,504,508],[460],{"tag":461,"href":35,"children":462},"a",[463],"Qdrant Dokumentation",[465],{"tag":461,"href":38,"children":466},[467],"Qdrant: Points",[469],{"tag":461,"href":41,"children":470},[471],"Qdrant: Collections",[473],{"tag":461,"href":44,"children":474},[475],"Qdrant: Indizierung, Payload-Indizes und das filterbare HNSW",[477],{"tag":461,"href":47,"children":478},[479],"Qdrant: Quantisierungsmethoden und Memory-Tiers",[481],{"tag":461,"href":50,"children":482},[483],"Qdrant: Kapazitätsplanung",[485],{"tag":461,"href":53,"children":486},[487],"Qdrant: Leistung optimieren",[489],{"tag":461,"href":56,"children":490},[491],"Qdrant: hybride und mehrstufige Abfragen",[493],{"tag":461,"href":59,"children":494},[495],"Qdrant: Filterklauseln",[497],{"tag":461,"href":62,"children":498},[499],"Qdrant: Sicherheit und Zugriffskontrolle",[501],{"tag":461,"href":65,"children":502},[503],"Qdrant Preise: kostenlos, Standard und Premium",[505],{"tag":461,"href":68,"children":506},[507],"Qdrant auf GitHub",[509],{"tag":461,"href":71,"children":510},[511],"Qdrant Vektor-Benchmarks",[513,563,614,653],{"slug":514,"published":515,"minutes":516,"category":7,"tags":517,"keywords":523,"about":532,"sources":536,"cover":555,"og":556,"expertise":74,"locales":557,"lang":77,"title":558,"description":559,"coverAlt":560,"url":561,"pricing":562,"kind":518},"zep","2026-10-06",11,[518,519,520,521,522],"Agent memory","Knowledge graph","Temporal graph","Context engineering","RAG",[524,525,526,527,528,529,530,531],"zep ai","zep agent memory","graphiti knowledge graph","zep pricing","zep vs mem0","long-term memory for agents","temporal knowledge graph","zep cloud",[533],{"name":534,"url":535},"Zep","https:\u002F\u002Fwww.getzep.com\u002F",[537,540,543,546,549,552],{"title":538,"url":539},"Zep pricing: plans, credits and limits","https:\u002F\u002Fwww.getzep.com\u002Fpricing",{"title":541,"url":542},"Zep documentation","https:\u002F\u002Fhelp.getzep.com\u002F",{"title":544,"url":545},"Graphiti on GitHub","https:\u002F\u002Fgithub.com\u002Fgetzep\u002Fgraphiti",{"title":547,"url":548},"Graphiti product page","https:\u002F\u002Fwww.getzep.com\u002Fplatform\u002Fgraphiti\u002F",{"title":550,"url":551},"Announcing a new direction for Zep's open-source strategy","https:\u002F\u002Fwww.getzep.com\u002Fblog\u002Fannouncing-a-new-direction-for-zeps-open-source-strategy\u002F",{"title":553,"url":554},"Graphiti: temporal knowledge graphs for AI agents (arXiv)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2501.13956","\u002Fimages\u002Fblog\u002Fzep\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fzep\u002Fog.jpg",[76,77,78],"Zep-Review: Agenten-Memory auf einem temporalen Graphen","Zep ist eine gehostete Agenten-Memory-API auf einem temporalen Knowledge Graph: Credits beim Schreiben, Retrieval gratis, Flex ab 125 Dollar im Monat, Graphiti als selbst hostbarer Teil.","Diagramm, wie eine Aussage in Zep den Prompt erreicht: Nachrichten und Aussagen werden in einen benutzerspezifischen Context Graph aus Entitäten und Beziehungen extrahiert, und der Retrieval durchläuft den Graphen und liefert einen Kontextblock mit den tragenden Fakten.","https:\u002F\u002Fwww.getzep.com","Apache-2.0 core · Cloud from $50 per month",{"slug":564,"published":565,"minutes":566,"category":7,"tags":567,"keywords":569,"about":576,"sources":581,"cover":606,"og":607,"expertise":74,"locales":608,"lang":77,"title":609,"description":610,"coverAlt":611,"url":612,"pricing":613,"kind":24},"lancedb","2026-09-21",9,[9,12,568,522],"Embedded database",[564,570,571,572,573,20,574,575],"lancedb review","lance vector database","embedded vector database","lancedb vs qdrant","lancedb indexing","lance data format",[577,578],{"name":24,"url":25},{"name":579,"url":580},"Apache Arrow","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FApache_Arrow",[582,585,588,591,594,597,600,603],{"title":583,"url":584},"LanceDB quickstart","https:\u002F\u002Fdocs.lancedb.com\u002Fquickstart",{"title":586,"url":587},"LanceDB vector indexes","https:\u002F\u002Fdocs.lancedb.com\u002Findexing\u002Fvector-index",{"title":589,"url":590},"LanceDB indexing guide","https:\u002F\u002Fdocs.lancedb.com\u002Findexing\u002Findex",{"title":592,"url":593},"LanceDB hybrid search","https:\u002F\u002Fdocs.lancedb.com\u002Fsearch\u002Fhybrid-search",{"title":595,"url":596},"LanceDB Enterprise","https:\u002F\u002Fdocs.lancedb.com\u002Fenterprise",{"title":598,"url":599},"LanceDB frequently asked questions","https:\u002F\u002Fdocs.lancedb.com\u002Ffaq\u002Ffaq-oss",{"title":601,"url":602},"LanceDB pricing","https:\u002F\u002Flancedb.com\u002Fpricing",{"title":604,"url":605},"LanceDB on PyPI","https:\u002F\u002Fpypi.org\u002Fproject\u002Flancedb\u002F","\u002Fimages\u002Fblog\u002Flancedb\u002Fcover.webp","\u002Fimages\u002Fblog\u002Flancedb\u002Fog.jpg",[76,77,78],"LanceDB: Vektorsuche, die als Bibliothek beginnt","Ein Test von LanceDB: eine Apache-2.0-Bibliothek statt Server, die IVF- und HNSW-Indexwahl, Hybridsuche mit Rangfusion und was Enterprise zusätzlich bringt.","Coverbild zum LanceDB-Test: eine Lance-Tabelle speist einen Vektorindex und einen Volltextindex in eine verschmolzene Rangliste","https:\u002F\u002Flancedb.com","Apache-2.0 · Cloud paid",{"slug":379,"published":565,"minutes":6,"category":7,"tags":615,"keywords":617,"about":624,"sources":630,"cover":645,"og":646,"expertise":74,"locales":647,"lang":77,"title":648,"description":649,"coverAlt":650,"url":626,"pricing":651,"kind":652},[9,616,10,522,11],"Postgres",[379,618,619,620,621,622,623],"pgvector vs qdrant","postgres vector search","hnsw index postgres","iterative index scans","binary quantization postgres","vector database postgres",[625,627],{"name":379,"url":626},"https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector",{"name":628,"url":629},"PostgreSQL","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FPostgreSQL",[631,633,636,639,642],{"title":632,"url":626},"pgvector README",{"title":634,"url":635},"pgvector changelog","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FCHANGELOG.md",{"title":637,"url":638},"PostgreSQL news: pgvector 0.8.2 released","https:\u002F\u002Fwww.postgresql.org\u002Fabout\u002Fnews\u002Fpgvector-082-released-3245\u002F",{"title":640,"url":641},"AWS: Scale pgvector with binary quantization","https:\u002F\u002Faws.amazon.com\u002Fblogs\u002Fdatabase\u002Fscale-pgvector-with-binary-quantization-on-amazon-aurora-postgresql\u002F",{"title":643,"url":644},"pgvector licence","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FLICENSE","\u002Fimages\u002Fblog\u002Fpgvector\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fpgvector\u002Fog.jpg",[76,77,78],"pgvector im Review: die Vektordatenbank, die du nicht betreiben musst","Ein Review von pgvector 0.8.7: iterative Index-Scans für gefilterte Suche, HNSW und IVFFlat, Binärquantisierung bei 100 Millionen Vektoren und das CVE im Indexaufbau.","Eine Anfrage teilt sich oben in einen exakten Sequenzscan, einen HNSW-Graphlauf und eine IVFFlat-Sonde; ein Band unten zeigt einen iterativen Scan, der weiterläuft, bis die LIMIT-Zahl erreicht ist.","PostgreSQL licence","Vector database extension",{"slug":654,"published":655,"minutes":6,"category":7,"tags":656,"keywords":658,"about":664,"sources":668,"cover":696,"og":697,"expertise":74,"locales":698,"lang":77,"title":699,"description":700,"coverAlt":701,"url":667,"pricing":702,"kind":518},"mem0","2026-09-17",[518,657,522,9],"Long-term memory",[654,659,660,661,662,529,663],"mem0 review","agent memory layer","mem0 self-hosted","mem0 pricing","mem0 alternatives",[665],{"name":666,"url":667},"Mem0","https:\u002F\u002Fmem0.ai",[669,672,675,678,681,684,687,690,693],{"title":670,"url":671},"Mem0 documentation","https:\u002F\u002Fdocs.mem0.ai\u002Fintroduction",{"title":673,"url":674},"Mem0 quickstart","https:\u002F\u002Fdocs.mem0.ai\u002Fquickstart",{"title":676,"url":677},"How Mem0 works","https:\u002F\u002Fdocs.mem0.ai\u002Fcore-concepts\u002Fhow-it-works",{"title":679,"url":680},"Mem0 pricing","https:\u002F\u002Fmem0.ai\u002Fpricing",{"title":682,"url":683},"Mem0 on GitHub","https:\u002F\u002Fgithub.com\u002Fmem0ai\u002Fmem0",{"title":685,"url":686},"mem0ai on PyPI","https:\u002F\u002Fpypi.org\u002Fproject\u002Fmem0ai\u002F",{"title":688,"url":689},"Mem0 research and benchmarks","https:\u002F\u002Fmem0.ai\u002Fresearch",{"title":691,"url":692},"Mem0 MCP server","https:\u002F\u002Fdocs.mem0.ai\u002Fplatform\u002Fmem0-mcp",{"title":694,"url":695},"Mem0 paper on arXiv","https:\u002F\u002Farxiv.org\u002Fabs\u002F2504.19413","\u002Fimages\u002Fblog\u002Fmem0\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fmem0\u002Fog.jpg",[76,77,78],"Mem0: was eine Agent-Speicherschicht pro Runde kostet","Ein Review von Mem0: extrahierte Fakten pro Runde, die Benchmark-Tabelle vom April 2026 mit Plattform-Vorbehalt, vier Cloud-Stufen und die Lücken beim Self-Hosting.","Eine Schleife, die aus Gespräch gespeicherte Fakten macht und sie zurück in den Prompt liest","Free tier · from $19 per month",1791383550851]