[{"data":1,"prerenderedAt":690},["ShallowReactive",2],{"tool-lancedb-de":3},{"slug":4,"published":5,"minutes":6,"category":7,"tags":8,"keywords":13,"about":21,"sources":28,"cover":53,"og":54,"expertise":55,"locales":56,"lang":58,"title":60,"description":61,"coverAlt":62,"url":63,"pricing":64,"kind":23,"metaTitle":65,"takeaways":66,"faq":72,"toc":85,"blocks":110,"others":497},"lancedb","2026-09-21",9,"rag",[9,10,11,12],"Vector search","Hybrid search","Embedded database","RAG",[4,14,15,16,17,18,19,20],"lancedb review","lance vector database","embedded vector database","lancedb vs qdrant","hybrid search rrf","lancedb indexing","lance data format",[22,25],{"name":23,"url":24},"Vector database","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FVector_database",{"name":26,"url":27},"Apache Arrow","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FApache_Arrow",[29,32,35,38,41,44,47,50],{"title":30,"url":31},"LanceDB quickstart","https:\u002F\u002Fdocs.lancedb.com\u002Fquickstart",{"title":33,"url":34},"LanceDB vector indexes","https:\u002F\u002Fdocs.lancedb.com\u002Findexing\u002Fvector-index",{"title":36,"url":37},"LanceDB indexing guide","https:\u002F\u002Fdocs.lancedb.com\u002Findexing\u002Findex",{"title":39,"url":40},"LanceDB hybrid search","https:\u002F\u002Fdocs.lancedb.com\u002Fsearch\u002Fhybrid-search",{"title":42,"url":43},"LanceDB Enterprise","https:\u002F\u002Fdocs.lancedb.com\u002Fenterprise",{"title":45,"url":46},"LanceDB frequently asked questions","https:\u002F\u002Fdocs.lancedb.com\u002Ffaq\u002Ffaq-oss",{"title":48,"url":49},"LanceDB pricing","https:\u002F\u002Flancedb.com\u002Fpricing",{"title":51,"url":52},"LanceDB on PyPI","https:\u002F\u002Fpypi.org\u002Fproject\u002Flancedb\u002F","\u002Fimages\u002Fblog\u002Flancedb\u002Fcover.webp","\u002Fimages\u002Fblog\u002Flancedb\u002Fog.jpg","ai-engineer",[57,58,59],"en","de","hu","LanceDB: Vektorsuche, die als Bibliothek beginnt","Ein Test von LanceDB: eine Apache-2.0-Bibliothek statt Server, die IVF- und HNSW-Indexwahl, Hybridsuche mit Rangfusion und was Enterprise zusätzlich bringt.","Coverbild zum LanceDB-Test: eine Lance-Tabelle speist einen Vektorindex und einen Volltextindex in eine verschmolzene Rangliste","https:\u002F\u002Flancedb.com","Apache-2.0 · Cloud paid","LanceDB im Test: eingebettete Vektordatenbank · Balázs Csorba",[67,68,69,70,71],"LanceDB 0.40.0, veröffentlicht am 7. Oktober 2026, ist eine Apache-2.0-Rust-Bibliothek im Anwendungsprozess, mit Python-, JavaScript- und Rust-Clients und ohne laufenden Server.","Unter etwa einer Million Zeilen ist ein Vektorindex optional: die FAQ des Herstellers misst 100.000 Paare von 1.000-dimensionalen Vektoren in unter 20 ms und empfiehlt den Index für kleine Tabellen auszulassen.","HNSW ist hier kein Index der obersten Ebene — es existiert nur innerhalb von IVF-Partitionen —, und die Doku warnt, dass HNSW-basierte Indizes bei Metadatenfiltern höhere Latenzvarianz zeigen.","Die Hybridsuche ist die stärkste Funktion: BM25-Volltextsuche und Vektorsuche, verschmolzen von einem Reciprocal-Rank-Fusion-Reranker, mit Prefiltering als Standard.","Der eigene Vergleich des Herstellers nennt für die Open-Source-Edition 10 bis 50 Abfragen pro Sekunde und 500 bis 1.000 ms auf Object Storage, gegen bis zu 10.000 Abfragen und 50 bis 200 ms bei Enterprise.",[73,76,79,82],{"q":74,"a":75},"Brauche ich in LanceDB einen Vektorindex?","Anfangs nicht. Die FAQ nennt für Brute-Force-Suche unter 20 ms bei 100.000 Paaren von 1.000-dimensionalen Vektoren und sagt, dass ein Vektorindex jenseits von etwa einer Million Zeilen oder höheren Dimensionen sinnvoll wird; darunter ist der Scan meist schnell genug.",{"q":77,"a":78},"Warum gibt es keinen schlichten HNSW-Index?","In LanceDB ist HNSW eine Unterstruktur innerhalb von IVF-Partitionen statt ein Index der obersten Ebene — das verbindet die Skalierbarkeit von IVF mit dem Recall von HNSW. Verfügbar sind IVF_HNSW_FLAT, IVF_HNSW_PQ und IVF_HNSW_SQ neben den IVF-Varianten mit und ohne Quantisierung.",{"q":80,"a":81},"Wie hält man den Index in der Open-Source-Edition gesund?","Indexbauten laufen asynchron, und angehängte Zeilen bleiben draußen, bis optimize() sie einfaltet. create_index kehrt sofort zurück, wait_for_index wartet auf vollständige Abdeckung, und fast_search() umgeht den langsameren Fallback-Scan über noch nicht indexierte Zeilen.",{"q":83,"a":84},"Was kostet LanceDB Enterprise?","Es gibt keine öffentliche Preisliste: die Preisseite ist ein Kontaktformular, und Enterprise wird als Managed-Deployment oder Bring-Your-Own-Cloud mit SOC 2 Type II und HIPAA verkauft. Der veröffentlichte Benchmark des Herstellers ergibt etwa 779 Dollar im Monat für 100 Millionen Vektoren.",[86,89,92,95,98,101,104,107],{"id":87,"title":88},"what-it-is","Was LanceDB ist",{"id":90,"title":91},"how-it-works","Wie eine Abfrage läuft",{"id":93,"title":94},"indexes","Welchen Index man baut",{"id":96,"title":97},"getting-started","Erste Schritte",{"id":99,"title":100},"where-it-shingles","Wo es hakt",{"id":102,"title":103},"pricing","Preise",{"id":105,"title":106},"verdict","Fazit",{"id":108,"title":109},"sources","Quellen",[111,115,118,121,140,194,195,202,211,230,233,234,237,281,284,317,318,321,323,337,351,352,355,402,405,419,420,427,435,436,439,452,462,463],{"type":112,"content":113},"paragraph",[114],"LanceDB ist eine eingebettete Vektordatenbank: eine Rust-Bibliothek, die sich in den Anwendungsprozess einlinkt und Vektoren, Metadaten und Quelltext im Spaltenformat Lance speichert. Kein Server zum Deployen, kein Cluster zum Ausdimensionieren, kein Connection-Pool zum Tunen — das stärkste Argument dafür und der Grund, es eher mit SQLite als mit Qdrant zu vergleichen.",{"type":112,"content":116},[117],"Es konkurriert mit den eingebetteten Optionen — SQLite mit einer Vektor-Erweiterung, Chroma, ein In-Process-Index — und, auf Object Storage gezeigt, mit den gehosteten Diensten. Es ersetzt das Muster, für ein Korpus, das auf eine Maschine passt, einen eigenen Suchcluster zu betreiben.",{"type":119,"level":120,"id":87,"text":88},"heading",2,{"type":112,"content":122},[123,124,128,129,128,132,135,136,139],"Die aktuelle Version ist 0.40.0, veröffentlicht am 7. Oktober 2026 und Python 3.10 oder neuer voraussetzend, mit JavaScript- und Rust-Clients auf demselben Rust-Kern. Die Daten liegen dort, wo die Verbindungs-URI zeigt: ein lokales Verzeichnis, ",{"tag":125,"children":126},"code",[127],"s3:\u002F\u002F",", ",{"tag":125,"children":130},[131],"gs:\u002F\u002F",{"tag":125,"children":133},[134],"az:\u002F\u002F"," oder ",{"tag":125,"children":137},[138],"db:\u002F\u002F"," für den Enterprise-Cluster — und dieselben Lance-Dateien liest beide Editionen.",{"type":141,"ordered":142,"items":143},"list",false,[144,150,155,160,179,184,189],[145,149],{"tag":146,"children":147},"strong",[148],"Lizenz:"," Apache-2.0 für die Bibliothek; Enterprise ist ein kommerzielles Produkt als Managed oder Bring-Your-Own-Cloud.",[151,154],{"tag":146,"children":152},[153],"Gestalt:"," eingebettet im eigenen Prozess — kein Daemon, kein Sharding, keine eigene Abfragesprache.",[156,159],{"tag":146,"children":157},[158],"Speicher:"," das Lance-Format hält Vektoren, Metadaten und Rohdaten in einer Tabelle, mit Versionierung und Zero-Copy-Lesern über Apache Arrow.",[161,164,165,128,168,128,171,174,175,178],{"tag":146,"children":162},[163],"Indizes:"," ",{"tag":125,"children":166},[167],"IVF_RQ",{"tag":125,"children":169},[170],"IVF_PQ",{"tag":125,"children":172},[173],"IVF_HNSW_SQ"," und ",{"tag":125,"children":176},[177],"IVF_HNSW_FLAT"," für Vektoren, BM25 für Volltext, dazu Skalarindizes.",[180,183],{"tag":146,"children":181},[182],"Suche:"," Vektor-, Volltext- und Hybridabfragen mit Reranking, standardmäßigem Prefilter, Distanzgrenzen und einem exakten Scan als Ausweg.",[185,188],{"tag":146,"children":186},[187],"Skalierung:"," bequem auf einem einzelnen Knoten; die FAQ nennt etwa 10 bis 50 Milliarden Zeilen und 10 bis 30 TB, bevor Enterprise die Antwort ist.",[190,193],{"tag":146,"children":191},[192],"Clients:"," Python, JavaScript und Rust, installiert per pip, npm oder cargo.",{"type":119,"level":120,"id":90,"text":91},{"type":112,"content":196},[197,198,201],"Eine Suche ohne Index ist ein Scan: jeder Vektor wird mit der Abfrage verglichen und die nächsten k zurückgegeben — exakt und schnell genug, solange die Tabelle klein ist. Ein IVF-Index investiert Trainingszeit, um Vektoren in Partitionen zu clustern, daher vergleicht die Abfrage zuerst mit wenigen Zentroiden und rechnet dann in diesen Partitionen per Brute Force; ",{"tag":125,"children":199},[200],"nprobes",", standardmäßig 20, legt fest, wie viele Partitionen geöffnet werden. HNSW sitzt danach in jeder Partition als Graph der zweiten Ebene — deshalb sagt die Dokumentation, HNSW sei in LanceDB kein Index der obersten Ebene.",{"type":203,"attrs":204,"inner":208,"caption":209},"diagram",{"viewBox":205,"role":206,"aria-labelledby":207},"0 0 720 160","img","lancedb-t lancedb-d","\u003Ctitle id=\"lancedb-t\">So läuft eine Hybrid-Abfrage\u003C\u002Ftitle>\u003Cdesc id=\"lancedb-d\">Ein Ablauf von links nach rechts: Zeilen werden in einer Lance-Tabelle geschrieben, die auf lokaler Platte oder im Object Storage liegt. Die Tabelle speist zwei Indizes parallel — einen Vektorindex über die Embedding-Spalte und einen BM25-Volltextindex über die Textspalte — und ein Schritt der Reciprocal Rank Fusion verschmilzt beide Ergebnislisten zu einem gerankten Top-k.\u003C\u002Fdesc>\u003Ctext x=\"8\" y=\"18\" class=\"d-title\">LANCEDB\u003C\u002Ftext>\u003Ctext x=\"712\" y=\"18\" text-anchor=\"end\" class=\"d-label\">zwei Indizes, eine Rangliste\u003C\u002Ftext>\u003Crect x=\"8\" y=\"76\" width=\"120\" height=\"48\" rx=\"10\" class=\"d-box\"\u002F>\u003Ctext x=\"68\" y=\"96\" text-anchor=\"middle\" class=\"d-text\">Import\u003C\u002Ftext>\u003Ctext x=\"68\" y=\"114\" text-anchor=\"middle\" class=\"d-small\">Arrow oder JSON\u003C\u002Ftext>\u003Cpath d=\"M128 100h28\" class=\"d-line\"\u002F>\u003Crect x=\"156\" y=\"76\" width=\"140\" height=\"48\" rx=\"10\" class=\"d-box\"\u002F>\u003Ctext x=\"226\" y=\"96\" text-anchor=\"middle\" class=\"d-text\">Lance-Tabelle\u003C\u002Ftext>\u003Ctext x=\"226\" y=\"114\" text-anchor=\"middle\" class=\"d-small\">lokal oder s3\u003C\u002Ftext>\u003Cpath d=\"M296 100 H316 V56 H336\" class=\"d-line\"\u002F>\u003Cpath d=\"M296 100 H316 V132 H336\" class=\"d-line\"\u002F>\u003Crect x=\"336\" y=\"34\" width=\"150\" height=\"44\" rx=\"10\" class=\"d-sky\"\u002F>\u003Ctext x=\"411\" y=\"50\" text-anchor=\"middle\" class=\"d-text\">Vektorindex\u003C\u002Ftext>\u003Ctext x=\"411\" y=\"68\" text-anchor=\"middle\" class=\"d-small\">HNSW, IVF, PQ\u003C\u002Ftext>\u003Crect x=\"336\" y=\"110\" width=\"150\" height=\"44\" rx=\"10\" class=\"d-gold\"\u002F>\u003Ctext x=\"411\" y=\"126\" text-anchor=\"middle\" class=\"d-text\">BM25-Index\u003C\u002Ftext>\u003Ctext x=\"411\" y=\"144\" text-anchor=\"middle\" class=\"d-small\">Volltext\u003C\u002Ftext>\u003Cpath d=\"M486 56 H512 V100 H540\" class=\"d-line\"\u002F>\u003Cpath d=\"M486 132 H512 V100 H540\" class=\"d-line\"\u002F>\u003Crect x=\"540\" y=\"76\" width=\"160\" height=\"48\" rx=\"10\" class=\"d-accent\"\u002F>\u003Ctext x=\"620\" y=\"96\" text-anchor=\"middle\" class=\"d-text\">RRF-Fusion\u003C\u002Ftext>\u003Ctext x=\"620\" y=\"114\" text-anchor=\"middle\" class=\"d-small\">Top-k\u003C\u002Ftext>",[210],"Eine Hybridsuche: eine Lance-Tabelle speist einen Vektorindex und einen BM25-Index, und die Rangfusion verschmilzt beide zu einer Liste.",{"type":112,"content":212},[213,214,217,218,221,222,225,226,229],"Die Volltextsuche ist ein eigener BM25-Index, gebaut mit ",{"tag":125,"children":215},[216],"create_fts_index",", und die Hybridsuche führt beide Hälften aus und verschmilzt sie: standardmäßig mit einem RRF-Reranker, der jede Liste in Ränge übersetzt und addiert, sodass ein Ergebnis gewinnt, das in beiden Hälften gut rangiert, ohne dass eine der beiden Skalen dominiert. Filter in ",{"tag":125,"children":219},[220],"where"," sind standardmäßig Prefilter, angewandt vor der Bewertung; ",{"tag":125,"children":223},[224],"prefilter=False"," verschiebt den Filter hinter die Teilabfragen, die dann weniger als ",{"tag":125,"children":227},[228],"limit"," Zeilen liefern können.",{"type":112,"content":231},[232],"Die Speicherschicht bestimmt das Latenzprofil. Auf lokaler Platte sind Lesezugriffe speichergemapped und schnell; auf S3, GCS oder Azure Blob ist jeder kalte Lesen ein Netzwerk-Roundtrip, und der eigene Vergleich des Herstellers nennt dafür 500 bis 1.000 ms bei der Open-Source-Edition gegen 50 bis 200 ms bei Enterprise, wo ein NVMe-Cache die Wiederholungslesezugriffe auffängt.",{"type":119,"level":120,"id":93,"text":94},{"type":112,"content":235},[236],"Die Indexwahl ist zuerst eine Kompressionsentscheidung, und die Dokumentation sagt den Trade-off ungeschönt:",{"type":238,"head":239,"rows":248},"table",[240,242,244,246],[241],"Priorität",[243],"Index",[245],"Kompression",[247],"Anmerkung",[249,257,265,273],[250,252,253,255],[251],"Maximale Kompression",[167],[254],"Etwa 1\u002F32 der Rohgröße",[256],"RaBitQ-Quantisierung über IVF",[258,260,261,263],[259],"Genauigkeit bis 256 Dimensionen",[170],[262],"1\u002F64 bis 1\u002F16 der Rohgröße",[264],"Produktquantisierung, Recall über refine_factor justiert",[266,268,269,271],[267],"Bestes Recall-zu-Latenz-Verhältnis",[173],[270],"Knapp über 1\u002F4 der Rohgröße",[272],"IVF-Partitionen mit HNSW darin, Skalarquantisierung",[274,276,277,279],[275],"Höchster Recall, ohne Quantisierung",[177],[278],"Rohgröße plus Graph-Overhead",[280],"Die teure, treue Option",{"type":112,"content":282},[283],"Zwei Regeln aus der Doku zählen mehr als die Tabelle. HNSW erscheint nie allein: es ist immer nur eine Unterstruktur innerhalb von IVF-Partitionen, es gibt also keinen schlichten HNSW-Index zu erstellen. Und wenn die Last Metadatenfilter enthält, empfiehlt die Doku IVF_RQ oder IVF_PQ, weil die HNSW-Varianten bei gefilterter Suche eine höhere Latenzvarianz zeigen.",{"type":285,"variant":286,"body":287,"title":316},"callout","warn",[288],[289,290,174,292,294,295,297,298,300,301,304,305,308,309,312,313,315],"Für ",{"tag":125,"children":291},[167],{"tag":125,"children":293},[170]," lautet die Empfehlung, ",{"tag":125,"children":296},[200]," auf dem Default zu lassen und nur bei zu wenig Recall zu erhöhen; für die IVF_HNSW-Varianten ",{"tag":125,"children":299},[200]," stehen zu lassen und zuerst ",{"tag":125,"children":302},[303],"ef"," zu justieren, beginnend bei etwa 1,5 mal k bis hoch zu 10 mal k. ",{"tag":125,"children":306},[307],"refine_factor"," gehört zwischen 5 und 50, und ein Filter, der wenige Zeilen trifft, braucht womöglich ein höheres ",{"tag":125,"children":310},[311],"maximum_nprobes",", um überhaupt ",{"tag":125,"children":314},[228]," Ergebnisse zu liefern.","Erst nprobes, dann ef",{"type":119,"level":120,"id":96,"text":97},{"type":112,"content":319},[320],"Paket installieren, auf ein Verzeichnis zeigen, und die Tabelle liegt auf der Platte. Der folgende Ausschnitt baut beide Indizes und führt die Hybridsuche aus, wie die Dokumentation sie empfiehlt, mit angewandtem Metadatenfilter vor der Bewertung.",{"type":125,"code":322},"import lancedb\nfrom lancedb.rerankers import RRFReranker\n\ndb = lancedb.connect(\".\u002Fdata\")            # a local directory, no server\ntable = db.open_table(\"documents\")\ntable.create_fts_index(\"text\")            # BM25, built in the background\n\nresults = (\n    table.search(query_type=\"hybrid\")\n    .vector(embed(query))                 # your embedding model\n    .text(\"refunds within 14 days\")\n    .where(\"lang = 'en'\", prefilter=True)  # default: filter before scoring\n    .rerank(RRFReranker())                # the default hybrid reranker\n    .limit(5)\n    .to_list()\n)\nfor row in results:\n    print(round(row[\"_relevance_score\"], 3), row[\"text\"][:80])\n",{"type":112,"content":324},[325,326,328,329,332,333,336],"In diesem Ausschnitt braucht weder ein Server noch ein Container noch einen API-Schlüssel, und derselbe Code läuft gegen ",{"tag":125,"children":327},[127],", sobald sich die Verbindungs-URI ändert. Volltext- und Vektor-Indexbauten kehren sofort zurück und laufen im Hintergrund; ",{"tag":125,"children":330},[331],"wait_for_index"," zusammen mit ",{"tag":125,"children":334},[335],"index_stats"," ist die Art, wie ein Job prüft, dass nichts mehr außerhalb des Index liegt.",{"type":285,"variant":338,"body":339,"title":350},"note",[340],[341,342,345,346,349],"Neue Zeilen bleiben außerhalb eines bestehenden Index, bis sie mit ",{"tag":125,"children":343},[344],"optimize()"," eingefaltet sind, und bis dahin zahlt eine normale Suche einen langsameren Fallback-Scan, während ",{"tag":125,"children":347},[348],"fast_search()"," ihn überspringt. In der Open-Source-Edition gehört dieser Zeitplan Ihnen: Kompaktierung und Reindexierung sind Aufrufe, die irgendjemand einplanen muss.","Zeilen nach dem Bau",{"type":119,"level":120,"id":99,"text":100},{"type":112,"content":353},[354],"Die Schwächen folgen aus der Architektur. Ein Prozess bedeutet ein Host: der eigene Vergleich des Herstellers deckt die Open-Source-Edition bei 10 bis 50 Abfragen pro Sekunde ohne Cache ab, und jede Wartungsaufgabe — Kompaktierung, Reindexierung, Indexfragmentierung nach Löschungen — ist ein Job, den jemand einplanen muss. Gleichzeitige Schreibvorgänge sind durch die Anzahl der Commit-Wiederholungen begrenzt, und Python-Anwender werden gewarnt, nicht zu forken.",{"type":238,"head":356,"rows":365},[357,359,361,363],[358],"Engine",[360],"Lizenz",[362],"Indexoptionen",[364],"Betriebsform",[366,375,384,393],[367,369,371,373],[368],"LanceDB",[370],"Apache-2.0, eingebettet",[372],"IVF und IVF-HNSW, BM25, skalar",[374],"Eine Bibliothek im eigenen Prozess",[376,378,380,382],[377],"Qdrant",[379],"Apache-2.0, Server",[381],"Filterbares HNSW, Skalar- und Produktquantisierung",[383],"Ein Container oder eine verwaltete Cloud",[385,387,389,391],[386],"pgvector",[388],"PostgreSQL-Lizenz",[390],"HNSW und IVFFlat in Postgres",[392],"Eine Erweiterung in einer Datenbank, die ohnehin läuft",[394,396,398,400],[395],"Weaviate",[397],"BSD-3-Clause",[399],"HNSW, flat und dynamic",[401],"Einzelnes Binary, optionaler Cluster",{"type":112,"content":403},[404],"Das ehrliche Fazit: LanceDB ist am billigsten zu betreiben und am aufwendigsten zu warten. Die Tabelle des Herstellers nennt für einen Prozess 10 bis 50 Abfragen pro Sekunde und 500 bis 1.000 ms auf Object Storage, wobei verteilte Suche und plattformgesteuerte Kompaktierung auf der Enterprise-Seite weiterhin als kommend markiert sind — wissenswert, bevor eine Kaufentscheidung auf der Roadmap ruht.",{"type":112,"content":406},[407,408,411,412,174,415,418],"Die API-Asymmetrie ist der andere Störfall: Auf einer Enterprise-",{"tag":125,"children":409},[410],"RemoteTable"," werden die Tabellenmethoden ",{"tag":125,"children":413},[414],"to_arrow",{"tag":125,"children":416},[417],"to_pandas"," abgelehnt, die Materialisierung muss also über den Query-Builder laufen, und ein Vorgang kann an einer Service-Richtlinie scheitern statt an den Daten. Der Code von OSS nach Enterprise ist nahezu derselbe, aber nicht derselbe.",{"type":119,"level":120,"id":102,"text":103},{"type":112,"content":421},[422,423,426],"Die Bibliothek ist Apache-2.0 und in jedem relevanten Sinne kostenlos: ",{"tag":125,"children":424},[425],"pip install",", kein Konto, kein Metering. Die Preisseite führt keine Preisliste — sie ist ein Kontaktformular —, und Enterprise wird als Managed oder Bring-Your-Own-Cloud mit SOC 2 Type II, HIPAA-Abdeckung und OpenTelemetry-Metriken und Traces verkauft. Die eine konkrete Zahl, die der Hersteller veröffentlicht, ist ein Benchmark von etwa 779 Dollar im Monat für 100 Millionen Vektoren.",{"type":141,"ordered":142,"items":428},[429,431,433],[430],"Open Source: Bibliothek, Indize, Hybridsuche und die Wartungs-CLI unter Apache-2.0, mit Community-Support.",[432],"Enterprise: Managed oder BYOC, verteilte Query-Knoten, ein NVMe-Cache, plattformgesteuerte Indexierung und Kompaktierung sowie Compliance nach SOC 2 Type II und HIPAA.",[434],"Als Nächstes, in der eigenen Tabelle des Herstellers: verteilte Suche, verteilte Indexierung und Kompaktierung.",{"type":119,"level":120,"id":105,"text":106},{"type":112,"content":437},[438],"LanceDB ist die richtige Antwort, wenn Korpus und Traffic auf eine Maschine passen, und die falsche, wenn nicht — das sagt der Hersteller in seiner eigenen Vergleichstabelle. Seine Stärke ist, dass Retrieval zum Bibliotheksaufruf wird statt zu einem Infrastrukturprojekt; seine Kosten liegen darin, dass jede betriebliche Aufgabe einer Datenbank beim Anwendungsteam landet. Die pointierte Lesart: Für eine RAG-Pipeline unter einer Million Chunks ist eine eigene Vektordatenbank ein unnötiger Dienst, und LanceDB ist das, worauf diese Pipeline zuerst zugreifen sollte.",{"type":141,"ordered":440,"items":441},true,[442,444,446,448,450],[443],"Für Prototypen, eine Single-Node-RAG-Pipeline oder Edge-Deployment nutzen, wo ein Datenbankserver die schwerste Komponente im Stack wäre.",[445],"Nutzen, wenn die Daten bereits im Object Storage liegen und Versionierung sowie Zero-Copy-Lesen des Lance-Formats eine zweite Kopie des Korpus ersparen.",[447],"Zweimal nachdenken, wenn Abfragen aus S3 unter 100 ms bei echter Konkurrenz bleiben müssen — die eigene Zahl des Herstellers für OSS liegt bei 500 bis 1.000 ms und 10 bis 50 Abfragen pro Sekunde.",[449],"Wartung einplanen: optimize, Kompaktierung und Reindexierung sind in der Open-Source-Edition ungeplante Arbeit, und Indexfragmentierung wächst mit jedem Delete.",[451],"Die Enterprise-Stufe nur für die verteilten Teile wählen; die API-Unterschiede, von den Materialisierungs-Grenzen der RemoteTable bis zu Guardrails auf Clusterseite, das ist die eigentliche Bindung.",{"type":285,"variant":453,"body":454,"title":461},"tip",[455],[456,457,460],"Den Index auf echten Daten bauen und den Recall gegen ",{"tag":125,"children":458},[459],"bypass_vector_index()"," messen, der einen exakten Scan ausführt und die Wahrheit liefert. Die Lücke zwischen beiden Antworten ist der tatsächliche Preis der Näherung — und die Zahl, aus der ein Latenzbudget geschrieben wird.","Eine Messung vor der Bindung",{"type":119,"level":120,"id":108,"text":109},{"type":141,"ordered":440,"items":464},[465,470,474,478,482,485,489,493],[466],{"tag":467,"href":31,"children":468},"a",[469],"LanceDB-Quickstart",[471],{"tag":467,"href":34,"children":472},[473],"LanceDB-Vektorindizes",[475],{"tag":467,"href":37,"children":476},[477],"LanceDB-Indexierungsleitfaden",[479],{"tag":467,"href":40,"children":480},[481],"LanceDB-Hybridsuche",[483],{"tag":467,"href":43,"children":484},[42],[486],{"tag":467,"href":46,"children":487},[488],"LanceDB-Häufige Fragen",[490],{"tag":467,"href":49,"children":491},[492],"LanceDB-Preise",[494],{"tag":467,"href":52,"children":495},[496],"LanceDB auf PyPI",[498,547,589,639],{"slug":499,"published":500,"minutes":501,"category":7,"tags":502,"keywords":507,"about":516,"sources":520,"cover":539,"og":540,"expertise":55,"locales":541,"lang":58,"title":542,"description":543,"coverAlt":544,"url":545,"pricing":546,"kind":503},"zep","2026-10-06",11,[503,504,505,506,12],"Agent memory","Knowledge graph","Temporal graph","Context engineering",[508,509,510,511,512,513,514,515],"zep ai","zep agent memory","graphiti knowledge graph","zep pricing","zep vs mem0","long-term memory for agents","temporal knowledge graph","zep cloud",[517],{"name":518,"url":519},"Zep","https:\u002F\u002Fwww.getzep.com\u002F",[521,524,527,530,533,536],{"title":522,"url":523},"Zep pricing: plans, credits and limits","https:\u002F\u002Fwww.getzep.com\u002Fpricing",{"title":525,"url":526},"Zep documentation","https:\u002F\u002Fhelp.getzep.com\u002F",{"title":528,"url":529},"Graphiti on GitHub","https:\u002F\u002Fgithub.com\u002Fgetzep\u002Fgraphiti",{"title":531,"url":532},"Graphiti product page","https:\u002F\u002Fwww.getzep.com\u002Fplatform\u002Fgraphiti\u002F",{"title":534,"url":535},"Announcing a new direction for Zep's open-source strategy","https:\u002F\u002Fwww.getzep.com\u002Fblog\u002Fannouncing-a-new-direction-for-zeps-open-source-strategy\u002F",{"title":537,"url":538},"Graphiti: temporal knowledge graphs for AI agents (arXiv)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2501.13956","\u002Fimages\u002Fblog\u002Fzep\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fzep\u002Fog.jpg",[57,58,59],"Zep-Review: Agenten-Memory auf einem temporalen Graphen","Zep ist eine gehostete Agenten-Memory-API auf einem temporalen Knowledge Graph: Credits beim Schreiben, Retrieval gratis, Flex ab 125 Dollar im Monat, Graphiti als selbst hostbarer Teil.","Diagramm, wie eine Aussage in Zep den Prompt erreicht: Nachrichten und Aussagen werden in einen benutzerspezifischen Context Graph aus Entitäten und Beziehungen extrahiert, und der Retrieval durchläuft den Graphen und liefert einen Kontextblock mit den tragenden Fakten.","https:\u002F\u002Fwww.getzep.com","Apache-2.0 core · Cloud from $50 per month",{"slug":386,"published":5,"minutes":548,"category":7,"tags":549,"keywords":553,"about":560,"sources":566,"cover":581,"og":582,"expertise":55,"locales":583,"lang":58,"title":584,"description":585,"coverAlt":586,"url":562,"pricing":587,"kind":588},10,[9,550,551,12,552],"Postgres","HNSW","Quantisation",[386,554,555,556,557,558,559],"pgvector vs qdrant","postgres vector search","hnsw index postgres","iterative index scans","binary quantization postgres","vector database postgres",[561,563],{"name":386,"url":562},"https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector",{"name":564,"url":565},"PostgreSQL","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FPostgreSQL",[567,569,572,575,578],{"title":568,"url":562},"pgvector README",{"title":570,"url":571},"pgvector changelog","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FCHANGELOG.md",{"title":573,"url":574},"PostgreSQL news: pgvector 0.8.2 released","https:\u002F\u002Fwww.postgresql.org\u002Fabout\u002Fnews\u002Fpgvector-082-released-3245\u002F",{"title":576,"url":577},"AWS: Scale pgvector with binary quantization","https:\u002F\u002Faws.amazon.com\u002Fblogs\u002Fdatabase\u002Fscale-pgvector-with-binary-quantization-on-amazon-aurora-postgresql\u002F",{"title":579,"url":580},"pgvector licence","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FLICENSE","\u002Fimages\u002Fblog\u002Fpgvector\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fpgvector\u002Fog.jpg",[57,58,59],"pgvector im Review: die Vektordatenbank, die du nicht betreiben musst","Ein Review von pgvector 0.8.7: iterative Index-Scans für gefilterte Suche, HNSW und IVFFlat, Binärquantisierung bei 100 Millionen Vektoren und das CVE im Indexaufbau.","Eine Anfrage teilt sich oben in einen exakten Sequenzscan, einen HNSW-Graphlauf und eine IVFFlat-Sonde; ein Band unten zeigt einen iterativen Scan, der weiterläuft, bis die LIMIT-Zahl erreicht ist.","PostgreSQL licence","Vector database extension",{"slug":590,"published":591,"minutes":548,"category":7,"tags":592,"keywords":594,"about":600,"sources":604,"cover":632,"og":633,"expertise":55,"locales":634,"lang":58,"title":635,"description":636,"coverAlt":637,"url":603,"pricing":638,"kind":503},"mem0","2026-09-17",[503,593,12,9],"Long-term memory",[590,595,596,597,598,513,599],"mem0 review","agent memory layer","mem0 self-hosted","mem0 pricing","mem0 alternatives",[601],{"name":602,"url":603},"Mem0","https:\u002F\u002Fmem0.ai",[605,608,611,614,617,620,623,626,629],{"title":606,"url":607},"Mem0 documentation","https:\u002F\u002Fdocs.mem0.ai\u002Fintroduction",{"title":609,"url":610},"Mem0 quickstart","https:\u002F\u002Fdocs.mem0.ai\u002Fquickstart",{"title":612,"url":613},"How Mem0 works","https:\u002F\u002Fdocs.mem0.ai\u002Fcore-concepts\u002Fhow-it-works",{"title":615,"url":616},"Mem0 pricing","https:\u002F\u002Fmem0.ai\u002Fpricing",{"title":618,"url":619},"Mem0 on GitHub","https:\u002F\u002Fgithub.com\u002Fmem0ai\u002Fmem0",{"title":621,"url":622},"mem0ai on PyPI","https:\u002F\u002Fpypi.org\u002Fproject\u002Fmem0ai\u002F",{"title":624,"url":625},"Mem0 research and benchmarks","https:\u002F\u002Fmem0.ai\u002Fresearch",{"title":627,"url":628},"Mem0 MCP server","https:\u002F\u002Fdocs.mem0.ai\u002Fplatform\u002Fmem0-mcp",{"title":630,"url":631},"Mem0 paper on arXiv","https:\u002F\u002Farxiv.org\u002Fabs\u002F2504.19413","\u002Fimages\u002Fblog\u002Fmem0\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fmem0\u002Fog.jpg",[57,58,59],"Mem0: was eine Agent-Speicherschicht pro Runde kostet","Ein Review von Mem0: extrahierte Fakten pro Runde, die Benchmark-Tabelle vom April 2026 mit Plattform-Vorbehalt, vier Cloud-Stufen und die Lücken beim Self-Hosting.","Eine Schleife, die aus Gespräch gespeicherte Fakten macht und sie zurück in den Prompt liest","Free tier · from $19 per month",{"slug":640,"published":641,"minutes":548,"category":7,"tags":642,"keywords":645,"about":654,"sources":664,"cover":683,"og":684,"expertise":55,"locales":685,"lang":58,"title":686,"description":687,"coverAlt":688,"url":657,"pricing":689,"kind":23},"milvus-zilliz","2026-09-08",[9,10,643,644,12],"BM25 full text","Distributed",[646,647,648,649,650,651,652,653],"milvus","milvus vs qdrant","zilliz cloud pricing","vector database comparison","milvus hybrid search","apache milvus self-hosting","milvus 3.0","rag vector store",[655,658,661],{"name":656,"url":657},"Milvus","https:\u002F\u002Fmilvus.io",{"name":659,"url":660},"Zilliz Cloud","https:\u002F\u002Fzilliz.com",{"name":662,"url":663},"Retrieval-augmented generation","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FRetrieval-augmented_generation",[665,668,671,674,677,680],{"title":666,"url":667},"Milvus architecture overview","https:\u002F\u002Fmilvus.io\u002Fdocs\u002Farchitecture_overview.md",{"title":669,"url":670},"Milvus release notes","https:\u002F\u002Fmilvus.io\u002Fdocs\u002Frelease_notes.md",{"title":672,"url":673},"Milvus releases on GitHub","https:\u002F\u002Fgithub.com\u002Fmilvus-io\u002Fmilvus\u002Freleases",{"title":675,"url":676},"Milvus README: features and licence","https:\u002F\u002Fgithub.com\u002Fmilvus-io\u002Fmilvus",{"title":678,"url":679},"Zilliz Cloud pricing","https:\u002F\u002Fzilliz.com\u002Fpricing",{"title":681,"url":682},"Zilliz Cloud list price","https:\u002F\u002Fzilliz.com\u002Fpricing\u002Fpricing-guide","\u002Fimages\u002Fblog\u002Fmilvus-zilliz\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fmilvus-zilliz\u002Fog.jpg",[57,58,59],"Milvus-Review: die vollständigste Vektordatenbank im Betrieb","Milvus 3.0.2 ist die vollständigste Open-Source-Vektordatenbank und die aufwendigste im Betrieb. Review von Architektur, Hybridsuche, Kosten und Einsatzgrenzen.","Covermotiv zum Milvus-Review: eine Pipeline von Ingest über Index, Suche und Reranking","Apache-2.0 · Zilliz Cloud free tier",1791383550522]