[{"data":1,"prerenderedAt":703},["ShallowReactive",2],{"tool-pinecone-de":3},{"slug":4,"published":5,"minutes":6,"category":7,"tags":8,"keywords":14,"about":23,"sources":33,"cover":58,"og":59,"expertise":60,"locales":61,"lang":63,"title":65,"description":66,"coverAlt":67,"url":68,"pricing":69,"kind":25,"metaTitle":70,"takeaways":71,"faq":77,"toc":96,"blocks":121,"others":510},"pinecone","2026-07-09",11,"rag",[9,10,11,12,13],"Vector search","Embeddings","RAG","Namespaces","Hybrid search",[15,16,17,18,19,20,21,22],"pinecone vector database","pinecone pricing","pinecone read units","pinecone namespaces","pinecone vs qdrant","pinecone vs pgvector","pinecone documents api","serverless vector database cost",[24,27,30],{"name":25,"url":26},"Vector database","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FVector_database",{"name":28,"url":29},"Nearest neighbor search","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FNearest_neighbor_search",{"name":31,"url":32},"Okapi BM25","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FOkapi_BM25",[34,37,40,43,46,49,52,55],{"title":35,"url":36},"Pinecone docs: Index data overview, indexes, namespaces and metadata","https:\u002F\u002Fdocs.pinecone.io\u002Fguides\u002Findex-data\u002Findexing-overview",{"title":38,"url":39},"Pinecone docs: Adopt the Documents API, API version 2026-07","https:\u002F\u002Fdocs.pinecone.io\u002Fguides\u002Findex-data\u002Fadopt-the-documents-api",{"title":41,"url":42},"Pinecone docs: Create an index, schemas, regions and metrics","https:\u002F\u002Fdocs.pinecone.io\u002Fguides\u002Findex-data\u002Fcreate-an-index",{"title":44,"url":45},"Pinecone docs: Understanding Pinecone cost, read units, write units and egress","https:\u002F\u002Fdocs.pinecone.io\u002Fguides\u002Forganizations\u002Fmanage-cost\u002Funderstanding-cost",{"title":47,"url":48},"Pinecone pricing: plans, limits and rates","https:\u002F\u002Fwww.pinecone.io\u002Fpricing\u002F",{"title":50,"url":51},"Pinecone docs: Semantic search","https:\u002F\u002Fdocs.pinecone.io\u002Fguides\u002Fsearch\u002Fsemantic-search",{"title":53,"url":54},"Pinecone docs: Local development with Pinecone Local","https:\u002F\u002Fdocs.pinecone.io\u002Fguides\u002Foperations\u002Flocal-development",{"title":56,"url":57},"Pinecone docs: 2026 release notes","https:\u002F\u002Fdocs.pinecone.io\u002Frelease-notes\u002F2026","\u002Fimages\u002Fblog\u002Fpinecone\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fpinecone\u002Fog.jpg","ai-engineer",[62,63,64],"en","de","hu","Pinecone: ein Test der verwalteten Vektordatenbank","Was Pinecone wirklich kostet: Read Units skalieren mit der Namespace-Größe, ein Schema ist nachträglich nicht änderbar, und wo eine selbst betriebene Vektordatenbank der bessere Kauf ist.","Diagramm: Dokumente, dichte und sparse Vektoren werden in einen serverlosen Index geschrieben, der nach Namespaces partitioniert ist; eine Query nennt einen Namespace und liefert bewertete Treffer.","https:\u002F\u002Fwww.pinecone.io","Free tier · from $2 per month","Pinecone Vektordatenbank im Test · Balázs Csorba",[72,73,74,75,76],"Pinecone rechnet Reads ab, nicht Vektoren. Eine Query kostet eine Read Unit pro Gigabyte des gescannten Namespaces, mit einem Minimum von 0,25 Read Units. Die Partitionierung ist damit die eine Entscheidung, die die Rechnung bestimmt.","Read Units kosten auf Standard das Vierfache von Write Units, 16 bis 18 US-Dollar pro Million gegenüber 4 bis 4,50. Eine leselastige Retrieval-Anwendung wird von einer einzigen Position dominiert.","Eine Million Queries gegen einen 50-GB-Namespace sind auf Standard rund 800 US-Dollar pro Monat. Dieselbe Million gegen 100 Namespaces à 0,5 GB sind etwa 8 Dollar. An der Anwendung ändert sich nichts.","Auf Dokumentindizes ist Schema-Migration nicht unterstützt, und ein Index vor API-Version 2026-07 kann nie auf die Documents API wechseln. Ein Feld mehr bedeutet neuer Index und erneutes Einlesen.","Unterhalb von Enterprise gibt es keine Verfügbarkeits-SLA, und Enterprise beginnt bei 500 US-Dollar Mindestumsatz pro Monat. Der Starter-Plan ist auf eine einzige Region beschränkt.",[78,81,84,87,90,93],{"q":79,"a":80},"Was ist Pinecone und wofür wird es verwendet?","Pinecone ist eine vollständig verwaltete Vektordatenbank. Man speichert Embeddings in einem Index und holt sie über Ähnlichkeit zurück — der Retrieval-Schritt in einer RAG-Pipeline, in semantischer Produktsuche und in Agent Memory. Sie läuft auf verwalteter serverloser Infrastruktur in AWS, Azure oder GCP, es gibt also keinen Cluster zu betreiben.",{"q":82,"a":83},"Was kostet Pinecone pro Monat?","Der Starter-Plan ist kostenlos und enthält bis zu 2 GB Storage, 2 Millionen Write Units, 1 Million Read Units und 1 GB Egress pro Monat. Builder kostet flach 20 Dollar. Standard hat 50 Dollar Mindestumsatz und rechnet Storage mit 0,33 Dollar pro GB und Monat, Write Units mit 4 bis 4,50 pro Million, Read Units mit 16 bis 18 pro Million und Egress mit 0,10 pro GB nach den enthaltenen 100 GB ab. Enterprise startet bei 500 Dollar pro Monat mit Read Units von 24 bis 27 pro Million.",{"q":85,"a":86},"Was ist der Unterschied zwischen einem Pinecone Vector Index und einem Document Index?","Ein Vector Index ist der klassische, angelegt mit dimension, metric und vector_type, hält dichte und sparse Vektoren über die Vectors API und kann Hybrid Search in einer Query. Ein Document Index wird mit einem Schema über die Documents API angelegt und kann dichte Vektoren, sparse Vektoren und Volltextfelder in einem Index halten, aber eine Suche rankt nach genau einem Scoring-Typ. Hybrid Search bedeutet dort also entweder einen Text-Match-Filter vor einer dichten Suche oder zwei getrennte Suchen, die in der Anwendung verschmolzen werden.",{"q":88,"a":89},"Sind Pinecone Namespaces nur für Multitenancy gedacht?","Sie sind für Multitenancy und Abfragegeschwindigkeit dokumentiert, aber das Kostenmodell macht sie zusätzlich zu einer Kostenkontrolle, und das ist das am schwierigsten zu erkennende an Pinecone. Eine Query kostet eine Read Unit pro Gigabyte des gescannten Namespaces, ein Namespace pro Mandant verhindert also, dass ein großer Mandant den Lesepreis für alle anderen festlegt.",{"q":91,"a":92},"Kann ich das Schema eines Pinecone Index später ändern?","Nein. Die Dokumentation sagt ausdrücklich, dass Schema-Migration noch nicht unterstützt wird: Ein einmal angelegter Dokumentindex lässt sich nicht um Felder erweitern, ändern oder reduzieren, und der dokumentierte Ausweg ist, den Index zu löschen und einen neuen anzulegen. Dasselbe gilt für Cloud und Region, die nach dem Anlegen eines serverlosen Index nicht mehr wechselbar sind.",{"q":94,"a":95},"Gibt es eine kostenlose Stufe, und kann ich lokal entwickeln?","Der Starter-Plan ist kostenlos, mit harten Obergrenzen und einem Projekt. Für lokale Entwicklung gibt es Pinecone Local, einen In-Memory-Docker-Emulator, der allerdings die API-Version 2025-01 statt der aktuellen fährt, einen Index auf 100.000 Datensätze begrenzt, API-Schlüssel ignoriert und weder Namespace-Verwaltung noch Backups noch Pinecone Inference unterstützt. Eher eine CI-Bequemlichkeit als eine getreue lokale Umgebung.",[97,100,103,106,109,112,115,118],{"id":98,"title":99},"what-it-is","Was es ist",{"id":101,"title":102},"how-it-works","Wie es funktioniert",{"id":104,"title":105},"where-it-breaks","Wo es bricht",{"id":107,"title":108},"getting-started","Erste Schritte",{"id":110,"title":111},"pricing","Preise",{"id":113,"title":114},"alternatives","Alternativen",{"id":116,"title":117},"verdict","Fazit",{"id":119,"title":120},"sources","Quellen",[122,126,129,132,135,221,222,229,238,250,251,254,276,279,288,289,292,294,313,321,322,325,389,392,395,396,399,454,457,458,461,474,482,483],{"type":123,"content":124},"paragraph",[125],"PINECONE ist die verwaltete Vektordatenbank, mit der die meisten Retrieval-Prototypen anfangen, und aus einem belastbaren Grund: Ein Index ist ein POST entfernt, es gibt nichts zu betreiben, und die Rechnung wird gemessen statt bereitgestellt. Diese Kombination ist im ersten Jahr einer Retrieval-Funktion wirklich schwer zu schlagen. Sie ist auch der Grund, warum Pinecone aufhört, der richtige Standard zu sein, sobald ein Produkt echten Verkehr hat, denn sein Preismodell belohnt eine Entscheidung, die Teams selten bewusst treffen — wie die Daten partitioniert sind.",{"type":123,"content":127},[128],"Es konkurriert mit zwei ganz verschiedenen Arten von Dingen. Auf der einen Seite die allgemeinen Datenbanken, die eine Vektorspalte bekommen haben: pgvector in PostgreSQL, MongoDB Atlas, Redis. Auf der anderen Seite die spezialisierten Engines, Qdrant und Weaviate, selbst betrieben oder in der Cloud. Das Argument gegen alle lautet operativ: kein Cluster, kein Reindex, kein ANN-Tuning, Kapazität, die erscheint, wenn sie gebraucht wird. Das Gegenargument sind Lock-in, die Kosten pro Query in der Größenordnung und ein Datenmodell, das bewusst kein SQL ist.",{"type":130,"level":131,"id":98,"text":99},"heading",2,{"type":123,"content":133},[134],"Der Index ist die Einheit von allem. Records gehen in einen, Queries treffen einen, und innerhalb davon sind die Daten in Namespaces partitioniert, wobei jeder Upsert, jede Query, jeder Fetch und jedes List genau einen Namespace adressiert. Seit API-Version 2026-07 gibt es zwei Arten von Index, und sie zu unterscheiden ist das Wichtigste, bevor man Code gegen Pinecone schreibt.",{"type":136,"ordered":137,"items":138},"list",false,[139,154,167,169,175,215],[140,141,145,146,149,150,153],"Ein Vector Index ist der klassische: dichte und optional sparse Vektoren, angelegt mit ",{"tag":142,"children":143},"code",[144],"dimension",", ",{"tag":142,"children":147},[148],"metric"," und ",{"tag":142,"children":151},[152],"vector_type",", gelesen und geschrieben über die Vectors API.",[155,156,145,159,162,163,166],"Ein Document Index ist der neue: ein Schema, das ",{"tag":142,"children":157},[158],"dense_vector",{"tag":142,"children":160},[161],"sparse_vector"," und Volltext-",{"tag":142,"children":164},[165],"string","-Felder deklariert, gelesen und geschrieben über die Documents API.",[168],"Namespaces entstehen implizit beim ersten Upsert. Einer pro Mandant ist das dokumentierte Multitenancy-Muster, und die Partitionierung nach Namespace senkt zugleich die Lesekosten.",[170,171,174],"Metadaten sind ein flaches JSON-Objekt: keine verschachtelten Objekte, keine null-Werte, Schlüssel dürfen nicht mit ",{"tag":142,"children":172},[173],"$"," beginnen, Ganzzahlen werden als 64-Bit-Fließkommazahlen gespeichert, und 40 KB sind die Obergrenze pro Record. Alles wird für Filter indiziert, sofern es nicht anders konfiguriert ist.",[176,177,145,180,145,183,145,186,145,189,145,192,145,195,145,198,145,201,204,205,145,208,149,211,214],"Die Filtersprache ist eine dokumentierte Teilmenge: ",{"tag":142,"children":178},[179],"$eq",{"tag":142,"children":181},[182],"$ne",{"tag":142,"children":184},[185],"$gt",{"tag":142,"children":187},[188],"$gte",{"tag":142,"children":190},[191],"$lt",{"tag":142,"children":193},[194],"$lte",{"tag":142,"children":196},[197],"$in",{"tag":142,"children":199},[200],"$nin",{"tag":142,"children":202},[203],"$exists"," sowie ",{"tag":142,"children":206},[207],"$and",{"tag":142,"children":209},[210],"$or",{"tag":142,"children":212},[213],"$not",". Die Listenoperatoren nehmen höchstens 10.000 Werte an.",[216,217,220],"Sparse-Indizes sind eng: höchstens 2.048 von Null verschiedene Werte pro Vektor, 10 Upserts pro Sekunde, 100 Queries pro Sekunde, ein ",{"tag":142,"children":218},[219],"top_k","-Maximum von 10.000 und Dot Product als einzige Metrik.",{"type":130,"level":131,"id":101,"text":102},{"type":123,"content":223},[224,225,228],"In einem Index können drei Ranking-Signale nebeneinander liegen: BM25 über Volltextfelder, dichte Vektoren für Bedeutung und sparse Vektoren für gelernte lexikalische Wichtigkeit. Auf einem Vector Index kombiniert eine Hybrid Query dicht und sparse in einem Aufruf. Auf einem Document Index rankt eine Suche nach genau einem Scoring-Typ, gewählt über ",{"tag":142,"children":226},[227],"score_by",", Hybrid Search bedeutet dort also entweder einen Text-Match-Filter, der die Kandidaten vor einer dichten Suche eingrenzt, oder zwei Suchen, die in der Anwendung per Reciprocal Rank Fusion verschmolzen werden.",{"type":230,"attrs":231,"inner":235,"caption":236},"diagram",{"viewBox":232,"role":233,"aria-labelledby":234},"0 0 720 360","img","pinc-t pinc-d","\u003Ctitle id=\"pinc-t\">Pinecone: Dokumente und Vektoren in Namespaces, Queries heraus\u003C\u002Ftitle>\u003Cdesc id=\"pinc-d\">Dokumente mit Volltextfeldern, dichte Vektoren und sparse Vektoren werden in einen serverlosen Index geschrieben, der in Namespaces partitioniert ist. Eine Query nennt einen Namespace, kostet eine Read Unit pro Gigabyte dieses Namespaces mit einem Minimum von 0,25 Read Units, lässt sich mit einem Metadatenfilter eingrenzen und liefert bewertete Treffer, deren Antwortbytes als Egress abgerechnet werden.\u003C\u002Fdesc>\u003Ctext x=\"20\" y=\"28\" class=\"d-title\">Pinecone: einmal schreiben, Namespace abfragen\u003C\u002Ftext>\u003Ctext x=\"700\" y=\"28\" text-anchor=\"end\" class=\"d-label\">docs.pinecone.io\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"56\" class=\"d-label\">UPSERT\u003C\u002Ftext>\u003Crect x=\"20\" y=\"70\" width=\"210\" height=\"54\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"125\" y=\"96\" text-anchor=\"middle\" class=\"d-text\">Dokumente\u003C\u002Ftext>\u003Ctext x=\"125\" y=\"114\" text-anchor=\"middle\" class=\"d-small\">BM25-Volltextfelder\u003C\u002Ftext>\u003Crect x=\"255\" y=\"70\" width=\"210\" height=\"54\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"360\" y=\"96\" text-anchor=\"middle\" class=\"d-text\">Dichte Vektoren\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"114\" text-anchor=\"middle\" class=\"d-small\">cosine oder euclidean\u003C\u002Ftext>\u003Crect x=\"490\" y=\"70\" width=\"205\" height=\"54\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"592\" y=\"96\" text-anchor=\"middle\" class=\"d-text\">Sparse Vektoren\u003C\u002Ftext>\u003Ctext x=\"592\" y=\"114\" text-anchor=\"middle\" class=\"d-small\">nur dotproduct\u003C\u002Ftext>\u003Cpath d=\"M125 124 V136\" class=\"d-line\" \u002F>\u003Cpath d=\"M125 146 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Cpath d=\"M360 124 V136\" class=\"d-line\" \u002F>\u003Cpath d=\"M360 146 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Cpath d=\"M592 124 V136\" class=\"d-line\" \u002F>\u003Cpath d=\"M592 146 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"20\" y=\"160\" class=\"d-label\">EIN SERVERLESS INDEX, NACH NAMESPACE PARTITIONIERT\u003C\u002Ftext>\u003Crect x=\"20\" y=\"174\" width=\"675\" height=\"58\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"357\" y=\"200\" text-anchor=\"middle\" class=\"d-text\">Index\u003C\u002Ftext>\u003Ctext x=\"357\" y=\"219\" text-anchor=\"middle\" class=\"d-small\">Namespace kunde-1 &#183; kunde-2 &#183; kunde-100 &#183; der Default-Namespace\u003C\u002Ftext>\u003Cpath d=\"M688 232 V246\" class=\"d-line\" \u002F>\u003Cpath d=\"M688 256 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"20\" y=\"256\" class=\"d-label\">QUERY\u003C\u002Ftext>\u003Crect x=\"20\" y=\"270\" width=\"210\" height=\"62\" rx=\"10\" class=\"d-gold\" \u002F>\u003Ctext x=\"125\" y=\"297\" text-anchor=\"middle\" class=\"d-text\">Namespace\u003C\u002Ftext>\u003Ctext x=\"125\" y=\"317\" text-anchor=\"middle\" class=\"d-small\">1 Read Unit pro GB, min. 0,25\u003C\u002Ftext>\u003Crect x=\"255\" y=\"270\" width=\"210\" height=\"62\" rx=\"10\" class=\"d-gold\" \u002F>\u003Ctext x=\"360\" y=\"297\" text-anchor=\"middle\" class=\"d-text\">Metadatenfilter\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"317\" text-anchor=\"middle\" class=\"d-small\">$eq, $in, $and, $not\u003C\u002Ftext>\u003Crect x=\"490\" y=\"270\" width=\"205\" height=\"62\" rx=\"10\" class=\"d-accent\" \u002F>\u003Ctext x=\"592\" y=\"297\" text-anchor=\"middle\" class=\"d-text\">Bewertete Treffer\u003C\u002Ftext>\u003Ctext x=\"592\" y=\"317\" text-anchor=\"middle\" class=\"d-small\">plus Egress auf die Bytes\u003C\u002Ftext>\u003Cpath d=\"M236 301 H243\" class=\"d-line\" \u002F>\u003Cpath d=\"M253 301 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Cpath d=\"M471 301 H478\" class=\"d-line\" \u002F>\u003Cpath d=\"M488 301 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"20\" y=\"352\" class=\"d-small\">Eine Data Plane pro Index &#183; bei Erstellung fixiert &#183; keine Schema-Migration\u003C\u002Ftext>",[237],"Das Abrechnungsmodell folgt aus derselben Struktur: Die Query zahlt für den Ausschnitt des Index, auf den sie gezielt wurde, nicht für die geleistete Arbeit.",{"type":123,"content":239},[240,241,145,243,149,246,249],"Das Kostenmodell folgt aus derselben Struktur. Eine Query kostet eine Read Unit pro Gigabyte des gescannten Namespaces, mit einem Minimum von 0,25 Read Units. ",{"tag":142,"children":242},[219],{"tag":142,"children":244},[245],"include_metadata",{"tag":142,"children":247},[248],"include_values"," ändern daran nichts; allein die Namespace-Größe zählt. Egress wird separat auf die zurückgegebenen Bytes abgerechnet, IDs und Scores eingerechnet. Um den Index herum gibt es drei weitere Dienste, die zu benennen sich lohnt, weil sie verändern, was die Anwendung selbst tun muss: Pinecone Inference hostet Embedding- und Reranking-Modelle und rechnet nach Token oder Rerank-Anfragen ab, Pinecone Assistant macht aus einem hochgeladenen Dokumentbestand einen Chat-Endpunkt mit eigener Token- und Ingestion-Abrechnung, und Pinecone Nexus, gelistet als Knowledge Engine für Agenten, geht mit derselben Idee weiter, indem Retrieval einmal bei einer Datenänderung erledigt wird statt bei jedem Agent-Call.",{"type":130,"level":131,"id":104,"text":105},{"type":123,"content":252},[253],"Vier Dinge werden zubeißen, und drei davon sind strukturell statt behebbar.",{"type":136,"ordered":137,"items":255},[256,258,260,270,272,274],[257],"Schema-Migration wird nicht unterstützt. Ist ein Dokumentindex einmal angelegt, lassen sich Felder nicht ergänzen, entfernen oder ändern, und der dokumentierte Ausweg ist, den Index zu löschen und einen neuen anzulegen.",[259],"Umwandeln ist nicht möglich. Die Data Plane eines Index steht bei seiner Erstellung fest, ein SDK-Upgrade verschiebt einen alten Vector Index also nie auf die Documents API. Wer Volltextsuche will, braucht einen zweiten Index und ein zweites Einlesen.",[261,262,265,266,269],"Cloud und Region sind nach der Erstellung nicht mehr wechselbar, und der Starter-Plan ist auf ",{"tag":142,"children":263},[264],"aws"," ",{"tag":142,"children":267},[268],"us-east-1"," beschränkt. Alles mit einer Anforderung an Datenresidenz ist am ersten Tag eine Entscheidung für einen bezahlten Plan.",[271],"Die Lesekosten skalieren mit der Namespace-Größe, nicht mit dem Aufwand. Ein 50-GB-Namespace kostet 50 Read Units pro Query; dieselben Daten in 100 Namespaces à 0,5 GB kosten 0,5. Das ist einhundertfach in der größten Position.",[273],"Unterhalb von Enterprise gibt es keine Verfügbarkeits-SLA, und Enterprise beginnt bei 500 Dollar Mindestumsatz. Standard, der Plan, auf dem die meisten Produktionslasten landen, hat weder SLA noch Audit-Logs.",[275],"Pinecone Local, der lokale Emulator, fährt die API-Version 2025-01, begrenzt einen Index auf 100.000 Datensätze, ignoriert API-Schlüssel und unterstützt weder Namespaces noch Backups noch Pinecone Inference. Das ist eine CI-Bequemlichkeit, keine getreue lokale Umgebung.",{"type":123,"content":277},[278],"Nehmen Sie die dokumentierten Tarife und rechnen Sie. Auf Standard kosten Read Units je nach Cloud und Region $16 bis $18 pro Million. Eine Million Queries gegen einen 50-GB-Namespace sind 50 Millionen Read Units, rund $800 pro Monat allein fürs Lesen. Dieselbe Million gegen 100 Namespaces à 0,5 GB sind 500.000 Read Units, etwa $8. An der Anwendung hat sich nichts geändert, nur an der Partitionierung. Auf Enterprise, wo Read Units bei $24 pro Million beginnen, werden aus denselben beiden Zahlen $1.200 und $12.",{"type":280,"variant":281,"title":282,"body":283},"callout","warn","Namespaces sind eine Kostenkontrolle, kein Schema-Detail",[284,286],[285],"Namespaces wurden für Multitenancy und Abfragegeschwindigkeit dokumentiert. Das Kostenmodell macht sie zusätzlich zu einer Kostenkontrolle, und das ist am Pinecone am schwierigsten zu erkennende. Ein Namespace pro Mandant ist zugleich der Isolationsmechanismus und der Mechanismus, der verhindert, dass ein großer Mandant den Lesepreis für alle festlegt.",[287],"Die Kehrseite ist unbequem. Die Durchsatzbeispiele auf der Preisseite wirken großzügig, weil ein kleiner Index das Minimum von 0,25 Read Units trifft; dasselbe Lastmuster über einen 10-GB-Namespace kostet das Vierzigfache pro Query.",{"type":130,"level":131,"id":107,"text":108},{"type":123,"content":290},[291],"Das kleinste nützliche Pinecone-Programm ist ein Vector Index mit eigenen Embeddings, ein Namespace pro Mandant und ein Metadatenfilter in der Query. So konvergiert der meiste Produktionscode, und diese Form belohnt das Kostenmodell.",{"type":142,"code":293},"import os\nfrom pinecone import Pinecone, ServerlessSpec\n\npc = Pinecone(api_key=os.environ[\"PINECONE_API_KEY\"])\n\nif not pc.has_index(\"products\"):\n    pc.create_index(\n        name=\"products\",\n        vector_type=\"dense\",\n        dimension=1536,\n        metric=\"cosine\",\n        spec=ServerlessSpec(cloud=\"aws\", region=\"eu-central-1\"),\n        deletion_protection=\"disabled\",\n    )\n\nindex = pc.Index(\"products\")\n\n# One namespace per tenant keeps each read inside a small slice of the index.\nindex.upsert(\n    namespace=\"tenant-42\",\n    vectors=[(\"p-1001\", embedding, {\"category\": \"pumps\", \"price\": 249.0})],\n)\n\nhits = index.query(\n    namespace=\"tenant-42\",\n    vector=query_embedding,\n    top_k=8,\n    filter={\"category\": {\"$eq\": \"pumps\"}, \"price\": {\"$lte\": 500}},\n    include_metadata=True,\n    include_values=False,   # omit the vector: egress is billed on the response\n)",{"type":123,"content":295},[296,297,300,301,304,305,308,309,312],"Zwei Details in diesem Snippet sind tragend. ",{"tag":142,"children":298},[299],"include_values=False"," ist der Standard und hält mehrere Kilobyte pro Treffer von der Egress-Rechnung fern, während ein ",{"tag":142,"children":302},[303],"fetch"," immer Vektorwerte zurückgibt; nutzen Sie also ",{"tag":142,"children":306},[307],"query",", wenn Sie suchen und nur IDs oder Metadaten brauchen. Und ",{"tag":142,"children":310},[311],"filter"," senkt die Read Units nicht: das macht der Namespace. Filter grenzen das innerhalb des bereits gewählten Namespaces Gescannte ein, ein Grund mehr, nicht alles in einen einzigen Namespace zu legen.",{"type":280,"variant":314,"title":315,"body":316},"note","Zuerst die Index-Art wählen",[317,319],[318],"Wenn BM25 im Plan ist, führt kein Weg an einem Dokumentindex mit Schema vorbei, und das Schema ist danach nicht mehr änderbar. Wenn es dichte und sparse Vektoren mit kombinierter Query sind, bleibt man auf einem Vector Index, wo Hybrid Search ein Aufruf ist.",[320],"Beide Arten gibt es in jedem Plan. Die Entscheidung hat nichts mit Lizenzen zu tun, sondern mit Dauerhaftigkeit.",{"type":130,"level":131,"id":110,"text":111},{"type":123,"content":323},[324],"Vier Pläne, jeder mit eigener Form. Starter ist kostenlos mit harten Obergrenzen, Builder ist flach $20 mit harten Obergrenzen, und Standard und Enterprise sind nutzungsabhängig hinter einem Mindestumsatz, der sich wie eine Verpflichtung verhält und nicht wie eine Gebühr.",{"type":326,"head":327,"rows":336},"table",[328,330,332,334],[329],"",[331],"Starter",[333],"Standard",[335],"Enterprise",[337,346,354,363,372,380],[338,340,342,344],[339],"Mindestumsatz",[341],"$0",[343],"$50",[345],"$500",[347,349,351,353],[348],"Storage",[350],"Bis zu 2 GB",[352],"Unbegrenzt, $0,33 pro GB und Monat",[352],[355,357,359,361],[356],"Write Units",[358],"Bis zu 2M pro Monat",[360],"Unbegrenzt, $4 bis $4,50 pro Million",[362],"Unbegrenzt, $6 bis $6,75 pro Million",[364,366,368,370],[365],"Read Units",[367],"Bis zu 1M pro Monat",[369],"Unbegrenzt, $16 bis $18 pro Million",[371],"Unbegrenzt, $24 bis $27 pro Million",[373,375,377,379],[374],"Egress",[376],"1 GB pro Monat",[378],"100 GB enthalten, dann $0,10 pro GB",[378],[381,383,385,387],[382],"Governance",[384],"Community Support, ein Projekt",[386],"SSO, RBAC, Backups und Restore",[388],"Audit-Logs, Private Endpoints, CMK, SCIM, 99,95 % SLA",{"type":123,"content":390},[391],"Drei Anmerkungen. Die Mindestumsätze von $50 und $500 werden als Aufschlagsposition abgerechnet, wenn die Nutzung darunter liegt, ein ruhiger Monat kostet also trotzdem den Mindestumsatz. Read Units kosten auf Standard das Vierfache von Write Units, eine leselastige Retrieval-Anwendung wird also von einer Position dominiert. Und die Pauschalpläne degradieren nicht elegant: Jenseits des Kontingents werden lesende Zugriffe mit einem 429 blockiert statt abgerechnet, was ein ganz anderes Fehlermuster ist als eine überraschende Rechnung, und arguably der bessere der beiden Fälle.",{"type":123,"content":393},[394],"Standard und Enterprise schalten außerdem das frei, was eine Produktionsinstallation irgendwann braucht: Import aus Object Storage für $0,25 pro GB, Backups für $0,10 pro GB und Monat, Restores für $0,15 pro GB sowie Dedicated Read Nodes, die gar nicht in Read Units abgerechnet, sondern nach bereitgestellter Kapazität bepreist werden. Dedicated Read Nodes sind das Feature, das man verstehen sollte, bevor man Pinecone für zu teuer erklärt, denn sie brechen die Read-Unit-Formel, auf der der Rest dieses Artikels beruht.",{"type":130,"level":131,"id":113,"text":114},{"type":123,"content":397},[398],"Der lohnende Vergleich ist nicht gegen jede Vektordatenbank. Er ist gegen die beiden, die das Pinecone-Modell auf eine spezifische, strukturelle Weise brechen.",{"type":326,"head":400,"rows":408},[401,402,404,406],[329],[403],"Pinecone",[405],"Qdrant",[407],"pgvector",[409,418,427,436,445],[410,412,414,416],[411],"Lizenz und Betrieb",[413],"Proprietär; verwaltetes Serverless auf AWS, Azure oder GCP",[415],"Apache-2.0; selbst betrieben oder Qdrant Cloud",[417],"PostgreSQL-Lizenz; eine Spalte in der eigenen Datenbank",[419,421,423,425],[420],"Hybrid Search",[422],"Ein Index hält dense, sparse und BM25, aber ein Dokumentindex rankt pro Request nach einem Signal",[424],"Eine Query mischt dense-, sparse- und BM25-Scores",[426],"Man kombiniert ts_vector und einen Vektorindex selbst",[428,430,432,434],[429],"Kosten einer Query",[431],"1 Read Unit pro GB Namespace, Minimum 0,25",[433],"Die eigenen Maschinen oder Cloud-Knoten",[435],"Teil der PostgreSQL-Rechnung, die ohnehin bezahlt wird",[437,439,441,443],[438],"Form ändern",[440],"Schema nicht änderbar; Index neu anlegen und neu einlesen",[442],"Payload-Felder ohne Rebuild ergänzbar",[444],"ALTER TABLE, dann den ANN-Index bauen",[446,448,450,452],[447],"SQL und Joins",[449],"Keine; keine Joins, keine Transaktionen",[451],"Keine; Filtern über Payload",[453],"Volles SQL über Vektoren und Zeilen zusammen",{"type":123,"content":455},[456],"Die ehrliche Zusammenfassung dieser Tabelle: pgvector gewinnt bei allem außer der Größenordnung, und die Schwelle liegt irgendwo bei zehn Millionen Vektoren, jenseits derer Index-Build-Zeiten und Recall-Tuning in PostgreSQL kein vernünftiger Nachmittag mehr sind. Qdrant gewinnt bei Kontrolle und bei Hybrid Search in einer Query und verliert daran, dass jemand es betreiben muss. Pinecone gewinnt bei der Zeit bis zur ersten Query und darin, keinen Bereitschaftsdienst für einen Suchdienst zu brauchen, und verliert bei den Kosten pro Query, sobald der Index wächst, und daran, dass die Form der Daten nachträglich nicht mehr geändert werden kann. Das sind die Abwägungen, keiner davon ist ein Fehler.",{"type":130,"level":131,"id":116,"text":117},{"type":123,"content":459},[460],"Pinecone ist der richtige Standard für die ersten neunzig Tage einer Retrieval-Funktion und eine vertretbare Wahl über Jahre, wenn die Last klein, sauber partitioniert und schwer genug ist, um auf dem Read-Unit-Minimum zu sitzen. Es hört auf, die richtige Antwort zu sein, wenn der Index ein paar Gigabyte überschreitet, wenn eine Compliance-Anforderung eine SLA oder Audit-Logs braucht, oder wenn die Form des Korpus noch in Bewegung ist.",{"type":136,"ordered":462,"items":463},true,[464,466,468,470,472],[465],"Übernehmen, wenn niemand einen Suchcluster besitzen wird. Die kostenlose Stufe ist wirklich nützlich, der erste bezahlte Schritt sind $20 flach.",[467],"Nach Namespaces partitionieren, bevor der Index groß ist, nicht danach. Diese eine Entscheidung setzt die Leserechnung und ist später viel schwerer zu ändern.",[469],"Nicht übernehmen für einen Korpus, dessen Felder bei einem Dokumentindex noch in Bewegung sind, weil Schema-Migration nicht unterstützt wird.",[471],"Mit der eigenen Namespace-Größe rechnen. Die Read-Unit-Formel in der Dokumentation ist kurz genug für den Taschenrechner.",[473],"Qdrant ansehen, wenn der Index zehn Millionen Vektoren überschreiten wird, und pgvector, wenn er deutlich unter einer Million bleibt und es schon einen Datenbankadministrator gibt.",{"type":280,"variant":475,"title":476,"body":477},"tip","Wenn Sie heute entscheiden",[478,480],[479],"Der [pgvector-Vergleich](\u002Fblog\u002Fpgvector-vs-vector-databases) behandelt die Open-Source-Seite ausführlicher, [Hybrid Search und Reranking](\u002Fblog\u002Frag-pipeline-chunking-hybrid-search-reranking) behandelt, was die Recall tatsächlich bewegt.",[481],"Die Retrieval-Qualität entscheiden Chunking, Embedding-Wahl und Reranking lange bevor die Index-Implementierung es entscheidet. Eine verwaltete Datenbank aus Gründen der Retrieval-Qualität auszuwählen heißt, nach der unwichtigsten Variablen auszuwählen.",{"type":130,"level":131,"id":119,"text":120},{"type":136,"ordered":462,"items":484},[485,489,492,495,498,501,504,507],[486],{"tag":487,"href":36,"children":488},"a",[35],[490],{"tag":487,"href":39,"children":491},[38],[493],{"tag":487,"href":42,"children":494},[41],[496],{"tag":487,"href":45,"children":497},[44],[499],{"tag":487,"href":48,"children":500},[47],[502],{"tag":487,"href":51,"children":503},[50],[505],{"tag":487,"href":54,"children":506},[53],[508],{"tag":487,"href":57,"children":509},[56],[511,559,611,653],{"slug":512,"published":513,"minutes":6,"category":7,"tags":514,"keywords":519,"about":528,"sources":532,"cover":551,"og":552,"expertise":60,"locales":553,"lang":63,"title":554,"description":555,"coverAlt":556,"url":557,"pricing":558,"kind":515},"zep","2026-10-06",[515,516,517,518,11],"Agent memory","Knowledge graph","Temporal graph","Context engineering",[520,521,522,523,524,525,526,527],"zep ai","zep agent memory","graphiti knowledge graph","zep pricing","zep vs mem0","long-term memory for agents","temporal knowledge graph","zep cloud",[529],{"name":530,"url":531},"Zep","https:\u002F\u002Fwww.getzep.com\u002F",[533,536,539,542,545,548],{"title":534,"url":535},"Zep pricing: plans, credits and limits","https:\u002F\u002Fwww.getzep.com\u002Fpricing",{"title":537,"url":538},"Zep documentation","https:\u002F\u002Fhelp.getzep.com\u002F",{"title":540,"url":541},"Graphiti on GitHub","https:\u002F\u002Fgithub.com\u002Fgetzep\u002Fgraphiti",{"title":543,"url":544},"Graphiti product page","https:\u002F\u002Fwww.getzep.com\u002Fplatform\u002Fgraphiti\u002F",{"title":546,"url":547},"Announcing a new direction for Zep's open-source strategy","https:\u002F\u002Fwww.getzep.com\u002Fblog\u002Fannouncing-a-new-direction-for-zeps-open-source-strategy\u002F",{"title":549,"url":550},"Graphiti: temporal knowledge graphs for AI agents (arXiv)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2501.13956","\u002Fimages\u002Fblog\u002Fzep\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fzep\u002Fog.jpg",[62,63,64],"Zep-Review: Agenten-Memory auf einem temporalen Graphen","Zep ist eine gehostete Agenten-Memory-API auf einem temporalen Knowledge Graph: Credits beim Schreiben, Retrieval gratis, Flex ab 125 Dollar im Monat, Graphiti als selbst hostbarer Teil.","Diagramm, wie eine Aussage in Zep den Prompt erreicht: Nachrichten und Aussagen werden in einen benutzerspezifischen Context Graph aus Entitäten und Beziehungen extrahiert, und der Retrieval durchläuft den Graphen und liefert einen Kontextblock mit den tragenden Fakten.","https:\u002F\u002Fwww.getzep.com","Apache-2.0 core · Cloud from $50 per month",{"slug":560,"published":561,"minutes":562,"category":7,"tags":563,"keywords":565,"about":573,"sources":578,"cover":603,"og":604,"expertise":60,"locales":605,"lang":63,"title":606,"description":607,"coverAlt":608,"url":609,"pricing":610,"kind":25},"lancedb","2026-09-21",9,[9,13,564,11],"Embedded database",[560,566,567,568,569,570,571,572],"lancedb review","lance vector database","embedded vector database","lancedb vs qdrant","hybrid search rrf","lancedb indexing","lance data format",[574,575],{"name":25,"url":26},{"name":576,"url":577},"Apache Arrow","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FApache_Arrow",[579,582,585,588,591,594,597,600],{"title":580,"url":581},"LanceDB quickstart","https:\u002F\u002Fdocs.lancedb.com\u002Fquickstart",{"title":583,"url":584},"LanceDB vector indexes","https:\u002F\u002Fdocs.lancedb.com\u002Findexing\u002Fvector-index",{"title":586,"url":587},"LanceDB indexing guide","https:\u002F\u002Fdocs.lancedb.com\u002Findexing\u002Findex",{"title":589,"url":590},"LanceDB hybrid search","https:\u002F\u002Fdocs.lancedb.com\u002Fsearch\u002Fhybrid-search",{"title":592,"url":593},"LanceDB Enterprise","https:\u002F\u002Fdocs.lancedb.com\u002Fenterprise",{"title":595,"url":596},"LanceDB frequently asked questions","https:\u002F\u002Fdocs.lancedb.com\u002Ffaq\u002Ffaq-oss",{"title":598,"url":599},"LanceDB pricing","https:\u002F\u002Flancedb.com\u002Fpricing",{"title":601,"url":602},"LanceDB on PyPI","https:\u002F\u002Fpypi.org\u002Fproject\u002Flancedb\u002F","\u002Fimages\u002Fblog\u002Flancedb\u002Fcover.webp","\u002Fimages\u002Fblog\u002Flancedb\u002Fog.jpg",[62,63,64],"LanceDB: Vektorsuche, die als Bibliothek beginnt","Ein Test von LanceDB: eine Apache-2.0-Bibliothek statt Server, die IVF- und HNSW-Indexwahl, Hybridsuche mit Rangfusion und was Enterprise zusätzlich bringt.","Coverbild zum LanceDB-Test: eine Lance-Tabelle speist einen Vektorindex und einen Volltextindex in eine verschmolzene Rangliste","https:\u002F\u002Flancedb.com","Apache-2.0 · Cloud paid",{"slug":407,"published":561,"minutes":612,"category":7,"tags":613,"keywords":617,"about":624,"sources":630,"cover":645,"og":646,"expertise":60,"locales":647,"lang":63,"title":648,"description":649,"coverAlt":650,"url":626,"pricing":651,"kind":652},10,[9,614,615,11,616],"Postgres","HNSW","Quantisation",[407,618,619,620,621,622,623],"pgvector vs qdrant","postgres vector search","hnsw index postgres","iterative index scans","binary quantization postgres","vector database postgres",[625,627],{"name":407,"url":626},"https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector",{"name":628,"url":629},"PostgreSQL","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FPostgreSQL",[631,633,636,639,642],{"title":632,"url":626},"pgvector README",{"title":634,"url":635},"pgvector changelog","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FCHANGELOG.md",{"title":637,"url":638},"PostgreSQL news: pgvector 0.8.2 released","https:\u002F\u002Fwww.postgresql.org\u002Fabout\u002Fnews\u002Fpgvector-082-released-3245\u002F",{"title":640,"url":641},"AWS: Scale pgvector with binary quantization","https:\u002F\u002Faws.amazon.com\u002Fblogs\u002Fdatabase\u002Fscale-pgvector-with-binary-quantization-on-amazon-aurora-postgresql\u002F",{"title":643,"url":644},"pgvector licence","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FLICENSE","\u002Fimages\u002Fblog\u002Fpgvector\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fpgvector\u002Fog.jpg",[62,63,64],"pgvector im Review: die Vektordatenbank, die du nicht betreiben musst","Ein Review von pgvector 0.8.7: iterative Index-Scans für gefilterte Suche, HNSW und IVFFlat, Binärquantisierung bei 100 Millionen Vektoren und das CVE im Indexaufbau.","Eine Anfrage teilt sich oben in einen exakten Sequenzscan, einen HNSW-Graphlauf und eine IVFFlat-Sonde; ein Band unten zeigt einen iterativen Scan, der weiterläuft, bis die LIMIT-Zahl erreicht ist.","PostgreSQL licence","Vector database extension",{"slug":654,"published":655,"minutes":612,"category":7,"tags":656,"keywords":658,"about":664,"sources":668,"cover":696,"og":697,"expertise":60,"locales":698,"lang":63,"title":699,"description":700,"coverAlt":701,"url":667,"pricing":702,"kind":515},"mem0","2026-09-17",[515,657,11,9],"Long-term memory",[654,659,660,661,662,525,663],"mem0 review","agent memory layer","mem0 self-hosted","mem0 pricing","mem0 alternatives",[665],{"name":666,"url":667},"Mem0","https:\u002F\u002Fmem0.ai",[669,672,675,678,681,684,687,690,693],{"title":670,"url":671},"Mem0 documentation","https:\u002F\u002Fdocs.mem0.ai\u002Fintroduction",{"title":673,"url":674},"Mem0 quickstart","https:\u002F\u002Fdocs.mem0.ai\u002Fquickstart",{"title":676,"url":677},"How Mem0 works","https:\u002F\u002Fdocs.mem0.ai\u002Fcore-concepts\u002Fhow-it-works",{"title":679,"url":680},"Mem0 pricing","https:\u002F\u002Fmem0.ai\u002Fpricing",{"title":682,"url":683},"Mem0 on GitHub","https:\u002F\u002Fgithub.com\u002Fmem0ai\u002Fmem0",{"title":685,"url":686},"mem0ai on PyPI","https:\u002F\u002Fpypi.org\u002Fproject\u002Fmem0ai\u002F",{"title":688,"url":689},"Mem0 research and benchmarks","https:\u002F\u002Fmem0.ai\u002Fresearch",{"title":691,"url":692},"Mem0 MCP server","https:\u002F\u002Fdocs.mem0.ai\u002Fplatform\u002Fmem0-mcp",{"title":694,"url":695},"Mem0 paper on arXiv","https:\u002F\u002Farxiv.org\u002Fabs\u002F2504.19413","\u002Fimages\u002Fblog\u002Fmem0\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fmem0\u002Fog.jpg",[62,63,64],"Mem0: was eine Agent-Speicherschicht pro Runde kostet","Ein Review von Mem0: extrahierte Fakten pro Runde, die Benchmark-Tabelle vom April 2026 mit Plattform-Vorbehalt, vier Cloud-Stufen und die Lücken beim Self-Hosting.","Eine Schleife, die aus Gespräch gespeicherte Fakten macht und sie zurück in den Prompt liest","Free tier · from $19 per month",1791383550730]