[{"data":1,"prerenderedAt":825},["ShallowReactive",2],{"blog-graphrag-knowledge-graph-rag-de":3},{"slug":4,"published":5,"minutes":6,"category":7,"tags":8,"keywords":13,"about":23,"sources":33,"cover":70,"og":71,"expertise":72,"locales":73,"lang":75,"title":77,"description":78,"coverAlt":79,"metaTitle":80,"takeaways":81,"faq":87,"toc":106,"blocks":134,"others":529},"graphrag-knowledge-graph-rag","2026-10-02",13,"rag",[9,10,11,12],"GraphRAG","Knowledge graphs","LightRAG","RAG",[9,14,15,16,17,18,19,20,21,22],"knowledge graph RAG","GraphRAG vs vector RAG","Microsoft GraphRAG explained","LightRAG vs GraphRAG","GraphRAG global vs local search","GraphRAG indexing cost","when to use GraphRAG","multi-hop RAG","LazyGraphRAG",[24,27,30],{"name":25,"url":26},"Knowledge graph","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FKnowledge_graph",{"name":28,"url":29},"Retrieval-augmented generation","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FRetrieval-augmented_generation",{"name":31,"url":32},"Leiden algorithm","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FLeiden_algorithm",[34,37,40,43,46,49,52,55,58,61,64,67],{"title":35,"url":36},"Edge et al.: From Local to Global: A Graph RAG Approach to Query-Focused Summarization (arXiv:2404.16130)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2404.16130",{"title":38,"url":39},"Microsoft GraphRAG documentation: overview","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002F",{"title":41,"url":42},"Microsoft GraphRAG documentation: default dataflow","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002Findex\u002Fdefault_dataflow\u002F",{"title":44,"url":45},"Microsoft GraphRAG documentation: global search","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002Fquery\u002Fglobal_search\u002F",{"title":47,"url":48},"Microsoft GraphRAG documentation: local search","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002Fquery\u002Flocal_search\u002F",{"title":50,"url":51},"Microsoft GraphRAG documentation: DRIFT search","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002Fquery\u002Fdrift_search\u002F",{"title":53,"url":54},"Microsoft GraphRAG documentation: getting started","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002Fget_started\u002F",{"title":56,"url":57},"Microsoft Research: LazyGraphRAG, setting a new standard for quality and cost (25 November 2024)","https:\u002F\u002Fwww.microsoft.com\u002Fen-us\u002Fresearch\u002Fblog\u002Flazygraphrag-setting-a-new-standard-for-quality-and-cost\u002F",{"title":59,"url":60},"Guo et al.: LightRAG: Simple and Fast Retrieval-Augmented Generation (arXiv:2410.05779)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2410.05779",{"title":62,"url":63},"HKUDS\u002FLightRAG on GitHub","https:\u002F\u002Fgithub.com\u002FHKUDS\u002FLightRAG",{"title":65,"url":66},"Gutiérrez et al.: HippoRAG: Neurobiologically Inspired Long-Term Memory for Large Language Models (arXiv:2405.14831)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2405.14831",{"title":68,"url":69},"Xiang et al.: When to use Graphs in RAG: A Comprehensive Analysis for Graph Retrieval-Augmented Generation (arXiv:2506.05690)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2506.05690","\u002Fimages\u002Fblog\u002Fgraphrag-knowledge-graph-rag\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fgraphrag-knowledge-graph-rag\u002Fog.jpg","ai-engineer",[74,75,76],"en","de","hu","GraphRAG und Knowledge-Graph-RAG: wann ein Graph die Vektorsuche schlägt","Was Microsoft GraphRAG und LightRAG wirklich tun, was die Indexierung kostet und wann ein Wissensgraph Vektor-RAG schlägt: Multi-Hop, globale Fragen, Produktkataloge.","Diagramm: ein Wissensgraph als Zentrum, verbunden mit Entitäten, Communities, lokaler Suche, globaler Suche und Produktteilen.","GraphRAG: wann ein Wissensgraph RAG schlägt · Balázs Csorba",[82,83,84,85,86],"GraphRAG legt einen per LLM gebauten Wissensgraphen, Leiden-Communities und Community-Berichte über das Chunking. Die Stärke sind globale Fragen zum ganzen Korpus, nicht ein besseres Auffinden einzelner Fakten.","Der Preis ist die Indexierung: mindestens ein LLM-Aufruf pro Chunk für die Extraktion plus Zusammenfassungen für jede Entität und jede Community. Microsoft selbst warnt, dass GraphRAG viele LLM-Ressourcen verbrauchen kann.","Lokale Suche (Entitäts-Nachbarschaften) hilft bei Beziehungs- und Multi-Hop-Fragen, globale Suche (Map-Reduce über Community-Berichte) bei Themen und Überblicken. Für einfaches Faktenlookup reicht meist Vektor-RAG mit Reranking.","Es gibt leichtere Varianten: LightRAG mit inkrementellen Updates, LazyGraphRAG mit den Indexierungskosten von Vektor-RAG, HippoRAG für günstiges Multi-Hop-Retrieval. Behandle die Angaben als Paper-Ergebnisse, bis du sie auf deinen Daten nachgemessen hast.","In B2B-Katalogen liegen die Relationen (ersetzt durch, Teil von, kompatibel mit) schon im PIM oder ERP. Lade sie als Graph, statt ein LLM dafür zu bezahlen, sie neu zu entdecken, und nutze die Vektorsuche für den Freitext.",[88,91,94,97,100,103],{"q":89,"a":90},"Was ist GraphRAG und wie unterscheidet es sich von normalem RAG?","Normales RAG zerlegt Dokumente in Chunks, bettet sie ein und holt die ähnlichsten. GraphRAG, wie von Microsoft Research veröffentlicht, lässt zuerst ein LLM Entitäten und Beziehungen aus den Chunks extrahieren, clustert den entstehenden Graphen mit dem Leiden-Algorithmus in Communities und schreibt pro Community eine LLM-Zusammenfassung. Abfragen können dann die Graph-Nachbarschaft einer Entität (lokale Suche) oder die Community-Zusammenfassungen (globale Suche) nutzen statt nur ähnliche Chunks.",{"q":92,"a":93},"Was ist der Unterschied zwischen lokaler und globaler Suche in GraphRAG?","Die lokale Suche startet bei Entitäten, die zur Frage passen, und zieht deren verbundene Entitäten, Beziehungen, Quelltext und Community-Berichte heran. Sie passt zu Fragen über konkrete Dinge. Die globale Suche führt ein Map-Reduce über Community-Berichte aus und passt zu Fragen über den gesamten Datenbestand, etwa die Hauptthemen. Die DRIFT-Suche kombiniert beides: Sie startet bei Community-Berichten und verfeinert mit lokaler Suche.",{"q":95,"a":96},"Wie teuer ist die GraphRAG-Indexierung?","Deutlich teurer als das Einbetten von Chunks, denn ein LLM liest jeden Chunk, um Entitäten und Beziehungen zu extrahieren, und schreibt danach Beschreibungen und Community-Berichte. Microsoft schreibt, dass GraphRAG viele LLM-Ressourcen verbrauchen kann, und empfiehlt, klein und mit günstigeren Modellen zu beginnen. LazyGraphRAG, eine spätere Variante, nennt Indexierungskosten identisch zu Vektor-RAG und 0,1 % von vollem GraphRAG.",{"q":98,"a":99},"Wann ist GraphRAG besser als Vektor-RAG?","Wenn Fragen von Beziehungen oder vom gesamten Korpus abhängen: Multi-Hop-Fragen, korpusweite Themen und Überblicke sowie Daten mit expliziten Relationen wie Produkt- und Teilehierarchien. Bei einfachem Faktenlookup oft nicht. Die Studie GraphRAG-Bench stellt fest, dass GraphRAG bei vielen realen Aufgaben häufig schlechter abschneidet als einfaches RAG. Miss also auf deinen eigenen Fragen.",{"q":101,"a":102},"Ist LightRAG eine gute Alternative zu Microsoft GraphRAG?","Es ist ein leichteres, MIT-lizenziertes Graph-RAG-Framework mit zweistufigem Retrieval (lokal und global), inkrementellen Updates und mehreren Speicher-Backends wie PostgreSQL und Neo4j. Ein Pilot lohnt sich, wenn sich deine Dokumente oft ändern. Die veröffentlichten Vergleiche stammen von den Autoren selbst, teste es also gegen deine Baseline, bevor du dich festlegst.",{"q":104,"a":105},"Brauche ich eine Graphdatenbank für GraphRAG?","Nicht unbedingt. Microsoft GraphRAG schreibt Tabellen und Embeddings, und LightRAG bringt für Tests einen In-Memory-Graphspeicher mit und unterstützt PostgreSQL für die Produktion. Eine dedizierte Graphdatenbank wie Neo4j lohnt sich, wenn du viel über Relationen traversierst oder sie ohnehin modellierst, zum Beispiel Produkt-Teile-Strukturen.",[107,110,113,116,119,122,125,128,131],{"id":108,"title":109},"what-graphrag-does","Was Microsoft GraphRAG wirklich tut",{"id":111,"title":112},"global-local-drift","Globale, lokale und DRIFT-Suche",{"id":114,"title":115},"lightrag-and-friends","LightRAG, LazyGraphRAG, HippoRAG und Co.",{"id":117,"title":118},"indexing-cost","Die Indexierungsrechnung",{"id":120,"title":121},"when-graphs-win","Wann Graphen gewinnen und wann nicht",{"id":123,"title":124},"b2b-product-parts","Ein pragmatisches B2B-Beispiel: Produkte und Teile",{"id":126,"title":127},"checklist","Eine Checkliste, bevor du einen Graphen baust",{"id":129,"title":130},"where-this-is-going","Wohin das führt",{"id":132,"title":133},"sources","Quellen",[135,139,142,156,159,167,170,179,182,185,186,189,246,249,252,253,256,279,282,283,286,308,311,323,324,331,396,404,405,408,411,418,421,453,461,462,480,483,484,487,490,491],{"type":136,"content":137},"paragraph",[138],"Alle paar Monate zeigt jemand eine schöne Wissensgraph-Visualisierung und behauptet, Vektor-RAG sei überholt. Ich habe genug Retrieval-Systeme gebaut, um beiden Hälften dieses Satzes zu misstrauen. Graphen lösen tatsächlich Probleme, die Chunk-Ähnlichkeit nicht lösen kann, und sie kosten echtes Geld und bringen echte Komplexität für Probleme, die eine Hybridsuche mit Reranker schon im Griff hat.",{"type":136,"content":140},[141],"Dieser Artikel erklärt, was Microsofts GraphRAG unter der Haube wirklich tut, was LightRAG, LazyGraphRAG und HippoRAG ändern, woher die Indexierungsrechnung kommt und welche Fragen einen Graphen rechtfertigen. Er endet mit einem pragmatischen B2B-Beispiel aus Katalogdaten, bei dem mein Rat bewusst unspektakulär ist: Nutze den Graphen, den du schon hast.",{"type":136,"content":143},[144,145,150,151,155],"Wenn du noch keine solide Baseline hast, beginne mit ",{"tag":146,"to":147,"children":148},"link","\u002Fblog\u002Frag-pipeline-chunking-hybrid-search-reranking",[149],"Chunking, Hybridsuche und Reranking"," und dem ",{"tag":146,"to":152,"children":153},"\u002Fblog\u002Frag-2026-hybrid-agentic-long-context",[154],"Überblick über RAG 2026",". Ein Graph ergänzt eine funktionierende Pipeline, er ersetzt keine.",{"type":157,"level":158,"id":108,"text":109},"heading",2,{"type":136,"content":160},[161,162,166],"Die Forschung dahinter ist das Paper ",{"tag":163,"href":36,"children":164},"a",[165],"From Local to Global: A Graph RAG Approach to Query-Focused Summarization"," von Darren Edge und Kollegen bei Microsoft Research (April 2024). Ausgangspunkt ist eine Schwäche gewöhnlichen RAGs: Es tut sich schwer mit globalen Fragen über einen ganzen Korpus, etwa „Was sind die Hauptthemen im Datensatz?“. Die Ähnlichkeitssuche liefert die Chunks, die der Frage am nächsten sind, und eine Frage über alles hat keinen nächsten Chunk.",{"type":136,"content":168},[169],"Die Open-Source-Implementierung dokumentiert die Indexierung in Stufen. Dokumente werden in Text Units geschnitten (standardmäßig 1.200 Tokens). Ein LLM extrahiert Entitäten mit Titel, Typ und Beschreibung sowie die Beziehungen zwischen ihnen, optional auch Claims. Wiederholte Beschreibungen werden zusammengeführt. Der hierarchische Leiden-Algorithmus clustert den Graphen dann in Communities auf mehreren Granularitätsstufen. Zuletzt schreibt das LLM zu jeder Community einen Bericht, und Text Units, Entitätsbeschreibungen und Berichte werden in einen Vektorspeicher eingebettet.",{"type":171,"attrs":172,"inner":176,"caption":177},"diagram",{"viewBox":173,"role":174,"aria-labelledby":175},"0 0 720 270","img","d1-grag-t d1-grag-d","\u003Ctitle id=\"d1-grag-t\">GraphRAG: von Dokumenten zu zwei Sucharten\u003C\u002Ftitle>\u003Cdesc id=\"d1-grag-d\">Indexierungs-Pipeline: Dokumente werden zu Text Units, einem extrahierten Entitätsgraphen, Leiden-Communities und Community-Berichten. Die lokale Suche liest Entitäts-Nachbarschaften, die globale Suche führt Map-Reduce über Community-Berichte aus.\u003C\u002Fdesc>\u003Ctext x=\"20\" y=\"28\" class=\"d-title\">GraphRAG: von Dokumenten zu zwei Sucharten\u003C\u002Ftext>\u003Ctext x=\"700\" y=\"28\" text-anchor=\"end\" class=\"d-label\">Microsoft-GraphRAG-Doku\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"56\" text-anchor=\"start\" class=\"d-label\">INDEXIERUNG (LLM-lastig)\u003C\u002Ftext>\u003Crect x=\"20\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"80\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Dokumente\u003C\u002Ftext>\u003Ctext x=\"80\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">Rohtext\u003C\u002Ftext>\u003Cpath d=\"M140 102 H152\" class=\"d-line\" \u002F>\u003Cpath d=\"M160 102 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"160\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"220\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Text Units\u003C\u002Ftext>\u003Ctext x=\"220\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">1.200 Tokens\u003C\u002Ftext>\u003Cpath d=\"M280 102 H292\" class=\"d-line\" \u002F>\u003Cpath d=\"M300 102 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"300\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"360\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Graph\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">Entitäten, Links\u003C\u002Ftext>\u003Cpath d=\"M420 102 H432\" class=\"d-line\" \u002F>\u003Cpath d=\"M440 102 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"440\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"500\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Communities\u003C\u002Ftext>\u003Ctext x=\"500\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">Leiden\u003C\u002Ftext>\u003Cpath d=\"M560 102 H572\" class=\"d-line\" \u002F>\u003Cpath d=\"M580 102 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"580\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-accent\" \u002F>\u003Ctext x=\"640\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Berichte\u003C\u002Ftext>\u003Ctext x=\"640\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">LLM-Summaries\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"172\" text-anchor=\"start\" class=\"d-label\">ABFRAGEZEIT\u003C\u002Ftext>\u003Cpath d=\"M300 134 C300 160 185 160 185 176\" class=\"d-line\" \u002F>\u003Cpath d=\"M185 186 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Cpath d=\"M580 134 C580 160 535 160 535 176\" class=\"d-line\" \u002F>\u003Cpath d=\"M535 186 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Crect x=\"20\" y=\"186\" width=\"330\" height=\"64\" rx=\"10\" class=\"d-mint\" \u002F>\u003Ctext x=\"185\" y=\"214\" text-anchor=\"middle\" class=\"d-text\">Lokale Suche\u003C\u002Ftext>\u003Ctext x=\"185\" y=\"235\" text-anchor=\"middle\" class=\"d-small\">Entität, Nachbarn, Quelltext\u003C\u002Ftext>\u003Crect x=\"370\" y=\"186\" width=\"330\" height=\"64\" rx=\"10\" class=\"d-gold\" \u002F>\u003Ctext x=\"535\" y=\"214\" text-anchor=\"middle\" class=\"d-text\">Globale Suche\u003C\u002Ftext>\u003Ctext x=\"535\" y=\"235\" text-anchor=\"middle\" class=\"d-small\">Map-Reduce über Berichte\u003C\u002Ftext>",[178],"Der teure Teil passiert einmal bei der Indexierung; die beiden Suchmodi lesen unterschiedliche Artefakte desselben Index.",{"type":136,"content":180},[181],"Daraus folgen zwei Dinge. Der Graph ist keine von Hand modellierte Ontologie, sondern das, was der Extraktions-Prompt gefunden hat; seine Qualität hängt also vom Prompt-Tuning für deine Domäne ab (die Dokumentation sagt das ausdrücklich). Und die Community-Berichte sind eine vorberechnete, hierarchische Zusammenfassung deines Korpus, und genau das macht globale Fragen beantwortbar.",{"type":136,"content":183},[184],"In den Experimenten des Papers schlugen GraphRAG-Varianten auf zwei Datensätzen mit je rund 1 Million Tokens (Podcast-Transkripte und Nachrichtenartikel) eine Vektor-RAG-Baseline in LLM-bewerteten Vergleichen: Gewinnraten von 72 bis 83 Prozent bei Umfassendheit und 62 bis 82 Prozent bei Vielfalt, je nach Datensatz und Variante. Zusammenfassungen auf Root-Ebene der Communities brauchten außerdem 9- bis 43-mal weniger Tokens als die Zusammenfassung des Quelltexts. Die Autoren sind beim Geltungsbereich vorsichtig: Die Auswertung betrifft Sensemaking-Fragen auf zwei Korpora, und es sei mehr Arbeit nötig, um zu sehen, wie gut sich das verallgemeinern lässt.",{"type":157,"level":158,"id":111,"text":112},{"type":136,"content":187},[188],"Der Unterschied zwischen den Abfragemodi ist das Nützlichste, was man verstehen sollte, denn er zeigt, welche Fragen den Index rechtfertigen.",{"type":190,"head":191,"rows":200},"table",[192,194,196,198],[193],"Modus",[195],"Welche Frage er beantwortet",[197],"Was er liest",[199],"Kostenprofil",[201,213,224,235],[202,207,209,211],[203],{"tag":204,"children":205},"strong",[206],"Lokale Suche",[208],"Über konkrete Dinge: „Was wissen wir über Kunde X und seine Verträge?“",[210],"Zur Frage passende Entitäten, ihre Nachbarn, Beziehungen, Quell-Text-Units und Community-Berichte",[212],"Ein Retrieval und eine Antwort, vergleichbar mit RAG mit größerem Kontext",[214,218,220,222],[215],{"tag":204,"children":216},[217],"Globale Suche",[219],"Über den ganzen Korpus: „Was sind die Hauptrisiken über alle Berichte hinweg?“",[221],"Community-Berichte, verarbeitet in einem Map- und einem Reduce-Schritt",[223],"Viele LLM-Aufrufe; eine tiefere Community-Ebene ist gründlicher, aber langsamer und teurer",[225,229,231,233],[226],{"tag":204,"children":227},[228],"DRIFT-Suche",[230],"Breiter Einstieg, spezifische Nachfrage",[232],"Zuerst relevante Community-Berichte, dann lokale Suche für die Folgefragen",[234],"Zwischen beiden; laut Doku umfassender als reine lokale Suche",[236,240,242,244],[237],{"tag":204,"children":238},[239],"Vektor-RAG",[241],"Wo steht das?",[243],"Die top-k ähnlichsten Chunks",[245],"Am günstigsten bei Indexierung und Abfrage",{"type":136,"content":247},[248],"Die globale Suche verdient einen genaueren Blick. Die Dokumentation beschreibt ein Map-Reduce über Community-Berichte: Die Berichte werden in Chunks zerlegt, jeder Chunk liefert eine Zwischenantwort mit Wichtigkeitsbewertung, und der Reduce-Schritt filtert und aggregiert sie. Die Wahl der Community-Ebene ist ein direkter Regler zwischen Tiefe und Kosten, ein Produktivsystem sollte ihn also nach außen geben, statt ihn fest zu verdrahten.",{"type":136,"content":250},[251],"Die lokale Suche ist der Modus, den die meisten Teams tatsächlich brauchen, und der, der einer klassischen Retrieval-Pipeline am nächsten kommt. Sie bettet die Frage ein, findet verwandte Entitäten und zieht verbundene Entitäten, Beziehungen, Kovariaten, Quell-Chunks und Community-Berichte heran, zugeschnitten auf ein Kontextfenster.",{"type":157,"level":158,"id":114,"text":115},{"type":136,"content":254},[255],"Das Originaldesign ist gründlich und teuer, und mehrere Projekte greifen genau das an. Eine kurze Orientierung, mit dem üblichen Vorbehalt, dass alle folgenden Zahlen von den Autoren selbst stammen:",{"type":257,"ordered":258,"items":259},"list",false,[260,266,272],[261,265],{"tag":204,"children":262},[263],{"tag":163,"href":63,"children":264},[11]," (Paper vom Oktober 2024, präsentiert auf der EMNLP 2025, MIT-Lizenz) baut einen Graph- plus Vektorindex mit zweistufigem Retrieval, unterstützt inkrementelle Updates und das Löschen von Dokumenten und bietet die Abfragemodi local, global, hybrid, naive und mix. Es läuft auf PostgreSQL, Neo4j, MongoDB, Milvus, Qdrant oder OpenSearch. Das Paper berichtet Verbesserungen bei Genauigkeit und Effizienz des Retrievals, einen Kostenvergleich mit GraphRAG auf Augenhöhe konnte ich aber nicht verifizieren und lasse die Behauptung deshalb offen. Inkrementelle Updates sind das Feature, das mich interessiert: Ein jedes Mal neu gebauter Index passt schlecht zu lebenden Dokumentbeständen.",[267,271],{"tag":204,"children":268},[269],{"tag":163,"href":57,"children":270},[22]," (Microsoft Research, 25. November 2024) verzichtet auf die vorab erstellte Zusammenfassung. Laut Microsoft sind die Indexierungskosten identisch mit Vektor-RAG und betragen 0,1 % der Kosten von vollem GraphRAG, die Arbeit verschiebt sich auf die Abfragezeit. Das ist der richtige Tausch bei einem großen Korpus und wenigen graphwürdigen Fragen.",[273,278],{"tag":204,"children":274},[275],{"tag":163,"href":66,"children":276},[277],"HippoRAG"," (NeurIPS 2024) kombiniert einen per LLM gebauten Wissensgraphen mit Personalized PageRank. Die Autoren berichten Gewinne von bis zu 20 % bei Multi-Hop-Fragebeantwortung und einstufiges Retrieval, das iteratives Retrieval erreicht oder übertrifft, dabei 10- bis 30-mal günstiger und 6- bis 13-mal schneller. Es zielt auf Multi-Hop, nicht auf globale Fragen.",{"type":136,"content":280},[281],"Meine Lesart: „Graph-RAG“ ist eine Familie, kein Produkt. Die nützliche Frage ist, welchen der drei Jobs du brauchst: globale Zusammenfassungen, beziehungsbewusstes Multi-Hop-Retrieval oder inkrementell aktualisiertes Wissen. Wähle die Variante für diesen Job.",{"type":157,"level":158,"id":117,"text":118},{"type":136,"content":284},[285],"Microsofts eigene Einstiegsseite warnt, dass GraphRAG viele LLM-Ressourcen verbrauchen kann, und empfiehlt, zuerst den Tutorial-Datensatz und günstigere Modelle auszuprobieren. Das ist die ehrliche Zusammenfassung. Einen Preis pro Million Tokens, der dauerhaft stimmt, kann ich dir nicht nennen, er hängt vom Modell und deinen Prompts ab, aber ich kann zeigen, woher die Aufrufe kommen:",{"type":257,"ordered":258,"items":287},[288,293,298,303],[289,292],{"tag":204,"children":290},[291],"Extraktion:"," mindestens ein LLM-Aufruf pro Text Unit, mehr bei Selbstreflexions-Durchgängen („Gleaning“). Das Paper fand, dass der Recall der Extraktion mit zusätzlichen Durchgängen und kleineren Chunks steigt: Mit GPT-4 lieferte ein 600-Token-Chunk fast doppelt so viele Entitätsnennungen wie ein 2.400-Token-Chunk.",[294,297],{"tag":204,"children":295},[296],"Beschreibungs-Zusammenfassung:"," Jede Entität und Beziehung, die in vielen Chunks vorkommt, bekommt ihre Beschreibungen von einem LLM zusammengeführt.",[299,302],{"tag":204,"children":300},[301],"Community-Berichte:"," ein LLM-geschriebener Bericht pro Community, auf jeder Hierarchieebene.",[304,307],{"tag":204,"children":305},[306],"Embeddings:"," Text Units, Entitätsbeschreibungen und Berichtsinhalte. Das ist der einzige Teil, den auch eine Vektor-RAG-Pipeline bezahlt.",{"type":136,"content":309},[310],"Auch die Größe zählt. Die Graphen des Papers für je rund 1 Million Tokens Text hatten 8.564 Knoten und 20.691 Kanten (Podcasts) sowie 15.754 Knoten und 19.520 Kanten (News). Multipliziere das mit deinem Korpus und mit jeder Neuindexierung. Dort summieren sich die Kosten: Ändern sich Dokumente wöchentlich, verändern ein inkrementelles Design wie LightRAG oder ein Design auf Abruf wie LazyGraphRAG die Wirtschaftlichkeit stärker als jedes Prompt-Tuning.",{"type":312,"variant":313,"title":314,"body":315},"callout","tip","Schätze, bevor du indexierst",[316],[317,318,322],"Indexiere eine repräsentative Stichprobe von 1 bis 5 Prozent, notiere Tokens und Kosten pro Text Unit und rechne hoch. Addiere dann die Kosten der Neuindexierung bei deiner realen Änderungsrate. Vergleiche die Summe mit dem Wert der Fragen, die nur der Graph beantworten kann. Die allgemeine Methode steht in ",{"tag":146,"to":319,"children":320},"\u002Fblog\u002Fllm-cost-latency-prompt-caching-routing",[321],"Kosten, Latenz und Routing",".",{"type":157,"level":158,"id":120,"text":121},{"type":136,"content":325},[326,327,330],"Die ",{"tag":163,"href":69,"children":328},[329],"GraphRAG-Bench-Studie"," (Juni 2025) beginnt mit einer unbequemen Beobachtung: GraphRAG schneidet bei vielen realen Aufgaben häufig schlechter ab als einfaches RAG. Sie untersucht dann Faktenabruf, komplexes Schlussfolgern, Zusammenfassung und kreative Generierung, um die Bedingungen zu finden, unter denen sich der Graph lohnt. Das deckt sich mit meiner Erfahrung. Die Entscheidung hängt von der Form der Frage ab.",{"type":190,"head":332,"rows":341},[333,335,337,339],[334],"Fragetyp",[336],"Vektor-RAG + Reranker",[338],"Graph-RAG",[340],"Meine Wahl",[342,351,360,369,378,387],[343,345,347,349],[344],"Einzelfakt („Welches Drehmoment gilt für Modell Z?“)",[346],"Stark, günstig",[348],"Selten besser",[350],"Vektor",[352,354,356,358],[353],"Multi-Hop („Welcher Lieferant fertigt das Teil, das X ersetzt hat?“)",[355],"Verpasst den zweiten Hop, außer ein Agent iteriert",[357],"Stark, wenn die Relation explizit ist",[359],"Graph oder agentisches Retrieval",[361,363,365,367],[362],"Global („Welche Themen wiederholen sich in 5.000 Tickets?“)",[364],"Schwach: kein nächster Chunk",[366],"Der Fall, für den GraphRAG entworfen wurde",[368],"Graph oder Zusammenfassung per Clustering",[370,372,374,376],[371],"Relationaler Katalog („Was passt, was ersetzt, was ist Teil von?“)",[373],"Findet Text, keine Struktur",[375],"Stark, und die Daten sind schon strukturiert",[377],"Graph aus strukturierten Daten",[379,381,383,385],[380],"Sich schnell ändernde Dokumente",[382],"Leicht zu aktualisieren",[384],"Teuer, außer inkrementell",[386],"Vektor oder LightRAG-artige Updates",[388,390,392,394],[389],"Kleiner Korpus, der in den Kontext passt",[391],"Nicht nötig",[393],"Lohnt sich nicht",[395],"Langer Kontext",{"type":136,"content":397},[398,399,403],"Das Muster: Graphen helfen, wenn sich die Antwort aus mehreren, durch Relationen verbundenen Teilen oder aus dem Korpus als Ganzem zusammensetzt. Sie helfen nicht, wenn die Antwort in einer Passage steht. Schreibe vor dem Bau zwanzig echte Nutzerfragen auf und ordne jede als Fakt, Multi-Hop oder global ein. Sind 80 Prozent Fakten, brauchst du besseres Chunking und Reranking, keinen Graphen. Miss das Ergebnis mit ",{"tag":146,"to":400,"children":401},"\u002Fblog\u002Fllm-evals-for-product-features",[402],"Evals für dein Produkt",", nicht mit einer Demo.",{"type":157,"level":158,"id":123,"text":124},{"type":136,"content":406},[407],"Das ist die Situation, der ich in B2B-E-Commerce- und ERP-Projekten begegne. Ein Hersteller oder Großhändler verkauft Maschinen, Ersatzteile und Zubehör. Der Vertrieb oder ein Kunde fragt: „Unsere Pumpe P-150 läuft aus. Welche Pumpe ersetzt sie, und welchen Dichtsatz brauche ich jetzt?“ Die Antwort braucht drei Hops: das Nachfolgeprodukt, seine Stückliste und den aktuellen Ersatz eines ausgelaufenen Teils. Verwandte Fragen sind „Was ist mit diesem Flansch kompatibel?“ und „Welches Handbuch deckt diese Variante ab?“.",{"type":136,"content":409},[410],"Eine Vektorsuche über Datenblätter findet die P-150-Seite und vielleicht die P-200-Seite. Sie folgt „ersetzt durch“ nicht zuverlässig zum richtigen Dichtsatz, denn dieser Fakt ist eine Relation zwischen Datensätzen, kein Satz, der der Frage ähnelt. Das ist ein klassischer Graph-Fall. Aber achte darauf, woher der Graph kommen sollte.",{"type":171,"attrs":412,"inner":415,"caption":416},{"viewBox":413,"role":174,"aria-labelledby":414},"0 0 720 316","d2-grag-t d2-grag-d","\u003Ctitle id=\"d2-grag-t\">Produkt- und Teilebeziehungen als Graph\u003C\u002Ftitle>\u003Cdesc id=\"d2-grag-d\">Pumpe P-150 wird durch Pumpe P-200 ersetzt. P-200 hat die Teile Motor M-4 und Dichtsatz S-17, passt zu Flansch F-80 und ist in einem Handbuch dokumentiert. Dichtsatz S-17 wird durch Dichtsatz S-18 ersetzt.\u003C\u002Fdesc>\u003Ctext x=\"20\" y=\"28\" class=\"d-title\">Produkt- und Teilebeziehungen als Graph\u003C\u002Ftext>\u003Ctext x=\"700\" y=\"28\" text-anchor=\"end\" class=\"d-label\">Beispiel zur Illustration\u003C\u002Ftext>\u003Crect x=\"20\" y=\"130\" width=\"130\" height=\"56\" rx=\"10\" class=\"d-gold\" \u002F>\u003Ctext x=\"85\" y=\"163\" text-anchor=\"middle\" class=\"d-text\">Pumpe P-150\u003C\u002Ftext>\u003Cpath d=\"M150 158 H252\" class=\"d-line\" \u002F>\u003Cpath d=\"M260 158 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"205\" y=\"148\" text-anchor=\"middle\" class=\"d-label\">ersetzt durch\u003C\u002Ftext>\u003Crect x=\"260\" y=\"130\" width=\"160\" height=\"56\" rx=\"10\" class=\"d-accent\" \u002F>\u003Ctext x=\"340\" y=\"163\" text-anchor=\"middle\" class=\"d-text\">Pumpe P-200\u003C\u002Ftext>\u003Crect x=\"260\" y=\"44\" width=\"160\" height=\"44\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"340\" y=\"71\" text-anchor=\"middle\" class=\"d-text\">Motor M-4\u003C\u002Ftext>\u003Cpath d=\"M340 130 V96\" class=\"d-line\" \u002F>\u003Cpath d=\"M340 88 l-5 9 h10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"352\" y=\"114\" text-anchor=\"start\" class=\"d-label\">hat Teil\u003C\u002Ftext>\u003Crect x=\"260\" y=\"232\" width=\"160\" height=\"44\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"340\" y=\"259\" text-anchor=\"middle\" class=\"d-text\">Dichtsatz S-17\u003C\u002Ftext>\u003Cpath d=\"M340 186 V224\" class=\"d-line\" \u002F>\u003Cpath d=\"M340 232 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"352\" y=\"214\" text-anchor=\"start\" class=\"d-label\">hat Teil\u003C\u002Ftext>\u003Crect x=\"20\" y=\"232\" width=\"130\" height=\"44\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"85\" y=\"259\" text-anchor=\"middle\" class=\"d-text\">Flansch F-80\u003C\u002Ftext>\u003Cpath d=\"M285 186 C260 232 200 254 160 254\" class=\"d-line\" \u002F>\u003Cpath d=\"M150 254 l9 -5 v10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"205\" y=\"226\" text-anchor=\"middle\" class=\"d-label\">passt zu\u003C\u002Ftext>\u003Crect x=\"560\" y=\"130\" width=\"140\" height=\"56\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"630\" y=\"163\" text-anchor=\"middle\" class=\"d-text\">Handbuch (PDF)\u003C\u002Ftext>\u003Cpath d=\"M420 158 H552\" class=\"d-line\" \u002F>\u003Cpath d=\"M560 158 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"490\" y=\"148\" text-anchor=\"middle\" class=\"d-label\">dokumentiert in\u003C\u002Ftext>\u003Crect x=\"560\" y=\"232\" width=\"140\" height=\"44\" rx=\"10\" class=\"d-mint\" \u002F>\u003Ctext x=\"630\" y=\"259\" text-anchor=\"middle\" class=\"d-text\">Dichtsatz S-18\u003C\u002Ftext>\u003Cpath d=\"M420 254 H552\" class=\"d-line\" \u002F>\u003Cpath d=\"M560 254 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"490\" y=\"246\" text-anchor=\"middle\" class=\"d-label\">ersetzt durch\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"304\" text-anchor=\"middle\" class=\"d-label\">Drei Hops: P-150, dann P-200, dann S-17, dann S-18\u003C\u002Ftext>",[417],"Die Relationen sind bereits Felder in einem PIM oder ERP; nur das Handbuch braucht Textsuche.",{"type":136,"content":419},[420],"In einem PIM oder ERP wie Pimcore, Spryker oder SAP liegen diese Relationen bereits als strukturierte Daten vor: Nachfolgerverweise, Stücklisten, Kompatibilitätstabellen. Ein LLM dafür zu bezahlen, sie noch einmal aus PDFs zu extrahieren, ist langsamer, teurer und ungenauer, als die Felder zu lesen. Meine empfohlene Architektur ist deshalb:",{"type":257,"ordered":422,"items":423},true,[424,429,434,439,444],[425,428],{"tag":204,"children":426},[427],"Baue den Graphen aus strukturierten Daten."," Knoten sind Produkte, Teile und Dokumente; Kanten sind die Relationstypen, die deine Stammdaten schon definieren (ersetzt durch, Teil von, kompatibel mit, dokumentiert in). Halte die Knoten-IDs gleich der SKU oder Artikelnummer.",[430,433],{"tag":204,"children":431},[432],"Nutze Vektor- oder Hybridsuche für den Text."," Handbücher, Datenblätter und Tickets bleiben in einem gechunkten Index. Jeder Chunk trägt die Produkt-IDs, die er erwähnt, sodass eine Graph-Traversierung genau die relevanten Chunks holen kann.",[435,438],{"tag":204,"children":436},[437],"Erst Entitäten auflösen, dann traversieren."," Der Agent oder Retrieval-Schritt ordnet „P-150“ einem Knoten zu (exakter Treffer schlägt Embeddings bei Artikelnummern), geht ein bis drei Hops mit einer typisierten Abfrage und übergibt dem Modell die gefundenen Datensätze plus die verknüpften Chunks.",[440,443],{"tag":204,"children":441},[442],"Ergänze LLM-Extraktion nur für Lücken,"," etwa Kompatibilitätshinweise, die nur im Freitext stehen, und markiere solche Kanten als weniger verlässlich.",[445,448,449,322],{"tag":204,"children":446},[447],"Prüfe die Verfügbarkeit im führenden System."," Bestand, Preis und Gültigkeit gehören dem ERP, das zur Antwortzeit als Tool aufgerufen wird, nie in den Graphen. Wohin die Reise geht, steht in ",{"tag":146,"to":450,"children":451},"\u002Fblog\u002Fagentic-commerce-protocols-ucp-acp-guide",[452],"Agentic-Commerce-Protokolle",{"type":136,"content":454},[455,456,460],"Das ist Graph-RAG ohne den teuren Teil. Es ist außerdem besser nachvollziehbar: Jeder Hop in der Antwort ist ein Datensatz, den jemand öffnen kann. Wenn du solche Systeme baust: Meine ",{"tag":146,"to":457,"children":458},"\u002Fexpertise\u002Fb2b-ecommerce-developer",[459],"B2B-E-Commerce-Arbeit"," ist genau diese Kombination aus Stammdaten und Retrieval.",{"type":157,"level":158,"id":126,"text":127},{"type":257,"ordered":422,"items":463},[464,466,468,470,472,474,476,478],[465],"Sammle zwanzig bis fünfzig echte Fragen und ordne sie als Fakt, Multi-Hop oder global ein.",[467],"Baue und messe die Baseline: Hybridsuche mit Reranking und ordentlichem Chunking.",[469],"Prüfe, ob die Relationen schon als strukturierte Daten existieren. Wenn ja, importiere sie, statt sie zu extrahieren.",[471],"Wenn du globale Fragen brauchst, pilotiere GraphRAG oder LazyGraphRAG auf einer Stichprobe und rechne die Kosten hoch, inklusive Neuindexierung.",[473],"Wenn sich deine Dokumente oft ändern, teste zuerst inkrementelle Ansätze wie LightRAG.",[475],"Tune den Extraktions-Prompt für deine Domäne und prüfe eine Stichprobe extrahierter Entitäten von Hand.",[477],"Vergleiche mit der Baseline auf deinen eigenen Fragen, mit LLM-Judge plus menschlichen Stichproben.",[479],"Mache den Retrieval-Modus (Vektor, lokal, global) zu einer Router-Entscheidung, statt jede Anfrage durch den Graphen zu zwingen.",{"type":136,"content":481},[482],"Der letzte Punkt spart Geld. Ein günstiger Klassifikator oder ein kleines Modell leitet Faktenfragen an die Vektorsuche und schickt nur globale oder relationale Fragen an den Graphen. Die Pipeline kostet dann so viel, wie jede Frage verdient.",{"type":157,"level":158,"id":129,"text":130},{"type":136,"content":485},[486],"Mit langen Kontextfenstern und agentischem Retrieval kann ein Agent über einen schlichten Index iterieren und Multi-Hop-Schlussfolgern annähern, zum Preis von mehr Aufrufen pro Frage. Graphen verlagern diese Arbeit in die Indexierung. Keiner gewinnt überall, deshalb ist das Muster 2026 ein Router über mehrere Retrieval-Strategien.",{"type":136,"content":488},[489],"Meine Empfehlung: skeptisch bleiben und empirisch arbeiten. Beginne mit der Baseline, ergänze einen Graphen nur für die Fragetypen, die ihn brauchen, beziehe seine Kanten wo immer möglich aus strukturierten Daten und halte die Indexierungsrechnung sichtbar. Ein Graph, der eine Fragenklasse zu bekanntem Preis besser beantwortet, ist ein Gewinn. Ein Graph, der gebaut wurde, weil er im Diagramm gut aussieht, ist ein Kostenfaktor.",{"type":157,"level":158,"id":132,"text":133},{"type":257,"ordered":422,"items":492},[493,496,499,502,505,508,511,514,517,520,523,526],[494],{"tag":163,"href":36,"children":495},[35],[497],{"tag":163,"href":39,"children":498},[38],[500],{"tag":163,"href":42,"children":501},[41],[503],{"tag":163,"href":45,"children":504},[44],[506],{"tag":163,"href":48,"children":507},[47],[509],{"tag":163,"href":51,"children":510},[50],[512],{"tag":163,"href":54,"children":513},[53],[515],{"tag":163,"href":57,"children":516},[56],[518],{"tag":163,"href":60,"children":519},[59],[521],{"tag":163,"href":63,"children":522},[62],[524],{"tag":163,"href":66,"children":525},[65],[527],{"tag":163,"href":69,"children":528},[68],[530,602,686,753],{"slug":531,"published":5,"minutes":6,"category":7,"tags":532,"keywords":537,"about":548,"sources":556,"cover":596,"og":597,"expertise":72,"locales":598,"lang":75,"title":599,"description":600,"coverAlt":601},"llm-hallucination-grounding-citations",[533,12,534,535,536],"Hallucinations","Citations","Grounding","Faithfulness",[538,539,540,541,542,543,544,545,546,547],"reduce LLM hallucinations in production","how to reduce hallucinations in RAG","LLM citations API","Anthropic citations API","RAG faithfulness metric","LLM abstention I don't know","claim-level verification LLM","grounding LLM answers in sources","check grounding API","show sources in AI chatbot UI",[549,552,553],{"name":550,"url":551},"Hallucination (artificial intelligence)","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FHallucination_(artificial_intelligence)",{"name":28,"url":29},{"name":554,"url":555},"Large language model","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FLarge_language_model",[557,560,563,566,569,572,575,578,581,584,587,590,593],{"title":558,"url":559},"Anthropic: Citations (Claude API documentation)","https:\u002F\u002Fplatform.claude.com\u002Fdocs\u002Fen\u002Fbuild-with-claude\u002Fcitations",{"title":561,"url":562},"Anthropic: Search results (Claude API documentation)","https:\u002F\u002Fplatform.claude.com\u002Fdocs\u002Fen\u002Fbuild-with-claude\u002Fsearch-results",{"title":564,"url":565},"Anthropic: Reduce hallucinations (Claude API documentation)","https:\u002F\u002Fplatform.claude.com\u002Fdocs\u002Fen\u002Ftest-and-evaluate\u002Fstrengthen-guardrails\u002Freduce-hallucinations",{"title":567,"url":568},"Anthropic: Introducing Citations on the Anthropic API","https:\u002F\u002Fclaude.com\u002Fblog\u002Fintroducing-citations-api",{"title":570,"url":571},"Simon Willison: Anthropic's new Citations API (24 January 2025)","https:\u002F\u002Fsimonwillison.net\u002F2025\u002FJan\u002F24\u002Fanthropics-new-citations-api\u002F",{"title":573,"url":574},"OpenAI: Web search guide (url_citation annotations and display requirement)","https:\u002F\u002Fdevelopers.openai.com\u002Fapi\u002Fdocs\u002Fguides\u002Ftools-web-search",{"title":576,"url":577},"Cohere: Documents and citations","https:\u002F\u002Fdocs.cohere.com\u002Fdocs\u002Fdocuments-and-citations",{"title":579,"url":580},"Google Cloud: Check grounding API","https:\u002F\u002Fdocs.cloud.google.com\u002Fgenerative-ai-app-builder\u002Fdocs\u002Fcheck-grounding",{"title":582,"url":583},"AWS: Amazon Bedrock Guardrails contextual grounding check","https:\u002F\u002Fdocs.aws.amazon.com\u002Fbedrock\u002Flatest\u002Fuserguide\u002Fguardrails-contextual-grounding-check.html",{"title":585,"url":586},"Ragas: Faithfulness metric","https:\u002F\u002Fdocs.ragas.io\u002Fen\u002Fstable\u002Fconcepts\u002Fmetrics\u002Favailable_metrics\u002Ffaithfulness\u002F",{"title":588,"url":589},"Kalai, Nachum, Vempala, Zhang: Why Language Models Hallucinate (arXiv 2509.04664)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2509.04664",{"title":591,"url":592},"Magesh et al.: Hallucination-Free? Assessing the Reliability of Leading AI Legal Research Tools (arXiv 2405.20362)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2405.20362",{"title":594,"url":595},"Wallat, Heuss, de Rijke, Anand: Correctness is not Faithfulness in RAG Attributions (arXiv 2412.18004)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2412.18004","\u002Fimages\u002Fblog\u002Fllm-hallucination-grounding-citations\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fllm-hallucination-grounding-citations\u002Fog.jpg",[74,75,76],"LLM-Halluzinationen in Produktion reduzieren: Grounding, Zitate und das Nein zur richtigen Zeit","Halluzinationen im produktiven RAG senken: Zitier-APIs, Abstention, Claim-Prüfung, Faithfulness-Metriken, Quellen-UI und die Fehler, die trotzdem durchrutschen.","Diagramm: Ein Retrieval-Schritt speist ein Evidenz-Gate, eine Antwort mit Zitaten und einen Claim-Prüfer und endet in einer Antwort mit Quellen; Pfade für Abstention und Markierung zweigen ab.",{"slug":603,"published":5,"minutes":6,"category":7,"tags":604,"keywords":609,"about":620,"sources":628,"cover":680,"og":681,"expertise":72,"locales":682,"lang":75,"title":683,"description":684,"coverAlt":685},"pgvector-vs-vector-databases",[605,606,12,607,608],"pgvector","Vector databases","Hybrid search","EU hosting",[610,611,612,613,614,615,616,617,618,619],"pgvector vs vector database","pgvector vs Qdrant","pgvector vs Pinecone","best vector database 2026","pgvector HNSW iterative scan","pgvector halfvec","OpenSearch vs Elasticsearch vector search","vector database EU hosting","hybrid search Postgres","Weaviate vs Milvus",[621,624,627],{"name":622,"url":623},"Vector database","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FVector_database",{"name":625,"url":626},"PostgreSQL","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FPostgreSQL",{"name":28,"url":29},[629,632,635,638,641,644,647,650,653,656,659,662,665,668,671,674,677],{"title":630,"url":631},"pgvector README (index limits, HNSW defaults, iterative scans, filtering, halfvec)","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FREADME.md",{"title":633,"url":634},"pgvector CHANGELOG (0.4.0 to 0.8.7)","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FCHANGELOG.md",{"title":636,"url":637},"pgvectorscale: StreamingDiskANN, statistical binary quantization, filtered search","https:\u002F\u002Fgithub.com\u002Ftimescale\u002Fpgvectorscale",{"title":639,"url":640},"Qdrant documentation: Filtering","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fconcepts\u002Ffiltering\u002F",{"title":642,"url":643},"Qdrant documentation: Hybrid queries","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fconcepts\u002Fhybrid-queries\u002F",{"title":645,"url":646},"Qdrant documentation: Create a cluster (providers, free tier, Hybrid Cloud)","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fcloud\u002Fcreate-cluster\u002F",{"title":648,"url":649},"Weaviate documentation: Hybrid search","https:\u002F\u002Fdocs.weaviate.io\u002Fweaviate\u002Fconcepts\u002Fsearch\u002Fhybrid-search",{"title":651,"url":652},"Weaviate documentation: Vector index types","https:\u002F\u002Fdocs.weaviate.io\u002Fweaviate\u002Fconcepts\u002Fvector-index",{"title":654,"url":655},"Weaviate Cloud pricing and deployment options","https:\u002F\u002Fweaviate.io\u002Fpricing",{"title":657,"url":658},"Milvus documentation: Overview","https:\u002F\u002Fmilvus.io\u002Fdocs\u002Foverview.md",{"title":660,"url":661},"Pinecone documentation: Database architecture","https:\u002F\u002Fdocs.pinecone.io\u002Fguides\u002Fget-started\u002Fdatabase-architecture",{"title":663,"url":664},"Pinecone documentation: Create an index (clouds, regions, sparse and hybrid)","https:\u002F\u002Fdocs.pinecone.io\u002Fguides\u002Findex-data\u002Fcreate-an-index",{"title":666,"url":667},"OpenSearch documentation: Methods and engines","https:\u002F\u002Fdocs.opensearch.org\u002Flatest\u002Fmappings\u002Fsupported-field-types\u002Fknn-methods-engines\u002F",{"title":669,"url":670},"OpenSearch documentation: Efficient k-NN filtering","https:\u002F\u002Fdocs.opensearch.org\u002Flatest\u002Fvector-search\u002Ffilter-search-knn\u002Fefficient-knn-filtering\u002F",{"title":672,"url":673},"Elasticsearch documentation: Dense vector search","https:\u002F\u002Fwww.elastic.co\u002Fdocs\u002Fsolutions\u002Fsearch\u002Fvector\u002Fdense-vector",{"title":675,"url":676},"Elasticsearch documentation: kNN query (filter as pre-filter)","https:\u002F\u002Fwww.elastic.co\u002Fdocs\u002Freference\u002Fquery-languages\u002Fquery-dsl\u002Fquery-dsl-knn-query",{"title":678,"url":679},"GitHub releases: Qdrant, Weaviate, Milvus, OpenSearch, pgvectorscale (versions as of 1 October 2026)","https:\u002F\u002Fgithub.com\u002Fqdrant\u002Fqdrant\u002Freleases","\u002Fimages\u002Fblog\u002Fpgvector-vs-vector-databases\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fpgvector-vs-vector-databases\u002Fog.jpg",[74,75,76],"pgvector oder Vektordatenbank? So wählst du 2026 den Vektorspeicher","pgvector, Qdrant, Weaviate, Milvus, Pinecone, OpenSearch oder Elasticsearch? Ein praktischer Leitfaden 2026 zu Filtern, Hybridsuche, Skalierung, Kosten und EU-Hosting.","Diagramm: ein Entscheidungspfad von deinen Daten zu pgvector in Postgres, einer Suchmaschine mit Vektorfeldern oder einer dedizierten Vektordatenbank.",{"slug":687,"published":5,"minutes":688,"category":7,"tags":689,"keywords":695,"about":705,"sources":713,"cover":747,"og":748,"expertise":72,"locales":749,"lang":75,"title":750,"description":751,"coverAlt":752},"rag-evaluation-metrics",12,[690,691,692,693,694],"RAG evaluation","Retrieval metrics","LLM-as-judge","Golden set","Ragas",[690,696,697,698,699,700,701,702,703,704],"how to evaluate RAG","RAG evaluation metrics","recall@k MRR nDCG","faithfulness vs answer relevance","golden dataset for RAG","LLM as a judge calibration","Ragas vs DeepEval vs TruLens","RAG evals in CI","retrieval vs generation failure",[706,707,710],{"name":28,"url":29},{"name":708,"url":709},"Discounted cumulative gain","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FDiscounted_cumulative_gain",{"name":711,"url":712},"Mean reciprocal rank","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FMean_reciprocal_rank",[714,717,720,723,725,728,731,734,737,740,742,744],{"title":715,"url":716},"Es et al.: RAGAS, Automated Evaluation of Retrieval Augmented Generation (arXiv 2309.15217)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2309.15217",{"title":718,"url":719},"Zheng et al.: Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena (arXiv 2306.05685)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2306.05685",{"title":721,"url":722},"Ragas documentation: available metrics","https:\u002F\u002Fdocs.ragas.io\u002Fen\u002Fstable\u002Fconcepts\u002Fmetrics\u002Favailable_metrics\u002F",{"title":724,"url":586},"Ragas documentation: faithfulness",{"title":726,"url":727},"Ragas documentation: context precision","https:\u002F\u002Fdocs.ragas.io\u002Fen\u002Fstable\u002Fconcepts\u002Fmetrics\u002Favailable_metrics\u002Fcontext_precision\u002F",{"title":729,"url":730},"Ragas documentation: context recall","https:\u002F\u002Fdocs.ragas.io\u002Fen\u002Fstable\u002Fconcepts\u002Fmetrics\u002Favailable_metrics\u002Fcontext_recall\u002F",{"title":732,"url":733},"DeepEval documentation: metrics introduction","https:\u002F\u002Fdeepeval.com\u002Fdocs\u002Fmetrics-introduction",{"title":735,"url":736},"TruLens","https:\u002F\u002Fwww.trulens.org\u002F",{"title":738,"url":739},"Arize Phoenix documentation","https:\u002F\u002Farize.com\u002Fdocs\u002Fphoenix",{"title":741,"url":709},"Wikipedia: Discounted cumulative gain",{"title":743,"url":712},"Wikipedia: Mean reciprocal rank",{"title":745,"url":746},"Wikipedia: Cohen's kappa","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FCohen%27s_kappa","\u002Fimages\u002Fblog\u002Frag-evaluation-metrics\u002Fcover.webp","\u002Fimages\u002Fblog\u002Frag-evaluation-metrics\u002Fog.jpg",[74,75,76],"RAG evaluieren: Retrieval-Metriken, Faithfulness und wie du erkennst, welche Hälfte versagt hat","So evaluierst du ein RAG-System: recall at k, MRR und nDCG vs. Faithfulness und Antwortrelevanz, Golden Set aus echten Anfragen, kalibrierter LLM-Judge, Evals in CI.","Diagramm: Eine RAG-Antwort wird auf zwei Seiten bewertet, mit Retrieval-Metriken wie recall at k, MRR und nDCG sowie Generierungs-Metriken wie Faithfulness und Antwortrelevanz, die in eine Diagnose münden.",{"slug":754,"published":5,"minutes":6,"category":7,"tags":755,"keywords":760,"about":771,"sources":779,"cover":818,"og":819,"expertise":820,"locales":821,"lang":75,"title":822,"description":823,"coverAlt":824},"semantic-product-search-b2b",[756,607,757,758,759],"B2B search","Semantic search","Spryker","OpenSearch",[761,762,763,764,765,766,767,768,769,770],"semantic product search B2B","B2B ecommerce search","hybrid search BM25 vector","part number search ecommerce","Spryker search Elasticsearch","OpenSearch hybrid search RRF","multilingual product search German English Hungarian","zero results rate site search","LLM query understanding ecommerce","AI product search for B2B shops",[772,774,777],{"name":757,"url":773},"https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FSemantic_search",{"name":775,"url":776},"Elasticsearch","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FElasticsearch",{"name":759,"url":778},"https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FOpenSearch",[780,783,786,788,791,794,797,800,803,806,809,812,815],{"title":781,"url":782},"Baymard Institute: E-commerce search query types","https:\u002F\u002Fbaymard.com\u002Fblog\u002Fecommerce-search-query-types",{"title":784,"url":785},"Elastic Search Labs: Hybrid search in Elasticsearch","https:\u002F\u002Fwww.elastic.co\u002Fsearch-labs\u002Fblog\u002Fhybrid-search-elasticsearch",{"title":787,"url":676},"Elasticsearch documentation: kNN query (pre-filters and post-filters)",{"title":789,"url":790},"Elasticsearch documentation: Semantic reranking","https:\u002F\u002Fwww.elastic.co\u002Fdocs\u002Fsolutions\u002Fsearch\u002Franking\u002Fsemantic-reranking",{"title":792,"url":793},"Elasticsearch documentation: Word delimiter graph token filter","https:\u002F\u002Fwww.elastic.co\u002Fdocs\u002Freference\u002Ftext-analysis\u002Fanalysis-word-delimiter-graph-tokenfilter",{"title":795,"url":796},"Elasticsearch documentation: Synonym graph token filter","https:\u002F\u002Fwww.elastic.co\u002Fdocs\u002Freference\u002Ftext-analysis\u002Fanalysis-synonym-graph-tokenfilter",{"title":798,"url":799},"OpenSearch documentation: Score ranker processor (RRF)","https:\u002F\u002Fdocs.opensearch.org\u002Flatest\u002Fsearch-plugins\u002Fsearch-pipelines\u002Fscore-ranker-processor\u002F",{"title":801,"url":802},"OpenSearch documentation: Normalization processor","https:\u002F\u002Fdocs.opensearch.org\u002Flatest\u002Fsearch-plugins\u002Fsearch-pipelines\u002Fnormalization-processor\u002F",{"title":804,"url":805},"Spryker documentation: Search feature overview","https:\u002F\u002Fdocs.spryker.com\u002Fdocs\u002Fpbc\u002Fall\u002Fsearch\u002Flatest\u002Fbase-shop\u002Fsearch-feature-overview\u002Fsearch-feature-overview",{"title":807,"url":808},"Spryker documentation: Migrate from OpenSearch 1.3 to 3.5","https:\u002F\u002Fdocs.spryker.com\u002Fdocs\u002Fpbc\u002Fall\u002Fsearch\u002Flatest\u002Fbase-shop\u002Finstall-and-upgrade\u002Fmigrate-from-opensearch-1.3-to-3.5.html",{"title":810,"url":811},"Instacart via ZenML: Rebuilding query understanding for e-commerce search with LLMs","https:\u002F\u002Fwww.zenml.io\u002Fllmops-database\u002Frebuilding-query-understanding-for-e-commerce-search-with-llms",{"title":813,"url":814},"arXiv: M3-Embedding, multilingual, multi-functionality, multi-granularity text embeddings","https:\u002F\u002Farxiv.org\u002Fabs\u002F2402.03216",{"title":816,"url":817},"Algolia documentation: Search analytics metrics","https:\u002F\u002Fwww.algolia.com\u002Fdoc\u002Fguides\u002Fsearch-analytics\u002Fconcepts\u002Fmetrics\u002F","\u002Fimages\u002Fblog\u002Fsemantic-product-search-b2b\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fsemantic-product-search-b2b\u002Fog.jpg","b2b-ecommerce-developer",[74,75,76],"Semantische Produktsuche für B2B-Shops: Artikelnummern, Hybrid-Retrieval und was du messen solltest","Semantische Suche im B2B-Shop, ohne die Artikelnummern-Suche zu zerstören: Hybrid aus BM25 und Vektoren, Filter, DE\u002FEN\u002FHU, LLM-Query-Parsing, Reranking, Metriken.","Diagramm: Eine Suchanfrage wird auf eine Kennungs-Spur, lexikalisches BM25 und Vektor-kNN verteilt, fusioniert, neu gerankt und als Ergebnis ausgegeben.",1791009037526]