[{"data":1,"prerenderedAt":660},["ShallowReactive",2],{"tool-graphrag-de":3},{"slug":4,"published":5,"minutes":6,"category":7,"tags":8,"keywords":14,"about":22,"sources":29,"cover":48,"og":49,"expertise":50,"locales":51,"lang":53,"title":55,"description":56,"coverAlt":57,"url":32,"pricing":58,"kind":59,"metaTitle":60,"takeaways":61,"faq":67,"toc":80,"blocks":105,"others":463},"graphrag","2026-09-08",10,"rag",[9,10,11,12,13],"Knowledge graph","RAG","Global search","Community summaries","Token cost",[4,15,16,17,18,19,20,21],"microsoft graphrag","graphrag vs vector rag","graphrag indexing cost","graphrag query modes","graphrag lightRAG comparison","knowledge graph rag","graphrag dynamic community selection",[23,26],{"name":24,"url":25},"GraphRAG","https:\u002F\u002Fgithub.com\u002Fmicrosoft\u002Fgraphrag\u002F",{"name":27,"url":28},"Retrieval-augmented generation","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FRetrieval-augmented_generation",[30,33,36,39,42,45],{"title":31,"url":32},"GraphRAG on GitHub","https:\u002F\u002Fgithub.com\u002Fmicrosoft\u002Fgraphrag",{"title":34,"url":35},"GraphRAG documentation","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002F",{"title":37,"url":38},"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","https:\u002F\u002Farxiv.org\u002Fabs\u002F2404.16130",{"title":40,"url":41},"GraphRAG: Improving global search via dynamic community selection","https:\u002F\u002Fwww.microsoft.com\u002Fen-us\u002Fresearch\u002Fblog\u002Fgraphrag-improving-global-search-via-dynamic-community-selection\u002F",{"title":43,"url":44},"LazyGraphRAG: Setting a new standard for quality and cost","https:\u002F\u002Fwww.microsoft.com\u002Fen-us\u002Fresearch\u002Fblog\u002Flazygraphrag-setting-a-new-standard-for-quality-and-cost\u002F",{"title":46,"url":47},"Graph RAG in 2026: What Actually Works in Production","https:\u002F\u002Fwww.paperclipped.de\u002Fen\u002Fblog\u002Fgraph-rag-production\u002F","\u002Fimages\u002Fblog\u002Fgraphrag\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fgraphrag\u002Fog.jpg","ai-engineer",[52,53,54],"en","de","hu","Microsoft GraphRAG: ein Wissensgraph-RAG mit Vorabrechnung","Ein Test von Microsoft GraphRAG 3.2.0: MIT, Wartungsmodus und eine Indexrechnung, die vor der ersten Abfrage fällig wird.","Coverbild für den GraphRAG-Test: ein Dokumentkorpus, der sich in einen Graphen aus Knoten und Community-Ringen faltet","MIT · API pay per token","RAG pipeline","GraphRAG im Test: die Indexrechnung · Balázs Csorba",[62,63,64,65,66],"GraphRAG 3.2.0 erschien am 23. September 2026 unter MIT, während das Repository angibt, weitgehend im Wartungsmodus zu sein und keine neuen Features zu bringen.","Die Rechnung entsteht beim Indexieren: ein Modellaufruf pro TextUnit und einer pro Community-Bericht, für einen 500-seitigen Korpus mit 50 bis 200 Dollar angegeben, gegen unter 5 Dollar für Vektoren.","Die globale Suche ist der Modus, den die Vektorsuche nicht nachbilden kann, und die dynamische Community-Auswahl senkt deren Token-Kosten um 77 %, ohne gemessenen Qualitätsverlust.","LazyGraphRAG erreicht Indexkosten auf Vektorniveau bei 0,1 % des vollen GraphRAG, liegt aber in Microsoft Discovery und Azure Local statt im MIT-Paket.","Der Graph zahlt sich nur aus, wenn Fragen korpusweit oder mehrsprünig sind; nachschlagelastige Arbeit bleibt an der Vektorsuche billiger.",[68,71,74,77],{"q":69,"a":70},"Was kostet der Betrieb von GraphRAG?","Das Paket ist MIT und nichts wird betrieben, die gesamte Rechnung sind also Modellaufrufe: ein Extraktionsaufruf pro TextUnit von 1.200 Token, ein Zusammenfassungsaufruf pro zusammengeführter Entität oder Beziehung und ein Berichtsaufruf pro Community auf jeder Ebene der Hierarchie. Ein unabhängiger Vergleich nennt für einen 500-seitigen Korpus 50 bis 200 Dollar und etwa 45 Minuten durch die volle Pipeline, gegen unter 5 Dollar für die Einbettung desselben Korpus in der Vektorsuche.",{"q":72,"a":73},"Wann schlägt GraphRAG die Vektorsuche?","Wenn die Antwort über den ganzen Korpus zusammengeführt werden muss oder zwischen Entitäten springt, die nie im selben Chunk stehen: Themen, Trends, Vergleiche über alles. Direkte Faktenfragen treffen einzelne Chunks, der Graph bringt dort nichts, und genau deshalb liefert GraphRAG einen eigenen Basic-Modus mit — Vektorabruf über dieselben Einbettungen —, um diesen Unterschied zu messen.",{"q":75,"a":76},"Wird GraphRAG noch gepflegt?","Das README sagt, das Projekt sei weitgehend im Wartungsmodus: keine neuen Pull Requests, keine neuen Features, Fehlerkorrekturen und Abhängigkeitsupdates nach Bedarf. Zugleich beschreibt es den Code als Demonstration und nicht als offiziell unterstütztes Microsoft-Angebot. Die aktuelle Version 3.2.0 erschien am 23. September 2026, über 495 Commits und 49 offene Issues und Pull Requests stehen 36.241 Stars gegenüber.",{"q":78,"a":79},"Was ändert LazyGraphRAG?","Es streicht das Sprachmodell aus dem Indexieren und nutzt stattdessen Nominalphrase-Extraktion; die Indexkosten werden mit denen der Vektorsuche und mit 0,1 % des vollen GraphRAG angegeben. Microsoft Research berichtet eine Qualität der globalen Suche auf mehr als 700-fach niedrigeren Abfragekosten und eine bessere Qualität bei 4 % dieser Kosten. Die Implementierung liegt in Microsoft Discovery und Azure Local, nicht im MIT-Repository, ein selbst betriebenes Team kann sie also nicht installieren.",[81,84,87,90,93,96,99,102],{"id":82,"title":83},"what-it-is","Was es ist",{"id":85,"title":86},"how-it-works","So funktioniert es",{"id":88,"title":89},"getting-started","Erste Schritte",{"id":91,"title":92},"indexing-cost","Was das Indexieren kostet",{"id":94,"title":95},"query-cost","Was Abfragen kosten",{"id":97,"title":98},"where-it-shingles","Wo es schwächelt",{"id":100,"title":101},"verdict","Fazit",{"id":103,"title":104},"sources","Quellen",[106,115,123,126,133,155,161,162,169,178,186,187,193,195,201,212,213,220,268,277,278,284,331,340,341,350,392,402,403,410,425,437,441,442],{"type":107,"content":108},"paragraph",[109,110,111,112,113,114],"GraphRAG ist die unter MIT lizenzierte Pipeline von Microsoft Research, die ein Korpus in einen ","Wissensgraphen verwandelt, ihn mit dem Leiden-Algorithmus clustert und für jede Community eine ","Zusammenfassung durch ein Sprachmodell schreiben lässt, bevor die erste Frage gestellt wird. Die ","Position hier ist, dass es nach wie vor der am besten dokumentierte Graph-RAG-Ansatz ist, und dass der ","interessante Teil nicht mehr die Konstruktion ist: Das Repository steht im Wartungsmodus, und was ein ","Team tatsächlich beantworten muss, ist, ob sich die Indexrechnung gegenüber der Vektorsuche rechnet.",{"type":107,"content":116},[117,118,119,120,121,122],"Es konkurriert mit der schlichten Vektorsuche, mit leichteren Graph-Pipelines wie LightRAG und mit der ","Graph-Abfrage in LlamaIndex- und Neo4j-Werkzeugen. Der Unterschied ist wichtig, denn GraphRAG ist kein ","Dienst: Es ist ein Python-Paket, das die Token des Lesers für den Aufbau eines Index ausgibt und danach ","vier Abfragemoden als Bibliotheksfunktionen bereitstellt. Bei Microsoft wird nichts abgerechnet und ","nichts betrieben, und das README sagt, dass der Code eine Demonstration ist und kein offiziell ","unterstütztes Microsoft-Angebot.",{"type":124,"level":125,"id":82,"text":83},"heading",2,{"type":107,"content":127},[128,129,130,131,132],"Das Design ist bewusst nach vorn geladen. Dokumente werden in TextUnits zerlegt, ein Sprachmodell ","extrahiert aus jeder Einheit Entitäten und Beziehungen, doppelte Beschreibungen werden zusammengeführt ","und zusammengefasst, das Leiden-Clustering verteilt den Graphen auf eine Hierarchie von Communities, und ","ein weiterer Modell-Durchlauf schreibt für jede Community auf jeder Ebene einen Bericht. Erst dann läuft ","eine Frage, und bis dahin ist die teure Arbeit bereits bezahlt.",{"type":134,"ordered":135,"items":136},"list",false,[137,143,145,147,149,151,153],[138,139,142],"Lizenz MIT, veröffentlicht als ",{"tag":140,"children":141},"code",[4]," auf PyPI, aktuelle Version 3.2.0 vom 23. September 2026, Python 3.11 bis 3.13.",[144],"Etwa 36.200 Stars, 3.800 Forks und 495 Commits auf GitHub, dazu 49 offene Issues und Pull Requests.",[146],"TextUnits sind standardmäßig 1.200 Token groß: größere Chunks indexieren schneller und extrahieren weniger präzise.",[148],"Die Community-Erkennung nutzt das hierarchische Leiden-Verfahren und kostet keine Modellaufrufe; das Zusammenfassen jeder Community kostet welche.",[150],"Vier Abfragemoden liegen im Paket — global, local, DRIFT und basic — dazu die dynamische Community-Auswahl für die globale Suche.",[152],"Die CLI nennt vier Indexierungsmethoden: standard, fast, standard-update und fast-update, dazu ein eigener update-Befehl für geänderte Dokumente.",[154],"Jeder Aufruf geht an den eigenen Endpunkt des Lesers — Azure OpenAI, OpenAI oder einen kompatiblen Dienst —, die Kosten hängen also vom Modellpreis und der Korpusgröße ab.",{"type":107,"content":156},[157,158,159,160],"Daraus folgen zwei Dinge. Der Index wird zum Asset und nicht zum Nebenprodukt: Entitätsbeschreibungen ","und Community-Berichte sind lesbare Artefakte, die sich wie jedes andere Ergebnis prüfen, teilen und ","versionieren lassen. Und der Graph ist nur so gut wie der Extraktionsdurchlauf, also muss ein Korpus, ","dessen Entitätstypen zählen, vor dem ersten vollständigen Lauf abgestimmt werden und nicht danach.",{"type":124,"level":125,"id":85,"text":86},{"type":107,"content":163},[164,165,166,167,168],"Die Indexierung ist eine feste Folge: zerlegen, extrahieren, zusammenführen, clustern, zusammenfassen, ","einbetten. Jede Stufe kostet entweder einen Modellaufruf pro Texteinheit oder nichts, und genau diese ","Grenze erzeugt die Rechnung — ein Extraktionsaufruf pro TextUnit, ein Zusammenfassungsaufruf pro ","zusammengeführter Entität oder Beziehung und ein Berichtsaufruf pro Community auf jeder Ebene der ","Hierarchie.",{"type":170,"attrs":171,"inner":175,"caption":176},"diagram",{"viewBox":172,"role":173,"aria-labelledby":174},"0 0 720 310","img","gr-d1-t gr-d1-d","\u003Ctitle id=\"gr-d1-t\">Ein GraphRAG-Index, dann vier Abfragemoden\u003C\u002Ftitle>\u003Cdesc id=\"gr-d1-d\">Die Indexierung zerlegt den Korpus in TextUnits, gibt pro Einheit einen Modellaufruf für die Extraktion aus, clustert den Graphen mit Leiden und gibt pro Community einen Modellaufruf für Berichte aus. Eine Frage läuft danach in einen von vier Modi: globales Map-Reduce über die Berichte, lokale Suche um Entitäten, DRIFT mit Folgefragen oder Basicsuche über dieselben Einbettungen.\u003C\u002Fdesc>\u003Ctext x=\"20\" y=\"28\" class=\"d-title\">Where the tokens go\u003C\u002Ftext>\u003Ctext x=\"700\" y=\"28\" text-anchor=\"end\" class=\"d-label\">the index is the asset\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"52\" class=\"d-label\">INDEXING — PAID ONCE\u003C\u002Ftext>\u003Crect x=\"20\" y=\"62\" width=\"140\" height=\"64\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"90\" y=\"90\" text-anchor=\"middle\" class=\"d-text\">Corpus\u003C\u002Ftext>\u003Ctext x=\"90\" y=\"111\" text-anchor=\"middle\" class=\"d-small\">your documents\u003C\u002Ftext>\u003Cpath d=\"M160 94 H192\" class=\"d-line\" \u002F>\u003Cpath d=\"M200 94 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"200\" y=\"62\" width=\"140\" height=\"64\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"270\" y=\"90\" text-anchor=\"middle\" class=\"d-text\">TextUnits\u003C\u002Ftext>\u003Ctext x=\"270\" y=\"111\" text-anchor=\"middle\" class=\"d-small\">1,200 tokens\u003C\u002Ftext>\u003Cpath d=\"M340 94 H372\" class=\"d-line\" \u002F>\u003Cpath d=\"M380 94 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"380\" y=\"62\" width=\"150\" height=\"64\" rx=\"10\" class=\"d-accent\" \u002F>\u003Ctext x=\"455\" y=\"90\" text-anchor=\"middle\" class=\"d-text\">Extract\u003C\u002Ftext>\u003Ctext x=\"455\" y=\"111\" text-anchor=\"middle\" class=\"d-small\">one call each\u003C\u002Ftext>\u003Cpath d=\"M530 94 H562\" class=\"d-line\" \u002F>\u003Cpath d=\"M570 94 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"570\" y=\"62\" width=\"130\" height=\"64\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"635\" y=\"90\" text-anchor=\"middle\" class=\"d-text\">Reports\u003C\u002Ftext>\u003Ctext x=\"635\" y=\"111\" text-anchor=\"middle\" class=\"d-small\">Leiden, then LLM\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"170\" class=\"d-label\">QUERY — PAID PER QUESTION\u003C\u002Ftext>\u003Crect x=\"20\" y=\"176\" width=\"130\" height=\"60\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"85\" y=\"204\" text-anchor=\"middle\" class=\"d-text\">Question\u003C\u002Ftext>\u003Ctext x=\"85\" y=\"225\" text-anchor=\"middle\" class=\"d-small\">plain words\u003C\u002Ftext>\u003Cpath d=\"M150 206 H645\" class=\"d-line\" \u002F>\u003Cpath d=\"M257 206 V228\" class=\"d-line\" \u002F>\u003Cpath d=\"M257 236 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Cpath d=\"M387 206 V228\" class=\"d-line\" \u002F>\u003Cpath d=\"M387 236 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Cpath d=\"M517 206 V228\" class=\"d-line\" \u002F>\u003Cpath d=\"M517 236 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Cpath d=\"M645 206 V228\" class=\"d-line\" \u002F>\u003Cpath d=\"M645 236 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Crect x=\"200\" y=\"236\" width=\"115\" height=\"60\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"257\" y=\"264\" text-anchor=\"middle\" class=\"d-text\">Global\u003C\u002Ftext>\u003Ctext x=\"257\" y=\"285\" text-anchor=\"middle\" class=\"d-small\">map-reduce\u003C\u002Ftext>\u003Crect x=\"330\" y=\"236\" width=\"115\" height=\"60\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"387\" y=\"264\" text-anchor=\"middle\" class=\"d-text\">Local\u003C\u002Ftext>\u003Ctext x=\"387\" y=\"285\" text-anchor=\"middle\" class=\"d-small\">entity walk\u003C\u002Ftext>\u003Crect x=\"460\" y=\"236\" width=\"115\" height=\"60\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"517\" y=\"264\" text-anchor=\"middle\" class=\"d-text\">DRIFT\u003C\u002Ftext>\u003Ctext x=\"517\" y=\"285\" text-anchor=\"middle\" class=\"d-small\">follow-ups\u003C\u002Ftext>\u003Crect x=\"590\" y=\"236\" width=\"110\" height=\"60\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"645\" y=\"264\" text-anchor=\"middle\" class=\"d-text\">Basic\u003C\u002Ftext>\u003Ctext x=\"645\" y=\"285\" text-anchor=\"middle\" class=\"d-small\">vector search\u003C\u002Ftext>",[177],"Die teure Zeile ist die erste: Jede Abfrage nutzt einen Index, der bereits bezahlt ist.",{"type":107,"content":179},[180,181,182,183,184,185],"Die vier Modi sind die Produktfläche. Die globale Suche führt Map-Reduce über die Community-Berichte aus ","und ist der Modus, den die Vektorsuche nicht nachbilden kann, weil kein Chunk eine Antwort über den ganzen ","Korpus enthält. Die lokale Suche läuft um benannte Entitäten im Graphen und kostet in etwa so viel wie ","Vektorabrufe plus Traversierung. DRIFT beginnt bei den relevantesten Berichten, stellt Folgefragen und ","beantwortet jede davon lokal. Die Basicsuche ist die eigene Vektorsuche des Pakets, damit ein Team messen ","kann, was der Graph auf seinen eigenen Daten bringt.",{"type":124,"level":125,"id":88,"text":89},{"type":107,"content":188},[189,190,191,192],"Der Einstiegspunkt ist ein Verzeichnis, ein init-Befehl und zwei Dateien. Die Folge unten legt einen ","Arbeitsbereich an, richtet ihn auf ein brauchbares Modell, indexiert einen kleinen input-Ordner und stellt ","eine globale Frage; in settings.yaml wird die Rechnung festgelegt, ein erster Lauf sollte also bei einem ","kleinen Korpus und einem günstigen Modell bleiben, bis die Prompts abgestimmt sind.",{"type":140,"code":194},"python -m venv .venv && source .venv\u002Fbin\u002Factivate\npython -m pip install graphrag\n\nmkdir ragtest && cd ragtest\ngraphrag init -r . -m gpt-4.1 -e text-embedding-3-large\n# write GRAPHRAG_API_KEY into the .env that init created\n# drop a few .txt or .md files into .\u002Finput, then index:\ngraphrag index -r . -m standard\n\n# global is the default; this prunes reports before the map-reduce step\ngraphrag query \"What are the top themes across these documents?\" -r . \\\n  --dynamic-community-selection\n\ngraphrag query \"Who is the main character?\" -r . -m local\ngraphrag update -r . -m standard-update\n",{"type":107,"content":196},[197,198,199,200],"Zwei Gewohnheiten halten die erste Rechnung klein. Ein Sample statt des gesamten Korpus indexieren, denn ","die Pipeline ruft das Modell einmal pro TextUnit und einmal pro Community-Ebene auf, unabhängig vom ","Modellpreis; und vor dem Hochfahren prompt-tune ausführen, denn die Dokumentation sagt, dass fertige ","Prompts selten die besten Ergebnisse liefern.",{"type":202,"variant":203,"title":204,"body":205},"callout","warn","Wartungsmodus ist Teil des Risikos",[206],[207,208,209,210,211],"Das README sagt, dass das Projekt weitgehend im Wartungsmodus ist, keine neuen Pull Requests annimmt und ","keine neuen Features implementiert, und dass Fehlerkorrekturen und Abhängigkeitsupdates nach Bedarf ","erfolgen. Es sagt außerdem, dass der bereitgestellte Code eine Demonstration ist und kein offiziell ","unterstütztes Microsoft-Angebot. Für ein Team, das diese Pipeline Jahre lang betreiben muss, gehören ","beide Sätze ins Risikoregister, neben die Indexrechnung.",{"type":124,"level":125,"id":91,"text":92},{"type":107,"content":214},[215,216,217,218,219],"Es gibt keine Lizenzgebühr und keinen betriebenen Dienst, die gesamten Kosten sind also Modellaufrufe. ","Die Extraktion läuft einmal pro TextUnit, die Berichterstattung einmal pro Community auf jeder Ebene; die ","Rechnung wächst also mit der Korpusgröße und mit der Zahl der Communities, die die Leiden-Hierarchie ","erzeugt. Die Zahlen unten stammen aus einem unabhängigen Vergleich vom März 2026 bei GPT-4-Preisen, nicht ","aus einer Microsoft-Preisliste:",{"type":221,"head":222,"rows":231},"table",[223,225,227,229],[224],"Ansatz",[226],"Index für 500 Seiten",[228],"Zeit",[230],"Was man bekommt",[232,241,250,259],[233,235,237,239],[234],"GraphRAG, volle Pipeline",[236],"50–200 $",[238],"etwa 45 Min.",[240],"Entitätsgraph, Community-Berichte, globale Suche",[242,244,246,248],[243],"Vektorsuche",[245],"unter 5 $",[247],"Minuten",[249],"Chunks nach Ähnlichkeit, keine globalen Fragen",[251,253,255,257],[252],"LightRAG",[254],"etwa 0,50 $",[256],"etwa 3 Min.",[258],"flacher Graph, schwächere globale Fragen",[260,262,264,266],[261],"LazyGraphRAG",[263],"mit 0,1 % des vollen GraphRAG angegeben",[265],"nicht angegeben",[267],"nicht im MIT-Paket enthalten",{"type":107,"content":269},[270,271,272,273,274,275,276],"Die Gegenzahl, die Microsoft Research veröffentlicht hat, ist LazyGraphRAG: Es ersetzt die Modell-","Extraktion durch Nominalphrase-Extraktion und verschiebt jeden Modellaufruf auf die Abfragezeit. Die ","Indexkosten werden mit denen der Vektorsuche und mit 0,1 % des vollen GraphRAG angegeben, und dieselbe ","Auswertung nennt eine Qualität der globalen Suche auf mehr als 700-fach niedrigeren Abfragekosten ","beziehungsweise eine bessere Qualität bei 4 % dieser Kosten. Die Implementierung liegt in Microsoft ","Discovery und Azure Local und nicht im MIT-Paket, ein Team mit der Open-Source-Pipeline kann sie also ","nicht installieren: Die Zahl beschreibt eine Richtung, keine Option im Regal.",{"type":124,"level":125,"id":94,"text":95},{"type":107,"content":279},[280,281,282,283],"Die Abfragekosten sind der Ort, an dem sich die Modi unterscheiden und an dem der Index das bereits ","investierte Geld entweder zurückverdient oder nicht. Die globale Suche ist der teure Modus, weil sie ","Community-Berichte in Batches liest und dann zusammenführt; die anderen drei lesen einen Bruchteil des ","Graphen:",{"type":221,"head":285,"rows":294},[286,288,290,292],[287],"Modus",[289],"Was er liest",[291],"Kostenverlauf",[293],"Wann",[295,304,313,322],[296,298,300,302],[297],"Global",[299],"Community-Berichte auf einer Ebene oder eine gefilterte Auswahl",[301],"wächst mit der Zahl der Berichte",[303],"Synthese über den ganzen Korpus",[305,307,309,311],[306],"Local",[308],"Entitäts-Nachbarschaft und ihre TextUnits",[310],"Vektorabruf plus Traversierung",[312],"Fragen zu Entitäten und Beziehungen",[314,316,318,320],[315],"DRIFT",[317],"top Berichte, dann lokal beantwortete Folgefragen",[319],"zwischen local und global",[321],"begrenzte Fragen mit gleichem Deckungsbedarf",[323,325,327,329],[324],"Basic",[326],"eingebettete TextUnits",[328],"die eigene Vektorbasis des Pakets",[330],"Faktenfragen mit einem Sprung",{"type":107,"content":332},[333,334,335,336,337,338,339],"Die dynamische Community-Auswahl ist die veröffentlichte Antwort auf die erste Zeile: Ein günstigeres ","Modell bewertet jeden Bericht an der Wurzel und schneidet irrelevante Zweige ab, bevor Map-Reduce läuft. ","Microsoft Research maß im Mittel 77 % weniger Token-Kosten gegenüber der statischen Suche auf Ebene 1 ","über 50 globale Fragen, wobei etwa 1.500 Berichte auf 470 sanken, ohne statistisch signifikanten ","Qualitätsunterschied; läuft die Bewertung bis Ebene 3, kostete das im Mittel 34 % mehr und gewann 58,8 % ","bei Comprehensiveness und 60,0 % bei Empowerment. Das sind Herstellerzahlen aus einem Datensatz, aber die ","Richtung ist nicht umstritten — aufhören, Berichte zu bezahlen, die die Frage nicht beantworten können.",{"type":124,"level":125,"id":97,"text":98},{"type":107,"content":342},[343,344,345,346,347,348,349],"Die Schwächen sind betrieblich, nicht algorithmisch. Das Repository steht im Wartungsmodus, Promptformate, ","Modellverhalten und Abhängigkeitsdrift sind also Sache des Lesers, und das README nennt den Code eine ","Demonstration. Das Aktualisieren ist ein eigener Befehl und kein Hintergrundjob: Dokumente ändern sich, ","Entitäten verschmelzen, Communities verschieben sich, und die Update-Methoden extrahieren geänderten Text ","weiter zu Modellpreisen. Der Graph trägt außerdem die Ontologie, denn Entitäts- und Beziehungstypen ","stammen aus offener Extraktion, ein lauter Korpus erzeugt also einen lauten Graphen. Vor allem wird der ","Index bezahlt, ob Fragen kommen oder nicht — das Gegenteil des Bezahlprofils der Vektorsuche.",{"type":221,"head":351,"rows":359},[352,354,355,357],[353],"Werkzeug",[83],[356],"Wo es läuft",[358],"Was es kostet",[360,368,376,383],[361,362,364,366],[24],[363],"volle Pipeline mit Community-Zusammenfassungen",[365],"Python-Paket auf eigenen Schlüsseln",[367],"Modellaufrufe beim Indexieren und Abfragen",[369,370,372,374],[243],[371],"Chunk-Embeddings und Ähnlichkeitssuche",[373],"jeder Vektorstore",[375],"Einbettungsaufrufe, billige Abfragen",[377,378,380,381],[252],[379],"flacher Graph mit leichterer Extraktion",[365],[382],"laut Vergleich etwa 1\u002F100 der Indexkosten",[384,386,388,390],[385],"Graphiti",[387],"temporaler Graph für Agenten-Gedächtnis",[389],"eigener Stack mit Neo4j-Instanz",[391],"Extraktion pro Interaktion",{"type":107,"content":393},[394,395,396,397,398,399,400,401],"Man liest diese Tabelle als Aussage über die Frage, für die jedes System gebaut ist. GraphRAG beantwortet ","korpusweite und mehrsprünige Fragen, die kein einzelner Chunk enthält; die Vektorsuche beantwortet ","Nachschlagefragen schneller und billiger, und deshalb liefert GraphRAG einen eigenen Basic-Modus mit, statt ","so zu tun, als gewinne der Graph überall. LightRAG ist der vernünftige Standard, wenn ein flacher Graph den ","größten Teil des Werts zu einem Bruchteil der Kosten bringt, und Graphiti löst Agenten-Gedächtnis statt ","Dokumentabfrage. Die Position hier ist, dass die meisten Teams zur vollen Pipeline greifen, weil deren ","Benchmark beeindruckend ist, obwohl ihre Anfragemischung von Nachschlagfragen bestimmt wird — und der ","billigste erste Schritt ist, diese Mischung zu messen, bevor irgendetwas indexiert wird.",{"type":124,"level":125,"id":100,"text":101},{"type":107,"content":404},[405,406,407,408,409],"GraphRAG ist das richtige Werkzeug für einen Korpus, dessen Fragen wirklich global sind, und der falsche ","Standard für eine Suchmaske. Es ist der am besten dokumentierte Graph-RAG, es ist MIT, und sein Index ist ","ein wiederverwendbares Artefakt mit Berichten, die Menschen lesen können; gleichzeitig steht es im ","Wartungsmodus, wird im Voraus bezahlt und langsamer aktualisiert als der Korpus, den es indexiert. ","Übernehme es mit gemessener Anfragemischung und einem kleinen ersten Korpus, oder übernehme es nicht.",{"type":134,"ordered":411,"items":412},true,[413,415,417,419,421,423],[414],"Wähle es, wenn ein erheblicher Teil der Fragen Synthese über den ganzen Korpus verlangt: Themen, Trends, Vergleiche über alles.",[416],"Wähle es, wenn Antworten von Sprüngen zwischen Entitäten abhängen, die nie im selben Chunk stehen.",[418],"Wähle es, wenn der Index selbst einen Wert hat — Berichte, die Menschen lesen, teilen und prüfen —, denn das kauft man für die Vorabkosten.",[420],"Wähle es nicht für eine Suchmaske voller Nachschlagfragen: Die Vektorsuche ist pro Abfrage billiger, und der eigene Basic-Modus von GraphRAG ist genau diese Suche.",[422],"Behandle es nicht als gepflegte Abhängigkeit; das Repository nennt Wartungsmodus und keine neuen Features.",[424],"Vor dem vollständigen Lauf die Anfragemischung messen und ein Sample mit dynamischer Community-Auswahl indexieren.",{"type":107,"content":426},[427,428,429,430,431,436],"Ein weiterer Punkt ist, wo der Index lebt. Er ist ein Batch-Artefakt und gehört dorthin, wo Batch-Artefakte ","hingehören: von einer Pipeline gebaut, versioniert, geprüft und ersetzt, statt aus einem Request-Handler ","heraus neu gebaut zu werden. Die Mechanik dessen, was der Graph enthält — Entitäten, TextUnits, Communities ","— steht in einem früheren Beitrag über ",{"tag":432,"to":433,"children":434},"link","\u002Fblog\u002Fgraphrag-knowledge-graph-rag",[435],"Wissensgraph-RAG","; dieser Test gilt der Implementierung, ihren Modi und ihrer Rechnung.",{"type":438,"content":439},"quote",[440],"GraphRAG indexing can be an expensive operation, please read all of the documentation to understand the process and costs involved, and start small.",{"type":124,"level":125,"id":103,"text":104},{"type":134,"ordered":411,"items":443},[444,448,451,454,457,460],[445],{"tag":446,"href":32,"children":447},"a",[31],[449],{"tag":446,"href":35,"children":450},[34],[452],{"tag":446,"href":38,"children":453},[37],[455],{"tag":446,"href":41,"children":456},[40],[458],{"tag":446,"href":44,"children":459},[43],[461],{"tag":446,"href":47,"children":462},[46],[464,512,568,610],{"slug":465,"published":466,"minutes":467,"category":7,"tags":468,"keywords":472,"about":481,"sources":485,"cover":504,"og":505,"expertise":50,"locales":506,"lang":53,"title":507,"description":508,"coverAlt":509,"url":510,"pricing":511,"kind":469},"zep","2026-10-06",11,[469,9,470,471,10],"Agent memory","Temporal graph","Context engineering",[473,474,475,476,477,478,479,480],"zep ai","zep agent memory","graphiti knowledge graph","zep pricing","zep vs mem0","long-term memory for agents","temporal knowledge graph","zep cloud",[482],{"name":483,"url":484},"Zep","https:\u002F\u002Fwww.getzep.com\u002F",[486,489,492,495,498,501],{"title":487,"url":488},"Zep pricing: plans, credits and limits","https:\u002F\u002Fwww.getzep.com\u002Fpricing",{"title":490,"url":491},"Zep documentation","https:\u002F\u002Fhelp.getzep.com\u002F",{"title":493,"url":494},"Graphiti on GitHub","https:\u002F\u002Fgithub.com\u002Fgetzep\u002Fgraphiti",{"title":496,"url":497},"Graphiti product page","https:\u002F\u002Fwww.getzep.com\u002Fplatform\u002Fgraphiti\u002F",{"title":499,"url":500},"Announcing a new direction for Zep's open-source strategy","https:\u002F\u002Fwww.getzep.com\u002Fblog\u002Fannouncing-a-new-direction-for-zeps-open-source-strategy\u002F",{"title":502,"url":503},"Graphiti: temporal knowledge graphs for AI agents (arXiv)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2501.13956","\u002Fimages\u002Fblog\u002Fzep\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fzep\u002Fog.jpg",[52,53,54],"Zep-Review: Agenten-Memory auf einem temporalen Graphen","Zep ist eine gehostete Agenten-Memory-API auf einem temporalen Knowledge Graph: Credits beim Schreiben, Retrieval gratis, Flex ab 125 Dollar im Monat, Graphiti als selbst hostbarer Teil.","Diagramm, wie eine Aussage in Zep den Prompt erreicht: Nachrichten und Aussagen werden in einen benutzerspezifischen Context Graph aus Entitäten und Beziehungen extrahiert, und der Retrieval durchläuft den Graphen und liefert einen Kontextblock mit den tragenden Fakten.","https:\u002F\u002Fwww.getzep.com","Apache-2.0 core · Cloud from $50 per month",{"slug":513,"published":514,"minutes":515,"category":7,"tags":516,"keywords":520,"about":528,"sources":535,"cover":560,"og":561,"expertise":50,"locales":562,"lang":53,"title":563,"description":564,"coverAlt":565,"url":566,"pricing":567,"kind":530},"lancedb","2026-09-21",9,[517,518,519,10],"Vector search","Hybrid search","Embedded database",[513,521,522,523,524,525,526,527],"lancedb review","lance vector database","embedded vector database","lancedb vs qdrant","hybrid search rrf","lancedb indexing","lance data format",[529,532],{"name":530,"url":531},"Vector database","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FVector_database",{"name":533,"url":534},"Apache Arrow","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FApache_Arrow",[536,539,542,545,548,551,554,557],{"title":537,"url":538},"LanceDB quickstart","https:\u002F\u002Fdocs.lancedb.com\u002Fquickstart",{"title":540,"url":541},"LanceDB vector indexes","https:\u002F\u002Fdocs.lancedb.com\u002Findexing\u002Fvector-index",{"title":543,"url":544},"LanceDB indexing guide","https:\u002F\u002Fdocs.lancedb.com\u002Findexing\u002Findex",{"title":546,"url":547},"LanceDB hybrid search","https:\u002F\u002Fdocs.lancedb.com\u002Fsearch\u002Fhybrid-search",{"title":549,"url":550},"LanceDB Enterprise","https:\u002F\u002Fdocs.lancedb.com\u002Fenterprise",{"title":552,"url":553},"LanceDB frequently asked questions","https:\u002F\u002Fdocs.lancedb.com\u002Ffaq\u002Ffaq-oss",{"title":555,"url":556},"LanceDB pricing","https:\u002F\u002Flancedb.com\u002Fpricing",{"title":558,"url":559},"LanceDB on PyPI","https:\u002F\u002Fpypi.org\u002Fproject\u002Flancedb\u002F","\u002Fimages\u002Fblog\u002Flancedb\u002Fcover.webp","\u002Fimages\u002Fblog\u002Flancedb\u002Fog.jpg",[52,53,54],"LanceDB: Vektorsuche, die als Bibliothek beginnt","Ein Test von LanceDB: eine Apache-2.0-Bibliothek statt Server, die IVF- und HNSW-Indexwahl, Hybridsuche mit Rangfusion und was Enterprise zusätzlich bringt.","Coverbild zum LanceDB-Test: eine Lance-Tabelle speist einen Vektorindex und einen Volltextindex in eine verschmolzene Rangliste","https:\u002F\u002Flancedb.com","Apache-2.0 · Cloud paid",{"slug":569,"published":514,"minutes":6,"category":7,"tags":570,"keywords":574,"about":581,"sources":587,"cover":602,"og":603,"expertise":50,"locales":604,"lang":53,"title":605,"description":606,"coverAlt":607,"url":583,"pricing":608,"kind":609},"pgvector",[517,571,572,10,573],"Postgres","HNSW","Quantisation",[569,575,576,577,578,579,580],"pgvector vs qdrant","postgres vector search","hnsw index postgres","iterative index scans","binary quantization postgres","vector database postgres",[582,584],{"name":569,"url":583},"https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector",{"name":585,"url":586},"PostgreSQL","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FPostgreSQL",[588,590,593,596,599],{"title":589,"url":583},"pgvector README",{"title":591,"url":592},"pgvector changelog","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FCHANGELOG.md",{"title":594,"url":595},"PostgreSQL news: pgvector 0.8.2 released","https:\u002F\u002Fwww.postgresql.org\u002Fabout\u002Fnews\u002Fpgvector-082-released-3245\u002F",{"title":597,"url":598},"AWS: Scale pgvector with binary quantization","https:\u002F\u002Faws.amazon.com\u002Fblogs\u002Fdatabase\u002Fscale-pgvector-with-binary-quantization-on-amazon-aurora-postgresql\u002F",{"title":600,"url":601},"pgvector licence","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FLICENSE","\u002Fimages\u002Fblog\u002Fpgvector\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fpgvector\u002Fog.jpg",[52,53,54],"pgvector im Review: die Vektordatenbank, die du nicht betreiben musst","Ein Review von pgvector 0.8.7: iterative Index-Scans für gefilterte Suche, HNSW und IVFFlat, Binärquantisierung bei 100 Millionen Vektoren und das CVE im Indexaufbau.","Eine Anfrage teilt sich oben in einen exakten Sequenzscan, einen HNSW-Graphlauf und eine IVFFlat-Sonde; ein Band unten zeigt einen iterativen Scan, der weiterläuft, bis die LIMIT-Zahl erreicht ist.","PostgreSQL licence","Vector database extension",{"slug":611,"published":612,"minutes":6,"category":7,"tags":613,"keywords":615,"about":621,"sources":625,"cover":653,"og":654,"expertise":50,"locales":655,"lang":53,"title":656,"description":657,"coverAlt":658,"url":624,"pricing":659,"kind":469},"mem0","2026-09-17",[469,614,10,517],"Long-term memory",[611,616,617,618,619,478,620],"mem0 review","agent memory layer","mem0 self-hosted","mem0 pricing","mem0 alternatives",[622],{"name":623,"url":624},"Mem0","https:\u002F\u002Fmem0.ai",[626,629,632,635,638,641,644,647,650],{"title":627,"url":628},"Mem0 documentation","https:\u002F\u002Fdocs.mem0.ai\u002Fintroduction",{"title":630,"url":631},"Mem0 quickstart","https:\u002F\u002Fdocs.mem0.ai\u002Fquickstart",{"title":633,"url":634},"How Mem0 works","https:\u002F\u002Fdocs.mem0.ai\u002Fcore-concepts\u002Fhow-it-works",{"title":636,"url":637},"Mem0 pricing","https:\u002F\u002Fmem0.ai\u002Fpricing",{"title":639,"url":640},"Mem0 on GitHub","https:\u002F\u002Fgithub.com\u002Fmem0ai\u002Fmem0",{"title":642,"url":643},"mem0ai on PyPI","https:\u002F\u002Fpypi.org\u002Fproject\u002Fmem0ai\u002F",{"title":645,"url":646},"Mem0 research and benchmarks","https:\u002F\u002Fmem0.ai\u002Fresearch",{"title":648,"url":649},"Mem0 MCP server","https:\u002F\u002Fdocs.mem0.ai\u002Fplatform\u002Fmem0-mcp",{"title":651,"url":652},"Mem0 paper on arXiv","https:\u002F\u002Farxiv.org\u002Fabs\u002F2504.19413","\u002Fimages\u002Fblog\u002Fmem0\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fmem0\u002Fog.jpg",[52,53,54],"Mem0: was eine Agent-Speicherschicht pro Runde kostet","Ein Review von Mem0: extrahierte Fakten pro Runde, die Benchmark-Tabelle vom April 2026 mit Plattform-Vorbehalt, vier Cloud-Stufen und die Lücken beim Self-Hosting.","Eine Schleife, die aus Gespräch gespeicherte Fakten macht und sie zurück in den Prompt liest","Free tier · from $19 per month",1791383550585]