[{"data":1,"prerenderedAt":825},["ShallowReactive",2],{"blog-graphrag-knowledge-graph-rag-hu":3},{"slug":4,"published":5,"minutes":6,"category":7,"tags":8,"keywords":13,"about":23,"sources":33,"cover":70,"og":71,"expertise":72,"locales":73,"lang":76,"title":77,"description":78,"coverAlt":79,"metaTitle":80,"takeaways":81,"faq":87,"toc":106,"blocks":134,"others":529},"graphrag-knowledge-graph-rag","2026-10-02",13,"rag",[9,10,11,12],"GraphRAG","Knowledge graphs","LightRAG","RAG",[9,14,15,16,17,18,19,20,21,22],"knowledge graph RAG","GraphRAG vs vector RAG","Microsoft GraphRAG explained","LightRAG vs GraphRAG","GraphRAG global vs local search","GraphRAG indexing cost","when to use GraphRAG","multi-hop RAG","LazyGraphRAG",[24,27,30],{"name":25,"url":26},"Knowledge graph","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FKnowledge_graph",{"name":28,"url":29},"Retrieval-augmented generation","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FRetrieval-augmented_generation",{"name":31,"url":32},"Leiden algorithm","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FLeiden_algorithm",[34,37,40,43,46,49,52,55,58,61,64,67],{"title":35,"url":36},"Edge et al.: From Local to Global: A Graph RAG Approach to Query-Focused Summarization (arXiv:2404.16130)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2404.16130",{"title":38,"url":39},"Microsoft GraphRAG documentation: overview","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002F",{"title":41,"url":42},"Microsoft GraphRAG documentation: default dataflow","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002Findex\u002Fdefault_dataflow\u002F",{"title":44,"url":45},"Microsoft GraphRAG documentation: global search","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002Fquery\u002Fglobal_search\u002F",{"title":47,"url":48},"Microsoft GraphRAG documentation: local search","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002Fquery\u002Flocal_search\u002F",{"title":50,"url":51},"Microsoft GraphRAG documentation: DRIFT search","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002Fquery\u002Fdrift_search\u002F",{"title":53,"url":54},"Microsoft GraphRAG documentation: getting started","https:\u002F\u002Fmicrosoft.github.io\u002Fgraphrag\u002Fget_started\u002F",{"title":56,"url":57},"Microsoft Research: LazyGraphRAG, setting a new standard for quality and cost (25 November 2024)","https:\u002F\u002Fwww.microsoft.com\u002Fen-us\u002Fresearch\u002Fblog\u002Flazygraphrag-setting-a-new-standard-for-quality-and-cost\u002F",{"title":59,"url":60},"Guo et al.: LightRAG: Simple and Fast Retrieval-Augmented Generation (arXiv:2410.05779)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2410.05779",{"title":62,"url":63},"HKUDS\u002FLightRAG on GitHub","https:\u002F\u002Fgithub.com\u002FHKUDS\u002FLightRAG",{"title":65,"url":66},"Gutiérrez et al.: HippoRAG: Neurobiologically Inspired Long-Term Memory for Large Language Models (arXiv:2405.14831)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2405.14831",{"title":68,"url":69},"Xiang et al.: When to use Graphs in RAG: A Comprehensive Analysis for Graph Retrieval-Augmented Generation (arXiv:2506.05690)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2506.05690","\u002Fimages\u002Fblog\u002Fgraphrag-knowledge-graph-rag\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fgraphrag-knowledge-graph-rag\u002Fog.jpg","ai-engineer",[74,75,76],"en","de","hu","GraphRAG és knowledge-graph RAG: mikor veri a gráf a vektoros keresést","Mit csinál valójában a Microsoft GraphRAG és a LightRAG, mennyibe kerül az indexelés, és mikor jobb a tudásgráf a vektoros RAG-nál: multi-hop, globális kérdések, termékkatalógus.","Diagram: egy tudásgráf középen, entitásokhoz, közösségekhez, lokális és globális kereséshez és termékalkatrészekhez kapcsolva.","GraphRAG: mikor veri a tudásgráf a RAG-ot · Balázs Csorba",[82,83,84,85,86],"A GraphRAG a chunkolás fölé egy LLM-mel épített tudásgráfot, Leiden-közösségeket és közösségi jelentéseket tesz. Az erőssége a teljes korpuszra vonatkozó globális kérdés, nem az egyes tények jobb megtalálása.","Az ár az indexelés: chunkonként legalább egy LLM-hívás a kinyerésre, plusz összefoglaló minden entitáshoz és közösséghez. A Microsoft maga figyelmeztet, hogy a GraphRAG sok LLM-erőforrást fogyaszthat.","A lokális keresés (entitás-környezet) a kapcsolati és multi-hop kérdéseken segít, a globális keresés (map-reduce a közösségi jelentéseken) a témákon és áttekintéseken. Egyszerű tény-lekérdezéshez általában elég a vektoros RAG rerankerrel.","Léteznek könnyebb változatok: a LightRAG inkrementális frissítéssel, a LazyGraphRAG vektoros RAG-os indexelési költséggel, a HippoRAG olcsó multi-hop kereséssel. Kezeld ezeket paper-eredményként, amíg a saját adatodon nem mérted le.","B2B katalógusokban a kapcsolatok (leváltja, része, kompatibilis) már ott vannak a PIM-ben vagy az ERP-ben. Töltsd be őket gráfként ahelyett, hogy LLM-mel újra felfedeztetnéd, a szabad szövegre pedig használj vektoros keresést.",[88,91,94,97,100,103],{"q":89,"a":90},"Mi a GraphRAG, és miben különbözik a hagyományos RAG-tól?","A hagyományos RAG a dokumentumokat chunkokra bontja, beágyazza, és a leghasonlóbbakat kéri le. A Microsoft Research által közzétett GraphRAG először egy LLM-mel entitásokat és kapcsolatokat nyer ki a chunkokból, a kapott gráfot a Leiden-algoritmussal közösségekbe fürtözi, és minden közösséghez LLM-összefoglalót ír. A lekérdezés ezután használhatja egy entitás gráfbeli környezetét (lokális keresés) vagy a közösségi összefoglalókat (globális keresés), nem csak hasonló chunkokat.",{"q":92,"a":93},"Mi a különbség a GraphRAG lokális és globális keresése között?","A lokális keresés a kérdéshez illő entitásokból indul, és behúzza a kapcsolódó entitásokat, kapcsolatokat, a forrásszöveget és a közösségi jelentéseket. Konkrét dolgokra vonatkozó kérdésekhez való. A globális keresés map-reduce-t futtat a közösségi jelentéseken, és a teljes adathalmazra vonatkozó kérdésekhez való, például a fő témákhoz. A DRIFT-keresés a kettőt kombinálja: közösségi jelentésekkel indul, és lokális kereséssel finomít.",{"q":95,"a":96},"Mennyibe kerül a GraphRAG indexelése?","Sokkal többe, mint a chunkok beágyazása, mert egy LLM végigolvassa az összes chunkot, hogy entitásokat és kapcsolatokat nyerjen ki, majd leírásokat és közösségi jelentéseket ír. A Microsoft szerint a GraphRAG sok LLM-erőforrást fogyaszthat, ezért kicsiben és olcsóbb modellekkel érdemes kezdeni. A LazyGraphRAG, egy későbbi változat, a vektoros RAG-gal azonos indexelési költséget és a teljes GraphRAG 0,1 százalékát közli.",{"q":98,"a":99},"Mikor jobb a GraphRAG a vektoros RAG-nál?","Ha a kérdések kapcsolatokon vagy a teljes korpuszon múlnak: multi-hop kérdések, korpuszszintű témák és áttekintések, valamint explicit kapcsolatokat tartalmazó adatok, például termék- és alkatrész-hierarchiák. Egyszerű tény-lekérdezésnél gyakran nem. A GraphRAG-Bench tanulmány szerint a GraphRAG sok valós feladaton gyakran gyengébb az egyszerű RAG-nál, ezért a saját kérdéseiden mérj.",{"q":101,"a":102},"Jó alternatíva a LightRAG a Microsoft GraphRAG helyett?","Könnyebb, MIT-licenccel elérhető graph RAG keretrendszer kétszintű (lokális és globális) kereséssel, inkrementális frissítéssel és több tárolási háttérrel, például PostgreSQL-lel és Neo4j-jel. Érdemes kipróbálni, ha a dokumentumaid gyakran változnak. A publikált összehasonlításokat a szerzők maguk végezték, ezért a döntés előtt teszteld a saját baseline-odhoz képest.",{"q":104,"a":105},"Kell gráfadatbázis a GraphRAG-hoz?","Nem feltétlenül. A Microsoft GraphRAG táblákat és embeddingeket ír, a LightRAG pedig teszteléshez memóriabeli gráftárolót tartalmaz, éles használathoz PostgreSQL-t támogat. A dedikált gráfadatbázis, például a Neo4j akkor hasznos, ha sokat járod be a kapcsolatokat, vagy amúgy is modellezed őket, például termék–alkatrész szerkezetekben.",[107,110,113,116,119,122,125,128,131],{"id":108,"title":109},"what-graphrag-does","Mit csinál valójában a Microsoft GraphRAG",{"id":111,"title":112},"global-local-drift","Globális, lokális és DRIFT keresés",{"id":114,"title":115},"lightrag-and-friends","LightRAG, LazyGraphRAG, HippoRAG és a többiek",{"id":117,"title":118},"indexing-cost","Az indexelés számlája",{"id":120,"title":121},"when-graphs-win","Mikor nyernek a gráfok, és mikor nem",{"id":123,"title":124},"b2b-product-parts","Pragmatikus B2B példa: termékek és alkatrészek",{"id":126,"title":127},"checklist","Ellenőrzőlista, mielőtt gráfot építesz",{"id":129,"title":130},"where-this-is-going","Merre tart ez",{"id":132,"title":133},"sources","Források",[135,139,142,156,159,167,170,179,182,185,186,189,246,249,252,253,256,280,283,284,287,309,312,324,325,331,396,404,405,408,411,418,421,453,461,462,480,483,484,487,490,491],{"type":136,"content":137},"paragraph",[138],"Pár havonta valaki megmutat egy szép tudásgráf-vizualizációt, és kijelenti, hogy a vektoros RAG elavult. Eleget építettem keresőrendszereket ahhoz, hogy a mondat mindkét felében kételkedjek. A gráfok valóban megoldanak olyan problémákat, amelyeket a chunk-hasonlóság nem tud, és valódi pénzbe és valódi komplexitásba kerülnek olyan problémákért, amelyeket egy hibrid keresés rerankerrel már kezel.",{"type":136,"content":140},[141],"Ez a cikk elmagyarázza, mit csinál valójában a Microsoft GraphRAG a motorháztető alatt, mit változtat a LightRAG, a LazyGraphRAG és a HippoRAG, honnan jön az indexelés költsége, és milyen kérdések indokolnak gráfot. Egy pragmatikus B2B példával zárul katalógusadatokból, ahol a tanácsom szándékosan unalmas: használd a gráfot, amid már van.",{"type":136,"content":143},[144,145,150,151,155],"Ha még nincs szilárd baseline-od, kezdd a ",{"tag":146,"to":147,"children":148},"link","\u002Fblog\u002Frag-pipeline-chunking-hybrid-search-reranking",[149],"chunkolással, hibrid kereséssel és rerankinggel"," és a ",{"tag":146,"to":152,"children":153},"\u002Fblog\u002Frag-2026-hybrid-agentic-long-context",[154],"2026-os RAG-áttekintéssel",". A gráf egy működő pipeline kiegészítése, nem a helyettesítője.",{"type":157,"level":158,"id":108,"text":109},"heading",2,{"type":136,"content":160},[161,162,166],"A hátterében a ",{"tag":163,"href":36,"children":164},"a",[165],"From Local to Global: A Graph RAG Approach to Query-Focused Summarization"," paper áll, Darren Edge és kollégái munkája a Microsoft Researchnél (2024 április). A kiindulópont a hagyományos RAG egy korlátja: nehezen kezeli a teljes korpuszra vonatkozó globális kérdéseket, például azt, hogy „Melyek az adathalmaz fő témái?”. A hasonlósági keresés a kérdéshez legközelebbi chunkokat adja vissza, a mindenről szóló kérdésnek viszont nincs legközelebbi chunkja.",{"type":136,"content":168},[169],"A nyílt forráskódú implementáció az indexelést lépésenként dokumentálja. A dokumentumokat text unitokra vágja (alapértelmezés szerint 1200 token). Egy LLM kinyeri az entitásokat címmel, típussal és leírással, valamint a köztük lévő kapcsolatokat, opcionálisan állításokat (claimeket) is. Az ismétlődő leírásokat összevonja. A hierarchikus Leiden-algoritmus ezután több részletességi szinten közösségekbe fürtözi a gráfot. Végül az LLM minden közösséghez jelentést ír, a text unitokat, az entitásleírásokat és a jelentéseket pedig beágyazza egy vektortárba.",{"type":171,"attrs":172,"inner":176,"caption":177},"diagram",{"viewBox":173,"role":174,"aria-labelledby":175},"0 0 720 270","img","d1-grag-t d1-grag-d","\u003Ctitle id=\"d1-grag-t\">GraphRAG: a dokumentumoktól két keresésfajtáig\u003C\u002Ftitle>\u003Cdesc id=\"d1-grag-d\">Indexelő pipeline: a dokumentumokból text unitok, kinyert entitásgráf, Leiden-közösségek és közösségi jelentések lesznek. A lokális keresés entitás-környezetet olvas, a globális keresés map-reduce-t futtat a közösségi jelentéseken.\u003C\u002Fdesc>\u003Ctext x=\"20\" y=\"28\" class=\"d-title\">GraphRAG: a dokumentumoktól két keresésfajtáig\u003C\u002Ftext>\u003Ctext x=\"700\" y=\"28\" text-anchor=\"end\" class=\"d-label\">Microsoft GraphRAG dokumentáció\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"56\" text-anchor=\"start\" class=\"d-label\">INDEXELÉS (LLM-igényes)\u003C\u002Ftext>\u003Crect x=\"20\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"80\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Dokumentumok\u003C\u002Ftext>\u003Ctext x=\"80\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">nyers szöveg\u003C\u002Ftext>\u003Cpath d=\"M140 102 H152\" class=\"d-line\" \u002F>\u003Cpath d=\"M160 102 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"160\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"220\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Text unitok\u003C\u002Ftext>\u003Ctext x=\"220\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">1200 token\u003C\u002Ftext>\u003Cpath d=\"M280 102 H292\" class=\"d-line\" \u002F>\u003Cpath d=\"M300 102 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"300\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"360\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Gráf\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">entitás, kapcsolat\u003C\u002Ftext>\u003Cpath d=\"M420 102 H432\" class=\"d-line\" \u002F>\u003Cpath d=\"M440 102 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"440\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"500\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Közösségek\u003C\u002Ftext>\u003Ctext x=\"500\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">Leiden\u003C\u002Ftext>\u003Cpath d=\"M560 102 H572\" class=\"d-line\" \u002F>\u003Cpath d=\"M580 102 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"580\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-accent\" \u002F>\u003Ctext x=\"640\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Jelentések\u003C\u002Ftext>\u003Ctext x=\"640\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">LLM-összefogl.\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"172\" text-anchor=\"start\" class=\"d-label\">LEKÉRDEZÉSKOR\u003C\u002Ftext>\u003Cpath d=\"M300 134 C300 160 185 160 185 176\" class=\"d-line\" \u002F>\u003Cpath d=\"M185 186 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Cpath d=\"M580 134 C580 160 535 160 535 176\" class=\"d-line\" \u002F>\u003Cpath d=\"M535 186 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Crect x=\"20\" y=\"186\" width=\"330\" height=\"64\" rx=\"10\" class=\"d-mint\" \u002F>\u003Ctext x=\"185\" y=\"214\" text-anchor=\"middle\" class=\"d-text\">Lokális keresés\u003C\u002Ftext>\u003Ctext x=\"185\" y=\"235\" text-anchor=\"middle\" class=\"d-small\">entitás, szomszédok, forrás\u003C\u002Ftext>\u003Crect x=\"370\" y=\"186\" width=\"330\" height=\"64\" rx=\"10\" class=\"d-gold\" \u002F>\u003Ctext x=\"535\" y=\"214\" text-anchor=\"middle\" class=\"d-text\">Globális keresés\u003C\u002Ftext>\u003Ctext x=\"535\" y=\"235\" text-anchor=\"middle\" class=\"d-small\">map-reduce a jelentéseken\u003C\u002Ftext>",[178],"A drága rész egyszer, indexeléskor történik; a két keresési mód ugyanazon index különböző elemeit olvassa.",{"type":136,"content":180},[181],"Ebből két dolog következik. A gráf nem kézzel modellezett ontológia, hanem az, amit a kinyerő prompt megtalált, ezért a minősége a domainre hangolt promptoktól függ (a dokumentáció ezt kifejezetten kimondja). A közösségi jelentések pedig a korpuszod előre kiszámolt, hierarchikus összefoglalói, és éppen ettől válaszolhatók meg a globális kérdések.",{"type":136,"content":183},[184],"A paper kísérleteiben, két körülbelül 1 millió tokenes adathalmazon (podcast-átiratok és hírcikkek) a GraphRAG-változatok LLM-mel értékelt összehasonlításokban verték a vektoros RAG baseline-t: 72–83 százalékos nyerési arány az átfogóságban és 62–82 százalék a sokszínűségben, adathalmaztól és változattól függően. A közösségek gyökérszintű összefoglalói emellett 9–43-szor kevesebb tokent igényeltek, mint a forrásszöveg összefoglalása. A szerzők óvatosak a hatókörrel: az értékelés két korpusz sensemaking-kérdéseire vonatkozik, és szerintük további munka kell annak megértéséhez, mennyire általánosítható.",{"type":157,"level":158,"id":111,"text":112},{"type":136,"content":187},[188],"A lekérdezési módok közti különbség a leghasznosabb dolog, amit érdemes megérteni, mert megmutatja, mely kérdések indokolják az indexet.",{"type":190,"head":191,"rows":200},"table",[192,194,196,198],[193],"Mód",[195],"Milyen kérdésre felel",[197],"Mit olvas",[199],"Költségprofil",[201,213,224,235],[202,207,209,211],[203],{"tag":204,"children":205},"strong",[206],"Lokális keresés",[208],"Konkrét dolgokról: „Mit tudunk az X ügyfélről és a szerződéseiről?”",[210],"A kérdéshez illő entitások, szomszédaik, kapcsolatok, forrás text unitok és közösségi jelentések",[212],"Egy keresés és egy válasz, hasonló a nagyobb kontextusú RAG-hoz",[214,218,220,222],[215],{"tag":204,"children":216},[217],"Globális keresés",[219],"A teljes korpuszról: „Melyek a fő kockázatok az összes jelentésben?”",[221],"Közösségi jelentések, map és reduce lépésben feldolgozva",[223],"Sok LLM-hívás; az alacsonyabb közösségi szint alaposabb, de lassabb és drágább",[225,229,231,233],[226],{"tag":204,"children":227},[228],"DRIFT keresés",[230],"Széles kezdés, konkrét folytatás",[232],"Először releváns közösségi jelentések, majd lokális keresés a követő kérdésekre",[234],"A kettő között; a dokumentáció szerint átfogóbb a sima lokális keresésnél",[236,240,242,244],[237],{"tag":204,"children":238},[239],"Vektoros RAG",[241],"Hol áll ez?",[243],"A top-k leghasonlóbb chunk",[245],"A legolcsóbb indexeléskor és lekérdezéskor",{"type":136,"content":247},[248],"A globális keresést érdemes közelebbről megnézni. A dokumentáció map-reduce-t ír le a közösségi jelentéseken: a jelentéseket chunkokra bontja, minden chunk köztes választ ad fontossági értékeléssel, a reduce lépés pedig szűri és összesíti ezeket. A közösségi szint megválasztása közvetlen szabályozó a mélység és a költség között, ezért egy éles rendszernek ki kell vezetnie, nem beledrótoznia.",{"type":136,"content":250},[251],"A lokális keresés az a mód, amelyre a csapatoknak valójában a legtöbbször szükségük van, és amelyik a leginkább hasonlít a klasszikus keresési pipeline-hoz. Beágyazza a kérdést, megkeresi a kapcsolódó entitásokat, és behúzza a kapcsolódó entitásokat, kapcsolatokat, kovariánsokat, forrás chunkokat és közösségi jelentéseket, egyetlen kontextusablakra szabva.",{"type":157,"level":158,"id":114,"text":115},{"type":136,"content":254},[255],"Az eredeti terv alapos és drága, és több projekt éppen ezt támadja. Rövid tájékoztató, a szokásos fenntartással, hogy az alábbi számok mind a szerzőktől származnak:",{"type":257,"ordered":258,"items":259},"list",false,[260,267,273],[261,262,266],"A ",{"tag":204,"children":263},[264],{"tag":163,"href":63,"children":265},[11]," (2024 októberi paper, az EMNLP 2025-ön bemutatva, MIT-licenc) gráf- és vektorindexet épít kétszintű kereséssel, támogatja az inkrementális frissítést és a dokumentumtörlést, és local, global, hybrid, naive és mix lekérdezési módokat kínál. Fut PostgreSQL-en, Neo4j-n, MongoDB-n, Milvuson, Qdranton vagy OpenSearchön. A paper a keresés pontosságának és hatékonyságának javulását közli, a GraphRAG-gal való, azonos alapú költség-összehasonlítást viszont nem tudtam ellenőrizni, ezért ezt nyitva hagyom. Az inkrementális frissítés az a funkció, ami engem érdekel: a minden alkalommal újraépített index rosszul illik az élő dokumentumállományokhoz.",[261,268,272],{"tag":204,"children":269},[270],{"tag":163,"href":57,"children":271},[22]," (Microsoft Research, 2024. november 25.) kihagyja az előzetes összefoglalást. A Microsoft szerint az indexelési költsége megegyezik a vektoros RAG-éval, és a teljes GraphRAG költségének 0,1 százaléka, a munka a lekérdezés idejére tolódik. Ez a jó csere nagy korpusznál és kevés gráfot érdemlő kérdésnél.",[261,274,279],{"tag":204,"children":275},[276],{"tag":163,"href":66,"children":277},[278],"HippoRAG"," (NeurIPS 2024) egy LLM-mel épített tudásgráfot Personalized PageRankkel kombinál. A szerzők akár 20 százalékos javulást közölnek multi-hop kérdésmegválaszolásban, az egylépéses keresés pedig eléri vagy túlszárnyalja az iteratív keresést, miközben 10–30-szor olcsóbb és 6–13-szor gyorsabb. A multi-hop kérdéseket célozza, nem a globálisakat.",{"type":136,"content":281},[282],"Az olvasatom: a „graph RAG” egy család, nem egy termék. A hasznos kérdés az, hogy a három feladat közül melyikre van szükséged: globális összefoglalókra, kapcsolat-tudatos multi-hop keresésre vagy inkrementálisan frissített tudásra. Ahhoz válassz változatot.",{"type":157,"level":158,"id":117,"text":118},{"type":136,"content":285},[286],"A Microsoft saját bevezető oldala arra figyelmeztet, hogy a GraphRAG sok LLM-erőforrást fogyaszthat, és azt javasolja, hogy előbb a tutorial adathalmazzal és olcsóbb modellekkel próbálkozz. Ez a becsületes összefoglalás. Olyan árat nem tudok mondani millió tokenenként, amely tartósan igaz marad, mert a modelltől és a promptoktól függ, de megmutathatom, honnan jönnek a hívások:",{"type":257,"ordered":258,"items":288},[289,294,299,304],[290,293],{"tag":204,"children":291},[292],"Kinyerés:"," text unitonként legalább egy LLM-hívás, önreflexiós („gleaning”) körökkel több. A paper szerint a kinyerés recallja javul a további körökkel és a kisebb chunkokkal: GPT-4-gyel egy 600 tokenes chunk majdnem kétszer annyi entitás-említést adott, mint egy 2400 tokenes.",[295,298],{"tag":204,"children":296},[297],"Leírások összefoglalása:"," minden entitás és kapcsolat, amely sok chunkban előfordul, egy LLM-mel összevont leírást kap.",[300,303],{"tag":204,"children":301},[302],"Közösségi jelentések:"," közösségenként egy LLM által írt jelentés, minden hierarchiaszinten.",[305,308],{"tag":204,"children":306},[307],"Embeddingek:"," text unitok, entitásleírások és jelentéstartalom. Ez az egyetlen rész, amelyért egy vektoros RAG pipeline is fizet.",{"type":136,"content":310},[311],"A méret is számít. A paper gráfjai a körülbelül 1 millió tokennyi szövegre 8564 csomóponttal és 20 691 éllel (podcastok), illetve 15 754 csomóponttal és 19 520 éllel (hírek) készültek. Szorozd meg a saját korpuszoddal és minden újraindexeléssel. A költségek itt halmozódnak: ha a dokumentumok hetente változnak, egy inkrementális terv, mint a LightRAG, vagy egy igény szerinti, mint a LazyGraphRAG, jobban változtat a gazdaságosságon, mint bármilyen prompt-hangolás.",{"type":313,"variant":314,"title":315,"body":316},"callout","tip","Becsülj, mielőtt indexelsz",[317],[318,319,323],"Indexelj egy reprezentatív 1–5 százalékos mintát, jegyezd fel a tokeneket és a költséget text unitonként, és extrapolálj. Add hozzá az újraindexelés költségét a valós változási ütem mellett. Hasonlítsd az összeget azon kérdések értékéhez, amelyekre csak a gráf tud válaszolni. Az általános módszert lásd a ",{"tag":146,"to":320,"children":321},"\u002Fblog\u002Fllm-cost-latency-prompt-caching-routing",[322],"költség, késleltetés és routing"," cikkben.",{"type":157,"level":158,"id":120,"text":121},{"type":136,"content":326},[261,327,330],{"tag":163,"href":69,"children":328},[329],"GraphRAG-Bench tanulmány"," (2025 június) egy kényelmetlen megfigyeléssel indul: a GraphRAG sok valós feladaton gyakran gyengébben teljesít az egyszerű RAG-nál. Ezután a tényközlést, az összetett következtetést, az összefoglalást és a kreatív generálást vizsgálja, hogy megtalálja, milyen feltételek mellett térül meg a gráf. Ez egyezik a tapasztalatommal. A döntés a kérdés alakjától függ.",{"type":190,"head":332,"rows":341},[333,335,337,339],[334],"Kérdéstípus",[336],"Vektoros RAG + reranker",[338],"Graph RAG",[340],"Az én döntésem",[342,351,360,369,378,387],[343,345,347,349],[344],"Egyetlen tény („Mekkora a Z modell nyomatéka?”)",[346],"Erős, olcsó",[348],"Ritkán jobb",[350],"Vektor",[352,354,356,358],[353],"Multi-hop („Melyik beszállító gyártja az X-et leváltó alkatrészt?”)",[355],"Kihagyja a második hopot, hacsak egy ügynök nem iterál",[357],"Erős, ha a kapcsolat explicit",[359],"Gráf vagy ügynöki keresés",[361,363,365,367],[362],"Globális („Milyen témák ismétlődnek 5000 jegyben?”)",[364],"Gyenge: nincs legközelebbi chunk",[366],"Az eset, amire a GraphRAG készült",[368],"Gráf, vagy összefoglalás fürtözéssel",[370,372,374,376],[371],"Kapcsolatos katalógus („Mi illik hozzá, mi váltja le, mi része?”)",[373],"Szöveget talál, szerkezetet nem",[375],"Erős, és az adat már strukturált",[377],"Gráf strukturált adatból",[379,381,383,385],[380],"Gyorsan változó dokumentumok",[382],"Könnyű frissíteni",[384],"Drága, hacsak nem inkrementális",[386],"Vektor, vagy LightRAG-jellegű frissítés",[388,390,392,394],[389],"Kis korpusz, ami belefér a kontextusba",[391],"Nem kell",[393],"Nem éri meg",[395],"Hosszú kontextus",{"type":136,"content":397},[398,399,403],"A minta: a gráfok akkor segítenek, ha a válasz több, kapcsolatokkal összekötött darabból vagy a korpusz egészéből áll össze. Nem segítenek, ha a válasz egyetlen szövegrészben van. Építés előtt írj le húsz valódi felhasználói kérdést, és sorold mindegyiket tény, multi-hop vagy globális kategóriába. Ha 80 százalék tény, jobb chunkolásra és rerankingre van szükséged, nem gráfra. Az eredményt ",{"tag":146,"to":400,"children":401},"\u002Fblog\u002Fllm-evals-for-product-features",[402],"a termékedhez kötött evalokkal"," mérd, ne egy demóval.",{"type":157,"level":158,"id":123,"text":124},{"type":136,"content":406},[407],"Ez az a helyzet, amellyel B2B e-commerce és ERP projektekben találkozom. Egy gyártó vagy nagykereskedő gépeket, alkatrészeket és kiegészítőket árul. Az értékesítő vagy egy ügyfél megkérdezi: „A P-150 szivattyúnk kifutott. Melyik szivattyú váltja le, és milyen tömítőszett kell most?” A válaszhoz három hop kell: az utódtermék, annak alkatrészlistája, és egy kifutott alkatrész aktuális pótlása. Rokon kérdések: „Mi kompatibilis ezzel a karimával?” és „Melyik kézikönyv fedi le ezt a változatot?”.",{"type":136,"content":409},[410],"Az adatlapokon végzett vektoros keresés megtalálja a P-150 oldalát és talán a P-200-ét. Nem követi megbízhatóan a „leváltja” kapcsolatot a helyes tömítőszettig, mert ez a tény rekordok közötti kapcsolat, nem a kérdéshez hasonló mondat. Ez klasszikus gráf-eset. De figyeld meg, honnan kell jönnie a gráfnak.",{"type":171,"attrs":412,"inner":415,"caption":416},{"viewBox":413,"role":174,"aria-labelledby":414},"0 0 720 316","d2-grag-t d2-grag-d","\u003Ctitle id=\"d2-grag-t\">Termék- és alkatrészkapcsolatok gráfként\u003C\u002Ftitle>\u003Cdesc id=\"d2-grag-d\">A P-150 szivattyút a P-200 szivattyú váltja le. A P-200-nak része az M-4 motor és az S-17 tömítőszett, illik hozzá az F-80 karima, és egy kézikönyv dokumentálja. Az S-17 tömítőszettet az S-18 tömítőszett váltja le.\u003C\u002Fdesc>\u003Ctext x=\"20\" y=\"28\" class=\"d-title\">Termék- és alkatrészkapcsolatok gráfként\u003C\u002Ftext>\u003Ctext x=\"700\" y=\"28\" text-anchor=\"end\" class=\"d-label\">szemléltető példa\u003C\u002Ftext>\u003Crect x=\"20\" y=\"130\" width=\"130\" height=\"56\" rx=\"10\" class=\"d-gold\" \u002F>\u003Ctext x=\"85\" y=\"163\" text-anchor=\"middle\" class=\"d-text\">P-150 szivattyú\u003C\u002Ftext>\u003Cpath d=\"M150 158 H252\" class=\"d-line\" \u002F>\u003Cpath d=\"M260 158 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"205\" y=\"148\" text-anchor=\"middle\" class=\"d-label\">leváltja\u003C\u002Ftext>\u003Crect x=\"260\" y=\"130\" width=\"160\" height=\"56\" rx=\"10\" class=\"d-accent\" \u002F>\u003Ctext x=\"340\" y=\"163\" text-anchor=\"middle\" class=\"d-text\">P-200 szivattyú\u003C\u002Ftext>\u003Crect x=\"260\" y=\"44\" width=\"160\" height=\"44\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"340\" y=\"71\" text-anchor=\"middle\" class=\"d-text\">M-4 motor\u003C\u002Ftext>\u003Cpath d=\"M340 130 V96\" class=\"d-line\" \u002F>\u003Cpath d=\"M340 88 l-5 9 h10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"352\" y=\"114\" text-anchor=\"start\" class=\"d-label\">része\u003C\u002Ftext>\u003Crect x=\"260\" y=\"232\" width=\"160\" height=\"44\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"340\" y=\"259\" text-anchor=\"middle\" class=\"d-text\">S-17 tömítőszett\u003C\u002Ftext>\u003Cpath d=\"M340 186 V224\" class=\"d-line\" \u002F>\u003Cpath d=\"M340 232 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"352\" y=\"214\" text-anchor=\"start\" class=\"d-label\">része\u003C\u002Ftext>\u003Crect x=\"20\" y=\"232\" width=\"130\" height=\"44\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"85\" y=\"259\" text-anchor=\"middle\" class=\"d-text\">F-80 karima\u003C\u002Ftext>\u003Cpath d=\"M285 186 C260 232 200 254 160 254\" class=\"d-line\" \u002F>\u003Cpath d=\"M150 254 l9 -5 v10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"205\" y=\"226\" text-anchor=\"middle\" class=\"d-label\">illik hozzá\u003C\u002Ftext>\u003Crect x=\"560\" y=\"130\" width=\"140\" height=\"56\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"630\" y=\"163\" text-anchor=\"middle\" class=\"d-text\">Kézikönyv (PDF)\u003C\u002Ftext>\u003Cpath d=\"M420 158 H552\" class=\"d-line\" \u002F>\u003Cpath d=\"M560 158 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"490\" y=\"148\" text-anchor=\"middle\" class=\"d-label\">dokumentálja\u003C\u002Ftext>\u003Crect x=\"560\" y=\"232\" width=\"140\" height=\"44\" rx=\"10\" class=\"d-mint\" \u002F>\u003Ctext x=\"630\" y=\"259\" text-anchor=\"middle\" class=\"d-text\">S-18 tömítő\u003C\u002Ftext>\u003Cpath d=\"M420 254 H552\" class=\"d-line\" \u002F>\u003Cpath d=\"M560 254 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"490\" y=\"246\" text-anchor=\"middle\" class=\"d-label\">leváltja\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"304\" text-anchor=\"middle\" class=\"d-label\">Három hop: P-150, majd P-200, majd S-17, majd S-18\u003C\u002Ftext>",[417],"A kapcsolatok már mezők egy PIM-ben vagy ERP-ben; csak a kézikönyvhöz kell szövegkeresés.",{"type":136,"content":419},[420],"Egy PIM-ben vagy ERP-ben, mint a Pimcore, a Spryker vagy az SAP, ezek a kapcsolatok már strukturált adatként léteznek: utód-hivatkozások, darabjegyzékek, kompatibilitási táblák. LLM-mel kifizettetni, hogy PDF-ekből újra kinyerje őket, lassabb, drágább és pontatlanabb, mint a mezők beolvasása. Az ajánlott architektúrám ezért:",{"type":257,"ordered":422,"items":423},true,[424,429,434,439,444],[425,428],{"tag":204,"children":426},[427],"Építsd a gráfot strukturált adatból."," A csomópontok termékek, alkatrészek és dokumentumok; az élek a törzsadataid által már definiált kapcsolattípusok (leváltja, része, kompatibilis, dokumentálja). A csomópont-azonosító legyen azonos az SKU-val vagy cikkszámmal.",[430,433],{"tag":204,"children":431},[432],"A szöveghez használj vektoros vagy hibrid keresést."," A kézikönyvek, adatlapok és jegyek chunkolt indexben maradnak. Minden chunk hordozza az általa említett termékazonosítókat, így egy gráfbejárás pontosan a releváns chunkokat tudja lekérni.",[435,438],{"tag":204,"children":436},[437],"Először entitásfeloldás, aztán bejárás."," Az ügynök vagy a keresési lépés a „P-150”-et egy csomóponthoz rendeli (cikkszámoknál a pontos egyezés jobb az embeddingnél), egy–három hopot jár be típusos lekérdezéssel, és a kapott rekordokat a kapcsolódó chunkokkal együtt adja át a modellnek.",[440,443],{"tag":204,"children":441},[442],"LLM-es kinyerést csak a hiányokra adj hozzá,"," például olyan kompatibilitási megjegyzésekre, amelyek csak szabad szövegben léteznek, és jelöld az ilyen éleket kevésbé megbízhatónak.",[445,448,449,323],{"tag":204,"children":446},[447],"A készletet a rendelkező rendszerből ellenőrizd."," A készlet, az ár és az érvényesség az ERP-é, amelyet válaszadáskor eszközként hívsz meg, a gráfba sosem kerül. Hogy merre tart ez, azt lásd az ",{"tag":146,"to":450,"children":451},"\u002Fblog\u002Fagentic-commerce-protocols-ucp-acp-guide",[452],"agentic commerce protokollok",{"type":136,"content":454},[455,456,460],"Ez graph RAG a drága rész nélkül. Ráadásul jobban auditálható: a válasz minden hopja egy rekord, amit bárki megnyithat. Ha ilyen rendszereket építesz: a ",{"tag":146,"to":457,"children":458},"\u002Fexpertise\u002Fb2b-ecommerce-developer",[459],"B2B e-commerce munkám"," pontosan a törzsadatok és a keresés ilyen kombinációja.",{"type":157,"level":158,"id":126,"text":127},{"type":257,"ordered":422,"items":463},[464,466,468,470,472,474,476,478],[465],"Gyűjts össze húsz–ötven valódi kérdést, és címkézd őket tény, multi-hop vagy globális kategóriával.",[467],"Építsd meg és mérd a baseline-t: hibrid keresés rerankinggel és rendes chunkolással.",[469],"Ellenőrizd, léteznek-e már a kapcsolatok strukturált adatként. Ha igen, importáld őket, ne kinyerd.",[471],"Ha globális kérdések kellenek, pilotálj GraphRAG-ot vagy LazyGraphRAG-ot egy mintán, és extrapold a költséget, az újraindexelést is beleértve.",[473],"Ha a dokumentumaid gyakran változnak, először inkrementális megoldásokat, például LightRAG-et teszteld.",[475],"Hangold a kinyerő promptot a domainedre, és nézz át kézzel egy mintát a kinyert entitásokból.",[477],"Hasonlítsd a baseline-hoz a saját kérdéseiden, LLM-bíróval és emberi szúrópróbával.",[479],"A keresési módot (vektor, lokális, globális) tedd routerdöntéssé, ne kényszeríts minden lekérdezést a gráfon át.",{"type":136,"content":481},[482],"Az utolsó pont spórol pénzt. Egy olcsó osztályozó vagy egy kis modell a tény-kérdéseket a vektoros keresésre irányítja, és csak a globális vagy kapcsolati kérdéseket küldi a gráfnak. A pipeline így annyiba kerül, amennyit az adott kérdés megérdemel.",{"type":157,"level":158,"id":129,"text":130},{"type":136,"content":485},[486],"Hosszú kontextusablakokkal és ügynöki kereséssel egy ügynök egy sima indexen is iterálhat, és közelítheti a multi-hop következtetést, kérdésenként több hívás árán. A gráfok ezt a munkát az indexelés idejére helyezik át. Egyik sem nyer mindenhol, ezért 2026-ban a minta egy router több keresési stratégia fölött.",{"type":136,"content":488},[489],"Az ajánlásom: maradj szkeptikus és empirikus. Kezdd a baseline-nal, gráfot csak azokra a kérdéstípusokra adj hozzá, amelyeknek kell, az éleit amikor csak lehet, strukturált adatból vedd, és tartsd láthatóan az indexelés számláját. Az a gráf, amely egy kérdésosztályt jobban, ismert áron válaszol meg, érték. Az a gráf, amelyet azért építettek, mert jól mutat a diagramon, költség.",{"type":157,"level":158,"id":132,"text":133},{"type":257,"ordered":422,"items":492},[493,496,499,502,505,508,511,514,517,520,523,526],[494],{"tag":163,"href":36,"children":495},[35],[497],{"tag":163,"href":39,"children":498},[38],[500],{"tag":163,"href":42,"children":501},[41],[503],{"tag":163,"href":45,"children":504},[44],[506],{"tag":163,"href":48,"children":507},[47],[509],{"tag":163,"href":51,"children":510},[50],[512],{"tag":163,"href":54,"children":513},[53],[515],{"tag":163,"href":57,"children":516},[56],[518],{"tag":163,"href":60,"children":519},[59],[521],{"tag":163,"href":63,"children":522},[62],[524],{"tag":163,"href":66,"children":525},[65],[527],{"tag":163,"href":69,"children":528},[68],[530,602,686,753],{"slug":531,"published":5,"minutes":6,"category":7,"tags":532,"keywords":537,"about":548,"sources":556,"cover":596,"og":597,"expertise":72,"locales":598,"lang":76,"title":599,"description":600,"coverAlt":601},"llm-hallucination-grounding-citations",[533,12,534,535,536],"Hallucinations","Citations","Grounding","Faithfulness",[538,539,540,541,542,543,544,545,546,547],"reduce LLM hallucinations in production","how to reduce hallucinations in RAG","LLM citations API","Anthropic citations API","RAG faithfulness metric","LLM abstention I don't know","claim-level verification LLM","grounding LLM answers in sources","check grounding API","show sources in AI chatbot UI",[549,552,553],{"name":550,"url":551},"Hallucination (artificial intelligence)","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FHallucination_(artificial_intelligence)",{"name":28,"url":29},{"name":554,"url":555},"Large language model","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FLarge_language_model",[557,560,563,566,569,572,575,578,581,584,587,590,593],{"title":558,"url":559},"Anthropic: Citations (Claude API documentation)","https:\u002F\u002Fplatform.claude.com\u002Fdocs\u002Fen\u002Fbuild-with-claude\u002Fcitations",{"title":561,"url":562},"Anthropic: Search results (Claude API documentation)","https:\u002F\u002Fplatform.claude.com\u002Fdocs\u002Fen\u002Fbuild-with-claude\u002Fsearch-results",{"title":564,"url":565},"Anthropic: Reduce hallucinations (Claude API documentation)","https:\u002F\u002Fplatform.claude.com\u002Fdocs\u002Fen\u002Ftest-and-evaluate\u002Fstrengthen-guardrails\u002Freduce-hallucinations",{"title":567,"url":568},"Anthropic: Introducing Citations on the Anthropic API","https:\u002F\u002Fclaude.com\u002Fblog\u002Fintroducing-citations-api",{"title":570,"url":571},"Simon Willison: Anthropic's new Citations API (24 January 2025)","https:\u002F\u002Fsimonwillison.net\u002F2025\u002FJan\u002F24\u002Fanthropics-new-citations-api\u002F",{"title":573,"url":574},"OpenAI: Web search guide (url_citation annotations and display requirement)","https:\u002F\u002Fdevelopers.openai.com\u002Fapi\u002Fdocs\u002Fguides\u002Ftools-web-search",{"title":576,"url":577},"Cohere: Documents and citations","https:\u002F\u002Fdocs.cohere.com\u002Fdocs\u002Fdocuments-and-citations",{"title":579,"url":580},"Google Cloud: Check grounding API","https:\u002F\u002Fdocs.cloud.google.com\u002Fgenerative-ai-app-builder\u002Fdocs\u002Fcheck-grounding",{"title":582,"url":583},"AWS: Amazon Bedrock Guardrails contextual grounding check","https:\u002F\u002Fdocs.aws.amazon.com\u002Fbedrock\u002Flatest\u002Fuserguide\u002Fguardrails-contextual-grounding-check.html",{"title":585,"url":586},"Ragas: Faithfulness metric","https:\u002F\u002Fdocs.ragas.io\u002Fen\u002Fstable\u002Fconcepts\u002Fmetrics\u002Favailable_metrics\u002Ffaithfulness\u002F",{"title":588,"url":589},"Kalai, Nachum, Vempala, Zhang: Why Language Models Hallucinate (arXiv 2509.04664)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2509.04664",{"title":591,"url":592},"Magesh et al.: Hallucination-Free? Assessing the Reliability of Leading AI Legal Research Tools (arXiv 2405.20362)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2405.20362",{"title":594,"url":595},"Wallat, Heuss, de Rijke, Anand: Correctness is not Faithfulness in RAG Attributions (arXiv 2412.18004)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2412.18004","\u002Fimages\u002Fblog\u002Fllm-hallucination-grounding-citations\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fllm-hallucination-grounding-citations\u002Fog.jpg",[74,75,76],"LLM-hallucinációk csökkentése éles rendszerben: grounding, hivatkozások és a nemet mondás tudománya","Hallucinációk csökkentése éles RAG-ban: hivatkozás-API-k, tartózkodás, állításszintű ellenőrzés, faithfulness-mérés, forrás-UI és ami mégis átcsúszik.","Ábra: egy retrieval lépés evidencia-kapuba, hivatkozásos válaszba és állításellenőrzőbe vezet, a végén forrásokkal ellátott válasz; tartózkodási és jelölési ágak térnek le.",{"slug":603,"published":5,"minutes":6,"category":7,"tags":604,"keywords":609,"about":620,"sources":628,"cover":680,"og":681,"expertise":72,"locales":682,"lang":76,"title":683,"description":684,"coverAlt":685},"pgvector-vs-vector-databases",[605,606,12,607,608],"pgvector","Vector databases","Hybrid search","EU hosting",[610,611,612,613,614,615,616,617,618,619],"pgvector vs vector database","pgvector vs Qdrant","pgvector vs Pinecone","best vector database 2026","pgvector HNSW iterative scan","pgvector halfvec","OpenSearch vs Elasticsearch vector search","vector database EU hosting","hybrid search Postgres","Weaviate vs Milvus",[621,624,627],{"name":622,"url":623},"Vector database","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FVector_database",{"name":625,"url":626},"PostgreSQL","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FPostgreSQL",{"name":28,"url":29},[629,632,635,638,641,644,647,650,653,656,659,662,665,668,671,674,677],{"title":630,"url":631},"pgvector README (index limits, HNSW defaults, iterative scans, filtering, halfvec)","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FREADME.md",{"title":633,"url":634},"pgvector CHANGELOG (0.4.0 to 0.8.7)","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FCHANGELOG.md",{"title":636,"url":637},"pgvectorscale: StreamingDiskANN, statistical binary quantization, filtered search","https:\u002F\u002Fgithub.com\u002Ftimescale\u002Fpgvectorscale",{"title":639,"url":640},"Qdrant documentation: Filtering","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fconcepts\u002Ffiltering\u002F",{"title":642,"url":643},"Qdrant documentation: Hybrid queries","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fconcepts\u002Fhybrid-queries\u002F",{"title":645,"url":646},"Qdrant documentation: Create a cluster (providers, free tier, Hybrid Cloud)","https:\u002F\u002Fqdrant.tech\u002Fdocumentation\u002Fcloud\u002Fcreate-cluster\u002F",{"title":648,"url":649},"Weaviate documentation: Hybrid search","https:\u002F\u002Fdocs.weaviate.io\u002Fweaviate\u002Fconcepts\u002Fsearch\u002Fhybrid-search",{"title":651,"url":652},"Weaviate documentation: Vector index types","https:\u002F\u002Fdocs.weaviate.io\u002Fweaviate\u002Fconcepts\u002Fvector-index",{"title":654,"url":655},"Weaviate Cloud pricing and deployment options","https:\u002F\u002Fweaviate.io\u002Fpricing",{"title":657,"url":658},"Milvus documentation: Overview","https:\u002F\u002Fmilvus.io\u002Fdocs\u002Foverview.md",{"title":660,"url":661},"Pinecone documentation: Database architecture","https:\u002F\u002Fdocs.pinecone.io\u002Fguides\u002Fget-started\u002Fdatabase-architecture",{"title":663,"url":664},"Pinecone documentation: Create an index (clouds, regions, sparse and hybrid)","https:\u002F\u002Fdocs.pinecone.io\u002Fguides\u002Findex-data\u002Fcreate-an-index",{"title":666,"url":667},"OpenSearch documentation: Methods and engines","https:\u002F\u002Fdocs.opensearch.org\u002Flatest\u002Fmappings\u002Fsupported-field-types\u002Fknn-methods-engines\u002F",{"title":669,"url":670},"OpenSearch documentation: Efficient k-NN filtering","https:\u002F\u002Fdocs.opensearch.org\u002Flatest\u002Fvector-search\u002Ffilter-search-knn\u002Fefficient-knn-filtering\u002F",{"title":672,"url":673},"Elasticsearch documentation: Dense vector search","https:\u002F\u002Fwww.elastic.co\u002Fdocs\u002Fsolutions\u002Fsearch\u002Fvector\u002Fdense-vector",{"title":675,"url":676},"Elasticsearch documentation: kNN query (filter as pre-filter)","https:\u002F\u002Fwww.elastic.co\u002Fdocs\u002Freference\u002Fquery-languages\u002Fquery-dsl\u002Fquery-dsl-knn-query",{"title":678,"url":679},"GitHub releases: Qdrant, Weaviate, Milvus, OpenSearch, pgvectorscale (versions as of 1 October 2026)","https:\u002F\u002Fgithub.com\u002Fqdrant\u002Fqdrant\u002Freleases","\u002Fimages\u002Fblog\u002Fpgvector-vs-vector-databases\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fpgvector-vs-vector-databases\u002Fog.jpg",[74,75,76],"pgvector vagy vektoradatbázis? Így válassz vektortárolót 2026-ban","pgvector, Qdrant, Weaviate, Milvus, Pinecone, OpenSearch vagy Elasticsearch? Gyakorlati útmutató 2026-ra: szűrés, hibrid keresés, skálázás, költség és EU-s hosztolás.","Ábra: döntési út az adataidtól a Postgres-beli pgvectorig, a vektormezős keresőmotorig vagy a dedikált vektoradatbázisig.",{"slug":687,"published":5,"minutes":688,"category":7,"tags":689,"keywords":695,"about":705,"sources":713,"cover":747,"og":748,"expertise":72,"locales":749,"lang":76,"title":750,"description":751,"coverAlt":752},"rag-evaluation-metrics",12,[690,691,692,693,694],"RAG evaluation","Retrieval metrics","LLM-as-judge","Golden set","Ragas",[690,696,697,698,699,700,701,702,703,704],"how to evaluate RAG","RAG evaluation metrics","recall@k MRR nDCG","faithfulness vs answer relevance","golden dataset for RAG","LLM as a judge calibration","Ragas vs DeepEval vs TruLens","RAG evals in CI","retrieval vs generation failure",[706,707,710],{"name":28,"url":29},{"name":708,"url":709},"Discounted cumulative gain","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FDiscounted_cumulative_gain",{"name":711,"url":712},"Mean reciprocal rank","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FMean_reciprocal_rank",[714,717,720,723,725,728,731,734,737,740,742,744],{"title":715,"url":716},"Es et al.: RAGAS, Automated Evaluation of Retrieval Augmented Generation (arXiv 2309.15217)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2309.15217",{"title":718,"url":719},"Zheng et al.: Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena (arXiv 2306.05685)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2306.05685",{"title":721,"url":722},"Ragas documentation: available metrics","https:\u002F\u002Fdocs.ragas.io\u002Fen\u002Fstable\u002Fconcepts\u002Fmetrics\u002Favailable_metrics\u002F",{"title":724,"url":586},"Ragas documentation: faithfulness",{"title":726,"url":727},"Ragas documentation: context precision","https:\u002F\u002Fdocs.ragas.io\u002Fen\u002Fstable\u002Fconcepts\u002Fmetrics\u002Favailable_metrics\u002Fcontext_precision\u002F",{"title":729,"url":730},"Ragas documentation: context recall","https:\u002F\u002Fdocs.ragas.io\u002Fen\u002Fstable\u002Fconcepts\u002Fmetrics\u002Favailable_metrics\u002Fcontext_recall\u002F",{"title":732,"url":733},"DeepEval documentation: metrics introduction","https:\u002F\u002Fdeepeval.com\u002Fdocs\u002Fmetrics-introduction",{"title":735,"url":736},"TruLens","https:\u002F\u002Fwww.trulens.org\u002F",{"title":738,"url":739},"Arize Phoenix documentation","https:\u002F\u002Farize.com\u002Fdocs\u002Fphoenix",{"title":741,"url":709},"Wikipedia: Discounted cumulative gain",{"title":743,"url":712},"Wikipedia: Mean reciprocal rank",{"title":745,"url":746},"Wikipedia: Cohen's kappa","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FCohen%27s_kappa","\u002Fimages\u002Fblog\u002Frag-evaluation-metrics\u002Fcover.webp","\u002Fimages\u002Fblog\u002Frag-evaluation-metrics\u002Fog.jpg",[74,75,76],"RAG kiértékelése: retrieval metrikák, faithfulness, és hogyan derül ki, melyik fele hibázott","Hogyan értékeld ki a RAG-rendszered: recall at k, MRR, nDCG vs. faithfulness és válaszrelevancia, golden set valódi kérdésekből, kalibrált LLM-bíró, evalok a CI-ban.","Ábra: egy RAG-választ két oldalon pontoznak, retrieval metrikákkal, mint a recall at k, az MRR és az nDCG, valamint generálási metrikákkal, mint a faithfulness és a válaszrelevancia, amelyek egy diagnózisba futnak.",{"slug":754,"published":5,"minutes":6,"category":7,"tags":755,"keywords":760,"about":771,"sources":779,"cover":818,"og":819,"expertise":820,"locales":821,"lang":76,"title":822,"description":823,"coverAlt":824},"semantic-product-search-b2b",[756,607,757,758,759],"B2B search","Semantic search","Spryker","OpenSearch",[761,762,763,764,765,766,767,768,769,770],"semantic product search B2B","B2B ecommerce search","hybrid search BM25 vector","part number search ecommerce","Spryker search Elasticsearch","OpenSearch hybrid search RRF","multilingual product search German English Hungarian","zero results rate site search","LLM query understanding ecommerce","AI product search for B2B shops",[772,774,777],{"name":757,"url":773},"https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FSemantic_search",{"name":775,"url":776},"Elasticsearch","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FElasticsearch",{"name":759,"url":778},"https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FOpenSearch",[780,783,786,788,791,794,797,800,803,806,809,812,815],{"title":781,"url":782},"Baymard Institute: E-commerce search query types","https:\u002F\u002Fbaymard.com\u002Fblog\u002Fecommerce-search-query-types",{"title":784,"url":785},"Elastic Search Labs: Hybrid search in Elasticsearch","https:\u002F\u002Fwww.elastic.co\u002Fsearch-labs\u002Fblog\u002Fhybrid-search-elasticsearch",{"title":787,"url":676},"Elasticsearch documentation: kNN query (pre-filters and post-filters)",{"title":789,"url":790},"Elasticsearch documentation: Semantic reranking","https:\u002F\u002Fwww.elastic.co\u002Fdocs\u002Fsolutions\u002Fsearch\u002Franking\u002Fsemantic-reranking",{"title":792,"url":793},"Elasticsearch documentation: Word delimiter graph token filter","https:\u002F\u002Fwww.elastic.co\u002Fdocs\u002Freference\u002Ftext-analysis\u002Fanalysis-word-delimiter-graph-tokenfilter",{"title":795,"url":796},"Elasticsearch documentation: Synonym graph token filter","https:\u002F\u002Fwww.elastic.co\u002Fdocs\u002Freference\u002Ftext-analysis\u002Fanalysis-synonym-graph-tokenfilter",{"title":798,"url":799},"OpenSearch documentation: Score ranker processor (RRF)","https:\u002F\u002Fdocs.opensearch.org\u002Flatest\u002Fsearch-plugins\u002Fsearch-pipelines\u002Fscore-ranker-processor\u002F",{"title":801,"url":802},"OpenSearch documentation: Normalization processor","https:\u002F\u002Fdocs.opensearch.org\u002Flatest\u002Fsearch-plugins\u002Fsearch-pipelines\u002Fnormalization-processor\u002F",{"title":804,"url":805},"Spryker documentation: Search feature overview","https:\u002F\u002Fdocs.spryker.com\u002Fdocs\u002Fpbc\u002Fall\u002Fsearch\u002Flatest\u002Fbase-shop\u002Fsearch-feature-overview\u002Fsearch-feature-overview",{"title":807,"url":808},"Spryker documentation: Migrate from OpenSearch 1.3 to 3.5","https:\u002F\u002Fdocs.spryker.com\u002Fdocs\u002Fpbc\u002Fall\u002Fsearch\u002Flatest\u002Fbase-shop\u002Finstall-and-upgrade\u002Fmigrate-from-opensearch-1.3-to-3.5.html",{"title":810,"url":811},"Instacart via ZenML: Rebuilding query understanding for e-commerce search with LLMs","https:\u002F\u002Fwww.zenml.io\u002Fllmops-database\u002Frebuilding-query-understanding-for-e-commerce-search-with-llms",{"title":813,"url":814},"arXiv: M3-Embedding, multilingual, multi-functionality, multi-granularity text embeddings","https:\u002F\u002Farxiv.org\u002Fabs\u002F2402.03216",{"title":816,"url":817},"Algolia documentation: Search analytics metrics","https:\u002F\u002Fwww.algolia.com\u002Fdoc\u002Fguides\u002Fsearch-analytics\u002Fconcepts\u002Fmetrics\u002F","\u002Fimages\u002Fblog\u002Fsemantic-product-search-b2b\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fsemantic-product-search-b2b\u002Fog.jpg","b2b-ecommerce-developer",[74,75,76],"Szemantikus termékkeresés B2B webshopokban: cikkszámok, hibrid keresés és amit mérned kell","Szemantikus keresés B2B shopban a cikkszámos keresés tönkretétele nélkül: BM25 és vektorok hibridje, szűrők, DE\u002FEN\u002FHU, LLM-es lekérdezés-értelmezés, reranking, mérőszámok.","Diagram: a keresőkérdés azonosító sávra, lexikális BM25-re és vektoros kNN-re oszlik, összefésülődik, újrarangsorolódik, majd találatként jelenik meg.",1791009036607]