[{"data":1,"prerenderedAt":651},["ShallowReactive",2],{"tool-firecrawl-hu":3},{"slug":4,"published":5,"minutes":6,"category":7,"tags":8,"keywords":14,"about":20,"sources":24,"cover":46,"og":47,"expertise":48,"locales":49,"lang":52,"title":53,"description":54,"coverAlt":55,"url":56,"pricing":57,"kind":58,"metaTitle":59,"takeaways":60,"faq":66,"toc":79,"blocks":104,"others":452},"firecrawl","2026-08-25",10,"rag",[9,10,11,12,13],"Web scraping","RAG ingestion","Crawling","MCP","AGPL",[4,15,16,17,18,19],"firecrawl vs apify","firecrawl alternative","web scraping api for llm","firecrawl self-hosting","markdown scraper api",[21],{"name":22,"url":23},"Firecrawl","https:\u002F\u002Fgithub.com\u002Ffirecrawl\u002Ffirecrawl",[25,28,31,34,37,40,43],{"title":26,"url":27},"Firecrawl pricing","https:\u002F\u002Fwww.firecrawl.dev\u002Fpricing",{"title":29,"url":30},"Firecrawl crawl documentation","https:\u002F\u002Fdocs.firecrawl.dev\u002Ffeatures\u002Fcrawl",{"title":32,"url":33},"Firecrawl self-hosting guide","https:\u002F\u002Fdocs.firecrawl.dev\u002Fcontributing\u002Fself-host",{"title":35,"url":36},"Open source or Firecrawl Cloud","https:\u002F\u002Fdocs.firecrawl.dev\u002Fcontributing\u002Fopen-source-or-cloud",{"title":38,"url":39},"Firecrawl benchmarks","https:\u002F\u002Fwww.firecrawl.dev\u002Fbenchmarks",{"title":41,"url":42},"Apify pricing","https:\u002F\u002Fapify.com\u002Fpricing",{"title":44,"url":45},"Browserbase pricing","https:\u002F\u002Fwww.browserbase.com\u002Fpricing","\u002Fimages\u002Fblog\u002Ffirecrawl\u002Fcover.webp","\u002Fimages\u002Fblog\u002Ffirecrawl\u002Fog.jpg","ai-engineer",[50,51,52],"en","de","hu","Firecrawl: webkúszó API RAG pipeline-okhoz, értékeléssel","A Firecrawl egy hosztolt API-jal URL-ekből tiszta Markdownot csinál. Mennyibe kerül, hol hibázik a crawl-számlázás, és mikor érdemes saját AGPL-magját futtatni.","Absztrakt pipeline-grafika a Firecrawl-értékeléshez","https:\u002F\u002Ffirecrawl.dev","Free tier · from $16 per month","Web crawling API","Firecrawl értékelés: webkúszó API RAG-hez · Csorba Balázs",[61,62,63,64,65],"A Firecrawl saját scrape benchmarkje 96%-os lefedettséget, de csak 0,638 F1-et ad: egy oldal tartalmának körülbelül harmada hibás vagy hiányzik.","Egy credit egy oldalra jut scrape, crawl és map esetén; a JSON, Question és Highlight formátum oldalanként további 4 credit.","A befejezett crawl, ahol a completed megegyezik a total értékkel, nem árulja el a hibákat; csak a crawl errors végpont nevezi meg az elveszett oldalakat.","Az AGPL-3.0 licenc alatt futtatható stack a scrape, crawl, map és search műveleteket fedi le; a képernyőképek, az oldalműveletek, a fire-engine, az Agent és az Interact a Cloudon marad.","A crawl feladatok 24 órán át lekérdezhetők, és a Scale csomag alatt a credit nem rolloverezik, így a betöltési állapothoz és a kiadásokhoz is kell keret.",[67,70,73,76],{"q":68,"a":69},"Mennyibe kerül egy dokumentációs oldal crawlolása Firecrawl-lal?","Egy credit jut egy oldalra scrape, crawl és map esetén, tehát egy 500 oldalas crawl 500 credit. A Hobby csomag éves számlázással havi 16 dollár 5.000 credit, a Standard 83 dollár 100.000 credit. A JSON, Question és Highlight formátum oldalanként további 4 credit, a pay-as-you-go pedig 5 dolláros lépésekkel tölti fel az egyenleget.",{"q":71,"a":72},"Elég pontos-e a Firecrawl RAG-hez?","A Firecrawl saját benchmarkja 2026. január 13-án futott 1.000 nyilvános URL-en, és 96%-os lefedettséget meg 0,638 F1-et jelent. Egy oldal már 10% várható tartalom visszaérkezése esetén lefedettnek számít, ezért az F1-et érdemes olvasni, nem a lefedettségi számot. Ez a pontosság jó egy chunkolt, beágyazott korpuszhoz, de túl alacsony táblákból származó pontos értékekhez.",{"q":74,"a":75},"Futtatható-e a Firecrawl saját szerveren?","Igen. A core engine és az API AGPL-3.0 licenc alatt áll, és a self-hosting útmutató Docker Compose-szal indítja a 3002-es porton, egy ellenőrzött release-t pinel a fő branch helyett. Az alap stack a fetch és a Playwright feldolgozással együtt fedi le a scrape, crawl, map és search műveleteket. A képernyőképek, az oldalműveletek, a fire-engine, az Agent és az Interact Cloud funkciók.",{"q":77,"a":78},"Honnan tudom, mely oldalaknak sikerült elbuknia egy crawlnak?","A státuszszámlálókból nem. A total mező a completed, active, queued és backlogged oldalakat összeadja, és kihagyja a hibákat, így egy befejezett jobon a completed megegyezik a total értékkel, függetlenül attól, hogy estek-e ki oldalak. A crawl errors végpont errors és robotsBlocked tömbjei mondják meg, melyek azok.",[80,83,86,89,92,95,98,101],{"id":81,"title":82},"what-it-is","Mi ez",{"id":84,"title":85},"how-it-works","Hogyan működik",{"id":87,"title":88},"getting-started","Első lépések",{"id":90,"title":91},"self-hosting","Saját szerveren",{"id":93,"title":94},"pricing","Árak",{"id":96,"title":97},"where-it-fits","Hol illik és hol nem",{"id":99,"title":100},"verdict","Ítélet",{"id":102,"title":103},"sources","Források",[105,109,117,120,123,164,165,168,177,187,190,223,226,227,230,232,239,246,247,250,262,267,268,271,327,330,336,337,340,386,389,392,393,396,409,413,414],{"type":106,"content":107},"paragraph",[108],"A Firecrawl hosztolt API, amely egy URL-t tiszta Markdowndá, JSON-ná vagy HTML-lé alakít, és egy crawler, amely ugyanezt egy teljes weboldalra elvégzi. Azért létezik, mert szinte minden retrieval pipeline-be végül bekerül a web, és mert egy tetszőleges oldalból nyelvi modell által olvasható szöveget készíteni böngészőautomatizálási probléma, adat tisztítási ruhában. Az ittani ítélet: a legjobb alapértelmezés azoknak a csapatoknak, akik ezen a héten webes kontextust akarnak egy termékbe, és rossz választás annak, aki egresszt akar irányítani, meg akarja tartani a nyers bájtokat, vagy megabajtonként fizet oldal helyett.",{"type":106,"content":110},[111,112,116],"A stackben a fetch réteg és az embedding réteg közé kerül. Egy vektortár soha nem látja a Firecrawl-t, csak az abból kijövő Markdownot. Erről szól az egész: a Firecrawl kevésbé versenyez egy általános scraping könyvtárral, mint a Scrapy-vel, mint a böngészőflottával, a proxy-rotációval és a blokkoló réteggel, amelyet egy csapat amúgy is össze kellene építenie ugyanahhoz a pipeline-hez. Search API-kkal is átfed, mert a ",{"tag":113,"children":114},"code",[115],"\u002Fsearch"," a találati metadatok mellett oldaltartalmat is ad.",{"type":118,"level":119,"id":81,"text":82},"heading",2,{"type":106,"content":121},[122],"Nem az érdekes, hogy a Firecrawl letölti az oldalakat. Az az, hogy kérésenként eldönti, mennyire erősen próbál: először egy statikus letöltés, majd headless böngésző, ha az oldalnak kell, és proxy-rotáció, ha a cél ellenáll. Az API vékony JSON-felület e felett a gépezet felett, a repository pedig az egész engine-t AGPL-3.0 alatt hordozza.",{"type":124,"ordered":125,"items":126},"list",false,[127,140,142,144,146,152,158],[128,129,132,133,136,137],"Végpontok: ",{"tag":113,"children":130},[131],"\u002Fscrape, \u002Fcrawl, \u002Fmap, \u002Fsearch, \u002Fparse, \u002Fbatch\u002Fscrape",", valamint a csak Cloudban lévő ",{"tag":113,"children":134},[135],"\u002Finteract"," és ",{"tag":113,"children":138},[139],"\u002Fagent",[141],"Kimeneti formátumok: Markdown, HTML, nyers linkek, képernyőképek és séma vagy természetes nyelvű prompt alapján kivonatolt JSON.",[143],"Licenc: AGPL-3.0 a core engine-re és az API-ra, MIT az SDK-kra.",[145],"Számlázási egység: egy credit oldalanként scrape, crawl és map esetén, két credit tíz keresési találatonként, két credit böngészőpercenként az Interactben.",[147,148,151],"Ingyenes csomag: havi 1.000 credit, kártya nélkül, két párhuzamos böngésző, tíz kérés percenként a ",{"tag":113,"children":149},[150],"\u002Fscrape"," végponton",[153,154,157],"MCP: kulcs nélküli Streamable HTTP szerver a ",{"tag":113,"children":155},[156],"https:\u002F\u002Fmcp.firecrawl.dev\u002Fv2\u002Fmcp"," címen, ami a Search, Scrape és Parse műveleteket fedi le.",[159,160,163],"Saját szerver: a dokumentáció a ",{"tag":113,"children":161},[162],"v2.11.162"," release-t pinneli, és Docker Compose-szal a 3002-es porton szolgálja ki az API-t.",{"type":118,"level":119,"id":84,"text":85},{"type":106,"content":166},[167],"Minden oldal ugyanazt az utat járja be, függetlenül a végponttól, és éppen ez teszi a crawlt olcsón átgondolhatóvá: amit a scrape tud, azt a crawl minden elért oldalon meg tud. Az alábbi lépések a dokumentáltak, plusz a számlázási lépés, amely eldönti a számlát.",{"type":169,"attrs":170,"inner":174,"caption":175},"diagram",{"viewBox":171,"role":172,"aria-labelledby":173},"0 0 720 280","img","fc-t fc-d","\u003Ctitle id=\"fc-t\">A Firecrawl oldal-pipeline és a creditek elszámolása\u003C\u002Ftitle>\u003Cdesc id=\"fc-d\">Négy lépés halad balról jobbra: letöltés, renderelés, kivonatolás és visszaadás. Az első két lépés alatt egy doboz jelöli a feloldási utat: először statikus letöltés, és headless böngésző, ha az oldalnak kell. Egy második doboz jelöli az elszámolást: egy credit minden visszaadott oldal után, plusz négy credit a JSON kimeneti formátumért. Alatta három sor rögzíti, hogy a crawl oldalanként ugyanezt az utat járja be, hogy a hibás oldalak kiesnek a data tömbből és csak a crawl errors végpont jelzi őket, és hogy a 403 vagy 404 választ adó céloldal is egy creditbe kerül.\u003C\u002Fdesc>\u003Cdefs>\u003Cmarker id=\"fc-a\" viewBox=\"0 0 10 10\" refX=\"9\" refY=\"5\" markerWidth=\"7\" markerHeight=\"7\" orient=\"auto-start-reverse\">\u003Cpath d=\"M0 0L10 5L0 10z\" class=\"d-head\" \u002F>\u003C\u002Fmarker>\u003C\u002Fdefs>\u003Ctext x=\"20\" y=\"26\" class=\"d-title\">FIRECRAWL OLDALPIPELINE\u003C\u002Ftext>\u003Ctext x=\"700\" y=\"26\" text-anchor=\"end\" class=\"d-label\">ugyanaz az út minden végponton\u003C\u002Ftext>\u003Crect x=\"84\" y=\"60\" width=\"120\" height=\"52\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"144\" y=\"92\" text-anchor=\"middle\" class=\"d-text\">letöltés\u003C\u002Ftext>\u003Cpath d=\"M206 86H226\" class=\"d-line\" marker-end=\"url(#fc-a)\" \u002F>\u003Crect x=\"228\" y=\"60\" width=\"120\" height=\"52\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"288\" y=\"92\" text-anchor=\"middle\" class=\"d-text\">renderelés\u003C\u002Ftext>\u003Cpath d=\"M350 86H370\" class=\"d-line\" marker-end=\"url(#fc-a)\" \u002F>\u003Crect x=\"372\" y=\"60\" width=\"120\" height=\"52\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"432\" y=\"92\" text-anchor=\"middle\" class=\"d-text\">kivonatolás\u003C\u002Ftext>\u003Cpath d=\"M494 86H514\" class=\"d-line\" marker-end=\"url(#fc-a)\" \u002F>\u003Crect x=\"516\" y=\"60\" width=\"120\" height=\"52\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"576\" y=\"92\" text-anchor=\"middle\" class=\"d-text\">válasz\u003C\u002Ftext>\u003Crect x=\"84\" y=\"128\" width=\"264\" height=\"56\" rx=\"10\" class=\"d-accent\" \u002F>\u003Ctext x=\"98\" y=\"150\" class=\"d-title\">FELOLDÁS\u003C\u002Ftext>\u003Ctext x=\"98\" y=\"172\" class=\"d-small\">statikusan, böngésző ha kell\u003C\u002Ftext>\u003Crect x=\"372\" y=\"128\" width=\"264\" height=\"56\" rx=\"10\" class=\"d-gold\" \u002F>\u003Ctext x=\"386\" y=\"150\" class=\"d-title\">ELSZÁMLÁLÁS\u003C\u002Ftext>\u003Ctext x=\"386\" y=\"172\" class=\"d-small\">1 credit oldalanként, +4 JSON\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"216\" class=\"d-small\">a crawl oldalanként járja ezt az utat, azonos scrape opciókkal\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"238\" class=\"d-small\">a hibás oldalak kiesnek a data tömbből, csak a hiba-végpont jelzi őket\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"260\" class=\"d-small\">a 403 vagy 404 választ adó céloldal is a data-ba kerül és is egy credit\u003C\u002Ftext>",[176],"Egyetlen scrape út minden végponton, a credit a végén esedékes.",{"type":106,"content":178},[179,180,183,184,186],"Két következmény adódik ebből az alakból. Először a ",{"tag":113,"children":181},[182],"\u002Fcrawl"," ugyanaz a kódút, mint a ",{"tag":113,"children":185},[150],", csak egy várólista előtte, így egy crawl felörökli a scrape minden viselkedését, még azokat is, amelyet senki nem kért. Másodszor a credit akkor íródik le, amikor az oldal létrejön, nem amikor hasznos, és itt kezd csíkkázni a költségmodell.",{"type":106,"content":188},[189],"A gyártó saját scrape benchmarkot publikál, 2026. január 13-án futtatva, tíz kategóriából származó 1.000 nyilvános URL-en, azt mérve, hogy az eszköz visszaadta-e az oldal szövegmagját. A számok pontos olvasást érdemelnek, mert a siker definíciója bőkezű.",{"type":191,"head":192,"rows":197},"table",[193,195],[194],"Metrika",[196],"Firecrawl eredmény",[198,203,208,213,218],[199,201],[200],"Adathalmaz",[202],"1.000 nyilvános URL tíz kategóriából",[204,206],[205],"Lefedettség, sikerarány",[207],"96%",[209,211],[210],"Kivonatolási pontosság, F1",[212],"0,638",[214,216],[215],"Tartalmi visszakeresés",[217],"0,639",[219,221],[220],"Késleltetés, P95",[222],"3.387 ms",{"type":106,"content":224},[225],"Egy oldal akkor számít lefedettnek, ha a várt tartalom legalább 10%-a visszaérkezett, tehát a 96% azt állítja, hogy nem jött vissza semmi, nem azt, hogy a megfelelő jött vissza. Az F1 értéke, 0,638, az őszinte szám, és azt jelenti, hogy egy átlagos oldalon a kivonatolt tartalom körülbelül harmada hibás vagy hiányzik. Ez elég egy olyan korpuszhoz, amit amúgy is chunkolni, beágyazni és szűrni fogunk; nem elég ahhoz a pipeline-hoz, aminek egy táblából kell a pontos érték.",{"type":118,"level":119,"id":87,"text":88},{"type":106,"content":228},[229],"A Python SDK becsomagolja a feladatsort, a lapozást és a lekérdezést, így a legrövidebb hasznos kódrészlet egyben az is, amelyik elrejti a hibaszámlálást. Az alábbi példa egy kis dokumentációs halmazt crawlol, majd közvetlenül az API-tól kérdezi meg, mely oldalakat nem sikerült letöltenie.",{"type":113,"code":231},"import os\nimport time\n\nimport requests\nfrom firecrawl import Firecrawl\n\nkey = os.environ[\"FIRECRAWL_API_KEY\"]\napp = Firecrawl(api_key=key)\n\njob = app.start_crawl(\n    \"https:\u002F\u002Fdocs.example.com\",\n    limit=100,                                # the default is 10000 pages\n    scrape_options={\"formats\": [\"markdown\"], \"only_main_content\": True},\n)\n\n# poll until a terminal status: completed, failed or cancelled\nwhile True:\n    status = app.get_crawl_status(job.id)\n    if status.status in (\"completed\", \"failed\", \"cancelled\"):\n        break\n    time.sleep(5)\n\nprint(len(status.data), \"pages scraped\")\n\n# completed == total does not mean every page arrived\nres = requests.get(\n    f\"https:\u002F\u002Fapi.firecrawl.dev\u002Fv2\u002Fcrawl\u002F{job.id}\u002Ferrors\",\n    headers={\"Authorization\": f\"Bearer {key}\"},\n).json()\n\nfor page in res.get(\"errors\", []):\n    print(\"failed:\", page[\"url\"], page[\"error\"])\n\nprint(\"robots-blocked:\", len(res.get(\"robotsBlocked\", [])))",{"type":106,"content":233},[234,235,238],"Ebben a hívásban két részlet fontosabb, mint elsőre látszik. A crawl limitje alapértelmezés szerint 10.000 oldal, és a végpont 402 hibával utasítja el a feladatot, ha a megmaradt credit nem fedezi a kért limitet, tehát a próbafiókon bekapcsolva hagyott alapértelmezés gyorsan ahhoz vezet, hogy semmi sem történik. És a ",{"tag":113,"children":236},[237],"only_main_content"," távolítja el a navigációt és a láblécet; enélkül a sablonszöveget is fizetjük, és be is ágyazzuk.",{"type":240,"variant":241,"title":242,"body":243},"callout","warn","A crawl eredményei lejárnak",[244],[245],"A feladat eredményei a crawl befejezése után 24 órán át kérdezhetők le az API-ról. Utána csak a tevékenységi napló marad, így mindent, aminek egy elbukott downstream feladaton át kell élnie, ebben az ablakban kell tartós tárolásba írni.",{"type":118,"level":119,"id":90,"text":91},{"type":106,"content":248},[249],"A core AGPL-3.0 alatt nyílt forrású, ami kétszer számít: átvizsgálható, és egy hálózaton kiszolgált módosított változat a forráskódját annak is adja, aki hozzá kapcsolódik. Az alap Compose stack a 3002-es porton indítja az API-t egy PostgreSQL sorral, a Redis-szel és egy Playwright szolgáltatással, és a dokumentáció egy ellenőrzött release-t pinel a fő branch követése helyett.",{"type":124,"ordered":125,"items":251},[252,254,256,258,260],[253],"Alapértelmezés szerint benne van: a scrape, crawl, map és search útvonalak, fetch és Playwright feldolgozással.",[255],"Külön csatlakoztatott provider kell hozzá: az LLM-alapú kivonatolás és a JSON formátumok OpenAI-kompatibilis végpontot vagy Ollamát kérnek.",[257],"Nincs az alap stackben: a fire-engine anti-bot szolgáltatás, a képernyőképek és az oldalműveletek.",[259],"Csak Cloudban: az Agent, a Browser, az Interact, a dashboard és az enterprise vezérlők.",[261],"Szállításkor nem production-ready: a quickstart hitelesítés nélkül és tartós volume-ok nélkül indul.",{"type":240,"variant":241,"title":263,"body":264},"Hol húzódik a licenc határa",[265],[266],"A repository AGPL-3.0 alatt áll, az SDK-k viszont MIT alatt, ami szokatlan helyre teszi a határt: a klienskönyvtár megengedő, a futtatott szolgáltatás nem. Aki egy termék részeként egy módosított deploymentet fontolgat, olvassa el a 13. szakaszt, mielőtt feltételezi, hogy a megengedő SDK bármit is engedne.",{"type":118,"level":119,"id":93,"text":94},{"type":106,"content":269},[270],"Minden egyetlen credit-egyenlegen fut le. A díjszabás minden csomagban azonos, így a költségtervezés oldalszám kérdés lesz, nem csomagszintű kérdés; csak a limitek mozognak.",{"type":191,"head":272,"rows":281},[273,275,277,279],[274],"Csomag",[276],"Havi credit",[278],"Párhuzamos böngészők",[280],"Rate limit a \u002Fscrape, \u002Fmap és \u002Fsearch végponton",[282,291,300,309,318],[283,285,287,289],[284],"Free",[286],"1.000",[288],"2",[290],"10 \u002F perc",[292,294,296,298],[293],"Hobby, évente $16",[295],"5.000",[297],"5",[299],"100 \u002F perc",[301,303,305,307],[302],"Standard, évente $83",[304],"100.000",[306],"25",[308],"500 \u002F perc",[310,312,314,316],[311],"Growth, évente $333",[313],"500.000",[315],"50",[317],"5.000 \u002F perc",[319,321,323,325],[320],"Scale, évente $599",[322],"1.000.000",[324],"100",[326],"10.000 \u002F perc",{"type":106,"content":328},[329],"Az egységgazdaságtan elég egyszerű ahhoz, hogy utánaszámolható legyen. A havi 16 dolláros Hobby csomag 5.000 oldalt ad, ami körülbelül 0,003 dollár oldalonként az első 5.000-re, utána pedig 5 dollár minden további 1.000 credit. Három dolog töri ezt a számítást. A JSON, Question és Highlight formátumok oldalanként további 4 creditet adnak a alapdíjhoz. Az Interact böngészőpercenként 2 creditet számol, nem oldalanként. És az az oldal, amely 403 vagy 404 választ ad, visszaadásra kerül, és 1 creditet fizet; a tele 404-es oldalakból álló webhely ezért valódi számla, nem kerekítési hiba.",{"type":240,"variant":331,"title":332,"body":333},"tip","Két számlázási alapérték, amit érdemes átírni",[334],[335],"A fel nem használt credit a Hobby, Standard és Growth csomagokban nem rolloverezik, tehát egy kihasználatlan hónap elveszett pénz, nem tartalék. A pay-as-you-go pedig 5 dolláros lépésekkel tölti fel az egyenleget a regisztrált kártyán, ha nincs havi limit beállítva, és ez a különbség a meglepetés és a könyvelési tétel között.",{"type":118,"level":119,"id":96,"text":97},{"type":106,"content":338},[339],"Először a gyengeségek. A crawl számlázása nem tudja megmondani, hogy tiszta volt-e a futás: a total számláló a completed, active, queued és backlogged oldalakat összeadja, és kihagyja a hibákat, így egy befejezett feladaton a completed megegyezik a total értékkel, függetlenül attól, kiestek-e oldalak, és csak a crawl errors végpont nevezi meg őket. A felderítés sem determinisztikus, mert az oldalak párhuzamosan jönnek, és a linkek sorrendje a hálózati időzítést követi. A keresés oldalán a Firecrawl saját benchmarkoldala a többkörös felfedezésen tizenkettesik a tizenhat konfiguráció közül, 30,4-es F1-gyel, míg a csak keresésen alapuló kódolási feladatokon második. Ez erős fetcher, amihez keresőtermék van csatolva, nem erős keresőtermék.",{"type":191,"head":341,"rows":350},[342,344,346,348],[343],"Eszköz",[345],"Mit ad el",[347],"Számlázási egység",[349],"Miben nyer",[351,359,368,377],[352,353,355,357],[22],[354],"Egy API a scrape, crawl, map, search és parse műveletekhez, Markdownot ad vissza",[356],"Credit oldalanként",[358],"Tiszta Markdown, alig kell utómunka",[360,362,364,366],[361],"Apify",[363],"Automatizálási platform: Actorok, adathalmazok, proxyk, ütemezés",[365],"Számítási egység, egy CU egy óra alatt 1 GB, plusz proxyk és tárhely",[367],"Szabálytalan oldalak, amelyek saját kódot vagy proxyválasztást igényelnek",[369,371,373,375],[370],"Browserbase",[372],"Menedzselt böngésző-munkamenetek plusz Fetch és Search API",[374],"Böngészőórák, $0,12 óránként a Developer csomagban az első 100 után",[376],"Interaktív folyamatok: belépés, kattintási útvonalak, állapottartó munkamenetek",[378,380,382,384],[379],"Scrapy és Playwright",[381],"Könyvtárak, amelyeket saját magad futtatsz, a teljes pipeline a kezedben",[383],"Saját infrastruktúra és saját idő",[385],"Kiszámítható költség nagy volumen mellett, és nincs szállító a körben",{"type":106,"content":387},[388],"Az összehasonlítás nem egyforma, és a különböző fajta az hasznos rész. A Firecrawl és a Browserbase is egy fetch-eredményt ad el. Az Apify számítást ad el egy piactérrel együtt. A Scrapy és a Playwright semmit nem ad el, és csak figyelmet fizet. Egy fix betöltési célhoz, stabil HTML struktúrával egy saját szerveren futtatott crawler még mindig olcsóbb oldalanként bármelyiknél, mert a határköltség egy core és egy sor ahelyett, hogy credit.",{"type":106,"content":390},[391],"Itt van a lock-in kérdés is. A Firecrawl Cloudban vannak a jó részek: a fire-engine, a képernyőképek, az oldalműveletek, az Interact és az Agent mind Cloud funkcióként dokumentáltak. A saját szerver az AGPL-3.0 alatti core engine-t adja és keveset mást, ami szűkebb ajánlat, mint a repository népszerűsége sugallja.",{"type":118,"level":119,"id":99,"text":100},{"type":106,"content":394},[395],"A Firecrawl megérdemli az átvételt a betöltési problémára, és érdemes távol tartani a keresési problémától. A 0,638-as kivonatolási F1 elfogadható, éppen azért, mert a chunkelés és a visszakeresés elnyeli a kivonatolási hiba egy részét, a creditmodell kiszámítható, és egy böngészőflotta, proxykészlet és blokkoló réteg üzemeltetése valódi operatív munka, amit a legtöbb termékcsapatnak nem kellene a vállára vennie. Az ellenérv szűk, de éles: ha az oldaltartalomnak pontosnak kell lennie, vagy ha az egress és az adat helye a valódi megkötés, akkor a credit a rossz dolgot vásárolja.",{"type":124,"ordered":397,"items":398},true,[399,401,403,405,407],[400],"Vedd át, ha egy terméknek most kell webes tartalom, és a céloldalak szokásos HTML-ek vagy dokumentációk.",[402],"Vedd át agent- és MCP-integrációhoz. A kulcs nélküli Streamable HTTP szerver és a CLI skillek a legrövidebb út egy agenttől egy olvasható oldalig.",[404],"Az ingyenes csomaggal nézd meg, hogy a kivonatolási minőség illik-e a korpuszodhoz. A havi 1.000 credit ehhez bőven elég.",[406],"Ne vetted át kereső API-ként. A cég saját többkörös benchmarkján a mező végén áll, és eredményenként számol.",[408],"Ne vetted át táblákból, hivatalos dokumentumokból vagy árakból való pontos kivonatolásra. Budgetálj egy ellenőrző körre, vagy használj olyan forrást, amely strukturált adatot ad.",{"type":410,"content":411},"quote",[412],"A Firecrawl-t legjobban renderelő szolgáltatásként érdemes érteni, amelyhez JSON API van csatolva. Amit korábban Playwrightből és proxy-előfizetésből építettek volna, azt mostantól oldalanként kell megvenni. Amit sitemapből és ütemezett jobból építettek, azt továbbra is érdemes saját kezbe venni.",{"type":118,"level":119,"id":102,"text":103},{"type":124,"ordered":397,"items":415},[416,422,427,432,437,442,447],[417,421],{"tag":418,"href":27,"children":419},"a",[420],"Firecrawl árazás"," — credit díjak, csomag limitek, rollover és pay-as-you-go szabályok, 2026. szeptember 4-től érvényben",[423,426],{"tag":418,"href":30,"children":424},[425],"Firecrawl crawl dokumentáció"," — státuszszámlálók, lapozási szerződés, a hibavégpont és a crawl konfigurációs referencia",[428,431],{"tag":418,"href":33,"children":429},[430],"Firecrawl self-hosting útmutató"," — a rögzített release, a Compose stack és az alap build hiányzó képességei",[433,436],{"tag":418,"href":36,"children":434},[435],"Open source vagy Firecrawl Cloud"," — mely képességek melyik működési modellhez tartoznak",[438,441],{"tag":418,"href":39,"children":439},[440],"Firecrawl benchmarkok"," — a 2026. januári scrape futás és a hivatkozott harmadik fél keresési vizsgálatai",[443,446],{"tag":418,"href":42,"children":444},[445],"Apify árazás"," — számítási egységek, proxy díjak és az előre fizetett használat az összehasonlító táblához",[448,451],{"tag":418,"href":45,"children":449},[450],"Browserbase árazás"," — böngészőórák, valamint Fetch és Search hívási díjak az összehasonlító táblához",[453,503,559,601],{"slug":454,"published":455,"minutes":456,"category":7,"tags":457,"keywords":463,"about":472,"sources":476,"cover":495,"og":496,"expertise":48,"locales":497,"lang":52,"title":498,"description":499,"coverAlt":500,"url":501,"pricing":502,"kind":458},"zep","2026-10-06",11,[458,459,460,461,462],"Agent memory","Knowledge graph","Temporal graph","Context engineering","RAG",[464,465,466,467,468,469,470,471],"zep ai","zep agent memory","graphiti knowledge graph","zep pricing","zep vs mem0","long-term memory for agents","temporal knowledge graph","zep cloud",[473],{"name":474,"url":475},"Zep","https:\u002F\u002Fwww.getzep.com\u002F",[477,480,483,486,489,492],{"title":478,"url":479},"Zep pricing: plans, credits and limits","https:\u002F\u002Fwww.getzep.com\u002Fpricing",{"title":481,"url":482},"Zep documentation","https:\u002F\u002Fhelp.getzep.com\u002F",{"title":484,"url":485},"Graphiti on GitHub","https:\u002F\u002Fgithub.com\u002Fgetzep\u002Fgraphiti",{"title":487,"url":488},"Graphiti product page","https:\u002F\u002Fwww.getzep.com\u002Fplatform\u002Fgraphiti\u002F",{"title":490,"url":491},"Announcing a new direction for Zep's open-source strategy","https:\u002F\u002Fwww.getzep.com\u002Fblog\u002Fannouncing-a-new-direction-for-zeps-open-source-strategy\u002F",{"title":493,"url":494},"Graphiti: temporal knowledge graphs for AI agents (arXiv)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2501.13956","\u002Fimages\u002Fblog\u002Fzep\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fzep\u002Fog.jpg",[50,51,52],"Zep ismertető: ügynök-memory temporális gráfon","A Zep hostolt ügynök-memory API temporális tudásgráfon: kreditek íráskor, lekérdezés ingyen, Flex 125 dollártól havonta, a Graphiti az a rész, amit magunk üzemeltethetünk.","A Zep diagramja arról, hogyan jut el egy tény a promptig: az üzeneteket és tényeket felhasználónkénti entitás- és kapcsolatgráffá bontják, a lekérdezés pedig bejárja a gráfot, és kontextusblokkot ad vissza a támasztó tényekkel.","https:\u002F\u002Fwww.getzep.com","Apache-2.0 core · Cloud from $50 per month",{"slug":504,"published":505,"minutes":506,"category":7,"tags":507,"keywords":511,"about":519,"sources":526,"cover":551,"og":552,"expertise":48,"locales":553,"lang":52,"title":554,"description":555,"coverAlt":556,"url":557,"pricing":558,"kind":521},"lancedb","2026-09-21",9,[508,509,510,462],"Vector search","Hybrid search","Embedded database",[504,512,513,514,515,516,517,518],"lancedb review","lance vector database","embedded vector database","lancedb vs qdrant","hybrid search rrf","lancedb indexing","lance data format",[520,523],{"name":521,"url":522},"Vector database","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FVector_database",{"name":524,"url":525},"Apache Arrow","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FApache_Arrow",[527,530,533,536,539,542,545,548],{"title":528,"url":529},"LanceDB quickstart","https:\u002F\u002Fdocs.lancedb.com\u002Fquickstart",{"title":531,"url":532},"LanceDB vector indexes","https:\u002F\u002Fdocs.lancedb.com\u002Findexing\u002Fvector-index",{"title":534,"url":535},"LanceDB indexing guide","https:\u002F\u002Fdocs.lancedb.com\u002Findexing\u002Findex",{"title":537,"url":538},"LanceDB hybrid search","https:\u002F\u002Fdocs.lancedb.com\u002Fsearch\u002Fhybrid-search",{"title":540,"url":541},"LanceDB Enterprise","https:\u002F\u002Fdocs.lancedb.com\u002Fenterprise",{"title":543,"url":544},"LanceDB frequently asked questions","https:\u002F\u002Fdocs.lancedb.com\u002Ffaq\u002Ffaq-oss",{"title":546,"url":547},"LanceDB pricing","https:\u002F\u002Flancedb.com\u002Fpricing",{"title":549,"url":550},"LanceDB on PyPI","https:\u002F\u002Fpypi.org\u002Fproject\u002Flancedb\u002F","\u002Fimages\u002Fblog\u002Flancedb\u002Fcover.webp","\u002Fimages\u002Fblog\u002Flancedb\u002Fog.jpg",[50,51,52],"LanceDB: vektoros keresés, amely könyvtárként indul","A LanceDB értékelése: Apache-2.0 beágyazott vektoros könyvtár szerver helyett, az IVF és HNSW indexválasztás, hibrid keresés rangsoregyesítéssel, és mit ad hozzá az Enterprise.","A LanceDB teszt borítóképe: egy Lance-tábla vektorindexet és teljes szöveges indexet táplál egy fúziós rangsorba","https:\u002F\u002Flancedb.com","Apache-2.0 · Cloud paid",{"slug":560,"published":505,"minutes":6,"category":7,"tags":561,"keywords":565,"about":572,"sources":578,"cover":593,"og":594,"expertise":48,"locales":595,"lang":52,"title":596,"description":597,"coverAlt":598,"url":574,"pricing":599,"kind":600},"pgvector",[508,562,563,462,564],"Postgres","HNSW","Quantisation",[560,566,567,568,569,570,571],"pgvector vs qdrant","postgres vector search","hnsw index postgres","iterative index scans","binary quantization postgres","vector database postgres",[573,575],{"name":560,"url":574},"https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector",{"name":576,"url":577},"PostgreSQL","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FPostgreSQL",[579,581,584,587,590],{"title":580,"url":574},"pgvector README",{"title":582,"url":583},"pgvector changelog","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FCHANGELOG.md",{"title":585,"url":586},"PostgreSQL news: pgvector 0.8.2 released","https:\u002F\u002Fwww.postgresql.org\u002Fabout\u002Fnews\u002Fpgvector-082-released-3245\u002F",{"title":588,"url":589},"AWS: Scale pgvector with binary quantization","https:\u002F\u002Faws.amazon.com\u002Fblogs\u002Fdatabase\u002Fscale-pgvector-with-binary-quantization-on-amazon-aurora-postgresql\u002F",{"title":591,"url":592},"pgvector licence","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FLICENSE","\u002Fimages\u002Fblog\u002Fpgvector\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fpgvector\u002Fog.jpg",[50,51,52],"pgvector, értékelés: az a vektordatázis, amelyet nem kell üzemeltetned","Értékelés a pgvector 0.8.7-ről: iteratív indexszkennelés szűrt kereséshez, HNSW és IVFFlat, bináris kvantizálás 100 millió vektornál, és a CVE, amely az indexépítést javítási tétellé tette.","A lekérdezés felül három útra bontakozik: pontos szekvenciális szkennelés, HNSW gráfjárás és IVFFlat vizsgálat; alul egy iteratív szkennelés folytatódik, amíg a limit kitelik.","PostgreSQL licence","Vector database extension",{"slug":602,"published":603,"minutes":6,"category":7,"tags":604,"keywords":606,"about":612,"sources":616,"cover":644,"og":645,"expertise":48,"locales":646,"lang":52,"title":647,"description":648,"coverAlt":649,"url":615,"pricing":650,"kind":458},"mem0","2026-09-17",[458,605,462,508],"Long-term memory",[602,607,608,609,610,469,611],"mem0 review","agent memory layer","mem0 self-hosted","mem0 pricing","mem0 alternatives",[613],{"name":614,"url":615},"Mem0","https:\u002F\u002Fmem0.ai",[617,620,623,626,629,632,635,638,641],{"title":618,"url":619},"Mem0 documentation","https:\u002F\u002Fdocs.mem0.ai\u002Fintroduction",{"title":621,"url":622},"Mem0 quickstart","https:\u002F\u002Fdocs.mem0.ai\u002Fquickstart",{"title":624,"url":625},"How Mem0 works","https:\u002F\u002Fdocs.mem0.ai\u002Fcore-concepts\u002Fhow-it-works",{"title":627,"url":628},"Mem0 pricing","https:\u002F\u002Fmem0.ai\u002Fpricing",{"title":630,"url":631},"Mem0 on GitHub","https:\u002F\u002Fgithub.com\u002Fmem0ai\u002Fmem0",{"title":633,"url":634},"mem0ai on PyPI","https:\u002F\u002Fpypi.org\u002Fproject\u002Fmem0ai\u002F",{"title":636,"url":637},"Mem0 research and benchmarks","https:\u002F\u002Fmem0.ai\u002Fresearch",{"title":639,"url":640},"Mem0 MCP server","https:\u002F\u002Fdocs.mem0.ai\u002Fplatform\u002Fmem0-mcp",{"title":642,"url":643},"Mem0 paper on arXiv","https:\u002F\u002Farxiv.org\u002Fabs\u002F2504.19413","\u002Fimages\u002Fblog\u002Fmem0\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fmem0\u002Fog.jpg",[50,51,52],"Mem0: mennyibe kerül egy ügynökmemória körönként","A Mem0 elemzése: körönként kinyert tények, az április 2026-i benchmark tábla platformra vonatkozó fenntartása, négy felhő-csomag és ami kimarad az önálló üzemeltetésből.","Hurok, amely a beszélgetésből tárolt tényeket készít, majd visszaolvasja őket a promptba","Free tier · from $19 per month",1791383550107]