[{"data":1,"prerenderedAt":642},["ShallowReactive",2],{"tool-mem0-de":3},{"slug":4,"published":5,"minutes":6,"category":7,"tags":8,"keywords":13,"about":20,"sources":24,"cover":52,"og":53,"expertise":54,"locales":55,"lang":57,"title":59,"description":60,"coverAlt":61,"url":23,"pricing":62,"kind":9,"metaTitle":63,"takeaways":64,"faq":70,"toc":83,"blocks":108,"others":446},"mem0","2026-09-17",10,"rag",[9,10,11,12],"Agent memory","Long-term memory","RAG","Vector search",[4,14,15,16,17,18,19],"mem0 review","agent memory layer","mem0 self-hosted","mem0 pricing","long-term memory for agents","mem0 alternatives",[21],{"name":22,"url":23},"Mem0","https:\u002F\u002Fmem0.ai",[25,28,31,34,37,40,43,46,49],{"title":26,"url":27},"Mem0 documentation","https:\u002F\u002Fdocs.mem0.ai\u002Fintroduction",{"title":29,"url":30},"Mem0 quickstart","https:\u002F\u002Fdocs.mem0.ai\u002Fquickstart",{"title":32,"url":33},"How Mem0 works","https:\u002F\u002Fdocs.mem0.ai\u002Fcore-concepts\u002Fhow-it-works",{"title":35,"url":36},"Mem0 pricing","https:\u002F\u002Fmem0.ai\u002Fpricing",{"title":38,"url":39},"Mem0 on GitHub","https:\u002F\u002Fgithub.com\u002Fmem0ai\u002Fmem0",{"title":41,"url":42},"mem0ai on PyPI","https:\u002F\u002Fpypi.org\u002Fproject\u002Fmem0ai\u002F",{"title":44,"url":45},"Mem0 research and benchmarks","https:\u002F\u002Fmem0.ai\u002Fresearch",{"title":47,"url":48},"Mem0 MCP server","https:\u002F\u002Fdocs.mem0.ai\u002Fplatform\u002Fmem0-mcp",{"title":50,"url":51},"Mem0 paper on arXiv","https:\u002F\u002Farxiv.org\u002Fabs\u002F2504.19413","\u002Fimages\u002Fblog\u002Fmem0\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fmem0\u002Fog.jpg","ai-engineer",[56,57,58],"en","de","hu","Mem0: was eine Agent-Speicherschicht pro Runde kostet","Ein Review von Mem0: extrahierte Fakten pro Runde, die Benchmark-Tabelle vom April 2026 mit Plattform-Vorbehalt, vier Cloud-Stufen und die Lücken beim Self-Hosting.","Eine Schleife, die aus Gespräch gespeicherte Fakten macht und sie zurück in den Prompt liest","Free tier · from $19 per month","Mem0-Test: Speicher mit Kosten pro Runde · Balázs Csorba",[65,66,67,68,69],"Mem0 macht aus Gespräch gespeicherte Fakten: Ein LLM extrahiert, dedupliziert und bettet sie ein, jeder Schreibvorgang kostet also einen Modellaufruf zusätzlich zum Speichern.","Der aktuelle Algorithmus erreicht auf LoCoMo 92,5 und auf LongMemEval 94,4, und das README sagt, dass diese Zahlen von der verwalteten Plattform stammen, nicht vom Open-Source-SDK.","Die Cloud-Stufen sind Hobby kostenlos, Starter für 19 Dollar im Monat und Pro für 249 Dollar im Monat; Graph Memory und Dream Consolidation sind erst ab Pro enthalten.","Die Open-Source-Retrieval hat keinen Graph Memory und verstärkt nur über Entitäts-Overlap, wer selbst hostet, kauft also die API und nicht die Benchmark-Tabellen.","Die kostenlose Stufe erlaubt 10.000 Add- und 1.000 Retrieval-Anfragen pro Monat, also rund 33 Suchanfragen am Tag.",[71,74,77,80],{"q":72,"a":73},"Ist Mem0 für Self-Hosting kostenlos?","Die Bibliothek steht unter Apache-2.0, und das README bietet einen docker-compose-Server mit standardmäßig eingeschalteter Authentifizierung, also keine Lizenzgebühr. Für die Extraktion braucht es weiterhin ein LLM, standardmäßig gpt-5-mini, und einen Vektorstore, standardmäßig Qdrant — die Kosten wandern zu Inferenz und Betrieb, nicht in ein Abo.",{"q":75,"a":76},"Mem0 oder eine Zusammenfassung des Transkripts in Postgres?","Wenn ein Produkt je Nutzer eine kurze Sitzung hat, sind eine rollierende Zusammenfassung und eine Faktentabelle günstiger, leichter zu prüfen und ohne Extraktionsschritt, der einen Fakt erfinden kann. Mem0 lohnt sich, wenn Erinnerungen Sitzungen überdauern, je Nutzer, Agent und Lauf gefiltert werden müssen und auf dem Hot Path jeder Anfrage gelesen werden.",{"q":78,"a":79},"Reicht die Open-Source-Version für die veröffentlichten Benchmark-Werte?","Nein, und das Repositorium sagt das: die Zahlen spiegeln die verwaltete Plattform, die proprietäre Optimierungen enthält, die es im Open-Source-SDK nicht gibt. Open-Source-Retrieval besitzt keinen Graph Memory und hängt vom konfigurierten Vektorstore ab.",{"q":81,"a":82},"Wie erreicht Mem0 einen Agenten, der bereits MCP spricht?","Über einen gehosteten Server auf mcp.mem0.ai per HTTPS mit elf Werkzeugen, darunter add_memory, search_memories, update_memory und delete_memory. Er authentifiziert über einen Browser-Sign-in oder einen als Bearer-Token gesendeten API-Key, und auf der Maschine des Entwicklers läuft nichts.",[84,87,90,93,96,99,102,105],{"id":85,"title":86},"what-it-is","Was es ist",{"id":88,"title":89},"how-it-works","Wie es funktioniert",{"id":91,"title":92},"getting-started","Erste Schritte",{"id":94,"title":95},"benchmarks","Benchmarks",{"id":97,"title":98},"pricing","Preise",{"id":100,"title":101},"where-it-shingles","Wo es hakt",{"id":103,"title":104},"verdict","Fazit",{"id":106,"title":107},"sources","Quellen",[109,113,116,119,131,149,150,153,162,165,166,181,183,190,201,202,205,262,265,275,276,279,324,327,328,331,377,380,385,386,389,402,406,407],{"type":110,"content":111},"paragraph",[112],"Mem0 ist eine Speicherschicht für Agenten: Gespräch hinein, Fakten heraus, und die Fakten werden vor dem nächsten Modellaufruf zurückgeholt. Die hier vertretene Position ist, dass es die sorgfältigste Memory-API dieses Marktes und zugleich eine schlechte Wahl ist, denn ein LLM-Aufruf sitzt auf dem Schreibpfad — Erinnern wird pro Runde abgerechnet, nicht pro Nutzer. Es lohnt sich, wenn Erinnerungen Sitzungen überdauern und je Nutzer, Agent und Lauf gefiltert werden müssen; eine rollierende Zusammenfassung mit einer Tabelle ist besser, wenn das nicht der Fall ist.",{"type":110,"content":114},[115],"Es sitzt zwischen Anwendung und Modell, ersetzt das Anhängen von Transkript an den Prompt und konkurriert mit Zep, LangMem, Letta und dem, was Teams aus einer Datenbank und einem Zusammenfassungsschritt bauen. Geliefert wird in drei Formen unter einer API: eine Bibliothek unter Apache-2.0, ein selbst gehosteter Server hinter docker compose mit standardmäßig eingeschalteter Authentifizierung und eine gehostete Plattform mit Dashboard, metered Tarifen und MCP-Endpunkt.",{"type":117,"level":118,"id":85,"text":86},"heading",2,{"type":110,"content":120},[121,122,126,127,130],"Zwei Produkte tragen denselben Namen. Das Open-Source-Repositorium ist die ",{"tag":123,"children":124},"code",[125],"mem0ai","-Bibliothek für Python und JavaScript, eingebettet in einen Prozess; die Plattform ist eine gehostete API mit Scopes, Tarifen und Dashboard, die dasselbe SDK über HTTPS unter ",{"tag":123,"children":128},[129],"api.mem0.ai"," erreicht. Die Homepage führte Anfang Oktober 2026 62.590 GitHub-Stars auf.",{"type":132,"ordered":133,"items":134},"list",false,[135,137,139,141,143,145,147],[136],"Auf PyPI als mem0ai, Version 2.2.1, unter Apache-2.0 veröffentlicht, mit einem passenden JavaScript-Paket.",[138],"Drei Betriebsmodi im README: Bibliothek für einen Prototyp, ein docker-compose-Server mit standardmäßig eingeschalteter Authentifizierung für ein Team und die Cloud-Plattform ohne Betriebsaufwand.",[140],"Die Operationen sind add, search, get_all, update und delete, jede mit user_id, agent_id, app_id oder run_id als Scope.",[142],"Schreibvorgänge werden abgeleitet: Ein LLM extrahiert dauerhafte Fakten, dedupliziert und bettet sie ein; infer=False speichert die Rohmeldung stattdessen.",[144],"Voreinstellungen sind gpt-5-mini für die Extraktion und text-embedding-3-small für die Einbettungen, mit Qdrant als mitgeliefertem Vektorstore.",[146],"Gehosteter MCP-Server auf mcp.mem0.ai mit elf Speicherwerkzeugen, authentifiziert über Browser-Sign-in oder einen API-Key als Bearer-Token.",[148],"Compliance laut Homepage: SOC 2 Typ 1, HIPAA und GDPR, mit BYOK und On-Premises-Deployment in der Enterprise-Stufe.",{"type":117,"level":118,"id":88,"text":89},{"type":110,"content":151},[152],"Die Pipeline ist asymmetrisch, und diese Asymmetrie ist das Produkt. Beim Add sucht Mem0 verwandte Erinnerungen, damit derselbe Fakt nicht doppelt gespeichert wird, extrahiert neue Fakten mit einem LLM, dedupliziert und bettet sie ein, zieht Entitäten heraus und schreibt in einen SQL-Store für Fakten, einen Vektorstore für Einbettungen und einen Entitätsstore für Verbindungen. Beim Search werden vier Signale bewertet und verschmolzen: semantische Ähnlichkeit, Keyword-Matching, Entitäts-Overlap und ein Zeit-Signal aus den Metadaten der Extraktionszeit.",{"type":154,"attrs":155,"inner":159,"caption":160},"diagram",{"viewBox":156,"role":157,"aria-labelledby":158},"0 0 720 380","img","d-m0-t d-m0-d","\u003Ctitle id=\"d-m0-t\">How a memory is written and read\u003C\u002Ftitle>\u003Cdesc id=\"d-m0-d\">A conversation box on the left feeds an extraction box in the middle, labelled one LLM call and ADD only, which produces facts rather than transcripts. An arrow continues to a deduplicate box that embeds the facts and links entities. From there the flow fans out into three stores: a SQL store for facts and metadata, a vector store for embeddings, and an entity store for boosting. The three stores merge into a search box at the bottom, labelled semantic, keyword, entity and time. A long return arrow runs from the search box back to the conversation box, labelled memories into the prompt, which closes the loop. A label at the top right reads one model call on the write path.\u003C\u002Fdesc>\u003Cdefs>\u003Cmarker id=\"m0-arrow\" viewBox=\"0 0 10 10\" refX=\"9\" refY=\"5\" markerWidth=\"7\" markerHeight=\"7\" orient=\"auto-start-reverse\">\u003Cpath d=\"M0 0L10 5L0 10z\" class=\"d-head\" \u002F>\u003C\u002Fmarker>\u003C\u002Fdefs>\u003Ctext x=\"20\" y=\"26\" class=\"d-title\">How a memory is written and read\u003C\u002Ftext>\u003Ctext x=\"700\" y=\"26\" text-anchor=\"end\" class=\"d-label\">one model call on the write path\u003C\u002Ftext>\u003Crect x=\"30\" y=\"48\" width=\"180\" height=\"64\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"120\" y=\"74\" text-anchor=\"middle\" class=\"d-text\">Conversation\u003C\u002Ftext>\u003Ctext x=\"120\" y=\"96\" text-anchor=\"middle\" class=\"d-small\">user and assistant turns\u003C\u002Ftext>\u003Cpath d=\"M214 80 H244\" class=\"d-line\" marker-end=\"url(#m0-arrow)\" \u002F>\u003Crect x=\"250\" y=\"40\" width=\"210\" height=\"80\" rx=\"10\" class=\"d-accent\" \u002F>\u003Ctext x=\"355\" y=\"68\" text-anchor=\"middle\" class=\"d-text\">Extraction\u003C\u002Ftext>\u003Ctext x=\"355\" y=\"90\" text-anchor=\"middle\" class=\"d-small\">one LLM call, ADD only\u003C\u002Ftext>\u003Ctext x=\"355\" y=\"110\" text-anchor=\"middle\" class=\"d-small\">facts, not transcripts\u003C\u002Ftext>\u003Cpath d=\"M464 80 H494\" class=\"d-line\" marker-end=\"url(#m0-arrow)\" \u002F>\u003Crect x=\"500\" y=\"48\" width=\"190\" height=\"64\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"595\" y=\"74\" text-anchor=\"middle\" class=\"d-text\">Deduplicate\u003C\u002Ftext>\u003Ctext x=\"595\" y=\"96\" text-anchor=\"middle\" class=\"d-small\">embed and link entities\u003C\u002Ftext>\u003Cpath d=\"M595 112 V150\" class=\"d-line\" \u002F>\u003Cpath d=\"M130 150 H595\" class=\"d-line\" \u002F>\u003Cpath d=\"M130 150 V184\" class=\"d-line\" marker-end=\"url(#m0-arrow)\" \u002F>\u003Cpath d=\"M360 150 V184\" class=\"d-line\" marker-end=\"url(#m0-arrow)\" \u002F>\u003Cpath d=\"M590 150 V184\" class=\"d-line\" marker-end=\"url(#m0-arrow)\" \u002F>\u003Crect x=\"30\" y=\"190\" width=\"200\" height=\"68\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"130\" y=\"216\" text-anchor=\"middle\" class=\"d-text\">SQL store\u003C\u002Ftext>\u003Ctext x=\"130\" y=\"240\" text-anchor=\"middle\" class=\"d-small\">facts and metadata\u003C\u002Ftext>\u003Crect x=\"260\" y=\"190\" width=\"200\" height=\"68\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"360\" y=\"216\" text-anchor=\"middle\" class=\"d-text\">Vector store\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"240\" text-anchor=\"middle\" class=\"d-small\">embeddings\u003C\u002Ftext>\u003Crect x=\"490\" y=\"190\" width=\"200\" height=\"68\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"590\" y=\"216\" text-anchor=\"middle\" class=\"d-text\">Entity store\u003C\u002Ftext>\u003Ctext x=\"590\" y=\"240\" text-anchor=\"middle\" class=\"d-small\">links for boosting\u003C\u002Ftext>\u003Cpath d=\"M130 258 V278\" class=\"d-line\" \u002F>\u003Cpath d=\"M360 258 V278\" class=\"d-line\" \u002F>\u003Cpath d=\"M590 258 V278\" class=\"d-line\" \u002F>\u003Cpath d=\"M130 278 H590\" class=\"d-line\" \u002F>\u003Cpath d=\"M360 278 V294\" class=\"d-line\" marker-end=\"url(#m0-arrow)\" \u002F>\u003Crect x=\"250\" y=\"300\" width=\"220\" height=\"64\" rx=\"10\" class=\"d-mint\" \u002F>\u003Ctext x=\"360\" y=\"326\" text-anchor=\"middle\" class=\"d-text\">Search\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"348\" text-anchor=\"middle\" class=\"d-small\">semantic, keyword, entity, time\u003C\u002Ftext>\u003Cpath d=\"M250 332 H14 V80 H26\" class=\"d-line d-dash\" marker-end=\"url(#m0-arrow)\" \u002F>\u003Ctext x=\"30\" y=\"290\" class=\"d-label\">memories into\u003C\u002Ftext>\u003Ctext x=\"30\" y=\"306\" class=\"d-label\">the prompt\u003C\u002Ftext>",[161],"Fakten werden pro Add einmal extrahiert und über einen gefilterten Search zurückgeholt; die Open-Source-Version hat keinen Entitäts-Graphen, ihr Entitäts-Signal ist Overlap auf extrahierten Begriffen.",{"type":110,"content":163},[164],"Die Dokumentation sagt klar, was daraus folgt: Die Plattform verschmilzt alle vier Signale mit Graph-gestütztem Entity Matching, die Open-Source-Version hat keinen Graph Memory und verstärkt nur über den Entitäts-Overlap, abhängig vom konfigurierten Vektorstore. Die Extraktion ist zudem additiv — ein neuer Fakt überschreibt keinen alten stillschweigend —, Korrekturen brauchen also explizite Update- oder Delete-Aufrufe. Für ein Audit-Log der richtige Standard, für einen Nutzer, der gerade umgedacht hat, ärgerlich.",{"type":117,"level":118,"id":91,"text":92},{"type":110,"content":167},[168,169,172,173,176,177,180],"Der gehostete Weg besteht aus zwei Aufrufen. SDK installieren, API-Key im Dashboard holen und jedem Aufruf einen Scope geben: Eine Erinnerung ohne ",{"tag":123,"children":170},[171],"user_id",", ohne ",{"tag":123,"children":174},[175],"agent_id"," und ohne ",{"tag":123,"children":178},[179],"run_id"," bekommt der Nächste, der danach fragt.",{"type":123,"code":182},"from mem0 import MemoryClient\n\nclient = MemoryClient(api_key=\"your-api-key\")\n\nmessages = [\n    {\"role\": \"user\", \"content\": \"I'm a vegetarian and allergic to nuts.\"},\n    {\"role\": \"assistant\", \"content\": \"Noted.\"},\n]\nclient.add(messages, user_id=\"user123\")\n\nresults = client.search(\n    \"What are my dietary restrictions?\",\n    filters={\"user_id\": \"user123\"},\n)\nfor r in results[\"results\"]:\n    print(r[\"memory\"], r[\"score\"])",{"type":110,"content":184},[185,186,189],"Die Open-Source-Bibliothek hat dieselbe Form und keinen Server dahinter: ",{"tag":123,"children":187},[188],"from mem0 import Memory",", dann add, search, update und delete gegen Stores, die man selbst betreibt. Vor dem ersten Aufruf braucht sie einen LLM-Key und einen Vektorstore — das ist der eigentliche Unterschied zwischen beiden Hälften: Die Bibliothek ist Apache-2.0, und die Retrieval-Qualität der Benchmark-Tabellen lebt auf der Plattform.",{"type":191,"variant":192,"title":193,"body":194},"callout","note","Was der Schreibpfad kostet",[195],[196,197,200],"Die Extraktion läuft bei jedem ",{"tag":123,"children":198},[199],"add",": Ein Chat-Produkt, das pro Runde speichert, zahlt für den Schreibvorgang einen Modellaufruf und eine Einbettung, zusätzlich zum ohnehin nötigen Retrieval. Die Zahl, die man beobachten sollte, ist deshalb nicht die des Tarifs, sondern die Kosten pro Gespräch. Die Docs warnen außerdem, keine Secrets und keine ungeschönten sensiblen Daten zu speichern, weil der Store genau dafür da ist, abgefragt zu werden.",{"type":117,"level":118,"id":94,"text":95},{"type":110,"content":203},[204],"Mem0 veröffentlicht eigene Zahlen, mehr als die meisten Speicherschichten, und das README beschreibt die Methode: Retrieval in einem Durchlauf, ein Aufruf ohne agentischen Loop, ein Retrieval-Budget von 200 Treffern, auf demselben produktionsnahen Modell-Stack.",{"type":206,"head":207,"rows":218},"table",[208,210,212,214,216],[209],"Benchmark",[211],"Vor April 2026",[213],"Aktueller Wert",[215],"Tokens pro Abfrage",[217],"p50-Latenz",[219,230,241,252],[220,222,224,226,228],[221],"LoCoMo",[223],"71,4",[225],"92,5",[227],"7,0K",[229],"0,88 s",[231,233,235,237,239],[232],"LongMemEval",[234],"67,8",[236],"94,4",[238],"6,8K",[240],"1,09 s",[242,244,246,248,250],[243],"BEAM, 1M Tokens",[245],"nicht veröffentlicht",[247],"64,1",[249],"6,7K",[251],"1,00 s",[253,255,256,258,260],[254],"BEAM, 10M Tokens",[245],[257],"48,6",[259],"6,9K",[261],"1,05 s",{"type":110,"content":263},[264],"Der Vorbehalt steht im selben Absatz: Diese Werte spiegeln die verwaltete Plattform, die proprietäre Optimierungen trägt, die es im Open-Source-SDK nicht gibt; Open-Source-Nutzer sollen mit in die Richtung gehenden, nicht identischen Zahlen rechnen. Das dahinterliegende Paper, im April 2025 auf arXiv veröffentlicht, nennt 91% niedrigere p95-Latenz und mehr als 90% Token-Ersparnis gegenüber Full-Context-Prompting auf LoCoMo, 26% relative Verbesserung im LLM-as-a-Judge gegenüber OpenAI Memory und etwa 2% mehr durch die Graph-Variante.",{"type":191,"variant":266,"title":267,"body":268},"warn","Eine Anbieter-Tabelle ist kein Vergleich",[269],[270,271,274],"Wer Mem0 aufgrund dieser Zeilen gegenüber Zep oder einer Zusammenfassung im Prompt bevorzugt, vergleicht die Plattform eines Anbieters mit dem eigenen Stack. Der Teil, der sich zu reproduzieren lohnt, ist das veröffentlichte Evaluierungs-Framework ",{"tag":123,"children":272},[273],"mem0ai\u002Fmemory-benchmarks",".",{"type":117,"level":118,"id":97,"text":98},{"type":110,"content":277},[278],"Die Preisseite misst zwei Zähler, Add-Anfragen und Retrieval-Anfragen, und Endnutzer sind auf jeder Stufe unbegrenzt. Die folgenden Werte sind das, was die Seite Anfang Oktober 2026 zeigte; nutzungsbasierte Preise gibt es für Traffic, der in keinen Tarif passt.",{"type":206,"head":280,"rows":289},[281,283,285,287],[282],"Tarif",[284],"Preis",[286],"Add-Anfragen pro Monat",[288],"Retrieval-Anfragen pro Monat",[290,299,308,316],[291,293,295,297],[292],"Hobby",[294],"Kostenlos",[296],"10.000",[298],"1.000",[300,302,304,306],[301],"Starter",[303],"19 Dollar pro Monat",[305],"50.000",[307],"5.000",[309,311,313,315],[310],"Pro",[312],"249 Dollar pro Monat",[314],"500.000",[305],[317,319,321,323],[318],"Enterprise",[320],"Individuell",[322],"Unbegrenzt",[322],{"type":110,"content":325},[326],"Zwei Funktionen, die das Marketing tragen — Graph Memory für das Verknüpfen von Entitäten und Dream Consolidation — stehen unter Pro und Enterprise, nicht in den kostenlosen Stufen, und die eigene Vergleichstabelle im README nennt die fortgeschrittenen Funktionen des selbst gehosteten Servers Teaser. Die 1.000 Retrievals der Hobby-Stufe entsprechen rund 33 Suchanfragen am Tag: genug, um eine Integration zu beweisen, nicht genug, um ein Produkt zu betreiben.",{"type":117,"level":118,"id":100,"text":101},{"type":110,"content":329},[330],"Die Schwächen sind strukturell, nicht kosmetisch. Jeder Add ist ein Modellaufruf, also wachsen Schreiblatenz und Token-Rechnung mit dem Gesprächsvolumen, und der Extraktionsschritt kann eine Ableitung speichern, die der Nutzer nie gesagt hat — ein abgeleiteter Fakt ist schwerer zu prüfen als eine protokollierte Nachricht. Die Funktionen, die Mem0 interessant machen, liegen auf der Plattform; Open-Source-Version und bezahltes Produkt teilen sich eher den Namen als den Funktionsumfang. Lock-in ist real, aber moderat: Erinnerungen sind Zeilen, die sich über die API zurücklesen lassen, und für den Umstieg auf die v3-API gibt es eine veröffentlichte Migrationsanleitung.",{"type":206,"head":332,"rows":341},[333,335,337,339],[334],"Option",[336],"Speichermodell",[338],"Betriebsaufwand",[340],"Wofür geeignet",[342,350,359,368],[343,344,346,348],[22],[345],"Extrahierte Fakten, gefiltert nach Nutzer, Agent und Lauf",[347],"Eine Bibliothek zum Betreiben oder eine Plattform zum Bezahlen",[349],"Personalisierung über Sitzungen hinweg mit bekanntem Kosten pro Gespräch",[351,353,355,357],[352],"Zep mit Graphiti",[354],"Temporärer Wissensgraph aus Episoden",[356],"Ein Graph-Store und seine Pflege",[358],"Beziehungsreiche Erinnerung, bei der die zeitliche Reihenfolge zählt",[360,362,364,366],[361],"LangMem",[363],"Memory Stores und semantische Suche im LangChain-Stack",[365],"Teil der LangChain-Werkzeuge",[367],"Teams, die schon auf LangChain setzen",[369,371,373,375],[370],"Eine Faktentabelle",[372],"Selbst geschriebene Zeilen plus pgvector",[374],"Eigenes SQL und ein Zusammenfassungs-Prompt",[376],"Kurzlebige Erinnerung und strenge Audit-Anforderungen",{"type":110,"content":378},[379],"Welche davon passt, hängt davon ab, wie viel Speicher das Produkt braucht, nicht davon, welche Zeile auf LoCoMo am höchsten steht. Ein Support-Agent mit ein paar dutzend dauerhaften Fakten pro Konto braucht keine Speicherschicht; ein Assistent mit einem Jahr Historie kann es sich nicht leisten, das Transkript neu zu lesen.",{"type":191,"variant":266,"title":381,"body":382},"Die Lücke zwischen SDK und Plattform",[383],[384],"Graph Memory, zeitliches Ranking und das verschmolzene Entitäts-Signal sind Plattform-Funktionen. Eine selbst gehostete Installation bekommt Vektorsuche, Keyword-Matching und Entitäts-Overlap; ein Team, das selbst betreibt, sollte das Produkt an diesem Funktionsumfang ausrichten und nicht an den Benchmark-Tabellen.",{"type":117,"level":118,"id":103,"text":104},{"type":110,"content":387},[388],"Übernehmen, wenn Speicher eine Produktfunktion ist, die Sitzungen überdauert, und sich der Modellaufruf auf dem Schreibpfad in das Produkt einrechnen lässt. Weglassen, wenn der Kontext einer Sitzung in eine Zusammenfassung passt oder jeder gespeicherte Fakt eine vom Menschen prüfbare Herkunft braucht, weil das Inferieren beim Schreiben hier die Konstruktion ist und kein Nebeneffekt.",{"type":132,"ordered":390,"items":391},true,[392,394,396,398,400],[393],"Mit der Bibliothek anfangen: dieselbe API-Form, und der Wechsel zur Plattform bleibt offen.",[395],"Jeden Aufruf scopen. Eine ungeschöpfte Erinnerung ist der einzige Fehlermodus, der Nutzer überschreitet.",[397],"Den Schreibpfad vor dem Tarif budgetieren: ein Extraktionsaufruf pro Add ist das Kostenmodell, was der Plan auch kostet.",[399],"Die Plattform nehmen für Graph Memory, zeitliches Ranking und verschmolzenes Retrieval — das, was die Open-Source-Version nicht hat.",[401],"Niemals Secrets oder ungeschönte personenbezogene Daten speichern; Retrieval ist dafür gemacht, den Inhalt des Stores sichtbar zu machen.",{"type":403,"content":404},"quote",[405],"Avoid storing secrets, raw credentials, or unredacted sensitive data. Mem0 is designed to retrieve stored context.",{"type":117,"level":118,"id":106,"text":107},{"type":132,"ordered":390,"items":408},[409,414,418,422,426,430,434,438,442],[410],{"tag":411,"href":27,"children":412},"a",[413],"Mem0-Dokumentation",[415],{"tag":411,"href":30,"children":416},[417],"Mem0-Quickstart",[419],{"tag":411,"href":33,"children":420},[421],"Wie Mem0 funktioniert",[423],{"tag":411,"href":36,"children":424},[425],"Mem0-Preise",[427],{"tag":411,"href":39,"children":428},[429],"Mem0 auf GitHub",[431],{"tag":411,"href":42,"children":432},[433],"mem0ai auf PyPI",[435],{"tag":411,"href":45,"children":436},[437],"Mem0-Forschung und Benchmarks",[439],{"tag":411,"href":48,"children":440},[441],"Mem0-MCP-Server",[443],{"tag":411,"href":51,"children":444},[445],"Mem0-Paper auf arXiv",[447,494,549,591],{"slug":448,"published":449,"minutes":450,"category":7,"tags":451,"keywords":455,"about":463,"sources":467,"cover":486,"og":487,"expertise":54,"locales":488,"lang":57,"title":489,"description":490,"coverAlt":491,"url":492,"pricing":493,"kind":9},"zep","2026-10-06",11,[9,452,453,454,11],"Knowledge graph","Temporal graph","Context engineering",[456,457,458,459,460,18,461,462],"zep ai","zep agent memory","graphiti knowledge graph","zep pricing","zep vs mem0","temporal knowledge graph","zep cloud",[464],{"name":465,"url":466},"Zep","https:\u002F\u002Fwww.getzep.com\u002F",[468,471,474,477,480,483],{"title":469,"url":470},"Zep pricing: plans, credits and limits","https:\u002F\u002Fwww.getzep.com\u002Fpricing",{"title":472,"url":473},"Zep documentation","https:\u002F\u002Fhelp.getzep.com\u002F",{"title":475,"url":476},"Graphiti on GitHub","https:\u002F\u002Fgithub.com\u002Fgetzep\u002Fgraphiti",{"title":478,"url":479},"Graphiti product page","https:\u002F\u002Fwww.getzep.com\u002Fplatform\u002Fgraphiti\u002F",{"title":481,"url":482},"Announcing a new direction for Zep's open-source strategy","https:\u002F\u002Fwww.getzep.com\u002Fblog\u002Fannouncing-a-new-direction-for-zeps-open-source-strategy\u002F",{"title":484,"url":485},"Graphiti: temporal knowledge graphs for AI agents (arXiv)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2501.13956","\u002Fimages\u002Fblog\u002Fzep\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fzep\u002Fog.jpg",[56,57,58],"Zep-Review: Agenten-Memory auf einem temporalen Graphen","Zep ist eine gehostete Agenten-Memory-API auf einem temporalen Knowledge Graph: Credits beim Schreiben, Retrieval gratis, Flex ab 125 Dollar im Monat, Graphiti als selbst hostbarer Teil.","Diagramm, wie eine Aussage in Zep den Prompt erreicht: Nachrichten und Aussagen werden in einen benutzerspezifischen Context Graph aus Entitäten und Beziehungen extrahiert, und der Retrieval durchläuft den Graphen und liefert einen Kontextblock mit den tragenden Fakten.","https:\u002F\u002Fwww.getzep.com","Apache-2.0 core · Cloud from $50 per month",{"slug":495,"published":496,"minutes":497,"category":7,"tags":498,"keywords":501,"about":509,"sources":516,"cover":541,"og":542,"expertise":54,"locales":543,"lang":57,"title":544,"description":545,"coverAlt":546,"url":547,"pricing":548,"kind":511},"lancedb","2026-09-21",9,[12,499,500,11],"Hybrid search","Embedded database",[495,502,503,504,505,506,507,508],"lancedb review","lance vector database","embedded vector database","lancedb vs qdrant","hybrid search rrf","lancedb indexing","lance data format",[510,513],{"name":511,"url":512},"Vector database","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FVector_database",{"name":514,"url":515},"Apache Arrow","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FApache_Arrow",[517,520,523,526,529,532,535,538],{"title":518,"url":519},"LanceDB quickstart","https:\u002F\u002Fdocs.lancedb.com\u002Fquickstart",{"title":521,"url":522},"LanceDB vector indexes","https:\u002F\u002Fdocs.lancedb.com\u002Findexing\u002Fvector-index",{"title":524,"url":525},"LanceDB indexing guide","https:\u002F\u002Fdocs.lancedb.com\u002Findexing\u002Findex",{"title":527,"url":528},"LanceDB hybrid search","https:\u002F\u002Fdocs.lancedb.com\u002Fsearch\u002Fhybrid-search",{"title":530,"url":531},"LanceDB Enterprise","https:\u002F\u002Fdocs.lancedb.com\u002Fenterprise",{"title":533,"url":534},"LanceDB frequently asked questions","https:\u002F\u002Fdocs.lancedb.com\u002Ffaq\u002Ffaq-oss",{"title":536,"url":537},"LanceDB pricing","https:\u002F\u002Flancedb.com\u002Fpricing",{"title":539,"url":540},"LanceDB on PyPI","https:\u002F\u002Fpypi.org\u002Fproject\u002Flancedb\u002F","\u002Fimages\u002Fblog\u002Flancedb\u002Fcover.webp","\u002Fimages\u002Fblog\u002Flancedb\u002Fog.jpg",[56,57,58],"LanceDB: Vektorsuche, die als Bibliothek beginnt","Ein Test von LanceDB: eine Apache-2.0-Bibliothek statt Server, die IVF- und HNSW-Indexwahl, Hybridsuche mit Rangfusion und was Enterprise zusätzlich bringt.","Coverbild zum LanceDB-Test: eine Lance-Tabelle speist einen Vektorindex und einen Volltextindex in eine verschmolzene Rangliste","https:\u002F\u002Flancedb.com","Apache-2.0 · Cloud paid",{"slug":550,"published":496,"minutes":6,"category":7,"tags":551,"keywords":555,"about":562,"sources":568,"cover":583,"og":584,"expertise":54,"locales":585,"lang":57,"title":586,"description":587,"coverAlt":588,"url":564,"pricing":589,"kind":590},"pgvector",[12,552,553,11,554],"Postgres","HNSW","Quantisation",[550,556,557,558,559,560,561],"pgvector vs qdrant","postgres vector search","hnsw index postgres","iterative index scans","binary quantization postgres","vector database postgres",[563,565],{"name":550,"url":564},"https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector",{"name":566,"url":567},"PostgreSQL","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FPostgreSQL",[569,571,574,577,580],{"title":570,"url":564},"pgvector README",{"title":572,"url":573},"pgvector changelog","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FCHANGELOG.md",{"title":575,"url":576},"PostgreSQL news: pgvector 0.8.2 released","https:\u002F\u002Fwww.postgresql.org\u002Fabout\u002Fnews\u002Fpgvector-082-released-3245\u002F",{"title":578,"url":579},"AWS: Scale pgvector with binary quantization","https:\u002F\u002Faws.amazon.com\u002Fblogs\u002Fdatabase\u002Fscale-pgvector-with-binary-quantization-on-amazon-aurora-postgresql\u002F",{"title":581,"url":582},"pgvector licence","https:\u002F\u002Fgithub.com\u002Fpgvector\u002Fpgvector\u002Fblob\u002Fmaster\u002FLICENSE","\u002Fimages\u002Fblog\u002Fpgvector\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fpgvector\u002Fog.jpg",[56,57,58],"pgvector im Review: die Vektordatenbank, die du nicht betreiben musst","Ein Review von pgvector 0.8.7: iterative Index-Scans für gefilterte Suche, HNSW und IVFFlat, Binärquantisierung bei 100 Millionen Vektoren und das CVE im Indexaufbau.","Eine Anfrage teilt sich oben in einen exakten Sequenzscan, einen HNSW-Graphlauf und eine IVFFlat-Sonde; ein Band unten zeigt einen iterativen Scan, der weiterläuft, bis die LIMIT-Zahl erreicht ist.","PostgreSQL licence","Vector database extension",{"slug":592,"published":593,"minutes":6,"category":7,"tags":594,"keywords":597,"about":606,"sources":616,"cover":635,"og":636,"expertise":54,"locales":637,"lang":57,"title":638,"description":639,"coverAlt":640,"url":609,"pricing":641,"kind":511},"milvus-zilliz","2026-09-08",[12,499,595,596,11],"BM25 full text","Distributed",[598,599,600,601,602,603,604,605],"milvus","milvus vs qdrant","zilliz cloud pricing","vector database comparison","milvus hybrid search","apache milvus self-hosting","milvus 3.0","rag vector store",[607,610,613],{"name":608,"url":609},"Milvus","https:\u002F\u002Fmilvus.io",{"name":611,"url":612},"Zilliz Cloud","https:\u002F\u002Fzilliz.com",{"name":614,"url":615},"Retrieval-augmented generation","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FRetrieval-augmented_generation",[617,620,623,626,629,632],{"title":618,"url":619},"Milvus architecture overview","https:\u002F\u002Fmilvus.io\u002Fdocs\u002Farchitecture_overview.md",{"title":621,"url":622},"Milvus release notes","https:\u002F\u002Fmilvus.io\u002Fdocs\u002Frelease_notes.md",{"title":624,"url":625},"Milvus releases on GitHub","https:\u002F\u002Fgithub.com\u002Fmilvus-io\u002Fmilvus\u002Freleases",{"title":627,"url":628},"Milvus README: features and licence","https:\u002F\u002Fgithub.com\u002Fmilvus-io\u002Fmilvus",{"title":630,"url":631},"Zilliz Cloud pricing","https:\u002F\u002Fzilliz.com\u002Fpricing",{"title":633,"url":634},"Zilliz Cloud list price","https:\u002F\u002Fzilliz.com\u002Fpricing\u002Fpricing-guide","\u002Fimages\u002Fblog\u002Fmilvus-zilliz\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fmilvus-zilliz\u002Fog.jpg",[56,57,58],"Milvus-Review: die vollständigste Vektordatenbank im Betrieb","Milvus 3.0.2 ist die vollständigste Open-Source-Vektordatenbank und die aufwendigste im Betrieb. Review von Architektur, Hybridsuche, Kosten und Einsatzgrenzen.","Covermotiv zum Milvus-Review: eine Pipeline von Ingest über Index, Suche und Reranking","Apache-2.0 · Zilliz Cloud free tier",1791383550545]