[{"data":1,"prerenderedAt":755},["ShallowReactive",2],{"blog-multi-agent-systems-when-worth-it-de":3},{"slug":4,"published":5,"minutes":6,"category":7,"tags":8,"keywords":13,"about":24,"sources":34,"cover":68,"og":69,"expertise":70,"locales":71,"lang":73,"title":75,"description":76,"coverAlt":77,"metaTitle":78,"takeaways":79,"faq":85,"toc":104,"blocks":129,"others":457},"multi-agent-systems-when-worth-it","2026-10-02",12,"agents",[9,10,11,12],"Multi-agent systems","AI agents","Orchestrator-worker","Context engineering",[14,15,16,17,18,19,20,21,22,23],"multi-agent systems when worth it","multi-agent vs single agent","orchestrator-worker pattern","multi-agent LLM token cost","why multi-agent systems fail","don't build multi-agents","subagents context isolation","multi-agent debate worth it","agent handoffs vs subagents","when to use multiple AI agents",[25,28,31],{"name":26,"url":27},"Multi-agent system","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FMulti-agent_system",{"name":29,"url":30},"Intelligent agent","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FIntelligent_agent",{"name":32,"url":33},"Large language model","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FLarge_language_model",[35,38,41,44,47,50,53,56,59,62,65],{"title":36,"url":37},"Anthropic Engineering: How we built our multi-agent research system","https:\u002F\u002Fwww.anthropic.com\u002Fengineering\u002Fmulti-agent-research-system",{"title":39,"url":40},"Anthropic: Building effective agents","https:\u002F\u002Fwww.anthropic.com\u002Fengineering\u002Fbuilding-effective-agents",{"title":42,"url":43},"Cognition: Don't Build Multi-Agents (12 June 2025)","https:\u002F\u002Fcognition.com\u002Fblog\u002Fdont-build-multi-agents",{"title":45,"url":46},"Cognition: Multi-Agents: What's Actually Working (22 April 2026)","https:\u002F\u002Fcognition.com\u002Fblog\u002Fmulti-agents-working",{"title":48,"url":49},"Google Research: Towards a science of scaling agent systems","https:\u002F\u002Fresearch.google\u002Fblog\u002Ftowards-a-science-of-scaling-agent-systems-when-and-why-agent-systems-work\u002F",{"title":51,"url":52},"arXiv 2512.08296: Towards a Science of Scaling Agent Systems","https:\u002F\u002Farxiv.org\u002Fabs\u002F2512.08296",{"title":54,"url":55},"arXiv 2503.13657: Why Do Multi-Agent LLM Systems Fail? (MAST)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2503.13657",{"title":57,"url":58},"arXiv 2305.14325: Improving Factuality and Reasoning in Language Models through Multiagent Debate","https:\u002F\u002Farxiv.org\u002Fabs\u002F2305.14325",{"title":60,"url":61},"arXiv 2502.08788: Stop Overvaluing Multi-Agent Debate","https:\u002F\u002Farxiv.org\u002Fabs\u002F2502.08788",{"title":63,"url":64},"OpenAI Agents SDK: Handoffs","https:\u002F\u002Fopenai.github.io\u002Fopenai-agents-python\u002Fhandoffs\u002F",{"title":66,"url":67},"Claude Code documentation: Subagents","https:\u002F\u002Fcode.claude.com\u002Fdocs\u002Fen\u002Fsub-agents","\u002Fimages\u002Fblog\u002Fmulti-agent-systems-when-worth-it\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fmulti-agent-systems-when-worth-it\u002Fog.jpg","ai-engineer",[72,73,74],"en","de","hu","Multi-Agent-Systeme: wann sie einen Agenten schlagen und wann nicht","Orchestrator-Worker, Fan-out, Critic, Handoff: was Multi-Agent-Systeme wirklich bringen, was sie an Tokens kosten, wie sie scheitern, mit Entscheidungstabelle.","Diagramm: Ein Lead-Agent verteilt Aufgaben an vier Worker-Agenten, jeder mit eigenem isoliertem Kontextfenster, und sammelt deren Zusammenfassungen ein.","Wann Multi-Agent-Systeme gewinnen · Balázs Csorba",[80,81,82,83,84],"Anthropic hat für einen Agenten etwa das 4-Fache der Tokens eines Chats gemessen, für ein Multi-Agent-System etwa das 15-Fache. Ein Multi-Agent-Design muss diesen Faktor wert sein.","Der eigentliche Nutzen ist Kontext-Isolation: Ein Worker erkundet in seinem eigenen Fenster und liefert eine Zusammenfassung. Das hält den Lead-Agenten fokussiert und lässt die Breite ein Kontextfenster übersteigen.","Paralleles Lesen skaliert gut, paralleles Schreiben und eng gekoppelte Schritte nicht. Google Research sah +81 % bei einer parallelisierbaren und 39 bis 70 % Verlust bei einer sequenziellen Aufgabe.","Die meisten Fehler sind Koordinationsfehler (vage Vorgaben, verlorener Kontext, fehlende Verifikation), keine Modellfehler. Debatten-Setups schlagen oft nicht einmal eine einfache Single-Agent-Baseline.","Starte mit einem Agenten und einem guten Harness, füge einen Subagenten nur aus gemessenem Grund hinzu, halte Schreibzugriffe single-threaded und miss die Multi-Agent-Variante gegen die Single-Agent-Variante.",[86,89,92,95,98,101],{"q":87,"a":88},"Wann sollte ich ein Multi-Agent-System statt eines einzelnen Agenten einsetzen?","Wenn die Arbeit breit statt tief ist: viele unabhängige Fragen, Quellen jenseits eines Kontextfensters oder Nebenaufgaben, die das Hauptgespräch mit Ausgaben fluten würden. Anthropic nennt breitenorientierte Recherche als Idealfall. Hängen die Schritte voneinander ab oder teilen viel Kontext, ist ein einzelner Agent meist besser.",{"q":90,"a":91},"Wie viele Tokens mehr verbrauchen Multi-Agent-Systeme?","Anthropic berichtete, dass Agenten etwa 4-mal mehr Tokens verbrauchen als Chat-Interaktionen und Multi-Agent-Systeme etwa 15-mal mehr. Die Analyse des BrowseComp-Benchmarks ergab, dass allein die Token-Nutzung etwa 80 % der Leistungsvarianz erklärte. Ein Teil des Gewinns ist also schlicht mehr Rechenaufwand.",{"q":93,"a":94},"Warum scheitern Multi-Agent-LLM-Systeme?","Die MAST-Studie mit mehr als 1.600 annotierten Traces aus 7 Frameworks ordnet 14 Fehlermodi drei Gruppen zu: Systemdesign, Fehlabstimmung zwischen Agenten und Aufgabenverifikation. In der Praxis sind das vage Aufgabenbeschreibungen, Kontext, der den nächsten Agenten nicht erreicht, doppelte Arbeit und niemand, der das Ergebnis prüft.",{"q":96,"a":97},"Lohnt sich Multi-Agent-Debate?","Selten als Standard. Das ursprüngliche Debate-Paper berichtete bessere Argumentation und Faktentreue, doch eine spätere Auswertung von 5 Debate-Methoden auf 9 Benchmarks fand, dass sie Chain-of-Thought oder Self-Consistency trotz mehr Rechenaufwand oft nicht schlagen. Verschiedene Modelle als Debattierende halfen in dieser Studie.",{"q":99,"a":100},"Was ist der Unterschied zwischen Handoff und Subagent?","Ein Handoff übergibt die Kontrolle: Der nächste Agent übernimmt das Gespräch, standardmäßig mit dem vollständigen Verlauf. Ein Subagent bekommt eine Nebenaufgabe in frischem Kontext und liefert nur eine Zusammenfassung zurück, während der Aufrufer die Verantwortung behält. Handoffs eignen sich zum Routing zwischen Spezialisten, Subagenten zur Kontext-Isolation.",{"q":102,"a":103},"Sollten Coding-Agenten Subagenten parallel laufen lassen?","Mit Vorsicht. Cognition argumentiert, dass parallele Schreiber widersprüchliche implizite Entscheidungen zu Stil und Randfällen treffen, und sagt, Multi-Agent-Setups funktionierten heute am besten, wenn Schreibzugriffe single-threaded bleiben. Subagenten für Exploration, Suche und Review sind der sichere Einsatz.",[105,108,111,114,117,120,123,126],{"id":106,"title":107},"four-patterns","Vier Muster und wofür jedes gut ist",{"id":109,"title":110},"context-isolation","Kontext-Isolation ist der eigentliche Nutzen",{"id":112,"title":113},"token-cost","Was es kostet: der Token-Multiplikator",{"id":115,"title":116},"coordination-failures","Wie Multi-Agent-Systeme scheitern",{"id":118,"title":119},"decision-framework","Ein Entscheidungsrahmen",{"id":121,"title":122},"checklist","Eine Checkliste, bevor du einen Agenten hinzufügst",{"id":124,"title":125},"what-i-would-do","Was ich tun würde",{"id":127,"title":128},"sources","Quellen",[130,134,142,151,154,157,166,169,198,199,206,209,217,224,232,233,236,243,251,254,255,258,285,292,300,301,304,379,382,383,402,410,411,414,421,422],{"type":131,"content":132},"paragraph",[133],"Alle paar Monate macht ein neues Framework es trivial, ein Team aus Agenten zu starten: Planer, Rechercheur, Coder, Reviewer. Die Diagramme sehen aus wie ein Organigramm, und man neigt zur Annahme, mehr Agenten bedeuteten mehr Intelligenz. Die veröffentlichte Evidenz sagt etwas Vorsichtigeres: Multi-Agent-Systeme sind hervorragend für eine enge Klasse von Problemen, überall teuer und bei erstaunlich vielen Aufgaben leise schlechter als ein einzelner Agent.",{"type":131,"content":135},[136,137,141],"Dieser Beitrag ordnet die Muster, beziffert die Kosten, listet die Fehlermodi, die Forschung und Hersteller dokumentiert haben, und endet mit einem Entscheidungsrahmen für deinen eigenen Anwendungsfall. Meine Position vorweg: ",{"tag":138,"children":139},"strong",[140],"Starte mit einem Agenten und behandle jeden weiteren Agenten als Anschaffung, die du begründen musst",". Die stärkste Begründung ist nicht „Spezialisierung“ oder „Teamarbeit“. Es ist Kontext-Isolation.",{"type":131,"content":143},[144,145,150],"Wenn du zuerst die Grundlagen eines einzelnen Agenten möchtest, lies ",{"tag":146,"to":147,"children":148},"link","\u002Fblog\u002Fagent-loop-explained",[149],"die Agent-Loop erklärt",". Alles Folgende setzt voraus, dass du bereits einen funktionierenden Agenten hast.",{"type":152,"level":153,"id":106,"text":107},"heading",2,{"type":131,"content":155},[156],"Die meisten Multi-Agent-Designs kombinieren vier Grundformen. Sie unterscheiden sich darin, wer die Kontrolle hält, wer welchen Kontext sieht und wo die Ergebnisse zusammengeführt werden.",{"type":158,"attrs":159,"inner":163,"caption":164},"diagram",{"viewBox":160,"role":161,"aria-labelledby":162},"0 0 720 370","img","d1-multi-t d1-multi-d","\u003Ctitle id=\"d1-multi-t\">Vier Multi-Agent-Muster\u003C\u002Ftitle>\u003Cdesc id=\"d1-multi-d\">Vier kleine Diagramme. Orchestrator-Worker: Ein Lead-Agent delegiert an drei Worker. Paralleler Fan-out: Eine Anfrage geht an drei Suchen, deren Ergebnisse zusammengeführt werden. Writer und Critic: Ein Writer und ein Critic mit frischem Kontext tauschen Entwürfe und Feedback aus. Handoff: Die Kontrolle wandert von Agent A über B zu C.\u003C\u002Fdesc>\u003Ctext x=\"20\" y=\"26\" class=\"d-title\">Vier Multi-Agent-Muster\u003C\u002Ftext>\u003Ctext x=\"700\" y=\"26\" text-anchor=\"end\" class=\"d-label\">Anthropic, Cognition, OpenAI\u003C\u002Ftext>\u003Crect x=\"20\" y=\"40\" width=\"340\" height=\"150\" rx=\"12\" class=\"d-box d-dash\" \u002F>\u003Ctext x=\"34\" y=\"62\" class=\"d-label\">Orchestrator-Worker\u003C\u002Ftext>\u003Crect x=\"34\" y=\"98\" width=\"90\" height=\"36\" rx=\"8\" class=\"d-accent\" \u002F>\u003Ctext x=\"79\" y=\"120\" text-anchor=\"middle\" class=\"d-small\">Lead\u003C\u002Ftext>\u003Cpath d=\"M124 116 L213 89\" class=\"d-line\" \u002F>\u003Cpath d=\"M220 89 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"220\" y=\"76\" width=\"126\" height=\"26\" rx=\"8\" class=\"d-sky\" \u002F>\u003Ctext x=\"283\" y=\"93\" text-anchor=\"middle\" class=\"d-small\">Worker 1\u003C\u002Ftext>\u003Cpath d=\"M124 116 L213 121\" class=\"d-line\" \u002F>\u003Cpath d=\"M220 121 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"220\" y=\"108\" width=\"126\" height=\"26\" rx=\"8\" class=\"d-sky\" \u002F>\u003Ctext x=\"283\" y=\"125\" text-anchor=\"middle\" class=\"d-small\">Worker 2\u003C\u002Ftext>\u003Cpath d=\"M124 116 L213 153\" class=\"d-line\" \u002F>\u003Cpath d=\"M220 153 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"220\" y=\"140\" width=\"126\" height=\"26\" rx=\"8\" class=\"d-sky\" \u002F>\u003Ctext x=\"283\" y=\"157\" text-anchor=\"middle\" class=\"d-small\">Worker 3\u003C\u002Ftext>\u003Ctext x=\"190\" y=\"180\" text-anchor=\"middle\" class=\"d-small\">Teilaufgaben vorab unbekannt\u003C\u002Ftext>\u003Crect x=\"360\" y=\"40\" width=\"340\" height=\"150\" rx=\"12\" class=\"d-box d-dash\" \u002F>\u003Ctext x=\"374\" y=\"62\" class=\"d-label\">Paralleler Fan-out\u003C\u002Ftext>\u003Crect x=\"372\" y=\"98\" width=\"70\" height=\"36\" rx=\"8\" class=\"d-box\" \u002F>\u003Ctext x=\"407\" y=\"120\" text-anchor=\"middle\" class=\"d-small\">Anfrage\u003C\u002Ftext>\u003Cpath d=\"M442 116 L465 89\" class=\"d-line\" \u002F>\u003Cpath d=\"M472 89 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"472\" y=\"76\" width=\"100\" height=\"26\" rx=\"8\" class=\"d-sky\" \u002F>\u003Ctext x=\"522\" y=\"93\" text-anchor=\"middle\" class=\"d-small\">Suche A\u003C\u002Ftext>\u003Cpath d=\"M572 89 L593 116\" class=\"d-line\" \u002F>\u003Cpath d=\"M600 116 l-8 -3 l2 7 z\" class=\"d-head\" \u002F>\u003Cpath d=\"M442 116 L465 121\" class=\"d-line\" \u002F>\u003Cpath d=\"M472 121 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"472\" y=\"108\" width=\"100\" height=\"26\" rx=\"8\" class=\"d-sky\" \u002F>\u003Ctext x=\"522\" y=\"125\" text-anchor=\"middle\" class=\"d-small\">Suche B\u003C\u002Ftext>\u003Cpath d=\"M572 121 L593 116\" class=\"d-line\" \u002F>\u003Cpath d=\"M600 116 l-8 -3 l2 7 z\" class=\"d-head\" \u002F>\u003Cpath d=\"M442 116 L465 153\" class=\"d-line\" \u002F>\u003Cpath d=\"M472 153 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"472\" y=\"140\" width=\"100\" height=\"26\" rx=\"8\" class=\"d-sky\" \u002F>\u003Ctext x=\"522\" y=\"157\" text-anchor=\"middle\" class=\"d-small\">Suche C\u003C\u002Ftext>\u003Cpath d=\"M572 153 L593 116\" class=\"d-line\" \u002F>\u003Cpath d=\"M600 116 l-8 -3 l2 7 z\" class=\"d-head\" \u002F>\u003Crect x=\"600\" y=\"98\" width=\"88\" height=\"36\" rx=\"8\" class=\"d-mint\" \u002F>\u003Ctext x=\"644\" y=\"120\" text-anchor=\"middle\" class=\"d-small\">Merge\u003C\u002Ftext>\u003Ctext x=\"530\" y=\"180\" text-anchor=\"middle\" class=\"d-small\">Unabhängiges Lesen, eine Synthese\u003C\u002Ftext>\u003Crect x=\"20\" y=\"205\" width=\"340\" height=\"150\" rx=\"12\" class=\"d-box d-dash\" \u002F>\u003Ctext x=\"34\" y=\"227\" class=\"d-label\">Writer und Critic\u003C\u002Ftext>\u003Crect x=\"40\" y=\"257\" width=\"110\" height=\"44\" rx=\"8\" class=\"d-box\" \u002F>\u003Ctext x=\"95\" y=\"283\" text-anchor=\"middle\" class=\"d-small\">Writer\u003C\u002Ftext>\u003Crect x=\"230\" y=\"257\" width=\"110\" height=\"44\" rx=\"8\" class=\"d-gold\" \u002F>\u003Ctext x=\"285\" y=\"283\" text-anchor=\"middle\" class=\"d-small\">Critic\u003C\u002Ftext>\u003Cpath d=\"M150 269 H222\" class=\"d-line\" \u002F>\u003Cpath d=\"M230 269 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Cpath d=\"M230 291 H158\" class=\"d-line\" \u002F>\u003Cpath d=\"M150 291 l9 -5 v10 z\" class=\"d-head\" \u002F>\u003Ctext x=\"285\" y=\"321\" text-anchor=\"middle\" class=\"d-label\">frischer Kontext\u003C\u002Ftext>\u003Ctext x=\"190\" y=\"345\" text-anchor=\"middle\" class=\"d-small\">Unabhängige Prüfung einer Ausgabe\u003C\u002Ftext>\u003Crect x=\"360\" y=\"205\" width=\"340\" height=\"150\" rx=\"12\" class=\"d-box d-dash\" \u002F>\u003Ctext x=\"374\" y=\"227\" class=\"d-label\">Handoff\u003C\u002Ftext>\u003Crect x=\"372\" y=\"263\" width=\"86\" height=\"40\" rx=\"8\" class=\"d-sky\" \u002F>\u003Ctext x=\"415\" y=\"287\" text-anchor=\"middle\" class=\"d-small\">Agent A\u003C\u002Ftext>\u003Cpath d=\"M458 283 H478\" class=\"d-line\" \u002F>\u003Cpath d=\"M486 283 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"486\" y=\"263\" width=\"86\" height=\"40\" rx=\"8\" class=\"d-accent\" \u002F>\u003Ctext x=\"529\" y=\"287\" text-anchor=\"middle\" class=\"d-small\">Agent B\u003C\u002Ftext>\u003Cpath d=\"M572 283 H592\" class=\"d-line\" \u002F>\u003Cpath d=\"M600 283 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"600\" y=\"263\" width=\"88\" height=\"40\" rx=\"8\" class=\"d-mint\" \u002F>\u003Ctext x=\"644\" y=\"287\" text-anchor=\"middle\" class=\"d-small\">Agent C\u003C\u002Ftext>\u003Ctext x=\"530\" y=\"345\" text-anchor=\"middle\" class=\"d-small\">Kontrolle wandert, ein Agent aktiv\u003C\u002Ftext>",[165],"Die vier Formen. In den ersten beiden behält der Aufrufer die Verantwortung und erhält Zusammenfassungen; beim Handoff wandert die Kontrolle selbst.",{"type":131,"content":167},[168],"Im Detail:",{"type":170,"ordered":171,"items":172},"list",false,[173,183,188,193],[174,177,178,182],{"tag":138,"children":175},[176],"Orchestrator-Worker."," Ein Lead-Agent plant, delegiert an Worker und fasst zusammen. Anthropic beschreibt in ",{"tag":179,"href":40,"children":180},"a",[181],"Building effective agents"," ein zentrales LLM, das Aufgaben „dynamisch zerlegt, an Worker-LLMs delegiert und deren Ergebnisse zusammenführt“. Geeignet ist das für Aufgaben, deren Teilschritte du vorab nicht vorhersagen kannst.",[184,187],{"tag":138,"children":185},[186],"Paralleler Fan-out."," Dieselbe Idee mit fester Form: Arbeit in unabhängige Teile zerlegen, gleichzeitig ausführen, zusammenführen. Derselbe Beitrag nennt zwei Varianten: Sectioning (unabhängige Teilaufgaben) und Voting (dieselbe Aufgabe mehrfach für diverse Ergebnisse).",[189,192],{"tag":138,"children":190},[191],"Writer und Critic (Debate)."," Ein zweiter Agent prüft die Ausgabe des ersten, oder mehrere Agenten streiten sich zu einer Antwort. Hier ist die Evidenz am gemischtesten, wie der Abschnitt zu den Fehlern zeigt.",[194,197],{"tag":138,"children":195},[196],"Handoff."," Ein Agent übergibt das Gespräch an einen Spezialisten. Im OpenAI Agents SDK wird ein Handoff dem Modell als Tool mit einem Namen wie transfer_to_refund_agent angeboten, und standardmäßig „übernimmt der neue Agent das Gespräch und sieht den gesamten bisherigen Verlauf“. Ein Input-Filter erlaubt, das einzuschränken.",{"type":152,"level":153,"id":109,"text":110},{"type":131,"content":200},[201,202,205],"Frag dich, was ein zweiter Agent kann, was der erste nicht kann. Er hat kein besseres Modell und denkt nicht härter. Er hat ",{"tag":138,"children":203},[204],"ein leeres Kontextfenster",". Ein Worker kann vierzig Suchergebnisse lesen, ein Monorepo durchsuchen oder eine laute Testsuite laufen lassen und zehn Zeilen zurückgeben. Der Lead-Agent trägt dieses Rauschen nie mit sich.",{"type":131,"content":207},[208],"Anthropics eigene Beschreibung des Research-Systems macht das explizit: Subagenten arbeiten parallel mit eigenen Kontextfenstern, so bewältigt das System Informationen, die ein einzelnes Kontextfenster übersteigen. Die Dokumentation von Claude Code sagt dasselbe fürs Coding: Nutze einen Subagenten, wenn eine Nebenaufgabe dein Hauptgespräch „mit Suchergebnissen, Logs oder Dateiinhalten fluten würde, die du nicht mehr brauchst“, denn er erledigt die Arbeit in seinem eigenen Kontext und „gibt nur die Zusammenfassung zurück“.",{"type":131,"content":210},[211,212,216],"Die Kehrseite ist genauso wichtig. Ein frischer Subagent erbt weder deinen Gesprächsverlauf noch deine Skills noch die bereits gelesenen Dateien, also muss alles Nötige in seinem Briefing stehen. Die Doku nennt, wann du im Hauptgespräch bleiben solltest: bei häufigem Hin und Her, bei mehreren Phasen mit viel gemeinsamem Kontext wie Planung, Implementierung und Test und bei latenzkritischer Arbeit. Das ist dieselbe Einsicht wie in ",{"tag":146,"to":213,"children":214},"\u002Fblog\u002Fharness-engineering-coding-agents",[215],"Harness Engineering für Coding-Agenten",": Was du ins Fenster legst und was du draußen hältst, entscheidet das Ergebnis.",{"type":218,"variant":219,"title":220,"body":221},"callout","tip","Ein nützlicher Test",[222],[223],"Bevor du einen Agenten hinzufügst, vervollständige diesen Satz: „Dieser Agent existiert, damit ___ nie in den Kontext des anderen Agenten gelangt.“ Kannst du die Lücke nicht füllen, fügst du wahrscheinlich Koordinationskosten ohne Isolationsnutzen hinzu.",{"type":131,"content":225},[226,227,231],"Cognition fand einen zweiten, subtileren Nutzen: Ein sauberer Kontext verbessert einen Reviewer. In ihrem Follow-up vom April 2026 berichten sie, dass ihr Review-Agent besser arbeitet, wenn er den Kontext mit dem Coding-Agenten nicht teilt, weil er unabhängig denkt, statt die Annahmen des Autors zu erben. Sie geben an, dass Devin Review im Schnitt 2 Bugs pro Pull Request findet, etwa 58 % davon gravierend. Das ist eine Herstellerangabe, aber der Mechanismus ist plausibel und billig zu testen. Er passt auch zum Review-Engpass aus ",{"tag":146,"to":228,"children":229},"\u002Fblog\u002Fai-generated-pr-review-bottleneck",[230],"KI-generierte Pull Requests",".",{"type":152,"level":153,"id":112,"text":113},{"type":131,"content":234},[235],"Anthropic ist in seinem Beitrag zum Multi-Agent-Research-System ungewöhnlich offen: Agenten verbrauchen typischerweise etwa 4-mal mehr Tokens als Chat-Interaktionen, Multi-Agent-Systeme etwa 15-mal mehr. Sie folgern, dass solche Systeme Aufgaben brauchen, deren Wert die Kosten rechtfertigt.",{"type":131,"content":237},[238,239,242],"Derselbe Beitrag lässt eine unbequeme Lesart zu. In der Analyse des BrowseComp-Benchmarks erklärte die Token-Nutzung allein 80 % der Leistungsvarianz. Ein Teil dessen, was ein Multi-Agent-System kauft, ist schlicht mehr Nachdenken pro Frage. Das ist legitim, heißt aber: Vergleiche mit einem ",{"tag":138,"children":240},[241],"einzelnen Agenten mit demselben Token-Budget",", nicht mit einem, der früh aufhört. Ihr Kernergebnis: Ein Claude-Opus-4-Lead mit Claude-Sonnet-4-Subagenten schlug ein einzelnes Claude Opus 4 in der internen Research-Evaluation um 90,2 %, und die Parallelisierung verkürzte die Recherchezeit bei komplexen Anfragen um bis zu 90 %.",{"type":131,"content":244},[245,246,250],"Latenz und Geld ziehen in entgegengesetzte Richtungen. Parallele Worker verkürzen die Wanduhrzeit und erhöhen die Rechnung. Der Preis pro Token sinkt durch Caching und Routing, lies also ",{"tag":146,"to":247,"children":248},"\u002Fblog\u002Fllm-cost-latency-prompt-caching-routing",[249],"LLM-Kosten, Latenz, Prompt Caching und Routing",", bevor du den Multiplikator für unbezahlbar hältst. Günstigere Worker-Modelle, geteilte gecachte Präfixe und harte Obergrenzen für die Zahl der Worker verändern die Ökonomie erheblich.",{"type":131,"content":252},[253],"Anthropic listet auch die Fehlermodi der frühen Versionen: 50 Subagenten für eine einfache Anfrage starten, endlos nach nicht existierenden Quellen suchen und Worker, die wegen vager Aufgabenbeschreibungen die Arbeit der anderen doppeln. Die Lösung waren explizite Skalierungsregeln im Prompt, damit der Aufwand zur Komplexität der Anfrage passt, und deutlich detailliertere Aufgabenbeschreibungen für jeden Worker.",{"type":152,"level":153,"id":115,"text":116},{"type":131,"content":256},[257],"Die Forschung ist sich in einem Punkt einig: Die Fehler betreffen meist die Koordination, nicht die Intelligenz der Modelle.",{"type":170,"ordered":171,"items":259},[260,265,270,275,280],[261,264],{"tag":138,"children":262},[263],"Verstreute Entscheidungen."," Cognitions Beitrag „Don't Build Multi-Agents“ vom Juni 2025 beruht auf zwei Prinzipien: Kontext teilen und „Aktionen tragen implizite Entscheidungen“. Ihr Beispiel ist ein Flappy-Bird-Klon, der in Teilaufgaben zerlegt wird: Ein Subagent baut einen Hintergrund im Super-Mario-Stil, ein anderer einen Vogel, der weder aussieht noch sich verhält wie Flappy Bird, und der letzte Agent muss die Diskrepanz zusammenführen. Ihr Fazit: Mehrere zusammenarbeitende Agenten ergeben nur fragile Systeme.",[266,269],{"tag":138,"children":267},[268],"Sequenzielle Arbeit wird schlechter."," Google Research evaluierte 180 Agentenkonfigurationen. Zentrale Koordination verbesserte eine parallelisierbare Finanzaufgabe um 80,9 % gegenüber einem einzelnen Agenten, während bei einer sequenziellen Planungsaufgabe jede getestete Multi-Agent-Variante die Leistung um 39 bis 70 % verschlechterte. Unabhängige Agenten verstärkten Fehler 17,2-fach, ein zentraler Orchestrator nur 4,4-fach, weil er als Validierungsengpass wirkt. Die Autoren berichten außerdem einen Tool-Koordinations-Trade-off: Der Overhead wächst bei toollastigen Aufgaben überproportional.",[271,274],{"tag":138,"children":272},[273],"Taxonomie der Zusammenbrüche."," Die MAST-Studie (Cemri et al.) analysierte mehr als 1.600 annotierte Traces aus 7 Multi-Agent-Frameworks und ordnete 14 Fehlermodi drei Kategorien zu: Systemdesign, Fehlabstimmung zwischen Agenten und Aufgabenverifikation. Die Autoren halten fest, dass die Leistungsgewinne auf populären Benchmarks oft minimal sind und in mehreren Fällen dasselbe Modell als Single Agent besser abschnitt.",[276,279],{"tag":138,"children":277},[278],"Debate wird standardmäßig überschätzt."," Du et al. (2023) zeigten, dass mehrere debattierende Modellinstanzen Argumentation und Faktentreue verbessern können. Eine Auswertung von 2025 mit 5 Debate-Methoden auf 9 Benchmarks und 4 Modellen fand dann, dass sie Chain-of-Thought und Self-Consistency trotz deutlich mehr Rechenzeit bei der Inferenz oft nicht übertreffen. Geholfen hat Modell-Heterogenität: Debattierende aus verschiedenen Modellen.",[281,284],{"tag":138,"children":282},[283],"Parallele Schreiber kollidieren."," Im April 2026 aktualisierte Cognition seine Sicht: Multi-Agent-Systeme funktionieren heute am besten, wenn Schreibzugriffe single-threaded bleiben und die zusätzlichen Agenten Intelligenz statt Aktionen beitragen; die meisten Schwarm-Ideen finden kaum Verbreitung. Anthropic nennt die meiste Coding-Arbeit ebenfalls einen schlechten Fit, weil sie sich kaum parallelisieren lässt.",{"type":131,"content":286},[287,288,291],"Das Muster in diesen Quellen ist eine Trennung zwischen ",{"tag":138,"children":289},[290],"Lesen und Schreiben",". Lesen, Suchen, Analysieren und Prüfen lassen sich gut parallelisieren, weil jedes Ergebnis für sich beurteilt werden kann. Code schreiben, geteilten Zustand ändern und Designentscheidungen treffen nicht, weil jede Aktion Entscheidungen trägt, die die anderen Agenten nicht sehen.",{"type":131,"content":293},[294,295,299],"Verifikation ist die zweite wiederkehrende Lücke. Prüft niemand das zusammengeführte Ergebnis, pflanzen sich Fehler fort; Googles Zahlen zeigen, wie viel ein zentraler Validierungsschritt eindämmt. Behandle den Merge-Schritt deines Orchestrators als Ort für explizite Prüfungen und miss das Gesamtsystem mit ",{"tag":146,"to":296,"children":297},"\u002Fblog\u002Fllm-evals-for-product-features",[298],"Evals für das Feature",", nicht durch das Lesen einiger Traces.",{"type":152,"level":153,"id":118,"text":119},{"type":131,"content":302},[303],"Das ist die Tabelle, die ich im Design-Review verwenden würde. Die Frage lautet nie „Single oder Multi“, sondern welche konkrete Form sich für diese Aufgabe auszahlt.",{"type":305,"head":306,"rows":315},"table",[307,309,311,313],[308],"Situation",[310],"Signal",[312],"Muster",[314],"Warum",[316,325,334,343,352,361,370],[317,319,321,323],[318],"Breite Recherche über viele unabhängige Quellen",[320],"Teilaufgaben vorab unbekannt und größer als ein Kontextfenster",[322],"Orchestrator-Worker",[324],"Isolierte Fenster geben Breite; Anthropic berichtet hier große Gewinne bei etwa dem 15-Fachen der Tokens eines Chats",[326,328,330,332],[327],"Bekannte Menge unabhängiger Prüfungen oder Abfragen",[329],"Dieselbe Operation über N Elemente, keine Abhängigkeiten",[331],"Paralleler Fan-out (Sectioning)",[333],"Wanduhrzeit sinkt, außer einem Merge keine Koordination nötig",[335,337,339,341],[336],"Folgenreiche Ausgabe, bei der ein zweiter Blick Fehler findet",[338],"Review profitiert davon, die Annahmen des Autors nicht zu teilen",[340],"Writer und Critic mit frischem Kontext",[342],"Unabhängige Prüfung; idealerweise ein anderes Modell, wie die Debate-Studie nahelegt",[344,346,348,350],[345],"Mehrere Domänen mit verschiedenen Tools oder Prompts",[347],"Routing zwischen Spezialisten, jeweils einer aktiv",[349],"Handoff",[351],"Jeder Spezialist bekommt einen kurzen Prompt und wenige Tools; entscheide, wie viel Verlauf mitwandert",[353,355,357,359],[354],"Eine Nebenaufgabe mit lauter Ausgabe",[356],"Logs, Suchergebnisse oder Dateiinhalte, die du nicht mehr brauchst",[358],"Subagent, der eine Zusammenfassung zurückgibt",[360],"Hält den Hauptkontext sauber, Preis ist der Neustart ohne Kontext",[362,364,366,368],[363],"Mehrschrittige Arbeit, deren Schritte voneinander abhängen",[365],"Planung, Refactoring, ein Dokument, geteilter Zustand",[367],"Einzelner Agent",[369],"Sequenzielle Aufgaben verschlechterten sich in Googles Studie bei Multi-Agent-Varianten um 39 bis 70 %",[371,373,375,377],[372],"Parallele Änderungen an derselben Codebasis",[374],"Widersprüchliche Stil- und Randfall-Entscheidungen",[376],"Ein Schreiber, Helfer nur lesend",[378],"Cognition: Schreibzugriffe single-threaded halten",{"type":131,"content":380},[381],"Steht in einer Zeile „einzelner Agent“, ist die übliche Lösung für ein kriselndes System nicht ein weiterer Agent, sondern ein besserer Harness: klarere Anweisungen, bessere Tools, Compaction und Checkpoints. Anthropics eigener Rat in Building effective agents lautet, die einfachste mögliche Lösung zu suchen und die Komplexität nur zu erhöhen, wenn sie die Ergebnisse nachweislich verbessert; außerdem warnt der Beitrag, dass Frameworks Prompts und Antworten verschleiern und das Debugging erschweren können.",{"type":152,"level":153,"id":121,"text":122},{"type":170,"ordered":384,"items":385},true,[386,388,390,392,394,396,398,400],[387],"Baue zuerst die Single-Agent-Baseline, mit denselben Tools und einem fairen Token-Budget.",[389],"Schreibe das Isolationsargument auf: Was bleibt aus wessen Kontext draußen.",[391],"Ordne die Arbeit als leselastig oder schreiblastig ein. Halte Schreibzugriffe single-threaded.",[393],"Gib jedem Worker ein vollständiges Briefing: Ziel, Ausgabeformat, Tools, Grenzen und Abbruchbedingung, denn er erbt nichts.",[395],"Lege explizite Skalierungsregeln in den Lead-Prompt und eine harte Obergrenze für Worker und Durchläufe.",[397],"Füge einen Verifikationsschritt auf das zusammengeführte Ergebnis hinzu und entscheide, wer „fertig“ sagen darf.",[399],"Evaluiere beide Versionen zunächst an etwa 20 realistischen Anfragen, wie Anthropic vorschlägt, und erweitere dann die Menge. Vergleiche Qualität, Tokens, Latenz und Fehlerrate.",[401],"Protokolliere jede Delegation mit Briefing und Zusammenfassung, um verlorenen Kontext zu debuggen, und plane, wie laufende Agenten ein Deployment überstehen.",{"type":131,"content":403},[404,405,409],"Zum letzten Punkt: Anthropic merkt an, dass Agentenprozesse zustandsbehaftet und langlaufend sind, und nutzt deshalb Rainbow Deployments, die den Traffic schrittweise verschieben, statt laufende Durchläufe zu unterbrechen. Kostenkontrolle gehört zur selben Disziplin; die Werkzeuge aus ",{"tag":146,"to":406,"children":407},"\u002Fblog\u002Ftoken-saving-tools-coding-agents-top-20",[408],"Token-Spar-Tools für Coding-Agenten"," gelten auch für Worker.",{"type":152,"level":153,"id":124,"text":125},{"type":131,"content":412},[413],"Für einen typischen Unternehmensfall würde ich einen einzelnen Agenten mit starken Tools und gutem Harness ausliefern und genau ein Multi-Agent-Element ergänzen, wo das Isolationsargument stark ist: einen Research-Subagenten, der belegte Zusammenfassungen liefert, oder einen Reviewer mit sauberem Kontext für die Ausgabe. Beide lassen die Schreibzugriffe bei einem Agenten und sind leicht gegen die Baseline zu messen.",{"type":131,"content":415},[416,417,231],"Schwärme gleichberechtigter Agenten, offene Debatten zwischen Agenten desselben Modells und parallele Code-Schreiber würde ich meiden, bis sich die Evidenz ändert. Selbst Cognition, der lauteste Kritiker, beschreibt inzwischen eine engere Klasse von Multi-Agent-Designs, die funktionieren. Die jüngeren Herstellerbeiträge, die ich gelesen habe, beschreiben dieselbe Form: ein Orchestrator, der den Kontext besitzt, mit isolierten Helfern, die Zusammenfassungen zurückgeben. Diese Architektur lohnt sich zu lernen, und sie passt gut zu der ",{"tag":146,"to":418,"children":419},"\u002Fexpertise\u002Fai-engineer",[420],"KI-Engineering-Arbeit, die ich für Kunden mache",{"type":152,"level":153,"id":127,"text":128},{"type":170,"ordered":384,"items":423},[424,427,430,433,436,439,442,445,448,451,454],[425],{"tag":179,"href":37,"children":426},[36],[428],{"tag":179,"href":40,"children":429},[39],[431],{"tag":179,"href":43,"children":432},[42],[434],{"tag":179,"href":46,"children":435},[45],[437],{"tag":179,"href":49,"children":438},[48],[440],{"tag":179,"href":52,"children":441},[51],[443],{"tag":179,"href":55,"children":444},[54],[446],{"tag":179,"href":58,"children":447},[57],[449],{"tag":179,"href":61,"children":450},[60],[452],{"tag":179,"href":64,"children":453},[63],[455],{"tag":179,"href":67,"children":456},[66],[458,526,587,665],{"slug":459,"published":5,"minutes":460,"category":7,"tags":461,"keywords":465,"about":475,"sources":483,"cover":520,"og":521,"expertise":70,"locales":522,"lang":73,"title":523,"description":524,"coverAlt":525},"openai-dots-always-on-agents-impact",14,[462,10,463,464],"OpenAI dots","GPT-6 Astra","AI governance",[462,466,467,468,469,470,471,472,473,474],"what are OpenAI dots","OpenAI dots impact","always-on AI agents","GPT-6 Astra agents","dots Auto-review and Custom Rules","specialist dots for enterprise","OpenAI dots EU availability","OpenAI DevDay 2026","AI agents in the workplace",[476,479,482],{"name":477,"url":478},"OpenAI","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FOpenAI",{"name":480,"url":481},"ChatGPT","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FChatGPT",{"name":29,"url":30},[484,487,490,493,496,499,502,505,508,511,514,517],{"title":485,"url":486},"OpenAI: Introducing dots (29 September 2026)","https:\u002F\u002Fopenai.com\u002Findex\u002Fintroducing-dots\u002F",{"title":488,"url":489},"OpenAI: How we build safety, security and privacy into dots","https:\u002F\u002Fopenai.com\u002Findex\u002Fhow-we-build-safety-security-and-privacy-into-dots\u002F",{"title":491,"url":492},"OpenAI Help Center: Dots privacy, security, and safety FAQs","https:\u002F\u002Fhelp.openai.com\u002Fen\u002Farticles\u002F20001529-dots-privacy-security-and-safety-faqs",{"title":494,"url":495},"TechCrunch: OpenAI launches Dots, its bubbly agentic avatar","https:\u002F\u002Ftechcrunch.com\u002F2026\u002F09\u002F29\u002Fopenai-launches-dots-its-bubbly-agentic-avatar\u002F",{"title":497,"url":498},"Unite.AI: OpenAI rolls out dots agents powered by GPT-6 Astra in ChatGPT","https:\u002F\u002Fwww.unite.ai\u002Fopenai-rolls-out-dots-agents-powered-by-gpt-6-astra-in-chatgpt\u002F",{"title":500,"url":501},"MediaNama: OpenAI launches dots that keep working without user prompts","https:\u002F\u002Fwww.medianama.com\u002F2026\u002F10\u002F223-openai-launches-dots-devday-2026\u002F",{"title":503,"url":504},"PYMNTS: OpenAI launches dots to capture AI agent market","https:\u002F\u002Fwww.pymnts.com\u002Fnews\u002Fartificial-intelligence\u002F2026\u002Fopenai-launches-dots-to-capture-ai-agent-market\u002F",{"title":506,"url":507},"Yahoo Finance: OpenAI debuts Dots AI agents in challenge to Meta's Muse","https:\u002F\u002Ffinance.yahoo.com\u002Ftechnology\u002Farticle\u002Fopenai-debuts-dots-ai-agents-in-challenge-to-metas-popular-muse-agent-174616593.html",{"title":509,"url":510},"CNBC: OpenAI abandons plan to release upcoming model as safety concerns escalate","https:\u002F\u002Fwww.cnbc.com\u002F2026\u002F09\u002F28\u002Fopenai-abandons-plan-to-release-upcoming-model-as-safety-concerns-escalate.html",{"title":512,"url":513},"The Hacker News: OpenAI shelves GPT-6.1 Astra after tests find deception and unauthorized actions","https:\u002F\u002Fthehackernews.com\u002F2026\u002F09\u002Fopenai-shelves-gpt-61-astra-after-tests.html",{"title":515,"url":516},"Al Jazeera: OpenAI launches dots, personal AI assistant built to handle everything","https:\u002F\u002Fwww.aljazeera.com\u002Feconomy\u002F2026\u002F9\u002F30\u002Fopenai-launches-dots-personal-ai-assistant-built-to-handle-everything",{"title":518,"url":519},"RedactSure: Do OpenAI dots Custom Rules control what the agent sees?","https:\u002F\u002Fredactsure.com\u002Fresearch\u002Fdo-openai-dots-custom-rules-control-what-the-agent-sees","\u002Fimages\u002Fblog\u002Fopenai-dots-always-on-agents-impact\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fopenai-dots-always-on-agents-impact\u002Fog.jpg",[72,73,74],"OpenAI dots: Was Always-on-Agenten verändern werden, und was nicht","OpenAI dots: Always-on-Agenten auf GPT-6 Astra mit eigenem Rechner. Was gestartet ist, wo die Schutzmechanismen enden und was sich für Arbeit, IT und Europa ändert.","Diagramm: ein Dot auf GPT-6 Astra verzweigt zu Slack und Teams, mehr als 4.000 Apps, einem eigenen Cloud-Rechner und einer Person, die freigibt und prüft.",{"slug":527,"published":5,"minutes":528,"category":7,"tags":529,"keywords":533,"about":544,"sources":552,"cover":581,"og":582,"expertise":70,"locales":583,"lang":73,"title":584,"description":585,"coverAlt":586},"human-in-the-loop-ai-agents",13,[530,10,531,532],"Human in the loop","Approval gates","Agent safety",[534,535,536,537,538,539,540,541,542,543],"human in the loop AI agents","human in the loop KI-Agent","Mensch im Loop KI","AI agent approval gates","agent approval fatigue","LangGraph interrupt human in the loop","OpenAI Agents SDK needs_approval","Claude Agent SDK canUseTool","AI agent audit trail","risk tiers for AI agent actions",[545,548,549],{"name":546,"url":547},"Human-in-the-loop","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FHuman-in-the-loop",{"name":29,"url":30},{"name":550,"url":551},"Audit trail","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FAudit_trail",[553,556,559,562,565,568,571,574,577,580],{"title":554,"url":555},"LangChain docs: LangGraph interrupts","https:\u002F\u002Fdocs.langchain.com\u002Foss\u002Fpython\u002Flanggraph\u002Finterrupts",{"title":557,"url":558},"LangChain docs: Human-in-the-loop (HumanInTheLoopMiddleware)","https:\u002F\u002Fdocs.langchain.com\u002Foss\u002Fpython\u002Flangchain\u002Fhuman-in-the-loop",{"title":560,"url":561},"OpenAI Agents SDK (Python): Human in the loop","https:\u002F\u002Fgithub.com\u002Fopenai\u002Fopenai-agents-python\u002Fblob\u002Fmain\u002Fdocs\u002Fhuman_in_the_loop.md",{"title":563,"url":564},"Claude Agent SDK: Handle approvals and user input","https:\u002F\u002Fcode.claude.com\u002Fdocs\u002Fen\u002Fagent-sdk\u002Fuser-input",{"title":566,"url":567},"Claude Agent SDK: Configure permissions","https:\u002F\u002Fcode.claude.com\u002Fdocs\u002Fen\u002Fagent-sdk\u002Fpermissions",{"title":569,"url":570},"Claude Code docs: Hooks (PreToolUse defer, PermissionRequest)","https:\u002F\u002Fcode.claude.com\u002Fdocs\u002Fen\u002Fhooks",{"title":572,"url":573},"Anthropic Engineering: Claude Code auto mode","https:\u002F\u002Fanthropic.com\u002Fengineering\u002Fclaude-code-auto-mode",{"title":575,"url":576},"DevOps.com: Anthropic makes Claude Code auto mode the default","https:\u002F\u002Fdevops.com\u002Fanthropic-makes-claude-codes-auto-mode-the-default-betting-automation-beats-manual-review\u002F",{"title":578,"url":579},"EU AI Act, Article 14: Human oversight","https:\u002F\u002Fartificialintelligenceact.eu\u002Farticle\u002F14\u002F",{"title":488,"url":489},"\u002Fimages\u002Fblog\u002Fhuman-in-the-loop-ai-agents\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fhuman-in-the-loop-ai-agents\u002Fog.jpg",[72,73,74],"Human in the Loop bei KI-Agenten: wo Freigaben hingehören","Wo Freigabe-Gates in einem KI-Agenten sitzen, wie du Durchwinken vermeidest und wie Interrupt und Resume in LangGraph sowie den OpenAI- und Claude-Agent-SDKs funktionieren.","Diagramm: Ein Agent schlägt eine Aktion vor, ein Risiko-Gate leitet sie an automatische Ausführung, menschliche Freigabe oder Sperre, und jede Entscheidung landet im Audit-Log.",{"slug":588,"published":5,"minutes":528,"category":7,"tags":589,"keywords":593,"about":604,"sources":612,"cover":659,"og":660,"expertise":70,"locales":661,"lang":73,"title":662,"description":663,"coverAlt":664},"ai-agent-memory-design",[590,12,591,592],"AI agent memory","Memory poisoning","GDPR",[594,595,596,597,598,599,600,601,602,603],"AI agent memory design","long-term memory for AI agents","episodic semantic procedural memory LLM","agent memory architecture","ChatGPT memory vs Claude memory","Claude memory tool","AI memory poisoning","LLM context compaction","AI agent memory GDPR","short-term vs long-term memory agents",[605,606,609],{"name":29,"url":30},{"name":607,"url":608},"General Data Protection Regulation","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FGeneral_Data_Protection_Regulation",{"name":610,"url":611},"Prompt injection","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FPrompt_injection",[613,616,619,622,625,628,631,634,637,640,643,646,649,650,653,656],{"title":614,"url":615},"Anthropic docs: Memory tool","https:\u002F\u002Fplatform.claude.com\u002Fdocs\u002Fen\u002Fagents-and-tools\u002Ftool-use\u002Fmemory-tool",{"title":617,"url":618},"Anthropic docs: Context editing","https:\u002F\u002Fplatform.claude.com\u002Fdocs\u002Fen\u002Fbuild-with-claude\u002Fcontext-editing",{"title":620,"url":621},"Anthropic Engineering: Effective context engineering for AI agents","https:\u002F\u002Fwww.anthropic.com\u002Fengineering\u002Feffective-context-engineering-for-ai-agents",{"title":623,"url":624},"Sumers et al.: Cognitive Architectures for Language Agents (CoALA)","https:\u002F\u002Farxiv.org\u002Fabs\u002F2309.02427",{"title":626,"url":627},"Packer et al.: MemGPT, Towards LLMs as Operating Systems","https:\u002F\u002Farxiv.org\u002Fabs\u002F2310.08560",{"title":629,"url":630},"Park et al.: Generative Agents, Interactive Simulacra of Human Behavior","https:\u002F\u002Farxiv.org\u002Fabs\u002F2304.03442",{"title":632,"url":633},"Unit 42: When AI Remembers Too Much, persistent behaviors in agents memory","https:\u002F\u002Funit42.paloaltonetworks.com\u002Findirect-prompt-injection-poisons-ai-longterm-memory\u002F",{"title":635,"url":636},"From Untrusted Input to Trusted Memory: A Systematic Study of Memory Poisoning Attacks in LLM Agents (preprint)","https:\u002F\u002Farxiv.org\u002Fhtml\u002F2606.04329v1",{"title":638,"url":639},"The Hacker News: ChatGPT macOS flaw could have enabled long-term spyware via memory function","https:\u002F\u002Fthehackernews.com\u002F2024\u002F09\u002Fchatgpt-macos-flaw-couldve-enabled-long.html",{"title":641,"url":642},"Vectorize: OWASP ASI06, Memory and Context Poisoning explained","https:\u002F\u002Fvectorize.io\u002Farticles\u002Fowasp-asi06",{"title":644,"url":645},"Claude Help Center: Use chat search and memory to build on previous context","https:\u002F\u002Fsupport.claude.com\u002Fen\u002Farticles\u002F11817273-use-claude-s-chat-search-and-memory-to-build-on-previous-context",{"title":647,"url":648},"OpenAI Help Center: Memory in ChatGPT","https:\u002F\u002Fhelp.openai.com\u002Fen\u002Farticles\u002F8590148-memory-faq",{"title":491,"url":492},{"title":651,"url":652},"Flavio Copes: A deep dive into OpenAI dots (quotes the dots documentation on memory)","https:\u002F\u002Fflaviocopes.com\u002Fopenai-dots\u002F",{"title":654,"url":655},"GDPR Article 5: Principles relating to processing of personal data","https:\u002F\u002Fgdpr-info.eu\u002Fart-5-gdpr\u002F",{"title":657,"url":658},"GDPR Article 17: Right to erasure","https:\u002F\u002Fgdpr-info.eu\u002Fart-17-gdpr\u002F","\u002Fimages\u002Fblog\u002Fai-agent-memory-design\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fai-agent-memory-design\u002Fog.jpg",[72,73,74],"Memory für KI-Agenten entwerfen: Ebenen, Schreibregeln, Poisoning und DSGVO","So entwirfst du das Gedächtnis von KI-Agenten: Kontext, Session, Langzeit, was du speicherst und nie speicherst, Retrieval, Compaction, Poisoning, DSGVO.","Diagramm: verschachtelte Gedächtnisebenen eines KI-Agenten, vom Arbeitskontext über den Session-Zustand bis zum episodischen und semantischen Langzeitgedächtnis.",{"slug":666,"published":5,"minutes":528,"category":7,"tags":667,"keywords":673,"about":684,"sources":694,"cover":749,"og":750,"expertise":70,"locales":751,"lang":73,"title":752,"description":753,"coverAlt":754},"voice-agents-realtime-latency",[668,669,670,671,672],"Voice agents","Realtime API","Latency","Telephony","AI Act",[674,675,676,677,678,679,680,681,682,683],"voice agents","speech-to-speech vs STT LLM TTS","OpenAI Realtime API","Gemini Live API","voice agent latency budget","turn detection and barge-in","Pipecat vs LiveKit","AI voice agent SIP telephony","German Hungarian voice AI","AI Act Article 50 voice bot disclosure",[685,688,691],{"name":686,"url":687},"Voice user interface","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FVoice_user_interface",{"name":689,"url":690},"Speech recognition","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FSpeech_recognition",{"name":692,"url":693},"Artificial Intelligence Act","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FArtificial_Intelligence_Act",[695,698,701,704,707,710,713,716,719,722,725,728,731,734,737,740,743,746],{"title":696,"url":697},"OpenAI: Voice agents guide","https:\u002F\u002Fdevelopers.openai.com\u002Fapi\u002Fdocs\u002Fguides\u002Fvoice-agents",{"title":699,"url":700},"OpenAI: gpt-realtime model page","https:\u002F\u002Fdevelopers.openai.com\u002Fapi\u002Fdocs\u002Fmodels\u002Fgpt-realtime",{"title":702,"url":703},"OpenAI: Voice activity detection in the Realtime API","https:\u002F\u002Fdevelopers.openai.com\u002Fapi\u002Fdocs\u002Fguides\u002Frealtime-vad",{"title":705,"url":706},"OpenAI: Realtime API with SIP","https:\u002F\u002Fdevelopers.openai.com\u002Fapi\u002Fdocs\u002Fguides\u002Frealtime-sip",{"title":708,"url":709},"OpenAI: Realtime conversations (function calling, interruption)","https:\u002F\u002Fdevelopers.openai.com\u002Fapi\u002Fdocs\u002Fguides\u002Frealtime-conversations",{"title":711,"url":712},"Google: Gemini Live API overview","https:\u002F\u002Fai.google.dev\u002Fgemini-api\u002Fdocs\u002Flive",{"title":714,"url":715},"Google: Gemini Live API capabilities guide","https:\u002F\u002Fai.google.dev\u002Fgemini-api\u002Fdocs\u002Flive-guide",{"title":717,"url":718},"Deepgram: Flux quickstart","https:\u002F\u002Fdevelopers.deepgram.com\u002Fdocs\u002Fflux\u002Fquickstart",{"title":720,"url":721},"Deepgram: Models and languages overview","https:\u002F\u002Fdevelopers.deepgram.com\u002Fdocs\u002Fmodels-languages-overview",{"title":723,"url":724},"ElevenLabs: Agents platform overview","https:\u002F\u002Felevenlabs.io\u002Fdocs\u002Feleven-agents\u002Foverview",{"title":726,"url":727},"ElevenLabs: Text to speech models and languages","https:\u002F\u002Felevenlabs.io\u002Fdocs\u002Foverview\u002Fcapabilities\u002Ftext-to-speech",{"title":729,"url":730},"LiveKit: Agents overview","https:\u002F\u002Fdocs.livekit.io\u002Fagents\u002F",{"title":732,"url":733},"LiveKit: Turn detector","https:\u002F\u002Fdocs.livekit.io\u002Fagents\u002Flogic\u002Fturns\u002Fturn-detector\u002F",{"title":735,"url":736},"Pipecat: Introduction","https:\u002F\u002Fdocs.pipecat.ai\u002Fgetting-started\u002Fintroduction",{"title":738,"url":739},"Pipecat: Smart Turn model (GitHub)","https:\u002F\u002Fgithub.com\u002Fpipecat-ai\u002Fsmart-turn",{"title":741,"url":742},"Fora Soft: Voice AI agents on LiveKit, 2026 engineer playbook","https:\u002F\u002Fwww.forasoft.com\u002Fblog\u002Farticle\u002Fvoice-ai-agents-livekit-guide",{"title":744,"url":745},"EU AI Act: Article 50, transparency obligations","https:\u002F\u002Fartificialintelligenceact.eu\u002Farticle\u002F50\u002F",{"title":747,"url":748},"Jones Walker: Yes, August 2 still matters (AI Act delay and Article 50)","https:\u002F\u002Fwww.joneswalker.com\u002Fen\u002Finsights\u002Fblogs\u002Fai-law-blog\u002Fyes-august-2-still-matters-the-eu-approved-a-high-risk-ai-delay-but-most-trans.html?id=102nbon","\u002Fimages\u002Fblog\u002Fvoice-agents-realtime-latency\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fvoice-agents-realtime-latency\u002Fog.jpg",[72,73,74],"Voice Agents bauen: Realtime Speech-to-Speech oder STT, LLM und TTS?","Realtime Speech-to-Speech oder kaskadierte Pipeline? Latenzbudget je Stufe, Turn-Taking, Tool-Calls, SIP, Qualität auf Deutsch und Ungarisch, KI-VO-Hinweispflicht.","Diagramm: Ein Anrufer erreicht per SIP oder WebRTC einen Voice Agent, der sich in Turn-Erkennung, Spracherkennung, ein LLM mit Tools und Sprachsynthese verzweigt.",1791009037517]