[{"data":1,"prerenderedAt":704},["ShallowReactive",2],{"tool-elevenlabs-de":3},{"slug":4,"published":5,"minutes":6,"category":7,"tags":8,"keywords":13,"about":20,"sources":27,"cover":51,"og":52,"expertise":53,"locales":54,"lang":56,"title":58,"description":59,"coverAlt":60,"url":61,"pricing":62,"kind":63,"metaTitle":64,"takeaways":65,"faq":71,"toc":84,"blocks":109,"others":478},"elevenlabs","2026-05-27",10,"web",[9,10,11,12],"Text to speech","Voice API","Speech to text","Voice cloning",[4,14,15,16,17,18,19],"elevenlabs api pricing","elevenlabs vs openai tts","text to speech api comparison","elevenlabs flash latency","voice cloning api","eleven v4 model",[21,24],{"name":22,"url":23},"ElevenLabs","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FElevenLabs",{"name":25,"url":26},"Speech synthesis","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FSpeech_synthesis",[28,31,34,37,40,42,45,48],{"title":29,"url":30},"ElevenLabs pricing: plans and credits","https:\u002F\u002Felevenlabs.io\u002Fpricing",{"title":32,"url":33},"ElevenAPI pricing: per-product rates","https:\u002F\u002Felevenlabs.io\u002Fpricing\u002Fapi",{"title":35,"url":36},"ElevenLabs documentation: models","https:\u002F\u002Felevenlabs.io\u002Fdocs\u002Fmodels",{"title":38,"url":39},"API reference: create speech","https:\u002F\u002Felevenlabs.io\u002Fdocs\u002Fapi-reference\u002Ftext-to-speech\u002Fconvert",{"title":41,"url":23},"Wikipedia: ElevenLabs",{"title":43,"url":44},"Amazon Polly pricing","https:\u002F\u002Faws.amazon.com\u002Fpolly\u002Fpricing\u002F",{"title":46,"url":47},"OpenAI API pricing","https:\u002F\u002Fdevelopers.openai.com\u002Fapi\u002Fdocs\u002Fpricing",{"title":49,"url":50},"SILMA AI: text to speech price comparison, August 2026","https:\u002F\u002Fsilma.ai\u002Fblog\u002Ftext-to-speech-price-comparison-august-2026","\u002Fimages\u002Fblog\u002Felevenlabs\u002Fcover.webp","\u002Fimages\u002Fblog\u002Felevenlabs\u002Fog.jpg","ai-engineer",[55,56,57],"en","de","hu","ElevenLabs: Sprachsynthese als API","Ein Review der ElevenLabs-Audio-API: Modellpalette, Latenzangaben, Guthaben- und Zeichenpreise, formatabhängige Stufen, und wo OpenAI und Amazon Polly besser sind.","ElevenLabs-Covermotiv mit Beschriftungen einer Sprach-API-Pipeline","https:\u002F\u002Felevenlabs.io","Free tier · from $5 per month","Voice and audio API","ElevenLabs: Sprachsynthese als API · Balázs Csorba",[66,67,68,69,70],"Die API verlangt 0,04 US-Dollar je 1.000 Zeichen für Flash und v4 Turbo und 0,08 Dollar für v3 und Multilingual v2, etwa drei- bis fünfmal so viel wie die Massenstufe, in der OpenAI, Google und xAI liegen.","Jede Latenzangabe in der Modelltabelle ist reine Inferenzzeit und in der Dokumentation ausdrücklich ohne Anwendungs- und Netzlaufzeit erklärt.","Nützliche Ausgabeformate sind tarifabhängig: MP3 mit 192 kbps erfordert Creator, PCM oder WAV mit 44,1 kHz den 99-Dollar-Tarif Pro.","Der Gratisplan gibt 10.000 Guthaben pro Monat ohne kommerzielle Lizenz, und bei Multilingual v2 beginnt die Parallelität bei zwei Anfragen.","Nichts ist selbst betreibbar, die geklonte Stimme und die Prosodie eines Produkts werden also gemietet statt besessen.",[72,75,78,81],{"q":73,"a":74},"Was kostet ElevenLabs je 1.000 Zeichen?","In der API 0,04 Dollar für Flash und v4 Turbo sowie 0,08 Dollar für v3 und Multilingual v2, mit einer Aktionsrate von 0,022 Dollar für Eleven v4 bis zum 12. Oktober 2026. Die Creative-Tarife rechnen stattdessen in Guthaben, von 6 Dollar für 30.000 Guthaben bei Starter bis 990 Dollar für 6 Millionen bei Business; alle Produkte teilen sich einen einzigen Pool.",{"q":76,"a":77},"Welches ElevenLabs-Modell hat die niedrigste Latenz?","Eleven Flash v2.5 nennt etwa 75 ms und Eleven v4 Turbo etwa 100 ms, jeweils als mediane Inferenzlatenz ohne Anwendungs- und Netzlaufzeit. Flash v2.5 akzeptiert zudem 40.000 Zeichen pro Anfrage, die größte Grenze der Palette, gegen 10.000 bei Eleven v4.",{"q":79,"a":80},"Darf man ElevenLabs-Ausgabe im Gratisplan kommerziell nutzen?","Nein. Die kommerzielle Lizenz beginnt mit dem Starter-Tarif für 6 Dollar im Monat, der auch das Instant Voice Cloning freischaltet. Professionelles Cloning kommt mit Creator (22 Dollar), 44,1-kHz-PCM-Ausgabe über die API mit Pro (99 Dollar).",{"q":82,"a":83},"Läuft ElevenLabs in der eigenen Cloud?","Nein. Es ist eine gehostete API mit Region-Endpunkten in den USA, der EU, Indien und Singapur, Zero Retention ist eine Enterprise-Option. Selbsteinbau oder offene Gewichte gibt es nicht; ein Ausstieg bedeutet Neuabmischung oder Neuaufnahme.",[85,88,91,94,97,100,103,106],{"id":86,"title":87},"what-it-is","Was es ist",{"id":89,"title":90},"how-it-works","Wie es funktioniert",{"id":92,"title":93},"models","Modelle und Latenz",{"id":95,"title":96},"getting-started","Erste Schritte",{"id":98,"title":99},"pricing","Preise",{"id":101,"title":102},"where-it-shingles","Wo es klemmt",{"id":104,"title":105},"verdict","Fazit",{"id":107,"title":108},"sources","Quellen",[110,114,123,126,129,169,170,178,187,202,203,206,259,266,267,284,286,293,305,306,309,346,349,352,358,359,362,408,411,412,415,428,437,443,444],{"type":111,"content":112},"paragraph",[113],"ElevenLabs ist eine gehostete Audio-API: Sprachausgabe, Spracherkennung, Synchronisation, Soundeffekte, Musik und eine Pipeline für Sprachagenten hinter einem einzigen Schlüssel. Das Ergebnis ist nach wie vor der Grund, warum Teams das Werkzeug wählen, und die Position hier ist bewusst eng gekauft wird für Sprachqualität und Sprachabdeckung, nicht für die Preisarchitektur, die so gebaut ist, dass ein Zeichenpreis nie so richtig auf die Konkurrenz passt.",{"type":111,"content":115},[116,117,122],"Es besetzt die Stelle, die früher ein Cloud-TTS-Dienst einnahm: ein HTTP-Aufruf in einer Content-Pipeline oder ein WebSocket in einem Sprachagenten, und es konkurriert im Preis mit den Audio-Modellen von OpenAI, Amazon Polly und Google Chirp. Alle drei sind je fertiger Minute billiger. Keiner davon bietet professionelles Stimmcloning zusammen mit einer expressiven Modellfamilie, und genau das ist das Produkt. Teams, die eine ",{"tag":118,"to":119,"children":120},"link","\u002Fblog\u002Fvoice-agents-realtime-latency",[121],"Echtzeit-Schleife"," bauen, interessieren sich für diesen Unterschied mehr als für die Modelldatenblätter.",{"type":124,"level":125,"id":86,"text":87},"heading",2,{"type":111,"content":127},[128],"ElevenLabs wurde 2022 von Piotr Dąbkowski und Mati Staniszewski gegründet, sitzt in London mit Büros in New York, Warschau und San Francisco, und der Wikipedia-Eintrag nennt für 2026 rund 400 Mitarbeitende. Das Unternehmen verkauft drei Oberflächen: ElevenCreative im Browser, ElevenAPI für nutzungsabhängige Abrechnung und ElevenAgents für Sprachagenten. Jedes Modell dahinter ist proprietär. Es gibt keine offenen Gewichte und keine Selbstbetriebsvariante, nur Region-Endpunkte.",{"type":130,"ordered":131,"items":132},"list",false,[133,139,144,149,154,159,164],[134,138],{"tag":135,"children":136},"strong",[137],"Proprietäre Modelle"," hinter einer REST-API: nichts zu deployen, keine Gewichte herunterzuladen, keine On-Premises-Variante, nur Region-Hosts.",[140,143],{"tag":135,"children":141},[142],"Sprachausgabe"," umfasst eleven_v4, eleven_v4_turbo, eleven_v3, eleven_multilingual_v2 und eleven_flash_v2_5, mit über 90 Sprachen in der v4-Familie und 29 bei Multilingual v2.",[145,148],{"tag":135,"children":146},[147],"Spracherkennung"," nutzt Scribe v2, Scribe v2 Realtime mit etwa 150 ms und Scribe v2 Medical, mit Sprechererkennung für bis zu 32 Personen und 65 Entitätstypen.",[150,153],{"tag":135,"children":151},[152],"Gratisplan"," gibt 10.000 Guthaben pro Monat ohne kommerzielle Lizenz; die kommerzielle Nutzung beginnt mit Starter für 6 Dollar.",[155,158],{"tag":135,"children":156},[157],"Sechs öffentliche Tarife",": 0, 6, 22, 99, 299 und 990 Dollar pro Monat, dazu individuelle Enterprise-Konditionen mit SSO, DPA und SLA.",[160,163],{"tag":135,"children":161},[162],"Region-Endpunkte"," für api.elevenlabs.io neben Hosts in den USA, der EU, Indien und Singapur.",[165,168],{"tag":135,"children":166},[167],"Die Parallelität hängt am Tarif",": 2 gleichzeitige Multilingual-v2-Anfragen im Gratisplan, 5 bei Creator, 10 bei Pro, 15 bei Business.",{"type":124,"level":125,"id":89,"text":90},{"type":111,"content":171},[172,173,177],"Ein Synthesearuf ist ein einziges POST an ",{"tag":174,"children":175},"code",[176],"\u002Fv1\u002Ftext-to-speech\u002F{voice_id}"," mit dem Ausgabeformat in der Query-Zeichenkette und einem JSON-Body aus text, model_id und optionalen voice_settings. Die Antwort ist die Audiodatei selbst, als Byte-Strom statt als JSON-Hülle, und die offiziellen SDKs zeigen dieselbe Form. Für Echtzeit gibt es einen WebSocket-Endpunkt, bei dem nur die Zeit angerechnet wird, in der das Modell wirklich erzeugt. Determinismus ist Absicht, kein Versprechen: ein seed wiederholt einen Take, previous_text oder previous_request_ids halten die Prosodie über Blöcke hinweg stabil.",{"type":179,"attrs":180,"inner":184,"caption":185},"diagram",{"viewBox":181,"role":182,"aria-labelledby":183},"0 0 720 300","img","d1-el-t d1-el-d","\u003Ctitle id=\"d1-el-t\">ElevenLabs: eine Anfrage von Text zu Audio\u003C\u002Ftitle>\u003Cdesc id=\"d1-el-d\">Text wird normalisiert, an ein Modell übergeben, im gewünschten Format kodiert und als Audiodaten zurückgegeben. Der Tarif bestimmt Parallelität und Warteschlangenpriorität und entscheidet überhaupt, welche Ausgabeformate erreichbar sind.\u003C\u002Fdesc>\u003Ctext x=\"20\" y=\"28\" class=\"d-title\">ElevenLabs: eine Anfrage von Text zu Audio\u003C\u002Ftext>\u003Ctext x=\"700\" y=\"28\" text-anchor=\"end\" class=\"d-label\">elevenlabs.io Doku\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"56\" class=\"d-label\">JEDE ANFRAGE\u003C\u002Ftext>\u003Crect x=\"20\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"80\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Text\u003C\u002Ftext>\u003Ctext x=\"80\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">seed, Historie\u003C\u002Ftext>\u003Cpath d=\"M140 102 H152\" class=\"d-line\" \u002F>\u003Cpath d=\"M160 102 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"160\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"220\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Normalisieren\u003C\u002Ftext>\u003Ctext x=\"220\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">Zahlen, Einheiten\u003C\u002Ftext>\u003Cpath d=\"M280 102 H292\" class=\"d-line\" \u002F>\u003Cpath d=\"M300 102 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"300\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"360\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Modell\u003C\u002Ftext>\u003Ctext x=\"360\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">v4, flash\u003C\u002Ftext>\u003Cpath d=\"M420 102 H432\" class=\"d-line\" \u002F>\u003Cpath d=\"M440 102 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"440\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"500\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Kodieren\u003C\u002Ftext>\u003Ctext x=\"500\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">mp3, pcm, wav\u003C\u002Ftext>\u003Cpath d=\"M560 102 H572\" class=\"d-line\" \u002F>\u003Cpath d=\"M580 102 l-9 -5 v10 z\" class=\"d-head\" \u002F>\u003Crect x=\"580\" y=\"70\" width=\"120\" height=\"64\" rx=\"10\" class=\"d-accent\" \u002F>\u003Ctext x=\"640\" y=\"98\" text-anchor=\"middle\" class=\"d-text\">Audio\u003C\u002Ftext>\u003Ctext x=\"640\" y=\"119\" text-anchor=\"middle\" class=\"d-small\">Bytes raus\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"172\" class=\"d-label\">VOM TARIF BESTIMMT\u003C\u002Ftext>\u003Cpath d=\"M330 134 C330 162 185 160 185 176\" class=\"d-line\" \u002F>\u003Cpath d=\"M185 186 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Cpath d=\"M390 134 C390 162 535 160 535 176\" class=\"d-line\" \u002F>\u003Cpath d=\"M535 186 l-5 -9 h10 z\" class=\"d-head\" \u002F>\u003Crect x=\"20\" y=\"186\" width=\"330\" height=\"64\" rx=\"10\" class=\"d-mint\" \u002F>\u003Ctext x=\"185\" y=\"214\" text-anchor=\"middle\" class=\"d-text\">Warteschlange\u003C\u002Ftext>\u003Ctext x=\"185\" y=\"235\" text-anchor=\"middle\" class=\"d-small\">2 gratis, 15 business\u003C\u002Ftext>\u003Crect x=\"370\" y=\"186\" width=\"330\" height=\"64\" rx=\"10\" class=\"d-gold\" \u002F>\u003Ctext x=\"535\" y=\"214\" text-anchor=\"middle\" class=\"d-text\">Formatgrenzen\u003C\u002Ftext>\u003Ctext x=\"535\" y=\"235\" text-anchor=\"middle\" class=\"d-small\">pcm 44,1 braucht pro\u003C\u002Ftext>",[186],"Zeichen bestimmen die Rechnung; der Tarif bestimmt Wartepriorität und welche Ausgabeformate es überhaupt gibt.",{"type":111,"content":188},[189,190,193,194,197,198,201],"Die Formatwahl macht die Tarifstruktur sichtbar. Standard ist ",{"tag":174,"children":191},[192],"mp3_44100_128","; MP3 mit 192 kbps erfordert Creator, PCM oder WAV mit 44,1 kHz erfordert Pro, und genau das ist die Stufe, die die meisten Sprach-Pipelines wirklich brauchen. Die Parallelität wird über eine Warteschlange umgesetzt statt über eine Ablehnung, und laut Dokumentation kostet das Überschreiten der Grenze typischerweise rund 50 ms. Die Antwort-Header ",{"tag":174,"children":195},[196],"current-concurrent-requests"," und ",{"tag":174,"children":199},[200],"maximum-concurrent-requests"," sind die einzige Telemetrie dafür.",{"type":124,"level":125,"id":92,"text":93},{"type":111,"content":204},[205],"Die Modellseite veröffentlicht Latenzangaben mit einem Fußnote, die zählt: Jede Zahl steht dort ausdrücklich ohne Anwendungs- und Netzlaufzeit. Lesen Sie sie als reine Inferenzzeit, vergleichbar zwischen Flash und Multilingual v2, und ungeeignet als Zusagen an Endnutzer, solange der Socket-Pfad zur gewählten Region nicht gemessen wurde.",{"type":207,"head":208,"rows":217},"table",[209,211,213,215],[210],"Modell",[212],"Veröffentlichte Latenz",[214],"Sprachen",[216],"Zeichen pro Anfrage",[218,227,234,243,250],[219,221,223,225],[220],"eleven_v4",[222],"Keine Zahl veröffentlicht",[224],"90+",[226],"10.000",[228,230,232,233],[229],"eleven_v4_turbo",[231],"Etwa 100 ms mediane Inferenz",[224],[226],[235,237,239,241],[236],"eleven_flash_v2_5",[238],"Etwa 75 ms",[240],"32",[242],"40.000",[244,246,247,249],[245],"eleven_multilingual_v2",[222],[248],"29",[226],[251,253,255,257],[252],"eleven_v3",[254],"280 ms in der Conversational-Variante",[256],"70+",[258],"5.000",{"type":111,"content":260},[261,262,265],"Ein verhaltensbezogenes Detail entscheidet häufiger über die Modellauswahl als die Qualität. Flash v2.5 lässt die Textnormalisierung ausdrücklich aus, um die Latenz zu schützen, weshalb Telefonnummern, Daten und Währungen holprig klingen; mit ",{"tag":174,"children":263},[264],"apply_text_normalization"," einschalten geht bei den v2.5-Modellen nur im Enterprise-Tarif. Multilingual v2 rechnet Zahlen korrekt ab, und deshalb empfiehlt die Dokumentation, den Text vor der Synthese im LLM normalisieren zu lassen, statt es in der TTS-Anfrage zu bezahlen.",{"type":124,"level":125,"id":95,"text":96},{"type":111,"content":268},[269,270,273,274,277,278,280,281,283],"Der Python-Client installiert mit ",{"tag":174,"children":271},[272],"pip install elevenlabs",", der Schlüssel liegt im Dashboard unter Developers. Das folgende Snippet erzeugt einen Clip mit dem Standardausgabeformat; ein Wechsel von ",{"tag":174,"children":275},[276],"model_id"," auf ",{"tag":174,"children":279},[236]," bringt Latenz und 40.000 Zeichen Grenze, ein Wechsel auf ",{"tag":174,"children":282},[220]," bringt das neueste Modell.",{"type":174,"code":285},"# pip install elevenlabs\nfrom elevenlabs import ElevenLabs\n\nclient = ElevenLabs(api_key=\"xi-api-key\")\n\naudio = client.text_to_speech.convert(\n    voice_id=\"JBFqnCBsd6RMkjVDRZzb\",\n    output_format=\"mp3_44100_128\",\n    text=\"The first move is what sets everything in motion.\",\n    model_id=\"eleven_multilingual_v2\",\n)\n\nwith open(\"clip.mp3\", \"wb\") as f:\n    for chunk in audio:\n        f.write(chunk)",{"type":111,"content":287},[288,289,292],"Zwei Regler ändern das Verhalten, ohne den Preis zu ändern: die voice_settings (stability, similarity_boost, style, speed) und der Sprachcode. Für langen Text in Blöcke teilen und ",{"tag":174,"children":290},[291],"previous_request_ids"," mitgeben, damit die Prosodie zwischen den Anfragen weiterläuft. Für Agenten über den WebSocket streamen statt einen kompletten MP3 zu puffern, denn Puffern schiebt die gesamte Generierungszeit vor das erste hörbare Byte.",{"type":294,"variant":295,"title":296,"body":297},"callout","warn","Bevor das in Produktion geht",[298,300],[299],"Der Gratisplan enthält keine kommerzielle Lizenz, und erzeugt wird pro Anfrage berechnet, nicht pro Download. Alles, was bei Nutzern ankommt, braucht mindestens Starter, und geklonte Stimmen brauchen Creator für professionelles Cloning.",[301,302,304],"Die Parallelität beginnt bei 2 gleichzeitigen Multilingual-v2-Anfragen im Gratisplan und 5 bei Creator, ein Burst paralleler Renders läuft also in die Warteschlange statt zu scheitern. Backoff um ",{"tag":174,"children":303},[196]," herum bauen statt um HTTP 429, denn dort steckt die Latenz tatsächlich.",{"type":124,"level":125,"id":98,"text":99},{"type":111,"content":307},[308],"Es gibt zwei Zählwerke, und sie lassen sich nicht ineinander umrechnen. Die Creative-Tarife rechnen in Guthaben, einem einzigen geteilten Pool, aus dem jedes Produkt zehrt: Sprachausgabe kostet etwa ein Guthaben pro Zeichen, Spracherkennung 330 Guthaben pro Minute, Musik 900 pro Minute, Synchronisation 2.000 pro Minute. Die ElevenAPI-Seite wird in US-Dollar statt in Guthaben abgerechnet, und nur diese Fassung lässt sich gegen eine Fremdpreistabelle legen.",{"type":130,"ordered":131,"items":310},[311,316,321,326,331,336,341],[312,315],{"tag":135,"children":313},[314],"Free",": 0 Dollar, 10.000 Guthaben pro Monat, keine kommerzielle Lizenz.",[317,320],{"tag":135,"children":318},[319],"Starter",": 6 Dollar, 30.000 Guthaben, kommerzielle Lizenz, Instant Voice Cloning.",[322,325],{"tag":135,"children":323},[324],"Creator",": 22 Dollar, 121.000 Guthaben, professionelles Stimmcloning, Audio mit 192 kbps.",[327,330],{"tag":135,"children":328},[329],"Pro",": 99 Dollar, 600.000 Guthaben, 44,1-kHz-PCM und WAV über die API.",[332,335],{"tag":135,"children":333},[334],"Scale",": 299 Dollar, 1.800.000 Guthaben, 3 Arbeitsplatzplätze.",[337,340],{"tag":135,"children":338},[339],"Business",": 990 Dollar, 6.000.000 Guthaben, 10 Plätze, Sprachausgabe mit niedriger Latenz ab 5 Cent pro Minute.",[342,345],{"tag":135,"children":343},[344],"Jahresabrechnung"," kostet zehn Monate für zwölf, damit liegt Starter bei 5 Dollar und Pro bei 82,50 Dollar pro Monat.",{"type":111,"content":347},[348],"In der API kostet Sprachausgabe 0,04 Dollar je 1.000 Zeichen für Flash und v4 Turbo sowie 0,08 Dollar für v3 und Multilingual v2, mit einer Aktionsrate von 0,022 Dollar für Eleven v4 bis zum 12. Oktober 2026. Spracherkennung kostet 0,22 Dollar die Stunde für Scribe v2 und 0,39 Dollar für Scribe v2 Realtime, die Speech Engine für Agenten 0,08 Dollar pro Minute mit Burst-Abrechnung bei 0,16 Dollar, Musik 0,15 Dollar pro Minute, und die Synchronisation läuft von 0,33 Dollar pro Minute mit Wasserzeichen bis 2,20 Dollar für Dubbing v2.",{"type":111,"content":350},[351],"Guthaben rollen bis zu zwei Monate weiter, solange ein bezahlter Tarif aktiv ist, der Saldo erreicht damit höchstens das Dreifache des Monatskontingents, und Pay-as-you-go-Aufladungen fallen außerhalb dieser Grenze an. Nicht verbrauchtes Guthaben verfällt beim Downgrade oder bei der Kündigung, was das Jahresabo von einem Rabatt zu einer Wette auf Nutzung macht.",{"type":294,"variant":353,"title":354,"body":355},"tip","Mit Listenpreisen planen",[356],[357],"Eine Aktionsrate ist keine Architektur. Der am 25. August 2026 veröffentlichte Vergleich, der jeden Anbieter auf Dollar je fertiger Minute normiert, nennt als Massenstufe etwa 0,015 Dollar, mit OpenAI, Google und xAI alle im Rundungsfehler darum, und expressive Modelle bei 0,04 bis 0,10 Dollar. ElevenLabs sitzt in dieser Premiumstufe mit Absicht. Vor der Unterschrift zählt die Frage, ob Prosodie und Cloning für diese Last zwei- bis fünfmal den Massenpreis rechtfertigen.",{"type":124,"level":125,"id":101,"text":102},{"type":111,"content":360},[361],"Die Schwächen sind strukturell, nicht kosmetisch. Nichts lässt sich selbst betreiben, Verfügbarkeit, Speicherung und Preis sind also Entscheidungen des Anbieters, und Zero Retention existiert nur als Parameter im Enterprise-Tarif. Die Zeichengrenzen je Anfrage begrenzen Langform bei Eleven v4 auf 10.000 und bei Flash auf 40.000 Zeichen, ein Buch ist also eine Schleife aus zusammengenähten Anfragen. Der Guthabenpool macht die Kostenplanung schwerer als ein klarer Zeichenpreis, nützliche Formate hängen an Tarifgrenzen statt an Funktionsgrenzen, und der Gratisplan erlaubt kommerzielle Nutzung gar nicht.",{"type":207,"head":363,"rows":371},[364,366,367,369],[365],"Merkmal",[22],[368],"OpenAI TTS",[370],"Amazon Polly",[372,381,390,399],[373,375,377,379],[374],"Preis je 1.000 Zeichen",[376],"0,04 Dollar für Flash und v4 Turbo, 0,08 Dollar für v3 und Multilingual v2",[378],"0,015 Dollar für tts-1 und 0,030 Dollar für tts-1-hd; gpt-4o-mini-tts rechnet Audiotoken",[380],"0,004 Dollar Standard, 0,016 Dollar Neural, 0,030 Dollar Generative",[382,384,386,388],[383],"Abrechnungseinheit",[385],"Zeichen in der API, ein geteilter Guthabenpool in den Creative-Tarifen",[387],"Zeichen für tts-1, Audiotoken für gpt-4o-mini-tts",[389],"Zeichen, monatlich abgerechnet",[391,393,395,397],[392],"Gratisstufe",[394],"10.000 Guthaben pro Monat, kommerzielle Lizenz ab Starter",[396],"Auf der Preisseite nicht gelistet",[398],"5 Millionen Standard-Zeichen pro Monat in den ersten 12 Monaten",[400,402,404,406],[401],"Wofür es passt",[403],"Geklonte und expressive Stimmen, über 90 Sprachen, Figurenarbeit",[405],"Nutzsprache neben einem bestehenden OpenAI-Stack",[407],"Masseninneres in AWS, mit kostenloser zwischengespeicherter Wiedergabe",{"type":111,"content":409},[410],"Das Lock-in ist die Stimme selbst. Eine geklonte Stimme, die Aussprachewörterbücher und die Prosodie-Entscheidungen einer Produktlinie haben kein Exportformat, ein Ausstiegsplan ist also wirklich ein Neuaufnahmeplan. Behandeln Sie die Audiodatei als das Artefakt und die API als Lieferanten, der sich nur durch Neusynthese ersetzen lässt, und bewahren Sie Quelltext und seed für jeden Take auf, den Sie reproduzieren wollen.",{"type":124,"level":125,"id":104,"text":105},{"type":111,"content":413},[414],"Einsetzen, wenn die Stimme Teil des Produkts ist. ElevenLabs ist die richtige Wahl für Hörbücher, Figurenarbeit, mehrsprachige Erzählung und jede Oberfläche, auf der Zuhörer den Unterschied hören; die falsche Wahl für reine Nutzsprache, wo Polly mit 0,016 Dollar je tausend Zeichen denselben Job erledigt. Die Schwachstelle sind die Preise: erst nach dem Normieren lesbar, die sie an Funktionen, und wer die FAQs vor der Architektur liest, wird belohnt.",{"type":130,"ordered":416,"items":417},true,[418,420,422,424,426],[419],"Wählen, wenn Sprachqualität für Nutzer hörbar ist: Erzählung, Figuren, Werbematerial, mehrsprachige Inhalte.",[421],"Für Agenten Flash oder v4 Turbo nehmen und die Anfrage im WebSocket lassen; 75 ms und 100 ms als Inferenzwerte behandelt, nicht als Round-Trip-Zusage.",[423],"Bei geklonten Stimmen oder 192-kbps-Audio ab Creator budgetieren, bei 44,1-kHz-PCM in der Pipeline ab Pro.",[425],"Nicht wählen für reine Nutzsprache, nicht ohne Enterprise-Konditionen für Datenresidenz, nicht für alles, was in der eigenen VPC laufen muss.",[427],"Die Rechnung in Zeichen je fertiger Audiominute modellieren statt in Guthaben, und diese Einheit vor der Bindung gegen einen Wettbewerber prüfen.",{"type":429,"content":430},"quote",[431,432,436],"Die Fußnote unter jeder Latenzangabe der Modelldokumentation lautet ",{"tag":433,"children":434},"em",[435],"ohne Anwendungs- und Netzlaufzeit",". Eine Architekturentscheidung, die 75 ms zitiert, ohne den Socket-Pfad zu messen, zitiert eine Zahl, aus der bereits der Teil herausgerechnet ist, der üblicherweise dominiert.",{"type":294,"variant":438,"title":439,"body":440},"note","Eine Faustregel",[441],[442],"Wenn jemand die Aufnahme einmal machen und wiederverwenden kann, ist ElevenLabs ein teurer Weg, um ein Studio zu sparen. Wenn der Text täglich wechselt, die Aufnahme nicht wiederverwendbar ist und Zuhörer die Stimme bemerken, ist es die günstigste Option auf dem Blatt.",{"type":124,"level":125,"id":107,"text":108},{"type":130,"ordered":416,"items":445},[446,451,455,459,463,466,470,474],[447],{"tag":448,"href":30,"children":449},"a",[450],"ElevenLabs-Preise: Tarife und Guthaben",[452],{"tag":448,"href":33,"children":453},[454],"ElevenAPI-Preise: Raten je Produkt",[456],{"tag":448,"href":36,"children":457},[458],"ElevenLabs-Dokumentation: Modelle",[460],{"tag":448,"href":39,"children":461},[462],"API-Referenz: Sprache erzeugen",[464],{"tag":448,"href":23,"children":465},[41],[467],{"tag":448,"href":44,"children":468},[469],"Amazon-Polly-Preise",[471],{"tag":448,"href":47,"children":472},[473],"OpenAI-API-Preise",[475],{"tag":448,"href":50,"children":476},[477],"SILMA AI: Preisvergleich Sprachausgabe, August 2026",[479,537,593,639],{"slug":480,"published":481,"minutes":6,"category":7,"tags":482,"keywords":488,"about":496,"sources":500,"cover":530,"og":531,"expertise":53,"locales":532,"lang":56,"title":533,"description":534,"coverAlt":535,"url":499,"pricing":536,"kind":483},"browserbase-stagehand","2026-09-30",[483,484,485,486,487],"Browser automation","Web agents","Headless browsers","Playwright","MCP",[489,490,491,492,493,494,495],"browserbase","stagehand","stagehand vs playwright","browserbase pricing","ai web agent framework","headless browser api","browserbase alternatives",[497],{"name":498,"url":499},"Browserbase","https:\u002F\u002Fwww.browserbase.com",[501,504,507,510,513,516,519,522,525,528],{"title":502,"url":503},"Browserbase pricing","https:\u002F\u002Fwww.browserbase.com\u002Fpricing",{"title":505,"url":506},"Browserbase plans and pricing docs","https:\u002F\u002Fdocs.browserbase.com\u002Fguides\u002Fplans-and-pricing",{"title":508,"url":509},"Stagehand documentation","https:\u002F\u002Fdocs.stagehand.dev\u002F",{"title":511,"url":512},"Stagehand quickstart","https:\u002F\u002Fdocs.stagehand.dev\u002Fv4\u002Ffirst-steps\u002Fquickstart",{"title":514,"url":515},"Stagehand v4 announcement","https:\u002F\u002Fwww.browserbase.com\u002Fblog\u002Fstagehand-v4",{"title":517,"url":518},"Stagehand repository","https:\u002F\u002Fgithub.com\u002Fbrowserbase\u002Fstagehand",{"title":520,"url":521},"Browser Use comparison of the two vendors","https:\u002F\u002Fbrowser-use.com\u002Fposts\u002Fbrowser-use-vs-browserbase",{"title":523,"url":524},"Browser Use pricing","https:\u002F\u002Fwww.browser-use.com\u002Fpricing",{"title":526,"url":527},"Skyvern pricing","https:\u002F\u002Fskyvern.com\u002Fpricing",{"title":486,"url":529},"https:\u002F\u002Fplaywright.dev\u002F","\u002Fimages\u002Fblog\u002Fbrowserbase-stagehand\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fbrowserbase-stagehand\u002Fog.jpg",[55,56,57],"Browserbase und Stagehand im Test: gemietetes Chrome für KI-Agenten","Browserbase vermietet verwaltetes Chrome pro Minute, Stagehand legt Natural-Language-Schritte obendrauf. Was es kostet, wo die Zähler laufen und wann Playwright gewinnt.","Abstrakte Pipeline-Grafik für die Browserbase- und Stagehand-Bewertung","From $20 per month · OSS library free",{"slug":538,"published":481,"minutes":539,"category":7,"tags":540,"keywords":545,"about":552,"sources":560,"cover":584,"og":585,"expertise":53,"locales":586,"lang":56,"title":587,"description":588,"coverAlt":589,"url":590,"pricing":591,"kind":592},"webmcp",11,[541,542,543,544,487],"WebMCP","Agent tools","JSON Schema","Chrome",[538,546,547,548,549,550,551],"webmcp vs mcp","document.modelContext registerTool","webmcp declarative api","browser agent tools","webmcp origin trial","webmcp chrome 149",[553,555,558],{"name":541,"url":554},"https:\u002F\u002Fgithub.com\u002Fwebmachinelearning\u002Fwebmcp",{"name":556,"url":557},"Model Context Protocol","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FModel_Context_Protocol",{"name":543,"url":559},"https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FJSON_Schema",[561,564,567,570,573,576,579,581],{"title":562,"url":563},"Chrome for Developers: WebMCP (get started)","https:\u002F\u002Fdeveloper.chrome.com\u002Fdocs\u002Fai\u002Fwebmcp",{"title":565,"url":566},"Chrome for Developers: Imperative API","https:\u002F\u002Fdeveloper.chrome.com\u002Fdocs\u002Fai\u002Fwebmcp\u002Fimperative-api",{"title":568,"url":569},"Chrome for Developers: Declarative API","https:\u002F\u002Fdeveloper.chrome.com\u002Fdocs\u002Fai\u002Fwebmcp\u002Fdeclarative-api",{"title":571,"url":572},"Chrome for Developers: WebMCP versus MCP","https:\u002F\u002Fdeveloper.chrome.com\u002Fdocs\u002Fai\u002Fwebmcp\u002Fcompare-mcp",{"title":574,"url":575},"Chrome for Developers: WebMCP tool security","https:\u002F\u002Fdeveloper.chrome.com\u002Fdocs\u002Fai\u002Fwebmcp\u002Fsecure-tools",{"title":577,"url":578},"Chrome for Developers: Build effective tools","https:\u002F\u002Fdeveloper.chrome.com\u002Fdocs\u002Fai\u002Fwebmcp\u002Fbuild-tools",{"title":580,"url":554},"WebMCP explainer and specification draft",{"title":582,"url":583},"WebMCP implementation status","https:\u002F\u002Fgithub.com\u002Fwebmachinelearning\u002Fwebmcp\u002Fblob\u002Fmain\u002Fimplementation-status.md","\u002Fimages\u002Fblog\u002Fwebmcp\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fwebmcp\u002Fog.jpg",[55,56,57],"WebMCP: Tools veröffentlichen statt Pixel ausliefern","WebMCP lässt eine Seite typisierte, aufrufbare Tools an einen Agenten im Browser publizieren. Was der Standard tut, wie viel heute ausgeliefert ist und wann ein MCP-Server die bessere Wahl bleibt.","Eine Seite registriert typisierte Tools im Browser, ein Browser-Agent ruft eines davon auf, und das Tool läuft in der Seite und aktualisiert deren Oberfläche.","https:\u002F\u002Fgithub.com\u002Fwebmcp","Emerging standard, open","Browser protocol",{"slug":594,"published":5,"minutes":6,"category":7,"tags":595,"keywords":598,"about":606,"sources":610,"cover":632,"og":633,"expertise":53,"locales":634,"lang":56,"title":635,"description":636,"coverAlt":637,"url":608,"pricing":638,"kind":483},"playwright",[596,483,487,597],"End-to-end testing","Cross-browser",[594,599,600,601,602,603,604,605],"playwright vs selenium","playwright mcp","browser automation testing","playwright test runner","playwright for ai agents","playwright vs cypress","playwright cloud pricing",[607,609],{"name":486,"url":608},"https:\u002F\u002Fplaywright.dev",{"name":556,"url":557},[611,614,617,620,623,626,629],{"title":612,"url":613},"Playwright documentation: installation","https:\u002F\u002Fplaywright.dev\u002Fdocs\u002Fintro",{"title":615,"url":616},"Playwright MCP introduction","https:\u002F\u002Fplaywright.dev\u002Fmcp\u002Fintroduction",{"title":618,"url":619},"Playwright CLI introduction","https:\u002F\u002Fplaywright.dev\u002Fagent-cli\u002Fintroduction",{"title":621,"url":622},"Playwright Test agents","https:\u002F\u002Fplaywright.dev\u002Fdocs\u002Ftest-agents",{"title":624,"url":625},"npm package metadata for @playwright\u002Ftest","https:\u002F\u002Fregistry.npmjs.org\u002F@playwright\u002Ftest\u002Flatest",{"title":627,"url":628},"Microsoft Learn: Playwright Workspaces free trial","https:\u002F\u002Flearn.microsoft.com\u002Fen-us\u002Fazure\u002Fapp-testing\u002Fplaywright-workspaces\u002Fhow-to-try-playwright-workspaces-free",{"title":630,"url":631},"Azure App Testing pricing","https:\u002F\u002Fazure.microsoft.com\u002Fen-us\u002Fpricing\u002Fdetails\u002Fapp-testing\u002F","\u002Fimages\u002Fblog\u002Fplaywright\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fplaywright\u002Fog.jpg",[55,56,57],"Playwright: eine Browser-API für Tests, Skripte und Agents","Playwright steuert Chromium, Firefox und WebKit über eine Apache-2.0-API: Test-Runner, agent-taugliche CLI und MCP-Server. Was es kostet und wo es hapert.","Ein Playwright-Testlauf: eine Spec-Datei, ein Runner mit drei Browser-Engines und ein Agent, der Accessibility-Snapshots liest.","Apache-2.0 · cloud paid",{"slug":640,"published":641,"minutes":6,"category":7,"tags":642,"keywords":648,"about":657,"sources":664,"cover":695,"og":696,"expertise":53,"locales":697,"lang":56,"title":698,"description":699,"coverAlt":700,"url":701,"pricing":702,"kind":703},"replicate","2026-05-22",[643,644,645,646,647],"Model hosting","Serverless GPU","Diffusion","Async jobs","Webhooks",[649,650,651,652,653,654,655,656],"replicate api","replicate vs fal.ai","serverless gpu inference pricing","replicate webhooks","replicate cold start","replicate vs baseten","how to run an open source model in production","replicate prediction api",[658,661],{"name":659,"url":660},"Replicate","https:\u002F\u002Freplicate.com\u002Fdocs",{"name":662,"url":663},"Serverless computing","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FServerless_computing",[665,668,671,674,677,680,683,686,689,692],{"title":666,"url":667},"Replicate pricing","https:\u002F\u002Freplicate.com\u002Fpricing",{"title":669,"url":670},"Replicate docs: About predictions","https:\u002F\u002Freplicate.com\u002Fdocs\u002Ftopics\u002Fpredictions",{"title":672,"url":673},"Replicate docs: Create a prediction","https:\u002F\u002Freplicate.com\u002Fdocs\u002Ftopics\u002Fpredictions\u002Fcreate-a-prediction",{"title":675,"url":676},"Replicate docs: Prediction lifecycle","https:\u002F\u002Freplicate.com\u002Fdocs\u002Ftopics\u002Fpredictions\u002Flifecycle",{"title":678,"url":679},"Replicate docs: Rate limits","https:\u002F\u002Freplicate.com\u002Fdocs\u002Ftopics\u002Fpredictions\u002Frate-limits",{"title":681,"url":682},"Replicate docs: Data retention","https:\u002F\u002Freplicate.com\u002Fdocs\u002Ftopics\u002Fpredictions\u002Fdata-retention",{"title":684,"url":685},"Replicate docs: Verify webhooks","https:\u002F\u002Freplicate.com\u002Fdocs\u002Ftopics\u002Fwebhooks\u002Fverify-webhook",{"title":687,"url":688},"Replicate docs: Official models","https:\u002F\u002Freplicate.com\u002Fdocs\u002Ftopics\u002Fmodels\u002Fofficial-models",{"title":690,"url":691},"fal.ai pricing","https:\u002F\u002Ffal.ai\u002Fpricing",{"title":693,"url":694},"Baseten pricing","https:\u002F\u002Fwww.baseten.co\u002Fpricing\u002F","\u002Fimages\u002Fblog\u002Freplicate\u002Fcover.webp","\u002Fimages\u002Fblog\u002Freplicate\u002Fog.jpg",[55,56,57],"Replicate im Test: eine Modell-API pro Sekunde abgerechnet, mit allen scharfen Kanten benannt","Replicate stellt tausende offene Modelle hinter eine Prediction-API und rechnet pro Sekunde Rechenzeit ab. Ein Test zu Cold Boots, Versionsdrift und der Löschung nach einer Stunde.","Ein Request läuft von starting über processing in einen von vier Endzuständen: succeeded, failed, canceled oder aborted.","https:\u002F\u002Freplicate.com","Pay per second of compute","Model hosting API",1791383550837]