[{"data":1,"prerenderedAt":712},["ShallowReactive",2],{"tool-langfuse-de":3},{"slug":4,"published":5,"minutes":6,"category":7,"tags":8,"keywords":14,"about":22,"sources":34,"cover":59,"og":60,"expertise":61,"locales":62,"lang":64,"title":66,"description":67,"coverAlt":68,"url":25,"pricing":69,"kind":9,"metaTitle":70,"takeaways":71,"faq":77,"toc":90,"blocks":115,"others":482},"langfuse","2026-08-13",10,"llmops",[9,10,11,12,13],"LLM observability","Tracing","OpenTelemetry","Self-hosting","Evaluation",[4,15,16,17,18,19,20,21],"langfuse vs langsmith","llm tracing tool","self-hosted llm observability","langfuse pricing","opentelemetry llm traces","llm cost tracking","prompt versioning",[23,26,28,31],{"name":24,"url":25},"Langfuse","https:\u002F\u002Flangfuse.com",{"name":11,"url":27},"https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FOpenTelemetry",{"name":29,"url":30},"ClickHouse","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FClickHouse",{"name":32,"url":33},"Observability (software)","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FObservability_(software)",[35,38,41,44,47,50,53,56],{"title":36,"url":37},"Langfuse documentation: observability and application tracing","https:\u002F\u002Flangfuse.com\u002Fdocs\u002Fobservability\u002Foverview",{"title":39,"url":40},"Langfuse documentation: get started with tracing","https:\u002F\u002Flangfuse.com\u002Fdocs\u002Fobservability\u002Fget-started",{"title":42,"url":43},"Langfuse pricing: cloud plans, billable units and worked examples","https:\u002F\u002Flangfuse.com\u002Fpricing",{"title":45,"url":46},"Langfuse pricing: self-hosted plans and the feature comparison","https:\u002F\u002Flangfuse.com\u002Fpricing-self-host",{"title":48,"url":49},"Self-host Langfuse: deployment options, containers and storage services","https:\u002F\u002Flangfuse.com\u002Fself-hosting",{"title":51,"url":52},"Langfuse changelog: v4 is live (17 August 2026)","https:\u002F\u002Flangfuse.com\u002Fchangelog\u002F2026-08-17-langfuse-v4",{"title":54,"url":55},"Langfuse blog: Langfuse joins ClickHouse (16 January 2026)","https:\u002F\u002Flangfuse.com\u002Fblog\u002Fjoining-clickhouse",{"title":57,"url":58},"GitHub: langfuse\u002Flangfuse, the platform repository","https:\u002F\u002Fgithub.com\u002Flangfuse\u002Flangfuse","\u002Fimages\u002Fblog\u002Flangfuse\u002Fcover.webp","\u002Fimages\u002Fblog\u002Flangfuse\u002Fog.jpg","ai-engineer",[63,64,65],"en","de","hu","Langfuse-Test: Tracing, Prompts und Evals selbst gehostet","Langfuse legt LLM-Traces, Prompt-Versionen und Experimente auf eine MIT-lizenzierte Plattform. Was das Selbsthosten wirklich kostet, wie die Einheitspreise rechnen und wo es verliert.","Eine Pipeline vom gebündelten Application-Event über den Langfuse-Web-Container und den Object Storage in ClickHouse, mit Redis und PostgreSQL daneben.","MIT · paid from $59 per month","Langfuse-Test: Tracing zum Selbsthosten · Balázs Csorba",[72,73,74,75,76],"Langfuse ist die vollständigste quelloffene Option für Tracing, Prompt-Verwaltung und Experimente in einem Backend, und die MIT-Lizenz deckt den ganzen Kern ab, nicht eine Demo.","Ein Produktions-Deployment selbst zu hosten sind zwei Anwendungscontainer plus PostgreSQL, ClickHouse, Redis und Object Storage – mehr, als die Docker-Compose-Seite vermuten lässt.","Die Cloud rechnet Datenpunkte ab, keine Plätze: ein Agenten-Turn mit drei Observations und zwei Scores kostet sechs Einheiten, laut Preisseite gibt es Hobby gratis und Core für 29 $ im Monat mit 100.000 Einheiten.","Instrumentierung wird im Hintergrund gepuffert und gebündelt, Tracing kostet also keine Request-Latenz, aber ein Prozess, der ohne Flush endet, verliert das Ende seiner Traces.","Langfuse Cloud stellt v3-Endpunkte am 16. November 2026 ein, eine bestehende v3-Integration braucht also ein Migrationsfenster und kein Upgrade nach Belieben.",[78,81,84,87],{"q":79,"a":80},"Wie teuer ist Langfuse?","Selbst hosten ist unter der MIT-Lizenz kostenlos und ohne Nutzungslimit. Langfuse Cloud hat einen kostenlosen Hobby-Tarif mit 50.000 Einheiten pro Monat, 30 Tagen Datenzugriff und zwei Nutzern, Core für 29 $ pro Monat mit 100.000 Einheiten und 90 Tagen, Pro für 199 $ und Enterprise für 2.499 $. Nutzung über den enthaltenen Einheiten kostet von 8 $ pro 100.000 Einheiten bis zu 6 $ bei hoher Last.",{"q":82,"a":83},"Was zählt als abrechnungseinheit bei Langfuse?","Jeder Tracing-Datenpunkt, den du an die Plattform sendest: ein Trace, eine Observation darin wie ein Span, Event oder Generation, oder ein Score. Ein einzelner Agenten-Turn mit drei Observations und zwei Bewertungs-Scores kostet damit sechs Einheiten. Deshalb ist die Granularität der Instrumentierung wichtiger als die Zahl der Nutzer.",{"q":85,"a":86},"Verlangsamt Langfuse meine Anwendung?","Laut Doku nein: Die SDKs legen Trace-Events lokal in eine Queue und fluschen sie gebündelt im Hintergrund, der Request-Pfad wird also nicht blockiert. In kurzlebigen Prozessen wie Lambda-Handlern, Cronjobs und CLIs musst du am Ende flush() aufrufen, sonst gehen die letzten Observations beim Beenden verloren.",{"q":88,"a":89},"Langfuse oder LangSmith?","Nimm Langfuse, wenn du eine MIT-lizenzierte Plattform im eigenen VPC willst und Traces, Prompts und Experimente in einem Modell. Nimm LangSmith, wenn du auf LangGraph baust und Tracing aus erster Hand mit Annotation-Queues willst, ohne selbst etwas zusammenzubauen. Die Kostenmodelle unterscheiden sich ebenfalls: Langfuse rechnet pro Datenpunkt mit unbegrenzt Nutzern, LangSmith pro Platz plus Traces.",[91,94,97,100,103,106,109,112],{"id":92,"title":93},"what-it-is","Was es ist",{"id":95,"title":96},"how-it-works","Wie es funktioniert",{"id":98,"title":99},"getting-started","Erste Schritte",{"id":101,"title":102},"prompts-and-evals","Prompts und Evaluierungen",{"id":104,"title":105},"cost-and-deployment","Was der Betrieb kostet",{"id":107,"title":108},"where-it-shingles","Wo es hakt",{"id":110,"title":111},"verdict","Urteil",{"id":113,"title":114},"sources","Quellen",[116,120,129,132,135,180,181,184,193,196,197,200,202,205,208,229,230,233,260,263,264,267,299,302,384,387,393,394,397,431,434,435,438,463,468,469],{"type":117,"content":118},"paragraph",[119],"Langfuse ist eine quelloffene Plattform für Tracing, Prompt-Verwaltung und Evaluation von LLM-Anwendungen, und die vollständigste unter denen, die unter einer permissiven Lizenz erscheint. Das Urteil vorweg: Teams, die Tracing, Prompts und Experimente in einem Backend wollen und die ein ClickHouse-Deployment betreuen können, sollten sie nehmen. Teams, die ein Wochenende Aufbau wollen, sollten sie nicht.",{"type":117,"content":121},[122,123,128],"Sie liegt in derselben Schicht wie LangSmith, Arize Phoenix und Helicone und konkurriert an zwei Achsen, die zählen: ob die Plattform im eigenen Netz laufen darf und ob man den eigenen Code oder den Modellanbieter instrumentiert. Langfuse beantwortet die erste Frage für den Kern mit Ja und die zweite auf beide Arten: Drop-in-Wrapper für die üblichen üblichen SDKs, ein Context Manager für alles andere und ein schlichter OpenTelemetry-Endpunkt für Code, der weder Python noch JavaScript ist. Das größere Argument für Tracing von Agenten steht in ",{"tag":124,"to":125,"children":126},"link","\u002Fblog\u002Fagent-observability-opentelemetry",[127],"Agent-Observability mit OpenTelemetry",".",{"type":130,"level":131,"id":92,"text":93},"heading",2,{"type":117,"content":133},[134],"Langfuse ist vier Produkte in einem Deployment: einen Trace-Speicher für LLM-Aufrufe, ein Prompt-Register mit Versionierung und Playground, einen Experiment-Runner über Datensätze und eine Dashboard-Schicht für Kosten, Latenz und Scores. Alle vier laufen mit demselben Code, gehostet oder selbst gehostet, und die selbst gehostete Edition ist kein reduzierter Build.",{"type":136,"ordered":137,"items":138},"list",false,[139,150,155,160,165,170,175],[140,144,145,149],{"tag":141,"children":142},"strong",[143],"MIT-Lizenz für den Kern. ","Das Repository trägt einen Copyright-Hinweis der ClickHouse Inc, und nur die Verzeichnisse unter ",{"tag":146,"children":147},"code",[148],"ee\u002F"," stehen unter einer separaten kommerziellen Lizenz.",[151,154],{"tag":141,"children":152},[153],"Selbst hostbar mit Docker Compose, Helm oder Terraform-Templates für AWS, Azure und GCP, ","mit denselben Containern wie Langfuse Cloud.",[156,159],{"tag":141,"children":157},[158],"Vier Speicherdienste in einem normalen Deployment: ","PostgreSQL, ClickHouse, Redis oder Valkey und S3-kompatibler Object Storage.",[161,164],{"tag":141,"children":162},[163],"SDKs für Python und JavaScript, ","dazu ein dokumentierter OpenTelemetry-Ingestion-Endpunkt mit Versionsheader in jeder Anfrage.",[166,169],{"tag":141,"children":167},[168],"35.468 Stars und 3.940 Forks auf GitHub im Oktober 2026, ","Version v4.54.0 erschien am 7. Oktober 2026.",[171,174],{"tag":141,"children":172},[173],"Seit Januar 2026 im Besitz von ClickHouse, ","die zugleich die Datenbank ist, in der die Traces liegen.",[176,179],{"tag":141,"children":177},[178],"Cloud-Regionen in der EU, den USA und Japan, ","plus eine HIPAA-Region im Enterprise-Tarif.",{"type":130,"level":131,"id":95,"text":96},{"type":117,"content":182},[183],"Der Ingestion-Pfad erklärt sowohl die Betriebslast als auch die Latenzgeschichte. Ein SDK oder ein Collector sendet einen Batch von Events; der Web-Container schreibt diesen Batch sofort in den Object Storage und legt nur eine Referenz in Redis ab; ein Worker holt die Events ab und schreibt sie in ClickHouse, wo Traces, Observations und Scores liegen. PostgreSQL hält die transaktionalen Daten: Projekte, API-Schlüssel, Prompt-Versionen.",{"type":185,"attrs":186,"inner":190,"caption":191},"diagram",{"viewBox":187,"role":188,"aria-labelledby":189},"0 0 720 330","img","d1-lf-t d1-lf-d","\u003Ctitle id=\"d1-lf-t\">How a trace reaches storage in Langfuse\u003C\u002Ftitle>\u003Cdesc id=\"d1-lf-d\">The application or an OpenTelemetry collector sends a batch of events to the Langfuse web container. The web container writes the batch to object storage and leaves a reference in Redis. A worker reads the batch from object storage and writes traces, observations and scores into ClickHouse. PostgreSQL holds the transactional data such as projects and prompt versions, and Redis holds the queue and the API key and prompt caches.\u003C\u002Fdesc>\u003Cdefs>\u003Cmarker id=\"ah-lf\" viewBox=\"0 0 10 10\" refX=\"9\" refY=\"5\" markerWidth=\"7\" markerHeight=\"7\" orient=\"auto-start-reverse\">\u003Cpath d=\"M0 0L10 5L0 10z\" class=\"d-head\" \u002F>\u003C\u002Fmarker>\u003C\u002Fdefs>\u003Ctext x=\"20\" y=\"28\" class=\"d-title\">Trace ingestion\u003C\u002Ftext>\u003Ctext x=\"700\" y=\"28\" text-anchor=\"end\" class=\"d-label\">same stack in cloud and self-hosted\u003C\u002Ftext>\u003Crect x=\"20\" y=\"52\" width=\"150\" height=\"62\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"95\" y=\"80\" text-anchor=\"middle\" class=\"d-text\">App or SDK\u003C\u002Ftext>\u003Ctext x=\"95\" y=\"102\" text-anchor=\"middle\" class=\"d-small\">batched events\u003C\u002Ftext>\u003Crect x=\"195\" y=\"52\" width=\"150\" height=\"62\" rx=\"10\" class=\"d-accent\" \u002F>\u003Ctext x=\"270\" y=\"80\" text-anchor=\"middle\" class=\"d-text\">Langfuse Web\u003C\u002Ftext>\u003Ctext x=\"270\" y=\"102\" text-anchor=\"middle\" class=\"d-small\">UI and API\u003C\u002Ftext>\u003Crect x=\"370\" y=\"52\" width=\"150\" height=\"62\" rx=\"10\" class=\"d-gold\" \u002F>\u003Ctext x=\"445\" y=\"80\" text-anchor=\"middle\" class=\"d-text\">S3 or blob\u003C\u002Ftext>\u003Ctext x=\"445\" y=\"102\" text-anchor=\"middle\" class=\"d-small\">raw events\u003C\u002Ftext>\u003Crect x=\"545\" y=\"52\" width=\"150\" height=\"62\" rx=\"10\" class=\"d-box\" \u002F>\u003Ctext x=\"620\" y=\"80\" text-anchor=\"middle\" class=\"d-text\">Worker\u003C\u002Ftext>\u003Ctext x=\"620\" y=\"102\" text-anchor=\"middle\" class=\"d-small\">async ingest\u003C\u002Ftext>\u003Cpath d=\"M170 83 H193\" class=\"d-line\" marker-end=\"url(#ah-lf)\" \u002F>\u003Cpath d=\"M345 83 H368\" class=\"d-line\" marker-end=\"url(#ah-lf)\" \u002F>\u003Cpath d=\"M520 83 H543\" class=\"d-line\" marker-end=\"url(#ah-lf)\" \u002F>\u003Cpath d=\"M240 114 V147 H95 V178\" class=\"d-line\" marker-end=\"url(#ah-lf)\" \u002F>\u003Cpath d=\"M300 114 V178\" class=\"d-line\" marker-end=\"url(#ah-lf)\" \u002F>\u003Cpath d=\"M620 114 V178\" class=\"d-line\" marker-end=\"url(#ah-lf)\" \u002F>\u003Crect x=\"20\" y=\"180\" width=\"150\" height=\"62\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"95\" y=\"208\" text-anchor=\"middle\" class=\"d-text\">Redis\u003C\u002Ftext>\u003Ctext x=\"95\" y=\"230\" text-anchor=\"middle\" class=\"d-small\">queue, key cache\u003C\u002Ftext>\u003Crect x=\"195\" y=\"180\" width=\"150\" height=\"62\" rx=\"10\" class=\"d-sky\" \u002F>\u003Ctext x=\"270\" y=\"208\" text-anchor=\"middle\" class=\"d-text\">PostgreSQL\u003C\u002Ftext>\u003Ctext x=\"270\" y=\"230\" text-anchor=\"middle\" class=\"d-small\">projects, prompts\u003C\u002Ftext>\u003Crect x=\"545\" y=\"180\" width=\"150\" height=\"62\" rx=\"10\" class=\"d-mint\" \u002F>\u003Ctext x=\"620\" y=\"208\" text-anchor=\"middle\" class=\"d-text\">ClickHouse\u003C\u002Ftext>\u003Ctext x=\"620\" y=\"230\" text-anchor=\"middle\" class=\"d-small\">traces, scores\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"278\" class=\"d-small\">Reads hit ClickHouse for traces and PostgreSQL for project and prompt data.\u003C\u002Ftext>\u003Ctext x=\"20\" y=\"302\" class=\"d-label\">Raw events reach object storage first: an outage delays data, it does not lose it\u003C\u002Ftext>",[192],"Jedes Event landet im Object Storage, bevor es in die analytische Datenbank kommt.",{"type":117,"content":194},[195],"Daraus folgen zwei Dinge. Ein ClickHouse-Ausfall verliert keine Events, denn der Roh-Batch liegt bereits im Object Storage und wird nachgespielt. Und Trace-Abfragen berühren PostgreSQL nie, weshalb das ClickHouse-Schema als breite, überwiegend unveränderliche Observations-Tabelle ausgelegt ist. Dasselbe Design trägt die Herstellerangabe von mehr als 90 Milliarden Observations pro Monat über die Plattform; das ist eine Unternehmenszahl auf eigener Infrastruktur und kein unabhängiger Benchmark.",{"type":130,"level":131,"id":98,"text":99},{"type":117,"content":198},[199],"Zwei Einstiegspunkte decken die meisten Fälle ab. Der OpenAI-Wrapper erfasst Aufrufe, ohne die Aufrufstellen zu ändern, und der Context Manager ist für Code ohne OpenAI-SDK gedacht oder wenn ein Span mehrere Modellaufrufe umschließen soll. Beide lesen die Zugangsdaten aus der Umgebung, dieselbe Instrumentierung läuft also gegen die EU-, US-, japanische oder HIPAA-Region oder gegen ein selbst gehostetes Deployment.",{"type":146,"code":201},"import os\n\nfrom langfuse import get_client\nfrom langfuse.openai import openai\n\nos.environ[\"LANGFUSE_PUBLIC_KEY\"] = \"pk-lf-...\"\nos.environ[\"LANGFUSE_SECRET_KEY\"] = \"sk-lf-...\"\nos.environ[\"LANGFUSE_HOST\"] = \"https:\u002F\u002Fcloud.langfuse.com\"  # EU region\n\nlangfuse = get_client()\n\n# 1. Drop-in: every OpenAI call is recorded as a generation.\nopenai.chat.completions.create(\n    model=\"gpt-4o\",\n    name=\"calculator\",\n    messages=[{\"role\": \"user\", \"content\": \"1 + 1 = \"}],\n)\n\n# 2. Explicit: a span around one unit of work, a generation inside it.\nwith langfuse.start_as_current_observation(as_type=\"span\", name=\"answer-question\") as span:\n    span.update(input={\"question\": \"What is the capital of France?\"})\n    with langfuse.start_as_current_observation(\n        as_type=\"generation\", name=\"llm-call\", model=\"gpt-4o\"\n    ) as generation:\n        generation.update(output=\"Paris.\")\n    span.update(output=\"answered\")\n\nlangfuse.flush()  # required in short-lived processes",{"type":117,"content":203},[204],"Alles, was bereits OTLP-Spans emittiert, kommt ohne SDKs aus: Der Ingestion-Endpunkt nimmt eine Standard-Payload entgegen, mit den Projektschlüsseln als Basic Auth und der Ingestion-Version im Header. Dieser Weg macht Langfuse zu einer vertretbaren Wahl in einer gemischtsprachigen Landschaft, in der Python-Instrumentierung ein weiterer Dienst wäre, den man pflegen müsste.",{"type":117,"content":206},[207],"Frameworks bekommen erstklassige Integrationen statt Wrapper: Die Doku listet OpenTelemetry, das Vercel AI SDK, LangChain für Python und JavaScript, LlamaIndex, CrewAI, AutoGen, Google ADK und Ollama sowie Proxy-basiertes Logging für Teams, deren Aufrufe ohnehin über LiteLLM laufen. Dieser letzte Punkt entscheidet die Architekturfrage, denn ein Team, das jeden Modellaufruf durch ein Gateway schickt, holt seine Traces aus dem Gateway statt aus der Anwendung.",{"type":209,"variant":210,"title":211,"body":212},"callout","note","Zwei Details, die einen Nachmittag kosten",[213,219],[214,215,218],"Die SDKs fluschen im Hintergrund, weshalb Tracing keine Latenz in den Request bringt und weshalb ein Lambda-Handler, ein Cronjob oder eine CLI, die zuerst beendet wird, ihre letzten Observations verlieren kann. Am Ende des Prozesses ",{"tag":146,"children":216},[217],"flush()"," aufrufen.",[220,221,224,225,228],"Der SDK-Quickstart setzt ",{"tag":146,"children":222},[223],"LANGFUSE_BASE_URL",", während die OpenTelemetry-Seite ",{"tag":146,"children":226},[227],"LANGFUSE_HOST"," für denselben Wert setzt. Den Variablennamen von der Seite nehmen, die zur eigenen SDK-Version passt, statt ihn anzunehmen.",{"type":130,"level":131,"id":101,"text":102},{"type":117,"content":231},[232],"Tracing ist der Teil, den jeder Wettbewerber hat. Ob Langfuse sein schwereres Deployment verdient, entscheidet sich daran, dass Prompts und Evaluierungen auf denselben Traces liegen: Ein Prompt wird in der Oberfläche versioniert, vom SDK mit einem Cache auf der Client-Seite geholt und über Labels freigegeben, während Datensätze und Experimente diesen Prompt gegen gespeicherte Eingaben laufen lassen und die Scores zurück auf die Observations schreiben.",{"type":136,"ordered":137,"items":234},[235,240,245,250,255],[236,239],{"tag":141,"children":237},[238],"Prompt-Versionierung mit Release-Management und Kompositionsfähigkeit, ","mit geschützten Deployment-Labels im Enterprise-Tarif.",[241,244],{"tag":141,"children":242},[243],"Prompt-Caching auf der Client-Seite in den SDKs, ","im Hintergrund nachvalidiert, mit einem Read-Through-Cache in Redis auf dem Server.",[246,249],{"tag":141,"children":247},[248],"LLM-as-a-judge-Evaluatoren, eigene Scores aus Code, ","Erfassung von Nutzer-Feedback und Annotation-Queues in der Oberfläche.",[251,254],{"tag":141,"children":252},[253],"Code-Evaluatoren, die deterministische Python- oder TypeScript-Prüfungen ","auf Live-Observations ausführen, neu in v4.",[256,259],{"tag":141,"children":257},[258],"Monitore, die Kosten-, Latenz- und Qualitätsschwellen überwachen ","und über Slack, Webhooks oder GitHub Actions melden.",{"type":117,"content":261},[262],"Der opinionierte Teil: Das ist der richtige Ort für Offline-Evaluation. Weil ein Experiment seine Scores auf dieselben Observation-Kennungen schreibt, die der Produktions-Trace benutzt, bleibt eine Regression aus einem Dataset-Lauf an die Request-Form nachvollziehbar, die sie ausgelöst hat – genau der Schritt, den die meisten Eval-Werkzeuge einer Tabelle überlassen. Der Preis ist ein Release-Prozess für Prompts, den man selbst besitzt, und ein Prompt-Register, das niemand pflegt, ist schlimmer als gar keines.",{"type":130,"level":131,"id":104,"text":105},{"type":117,"content":265},[266],"Selbst hosten ist kostenlos und ohne Nutzungslimit, damit bleibt nur der Cloud-Preis zu modellieren. Die Cloud rechnet Datenpunkte ab, keine Plätze: Eine Einheit ist jeder Trace, jede Observation und jeder Score, und ein Agenten-Turn mit drei Observations und zwei Scores kostet sechs Einheiten.",{"type":136,"ordered":137,"items":268},[269,274,279,284,289,294],[270,273],{"tag":141,"children":271},[272],"PostgreSQL für transaktionale Daten, ","ClickHouse für Traces, Observations und Scores, Redis für die Queue sowie die API-Schlüssel- und Prompt-Caches.",[275,278],{"tag":141,"children":276},[277],"Events landen vor der Datenbank im Object Storage, ","ein analytischer Ausfall verzögert also Daten, statt sie zu verlieren.",[280,283],{"tag":141,"children":281},[282],"Hintergrund-Migrationen legen lang laufende Schema-Arbeit aus dem Upgrade-Pfad heraus, ","das verkürzt die Stillstandszeit beim Upgrade.",[285,288],{"tag":141,"children":286},[287],"Client-seitiges Data Masking ist in der Open-Source-Edition enthalten; ","serverseitiges Masking, Audit Logs, SCIM, projektbezogenes RBAC und Aufbewahrungsrichtlinien brauchen einen Enterprise-Lizenzschlüssel.",[290,293],{"tag":141,"children":291},[292],"Die selbst gehostete Enterprise-Edition ist an ClickHouse Cloud, BYOC oder Private gebündelt, ","und ihr Preis addiert sich zum kommerziellen ClickHouse-Tarif.",[295,298],{"tag":141,"children":296},[297],"Templates gibt es für Kubernetes, AWS, Azure und GCP; ","Render und Railway werden nur von der Community unterstützt.",{"type":117,"content":300},[301],"Das operative Urteil: Das ist eine Plattform und kein Sidecar. Sie zu betreiben heißt, ClickHouse zu betreiben, also muss jemand im Team ClickHouse kennen. Teams, die es schon betreiben, gewinnen eine Fähigkeit, die sie sonst nicht kaufen könnten; Teams ohne diese Erfahrung sollten auf dem kostenlosen Hobby-Tarif anfangen und das Selbsthosting für den Tag aufheben, an dem die Frage der Datenresidenz real wird.",{"type":303,"head":304,"rows":327},"table",[305,311,315,321],[306,307,308,309,310],"T","a","r","i","f",[312,308,313,309,314],"P","e","s",[316,317,318,319,307,320,318,313,317],"E","n","t","h","l",[322,307,314,323,314,309,324,319,323,325,317,326,313,308,318],"W"," ","c","ä","d",[328,354,364,373],[329,334,336,341],[330,331,332,332,333],"H","o","b","y",[335,331,314,318,313,317,320,331,314],"K",[337,338,128,338,338,338,323,316,309,317,319,313,309,318,313,317,323,339,308,331,323,340,331,317,307,318],"5","0","p","M",[342,338,323,306,307,343,313,323,344,307,318,313,317,345,323,346,347,313,309,323,348,349,318,346,313,308,345,323,350,128,338,338,338,323,351,317,343,313,314,318,309,331,317,352,353,317,310,308,307,343,313,317,323,339,308,331,323,340,309,317,349,318,313],"3","g","D",",","z","w","N","u","1","I","-","A",[355,357,361,362],[356,331,308,313],"C",[358,359,323,360,323,339,308,331,323,340,331,317,307,318],"2","9","$",[350,338,338,128,338,338,338,323,316,309,317,319,313,309,318,313,317],[359,338,323,306,307,343,313,323,344,307,318,313,317,345,323,349,317,332,313,343,308,313,317,346,318,323,348,349,318,346,313,308,345,323,363,128,338,338,338,323,353,317,310,308,307,343,313,317,323,339,308,331,323,340,309,317,349,318,313],"4",[365,366,367,368],[312,308,331],[350,359,359,323,360,323,339,308,331,323,340,331,317,307,318],[350,338,338,128,338,338,338,323,316,309,317,319,313,309,318,313,317],[326,308,313,309,323,369,307,319,308,313,323,344,307,318,313,317,345,323,358,338,128,338,338,338,323,353,317,310,308,307,343,313,317,323,339,308,331,323,340,309,317,349,318,313,345,323,370,371,356,323,358,323,349,317,326,323,351,370,371,323,358,372,338,338,350],"J","S","O","7",[374,375,376,377],[316,317,318,313,308,339,308,309,314,313],[358,128,363,359,359,323,360,323,339,308,331,323,340,331,317,307,318],[350,338,338,128,338,338,338,323,316,309,317,319,313,309,318,313,317],[353,349,326,309,318,323,378,331,343,314,345,323,370,356,351,340,345,323,313,309,343,313,317,313,323,379,307,318,313,320,309,380,309,318,314,345,323,381,313,308,310,382,343,332,307,308,383,313,309,318,314,352,370,378,353],"L","R","m","V","ü","k",{"type":117,"content":385},[386],"Nutzung über den enthaltenen Einheiten wird nach gestaffelten Sätzen abgerechnet: 8 $ pro 100.000 Einheiten bis eine Million, 7 $ bis zehn Millionen, 6,50 $ bis fünfzig Millionen und darunter 6 $. Die Preisseite beziffert einen Monat mit einer Million Einheiten auf Core mit 101 $ und einen Monat mit fünfundzwanzig Millionen auf Pro mit Teams-Addon auf 2.176 $. Erst die Zahl der Einheiten modellieren, dann mit einem Preis pro Platz oder pro Gigabyte vergleichen, denn dieselbe Last kann je nach Anzahl der Observations pro Request um eine Größenordnung abweichen.",{"type":209,"variant":388,"title":389,"body":390},"tip","Rabatte, die es gibt und nicht beworben werden",[391],[392],"Beide Preisseiten nennen 50 Prozent Rabatt für Frühphasen-Start-ups im ersten Jahr, bis zu 100 Prozent für Forschung und Studierende, 199 Dollar Monatsguthaben für gemeinnützige Organisationen und 300 Dollar pro Monat für Open-Source-Projekte im ersten Jahr. Danach fragen, nicht vorher, denn genau solche Zeilen verschwinden aus jeder Vergleichstabelle.",{"type":130,"level":131,"id":107,"text":108},{"type":117,"content":395},[396],"Zuerst die Schwächen, denn sie sind die Gründe für etwas anderes. Instrumentierung muss weiterhin geschrieben werden, und eine Anwendung, die drei Anbieter über ein Gateway ruft, braucht drei Integrationen oder eine OpenTelemetry-Pipeline. Die Oberfläche ist dicht, und der Weg von einem Trace zu einem Dashboard, das eine Frage beantwortet, misst sich in Tagen. Die Einheitspreisrechnung bestraft geschwätzige Instrumentierung, denn der billigste Weg, eine Rechnung zu senken, ist weniger Detail zu senden – genau die falsche Instinkt in einem Störfall. Und das Produkt gehört inzwischen einem Datenbankhersteller: ClickHouse hat Langfuse im Januar 2026 gekauft, was der Roadmap klar zugutekam und die kommerzielle Enterprise-Edition zugleich immer mehr zu einem ClickHouse-Gespräch macht.",{"type":303,"head":398,"rows":403},[399,400,401,402],[322,313,308,383,346,313,349,343],[378,309,346,313,317,346],[322,331,323,313,314,323,320,325,349,310,318],[370,318,325,308,383,314,318,313,323,370,313,309,318,313],[404,412,419,424],[405,406,408,409],[378,307,317,343,310,349,314,313],[340,351,306,352,335,313,308,317,345,323,313,313,407,352,381,313,308,346,313,309,324,319,317,309,314,314,313,323,349,317,318,313,308,323,383,331,380,380,313,308,346,309,313,320,320,313,380,323,370,324,319,320,382,314,314,313,320],"\u002F",[356,320,331,349,326,323,331,326,313,308,323,313,309,343,313,317,313,314,323,344,331,324,383,313,308,352,345,323,330,313,320,380,352,323,331,326,313,308,323,306,313,308,308,307,310,331,308,380,352,344,313,339,320,331,333,380,313,317,318],[306,308,307,324,313,314,345,323,312,308,331,380,339,318,314,323,349,317,326,323,316,410,339,313,308,309,380,313,317,318,313,323,309,317,323,313,309,317,313,380,323,411,307,324,383,313,317,326],"x","B",[413,414,415,417],[378,307,317,343,370,380,309,318,319],[356,320,309,313,317,318,352,370,344,335,323,349,317,318,313,308,323,340,351,306,345,323,326,309,313,323,312,320,307,318,318,310,331,308,380,323,309,314,318,323,343,313,319,331,314,318,313,318],[326,313,308,323,343,313,319,331,314,318,313,318,313,323,344,309,313,317,314,318,323,416,331,317,323,378,307,317,343,356,319,307,309,317],"v",[306,313,307,380,314,345,323,326,309,313,323,314,309,324,319,323,332,313,308,313,309,318,314,323,310,382,308,323,378,307,317,343,418,308,307,339,319,323,313,317,318,314,324,319,309,313,326,313,317,323,319,307,332,313,317],"G",[420,421,422,423],[353,308,309,346,313,323,312,319,331,313,317,309,410],[316,320,307,314,318,309,324,323,378,309,324,313,317,314,313,323,358,128,338],[314,313,320,332,314,318,323,343,313,319,331,314,318,313,318,345,323,306,308,307,324,309,317,343,323,382,332,313,308,323,371,339,313,317,351,317,310,313,308,313,317,324,313,323,349,317,326,323,371,339,313,317,306,313,320,313,380,313,318,308,333],[313,416,307,320,349,307,318,309,331,317,314,346,313,317,318,308,309,313,308,318,313,323,353,332,320,325,349,310,313,323,382,332,313,308,323,313,309,343,313,317,313,323,306,308,307,324,313,314],[425,426,427,428],[330,313,320,309,324,331,317,313],[353,339,307,324,319,313,352,358,128,338],[314,313,320,332,314,318,323,343,313,319,331,314,318,313,318,323,331,326,313,308,323,356,320,331,349,326],[429,313,326,313,317,323,353,349,310,308,349,310,323,331,319,317,313,323,370,344,335,352,430,317,326,313,308,349,317,343,323,313,308,310,307,314,314,313,317,345,323,382,332,313,308,323,313,309,317,313,317,323,312,308,331,410,333],"j","Ä",{"type":117,"content":432},[433],"Der Vergleich, auf den es ankommt, ist nicht der Funktionsumfang. Phoenix ist kostenlos zu betreiben und strenger beim Evaluieren, aber Elastic License 2.0 ist source-available und nicht quelloffen und verbietet dir, es als Dienst anzubieten. Helicone ist der billigste Weg zu Kosten- und Latenzzahlen für jeden Aufruf, um den Preis eines Proxys im Request-Pfad. LangSmith ist die bequemste Option, sobald die Framework-Entscheidung steht, und diejenige, deren Preis mit der Größe des Engineering-Teams wächst.",{"type":130,"level":131,"id":110,"text":111},{"type":117,"content":436},[437],"Langfuse ist das Werkzeug, das diese Kategorie gebraucht hat: eine permissiv lizenzierte Plattform, die nicht verlangt, dass du Frameworks wechselst, einen Proxy in den Request-Pfad legst oder die Rohdaten abgibst. Position beziehen: Für ein Team mit mehreren Agent-Oberflächen und einer echten Rechnung ist es die richtige Voreinstellung, für einen einzelnen Prompt in einem Nebenprojekt die falsche.",{"type":136,"ordered":439,"items":440},true,[441,446,450,454,459],[442,445],{"tag":141,"children":443},[444],"Nimm es, wenn ","Traces, Prompt-Versionierung und Experimente in einem Ort liegen müssen und jemand ClickHouse betreiben kann.",[447,449],{"tag":141,"children":448},[444],"Prompt-Versionen auditierbar sein müssen, was in Beschaffungsgesprächen in der EU der übliche Fall ist.",[451,453],{"tag":141,"children":452},[444],"du bereits OpenTelemetry emittierst und lieber ein Backend als Instrumentierung pro Framework haben willst.",[455,458],{"tag":141,"children":456},[457],"Nimm es nicht, wenn ","die Anwendung ein paar Modellaufrufe am Tag macht; ein kostenloser Tarif plus strukturierte Logs kostet weniger Aufmerksamkeit.",[460,462],{"tag":141,"children":461},[457],"niemand die Instrumentierung nachjustiert. Die Rechnung wächst mit der Zahl der Observations, nicht mit der Zahl der Nutzer, und die billigste Ersparnis ist, genau die Details abzuschalten, die man um 3 Uhr nachts braucht.",{"type":209,"variant":388,"title":464,"body":465},"Die Migration, die jetzt ansteht",[466],[467],"Langfuse Cloud stellt v3-Endpunkte und -Funktionen ab 16. November 2026 ein, danach werden die alten APIs und Ingestion-Pfade entfernt. Das Changelog sagt, die meisten Projekte brauchten keine Migration und ein Migration Assistant liste nur die Prüfungen, die für das jeweilige Projekt gelten – eine bestehende v3-Integration sollte aber jetzt getestet werden und nicht im November. Selbst gehostete Deployments können nach eigenem Zeitplan aktualisieren.",{"type":130,"level":131,"id":113,"text":114},{"type":136,"ordered":137,"items":470},[471,475,476,477,478,479,480,481],[472,473,474],"tag","href","children",[472,473,474],[472,473,474],[472,473,474],[472,473,474],[472,473,474],[472,473,474],[472,473,474],[483,532,615,658],{"slug":484,"published":485,"minutes":486,"category":7,"tags":487,"keywords":493,"about":500,"sources":504,"cover":523,"og":524,"expertise":61,"locales":525,"lang":64,"title":526,"description":527,"coverAlt":528,"url":529,"pricing":530,"kind":531},"ollama","2026-09-29",11,[488,489,490,491,492],"Local inference","Open models","llama.cpp","GGUF","Model serving",[484,494,495,496,497,498,499],"ollama vs lm studio","ollama vs vllm","local llm runtime","gguf model server","ollama self hosting","ollama api",[501],{"name":502,"url":503},"Ollama (software)","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FOllama",[505,508,511,514,517,520],{"title":506,"url":507},"Ollama API documentation","https:\u002F\u002Fdocs.ollama.com\u002Fapi",{"title":509,"url":510},"Ollama on GitHub, with the MIT LICENSE file","https:\u002F\u002Fgithub.com\u002Follama\u002Follama",{"title":512,"url":513},"Ollama terms of service, last updated May 2026","https:\u002F\u002Follama.com\u002Fterms",{"title":515,"url":516},"Ollama pricing, cloud plans and per-token model rates","https:\u002F\u002Follama.com\u002Fpricing",{"title":518,"url":519},"Hardware support: Nvidia, AMD, Metal and Vulkan","https:\u002F\u002Fdocs.ollama.com\u002Fgpu",{"title":521,"url":522},"OpenAI compatibility, including what is not supported","https:\u002F\u002Fdocs.ollama.com\u002Fapi\u002Fopenai-compatibility","\u002Fimages\u002Fblog\u002Follama\u002Fcover.webp","\u002Fimages\u002Fblog\u002Follama\u002Fog.jpg",[63,64,65],"Ollama im Test: der freundliche Weg zu offenen Modellen","Ollama liefert offene Modelle über eine HTTP-API auf eigener Hardware aus. Was es gut macht, wo der Durchsatz zu kurz kommt, was die MIT-Lizenz nicht abdeckt.","Abstrakte Titelgrafik für den Ollama-Test","https:\u002F\u002Follama.com","MIT · free for personal use","Local inference runtime",{"slug":533,"published":534,"minutes":486,"category":7,"tags":535,"keywords":541,"about":549,"sources":556,"cover":608,"og":609,"expertise":61,"locales":610,"lang":64,"title":611,"description":612,"coverAlt":613,"url":552,"pricing":614,"kind":536},"portkey","2026-09-28",[536,537,538,539,540],"LLM gateway","Guardrails","Routing","Observability","Cost control",[542,543,544,545,546,547,548],"portkey ai gateway","portkey vs litellm","llm gateway comparison","llm gateway latency overhead","llm guardrails gateway","self-hosted llm gateway","portkey pricing",[550,553],{"name":551,"url":552},"Portkey","https:\u002F\u002Fportkey.ai",{"name":554,"url":555},"API gateway","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FAPI_gateway",[557,560,563,566,569,572,575,578,581,584,587,590,593,596,599,602,605],{"title":558,"url":559},"Portkey docs: AI Gateway","https:\u002F\u002Fportkey.ai\u002Fdocs\u002Fproduct\u002Fai-gateway",{"title":561,"url":562},"Portkey docs: Getting started with the AI Gateway","https:\u002F\u002Fdocs.portkey.ai\u002Fdocs\u002Fguides\u002Fgetting-started\u002Fgetting-started-with-ai-gateway",{"title":564,"url":565},"Portkey docs: Gateway config object","https:\u002F\u002Fportkey.ai\u002Fdocs\u002Fapi-reference\u002Fconfig-object",{"title":567,"url":568},"Portkey docs: Guardrails","https:\u002F\u002Fportkey.ai\u002Fdocs\u002Fproduct\u002Fguardrails",{"title":570,"url":571},"Portkey docs: Guardrail endpoints and capabilities","https:\u002F\u002Fportkey.ai\u002Fdocs\u002Fproduct\u002Fguardrails\u002Fcapabilities",{"title":573,"url":574},"Portkey docs: Cache, simple and semantic","https:\u002F\u002Fportkey.ai\u002Fdocs\u002Fproduct\u002Fai-gateway\u002Fcache-simple-and-semantic",{"title":576,"url":577},"Portkey docs: Load balancing","https:\u002F\u002Fportkey.ai\u002Fdocs\u002Fproduct\u002Fai-gateway\u002Fload-balancing",{"title":579,"url":580},"Portkey docs: Enterprise hybrid deployment architecture","https:\u002F\u002Fportkey.ai\u002Fdocs\u002Fself-hosting\u002Fhybrid-deployments\u002Farchitecture",{"title":582,"url":583},"Portkey pricing","https:\u002F\u002Fportkey.ai\u002Fpricing",{"title":585,"url":586},"Portkey gateway on GitHub, MIT licensed","https:\u002F\u002Fgithub.com\u002FPortkey-AI\u002Fgateway",{"title":588,"url":589},"Portkey's own benchmark: gateway versus direct Bedrock","https:\u002F\u002Fgithub.com\u002FPortkey-AI\u002Fbenchmark-test",{"title":591,"url":592},"Portkey status page","https:\u002F\u002Fstatus.portkey.ai\u002F",{"title":594,"url":595},"Palo Alto Networks completes acquisition of Portkey, May 2026","https:\u002F\u002Fwww.paloaltonetworks.com\u002Fcompany\u002Fpress\u002F2026\u002Fpalo-alto-networks-completes-acquisition-of-portkey-to-secure-ai-agents",{"title":597,"url":598},"Palo Alto Networks: Prisma AIRS AI Gateway","https:\u002F\u002Fwww.paloaltonetworks.com\u002Fai-security\u002Fai-gateway",{"title":600,"url":601},"Cloudflare AI Gateway pricing","https:\u002F\u002Fdevelopers.cloudflare.com\u002Fai-gateway\u002Freference\u002Fpricing\u002F",{"title":603,"url":604},"LiteLLM pricing","https:\u002F\u002Fwww.litellm.ai\u002Fpricing",{"title":606,"url":607},"OpenRouter pricing","https:\u002F\u002Fopenrouter.ai\u002Fpricing","\u002Fimages\u002Fblog\u002Fportkey\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fportkey\u002Fog.jpg",[63,64,65],"Portkey: ein LLM-Gateway für die Produktion, geprüft auf Routing, Guardrails und Kosten","Portkey bündelt Retries, Fallbacks, Cache, Guardrails und Kostenkontrolle hinter einer OpenAI-kompatiblen Schnittstelle. Was die Konfiguration gut löst und was das Gateway an Latenz kostet.","Ein Requestweg von der Anwendung durch das Portkey-Gateway zu drei Modellanbietern, darunter das Guardrail-Ergebnis und das Protokoll.","Free · from $49 per month",{"slug":616,"published":617,"minutes":6,"category":7,"tags":618,"keywords":623,"about":630,"sources":634,"cover":650,"og":651,"expertise":61,"locales":652,"lang":64,"title":653,"description":654,"coverAlt":655,"url":656,"pricing":657,"kind":536},"openrouter","2026-07-23",[536,619,620,621,622],"Model routing","Fallbacks","OpenAI-compatible","Pay per token",[616,624,544,625,626,627,628,629],"openrouter vs litellm","openrouter pricing","openai compatible api gateway","llm fallback routing","multi model api gateway","byok llm routing",[631],{"name":632,"url":633},"OpenRouter","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FOpenRouter",[635,638,639,642,645,648],{"title":636,"url":637},"OpenRouter documentation: quickstart","https:\u002F\u002Fopenrouter.ai\u002Fdocs\u002Fquickstart",{"title":606,"url":607},{"title":640,"url":641},"OpenRouter documentation: model fallbacks","https:\u002F\u002Fopenrouter.ai\u002Fdocs\u002Fguides\u002Frouting\u002Fmodel-fallbacks",{"title":643,"url":644},"OpenRouter documentation: provider routing","https:\u002F\u002Fopenrouter.ai\u002Fdocs\u002Fguides\u002Frouting\u002Fprovider-selection",{"title":646,"url":647},"OpenRouter documentation index","https:\u002F\u002Fopenrouter.ai\u002Fdocs\u002Fllms.txt",{"title":649,"url":633},"Wikipedia: OpenRouter","\u002Fimages\u002Fblog\u002Fopenrouter\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fopenrouter\u002Fog.jpg",[63,64,65],"OpenRouter: ein API-Schlüssel vor jedem Modell im Katalog","OpenRouter packt 500+ Modelle von 80+ Anbietern hinter einen OpenAI-kompatiblen Endpunkt, mit Fallbacks und Weiterverrechnung zum Listenpreis. Kosten und Schwächen.","Anfragepfad durch OpenRouter: Client, Router, mögliche Anbieter, Fallback-Liste und das Modell, das tatsächlich antwortet.","https:\u002F\u002Fopenrouter.ai","Pay per token, no subscription",{"slug":659,"published":660,"minutes":6,"category":7,"tags":661,"keywords":665,"about":672,"sources":680,"cover":704,"og":705,"expertise":61,"locales":706,"lang":64,"title":707,"description":708,"coverAlt":709,"url":675,"pricing":710,"kind":711},"braintrust","2026-07-07",[662,539,663,664,10],"Evaluations","LLM-as-a-judge","CI gates",[659,666,667,668,669,670,671],"braintrust pricing","braintrust eval","autoevals library","braintrust vs langfuse","llm evaluation platform","eval driven development",[673,676,679],{"name":674,"url":675},"Braintrust","https:\u002F\u002Fwww.braintrust.dev",{"name":677,"url":678},"Continuous integration","https:\u002F\u002Fen.wikipedia.org\u002Fwiki\u002FContinuous_integration",{"name":32,"url":33},[681,684,687,690,693,696,699,701],{"title":682,"url":683},"Braintrust pricing: plans, credits and usage rates","https:\u002F\u002Fwww.braintrust.dev\u002Fpricing",{"title":685,"url":686},"Braintrust documentation: plans and limits","https:\u002F\u002Fwww.braintrust.dev\u002Fdocs\u002Fplans-and-limits",{"title":688,"url":689},"Braintrust documentation: evaluation quickstart","https:\u002F\u002Fwww.braintrust.dev\u002Fdocs\u002Fevaluation-quickstart",{"title":691,"url":692},"Braintrust documentation: get started","https:\u002F\u002Fwww.braintrust.dev\u002Fdocs",{"title":694,"url":695},"GitHub: Braintrust organisation repositories","https:\u002F\u002Fgithub.com\u002Forgs\u002Fbraintrustdata\u002Frepositories",{"title":697,"url":698},"Arize Phoenix documentation: self-hosting","https:\u002F\u002Farize.com\u002Fdocs\u002Fphoenix\u002Fself-hosting",{"title":700,"url":43},"Langfuse pricing: cloud plans and billable units",{"title":702,"url":703},"LangChain pricing: LangSmith plans","https:\u002F\u002Fwww.langchain.com\u002Fpricing","\u002Fimages\u002Fblog\u002Fbraintrust\u002Fcover.webp","\u002Fimages\u002Fblog\u002Fbraintrust\u002Fog.jpg",[63,64,65],"Braintrust im Test: Eval-first Observability mit hartem Zähler","Braintrust macht aus Produktions-Traces Datasets und gate-te Experimente. Was Starter und Pro wirklich enthalten, welches Teil quelloffen ist und wo Phoenix, Langfuse und LangSmith gewinnen.","Eine Schleife von instrumentierten Anwendungs-Logs in ein Dataset, ein Experiment mit Scorern und einen Vergleich, der den Pull Request sperrt, bevor die Änderung zurück in die Anwendung geht.","Free · from $249 per month","Evaluation platform",1791383550633]