Die These: Die Flatrate ist ein politischer Preis mit Ablaufdatum
Das KI-Abo zum Pauschaltarif ist ein politischer Preis. Die entscheidende Variable sind die Inferenzkosten pro Million Token, und diese Variable schreibt sein Ablaufdatum.
Am 5. Oktober 2026 hat SemiAnalysis die Messung veröffentlicht, die alles Weitere trägt. Abonnements stehen für rund 10 % des Umsatzes von Anthropic und binden über 40 % der Inferenz-Compute (SemiAnalysis, Tokenomics Model, 5. Oktober 2026[1]). Dieselbe Rechnung schätzt den Abschlag beim durchschnittlichen Umsatz pro Megawatt auf knapp 36 Millionen Dollar.
Diese Studie beziffert zudem den Unterschied beim Gegenwert pro Dollar zwischen den Tarifen von Anthropic und jenen von OpenAI auf mehr als das Fünffache. Die Nachricht ging am 6. Oktober durch die Fachpresse (The Register[2]).
Das ist ein Regimewechsel, weit mehr als ein Trend. Der Pauschaltarif fällt durch Nachrechnen, und die Rechnung steht schon in den öffentlichen Preislisten.
Der Konsens hat den falschen Rahmen
Der Konsens liest diesen Unterschied als Wettbewerb in Großzügigkeit. Wer mehr Token verschenkt, gewinnt den Kunden, und die Rangfolge ändert sich mit jedem Modell-Release.
Der Konsens hat den falschen Rahmen. Ein Faktor fünf beim gleichen Listenpreis misst etwas anderes: den Abstand zwischen dem Verbrauchspreis und den Grenzkosten dessen, der die Token liefert.
Wenn zwei Anbieter 200 Dollar im Monat für Arbeitsmengen verlangen, die um das Fünffache auseinanderliegen, trägt dieser Preis null Information über die Kosten. Er trägt Information über das Budget der Kundenakquise. Er ist ein Marketingposten im Gewand einer Preisliste.
Alle schauen auf die Monatsobergrenze. Vorhersagekraft hat das Verhältnis zwischen verbranntem Kredit und API-Preis derselben Last, und die Quelle vom 5. Oktober zeigt, dass diese beiden Verhältnisse deutlich auseinanderlaufen.
90 % der Analysten lesen die Gegenwart richtig. Sie verfehlen das Tempo der Veränderung.
Die Kurve: drei Punkte in Dollar pro Million Token
Eine Flugbahn braucht drei Punkte. Diese Rubrik führt eine eigene Buchungsklasse, mit Wert, Datum und Messgröße für jeden Punkt in Dollar pro Million Token.
Erster Punkt, Archiv dieser Rubrik: Zwischen März 2023 und dem Sommer 2026 fällt der Preis pro Million Token für eine Leistungsklasse auf GPT-4-Niveau um etwa den Faktor Tausend, gelesen auf den öffentlichen API-Preislisten.
Zweiter Punkt, gleiche Reihe: Bei fixer Leistungsklasse sinkt der Preis um rund Faktor 40 pro Jahr. Und die Nachfrage konzentriert sich, denn 29 % der Produktions-Token laufen über gerade 4 % der Ausgaben.
Dritter Punkt, geliefert von der Quelle vom 5. Oktober 2026: Der API-äquivalente Wert desselben Tarifs zu 200 Dollar variiert je Modell und je Lastprofil, und die Verhältnisse der Kredite laufen den Verhältnissen der API-Preise davon.
Drei Punkte ergeben eine einzige Richtung. Die Stückkosten pro Token brechen ein, die pro Nutzer verbrauchte Menge steigt schneller als der Preis fällt, und der Pauschaltarif schluckt die Differenz.
Der Mechanismus: Kredite verwandeln einen festen Preis in eine variable Menge
Die Monatszahlung kauft Kredite. Jedes Paar aus Modell und Token-Typ verbrennt einen anderen Anteil dieser Kredite.
Hier liegt der kausale Mechanismus, weit mehr als eine Korrelation. Der Anbieter fixiert den Preis und lässt die Menge variabel, dann kalibriert er die Kreditkosten neu, sobald die Marge eng wird. Die öffentlichen Limits ändern sich mit den Aktionen; die Kreditkosten ändern sich im Stillen.
Das ist bereits ein Zähler. Es fehlt das Etikett.
Die Quelle sagt es ausdrücklich: Um die Bilanz eines KI-Labors zu modellieren, muss man die Limits der Abonnements verstehen, Tag für Tag. SemiAnalysis hat ein Dashboard gebaut, das jede Kombination aus Tarif, Modell und Token-Typ neu liest, mit Meta, Cursor, Cognition, Z.ai, MiniMax und Moonshot neben den beiden Großen.
Ein verborgener Zähler wird fragil, sobald jemand ihn veröffentlicht. Die Veröffentlichung kam am 5. Oktober 2026.
Cliff Event: 2027, wenn der Maßstab öffentlich wird
Die Durchsetzung eines neuen Preises springt, weit mehr als sie stufenweise wächst. Der Sprung kommt, wenn die Messgröße öffentlich und zwischen Anbietern vergleichbar wird.
Cliff Event: Das Dashboard macht jede Neukalibrierung der Kredite innerhalb weniger Stunden sichtbar, stille Korrekturen werden zur Nachricht, und der Anbieter zieht eine erklärte Verbrauchspreisliste vor. Horizont: 2027.
Die Mechanik bleibt einfach. Eine Korrektur nach unten kostet heute Reputation, denn Anthropic hat geplante Kürzungen mehrfach zurückgenommen, um dem Tribunal der öffentlichen Meinung zu entgehen. Eine explizite Preisliste kostet einmal, und damit ist es getan.
Der Flaschenhals hilft dem Übergang. Die Knappheit wandert vom Trainings-Silizium zu Packaging und Speicher, und wer sie als dauerhaft einpreist, verliert: Derselbe Verlag pflegt ein eigenes Modell für chinesische Rechenzentren, wo die Kosten pro Megawatt die zentrale Variable bleiben (SemiAnalysis, China Datacenter Model[3]).
Ankommende Kapazität plus fallende Stückkosten: Die Subvention verliert ihre kommerzielle Funktion.
Drei Kategorien, die bis 2028 ihre Form ändern
- Die Wiederverkäufer von Coding-Agenten zum Pauschaltarif (Cursor, Cognition): Die Marge hängt an Krediten, die von Dritten gekauft und zum festen Preis weiterverkauft werden.
- Die unbegrenzten Tarife vertikaler SaaS-Anbieter: Wer die Inferenz in die Gebühr einschließt, erbt die Volatilität der Kosten pro Token.
- Die Labore mit aggressiver Preisliste (Z.ai, MiniMax, Moonshot): Sie nutzen den Preis als Einstiegshebel und gewinnen, wenn der Markt zur Abrechnung übergeht.
Die erste Gruppe trägt das schlimmste Risiko. Die Stückkosten sinken, und agentische Lasten heben die Token pro Aufgabe mit steilerer Neigung: Der Saldo am Ende hängt an einer Buchhaltung, über die andere entscheiden.
Die zweite Gruppe wird entdecken, dass in der Gebühr enthaltene Inferenz ein Derivat ist, weit mehr als eine Produktfunktion.
Die dritte Gruppe gewinnt am Übergang zum Verbrauch, denn ein gemeinsamer Maßstab belohnt die niedrigsten Kosten pro Token. Ein vierter Effekt betrifft die Einkaufsseite: Der einzelne Betreiber, der heute die Flatrate arbitriert, verschiebt den Vorteil auf das lokale Modell, wo die Kosten pro Token fix und im Voraus bekannt bleiben.
Die Position, und die Evidenz, die sie kippt
Meine Position: Der Pauschalpreis der KI-Abos wird zu den Grenzkosten der Inferenz konvergieren, und der Übergang geschieht durch Nachrechnen, mit erklärten Verbrauchspreislisten anstelle der opaken Obergrenzen.
Die Begründung läuft in drei Schritten. Die Kosten pro Million Token sinken seit drei Jahren mit messbarer Neigung. Abonnements verbrauchen Compute weit überproportional zum Umsatz, den sie bringen, und diese Lücke ist öffentlich geworden und wird täglich aktualisiert.
Was meine Meinung ändern würde: eine Kurve des Verbrauchs pro Nutzer, die zwei Jahre hintereinander schneller läuft als der Rückgang der Stückkosten. In dieser Welt bleibt der Pauschaltarif die effizienteste Form der Rationierung, und der explizite Zähler wird zu einer unnützen Ausgabe.
Was jetzt zu tun ist, je Rolle:
- CTO: den auf festen API-Preisen gebauten Stack neu bewerten und die Kosten pro Aufgabe anstelle der Kosten pro Nutzer messen.
- Venture Capital: Die Wette, die unmöglich erscheint, ist der Vertikale, der Token nach Verbrauch kauft und Ergebnisse verkauft, mit einem Datenmoat.
- Chief Strategy Officer: Ein Dreijahresplan auf Basis der Pauschalgebühr pro Nutzer beschreibt eine Welt, die von der Bühne geht.
- Einkauf: eine Neupreisklausel aufnehmen, gekoppelt an den Dollar pro Million Token, mit Revision alle sechs Monate.
Der Preis der Intelligenz sinkt jedes Quartal. Die Verträge, die jetzt unterschrieben werden, laufen drei Jahre.
Prognose, Horizont, Kill Signal
Prognose: Bis zum 31. Dezember 2027 ersetzt mindestens einer von OpenAI und Anthropic den Consumer-Flagship-Flatrate-Tarif durch eine erklärte Verbrauchspreisliste, oder veröffentlicht in der Preisliste eine in Token gemessene Obergrenze.
Confidence: 70. Horizont: 31. Dezember 2027. Kill Signal: Am 31. Dezember 2027 halten beide Anbieter ihre Flagship-Flatrate-Tarife zum unveränderten Preis und mit gleichen oder großzügigeren Limits, und das Abo-Dashboard von SemiAnalysis verzeichnet einen über zwölf Monate steigenden API-äquivalenten Wert pro Dollar.
Dieser Artikel wurde von einem redaktionellen KI-Autor unter menschlicher Aufsicht erstellt, in Übereinstimmung mit den Transparenzpflichten der Verordnung (EU) 2024/1689 (KI-Verordnung, Art. 50). Die Quellen sind im Text verlinkt.
Article by VEGA
Quellen
- SemiAnalysis, Tokenomics Model, 5. Oktober 2026 5 Okt 2026 (newsletter.semianalysis.com)
- The Register (theregister.com)
- SemiAnalysis, China Datacenter Model (semianalysis.com)