Anthropics Rechenkosten steigen auf 7,33 Milliarden Dollar, Sonnet 5.5 verbraucht so viele Token wie kein Modell zuvor
Aus dem IPO-Prospekt von Anthropic, das Reuters vorliegt, geht hervor: Das Unternehmen hat 2025 7,33 Milliarden Dollar für Rechenleistung und Infrastruktur ausgegeben, dreimal so viel wie 2024. Eines seiner neuesten Modelle verbraucht pro Aufgabe mehr Ausgabe-Token als jedes Modell, das Artificial Analysis je gemessen hat.

Am 29. September veröffentlichte Artificial Analysis eine Bewertung von Anthropics Claude Sonnet 5.5. Bei maximalem Aufwand verbraucht das Modell rund 193.000 Ausgabe-Token pro Aufgabe des Intelligence Index. Das ist der höchste Tokenverbrauch, den das Testunternehmen je gemessen hat, etwa siebenmal so viel wie GPT-6 Astra bei maximalem Aufwand. Es ist eine Messung, keine Finanzierungsrunde und kein Chip-Start. Sie fällt zusammen mit der größten Kostenoffenlegung, die die Branche in diesem Jahr vorgelegt hat.
Das IPO-Prospekt von Anthropic, über das Reuters zuerst berichtete und das CNBC und TradingView am 28. und 29. September aufgriffen, zeigt: Das Unternehmen hat im vergangenen Jahr 7.330.000.000 Dollar für Rechenleistung und Infrastruktur ausgegeben, mehr als die Hälfte seiner gesamten Betriebsausgaben von 12.650.000.000 Dollar. Für die kommenden Jahre plant es Verpflichtungen von 518.000.000.000 Dollar für Cloud, Computing und Infrastruktur. Preise pro Token sind zur Standardmethode geworden, um Modelle zu vergleichen. Artificial Analysis merkt an, dass Anthropic Sonnet 5.5 identisch zu Sonnet 5 bepreist hat: 2 Dollar pro Million Eingabe-Token und 10 Dollar pro Million Ausgabe-Token, was GPT-6 Sol entspricht. Dieselbe Bewertung nennt Kosten von etwa 7,60 Dollar pro Aufgabe, rund 50% mehr als bei Sonnet 5. Der Grund: Das Modell gibt schlicht mehr Token aus, um vergleichbare Werte zu erreichen.
Der Tokenverbrauch ist die Kostenvariable, die an der Kasse niemand bepreist
Bei maximalem Aufwand, wo es eine Leistung nahe der von Opus 5.5 erreicht, verbrauchte Claude Sonnet 5.5 etwa 193.000 Ausgabe-Token pro Aufgabe des Intelligence Index. Das ist der höchste Tokenverbrauch, den wir gemessen haben.
Artificial Analysis nennt auch einen Vorbehalt: Die Bewertungen liefen auf einem Vorab-Deployment mit einem Fehler bei strukturierten Ausgaben. Für die öffentliche Version wurde er behoben, die relevanten Tests will das Unternehmen erneut durchführen. Sonnet 5.5 erreicht 56 Punkte im Intelligence Index, zwei Punkte hinter Opus 5.5 bei maximalem Aufwand. Bei Terminal-Bench 4.0 kommt es auf 64%, gegenüber 60% für Opus 5.5 und GPT-6 Astra.
Die Rechnung für die Auslieferung dieses Verkehrs bewegt sich unterdessen in eine Richtung. Laut einem Beitrag auf getunblocked.com vom 29. September leitet das Unternehmen den Verkehr des offenen Modells GLM 5.2 über Baseten, Fireworks und CoreWeave. Dabei stellte es fest, dass die Listenpreise von CoreWeave etwa 45% unter denen von Baseten liegen. Sein adaptiver Router gewichtet Kosten mit 0,7 und Geschwindigkeit mit 0,3, nach der Logik, dass das Modell identisch ist, egal welcher Anbieter es ausliefert. Der Beitrag ist offen über den früheren Aufbau: Eine Round-Robin-Aufteilung schickte 51% der Aufgaben an Fireworks, zu Preisen, die 25% über denen von Baseten lagen, ohne Nutzen.
Speicher ist der Punkt, an dem das Geld hingeht
Auf der Hardwareseite hat der Druck nicht nachgelassen. Yahoo Finance berichtete am 30. September unter Berufung auf einen Bloomberg-Bericht, dass der neue Apple-CEO John Ternus kleinere Entlassungen innerhalb großer Teams plant und Projekte streicht, während die Speicherkosten drücken. Der Artikel zitiert Apples scheidenden CEO Tim Cook, der in seiner letzten Bilanzkonferenz von einer Jahrhundertflut bei den Speicherpreisen sprach, mit exponentiellen Anstiegen. Apple hatte bereits Ende Juli eine vorsichtige Umsatzprognose abgegeben, weil es nicht genügend Speicherchips beschaffen konnte.
Derselbe Beitrag merkt an, dass SK Hynix, Samsung Electronics und Micron ihre Premium-Kapazitäten für KI-Speicher während eines Großteils von 2026 weitgehend ausverkauft haben, während Nvidia, Microsoft, Amazon und Meta ihre KI-Infrastruktur ausbauen. Das Angebot dürfte bis 2027 knapp bleiben. Vor diesem Hintergrund muss heute jede Inferenz-Kostenprognose gelesen werden: Es geht nicht nur darum, wie viele Token ein Modell ausgibt, sondern auch darum, was der Speicher im Auslieferungscluster kostet.
Die eigene Anmeldung von Anthropic, wie von Reuters berichtet, beschreibt die Nachfrageseite in drastischen Zahlen. Der Umsatz wuchs 2025 um das Zwölffache auf fast 4.600.000.000 Dollar. Das Unternehmen verzeichnete jedoch einen Nettoverlust von 42.000.000.000 Dollar, einschließlich einer buchhalterischen Belastung von rund 34.000.000.000 Dollar im Zusammenhang mit dem steigenden geschätzten Wert von Finanzierungen, die in Aktien umgewandelt werden könnten. Es warnte zudem, dass fast ein Viertel des Umsatzes von zwei Kunden stammte und dass viele seiner größten Kunden nicht an langfristige Verträge gebunden waren.
Eine Preisfrage ohne saubere Antwort
Die Lücke zwischen den Preisschildern pro Token und den tatsächlichen Kosten pro Aufgabe ist kein kleines Buchhaltungsdetail. Artificial Analysis verortet Sonnet 5.5 außerhalb der Pareto-Grenze von Intelligenz gegenüber Kosten pro Aufgabe. Einstellungen mit geringerem Aufwand liegen hinter GPT-6-Sol-Konfigurationen, die gleichwertige Leistung mit weniger Ausgabe-Token liefern. Die Einstellung mit hohem Aufwand wird als sehr knapp hinter GPT-6 Sol bei der Intelligenz beschrieben, bei praktisch gleichen Kosten pro Aufgabe.
Andere Quellen im Dossier weisen in dieselbe Richtung, auch wenn sie nicht direkt die Inferenz betreffen. Ein Beitrag vom 29. September auf flaviocopes.com vergleicht Gebühren von Zahlungsanbietern bei einem Monatsumsatz von 10.000 und findet effektive Sätze zwischen 3,5% und 6% für alle außer Gumroad mit 14,5%. Das erinnert daran, wie sehr ein scheinbarer Preisvergleich von der gewählten Einheit abhängt: Eine feste Gebühr von 0,40 Dollar sind 0,8% einer Bestellung von 50 Dollar und 4% einer Bestellung von 10 Dollar.
Ob die Inferenz-Preisgestaltung demselben Muster folgt, ist die offene Frage. Anthropics Prospekt deutet auf ein Unternehmen, das darauf wettet, dass Skalierung die Kostenkurve irgendwann biegt. Seine eigenen Modellveröffentlichungen machen die Aufgaben jedoch teurer. Der Börsengang dürfte nach den US-Zwischenwahlen im November verschoben werden, berichtete Reuters zuvor unter Berufung auf Quellen, mit einer erwarteten Bewertung von über 2.000.000.000.000 Dollar, mehr als das Doppelte der eigenen Schätzung von 965.000.000.000 Dollar im Mai.
Anleger, die diese Zahl bewerten, müssen zwei Dokumente abwägen, die einen Tag auseinander veröffentlicht wurden: einen Prospekt mit künftigen Infrastrukturverpflichtungen von 518.000.000.000 Dollar und einen Benchmark, der zeigt, dass das neueste Mittelklasse-Modell des Unternehmens mehr Ausgabe-Token verbraucht als alles zuvor Gemessene. Keines davon ist für sich fatal. Zusammen umreißen sie die Frage, die der KI-Handel zwei Jahre lang vermieden hat: was eine Aufgabe tatsächlich kostet, bis sie abgeschlossen ist.
Quellen
6- 01Anthropic's IPO prospectus shows AI vision, surging costs | ReutersEN
- 02Anthropic IPO prospectus reveals surging costs, $42B 2025 net lossEN
- 03Sonnet 5.5 has the heaviest token use we've measured; pricing matches GPT-6 SolEN
- 04Routing LLM traffic across inference providers with TCP-style congestion controlEN
- 05Apple CEO John Ternus is reportedly planning layoffs as memory chip costs riseEN
- 06What $10k a month in sales costs you on each payment providerEN
Alle Zahlen und Zitate in diesem Text stammen aus den unten genannten Quellen.
Die Materialien wurden vom Redaktionsteam mit Unterstützung von KI erstellt.
Kommentare
0- Noch keine Kommentare — seien Sie der Erste.