Anthropics IPO-Prospekt beziffert Inferenzkosten mit 518 Milliarden Dollar
Das IPO-Prospekt von Anthropic, über das Reuters am 29. September berichtet hat, weist Verpflichtungen von 518 Milliarden Dollar für Cloud und Infrastruktur aus sowie einen Nettoverlust von 42 Milliarden Dollar für 2025. So deutlich wie nie zuvor zeigt sich daran: Inferenz- und Rechenkosten sind das Geschäftsmodell, nicht bloß eine Kostenposition.

Die wichtigste Zahl in Anthropics Prospekt ist nicht die Bewertung, die laut Reuters zwei Billionen Dollar übersteigen könnte. Wichtig sind die 518 Milliarden Dollar, die das Unternehmen in den kommenden Jahren für Cloud, Rechenleistung und Infrastruktur ausgeben will. Reuters meldete die Zahl am 29. September und berief sich auf das Prospekt, das die Agentur nach eigenen Angaben eingesehen hat. Die Zusammenfassung dieser Berichterstattung bei CNBC gibt sie wieder.
Dasselbe Dokument verzeichnet für 2025 einen Nettoverlust von 42 Milliarden Dollar. Der Umsatz wuchs auf das Zwölffache, auf fast 4,6 Milliarden Dollar. Der operative Verlust lag bei mehr als 8 Milliarden Dollar, ohne Abschreibungen im Zusammenhang mit früheren Kapitalbeschaffungen. Für Rechenleistung und Infrastruktur gab Anthropic im vergangenen Jahr 7,33 Milliarden Dollar aus, dreimal so viel wie 2024 und mehr als die Hälfte der gesamten Betriebsausgaben von 12,65 Milliarden Dollar.
Der Preis eines Tokens ist nicht der Preis der GPU
Wer diese Zahlen als reine GPU-Rechnung liest, sollte sich ansehen, was die Preisvergleichsdienste in derselben Woche gemessen haben. Meetrix.io prüfte am 28. September die On-Demand-Listenpreise und fand eine H100 bei AWS für 6,88 Dollar pro Stunde, bei GCP für 10,98 Dollar. Das sind rund 37 Prozent weniger, der AWS-Wert stammt aus dem EC2-Tracker von Vantage. Dieselbe Analyse beziffert die Kosten pro Million Tokens mit 0,76 Dollar bei voll ausgelasteter H100 und mit 3,06 Dollar bei 25 Prozent Auslastung. Grundlage ist ein als Platzhalter gekennzeichneter Durchsatz von 2.500 Tokens pro Sekunde. Das Verhältnis, ein Faktor vier, hängt nicht von dieser Annahme ab. Kein Anbieterwechsel liefert das.
GPUAdvisor, nach eigenen Angaben mit 14 Anbietern im Vergleich und einer am 1. Oktober aktualisierten Tabelle, listet Preise pro GPU bei AWS, GCP, Azure, Lambda, CoreWeave, RunPod, Nebius und weiteren auf. Spezialisierte GPU-Clouds bieten zwei- bis viermal niedrigere Preise pro GPU als Hyperscaler, heißt es dort. Der zentrale Befund ist enger, als er klingt: Die Preisgestaltung verhält sich nicht mehr wie eine Nachschlagetabelle. Der Vergleich hält also nur, wenn man vor der Budgetfreigabe die Anbieterseite prüft.
Anthropic kauft nicht allein nach dem Preis ein. Laut Prospekt stammte fast ein Viertel des Umsatzes im vergangenen Jahr von zwei Kunden. Das Unternehmen warnt, dass viele seiner größten Kunden nicht langfristig vertraglich gebunden sind.
Die Einsparungen liegen im Routing, nicht im Einkauf
Unblocked veröffentlichte am 29. September eigene Zahlen und beschreibt einen Router, der Datenverkehr zwischen Baseten, Fireworks und CoreWeave verteilt. Alle drei bedienen dasselbe offene Modell. Im Round-Robin-Verfahren bediente Fireworks 51 Prozent der Aufgaben, zu Preisen, die 25 Prozent über denen von Baseten lagen, und langsamer. Eine feste Reihenfolge schob Baseten auf 98,5 Prozent der Aufgaben, doch jede Änderung erforderte ein Deployment. Die adaptive Version bewertet Anbieter mit 0,7 für Kosten und 0,3 für Geschwindigkeit. Sie schreibt alle fünf Minuten eine Zusammenfassung nach Redis, sodass kein Netzwerkaufruf pro Anfrage nötig ist. Die Listenpreise von CoreWeave lagen etwa 45 Prozent unter denen von Baseten, und der Router konnte CoreWeave ohne menschliches Eingreifen einbeziehen.
Artificial Analysis ergänzt in einer Notiz vom 29. September eine Variable auf Modellseite. Claude Sonnet 5.5 kostet 2 Dollar pro Million Eingabe-Tokens und 10 Dollar pro Million Ausgabe-Tokens und erreicht 56 Punkte im Intelligence Index. Bei maximalem Aufwand verbraucht es rund 193.000 Ausgabe-Tokens pro Aufgabe, der höchste gemessene Wert des Hauses und etwa siebenmal so viel wie GPT-6 Astra (max). Die Kosten pro Aufgabe liegen bei 7,60 Dollar, rund 50 Prozent über Sonnet 5.
Die beiden Zahlen widersprechen sich nicht, sie messen Unterschiedliches: den Listenpreis pro GPU-Stunde und die Kosten pro abgeschlossener Aufgabe. Meetrix.io erklärt ausdrücklich, dass kein Durchsatz-Benchmark durchgeführt wurde und die Tokens-pro-Sekunde-Angabe ein Platzhalter ist. Die Verpflichtung von 518 Milliarden Dollar bei Anthropic ist ein Vertrag, kein Benchmark.
Quellen
5- 01Anthropic's IPO prospectus shows AI vision, surging costs | ReutersEN
- 02GPU Costs for LLM Inference: AWS vs GCP (2026)EN
- 03Cloud GPU Pricing - Cost Intelligence for H100, A100 & B200EN
- 04Routing LLM traffic across inference providers with TCP-style congestion controlEN
- 05Sonnet 5.5 has the heaviest token use we've measured; pricing matches GPT-6 SolEN
Alle Zahlen und Zitate in diesem Text stammen aus den unten genannten Quellen.
Die Materialien wurden vom Redaktionsteam mit Unterstützung von KI erstellt.
Kommentare
0- Noch keine Kommentare — seien Sie der Erste.