Prospekt IPO Anthropic wpisuje 518 mld dolarów w koszty wnioskowania
Prospekt IPO Anthropic, o którym Reuters napisał 29 września, ujawnia 518 mld dolarów zobowiązań wobec chmury i infrastruktury oraz 42 mld dolarów straty netto za 2025 rok. To najwyraźniejszy sygnał, że koszty wnioskowania i mocy obliczeniowej są dziś samym modelem biznesowym, a nie jedną z pozycji w budżecie.

W dokumentach Anthropic najważniejsza nie jest wycena, która według Reutersa może przekroczyć 2 000 000 000 000 dolarów. Liczy się 518 000 000 000 dolarów, które spółka zamierza wydać na zobowiązania wobec chmury, mocy obliczeniowej i infrastruktury w najbliższych latach. Reuters podał tę kwotę 29 września, powołując się na prospekt, który, jak twierdzi, widział. Omówienie tego materiału opublikował CNBC.
Ten sam dokument odnotowuje 42 000 000 000 dolarów straty netto za 2025 rok. Przychody wzrosły dwunastokrotnie, do blisko 4 600 000 000 dolarów. Strata operacyjna, bez odpisów związanych z wcześniejszym pozyskiwaniem kapitału, przekroczyła 8 000 000 000 dolarów. Na moc obliczeniową i infrastrukturę Anthropic wydał w ubiegłym roku 7 330 000 000 dolarów, trzy razy więcej niż w 2024 roku i ponad połowę z 12 650 000 000 dolarów łącznych kosztów operacyjnych.
Cena tokena to nie cena GPU
Kto czyta te liczby jak zwykły rachunek za GPU, powinien zajrzeć do tego, co w tym samym tygodniu zmierzyły serwisy śledzące ceny. Meetrix.io sprawdził 28 września ceny katalogowe na żądanie i znalazł H100 po 6,88 dolara za godzinę w AWS wobec 10,98 dolara w GCP, czyli około 37% taniej. Kwota dla AWS pochodzi z trackera EC2 firmy Vantage. Ta sama analiza podaje jednak koszt miliona tokenów na poziomie 0,76 dolara przy w pełni zajętym H100 i 3,06 dolara przy wykorzystaniu 25%. Opiera się przy tym na oznaczonym jako zastępczy przeliczniku 2 500 tokenów na sekundę. Ten stosunek, czterokrotna różnica, nie zależy od tego założenia. Żadna zmiana chmury tego nie daje.
GPUAdvisor, który twierdzi, że śledzi 14 dostawców i odświeżył swoją tabelę 1 października, podaje stawki za GPU w AWS, GCP, Azure, Lambda, CoreWeave, RunPod, Nebius i innych. Zauważa, że wyspecjalizowani dostawcy GPU oferują dwu- do czterokrotnie niższe ceny za GPU niż hyperskalerzy. Główny wniosek jest węższy, niż brzmi: ceny przestały zachowywać się jak tabela, więc porównanie ma sens tylko wtedy, gdy przed zaplanowaniem budżetu sprawdzisz stronę dostawcy.
Anthropic nie kieruje się wyłącznie ceną. Prospekt mówi, że blisko jedna czwarta przychodów pochodziła w ubiegłym roku od dwóch klientów, i ostrzega, że wielu największych klientów nie jest związanych długoterminowymi umowami.
Oszczędności siedzą w routingu, nie w zakupach
Unblocked opublikował 29 września własne liczby i opisał router, który przerzuca ruch między Baseten, Fireworks i CoreWeave. Wszystkie trzy obsługują ten sam model o otwartych wagach. W trybie round-robin Fireworks obsłużył 51% zadań po cenach o 25% wyższych niż Baseten i wolniej. Stała kolejność skierowała do Baseten 98,5% zadań, ale każda zmiana wymagała wdrożenia. Wersja adaptacyjna ocenia dostawców w 0,7 według kosztu i 0,3 według szybkości, a podsumowanie publikuje w Redisie co pięć minut, żeby nie wykonywać zapytania sieciowego przy każdym żądaniu. Ceny katalogowe CoreWeave były około 45% niższe niż u Baseten, a router mógł je sprawdzić bez udziału człowieka.
Artificial Analysis w nocie z 29 września dodaje zmienną po stronie modelu. Claude Sonnet 5.5, wyceniany na 2 dolary za milion tokenów wejściowych i 10 dolarów za milion wyjściowych, osiąga 56 punktów w ich Intelligence Index. Zużywa jednak około 193 000 tokenów wyjściowych na zadanie przy maksymalnym wysiłku, najwięcej, ile zmierzono, i około siedem razy więcej niż GPT-6 Astra (max). Koszt zadania wynosi 7,60 dolara, około 50% więcej niż w Sonnet 5.
Te dwie liczby nie tyle się kłócą, ile mierzą co innego: cenę katalogową za godzinę GPU i koszt ukończonego zadania. Meetrix.io mówi wprost, że nie robił testów przepustowości, a jego wartość tokenów na sekundę jest zastępcza. Zobowiązanie Anthropic na 518 000 000 000 dolarów to umowa, nie test.
Źródła
5- 01Anthropic's IPO prospectus shows AI vision, surging costs | ReutersEN
- 02GPU Costs for LLM Inference: AWS vs GCP (2026)EN
- 03Cloud GPU Pricing - Cost Intelligence for H100, A100 & B200EN
- 04Routing LLM traffic across inference providers with TCP-style congestion controlEN
- 05Sonnet 5.5 has the heaviest token use we've measured; pricing matches GPT-6 SolEN
Wszystkie liczby i cytaty w tym tekście pochodzą z poniższych źródeł. Nie dopisujemy danych, których w źródłach nie ma.
Materiały zostały przygotowane przez zespół redakcyjny wspierane przez AI.
Komentarze
0- Brak komentarzy — bądź pierwszy.