Ekonomia inferencji się zmienia. Anthropic wydała 7,33 mld dolarów na moc obliczeniową, a Sonnet 5.5 zużywa rekordowo dużo tokenów
Prospekt emisyjny Anthropic, do którego dotarł Reuters, pokazuje, że firma wydała w 2025 roku 7,33 mld dolarów na moc obliczeniową i infrastrukturę, trzy razy więcej niż w 2024 roku. W tym samym czasie jeden z jej najnowszych modeli zużywa więcej tokenów wyjściowych na zadanie niż jakikolwiek model zmierzony przez Artificial Analysis.

29 września Artificial Analysis opublikowało ocenę Claude Sonnet 5.5 od Anthropic. Model zużywa około 193 000 tokenów wyjściowych na zadanie Intelligence Index przy maksymalnym wysiłku. To najwyższe zużycie tokenów, jakie ta firma badawcza zarejestrowała, około siedem razy więcej niż GPT-6 Astra przy maksymalnym wysiłku. To pomiar, nie runda finansowania ani premiera układu, a zbiega się w czasie z największym ujawnieniem kosztów w branży w tym roku.
Prospekt emisyjny Anthropic, o którym pierwszy napisał Reuters, a który podjęły CNBC i TradingView 28 i 29 września, pokazuje, że firma wydała 7,33 mld dolarów na moc obliczeniową i infrastrukturę w ubiegłym roku, czyli ponad połowę z 12,65 mld dolarów łącznych kosztów operacyjnych. Firma planuje też 518 mld dolarów zobowiązań w zakresie chmury, mocy obliczeniowej i infrastruktury w najbliższych latach. Ceny za token stały się standardowym sposobem porównywania modeli. Artificial Analysis zauważa, że Anthropic wyceniła Sonnet 5.5 identycznie jak Sonnet 5: 2 dolary za milion tokenów wejściowych i 10 dolarów za milion tokenów wyjściowych, tak samo jak GPT-6 Sol. Ta sama ocena mówi, że model kosztuje około 7,60 dolara na zadanie, mniej więcej 50% więcej niż koszt zadania w Sonnet 5, bo po prostu emituje więcej tokenów, żeby osiągnąć porównywalne wyniki.
Zużycie tokenów to zmienna kosztowa, której nikt nie wycenia przy kasie
Przy maksymalnym wysiłku, gdzie osiąga wydajność zbliżoną do Opus 5.5, Claude Sonnet 5.5 zużył około 193 000 tokenów wyjściowych na zadanie Intelligence Index. To najwyższe zużycie tokenów, jakie zmierzyliśmy.
Artificial Analysis zaznacza też zastrzeżenie: oceny przeprowadzono na wersji przedpremierowej z błędem wpływającym na ustrukturyzowane wyniki, który naprawiono w wersji publicznej, a firma zamierza powtórzyć odpowiednie testy. Sonnet 5.5 osiąga 56 punktów w Intelligence Index, dwa punkty za Opus 5.5 przy maksymalnym wysiłku, i zdobywa 64% w Terminal-Bench 4.0 wobec 60% dla Opus 5.5 i GPT-6 Astra.
Tymczasem rachunek za obsługę tego ruchu cały czas rośnie. Według wpisu na getunblocked.com z 29 września firma kieruje ruch modelu otwartego GLM 5.2 przez Baseten, Fireworks i CoreWeave i ustaliła, że ceny katalogowe CoreWeave są około 45% niższe niż w Baseten. Jej adaptacyjny router waży koszt na 0,7, a szybkość na 0,3, wychodząc z założenia, że model jest identyczny niezależnie od dostawcy. Wpis otwarcie opisuje wcześniejsze rozwiązanie: podział metodą round-robin wysyłał 51% zadań do Fireworks po cenach 25% wyższych niż w Baseten, bez żadnej korzyści.
Pamięć to miejsce, do którego płyną pieniądze
Po stronie sprzętu presja nie zelżała. Yahoo Finance podało 30 września, że nowy dyrektor generalny Apple, John Ternus, planuje niewielkie zwolnienia w dużych zespołach i anulowanie projektów, powołując się na raport Bloomberga, bo koszty pamięci dają się we znaki. Artykuł cytuje ustępującego dyrektora generalnego Apple, Tima Cooka, który na swojej ostatniej konferencji wynikowej mówił o studwudziestoletniej powodzi, jak to nazwał, w cenach pamięci, z wykładniczymi wzrostami. Apple już pod koniec lipca podało ostrożne prognozy przychodów, bo nie mogło zdobyć wystarczającej liczby układów pamięci.
Ten sam tekst zauważa, że SK Hynix, Samsung Electronics i Micron wyprzedały niemal całe moce produkcyjne pamięci premium na potrzeby AI przez znaczną część 2026 roku, gdy Nvidia, Microsoft, Amazon i Meta rozbudowują infrastrukturę AI. Podaż ma pozostać ograniczona do 2027 roku. To tło, przez które trzeba teraz czytać każdą prognozę kosztów inferencji: chodzi nie tylko o to, ile tokenów emituje model, ale też ile kosztuje pamięć wewnątrz klastra obsługującego zapytania.
Własny dokument Anthropic, jak relacjonuje Reuters, stawia stronę popytu w ostrych słowach. Przychody wzrosły w 2025 roku dwunastokrotnie, do prawie 4,6 mld dolarów, ale firma odnotowała 42 mld dolarów straty netto, w tym około 34 mld dolarów obciążenia księgowego związanego z rosnącą szacowaną wartością finansowania, które mogłoby zamienić się na akcje. Firma ostrzegła też, że prawie jedna czwarta przychodów pochodziła od dwóch klientów, a wielu jej największych odbiorców nie miało długoterminowych umów.
Pytanie o ceny bez czystej odpowiedzi
Luka między cenami katalogowymi za token a rzeczywistym kosztem zadania to nie drobny szczegół księgowy. Artificial Analysis umieszcza Sonnet 5.5 poza granicą Pareto inteligencji względem kosztu zadania, a ustawienia niższego wysiłku lokują się za konfiguracjami GPT-6 Sol, które dają równoważną wydajność przy mniejszej liczbie tokenów wyjściowych. Ustawienie wysokiego wysiłku opisano jako bardzo niewiele ustępujące GPT-6 Sol pod względem inteligencji przy praktycznie tym samym koszcie zadania.
Inne źródła w dossier wskazują w tym samym kierunku, choć nie dotyczą bezpośrednio inferencji. Wpis z 29 września na flaviocopes.com porównuje opłaty dostawców płatności przy miesięcznym obrocie 10 000 dolarów i pokazuje, że efektywne stawki skupiają się między 3,5% a 6% u wszystkich oprócz Gumroad z 14,5%. To przypomnienie, jak bardzo pozorne porównanie cen zależy od wybranej jednostki: stała opłata 0,40 dolara to 0,8% zamówienia na 50 dolarów i 4% zamówienia na 10 dolarów.
Czy ceny inferencji podążają tym samym wzorem, pozostaje otwartym pytaniem. Prospekt Anthropic sugeruje firmę, która zakłada, że skala w końcu naganie krzywą kosztów, a jednocześnie jej własne premiery modeli sprawiają, że obsługa zadań staje się droższa. Reuters podał wcześniej, powołując się na źródła, że IPO zostanie prawdopodobnie przesunięte na czas po listopadowych wyborach do Kongresu w USA, przy oczekiwanej wycenie powyżej 2 000 000 000 000 dolarów, ponad dwukrotnie większej niż własne szacunki firmy na 965 000 000 000 dolarów z maja.
Inwestorzy oceniający tę kwotę będą musieli zważyć dwa dokumenty opublikowane dzień po dniu: prospekt pokazujący 518 000 000 000 dolarów przyszłych zobowiązań infrastrukturalnych i benchmark pokazujący, że najnowszy model średniej półki tej firmy zużywa więcej tokenów wyjściowych niż cokolwiek wcześniej zmierzone. Żaden z osobna nie jest zabójczy. Razem wyznaczają pytanie, które branża AI omijała przez dwa lata: ile naprawdę kosztuje ukończenie zadania.
Źródła
6- 01Anthropic's IPO prospectus shows AI vision, surging costs | ReutersEN
- 02Anthropic IPO prospectus reveals surging costs, $42B 2025 net lossEN
- 03Sonnet 5.5 has the heaviest token use we've measured; pricing matches GPT-6 SolEN
- 04Routing LLM traffic across inference providers with TCP-style congestion controlEN
- 05Apple CEO John Ternus is reportedly planning layoffs as memory chip costs riseEN
- 06What $10k a month in sales costs you on each payment providerEN
Wszystkie liczby i cytaty w tym tekście pochodzą z poniższych źródeł. Nie dopisujemy danych, których w źródłach nie ma.
Materiały zostały przygotowane przez zespół redakcyjny wspierane przez AI.
Komentarze
0- Brak komentarzy — bądź pierwszy.