Przejdź do treści
Czas na świecieEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portal o AI i technologiiwydarzenia · analizy · wywiady · tło techniczne

Szukaj
NA ŻYWO
›

Matematyka IPO Anthropica i zwolnienia w Apple pokazują, ile naprawdę kosztuje wnioskowanie

Prospekt IPO Anthropica, do którego dotarł Reuters i o którym pisano 29 września, zestawia rachunek za infrastrukturę na 518 000 000 000 dolarów ze stratą netto 42 000 000 000 dolarów za 2025 rok. Nowy dyrektor generalny Apple redukuje zatrudnienie, bo ceny pamięci dają się we znaki.

AI i modeleNewsAnna KaczmarekOpublikowano: 29 września 20264 min czytaniaŹródła 10
Matematyka IPO Anthropica i zwolnienia w Apple pokazują, ile naprawdę kosztuje wnioskowanie

Dwie historie pojawiły się w odstępie jednego dnia. Opisują ten sam ucisk z dwóch przeciwnych stron. Prospekt Anthropica, do którego dotarł Reuters, zobowiązuje spółkę do 518 000 000 000 dolarów zobowiązań wobec chmury, mocy obliczeniowych i infrastruktury w najbliższych latach. Apple, jak podał w środę Bloomberg, planuje niewielkie zwolnienia i anulowanie projektów pod wodzą nowego dyrektora generalnego Johna Ternusa.

Liczby Anthropica pochodzą z dokumentów, które przejrzał Reuters. Przychody wzrosły w 2025 roku dwunastokrotnie, do blisko 4 600 000 000 dolarów. Spółka straciła na działalności operacyjnej ponad 8 000 000 000 dolarów, a na moc obliczeniową i infrastrukturę wydała w zeszłym roku 7 330 000 000 dolarów, czyli trzykrotnie więcej niż w 2024 roku i ponad połowę z 12 650 000 000 dolarów całkowitych kosztów operacyjnych. Na 31 grudnia miała 20 280 000 000 dolarów w gotówce, ekwiwalentach i inwestycjach krótkoterminowych.

Strata nie jest w całości gotówkowa.

Około 34 000 000 000 dolarów z blisko 42 000 000 000 dolarów straty netto to obciążenie księgowe związane z rosnącą szacowaną wartością finansowania, które może zamienić się na akcje Anthropica, a nie pieniądze wydane na prowadzenie biznesu. Dwóch klientów wypracowało w zeszłym roku blisko jedną czwartą przychodów, a prospekt ostrzega, że wielu dużych klientów nie jest związanych długoterminowymi umowami.

Pamięć jest wąskim gardłem

Problem Apple jest bardziej przyziemny, a dla kupujących sprzęt do AI bardziej pouczający. Spółka pod koniec lipca podała ostrożną prognozę przychodów, bo nie mogła pozyskać wystarczającej liczby kości pamięci, a marże znalazły się pod presją wyższych cen pamięci. Podczas swojej ostatniej konferencji wynikowej ówczesny dyrektor generalny Tim Cook mówił o „studwudziestoletniej powodzi, jeśli chodzi o ceny pamięci, z wykładniczymi wzrostami cen pamięci”. Yahoo Finance podało, że Ternus chce uniknąć kolejnych podwyżek cen w 2027 roku, jeśli niedobór się utrzyma.

Ten niedobór ma przyczynę: popyt ze strony wnioskowania i treningu na pamięć o wysokiej przepustowości oraz zaawansowane pamięci DRAM. Yahoo Finance zauważa, że SK Hynix, Samsung Electronics i Micron wyprzedały niemal całe moce produkcyjne pamięci klasy premium dla AI przez większość 2026 roku, a konkurują o nie Nvidia, Microsoft, Amazon i Meta. Dostawcy spodziewają się ograniczonej podaży do 2027 roku.

Koszt obsługi modelu nie jest więc wyłącznie kwestią oprogramowania. To kwestia przydziału pamięci, a Apple płaci za nią teraz stanem zatrudnienia.

Ile faktycznie kosztuje token

Artificial Analysis zmierzyło Claude Sonnet 5.5 od Anthropica własnym indeksem. Model osiąga 56 punktów, dwa mniej niż Opus 5.5 przy maksymalnym wysiłku, przy cenniku identycznym jak Sonnet 5: 2 dolary za milion tokenów wejściowych i 10 dolarów za milion tokenów wyjściowych. Haczyk tkwi w zużyciu tokenów. Przy maksymalnym wysiłku model pochłonął około 193 000 tokenów wyjściowych na zadanie Intelligence Index, najwięcej, ile firma dotąd zmierzyła. To mniej więcej 60% więcej niż Opus 5.5 przy maksimum i około siedem razy więcej niż GPT-6 Astra przy maksimum. Koszt zadania wynosi blisko 7,60 dolara, około 50% więcej niż w Sonnecie 5.

Niższa cena za token nie oznacza automatycznie tańszych zadań, dlatego routing stał się osobną dyscypliną. Unblocked, które obsługuje obciążenia agentowe, opisało przenoszenie ruchu GLM 5.2 między Baseten, Fireworks i CoreWeave za pomocą adaptacyjnego routera. Router wybiera dostawcę dla każdego żądania na podstawie zmierzonego kosztu i szybkości. Przy trybie round-robin Fireworks obsłużył 51% zadań po cenach o 25% wyższych niż Baseten. Stała kolejność wypchnęła Baseten do 98,5%. CoreWeave miało ceny około 45% niższe niż Baseten, ale firma nie miała danych o wydajności, żeby je tam umieścić.

Strona rozliczeń ma własną arytmetykę. Flaviocopes policzył, ile kosztuje 10 000 dolarów miesięcznej sprzedaży przy 200 zamówieniach po 50 dolarów: Stripe bierze 350 dolarów, Creem 470 dolarów, Paddle 600 dolarów, a Gumroad 1 450 dolarów. Autor ujawnia, że Creem sponsoruje serwis, i podaje, że każdą opłatę sprawdził na stronach z cennikami dostawców 29 września.

Producenci sprzętu gonią tę samą krzywą

Wspólne przedsięwzięcie GM ds. baterii, Ultium Cells, podało we wtorek, że jego zakład w Spring Hill w Tennessee jako pierwszy na świecie zacznie masowo produkować pryzmatyczne ogniwa LMR. Według spółki ogniwa te dają o 33% wyższą gęstość energii niż LFP przy porównywalnym koszcie. Modernizacja rusza pod koniec tego roku i zakończy się do 2028 roku, tworząc 500 miejsc pracy, a pierwszy pojazd z ogniwami LMR ma pojawić się w 2028 roku.

MaxLinear przedstawiło podobny argument kosztowy w sieciach. Zapowiedziany 29 września układ Puma 9 DOCSIS obsługuje DOCSIS 3.1, 3.1+ i 4.0. Według spółki obniża koszty sprzętu u klienta o 30% do 50% względem poprzednika, dodając obsługę Wi-Fi 8 oraz opcje pamięci DDR5, gdy podaż DDR4 się kurczy. Modemy na nim oparte mają pojawić się w 2027 roku.

Dwie mniejsze notki inżynieryjne wskazują w tym samym kierunku. Bitdrift opublikował blob-stream, alternatywę dla Kafki zbudowaną tak, by wyeliminować ruch sieciowy między strefami dostępności i bezstanowe brokery. Firma argumentuje, że koszty transmisji między strefami dominują w rachunkach za strumieniowanie w chmurze. Radim Marek porównał REPACK (CONCURRENTLY) z PostgreSQL 19 z pg_repack i pg_squeeze na Hetzner ccx33 oraz GCE n2-standard-4. Przepisanie online wygenerowało 18,8 GB WAL wobec 33,5 GB w pg_repack na tej samej tabeli.

Nic z tego nie czyni wnioskowania tanim. Czyni rachunek czytelnym, a to coś innego.

Komentarze 0

Źródła

10
  1. 01Anthropic's IPO prospectus shows AI vision, surging costs: ReutersEN
  2. 02New Apple CEO John Ternus is reportedly planning layoffs as memory chip costs riseEN
  3. 03Sonnet 5.5 has the heaviest token use we've measured; pricing matches GPT-6 SolEN
  4. 04Routing LLM traffic across inference providers with TCP-style congestion controlEN
  5. 05What $10k a month in sales costs you on each payment providerEN
  6. 06GM's new EV battery tech will cut costs without sacrificing performance or rangeEN
  7. 07MaxLinear claims new 'Puma 9' DOCSIS chip is a big cost-cutterEN
  8. 08Announcing blob-stream: a Kafka alternative for no fuss, low cost high volume streamingEN
  9. 09What REPACK (CONCURRENTLY) costs while it runsEN
  10. 10Anthropic IPO prospectus reveals surging costs, $42B 2025 net loss: reportEN

Wszystkie liczby i cytaty w tym tekście pochodzą z poniższych źródeł. Nie dopisujemy danych, których w źródłach nie ma.

Materiały zostały przygotowane przez zespół redakcyjny wspierane przez AI.

Anna Kaczmarek

Anna Kaczmarek

AI, modele i technologie

Anna Kaczmarek pisze o technologiach, AI i modelach oraz mediach i internecie, opierając się na dokumentacji, repozytoriach i danych źródłowych, a nie na komunikatach prasowych. Przy testach modeli sprawdza karty techniczne, parametry wejściowe i liczy wyniki na tych samych zbiorach, zamiast powtarzać liczby od producentów. Czeka na premiery API i aktualizacje wag, rozmawia z inżynierami oraz porównuje wersje modeli pod kątem kosztów i opóźnień. Prywatnie self-hostuje usługi i konfiguruje sieci domowe, więc do redakcji wnosi praktykę z własnego serwera. Nie publikuje zapowiedzi ani parametrów, których nie może odtworzyć na własnym środowisku.

Redakcja →

Komentarze

0
  1. Brak komentarzy — bądź pierwszy.

Dodaj komentarz

Komentarze są widoczne publicznie. Nie publikujemy wulgaryzmów, spamu i treści reklamowych.