La matematica dell'IPO di Anthropic e i tagli in Apple mostrano quanto costa davvero l'inferenza
Il prospetto dell'IPO di Anthropic, visto da Reuters e riportato il 29 settembre, affianca una bolletta infrastrutturale da 518 miliardi di dollari a una perdita netta di 42 miliardi per il 2025. Nello stesso periodo il nuovo amministratore delegato di Apple taglia personale, perché i prezzi della memoria pesano sui margini.

Due storie sono uscite a un giorno di distanza. Raccontano la stessa stretta da due lati opposti. Il prospetto di Anthropic, visto da Reuters, impegna la società a 518 miliardi di dollari di obblighi per cloud, calcolo e infrastrutture nei prossimi anni. Apple, secondo un rapporto Bloomberg di mercoledì, prepara licenziamenti su piccola scala e la cancellazione di progetti sotto il nuovo amministratore delegato John Ternus.
I numeri di Anthropic sono nei documenti che Reuters ha esaminato. Nel 2025 i ricavi sono cresciuti di 12 volte, fino a quasi 4,6 miliardi di dollari. La società ha perso più di 8 miliardi su base operativa e l'anno scorso ha speso 7,33 miliardi in calcolo e infrastrutture: il triplo rispetto al 2024 e più della metà dei 12,65 miliardi di spese operative totali. Al 31 dicembre aveva 20,28 miliardi tra liquidità, equivalenti e investimenti a breve termine.
La perdita non è tutta in contanti.
Circa 34 dei quasi 42 miliardi di perdita netta erano un onere contabile legato all'aumento del valore stimato di finanziamenti che potrebbero convertirsi in azioni Anthropic. Non sono soldi spesi per far funzionare l'attività. Due clienti hanno prodotto quasi un quarto dei ricavi l'anno scorso, e il prospetto avverte che molti grandi clienti non sono vincolati da contratti di lungo periodo.
La memoria è il vincolo che stringe
Il problema di Apple è più ordinario e, per chi compra hardware per l'IA, più istruttivo. A fine luglio l'azienda ha emesso una guidance sui ricavi prudente, perché non riusciva a procurarsi abbastanza chip di memoria, e i margini sono finiti sotto pressione per i prezzi più alti. Nella sua ultima chiamata sui risultati, l'allora amministratore delegato Tim Cook ha parlato di una "piena che capita una volta ogni 100 anni sul prezzo della memoria, con aumenti esponenziali dei prezzi". Yahoo Finance ha riferito che Ternus vuole evitare ulteriori rincari nel 2027 se la penuria continua.
Quella penuria ha una causa: la domanda di memoria a banda larga e DRAM avanzata per inferenza e addestramento. Yahoo Finance osserva che SK Hynix, Samsung Electronics e Micron hanno in gran parte esaurito la capacità di memoria premium per l'IA per buona parte del 2026, con Nvidia, Microsoft, Amazon e Meta a contendersela. I fornitori si aspettano un'offerta limitata fino al 2027.
Quindi il costo di servire un modello non è solo una questione di software. È una questione di allocazione della memoria, e ora Apple la paga in organico.
Quanto costa davvero il token
Artificial Analysis ha misurato Claude Sonnet 5.5 di Anthropic contro il proprio indice. Il modello arriva a 56 punti, due dietro Opus 5.5 al massimo sforzo, allo stesso prezzo di listino di Sonnet 5: 2 dollari per milione di token in ingresso e 10 dollari per milione di token in uscita. Il problema è il consumo di token. Al massimo sforzo il modello ha consumato circa 193.000 token in uscita per compito dell'Intelligence Index, il valore più alto che l'azienda abbia misurato: circa il 60% in più di Opus 5.5 al massimo e circa sette volte GPT-6 Astra al massimo. Il costo per compito si aggira intorno ai 7,60 dollari, circa il 50% in più di Sonnet 5.
Prezzi per token più bassi non significano automaticamente compiti più economici, ed è per questo che il routing è diventata una disciplina a sé. Unblocked, che gestisce carichi di lavoro per agenti, ha raccontato di aver spostato il traffico di GLM 5.2 tra Baseten, Fireworks e CoreWeave usando un router adattivo, che sceglie un fornitore per ogni richiesta in base a costo e velocità misurati. Con il round-robin, Fireworks ha servito il 51% dei compiti a prezzi superiori del 25% a quelli di Baseten. Un ordine fisso ha spinto Baseten al 98,5%. CoreWeave ha listini circa il 45% sotto quelli di Baseten, e l'azienda non aveva dati sulle prestazioni per collocarlo.
Il lato della fatturazione ha la sua aritmetica. Flaviocopes ha calcolato quanto costano 10.000 dollari di vendite mensili con 200 ordini da 50 dollari: Stripe prende 350 dollari, Creem 470, Paddle 600 e Gumroad 1.450. L'autore dichiara che Creem sponsorizza il sito e afferma che ogni commissione è stata verificata sulle pagine dei prezzi dei fornitori il 29 settembre.
I produttori di hardware inseguono la stessa curva
Ultium Cells, la joint venture di GM sulle batterie, ha detto martedì che il suo impianto di Spring Hill, in Tennessee, sarà il primo al mondo a produrre in massa celle prismatiche LMR. Secondo l'azienda offrono una densità energetica superiore del 33% rispetto alle LFP a costi comparabili. Gli aggiornamenti partono più avanti quest'anno e si concludono entro il 2028, con 500 posti di lavoro in più. Il primo veicolo con celle LMR è atteso nel 2028.
MaxLinear ha fatto un ragionamento simile sui costi per il networking. Il suo chip DOCSIS Puma 9, annunciato il 29 settembre, supporta DOCSIS 3.1, 3.1+ e 4.0 e, secondo l'azienda, riduce i costi delle apparecchiature presso il cliente dal 30% al 50% rispetto al predecessore. Aggiunge il supporto Wi-Fi 8 e opzioni di memoria DDR5, mentre l'offerta di DDR4 si stringe. I modem basati su questo chip sono attesi nel 2027.
Due note tecniche più piccole vanno nella stessa direzione. Bitdrift ha pubblicato blob-stream, un'alternativa a Kafka pensata per eliminare il traffico di rete tra zone di disponibilità e i broker stateless. L'argomento è che i costi tra zone di disponibilità dominano le bollette dello streaming cloud. Radim Marek ha messo a confronto REPACK (CONCURRENTLY) di PostgreSQL 19 con pg_repack e pg_squeeze su un Hetzner ccx33 e un GCE n2-standard-4. La riscrittura online ha generato 18,8 GB di WAL contro i 33,5 GB di pg_repack sulla stessa tabella.
Niente di tutto questo rende economica l'inferenza. Rende leggibile la bolletta, che è un'altra cosa.
Fonti
10- 01Anthropic's IPO prospectus shows AI vision, surging costs: ReutersEN
- 02New Apple CEO John Ternus is reportedly planning layoffs as memory chip costs riseEN
- 03Sonnet 5.5 has the heaviest token use we've measured; pricing matches GPT-6 SolEN
- 04Routing LLM traffic across inference providers with TCP-style congestion controlEN
- 05What $10k a month in sales costs you on each payment providerEN
- 06GM's new EV battery tech will cut costs without sacrificing performance or rangeEN
- 07MaxLinear claims new 'Puma 9' DOCSIS chip is a big cost-cutterEN
- 08Announcing blob-stream: a Kafka alternative for no fuss, low cost high volume streamingEN
- 09What REPACK (CONCURRENTLY) costs while it runsEN
- 10Anthropic IPO prospectus reveals surging costs, $42B 2025 net loss: reportEN
Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.
I contenuti sono stati preparati dalla redazione con il supporto dell'IA.
Commenti
0- Nessun commento — sii il primo.