Il conto compute di Anthropic tra carenza di memoria e prezzi GPU in salita
Il prospetto IPO di Anthropic, riportato da Reuters il 28 settembre, indica una perdita netta di 42.000.000.000 di dollari per il 2025 e 518.000.000.000 di dollari di impegni previsti per cloud e computing: è il segnale più chiaro di quanto costi oggi la capacità di calcolo per l'AI.

Il 28 settembre Reuters ha riferito che il prospetto IPO di Anthropic mostra una perdita netta di 42.000.000.000 di dollari nel 2025 e una spesa prevista di 518.000.000.000 di dollari per obblighi legati a cloud, computing e infrastruttura negli anni a venire. L'anno scorso l'azienda ha speso 7.330.000.000 di dollari in compute e infrastruttura, il triplo rispetto al 2024, secondo lo stesso documento. L'analisi di TradingView del report Reuters aggiunge che le spese operative totali di Anthropic, pari a 12.650.000.000 di dollari, significano che il solo compute ne ha assorbito più della metà. Al 31 dicembre l'azienda chiudeva l'anno con liquidità, equivalenti di liquidità e investimenti a breve termine per 20.280.000.000 di dollari.
Il conto non riguarda solo le GPU
La memoria è il punto in cui la pressione ora si vede.
Mercoledì Yahoo Finance ha riferito che John Ternus, prossimo CEO di Apple, sta pianificando licenziamenti su piccola scala e la cancellazione di progetti, citando un report di Bloomberg. Il sito collega la mossa a una carenza di memoria che fa salire i costi dei componenti. L'articolo cita l'ex CEO Tim Cook nella sua ultima call sugli utili: "Lo abbiamo fatto perché siamo in quella che definirei un'alluvione centenaria sul fronte dei prezzi della memoria, con aumenti esponenziali." Quella carenza ha un lato dell'offerta. Yahoo Finance osserva che SK Hynix, Samsung Electronics e Micron hanno in gran parte esaurito la loro capacità premium di memoria per l'AI per buona parte del 2026, mentre Nvidia, Microsoft, Amazon e Meta corrono a costruire infrastruttura per l'AI. Aggiunge che i fornitori si aspettano che l'offerta di memoria resti limitata fino al 2027.
"We're pioneering manganese-rich battery technology to unlock premium range and performance at an affordable cost, especially in electric trucks."
Non ogni costo hardware è in salita.
Il 29 settembre MaxLinear ha annunciato che il suo nuovo chip Puma 9 DOCSIS riduce i costi delle apparecchiature presso il cliente del 30% al 50% rispetto al predecessore, secondo Light Reading. Il chip aggiunge il supporto alla memoria DDR5 per alleggerire la stretta sul DDR4. Puneet Sethi, SVP dell'unità network infrastructure di MaxLinear, ha detto a Light Reading che, man mano che i produttori spostano capacità verso il DDR5, "riteniamo che l'ecosistema DDR5, i prezzi e l'offerta diventeranno più distesi rispetto allo stress che vediamo con il DDR4". La stessa logica della memoria si sta muovendo nell'auto. Il 29 settembre Electrek ha riferito che Ultium Cells, la joint venture di GM con LG Energy Solution, produrrà in serie celle prismatiche LMR nello stabilimento di Spring Hill, in Tennessee, rivendicando una densità energetica superiore del 33% rispetto alle LFP a costi comparabili. Kurt Kelty di GM ha detto che la chimica permette all'azienda di "scavalcare le chimiche più economiche di oggi". Gli aggiornamenti partono più avanti quest'anno e dovrebbero concludersi nel 2028, con 500 posti di lavoro in più.
Quanto costa davvero l'inferenza per task
Il 29 settembre Artificial Analysis ha pubblicato una recensione di Claude Sonnet 5.5 di Anthropic, misurato su una build pre-release. Ha ottenuto 56 sull'Artificial Analysis Intelligence Index, due punti dietro Opus 5.5 (max), usando circa 193.000 token di output per task dell'indice, circa il 60% in più di Opus 5.5 o Sonnet 5 e all'incirca 7 volte GPT-6 Astra. Ai prezzi di Anthropic di 2 dollari per milione di token in input e 10 dollari per milione in output, si arriva a 7,60 dollari per task, circa il 50% in più del costo per task di Sonnet 5.
È la tensione che gli operatori stanno prezzando. Il 29 settembre Unblocked ha descritto un router adattivo che sposta il traffico tra Baseten, Fireworks e CoreWeave, tutti con GLM 5.2. Ha rilevato che i prezzi di listino di CoreWeave sono circa il 45% più bassi di quelli di Baseten, ma afferma di non avere dati di produzione sull'affidabilità di CoreWeave, quindi inizialmente non poteva collocare il fornitore in un ordine fisso. Il router misura costo e velocità per task, non per chiamata al modello.
Sotto il livello di routing, anche l'infrastruttura di streaming viene ricalcolata. Il 28 settembre bitdrift ha annunciato blob-stream, un'alternativa a Kafka il cui primo obiettivo dichiarato è zero traffico di rete tra zone di disponibilità, che secondo l'azienda domina i costi di Kafka nel cloud a volumi elevati. I suoi broker sono stateless, senza storage locale.
La manutenzione del database è un'altra voce. Il 29 settembre boringSQL ha misurato il nuovo REPACK (CONCURRENTLY) di PostgreSQL 19beta4. Nel suo test, VACUUM FULL ha impiegato 109 secondi e generato 17,3 GB di WAL, mentre REPACK (CONCURRENTLY) ha impiegato 107 secondi, generato 18,8 GB e usato 18,7 GB di disco extra di picco. pg_repack ha impiegato 162 secondi e generato 33,5 GB di WAL; pg_squeeze ha impiegato 165 secondi e 18,8 GB.
Chi paga la verifica
Il lavoro degli agenti crea una nuova categoria di costo. Il 29 settembre Append Only ha pubblicato un pilot di 55 giorni del suo sistema di registrazione, indicando il costo in circa 15 dollari al giorno a prezzo di listino, 829,12 dollari in totale, con 557 verifiche e 43 incidenti. Afferma che il 98% del contesto è stato servito dalla cache e che una nuova istanza aveva bisogno di 1,04 dollari per orientarsi dal solo registro. Sono i numeri del fornitore, dal suo stesso pilot, non un audit indipendente.
Twin commercializza un modello diverso: agenti illimitati con abbonamento mensile, con 257 template pubblicizzati sul suo sito il 29 settembre. Entrambi gli approcci cercano di rendere prevedibili i costi per task, un problema che diventa più difficile man mano che cresce l'uso di token per task.
Le commissioni di pagamento ricordano che i margini dell'AI stanno dentro i normali costi d'impresa. Il 29 settembre Flaviocopes ha calcolato che su 10.000 dollari al mese di vendite, distribuite su 200 ordini da 50 dollari, Stripe prende 350 dollari, Creem 470, Paddle 600, il piano gratuito di Polar e Lemon Squeezy 600 ciascuno, e Gumroad 1.450. L'autore dichiara che Creem sponsorizza il sito. L'elaborazione delle carte e lo status di merchant of record spiegano gran parte della differenza.
C'è un argomento più ampio su come si formano i prezzi. Il 29 settembre The American Prospect ha recensito il libro di Lindsay Owens Gouged, notando che il suo lavoro precedente con Groundwork Collaborative, Consumer Reports e More Perfect Union ha rilevato che circa il 75% degli articoli in carrelli Instacart identici variava di prezzo tra acquirenti nello stesso momento. La recensione dice che la critica ha spinto un'indagine della FTC e che Instacart in seguito ha preso le distanze dalla tecnologia.
Altri due pezzi del dossier indicano come il mercato del compute venga riprezzato. Il dataset pubblico di Captain ACAB sugli accordi con le forze dell'ordine elenca un risarcimento per morte ingiusta di 36.000.000 di dollari approvato nella contea di Alameda il 2026-05-12 e un risarcimento per morte ingiusta di 8.150.000 di dollari nella contea di Orange il 2026-05-19, a ricordare che i costi pubblici spesso stanno lontani dalla tecnologia che li produce. Il saggio del 29 settembre di Pedro Santa Clara sull'asset pricing nota che la storia canonica del settore è stata messa insieme negli anni Sessanta da persone che avevano bisogno di una discendenza, un monito a non leggere le storie odierne di capex AI come aritmetica consolidata.
La domanda di breve periodo non è se il compute per l'AI sia caro. È se l'offerta di memoria, il routing e i costi di verifica scenderanno abbastanza in fretta da contare prima che arrivi il prossimo giro di impegni.
Fonti
15- 01Anthropic's IPO prospectus shows AI vision, surging costsEN
- 02Anthropic IPO prospectus reveals surging costs, $42B 2025 net lossEN
- 03New Apple CEO John Ternus is reportedly planning layoffs as memory chip costs riseEN
- 04MaxLinear claims new 'Puma 9' DOCSIS chip is a big cost-cutterEN
- 05GM's new EV battery tech will cut costs without sacrificing performance or rangeEN
- 06Sonnet 5.5 has the heaviest token use we've measured; pricing matches GPT-6 SolEN
- 07Routing LLM traffic across inference providers with TCP-style congestion controlEN
- 08Blob-stream: a Kafka alternative for no fuss, low cost high volume streamingEN
- 09Radim Marek: What REPACK (CONCURRENTLY) costs while it runsEN
- 10The Record Does Not Change: what a verifiable record of AI-agent work costsEN
- 11Twin: Unlimited agents, monthly subscription pricingEN
- 12What $10k a month in sales costs you on each payment providerEN
- 13The End of a Fair Price: Dynamic Pricing and the Normalization of GougingEN
- 14Captain ACAB: collectively tracking the hidden costs of law enforcementEN
- 15What I Learned About Asset PricingEN
Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.
I contenuti sono stati preparati dalla redazione con il supporto dell'IA.
Commenti
0- Nessun commento — sii il primo.