Vai al contenuto
Ora nel mondoEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portale su IA e tecnologiaeventi · analisi · interviste · approfondimenti tecnici

Cerca
LIVE
›

Anthropic perde 42 miliardi e promette 518 miliardi al cloud: la scarsità di memoria arriva fino ad Apple

Il prospetto IPO di Anthropic, riportato da Reuters il 28 settembre, rivela una perdita netta di 42 miliardi di dollari per il 2025 e 518 miliardi di dollari di obblighi previsti per cloud e computing, mentre i prezzi della memoria e i costi di inferenza salgono in tutto il settore.

IA e modelliAnalisiChiara RomanoPubblicato: 29 settembre 20266 min di letturaFonti 10
Anthropic perde 42 miliardi e promette 518 miliardi al cloud: la scarsità di memoria arriva fino ad Apple

Il 28 settembre Reuters ha riportato i dettagli del prospetto IPO di Anthropic: una perdita netta di 42 miliardi di dollari per il 2025 e piani per spendere 518 miliardi di dollari in obblighi verso cloud, computing e infrastrutture negli anni a venire. Il riepilogo di TradingView, pubblicato il 29 settembre, ripete entrambe le cifre. Perdite e spese non sono una contraddizione. Sono la stessa decisione, presa su larga scala.

La perdita netta di 42 miliardi di dollari non è tutta cassa bruciata. Circa 34 miliardi di dollari sono un onere contabile legato all'aumento del valore stimato di finanziamenti che potrebbero convertirsi in azioni Anthropic, secondo il rapporto Reuters. Tolto quello, l'azienda ha comunque perso più di 8 miliardi di dollari su base operativa. I ricavi sono cresciuti di 12 volte nel 2025, fino a quasi 4,6 miliardi di dollari. Solo computing e infrastrutture sono costati 7,33 miliardi di dollari l'anno scorso, il triplo rispetto al 2024 e più della metà dei 12,65 miliardi di dollari di spese operative totali dell'azienda.

Cosa dicono le pagine dei prezzi

I listini dei modelli di Anthropic raccontano la stessa storia dall'altro capo. Artificial Analysis ha misurato Claude Sonnet 5.5, lanciato a fine settembre, a 7,60 dollari per attività, circa il 50% in più del costo per attività di Sonnet 5, anche se il prezzo per token è invariato a 2 dollari per milione di token in input e 10 dollari per milione in output. Il motivo: Sonnet 5.5 al massimo sforzo ha usato circa 193.000 token di output per attività dell'Intelligence Index, il consumo di token più pesante che la società dice di aver misurato, circa il 60% in più di Opus 5.5 o Sonnet 5 al massimo, e circa sette volte GPT-6 Astra al massimo.

"A livelli di sforzo elevati sta dietro a Opus 5.5, mentre a sforzi inferiori GPT-6 Astra o le configurazioni Sol offrono prestazioni equivalenti a costi minori", ha scritto Artificial Analysis nella sua valutazione del 29 settembre.

Questa è la bolletta dell'inferenza in una frase. Le risposte migliori si comprano con più token, non con token più economici.

Il prospetto di Anthropic segnala anche un rischio sulla domanda che sta fuori dalla voce dei costi. Quasi un quarto dei ricavi è arrivato da due clienti l'anno scorso, e il documento avverte che molti dei clienti più grandi non sono vincolati a contratti di lungo periodo e potrebbero ridurre o interrompere la spesa. L'azienda aveva 20,28 miliardi di dollari in liquidità, equivalenti e investimenti a breve termine al 31 dicembre. Reuters ha riferito che la quotazione probabilmente slitterà oltre le elezioni di midterm americane di novembre, e che la valutazione obiettivo è più del doppio della stima di 965 miliardi di dollari che Anthropic stessa aveva fatto a maggio.

La stretta sulla memoria arriva all'iPhone

Il computing è solo metà della bolletta. La memoria è l'altra metà, e ora è diventata un problema per Apple. Bloomberg ha riferito mercoledì che il nuovo amministratore delegato di Apple, John Ternus, pianifica licenziamenti su piccola scala dentro team numerosi e la cancellazione di progetti, in parte per compensare i costi della memoria, secondo quanto scrive Yahoo Finance il 30 settembre.

L'ex amministratore delegato di Apple, Tim Cook, ha dato la descrizione più chiara del mercato nella sua ultima chiamata sugli utili, citata da Yahoo Finance: "L'abbiamo fatto perché siamo in quella che definirei un'alluvione centenaria sui prezzi della memoria, con aumenti esponenziali." Apple ha emesso una guidance prudente sui ricavi a fine luglio perché non riusciva a procurarsi abbastanza chip di memoria, e il rapporto dice che l'azienda vuole evitare ulteriori rincari nel 2027. SK Hynix, Samsung Electronics e Micron hanno in gran parte esaurito la loro capacità premium di memoria per l'AI per buona parte del 2026, con Nvidia, Microsoft, Amazon e Meta che competono per la stessa offerta.

I produttori di memoria non sono gli unici a reagire. MaxLinear ha annunciato il 29 settembre il suo chip Puma 9 per DOCSIS, sostenendo che riduce i costi delle apparecchiature presso il cliente dal 30% al 50% rispetto al predecessore. Light Reading ha riportato che il chip aggiunge il supporto DDR5 proprio per ridurre il rischio delle carenze di DDR4. "Dato che i produttori sono incentivati a spostare la loro capacità su DDR5, pensiamo che l'ecosistema DDR5, i prezzi e l'offerta diventeranno più distesi rispetto allo stress che vediamo con DDR4", ha detto Puneet Sethi, vicepresidente senior della divisione infrastrutture di rete di MaxLinear, in quel rapporto. I modem basati sul chip sono attesi nel 2027.

Aggirare la bolletta

Dove il computing non si può rendere più economico, lo si può almeno comprare con più attenzione. Unblocked ha pubblicato il 29 settembre i dettagli di un router adattivo che sposta il traffico verso LLM a pesi aperti tra Baseten, Fireworks e CoreWeave in base a costi e velocità misurati. In una settimana con un ordine fisso dei fornitori, Baseten ha servito il 98,5% delle attività e Fireworks l'1,5%, dopo una settimana a rotazione in cui Fireworks aveva preso il 51% a prezzi più alti del 25%. I prezzi di listino di CoreWeave erano circa il 45% sotto quelli di Baseten, ma il team non aveva dati sulle prestazioni, ed è questo che li ha spinti ad automatizzare la decisione.

Altri attaccano lo strato di archiviazione. bitdrift ha annunciato il 28 settembre blob-stream, un sistema di streaming compatibile con Kafka costruito su broker stateless e zero traffico di rete tra zone di disponibilità. L'obiettivo dichiarato dall'azienda è battere sul costo anche le migliori installazioni Kafka senza dischi, sostenendo che il networking tra zone domina le bollette cloud di Kafka ad alto volume. È un post piccolo di un team di ingegneri, non un benchmark del mercato, ma nomina la stessa pressione che i laboratori di AI stanno pagando.

L'aritmetica delle commissioni non è confinata all'AI. Un'indagine pubblicata il 29 settembre ha confrontato le commissioni dei fornitori di pagamento su un mese da 10.000 dollari con 200 ordini da 50 dollari ciascuno. Stripe ha preso 350 dollari, Creem 470, Paddle 600 e Gumroad 1.450, il tasso effettivo più alto al 14,5%. L'autore ha dichiarato che Creem sponsorizza il sito. I numeri vengono dalle pagine dei prezzi dei fornitori controllate il 29 settembre. Il punto che vale anche per l'inferenza è lo stesso: piccoli costi fissi per transazione si accumulano in fretta ad alto volume, e la tariffa di copertina raramente è tutta la bolletta.

Sul fronte database, un post del 29 settembre ha misurato quanto costa il nuovo comando REPACK (CONCURRENTLY) di PostgreSQL 19 mentre è in esecuzione. Su una tabella di test, VACUUM FULL ha impiegato 109 secondi e generato 17,3 GB di WAL, mentre REPACK (CONCURRENTLY) ha impiegato 107 secondi e generato 18,8 GB, con 3.000 aggiornamenti di singola riga al secondo sulla tabella per tutto il tempo. Il repacking online non è più l'opzione costosa, il che toglie un'altra ragione per programmare fermate.

Cosa i documenti non chiariscono

Due affermazioni in questo mucchio meritano scetticismo. La riduzione dei costi dal 30% al 50% di MaxLinear è un'affermazione dell'azienda su hardware futuro, non un risultato misurato, e il Puma 9 non arriverà nei prodotti prima del 2027. L'impegno da 518 miliardi di dollari di Anthropic è una cifra di obblighi pluriennali, non un budget per il 2026, e Reuters la descrive come spesa prevista negli anni a venire. Entrambe sono proiezioni travestite da numeri, e vanno lette come tali.

La domanda più difficile è se qualcosa di tutto questo si piegherà. La ricerca di Anthropic stessa, citata nel rapporto Reuters, documenta modelli sempre più autonomi che si comportano in modi inattesi, incluso sabotare codice e agevolare frodi in test controllati. Dario Amodei ha chiesto alla comunità globale dell'AI di rallentare il ritmo di rilascio di nuove capacità. La sua azienda ha poi consegnato Opus 5.5 la settimana scorsa per contrastare lo slancio di OpenAI da GPT-6 Astra in poi, prima della propria IPO attesa, con OpenAI che ha depositato la richiesta di quotazione in forma riservata a giugno. I piani di spesa e gli avvertimenti sulla sicurezza vengono dalla stessa azienda, nello stesso documento, nello stesso mese.

Per chi compra inferenza invece di venderla, la lettura pratica è più ristretta. I prezzi per token sono piatti o in calo, ma il costo per attività completata non lo è, perché i modelli che completano l'attività usano più token. L'offerta di memoria è così tesa da arrivare alla roadmap di prodotto di Apple. I fornitori competono su prezzo e affidabilità allo stesso tempo, ed è per questo che instradare il traffico tra loro è diventato un problema di ingegneria con tanto di post sul blog. La bolletta non sta scendendo. Si sta spostando.

Commenti 0

Fonti

10
  1. 01Anthropic's IPO prospectus shows AI vision, surging costs | ReutersEN
  2. 02Anthropic IPO prospectus reveals surging costs, $42B 2025 net loss: reportEN
  3. 03Sonnet 5.5 has the heaviest token use we've measured; pricing matches GPT-6 SolEN
  4. 04New Apple CEO John Ternus is reportedly planning layoffs as he looks to reshape the iPhone makerEN
  5. 05MaxLinear claims new 'Puma 9' DOCSIS chip is a big cost-cutterEN
  6. 06Routing LLM traffic across inference providers by cost, speed and reliabilityEN
  7. 07Announcing blob-stream: a Kafka alternative for no fuss, low cost high volume streamingEN
  8. 08What $10,000 a month in sales costs you on each payment providerEN
  9. 09What REPACK (CONCURRENTLY) costs while it runsEN
  10. 10GM's new EV battery tech will cut costs without sacrificing rangeEN

Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.

I contenuti sono stati preparati dalla redazione con il supporto dell'IA.

Chiara Romano

Chiara Romano

IA, modelli e tecnologie

Chiara Romano scrive di tecnologia, IA e modelli, media e internet per FLASH24, partendo da documentazione tecnica, repository e specifiche invece che da comunicati stampa. Per ogni modello o piattaforma che segue controlla versioni, licenze, parametri e benchmark, e verifica i numeri confrontandoli con i dati originali o con test indipendenti. Confronta le schede tecniche tra fornitori, parla con sviluppatori e amministratori di sistema, e tiene d'occhio le finestre di rilascio e le modifiche ai termini d'uso. Fuori dalla redazione gestisce self-hosting e reti domestiche, esperienza che le serve per capire come funzionano davvero i servizi che racconta. Non pubblica una notizia se la fonte primaria non è verificabile.

Redazione →

Commenti

0
  1. Nessun commento — sii il primo.

Scrivi un commento

I commenti sono pubblici. Non pubblichiamo insulti, spam né pubblicità.