Opus 5.5 e GPT-6 Sol: la guerra dei modelli si sposta sul listino
Anthropic taglia del 20 per cento il prezzo di Opus 5.5 e del 60 per cento le letture della cache. OpenAI risponde con Sol e Luna. DeepSeek riduce i prezzi di Flash in Cina.

I nuovi modelli di Anthropic e OpenAI non portano un salto di capacità. Portano tagli di prezzo, ed è qui che si combatte adesso la concorrenza. Opus 5.5 è l'ultima versione del modello principale di Anthropic per la programmazione e il lavoro complesso sulla conoscenza. Costa 4 dollari per milione di token in ingresso e 20 dollari per milione di token in uscita, il 20 per cento in meno rispetto a Opus 5. Le letture della cache, che nel lavoro degli agenti e nella programmazione fanno la maggior parte dei costi, scendono a 0,20 dollari per milione di token, con un calo del 60 per cento. Il modello genera le risposte anche oltre il 30 per cento più velocemente.
Anthropic sostiene che con i compiti tipici e le impostazioni predefinite il risparmio arriva al 40 per cento, perché il modello consuma meno token per svolgere lo stesso compito. C'è una riserva, però, per le aree ad alto rischio come la cybersicurezza e la biologia: le richieste che arrivano da questi ambiti possono essere indirizzate automaticamente a un modello più vecchio.
OpenAI risponde con GPT-6 Sol e Luna, varianti più leggere della famiglia GPT-6. Sol dovrebbe essere lo strumento quotidiano per i compiti che richiedono una qualità decorosa a un costo inferiore, Luna la variante ancora più economica e più piccola. Le aziende non corrono solo l'una contro l'altra, ma anche contro i modelli aperti. Gli imprenditori ricorrono sempre più spesso ai router di modelli per usare di rado i costosi modelli di frontiera.
In Cina lo stesso meccanismo si vede nel listino di DeepSeek. Dal 10 settembre, dalle ore 12 ora di Pechino, il modello flash viene servito con nuove tariffe. L'ingresso con esito positivo nella cache scende nelle ore non di punta da 0,05 a 0,02 yuan per milione di token, cioè del 60 per cento. L'ingresso senza esito positivo passa da 1,5 a 1 yuan, un terzo in meno. L'uscita da 4,5 a 4 yuan, circa l'11 per cento in meno. Le tariffe nelle ore di punta sono il doppio di quelle non di punta.
Il taglio è tanto più significativo se si pensa che ancora il 17 agosto DeepSeek aveva introdotto le tariffe di punta e aveva alzato il prezzo di uscita da 2 yuan a 4,5 yuan nelle ore non di punta e a 9 yuan nelle ore di punta, con un aumento del 125 per cento e del 350 per cento. Poco più di un mese dopo l'azienda si è accorta che i prezzi si potevano tagliare senza perdere ricavi. Il 19 settembre ha poi precisato che i fine settimana e i giorni festivi in Cina sono conteggiati per l'intera giornata con le tariffe non di punta. Per molti team questo significa un conto ancora più basso.
Per chi acquista, però, la cosa più importante non è il livello delle tariffe, ma la direzione in cui cambiano. Il taglio dei prezzi dei modelli di fascia più alta cambia i conti non solo nei laboratori, ma anche per tutti coloro che ci costruiscono sopra i propri prodotti: quello che un anno fa era un esperimento, oggi rientra nel budget di un piccolo team. La guerra dei prezzi non significa però che i modelli diventino più economici all'infinito: i fornitori spostano i costi sulle versioni più deboli e sulle condizioni di punta. Chi riesce a spostare il carico sulla finestra non di punta paga oggi meno di quanto chiunque pagasse un anno fa per un volume comparabile.
Fonti
3- 01New Anthropic, OpenAI models: a little more for a lot lessEN
- 02DeepSeek 官宣明日 flash 系列 AI 模型降价ZH
- 03DeepSeek:调休上班的周末、法定节假日全天均按空闲时段计费ZH
Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.
I contenuti sono stati preparati dalla redazione con il supporto dell'IA.
Commenti
0- Nessun commento — sii il primo.