Il 10 settembre 2026 DeepSeek ha rilasciato DeepSeek-V4.1-Flash, un modello Mixture-of-Experts multimodale da 552 miliardi di parametri. Ne attiva 8 miliardi per token in ingresso e 16 miliardi in uscita. È un cambio di architettura, non solo di scala.
IA e modelli26 settembre 20265 min di letturaFonti 3
La scheda del modello indica 890 byte di cache per token, circa quattro volte meno di V4-Flash, e un fabbisogno di HBM pari a un quarto della generazione precedente.
IA e modelli26 settembre 20265 min di letturaFonti 4
Secondo l'annuncio della Cyberspace Administration of China, al 31 agosto 2026 sono 1112 i servizi di intelligenza artificiale generativa che hanno completato la registrazione. Alla settimana della sicurezza informatica è stato presentato il quadro di governance della sicurezza dell'IA 3.0.
IA e modelli25 settembre 20266 min di letturaFonti 3
Nella tabella della scheda del modello V4.1-Flash arriva a 90,6 punti su Terminal-Bench 2.1 e 74,2 su DeepSWE v1.1, un risultato in linea o sopra Opus-5.0, GPT-5.6 Sol, K3 e GLM-5.3.
IA e modelli25 settembre 20267 min di letturaFonti 2
Secondo Reuters e The Information, DeepSeek ha incaricato CITIC Securities di preparare la quotazione allo STAR Market e porta avanti un secondo round di finanziamenti con un obiettivo di 50 miliardi di yuan; il fatturato annualizzato avrebbe superato 1 miliardo di dollari.
IA e modelli24 settembre 20265 min di letturaFonti 3
All'AICC 2026 il rapporto IDC divide il deficit di calcolo in due voci, tetto di capacità e scala produttiva: entro il 2030 il divario assoluto potrebbe arrivare a 380,9 miliardi di dollari. Accumulare schede non basta più a coprire i carichi diversi di Prefill e Decode.
IA e modelli23 settembre 20267 min di letturaFonti 2