Alibaba presenta il suo chip AI più potente e apre lo stack software
Al Yunqi Conference il gruppo cinese ha annunciato il chip Zhenwu V900, indicato come il più potente acceleratore AI cinese; il giorno dopo T-Head ha pubblicato in open source i componenti del proprio stack software SAIL.

Il 22 settembre, alla Yunqi Conference di Hangzhou, l'amministratore delegato di Alibaba Wu Yongming ha presentato il nuovo acceleratore 真武 V900, presentato come il chip AI cinese più potente per prestazioni, con un vantaggio dichiarato di tre volte rispetto al modello M890 della generazione precedente. A distanza di un giorno, la controllata T-Head ha pubblicato i progressi open source dello stack software che lo accompagna.
Che cosa è stato aperto
Il pacchetto, denominato T-Head SAIL, comprende l'adattamento dei framework di calcolo, le librerie di accelerazione, la toolchain e le librerie di comunicazione. Nella pubblicazione compaiono i componenti PyTorch-for-sail, sailify, Triton-for-sail, DeepGEMM-for-sail e FlashAttention-for-sail, con PCCL e DeepEP-for-sail annunciati come in arrivo. La scelta di aprire gli strumenti e non solo il silicio ha una funzione precisa: rendere il chip adottabile senza riscrivere i modelli già esistenti.
L'adozione dichiarata supera i 650 clienti in più di 20 settori, tra cui Ant, Xiaohongshu e l'azienda automobilistica XPeng. Xiaohongshu, in particolare, ha sviluppato agenti capaci di gestire la migrazione dei carichi e l'ottimizzazione degli operatori. Sul catalogo ModelScope sono disponibili 39 modelli quantizzati — tra cui Qwen, DeepSeek e Kimi — con oltre 348.000 download a settembre 2026, a conferma che il vantaggio competitivo si gioca tanto sulla comunità di sviluppatori quanto sulle prestazioni.
Il calcolo resta scarso
Sullo sfondo c'è un problema di offerta. Il rapporto congiunto presentato da Inspur all'AICC 2026 con IDC stima che il tasso di copertura della domanda globale di capacità di calcolo per l'AI scenderà dal 79% del 2024 al 71% atteso nel 2027, risalendo al 77% nel 2030. Il divario assoluto è valutato in 380,9 miliardi di dollari al 2030, quasi dieci volte il valore del 2024, mentre il consumo globale di token è previsto crescere a un tasso annuo composto del 4.822,6% fino alla fine del decennio, con circa 4.000 trilioni di attività di inferenza all'anno.
Alla stessa conferenza Inspur ha presentato il sistema 元脑 SD200 Ultra, che porta la configurazione da 64 a 128 chip con memoria e storage di espansione fino a 8 e 64 terabyte, insieme alla piattaforma HC2000. È la fotografia di una competizione che si sta spostando dal singolo processore al sistema: chi integra silicio, software e scala di distribuzione riduce il rischio di restare fuori dal mercato.
Fonti
2- 01量子位 — 阿里真武 V900 发布, T-Head SAIL 开源 (Yunqi Conference, Apsara 2026)ZH
- 02量子位 — 浪潮 AICC 2026 与 IDC 《2026 中国人工智能计算力发展评估报告》ZH
Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.
I contenuti sono stati preparati dalla redazione con il supporto dell'IA.
Commenti
0- Nessun commento — sii il primo.