Alibaba presenta il chip Zhenwu V900 e apre lo stack T-Head SAIL
Il 22 settembre alla conferenza Yunqi Alibaba ha annunciato un chip che presenta come il più potente della Cina. Il giorno dopo T-Head ha allargato l'open source con strumenti di migrazione e librerie di accelerazione.

I giganti cinesi del cloud passano dalla fase "forniamo chip" a quella "costruiamo insieme un ecosistema intorno ai chip". È la lettura del portale qbitai, che ha seguito l'intervento dell'amministratore delegato del gruppo Alibaba, Wu Yongming, alla conferenza Yunqi del 22 settembre. Presentando il nuovo chip AI Zhenwu V900, Wu lo ha definito il processore di calcolo più potente della Cina. Sarà tre volte più efficiente del precedente M890, ha detto.
Il giorno dopo la società T-Head ha annunciato un altro passo nell'apertura dello stack software T-Head SAIL, l'equivalente di CUDA per i chip Zhenwu. Nell'open source sono entrati tra l'altro l'adattamento PyTorch-for-sail, lo strumento di migrazione del codice sailify, l'ambiente per scrivere operatori Triton-for-sail e le librerie DeepGEMM-for-sail e FlashAttention-for-sail. I primi elementi erano stati resi noti a luglio alla fiera WAIC, con la pubblicazione di SDK, driver e strumenti per l'analisi delle prestazioni e il debug.
Il problema che deve risolvere
Chi ha spostato una produzione su un'altra piattaforma hardware conosce bene l'argomento: la voce che pesa di più è il costo di migrazione. Il direttore senior Lu Shenghua di T-Head diceva apertamente che i clienti chiedono soprattutto quanto codice dovranno riscrivere. Il secondo problema compare dopo l'avvio del modello. Se dopo il cambio di hardware le prestazioni scendono al 30-40 per cento delle precedenti, nessuno accetta una migrazione del genere. Il terzo è il ritmo. I modelli escono ogni poche settimane e i clienti si aspettano di poterli avviare almeno il giorno del debutto.
L'apertura del codice delle librerie di accelerazione cambia gli equilibri anche per un altro motivo. Un cliente che vuole scrivere operatori propri a volte deve rivelare al fornitore del chip i dettagli del proprio algoritmo, e non vuole farlo. L'accesso all'architettura e al codice permette di lavorare in casa propria, dentro l'azienda. T-Head descrive anche il processo di invio delle modifiche: proposta, modifica del codice, test automatici e revisione da parte dei manutentori, poi il rilascio. Secondo l'azienda i primi contributi sono arrivati sia dall'interno di Alibaba sia da clienti esterni.
Chi lo usa già
Secondo i dati presentati all'intervento, i chip Zhenwu servono oltre 650 clienti in più di 20 settori. Ant Group ha completato l'adattamento dei modelli più importanti per l'inferenza sui chip Zhenwu 810E e M890 e lavora sulla quantizzazione e sul parallelismo degli esperti. XPeng ha spostato sul cluster Zhenwu l'addestramento dei modelli per la guida autonoma e usa gli strumenti di profilazione per cercare i colli di bottiglia. Xiaohongshu è andata oltre e sulla base del codice aperto SAIL ha costruito un proprio agente per la migrazione e l'ottimizzazione degli operatori, accelerando il rilascio dei modelli di raccomandazione generativa.
Un'aggiunta all'ecosistema è il catalogo dei modelli: entro settembre 2026 sulla piattaforma ModelScope sono stati resi disponibili 39 modelli quantizzati, che coprono le famiglie Qwen, DeepSeek e Kimi, scaricati complessivamente più di 348 mila volte. La storia della linea di prodotto mostra la direzione: dal chip Hanguang 800 del 2019, allo Yitian 710 del 2021, fino all'attuale serie Zhenwu. La pressione verso l'apertura non è altruismo: senza codice portabile i clienti stranieri e nazionali non hanno motivo di cambiare piattaforma.
Fonti
2Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.
I contenuti sono stati preparati dalla redazione con il supporto dell'IA.
Commenti
0- Nessun commento — sii il primo.