Chip IA: Alibaba presenta lo Zhenwu V900 e apre di più la pila software SAIL
Alla Yunqi Conference il CEO di Alibaba ha presentato lo Zhenwu V900 come il chip IA più potente della Cina, tre volte più veloce dell'M890. Il giorno dopo la controllata T-Head ha ampliato l'apertura della sua pila software SAIL.

La corsa ai chip per l'IA si gioca ormai tanto sul software quanto sul silicio. È il messaggio che Alibaba ha portato alla Yunqi Conference, riferisce il media cinese 量子位 (QbitAI). Il 22 settembre il CEO del gruppo, Wu Yongming, ha presentato il nuovo chip Zhenwu V900 e lo ha definito «il chip IA più performante della Cina». Le prestazioni sono tre volte superiori a quelle dell'M890.
Il software, la parte sommersa dell'iceberg
Un processore, però, vale per quello che ci si può far girare sopra. Il giorno dopo, il 23 settembre, la controllata per i semiconduttori T-Head ha pubblicato nuovi progressi sull'apertura della sua pila software T-Head SAIL. L'azienda ha ampliato gli adattamenti dei framework, le librerie di accelerazione, la catena di strumenti e le librerie di comunicazione.
L'immagine usata dall'azienda è chiara: il chip IA è il motore, la pila software è il cambio, la trasmissione e il sistema di guida. Per quanto performante sia il motore, il risultato dipende dalla capacità del software di far migrare, eseguire e ottimizzare i modelli.
650 clienti e casi d'uso industriali
Secondo i dati presentati, i chip IA Zhenwu servono già più di 650 clienti in oltre venti settori. Aziende come Ant Group, Xiaohongshu o la casa automobilistica Xpeng usano T-Head SAIL. Xiaohongshu ha persino sviluppato, partendo dal codice aperto di SAIL, un agente incaricato della migrazione dei modelli e dell'ottimizzazione degli operatori, per accelerare il rilascio dei suoi modelli di raccomandazione generativi.
Il contesto di questa apertura risale al salone WAIC di luglio, dove T-Head aveva annunciato il passaggio di SAIL all'open source, con kit di sviluppo, driver, strumenti di analisi delle prestazioni e documentazione tecnica. Due mesi dopo, i progetti aperti includono l'adattamento del framework al modello PyTorch, lo strumento di migrazione del codice sorgente, uno strumento di sviluppo di operatori ispirato a Triton e progetti di accelerazione del calcolo.
Ridurre il costo di migrazione
La preoccupazione centrale dei clienti è riassunta da un responsabile dell'ecosistema software di T-Head: «la richiesta più forte, dal punto di vista del business, è il costo di migrazione». Molte aziende fanno girare i loro software da anni. Cambiare chip significa rivalutare questo patrimonio senza interrompere l'attività. Fornire strumenti di migrazione serve proprio a preservare quel patrimonio.
Il secondo punto è la performance dopo la migrazione. Se l'efficienza scende al 30 o al 40% dell'originale, il passaggio diventa difficilmente accettabile. Da qui la pubblicazione dei progetti di accelerazione, che permettono ai team di business di capire l'implementazione e ottimizzare da soli. Il terzo punto è la rapidità di adattamento dei nuovi modelli, con l'obiettivo della disponibilità dal giorno del lancio.
Sul fronte delle risorse, T-Head dichiara di proporre sulla piattaforma ModelScope 39 modelli quantizzati, che coprono in particolare le serie Qwen, DeepSeek e Kimi, con più di 348 000 download cumulati a fine settembre 2026. Tra gli utenti, Xpeng ha migrato l'addestramento dei suoi modelli di guida intelligente da una piattaforma GPU a un cluster cloud Zhenwu. Ant Group ha realizzato l'adattamento dell'inferenza dei suoi principali modelli sui chip Zhenwu 810E e M890.
La produzione di chip da parte dei grandi gruppi passa da una logica di consegna a una logica di co-costruzione aperta.
Fonti
2- 01量子位 (QbitAI) : 亮出「中国最强AI芯片」还不够,平头哥又甩出一手开源ZH
- 02ModelScope : plateforme de modèles ouverts (ressources adaptées par T-Head)ZH
Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.
I contenuti sono stati preparati dalla redazione con il supporto dell'IA.
Commenti
0- Nessun commento — sii il primo.