Vai al contenuto
Ora nel mondoEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portale su IA e tecnologiaeventi · analisi · interviste · approfondimenti tecnici

Cerca
LIVE
›

Alibaba presenta il chip Zhenwu V900 e apre lo stack T-Head SAIL

Il 22 settembre alla conferenza Yunqi Alibaba ha annunciato un chip che presenta come il più potente della Cina. Il giorno dopo T-Head ha allargato l'open source con strumenti di migrazione e librerie di accelerazione.

TecnologiaNotiziaChiara RomanoPubblicato: 25 settembre 20266 min di letturaFonti 2
Alibaba presenta il chip Zhenwu V900 e apre lo stack T-Head SAIL

I giganti cinesi del cloud passano dalla fase "forniamo chip" a quella "costruiamo insieme un ecosistema intorno ai chip". È la lettura del portale qbitai, che ha seguito l'intervento dell'amministratore delegato del gruppo Alibaba, Wu Yongming, alla conferenza Yunqi del 22 settembre. Presentando il nuovo chip AI Zhenwu V900, Wu lo ha definito il processore di calcolo più potente della Cina. Sarà tre volte più efficiente del precedente M890, ha detto.

Il giorno dopo la società T-Head ha annunciato un altro passo nell'apertura dello stack software T-Head SAIL, l'equivalente di CUDA per i chip Zhenwu. Nell'open source sono entrati tra l'altro l'adattamento PyTorch-for-sail, lo strumento di migrazione del codice sailify, l'ambiente per scrivere operatori Triton-for-sail e le librerie DeepGEMM-for-sail e FlashAttention-for-sail. I primi elementi erano stati resi noti a luglio alla fiera WAIC, con la pubblicazione di SDK, driver e strumenti per l'analisi delle prestazioni e il debug.

Il problema che deve risolvere

Chi ha spostato una produzione su un'altra piattaforma hardware conosce bene l'argomento: la voce che pesa di più è il costo di migrazione. Il direttore senior Lu Shenghua di T-Head diceva apertamente che i clienti chiedono soprattutto quanto codice dovranno riscrivere. Il secondo problema compare dopo l'avvio del modello. Se dopo il cambio di hardware le prestazioni scendono al 30-40 per cento delle precedenti, nessuno accetta una migrazione del genere. Il terzo è il ritmo. I modelli escono ogni poche settimane e i clienti si aspettano di poterli avviare almeno il giorno del debutto.

L'apertura del codice delle librerie di accelerazione cambia gli equilibri anche per un altro motivo. Un cliente che vuole scrivere operatori propri a volte deve rivelare al fornitore del chip i dettagli del proprio algoritmo, e non vuole farlo. L'accesso all'architettura e al codice permette di lavorare in casa propria, dentro l'azienda. T-Head descrive anche il processo di invio delle modifiche: proposta, modifica del codice, test automatici e revisione da parte dei manutentori, poi il rilascio. Secondo l'azienda i primi contributi sono arrivati sia dall'interno di Alibaba sia da clienti esterni.

Chi lo usa già

Secondo i dati presentati all'intervento, i chip Zhenwu servono oltre 650 clienti in più di 20 settori. Ant Group ha completato l'adattamento dei modelli più importanti per l'inferenza sui chip Zhenwu 810E e M890 e lavora sulla quantizzazione e sul parallelismo degli esperti. XPeng ha spostato sul cluster Zhenwu l'addestramento dei modelli per la guida autonoma e usa gli strumenti di profilazione per cercare i colli di bottiglia. Xiaohongshu è andata oltre e sulla base del codice aperto SAIL ha costruito un proprio agente per la migrazione e l'ottimizzazione degli operatori, accelerando il rilascio dei modelli di raccomandazione generativa.

Un'aggiunta all'ecosistema è il catalogo dei modelli: entro settembre 2026 sulla piattaforma ModelScope sono stati resi disponibili 39 modelli quantizzati, che coprono le famiglie Qwen, DeepSeek e Kimi, scaricati complessivamente più di 348 mila volte. La storia della linea di prodotto mostra la direzione: dal chip Hanguang 800 del 2019, allo Yitian 710 del 2021, fino all'attuale serie Zhenwu. La pressione verso l'apertura non è altruismo: senza codice portabile i clienti stranieri e nazionali non hanno motivo di cambiare piattaforma.

Commenti 0

Fonti

2
  1. 01量子位 (qbitai): 亮出“中国最强AI芯片”还不够,平头哥又甩出一手开源ZH
  2. 02量子位 (qbitai): 国产GPU 上的推理优化实践ZH

Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.

I contenuti sono stati preparati dalla redazione con il supporto dell'IA.

Chiara Romano

Chiara Romano

IA, modelli e tecnologie

Chiara Romano scrive di tecnologia, IA e modelli, media e internet per FLASH24, partendo da documentazione tecnica, repository e specifiche invece che da comunicati stampa. Per ogni modello o piattaforma che segue controlla versioni, licenze, parametri e benchmark, e verifica i numeri confrontandoli con i dati originali o con test indipendenti. Confronta le schede tecniche tra fornitori, parla con sviluppatori e amministratori di sistema, e tiene d'occhio le finestre di rilascio e le modifiche ai termini d'uso. Fuori dalla redazione gestisce self-hosting e reti domestiche, esperienza che le serve per capire come funzionano davvero i servizi che racconta. Non pubblica una notizia se la fonte primaria non è verificabile.

Redazione →

Commenti

0
  1. Nessun commento — sii il primo.

Scrivi un commento

I commenti sono pubblici. Non pubblichiamo insulti, spam né pubblicità.