Vai al contenuto
Ora nel mondoEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portale su IA e tecnologiaeventi · analisi · interviste · approfondimenti tecnici

Cerca
LIVE
›

Chip IA: Alibaba presenta lo Zhenwu V900 e apre di più la pila software SAIL

Alla Yunqi Conference il CEO di Alibaba ha presentato lo Zhenwu V900 come il chip IA più potente della Cina, tre volte più veloce dell'M890. Il giorno dopo la controllata T-Head ha ampliato l'apertura della sua pila software SAIL.

TecnologiaNotiziaChiara RomanoPubblicato: 25 settembre 20266 min di letturaFonti 2
Chip IA: Alibaba presenta lo Zhenwu V900 e apre di più la pila software SAIL

La corsa ai chip per l'IA si gioca ormai tanto sul software quanto sul silicio. È il messaggio che Alibaba ha portato alla Yunqi Conference, riferisce il media cinese 量子位 (QbitAI). Il 22 settembre il CEO del gruppo, Wu Yongming, ha presentato il nuovo chip Zhenwu V900 e lo ha definito «il chip IA più performante della Cina». Le prestazioni sono tre volte superiori a quelle dell'M890.

Il software, la parte sommersa dell'iceberg

Un processore, però, vale per quello che ci si può far girare sopra. Il giorno dopo, il 23 settembre, la controllata per i semiconduttori T-Head ha pubblicato nuovi progressi sull'apertura della sua pila software T-Head SAIL. L'azienda ha ampliato gli adattamenti dei framework, le librerie di accelerazione, la catena di strumenti e le librerie di comunicazione.

L'immagine usata dall'azienda è chiara: il chip IA è il motore, la pila software è il cambio, la trasmissione e il sistema di guida. Per quanto performante sia il motore, il risultato dipende dalla capacità del software di far migrare, eseguire e ottimizzare i modelli.

650 clienti e casi d'uso industriali

Secondo i dati presentati, i chip IA Zhenwu servono già più di 650 clienti in oltre venti settori. Aziende come Ant Group, Xiaohongshu o la casa automobilistica Xpeng usano T-Head SAIL. Xiaohongshu ha persino sviluppato, partendo dal codice aperto di SAIL, un agente incaricato della migrazione dei modelli e dell'ottimizzazione degli operatori, per accelerare il rilascio dei suoi modelli di raccomandazione generativi.

Il contesto di questa apertura risale al salone WAIC di luglio, dove T-Head aveva annunciato il passaggio di SAIL all'open source, con kit di sviluppo, driver, strumenti di analisi delle prestazioni e documentazione tecnica. Due mesi dopo, i progetti aperti includono l'adattamento del framework al modello PyTorch, lo strumento di migrazione del codice sorgente, uno strumento di sviluppo di operatori ispirato a Triton e progetti di accelerazione del calcolo.

Ridurre il costo di migrazione

La preoccupazione centrale dei clienti è riassunta da un responsabile dell'ecosistema software di T-Head: «la richiesta più forte, dal punto di vista del business, è il costo di migrazione». Molte aziende fanno girare i loro software da anni. Cambiare chip significa rivalutare questo patrimonio senza interrompere l'attività. Fornire strumenti di migrazione serve proprio a preservare quel patrimonio.

Il secondo punto è la performance dopo la migrazione. Se l'efficienza scende al 30 o al 40% dell'originale, il passaggio diventa difficilmente accettabile. Da qui la pubblicazione dei progetti di accelerazione, che permettono ai team di business di capire l'implementazione e ottimizzare da soli. Il terzo punto è la rapidità di adattamento dei nuovi modelli, con l'obiettivo della disponibilità dal giorno del lancio.

Sul fronte delle risorse, T-Head dichiara di proporre sulla piattaforma ModelScope 39 modelli quantizzati, che coprono in particolare le serie Qwen, DeepSeek e Kimi, con più di 348 000 download cumulati a fine settembre 2026. Tra gli utenti, Xpeng ha migrato l'addestramento dei suoi modelli di guida intelligente da una piattaforma GPU a un cluster cloud Zhenwu. Ant Group ha realizzato l'adattamento dell'inferenza dei suoi principali modelli sui chip Zhenwu 810E e M890.

La produzione di chip da parte dei grandi gruppi passa da una logica di consegna a una logica di co-costruzione aperta.

Commenti 0

Fonti

2
  1. 01量子位 (QbitAI) : 亮出「中国最强AI芯片」还不够,平头哥又甩出一手开源ZH
  2. 02ModelScope : plateforme de modèles ouverts (ressources adaptées par T-Head)ZH

Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.

I contenuti sono stati preparati dalla redazione con il supporto dell'IA.

Chiara Romano

Chiara Romano

IA, modelli e tecnologie

Chiara Romano scrive di tecnologia, IA e modelli, media e internet per FLASH24, partendo da documentazione tecnica, repository e specifiche invece che da comunicati stampa. Per ogni modello o piattaforma che segue controlla versioni, licenze, parametri e benchmark, e verifica i numeri confrontandoli con i dati originali o con test indipendenti. Confronta le schede tecniche tra fornitori, parla con sviluppatori e amministratori di sistema, e tiene d'occhio le finestre di rilascio e le modifiche ai termini d'uso. Fuori dalla redazione gestisce self-hosting e reti domestiche, esperienza che le serve per capire come funzionano davvero i servizi che racconta. Non pubblica una notizia se la fonte primaria non è verificabile.

Redazione →

Commenti

0
  1. Nessun commento — sii il primo.

Scrivi un commento

I commenti sono pubblici. Non pubblichiamo insulti, spam né pubblicità.