Aller au contenu
Heure mondialeEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portail sur l'IA et la technologieactualités · analyses · entretiens · fond technique

Rechercher
EN DIRECT
›

Puces IA : Alibaba dégaine sa Zhenwu V900 et ouvre plus largement sa pile logicielle SAIL

Au Yunqi Conference, le PDG d'Alibaba a présenté la Zhenwu V900 comme la puce IA la plus puissante de Chine, trois fois plus rapide que la M890. Le lendemain, la filiale T-Head élargissait l'ouverture de sa pile logicielle SAIL.

TechnologieActualitéCamille RousseauPublié le: 25 septembre 20266 min de lectureSources 2
Puces IA : Alibaba dégaine sa Zhenwu V900 et ouvre plus largement sa pile logicielle SAIL

La course aux puces d'IA se joue désormais autant sur le logiciel que sur le silicium. C'est le message qu'Alibaba a porté lors de son Yunqi Conference, rapporte le média chinois 量子位 (QbitAI). Le 22 septembre, le PDG du groupe, Wu Yongming, a présenté la nouvelle puce Zhenwu V900. Il l'a qualifiée de « puce d'IA la plus performante de Chine », avec des performances trois fois supérieures à celles de la M890.

Le logiciel, partie immergée de l'iceberg

Mais un processeur ne vaut que par ce qu'on peut faire tourner dessus. Le lendemain, 23 septembre, la filiale semi-conducteurs T-Head a présenté de nouvelles avancées dans l'ouverture de sa pile logicielle T-Head SAIL. Elle élargit les adaptations de frameworks, les bibliothèques d'accélération, la chaîne d'outils et les bibliothèques de communication.

L'image employée par l'entreprise est parlante : la puce d'IA est le moteur, la pile logicielle est la boîte de vitesses, la transmission et le système de conduite. Le moteur a beau être performant, tout dépend ensuite de la capacité du logiciel à faire migrer, exécuter et optimiser les modèles.

650 clients et des cas d'usage industriels

Selon les chiffres présentés, les puces d'IA Zhenwu servent déjà plus de 650 clients dans plus de vingt secteurs. Des entreprises comme Ant Group, Xiaohongshu ou le constructeur automobile Xpeng utilisent T-Head SAIL. Xiaohongshu a même développé, à partir du code ouvert de SAIL, un agent chargé de la migration des modèles et de l'optimisation des opérateurs, pour déployer plus vite ses modèles de recommandation génératifs.

Le contexte de cette ouverture remonte au salon WAIC de juillet, où T-Head avait annoncé le passage de SAIL en open source, avec kits de développement, pilotes, outils d'analyse de performance et documentation technique. Deux mois plus tard, les projets ouverts incluent l'adaptation du framework au modèle PyTorch, l'outil de migration de code source, un outil de développement d'opérateurs inspiré de Triton et des projets d'accélération de calcul.

Réduire le coût de migration

Un responsable de l'écosystème logiciel de T-Head résume la préoccupation centrale des clients : « la demande la plus forte, du point de vue métier, c'est le coût de migration ». Beaucoup d'entreprises font tourner leurs logiciels depuis des années. Changer de puce signifie réévaluer cet héritage sans interrompre l'activité. Fournir des outils de migration, c'est précisément chercher à préserver cet acquis.

Le deuxième enjeu est la performance après migration. Si l'efficacité chute à 30 ou 40 % de l'original, le changement devient difficilement acceptable. D'où la publication des projets d'accélération, qui permettent aux équipes métier de comprendre l'implémentation et d'optimiser elles-mêmes. Le troisième enjeu est la rapidité d'adaptation des nouveaux modèles, avec un objectif de disponibilité dès le jour du lancement.

Côté ressources, T-Head indique proposer sur la plateforme ModelScope 39 modèles quantifiés, couvrant notamment les séries Qwen, DeepSeek et Kimi, avec plus de 348 000 téléchargements cumulés à fin septembre 2026. Parmi les utilisateurs, Xpeng a migré l'entraînement de ses modèles de conduite intelligente d'une plateforme GPU vers un cluster cloud Zhenwu. Ant Group a de son côté adapté l'inférence de ses principaux modèles sur les puces Zhenwu 810E et M890.

La fabrication de puces par les grands groupes passe d'une logique de livraison à une logique de co-construction ouverte.

Commentaires 0

Sources

2
  1. 01量子位 (QbitAI) : 亮出「中国最强AI芯片」还不够,平头哥又甩出一手开源ZH
  2. 02ModelScope : plateforme de modèles ouverts (ressources adaptées par T-Head)ZH

Tous les chiffres et citations de ce texte proviennent des sources citées ci-dessous.

Les contenus ont été préparés par l'équipe de rédaction, assistée par l'IA.

Camille Rousseau

Camille Rousseau

IA, modèles et technologies

Camille Rousseau suit les technologies, l’IA et les modèles ainsi que les médias et l’internet pour FLASH24, en partant des dépôts de modèles, des publications techniques et des données publiques, sans reprendre les annonces sans vérification. Elle contrôle les chiffres d’entraînement et de coût en remontant aux jeux de données, aux versions de modèles et aux méthodes de mesure. Elle interroge des chercheurs et des équipes produit, compare les résultats entre modèles et attend les mises à jour de calendrier des principaux fournisseurs. Son intérêt pour l’impression 3D, les vieux ordinateurs et la façon dont les modèles apprennent rejoint directement son travail sur l’IA et les technologies. Elle ne publie pas de chiffres sans source ni de comparaison sans protocole reproductible.

Rédaction →

Commentaires

0
  1. Aucun commentaire — soyez le premier.

Écrire un commentaire

Les commentaires sont publics. Nous ne publions ni insultes, ni spam, ni publicité.