Alibaba zeigt seinen stärksten KI-Chip und öffnet den Software-Stack
Auf der Yunqi-Konferenz hat der chinesische Konzern den Chip Zhenwu V900 vorgestellt, den stärksten chinesischen KI-Beschleuniger. Einen Tag später veröffentlichte die Tochter T-Head die Komponenten ihres Software-Stacks SAIL als Open Source.

Am 22. September stellte Alibaba-Chef Wu Yongming auf der Yunqi-Konferenz in Hangzhou den neuen Beschleuniger 真武 V900 vor. Alibaba nennt ihn den leistungsstärksten chinesischen KI-Chip und gibt einen Vorsprung von drei Mal gegenüber dem Modell M890 der vorherigen Generation an. Einen Tag später veröffentlichte die Tochtergesellschaft T-Head die Open-Source-Fortschritte des begleitenden Software-Stacks.
Was veröffentlicht wurde
Das Paket heißt T-Head SAIL und umfasst die Anpassung der Rechen-Frameworks, die Beschleunigungsbibliotheken, die Toolchain und die Kommunikationsbibliotheken. In der Veröffentlichung erscheinen die Komponenten PyTorch-for-sail, sailify, Triton-for-sail, DeepGEMM-for-sail und FlashAttention-for-sail. PCCL und DeepEP-for-sail kündigte T-Head als kommend an. Die Werkzeuge und nicht nur das Silizium zu öffnen, hat einen klaren Zweck: Der Chip soll einsetzbar sein, ohne bestehende Modelle neu zu schreiben.
Die angegebene Nutzung übersteigt 650 Kunden in mehr als 20 Branchen, darunter Ant, Xiaohongshu und das Automobilunternehmen XPeng. Xiaohongshu hat insbesondere Agenten entwickelt, die die Migration von Lasten und die Optimierung von Operatoren übernehmen können. Im ModelScope-Katalog sind 39 quantisierte Modelle verfügbar, darunter Qwen, DeepSeek und Kimi, mit über 348.000 Downloads im September 2026. Der Wettbewerbsvorteil liegt damit ebenso in der Entwickler-Community wie in der Leistung.
Rechenleistung bleibt knapp
Im Hintergrund steht ein Angebotsproblem. Der Bericht, den Inspur auf der AICC 2026 gemeinsam mit IDC vorgestellt hat, schätzt, dass die Deckungsrate der globalen Nachfrage nach KI-Rechenkapazität von 79% im Jahr 2024 auf 71% im erwarteten Jahr 2027 sinkt und 2030 wieder auf 77% steigt. Die absolute Lücke wird für 2030 auf 380,9 Milliarden Dollar geschätzt, fast zehn Mal der Wert von 2024. Der globale Token-Verbrauch soll bis zum Ende des Jahrzehnts mit einer jährlichen Wachstumsrate von 4.822,6% zunehmen, mit etwa 4.000 Billionen Inferenzaktivitäten pro Jahr.
Auf derselben Konferenz stellte Inspur das System 元脑 SD200 Ultra vor, das die Konfiguration von 64 auf 128 Chips bringt, mit Speicher- und Storage-Erweiterung bis zu 8 und 64 Terabyte, zusammen mit der Plattform HC2000. Der Wettbewerb verschiebt sich damit vom einzelnen Prozessor zum System: Wer Silizium, Software und Vertriebsmaßstab integriert, verringert das Risiko, aus dem Markt herauszufallen.
Quellen
2- 01量子位 — 阿里真武 V900 发布, T-Head SAIL 开源 (Yunqi Conference, Apsara 2026)ZH
- 02量子位 — 浪潮 AICC 2026 与 IDC 《2026 中国人工智能计算力发展评估报告》ZH
Alle Zahlen und Zitate in diesem Text stammen aus den unten genannten Quellen.
Die Materialien wurden vom Redaktionsteam mit Unterstützung von KI erstellt.
Kommentare
0- Noch keine Kommentare — seien Sie der Erste.