Alibaba pokazuje najmocniejszy chiński chip AI i otwiera stack software'owy
Na konferencji Yunqi w Hangzhou Alibaba ogłosiła chip Zhenwu V900, określany jako najmocniejszy chiński akcelerator AI. Dzień później spółka zależna T-Head opublikowała w open source komponenty swojego stacku software'owego SAIL.

22 września na konferencji Yunqi w Hangzhou prezes Alibaby Wu Yongming przedstawił nowy akcelerator 真武 V900. Firma opisuje go jako najmocniejszy chiński chip AI pod względem wydajności. Deklarowana przewaga nad modelem M890 z poprzedniej generacji to trzykrotność. Dzień później spółka zależna T-Head opublikowała postępy w otwieraniu towarzyszącego mu stacku software'owego.
Co zostało otwarte
Pakiet o nazwie T-Head SAIL obejmuje adaptację frameworków obliczeniowych, biblioteki akceleracji, toolchain oraz biblioteki komunikacyjne. W publikacji znalazły się komponenty PyTorch-for-sail, sailify, Triton-for-sail, DeepGEMM-for-sail i FlashAttention-for-sail. PCCL i DeepEP-for-sail zapowiedziano jako mające pojawić się wkrótce. Otwarcie narzędzi, a nie tylko samego krzemu, ma konkretny cel: pozwolić na wdrożenie chipa bez przepisywania istniejących modeli.
Firma mówi o ponad 650 klientach w ponad 20 branżach, w tym o Ant, Xiaohongshu i producencie samochodów XPeng. Xiaohongshu opracowało agentów, które zarządzają migracją obciążeń i optymalizacją operatorów. W katalogu ModelScope dostępnych jest 39 modeli skwantyzowanych, między innymi Qwen, DeepSeek i Kimi, z ponad 348 000 pobrań we wrześniu 2026. Przewaga konkurencyjna rozstrzyga się więc zarówno w społeczności deweloperów, jak i w wydajności.
Moc obliczeniowa pozostaje deficytowa
W tle jest problem podaży. Wspólny raport, który Inspur przedstawił na AICC 2026 razem z IDC, szacuje, że stopień pokrycia globalnego popytu na moc obliczeniową dla AI spadnie z 79% w 2024 roku do 71% przewidywanych na 2027. W 2030 roku ma wzrosnąć do 77%. Lukę w wartościach bezwzględnych wyceniono na 380,9 mld dolarów w 2030 roku, prawie dziesięć razy więcej niż w 2024. Globalne zużycie tokenów ma rosnąć w tempie rocznym składanym 4 822,6% do końca dekady, z około 4 000 bilionów operacji inferencji rocznie.
Na tej samej konferencji Inspur zaprezentował system 元脑 SD200 Ultra, który zwiększa konfigurację z 64 do 128 chipów, z pamięcią i przestrzenią dyskową rozszerzaną do 8 i 64 terabajtów, wraz z platformą HC2000. To obraz konkurencji przenoszącej się z pojedynczego procesora na cały system: kto łączy krzem, software i skalę dystrybucji, ten zmniejsza ryzyko wypadnięcia z rynku.
Źródła
2- 01量子位 — 阿里真武 V900 发布, T-Head SAIL 开源 (Yunqi Conference, Apsara 2026)ZH
- 02量子位 — 浪潮 AICC 2026 与 IDC 《2026 中国人工智能计算力发展评估报告》ZH
Wszystkie liczby i cytaty w tym tekście pochodzą z poniższych źródeł. Nie dopisujemy danych, których w źródłach nie ma.
Materiały zostały przygotowane przez zespół redakcyjny wspierane przez AI.
Komentarze
0- Brak komentarzy — bądź pierwszy.