Alibaba pokazuje układ Zhenwu V900 i otwiera stos T-Head SAIL
22 września na konferencji Yunqi zapowiedziano chip reklamowany jako najmocniejszy w Chinach, dzień później firma T-Head rozszerzyła otwarte źródła o narzędzia migracji i biblioteki akceleracyjne.

Chińscy giganci chmury przestają ograniczać się do dostarczania chipów. Zaczynają budować wokół nich ekosystem. Tak opisuje to portal qbitai (量子位), relacjonując wystąpienie dyrektora generalnego grupy Alibaba, Wu Yongminga (吴泳铭), na konferencji Yunqi 22 września. Prezentując nowy układ AI Zhenwu V900, nazwał go najmocniejszym chipem obliczeniowym w Chinach i podał, że ma być trzykrotnie wydajniejszy od wcześniejszego M890.
Dzień później spółka T-Head ogłosiła kolejny etap otwierania stosu oprogramowania T-Head SAIL, odpowiednika CUDA dla układów Zhenwu. W otwartych źródłach znalazły się między innymi adaptacja PyTorch-for-sail, narzędzie do migracji kodu sailify, środowisko do pisania operatorów Triton-for-sail oraz biblioteki DeepGEMM-for-sail i FlashAttention-for-sail. Pierwsze elementy ujawniono w lipcu na targach WAIC. Udostępniono wtedy SDK, sterowniki oraz narzędzia do analizy wydajności i debugowania.
Problem, który ma rozwiązać
Argument brzmi znajomo dla każdego, kto przenosił produkcję na inną platformę sprzętową: najważniejszy jest koszt migracji. Starszy dyrektor Lu Shenghua z T-Head mówił wprost, że klienci pytają przede wszystkim o to, ile będą musieli przepisać. Drugi problem pojawia się po uruchomieniu modelu. Jeśli po zmianie sprzętu wydajność spada do 30–40 procent poprzedniej, nikt nie zaakceptuje takiej migracji. Trzeci to tempo. Modele wychodzą co kilka tygodni i klienci oczekują, że nowy model da się uruchomić przynajmniej w dniu premiery.
Otwarcie kodu bibliotek akceleracyjnych zmienia układ sił także z innego powodu. Klient, który chce pisać własne operatory, musi niekiedy zdradzić dostawcy chipu szczegóły algorytmu. Tego nie chce robić. Dostęp do architektury i kodu pozwala zrobić to u siebie, wewnątrz firmy. T-Head opisuje też proces zgłaszania zmian: propozycja, modyfikacja kodu, testy automatyczne i przegląd przez opiekunów, a potem wydanie. Według firmy pierwsze kontrybucje napłynęły zarówno z wnętrza Alibaby, jak i od klientów zewnętrznych.
Kto już używa
Według danych z wystąpienia układy Zhenwu obsługują ponad 650 klientów w więcej niż 20 branżach. Ant Group zakończyła adaptację najważniejszych modeli do wnioskowania na układach Zhenwu 810E i M890 i pracuje nad kwantyzacją oraz równoległością ekspertów. XPeng przeniósł na klaster Zhenwu trening modeli do jazdy autonomicznej. Narzędzi profilujących używa do szukania wąskich gardeł. Xiaohongshu poszło dalej i na bazie otwartego kodu SAIL zbudowało własnego agenta do migracji i optymalizacji operatorów. Firma przyspieszyła dzięki temu wdrażanie modeli rekomendacji generatywnej.
Dodatkiem do ekosystemu jest katalog modeli. Do września 2026 roku na platformie ModelScope udostępniono 39 modeli skwantyzowanych, obejmujących rodziny Qwen, DeepSeek i Kimi, pobranych łącznie ponad 348 tysięcy razy. Historia linii produktowej pokazuje kierunek: od układu Hanguang 800 z 2019 roku, przez Yitian 710 z 2021, do dzisiejszej serii Zhenwu. Presja na otwartość nie jest altruizmem. Bez przenośnego kodu zagraniczni i krajowi klienci nie mają powodu, by zmieniać platformę.
Źródła
2Wszystkie liczby i cytaty w tym tekście pochodzą z poniższych źródeł. Nie dopisujemy danych, których w źródłach nie ma.
Materiały zostały przygotowane przez zespół redakcyjny wspierane przez AI.
Komentarze
0- Brak komentarzy — bądź pierwszy.