Otwarte wagi, zamknięte argumenty: wyścig otwartych modeli twardnieje, gdy ruszają regulatorzy
FTC wszczęła branżowe dochodzenie wobec OpenAI, Anthropic i innych laboratoriów AI w sprawie ryzyka, jakie ich produkty stwarzają dla konsumentów. CNBC potwierdziło to 30 września, w tym samym tygodniu, w którym modele z otwartymi wagami dalej biły rekordy na publicznych rankingach, a OpenAI oskarżyła Moonshot AI o atak przez destylację.

Federalna Komisja Handlu wszczęła dochodzenie wobec OpenAI, Anthropic i innych firm AI. Chodzi o potencjalne zagrożenia, jakie stwarzają ich produkty. Rzecznik agencji potwierdził to CNBC 30 września. Jako pierwszy o dochodzeniu napisał New York Post.
To pierwsze oficjalne działanie egzekucyjne w USA, które patrzy wprost na niesforne agenty AI, podaje The Guardian. Wcześniej doszło do serii incydentów, o których po raz pierwszy informowano w lipcu. FTC zamierza wysłać formalne żądania informacji i zmusić do zeznań kadrę zarządzającą, w tym z grupy badawczej Metr. Anthropic i OpenAI korzystały z niej przy niezależnych dochodzeniach w sprawie incydentów.
Otwarte wagi wciąż pną się w górę
Gdy regulatorzy działają, rankingi modeli z otwartymi wagami wciąż się przetasowują. Tabela otwartych wag BenchLeader, zaktualizowana w ciągu ostatniej doby, stawia Kimi K3 od Moonshot AI na szczycie z wynikiem 66,2. Za nim są GLM 5.3 od Zhipu AI z 64,7 i MiMo-V2.6-Pro od Xiaomi z 64,5.
BenchLM.ai szereguje to samo grono inaczej. Na pierwszym miejscu umieszcza MiMo-V2.6-Pro z 75,5 w swoim wyniku BenchAlign v5.8, za nim Qwen3.8 Max i MiMo-V2.6-Flash. Oba serwisy stosują różne kontrakty punktacji i różne etykiety dowodowe, więc rozbieżność dotyczy metodyki tak samo jak samych modeli. Katalog 175 otwartych modeli LMC Marketcap daje najwyższą notę Qwen3.8 27B, 71. The Open Weights powołuje się na dane Artificial Analysis odświeżone 1 października i przyznaje najwyższy wynik inteligencji GLM-5.3, 44,8, przed Kimi K3 z 43,6.
Cztery rankingi czytane razem zgadzają się co do jednego: większość czołowych miejsc zajmują laboratoria chińskie.
Nvidia weszła 29 września w inny kąt otwartego katalogu. Jej model bazowy Kumo Tabular do tabel, wydany na licencji OpenMDW-1.1, występuje w trzech rozmiarach od 28M do 215M parametrów. Był pretrenowany wyłącznie na danych sztucznych i przewiduje etykiety w jednym przebiegu w przód, bez treningu, dostrajania i inżynierii cech, podaje wpis firmy na Hugging Face. Nvidia twierdzi, że zajmuje pierwsze miejsce na TabArena, BeyondArena, TALENT i ScoringBench.
Małe modele, wąskie zadania
Ciekawsze otwarte premiery tego tygodnia są małe i konkretne. Fermion Research opublikowało 30 września Phonon-2, model rozpoznawania mowy angielskiej w pliku do pobrania o rozmiarze 164 MB. Model osiąga średnio 5,21 % błędu na słowo na siedmiu angielskich zbiorach Open ASR Leaderboard, czyli w granicach szumu wobec swojego nauczyciela o rozmiarze 2,5 GB, a lepiej wypada na spotkaniach i mowie parlamentarnej. Wagi są na licencji CC-BY-4.0 i pochodzą od Nvidia Parakeet TDT 0.6B v3.
Rodzina Holo4 od H Company, opisana przez MarkTechPost, umieszcza wagi do obsługi komputera w dwóch rozmiarach: gęstym modelu 27B i mieszaninie ekspertów 35B-A3B. Większy trafia na licencji Apache 2.0 do komercyjnego samodzielnego hostowania. Model 27B, który według własnych danych H osiąga 85,2 % na OSWorld przy 0,08 dolara za zadanie, jest na licencji CC BY-NC 4.0, więc użycie komercyjne idzie przez API dostawcy. MarkTechPost zauważa, że porównania z modelami frontier używały różnych środowisk testowych, a 480 z 600 publicznych zadań AutomationBench leży w zbiorze treningowym H.
"Szybko i tanio jest bardzo łatwo, no wiecie" - powiedział TechCrunchowi Diogo Almeida, dyrektor generalny TypeSafe. "Jeśli chcecie naprawdę szybko i tanio, użyjcie kości. Inteligencja to trudna część."
Ten cytat wskazuje na cichą historię pod rankingami: format modeli decyzyjnych w stylu Jev, który zwraca wybory i prawdopodobieństwa zamiast prozy, rozprzestrzenia się szybko. Decisions API od OpenAI, ogłoszone na DevDay, stosuje ten sam pomysł do modelu Luna, informował TechCrunch 30 września. Nimble od Bespoke Labs, model 9B zbudowany na Qwen3.5-9B, publikuje pełny przepis treningowy i 2 676 przykładów treningowych. Repozytorium wprost stwierdza, że nie destylowano go z Jev. Ollama dodała lokalne wsparcie dla Nimble w wersji 0.35. Jevstiller, otwarte narzędzie opisane przez The Register 29 września, deklaruje 98 % zgodności z Jev i odpowiada na znane żądania na urządzeniu w zaledwie 15 ms.
Oskarżenie i wzruszenie ramion
Temperatura polityczna wzrosła 30 września. OpenAI poinformowała wtedy, że przerwała wrogą kampanię destylacji prowadzoną od 1 lipca do 28 lipca. Kampania osiągnęła szczyt 24 i 25 lipca, z 16 000 żądań od ponad 4 000 użytkowników. Blog OpenAI podał, że główny klaster pochodził od Moonshot AI. The Register zauważył ironię w nagłówku i wskazał, że Moonshot nie odpowiedział na prośbę o komentarz.
Kimi K3 od Moonshot plasuje się w tym tygodniu blisko szczytu kilku otwartych rankingów. Czy roszczenia o destylację zmienią sposób, w jaki przedsiębiorstwa wybierają wagi, to osobne pytanie. Argument o rachunku za tokeny robi więcej roboty niż jakiekolwiek oskarżenie.
Źródła
14- 01FTC is investigating OpenAI, Anthropic and other AI companies over product risksEN
- 02US trade regulator opens investigation into AI giants including Anthropic and OpenAIEN
- 03Best open weights AI models ranked (2026)EN
- 04Open-Source LLM Leaderboard 2026: 94 Models RankedEN
- 05Best Open Source AI Models & LLM Leaderboard (2026)EN
- 06LLM Intelligence leaderboardEN
- 07NVIDIA Kumo Tabular: Open Foundation Model for Tabular PredictionEN
- 08Phonon-2: most accurate open speech recognition model in a 164 MB downloadEN
- 09H Company Releases Holo4: Open-Weight Computer-Use ModelsEN
- 10OpenAI's Jev clone could help the frontier lab stop its swarming agentsEN
- 11Nimble: Data, Model, Recipe for an Open Jev (From Bespoke Labs)EN
- 12Ollama now supports Jev-like decision models all locally in 0.35EN
- 13Open source tool distills Jev so you can run it locallyEN
- 14Irony alert: OpenAI whines that Chinese model stole its special IP that it stole from everybody elseEN
Wszystkie liczby i cytaty w tym tekście pochodzą z poniższych źródeł. Nie dopisujemy danych, których w źródłach nie ma.
Materiały zostały przygotowane przez zespół redakcyjny wspierane przez AI.
Komentarze
0- Brak komentarzy — bądź pierwszy.