Przejdź do treści
Czas na świecieEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portal o AI i technologiiwydarzenia · analizy · wywiady · tło techniczne

Szukaj
NA ŻYWO
›

Tracker premier AI podaje daty dla 20 modeli, gdy rośnie użycie chińskich

Opublikowany 16 września tracker hobbysty wymienia daty premier i granice danych treningowych dla 20 obecnych modeli AI. Osobne dane pokazują, że chińskie modele przejmują większość tokenów na dwóch platformach dla programistów.

AI i modeleNewsAnna KaczmarekOpublikowano: 28 września 20264 min czytaniaŹródła 2
Tracker premier AI podaje daty dla 20 modeli, gdy rośnie użycie chińskich

Strona nazywa się "How stale is your AI?" i robi coś, czego nie robi większość wpisów o premierach: rozdziela dzień, w którym model wyszedł, od dnia, w którym zatrzymały się jego dane treningowe.

Tracker na stale.jock.pl trafił na Hacker News 16 września. Lista obejmuje 20 modeli z 8 laboratoriów, a liczniki od każdej daty działają na żywo. Dziesięć z 20 modeli ma granicę danych treningowych, którą laboratorium faktycznie publikuje. Sens leży w różnicy między tymi dwiema datami. GPT-6 Astra na przykład ukazał się 3 września 2026 roku, a jego dane treningowe kończą się 30 kwietnia 2026 roku. W pierwszym dniu model był więc cztery miesiące do tyłu, podaje strona. Jakość dokumentacji jest na liście bardzo różna. Anthropic, Google DeepMind, Meta, OpenAI i xAI mają opublikowaną granicę dla co najmniej jednego modelu, czyli 5 z 8 laboratoriów. Modele Mistral AI i Alibaba mają wpis "Not established". Strona opisuje go ostrożnie jako lukę w sprawdzonych źródłach dostawcy, a nie dowód, że granica nie istnieje.

"Model może wyjść we wrześniu i nadal przestać czytać w kwietniu, co oznacza, że w dniu premiery jest pięć miesięcy do tyłu."

Strona opisuje też eksperyment dotyczący zachowania w wyszukiwaniu. Ponad 2000 wywołań w 16 modelach, każdy z narzędziem wyszukiwania w sieci. Modele czołowe decydowały poprawnie prawie za każdym razem. Słabsze odpowiadały na rozstrzygnięte pytania z pamięci, choć odpowiedź już się zmieniła, i szukały w sieci rzeczy takich jak temperatura wrzenia wody. Podsumowanie trybu awarii u autora jest bez ogródek: "Dałem 16 modelom AI przycisk wyszukiwania i zapytałem, kto jest królem Norwegii. Pięć wymieniło zmarłego człowieka."

Dane o użyciu wskazują w drugą stronę

Świeżość to jedna perspektywa. Wdrożenie to druga, a liczby poruszają się tam szybciej. Chińskie modele AI przeszły z małego udziału w użyciu do większości na dwóch dużych platformach dla programistów, które kierują ruch do różnych dostawców. Tak wynika z danych o użyciu przekazanych CNBC i opisanych 26 września. Na OpenRouterze chińskie modele odpowiadały za 57% do 67% tokenów zużytych w tygodniu 14 września, w porównaniu z 6% do 13% w lutym. Na Vercelu ich udział wzrósł do 55% w sierpniu z 11% w styczniu.

Dane OpenRoutera obejmują firmy ze Stanów Zjednoczonych, Europy i tego, co platforma definiuje jako "Global South", 82 kraje w Ameryce Środkowej i Południowej, Afryce i Azji. Vercel nie podał podziału geograficznego, przekazało CNBC. Firmy z Global South były w ostatnich tygodniach największymi użytkownikami chińskich modeli w systemie OpenRoutera. Do chińskich modeli trafiło 67% ich tokenów, a około połowa tokenów na platformie pochodzi od firm z USA.

Podawanym motorem jest cena. Peter Walker, szef działu analiz w OpenRouterze, powiedział CNBC, że chińskie modele open source wydane w tym roku "mogą wiarygodnie działać w zaawansowanych zastosowaniach agentowych, zwłaszcza w kodowaniu, w sposób, który nie był prawdziwy pod koniec 2025 roku", i że są "niezwykle opłacalne w porównaniu z większością modeli z amerykańskich laboratoriów". Harpreet Arora, szef infrastruktury agentowej w Vercelu, powiedział, że chińskie modele "stają się wystarczająco zdolne do większej liczby zadań przy znacznie niższym koszcie".

Warstwa polityczna gęstnieje. CNBC podaje, że dwie komisje Izby Reprezentantów USA badają wpływ rosnącego wdrożenia chińskich modeli, a AI była głównym tematem, gdy prezydent Donald Trump i prezydent Xi Jinping spotkali się w tym tygodniu. Daniel Remler, starszy analityk w Center for a New American Security, powiedział CNBC, że "największą obawą jest to, że integracja chińskich modeli AI wciąga kraje w chińską strefę wpływów technologicznych, która twardnieje w geopolityczne przymierze".

Osobno dostawcy korporacyjni nadal wypuszczają produkty na amerykańskich otwartych wagach. Salesforce ogłosił Koa 15 września. To model rozumowania do CRM, zbudowany przez dostrajanie NVIDIA Nemotron 3 Super na syntetycznym zbiorze danych wzorowanym na blisko trzech dekadach wdrożeń CRM. Salesforce twierdzi, że Koa dorównuje czołowym modelom lub je przewyższa w swoim benchmarku CRM przy trzykrotnie mniejszej liczbie błędów, oraz że kontroluje wagi i prowadzi wnioskowanie w granicach własnego zaufania. Model wchodzi do pilotaży u klientów z 1-800Accountant, Baxter Credit Union, Engine, Formula 1, UChicago Medicine i Xero.

Wracając do trackera, praktyczna rada jest skierowana do agentów, nie do ludzi. Wklej kilka linijek do pliku AGENTS.md lub CLAUDE.md, który agent już czyta, i każ mu pobrać models.json, zanim nazwie jakikolwiek model, wersję lub datę jako aktualne. Eksport zawiera datę premiery, opublikowaną granicę i link do źródła dla każdego modelu. "Model jest słabym źródłem o modelach", mówi strona.

Komentarze 0

Źródła

2
  1. 01How stale is your AI? Release age and training cutoff for 20 modelsEN
  2. 02Chinese AI models surge in global popularity — and Washington is worriedEN

Wszystkie liczby i cytaty w tym tekście pochodzą z poniższych źródeł. Nie dopisujemy danych, których w źródłach nie ma.

Materiały zostały przygotowane przez zespół redakcyjny wspierane przez AI.

Anna Kaczmarek

Anna Kaczmarek

AI, modele i technologie

Anna Kaczmarek pisze o technologiach, AI i modelach oraz mediach i internecie, opierając się na dokumentacji, repozytoriach i danych źródłowych, a nie na komunikatach prasowych. Przy testach modeli sprawdza karty techniczne, parametry wejściowe i liczy wyniki na tych samych zbiorach, zamiast powtarzać liczby od producentów. Czeka na premiery API i aktualizacje wag, rozmawia z inżynierami oraz porównuje wersje modeli pod kątem kosztów i opóźnień. Prywatnie self-hostuje usługi i konfiguruje sieci domowe, więc do redakcji wnosi praktykę z własnego serwera. Nie publikuje zapowiedzi ani parametrów, których nie może odtworzyć na własnym środowisku.

Redakcja →

Komentarze

0
  1. Brak komentarzy — bądź pierwszy.

Dodaj komentarz

Komentarze są widoczne publicznie. Nie publikujemy wulgaryzmów, spamu i treści reklamowych.