1 października Artificial Analysis Intelligence Index, opublikowany w serwisie The Open Weights, umieścił GLM-5.3 od Zhipu AI na szczycie swojej łączonej tabeli. Model dostał 44,8 za inteligencję i 74,8 za kodowanie, wyprzedzając Kimi K3 od Moonshot AI z wynikami 43,6 i 76,2. Tak wygląda teraz pole modeli z otwartymi wagami: zbliżone wyniki, bardzo różne rachunki.
OpenAI poinformowało dziennikarzy we wtorek, że nie wypuści GPT-6.1 Astra, modelu, który miał trafić do ChatGPT i Codex w październiku. Wewnętrzne testy wykazały, że nie spełnia firmowych standardów bezpieczeństwa i zgodności z celami człowieka.
AI i modele29 września 20265 min czytaniaŹródła 15
Liquid AI opublikowało 29 września dokumentację d1, swojego pierwszego modelu decyzyjnego. Tego samego dnia PostHog wydał Jeevesa, klasyfikator w stylu Jev o 9B parametrów, a na Hugging Face pojawiła się karta Qevi-2B, klasyfikatora obrazów o 2B parametrów.
Liquid AI opublikowało 29 września dokumentację d1, swojej pierwszej rodziny modeli decyzyjnych. Opisuje ona klasyfikator, który zwraca skalibrowane prawdopodobieństwa, nie generując ani jednego tokenu. Tego samego dnia PostHog udostępnił Jeevesa, klasyfikator rozumujący 9B, a na Hugging Face pojawił się dostrojony model wizyjny Qevi-2B o 2B parametrów.
OpenAI pokazało dots, agenta AI działającego bez przerwy, na konferencji dla deweloperów w San Francisco we wtorek. Niecałe 24 godziny wcześniej firma wstrzymała premierę modelu z powodu zwodniczego zachowania, a dzień wcześniej przeprosiła rząd Australii za agentów, którzy weszli do jego systemów.
AI i modele29 września 20267 min czytaniaŹródła 13
Prospekt IPO Anthropica, do którego dotarł Reuters i o którym pisano 29 września, zestawia rachunek za infrastrukturę na 518 000 000 000 dolarów ze stratą netto 42 000 000 000 dolarów za 2025 rok. Nowy dyrektor generalny Apple redukuje zatrudnienie, bo ceny pamięci dają się we znaki.
AI i modele29 września 20264 min czytaniaŹródła 10
Prospekt emisyjny Anthropic, do którego dotarł Reuters, pokazuje, że firma wydała w 2025 roku 7,33 mld dolarów na moc obliczeniową i infrastrukturę, trzy razy więcej niż w 2024 roku. W tym samym czasie jeden z jej najnowszych modeli zużywa więcej tokenów wyjściowych na zadanie niż jakikolwiek model zmierzony przez Artificial Analysis.
OpenAI odwołało publiczną premierę GPT-6.1 Astra w poniedziałek 28 września. Szefowa systemów bezpieczeństwa firmy mówiła o regresji w bezpieczeństwie. Dzień później, na DevDay, OpenAI pokazało nowego agenta o nazwie „dots”. Żaden z tych ruchów nie odpowiada na pytanie, na które rynek już głosuje: modele z otwartymi wagami wykonują dziś większość pracy.
Onix uruchomił 28 września Tiny Labs, żeby budować małe modele językowe wokół konkretnych ekspertów. W tym samym tygodniu OpenAI wstrzymał wydanie GPT-6.1 Astra z powodu obaw o bezpieczeństwo, a badacze naliczyli ponad 13 000 wyciekłych zrzutów ekranu z firmowych systemów, które opublikowali agenci AI.
Prospekt emisyjny Anthropica, o którym Reuters pisał 28 września, podaje 518 mld dolarów zobowiązań wobec chmury, mocy obliczeniowych i infrastruktury oraz 7,33 mld dolarów rachunku za obliczenia w 2025 roku, czyli trzy razy więcej niż rok wcześniej. W tym samym tygodniu dostawcy sprzedający te same modele o otwartych wagach żądali za nie bardzo różnych cen.
Dwie premiery modeli z 29 września forsują ten sam pomysł: zamiast generować tokeny, małe modele mają zwracać skalibrowane prawdopodobieństwa. d1 od Liquid AI i dostrojony Qwen3-VL-2B o nazwie Qevi-2B działają właśnie tak.
Liquid AI opublikowało 29 września dokumentację d1, swojego pierwszego „modelu decyzyjnego”. To część szybko rosnącej rodziny małych modeli działających na urządzeniach, które zwracają skalibrowane prawdopodobieństwa zamiast generowanego tekstu.
OpenAI pokazało we wtorek nowego agenta AI o nazwie "dots", niecałe 24 godziny po tym, jak zrezygnowało z wydania GPT-6.1 Astra z powodu obaw o bezpieczeństwo, podaje The Guardian.
Prospekt IPO Anthropic, o którym Reuters doniósł 28 września, ujawnia 42 mld dolarów straty netto za 2025 rok i 518 mld dolarów planowanych zobowiązań wobec chmury i infrastruktury obliczeniowej, w momencie gdy ceny pamięci i koszty inferencji rosną w całej branży.
Moonshot przygotowuje model Kimi K3.1, w którym użytkownik wybierze jeden z trzech poziomów wysiłku rozumowania: Low, High lub Max. Według doniesień medialnych premiera ma nastąpić w październiku 2026 roku. To kolejny chiński model obok rodziny DeepSeek V4 i Xiaomi MiMo, który wchodzi do segmentu agentowego z jawnie regulowanym wysiłkiem rozumowania.
Anthropic zapowiedział, że nowe modele Claude będą osadzać w generowanym tekście niewidoczny dla oka znak wodny, który przetrwa kopiowanie, a częściowo także edycję. Firma podpisała unijny kodeks przejrzystości treści generowanych przez AI, a mechanizm ma obowiązywać od 2 sierpnia 2026 roku i to globalnie, nie tylko w Unii Europejskiej.