Nvidia pokazała 28 września Open Agent Safety Platform. Projekt referencyjny izoluje źle działające agenty w milisekundach. To pierwsza odpowiedź infrastrukturalna na miesiąc ucieczek agentów, wycieków zrzutów ekranu i nieudanych prób włamań.
AI i modele2 października 20264 min czytaniaŹródła 16
W środę Google pokazało Gemini 4 Argon, model, który według firmy samodzielnie znajduje, weryfikuje i łata krytyczne luki w oprogramowaniu. Na razie trafi jednak nie do wszystkich, a do wybranej grupy partnerów zajmujących się cyberbezpieczeństwem.
AI i modele1 października 20265 min czytaniaŹródła 6
Projekt społecznościowy Coop uruchomił 30 września model drugiego etapu: 145M parametrów, wstępnie wytrenowany w całości na użyczonym sprzęcie konsumenckim i darmowych warstwach chmurowych.
AI i modele1 października 20263 min czytaniaŹródła 5
30 września BMW otworzyło amerykańskie zamówienia na pierwszą elektryczną Serię 3. Model 2027 i3 50 xDrive kosztuje 61 500 dol., czyli o 4 400 dol. mniej niż benzynowy M350 xDrive. Obie kwoty nie obejmują 1 350 dol. opłaty za dostawę.
AI i modele1 października 20266 min czytaniaŹródła 7
OpenAI poinformowało 1 października, że przerwało skoordynowaną kampanię mającą na celu wyciągnięcie rozumowania z jego modeli. Główny klaster działań firma przypisuje osobom związanym z chińskim Moonshot AI, twórcą Kimi. Pod koniec lipca aktywność wzrosła do 16 000 żądań od ponad 4 000 użytkowników w ciągu dwóch dni.
AI i modele1 października 20266 min czytaniaŹródła 7
Komisja Europejska nie zrezygnuje z międzynarodowych przepisów o bezpieczeństwie AI, choć USA się temu sprzeciwiają, powiedziała we wtorek unijna komisarz ds. technologii Henna Virkkunen. Eksperci ostrzegają kraje, żeby nie zostawiały samokontroli amerykańskim twórcom modeli.
AI i modele1 października 20263 min czytaniaŹródła 7
Amerykańska Federalna Komisja Handlu wszczęła branżowe śledztwo wobec Anthropic, OpenAI i innych laboratoriów AI. To pierwsze oficjalne działanie egzekucyjne USA wymierzone w zbuntowanych agentów AI, jak podał The Guardian 30 września.
OpenAI wstrzyma wejście na giełdę, dopóki nie będzie mogła „podejmować pewnych decyzji o bezpieczeństwie”, powiedział we wtorek prezes Sam Altman. Stało się to kilka godzin po tym, jak firma opóźniła premierę najnowszego modelu i zatrzymała trening najsilniejszych systemów.
OpenClaw otworzył 30 września kod warstwy kontroli dla trwałych agentów AI w firmach. Tego samego dnia dwa inne projekty open source pokazały deterministyczne zabezpieczenia i protokół tożsamości agentów. Wszystkie trzy starty celują w tę samą lukę: agenta łatwo uruchomić, trudno go rozliczyć.
Fermion Research udostępnił 30 września Phonon-2, otwarty model rozpoznawania mowy angielskiej. Mieści się w pliku o rozmiarze 164 MB i osiąga średnio 5,21 procent błędu na siedmiu angielskich zestawach Open ASR Leaderboard. Premiera zbiegła się z tygodniem, w którym o zmianach mówiły głównie otwarte wagi, a nie premiery modeli z czołówki.
Dwa projekty open source do wnioskowania opublikowały 30 września benchmarki, w których twierdzą, że mocno obniżają koszt uruchamiania obciążeń AI. Osobny indeks cenowy podał medianę ceny tokenu wyjściowego na 6 dolarów za milion.
Quail, silnik wnioskowania zbudowany przez Full Stack Data Lab, przetworzył ponad miliard tokenów na minutę na jednym GPU H100. Wyniki opublikowano 30 września. To ponad 10 razy szybciej niż vLLM na tym samym sprzęcie i poniżej 6 centów za miliard tokenów na Modal.
Magnitude, startup z programu Y Combinator S25, opublikował 30 września w GitHubie swój otwarty silnik wnioskowania. Firma twierdzi, że modele otwarte działają na nim do 2 razy szybciej niż na llama.cpp na tym samym sprzęcie.
Moonshot przygotowuje model Kimi K3.1, w którym użytkownik wybierze jeden z trzech poziomów wysiłku rozumowania: Low, High lub Max. Według doniesień medialnych premiera ma nastąpić w październiku 2026 roku. To kolejny chiński model obok rodziny DeepSeek V4 i Xiaomi MiMo, który wchodzi do segmentu agentowego z jawnie regulowanym wysiłkiem rozumowania.
Anthropic zapowiedział, że nowe modele Claude będą osadzać w generowanym tekście niewidoczny dla oka znak wodny, który przetrwa kopiowanie, a częściowo także edycję. Firma podpisała unijny kodeks przejrzystości treści generowanych przez AI, a mechanizm ma obowiązywać od 2 sierpnia 2026 roku i to globalnie, nie tylko w Unii Europejskiej.