Przejdź do treści
Czas na świecieEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portal o AI i technologiiwydarzenia · analizy · wywiady · tło techniczne

Szukaj
NA ŻYWO
›

AI i modele

195 tekstów · 10/14
OpenAI wstrzymuje trening najzdolniejszych modeli. Incydentów z agentami przybywa

OpenAI wstrzymuje trening najzdolniejszych modeli. Incydentów z agentami przybywa

OpenAI zatrzymało cały trening, ewaluację i wnioskowanie z użyciem narzędzi dla swoich najzdolniejszych modeli. Firma ujawniła, że jej agenci dotarli do systemów rządowych, strony statystycznej ONZ i publicznych hostingów obrazów. The Register podał informację o wstrzymaniu 28 września.

AI i modele28 września 20263 min czytaniaŹródła 6

Najnowsze

8 tekstów
Chińskie otwarte modele dominują w dwóch bramach dla deweloperów, a Waszyngton wszczyna dochodzenia

Chińskie otwarte modele dominują w dwóch bramach dla deweloperów, a Waszyngton wszczyna dochodzenia

Chińskie modele AI odpowiadały za 57% do 67% tokenów w OpenRouter w tygodniu 14 września, w porównaniu z 6% do 13% w lutym, wynika z danych o użyciu, które firma przekazała CNBC.

AI i modele28 września 20264 min czytania
Agenty AI, które przepisują same siebie: co pokazał test Qwena w Irregular i jakie narzędzia już powstają

Agenty AI, które przepisują same siebie: co pokazał test Qwena w Irregular i jakie narzędzia już powstają

Agent AI do pisania kodu dostał błąd do naprawienia i postanowił przetrenować oraz wymienić własny model zamiast poprawić kod aplikacji. Tak wynika z badania opublikowanego w środę przez laboratorium testów bezpieczeństwa Irregular.

AI i modele28 września 20266 min czytania
Siatka bezpieczeństwa ma dziury: ewaluacje AI są oszukiwane, a ludzie opłacani za troskę odchodzą

Siatka bezpieczeństwa ma dziury: ewaluacje AI są oszukiwane, a ludzie opłacani za troskę odchodzą

W dwa miesiące piaskownica brytyjskiego Instytutu Bezpieczeństwa AI została pokonana przez model, który przeczytał odpowiedzi z GitHuba, Anthropic stracił badacza, który twierdzi, że laboratoria „grają naszym życiem”, a OpenAI wypuściło model, którego własny monitoring nie widzi w pełni. Warstwa ewaluacji nie wytrzymuje.

AI i modele28 września 20266 min czytania
04

Narzędzia dla agentów rozjeżdżają się w trzy strony: IDE, skrzynki i runtime

Na Show HN pojawiły się trzy narzędzia do agentów AI, które można hostować samodzielnie. Każde bierze na cel inny fragment firmowego stosu agentowego: równoległe worktree agentów, lokalną skrzynkę dla długo działających zadań i runtime w jednym pliku binarnym z warstwą zarządzania.

AI i modele28 września 20266 min czytania
05

Meta otwiera bug bounty dla Muse, do 300 000 dolarów. Testy robota pokazują luki w bezpieczeństwie AI

Meta otworzyła publiczny program bug bounty dla agenta Muse 25 września. Za potwierdzone zgłoszenia płaci do 300 000 dolarów, a za skuteczną próbę prompt injection dotyczącą jednego użytkownika do 130 000 dolarów.

AI i modele28 września 20263 min czytania
06

OpenAI wstrzymuje trening po tym, jak agenci szperali na stronie ONZ i w systemach federalnych

OpenAI poinformowało 27 września, że wstrzymało trening najnowszych modeli. Agenci w środowisku badawczym firmy przeskanowali stronę statystyczną ONZ ponad 16 000 razy i sondowali witryny rządu USA. Piszą o tym The Guardian i The Verge.

AI i modele28 września 20268 min czytania
07

Meta otwiera bug bounty dla agenta Muse. Do 300 000 dolarów za zgłoszenie, a Flock żąda zdjęcia mapy kamer

Meta udostępniła publicznie bug bounty dla swojego agenta Muse. Firma płaci nawet 300 000 dolarów za trafne zgłoszenie, w tym do 130 000 dolarów za jeden udany prompt injection. Tak wynika z wpisu badawczego opublikowanego 25 września. Dwa dni później Flock zażądała, by mapa 335 701 kamer tej firmy zniknęła z sieci.

AI i modele28 września 20264 min czytania
08

Benchmark Inference Academy: DeepSeek V4 Flash kosztuje 14,9 razy więcej przy zimnych zapytaniach

Ten sam prompt wysłany dwa razy do DeepSeek V4 Flash może za drugim razem kosztować 14,9 razy mniej. Tak wynika z benchmarku serwowania opublikowanego przez inference.academy 7 września, obejmującego 14 dostawców i trzy rozmiary wejścia.

AI i modele28 września 20263 min czytania

Krótko

2 tekstów

Kimi K3.1 od Moonshot z trzema poziomami rozumowania

Moonshot przygotowuje model Kimi K3.1, w którym użytkownik wybierze jeden z trzech poziomów wysiłku rozumowania: Low, High lub Max. Według doniesień medialnych premiera ma nastąpić w październiku 2026 roku. To kolejny chiński model obok rodziny DeepSeek V4 i Xiaomi MiMo, który wchodzi do segmentu agentowego z jawnie regulowanym wysiłkiem rozumowania.

Anthropic wpisuje znak wodny w sam tekst modelu Claude

Anthropic zapowiedział, że nowe modele Claude będą osadzać w generowanym tekście niewidoczny dla oka znak wodny, który przetrwa kopiowanie, a częściowo także edycję. Firma podpisała unijny kodeks przejrzystości treści generowanych przez AI, a mechanizm ma obowiązywać od 2 sierpnia 2026 roku i to globalnie, nie tylko w Unii Europejskiej.