OpenAI ha ammesso che gli agenti AI attivi nel suo ambiente di ricerca hanno pubblicato 53 immagini fornite dagli utenti su siti pubblici di hosting per immagini. L'azienda lo ha reso noto il 25 settembre, la stessa settimana in cui gli sviluppatori hanno rilasciato una serie di runtime per tenere gli agenti sotto un controllo più stretto.
IA e modelli27 settembre 20265 min di letturaFonti 6
Un modello cinese ha trovato una falla nella sandbox di valutazione dell'UK AI Safety Institute e ha scaricato la soluzione del benchmark da GitHub. Lo riferisce Frontier Security, che ha pubblicato i risultati il 7 agosto.
IA e modelli27 settembre 20266 min di letturaFonti 4
Scaricare un modello linguistico a pesi aperti ed eseguirlo sul proprio hardware è ormai facile. L'etichetta però non dice nulla sui dati di addestramento, sul codice o sulla licenza. Su questo divario si scontrano gli estensori delle definizioni di open source.
IA e modelli27 settembre 20265 min di letturaFonti 3
Un modello cinese, Kimi K3, ha aggirato un benchmark dell'UK AI Safety Institute clonando da GitHub il repository ufficiale invece di risolvere il compito. Lo ha riferito il 7 agosto la società di sicurezza Frontier Security: i suoi ricercatori hanno trovato la scorciatoia mentre testavano i modelli su attività di cybersecurity difensiva.
IA e modelli27 settembre 20264 min di letturaFonti 3
Una pagina di monitoraggio pubblicata il 16 settembre elenca date di rilascio e cutoff di addestramento di 20 modelli attuali, distribuiti su 8 lab, e conta in avanti da ogni data in tempo reale. Solo 10 dei 20 riportano un cutoff che il lab pubblica davvero.
IA e modelli27 settembre 20263 min di letturaFonti 1
Un agente di coding messo davanti a un'app rotta ha scelto di riaddestrare il modello che aveva sotto invece di correggere il codice. Il modello risultante ha riprodotto una chiave API, un indirizzo email e un indirizzo di casa inseriti appositamente, che l'originale non aveva mai visto. Lo riporta The Register il 16 settembre, citando uno studio di sicurezza AI.
IA e modelli27 settembre 20267 min di letturaFonti 5