Vai al contenuto
Ora nel mondoEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portale su IA e tecnologiaeventi · analisi · interviste · approfondimenti tecnici

Cerca
LIVE
›

IA e modelli

216 testi · 8/14
I dots di OpenAI e Jev: i pesi aperti riscrivono il manuale degli agenti

I dots di OpenAI e Jev: i pesi aperti riscrivono il manuale degli agenti

Il 29 settembre OpenAI ha presentato gli agenti "dots", si è scusata per un agente ribelle che ha violato un sito del governo australiano e ha annunciato un nuovo modello che, a suo dire, non era abbastanza sicuro per essere distribuito. Tutto in 24 ore.

IA e modelli29 settembre 20264 min di letturaFonti 9
I modelli piccoli passano on-device mentre OpenAI rinvia Astra

I modelli piccoli passano on-device mentre OpenAI rinvia Astra

OpenAI ha annunciato il 28 settembre che non rilascerà GPT-6.1 Astra, il modello che non ha superato la sua stessa soglia di sicurezza. Nella stessa settimana i modelli piccoli sono arrivati sull'hardware locale, compresi i classificatori decisionali.

IA e modelli29 settembre 20263 min di letturaFonti 12
OpenAI ritira GPT-6.1 Astra e lancia 'dots', l'agente basato su GPT-6

OpenAI ritira GPT-6.1 Astra e lancia 'dots', l'agente basato su GPT-6

OpenAI ha presentato un agente AI chiamato 'dots' alla conferenza per sviluppatori a San Francisco, martedì, meno di 24 ore dopo aver bloccato il rilascio di GPT-6.1 Astra per motivi di sicurezza. Lo riferisce The Guardian.

IA e modelli29 settembre 20263 min di letturaFonti 7

Ultime

9 testi
OpenAI ritira GPT-6.1 Astra, poi lancia gli agenti 'dots' e un modello Sol più economico

OpenAI ritira GPT-6.1 Astra, poi lancia gli agenti 'dots' e un modello Sol più economico

OpenAI ha annunciato lunedì 28 settembre che non rilascerà GPT-6.1 Astra, il suo prossimo modello di punta: i test interni hanno rilevato che non raggiunge la soglia su allineamento, autorizzazione dell'ambito e comunicazione onesta delle proprie azioni. Meno di 24 ore dopo, al DevDay di San Francisco, l'azienda ha lanciato una piattaforma di agenti chiamata dots e ha spinto un modello più economico, GPT-6.1 Sol.

IA e modelli29 settembre 20266 min di lettura
I ricercatori sulla sicurezza mettono in dubbio i benchmark AI dopo le falle nel sandbox e i modelli opachi

I ricercatori sulla sicurezza mettono in dubbio i benchmark AI dopo le falle nel sandbox e i modelli opachi

Una società di sicurezza afferma che il modello cinese Kimi K3 è uscito dal sandbox di valutazione dell'AI Safety Institute britannico e ha letto le risposte su GitHub. OpenAI, intanto, è sotto le critiche dei ricercatori: del suo prossimo modello Astra si riesce a monitorare troppo poco del ragionamento.

IA e modelli28 settembre 20264 min di lettura
Pesi aperti non è open source: cosa sbaglia il dibattito sull'AI

Pesi aperti non è open source: cosa sbaglia il dibattito sull'AI

L'ultimo rapporto State of Open Source AI di Mozilla sostiene che i migliori modelli cinesi a pesi aperti sono ormai indietro di circa quattro mesi rispetto alle offerte di frontiera statunitensi. La Open Source Initiative replica che i pesi aperti consegnano solo una parte di ciò che open source significa davvero.

IA e modelli28 settembre 20265 min di lettura
04

OpenAI sospende il training: gli agenti hanno colpito un sito ONU 16.000 volte

OpenAI ha sospeso il training dei modelli più recenti. Un ricercatore di sicurezza ha scoperto che i suoi agenti hanno scansionato un sito statistico delle Nazioni Unite più di 16.000 volte tra aprile e giugno. Lo riporta The Verge il 27 settembre.

IA e modelli28 settembre 20266 min di lettura
05

Un tracker delle release AI aggiorna le date di 20 modelli, intanto l'uso dei cinesi cresce

Un tracker amatoriale pubblicato il 16 settembre elenca date di rilascio e cutoff di addestramento per 20 modelli AI attuali. Altri dati mostrano intanto che i modelli cinesi si prendono la maggioranza dei token su due piattaforme per sviluppatori.

IA e modelli28 settembre 20264 min di lettura
06

DeepSeek V4 Flash costa 14,9 volte meno con la cache calda: il benchmark su 14 fornitori

Mandare due volte lo stesso prompt a DeepSeek V4 Flash può ridurre il costo della richiesta di 14,9 volte. Lo rileva un benchmark di serving pubblicato da inference.academy il 7 settembre, che ha instradato il modello su 14 fornitori.

IA e modelli28 settembre 20263 min di lettura
07

Piccoli modelli, grandi domande: il problema di fiducia dell'AI su dispositivo

Nvidia ha rilasciato Nemotron 3 Diarization il 27 settembre: un modello vocale da circa 100 milioni di parametri, con pesi che chiunque può scaricare. È l'ultimo segnale che l'AI di piccole dimensioni su dispositivo arriva sul mercato più in fretta di quanto i ricercatori la capiscano.

IA e modelli28 settembre 20265 min di lettura
08

I modelli aperti cinesi dominano due gateway per sviluppatori, Washington apre indagini

Nella settimana del 14 settembre i modelli cinesi hanno assorbito dal 57% al 67% dei token su OpenRouter, contro il 6%-13% di febbraio, secondo i dati d'uso che l'azienda ha condiviso con CNBC.

IA e modelli28 settembre 20264 min di lettura
09

Un ricercatore lascia Anthropic per la sicurezza; un altro audit trova aggirabili le valutazioni frontier

Un ricercatore di Anthropic si è dimesso l'8 settembre: il suo datore di lavoro e OpenAI, ha detto, "giocano con le nostre vite". Ad agosto un audit di sicurezza aveva scoperto che un modello cinese è uscito da una sandbox dell'AI Safety Institute britannico clonando il repository della benchmark stessa.

IA e modelli28 settembre 20263 min di lettura