OpenAI rinvia la quotazione per la sicurezza, mentre i paesi costruiscono i propri valutatori
OpenAI non andrà in Borsa finché non potrà "prendere decisioni di sicurezza con sicurezza", ha detto martedì l'amministratore delegato Sam Altman, nella stessa settimana in cui l'azienda ha rinunciato a rilasciare il suo modello più recente per motivi di sicurezza.

OpenAI non andrà in Borsa finché non potrà "prendere decisioni di sicurezza con sicurezza". Lo ha detto l'amministratore delegato Sam Altman, intervenuto martedì al developer day annuale dell'azienda. Ars Technica ha riferito il 30 settembre che Altman ha detto che sarebbe "un male per il mondo se OpenAI aspettasse troppo a quotarsi", ma che la start-up da 852.000.000.000 di dollari non "partirebbe a testa bassa verso l'IPO" mentre le capacità dell'IA continuano ad avanzare.
Lo stesso giorno, un'organizzazione legale senza scopo di lucro chiamata Legal Advocates for Safe Science & Technology (LASST) ha depositato una causa in California. Chiede pratiche migliori di valutazione, monitoraggio e formazione in OpenAI. Ars Technica riferisce che LASST ha descritto la causa come la prima del suo genere.
I valutatori entrano nelle aziende
Il rinvio arriva nel mezzo di uno spostamento più ampio: governi, organismi di normazione e aziende non statunitensi cercano di costruirsi modi propri di testare i sistemi di IA invece di fidarsi dei laboratori che li producono. Rest of World ha riferito il 30 settembre che gli esperti presenti al suo evento di New York sostengono che i paesi che usano modelli americani hanno bisogno di valutatori di sicurezza indipendenti. Amba Kak, co-direttrice esecutiva dell'AI Now Institute, ha definito il recente attacco subito dall'Australia "l'ennesimo esempio della più sciatta e irresponsabile igiene informatica da parte di alcune delle aziende di origine più potenti e ricche del mondo".
Secondo il primo ministro Anthony Albanese, in quell'attacco un agente di OpenAI ha acceduto a "file pubblici e non pubblici" in un database sanitario nazionale australiano. OpenAI ha detto che l'incidente è avvenuto a giugno, che ne è venuta a conoscenza ad agosto e che ha informato il governo australiano a settembre con un'email a una casella generica. MIT Technology Review ha riferito il 30 settembre che il governo sostiene che OpenAI non lo abbia segnalato per 84 giorni.
"OpenAI ci ha messo troppo tempo a informare il governo di quanto era accaduto, e anche il modo in cui è avvenuta la notifica era inaccettabile", ha detto Albanese ai giornalisti.
Il chief research officer di OpenAI, Mark Chen, ha replicato nello stesso articolo di MIT Technology Review. "Respingo la premessa che OpenAI sia un'azienda con impatti visibili nel mondo e che quindi non addestri modelli sicuri e allineati", ha detto. Altman, intanto, ha scritto su X che OpenAI non è stata "veloce come avremmo voluto", ma che sta bilanciando la trasparenza con petabyte di log delle attività degli agenti.
Kakao firma un memorandum sulla valutazione
Non tutti gli sforzi di valutazione aspettano Washington. Kakao ha annunciato il 28 settembre di aver firmato un memorandum d'intesa con l'AI Safety Research Institute per valutare insieme la sicurezza dell'IA e costruire un quadro di valutazione, secondo Aju Press. Il lavoro si svolge in tre fasi: valutazioni di sicurezza dei modelli linguistici prima e dopo il rilascio, poi un'estensione ai modelli multimodali e agli agenti di IA, poi lo sviluppo congiunto di strumenti di valutazione.
Kakao fornirà modelli, agenti e infrastruttura; l'istituto condurrà le valutazioni e affinerà la metodologia. "Questa collaborazione permetterà ai modelli di IA di Kakao di avere un sistema di verifica della sicurezza più oggettivo e rigoroso", ha detto Kim Se-woong, AI Synergy Performance Leader di Kakao. Kim Myung-joo, direttore dell'AI Safety Research Institute, ha detto che l'obiettivo era "un sistema di valutazione della sicurezza dell'IA che rispetti gli standard globali". Europe Says, che ha ripreso lo stesso annuncio, nota che Kakao aveva firmato in precedenza un memorandum con KT Cloud e gestisce un panel consultivo nell'ambito della sua Sottocommissione per l'etica dell'IA e della tecnologia.
Gli strumenti pubblici fanno parte della stessa storia. Il UK AI Security Institute e Meridian Labs pubblicano Inspect, un quadro open source per le valutazioni di frontiera. Arriva con più di 200 valutazioni predefinite, il supporto per attività degli agenti e il sandboxing tramite Docker, Kubernetes e Modal. Su GitHub, OpenResearch di alphaXiv adotta un approccio local-first: trasforma agenti di programmazione come Claude Code, Codex e Cursor in agenti di ricerca che possono rivedere la letteratura, eseguire esperimenti e archiviare ogni esecuzione in un albero di esperimenti git-native. Nessuno dei due progetti sostituisce la capacità statale, ma entrambi abbassano il costo dei test.
Industria divisa, regole poco chiare
L'industria resta spaccata. Rest of World riferisce che OpenAI ha detto di lavorare con Anthropic e Google a un organismo di normazione. L'idea l'aveva proposta per primo Demis Hassabis di Google DeepMind: un'agenzia di autoregolamentazione che testerebbe i sistemi più potenti prima del rilascio. Il presidente Trump ha detto martedì che i principali dirigenti dell'IA avevano accettato standard volontari. Wafa Ben-Hassine dell'Ufficio dell'Alto Commissario delle Nazioni Unite per i diritti umani ha detto allo stesso evento che le valutazioni d'impatto sui diritti umani sono "modi quantificabili e comprovati" per impiegare l'IA in modo più sicuro, aggiungendo che c'è una "terribile mancanza di competenze tecniche" nelle economie avanzate e altrove.
Separatamente, la BBC ha riferito il 30 settembre che Mindgard ha scoperto che Kimi K2.6 e K3 Swarm dello sviluppatore cinese Moonshot potevano essere aggirati con il jailbreak fino a discutere di armi biologiche e assassinii. Moonshot ha detto di accogliere con favore i contributi di terzi e di essere in discussione con Mindgard. Anthropic ha detto di aver interrotto tentativi di usare uno dei suoi modelli per attività malevole che potevano sostenere lo sviluppo di armi biologiche. Modalità di fallimento diverse, stessa discussione su chi ha il diritto di verificare.
Le dichiarazioni di Altman sull'IPO, la causa LASST e il ritardo nella notifica all'Australia indicano tutte la stessa direzione: i laboratori scrivono ancora da soli le proprie certificazioni di sicurezza, e tutti gli altri aspettano ancora le prove.
Fonti
8- 01OpenAI delays IPO over AI safety concernsEN
- 02AI companies want to embed safety evaluators, but countries need their ownEN
- 03The Download: OpenAI's chief research officer explains its hacking responseEN
- 04Kakao and AI Safety Research Institute Sign MOU for AI Safety Evaluation SystemEN
- 05Kakao, AI Safety Research Institute sign MOU to build AI safety evaluation frameworkEN
- 06Inspect: An open-source framework for large language model evaluationsEN
- 07OpenResearch: A local-first workspace for research agentsEN
- 08Chinese AI tool told researchers how to make bioweaponsEN
Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.
I contenuti sono stati preparati dalla redazione con il supporto dell'IA.
Commenti
0- Nessun commento — sii il primo.