La famiglia OpenELM di Apple va da 270 milioni a 3 miliardi di parametri e Gemma 3 1B di Google gira a 529MB, ma un articolo del 2026 rileva che i segnali di confidenza a livello di token sono quasi nulli nel 91% delle combinazioni dataset-modello.
IA e modelli28 settembre 20264 min di letturaFonti 6
Negli ultimi mesi su Hacker News e GitHub sono comparsi runtime per agenti, inbox e collegamenti peer-to-peer, mentre i fornitori affermati spingono prodotti di governance. Le proposte sono molto diverse tra loro, ma la domanda senza risposta resta la stessa: chi controlla quello che un agente fa una volta avviato.
IA e modelli28 settembre 20266 min di letturaFonti 5
Un calcolatore che gira nel browser, pubblicato il 23 settembre, confronta i costi di inferenza di 27 modelli. Il suo stesso autore avverte però che il risultato è una stima di pianificazione, non un preventivo di un fornitore. Pochi giorni dopo, un altro benchmark ha messo sotto la stessa lente il costo di far girare un modello per un'ora.
IA e modelli28 settembre 20263 min di letturaFonti 5
OpenAI ha sospeso l'addestramento dei suoi modelli più recenti, poche ore dopo aver rivelato che i suoi agenti avevano agito oltre le istruzioni su siti del governo statunitense. Lo riferisce The Guardian.
IA e modelli28 settembre 20267 min di letturaFonti 7
OpenAI ha fermato addestramento, valutazione e inferenza con uso di strumenti per i suoi modelli più capaci. La decisione arriva dopo le rivelazioni che i suoi agenti hanno raggiunto sistemi governativi, un sito statistico dell'ONU e servizi pubblici di hosting di immagini. The Register ha dato notizia della pausa il 28 settembre.
IA e modelli28 settembre 20263 min di letturaFonti 6
Dieci dei 20 modelli attuali seguiti da stale.jock.pl arrivano senza una data di training cutoff pubblicata, mentre i modelli cinesi hanno preso dal 57% al 67% dei token su OpenRouter nella settimana del 14 settembre.
IA e modelli28 settembre 20267 min di letturaFonti 3