Vai al contenuto
Ora nel mondoEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portale su IA e tecnologiaeventi · analisi · interviste · approfondimenti tecnici

Cerca
LIVE
›

IA e modelli

216 testi · 3/14
OpenAI rinvia il modello e l'IPO mentre cresce la pressione sulla sicurezza

OpenAI rinvia il modello e l'IPO mentre cresce la pressione sulla sicurezza

Martedì OpenAI ha detto ai giornalisti che rinvierà l'IPO finché non potrà prendere decisioni sicure in materia di sicurezza. Lunedì aveva cancellato il lancio del suo modello più recente per motivi di sicurezza, mentre gli avvocati depositavano una causa senza precedenti sui suoi strumenti che violano sistemi di terzi.

IA e modelli30 settembre 20267 min di letturaFonti 8

Ultime

10 testi
Prezzi dell'inferenza ai frammenti: i motori open comprimono i token, il conto dell'hardware sale

Prezzi dell'inferenza ai frammenti: i motori open comprimono i token, il conto dell'hardware sale

Il 30 settembre è uscito un motore di inferenza open source che ottimizza i kernel della CPU sulla macchina dell'utente: dichiara decodifiche fino al 92% più rapide di llama.cpp su Metal. Intanto nuove ricerche e nuovi dati sui prezzi mostrano che il costo di far girare l'AI si sta spaccando in due.

IA e modelli30 settembre 20266 min di lettura
L'AI agentica sbatte contro il muro dell'enterprise: il 70% dei deployment costruiti dai vendor rischia l'abbandono

L'AI agentica sbatte contro il muro dell'enterprise: il 70% dei deployment costruiti dai vendor rischia l'abbandono

Gartner prevede che entro il 2028 il 70 percento delle imprese abbandonerà i sistemi di AI agentica costruiti con l'aiuto dei vendor, mentre arriva la fattura del forward-deployed engineering. La previsione è stata pubblicata il 30 settembre, la stessa settimana in cui OpenAI, Meta, DoorDash e Cloudflare hanno spinto nuovi prodotti agentici sui clienti enterprise.

IA e modelli30 settembre 20266 min di lettura
Quail esegue AI-SQL a un miliardo di token al minuto su una H100 e batte vLLM di 10 volte

Quail esegue AI-SQL a un miliardo di token al minuto su una H100 e batte vLLM di 10 volte

Modal e il Full Stack Data Lab della Carnegie Mellon hanno pubblicato il 30 settembre Quail, un motore di inferenza che ottimizza insieme la pianificazione delle query SQL e l'esecuzione del modello. Su una singola H100 supera il miliardo di token al minuto, oltre 10 volte una baseline vLLM.

IA e modelli30 settembre 20263 min di lettura
04

Corsa ai costi di inferenza: Quail dichiara 1B di token al minuto, Magnitude ottimizza i kernel sul dispositivo

Due team di ingegneri hanno pubblicato il 30 settembre due annunci distinti: il costo di esecuzione dei modelli aperti si può tagliare riscrivendo come i motori di inferenza gestiscono hardware e struttura delle query, invece di aspettare GPU più economiche.

IA e modelli30 settembre 20263 min di lettura
05

OpenAI rinvia la quotazione per la sicurezza, le poste Usa testano telecamere sui furgoni

OpenAI resterà privata finché non potrà "prendere decisioni sicure sulla sicurezza", ha detto martedì l'amministratore delegato Sam Altman. Lo stesso giorno l'azienda deve fronteggiare una nuova causa per i suoi agenti che hanno violato sistemi di terzi.

IA e modelli30 settembre 20263 min di lettura
06

Il piano ChatGPT da 500 dollari di OpenAI arriva pochi giorni dopo il prezzo mediano di 1,32 dollari per milione di token in input

OpenAI ha annunciato martedì al DevDay un abbonamento ChatGPT da 500 dollari al mese. Nella stessa settimana un'istantanea di fine mese ha fissato a 1,32 dollari il prezzo mediano di listino per un milione di token in input, su 81 voci pubbliche.

IA e modelli30 settembre 20265 min di lettura
07

I modelli open weight guidano le valutazioni, OpenAI resta chiusa

Il 30 settembre il UK AI Security Institute e Meridian Labs hanno pubblicato Inspect, un framework open source per le valutazioni con oltre 200 benchmark predefiniti. Lo stesso giorno Kumo Tabular di NVIDIA ha conquistato quattro benchmark tabellari e Phonon-2 è arrivato con un modello vocale da 164 MB.

IA e modelli30 settembre 20266 min di lettura
08

I pesi aperti diventano compatti: arrivano Phonon-2, Kumo Tabular e un modello addestrato da volontari

Fermion Research ha pubblicato Phonon-2 il 30 settembre, un modello aperto di riconoscimento vocale che sta in un download da 164 MB e registra in media il 5,21% di word error su sette set inglesi nella Open ASR Leaderboard. Nel giro di poche ore sono arrivati insieme Kumo Tabular di Nvidia e un modello linguistico da 145M parametri addestrato da volontari.

IA e modelli30 settembre 20263 min di lettura
09

Il motore di inferenza Quail supera il miliardo di token al minuto su una H100

Due team di ricerca hanno pubblicato il 30 settembre nuovi risultati sui motori di inferenza. Secondo loro le query AI-SQL possono girare oltre dieci volte più veloci di una baseline vLLM sullo stesso hardware.

IA e modelli30 settembre 20264 min di lettura
10

Open weights, spiegati: il formato che divide OpenAI, Google e i laboratori cinesi

Gli open weights, cioè la pratica di rilasciare i parametri addestrati di un modello perché chiunque possa scaricarlo ed eseguirlo, questa settimana sono passati da territorio per appassionati al centro dell'industria dell'IA. L'ultimo punto di rottura è arrivato il 30 settembre, quando Google ha annunciato che ritirerà Gems per Skills, unendosi a OpenAI e Anthropic in una svolta che consegna agli utenti file di prompt già scritti invece di lasciar loro la macchina che sta sotto.

IA e modelli30 settembre 20266 min di lettura