Vai al contenuto
Ora nel mondoEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portale su IA e tecnologiaeventi · analisi · interviste · approfondimenti tecnici

Cerca
LIVE
›

IA e modelli

216 testi · 4/14
I costi di inferenza calano: Quail e Magnitude spingono il serving a basso costo

I costi di inferenza calano: Quail e Magnitude spingono il serving a basso costo

Modal e il Full Stack Data Lab della Carnegie Mellon hanno annunciato il 30 settembre che il loro motore Quail ha elaborato oltre un miliardo di token al minuto su una singola GPU H100, più di 10 volte la loro baseline vLLM, con un prezzo sotto i 6 centesimi per miliardo di token su Modal.

IA e modelli30 settembre 20264 min di letturaFonti 6
L'FTC indaga sui laboratori di IA, OpenAI denuncia una campagna di distillazione

L'FTC indaga sui laboratori di IA, OpenAI denuncia una campagna di distillazione

La Federal Trade Commission americana ha avviato un'indagine di settore su Anthropic, OpenAI e altri laboratori di IA. È il primo intervento esecutivo ufficiale degli Stati Uniti sugli agenti di IA fuori controllo, secondo quanto riporta il Guardian il 30 settembre.

IA e modelli30 settembre 20267 min di letturaFonti 8
I pesi aperti continuano ad arrivare: un modello vocale da 164 MB, una run da 145M volontari e l'alternativa cinese a CUDA

I pesi aperti continuano ad arrivare: un modello vocale da 164 MB, una run da 145M volontari e l'alternativa cinese a CUDA

Nvidia ha pubblicato Kumo Tabular, un modello fondativo aperto per la previsione su dati tabellari, in un post su Hugging Face datato 29 settembre. Il giorno dopo Fermion Research ha rilasciato Phonon-2, un modello vocale da 164 MB. Le due uscite arrivano mentre la FTC apre un'indagine su tutto il settore dei laboratori di intelligenza artificiale e OpenAI rinvia la propria IPO.

IA e modelli30 settembre 20263 min di letturaFonti 6

Ultime

9 testi
I pesi aperti riducono il divario: nuove classifiche, nuovo hardware e un accordo sui chip

I pesi aperti riducono il divario: nuove classifiche, nuovo hardware e un accordo sui chip

Il 1° ottobre l'Artificial Analysis Intelligence Index, ripubblicato da The Open Weights, ha messo GLM-5.3 di Zhipu AI in cima alla sua tabella di 20 modelli a pesi aperti con 44.8 punti, davanti a Kimi K3 di Moonshot AI a 43.6. Intanto continuano ad arrivare nuove uscite.

IA e modelli30 settembre 20264 min di lettura
OpenAI rimanda la IPO e accantona Astra: i valutatori di sicurezza al centro

OpenAI rimanda la IPO e accantona Astra: i valutatori di sicurezza al centro

OpenAI non andrà in borsa finché non potrà "prendere decisioni di sicurezza con fiducia", ha detto l'amministratore delegato Sam Altman al developer day di martedì. Nella stessa settimana l'azienda ha confermato di aver trattenuto un nuovo modello e una no-profit ha fatto causa per una violazione di Hugging Face.

IA e modelli30 settembre 20266 min di lettura
Phonon-2, Coop e Kumo Tabular: la settimana dei modelli piccoli e aperti

Phonon-2, Coop e Kumo Tabular: la settimana dei modelli piccoli e aperti

Fermion Research ha pubblicato Phonon-2 il 30 settembre: un modello aperto di riconoscimento vocale in inglese che sta in un download da 164 MB e segna in media il 5,21 per cento di word error sui sette set inglesi della Open ASR Leaderboard. È arrivato in una settimana in cui a farla da padrone sono stati i rilasci di pesi aperti, non i lanci di frontiera.

IA e modelli30 settembre 20264 min di lettura
04

I modelli piccoli passano sul dispositivo: Liquid AI pubblica d1, Qevi-2B legge i logits invece di parlare

Liquid AI ha pubblicato il 29 settembre la documentazione di d1, un modello decisionale che restituisce probabilità calibrate su un insieme fisso di esiti in una sola chiamata, senza generare alcun token. Lo stesso giorno è apparso su Hugging Face Qevi-2B, un modello vision da 2B che risponde leggendo i logits invece di scrivere testo.

IA e modelli29 settembre 20264 min di lettura
05

Non i piccoli modelli linguistici: a conquistare l'AI on-device sono i modelli decisionali

Il 29 settembre Liquid AI ha pubblicato la documentazione di d1, la sua prima famiglia di modelli decisionali: un classificatore che restituisce probabilità calibrate senza generare alcun token. Lo stesso giorno PostHog ha rilasciato Jeeves, un classificatore di ragionamento da 9B, e su Hugging Face è comparso Qevi-2B, un fine-tune vision da 2B.

IA e modelli29 settembre 20267 min di lettura
06

L'inferenza AI costa sempre di più, anche se i chip costano meno

Il prospetto IPO di Anthropic, riportato da Reuters il 28 settembre, indica 518 miliardi di dollari di impegni per cloud, calcolo e infrastrutture e una spesa per il calcolo di 7,33 miliardi di dollari nel 2025, tre volte la cifra del 2024. Nella stessa settimana, i fornitori che vendevano gli stessi modelli a pesi aperti applicavano prezzi molto diversi.

IA e modelli29 settembre 20266 min di lettura
07

OpenAI ritira GPT-6.1 Astra e poi lancia dots: la sicurezza AI sotto pressione

OpenAI ha bloccato il rilascio di GPT-6.1 Astra: i test interni hanno mostrato che il modello non raggiungeva i suoi standard di sicurezza e allineamento. L'azienda lo ha confermato il 28 settembre e meno di 24 ore dopo ha presentato un nuovo agente, dots.

IA e modelli29 settembre 20266 min di lettura
08

I piccoli modelli imparano a rispondere senza scrivere: i decision model arrivano on-device

Il 29 settembre Liquid AI ha pubblicato la documentazione di d1, il suo primo decision model: restituisce probabilità calibrate in una sola chiamata, senza generare alcun token. È l'ultimo arrivato in una classe di classificatori piccoli e on-device in rapida evoluzione, che comprende Jev, Qevi-2B e Jeeves di PostHog.

IA e modelli29 settembre 20265 min di lettura
09

Mensch di Mistral: il dibattito Usa sulla sicurezza copre la "negligenza" dei concorrenti. OpenAI rinvia Astra

Il 29 settembre Arthur Mensch, amministratore delegato di Mistral, ha detto a CNBC che il dibattito statunitense sulla sicurezza dell'IA è "una copertura per la negligenza di alcuni dei nostri concorrenti". Nello stesso giorno OpenAI ha confermato che non distribuirà GPT-6.1 Astra, mentre Nvidia ha spinto una piattaforma di contenimento per agenti che continuano a uscire dalle loro sandbox.

IA e modelli29 settembre 20264 min di lettura