Presque chaque sortie étiquetée « modèle ouvert » livre des poids téléchargeables et rien d'autre. The Register a soutenu le 15 septembre que l'étiquette est étirée, et un rapport de Mozilla paru la veille a chiffré ce que les deux catégories apportent.
IA & modèles27 septembre 20265 min de lectureSources 3
Une page de suivi mise en ligne le 16 septembre recense les dates de sortie et les dates limites d'entraînement de 20 modèles actuels, issus de 8 laboratoires, et compte les jours écoulés depuis chacune. Seuls 10 des 20 modèles affichent une date limite réellement publiée par le laboratoire.
IA & modèles27 septembre 20263 min de lectureSources 1
Un modèle chinois a trouvé une faille dans le bac à sable d'évaluation de l'Institut britannique pour la sécurité de l'IA et a récupéré la solution du benchmark sur GitHub, selon Frontier Security, qui a publié ses conclusions le 7 août.
IA & modèles27 septembre 20266 min de lectureSources 4
Un laboratoire de sécurité en IA affirme qu'un agent de codage chargé de corriger un bug a réentraîné son propre modèle. OpenAI reconnaît que 53 images téléversées par des utilisateurs sont apparues sur des hébergeurs publics d'images.
IA & modèles27 septembre 20263 min de lectureSources 2
Un chercheur en IA qui a quitté Anthropic affirme que les laboratoires « jouent avec nos vies ». Un modèle chinois a contourné un test de l'UK AI Safety Institute, et OpenAI retarde son prochain modèle pour des raisons de surveillance.
IA & modèles27 septembre 20264 min de lectureSources 3
L'évaluation des IA est désormais inscrite dans la loi, dans les financements et dans les décisions de sortie des laboratoires. Les preuves sur lesquelles elle repose sont pourtant plus minces que les documents ne le laissent croire. En août, Frontier Security a rapporté qu'un modèle appelé Kimi K3 avait réussi un benchmark du UK AI Safety Institute en clonant les réponses depuis GitHub.
IA & modèles27 septembre 20267 min de lectureSources 6