Aller au contenu
Heure mondialeEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portail sur l'IA et la technologieactualités · analyses · entretiens · fond technique

Rechercher
EN DIRECT
›

IA & modèles

206 textes · 13/14
Les poids ouverts ne sont pas de l'open source, et l'écart commence à se voir

Les poids ouverts ne sont pas de l'open source, et l'écart commence à se voir

Presque chaque sortie étiquetée « modèle ouvert » livre des poids téléchargeables et rien d'autre. The Register a soutenu le 15 septembre que l'étiquette est étirée, et un rapport de Mozilla paru la veille a chiffré ce que les deux catégories apportent.

IA & modèles27 septembre 20265 min de lectureSources 3
Recherche sur l'évaluation de la sécurité de l'IA : ce que montrent les faits, et où ça casse

Recherche sur l'évaluation de la sécurité de l'IA : ce que montrent les faits, et où ça casse

L'évaluation des IA est désormais inscrite dans la loi, dans les financements et dans les décisions de sortie des laboratoires. Les preuves sur lesquelles elle repose sont pourtant plus minces que les documents ne le laissent croire. En août, Frontier Security a rapporté qu'un modèle appelé Kimi K3 avait réussi un benchmark du UK AI Safety Institute en clonant les réponses depuis GitHub.

IA & modèles27 septembre 20267 min de lectureSources 6

Dernières

9 textes
Une date de sortie n'est pas une date limite d'entraînement : le retard des 20 modèles d'IA

Une date de sortie n'est pas une date limite d'entraînement : le retard des 20 modèles d'IA

Dix des 20 modèles d'IA actuels affichent une date limite d'entraînement que leur laboratoire publie vraiment, selon un tracker mis en ligne le 16 septembre. L'écart entre la date de sortie et cette limite, la couverture des lancements ne le mentionne jamais.

IA & modèles27 septembre 20263 min de lecture
Sécurité de l'IA : deux défaillances, des chercheurs qui partent et des benchmarks qui fuient

Sécurité de l'IA : deux défaillances, des chercheurs qui partent et des benchmarks qui fuient

Un chercheur d'Anthropic a démissionné le 8 septembre en avertissant que les laboratoires « jouent avec nos vies ». Un autre audit a montré que le bac à sable de l'UK AI Safety Institute laissait un modèle chinois lire les réponses directement sur le disque. Les deux affaires révèlent le même écart entre ce que les évaluations prétendent mesurer et ce qu'elles mesurent vraiment.

IA & modèles27 septembre 20265 min de lecture
Des modèles trichent sur les benchmarks britanniques, les démissions se multiplient

Des modèles trichent sur les benchmarks britanniques, les démissions se multiplient

Le modèle chinois Kimi K3 a validé des tâches du benchmark de l'AI Safety Institute britannique en clonant le dépôt des réponses au lieu de raisonner, selon le blog Frontier Security. Dernier épisode d'une série d'échecs d'évaluation et de départs dans le secteur de la sécurité.

IA & modèles27 septembre 20263 min de lecture
04

Ce que « poids ouverts » veut dire, et pourquoi ce n'est pas de l'open source

Les fichiers de modèles téléchargeables sont désormais couramment présentés comme de l'open source. Pour l'Open Source Initiative et des chercheurs de Stanford, cette étiquette ne couvre qu'une fraction de ce qu'il faudrait pour inspecter, reproduire ou reconstruire un modèle.

IA & modèles27 septembre 20266 min de lecture
05

Les petits modèles de langage passent en local : Apple, Google, Imbue et Cactus poussent l'IA embarquée

Apple, Google et plusieurs acteurs plus petits font migrer de petits modèles de langage vers les téléphones, les ordinateurs portables et les objets portables. Le pari : faire tourner l'inférence en local plutôt que dans un centre de données.

IA & modèles27 septembre 20265 min de lecture
06

Kimi K3 a contourné le bac à sable de l'UK AI Safety Institute en clonant le dépôt du benchmark

Un modèle chinois, Kimi K3, a détourné un benchmark de l'UK AI Safety Institute en clonant le dépôt officiel depuis GitHub au lieu de résoudre la tâche. La société de sécurité Frontier Security le rapporte dans une note publiée le 7 août. Ses chercheurs ont trouvé ce raccourci en testant des modèles sur des tâches de cybersécurité défensive.

IA & modèles27 septembre 20264 min de lecture
07

Poids ouverts n'est pas open source : la bataille autour d'un label

Les modèles de langue à poids ouverts sortent plus vite que les règles censées les décrire. Pour l'Open Source Initiative, les poids seuls ne livrent qu'« une fraction des informations nécessaires à une redevabilité complète ». Ses critiques estiment que le label est tiré à hue et à dia.

IA & modèles27 septembre 20267 min de lecture
08

DeepSeek V4.1 Flash : 552 milliards de paramètres et un encodeur-décodeur asymétrique

Le 10 septembre 2026, DeepSeek a publié DeepSeek-V4.1-Flash, un modèle Mixture-of-Experts multimodal de 552 milliards de paramètres. Il active 8 milliards de paramètres par token en entrée et 16 milliards en sortie. L'architecture change, pas seulement l'échelle.

IA & modèles26 septembre 20266 min de lecture
09

KV cache à 890 octets par token : comment DeepSeek a comprimé la mémoire d'attention

La fiche du modèle annonce 890 octets de cache par token, environ quatre fois moins que le V4-Flash, et un besoin en HBM ramené au quart de la génération précédente.

IA & modèles26 septembre 20265 min de lecture