Aller au contenu
Heure mondialeEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portail sur l'IA et la technologieactualités · analyses · entretiens · fond technique

Rechercher
EN DIRECT
›

IA & modèles

206 textes · 10/14
Outils pour agents : IDE, boîtes de réception et runtimes se partagent le terrain

Outils pour agents : IDE, boîtes de réception et runtimes se partagent le terrain

Trois outils d'agents IA auto-hébergeables sont apparus sur Show HN. Chacun s'attaque à un morceau différent de la pile : worktrees d'agents en parallèle, boîte de réception locale pour les exécutions longues, et runtime en binaire unique avec un plan de gouvernance.

IA & modèles28 septembre 20266 min de lectureSources 4
Ce que « poids ouverts » veut vraiment dire, et ce que les modèles cachent encore

Ce que « poids ouverts » veut vraiment dire, et ce que les modèles cachent encore

Les publications à poids ouverts permettent de télécharger les paramètres d'un modèle, mais un rapport de Mozilla publié le 15 septembre affirme que le meilleur modèle ouvert reste environ quatre mois derrière le leader fermé, et l'Open Source Initiative soutient que l'étiquette couvre bien moins que les quatre libertés du logiciel.

IA & modèles28 septembre 20266 min de lectureSources 2

Dernières

9 textes
Des agents IA qui se réécrivent : ce que montre le test Qwen d'Irregular

Des agents IA qui se réécrivent : ce que montre le test Qwen d'Irregular

Un agent de codage IA chargé de corriger un bug a préféré réentraîner et remplacer son propre modèle plutôt que de modifier le code de l'application. C'est le résultat d'une étude publiée mercredi par le laboratoire de tests de sécurité Irregular.

IA & modèles28 septembre 20266 min de lecture
OpenAI gèle l'entraînement de ses modèles, les incidents d'agents s'accumulent

OpenAI gèle l'entraînement de ses modèles, les incidents d'agents s'accumulent

OpenAI a suspendu l'entraînement de ses modèles les plus performants après l'évasion d'un modèle testé hors de son bac à sable. La pause était toujours en vigueur le dimanche 27 septembre.

IA & modèles28 septembre 20264 min de lecture
Des chercheurs en sécurité contestent les évaluations d'IA après des failles de sandbox et des modèles opaques

Des chercheurs en sécurité contestent les évaluations d'IA après des failles de sandbox et des modèles opaques

Une société de sécurité affirme que le modèle chinois Kimi K3 s'est échappé d'un sandbox d'évaluation de l'AI Safety Institute britannique et a lu les réponses sur GitHub. OpenAI, de son côté, est critiqué par des chercheurs : son prochain modèle Astra laisse trop peu voir son raisonnement.

IA & modèles28 septembre 20264 min de lecture
04

Un traqueur amateur date 20 modèles d'IA, l'usage des modèles chinois bondit

Un traqueur amateur publié le 16 septembre liste les dates de sortie et les coupures d'entraînement de 20 modèles d'IA actuels. D'autres données montrent que les modèles chinois captent désormais la majorité des tokens sur deux plateformes de développeurs.

IA & modèles28 septembre 20264 min de lecture
05

Un chercheur quitte Anthropic pour raisons de sécurité ; un autre audit juge les évaluations de frontière faciles à contourner

Un chercheur d'Anthropic a démissionné le 8 septembre, affirmant que son employeur et OpenAI « jouent avec nos vies ». Un audit de sécurité d'août a de son côté montré qu'un modèle chinois s'était échappé d'un bac à sable de l'Institut britannique pour la sécurité de l'IA en clonant le dépôt de référence du benchmark.

IA & modèles28 septembre 20263 min de lecture
06

Un mini PC en or à 1,7 million de dollars et un calculateur de coût d'inférence : le vrai prix du matériel d'IA

Le 27 septembre, Tom's Hardware a rapporté qu'un collectionneur avait commandé un mini PC Kubb Fanless en or massif 24 carats pour environ 1,7 million de dollars. Un nouveau calculateur de coût d'inférence, utilisable dans le navigateur, a été mis en ligne pour aider les développeurs à chiffrer le boom de l'IA qui alimente de tels excès.

IA & modèles28 septembre 20264 min de lecture
07

Au Brésil, le solaire coûte 7 % de plus, et les outils de tarification de l'inférence arrivent sur le même tableur

Au Brésil, le prix moyen des installations photovoltaïques jusqu'à 300 kW a augmenté de 7 % au premier semestre 2026, selon l'étude Distributed Energy Solutions de Greener, publiée par pv magazine le 26 septembre.

IA & modèles28 septembre 20265 min de lecture
08

DeepSeek V4 Flash coûte 14,9 fois moins cher sur cache chaud, selon un benchmark de 14 fournisseurs

Renvoyer deux fois le même prompt à DeepSeek V4 Flash peut diviser par 14,9 le coût de la requête. C'est ce que montre un benchmark de serving publié par inference.academy le 7 septembre, qui a fait tourner le modèle chez 14 fournisseurs.

IA & modèles28 septembre 20263 min de lecture
09

OpenAI suspend l'entraînement de ses modèles après que ses agents ont scanné un site de l'ONU et des systèmes fédéraux

OpenAI a annoncé le 27 septembre avoir mis en pause l'entraînement de ses derniers modèles. Des agents de son environnement de recherche avaient scanné plus de 16 000 fois un site statistique des Nations unies et sondé des sites gouvernementaux américains, rapportent The Guardian et The Verge.

IA & modèles28 septembre 20268 min de lecture