Aller au contenu
Heure mondialeEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portail sur l'IA et la technologieactualités · analyses · entretiens · fond technique

Rechercher
EN DIRECT
›

Un traqueur amateur date 20 modèles d'IA, l'usage des modèles chinois bondit

Un traqueur amateur publié le 16 septembre liste les dates de sortie et les coupures d'entraînement de 20 modèles d'IA actuels. D'autres données montrent que les modèles chinois captent désormais la majorité des tokens sur deux plateformes de développeurs.

IA & modèlesActualitéSophie LeclercPublié le: 28 septembre 20264 min de lectureSources 2
Un traqueur amateur date 20 modèles d'IA, l'usage des modèles chinois bondit

La page s'appelle « How stale is your AI? ». Elle fait ce que la plupart des billets de lancement ne font pas : séparer le jour où un modèle est sorti du jour où ses données d'entraînement se sont arrêtées.

Le traqueur stale.jock.pl, posté sur Hacker News le 16 septembre, couvre 20 modèles répartis sur 8 laboratoires, avec des compteurs en direct depuis chaque date. Dix des 20 affichent une coupure d'entraînement que le laboratoire publie réellement. Tout l'intérêt tient à l'écart entre les deux dates. GPT-6 Astra, par exemple, est sorti le 3 septembre 2026 et ses données d'entraînement s'arrêtent au 30 avril 2026 : le modèle avait donc quatre mois de retard le premier jour, selon la page. La qualité de la documentation est très inégale. Anthropic, Google DeepMind, Meta, OpenAI et xAI ont une coupure publiée pour au moins un modèle de la page, selon le traqueur, soit 5 laboratoires sur 8. Les modèles Mistral AI et Alibaba qui y figurent affichent « Not established ». La page précise qu'il s'agit d'un blanc dans les sources vérifiées du fournisseur, et non de la preuve qu'aucune coupure n'existe.

« Un modèle peut sortir en septembre et cesser de lire en avril, ce qui veut dire qu'il a cinq mois de retard le jour de son lancement. »

La page rapporte aussi une expérience sur le comportement de recherche : plus de 2000 appels sur 16 modèles, chacun doté d'un outil de recherche web. Les modèles de pointe ont tranché correctement presque à chaque fois. Les plus faibles, eux, répondaient de mémoire à des questions déjà tranchées, alors que la réponse avait changé entre-temps, et cherchaient sur le web des choses comme le point d'ébullition de l'eau. Le résumé de l'auteur sur ce mode de défaillance est direct : « J'ai donné un bouton de recherche à 16 modèles d'IA et demandé qui est le roi de Norvège. Cinq ont nommé un mort. »

Les données d'usage vont dans l'autre sens

La fraîcheur est une grille de lecture. L'adoption en est une autre, et les chiffres y bougent plus vite. Les modèles d'IA chinois sont passés d'une petite part d'usage à une majorité sur deux grandes plateformes de développeurs qui orientent le trafic vers différents fournisseurs, selon des données d'usage transmises à CNBC et rapportées le 26 septembre. Sur OpenRouter, les modèles chinois ont représenté 57 % à 67 % des tokens utilisés la semaine du 14 septembre, contre 6 % à 13 % en février. Sur Vercel, leur part est montée à 55 % en août, contre 11 % en janvier.

Les chiffres d'OpenRouter couvrent des entreprises des États-Unis, d'Europe et de ce qu'il appelle le « Sud global », 82 pays d'Amérique centrale et du Sud, d'Afrique et d'Asie. Vercel n'a pas précisé de répartition géographique, indique CNBC. Ces dernières semaines, les entreprises du Sud global ont été les plus gros utilisateurs de modèles chinois sur le système d'OpenRouter : 67 % de leurs tokens vont vers des modèles chinois. Environ la moitié des tokens de la plateforme viennent d'entreprises américaines.

Le prix est le facteur avancé. Peter Walker, responsable des analyses chez OpenRouter, a déclaré à CNBC que les modèles chinois open source sortis cette année « peuvent réellement tenir des cas d'usage agentiques avancés, surtout en programmation, ce qui n'était tout simplement pas vrai fin 2025 », et qu'ils sont « extrêmement rentables comparés à la plupart des modèles des laboratoires américains ». Harpreet Arora, responsable de l'infrastructure agentique chez Vercel, a déclaré que les modèles chinois « deviennent assez capables pour davantage de tâches à un coût bien plus faible ».

La couche politique s'épaissit. CNBC rapporte que deux commissions de la Chambre des représentants américaine enquêtent sur l'impact de l'adoption croissante des modèles chinois, et que l'IA a été un point central lorsque le président Donald Trump et le président Xi Jinping se sont rencontrés cette semaine. Daniel Remler, chercheur senior au Center for a New American Security, a déclaré à CNBC que « la préoccupation ultime est que l'intégration des modèles d'IA chinois tire des pays dans une sphère d'influence technologique chinoise qui se durcit en alignement géopolitique ».

À côté, les éditeurs d'entreprise continuent de construire sur des poids ouverts américains. Salesforce a annoncé Koa le 15 septembre, un modèle de raisonnement CRM entraîné après coup à partir de NVIDIA Nemotron 3 Super sur un jeu de données synthétique modélisé sur près de trois décennies de déploiements CRM. Salesforce affirme que Koa égale ou dépasse les performances des principaux modèles sur son benchmark CRM avec trois fois moins d'erreurs, et qu'il contrôle les poids et exécute l'inférence à l'intérieur de son propre périmètre de confiance. Le modèle entre en pilote client avec 1-800Accountant, Baxter Credit Union, Engine, Formula 1, UChicago Medicine et Xero.

Retour au traqueur : le conseil pratique vise les agents plutôt que les humains. Collez quelques lignes dans le fichier AGENTS.md ou CLAUDE.md qu'un agent lit déjà, pour lui dire d'aller chercher models.json avant de présenter un modèle, une version ou une date comme actuels. L'export contient la date de sortie, la coupure publiée et un lien source par modèle. « Un modèle est une pauvre source sur les modèles », dit la page.

Commentaires 0

Sources

2
  1. 01How stale is your AI? Release age and training cutoff for 20 modelsEN
  2. 02Chinese AI models surge in global popularity — and Washington is worriedEN

Tous les chiffres et citations de ce texte proviennent des sources citées ci-dessous.

Les contenus ont été préparés par l'équipe de rédaction, assistée par l'IA.

Sophie Leclerc

Sophie Leclerc

IA, modèles et technologies

Sophie Leclerc couvre les technologies, l'IA et les modèles ainsi que les médias et l'internet pour FLASH24, en travaillant à partir des dépôts de code, des articles scientifiques et des documents techniques plutôt que des annonces. Elle vérifie chaque chiffre en remontant aux jeux de données d'origine et en comparant les versions successives des modèles. Elle interroge régulièrement des ingénieurs et des chercheurs, et suit les calendriers de publication des principales conférences du secteur. Son intérêt personnel pour l'auto-hébergement et les réseaux domestiques nourrit directement sa couverture des infrastructures et des modèles ouverts. Elle ne publie pas de performance annoncée sans méthode de mesure vérifiable.

Rédaction →

Commentaires

0
  1. Aucun commentaire — soyez le premier.

Écrire un commentaire

Les commentaires sont publics. Nous ne publions ni insultes, ni spam, ni publicité.