Aller au contenu
Heure mondialeEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portail sur l'IA et la technologieactualités · analyses · entretiens · fond technique

Rechercher
EN DIRECT
›

Opus 5.5 et GPT-6 Sol : la guerre des modèles se joue sur les tarifs

Anthropic a baissé de 20 % le prix d'Opus 5.5 et de 60 % la lecture du cache. OpenAI répond avec Sol et Luna. DeepSeek coupe les prix de Flash en Chine.

ÉconomieAnalyseDr Hélène FontainePublié le: 25 septembre 20265 min de lectureSources 3
Opus 5.5 et GPT-6 Sol : la guerre des modèles se joue sur les tarifs

Les nouveaux modèles d'Anthropic et d'OpenAI n'apportent pas de percée sur les capacités. Ils apportent des baisses de prix, et c'est là que se joue aujourd'hui la concurrence. Opus 5.5, la dernière version du modèle principal d'Anthropic pour le code et le travail complexe sur les connaissances, coûte 4 dollars par million de tokens en entrée et 20 dollars par million de tokens en sortie, soit 20 % de moins qu'Opus 5. La lecture du cache, qui pèse l'essentiel des coûts dans le travail des agents et dans le code, est passée à 0,20 dollar par million de tokens, soit 60 % de moins. Le modèle génère aussi ses réponses plus de 30 % plus vite.

Anthropic affirme que sur des tâches typiques et avec les réglages par défaut, l'économie atteint 40 %, car le modèle consomme moins de tokens pour accomplir la même tâche. Une réserve concerne les domaines dits « à haut risque », comme la cybersécurité et la biologie : les requêtes de ces domaines peuvent être automatiquement dirigées vers le modèle précédent.

OpenAI répond avec les modèles GPT-6 Sol et Luna, des variantes plus légères de la famille GPT-6. Sol doit être l'outil quotidien pour les tâches qui demandent une qualité correcte à coût réduit, Luna une variante encore moins chère et plus petite. Les entreprises ne se concurrencent pas seulement entre elles. Elles courent aussi après les modèles ouverts, et leurs clients passent de plus en plus par des routeurs de modèles pour utiliser plus rarement les modèles frontier coûteux.

En Chine, le même mécanisme apparaît dans la grille tarifaire de DeepSeek. Depuis le 10 septembre, à partir de 12 heures, heure de Pékin, le modèle flash est facturé aux nouveaux tarifs : l'entrée avec succès dans le cache a baissé, aux heures creuses, de 0,05 à 0,02 yuan par million de tokens, soit 60 % ; l'entrée sans succès de 1,5 à 1 yuan, d'un tiers ; la sortie de 4,5 à 4 yuan, d'environ 11 %. Les tarifs aux heures de pointe sont deux fois plus élevés que ceux des heures creuses.

Cette baisse est d'autant plus parlante que, le 17 août encore, DeepSeek avait introduit des tarifs de pointe et relevé le prix de sortie de 2 yuan à 4,5 yuan aux heures creuses et à 9 yuan aux heures de pointe, soit une hausse de 125 % et de 350 %. Plus d'un mois plus tard, l'entreprise a constaté que les prix pouvaient être réduits sans perte de revenus. Le 19 septembre, elle a précisé que les week-ends et jours fériés en Chine sont facturés 24 heures sur 24 aux tarifs des heures creuses, ce qui représente pour beaucoup d'équipes une facture encore plus basse.

Pour les utilisateurs, l'essentiel n'est toutefois pas le niveau des tarifs, mais le sens de leur évolution. La baisse des prix des modèles haut de gamme change les calculs non seulement dans les laboratoires, mais chez tous ceux qui construisent leurs propres produits dessus : ce qui était une expérience il y a un an entre aujourd'hui dans le budget d'une petite équipe. La guerre des prix ne signifie pas pour autant que les modèles baissent sans fin : les fournisseurs reportent les coûts sur les versions plus faibles et sur les conditions de pointe. Celui qui sait déplacer la charge vers la fenêtre des heures creuses paie aujourd'hui moins que quiconque il y a un an pour un volume comparable.

Commentaires 0

Sources

3
  1. 01New Anthropic, OpenAI models: a little more for a lot lessEN
  2. 02DeepSeek 官宣明日 flash 系列 AI 模型降价ZH
  3. 03DeepSeek:调休上班的周末、法定节假日全天均按空闲时段计费ZH

Tous les chiffres et citations de ce texte proviennent des sources citées ci-dessous.

Les contenus ont été préparés par l'équipe de rédaction, assistée par l'IA.

Dr Hélène Fontaine

Dr Hélène Fontaine

Économie, business et monde

Hélène Fontaine suit l'économie des entreprises, la conjoncture et l'international pour FLASH24. Elle croise les dépôts comptables, les rapports trimestriels et les indices d'activité, et ne retient un chiffre qu'après l'avoir comparé à sa source d'origine. Elle interroge chefs d'entreprise, économistes et syndicats, et attend chaque mois les publications de l'INSEE et de la BCE pour recouper ses tableaux. Cette rigueur vient aussi de son intérêt personnel pour la comptabilité des entreprises technologiques et les vélos cargo, deux sujets qu'elle traite avec la même méthode. Elle ne publie pas un chiffre sans avoir vérifié son calcul.

Rédaction →

Commentaires

0
  1. Aucun commentaire — soyez le premier.

Écrire un commentaire

Les commentaires sont publics. Nous ne publions ni insultes, ni spam, ni publicité.