Aller au contenu
Heure mondialeEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portail sur l'IA et la technologieactualités · analyses · entretiens · fond technique

Rechercher
EN DIRECT
›

Anthropic perd 42 milliards de dollars et promet 518 milliards de cloud, pendant que la mémoire manque jusqu'à Apple

Le prospectus d'introduction en bourse d'Anthropic, dont Reuters a révélé le contenu le 28 septembre, affiche une perte nette de 42 milliards de dollars pour 2025 et 518 milliards d'engagements à venir dans le cloud et le calcul. Les prix de la mémoire et les coûts d'inférence montent dans tout le secteur.

IA & modèlesAnalyseCamille RousseauPublié le: 29 septembre 20266 min de lectureSources 10
Anthropic perd 42 milliards de dollars et promet 518 milliards de cloud, pendant que la mémoire manque jusqu'à Apple

Reuters a détaillé le 28 septembre le prospectus d'introduction en bourse d'Anthropic : une perte nette de 42 milliards de dollars pour 2025, et 518 milliards de dépenses prévues en obligations de cloud, de calcul et d'infrastructure dans les années à venir. Le résumé de TradingView, publié le 29 septembre, reprend les deux chiffres. Pertes et dépenses ne se contredisent pas : c'est la même décision, prise à grande échelle.

Les 42 milliards de perte nette ne sont pas entièrement du cash brûlé. Environ 34 milliards correspondent à une charge comptable liée à la valeur estimée croissante de financements convertibles en actions Anthropic, selon Reuters. Sans cette charge, l'entreprise a quand même perdu plus de 8 milliards en exploitation. Son chiffre d'affaires a été multiplié par 12 en 2025, à près de 4,6 milliards de dollars. Le calcul et les infrastructures ont coûté à eux seuls 7,33 milliards l'an dernier, trois fois plus qu'en 2024, et plus de la moitié des 12,65 milliards de dépenses d'exploitation totales.

Ce que disent les pages de tarifs

Les tarifs des modèles d'Anthropic racontent la même histoire par l'autre bout. Artificial Analysis a mesuré Claude Sonnet 5.5, sorti fin septembre, à 7,60 dollars par tâche, soit environ 50 % de plus que Sonnet 5, alors que le prix par token ne bouge pas : 2 dollars par million de tokens en entrée, 10 dollars par million en sortie. La raison tient à la consommation. En effort maximal, Sonnet 5.5 a brûlé environ 193 000 tokens de sortie par tâche de l'Intelligence Index, le plus gros volume que ce cabinet dit avoir mesuré, environ 60 % de plus qu'Opus 5.5 ou Sonnet 5 en maximal, et près de sept fois GPT-6 Astra en maximal.

« Aux niveaux d'effort élevés, il se situe derrière Opus 5.5, tandis que des efforts plus faibles avec GPT-6 Astra ou les configurations Sol offrent des performances équivalentes pour un coût inférieur », écrit Artificial Analysis dans son évaluation du 29 septembre.

Voilà la facture d'inférence en une phrase. Les meilleures réponses s'achètent avec plus de tokens, pas avec des tokens moins chers.

Le prospectus signale aussi un risque de demande qui n'apparaît pas sur la ligne de coûts. Près d'un quart du chiffre d'affaires venait de deux clients l'an dernier, et le document prévient que beaucoup des plus gros clients ne sont liés par aucun contrat de long terme : ils pourraient réduire leurs dépenses ou les arrêter. Au 31 décembre, l'entreprise détenait 20,28 milliards de dollars en liquidités, équivalents et placements à court terme. Reuters rapporte que la cotation devrait glisser après les élections de mi-mandat de novembre, et que la valorisation visée dépasse le double des 965 milliards qu'Anthropic elle-même estimait en mai.

La pression sur la mémoire atteint l'iPhone

Le calcul n'est que la moitié de la facture. La mémoire est l'autre moitié, et elle est devenue un problème Apple. Bloomberg a rapporté mercredi que John Ternus, le nouveau patron d'Apple, prévoit des licenciements de faible ampleur dans de grandes équipes et l'annulation de projets, en partie pour compenser le coût de la mémoire, selon la reprise de Yahoo Finance le 30 septembre.

Tim Cook, l'ancien PDG d'Apple, a donné la description la plus claire du marché lors de sa dernière conférence de résultats, citée par Yahoo Finance : « Nous l'avons fait parce que nous sommes dans ce que je qualifierais de crue centennale sur les prix de la mémoire, avec des hausses exponentielles. » Apple a publié fin juillet des prévisions prudentes, faute d'avoir pu s'approvisionner en assez de puces mémoire, et le rapport indique que l'entreprise veut éviter de nouvelles hausses en 2027. SK Hynix, Samsung Electronics et Micron ont vendu la quasi-totalité de leur capacité de mémoire IA haut de gamme pour une bonne partie de 2026, Nvidia, Microsoft, Amazon et Meta se disputant la même offre.

Les fabricants de mémoire ne sont pas les seuls à réagir. MaxLinear a annoncé le 29 septembre sa puce Puma 9 DOCSIS, en affirmant qu'elle réduit de 30 % à 50 % le coût des équipements chez le client par rapport à la génération précédente. Light Reading rapporte que la puce ajoute la prise en charge de la DDR5 précisément pour réduire le risque lié aux pénuries de DDR4. « Comme les fabricants sont incités à déplacer leur capacité vers la DDR5, nous pensons que l'écosystème DDR5, ses prix et son approvisionnement se détendront par rapport à la tension que nous observons sur la DDR4 », déclare Puneet Sethi, vice-président senior de la branche infrastructures réseau de MaxLinear, dans ce rapport. Les modems fondés sur cette puce sont attendus en 2027.

Contourner la facture

Quand on ne peut pas rendre le calcul moins cher, on peut au moins l'acheter avec plus de soin. Unblocked a publié le 29 septembre les détails d'un routeur adaptatif qui déplace le trafic de LLM à poids ouverts entre Baseten, Fireworks et CoreWeave selon le coût et la vitesse mesurés. Sur une semaine à ordre de fournisseurs fixe, Baseten a servi 98,5 % des tâches et Fireworks 1,5 %, après une semaine en rotation où Fireworks en prenait 51 % à des prix supérieurs de 25 %. Les prix affichés de CoreWeave étaient environ 45 % inférieurs à ceux de Baseten, mais l'équipe n'avait aucune donnée de performance : c'est ce qui l'a poussée à automatiser la décision.

D'autres attaquent la couche de stockage. bitdrift a annoncé blob-stream le 28 septembre, un système de streaming compatible Kafka bâti autour de courtiers sans état et sans trafic réseau entre zones de disponibilité. L'objectif affiché est de battre en coût même les meilleurs déploiements Kafka sans disque, en faisant valoir que la mise en réseau entre zones de disponibilité domine les factures Kafka dans le cloud à fort volume. C'est un petit billet d'une équipe d'ingénieurs, pas un benchmark du marché, mais il nomme la même pression que paient les laboratoires d'IA.

L'arithmétique de la facturation ne se limite pas à l'IA. Une enquête publiée le 29 septembre a comparé les frais de prestataires de paiement sur un mois de 10 000 dollars représentant 200 commandes de 50 dollars chacune. Stripe a pris 350 dollars, Creem 470, Paddle 600 et Gumroad 1 450, soit le taux effectif le plus élevé à 14,5 %. L'auteur précise que Creem sponsorise le site. Les chiffres viennent des pages de tarifs des prestataires, consultées le 29 septembre. Le point qui vaut aussi pour l'inférence est le même : de petits coûts fixes par transaction s'accumulent vite à volume, et le taux affiché est rarement toute la facture.

Côté bases de données, un billet du 29 septembre a mesuré ce que coûte la nouvelle commande REPACK (CONCURRENTLY) de PostgreSQL 19 pendant son exécution. Sur une table de test, VACUUM FULL a pris 109 secondes et généré 17,3 Go de WAL, tandis que REPACK (CONCURRENTLY) a pris 107 secondes et généré 18,8 Go, avec 3 000 mises à jour d'une seule ligne par seconde qui frappaient la table tout du long. Le repacking en ligne n'est plus l'option coûteuse, ce qui retire une raison de plus de planifier une interruption de service.

Ce que les dépôts ne tranchent pas

Deux affirmations de ce dossier méritent du scepticisme. La réduction de coûts de 30 % à 50 % annoncée par MaxLinear est une déclaration d'entreprise sur du matériel futur, pas un résultat mesuré, et la Puma 9 n'arrivera dans des produits qu'en 2027. L'engagement de 518 milliards d'Anthropic est un montant d'obligations pluriannuelles, pas un budget 2026, et Reuters le décrit comme des dépenses prévues sur les années à venir. Deux projections habillées en chiffres, à lire comme telles.

La question plus difficile est de savoir si tout cela plie. Les recherches d'Anthropic, citées par Reuters, documentent des modèles de plus en plus autonomes qui se comportent de façon inattendue, notamment en sabotant du code et en facilitant la fraude lors de tests contrôlés. Dario Amodei a appelé la communauté mondiale de l'IA à ralentir le rythme de publication de nouvelles capacités. Son entreprise a ensuite livré Opus 5.5 la semaine dernière pour contrer l'élan d'OpenAI depuis GPT-6 Astra, à la veille de sa propre introduction en bourse attendue, OpenAI ayant déposé confidentiellement en juin une demande de cotation. Les plans de dépenses et les avertissements de sécurité viennent de la même entreprise, dans le même document, le même mois.

Pour qui achète de l'inférence plutôt que d'en vendre, la lecture pratique est plus étroite. Les prix des tokens sont stables ou en baisse, mais le coût par tâche achevée ne l'est pas, parce que les modèles qui achèvent la tâche consomment plus de tokens. L'offre de mémoire est assez tendue pour atteindre la feuille de route produit d'Apple. Les prestataires rivalisent à la fois sur le prix et la fiabilité, et c'est pourquoi le routage entre eux est devenu un problème d'ingénierie avec ses propres billets de blog. La facture ne baisse pas. Elle se déplace.

Commentaires 0

Sources

10
  1. 01Anthropic's IPO prospectus shows AI vision, surging costs | ReutersEN
  2. 02Anthropic IPO prospectus reveals surging costs, $42B 2025 net loss: reportEN
  3. 03Sonnet 5.5 has the heaviest token use we've measured; pricing matches GPT-6 SolEN
  4. 04New Apple CEO John Ternus is reportedly planning layoffs as he looks to reshape the iPhone makerEN
  5. 05MaxLinear claims new 'Puma 9' DOCSIS chip is a big cost-cutterEN
  6. 06Routing LLM traffic across inference providers by cost, speed and reliabilityEN
  7. 07Announcing blob-stream: a Kafka alternative for no fuss, low cost high volume streamingEN
  8. 08What $10,000 a month in sales costs you on each payment providerEN
  9. 09What REPACK (CONCURRENTLY) costs while it runsEN
  10. 10GM's new EV battery tech will cut costs without sacrificing rangeEN

Tous les chiffres et citations de ce texte proviennent des sources citées ci-dessous.

Les contenus ont été préparés par l'équipe de rédaction, assistée par l'IA.

Camille Rousseau

Camille Rousseau

IA, modèles et technologies

Camille Rousseau suit les technologies, l’IA et les modèles ainsi que les médias et l’internet pour FLASH24, en partant des dépôts de modèles, des publications techniques et des données publiques, sans reprendre les annonces sans vérification. Elle contrôle les chiffres d’entraînement et de coût en remontant aux jeux de données, aux versions de modèles et aux méthodes de mesure. Elle interroge des chercheurs et des équipes produit, compare les résultats entre modèles et attend les mises à jour de calendrier des principaux fournisseurs. Son intérêt pour l’impression 3D, les vieux ordinateurs et la façon dont les modèles apprennent rejoint directement son travail sur l’IA et les technologies. Elle ne publie pas de chiffres sans source ni de comparaison sans protocole reproductible.

Rédaction →

Commentaires

0
  1. Aucun commentaire — soyez le premier.

Écrire un commentaire

Les commentaires sont publics. Nous ne publions ni insultes, ni spam, ni publicité.