L'introduction en bourse d'Anthropic chiffre à 518 milliards de dollars les coûts d'inférence de l'IA
Le prospectus d'introduction en bourse d'Anthropic, rapporté par Reuters le 29 septembre, fait état de 518 milliards de dollars d'engagements cloud et d'infrastructure et d'une perte nette de 42 milliards de dollars pour 2025. Les coûts d'inférence et de calcul ne sont plus une ligne comptable : ils sont le modèle économique.

Le chiffre qui compte dans le dossier d'Anthropic n'est pas la valorisation, que Reuters estime pouvoir dépasser 2 000 milliards de dollars. C'est la somme de 518 milliards de dollars que l'entreprise prévoit de dépenser en engagements cloud, informatiques et d'infrastructure dans les années à venir. Reuters a publié ce chiffre le 29 septembre en citant le prospectus qu'il dit avoir consulté, et dont la reprise par CNBC résume le contenu.
Le même document enregistre une perte nette de 42 milliards de dollars pour 2025. Le chiffre d'affaires a été multiplié par 12 pour atteindre près de 4,6 milliards de dollars, tandis que la perte d'exploitation, hors dépréciations liées à des levées de fonds antérieures, a dépassé 8 milliards de dollars. Anthropic a dépensé 7,33 milliards de dollars en calcul et infrastructure l'an dernier, trois fois plus qu'en 2024, et plus de la moitié de ses 12,65 milliards de dollars de charges d'exploitation totales.
Le prix d'un token n'est pas le prix du GPU
Ces chiffres ressemblent à une facture de GPU. Ils ne le sont pas. Meetrix.io a relevé les prix catalogue à la demande le 28 septembre : un H100 à 6,88 dollars l'heure sur AWS contre 10,98 dollars sur GCP, soit environ 37 % moins cher, le chiffre AWS provenant du tracker EC2 de Vantage. La même analyse situe le coût par million de tokens à 0,76 dollar sur un H100 pleinement occupé et à 3,06 dollars à 25 % d'utilisation. Elle s'appuie pour cela sur un débit de 2 500 tokens par seconde, que Meetrix.io présente lui-même comme une hypothèse de travail. Le rapport, un écart d'un facteur quatre, ne dépend pas de cette hypothèse. Aucun changement de cloud ne produit un tel écart.
GPUAdvisor, qui dit suivre 14 fournisseurs et a actualisé son tableau le 1er octobre, liste les tarifs par GPU chez AWS, GCP, Azure, Lambda, CoreWeave, RunPod, Nebius et d'autres. Il note que les clouds spécialisés dans le GPU affichent des prix par GPU deux à quatre fois inférieurs à ceux des hyperscalers. Sa conclusion principale est plus étroite qu'il n'y paraît : la tarification a cessé de se comporter comme un tableau de correspondance. La comparaison ne tient donc que si l'on vérifie la page du fournisseur avant d'engager un budget.
Anthropic ne fait pas ses achats sur le seul critère du prix. Son prospectus indique que près d'un quart du chiffre d'affaires provenait de deux clients l'an dernier, et il avertit que nombre de ses plus gros clients ne sont pas liés par des contrats à long terme.
Le routage, et non l'achat, concentre les économies
Unblocked a publié ses propres chiffres le 29 septembre. L'entreprise décrit un routeur qui déplace le trafic entre Baseten, Fireworks et CoreWeave, tous servant le même modèle à poids ouverts. En round-robin, Fireworks a servi 51 % des tâches à des prix 25 % plus élevés que ceux de Baseten, et plus lentement. Un ordre fixe a poussé Baseten à 98,5 % des tâches, mais chaque changement exigeait un déploiement. La version adaptative note les fournisseurs 0,7 sur le coût et 0,3 sur la vitesse, et publie un résumé dans Redis toutes les cinq minutes, ce qui évite tout appel réseau par requête. Les prix catalogue de CoreWeave étaient environ 45 % inférieurs à ceux de Baseten, et le routeur pouvait l'échantillonner sans intervention humaine.
Artificial Analysis, dans une note du 29 septembre, ajoute une variable du côté du modèle. Claude Sonnet 5.5, facturé 2 dollars par million de tokens en entrée et 10 dollars par million en sortie, atteint 56 sur son Intelligence Index. Il consomme toutefois environ 193 000 tokens de sortie par tâche à effort maximal, le plus lourd qu'Artificial Analysis ait mesuré, soit environ sept fois GPT-6 Astra (max). Le coût par tâche s'établit à 7,60 dollars, environ 50 % de plus que Sonnet 5.
Les deux séries de chiffres ne se contredisent pas : elles ne mesurent pas la même chose, à savoir le prix catalogue par heure de GPU et le coût par tâche achevée. Meetrix.io précise clairement qu'il n'a pas évalué le débit et que son chiffre de tokens par seconde est une hypothèse de travail. L'engagement de 518 milliards de dollars d'Anthropic est un contrat, pas un benchmark.
Sources
5- 01Anthropic's IPO prospectus shows AI vision, surging costs | ReutersEN
- 02GPU Costs for LLM Inference: AWS vs GCP (2026)EN
- 03Cloud GPU Pricing - Cost Intelligence for H100, A100 & B200EN
- 04Routing LLM traffic across inference providers with TCP-style congestion controlEN
- 05Sonnet 5.5 has the heaviest token use we've measured; pricing matches GPT-6 SolEN
Tous les chiffres et citations de ce texte proviennent des sources citées ci-dessous.
Les contenus ont été préparés par l'équipe de rédaction, assistée par l'IA.
Commentaires
0- Aucun commentaire — soyez le premier.