Anthropic et OpenAI ont baissé leurs prix d'IA le même jour

iEXExchanger
Anthropic et OpenAI ont baissé leurs prix d'IA le même jour

Le 22 septembre, Anthropic a lancé Opus 5.5 avec une baisse de 20% et de meilleurs résultats, tandis qu'OpenAI a divisé par deux les prix de GPT-6 Sol et Luna le même jour : la guerre des prix de l'IA s'intensifie.

Quand Anthropic a lancé Claude Opus 5 en juillet, elle avait conservé exactement le même tarif que le modèle précédent. Cette habitude a pris fin le 22 septembre. Opus 5.5 est arrivé avec une baisse de prix immédiate de 20% : le million de tokens en entrée est passé à 4 dollars, la sortie à 20, et les lectures de cache ont chuté de 60%. Comme le nouveau modèle consomme moins de tokens pour accomplir la même tâche, la facture réelle des développeurs baisse généralement d'environ 40%.

Selon Anthropic, Opus 5.5 devance Fable 5.1 — un modèle plus cher lancé seulement trois semaines plus tôt — sur les tests qui comptent pour les agents de code : 66,4% contre 55,8% sur Terminal-Bench 4.0, et un score Elo supérieur sur GDPval-AA. La vice-présidente de Box, Yashodha Bhavnani, a noté que les réponses du modèle étaient 40% plus courtes sans perte de précision, tandis que le directeur produit de GitHub, Mario Rodriguez, a souligné qu'il résolvait davantage de tâches de terminal qu'Opus 5, en deux fois moins d'étapes.

OpenAI n'est pas resté les bras croisés. Le même jour, l'entreprise a lancé deux nouveaux modèles, GPT-6 Sol et GPT-6 Luna, à des prix divisés par deux par rapport à leurs prédécesseurs. Sol coûte désormais 2 dollars par million de tokens en entrée et 10 en sortie ; Luna, 0,10 et 0,50 dollar. OpenAI a précisé qu'il s'agissait de tarifs permanents et non d'une promotion, avec en plus une réduction de 90% sur la lecture des tokens mis en cache.

Cette coïncidence de calendrier n'en est probablement pas une. Anthropic se dirige vers une entrée en bourse qui pourrait intervenir dans quelques semaines, et montrer au marché une courbe d'efficacité en baisse compte aujourd'hui plus qu'un point supplémentaire sur un classement de benchmarks. De son côté, OpenAI annonce à ses investisseurs prévoir 750 milliards de dollars de dépenses en calcul d'ici 2030 : baisser le prix du token n'est pas un geste de générosité, mais un pari sur une croissance de l'usage plus rapide que la baisse des revenus par requête.

Les deux entreprises se disputaient autrefois des points sur des tableaux de benchmarks. Le débat porte désormais sur ce que coûte réellement l'exécution d'une tâche — pas une intelligence abstraite, mais une migration de code terminée ou un ticket de support résolu. Pour toute entreprise qui paie ces API, la conclusion est simple : les prix des modèles de pointe baissent plus vite qu'ils n'ont augmenté ces deux dernières années, et la vraie concurrence entre Anthropic et OpenAI ne porte plus seulement sur la qualité des réponses, mais sur qui termine le travail au meilleur prix.

Questions et réponses

Questions fréquemment posées sur le sujet de l'article

Qu'est-ce qui a vraiment changé dans les prix de Claude Opus 5.5 et GPT-6 ?

Anthropic a baissé le prix d'Opus 5.5 de 20% (4 dollars par million de tokens en entrée et 20 en sortie) et réduit de 60% le coût de lecture du cache. Le même jour, OpenAI a lancé GPT-6 Sol (2/10 dollars par million de tokens) et Luna (0,10/0,50), à moitié prix par rapport à leurs prédécesseurs.

Pourquoi les deux entreprises ont-elles baissé leurs prix le même jour ?

C'est une question de concurrence. Anthropic se dirige vers une entrée en bourse et veut montrer au marché une baisse des coûts, pas seulement de nouvelles fonctionnalités. OpenAI, qui prévoit de dépenser 750 milliards de dollars en calcul d'ici 2030, parie qu'un usage plus important compensera la baisse des revenus par requête.

Qu'est-ce que cela signifie pour les développeurs et les entreprises ?

Les entreprises qui utilisent ces API réalisent une économie réelle — jusqu'à 40% pour les charges de travail sur Opus 5.5 et environ la moitié pour GPT-6. Cela abaisse la barrière à l'entrée pour les startups et déplace la concurrence vers le coût de réalisation d'une tâche, pas seulement la qualité de la réponse.

Cette guerre des prix peut-elle durer ?

Pas nécessairement. Entraîner et faire fonctionner ces modèles exige toujours d'énormes investissements en calcul, et les prix plus bas ne sont possibles que grâce à des modèles plus efficaces. Si la croissance de l'usage ne compense pas la baisse des revenus par requête, la pression sur les prix pourrait s'arrêter ou s'inverser.