Quand Anthropic a lancé Claude Opus 5 en juillet, elle avait conservé exactement le même tarif que le modèle précédent. Cette habitude a pris fin le 22 septembre. Opus 5.5 est arrivé avec une baisse de prix immédiate de 20% : le million de tokens en entrée est passé à 4 dollars, la sortie à 20, et les lectures de cache ont chuté de 60%. Comme le nouveau modèle consomme moins de tokens pour accomplir la même tâche, la facture réelle des développeurs baisse généralement d'environ 40%.
Selon Anthropic, Opus 5.5 devance Fable 5.1 — un modèle plus cher lancé seulement trois semaines plus tôt — sur les tests qui comptent pour les agents de code : 66,4% contre 55,8% sur Terminal-Bench 4.0, et un score Elo supérieur sur GDPval-AA. La vice-présidente de Box, Yashodha Bhavnani, a noté que les réponses du modèle étaient 40% plus courtes sans perte de précision, tandis que le directeur produit de GitHub, Mario Rodriguez, a souligné qu'il résolvait davantage de tâches de terminal qu'Opus 5, en deux fois moins d'étapes.
OpenAI n'est pas resté les bras croisés. Le même jour, l'entreprise a lancé deux nouveaux modèles, GPT-6 Sol et GPT-6 Luna, à des prix divisés par deux par rapport à leurs prédécesseurs. Sol coûte désormais 2 dollars par million de tokens en entrée et 10 en sortie ; Luna, 0,10 et 0,50 dollar. OpenAI a précisé qu'il s'agissait de tarifs permanents et non d'une promotion, avec en plus une réduction de 90% sur la lecture des tokens mis en cache.
Cette coïncidence de calendrier n'en est probablement pas une. Anthropic se dirige vers une entrée en bourse qui pourrait intervenir dans quelques semaines, et montrer au marché une courbe d'efficacité en baisse compte aujourd'hui plus qu'un point supplémentaire sur un classement de benchmarks. De son côté, OpenAI annonce à ses investisseurs prévoir 750 milliards de dollars de dépenses en calcul d'ici 2030 : baisser le prix du token n'est pas un geste de générosité, mais un pari sur une croissance de l'usage plus rapide que la baisse des revenus par requête.
Les deux entreprises se disputaient autrefois des points sur des tableaux de benchmarks. Le débat porte désormais sur ce que coûte réellement l'exécution d'une tâche — pas une intelligence abstraite, mais une migration de code terminée ou un ticket de support résolu. Pour toute entreprise qui paie ces API, la conclusion est simple : les prix des modèles de pointe baissent plus vite qu'ils n'ont augmenté ces deux dernières années, et la vraie concurrence entre Anthropic et OpenAI ne porte plus seulement sur la qualité des réponses, mais sur qui termine le travail au meilleur prix.



