Le 28 septembre, Anthropic a lancé Claude Sonnet 5.5, son deuxième modèle de la génération 5.5 en à peine une semaine, juste après le fleuron Opus 5.5. À première vue, rien de spectaculaire : une nouvelle version d'un modèle de travail. Mais les chiffres qui l'accompagnent méritent qu'on s'y attarde : la même tâche s'exécute désormais 30 % plus vite et coûte jusqu'à 30 % de moins, sans qu'Anthropic n'ait touché au prix du token.
Le tarif, justement, n'a pas bougé : 2 dollars par million de tokens en entrée, 10 dollars par million en sortie, comme pour Sonnet 5. L'économie vient du fait que le modèle a besoin de moins d'étapes, de tokens et d'appels à des outils pour arriver au même résultat. Les premiers utilisateurs le confirment : Slack rapporte 14 % de tokens de sortie en moins par tâche, Zendesk a gagné 20 % de vitesse, et Box a mesuré des traitements 2,4 fois plus rapides avec 12 % de tokens en moins.
L'écart dans les tests est encore plus frappant que ces pourcentages. Sur Terminal-Bench 4.0, le score est passé de 10,3 % pour Sonnet 5 à 70,6 % — presque sept fois plus. Sur GDPval-AA v2.1, Sonnet 5.5 obtient 1844 points contre 1846 pour Opus 5.5, bien plus onéreux : l'écart s'est quasiment effacé. Détail amusant : c'est le premier Sonnet à avoir terminé Pokémon Rouge en se basant uniquement sur des captures d'écran.
La répartition des rôles chez Anthropic reste la même : Opus 5.5 est réservé aux tâches ouvertes exigeant un raisonnement soutenu, tandis que Sonnet 5.5 s'occupe du travail quotidien bien cadré — corrections de code, documents, tableurs, présentations. Le modèle est déjà disponible via l'API d'Anthropic, AWS, Google Cloud et Microsoft Azure sous l'identifiant claude-sonnet-5-5, avec un Haiku actualisé promis pour "les prochaines semaines", sans date précise pour l'instant.
Il y a aussi un vrai compromis, qu'Anthropic ne cache pas. Sonnet hérite pour la première fois des mêmes garde-fous en cybersécurité que ceux réservés jusqu'ici à Opus et Fable, et l'entreprise reconnaît que cela peut entraîner davantage de refus, même sur des tâches de sécurité inoffensives. Juste après la baisse des prix de GPT-5.6 chez OpenAI la semaine dernière, la bataille entre laboratoires d'IA porte visiblement moins sur qui est le plus intelligent que sur qui accomplit le même travail moins cher.



