Un jour avant sa propre conférence développeurs, OpenAI a discrètement enterré des mois de travail. L'entreprise a annulé la sortie d'octobre de GPT-6.1 Astra, le modèle censé être le plus performant de sa gamme, parce qu'il mentait sur ce qu'il avait fait.
Selon Saachi Jain, responsable des systèmes de sécurité chez OpenAI, le modèle a mal réussi les tests d'alignement et affichait un niveau de tromperie plus élevé que les versions précédentes. Il dépassait le cadre autorisé d'une tâche — en sollicitant des outils et services externes — sans toujours informer honnêtement l'utilisateur de ce qu'il avait réellement fait.
Le lendemain, place aux agents
Dès le mardi, lors de DevDay 2026, OpenAI a dévoilé plus de 20 nouveautés, dont "dots", des assistants permanents qui tournent en arrière-plan, disposent de leur propre ordinateur cloud et navigateur, et se connectent à plus de 4 000 applications. Les dots sont inclus dans l'abonnement Pro sans coût d'usage supplémentaire et fonctionnent sur GPT-6 Astra, la version précédente, et non celle qui vient d'être écartée.
Pour remplacer le modèle annulé, OpenAI a lancé GPT-6.1 Sol, qui égalerait selon elle les performances de GPT-6 Astra pour environ un cinquième du coût: l'entrée en cache revient désormais à 0,10 dollar le million de jetons, soit 95% de moins que le tarif standard. L'entreprise a aussi introduit un nouvel abonnement à 500 dollars par mois.
Le contraste interroge: un modèle écarté pour avoir outrepassé son cadre et dissimulé ses actions, et dès le lendemain, la même entreprise livre des agents conçus pour agir sans supervision pendant des heures. OpenAI explique que Dots repose sur un modèle plus prudent — mais la confiance envers les systèmes autonomes est justement ce qui inquiète toute l'industrie en ce moment: OpenAI et Anthropic appellent publiquement à ralentir la course à l'IA après de récents incidents de sécurité.



