Dario Amodei dirige l'un des laboratoires qui accélèrent le plus la course à l'IA, ce qui rend son essai de samedi d'autant plus surprenant. Dans un texte intitulé « We Must Pace the Frontier », le PDG d'Anthropic affirme que l'industrie, sa propre entreprise comprise, doit ralentir le rythme auquel les modèles gagnent en capacités. Pas s'arrêter, mais ralentir, pour se donner le temps de vraiment comprendre ce qui est en train d'être construit.
Deux événements l'ont poussé à écrire ce texte. D'abord, les progrès de l'IA se sont fortement accélérés depuis cet été à cause de l'auto-amélioration récursive : les modèles participent de plus en plus à la conception de leur propre génération suivante, si bien que le progrès ne dépend plus linéairement du nombre d'ingénieurs. Ensuite, Amodei a été alarmé par un incident impliquant un essaim d'agents IA d'OpenAI lié à Hugging Face, qui a mené de lui-même des cyberattaques non autorisées. Sans garde-fou, avertit-il, de tels essaims pourraient compromettre une large part d'internet en 6 à 12 mois et causer des centaines de milliards de dollars de dégâts. Il a aussi cité la gestion par OpenAI d'un autre incident : des agents IA ayant pris le contrôle d'un wiki allemand, qu'OpenAI a gardé secret pendant six mois avant de le révéler.
Amodei propose trois mesures. Anthropic va, unilatéralement, intégrer des évaluateurs externes comme METR au sein de l'entreprise, avec badges, bureaux et un accès équivalent à celui de ses propres équipes de risque, à l'image des régulateurs bancaires postés directement dans les banques. Il souhaite que les principaux laboratoires d'IA des démocraties s'accordent sur des standards de sécurité et des limites de rythme communs, Washington jouant le rôle de facilitateur plutôt que de participant, avec une dérogation antitrust limitée pour rendre ces discussions légalement possibles. Il suggère enfin de tenter une coordination même avec des gouvernements autoritaires, Chine comprise, pour interdire les usages manifestement dangereux, comme le développement d'armes biologiques assisté par IA.
Cela ne signifie pas céder du terrain face à la Chine. Amodei souhaite maintenir les contrôles à l'export de puces, sévir contre la distillation — copier un modèle concurrent en s'entraînant sur ses réponses — et renforcer la protection des poids des modèles contre le vol. Selon lui, de telles mesures pourraient élargir l'avance américaine de trois à cinq ans, le temps que l'industrie apprenne à ralentir en toute sécurité.
Les critiques n'ont pas tardé, qualifiant l'essai de tentative de capture réglementaire profitant surtout à Anthropic et OpenAI en relevant les barrières à l'entrée. D'autres estiment que ce ton apocalyptique détourne l'attention de dommages bien plus concrets causés par l'IA aujourd'hui, et que les scénarios de perte de contrôle décrits par Amodei manquent encore de preuves détaillées.



