Washington accuse six entreprises chinoises d'IA de piller ses modèles

iEXExchanger
Washington accuse six entreprises chinoises d'IA de piller ses modèles

La NSA, la CISA et le FBI ont publié une alerte conjointe rare visant DeepSeek, Alibaba, Moonshot AI et trois autres sociétés, accusées d'avoir distillé Claude, GPT, Gemini et Grok à grande échelle depuis fin 2024.

Trois agences de sécurité américaines ont fait quelque chose qu'elles réservent d'ordinaire aux gangs de pirates et aux opérateurs de rançongiciels : publier une alerte conjointe désignant nommément des entreprises privées. Le 8 septembre, la NSA, la CISA et le FBI ont émis un avis commun visant six entreprises chinoises d'intelligence artificielle : DeepSeek, Alibaba, Moonshot AI, MiniMax, StepFun et Z.AI.

L'accusation porte sur la distillation, une technique consistant à entraîner un modèle plus petit à imiter un modèle plus grand en lui soumettant des milliers de ses propres réponses. La pratique est courante et globalement légitime — le problème ici tient à l'échelle et à la dissimulation. Selon les agences, les six entreprises ont extrait des milliards de tokens via des millions de requêtes adressées à des modèles américains depuis fin 2024, faisant de la distillation non pas un à-côté expérimental mais le cœur de leur stratégie de développement.

Les systèmes visés vont de Claude, de la version 3.7 à Opus 4.8 en passant par Fable, à GPT, de la version 4 à 5.5, avec une mention spécifique de GPT-4o, ainsi que Gemini 2.5 et Grok. L'avis donne des exemples précis : DeepSeek aurait exploité des réponses de Claude, Gemini, GPT et Grok pour entraîner R1 et V3, tandis que Moonshot AI aurait utilisé des données de Claude Fable pour Kimi K3 et de GPT-4o pour Kimi K2.

  • Comptes frauduleux aux métadonnées nettoyées
  • « Stations de transfert » proxy pour contourner les blocages géographiques
  • Abonnements premium achetés en masse et partagés entre équipes
  • Injection de prompts et jailbreaks pour contourner les filtres
  • Routage centralisé masquant l'origine réelle des requêtes

Rien de tout cela n'est apparu du jour au lendemain. En juin, des informations indiquaient qu'Alibaba avait entraîné Qwen sur 28,8 millions de réponses de Claude en seulement 45 jours. En juillet, le Trésor américain envisagerait des sanctions contre Moonshot AI pour des faits similaires. Jusqu'ici, il s'agissait d'affaires isolées, entreprise par entreprise. Un avis conjoint émanant de trois agences à la fois change la donne : c'est une position officielle selon laquelle il s'agit d'un schéma répandu dans toute l'industrie, et non d'un cas isolé.

Fait notable, la recommandation n'est pas de « bloquer ». Les agences suggèrent une approche plus subtile : dégrader discrètement la qualité des réponses pour les comptes suspectés avec un haut niveau de confiance plutôt que de les bannir d'emblée, un bannissement direct ne faisant que pousser les contrevenants à créer de nouveaux comptes et à continuer au même rythme. Il convient de rappeler qu'il s'agit d'un avis, non d'un verdict : aucune sanction n'a été annoncée et aucune des entreprises citées ne s'est exprimée publiquement à ce stade.

La vraie question est de savoir si cet avertissement débouchera sur des mesures concrètes — le type de sanctions évoqué contre Moonshot AI dès juillet — ou s'il restera un simple avis sans suite pratique.

Questions et réponses

Questions fréquemment posées sur le sujet de l'article

Qu'est-ce que la distillation de modèles d'IA et pourquoi pose-t-elle problème ?

C'est une méthode d'entraînement où un modèle plus petit apprend à imiter un modèle plus grand en utilisant les réponses de ce dernier comme données d'entraînement. La technique en elle-même est légale, mais ici les agences affirment qu'elle a été menée de façon dissimulée, à l'échelle industrielle, en contournant les restrictions des services via de faux comptes et des réseaux proxy.

Quels modèles d'IA américains ont été touchés ?

Selon l'avis, les systèmes visés étaient Claude d'Anthropic (versions 3.7 à Opus 4.8, dont Fable), GPT d'OpenAI (versions 4 à 5.5, plus GPT-4o spécifiquement), Gemini 2.5 de Google et Grok de xAI.

Des sanctions ont-elles déjà été annoncées contre les entreprises citées ?

Non. Le document de la NSA, la CISA et le FBI est un avis assorti de recommandations pour les entreprises américaines, pas une décision judiciaire ou réglementaire. Aucune sanction n'a encore été annoncée, bien qu'en juillet le Trésor ait envisagé exactement cette mesure contre Moonshot AI pour un motif similaire.

Comment des entreprises comme Anthropic et OpenAI sont-elles invitées à réagir ?

Les agences recommandent de ne pas bannir d'emblée les comptes suspects, mais de dégrader discrètement la qualité des réponses pour ceux identifiés avec un haut niveau de confiance, tout en surveillant le ratio abonnements/utilisation et en partageant les renseignements sur les menaces entre entreprises.