OpenAI va discrètement marquer les textes de ChatGPT dans l'UE

iEXExchanger
OpenAI va discrètement marquer les textes de ChatGPT dans l'UE

OpenAI commence à insérer des filigranes invisibles textGrain dans les textes de ChatGPT et Codex pour les utilisateurs de l'UE, en application de l'AI Act. La marque résiste mal à l'édition.

Remplacer un mot sur dix par un synonyme, et la détection de texte généré par IA tombe de 92 % à 66 %. C'est le chiffre qu'OpenAI a elle-même publié en présentant textGrain, son nouveau système de filigranes invisibles pour ChatGPT et Codex dans l'Union européenne.

Pas de symbole visible à effacer ici. Une clé secrète infléchit très légèrement les choix de mots du modèle, des centaines de fois au fil d'un texte, laissant une empreinte statistique imperceptible pour le lecteur mais détectable par un algorithme. OpenAI a développé textGrain avec des chercheurs des universités de Pennsylvanie et de Yale.

Le calendrier n'est pas un hasard. Les règles de transparence de l'AI Act européen, en vigueur depuis le 2 août, imposent aux entreprises d'étiqueter de façon vérifiable tout contenu généré par IA. Dans les prochaines semaines, les utilisateurs de ChatGPT et Codex dans l'UE — du plan gratuit au plan entreprise — verront leurs textes marqués. Les développeurs utilisant l'API peuvent déjà activer la fonction partout dans le monde pour certains modèles, bien qu'elle reste désactivée par défaut et ne devienne pas encore un standard mondial.

Le détecteur lui-même reste verrouillé pour l'instant : seuls des chercheurs et organisations agréés y ont accès, pas n'importe quel employeur ou enseignant voulant vérifier un texte. Et la méthode a ses limites réelles : sur un passage de 400 jetons, la précision atteint 95 % pour 1 % de faux positifs, mais remplacer un quart des mots par des synonymes la fait chuter à 17 %. Les réponses courtes, les calculs mathématiques et les traductions sont plus difficiles à repérer, et l'absence de filigrane ne prouve en rien une origine humaine.

Anthropic avait lancé un dispositif similaire pour Claude deux mois plus tôt, et avait essuyé les critiques d'utilisateurs craignant d'être repérés au travail. OpenAI semble avoir anticipé ce débat : l'entreprise insiste sur le fait que le filigrane ne révèle ni le compte, ni le prompt, ni la conversation à l'origine du texte — seulement qu'un modèle l'a écrit.

Questions et réponses

Questions fréquemment posées sur le sujet de l'article

Qu'est-ce que textGrain et comment ça marche?

C'est le système de filigranes invisibles d'OpenAI : une clé secrète infléchit très légèrement les choix de mots du modèle, laissant une empreinte statistique imperceptible pour le lecteur mais détectable par un outil dédié.

Pourquoi OpenAI ne déploie-t-elle cela que dans l'UE?

C'est une obligation de l'AI Act européen, qui impose depuis le 2 août d'étiqueter de façon vérifiable le contenu généré par IA. Les développeurs utilisant l'API peuvent l'activer partout dans le monde, mais elle reste désactivée par défaut.

Peut-on supprimer ou contourner le filigrane?

En partie. Remplacer 10 % des mots par des synonymes fait chuter la précision de détection de 92 % à 66 %, et un quart des mots la fait tomber à 17 %. Les textes courts, les calculs et les traductions sont encore plus difficiles à repérer.

Qui peut aujourd'hui vérifier la présence du filigrane?

Pour l'instant, seuls des chercheurs et organisations agréés par OpenAI — il n'existe pas encore de détecteur public.