OpenAI empezará a marcar los textos de ChatGPT en la UE

iEXExchanger
OpenAI empezará a marcar los textos de ChatGPT en la UE

OpenAI empieza a insertar marcas de agua invisibles textGrain en los textos de ChatGPT y Codex para usuarios de la UE, cumpliendo con la Ley de IA. La marca apenas sobrevive a la edición del texto.

Cambiar una de cada diez palabras por un sinónimo basta para que la detección de texto generado por IA caiga del 92% al 66%. Ese dato lo ha publicado la propia OpenAI al presentar textGrain, su nuevo sistema de marcas de agua invisibles para ChatGPT y Codex en la Unión Europea.

No hay ningún símbolo visible que borrar. Una clave secreta inclina ligeramente las elecciones de palabras del modelo, cientos de veces a lo largo de un texto, dejando una huella estadística imperceptible para el lector pero detectable por un algoritmo. OpenAI desarrolló textGrain junto con investigadores de las universidades de Pensilvania y Yale.

El momento no es casual. Las normas de transparencia de la Ley de IA de la UE, vigentes desde el 2 de agosto, obligan a las empresas a etiquetar de forma verificable el contenido generado por inteligencia artificial. En las próximas semanas, los usuarios de ChatGPT y Codex en la UE —desde el plan gratuito hasta el empresarial— empezarán a recibir textos marcados. Los desarrolladores que usan la API ya pueden activarlo en cualquier parte del mundo para algunos modelos, aunque viene desactivado por defecto y no se convierte todavía en estándar global.

El detector sigue cerrado por ahora: solo investigadores y organizaciones autorizadas pueden acceder a él, no cualquier empleador o profesor que quiera comprobar un texto. Y el método tiene límites reales: en pasajes de 400 tokens la precisión llega al 95% con un 1% de falsos positivos, pero si se sustituye una cuarta parte de las palabras por sinónimos, cae al 17%. Las respuestas cortas, los cálculos matemáticos y las traducciones son más difíciles de marcar, y la ausencia de la marca no demuestra que el texto sea de origen humano.

Anthropic implementó algo parecido en Claude dos meses antes, y recibió críticas de usuarios preocupados por que sus jefes detectaran textos de IA en el trabajo. OpenAI parece haberlo anticipado: insiste en que la marca no revela ni la cuenta, ni el prompt, ni la conversación detrás del texto, solo que un modelo lo escribió.

Preguntas y respuestas

Preguntas frecuentes sobre este artículo

¿Qué es textGrain y cómo funciona?

Es el sistema de marcas de agua invisibles de OpenAI: una clave secreta inclina ligeramente las elecciones de palabras del modelo, dejando un patrón estadístico imperceptible para el lector pero detectable por una herramienta específica.

¿Por qué OpenAI lo implementa solo en la UE?

Lo exige la Ley de IA de la UE, que desde el 2 de agosto obliga a etiquetar de forma verificable el contenido generado por IA. Los desarrolladores de la API pueden activarlo en cualquier parte del mundo, pero viene desactivado por defecto.

¿Se puede eliminar o evitar la marca de agua?

En parte. Sustituir el 10% de las palabras por sinónimos reduce la precisión de detección del 92% al 66%, y sustituir una cuarta parte la reduce al 17%. Los textos cortos, las matemáticas y las traducciones son aún más difíciles de detectar.

¿Quién puede comprobar hoy si un texto tiene la marca?

Por ahora, solo investigadores y organizaciones autorizados por OpenAI; todavía no existe un detector público.