OpenAI suma a su consejo a un experto que teme una IA fuera de control

iEXExchanger
OpenAI suma a su consejo a un experto que teme una IA fuera de control

Paul Christiano, exjefe de investigación de alineación en OpenAI y cocreador del RLHF, se incorpora a la junta de la fundación y al comité de seguridad, en medio de crecientes temores sobre los riesgos de la IA.

Esta semana, un investigador de IA renunció calificando la carrera hacia la superinteligencia como una apuesta imprudente con vidas humanas. Casi al mismo tiempo, otro aceptó un asiento en la industria que él mismo cuestiona: OpenAI incorporó a Paul Christiano, veterano investigador de alineación, a la junta de su fundación sin fines de lucro.

Christiano no es un nombre cualquiera. Entre 2017 y 2021 dirigió la investigación de alineación en OpenAI y ayudó a desarrollar el RLHF, el aprendizaje por refuerzo con retroalimentación humana que todavía moldea el comportamiento de ChatGPT y la mayoría de los chatbots actuales. Al salir, fundó el Alignment Research Center, independiente. Hoy es asesor técnico senior en el CAISI, la unidad del Departamento de Comercio de EE. UU. que evalúa modelos de IA y redacta pautas de seguridad para el gobierno.

El nuevo cargo le da tres funciones a la vez: un puesto en la junta de la fundación sin fines de lucro, que tras la reestructuración del año pasado conserva el 26% de la empresa con fines de lucro OpenAI Group PBC; membresía en el Comité de Seguridad y Protección, presidido por Zico Kolter; y un puesto de observador sin voto en la junta comercial. Se abstendrá en cualquier asunto relacionado con su trabajo en el Departamento de Comercio o con evaluaciones de modelos.

Christiano no suaviza sus advertencias. Sostiene que, sin un desarrollo más lento, la industria corre el riesgo de una 'pérdida de control catastrófica e irreversible', y que los sistemas diseñados para crear a sus sucesores podrían acabar superando la capacidad humana de dirigirlos. En 2023 calculó entre un 10% y un 20% la probabilidad de que la IA se descontrole y acabe con buena parte de la humanidad.

El nombramiento no resuelve la tensión de fondo entre velocidad y cautela. Pero una de las voces más críticas con los riesgos de la IA ahora se escucha dentro de la sala del consejo, no solo desde fuera.

Preguntas y respuestas

Preguntas frecuentes sobre este artículo

¿Quién es Paul Christiano?

Un investigador de alineación que dirigió esa área en OpenAI entre 2017 y 2021 y ayudó a desarrollar el RLHF. Tras salir, fundó el independiente Alignment Research Center. Hoy es asesor técnico senior en el CAISI, del Departamento de Comercio de EE. UU.

¿Qué es el Comité de Seguridad y Protección de OpenAI?

Un órgano a nivel de junta que supervisa las decisiones de la empresa sobre cuestiones críticas de seguridad de modelos e infraestructura. Lo preside Zico Kolter, profesor de Carnegie Mellon.

¿Qué es el RLHF y por qué importa?

El aprendizaje por refuerzo con retroalimentación humana es un método de entrenamiento que ajusta las respuestas de los modelos de lenguaje para que coincidan con lo que esperan las personas. Es la base del comportamiento de ChatGPT y la mayoría de los chatbots actuales.

¿Está relacionado con la renuncia del investigador de Anthropic?

No directamente: son dos hechos independientes en empresas distintas. Pero ocurrieron casi al mismo tiempo y reflejan la misma tendencia: la creciente tensión en la industria de la IA entre la velocidad de desarrollo y las exigencias de seguridad.