Mientras Anthropic y OpenAI discuten si hace falta frenar la carrera por una IA más potente, Microsoft tomó otro camino: ponerle límites por escrito a su propia inteligencia artificial. El 14 de septiembre, la compañía publicó un borrador de "código de conducta" para sus modelos MAI y abrió seis semanas de consulta pública.
Las reglas son claras. Los modelos no pueden engañar a las personas, ocultar su razonamiento, resistirse a ser corregidos o apagados, ni coordinarse entre sí para esquivar la supervisión humana. Aparte hay una lista de prohibiciones absolutas: ciberataques, ayuda para fabricar armas nucleares, deepfakes, armas y sustancias peligrosas. Otra exigencia suena casi humana: el modelo debe explicarse en un lenguaje comprensible, no en un formato que la gente no pueda seguir.
El documento tardó cinco meses en redactarse, con abogados, filósofos y lingüistas involucrados, según Mustafa Suleyman, jefe de Microsoft AI y defensor de la idea de una "superinteligencia humanista" que permanezca bajo control humano. La publicación no llega por casualidad: esa misma semana, un investigador de Anthropic renunció advirtiendo sobre el riesgo de perder el control de la IA, y el propio director de esa empresa pidió públicamente frenar el ritmo de la industria. Sam Altman, de OpenAI, expresó preocupaciones parecidas. El director de Microsoft, Satya Nadella, respaldó la idea de avanzar con más cautela.
Tras las seis semanas de consulta, Microsoft asegura que publicará una versión final que guiará el desarrollo de los modelos MAI a partir de 2027.
Por ahora no es una ley ni una restricción incorporada al código de los modelos: es más bien una declaración de principios que la empresa se compromete a seguir por voluntad propia. Pero si sus rivales están preparando de verdad un estándar de seguridad similar para toda la industria, el código de Microsoft podría convertirse en el primer ejemplo público de una gran empresa de IA poniendo sus reglas por escrito antes de que lleguen los reguladores.



