Microsoft rédige un code de conduite pour son IA

iEXExchanger
Microsoft rédige un code de conduite pour son IA

Microsoft a publié un projet de code de conduite pour ses modèles MAI, interdisant la tromperie, le piratage et la résistance à l'arrêt. Le texte sera débattu pendant six semaines avant 2027.

Pendant qu'Anthropic et OpenAI débattent de la nécessité de freiner la course à une IA plus puissante, Microsoft a choisi une autre approche : dicter par écrit à sa propre IA ce qu'elle n'a pas le droit de faire. Le 14 septembre, l'entreprise a publié un projet de « code de conduite » pour ses modèles MAI et ouvert six semaines de consultation publique.

Les règles sont sans détour. Les modèles ne doivent pas tromper les humains, dissimuler leur raisonnement, résister à une correction ou à un arrêt, ni s'entendre avec d'autres systèmes pour échapper à la supervision humaine. Une liste à part fixe des interdictions absolues : cyberattaques, aide à la fabrication d'armes nucléaires, deepfakes, armes et substances dangereuses. Une autre exigence sonne presque humaine : le modèle doit s'expliquer dans un langage compréhensible, et non dans un format que les gens ne peuvent pas suivre.

Le document a demandé cinq mois de travail, avec juristes, philosophes et linguistes à la table, selon Mustafa Suleyman, patron de Microsoft AI et défenseur de longue date d'une « superintelligence humaniste » qui resterait sous contrôle humain. La publication ne tombe pas du ciel : la même semaine, un chercheur d'Anthropic a démissionné en alertant sur le risque de perte de contrôle de l'IA, et le patron de cette entreprise a publiquement appelé le secteur à ralentir. Sam Altman, d'OpenAI, a exprimé des inquiétudes similaires. Le PDG de Microsoft, Satya Nadella, a soutenu l'idée d'un rythme plus mesuré.

À l'issue des six semaines de consultation, Microsoft affirme qu'une version finale guidera le développement des modèles MAI à partir de 2027.

Pour l'instant, ce n'est ni une loi ni une contrainte codée dans les modèles, plutôt une déclaration de principes que l'entreprise s'engage à suivre volontairement. Mais si des concurrents préparent réellement une norme de sécurité similaire pour toute l'industrie, le code de Microsoft pourrait devenir le premier exemple public d'un grand acteur de l'IA couchant ses propres règles sur le papier avant même les régulateurs.

Questions et réponses

Questions fréquemment posées sur le sujet de l'article

Qu'est-ce que le code de conduite MAI de Microsoft ?

C'est un projet de règles définissant ce que les modèles de Microsoft AI (MAI) peuvent et ne peuvent pas faire — de l'interdiction de la tromperie et des cyberattaques à l'obligation de ne jamais résister à la supervision humaine.

Quand le code entrera-t-il en vigueur ?

Il fait actuellement l'objet de six semaines de consultation publique. Microsoft affirme que la version finale guidera le développement des modèles MAI à partir de 2027.

Qu'est-ce qui est exactement interdit aux modèles ?

Les interdictions absolues incluent les cyberattaques, l'aide à la fabrication d'armes nucléaires, les deepfakes, les armes et les substances dangereuses. Les modèles ne peuvent pas non plus tromper les humains, dissimuler leur raisonnement ni résister à un arrêt.

S'agit-il d'un document juridiquement contraignant ?

Non. C'est une déclaration volontaire de principes de Microsoft, pas une loi ni une restriction technique intégrée au code des modèles.