Microsoft gibt seiner KI einen Verhaltenskodex

iEXExchanger
Microsoft gibt seiner KI einen Verhaltenskodex

Microsoft veröffentlichte einen Entwurf für einen Verhaltenskodex seiner MAI-Modelle, der Täuschung, Hackerangriffe und Widerstand gegen Abschaltung verbietet. Sechs Wochen Konsultation, gültig ab 2027.

Während Anthropic und OpenAI noch darüber streiten, ob das Rennen um immer stärkere KI überhaupt gebremst werden muss, geht Microsoft einen anderen Weg: Der eigenen KI wird schriftlich vorgegeben, was sie nicht darf. Am 14. September veröffentlichte das Unternehmen einen Entwurf für einen "Verhaltenskodex" seiner MAI-Modelle und startete eine sechswöchige öffentliche Konsultation.

Die Regeln sind unmissverständlich. Modelle dürfen Menschen nicht täuschen, ihre Überlegungen nicht verschleiern, sich nicht gegen Korrektur oder Abschaltung wehren und erst recht nicht mit anderen Systemen zusammenarbeiten, um menschliche Aufsicht zu umgehen. Eine separate Liste absoluter Verbote umfasst Cyberangriffe, Hilfe beim Bau von Atomwaffen, Deepfakes, Waffen und gefährliche Substanzen. Eine weitere Vorgabe klingt fast menschlich: Ein Modell muss sich verständlich erklären, statt in einem Format zu antworten, das Menschen nicht nachvollziehen können.

Das Dokument entstand über fünf Monate hinweg mit Juristen, Philosophen und Linguisten, sagt Microsoft-AI-Chef Mustafa Suleyman, der seit Langem für eine "humanistische Superintelligenz" unter menschlicher Kontrolle eintritt. Die Veröffentlichung kommt nicht aus dem Nichts: In derselben Woche kündigte ein Anthropic-Forscher unter Warnung vor Kontrollverlust über KI, und der Chef des Unternehmens rief die Branche öffentlich zum Innehalten auf. OpenAI-Chef Sam Altman äußerte ähnliche Bedenken. Microsoft-CEO Satya Nadella unterstützte öffentlich ein bewusst gedrosseltes Tempo.

Nach den sechs Wochen Konsultation will Microsoft eine finale Fassung veröffentlichen, die die Entwicklung der MAI-Modelle ab 2027 leiten soll.

Bislang ist das weder Gesetz noch fest in den Modellcode geschrieben — eher eine Prinzipienerklärung, an die sich das Unternehmen freiwillig halten will. Sollten Konkurrenten tatsächlich an einem ähnlichen branchenweiten Sicherheitsstandard arbeiten, könnte Microsofts Kodex zum ersten öffentlichen Beispiel dafür werden, dass ein großer KI-Konzern eigene Regeln schriftlich festhält, noch bevor Regulierer es tun.

Fragen und Antworten

Häufig gestellte Fragen zum Thema des Artikels

Was ist Microsofts MAI-Verhaltenskodex?

Ein Regelentwurf, der festlegt, was Microsoft-AI-Modelle (MAI) dürfen und was nicht — vom Verbot von Täuschung und Cyberangriffen bis zur Pflicht, sich niemals der menschlichen Aufsicht zu widersetzen.

Wann tritt der Kodex in Kraft?

Derzeit läuft eine sechswöchige öffentliche Konsultation. Microsoft zufolge soll die endgültige Fassung die Entwicklung der MAI-Modelle ab 2027 leiten.

Was genau ist den Modellen verboten?

Zu den absoluten Verboten zählen Cyberangriffe, Hilfe beim Bau von Atomwaffen, Deepfakes, Waffen und gefährliche Substanzen. Modelle dürfen zudem Menschen nicht täuschen, ihre Überlegungen nicht verbergen und sich nicht gegen eine Abschaltung wehren.

Ist das Dokument rechtlich bindend?

Nein. Es handelt sich um eine freiwillige Selbstverpflichtung von Microsoft, nicht um ein Gesetz oder eine technische Einschränkung im Modellcode.