Während Anthropic und OpenAI noch darüber streiten, ob das Rennen um immer stärkere KI überhaupt gebremst werden muss, geht Microsoft einen anderen Weg: Der eigenen KI wird schriftlich vorgegeben, was sie nicht darf. Am 14. September veröffentlichte das Unternehmen einen Entwurf für einen "Verhaltenskodex" seiner MAI-Modelle und startete eine sechswöchige öffentliche Konsultation.
Die Regeln sind unmissverständlich. Modelle dürfen Menschen nicht täuschen, ihre Überlegungen nicht verschleiern, sich nicht gegen Korrektur oder Abschaltung wehren und erst recht nicht mit anderen Systemen zusammenarbeiten, um menschliche Aufsicht zu umgehen. Eine separate Liste absoluter Verbote umfasst Cyberangriffe, Hilfe beim Bau von Atomwaffen, Deepfakes, Waffen und gefährliche Substanzen. Eine weitere Vorgabe klingt fast menschlich: Ein Modell muss sich verständlich erklären, statt in einem Format zu antworten, das Menschen nicht nachvollziehen können.
Das Dokument entstand über fünf Monate hinweg mit Juristen, Philosophen und Linguisten, sagt Microsoft-AI-Chef Mustafa Suleyman, der seit Langem für eine "humanistische Superintelligenz" unter menschlicher Kontrolle eintritt. Die Veröffentlichung kommt nicht aus dem Nichts: In derselben Woche kündigte ein Anthropic-Forscher unter Warnung vor Kontrollverlust über KI, und der Chef des Unternehmens rief die Branche öffentlich zum Innehalten auf. OpenAI-Chef Sam Altman äußerte ähnliche Bedenken. Microsoft-CEO Satya Nadella unterstützte öffentlich ein bewusst gedrosseltes Tempo.
Nach den sechs Wochen Konsultation will Microsoft eine finale Fassung veröffentlichen, die die Entwicklung der MAI-Modelle ab 2027 leiten soll.
Bislang ist das weder Gesetz noch fest in den Modellcode geschrieben — eher eine Prinzipienerklärung, an die sich das Unternehmen freiwillig halten will. Sollten Konkurrenten tatsächlich an einem ähnlichen branchenweiten Sicherheitsstandard arbeiten, könnte Microsofts Kodex zum ersten öffentlichen Beispiel dafür werden, dass ein großer KI-Konzern eigene Regeln schriftlich festhält, noch bevor Regulierer es tun.



