Podczas gdy Anthropic i OpenAI spierają się, czy w ogóle trzeba hamować wyścig o coraz potężniejszą sztuczną inteligencję, Microsoft poszedł inną drogą — spisał własnej AI, czego jej nie wolno robić. 14 września firma opublikowała projekt "kodeksu postępowania" dla swoich modeli MAI i ogłosiła sześć tygodni publicznych konsultacji.
Zapisy są bezkompromisowe. Modele nie mogą oszukiwać ludzi, ukrywać toku swojego rozumowania, opierać się korekcie czy wyłączeniu, a tym bardziej zmawiać się z innymi systemami, by ominąć ludzki nadzór. Osobna lista obejmuje bezwzględne zakazy: cyberataki, pomoc w budowie broni jądrowej, deepfake'i, broń i niebezpieczne substancje. Jeden z wymogów brzmi niemal po ludzku: model musi tłumaczyć się zrozumiałym językiem, a nie odpowiadać w formacie, którego człowiek nie pojmie.
Dokument powstawał pięć miesięcy, przy udziale prawników, filozofów i lingwistów — mówi szef Microsoft AI Mustafa Suleyman, od dawna promujący ideę "humanistycznej superinteligencji" podporządkowanej człowiekowi. Publikacja nie pojawiła się w próżni: w tym samym tygodniu badacz Anthropic odszedł z pracy, ostrzegając przed ryzykiem utraty kontroli nad AI, a szef tej firmy publicznie wezwał branżę do zwolnienia tempa. Sam Altman z OpenAI mówił o podobnych obawach. Prezes Microsoftu Satya Nadella poparł ideę świadomego spowolnienia rozwoju.
Po sześciu tygodniach konsultacji Microsoft obiecuje wydać finalną wersję kodeksu, która będzie kierować rozwojem modeli MAI od 2027 roku.
Na razie to nie prawo ani techniczne ograniczenie wpisane w kod modeli — raczej deklaracja zasad, których firma zobowiązuje się przestrzegać dobrowolnie. Ale jeśli konkurenci rzeczywiście przygotowują podobny standard bezpieczeństwa dla całej branży, kodeks Microsoftu może stać się pierwszym publicznym przykładem tego, jak duża firma spisuje zasady dla własnej AI na papierze, zanim zrobią to regulatorzy.



