Microsoft veröffentlicht 38-seitigen MAI-Modell-Code

Ein 38-seitiges Dokument beschreibt die Möglichkeiten und Grenzen von MAI-Modellen sowie die Autorität zur Deaktivierung. Die öffentliche Konsultation dauert sechs Wochen.
Eine Verfassung für die Modelle
Am Montag, den 14. September, veröffentlichte Microsoft AI die erste Version des Humanist AI Code of Conduct, ein 38-seitiges Dokument, das beschreibt, wie die MAI-Modelle operieren sollen, was sie unter keinen Umständen tun dürfen und wer die Autorität hat, sie abzuschalten. Mustafa Suleyman, CEO der Microsoft AI-Sparte, sagte der Reuters, der Text sei "eine Art Verfassung" für die zukünftigen Modelle des Unternehmens. Der Entwurf wird für sechs Wochen zur öffentlichen Konsultation bereitstehen, und eine zweite Version ist für Ende 2026 vorgesehen, mit dem Versprechen, die Entwicklung ab 2027 zu leiten.
Was die Modelle nicht tun dürfen
Der Code verbietet ohne Ausnahme drei Dinge: die Entwicklung von QBRNE-Waffen (chemisch, biologisch, radiologisch, nuklear oder explosiv), die Durchführung von Cyberangriffen oder die Erzeugung nicht einvernehmlicher Deepfakes. Es handelt sich um eine kürzere Liste als die, die Anthropic und OpenAI in ihren eigenen Richtlinien veröffentlichen, und das ist kein Unfall. Ein kurzer Katalog zwingt das Modell dazu, wenige und strenge Fälle zu erleiden, anstatt Millionen legitimer Anfragen abzulehnen, was eine ständige Beschwerde von Unternehmenskunden ist, die GPT und Claude über die API kaufen. Für den CISO, der versucht, Standards zwischen drei LLM-Anbietern zu harmonisieren, wird der Text von Microsoft zur Verhandlungsbasis: Kunde und Anbieter haben nun eine gemeinsame Karte, welche Ablehnungen absolut sind und welche konfigurierbare Präferenzen darstellen.
Menschliche Unterbrechung als unhintergehbare Klausel
Der strikteste Abschnitt des Dokuments ist nicht die Liste der Verbote, sondern die Anforderung, dass jedes MAI-System Unterbrechungen, Korrekturen, Umleitungen und Abschaltungen durch einen menschlichen Operator akzeptieren muss. Wenn eine Aufgabe nur durch eine Regelverletzung erfüllt werden kann, muss das Modell die Aufgabe misslingen lassen, nicht die Regel. Dies verändert die Referenzarchitektur, die Microsoft Banken verkauft: agentenbasierte Systeme, die Ende-zu-Ende arbeiten, ohne Mensch im Prozess, benötigen einen vom Kunden auditierbaren Abschalt-Haken, nicht nur vom Anbieter. Dies ist die direkte Antwort auf die Debatte, die Anthropic mit dem Konzept der "constitutional AI" eröffnet hat und auf die OpenAI mit dem Model Spec reagiert hat. Microsoft ist in diesem dokumentarischen Rennen zwar Dritter, hat jedoch etwas mitgebracht, was Anthropic noch nicht formalisiert hat: einen öffentlichen Kommentierungszyklus mit festgelegtem Zeitrahmen.
Das Gegenargument, das Microsoft veröffentlichen musste
Das größte Risiko des Dokuments ist nicht technischer Natur, sondern politischer. Laut Forschern, die von Unite.AI zitiert werden, kann eine kurze Liste von Verboten ein falsches Sicherheitsgefühl erzeugen und sekündäre Risiken auslassen: Missbrauch von Trainingsdaten, algorithmische Diskriminierung bei der Einstellung, psychologische Abhängigkeit von Konversationsagenten. Suleyman antizipierte einen Teil dieser Kritik, indem er Microsoft als Unterzeichner des Prinzips "KI, die dem menschlichen Benutzer untergeordnet ist" definierte, aber Antizipation ist keine Antwort. Ein Präambel, die sich als humanistisch erklärt, neutralisiert keine Auslassungen im Hauptteil der Regel, und die endgültige Version wird wählen müssen: die sekundären Risiken einbeziehen und die kommerziellen Kosten der zusätzlichen Ablehnungen übernehmen oder den engen Rahmen beibehalten und ein Beispiel für die Erfassung der Unternehmensagenda zur verantwortungsvollen KI werden.
Unternehmenslesung: Zwei Märkte im Spiel
Microsoft benötigt dieses Dokument, um autonome Agenten an den regulierten Sektor zu verkaufen. In Brüssel fordert der EU AI Act von Anbietern hochriskanter Systeme die Veröffentlichung interner Sicherheitsrichtlinien, die von Dritten auditierbar sind, und die Europäische Kommission hat bereits signalisiert, dass sie freiwillige Codes als Teil der Einhaltung akzeptiert. In den Vereinigten Staaten hat das von der aktuellen Verwaltung unterzeichnete Paket von Exekutivbefehlen die Berichterstattung über Sicherheitsvorfälle in Frontier-Modellen zur Pflicht gemacht, und ein öffentlicher Verhaltenskodex dient als Anker, um Sorgfalt nachzuweisen. In Brasilien, wo der PL 2338 weiterhin blockiert ist, wird Suleymans Text zu einem Lobby-Instrument: Banken und Versicherer werden ihn als Beweis anführen, dass private Selbstregulierung möglich ist, und drücken auf Brasília, die restriktivere europäische Version nicht zu kopieren. Wer öffentliche Politik im Land schreibt, wird die nächsten sechs Wochen damit verbringen, die 38 Seiten zu lesen.