Microsoft-Chef Satya Nadella hat in einem am Freitag auf X veröffentlichten Beitrag gefordert, hochentwickelte KI-Modelle grundsätzlich als kompromittiert zu betrachten. Er verlangt externe Notbremsen, eine Abkehr von undurchsichtigen Blackboxes und manipulationssichere Nachweise für alle Aktionen in Unternehmenssystemen.
Die Art und Weise, wie Unternehmen künstliche Intelligenz in ihre Netzwerke einbinden, greift nach Ansicht von Microsoft-CEO Satya Nadella zu kurz. In einer ausführlichen Grundsatzerklärung auf der Plattform X warnte er davor, fortschrittliche und agentische KI-Systeme weiterhin unkritisch zu nutzen. Angesichts ihrer tiefen Integration in geschäftskritische Prozesse seien diese Modelle wie betriebliche Insider zu behandeln, die potenziell manipuliert oder fehlerhaft sein könnten. Dabei verwies er auf die zunehmenden Gefahren, die von autonomen Systemen ausgehen. Um den wachsenden Sicherheitsrisiken wirksam zu begegnen, plädiert der Microsoft-Chef für externe Kontrollarchitekturen, nachvollziehbare Protokolle und die Einführung einer manuellen Notbremse, mit der autorisierte Personen Eingriffe jederzeit stoppen können.
Abschied von verschachtelten Blackboxes in der KI-Architektur
Im Zentrum der Kritik steht die bisherige Praxis vieler Organisationen, künstliche Intelligenz als eine Ansammlung ineinander verschachtelter Einheiten zu akzeptieren. Bei hochentwickelten Systemen arbeiten oft mehrere undurchsichtige Modelle und Orchestrierungswerkzeuge zusammen, deren interne Pfade von außen kaum nachvollziehbar sind. Anwender akzeptieren die Ratschläge solcher Systeme laut Nadella bisher allzu oft blind oder verwerfen sie pauschal. Er fordert den Aufbau eines transparenteren Systems, in dem Modelle kontrolliert und beobachtet werden können und dabei manipulationssichere, menschenlesbare Nachweise hinterlassen.

Satya Nadella erklärte: „Sie können und sollten Modelle verwenden, um sich gegenseitig adversarisch zu testen und zu überprüfen. Am Ende kann man jedoch bei einem undurchsichtigen Modell in einer undurchsichtigen Orchestrierungsschicht landen, das von einem anderen undurchsichtigen Modell überwacht wird. Im Wesentlichen sind das ineinander verschachtelte Blackboxes.
Da nicht-deterministische Modelle bei gleichen Eingaben unterschiedliche Ausgaben erzeugen können, reicht es laut Nadella nicht aus, KI-Systeme lediglich durch andere KI-Modelle überwachen zu lassen oder sich auf die interne Transparenz von Denkschleifen zu verlassen. Stattdessen fordert der Microsoft-Chef eine harte, deterministische Systemumgebung. Die strikte Trennung zwischen der eigentlichen Intelligenzquelle und den Instanzen, die über Berechtigungen und Aktionen entscheiden, bildet dabei einen wesentlichen Pfeiler seines Sicherheitskonzepts.
Das Prinzip der standardmäßigen Kompromittierung und die manuelle Notbremse
Nadella plädiert dafür, bei jedem fortschrittlichen Modell präventiv von einer Kompromittierung auszugehen und entsprechende Schutzwälle zu errichten.
Satya Nadella sagte: „Wir müssen davon ausgehen, dass ein Modell kompromittiert ist, und es von Anfang an eindämmen. Betrachten Sie es wie eine Notbremse. Eine autorisierte Person sollte jederzeit in der Lage sein, ein Modell mitten in einer Aufgabe anzuhalten oder abzuschalten.
Manipulationssichere Nachweise für jede KI-Aktion
Kein einzelnes Modell darf demnach sowohl über ein Systemverhalten entscheiden als auch die Nachweise liefern, ob dieses Verhalten der ursprünglichen Absicht entspricht.
Aus diesem Grund fordert das Unternehmen, dass jeder bedeutende Modellschritt manipulationssichere, menschenlesbare Beweise hinterlässt. Entwickler und Betreiber müssen demnach in der Lage sein, die Entstehung eines Ergebnisses exakt zu rekonstruieren, ohne sich dabei auf die bloße Selbstauskunft des Modells verlassen zu müssen.
Verwandte Artikel