Artikel

Nadella: KI-Modelle als Risiko behandeln und einrahmen

Nadella fordert, KI-Modelle von Anfang an als potenzielle Gefahr zu betrachten und Systeme so zu entwerfen, dass Modelle von Steuerungs- und Ausführungsmechanismen getrennt werden. Er betont Containment, Protokollierung und gemeinsame Standards.

Nadella: KI-Modelle als Risiko behandeln und einrahmen
Lesezeit: 2 Minuten
Auf Google folgen

Microsoft-Chef Satya Nadella schrieb in einem ausführlichen Beitrag auf X, Entwickler und Regulierungsbehörden sollten fortgeschrittene KI-Modelle grundsätzlich als potenzielle Gefahr betrachten und sie mit Eindämmungsmechanismen entwickeln. Er argumentierte, die „Architektur des Vertrauens“ für KI müsse neu gedacht werden. Die bisherige Praxis, leistungsfähige Modelle als verschachtelte Blackboxen zu behandeln, reiche nicht aus.

Modelle von Kontrolle und Aufsicht trennen

Nadella erklärte, wir sollten Empfehlungen, Antworten oder Aktionen eines Modells nicht länger ohne strukturelle Schutzvorkehrungen akzeptieren. Er schlug Architekturen vor, in denen Modelle von den Systemen getrennt sind, die Aufgaben verwalten und ausführen. So könnten Eindämmungsmaßnahmen und Sicherheitskontrollen außerhalb des Modells angesiedelt werden. Diese Trennung würde, wie er schrieb, eine unabhängigere Aufsicht und Überwachung des Modellverhaltens ermöglichen.

Beim Thema Kontrollverlust empfahl Nadella, davon auszugehen, dass ein Modell von Beginn an außer Kontrolle geraten könnte, und die Eindämmung entsprechend auszulegen. Er bezeichnete dies als operative Sicherheitsanforderung: „Wir sollten davon ausgehen, dass das Modell von Anfang an außer Kontrolle ist, und wir müssen es eindämmen. Denken Sie daran wie an eine Notbremse. Eine autorisierte Person sollte jederzeit in der Lage sein, das Modell während der Ausführung einer Aufgabe zu stoppen oder herunterzufahren.“ Er ergänzte, dass leistungsfähigere Modelle fortschrittlichere Eindämmungstechnologien erforderten und gemeinsame Standards dafür entwickelt werden sollten.

Neben Stoppmechanismen forderte Nadella eine umfassende Protokollierung wichtiger Modellaktionen. Die Aufzeichnungen sollten sowohl für Menschen lesbar als auch manipulationssicher sein, damit sich Leistung und Entscheidungen überprüfen und auditieren lassen. Solche Protokolle würden, so Nadella, helfen nachzuvollziehen und zu bewerten, wie Modelle in der Praxis arbeiten.

Viele Elemente von Nadellas Vorschlägen decken sich mit Empfehlungen, die bereits an anderer Stelle in der KI-Community diskutiert wurden. Dazu zählen laut Nadella die zeitnahe Offenlegung von Vorfällen, unabhängige Prüfungen, nachvollziehbare Datenherkunft sowie Mechanismen zur Eindämmung von Modellen bei unerwartetem Verhalten.

Nadella legte in seinem Beitrag weder technische Blaupausen noch Zeitpläne vor; seine Ausführungen waren als Vorschläge und Prinzipien formuliert, nicht als konkrete politische Vorgaben. Er betonte die Notwendigkeit gemeinsamer Standards und stärkerer externer Kontrollen, um eine robustere und unabhängigere Aufsicht über fortgeschrittene KI-Systeme zu ermöglichen.

Maximilian Fischer

"KI und Software sind meine Welt. Ich erkläre komplexe Algorithmen so, dass jeder sie verstehen kann."

Kommentar hinterlassen

Kommentare

Noch keine Kommentare. Seien Sie der Erste.