Südkorea und das Vereinigte Königreich waren gemeinsam Gastgeber des AI Seoul Summit, des zweiten Treffens in der Serie, die im November 2023 in Bletchley Park gestartet wurde. Die Agenda teilte sich klar. Auf der Unternehmensspur gaben führende Entwickler öffentliche Sicherheitszusagen ab. Auf der Regierungsspur vereinbarten Staaten, die Zusammenarbeit in der Evaluationswissenschaft zu vertiefen. Was jede Spur lieferte und was jede offenließ, ist immer noch die klarste Einschätzung, wo ASI-Governance 2024 stand.
Beide Ausgaben waren echt. Keine war Gesetz.
Die Frontier-KI-Sicherheitsverpflichtungen
Das Leitdokument war die Frontier AI Safety Commitments, unterzeichnet von sechzehn großen KI-Unternehmen, darunter Entwickler aus den Vereinigten Staaten, China, dem Vereinigten Königreich und den Vereinigten Arabischen Emiraten. Die Unternehmen verpflichteten sich, Sicherheitsframeworks zu veröffentlichen, in denen sie beschreiben, wie sie Risiken von Frontier-Modellen bewerten; Schwellenwerte für Risiken zu definieren, die sie als unerträglich behandeln; und, entscheidend, keine Modelle zu entwickeln oder einzusetzen, wenn diese Schwellenwerte nicht unter dieser Linie gehalten werden können, einschließlich der Verpflichtung, zurückzutreten, wenn Mitigationen scheitern.
Die bedeutsame Verschiebung war ein öffentliches Prinzip. Führende Entwickler sagten öffentlich, dass manche Fähigkeiten zu gefährlich seien, um eingesetzt zu werden, und dass sie rote Linien definieren und danach handeln würden. Die Branche bewegte sich von vagen Zusicherungen hin zu erklärten Grenzen. Die Grenzen blieben selbst definiert.
Warum reichen freiwillige Verpflichtungen nicht aus
- Unternehmen setzen ihre eigenen Schwellenwerte. Jeder Entwickler definiert inakzeptables Risiko und wie es zu messen ist. Es gibt keinen gemeinsamen Standard und keine externe Instanz, die die Definitionen validiert.
- Keine unabhängige Verifizierung. Nichts bestätigt, dass ein internes Sicherheitskonzept eingehalten wird oder dass Bewertungen ehrlich sind. Die Einhaltung beruht auf dem Wort des Entwicklers.
- Keine Durchsetzung. Einen Schwur zu brechen, bringt allenfalls Reputationskosten. Die Schwüre sind kein Gesetz.
- Sie können überarbeitet oder fallen gelassen werden. Freiwillige Verpflichtungen unter Wettbewerbsdruck können leise erodieren, wenn ein Rivale vorauseilt. Selbstregulierung ist so fragil.
Der gängige Einwand lautet, dass es besser als nichts sei, wenn Labore sich selbst kontrollieren. Richtig, und unzureichend. Ein Versprechen, das der Versprechende allein definieren, messen und brechen kann, ist ein Platzhalter für Governance. Platzhalter helfen nur, wenn etwas Härteres sie gezielt ersetzt.
Das Netzwerk von Sicherheitsinstituten
Der Regierungs-Track brachte etwas mit dauerhafterem Potenzial hervor: Schwung in Richtung eines internationalen Netzwerks von KI-Sicherheitsinstituten. Aufbauend auf den neu geschaffenen Einrichtungen des Vereinigten Königreichs und der Vereinigten Staaten einigten sich die Staaten darauf, bei der Wissenschaft der Evaluierung von frontier-Modellen zusammenzuarbeiten, Methoden zu teilen, Tests abzustimmen und die technische Kapazität aufzubauen, die jedes künftige Verifikationsregime benötigen wird. Öffentliche Stellen, die tatsächlich beurteilen können, ob ein Modell gefährlich ist, bilden das Bindeglied, das ein Vertrag letztlich erfordert. Siehe den Leitfaden der Foundation zu was ein KI-Sicherheitsinstitut ist.
Die Seoul-Erklärung, von den versammelten Regierungen unterstützt, bekräftigte menschenzentrierte, sichere und vertrauenswürdige KI sowie die fortgesetzte internationale Zusammenarbeit. Wie der Text von Bletchley war sie eine Richtungsangabe und keine Sammlung von Verpflichtungen.
Das Muster und die Lücke
Seoul passt in ein bekanntes Muster bei der Governance gefährlicher Technologien: Anerkennung, dann freiwillige Zusage, dann (falls der Prozess gelingt) bindende Regeln. Die Unternehmenszusagen und das Institut-Netzwerk sind die zweite Stufe. Die unvollendete Arbeit ist die dritte: gemeinsame Standards, unabhängige Verifikation und rechtliche Verpflichtung.
Die Safety Institutes sind die vielversprechendste Brücke, weil die Kapazität, die sie aufbauen, genau die ist, die ein verbindliches Regime nutzen würde. Das Risiko besteht darin, dass der Gipfelprozess auf der freiwilligen Stufe stecken bleibt, dass sich die Welt mit Absichtserklärungen begnügt, weil diese leichter sind als Verträge, während die Fähigkeiten weiter voranschreiten. Seoul hat die Lücke zwischen Verpflichtung und Governance sichtbar gemacht. Sie zu schließen ist die verbleibende Aufgabe. Die Position der Foundation ist, dass dies bedeutet, von Unternehmenszusagen zu präventives internationales Recht bevor selbst definierte rote Linien unter Renn-Druck zerfallen. Weiterführende Lektüre: warum freiwillige KI-Sicherheitszusagen als alleinige Strategie scheitern.