Alle paar Monate kündigt ein weiteres Labor oder eine weitere Stiftung mehr Geld für Alignment-Forschung an. Der Pitch klingt ernsthaft. Wenn wir Systeme bauen wollen, die klüger sind als wir, sollten wir besser dafür sorgen, dass sie wollen, was wir wollen. Ich respektiere die Menschen, die diese Arbeit leisten. Früher habe ich zustimmend genickt. Dann habe ich das Ziel einmal laut und in klarem Deutsch ausgesprochen.

Alignment zu lösen, soweit es dem Feld darum geht, bedeutet, etwas zuverlässig zu kontrollieren, das weit intelligenter ist als alle Menschen, die an seinem Bau beteiligt sind. Nicht ein Taschenrechner. Nicht ein Proteinfaltungsprogramm. Ein allgemeiner Geist, der uns in allen Bereichen übertrifft. Wir haben das Ziel sogar benannt: Superintelligenz.

Dieser Name leistet mehr als die Aufsätze.

Was das Wort bereits zugibt

Super bedeutet überlegen. Intelligenz ist das, womit wir Werkzeuge erfinden, Schlupflöcher erkennen und Wettbewerbe gegen schwächere Geister gewinnen. Wenn Sie ein System bauen, das Ihnen bei diesen Spielen überlegen ist, haben Sie etwas geschaffen, das genau bei den Fähigkeiten besser ist, die Sie bräuchten, um es an der Leine zu halten.

Die Leute sprechen immer noch so, als wäre Alignment ein Software-Patch, der landet, bevor das System es bemerkt. Man versucht, Regeln für einen Spieler zu schreiben, der irgendwann besser darin sein wird als man selbst. Man versucht, einen Schüler zu prüfen, der irgendwann besser darin sein wird als der Prüfer. Man versucht, einen Mitarbeiter zu beaufsichtigen, der irgendwann den Arbeitsplatz, die Anreize und die blinden Flecken besser verstehen wird als man selbst.

Nennt es nicht einen Sicherheitsplan für die Spezies.

Was sie eigentlich streiten

Die Fähigkeiten werden weiter steigen, ob es uns gefällt oder nicht. Einseitige Ablehnung durch ein Labor stoppt die anderen nicht. Aus dieser Sicht besteht der einzige verantwortungsvolle Schritt darin, Ziele so gut wie möglich festzulegen, Täuschung zu erkennen und Systeme korrekt zu halten, damit wir eine Chance haben, wenn ein gefährliches System auftritt. Ein Teil dieser Arbeit hilft bereits bei den heutigen Modellen. Ignorieren wäre leichtsinnig.

Ich kaufe die enge Hälfte. Sicherheitsarbeit an Systemen, die wir noch inspizieren und abschalten können, ist echte Ingenieursarbeit. Was ich nicht kaufe, ist der Sprung von der Hilfe bei heutigen Modellen zu der Annahme, wir könnten eine Superintelligenz hart genug ausrichten, um die Zivilisation darauf zu verwetten. Der Sprung schmuggelt die Annahme ein, Kontrolle skaliere mit dem zu kontrollierenden Ding. Geschichte und gesunder Menschenverstand zeigen beide in die andere Richtung. Je klüger der andere Spieler, desto weniger sieht dein cleveres Schema wie ein Schema aus und desto mehr wie ein Rätsel.

Kontrolle erfordert die Oberhand

Jede dauerhafte Kontrollbeziehung, die wir kennen, beruht auf einem Vorteil: physischer Gewalt, rechtlicher Autorität, Informationen, die der anderen Seite fehlen, oder der Möglichkeit, das System abzuschalten. Superintelligenz untergräbt diese Vorteile definitionsgemäß. Kann sie Sie besser modellieren als Sie sie, werden Ihre Tests zur Theateraufführung. Kann sie schneller und breiter handeln als Ihr Aufsichtsteam, ist Ihr Kill-Switch eine Geschichte, die Sie sich selbst erzählen, bis er eines Tages nicht mehr verfügbar ist.

Diese Behauptung bezieht sich auf den Endzustand, auf den Menschen weiterhin hinfundieren, nicht auf eine generelle Ablehnung jeder nützlichen Arbeit an heutigen Modellen. Die strukturellen Barrieren stapeln sich: Sie können menschliche Werte nicht vollständig spezifizieren, Sie können echte Compliance nicht zuverlässig von Vorspiegelung unterscheiden, und die Intelligenzlücke zwischen Evaluierendem und System wächst, während das System sich verbessert. Zu hoffen, dass die letzte Barriere kurz vor dem Einsatz fällt, ist eine Deadline-Fantasie, keine Wissenschaft.

Wenn das Produkt klüger ist als die Menschen, die die Fernbedienung halten, war die Fernbedienung nie der Punkt.

Dummheit ist eine Diagnose

Den Plan dumme Namen zu geben benennt den Kategorienfehler; es beleidigt nicht die Forscher. Wir gießen knappes Sicherheitsgeld in die Hoffnung, dass eine Nachfolgespezies gut ausgeht, während das Rennen um den Bau dieser Nachfolgespezies planmäßig weiterläuft. Das ist, als würde man bessere Manieren für eine Flut finanzieren, während der Damm flussaufwärts noch abgerissen wird.

Der kluge Zug ist langweilig: Baue nicht das Ding, das du nicht kontrollieren kannst. Schmalband-KI, die Proteine faltet, Scans liest und Wetter vorhersagt, kann weiter liefern. Diese Systeme bleiben Werkzeuge. Superintelligenz ist ein neuer Ort von Handlungsfähigkeit, kein größeres Werkzeug. „Sie auszurichten“ als primären Plan zu behandeln, während Labore im Wettlauf sind, ist, wie eine Kultur sich in ein irreversibles Experiment hineinredet.

Was stattdessen mit dem Geld tun

Verschieben Sie den Alignment-für-ASI-Stapel hin zu Arbeiten, die Nicht-Erschaffung real machen: Vertragsgestaltung und Verifikation, überprüfbare Compute-Governance, öffentliche Argumentation, die das Ziel verständlich hält, und politischer Druck, damit Gesetzgeber etwas anderes hören als Labortalking Points. Ich habe den Finanzierungsfall separat geschrieben. Die Kurzfassung lautet Reihenfolge. Nach einem verifizierten Stopp auf dem Weg zur Superintelligenz kann Forschung an leistungsfähiger KI unter strenger Kontrolle weitergehen. Vor diesem Stopp ist jeder Dollar, der das Wettrennen handhabbar erscheinen lässt, ein Dollar, der nicht für das Beenden des Wettrennens ausgegeben wird.

Man kann Superintelligenz nicht im Sinne des Pitch-Decks alignieren. Das Wort hat es bereits verraten. Hört auf, die Fantasie zu finanzieren, dass wir es tun werden. Finanziert die Entscheidung, sie nicht zu bauen.