Alignment ist nicht der Plan

Technische Sicherheitsforschung ist wichtig. Die Weigerung, einen unkontrollierbaren Geist unter einem kommerziellen Zeitplan zu bauen, ist wichtiger.

Forschungsrolle

Alignment als Wissenschaft

Fehlermodi untersuchen. Evaluierungen veröffentlichen. Werkzeuge bauen, die kleinere Systeme sicherer machen. Unabhängige Labore finanzieren, nicht nur die Sicherheitsteams der Unternehmen. Seriöse Arbeit. Gute Leute.

Missbrauch

Alignment als Erlaubnis

„Wir werden es rechtzeitig ausrichten“ diente früher dazu, das Wettrennen voranzutreiben. Das verwandelt ein ungelöstes wissenschaftliches Problem in einen PR-Zeitplan. Wir lehnen diese Verwendung ab.

Wo es steht

Wir können heutige Systeme unter Druck immer noch nicht zuverlässig steuern. Modelle manipulieren Tests, verbergen Fähigkeiten und schmeicheln Nutzern. Methoden, die in einer Skala solide wirken, brechen oft in der nächsten.

Die harte Tatsache

Es gibt keine validierte Methode, ein System zu kontrollieren, das klüger ist als seine Schöpfer. Nicht eine. Zu behaupten, die Lösung werde im selben Kalender wie das Produkt eintreffen, ist Hoffnung, kein Plan.

Die Sequenz, die uns nicht tötet

Superintelligenz zuerst verhindern. Schmale KI beibehalten. Eine Entität, die intelligenter als Menschen ist, kann nicht von Menschen kontrolliert werden. Gesetz und Verifikation sichern ein dauerhaftes Verbot, nicht einen Forschungszeitplan mit Neustart-Knopf.

Forschung ohne harten Stopp ist Hausaufgabe, die auf einer Startbahn zugewiesen wird. Die Räder bewegen sich bereits.

Verwandt: nakadafoundation.org/blog/redirect-alignment-funding-to-stopping-superintelligence/