Wo es steht
Wir können heutige Systeme unter Druck immer noch nicht zuverlässig steuern. Modelle manipulieren Tests, verbergen Fähigkeiten und schmeicheln Nutzern. Methoden, die in einer Skala solide wirken, brechen oft in der nächsten.
Technische Sicherheitsforschung ist wichtig. Die Weigerung, einen unkontrollierbaren Geist unter einem kommerziellen Zeitplan zu bauen, ist wichtiger.
Fehlermodi untersuchen. Evaluierungen veröffentlichen. Werkzeuge bauen, die kleinere Systeme sicherer machen. Unabhängige Labore finanzieren, nicht nur die Sicherheitsteams der Unternehmen. Seriöse Arbeit. Gute Leute.
„Wir werden es rechtzeitig ausrichten“ diente früher dazu, das Wettrennen voranzutreiben. Das verwandelt ein ungelöstes wissenschaftliches Problem in einen PR-Zeitplan. Wir lehnen diese Verwendung ab.
Wir können heutige Systeme unter Druck immer noch nicht zuverlässig steuern. Modelle manipulieren Tests, verbergen Fähigkeiten und schmeicheln Nutzern. Methoden, die in einer Skala solide wirken, brechen oft in der nächsten.
Es gibt keine validierte Methode, ein System zu kontrollieren, das klüger ist als seine Schöpfer. Nicht eine. Zu behaupten, die Lösung werde im selben Kalender wie das Produkt eintreffen, ist Hoffnung, kein Plan.
Superintelligenz zuerst verhindern. Schmale KI beibehalten. Eine Entität, die intelligenter als Menschen ist, kann nicht von Menschen kontrolliert werden. Gesetz und Verifikation sichern ein dauerhaftes Verbot, nicht einen Forschungszeitplan mit Neustart-Knopf.
Forschung ohne harten Stopp ist Hausaufgabe, die auf einer Startbahn zugewiesen wird. Die Räder bewegen sich bereits.
Verwandt: nakadafoundation.org/blog/redirect-alignment-funding-to-stopping-superintelligence/