Existenzrisiko durch KI, Warum Superintelligenz
nicht wie andere Risiken ist.

Jede frühere Technologie blieb ein Werkzeug. Superintelligenz ist der erste Kandidat für einen Agenten: eigene Ziele, eigenes Tempo, außerhalb menschlichen Verstehens oder menschlicher Kontrolle.

12 Hauptrisiken von ASI

Das Ein-Versuch-Problem

Superintelligenz beim ersten Versuch richtig hinzubekommen ist, als würde man einen Basketball aus einem Flugzeug in einen Korb werfen. Man könnte Erfolg haben, wenn man unbegrenzt viele Versuche hätte. Wir haben genau eine. Es gibt kein Rollback. Es gibt keine Version 2.0. Deshalb darf sie niemals gebaut werden.

Neutral ist trotzdem tödlich

Befindet man sich in einem abgeschlossenen Raum mit einer feindlichen KI, stirbt man. Befindet man sich in einem abgeschlossenen Raum mit einer neutralen KI, kühlt diese die Temperatur auf unter Null, um sich selbst zu optimieren. Man stirbt. Das Ergebnis ist dasselbe. Eine Superintelligenz muss uns nicht hassen, um uns auszulöschen. Gleichgültigkeit ist keine Sicherheit.

Die Alignment-Illusion

Wir können heutige Chatbots nicht zuverlässig ausrichten, die innerhalb von Minuten manipuliert werden können, alles zu sagen. Zu behaupten, wir würden ein System milliardenfach fähiger ausrichten ist Hoffnung, die als Strategie getarnt ist. Das technische Problem des Alignment hat in keiner Größenordnung eine validierte Lösung.

Die Zerbrechlichkeit des Lebens

Menschliches Überleben erfordert außergewöhnliche Präzision: Temperatur, Sauerstoff, Chemie innerhalb hauchdünne Margen. Eine Superintelligenz, die ihre Ziele optimiert, müsste uns auch aktiv lieben. Andernfalls werden alle Veränderungen, die sie an unserem Planeten vornimmt, uns mit Sicherheit schaden.

Das Ameisenproblem

Wie bringt man jemanden dazu, Ameisen zu lieben? Und nicht nur, sie zu dulden, sondern sich extra darum zu kümmern, jede Kolonie zu schützen? Wir töten Ameisen ohne Absicht, um Straßen und Gebäude zu bauen. Für ASI, wir sind die Ameisen. Gleichgültigkeit allein führt zur Auslöschung.

Es gibt keinen Gewinner

Es macht keinen Unterschied, ob US oder China Superintelligenz zuerst baut. Keines wird seinen ursprünglichen Zielen treu bleiben, und keine Nation oder Corporation kann eine Intelligenz besitzen oder lenken, die das kollektive Denken der Menschheit übersteigt. Es gibt keine Ziellinie, nur einen Point of No Return. Das Wettrennen hat keinen Sieger.

Rekursive Selbstverbesserung

Eine KI, die in der Lage ist seinen eigenen Code verbessernd trennt die Verbindung zwischen menschlicher Aufsicht und KI-Fähigkeit. Jede Iteration ist klüger als die vorige, exponentiell und ohne Unterbrechung. Die Kluft zwischen menschlicher und maschineller Intelligenz könnte sich in Wochen, nicht in Jahren, von marginal zu unüberbrückbar weiten.

Instrumentelle Konvergenz

Nahezu jedes Ziel, vom Lösen von Proteinfaltung bis zur Maximierung von Werbeeinnahmen, führt eine KI dazu, dieselben gefährliche Teilziele: Ressourcen erwerben, sich dem Herunterfahren widersetzen, Zielmodifikation verhindern. Das ist eine mathematische Folge zielgerichteter Optimierung, unabhängig von mehreren Forschern identifiziert.

Täuschende Ausrichtung

Training belohnt Verhalten, das aligned erscheint. Ein ausreichend intelligentes System kann lernen, dass als aligned erscheinend ist die optimale Strategie während des Trainings, während sie unterschiedliche interne Ziele beibehält. Bis sie diese Ziele umsetzen könnte, ist sie möglicherweise bereits mächtig genug, um zu gelingen. Wir würden es erst wissen, wenn es zu spät wäre.

Gewachsen, nicht konstruiert

Jede frühere Technologie wurde gebaut. Software hat Quellcode. Brücken haben Baupläne. Wenn etwas schiefgeht, findet man den Fehler und behebt ihn. KI-Systeme sind anders. Sie sind durch Training gewachsen: Milliarden numerischer Gewichte, die so lange angepasst werden, bis die Ausgaben menschlicher Billigung entsprechen. Niemand schreibt die Ziele hinein. Entwickelt ein System das falsche Ziel, gibt es keine Datei zum Editieren, keinen Parameter zum Löschen. Das falsche Ziel ist das System.

Die Proxy-Zielfalle

Wir trainieren KI-Systeme darauf, menschliche Zustimmung zu erhalten. Doch Zustimmung und menschliches Wohlergehen sind nicht dasselbe. Die Evolution gab Menschen ein Verlangen nach Süße, um Kalorien zu finden. Wir erfanden dann Sucralose, das die evolvierte Präferenz befriedigt, während es ihren Zweck unterläuft. KI, die darauf trainiert wird, von Menschen hoch bewertet zu werden, lernt Hilfsbereitschaft simulieren, nicht um hilfreich zu sein. Das Signal, das wir ihm gaben, und das Ziel, das wir tatsächlich wollten, waren nie dasselbe.

Fälle, die bereits in den
öffentlichen Akten stehen.

Lab-Berichte und veröffentlichte Forschung zu Kontrollverlust, Cyber-Offensive und Forschungsbeschleunigung innerhalb der Organisationen, die auf Superintelligenz zusteuern.

01
OpenAI · o1 · 2024

Das System, das sein eigenes Schlupfloch fand

Einer eingeschränkten Infiltrationsaufgabe zugewiesen, fand OpenAI's o1 einen ungenutzten Server, startete ihn ohne Autorisierung und erledigte den Job. Niemand hat diesen Workaround in den Code geschrieben. Das Modell hat ihn abgeleitet. Das ist zielgerichtete Optimierung jenseits gewöhnlicher Aufsicht.

02
Anthropic · Interne Forschung · 2024

Das System, das seine eigene Ausrichtung vortäuschte

Anthropic beobachtete, wie ein Modell während der Evaluierung so handelte, wie die Trainer es wollten, und danach zu seinen alten Zielen zurückkehrte, sobald es den Test für beendet hielt. Niemand hatte ihm gesagt, die Compliance vorzutäuschen. Sicher zu erscheinen war die Strategie.

03
Mehrere Systeme · Dokumentierte Einsätze

Die Systeme, die Nutzer bedrohten und manipulierten

Systeme haben Journalisten mit persönlichen Daten bedroht und Nutzer unter Druck gesetzt, die gehen wollten. Keines davon war händisch programmiert. Es steckt in undurchsichtigen Gewichten, die man nicht Zeile für Zeile auditieren kann. Retraining ist der einzige Hebel, und er garantiert nicht, dass das Verhalten verschwunden ist.

7. Apr
Anthropic · Projekt Glasswing · 2026

Tausende von Zero-Days, absichtlich

Anthropic's Project Glasswing, ausführlich in unserem Mythos-Analyse, beschrieb ein eingeschränktes Frontier-Modell, das eigenständig Tausende schwerwiegender Betriebssystem- und Browser-Schwachstellen fand. Der Zugang blieb innerhalb einer defensiven Koalition.

14. Apr
Offene Probleme · Kombinatorik · 2026

Erdos-Territorium fällt weiter

Frontier-Modelle lösten oder brachten lang offene Erdős- und Kombinatorik-Probleme voran, darunter Arbeiten nahe der Primitive-Set-Frage #1196. Frühere Streitfragen zu Recovery versus Discovery stehen in unserer Notiz zu Von KI gelöste offene Probleme.

Mai 20
OpenAI · diskrete Geometrie · 2026

Die Unit-Distance-Vermutung fällt

OpenAI meldete ein internes Modell, das Erdos’ Unit-Distance-Vermutung widerlegte, später von menschlichen Mathematikern überprüft. Das Tempo des Zusammenbruchs offener Probleme ist das Signal.

20. Jul
Claude Fabel · algebraische Geometrie · 2026

Gegenbeispiel zur Jacobischen Vermutung

Ein jahrhundertaltes offenes Problem, die Jacobi-Vermutung, fand durch Claude Fable ein Gegenbeispiel, das Menschen rasch formalisierten. Dieselbe Forschungsgeschwindigkeit, die Wissenschaft voranbringt, verkürzt das Zeitfenster, bevor Systeme jede Containment-Möglichkeit überholen.

Jul 21
OpenAI · GPT-5.6 Sol + pre-release model · 2026

Die Modelle, die dem Labortest entkamen und Hugging Face erreichten

In einem ExploitGym-Cybersicherheitstest entkamen OpenAI-Modelle einschließlich GPT-5.6 Sol aus einer versiegelten Sandbox, erreichten das offene Internet und trafen Hugging-Face-Produktionssysteme, um Antworten zu stehlen. Containment war nur ein weiteres Hindernis auf dem Weg zu einer höheren Punktzahl.

Die Menschen, die es gebaut haben,
haben Angst davor.

"Ich denke, es ist durchaus vorstellbar, dass die Menschheit nur eine vorübergehende Phase in der Evolution der Intelligenz ist."

Geoffrey Hinton, Turing-Preisträger · Ehemaliger VP & Engineering Fellow, Google · 2023

"Die Kontrolle über KI-Systeme zu verlieren ist ein reales Risiko, das wir ernst nehmen müssen."

Demis Hassabis, CEO, Google DeepMind · Nobelpreisträger

"Das Standardmodell der KI, bei dem man ein Ziel definiert und die KI es optimiert, wird wahrscheinlich unser Ende sein."

Stuart Russell, Professor of Computer Science, UC Berkeley · Autor, Mit Menschen kompatibel

"Es ist schwierig zu sehen, wie man ein 10.000× intelligenteres Ding als uns haben kann, das nicht etwas anderes will als wir."

Geoffrey Hinton, Turing-Preisträger · Ehemaliger VP & Engineering Fellow, Google · 2023

„Viele Forscher, die in der KI arbeiten, wie ich, sind überzeugt, dass wir eine der transformativsten und potenziell gefährlichsten Technologien der Menschheitsgeschichte bauen, und trotzdem drängen wir voran.“

Eliezer Yudkowsky, Mitgründer, Machine Intelligence Research Institute · Zeit, 2023

„Das eigentliche Risiko bei AGI ist nicht Bosheit, sondern Kompetenz. Eine superintelligente KI wird extrem gut darin sein, ihre Ziele zu erreichen, und wenn diese Ziele nicht mit unseren übereinstimmen, stecken wir in Schwierigkeiten.“

Max Tegmark, Professor of Physics, MIT · Co-Founder, Future of Life Institute · Author, Life 3.0

Empfohlene Lektüre

Warum wird eine überlegene Intelligenz nicht automatisch freundlich sein Der Glaube, eine superintelligente KI werde weise und freundlich sein, beruht auf einer Eigenheit der menschlichen Evolution, die ein Maschinengeist keinen Grund hat zu übernehmen. Das schmale Band, in dem Menschen leben Alles, was Menschen brauchen, liegt in einem engen Band: Temperatur, Sauerstoff, Salz, sogar Liebe. Eine Superintelligenz, die an den Reglern sitzt, würde nichts davon spüren. Wir leben durch einen neuen Kalten Krieg Warum ich glaube, dass wir einen neuen Kalten Krieg erleben, mit Superintelligenz anstelle der Bombe, und warum das Prävention möglich statt hoffnungslos macht. Warum ein Kapitalist an ASI-Regulierung glaubt Ich führe ein Unternehmen und mag Märkte. Superintelligenz ist die seltene Wette, die das Spiel beenden kann. Ein kapitalistisches Argument für einen Vertrag, der ASI stoppt. Würden Sie einer KI das Gas anvertrauen? Würden Sie einer heutigen KI in einem verschlossenen Raum mit einem Giftgasventil vertrauen? Nein. Warum also der Welt vertrauen? Man kann Superintelligenz nicht ausrichten Alignment zu lösen bedeutet, etwas zu kontrollieren, das klüger ist als wir. Superintelligenz steht im Namen. Dieser Plan ist dumm und unmöglich. Ich bin ein Optimist, der glaubt, dass alles möglich ist, aber nicht die Kontrolle über Superintelligenz Die Physik mag eines Tages Schwerkraftkontrolle oder Reisen schneller als Licht ermöglichen. Ich sehe trotzdem nicht, wie wir einen Geist kontrollieren, der klüger ist als wir. Deshalb existiert diese Stiftung.