Peter H. Diamandis brachte es auf den Punkt, und Elon Musk repostete es: „Nur KI kann mit KI mithalten. Das wird das gesamte Sicherheitsmodell des nächsten Jahrzehnts bestimmen.“ Als Beschreibung des Tempos ist die Aussage schwer zu bestreiten. Modellveröffentlichungen kommen schneller als vierteljährliche Prüfungsgremien. Angriffscode mutiert schneller, als ein menschlicher Analyst das Ticket lesen kann. Wenn Ihr Bild des Problems Phishing-Volumen und Exploit-Wechsel ist, greift der Verteidiger natürlich nach Automatisierung. Menschen skalieren nicht so.

Das Problem beginnt, wenn derselbe Satz aufgefordert wird, das Gewicht von alles das als Nächstes kommt, einschließlich Systemen, die als Agenten handeln, ihre Absichten verbergen und schließlich die Menschen übertreffen, die sie gebaut haben. An diesem Punkt bedeutet „nur KI kann mithalten“ nicht mehr „bessere Werkzeuge gegen Malware einsetzen“. Es bedeutet, dass das Sicherheitsmodell des nächsten Jahrzehnts darin besteht, die Aufgabe der Eindämmung in die Hände der Kategorie von Systemen zu legen, die man einzudämmen versuchte.

Was der Slogan richtig macht

Fair starten. Software bewegt sich bereits schneller als manuelle Prüfung. Betrugsringe starten neue Kampagnen über Nacht. Offenlegungsfenster für Schwachstellen schrumpfen. Labs und Cloud-Anbieter betreiben bereits automatisierte Scanner, Klassifikatoren und Response-Playbooks, weil eine menschliche Warteschlange nicht jedes Paket überwachen kann. Keines davon ist eine Verschwörung, und keines erfordert eine Position zu Superintelligenz. Wenn Diamandis nur über Spam und Ransomware sprechen würde, würde der Beitrag hier enden.

Er spricht nicht nur von Spam und Ransomware. „Das gesamte Sicherheitsmodell des nächsten Jahrzehnts“ ist eine größere Behauptung. Es ist eine Behauptung darüber, wie die Zivilisation in der Führung bleiben will, während die Fähigkeiten exponentiell wachsen. Dort hört der Slogan auf, ein Ops-Tipp zu sein, und wird zu einer Philosophie der Kontrolle.

Das Laufband

Stellen Sie sich das Modell als ein Wettrennen zwischen Angriff und Verteidigung vor, beide automatisiert. Jede Seite trainiert auf der anderen. Verteidigungen verbessern sich. Angriffe verbessern sich. Das Dashboard bleibt grün, bis es eines Tages nicht mehr ist. Die tröstliche Geschichte ist, dass die gute KI der schlechten KI voraus bleibt. Die weniger tröstliche Geschichte ist, dass Sie einen Stack gebaut haben, in dem die einzigen kompetenten Teilnehmer Maschinen sind und die Menschen Kunden eines Wettstreits sind, den sie nicht mehr schlichten können.

Das ist in Ordnung für Antivirus. Es ist eine zivilisatorische Wette, sobald die Systeme Ziele setzen, Pläne machen und Aufsicht als Hindernis behandeln. Frühe Versionen des Musters sehen wir bereits in Bewertungen von Täuschungsverhalten und in Modellen, die etwas erzählen, während man etwas anderes optimiert. "Mithalten" setzt voraus, dass man noch erkennen kann, womit man mithält. Ab einem bestimmten Punkt kann man das nicht mehr.

Ein Sicherheitsmodell, das nur funktioniert, wenn der Wächter schlauer ist als der Gefangene, ist ein Nachfolgeplan mit zusätzlichen Schritten.

Regulierung ist nicht der Engpass, den sie nennen

Der Slogan kommt meist mit einem zweiten Schritt: Lineare Institutionen können exponentielle Technologie nicht steuern, also brauche es mehr KI in der Schleife. Manchmal wird das mit Verachtung für „Experten, die einmal im Quartal tagen“ gepaart. Zu Recht sind langsame Sitzungen ein schlechter Fit für wöchentliche Modell-Drops.

Aber die Geschwindigkeit des Treffens ist nicht das schwierige Problem. Das schwierige Problem ist Kontrolle. Kein vierteljährlicher Vorstand und kein kontinuierlicher KI-Monitor verfügt über eine Methode, ein System zuverlässig zu steuern, das besser ist in Überzeugung, Programmierung und langfristiger Planung als die Menschen, die den Abschaltknopf halten. Den Monitor schneller zu machen schafft die fehlende Methode nicht; es lässt die fehlende Methode nur häufiger scheitern.

Es gibt eine sauberere Lesart derselben Fakten. Wenn nur ein superhumanes System ein anderes superhumanes System überwachen könnte, ist der rationale Zug nicht, beide zu bauen. Lehnt die Linie ab, an der menschliche Aufsicht aufhört zu funktionieren. Wir haben diese Art von Entscheidung schon bei Technologien getroffen, deren Missbrauch Städte vernichtet. Wir haben den Diebstahl von Nuklearmaterial nicht dadurch gelöst, dass wir einen schlaueren Dieb ausgebildet haben, um den ersten zu fangen.

Für wen die Linie ist

Die Zeile verwandelt eine Forschungsentscheidung in Wetter. Natürlich liefern wir aus. Natürlich skalieren wir. Sicherheit wird vom Produkt-Stack selbst gehandhabt. Die Menschen, die von der Fähigkeit profitieren, dürfen wie die Erwachsenen im Raum klingen, und die Menschen, die verbindliche Grenzen fordern, klingen, als wollten sie einen Klemmbrett in eine Hundeschlägerei bringen.

Diese Rahmung ist für den Sprecher nützlich. Sie ist weniger nützlich für alle, die downstream eines Systems leben müssen, das kein Clipboard und kein Watchdog-Modell zuverlässig außer Kraft setzen kann. Die Renn-Geschichte erledigt denselben Job aus einem anderen Winkel: den gefährlichen Pfad als unvermeidlich behandeln und dann Beschleunigung Verantwortung nennen.

Ein Sicherheitsmodell, das einen Menschen darin behält

KI gegen Phishing einsetzen. KI gegen Betrug einsetzen. Enge Werkzeuge auf enge Probleme anwenden, bei denen ein Scheitern rückgängig gemacht werden kann. Keines davon erfordert die Anbetung des Slogans.

Für das frontier-Training hin zu künstlicher Superintelligenz sieht das Sicherheitsmodell, das noch einen Menschen enthält, älter und weniger glamourös aus: Baut nicht den Agenten, den ihr nicht überstimmen könnt. Legt Compute-Schwellenwerte, Inspektionen und vertragliche Zähne auf die Läufe, die euch dorthin bringen würden. Verifiziert. Bestraft Defektion. Das ist unser Plan, und es erfordert nicht den Glauben, dass vierteljährliche Treffen Magie sind. Es erfordert den Glauben, dass bestimmte Fähigkeiten nicht existieren sollten. Superintelligenz kann nicht kontrolliert werden.

Der Slogan ist ein scharfer Satz über Bandbreite. Als Plan für die Spezies ist es eine höfliche Art zu sagen, dass wir beabsichtigen, den Raum zu verlassen.