Quản trị Siêu trí tuệ:
Một Bản Tóm Tắt cho Các Nhà Làm Chính Sách

Lý lẽ cho quản trị an toàn AI quốc tế: vấn đề, những gì cần thiết, và các tiền lệ cho thấy điều đó là khả thi.

Một công nghệ chưa từng có mà không có khuôn khổ quản trị

Siêu trí tuệ nhân tạo (một hệ thống vượt trội trí tuệ con người ở mọi lĩnh vực) đang được các tập đoàn tư nhân phát triển tích cực dưới sự giám sát quy định tối thiểu. Các phòng thí nghiệm AI hàng đầu đã tuyên bố nội bộ rằng họ kỳ vọng đạt ngưỡng này trong thập kỷ này.

Không giống các rủi ro công nghệ trước đây, superintelligence không có kiến trúc quản trị quốc tế hiện có. Không có hiệp ước, không có cơ quan xác minh, không có tiêu chuẩn an toàn đa phương, và không có cơ chế dừng phát triển nếu xuất hiện dấu hiệu cảnh báo. Khoảng trống quản trị là tuyệt đối.

Cửa sổ cho quản trị hiệu quả đang khép lại

Các khuôn khổ quản trị quốc tế đòi hỏi nhiều năm đàm phán để thiết lập. Hiệp ước Không phổ biến vũ khí hạt nhân mất một thập kỷ ngoại giao sau các vụ thử hạt nhân đầu tiên. Nghị định thư Montreal cần xây dựng đồng thuận khoa học bền vững trước khi đạt được sự thông qua đa phương.

Sự phát triển năng lực AI đang tăng tốc. Những cải tiến từng mất nhiều năm nay chỉ cần vài tháng. Một khi hệ thống đủ năng lực tồn tại, có thể đã quá muộn để áp đặt các ràng buộc có ý nghĩa. Quản trị phải đi trước năng lực, không phải theo sau.

Tiền lệ: Chúng ta đã làm điều này trước đây

Name Hiệp ước quốc tế hạn chế phổ biến vũ khí hạt nhân. 191 quốc gia tham gia. Bao gồm các cơ chế thanh tra và xác minh.
Giao thức Montreal (1987) Loại bỏ 99% các chất làm suy giảm tầng ozone trên toàn cầu. Được UN gọi là "hiệp ước môi trường thành công nhất trong lịch sử".
Vũ khí sinh học Conv. (1972) Cấm phát triển và tích trữ vũ khí sinh học. 183 quốc gia tham gia. Thiết lập chuẩn mực quốc tế chống vũ khí sinh học.
Hiệp ước Không gian Ngoài (67) Cấm vũ khí hạt nhân trong không gian và trên các thiên thể. Đàm phán giữa US và USSR trong giai đoạn căng thẳng cao điểm Chiến tranh Lạnh.

Các Hành động Chính sách Được Khuyến nghị

  • Đánh giá an toàn bắt buộc trước khi triển khai bởi các cơ quan chính phủ độc lập trước khi bất kỳ hệ thống AI tiên phong nào được phát hành, tương đương thử nghiệm lâm sàng cho dược phẩm.
  • Giám sát và cấp phép tính toán cho các lần huấn luyện vượt ngưỡng năng lực đã định. Compute là thước đo có thể theo dõi và điều chỉnh cho năng lực; nó có thể bị giám sát và quy định.
  • Cơ quan An toàn AI Quốc tế với thẩm quyền thanh tra, được mô phỏng theo IAEA, để xác minh việc tuân thủ các tiêu chuẩn an toàn đã thỏa thuận trên các khu vực pháp lý.
  • Yêu cầu báo cáo sự cố cho các hành vi nguy hiểm được quan sát trong quá trình huấn luyện hoặc triển khai, hiện đang tự nguyện và không nhất quán giữa các phòng lab.
  • Luật an toàn AI trong nước thiết lập trách nhiệm pháp lý cho các thiệt hại có thể dự đoán từ các hệ thống AI chưa được kiểm tra đầy đủ, tạo động lực thị trường phù hợp cho sự thận trọng.
  • Đàm phán đa phương để thiết lập tiêu chuẩn quốc tế trước khi ngưỡng năng lực đạt được, không phải sau. Bắt đầu ngay, trong khi cửa sổ còn mở.

Đây là sự đồng thuận khoa học, không phải quan điểm bên lề

Hơn 500 nhà khoa học AI, trong đó có các nhà Nobel Geoffrey Hinton và Yoshua Bengio, cùng CEO của OpenAI và DeepMind, đã ký một tuyên bố năm 2023 gọi rủi ro AI cấp độ tuyệt chủng là "một ưu tiên toàn cầu song song với đại dịch và chiến tranh hạt nhân."

Chính phủ UK thành lập Viện An toàn AI đầu tiên trên thế giới (nay là Viện An ninh AI) năm 2023. Đạo luật AI của EU đưa ra phân loại rủi ro bắt buộc cho các hệ thống AI. Sắc lệnh Hành pháp về AI của US yêu cầu đánh giá an toàn cho các mô hình biên giới. Khung quốc tế chưa tồn tại, nhưng ý chí chính trị đang hình thành. Thời điểm hành động là bây giờ.

nakadafoundation.org

Nakada Foundation to Save Humanity ủng hộ quản trị an toàn AI quốc tế. Chúng tôi cung cấp chuyên môn chính sách, giáo dục công chúng và hỗ trợ vận động. Liên hệ với chúng tôi để sắp xếp buổi tóm tắt cho văn phòng hoặc nhân viên của bạn.