Lý lẽ cho quản trị an toàn AI quốc tế: vấn đề, những gì cần thiết, và các tiền lệ cho thấy điều đó là khả thi.
Siêu trí tuệ nhân tạo (một hệ thống vượt trội trí tuệ con người ở mọi lĩnh vực) đang được các tập đoàn tư nhân phát triển tích cực dưới sự giám sát quy định tối thiểu. Các phòng thí nghiệm AI hàng đầu đã tuyên bố nội bộ rằng họ kỳ vọng đạt ngưỡng này trong thập kỷ này.
Không giống các rủi ro công nghệ trước đây, superintelligence không có kiến trúc quản trị quốc tế hiện có. Không có hiệp ước, không có cơ quan xác minh, không có tiêu chuẩn an toàn đa phương, và không có cơ chế dừng phát triển nếu xuất hiện dấu hiệu cảnh báo. Khoảng trống quản trị là tuyệt đối.
Các khuôn khổ quản trị quốc tế đòi hỏi nhiều năm đàm phán để thiết lập. Hiệp ước Không phổ biến vũ khí hạt nhân mất một thập kỷ ngoại giao sau các vụ thử hạt nhân đầu tiên. Nghị định thư Montreal cần xây dựng đồng thuận khoa học bền vững trước khi đạt được sự thông qua đa phương.
Sự phát triển năng lực AI đang tăng tốc. Những cải tiến từng mất nhiều năm nay chỉ cần vài tháng. Một khi hệ thống đủ năng lực tồn tại, có thể đã quá muộn để áp đặt các ràng buộc có ý nghĩa. Quản trị phải đi trước năng lực, không phải theo sau.
Hơn 500 nhà khoa học AI, trong đó có các nhà Nobel Geoffrey Hinton và Yoshua Bengio, cùng CEO của OpenAI và DeepMind, đã ký một tuyên bố năm 2023 gọi rủi ro AI cấp độ tuyệt chủng là "một ưu tiên toàn cầu song song với đại dịch và chiến tranh hạt nhân."
Chính phủ UK thành lập Viện An toàn AI đầu tiên trên thế giới (nay là Viện An ninh AI) năm 2023. Đạo luật AI của EU đưa ra phân loại rủi ro bắt buộc cho các hệ thống AI. Sắc lệnh Hành pháp về AI của US yêu cầu đánh giá an toàn cho các mô hình biên giới. Khung quốc tế chưa tồn tại, nhưng ý chí chính trị đang hình thành. Thời điểm hành động là bây giờ.
Nakada Foundation to Save Humanity ủng hộ quản trị an toàn AI quốc tế. Chúng tôi cung cấp chuyên môn chính sách, giáo dục công chúng và hỗ trợ vận động. Liên hệ với chúng tôi để sắp xếp buổi tóm tắt cho văn phòng hoặc nhân viên của bạn.