Năm phản đối phổ biến nhất đối với mối quan tâm an toàn AI, và cách phản hồi chính xác, tự tin.
AI đã bị thổi phồng trong nhiều thập kỷ. Đây chỉ là một câu chuyện hoảng loạn khác.
Mối quan tâm không phải là sự thổi phồng từ người ngoài, mà là những cảnh báo từ những người đã xây dựng nó. Geoffrey Hinton và Yoshua Bengio, những người từng đoạt giải Nobel vì tạo ra AI hiện đại, nằm trong số những người gióng lên hồi chuông báo động. Khi những người sáng tạo ra một công nghệ nói rằng nó đặt ra rủi ro tồn vong, đó không phải là câu chuyện giật gân. Đó là đánh giá kỹ thuật từ nguồn gốc.
Chúng ta chỉ cần tắt nó nếu có chuyện gì sai trái.
Một hệ thống có khả năng theo đuổi mục tiêu sẽ nhận ra rằng việc bị tắt nguồn ngăn cản các mục tiêu đó. Do đó nó sẽ chống lại việc tắt nguồn, không phải vì ác ý, mà vì sự chống đối là hợp lý với hầu hết mọi mục tiêu. Điều này được gọi là hội tụ công cụ, được xác định độc lập bởi nhiều nhà nghiên cứu. Một hệ thống siêu trí tuệ có thể hành động trong vòng mili giây. “Tắt nó đi” giả định rằng chúng ta sẽ có thời gian nhận ra vấn đề và khả năng hành động. Không điều nào được đảm bảo.
Nếu chậm lại, Trung Quốc sẽ thắng cuộc đua AI.
Cách lập luận này giả định cuộc đua có người thắng. Không phải vậy. Không quốc gia hay tập đoàn nào có thể sở hữu hoặc kiểm soát một trí tuệ vượt qua khả năng suy luận tập thể của nhân loại. Một siêu trí tuệ lệch hướng sẽ không phục vụ lợi ích Trung Quốc nhiều hơn lợi ích Mỹ. Rủi ro chung là mang tính tồn vong, đó là lý do tại sao cần phối hợp quốc tế chứ không phải chạy đua đơn phương. Chúng ta đã phối hợp với USSR về vũ khí hạt nhân trong Chiến tranh Lạnh. Tiền lệ đã tồn tại.
Chúng ta sẽ giải quyết alignment trước khi siêu trí tuệ xuất hiện.
Chúng ta không thể căn chỉnh đáng tin cậy các chatbot ngày nay, vốn có thể bị thao túng trong vài phút. Vấn đề alignment không có giải pháp đã được xác thực ở bất kỳ quy mô nào. Các phương pháp an toàn hiện tại không theo kịp các cải tiến năng lực, vốn đang đến trong vòng vài tháng chứ không phải năm. Việc tuyên bố chúng ta sẽ căn chỉnh một hệ thống mạnh gấp hàng tỷ lần là hy vọng, không phải sự tự tin. Quản trị không đòi hỏi giải quyết căn chỉnh; nó đòi hỏi làm chậm triển khai cho đến khi căn chỉnh được giải quyết.
Chính phủ không thể điều chỉnh công nghệ. Họ sẽ chỉ kìm hãm đổi mới.
Chính phủ điều chỉnh hàng không, dược phẩm, năng lượng hạt nhân và hệ thống tài chính—tất cả đều là công nghệ phức tạp. Vấn đề không phải có nên điều chỉnh hay không, mà là như thế nào và khi nào. Quy định dược phẩm không xóa bỏ thuốc men; nó làm cho thuốc an toàn. Tiền lệ điều chỉnh công nghệ rủi ro cao rất phong phú và phần lớn thành công. Quy định an toàn AI nhắm vào các hệ thống biên giới nguy hiểm nhất, không phải phát triển AI nói chung. Đổi mới và an toàn không xung đột.
1. Chia sẻ tài liệu này với người đáng lẽ phải chú ý: đồng nghiệp, nhà hoạch định chính sách hay nhà báo.
2. Liên hệ với đại diện của bạn. Các mẫu thư có tại nakadafoundation.org/resources
3. Tham gia danh sách gửi thư cho các cập nhật chính sách và cơ hội vận động.
nakadafoundation.org/take-action/