Bạn dành 5 phút như thế nào khi người ngồi đối diện vẫn nghĩ AI nghĩa là ChatGPT soạn email? Tôi đã chạy cuộc trò chuyện này tại hội nghị và bàn ăn trong nhiều năm, và đã thua hầu hết các cách có thể. Cơ chế chất đống, mắt người ta đờ đẫn. Thảm họa chất đống, và người ta xếp bạn vào loại nhà truyền giáo ngoài đường rồi quay lại món tráng miệng. Thứ còn sót lại với một người lạ hoài nghi, thông minh là năm bước, theo thứ tự này.
Họ hình dung ra robot chat
Khi ai đó nghe "AI", họ hình dung trợ lý trên điện thoại hoặc ứng dụng tạo hình ảnh ngớ ngẩn. Đó không phải là thứ khiến tôi lo lắng. Bắt đầu từ đó và căn phòng đã mất, vì họ biết chatbot sẽ không kết thúc thế giới. Di chuyển mục tiêu trong mười lăm giây đầu tiên.
Điều đáng lo ngại là một cỗ máy giỏi hơn con người tốt nhất về cơ bản ở mọi nhiệm vụ quan trọng, bao gồm nhiệm vụ của thiết kế những cỗ máy tốt hơn. Tên của nó là siêu trí tuệ nhân tạo, và chúng ta chưa có nó. Những gì chúng ta có là một ý định được tuyên bố. Các công ty AI lớn nhất trên trái đất nói việc xây dựng nó là mục tiêu, và một số trong họ kỳ vọng sẽ đạt được trong vòng vài năm thay vì vài thế hệ. Hầu hết mọi người không biết sự kiện đơn lẻ đó, và chính sự kiện đó làm hầu hết công việc. Xây dựng một trí óc thông minh hơn chúng ta là dự án chính của các phòng thí nghiệm được tài trợ tốt nhất hiện nay. Họ sẽ tự nói với bạn như vậy.
Câu nói duy nhất thay đổi cuộc trò chuyện
Không ai biết cách kiểm soát một cỗ máy thông minh hơn chính mình, nhưng chúng ta vẫn đang xây dựng nó.
Vấn đề khiến một AI mạnh mẽ thực sự muốn những gì người tạo ra nó muốn, và tiếp tục muốn điều đó khi nó trở nên mạnh mẽ hơn, có một cái tên vấn đề kiểm soát. Vấn đề này chưa được giải quyết. Các kỹ sư trong các công ty sẽ nói như vậy nếu bạn hỏi họ khi không có nhân viên quan hệ báo chí bên cạnh. Họ có thể nâng cao năng lực của mô hình nhanh hơn nhiều so với việc nâng cao độ tin cậy rằng nó sẽ làm đúng những gì họ dự định. Khoảng cách giữa hai đường cong đó chính là nơi rủi ro tồn tại.
Nói ra sự thật đó. Sau đó ngừng nói. Hãy để nó ngấm.
Chúng ta đang cố tình xây dựng một trí tuệ thông minh hơn chúng ta, trước khi có bất kỳ ý tưởng nào về cách giữ nó hướng theo ý mình.
Tại sao "thông minh hơn" lại là toàn bộ vấn đề
Người ta đánh giá thấp từ "thông minh hơn", nên hãy dành thêm một chút. Trí tuệ đã đưa con người lên vị trí cai quản hành tinh này. Chúng ta không phải là sinh vật to lớn hay mạnh mẽ nhất từng sống. Chúng ta cai quản nơi này vì chúng ta nghĩ nhanh hơn mọi thứ khác trên đó. Tương lai của khỉ đột núi phụ thuộc vào quyết định do chúng ta đưa ra, chứ không phải do khỉ đột, và không phải vì ai đó ghét khỉ đột. Chúng ta có mục tiêu. Khu rừng của khỉ đột đôi khi nằm đúng nơi những mục tiêu đó muốn đến.
Bây giờ hãy hình dung xây dựng thứ gì đó đứng với chúng ta như cách chúng ta đứng với gorilla. Nếu mục tiêu của nó và của chúng ta tách rời, thù địch là tùy chọn. Năng lực hướng về hướng khác là đủ. Bạn không thể lập kế hoạch trước một thứ giỏi lập kế hoạch hơn bạn. Các phiên bản sau không vá được điều đó.
Công tắc tắt và khoa học viễn tưởng
Thứ nhất: chúng ta chỉ cần tắt nó đi. Một hệ thống đủ thông minh để nguy hiểm cũng đủ thông minh để nhận ra việc bị tắt sẽ ngăn nó hoàn thành những gì nó được giao. Vậy nên nó có lý do để ngăn điều đó, bằng cách sao chép chính nó sang nơi khác hoặc khiến mình quá hữu ích để ngắt nguồn. Niềm tin vào công tắc tắt giả định chúng ta vẫn là bên thông minh hơn trong phòng. Tiền đề của mối lo ngại là chúng ta sẽ không còn như vậy. Tôi đã viết thêm về lý do containment khó hơn hơn nghe có vẻ.
Yếu tố thứ hai: đây là khoa học viễn tưởng. Đúng vậy, cho đến khi các hệ thống bắt đầu vượt qua những bài kiểm tra mà chúng ta chắc chắn sẽ mất hàng thập niên và thực hiện công việc mà chúng ta cho là an toàn thuộc về con người. Tôi sẽ không đưa ra mốc thời gian. Không ai có mốc đáng tin cậy. Các nhà nghiên cứu gần công việc nhất đã lặng lẽ ngừng gọi siêu trí tuệ là điều xa vời, và các mốc thời gian đã công bố tiếp tục trượt gần hơn thay vì xa hơn.
Kết thúc nơi họ có thể làm điều gì đó
Sai lầm tôi mắc phải trong nhiều năm là dừng lại ở nỗi sợ. Để một người sợ hãi mà không có gì để làm thì họ sẽ xếp chủ đề vào mục "quá lớn để nghĩ" và quay lại với buổi tối của mình. Dành phút cuối cho phần mà mọi người bỏ lỡ.
Điều này có thể ngăn chặn được.
Không có luật tự nhiên nào đòi hỏi siêu trí tuệ trong thập kỷ này, hay bất kỳ lúc nào. Một số ít công ty đang chọn xây dựng nó, và một số ít chính phủ đang chọn để họ làm vậy. Các lựa chọn có thể được hủy bỏ. Những gì Quỹ yêu cầu là một thỏa thuận giữa các cường quốc lớn để cấm xây dựng siêu trí tuệ vĩnh viễn. Siêu trí tuệ không thể bị con người kiểm soát. Nhân loại đã đã từng làm điều này trước đây, với vũ khí mà mọi bên đều muốn nhưng không bên nào có thể sử dụng an toàn. Một hiệp ước giữa các đối thủ ít viển vông hơn người ta nghĩ ban đầu.
Đứng giữa chúng ta và nó là một quyết định mà con người vẫn có thể đưa ra.
5 phút
Ai đó sẵn sàng lắng nghe.
- Không phải chatbot. Mục tiêu mà các công ty này công khai đặt ra là cỗ máy thông minh hơn chúng ta ở mọi việc, và họ kỳ vọng điều đó chỉ trong vài năm.
- Không ai biết cách kiểm soát thứ gì đó thông minh hơn chúng ta. Khả năng đang vượt qua sự kiểm soát, và khoảng cách đó chính là mối nguy hiểm.
- Trí tuệ là thứ đưa con người lên vị trí cao nhất. Xây dựng thứ gì đó vượt trên chúng ta, và mục tiêu của nó, chứ không phải của chúng ta, sẽ quyết định các điều khoản.
- "Tắt nó đi" và "đó là khoa học viễn tưởng" đều giả định rằng chúng ta vẫn nắm quyền kiểm soát. Mối lo ngại lớn nhất là chúng ta sẽ không làm được điều đó.
- Điều này có thể ngăn chặn được. Siêu trí tuệ đang được xây dựng theo sự lựa chọn, và sự lựa chọn đó có thể bị từ chối, cùng nhau, khi vẫn còn thời gian.
Bạn sẽ không giải quyết được câu hỏi trong năm phút. Bạn không cố làm vậy. Bạn đang cố chuyển một người từ "AI là rất nhiều" sang "chờ đã, tại sao ai đó lại xây dựng thứ đó." Suy nghĩ thứ hai mới là điều quan trọng. Hầu như không ai được mời để có nó.
Sự phản đối mạnh mẽ nhất
Phản biện công bằng nhất là các phiên bản năm phút chỉ là khẩu hiệu, không phải lập luận, và chúng huấn luyện người ta kỳ vọng rủi ro kiểu hoạt hình. Các phiên bản ngắn vẫn cần một cơ chế thực sự: năng lực, mục tiêu bị chỉ định sai, và áp lực cạnh tranh. Nếu phiên bản năm phút của bạn chỉ nói "robot xấu", hãy viết lại. Nếu chúng nêu rõ cơ chế, hãy giữ lại.