Cứ vài tháng lại có một benchmark năng lực AI bị phá vỡ. Những hệ thống hai năm trước còn không vượt nổi kỳ thi cấp phép nghề nghiệp nay đã đạt top percentile. Các lãnh đạo của các phòng thí nghiệm AI tiên phong công khai mô tả trí tuệ nhân tạo tổng quát chỉ còn cách vài năm, không phải vài thập kỷ. Một trong những nhà nghiên cứu an toàn AI nổi bật nhất, Nick Bostrom, đã xuất bản bài làm việc năm 2026 không hỏi có nên phát triển siêu trí tuệ hay không, mà hỏi khi nào.
Trong bối cảnh này, câu hỏi liệu chúng ta đã sẵn sàng cho siêu trí tuệ nhân tạo hay chưa là một đánh giá thực tiễn khẩn cấp, và câu trả lời rõ ràng là chưa, chứ không phải bài tập lý thuyết.
Sự sẵn sàng thực sự đòi hỏi những gì
Việc cụ thể hóa "sẵn sàng" nghĩa là gì rất quan trọng, vì từ này thường được dùng lỏng lẻo để chỉ "chúng tôi đã nghĩ về rủi ro" hoặc "các phòng thí nghiệm có trách nhiệm đang làm việc về an toàn." Những điều đó không phải là sẵn sàng theo nghĩa cần thiết.
Sự sẵn sàng thực sự cho siêu trí tuệ nhân tạo đòi hỏi tất cả những điều sau phải có trước khi triển khai bất kỳ hệ thống nào đạt khả năng ASI:
- Một phương pháp kỹ thuật đáng tin cậy để xác minh sự căn chỉnh AI trước khi triển khai, không suy luận từ các đánh giá hành vi
- Quản trị quốc tế đủ tầm với để ngăn bất kỳ tác nhân nào (công ty hay quốc gia) triển khai hệ thống trước khi vượt qua kiểm chứng
- Hạ tầng giám sát được vận hành độc lập với các tổ chức đang xây dựng hệ thống
- Khung pháp lý ở các quốc gia phát triển trí tuệ nhân tạo lớn trao cho các cơ quan giám sát thẩm quyền thực sự
- Các chuẩn mực quốc tế đã được thiết lập với đủ trọng lượng chính trị để tồn tại dưới áp lực cạnh tranh
Đánh giá theo các yêu cầu này, đây là vị trí thực tế của chúng ta.
Cuộc trò chuyện về quản trị đã đi sai hướng
Tháng 11 năm 2023, chính phủ UK chủ trì Hội nghị thượng đỉnh An toàn AI Bletchley Park, cuộc tụ họp quốc tế lớn đầu tiên tập trung cụ thể vào rủi ro AI biên giới. Cách tiếp cận rõ ràng là ưu tiên an toàn. Tuyên bố Bletchley Park kết quả được 28 quốc gia ký kết, bao gồm US, Trung Quốc và EU, thừa nhận các rủi ro "tiềm ẩn thảm khốc" từ ASI.
Đến tháng 2 năm 2025, Pháp đã tổ chức cái gọi là Hội nghị Thượng đỉnh Hành động AI, cố tình đổi tên định dạng để báo hiệu sự chuyển hướng ưu tiên. Trọng tâm chuyển từ xác định và quản lý rủi ro sang thúc đẩy triển khai và nắm bắt lợi thế kinh tế. Đây không phải thay đổi thuật ngữ trung lập. Nó phản ánh áp lực chính trị thực sự từ các chính phủ và ngành công nghiệp coi cạnh tranh AI với Trung Quốc là khung chính, và các yêu cầu an toàn là bất lợi cạnh tranh tiềm ẩn.
"Câu hỏi không còn là có nên phát triển siêu trí tuệ hay không, mà là khi nào làm vậy là tối ưu và ai hưởng lợi từ quyết định thời điểm đó."
Nick Bostrom, "Về Thời điểm Phát triển Siêu trí tuệ" · Bài làm việc, 2026
Cách tiếp cận của Bostrom đáng chú ý vì công trình trước đó của ông (Superintelligence, 2014) đã đặt nền móng cho nhiều lập luận về việc tại sao siêu trí tuệ đặt ra rủi ro tồn vong. Sự chuyển dịch năm 2026 của ông hướng tới các câu hỏi về thời điểm và phân phối phản ánh xu hướng rộng hơn trong lĩnh vực: chấp nhận rằng phát triển sẽ diễn ra và tập trung vào ai kiểm soát quá trình. Một câu hỏi hợp pháp. Khác với việc đảm bảo quá trình an toàn.
Vấn đề chuyển tiếp từ AGI sang ASI
Các cuộc thảo luận về quản trị thường coi AGI là ngưỡng liên quan, với giả định rằng các hệ thống cấp AGI sẽ dễ hiểu đối với người giám sát con người và có thể đánh giá một cách có ý nghĩa. Điều này có lẽ đúng ở ngưỡng AGI. Vấn đề nằm ở những gì xảy ra tiếp theo.
Một hệ thống ở mức năng lực AGI có thể tự định hướng nghiên cứu và cải tiến có thể chuyển từ trình độ con người sang siêu phàm đáng kể trong khoảng thời gian ngắn hơn nhiều so với lúc đạt mức con người. Thuật ngữ kỹ thuật cho tình huống này là kịch bản takeoff nhanh. Trong takeoff nhanh, hệ thống di chuyển từ mức mà con người còn có thể quản trị sang mức có thể không còn, trong khung thời gian ngắn hơn thời gian phản ứng của bất kỳ thể chế quản trị nào.
Sẵn sàng cho siêu trí tuệ nghĩa là sẵn sàng trước ngưỡng AGI, không phải kế hoạch phản ứng sau khi nó đến. Quản trị chỉ bắt đầu khi AGI xuất hiện có thể đã quá muộn để ngăn chặn sự chuyển đổi nhanh chóng sang mức năng lực đánh bại nó.
Tại sao cửa sổ vẫn còn mở
Khoảng cách sẵn sàng là có thật và nghiêm trọng. Mô tả nó một cách trung thực không có nghĩa là kết luận không thể làm gì được. Cửa sổ xây dựng quản trị đầy đủ đang thu hẹp, nhưng chưa khép lại.
Các phòng thí nghiệm trí tuệ nhân tạo tiên phong vẫn ở mức hiệu suất ngang con người hoặc gần ngang con người trên hầu hết các nhiệm vụ nhận thức, chưa vượt trội đáng kể. Sự chuyển đổi từ mức năng lực này sang mức quan trọng nhất vẫn chưa xảy ra. Đây là lúc các khung quản trị có thể được xây dựng với sự hợp tác của các bên sẽ chịu sự điều chỉnh, chứ không phải sau khi những bên đó đã phát triển hệ thống khiến sự hợp tác ít cần thiết hơn.
Chi phí chính trị của việc xây dựng quản trị ngay bây giờ là có thật: ma sát cạnh tranh, triển khai chậm hơn, khả năng mất lợi thế kinh tế so với các tác nhân ít quan tâm an toàn hơn. Những chi phí này cần được cân nhắc một cách trung thực với chi phí của việc không xây dựng quản trị ngay bây giờ và rơi vào tình huống đã mô tả ở trên. Sự bất đối xứng trong so sánh đó không hề tinh vi. Ba đề xuất của Foundation được thiết kế chính xác cho cửa sổ này: trước khi ngưỡng bị vượt qua, trong khi sự hợp tác của tất cả các bên lớn vẫn có thể được tìm kiếm và đạt được.