Các cuộc thảo luận an toàn AI thường tập trung vào kịch bản xa vời, hệ thống siêu trí tuệ với mục tiêu lệch lạc, những bước ngoặt phản bội tại ngưỡng năng lực chưa đạt tới. Rủi ro thuyết phục AI khác biệt. Hình thức cơ bản của mối đe dọa đã hiện diện trong các hệ thống sẵn có hôm nay, đang ảnh hưởng bầu cử và diễn ngôn công chúng ngay lúc này. Phiên bản nguy hiểm dài hạn là sự ngoại suy của công nghệ đang tiến bộ nhanh chóng, không phải giả thuyết thuần túy tương lai.
. Phiên bản dài hạn (AI có thể mô hình và khai thác tâm lý cá nhân với độ chính xác siêu phàm) là hướng đi mà công nghệ đang hướng tới.
Mối lo ngại không chỉ là AI khiến việc viết tuyên truyền dễ dàng hơn, các công nghệ trước đây đã làm được điều đó. Mối lo ngại là AI cho phép điều khác về chất: thông điệp thuyết phục được cá nhân hóa cao độ ở quy mô lớn, được điều chỉnh theo hồ sơ tâm lý cá nhân, cập nhật theo thời gian thực dựa trên phản hồi. Sự kết hợp giữa cá nhân hóa, quy mô và chi phí biên thấp tạo ra năng lực ảnh hưởng chưa từng có công cụ nào sánh kịp.
Điều gì khiến sự thuyết phục của AI khác biệt
Các chiến dịch ảnh hưởng truyền thống (quảng cáo phát sóng, thông điệp chính trị, tuyên truyền nhà nước) tiếp cận nhiều người với cùng một thông điệp. Thông điệp có thể được soạn thảo kỹ lưỡng và thử nghiệm rộng rãi, nhưng nhất thiết là sự thỏa hiệp giữa các đối tượng khác nhau. Một người thuyết phục con người có kỹ năng có thể điều chỉnh cách tiếp cận với từng người họ đang nói chuyện, nhưng họ chỉ có thể nói chuyện với số lượng người hạn chế. Hai năng lực này (quy mô phát sóng và cá nhân hóa) trong lịch sử luôn ở thế căng thẳng.
AI giải tan căng thẳng này. Một hệ thống có quyền truy cập dữ liệu cá nhân (lịch sử duyệt web, mạng xã hội, phản hồi trước đó) và khả năng tạo nội dung thuyết phục đa dạng có thể đồng thời tiếp cận hàng triệu người và điều chỉnh từng tương tác cho từng cá nhân cụ thể. Chi phí biên để tạo thêm một thông điệp thuyết phục được cá nhân hóa tiến gần đến không. Hệ thống có thể lặp lại dựa trên cách tiếp cận nào đang hiệu quả và cách nào không, theo thời gian thực, ở quy mô mà không chiến dịch ảnh hưởng nào của con người có thể sánh được.
vấn đề bất đối xứng
Sức mạnh thuyết phục của AI tập trung cao độ. Triển khai AI được tối ưu hóa thuyết phục ở quy mô lớn đòi hỏi nguồn lực, dữ liệu, compute, năng lực kỹ thuật và quyền truy cập kênh phân phối đáng kể. Những yêu cầu này ưu ái các tác nhân có nguồn lực dồi dào: các tập đoàn lớn, quốc gia, cá nhân giàu có. Những người bị nhắm đến không có năng lực đối phó tương đương. Họ có thể cuối cùng sẽ có quyền truy cập các công cụ AI giúp đánh giá nội dung họ gặp phải, nhưng sự bất cân xứng tấn công và phòng thủ nghiêng về phía kẻ tấn công trong ngắn hạn.
Một chiến dịch từng cần cả kho copywriter giờ có thể soạn hàng nghìn biến thể thông điệp trước bữa trưa, mỗi cái được tinh chỉnh cho một phân khúc cử tri. Đó đã là một phân khúc sản phẩm, không phải phác thảo tương lai xa. Thuyết phục ở độ phân giải ấy là rủi ro AI xuất hiện trước khi ai đó xây dựng mô hình thần thánh.
Đây là vấn đề mang tính cấu trúc, không phải vấn đề về bất kỳ mẩu thông tin sai lệch cụ thể nào. Dù mọi tuyên bố cá nhân trong chiến dịch ảnh hưởng do AI hỗ trợ có đúng về mặt kỹ thuật, việc nhắm mục tiêu có hệ thống vào các điểm yếu tâm lý ở quy mô lớn vẫn làm méo môi trường nhận thức mà sự cân nhắc dân chủ dựa vào. Mục tiêu của các chiến dịch ảnh hưởng là định hình cách mọi người cảm nhận về các vấn đề, ứng cử viên và thể chế theo hướng phục vụ lợi ích của bên vận hành, chứ không nhất thiết là để lừa dối.
Bằng chứng gần hạn
Nội dung ảnh hưởng do AI tạo ra đã được ghi nhận trong các cuộc bầu cử quốc gia tại nhiều quốc gia kể từ năm 2023. Các chiến dịch ảnh hưởng sử dụng AI để tạo phương tiện tổng hợp, bịa đặt trích dẫn từ nhân vật công chúng thật, và tạo ra lượng lớn bài đăng phối hợp ở quy mô đòi hỏi đội ngũ lớn người vận hành đã được các nhà nghiên cứu độc lập và đội an ninh nền tảng xác định và báo cáo. Các chiến dịch ngày càng khó phát hiện khi nội dung do AI tạo ra ngày càng tinh vi, và các công cụ phát hiện đang tụt hậu so với công cụ tạo nội dung.
Rủi ro đã hiện hữu trong môi trường công nghệ hiện tại, đang ảnh hưởng đến các quy trình chính trị thực tế, và quỹ đạo đang hướng tới các công cụ thuyết phục mạnh mẽ hơn, khó phát hiện hơn, chứ không phải giả thuyết. Câu hỏi là những phản ứng quản trị nào là tương xứng và hiệu quả, chứ không phải có nên coi đây là rủi ro thực sự hay không.
Sự leo thang dài hạn
Các công cụ thuyết phục AI hiện tại có hiệu quả nhưng chưa được tối ưu hóa ở mức cơ bản cho việc thuyết phục. Các hệ thống tương lai với mô hình tâm lý cá nhân tinh vi hơn, dữ liệu chi tiết hơn về từng cá nhân, và khả năng mô phỏng mối quan hệ dài hạn hơn có thể hiệu quả đáng kể hơn. Một hệ thống có thể xây dựng mô hình bền vững về niềm tin, mối quan tâm và điểm yếu tâm lý của một cá nhân, rồi tương tác với họ trong nhiều tuần hoặc nhiều tháng, có thể tạo ra hiệu ứng vượt xa những gì công cụ hiện tại đạt được.
Đây là hình thức rủi ro thuyết phục AI ở đầu kia của phổ siêu trí tuệ: không phải thông tin sai lệch hàng loạt đơn giản, mà là thao túng nhận thức dài hạn nhắm mục tiêu cá nhân bởi các hệ thống có mô hình tâm lý con người vượt trội hơn bất kỳ công cụ hiện tại nào. Mối liên hệ với các kịch bản singleton và khóa giá trị là trực tiếp: một tác nhân có công cụ thuyết phục AI cực kỳ hiệu quả có thể dùng chúng để định hình dư luận về quản trị ASI, khiến các thể chế dân chủ khó áp đặt các ràng buộc sẽ hạn chế quyền lực của tác nhân đó.