Nếu bạn đã dành thời gian theo dõi tranh luận AI trực tuyến, hẳn đã thấy hậu tố này. Người ta thêm "e/acc" vào tên người dùng giống như thế hệ trước đeo huy hiệu ve áo. Nó viết tắt cho chủ nghĩa tăng tốc hiệu quả, và nó là đối trọng rõ ràng nhất, tự tin nhất và có ảnh hưởng nhất đối với phong trào an toàn AI. Coi trọng nó (thay vì bóp méo nó) là cách duy nhất trung thực để tranh luận chống lại nó.

Những gì chủ nghĩa tăng tốc hiệu quả tin tưởng

Chủ nghĩa tăng tốc hiệu quả xuất hiện quanh năm 2022 từ các tài khoản mạng xã hội ẩn danh, nổi bật nhất là tài khoản tự gọi mình là "Beff Jezos," sau này được xác định là cựu kỹ sư Google Guillaume Verdon, hợp tác với một cộng sự được biết đến với tên Bayeslord. Nó mượn tên của một dòng triết học cũ hơn là chủ nghĩa tăng tốc, nhưng trên thực tế nó đơn giản và lạc quan hơn tổ tiên học thuật của mình.

Các luận điểm cốt lõi:

  • Công nghệ là động lực của sự thịnh vượng nhân loại. Gần như mọi tiến bộ về sức khỏe, tài sản và tự do đều xuất phát từ sự tiến bộ công nghệ. Tiến bộ nhiều hơn, nhanh hơn đồng nghĩa với sự thịnh vượng lớn hơn.
  • AI là động cơ mạnh mẽ nhất từng được xây dựng, và việc đẩy nhanh nó là con đường nhanh nhất để chữa bệnh, chấm dứt sự khan hiếm, và mở rộng những gì nhân loại có thể làm và trở thành.
  • Rủi ro thảm khốc thấp hoặc không đáng kể. Một số nhà tăng tốc nổi bật đặt xác suất thảm họa tồn vong do AI ở mức "bằng không hoặc gần như không", và coi các kịch bản tận thế là nỗi lo không thể kiểm chứng.
  • Bạn không thể hiểu một công nghệ mà không xây dựng nó. Sự kiềm chế ngăn cản chính trải nghiệm dạy chúng ta cách làm cho công nghệ an toàn. Chúng ta học hỏi bằng cách làm, không phải bằng cách dừng lại.
  • Hạn chế tự nó đã nguy hiểm. Quy định nặng tay tập trung quyền lực, kìm hãm cạnh tranh, và có thể trao tương lai cho những tác nhân ít nguyên tắc hơn. Phát triển mở, nhanh và phi tập trung an toàn hơn là làm chậm có kiểm soát.

Stated this way, e/acc is a recognizably American, recognizably Enlightenment faith in progress, aimed at a technology of genuine promise, not foolish. Our own position agrees with more of it than the online shouting suggests: as we say plainly, chúng tôi không chống lại AI. AI hẹp đã chữa bệnh và thúc đẩy khám phá. Sự bất đồng hẹp hơn và sắc nét hơn nhiều so với "lạc quan chống bi quan."

e/acc đúng ở đâu

Một phản biện trung thực bắt đầu bằng việc thừa nhận những điểm mạnh, vì chúng thực sự mạnh.

Tiến bộ thực sự là lực lượng nhân đạo vĩ đại. Tuổi thọ, tỷ lệ tử vong trẻ em, tỷ lệ biết chữ, nghèo đói tuyệt đối, các đường xu hướng dài hạn là tin tốt nhất trong lịch sử nhân loại, và công nghệ đã thúc đẩy chúng. Sự nghi ngờ blanket đối với công nghệ mới có thành tích kém.

Hạn chế phòng ngừa thực sự có chi phí, và chúng thường vô hình. Mỗi năm một phương pháp chữa trị bị trì hoãn, những người sẽ sống được lại chết. "Trước hết, không gây hại" không thể nghĩa là "trước hết, không làm gì", vì không hành động cũng là một lựa chọn có số người chết. Bất kỳ lập luận an toàn nghiêm túc nào cũng phải gánh vác gánh nặng này, thay vì phớt lờ nó.

Sự tập trung quyền lực thực sự là một rủi ro. A governance regime that hands control of AI to a small cartel of incumbents or a single government is its own kind of catastrophe, a point we make ourselves in our pieces on the siêu trí tuệ đơn nhấtgiám sát dân chủ. e/acc đúng khi cho rằng "chỉ cần điều chỉnh" có thể dẫn đến sai lầm nghiêm trọng.

Nơi lập luận sụp đổ

Và tuy nhiên kết luận không theo sau. Sai lầm nằm ở ba bước cụ thể, không phải ở sự lạc quan của e/acc về công nghệ nói chung.

1. Nó coi một tuyên bố chưa được chứng minh là sự thật đã được xác lập

Tiền đề chịu tải là rủi ro AI thảm khốc là "gần như không." Nhưng đây không phải là một phát hiện. Không ai đã chứng minh nó. Nó được đặt đối lập với phán đoán có cân nhắc của chính những nhà nghiên cứu đã xây dựng AI hiện đại, Geoffrey Hinton, Yoshua Bengio, và hàng trăm người khác đã ký tuyên bố năm 2023 đặt rủi ro tuyệt chủng ngang hàng với đại dịch và chiến tranh hạt nhân. Khi giả định trung tâm của một phong trào bị mâu thuẫn hoàn toàn với những người tiên phong của lĩnh vực, gọi giả định đó là "lạc quan" là đánh giá thấp những gì đang xảy ra. Đó là một canh bạc, và người tăng tốc đang âm thầm giả định câu trả lời cho câu hỏi duy nhất mà toàn bộ lập luận xoay quanh. Chúng tôi khảo sát phạm vi ước tính chuyên gia thực tế trong phần giải thích của chúng tôi về P(doom).

2. "Học qua việc xây dựng" không hiệu quả với những sai lầm không thể sống sót

Lập luận rằng chúng ta hiểu công nghệ tốt nhất bằng cách xây dựng chúng đúng với hầu hết mọi thứ, và hoàn toàn sai với loại duy nhất quan trọng ở đây. Phát triển lặp lại, học từ thất bại hoạt động khi các thất bại có thể sống sót và đảo ngược được. Bạn phát hành phần mềm lỗi, nó sập, bạn vá nó. Vòng lặp đó là động cơ của mọi tiến bộ kỹ thuật.

Nó không hiệu quả khi lỗi nghiêm trọng đầu tiên cũng là lỗi cuối cùng. Một hệ thống không phù hợp siêu trí tuệ không phải là lỗi có thể vá; nó là, theo logic của hội tụ công cụlần phản trắc, một hệ thống chống lại việc sửa chữa và tắt nguồn. "Chúng ta sẽ học dần" giả định có lần thử thứ hai. Với vấn đề cụ thể này, có thể sẽ không có lần nào. Lập luận của chúng tôi là lợi ích không tưởng mà e/acc mong muốn đòi hỏi sự liên kết mà chúng ta không biết cách đạt được, và rằng siêu trí tuệ không được căn chỉnh sẽ không mang lại sự thịnh vượng, mà chỉ kết thúc câu chuyện.

3. Nó nhầm lẫn vấn đề phối hợp thành vấn đề giá trị

e/acc định khung tranh luận là những người lạc quan yêu tiến bộ chống lại những người bi quan sợ hãi. Nhưng ngay cả một người lạc quan tận tụy cũng phải đối mặt với động lực cuộc đua: khi nhiều phòng thí nghiệm và quốc gia tranh nhau xây trước, mỗi bên đều có động lực cắt xén an toàn, vì ai chậm chân đơn giản là thua kẻ không chậm. Kết quả là mọi người di chuyển nhanh hơn bất kỳ ai nghĩ là khôn ngoan. Đó không phải chiến thắng của sự lạc quan; đó là thất bại hành động tập thể điển hình, loại thất bại tạo ra kết quả mà không ai trong số những người tham gia muốn chọn. Tăng tốc không giải quyết được cái bẫy ấy. Nó chỉ làm sâu thêm. Thứ duy nhất giải quyết được là sự phối hợp, chính những khuôn khổ quốc tế mang tính ràng buộc mà e/acc phản đối.

Sự bất đồng, được phát biểu chính xác

Bỏ qua các meme, hai phe bất đồng về một điều: thứ tự thực hiện. e/acc nói xây trước, rồi tin rằng kiểm soát và hiểu biết sẽ theo sau từ năng lực. Lập trường an toàn nói thiết lập kiểm soát trước, vì với công nghệ này chi phí làm sai thứ tự là không giới hạn và không thể đảo ngược.

Bạn không cần phải là người bi quan để chọn quan điểm thứ hai. Bạn chỉ cần nhận ra một sự bất đối xứng. Nếu phe tăng tốc đúng và chúng ta vẫn quản trị, chúng ta chỉ mất một phần tốc độ và hiệu quả, những chi phí thực tế nhưng có thể phục hồi. Nếu phe tăng tốc sai và chúng ta không quản trị, chúng ta mất khả năng định hướng thứ mạnh mẽ nhất loài người từng tạo ra, vĩnh viễn. Trước sự bất đối xứng đó, kiên trì đặt an toàn lên hàng đầu là hình thức thận trọng cơ bản nhất, áp dụng cho quyết định có cược cao nhất chúng ta từng đưa ra, chứ không phải nỗi sợ tiến bộ.

Đó là lý do Nakada Foundation không phản đối AI, và không phản đối một tương lai tốt đẹp. Nó lập luận cho việc xây dựng phanh trước khi xe đạt tốc độ tối đa. Nếu bạn muốn sự dồi dào mà những người tăng tốc hứa hẹn, cách chắc chắn nhất để có được nó là đảm bảo chúng ta sống sót để tận hưởng kế hoạch là những gì "an toàn trước tiên" trông như trong thực tế.