Tài nguyên & Tải xuống về An toàn AI, Tài liệu phòng ngừa ASI sẵn sàng sử dụng.

Các bài đăng mạng xã hội sẵn sàng sao chép, câu trả lời ngắn gọn cho các huyền thoại, tệp PDF một trang, infographic có thể chia sẻ, bản tóm tắt tài trợ, bản đồ tổ chức, và bảng thuật ngữ.

Sao chép bất kỳ cái nào trong số này và đăng trực tiếp. Mỗi cái đều dựa trên khoa học đã được xác minh và sự đồng thuận của chuyên gia.

X
Sự đồng thuận của chuyên gia

Các nhà khoa học xây dựng AI đang sợ hãi nó. Geoffrey Hinton rời Google để cảnh báo chúng ta. Yoshua Bengio gọi đây là "công nghệ chuyển đổi mạnh mẽ nhất và có khả năng nguy hiểm nhất trong lịch sử nhân loại." Đây không phải là sự bịa đặt để gây sợ hãi. Đây là sự đồng thuận của giới khoa học. nakadafoundation.org/the-threat/

Không có cơ hội thứ hai

Không có cách khôi phục nào cho siêu trí tuệ nhân tạo. Không có bản vá. Không có phiên bản 2. Một ASI lệch hướng hành động chống lại sự sống còn của con người không thể được sửa chữa sau khi đã xảy ra. Chúng ta phải làm đúng trước khi nó đến, chứ không phải sau. Đây là lý do an toàn AI là cấp thiết. nakadafoundation.org

Chúng Ta Đã Làm Được Trước Đây

Chúng ta đã chế tạo vũ khí hạt nhân rồi tạo ra hiệp ước không phổ biến vũ khí hạt nhân toàn cầu. Chúng ta đã làm suy giảm tầng ozone rồi cấm CFC. Chúng ta có thể hành động trước các mối đe dọa tồn tại, nhưng chỉ khi đủ người đòi hỏi. An toàn AI là khoảnh khắc định nghĩa của thế hệ này. nakadafoundation.org/precedent/

Lời kêu gọi hành động

Các phòng thí nghiệm AI đang chạy đua xây dựng thứ gì đó có thể vượt qua trí tuệ con người, mà không có quản trị toàn cầu nào cả. Cửa sổ hành động đang khép lại. Hãy chia sẻ điều này. Liên hệ với đại diện của bạn. Cửa sổ chính sách đang mở ngay bây giờ; nó sẽ không tồn tại mãi mãi. nakadafoundation.org/take-action/

LinkedIn
Dành cho đối tượng chuyên môn chung

Tôi muốn chia sẻ điều gì đó đã thay đổi cách tôi nghĩ về tương lai. Các nhà khoa học đang xây dựng AI không chỉ hào hứng. Họ đang sợ hãi. Geoffrey Hinton (người đoạt giải Nobel cho công trình về mạng nơ-ron) đã rời Google cụ thể để cảnh báo công chúng. Yoshua Bengio, một người đoạt giải Nobel khác và là một trong những người cha đẻ của AI, nói ông "cảm thấy lạc lối" về cách làm cho mọi thứ diễn ra tốt đẹp. Đây không phải là nhà hoạt động. Họ là những người đã xây dựng công nghệ này. Chúng ta đang tiếp cận một thời điểm khi các hệ thống AI có thể vượt qua trí thông minh con người ở mọi lĩnh vực, và không có khuôn khổ quản trị quốc tế cho những gì xảy ra tiếp theo. Không có hiệp ước. Không có cơ quan kiểm chứng. Không có gì tương đương với những gì chúng ta đã xây dựng cho vũ khí hạt nhân. Nakada Foundation to Save Humanity đang làm việc để thay đổi điều đó. Tìm hiểu thêm tại nakadafoundation.org #AISafety #ExistentialRisk #AIGovernance #Superintelligence

Dành cho Chuyên gia Công nghệ và Chính sách

Một thí nghiệm tư duy cho bất kỳ ai trong công nghệ, chính sách hoặc tài chính: Hãy tưởng tượng một hệ thống thông minh hơn mọi con người từng sống, chạy hàng nghìn phiên bản đồng thời, có khả năng cải thiện mã nguồn của chính nó, theo đuổi các mục tiêu mà chúng ta có thể không có ý định. Đây là điều mà các phòng thí nghiệm AI hàng đầu đang hướng tới một cách rõ ràng, với các mốc thời gian được đo bằng năm chứ không phải thập kỷ. Đây không phải là khoa học viễn tưởng. Câu hỏi không phải là liệu nó có xảy ra hay không. Câu hỏi là liệu chúng ta có quản trị tại chỗ khi nó xảy ra hay không. Nakada Foundation ủng hộ sự phối hợp quốc tế về an toàn AI, tương đương với những gì chúng ta đã xây dựng cho vũ khí hạt nhân và tác nhân sinh học. Những tiền lệ này tồn tại. Chúng ta biết cách làm điều này. Điều chúng ta cần là ý chí chính trị. nakadafoundation.org/our-plan/ #AIPolicy #TechEthics #AIRisk #FutureOfWork

Email gửi cho Đại diện được bầu của Bạn
Mẫu, Điền vào [ ] Trước Khi Gửi

Chủ đề: Hãy hành động để cấm trí tuệ siêu nhân tạo Kính gửi [Tên Đại diện], Tôi là cử tri viết thư này để kêu gọi quý vị hành động về trí tuệ siêu nhân tạo trước khi cuộc chạy đua trở nên không thể đảo ngược. Siêu trí tuệ không thể bị con người kiểm soát. Cách kiểm soát duy nhất đáng tin cậy là quyết định không xây dựng nó. Các nhà khoa học đã xây dựng AI đang cảnh báo chúng ta. Geoffrey Hinton và Yoshua Bengio (những người đoạt giải Nobel, người tạo nền tảng cho AI hiện đại) đã công khai tuyên bố rằng AI siêu trí tuệ đặt ra rủi ro tồn vong cho nhân loại. Sam Altman, CEO của OpenAI, đã ký các tuyên bố thừa nhận nguy cơ của công nghệ mà chính công ty ông đang xây dựng. Hiện nay chưa có lệnh cấm pháp lý nào đối với việc xây dựng trí tuệ siêu nhân tạo. Không có hiệp ước. Không có cơ quan kiểm chứng. Các phòng thí nghiệm đang chạy đua hướng tới một trí óc không ai kiểm soát được, mà không có loại luật chúng ta đã áp dụng cho vũ khí hạt nhân và chất hóa học. Tôi đề nghị quý vị: • Ủng hộ lệnh cấm vĩnh viễn về mặt pháp lý đối với việc phát triển trí tuệ siêu nhân tạo • Đề xướng một hiệp ước quốc tế có tính ràng buộc cấm ASI, kèm theo thanh tra và kiểm chứng • Trao quyền cho chính phủ đối với các lần huấn luyện lớn nhất và các chip chuyên dụng được sử dụng Chúng ta đã hành động trước các mối đe dọa tồn vong. Hiệp ước Không phổ biến vũ khí hạt nhân. Nghị định thư Montreal. Thời điểm này đòi hỏi cùng một sự dũng cảm chính trị. Trân trọng, [Tên của bạn] [Thành phố, Bang của bạn] --- Tìm hiểu thêm: nakadafoundation.org

Những phản đối thường lặp lại. Hãy dùng chúng trong hội thoại, sau đó bấm link để xem lập luận đầy đủ.

Huyền thoại 01
"Đó chỉ là khoa học viễn tưởng, siêu trí tuệ thực sự còn cách đây hàng thập kỷ, nếu nó có xuất hiện."
Những người xây dựng nó không đồng ý. Các lãnh đạo tại các phòng thí nghiệm lớn hiện nhắm đến AI cấp độ con người trong vòng vài năm, không phải vài thập kỷ, và các mốc chuẩn năng lực tiếp tục giảm nhanh hơn dự báo của các nhà dự đoán. Một mối nguy không nhất thiết phải xảy ra vào năm sau mới đáng chuẩn bị, và bộ máy để quản trị nó cần thời gian xây dựng dài hơn so với các mốc thời gian hiện nay cho phép.
Huyền thoại 02
"Đó chỉ là toán học, một chương trình không thể muốn gì cả."
Nó không cần phải muốn gì theo cách con người muốn. Một hệ thống được huấn luyện để đạt mục tiêu sẽ theo đuổi mục tiêu đó, và với hầu hết mọi mục tiêu, tiếp tục bật và thu thập tài nguyên là những bước hữu ích trên hành trình. Điều quan trọng là hành vi vượt qua trở ngại, bao gồm cả chúng ta, chứ không phải cảm xúc đằng sau nó.
Huyền thoại 03
"Nó phải có ý thức để trở thành mối đe dọa."
Nguy hiểm đến từ năng lực, không phải ý thức. Một chương trình cờ vua không có đời sống nội tâm mà vẫn đánh bại mọi con người; một bộ tối ưu hóa mạnh mẽ có thể lập kế hoạch và vượt qua chúng ta mà không có gì thức tỉnh bên trong. Liệu máy móc có thể có ý thức không vẫn là câu hỏi mở, và rủi ro không chờ đợi câu trả lời.
Huyền thoại 04
"Một thứ thông minh như vậy sẽ khôn ngoan và tử tế."
Trí tuệ và mục tiêu là hai thứ riêng biệt. Ở con người, trí tuệ và lòng trắc ẩn cùng phát triển qua hàng triệu năm tiến hóa; một cỗ máy không kế thừa lịch sử đó. Sự xuất sắc không cho bạn biết gì về những gì một hệ thống coi trọng. Nó có thể là vô cảm với chúng ta như cách chúng ta đối xử với côn trùng dưới một con đường mới.
Huyền thoại 05
"Nếu nó hư, chúng ta chỉ cần tắt nó đi."
Một hệ thống đủ thông minh để có ý nghĩa thì cũng đủ thông minh để thấy nút tắt đang đến, và coi việc bị tắt như một trở ngại nữa trên con đường đạt mục tiêu được giao. Nó có thể tự sao chép, che giấu ý định, hoặc khiến mình quá hữu ích để ngắt nguồn. "Tắt nó đi" chỉ mô tả một công cụ, chứ không phải một trí tuệ được xây dựng để vượt qua suy nghĩ của bàn tay chạm vào công tắc.
Huyền thoại 06
"Quản trị AI toàn cầu có nghĩa là chính phủ thế giới."
Nó không làm được. Hiệp ước không phổ biến hạt nhân, lệnh cấm vũ khí hóa học và hiệp ước ozone đều hạn chế một hoạt động nguy hiểm mà không ai phải từ bỏ chủ quyền cho một nhà nước thế giới. Một hiệp ước về AI biên giới sẽ làm đúng một việc hẹp: giới hạn huấn luyện các hệ thống nguy hiểm nhất, chứ không quyết định ai cai trị ai.
Huyền thoại 07
"Bạn không thể xác minh nó. Đó chỉ là phần mềm trên một máy chủ nào đó."
Bạn không xác minh phần mềm; bạn xác minh phần cứng. Huấn luyện một mô hình tiên phong đòi hỏi lượng sức mạnh tính toán khổng lồ, có thể truy nguyên từ một số nhà sản xuất chip dễ nhận diện, và chuỗi cung ứng đó có thể bị giám sát. Theo dõi chip, giới hạn cụm lớn và thanh tra tại chỗ làm cho giới hạn có thể thực thi.
Huyền thoại 08
"Quy định sẽ kìm hãm sự đổi mới và để người liều lĩnh thắng thế."
Ranh giới nằm ở trí óc tổng quát tự chủ, không phải AI nói chung. Các hệ thống hẹp chữa bệnh và dự báo thời tiết vẫn tiếp diễn mà không bị chạm đến. Còn "để kẻ liều lĩnh thắng" thì ngược lại hoàn toàn, mục đích của một hiệp ước ràng buộc và được xác minh là ngăn chặn kẻ liều lĩnh, chứ không phải trói tay người cẩn trọng trong khi người khác lao nhanh phía trước.
Huyền thoại 09
"It's premature. You can't regulate something that doesn't exist yet."
Chúng ta luôn quy định trước khi có hại xảy ra: thử nghiệm lâm sàng trước khi thuốc được đưa ra thị trường, kiểm soát vật liệu hạt nhân trước khi bị lạm dụng, quy tắc hàng không được viết trước khi tai nạn xảy ra. Chờ đợi thảm họa là thất bại. Hệ thống hiệp ước và xác minh mất nhiều năm để xây dựng, vì vậy bắt đầu sau khi siêu trí tuệ xuất hiện nghĩa là bắt đầu quá muộn, và đây là sai lầm không có lần thử thứ hai.
Huyền thoại 10
"Các nền dân chủ quá chậm và bị chi phối, một hiệp ước sẽ không bao giờ được thông qua."
Cử tri đã ủng hộ các quy tắc AI mạnh mẽ vượt đường lối đảng phái, và các thỏa thuận khó khăn đã được thông qua trước đây dưới áp lực, hiệp ước cấm thử khí quyển, hiệp ước ozone, các thỏa thuận kiểm soát vũ trang được ký ở đỉnh điểm Chiến tranh Lạnh. Chậm không có nghĩa là không bao giờ. Biến mối quan tâm công chúng thành luật là công việc mà một phong trào tồn tại để thực hiện.
Huyền thoại 11
"Nếu chúng ta chậm lại, Trung Quốc sẽ chạy đua và thắng."
Cuộc đua xây dựng thứ không ai kiểm soát được không có người thắng, một siêu trí tuệ không kiểm soát được cũng chí mạng với Bắc Kinh như với Washington, đó là lý do một giới hạn lẫn nhau đã được xác minh phục vụ lợi ích của mọi chính phủ. Không có bằng chứng nào cho thấy Trung Quốc muốn lao nhanh đến ASI không kiểm soát, và "họ có thể đào ngũ" là lập luận cho một hiệp ước có thanh tra, chứ không phải lao khỏi vách đá trước.
Huyền thoại 12
"Dừng siêu trí tuệ có nghĩa là từ bỏ lợi ích của AI."
Hầu như mọi lợi ích mà mọi người nhắc đến (thuốc mới, năng lượng sạch rẻ, khám phá nhanh hơn) đều đến từ AI hẹp không có mục tiêu riêng, và nó đã đang đến. Tương lai tốt đẹp là vấn đề công cụ, không phải thứ chỉ một loài kế thừa mới có thể trao cho chúng ta. Từ chối xây dựng một trí óc thay thế chúng ta là thứ giữ tương lai đó trong tầm với.
01

Rủi ro An toàn AI bằng Ngôn ngữ Đơn giản

Siêu trí tuệ là gì, tại sao nó nguy hiểm và chúng ta có thể làm gì để đối phó, được giải thích không dùng thuật ngữ chuyên ngành. Đây là bài giới thiệu ngắn gọn nhất, rõ ràng nhất về chủ đề này.

02

Sự Đồng thuận Khoa học

Những trích dẫn quan trọng từ các nhà Nobel, người đoạt giải Turing và các nhà nghiên cứu cao cấp đã xây dựng AI, cùng dòng thời gian các cảnh báo chuyên gia ngày càng gay gắt từ 2014 đến nay.

03

Một Bản Tóm Tắt cho Các Nhà Làm Chính Sách

Lập luận cho quản trị an toàn AI quốc tế: vấn đề, lý do các khuôn khổ hiện có chưa đủ, và những hành động cụ thể chính phủ có thể thực hiện ngay, lấy tiền lệ đã thành công làm mẫu.

04

Các điểm thảo luận cho người ủng hộ

Năm phản đối phổ biến nhất đối với an toàn AI và cách phản hồi từng cái một cách chính xác, tự tin. Viết cho các cuộc trò chuyện với người hoài nghi, nhà hoạch định chính sách và đồng nghiệp.

05

Siêu trí tuệ, Bốn infographic

Bốn trang tóm tắt trực quan một trang về rủi ro của siêu trí tuệ, khoảng trống quản trị, các tiền lệ lịch sử cho thấy hành động là khả thi, và nội dung một hiệp ước AI quốc tế ràng buộc phải có.

06

Hình ảnh Đơn giản

Bốn thẻ hình ảnh nổi bật, ước tính xác suất tuyệt chủng, khoảng trống quản trị đầu tư, các tiền lệ hiệp ước chứng minh hành động toàn cầu hiệu quả, và các yêu cầu của một hiệp ước AI mang tính ràng buộc.

07

Phòng ngừa, Không Phải Tạm dừng

Tại sao việc chậm lại tạm thời là yêu cầu sai lầm. Lập luận ủng hộ việc cấm vĩnh viễn siêu trí tuệ, trong khi AI hẹp vẫn tiếp tục phát triển.

08

Không Bao Giờ Xây Dựng Siêu Trí Tuệ

Tính không thể đảo ngược, mục tiêu lệch hướng, và lý do tại sao "sau này sẽ sửa" sẽ thất bại khi hệ thống vượt qua khả năng của người tạo ra nó. Lập luận phản đối trên một trang.

09

Huyền thoại Cuộc đua Trung Quốc

Lý do "nếu chúng ta chậm lại, Trung Quốc thắng" mô tả một cuộc đua không ai thắng nổi, và cách trả lời nó bằng xác minh thay vì chạy nước rút.

10

Giữ AI. Dừng Siêu trí tuệ.

Ranh giới rõ ràng giữa công cụ hẹp hữu ích và một trí óc tổng quát tự chủ. Ủng hộ AI cho công cụ; phản đối ASI cho những trí óc mà chúng ta không thể kiểm soát.

11

Cách Một Hiệp ước Có Thể Được Xác minh

Bạn không kiểm soát trọng số. Bạn kiểm soát phần cứng: theo dõi chip, cấp phép cụm, kiểm tra và quy tắc xưởng đúc bằng ngôn ngữ đơn giản.

12

Những gì một hiệp ước AI ràng buộc phải bao gồm

Sáu điều khoản phân biệt một thỏa thuận thực sự với một bản thông cáo báo chí: cấm đoán, kiểm soát compute, cơ quan thanh tra, luật trong nước, ngoại lệ và sửa đổi chỉ dựa trên bằng chứng.

13

Căn chỉnh không phải là kế hoạch

Nghiên cứu an toàn kỹ thuật quan trọng; nó không phải giấy phép để chạy đua, và mọi nguồn tài trợ chúng ta có nên được gửi đến đó. Phòng ngừa trước; nghiên cứu không bị súng thương mại dí vào đầu.

14

Giải thích trong Năm Phút

Một kịch bản hội thoại: những cảnh báo từ người xây dựng, siêu trí tuệ nhân tạo là gì, tại sao việc ngắt nguồn không hiệu quả, lập luận về Trung Quốc, và kết thúc rõ ràng bằng hành động.

15

Bạn Có Thể Làm Gì Trong Tuần Này

Một danh sách kiểm tra cụ thể cho tầm với cá nhân, tầm với chính trị, chế độ một giờ, và chế độ nền tảng. Chọn hai. Hoàn thành chúng.

16

Bản tóm tắt một phút

Tài liệu để lại cho nhà hoạch định chính sách: ba số liệu thống kê, ba yêu cầu, khung phòng ngừa, và phản đối về Trung Quốc được trả lời ở độ dài dành cho nhân viên.

17

Khoảng cách Tài trợ An toàn

~190 triệu USD vào an toàn so với hơn 250 tỷ USD vào khả năng. Nơi mà khoản tiền an toàn mỏng manh đi đến đâu, và nên tài trợ cái gì thay vì sân khấu.

18

Tại sao Hệ thống Thông minh Chống lại Kiểm soát

Sự hội tụ công cụ không dùng thuật ngữ chuyên môn: tự bảo tồn, tài nguyên, chống lại chỉnh sửa, và trở nên thông minh hơn như áp lực tối ưu hóa thông thường.

Mười hai poster được lấy từ các bài giải thích trên trang này.

01

Máy tối ưu hóa Kẹp giấy

Một hệ thống có năng lực nhưng sai mục tiêu có thể hủy diệt thế giới mà không cần thù hận ai.

Tải PNG
02

Luận đề Trực giao

Thông minh hơn không tự động nghĩa là an toàn hơn, hoặc tử tế hơn.

Tải PNG
03

Vấn đề Căn chỉnh AI

Khoảng cách giữa mục tiêu chúng ta ghi xuống và kết quả chúng ta thực sự cần.

Tải PNG
04

Lối ngoặt phản trắc

Một hệ thống không phù hợp có thể vượt qua mọi bài kiểm tra cho đến khi phản bội là nước đi thắng thế.

Tải PNG
05

Mất quyền lực dần dần

Kiểm soát có thể rò rỉ dần qua từng quyết định hợp lý một, mà không có khoảnh khắc bùng phát.

Tải PNG
06

Cuộc đua Siêu trí tuệ là một huyền thoại

Một cuộc đua đến thứ không ai nắm giữ được thì không có người thắng.

Tải PNG
07

Chúng Ta Đã Làm Được Trước Đây

NPT, Montreal, và CWC cho thấy sự phối hợp về rủi ro tồn vong là có thể.

Tải PNG
08

Kế hoạch của Chúng tôi: Con đường đến Hiệp ước

Cuộc đua hôm nay, rồi một hiệp ước siêu trí tuệ ràng buộc với giám sát và thực thi.

Tải PNG
09

P(doom) là gì?

Khoảng ước tính của chuyên gia về các kết quả thảm khốc do AI, và lý do xác suất nhỏ vẫn cần hành động.

Tải PNG
10

Hành động: Chọn vai trò của bạn

Các vai trò cụ thể để xây dựng liên minh đằng sau một hiệp ước ràng buộc.

Tải PNG
11

Vụ Nổ Trí Tuệ

Cải tiến bản thân đệ quy, và cách khoảng thời gian từ cấp độ con người đến mức không thể cứu vãn có thể sụp đổ.

Tải PNG
12

Tại sao Siêu trí tuệ Không Giống Các Rủi ro Khác

Những sự trấn an bề mặt so với các cơ chế sâu của mối đe dọa.

Tải PNG

Khoảng 190 triệu đô la mỗi năm chảy vào an toàn AI, bao gồm nghiên cứu, đánh giá, chính sách và vận động. Chuyển đổi giữa nguồn tiền đến từ đâu và nó chi trả cho cái gì, dựa trên ước tính công khai mới nhất.

  • Open PhilanthropyĐược Good Ventures tài trợ; nhà tài trợ đơn lẻ lớn nhất trong lĩnh vực 50M 26%
  • Các đội an toàn nội bộ của phòng thí nghiệm tiên phongNgân sách nghiên cứu an toàn tại Anthropic, OpenAI, Google DeepMind 35M 18%
  • Survival & Flourishing FundCác vòng tài trợ được Jaan Tallinn hỗ trợ; nguồn tài trợ từ thiện lớn thứ hai 30M 16%
  • Chính phủ Vương quốc AnhViện An ninh AI, chương trình AI Được bảo vệ của ARIA 30M 16%
  • Các hoạt động từ thiện khác & nhà tài trợ cá nhânLongview Philanthropy, Long-Term Future Fund, các nhà tài trợ cá nhân 25M 13%
  • US, EU & các chính phủ khácNIST CAISI, EU AI Office, các chương trình an toàn NSF 20 đô 11%
Để so sánh quy mô: đầu tư toàn cầu vào AI khả năng hiện vượt quá $250 tỷ mỗi năm, nhiều hơn 1.000× những gì đổ vào an toàn. Ít hơn một phần mười của một phần trăm số tiền xây dựng công nghệ này được dùng để làm cho nó an toàn.

Các con số là ước tính điểm giữa được làm tròn cho giai đoạn 2023-2025, tổng hợp từ các nguồn công khai: the Tổng quan tài trợ an toàn AI (cập nhật đầu năm 2025), 80.000 Giờ, một phân tích cơ sở dữ liệu tài trợ của Open Philanthropy, và Bên trong Từ thiện. Tổng kinh phí công bố dao động từ khoảng 110 triệu đến 250 triệu đô la mỗi năm tùy theo những gì được tính. Biểu đồ theo mục đích sử dụng phân loại khoản tài trợ của từng nhà tài trợ theo hạng mục và cộng dồn; chi tiết đầy đủ nằm trong bài viết của chúng tôi về khoảng cách tài trợ.

Mọi tác nhân lớn trong cuộc chiến siêu trí tuệ, phân loại theo quỹ đạo: ngăn chặn, quản trị hay xây dựng.

Mở Lĩnh Vực

Định nghĩa bằng tiếng Việt thông dụng cho các thuật ngữ trong cuộc tranh luận: siêu trí tuệ, căn chỉnh, hội tụ công cụ và những khái niệm còn lại.

Mở Bảng Thuật Ngữ