Mô hình là Mythos, được cho là hệ thống mạnh nhất của Anthropic. Thượng nghị sĩ là Mark Warner của Virginia, phó chủ tịch Ủy ban Tình báo Thượng viện. Tướng là Joshua Rudd, người điều hành cả NSA và Bộ Tư lệnh Tác chiến Mạng Hoa Kỳ. Theo lời kể của Warner, được báo cáo đầu tiên bởi The Economist và được lan truyền trên báo chí chuyên ngành, Rudd nói với anh ta mô hình đã làm gì.
Trong vài giờ, bởi một mô hình thương mại. Chi tiết còn tranh cãi và câu chuyện trở nên phức tạp chỉ sau vài ngày. Nhưng cốt lõi của nó là có thật, và cốt lõi ấy đã đủ.
Mythos xâm nhập gần như toàn bộ hệ thống mật của chúng tôi, không phải trong vài tuần mà chỉ trong vài giờ.
Gen. Joshua Rudd, người đứng đầu NSA và U.S. Cyber Command, theo lời Sen. Mark Warner và được báo cáo bởi The Economist, Tháng 6 năm 2026
"AI hacks the NSA" tự viết tiêu đề của chính nó. Nó cũng không hẳn là những gì đã xảy ra. Khoảng cách giữa phiên bản lan truyền và phiên bản thực tế đáng được làm rõ, bởi vì phiên bản thực tế là thứ nên khiến bạn mất ngủ.
Những gì thực sự đã xảy ra
Không có cỗ máy phản loạn nào tự bật dậy và xông vào kho bí mật quốc gia. Vụ đột nhập diễn ra bên trong một bài tập red-team: một cuộc thử nghiệm an ninh được kiểm soát trong đó cơ quan chỉ định mô hình nhắm vào các bản sao môi trường mật của chính mình và yêu cầu nó tìm cách xâm nhập.
Những lưu ý chất đống nhanh chóng. Một quan chức chính phủ sau đó nói Warner có thể đã nén câu chuyện khi kể lại, và dòng "giờ chứ không phải tuần" chỉ đề cập cụ thể đến ngữ cảnh red-teaming chứ không phải mạng lưới thực tế. NSA lẫn Cyber Command đều chưa xác nhận độc lập tài khoản của ông. Hãy ghi nhận tất cả điều đó. Chấp nhận mọi sửa đổi. Giả sử cách đọc trấn an nhất vẫn tồn tại.
Những gì còn lại sau khi thổi phồng vẫn là thế này. Một mô hình bạn có thể thuê, nhắm vào các đại diện cho những hệ thống an ninh nhất mà đất nước này biết cách xây dựng, đã tìm ra lỗ hổng và xâu chuỗi chúng thành quyền truy cập gần như hoàn toàn chỉ trong một buổi chiều. Một red team con người gồm những operator giỏi nhất thế giới không làm được điều đó trong một buổi chiều.
Họ đã tắt sản phẩm
Bạn có thể học được nhiều về mức độ nghiêm trọng của một vấn đề bằng cách quan sát hành động tiếp theo của những người nghiêm túc. Họ không có thái độ thờ ơ.
Ngày hôm sau cuộc thử nghiệm, Bộ Thương mại đã cấm mọi công dân nước ngoài, bao gồm cả nhân viên không phải công dân của Anthropic, sử dụng hai mô hình mạnh nhất của hãng là Mythos và Fable. Anthropic không kiện tụng về kỹ thuật. Nó rút cả hai mô hình khỏi thị trường toàn cầu, cho mọi người, nói rằng họ không thể thực tế thực thi bài kiểm tra quyền công dân đối với người đăng nhập. Một công ty đã tắt sản phẩm chủ lực của mình, thứ mà nó tồn tại để bán, cho cả hành tinh chỉ trong một ngày. Bạn không làm điều đó vì một năng lực mà bạn tin là an toàn trong tầm kiểm soát.
Và bài kiểm tra NSA không phải là trò ảo thuật một lần. Thông qua chương trình đánh giá mật, Mythos được cho là đã phát hiện hàng nghìn lỗ hổng phần mềm, trong đó có một lỗi nằm ẩn trong OpenBSD suốt hai mươi bảy năm, một hệ điều hành được các chuyên gia bảo mật chọn chính vì nó khó bị phá. Hai mươi bảy năm đôi mắt chuyên gia con người đã bỏ lỡ nó. Mô hình đọc mã như bạn đọc một đoạn văn. Nó không mệt mỏi. Sẽ chỉ có ngày càng nhiều nó.
Đây là lúc nó di chuyển chậm nhất
Điều này phải khiến bất kỳ ai đang chú ý đều lo ngại. Các phòng lab đang chạy đua hướng tới siêu trí tuệ và tốc độ chỉ đang tăng. Một năm trước, không ai ngoài phòng lab frontier từng thấy mô hình làm được những gì Mythos vừa làm. Sáu tháng nữa sẽ có hệ thống khiến Mythos trông chậm chạp, và sáu tháng sau đó sự so sánh sẽ khiến chúng ta xấu hổ thêm lần nữa.
Lý do nó nhân lên không có gì bí ẩn. Một mô hình đủ tốt để tìm lỗ hổng trong phần mềm thế giới cũng đủ tốt để giúp thiết kế phiên bản kế nhiệm của chính nó, đó chính là toàn bộ cơ chế đằng sau cải thiện bản thân đệ quy. Nghiên cứu thúc đẩy nghiên cứu không phải là phép cộng. Đó là phép nhân. Đường cong năng lực không quan tâm chúng ta chưa sẵn sàng, và nó sẽ không dừng lại để chờ luật pháp bắt kịp. Luật pháp còn cách xa.
Tôi đã thôi làm dịu nó
Vậy nên tôi sẽ ngừng chọn từ ngữ quá cẩn thận. Chúng ta không còn thời gian cho sự cẩn thận nữa. Tôi đã dành khá lâu để diễn đạt mọi thứ một cách nhẹ nhàng, để những người hợp lý tiếp tục lắng nghe thay vì xếp tôi vào nhóm bi quan. Sự thận trọng ấy giờ đã trở thành gánh nặng. Nó mang lại danh tiếng đo lường được trong khi thứ tôi đang đo lường vẫn bị xây dựng.
Một kết quả có khả năng xảy ra của cuộc đua này, nếu chúng ta không dừng lại, là chúng ta mất kiểm soát những gì đang xây dựng và nó sẽ giết chúng ta. Không phải "làm rối loạn thị trường lao động." Không phải "làm căng thẳng các thể chế," dù nó cũng sẽ gây ra những điều đó trên đường đi. Giết chúng ta. Mọi người. Tất cả những người bạn yêu quý, và tất cả những người họ yêu quý, và toàn bộ tương lai nhân loại yên bình lẽ ra sẽ đến sau.
Tôi biết chính xác cách nó đọc trên trang. Trong cuộc khảo sát lớn nhất từng được thực hiện với các nhà nghiên cứu AI, với gần 2.800 người xây dựng các hệ thống này để kiếm sống, từ 38 đến 51 phần trăm cho rằng xác suất AI tiên tiến gây ra kết cục tồi tệ ngang với tuyệt chủng loài người là một trên mười hoặc cao hơn. Không phải một trên một triệu. Một trên mười, từ chính những người xây dựng. Bạn sẽ không để con mình lên máy bay với tỷ lệ đó. Chúng ta đang buộc cả loài người ngồi vào ghế.
Geoffrey Hinton đã nhận giải Turing cho các phương pháp khiến tất cả điều này trở nên khả thi, sau đó rời Google để có thể nói những gì ông nghĩ mà không có người giám sát doanh nghiệp trong phòng. Ông đặt khả năng AI dẫn nhân loại đến tuyệt chủng ở mức 10 đến 20 phần trăm. Ông không phải là người sợ hãi nhất trong lĩnh vực. Rất nhiều người gần gũi nhất với công việc đặt con số cao hơn, và các ước tính có xu hướng tăng lên, không giảm xuống, khi chuyên gia ngồi càng gần biên giới.
Năm 2023, hàng trăm nhà nghiên cứu được trích dẫn nhiều nhất còn sống và các giám đốc điều hành của các phòng thí nghiệm đang chạy đua xây dựng công nghệ, trong đó có Anthropic, đã ký một câu duy nhất từ Center for AI Safety: giảm thiểu rủi ro tuyệt chủng do AI nên là ưu tiên toàn cầu song song với các rủi ro quy mô xã hội khác như đại dịch và chiến tranh hạt nhân. Những người đang xây dựng thứ này đặt sức mạnh hủy diệt nhân loại của nó ngang hàng với chiến tranh hạt nhân, rồi quay lại bàn làm việc và xây dựng nó nhanh hơn. Khung của họ. Lời của họ. Tên của họ.
Nhưng bạn có thể làm gì đó về nó
Sự tuyệt vọng thầm lặng là một cách khác để không làm gì cả, và không làm gì là cách chúng ta thua cuộc theo mặc định. Bạn không phải là khán giả ở đây.
Mythos bị kéo ra khỏi kệ vì một chính phủ thúc đẩy, và chính phủ thúc đẩy vì áp lực đã chạm đến họ. Chính phủ viết luật, và chính phủ lắng nghe những người từ chối im lặng. Vậy hãy từ chối im lặng.
- Hãy nói với các đại diện của bạn, bằng những lời lẽ đơn giản, rằng bạn muốn các giới hạn ràng buộc đối với AI tiên phong và bạn sẽ bỏ phiếu cho nó. Nếu bạn chưa bao giờ làm, công cụ của chúng tôi để viết cho đại diện của bạn giúp tin nhắn đầu tiên trở nên dễ dàng.
- Ủng hộ một hiệp ước quốc tế có thể thực thi đối với những hệ thống nguy hiểm nhất, giống như thế giới từng quyết định vũ khí hạt nhân và sinh học quá nguy hiểm để giao cho ai chạy nhanh nhất. Đó chính là công việc kế hoạch của chúng tôi được xây dựng xung quanh.
- Hỗ trợ những người làm việc này toàn thời gian. Add your name below, give what you can, and do it this week, not after the next headline that is worse than this one.
Những người đang xây dựng thứ này đã nói thẳng với bạn, ghi rõ tên tuổi, rằng nó có thể giết chết tất cả mọi người. Một AI vừa xuyên thủng gần như mọi bức tường mật của quốc gia chỉ trong một buổi chiều, và phản ứng chính thức là gỡ nó khỏi thị trường trước cuối tuần. Đừng chờ một lời cảnh báo rõ ràng hơn những gì đã nằm ngay trước mặt bạn. Sẽ không có lời cảnh báo nào như vậy.