모델은 Anthropic의 가장 강력한 시스템으로 알려진 미토스였습니다. 상원의원은 버지니아주 출신으로 상원 정보위원회 부의장인 마크 워너였습니다. 장군은 NSA와 미국 사이버사령부를 모두 지휘하는 조슈아 러드였습니다. 워너의 설명에 따르면, 최초로 보고한 The Economist 그리고 업계 언론 전반에 보도되었습니다, Rudd는 그에게 모델이 한 일을 말해 주었다.
상업 모델이 몇 시간 만에 작성했다. 세부 내용은 논쟁 중이고 며칠 안에 이야기가 복잡해졌지만, 핵심은 사실이며 그 핵심만으로도 충분하다.
신화가 우리의 거의 모든 기밀 시스템에 침투했습니다. 몇 주가 아니라 몇 시간 만에.
NSA와 미 사이버사령부 책임자인 조슈아 러드 장군이 마크 워너 상원의원을 통해 전달한 내용으로 The Economist, 2026년 6월
"인공지능이 NSA를 해킹한다"는 제목을 스스로 씁니다. 실제로 일어난 일은 그와 조금 다릅니다. 바이럴 버전과 실제 버전 사이의 간격을 정확히 아는 것은 중요합니다. 실제 버전이 바로 당신을 밤잠 설치게 할 내용이기 때문입니다.
실제로 일어난 일
어떤 불법 기계도 제작자를 배신하고 국가 기밀을 습격하지 않았습니다. 침입은 승인된 적대팀 연습: 통제된 보안 테스트로, 기관이 모델을 자체 기밀 환경 복제본에 겨냥하고 침투 경로를 찾도록 지시했습니다.
주의사항들이 빠르게 쌓여갔다. 정부 관리는 나중에 워너가 이야기를 다시 말할 때 압축했을 수 있다고 말했으며, "몇 주가 아닌 몇 시간"이라는 표현은 실제 네트워크가 아닌 레드팀 맥락을 구체적으로 가리킨다고 했다. NSA나 사이버사령부는 그의 설명을 독립적으로 확인하지 않았다. 그 모든 것을 받아들여라. 모든 수정을 인정하라. 가장 안심되는 해석이 살아남았다고 가정하라.
디플레이션 후에도 남는 것은 이것입니다. 이 나라가 구축할 수 있는 가장 안전한 시스템의 대역을 겨냥해 임대할 수 있는 모델이 결함을 찾아내 단 한 오후 만에 거의 완전한 접근으로 연결했습니다. 세계 최고의 운영자로 구성된 인간 레드팀도 한 오후 만에 그렇게 하지 못합니다.
그들은 제품을 껐습니다
무언가가 얼마나 심각했는지 알 수 있는 좋은 방법은 진지한 사람들이 다음에 무엇을 하는지 지켜보는 것입니다. 그들은 어깨를 으쓱하지 않았습니다.
시험 다음 날 상무부는 모든 외국인을 포함해 Anthropic의 비시민 직원까지 가장 유능한 두 모델인 Mythos와 Fable 사용을 금지하는 조치를 취했습니다. Anthropic은 그 기술적 문제를 소송하지 않았습니다 전 세계 시장에서 두 모델을 모두 철수시켰다, 모두를 위해, 로그인할 수 있는 사람에 대한 시민권 시험을 실제로 집행할 수 없다고 말하면서. 한 회사는 자사의 주력 제품, 즉 존재 이유인 그 제품을 하루 만에 전 세계에서 꺼버렸습니다. 안전하게 통제할 수 있다고 믿는 능력 때문에 그렇게 하지 않습니다.
NSA 실험은 일회성 묘기가 아니었다. 기밀 평가 프로그램을 통해 Mythos는 수천 건의 소프트웨어 취약점을 발견했다고 알려졌으며, 그중에는 보안 전문가들이 깨기 어렵다고 선택한 운영체제 OpenBSD에 27년 동안 발견되지 않았던 결함도 포함됐다. 27년 동안 전문가의 눈이 놓친 것을 모델은 문단을 읽듯 코드를 읽었다. 모델은 피곤해하지 않는다. 앞으로는 더 많아질 뿐이다.
이것이 앞으로 가장 느리게 움직일 때이다
이것은 주의를 기울이는 누구에게나 경고가 되어야 합니다. 연구소들은 초지능을 향해 질주하고 있으며 속도는 점점 빨라지고 있습니다. 1년 전에는 최전선 연구소 밖에서 미토스가 한 일을 본 사람이 없었습니다. 6개월 후에는 미토스를 느리게 보이게 만드는 시스템이 등장할 것이고, 그 6개월 후에는 다시 비교 자체가 부끄러워질 것입니다.
문제가 커지는 이유는 분명합니다. 세계 소프트웨어의 취약점을 찾을 만큼 뛰어난 모델은 스스로의 후계자를 설계하는 데도 도움을 줄 수 있으며, 이것이 바로 메커니즘의 전부입니다 재귀적 자기 개선. 연구를 가속하는 연구는 더하지 않습니다. 곱합니다. 능력 곡선은 우리가 준비되지 않았다는 사실에 관심이 없으며, 법이 따라잡을 때까지 길가에 멈춰 기다려 주지 않습니다. 법은 아직 멀었습니다.
더 이상 완화하지 않겠습니다
그래서 이제는 말을 조심스럽게 고르는 것을 그만두겠습니다. 조심할 시간은 이미 지났습니다. 저는 오랫동안 이 모든 내용을 부드럽게 표현해 왔습니다. 합리적인 사람들이 계속 귀를 기울이고 저를 파멸론자로 분류하지 않도록 하기 위해서였습니다. 그 신중함은 이제 부담이 되었습니다. 그것은 제가 신중하게 다루는 사안이 어쨌든 구축되는 동안 신중하다는 평판만 사들입니다.
이 경주를 멈추지 않는다면, 일어날 가능성이 높은 결과는 우리가 만들고 있는 것을 통제하지 못하게 되고 그것이 우리를 죽인다는 것입니다. "노동 시장을 혼란에 빠뜨린다"가 아닙니다. "기관에 부담을 준다"도 아닙니다. 비록 그것이 가는 길에 그렇게 하겠지만. 우리를 죽입니다. 모두를. 사랑하는 모든 사람을, 그리고 그들이 사랑하는 모든 사람을, 그리고 그 후에 와야 했던 조용한 인간의 미래 전체를.
그게 페이지에 어떻게 읽히는지 정확히 압니다 지금까지 진행된 AI 연구자 대상 조사 중 최대 규모, 에서 이들 시스템을 생업으로 만드는 거의 2,800명 중 38~51퍼센트는 고도 AI가 인류 멸종만큼 나쁜 결과를 초래할 확률을 10분의 1 이상으로 본다. 100만 분의 1이 아니다. 10분의 1이다. 제작자들 자신이 말하는 수치다. 그런 확률로 자녀를 비행기에 태우게 두지는 않을 것이다. 우리는 온 인류를 그 자리에 앉히고 있다.
Geoffrey Hinton 는 이 모든 것을 가능하게 한 방법으로 튜링상을 받았고, 기업 감시인이 없는 방에서 자신의 생각을 말할 수 있도록 Google을 떠났다. 그는 인공지능이 인류를 멸종으로 몰아갈 확률을 10~20퍼센트로 본다. 그는 분야에서 가장 두려워하는 사람이 아니다. 작업에 가장 가까운 많은 사람들은 그 수치를 더 높게 잡으며, 전문가가 최전선에 가까이 앉을수록 추정치는 내려가지 않고 올라가는 경향이 있다.
2023년, 가장 많이 인용되는 생존 연구자 수백 명과 기술 개발 경쟁 연구소 최고경영진(Anthropic 포함)이 AI 안전 센터의 한 문장에 서명했습니다. AI로 인한 인류 멸종 위험 완화는 팬데믹이나 핵전쟁 같은 다른 사회 규모 위험과 함께 세계적 우선순위가 되어야 한다는 내용이었습니다. 이를 만드는 사람들은 그 힘이 인류를 끝낼 수 있음을 핵전쟁과 같은 호흡으로 언급한 뒤, 책상으로 돌아가 더 빠르게 만들었습니다. 그들의 표현. 그들의 말. 그들의 이름.
하지만 당신은 그것에 대해 뭔가 할 수 있습니다
조용한 절망 역시 아무것도 하지 않는 또 다른 방식이며, 아무것도 하지 않는 것이 우리가 기본적으로 지는 길이다. 당신은 여기서 구경꾼이 아니다.
미토스가 선반에서 내려진 것은 정부가 밀어붙였기 때문이고, 정부가 밀어붙인 것은 압력이 정부에 닿았기 때문입니다. 정부가 규칙을 만들고, 정부는 침묵을 거부하는 사람들에게 답합니다. 그러니 침묵하지 마십시오.
- 대표자들에게 평이한 말로 전하세요, 최첨단 인공지능에 구속력 있는 제한을 원하며 이에 투표할 것이라고 말하십시오. 한 번도 해본 적이 없다면 우리의 도구를 대표에게 편지 쓰기 첫 번째 메시지를 쉽게 만듭니다.
- 집행 가능한 국제 조약을 지지하세요 가장 위험한 시스템에 대해, 세계가 한때 핵무기와 생물학 무기가 가장 빠르게 움직이는 자에게 맡기기에는 너무 위험하다고 결정했던 방식으로. 바로 그 작업이 우리의 계획 주위에 구축됩니다.
- 이 일을 전업으로 하는 사람들을 지원하라. 아래에 이름을 추가하고, 기부할 수 있는 만큼 기부하며, 이번 주에 하라. 이번 사건보다 더 나쁜 다음 헤드라인 이후가 아니다.
이 기술을 만드는 사람들은 기록으로, 실명으로, 그것이 모두를 죽일 수도 있다고 말했다. 한 AI가 하루 오후에 이 나라가 가진 거의 모든 기밀 장벽을 뚫고 지나갔고, 공식 대응은 주말 전에 그것을 시장에서 빼는 것이었다. 이미 눈앞에 놓인 경고보다 더 명확한 경고를 기다리지 말라. 그런 경고는 오지 않을 것이다.