Ang modelo ay Mythos, na iniulat na pinakamakapangyarihang sistema ng Anthropic. Ang senador ay si Mark Warner ng Virginia, vice chair ng Senate Intelligence Committee. Ang heneral ay si Joshua Rudd, na namumuno sa NSA at U.S. Cyber Command. Ayon sa salaysay ni Warner, unang iniulat ni The Economist at kumalat sa mga trade press, sinabi ni Rudd sa kanya kung ano ang ginawa ng modelo.
Sa loob ng ilang oras, ng isang komersyal na modelo. Pinagtatalunan ang mga detalye at naging masalimuot ang kuwento sa loob ng ilang araw. Ang ubod nito ay totoo, at sapat na ang ubod nito.
Pumasok ang Mythos sa halos lahat ng classified systems namin, hindi sa loob ng linggo kundi ng oras.
Gen. Joshua Rudd, head of the NSA at U.S. Cyber Command, gaya ng ipinasa ni Sen. Mark Warner at iniulat ng The Economist, Hunyo 2026
"AI hacks the NSA" ang sarili nitong headline. Hindi rin eksaktong iyon ang nangyari. Ang agwat sa pagitan ng viral na bersyon at ng tunay ay dapat tumpak na talakayin, dahil ang tunay ang dapat magpuyat sa iyo.
Ano talaga ang nangyari
Walang rogue machine na bumaling sa mga gumawa nito at sinakop ang mga lihim ng bansa. Naganap ang break-in sa loob ng isang awtorisadong ehersisyong red-team: isang kontroladong security test kung saan itinuro ng ahensya ang modelo sa mga replika ng sarili nitong classified na kapaligiran at inutusang humanap ng paraan papasok.
Mabilis na nag-stack ang mga caveats. Isang opisyal ng gobyerno ang nagsabi mamaya na maaaring pinaikli ni Warner ang kwento sa pagkukwento, at ang linyang "hours, not weeks" ay tumutukoy lamang sa red-teaming context at hindi sa live network. Hindi kinumpirma ng NSA o Cyber Command ang kanyang account. Isama ang lahat ng iyan. Bigyan ng bawat pagwawasto. Ipagpalagay na ang pinakakapanatag na pagbabasa ang nakaligtas.
Ang natitira pagkatapos ng deflation ay ito pa rin. Isang modelong maaari mong arkilahin, na nakatuon sa mga stand-in para sa pinakasecure na sistema na alam ng bansang ito kung paano itayo, natagpuan ang mga flaw at pinagsama-sama ang mga ito sa halos kabuuang access sa isang hapon. Hindi ginagawa iyon ng isang human red team ng pinakamahuhusay na operator sa mundo sa isang hapon.
Pinatay nila ang produkto
Malalaman mo kung gaano kaseryoso ang isang bagay sa pamamagitan ng pagmamasid sa susunod na gagawin ng mga seryosong tao. Hindi nila ito binalewala.
Kinabukasan pagkatapos ng pagsusuri, inilipat ng Departamento ng Komersyo na ipagbawal ang bawat dayuhang nasyonal, kasama na ang sariling hindi mamamayang empleyado ng Anthropic, sa paggamit ng dalawa nitong pinakamahuhusay na modelo, Mythos at Fable. Hindi hinamon ng Anthropic ang teknikalidad. Ito tinanggal ang parehong mga model sa merkado sa buong mundo, para sa lahat, na sinasabi nitong hindi praktikal na ipatupad ang citizenship test sa kung sino ang makakapag-log in. Kinuha ng isang kumpanya ang flagship product nito, ang mismong dahilan ng pag-iral nito para ibenta, at pinatay ito sa buong planeta sa loob ng isang araw. Hindi mo gagawin iyan dahil sa kakayahang sa tingin mo ay ligtas na kontrolado.
At hindi ito isang one-off parlor trick ang NSA test. Sa pamamagitan ng isang classified evaluation program, iniulat na nakahanap ang Mythos ng libu-libong software vulnerabilities, kasama ang isang depekto na nanatiling hindi natuklasan sa OpenBSD, isang operating system na pinipili ng mga security professionals dahil mahirap sirain, sa loob ng dalawampu't pitong taon. Dalawampu't pitong taon ng mga ekspertong mata ng tao ang hindi ito nakita. Binasa ng modelo ang code tulad ng pagbabasa mo ng isang talata. Hindi ito napapagod. Lagi na lang dadami pa ito.
Ito ang pinakamabagal na galaw nito kailanman
Dapat itong mabahala ang sinumang nagbibigay-pansin. Nagmamadali ang mga lab patungo sa superintelligence at lalong bumibilis ang takbo. Isang taon na ang nakalipas, walang sinuman sa labas ng frontier lab ang nakakita ng modelong gumagawa ng ginawa ng Mythos. Pagkalipas ng anim na buwan, magkakaroon ng mga sistema na magpapakita sa Mythos na mabagal, at pagkatapos ng isa pang anim na buwan ay mapapahiya na naman tayo.
Hindi misteryoso ang dahilan kung bakit ito nagkakaroon ng compound effect. Ang isang modelo na sapat na mahusay para makahanap ng mga butas sa software ng mundo ay sapat na mahusay para makatulong sa pagdidisenyo ng sarili nitong kahalili, na siyang buong mekanismo sa likod ng paulit-ulit na pagpapabuti sa sarili. Ang pananaliksik na nagpapabilis sa pananaliksik ay hindi nagdaragdag. Nagpaparami ito. Hindi alintana ng kurba ng kakayahan na hindi pa tayo handa, at hindi ito hihinto sa gilid habang hinihintay ang batas. Hindi pa malapit ang batas.
Tapos na ako sa pagpapalambot nito
Kaya hihinto na ako sa pagpili ng mga salita nang maingat. Wala na tayong oras para sa pagiging maingat. Matagal akong nag-ingat sa pagbigkas ng lahat ng ito nang banayad, para patuloy na makinig ang mga makatwirang tao at hindi ako ilagay sa ilalim ng doom. Naging pananagutan na ang pag-iingat na iyon. Bumibili ito ng reputasyon na nasusukat habang itinayo pa rin ang bagay na sinusukat ko.
Isang malamang na resulta ng karerang ito, kung hindi natin ito pipigilan, ay mawawalan tayo ng kontrol sa ginagawa natin at papatayin tayo nito. Hindi lang "disrupts the labor market." Hindi lang "strains our institutions," bagaman gagawin din nito iyon, habang patungo. Papatayin tayo. Lahat. Lahat ng mahal mo, at lahat ng mahal nila, at ang buong tahimik na hinaharap ng sangkatauhan na dapat sanang sumunod.
Alam ko nang eksakto kung paano ito nababasa sa pahina. Sa ang pinakamalaking survey ng mga AI researcher na naisagawa kailanman, sa halos 2,800 katao na gumagawa ng mga sistemang ito para mabuhay, sa pagitan ng 38 at 51 porsyento ang naglalagay ng tsansa na ang advanced AI ay magdudulot ng resulta na kasing sama ng pagkalipol ng sangkatauhan sa isa sa sampu o mas mataas pa. Hindi isa sa isang milyon. Isa sa sampu, mula mismo sa mga gumagawa. Hindi mo papayagang sumakay ang anak mo sa eroplano na may ganitong tsansa. Sinusuot namin ang buong species.
Geoffrey Hinton nanalo ng Turing Award para sa mga pamamaraang nagbigay-daan sa lahat ng ito, pagkatapos ay umalis sa Google para masabi niya ang iniisip niya nang walang corporate minder sa silid. Inilalagay niya ang tsansang magdala ng extinction ang AI sa 10 hanggang 20 porsyento. Hindi siya ang pinakakilabutan sa larangan. Marami sa mga taong pinakamalapit sa gawain ang naglalagay ng mas mataas na numero, at ang mga estimate ay karaniwang tumataas, hindi bumababa, habang mas malapit ang eksperto sa frontier.
Noong 2023, daan-daang pinakamaraming binabanggit na mga researcher na buhay at ang mga chief executive ng mga lab na nagmamadaling buuin ang teknolohiya, kasama ang Anthropic, ay pumirma sa isang pangungusap mula sa Center for AI Safety: ang pagpapagaan ng panganib ng extinction mula sa AI ay dapat maging global priority kasama ang iba pang societal-scale risks tulad ng pandemics at nuclear war. Inilagay ng mga taong bumubuo nito ang kapangyarihan nitong wakasan ang sangkatauhan sa parehong antas ng nuclear war, pagkatapos ay bumalik sila sa kanilang mga mesa at binilisan pa ang pagbuo. Ang kanilang framing. Ang kanilang mga salita. Ang kanilang mga pangalan.
Pero may magagawa ka tungkol dito
Ang tahimik na pag-asa ay isa pang paraan ng walang ginagawa, at ang walang ginagawa ang dahilan kung bakit natatalo tayo nang default. Hindi ka isang manonood dito.
Naibangon ang Mythos dahil pinindot ng gobyerno, at pinindot ng gobyerno dahil umabot sa kanila ang pressure. Ang mga gobyerno ang nagsusulat ng mga patakaran, at ang mga gobyerno ay sumasagot sa mga taong tumatangging manahimik. Kaya tumanggi ka.
- Sabihin sa inyong mga kinatawan, sa simpleng salita, na gusto mo ng binding limits sa frontier AI at iboboto mo ito. Kung hindi mo pa nagagawa, gamitin ang aming tool para sa sumulat sa iyong kinatawan ginagawang madali ang unang mensahe.
- Suportahan ang isang maipapatupad na internasyonal na kasunduan sa mga pinakamapanganib na sistema, tulad ng ginawa ng mundo noon nang napagpasyahan na masyadong mapanganib ang mga sandatang nuklear at biyolohikal para iwan sa sinumang pinakamabilis kumilos. Ito mismo ang gawain aming plano ay nakasentro sa.
- Suportahan ang mga taong gumagawa nito nang full time. Maglagay ng iyong pangalan sa ibaba, magbigay ng anumang kaya mo, at gawin ito ngayong linggo, hindi pagkatapos ng susunod na headline na mas masahol pa rito.
Sinabi na sa inyo ng mga taong gumagawa nito, sa rekord at sa kanilang sariling pangalan, na maaaring patayin nito ang lahat. Isang AI lang ang nakalusot sa halos lahat ng classified wall ng bansa, sa isang hapon lang, at ang opisyal na tugon ay alisin ito sa merkado bago ang weekend. Huwag nang maghintay ng babala na mas malinaw pa sa mga nasa harap niyo na. Wala nang darating na ganoon.