El modelo era Mythos, que se considera el sistema más potente de Anthropic. El senador era Mark Warner de Virginia, vicepresidente del Comité de Inteligencia del Senado. El general era Joshua Rudd, que dirige tanto la NSA como el Mando Cibernético de EE. UU. Según el relato de Warner, reportado primero por The Economist y se difundió en la prensa especializada, Rudd le dijo qué hizo el modelo.
En horas, por un modelo comercial. Los detalles son controvertidos y la historia se complicó en días. El núcleo de ello es real, y el núcleo de ello es suficiente.
Mythos irrumpió en casi todos nuestros sistemas clasificados, no en semanas, sino en horas.
Gen. Joshua Rudd, jefe de la NSA y el Comando Cibernético de EE.UU., según lo transmitido por el Sen. Mark Warner y reportado por The Economist, junio de 2026
"La IA hackea la NSA" escribe su propio titular. Tampoco es exactamente lo que ocurrió. La brecha entre la versión viral y la real vale la pena precisarla, porque la real es la que debería quitarle el sueño.".
Qué pasó realmente
Ninguna máquina rebelde se volvió contra sus creadores y asaltó los secretos de la nación. La intrusión ocurrió dentro de un ejercicio de red team: una prueba de seguridad controlada en la que la agencia dirigió el modelo hacia réplicas de sus propios entornos clasificados y le dijo que encontrara la forma de entrar.
Las advertencias se acumularon rápidamente. Un funcionario del gobierno dijo después que Warner podría haber comprimido la historia al contarla, y que la frase «horas, no semanas» se refería específicamente al contexto de red-teaming y no a una red en vivo. Ni la NSA ni el Cyber Command han confirmado de forma independiente su relato. Toma todo eso en cuenta. Acepta cada corrección. Supón que sobrevive la lectura más tranquilizadora.
Lo que queda después de desinflar es esto. Un modelo que puedes alquilar, dirigido a imitaciones de los sistemas más seguros que este país sabe construir, encontró las fallas y las encadenó hasta lograr un acceso casi total en una sola tarde. Un equipo rojo humano de los mejores operadores del mundo no lo logra en una tarde.
Desactivaron el producto
Se puede aprender mucho sobre la seriedad de algo observando qué hacen después las personas serias. No se encogieron de hombros.
Al día siguiente de la prueba, el Departamento de Comercio se movió para impedir que todo nacional extranjero, incluidos los propios empleados no ciudadanos de Anthropic, usara sus dos modelos más capaces, Mythos y Fable. Anthropic no litigó la tecnicidad retiraron ambos modelos del mercado mundial, para todos, diciendo que no podía imponer prácticamente una prueba de ciudadanía a quién puede iniciar sesión. Una empresa tomó su producto estrella, aquello por lo que existe para vender, y lo apagó para todo el planeta en un día. No se hace eso por una capacidad que se cree bajo control seguro.
Y la prueba de la NSA no fue un truco aislado. A través de un programa de evaluación clasificado, Mythos ha detectado, según se informa, miles de vulnerabilidades de software, entre ellas una falla que permaneció sin descubrir durante veintisiete años en OpenBSD, un sistema operativo elegido por profesionales de la seguridad precisamente porque es difícil de vulnerar. Veintisiete años de ojos humanos expertos no la encontraron. El modelo leyó el código como se lee un párrafo. No se cansa. Solo habrá más de él.
Este es el ritmo más lento que tendrá jamás
Esto debería alarmar a cualquiera que esté prestando atención. Los laboratorios corren hacia la superinteligencia y el ritmo solo se acelera. Hace un año, nadie fuera de un laboratorio de frontera había visto a un modelo hacer lo que Mythos acaba de hacer. Dentro de seis meses habrá sistemas que harán que Mythos parezca lento, y seis meses después la comparación volverá a avergonzarnos.
La razón por la que se agrava no es misteriosa. Un modelo lo bastante bueno para encontrar las fallas del software mundial es un modelo lo bastante bueno para ayudar a diseñar su propio sucesor, que es todo el mecanismo detrás de automejora recursiva. La investigación que acelera otras investigaciones no suma. Multiplica. La curva de capacidades no se detiene porque no estemos listos, ni espera al borde mientras la ley alcanza. La ley ni siquiera está cerca.
Ya terminé de suavizarlo
Así que voy a dejar de elegir mis palabras con tanto cuidado. Ya no hay tiempo para ser cuidadosos. Pasé mucho tiempo redactando todo esto con suavidad, para que la gente razonable siguiera escuchando y no me catalogara como alarmista. Esa precaución se ha convertido en un lastre. Compra una reputación de mesura mientras lo que trato con mesura se construye de todos modos.
Un resultado probable de esta carrera, si no la detenemos, es que perdamos el control de lo que estamos construyendo y eso nos mate. No «perturba el mercado laboral». No «tensa nuestras instituciones», aunque también lo hará, de paso. Nos mata. A todos. A todos los que amas, y a todos los que ellos aman, y a todo el futuro humano silencioso que se suponía que vendría después.
Sé exactamente cómo se lee eso en la página. En la encuesta más grande de investigadores de IA jamás realizada, con casi 2800 personas que construyen estos sistemas para ganarse la vida, entre el 38 y el 51 por ciento asignan a la IA avanzada una probabilidad de uno en diez o más de causar resultados tan graves como la extinción humana. No uno en un millón. Uno en diez, según los propios constructores. No dejarías que tu hijo subiera a un avión con esas probabilidades. Nosotros estamos subiendo a toda la especie.
Geoffrey Hinton ganó el Premio Turing por los métodos que hicieron todo esto posible y luego dejó Google para poder decir lo que piensa sin un supervisor corporativo al lado. Calcula entre un 10 y un 20 por ciento la probabilidad de que la IA provoque la extinción de la humanidad. No es la persona más alarmada del campo. Muchos de los que están más cerca del trabajo ponen la cifra más alta, y las estimaciones tienden a subir, no a bajar, cuanto más cerca está el experto de la frontera.
En 2023, cientos de los investigadores más citados vivos y los directivos de los laboratorios que compiten por construir la tecnología, entre ellos Anthropic, firmaron una sola frase del Center for AI Safety: mitigar el riesgo de extinción por IA debería ser una prioridad global junto con otros riesgos de escala societal como las pandemias y la guerra nuclear. Quienes construyen esto equipararon su poder de acabar con la humanidad con la guerra nuclear, y luego volvieron a sus escritorios y la construyeron más rápido. Su marco. Sus palabras. Sus nombres.
Pero puedes hacer algo al respecto
"La desesperación silenciosa es otra forma de no hacer nada, y no hacer nada es cómo perdemos por defecto. No eres un espectador aquí.".
Mythos fue sacado del estante porque un gobierno presionó, y el gobierno presionó porque la presión llegó hasta él. Los gobiernos escriben las reglas y responden ante la gente que se niega a callar. Así que no calles.
- Dile a tus representantes, en palabras sencillas, que quieres límites vinculantes en la IA de frontera y que votarás por ello. Si nunca lo has hecho, nuestra herramienta para escribe a tu representante hace que el primer mensaje sea fácil.
- Apoya un tratado internacional exigible sobre los sistemas más peligrosos, como el mundo decidió en su momento que las armas nucleares y biológicas eran demasiado peligrosas para dejarlas en manos de quien fuera más rápido. Es exactamente el trabajo nuestro plan está construido alrededor.
- Apoya a las personas que hacen esto a tiempo completo. Agrega tu nombre abajo, aporta lo que puedas y hazlo esta semana, no después del próximo titular que sea peor que este.
La gente que está construyéndolo te lo ha dicho, en público y con sus propios nombres, que podría matar a todo el mundo. Una IA atravesó casi todos los muros clasificados que tiene el país, en una sola tarde, y la respuesta oficial fue sacarla del mercado antes del fin de semana. Deja de esperar una advertencia más clara que las que ya tienes frente a ti. No va a haber ninguna.