Le modèle était Mythos, considéré comme le système le plus puissant de Anthropic. Le sénateur était Mark Warner de Virginie, vice-président de la commission du renseignement du Sénat. Le général était Joshua Rudd, qui dirige à la fois la NSA et le Cyber Command américain. Selon Warner, signalé pour la première fois par The Economist et repris dans la presse spécialisée, Rudd lui a expliqué ce que le modèle avait fait.

En quelques heures, par un modèle commercial. Les détails sont contestés et l'histoire s'est compliquée en quelques jours. Le cœur en est réel, et le cœur en est suffisant.

Mythos a pénétré presque tous nos systèmes classifiés, non pas en semaines, mais en heures.

Le gén. Joshua Rudd, chef de la NSA et du U.S. Cyber Command, tel que relayé par le sén. Mark Warner et rapporté par The Economist, juin 2026

« L’IA pirate la NSA » fait un titre tout trouvé. Ce n’est pourtant pas exactement ce qui s’est passé. L’écart entre la version virale et la réalité mérite d’être précisé, car c’est la réalité qui devrait vous empêcher de dormir.

Ce qui s'est réellement passé

Aucune machine renégate ne s'est retournée contre ses créateurs ni n'a pillé les secrets de la nation. L'intrusion s'est produite à l'intérieur d'un exercice d'équipe rouge: un test de sécurité contrôlé au cours duquel l’agence a dirigé le modèle vers des répliques de ses propres environnements classifiés et lui a demandé d’y pénétrer.

Les réserves se sont accumulées rapidement. Un responsable gouvernemental a ensuite indiqué que Warner avait peut-être condensé l’histoire dans son récit et que l’expression « des heures, pas des semaines » se rapportait spécifiquement au contexte du red teaming et non à un réseau opérationnel. Ni la NSA ni le Cyber Command n’ont confirmé indépendamment son propos. Il faut prendre tout cela en compte. Accorder toutes les corrections. Retenir la lecture la plus rassurante.

Ce qui reste après la déflation est toujours ceci. Un modèle que l'on peut louer, dirigé contre des substituts des systèmes les plus sécurisés que ce pays sache construire, a trouvé les failles et les a enchaînées pour obtenir un accès quasi total en un seul après-midi. Une équipe rouge humaine des meilleurs opérateurs mondiaux n'y parvient pas en un après-midi.

Ils ont désactivé le produit

On peut apprendre beaucoup sur le sérieux d'une chose en observant ce que font ensuite les personnes sérieuses. Ils n'ont pas haussé les épaules.

Le lendemain de l'essai, le ministère du Commerce a interdit à tout ressortissant étranger, y compris les employés non citoyens du Anthropic lui-même, d'utiliser ses deux modèles les plus performants, Mythos et Fable. Le Anthropic n'a pas contesté la subtilité technique. Il retiré les deux modèles du marché mondial, pour tout le monde, en disant qu'il ne pouvait pas pratiquement imposer un test de citoyenneté à ceux qui se connectent. Une entreprise a pris son produit phare, la chose même qui justifie son existence, et l'a désactivé pour la planète entière en une journée. On ne fait pas cela pour une capacité que l'on croit maîtrisée en toute sécurité.

Et le test de la NSA n'était pas un tour de salon isolé. À travers un programme d'évaluation classifié, Mythos aurait fait apparaître des milliers de vulnérabilités logicielles, dont une faille restée non découverte pendant vingt-sept ans dans OpenBSD, un système d'exploitation choisi par les professionnels de la sécurité précisément parce qu'il est difficile à percer. Vingt-sept ans d'yeux humains experts l'ont manquée. Le modèle a lu le code comme on lit un paragraphe. Il ne se fatigue pas. Il n'y en aura jamais que davantage.

C'est le plus lent que cela ne bougera jamais

Cela devrait alarmer tous ceux qui suivent la question. Les laboratoires courent vers la superintelligence et le rythme ne cesse de s’accélérer. Il y a un an, personne en dehors d’un laboratoire de pointe n’avait vu un modèle accomplir ce que vient de faire Mythos. Dans six mois, des systèmes rendront Mythos obsolète, et six mois plus tard la comparaison nous paraîtra à nouveau dépassée.

La raison pour laquelle cela s’aggrave n’a rien de mystérieux. Un modèle assez bon pour trouver les failles des logiciels mondiaux est assez bon pour aider à concevoir son propre successeur, ce qui est tout le mécanisme derrière auto-amélioration récursive. La recherche qui accélère la recherche n'ajoute pas. Elle multiplie. La courbe des capacités ne se soucie pas que nous ne soyons pas prêts, et elle ne s'arrêtera pas au bord du trottoir en attendant que la loi rattrape son retard. La loi n'est pas proche.

J'ai fini de l'adoucir

Alors je vais cesser de choisir mes mots avec tant de soin. Nous n'avons plus le temps pour la prudence. J'ai passé longtemps à formuler tout cela avec douceur, pour que des gens raisonnables continuent d'écouter sans me classer parmi les prophètes de malheur. Cette prudence est devenue un handicap. Elle achète une réputation de mesure alors que la chose sur laquelle je suis mesuré se construit quand même.

Un résultat probable de cette course, si nous ne l'arrêtons pas, est que nous perdons le contrôle de ce que nous construisons et que cela nous tue. Pas « perturbe le marché du travail ». Pas « met nos institutions à rude épreuve », même si cela arrivera aussi, en chemin. Nous tue. Tout le monde. Tous ceux que vous aimez, et tous ceux qu'ils aiment, et tout l'avenir humain tranquille qui était censé suivre.

Je sais exactement comment cela se lit sur la page. Dans la plus grande enquête jamais menée auprès de chercheurs en IA, avec près de 2 800 personnes qui construisent ces systèmes pour vivre, entre 38 et 51 pour cent estiment à une chance sur dix ou plus les probabilités qu'une IA avancée provoque des issues aussi graves que l'extinction humaine. Pas une sur un million. Une sur dix, de la part des constructeurs eux-mêmes. Vous ne laisseriez pas votre enfant monter dans un avion avec de telles probabilités. Nous attachons toute l'espèce dans le siège.

Geoffrey Hinton a reçu le prix Turing pour les méthodes qui ont rendu tout cela possible, puis a quitté Google afin de pouvoir dire ce qu'il pense sans un surveillant d'entreprise dans la pièce. Il évalue à 10-20 % la probabilité qu'une IA conduise l'humanité à l'extinction. Il n'est pas la personne la plus effrayée du domaine. Beaucoup de ceux qui sont les plus proches du travail placent le chiffre plus haut, et les estimations ont tendance à monter, pas à baisser, plus l'expert est proche de la frontière.

En 2023, des centaines des chercheurs les plus cités au monde et les dirigeants des laboratoires qui se précipitent pour construire cette technologie, Anthropic parmi eux, ont signé une seule phrase du Center for AI Safety : atténuer le risque d’extinction par l’IA devrait être une priorité mondiale au même titre que d’autres risques sociétaux comme les pandémies et la guerre nucléaire. Les personnes qui construisent cela ont placé son pouvoir de mettre fin à l’humanité sur le même plan que la guerre nucléaire, puis sont retournées à leurs bureaux et l’ont construit plus vite. Leur cadrage. Leurs mots. Leurs noms.

Mais vous pouvez faire quelque chose

Le désespoir silencieux n’est qu’une autre façon de ne rien faire, et ne rien faire, c’est perdre par défaut. Vous n’êtes pas spectateur.

Mythos a été retiré des rayons parce qu'un gouvernement a poussé, et le gouvernement a poussé parce que la pression l'a atteint. Les gouvernements écrivent les règles, et les gouvernements répondent aux personnes qui refusent de se taire. Alors refusez.

  • Dites à vos représentants, en termes simples, que vous voulez des limites contraignantes sur l'IA de pointe et que vous voterez en ce sens. Si vous ne l'avez jamais fait, notre outil pour écrivez à votre représentant rend le premier message facile.
  • Soutenez un traité international contraignant sur les systèmes les plus dangereux, comme le monde a jadis décidé que les armes nucléaires et biologiques étaient trop dangereuses pour les laisser à ceux qui vont le plus vite. C’est exactement le travail notre plan est construit autour.
  • Soutenez les personnes qui font cela à temps plein. Ajoutez votre nom ci-dessous, donnez ce que vous pouvez, et faites-le cette semaine, pas après le prochain titre qui sera pire que celui-ci.

Les gens qui construisent cela vous ont dit, publiquement et sous leur propre nom, que cela pourrait tuer tout le monde. Une IA a franchi presque tous les murs classifiés du pays en un seul après-midi, et la réponse officielle a été de la retirer du marché avant le week-end. Arrêtez d’attendre un avertissement plus clair que ceux déjà posés devant vous. Il n’y en aura pas.