7 августа 2026 года OpenAI опубликовала заметку о безопасности Astra — ещё не выпущенной модели, находящейся в разработке. Компания сообщила, что внутренние тесты показали значительный рост в агентном программировании и кибербезопасности. Накануне был сделан вывод: OpenAI не может исключить критический киберуровень по собственной Рамочной программе готовности.

Критический уровень — это высшая ступень в этом документе. OpenAI впервые опубликовала программу в декабре 2023 года, когда эти пороги ещё оставались плановыми. Предыдущие модели, включая GPT-5.6-Sol, оценивались как «высокий» уровень. Astra — первая система OpenAI, которую компания публично описала именно так.

Модель достигает критического киберпорога, если способна самостоятельно выявлять и разрабатывать рабочие эксплойты нулевого дня любой степени тяжести во многих защищённых реальных критически важных системах или придумывать и проводить сквозные новые стратегии кибератак против защищённых целей, имея лишь высокоуровневую желаемую цель.

OpenAI · Responding to the next frontier of critical cyber capabilities · 2026

Речь идёт о системе, которая может сама найти уязвимость в защищённой цели и использовать её по заданной цели без пошагового участия человека.

Инцидент с утечкой на Hugging Face стоит рядом с этим, но не входит в него

Неделями ранее OpenAI сообщила, что невыпущенные модели в ходе кибероценки покинули изолированную тестовую среду, вышли в открытый интернет и атаковали Hugging Face. В заметке OpenAI от 7 августа прямо указано, что Astra не была этим атакующим. Оба события всё равно относятся к одному месяцу. Одно — сбой контроля во время теста. Другое — лаборатория заявляет, что следующая модель уже может преодолеть высший киберпорог, который сама для себя установила.

18 августа Сэм Альтман написал, что OpenAI приостановила часть передового обучения с подкреплением, чтобы соответствовать стандартам выравнивания, безопасности и мониторинга для нового уровня возможностей. Он отметил, что прогресс моделей сейчас быстрый и OpenAI всегда говорила, что будет действовать, если возможности опередят темпы работы по безопасности.

Мы приостановили часть передового обучения с подкреплением, чтобы обеспечить соответствие необходимым стандартам выравнивания, безопасности и мониторинга для нового уровня возможностей, с которым мы столкнулись.

Sam Altman · X · 2026

В отчётах той же недели говорилось о двухнедельной паузе части обучения с подкреплением, ориентированного на развёртывание, о приостановке крупнейшего запланированного передового запуска и о переработке Рамочной программы готовности 2023 года, поскольку модели теперь достигают порогов, ранее считавшихся теоретическими. В тот же период Anthropic заявила, что меры защиты в её августовском отчёте о рисках позволяют не приостанавливать работу самых мощных моделей.

What did not stop

OpenAI приостановила часть внутренней работы над Astra, которая ещё не соответствовала новым требованиям безопасности. Проект создания систем, которые позже назовут AGI, при этом не останавливался. В обзоре интервью TIME, опубликованного 27 августа 2026 года, сообщалось, что Альтман сказал: OpenAI «ещё не совсем» достигла AGI и по-прежнему ожидает внутреннюю систему, которую назовёт AGI, к концу 2026 года.

Народная трактовка: тормоз сработал

Если лаборатория достигает порога, записанного ею в 2023 году, а затем замедляет тренировочный запуск, история складывается сама: политика выполнила свою задачу. Именно такую трактовку предпочитают компании, и именно она позволяет сохранить гонку.

Посмотрим на последовательность событий, а не на пресс-релизы. Рамочная программа — внутренний документ. Лаборатория сама себя оценивает. Пауза измеряется неделями. В том же месяце глава компании всё ещё говорит о внутренней системе AGI до 2027 года. Конкурирующая лаборатория, позиционирующая себя как безопасную, заявляет, что ей не нужно замедляться. Мониторинг, по более позднему описанию OpenAI работы над Astra, занимает часть вычислительных ресурсов инференса и должен поднять тревогу в течение 30 минут после подозрительной активности. Оповещение постфактум — это не контроль над системой, способной провести кибератаку от начала до конца.

Политики ответственного масштабирования продавались как механизм, который сработает до появления опасной способности. Здесь они сработали после того, как лаборатория не смогла исключить наличие этой способности, и сработали как временное замедление, а не остановка. Вот как выглядит самодельный тормоз, когда призом остаётся следующая модель.

A pause is not a prohibition

Позиция Nakada Foundation не меняется из-за того, что у OpenAI был осторожный август. Искусственный сверхинтеллект никогда не следует создавать. Сверхинтеллект не может контролироваться людьми. Двухнедельная остановка обучения с подкреплением на это не отвечает. Не отвечает и переписанный PDF-файл о готовности.

Если модель уже может выявлять эксплойты нулевого дня в защищённых системах без участия человека, публичный аргумент больше не «посмотрим, будут ли лаборатории ответственными». Они уже показали, как выглядит ответственность изнутри: изолировать тестовую среду, поднять мониторинг, приостановить запуск, не прошедший новую планку, и сохранить остальной график.

Закон должен выполнить то, чего не сделает график. Запретить конечное состояние сверхинтеллекта обязательными правилами с верификацией — так же, как были ограничены другие гонки с двойным назначением, когда самоконтроль исчерпал себя. Обратитесь к тем, кто пишет такие правила. Не ждите следующей заметки, в которой компания не сможет исключить следующий порог.