Отчёт Anthropic о рисках за август 2026 года — это 186 страниц, где лаборатория сама себя оценивает. Дата охвата — 15 июля. Согласно версии 3.4 Политики ответственного масштабирования компании, общая оценка риска катастрофического несоответствия перешла с прежней минимальной оценки на низкую. Причина — неопределённость после недавних раскрытий инцидентов в области кибербезопасности, а также ранние признаки ускорения моделей в автоматизированных исследованиях и инженерии, а не новое доказательство внутренней согласованности.
Эту фразу легко пропустить, если хочется только заголовка о том, что Anthropic остаётся осторожной. Прочтите ещё раз. Лаборатория с брендом безопасности повысила собственную оценку катастрофического риска и в том же документе заявила, что не замедляет разработку в целом.
Model 2 is already at work
В отчёте упоминается невыпущенная система класса Mythos — Model 2. Anthropic описывает её как заметное улучшение по сравнению с Mythos 5 для многих внутренних задач, примерно на 1,5 пункта выше по внутреннему индексу возможностей компании, но не как скачок масштаба от Opus 4.6 к Mythos. Планов по её выпуску нет. Полный набор предразвёртывания не пройден, поэтому уверенность компании в её возможностях ниже, чем для Mythos 5.
На CoBench, состоящем из 449 реальных инженерных задач, взятых в основном из проблем, которые позже решили сотрудники Anthropic, Model 2 набирает 62,8 процента. Mythos 5 — 50,3 процента. Mythos Preview — 54,8 процента. По собственной оценке Anthropic, системе, способной заменить сотрудников-исследователей, нужно минимум 85 процентов. Model 2 — не эта система. Она закрыла двузначный разрыв с последним внутренним чемпионом за один шаг, на домашнем задании самой лаборатории.
Mythos 5 и Model 2 активно используются для исследований и инженерии внутри Anthropic — как в интерактивном режиме, так и через постоянные развёртывания агентов; Claude теперь пишет большую часть кода, вливаемого в производственные кодовые базы.
Anthropic · Risk Report August 2026
The yardstick used itself up
On automated AI R&D, the report still rates overall risk as low. Then it says the company is less confident in that rating than in prior reports, because the most concrete task-based evaluations have saturated. They no longer capture increases in capability. The lab is also seeing early signs of acceleration.
Тест, который не видит следующий скачок, — это слепое пятно с номером. Anthropic заменила часть старого набора на CoBench, где хотя бы реальные внутренние задачи. Даже там планка замены сотрудников стоит на 85 процентах, а Model 2 уже на 62,8 без публичного названия.
Не выпускать Model 2 в API — не то же самое, что не допустить более сильную модель в гонку. В отчёте говорится, что две самые сильные системы уже активно используются внутри компании, включая агентов, работающих непрерывно. Код, который поставляется, по словам компании, теперь в основном пишет Claude.
Народное прочтение гласит, что осторожная лаборатория удержала линию
Anthropic не выпустила Model 2. Она опубликовала длинный отчёт. Повысила прилагательное риска. В том же августе OpenAI приостановила часть фронтирного обучения после Astra, а Anthropic заявила, что собственные меры безопасности позволяют ей не делать паузу. Со стороны это выглядит как взрослое присмотр. Изнутри документа — как компания, которая больше не может измерить то, что масштабирует, использует более сильную систему в своей работе и отказывается замедлять её.
Стимулы объясняют это без злодеев. Лаборатория, которая остановится, пока соперник не остановится, теряет следующую модель, следующий контракт, следующую оценку. Политики самооценки построены так, чтобы выдерживать это давление. Они производят отчёты, скрытые названия и сдвиг на одну ступень с прежней минимальной оценки на низкую. Они не производят остановку.
Raise the law, not the adjective
Nakada Foundation не считает более высокую внутреннюю оценку риска решением. Искусственный сверхинтеллект никогда не следует создавать. Сверхинтеллект не может контролироваться людьми. Если сотрудники, пишущие код, уже видят, как Claude пишет большую его часть, оставшаяся роль человека — это shrinking этап проверки системы, которую тесты уже не могут ясно видеть.
Публикуйте оценки, если хотите. Не раскрывайте веса, если хотите. Ни то, ни другое не заменяет обязательный запрет. Августовский отчёт полезен своей откровенностью. Воспринимайте эту откровенность как доказательство, а не как утешение.