Повторяющаяся проблема управления ASI в том, что у правительств исторически не хватало внутренней экспертизы для оценки систем, которые они должны регулировать. Институты безопасности существуют, чтобы закрыть этот разрыв. Это государственные или поддерживаемые государством органы, укомплектованные техническими исследователями, чья задача — оценивать возможности и риски frontier-моделей; государство наконец обретает способность видеть, что строят лаборатории, а не полагаться на их слово.
Начиная с UK и US в конце 2023 года национальные институты безопасности ИИ множатся и объединяются в международную сеть. Они лишены блеска, но могут оказаться самой важной инфраструктурой управления, созданной на сегодняшний день.
Откуда взялась сеть
Великобритания объявила о создании своего Института безопасности ИИ на саммите в Блетчли в ноябре 2023 года — первого такого рода. США учредили свой институт при NIST вскоре после. На сеульском саммите в мае 2024 года более широкая группа правительств (включая Японию, Сингапур, Канаду, Южную Корею, EU и других) договорилась создавать институты и объединять их в международную сеть для координации работы. То, что начиналось как два национальных органа, стало зародышем совместной системы.
Примечание об именах: два основавших института с тех пор переименованы, институт UK теперь называется Институт безопасности ИИ, а орган US в 2025 году стал Центром стандартов и инноваций в области ИИ (CAISI). Сеть и её работа по оценке продолжаются под новыми названиями.
Что на самом деле делают институты
- Оценка передовых моделей. Они тестируют передовые системы на опасные возможности (в том числе в высокорискованных областях), разрабатывая методы измерения того, что модель действительно умеет.
- Развивать науку оценки. Строгое стандартизированное тестирование ИИ остаётся нерешённой технической задачей. Институты разрабатывают методику, без которой надёжное управление невозможно.
- Консультировать правительства. Они дают государствам независимую техническую оценку рисков ИИ, снижая зависимость от суждений самих разработчиков.
- Сотрудничество через границы. Через сеть институты делятся методами, координируют тестирование и работают над общими стандартами — начало интероперабельной международной оценки.
Почему они важны для договора
Связь между институтами и будущим обязывающим соглашением прямая и недооценённая. Каждое серьёзное предложение договора по ИИ зависит от способности оценивать, пересекает ли система опасный порог, и проверять соблюдение обязательств по безопасности. Эта способность не возникает сама собой — её нужно создать. Институты безопасности именно этим и занимаются. По сути, они строят технические органы, которые впоследствии будут использоваться режимом верификации.
Они также решают проблему последовательности. Договор, который бы задавал требования к оценкам, оказался бы бесполезным, если бы ни один независимый орган не мог эти оценки проводить. Развивая этот потенциал уже сейчас (до появления договора) институты обеспечивают готовность инструментов к моменту, когда политическое соглашение будет достигнуто. Сеть — это практическая основа, на которой в конечном счёте может стоять обязательное управление, и она закладывается тихо, пока более заметная дипломатия идёт параллельно.
Пределы, о которых нужно говорить честно
Институты не заменяют обязательного управления, и ошибкой будет относиться к ним как к замене. Их доступ к моделям обычно зависит от добровольного сотрудничества разработчиков; они не могут принудить к тестированию системы, которую компания отказывается предоставить. Их мандаты и ресурсы сильно различаются между странами, а координация сети пока находится в зачаточном состоянии и не имеет обязательной силы. Кроме того, сама оценка остаётся научно незрелой: надёжно определить, опасна ли модель, действительно сложно, и у текущих методов есть реальные пробелы.
Договор, требующий проверок безопасности, пуст, если их некому проводить. Институты безопасности создают «глаза», которые понадобятся любой реальной системе верификации. Эта работа должна быть сделана до договора, а не после.
Инфраструктура принудительного управления
Институты безопасности представляют собой переход от разговоров о рисках ИИ к созданию возможностей для их измерения. Этот сдвиг важен, потому что управление без измерений остаётся лишь благим пожеланием. Реалистичный путь — развитие сети с гарантированным доступом к передовым моделям через законодательные требования, а не добрую волю, выработка общих стандартов и формирование независимого, хорошо финансируемого потенциала оценки, необходимого для режима верификации. Сами по себе институты мир не спасут. Но они собирают инструменты, без которых не сможет работать ни один обязывающий договор, и их укрепление — одно из самых конкретных и полезных действий, которые правительства могут предпринять, пока ведутся переговоры о более широком соглашении.