Южная Корея и Великобритания совместно провели Сеульский саммит по ИИ — вторую встречу в серии, начатой в Блетчли-парке в ноябре 2023 года. Повестка разделилась чётко. На корпоративном треке ведущие разработчики приняли публичные обязательства по безопасности. На правительственном треке государства договорились углубить сотрудничество в области науки оценок. Что каждый трек дал и что оставил открытым — до сих пор самый ясный индикатор состояния управления ASI в 2024 году.
Оба результата были реальными. Ни один не имел силы закона.
Обязательства по безопасности передового ИИ
Заглавным документом стали Обязательства по безопасности передового ИИ, подписанные шестнадцатью крупными ИИ-компаниями, включая разработчиков из США, Китая, Великобритании и ОАЭ. Компании обязались публиковать рамки безопасности с описанием того, как они оценивают риски передовых моделей; определять пороги риска, которые считают неприемлемыми; и, что особенно важно, не разрабатывать и не развёртывать модели, если эти пороги не удаётся удержать ниже установленной линии, включая обязательство отступить, если меры по снижению риска не срабатывают.
Содержательный сдвиг заключался в публичном принципе. Ведущие разработчики заявили официально, что некоторые возможности слишком опасны для развёртывания и что они определят красные линии и будут их соблюдать. Индустрия перешла от расплывчатых заверений к заявленным ограничениям. Ограничения остались самоопределёнными.
Почему добровольных обязательств недостаточно
- Компании сами устанавливают свои пороги. Каждый разработчик сам определяет, что считать недопустимым риском и как его измерять. Общего стандарта и внешнего органа, проверяющего эти определения, нет.
- Нет независимой проверки. Ничто не подтверждает, что внутренние рамки безопасности соблюдаются или что оценки честны. Соблюдение держится только на слове разработчика.
- Нет принуждения. Нарушение обещания влечёт максимум репутационные издержки. Обещания не являются законом.
- Их можно пересмотреть или отменить. Добровольные обязательства под давлением конкуренции могут незаметно размываться, когда соперник вырывается вперёд. Саморегуляция именно такая хрупкая.
Народное возражение: просить лаборатории следить за собой лучше, чем ничего. Верно, но недостаточно. Обещание, которое обещающий может сам определять, измерять и нарушать, — это лишь замена настоящему регулированию. Такие замены помогают только тогда, когда их намеренно заменяют чем-то более жёстким.
Сеть институтов безопасности
Государственное направление дало результат с более долгосрочным потенциалом: движение к международной сети институтов безопасности ИИ. Опираясь на недавно созданные органы Великобритании и США, государства договорились сотрудничать в науке оценки передовых моделей, обмениваться методами, согласовывать тестирование и наращивать технический потенциал, который потребуется любой будущей системе верификации. Государственные органы, способные реально оценивать опасность модели, — это связующее звено, необходимое для будущего договора. См. руководство Фонда по что такое институт безопасности ИИ.
Сеульская декларация, одобренная собравшимися правительствами, подтвердила приверженность человекоориентированному, безопасному и заслуживающему доверия ИИ и продолжению международного сотрудничества. Как и текст из Блетчли, это было заявление о направлении, а не набор обязательств.
Шаблон и разрыв
Сеул вписывается в известную схему управления опасными технологиями: признание, затем добровольные обязательства, затем (если процесс удастся) обязательные правила. Корпоративные обещания и сеть институтов — это вторая стадия. Незавершённая работа — третья: общие стандарты, независимая проверка и юридические обязательства.
Институты безопасности — самый перспективный мост, потому что именно тот потенциал, который они наращивают, и понадобится для обязательного режима. Риск в том, что процесс саммитов застрянет на стадии добровольных обязательств, мир удовлетворится обещаниями, поскольку их проще давать, чем заключать договоры, а возможности продолжат расти. Сеул показал разрыв между обещаниями и реальным управлением. Осталось его закрыть. Позиция Фонда: закрыть его — значит перейти от обещаний компаний к превентивное международное право прежде чем самостоятельно установленные красные линии растворятся под давлением гонки. Дополнительные материалы: почему добровольные обязательства по безопасности ИИ не работают как единственная стратегия.