Первыми, кто видит опасный тренировочный запуск, обычно оказываются сотрудники лаборатории, связанные NDA и наблюдающие за календарём запуска. Защита информаторов превращает этих людей в систему предупреждения, а не в систему молчания. Пока внешних инспекторов нет, insiders — это дымовые извещатели.

У исследователей передового ИИ есть точка обзора, которой сейчас не может сравниться ни один регулятор или инспектор, и они часто связаны контрактами и пунктами о неразглашении, из-за которых публичное предупреждение обходится дорого или заканчивает карьеру. Защита их возможности предупреждать — один из самых доступных и недооценённых рычагов управления ASI.

Почему инсайдеры так важны для ИИ

У передового ИИ необычная проблема прозрачности. Самые важные решения — как именно обучалась модель, какое тестирование безопасности она прошла, какие тревожные поведения проявились, были ли предупреждения проигнорированы — происходят внутри частных организаций и остаются невидимыми для внешних. Регуляторам не хватает доступа, а часто и экспертизы, чтобы увидеть это независимо. В такой среде именно исследователи и инженеры, обладающие прямым знанием, единственные, кто может вовремя заметить и сообщить о проблеме до того, как она станет публичной самым худшим образом.

Эта обеспокоенность не гипотетична. В 2024 году группа нынешних и бывших сотрудников ведущих компаний ИИ опубликовала открытое письмо «Право предупреждать об advanced artificial intelligence», в котором утверждалось, что соглашения о конфиденциальности мешают им поднимать вопросы безопасности, и содержался призыв ввести защиты, позволяющие это делать. Уже то, что такое письмо потребовалось, само по себе свидетельствует о проблеме: люди, ближе всех стоящие к риску, чувствовали себя юридически и профессионально неспособными о нём говорить.

Что их блокирует

  • Ограничительные соглашения. Широкие пункты о конфиденциальности и запрете критики (иногда привязанные к вестед-опционам на миллионы) могут сделать публичное высказывание финансово разорительным.
  • Юридическая уязвимость. Без защищённого канала сотрудник, раскрывающий обеспокоенность, рискует быть привлечённым к суду за нарушение контракта или разглашение коммерческой тайны.
  • Пробелы в существующем праве. Традиционные законы о разоблачителях защищают сообщения о незаконной деятельности, но многое из того, что опасно во фронтирном ИИ, пока не является незаконным, поэтому раскрытие информации о законной, но безрассудной разработке остаётся без защиты.
  • Риск для карьеры. В небольшой области неформальная цена за репутацию нелояльного может оборвать карьеру даже там, где формальные санкции запрещены.

Как могла бы выглядеть эффективная защита

1

Защищённые каналы раскрытия информации

Закреплённые законом каналы, по которым работники в сфере ИИ могут сообщать о проблемах безопасности регулятору или надзорному органу, без риска ответственности, даже если раскрываемые действия сами по себе не являются незаконными.

2

Ограничения на договоры о молчании

Ограничения на использование соглашений о конфиденциальности и неразглашении для подавления добросовестных опасений по безопасности, чтобы сообщение об опасности не стоило сотруднику уже заработанных выплат.

3

Гарантии защиты от репрессий

Надёжная и enforceable защита от увольнения, чёрного списка или иной мести за защищённые разоблачения с реальными средствами восстановления прав.

4

Орган для получения предупреждений

Орган надзора (регулятор или институт безопасности) с мандатом и экспертизой для действий по раскрытиям, а не позволять им исчезать.

Пока мы не можем инспектировать лаборатории извне, люди внутри них — наши датчики дыма. Закон, позволяющий компании заставить собственных исследователей молчать о катастрофическом риске, — это закон, который отключает сигнализацию.

Разрешимая, и мост к большему

Защита информаторов обладает редким качеством в управлении ASI: её можно обеспечить обычным внутренним законодательством, без договора, без международного консенсуса и без решения сложных вопросов порогов и верификации. Любая юрисдикция, где расположены передовые лаборатории, может ввести её в одностороннем порядке, и это сразу усилит способность мира обнаруживать опасные разработки. Это также мост к более жёсткому управлению: защищённые разоблачения дают именно ту внутреннюю информацию, на которую будут опираться регуляторы и, в конечном счёте, международный режим верификации. Создание внешней верификации займёт годы. Защита тех, кто может предупредить нас в это время, — то, что законодатели могут сделать уже сейчас, и это одна из самых эффективных мер безопасности, доступных до появления договора.