Первыми, кто видит опасный тренировочный запуск, обычно оказываются сотрудники лаборатории, связанные NDA и наблюдающие за календарём запуска. Защита информаторов превращает этих людей в систему предупреждения, а не в систему молчания. Пока внешних инспекторов нет, insiders — это дымовые извещатели.
У исследователей передового ИИ есть точка обзора, которой сейчас не может сравниться ни один регулятор или инспектор, и они часто связаны контрактами и пунктами о неразглашении, из-за которых публичное предупреждение обходится дорого или заканчивает карьеру. Защита их возможности предупреждать — один из самых доступных и недооценённых рычагов управления ASI.
Почему инсайдеры так важны для ИИ
У передового ИИ необычная проблема прозрачности. Самые важные решения — как именно обучалась модель, какое тестирование безопасности она прошла, какие тревожные поведения проявились, были ли предупреждения проигнорированы — происходят внутри частных организаций и остаются невидимыми для внешних. Регуляторам не хватает доступа, а часто и экспертизы, чтобы увидеть это независимо. В такой среде именно исследователи и инженеры, обладающие прямым знанием, единственные, кто может вовремя заметить и сообщить о проблеме до того, как она станет публичной самым худшим образом.
Эта обеспокоенность не гипотетична. В 2024 году группа нынешних и бывших сотрудников ведущих компаний ИИ опубликовала открытое письмо «Право предупреждать об advanced artificial intelligence», в котором утверждалось, что соглашения о конфиденциальности мешают им поднимать вопросы безопасности, и содержался призыв ввести защиты, позволяющие это делать. Уже то, что такое письмо потребовалось, само по себе свидетельствует о проблеме: люди, ближе всех стоящие к риску, чувствовали себя юридически и профессионально неспособными о нём говорить.
Что их блокирует
- Ограничительные соглашения. Широкие пункты о конфиденциальности и запрете критики (иногда привязанные к вестед-опционам на миллионы) могут сделать публичное высказывание финансово разорительным.
- Юридическая уязвимость. Без защищённого канала сотрудник, раскрывающий обеспокоенность, рискует быть привлечённым к суду за нарушение контракта или разглашение коммерческой тайны.
- Пробелы в существующем праве. Традиционные законы о разоблачителях защищают сообщения о незаконной деятельности, но многое из того, что опасно во фронтирном ИИ, пока не является незаконным, поэтому раскрытие информации о законной, но безрассудной разработке остаётся без защиты.
- Риск для карьеры. В небольшой области неформальная цена за репутацию нелояльного может оборвать карьеру даже там, где формальные санкции запрещены.
Как могла бы выглядеть эффективная защита
Защищённые каналы раскрытия информации
Закреплённые законом каналы, по которым работники в сфере ИИ могут сообщать о проблемах безопасности регулятору или надзорному органу, без риска ответственности, даже если раскрываемые действия сами по себе не являются незаконными.
Ограничения на договоры о молчании
Ограничения на использование соглашений о конфиденциальности и неразглашении для подавления добросовестных опасений по безопасности, чтобы сообщение об опасности не стоило сотруднику уже заработанных выплат.
Гарантии защиты от репрессий
Надёжная и enforceable защита от увольнения, чёрного списка или иной мести за защищённые разоблачения с реальными средствами восстановления прав.
Орган для получения предупреждений
Орган надзора (регулятор или институт безопасности) с мандатом и экспертизой для действий по раскрытиям, а не позволять им исчезать.
Пока мы не можем инспектировать лаборатории извне, люди внутри них — наши датчики дыма. Закон, позволяющий компании заставить собственных исследователей молчать о катастрофическом риске, — это закон, который отключает сигнализацию.
Разрешимая, и мост к большему
Защита информаторов обладает редким качеством в управлении ASI: её можно обеспечить обычным внутренним законодательством, без договора, без международного консенсуса и без решения сложных вопросов порогов и верификации. Любая юрисдикция, где расположены передовые лаборатории, может ввести её в одностороннем порядке, и это сразу усилит способность мира обнаруживать опасные разработки. Это также мост к более жёсткому управлению: защищённые разоблачения дают именно ту внутреннюю информацию, на которую будут опираться регуляторы и, в конечном счёте, международный режим верификации. Создание внешней верификации займёт годы. Защита тех, кто может предупредить нас в это время, — то, что законодатели могут сделать уже сейчас, и это одна из самых эффективных мер безопасности, доступных до появления договора.