2023年7月のホワイトハウスで、OpenAI、Anthropic、Google、Meta、Microsoftを含む7つの主要なUS AI企業が、自主的な安全・セキュリティ・透明性対策のセットにコミットした。2023年11月のブレッチリーAI安全サミットでは、28カ国がフロンティアAIリスクに関する共通の懸念を認める宣言に署名した。2024年6月のソウルAI安全サミットでは、16のAI企業がフロンティアAI安全コミットメントに署名し、安全閾値、モデル評価、情報共有をカバーした。
自主的な企業安全コミットメントは他産業に長い歴史があり、その歴史はそれらが何ができ、何ができないかを示唆している。
これらは重要な政治的成果だ。フロンティアAIシステムの主要開発者が、自らの仕事が深刻なリスクを伴い、何らかの統治が適切であることを初めて公に認めたことを意味する。それらを退けるのは誤りだ。しかし、十分だと受け入れるのはより大きな過ちになる。
自主的なコミットメントが実際に必要とするもの
ソウルで署名されたフロンティアAI安全コミットメントは、主要な誓約の中で最も実質的なものだ。署名者は、モデルを展開または訓練を継続しない安全閾値を特定すること、それらの閾値に対するフロンティアモデルの評価を実施・公開すること、安全インシデントや評価に関する情報を政府や他社と共有すること、安全研究に投資することを約束した。これらは、可視的な行動を必要とし、公に観察・批評可能な意味で本物のコミットメントである。
必要としないもの:閾値が満たされているかどうかの独立した外部検証、非遵守に対する拘束力のある結果、署名国が不十分だった場合の執行メカニズム、そして署名しないことを選んだ企業による参加です。コミットメントは、解釈と実施の全裁量を保持する企業による意図の表明に過ぎません。
これは自主的コミットメントの構造であり、拘束力ある義務との違いは微妙ではない。自主的コミットメントは道徳的・評判的に当事者を縛る。拘束力ある法的義務は法的に当事者を縛り、不遵守には正式な結果が伴う。道徳的義務と法的義務の間の隙間こそが、競争圧力のもとで最も重大な安全判断が行われる場所である。
他のハイリスク産業から見られるパターン
自主的な企業の安全コミットメントは、ほとんどの主要なハイリスク産業で拘束力のある規制に先立っており、それらのコミットメントが達成したことと達成しなかったことのパターンはかなり一貫している。
金融サービス分野では、大手銀行が1990年代から2000年代初頭にかけて業界主導のリスク管理規範と実務を開発した。これらの規範は2007年から2009年の金融危機時にすでに存在し、名目上は運用されていたが、自主的なリスク管理がシステミックリスクの蓄積を防げなかったことが明らかになった。その後、金融安定理事会、バーゼルIII枠組み、拡大された強制開示要件が導入された。自主的コミットメントはベースラインの実務を改善したが、失敗のコストが最も大きいテールリスクでは不十分だった。
化学産業では、1984年のボパール事故など一連の重大事故を受けて1985年にResponsible Careプログラムが開始された。参加企業は安全・健康・環境パフォーマンスの向上と進捗の透明な報告を約束した。このプログラムは業界の安全文化を改善し、日常的な事故件数をその後の数十年にわたって減少させた。ただし重大事故を防ぐことはできず、最終的に拘束力のある規制で補完された。プログラム自身の評価では、最大の限界は独立した検証の欠如だった。
化学産業のResponsible Careプログラムは1985年に開始され、現在のAI安全コミットメントに最も近い歴史的類似例である。安全、透明性、情報共有をカバーする自主的な業界誓約だ。プログラム自身による20年後の評価では、主な限界は報告された実績の独立検証が存在しない点だった。この限界は現在のAI安全コミットメントにも構造的に存在し、同じギャップを生んでいる。つまり、成果へのコミットメントはあるが、それが達成されているかを確認する仕組みがない。
米国の原子力発電所安全は当初、主に自主規制と業界基準によって管理されていた。1979年3月のスリーマイル島事故は、住民に影響を及ぼし得る技術において、自主的な業界安全文化だけでは不十分であることを示した。独立した検査、事故報告の義務化、拘束力のある運用基準を備えた原子力規制委員会の強制的な監督枠組みがその後に続いた。当時、業界は強制規制に反対したが、現在では自主的アプローチでは達成できなかった安全文化の改善をもたらしたと一般に評価されている。
競争圧力の問題
自主的コミットメントには、拘束力のある規制にはない構造的脆弱性がある。それは競争圧力の問題である。コミットメントが開発タイムラインの遅延、高額な安全性評価の義務化、高収益アプリケーションの除外といった実質的なコストを生む場合、コミットメントに署名しない企業はコストを回避して競争優位に立つ。署名した企業は、競争力を維持するためにコミットメントの解釈を緩めるか、コストを負担して後れを取るかの選択を迫られる。
この力学はAIセクターでは仮定の話ではありません。ソウルでFrontier AI Safety Commitmentsに署名した企業は、同等の文書に署名していない中国の企業や国家支援プログラムと直接競合しています。また互いにも競合しており、署名したコミットメントの文言は十分に広範なので、遵守に何が必要かについての合理的な解釈の相違は避けられません。
拘束力のある規制は、すべての競争者が満たさなければならない最低基準を作り、非遵守による競争優位を排除することでこれを解決する。だから拘束力のある規制は、自主的なコミットメントでは通常達成できない安全成果を生む:安全をショートカットする誘因構造を除去するのだ。
自主的コミットメントがうまく達成すること
産業安全ガバナンスの歴史において、自主的コミットメントの最も価値ある機能は規範の確立でした。自主的コミットメントは、問題が存在し、特定の慣行が適切な対応であることを業界が認めた記録を作ります。この記録は、拘束力のある規制が機能するためのベースラインとなります。
規制当局や立法者が人工超知能ガバナンスに取り組むとき、フロンティアAI安全コミットメントは、主要企業が安全閾値、モデル評価、情報共有をガバナンス概念として正当と認めていることを確立しているでしょう。産業界は、これらの要件が技術的に実行不可能または商業的に不適切だと主張しにくくなっています。すでに自発的にコミットしているからです。この意味で、自発的コミットメントは拘束力のあるガバナンスへの第一歩であり、その代替ではありません。
自主的コミットメントは制度的な基盤も作る。ソウルのコミットメントにより、各社は安全閾値の設定やモデル評価のための内部プロセスを整備した。これらのプロセスと、そこに蓄積された知見は、拘束力のある検証制度を構築する土台になる。強制的なAI安全評価を監督する規制機関は、ゼロからコンプライアンス基盤を設計するのではなく、既存の企業慣行を活用できる。
「自主的コミットメントはガバナンス発展の初期段階で有用な機能を果たし、BletchleyやSeoulでのコミットメントも実際に何らかの成果を上げた。しかし、すべての主要なハイリスク産業の歴史が示すのは同じことだ。自主的コミットメントはベースラインの慣行を改善するが、テールリスクでは失敗する。スーパーインテリジェンスをめぐるガバナンスで問題にしているのは、まさにそのテールリスクなのだ」
拘束力のある統治が求め、自主的なコミットメントでは提供できないもの
拘束力のある統治と自発的な統治を区別する4つの要素があり、そのすべてがフロンティアAIにとって重要である。
独立した検証。自発的なコミットメントは自己申告だ。拘束力のある義務は、規制機関、国際査察機関、または法的地位を持つ独立監査人による第三者検証の対象となる。自己申告が正確な情報を生むのは、報告組織に虚偽表示するインセンティブがない場合だ。競争市場では、その条件が満たされることは稀だ。
不遵守に対する明確な結果。自主的なコミットメントは不遵守に対する評判上のコストを生みますが、それは現実的であるものの限定的です。拘束力のある義務は法的結果を生みます。罰金、ライセンスの剥奪、市場アクセス制限、または条約に基づく制裁です。ガバナンス枠組みの信頼性は、その結果の信頼性に依存します。
非署名国への適用範囲です。最も重大なAI開発は、自主的なコミットメントに署名しない企業や政府から生まれる可能性があります。拘束力のある国内規制と国際条約義務は、事前の同意の有無にかかわらず行為者に適用されるガバナンスを生みます。自主的コミットメントの枠組みでは、深刻なリスクを生み出す可能性が最も高い行為者が、枠組みの外に留まることを選択すれば、そのまま外に置かれます。
リーダーシップ変更時の安定性。自主的コミットメントは、現在の経営陣を拘束する。リーダーシップが変わり、取締役構成が変わり、競争圧力が高まると、コミットメントはその変化を乗り越える法的効力を持たない。拘束力のある規制は法律に組み込まれ、通常の組織変更を生き延びる。
ブレッチリーとソウルでなされた自主的コミットメントは genuine な成果であり、土台にすべきだ。それを土台にするとは、何を達成し何を達成できないかを正直に認め、それらが持つ政治的・制度的勢いを利用して、残された隙間を埋める拘束力ある統治を追求することである。
最も強い反発
最も公平な反論は、自主規制こそが産業を成熟させ、法を先に求めることは進歩を凍結させるというものだ。自主規制は開示する場合には役立つ。しかし同じ企業が作成・採点・利益享受をすべて行う場合には失敗する。外部からの実効性こそが成熟を本物にする。