人工超知能ガバナンスで繰り返される問題は、政府が規制すべきシステムを評価する社内専門知識を historically 欠いていたことである。安全研究所は、そのギャップを埋めるために存在する。政府または政府支援の機関で、技術研究者がフロンティアモデルの能力とリスクを評価する。政府がついにラボが何を構築しているかを自ら見る能力を築きつつあるのであり、ラボの言葉を鵜呑みにしているのではない。

UKとUSを端緒として、2023年末以降、各国のAI安全機関が急増し、国際的なネットワークを形成している。派手さはないが、これまでで最も重要なガバナンス基盤かもしれない。

「ネットワークの出自」

英国は2023年11月のBletchleyサミットでAI安全研究所を発表した。米国も直後にNISTに同様の機関を設置した。2024年5月のソウルサミットでは、日本、シンガポール、カナダ、韓国、EUなどを含むより広い国々が研究所を設立し、国際ネットワークで連携させることに合意した。二つの国家機関から始まった動きが、協力システムの種になった。

名前の注記:2つの設立機関はその後改名され、UKはAI Security Instituteとなり、USの機関は2025年にCenter for AI Standards and Innovation (CAISI)となった。ネットワークと評価業務は新名称の下で継続している。

各研究所が実際に行っていること

  • 最先端モデルを評価せよ。 彼らは先進システムを危険能力についてテストし(ハイステークス領域を含む)、モデルが実際に何ができるかを測定する方法を開発している。
  • 評価の科学を発展させる。 AIの厳密で標準化されたテストは未解決の技術的課題です。各研究所は、信頼できるガバナンスに必要な方法論を構築しています。
  • 政府に助言する。 各国にAIリスクに関する独立した技術的判断力を与え、開発者自身の評価への依存を減らす。
  • 国境を越えて協力せよ。 ネットワークを通じて、研究所は手法を共有し、テストを調整し、共通の基準に向かって取り組み、相互運用可能な国際評価の始まりとなる。

なぜそれらが条約にとって重要なのか

「研究所と将来の拘束力ある合意とのつながりは直接的かつ過小評価されている。AI条約に関するあらゆる真剣な提案は、システムが危険な閾値を超えるかどうかを評価し、安全義務の遵守を検証する能力に依存する。その能力はデフォルトでは存在せず、構築しなければならない。安全研究所はまさにそれを構築している。実質的に、検証体制が後に利用する技術的機関を構築しているのだ。」.

また、順序の問題も解決する。評価要件を具体的に定めた条約は、独立した機関が評価を実施できなければ無意味である。今(条約が存在する前に)その能力を開発しておくことで、研究所は政治的合意が成立したときにツールが準備できていることを保証する。このネットワークは、拘束力のあるガバナンスが最終的に立つための実務的基盤であり、上位の外交が並行して進む一方で静かに敷かれている。

正直に語るべき限界

これらの研究所は拘束力のあるガバナンスの代わりにはなりません。それを代わりとみなすのは誤りです。モデルへのアクセスは一般に開発者の自発的な協力に依存しており、企業が共有を拒否したシステムのテストを強制することはできません。各国の権限と資源は大きく異なり、ネットワークの調整はまだ初期段階で拘束力もありません。また、評価自体が科学的に未熟であり、モデルが危険かどうかを確実に判断するのは本当に難しく、現在の手法には実際の隙間があります。

安全評価を義務づける条約は、誰もそれを実施できないなら空文である。安全研究所は、実際の検証体制に必要な「目」を構築している。その作業は条約の後ではなく前に完了していなければならない。

執行可能なガバナンスの基盤

安全保障機関は、AIリスクについて語ることから、それを測定する能力を構築することへの移行を表している。この移行が重要なのは、測定のない統治は単なる願望にすぎないからだ。現実的な道筋は、ネットワークが成熟し、善意ではなく法的義務を通じて最先端モデルへの確実なアクセスを獲得し、共通基準に収束し、検証体制に必要な独立した十分な資源を備えた評価能力を構築することである。安全保障機関だけでは世界を救えない。しかし、拘束力のある条約が機能するために不可欠な道具を組み立てており、それらを強化することは、より大きな合意がまだ交渉中である間に政府ができる最も具体的で即効性のある有用なことの一つである。