滅亡確率 計算機
"滅亡確率"とは、先進AIが人類に破局をもたらす確率のことだ。それは一つの数字ではない。五つの判断がそこに入る。スライダーを動かしてそれぞれの見方を設定し、リスクを半分以上と見る研究者と結果を比べてほしい。財団の立場は単純だ。人工超知能は作るべきではない。
この推定は、私たちの手の届かない何かの予測ではありません。超知能は、私たちが作り続けなければ構築されません。そのプロジェクトを止めれば滅亡確率はそれとともに低下します。
これの計算方法
各スライダーは判断の一部分だ。計算機は5つのパーセンテージの幾何平均を報告する。
滅亡確率 = (P(built) × P(no control) × P(gets power) × P(catastrophe) × P(no recovery))1/5
5つすべてを80に設定すれば結果は80になる。1つでも下げれば結果はそれとともに下がる。5段階の積み上げなら同じ入力でもゼロに近づく。各段階50%なら全体で3%程度にしかならない。HintonやTegmark、ユドコウスキーが数字を述べる方法はこれではない。平均値は彼らの尺度に合わせたものだ。
Joe Carlsmithの2021年報告書は、前提の真の積を用いたため、深刻な条件付きであっても初期値が10%近くに留まった。この出力を推論の補助として扱え。
滅亡確率 推定
- ヤン・ルカン
Meta; 公式声明<1% - ML研究者の中央値
AI Impactsによる2,700人以上の研究者への調査、2023年~5% - Joe Carlsmith
Open Philanthropyレポート、2021(後に上方修正)~10% - ポール・クリスティアーノ
アライメント研究者;公開推定値~20% - ジェフリー・ヒントン
ノーベル賞受賞者;インタビュー、2023-2025(範囲最大~50%)~50% - Daniel Kokotajlo
元OpenAI;ニューヨーク・タイムズ 2024年インタビュー~70% - ダン・ヘンドリクス
Center for AI Safety; 公開声明、2023年>80% - アンドリュー・クリッチ
UC Berkeley CHAI; 2024年の公的推定値~85% - マックス・テグマーク
MIT; Future of Life Institute; 公的推定>90% - コナー・レーヒー
推測; 公的推定90%+ - エリエザー・ユドコウスキー
機械知能研究所; 誰かが作れば、みんな死ぬ>95% - ネイト・ソアレス
機械知能研究所社長;ユドコウスキーとの共著者>95% - ロマン・ヤンポルスキー
University of Louisville; AI安全研究~99.9%
よりインタラクティブなツール
すべてのツール →