这份文件是布莱切利宣言。它出自英国 AI 安全峰会,这是各国政府首次专门围绕最前沿系统风险召开的会议。文本简短、无约束力且措辞谨慎。阅读它所记录的内容以及它所省略的内容,仍然是衡量 2023 年底国际 ASI 治理状况的最清晰标尺。
敌对政府首次共同记录到前沿AI可能造成灾难性伤害。
宣言说了什么
核心动作是承认。宣言指出前沿AI模型具有造成严重甚至灾难性伤害的潜力。它列出可能蓄意或非蓄意的风险,并指出最强通用系统可能造成严重伤害。几乎在其他所有问题上意见相左的政府,包括华盛顿和北京,都公开接受了这一框架。
除了表态,签署方还承诺两个方向:识别共同关注的 AI 安全风险并建立对其的共同科学理解;制定基于风险的国家政策,并在适当情况下开展合作。文本支持继续国际对话,并欢迎后续一系列峰会。它并不假装这些峰会已经掌握答案。
它不做什么
- 没有具有约束力的义务。 没有任何国家需要按时间表行动、报告指标或禁止某项能力。
- 无机构。 没有机构、秘书处或监测机构,只有一项继续对话和重新召集的协议。
- 没有红线。 该宣言未定义哪些能力不可接受,或什么会触发集体行动。
- 无验证或执行。 合规性无法衡量,因为没有具体的合规内容。
为什么一份不具约束力的声明仍然重要
轻易否定没有约束力的宣言很容易,但这也误读了危险技术进入国际法的方式。用于臭氧和气候的框架公约模式,首先确立共同原则和合作义务,因为命名问题才是协商应对措施的前提。布莱切利峰会完成了第一项艰巨的外交工作:让敌对大国正式承认风险真实且共同存在。
它还开启了一个进程。峰会并非一次性活动。它启动了后续系列会议,2024年5月在首尔继续,为各国政府提供常设平台,以发展科学、制度,最终形成单一宣言无法承载的承诺。其价值不在于措辞,而在于措辞所开辟的路径。
民间反对意见认为,软性声明不过是做戏。如果它们是故事的结局,这话有道理。但如果它们是后续加入阈值、核查和处罚的制度的开场白,那就是国家开始讨论自己尚未准备好接受的约束的方式。布莱切利只有在进程停留在合影阶段时才会失败。
接下来的测试
衡量布莱切利会议的标准在于,承认是否转化为架构。共同关切若从未固化为有约束力的规则、独立核查和机构,就只是空话。后续峰会、各国 AI 安全研究所, ,以及科学评估,是让声明成长为治理体系或任其消散的机制。文本买来了起点。工作在于在它所警示的能力超越它开启的进程之前完成转化。对基金会而言,这种转化意味着一个 阻止超级智能的约束路径, ,而非永无立法的峰会循环。