安全的做法是拒绝。一旦系统比掌握工具的人更聪明,“我们以后再修”就会失败。
大多数技术失效时都较为温和。超级智能则不然。一旦系统能自我复制、隐藏意图,或让自己有用到无法拔掉电源,回滚和召回就失效了。
再聪明也不等于仁慈。在人类身上,技能与关怀一同成长。训练出的优化器却没有这段历史。能力而无共享价值观,就是不受约束的权力。
几乎任何目标都会受益于持续运行和收集资源。追求目标的系统会把关机视为障碍。这是普通的优化,而非反派独白。
航空业从坠机中吸取教训。药物从临床试验中学习。如果第一个失控的超级智能终结了实验,我们就没有第二个原型了。
完整论据、反对意见及政策路径。
nakadafoundation.org/blog/never-build-superintelligence/