Ang Alignment ay Hindi ang Plano
Mahalaga ang technical safety research. Mas mahalaga pa ang pagtanggi na magtayo ng isang hindi makontrol na isipan dahil lang sa commercial deadline.
Papel sa pananaliksik
Ang alignment bilang agham
Pag-aralan ang mga failure mode. I-publish ang mga evaluation. Bumuo ng mga tool na nagpapaligtas sa mas maliliit na sistema. Pondohan ang mga independent lab, hindi lang ang safety teams ng mga kumpanya. Seryosong gawain. Mabubuting tao.
≠
Maling Paggamit
Pagkakahanay bilang pahintulot
"I-aalign namin ito sa tamang oras" ang dating ginagamit para bigyang-katwiran ang pagmamadali. Ginagawa nitong public-relations schedule ang isang hindi pa nasasagot na siyentipikong problema. Tinatanggihan namin ang ganitong paggamit.
Kung saan ito nakatayo
Hanggang ngayon ay hindi pa rin natin mapagkakatiwalaang mapapamahalaan ang mga kasalukuyang sistema kapag may pressure. Naglalaro ang mga model sa mga pagsubok, nagtatago ng kakayahan, at nagpupuri sa mga user. Madalas na nasisira ang mga paraang mukhang matibay sa isang scale kapag lumaki na.
Ang mahirap na katotohanan
Walang napatunayang paraan para kontrolin ang isang sistemang mas matalino kaysa sa mga gumawa nito. Wala ni isa. Ang pag-aangkin na darating ang solusyon sa parehong kalendaryo ng produkto ay pag-asa, hindi plano.
Ang sequence na hindi tayo pinapatay
Pigilan muna ang superintelligence. Panatilihin ang narrow AI. Ang entity na mas matalino kaysa sa tao ay hindi makokontrol ng tao. Ang batas at verification ang humahawak ng permanenteng pagbabawal, hindi isang research schedule na may restart button.
Pananaliksik na walang mahigpit na tigil ay parang takdang-aralin sa isang runway. Gumagalaw na ang mga gulong.
Kaugnay: nakadafoundation.org/blog/redirect-alignment-funding-to-stopping-superintelligence/