초지능 통치:
정책 입안자를 위한 간략한 설명서

국제 AI 안전 거버넌스의 근거: 문제점, 필요한 조치, 그리고 그것이 가능함을 보여주는 선례들입니다.

거버넌스 체계가 전혀 없는 전례 없는 기술

인공 초지능(모든 영역에서 인간 지능을 초월하는 시스템)은 최소한의 규제 감독 아래 운영되는 민간 기업들에 의해 적극 개발되고 있습니다. 주요 AI 연구소들은 내부적으로 이번 10년 안에 이 문턱에 도달할 것으로 예상한다고 밝혔습니다.

이전의 기술적 위험들과 달리 초지능에는 기존 국제 거버넌스 구조가 전혀 없습니다. 조약도 없고 검증 기구도 없으며 다자간 안전 기준도 없고 경고 신호가 나타날 경우 개발을 중단할 메커니즘도 없습니다. 거버넌스 격차는 완전합니다.

효과적인 거버넌스를 위한 시간은 줄어들고 있다

국제 거버넌스 체계는 수립하는 데 수년의 협상이 필요하다. 핵확산금지조약은 첫 핵실험 이후 십 년의 외교를 거쳤다. 몬트리올 의정서는 다자 채택을 이루기 전에 지속적인 과학적 합의 구축이 필요했다.

인공지능 능력 개발은 가속하고 있습니다. 한때 수년이 걸리던 개선이 이제는 수개월 만에 도착합니다. 충분히 강력한 시스템이 존재하게 되면 의미 있는 제약을 부과하기에는 너무 � 늦을 수 있습니다. 거버넌스는 능력 뒤가 아니라 앞에 와야 합니다.

전례: 우리는 이미 이렇게 한 적이 있습니다

핵확산금지조약 (1968) 핵무기 확산을 제한하는 국제 조약. 191개국이 가입했으며 사찰 및 검증 메커니즘을 포함합니다.
몬트리올 의정서 (1987) 오존층 파괴 물질의 99퍼센트를 전 세계적으로 단계적으로 퇴출했다. UN가 '역사상 가장 성공적인 환경 조약'이라고 평가한 사례다.
생물무기협약 (1972) 생물 무기의 개발과 비축을 금지했다. 183개국이 가입했다. 생물 무기에 반대하는 국제 규범을 확립했다.
우주조약 (1967) 우주와 천체에서 핵무기를 금지했습니다. 냉전 절정기에 US와 USSR 사이에 협상되었습니다.

권장 정책 조치

  • 배포 전 의무적 안전 평가 국경을 초월한 인공지능 시스템이 공개되기 전에 독립 정부 기구가 실시하는 것으로, 의약품에 대한 임상 시험과 동등하다.
  • 연산 자원 모니터링과 허가 정의된 능력 기준을 초과하는 훈련 실행에 대한 것입니다. 연산은 능력의 측정 가능한 대리 지표이며, 추적하고 규제할 수 있습니다.
  • 국제 AI 안전 기구 합의된 안전 기준 준수를 여러 관할권에 걸쳐 검증할 수 있도록 IAEA를 모델로 한 사찰 권한을 부여합니다.
  • 사건 보고 요건 훈련이나 배포 중 관찰된 위험 행동에 대한 것으로, 현재는 자발적이며 연구실마다 일관되지 않습니다.
  • 국내 AI 안전 법안 예측 가능한 피해에 대한 법적 책임을 부과하고, 신중함을 위한 적절한 시장 인센티브를 조성합니다.
  • 다자간 협상 능력 한계점에 도달하기 전이 아니라 도달하기 전에 국제 기준을 세우기 위해서다. 지금 시작하라. 기회가 열려 있는 동안에.

이것은 과학적 합의이지, 변두리 입장이 아니다

노벨상 수상자 제프리 힌튼과 요슈아 벤지오를 포함한 500명 이상의 AI 과학자와 OpenAI, DeepMind 최고경영자들이 2023년 성명에 서명하며 멸종 수준 AI 위험을 "팬데믹과 핵전쟁과 함께하는 세계적 우선 과제"로 규정했습니다.

UK 정부는 2023년 세계 최초의 인공지능 안전 연구소를 설립했습니다(현재는 인공지능 보안 연구소). EU 인공지능법은 인공지능 시스템에 대한 의무적 위험 분류를 도입했습니다. US 인공지능 행정명령은 최전선 모델에 대한 안전 평가를 요구했습니다. 국제 틀은 아직 존재하지 않지만 정치적 의지는 형성되고 있습니다. 행동할 순간은 지금입니다.

nakadafoundation.org

Nakada Foundation to Save Humanity는 국제 인공지능 안전 거버넌스를 지지합니다. 정책 전문성, 공공 교육, 옹호 지원을 제공합니다. 귀하의 사무실이나 직원을 위한 브리핑을 원하시면 연락해 주십시오.