문서는 Bletchley 선언입니다. 이는 가장 유능한 프론티어 시스템의 위험을 구체적으로 다루기 위해 소집된 첫 번째 정부 회의인 영국의 AI 안전 정상회의에서 나왔습니다. 텍스트는 간결하고, 구속력이 없으며, 신중하게 유보적입니다. 그것이 기록한 것과 보류한 것을 읽는 것은 2023년 말 국제 ASI 거버넌스가 어디에 있었는지에 대한 가장 명확한 척도입니다.

적대국 정부들이 처음으로 최전선 인공지능이 재앙적 피해를 일으킬 수 있음을 공동으로 기록했다.

선언문이 말하는 것

핵심 동작은 인지입니다. 선언문은 최전선 인공지능 모델이 심각하고 심지어 재앙적인 피해 가능성을 지니고 있다고 밝힙니다. 의도적이거나 비의도적일 수 있는 위험을 명시하고, 가장 강력한 범용 시스템으로 인한 심각한 피해를 지적합니다. 워싱턴과 베이징을 포함해 거의 아무것도 합의하지 않는 정부들도 공개적으로 그 틀을 받아들였습니다.

인정에 더해 서명국들은 두 가지 방향을 약속합니다. 공통으로 우려하는 AI 안전 위험을 식별하고 이에 대한 공동의 과학적 이해를 구축하는 것, 그리고 위험 기반 국가 정책을 개발하며 적절한 경우 협력하는 것입니다. 문서는 지속적인 국제 대화를 지지하며 후속 정상회의 시리즈를 환영합니다. 그러나 그 정상회의들이 이미 답을 갖고 있다고 주장하지는 않습니다.

그것이 하지 않는 것

  • 구속력 있는 의무 없음. 어떤 나라도 일정에 따라 행동하거나, 지표를 보고하거나, 특정 능력을 금지할 의무가 없다.
  • 기관 없음. 기구, 사무국 또는 모니터링 기구는 없으며, 대화를 계속하고 재소집하기로 한 합의뿐입니다.
  • 빨간 선은 없다. 선언은 어떤 역량이 용납될 수 없으며 어떤 상황이 집단 행동을 촉발하는지 정의하지 않습니다.
  • 검증이나 집행이 없습니다. 준수는 구체적으로 준수할 내용이 없기 때문에 측정되지 않는다.

구속력이 없는 성명서가 여전히 중요한 이유

실효성 없는 선언을 일축하기는 쉽다. 그러나 이는 위험한 기술이 국제법에 진입하는 방식을 잘못 읽는 것이다. 오존과 기후 변화에 사용된 기본 협약 패턴은 먼저 공통 원칙과 협력 의무를 정하는 것으로 시작한다. 문제를 명명하는 것이 해결책을 협상하기 위한 전제 조건이기 때문이다. 블레츨리는 첫 번째 어려운 외교 작업을 해냈다. 경쟁국들이 위험을 실재하고 공유된 것으로 기록하게 만든 것이다.

그것은 또한 하나의 과정을 열었습니다. 정상회담은 일회성 행사가 아니었습니다. 2024년 5월 서울에서 이어진 정기적인 시리즈를 시작했으며, 이는 정부들에게 과학, 제도, 그리고 단일 선언으로는 유지할 수 없는 약속들을 발전시킬 수 있는 상설 장을 제공합니다. 그 가치는 문구 자체보다 문구가 가능하게 하는 경로에 있습니다.

민간의 반론은 부드러운 성명이 연극에 불과하다는 것이다. 그것이 이야기의 끝일 때는 타당하다. 그러나 나중에 임계값·검증·처벌을 추가하는 체제의 첫걸음일 때는 국가들이 아직 받아들일 준비가 되지 않은 제약에 대해 이야기하기 시작하는 방식이다. 블레츨리 회의가 실패하는 경우는 과정이 사진 행사에서 멈출 때뿐이다.

뒤따르는 시험

블레츨리의 가치는 인정이 제도로 이어지는지로 판단됩니다. 구속력 있는 규칙과 독립적인 점검, 제도로 굳어지지 않는 공유된 우려는 그저 말뿐입니다. 후속 정상회의와 국가 인공지능 안전 연구소, 그리고 과학적 평가는 선언을 거버넌스로 성숙시키거나, 선언이 시작한 과정을 능력이 앞질러 사라지게 만드는 장치입니다. 그 문서는 출발점을 샀습니다. 해야 할 일은 그것이 경고한 능력이 시작한 과정을 앞지르기 전에 이를 전환하는 것입니다. 재단에게 그 전환은 초지능을 막는 구속력 있는 경로, 영구적인 정상 회담의 순환으로 끝나지 않게.