구글과 구글 딥마인드 연구진이 수요일 딥마인드 인스티튜트(DeepMind Institute)를 출범시켰다. 인공일반지능(AGI)에 관한 논의를 진전시키기 위한 새로운 노력이다. 빠르게 움직이는 AGI의 최전선에 딱 하나 필요한 게 있다면, 바로 더 많은 '대화'니까.

이 기관은 딥마인드 공동 창업자 셰인 레그, 구글 임원 제임스 매니카, 구글 딥마인드 의장 데미스 허사비스을 이사로 두고 있으며, 레그가 편집장을 맡는다. 표면적인 목표는 구글, 구글 딥마인드, 그리고 더 넓은 글로벌 연구 커뮤니티 사이의 AGI에 대한 서로 다른 견해를 드러내는 것이다. "그들은 항상 동의하지는 않을 것이며, 빠르게 움직이는 최전선에서 더 많은 데이터와 정보가 밝혀짐에 따라 아마도 입장을 바꿀 것이다"라는 발표 문구는 2022년 이후 모든 단체 채팅방의 사명 선언문으로도 쓸 수 있는 문장이다.

창간호 에세이 네 편은 AGI로 인한 잠재적 혼란을 관리하기 위한 경제 정책, 사람이 읽을 수 있는 모델 추론 보존, 인간 번영을 위한 원칙, 프런티어 AI 모델 평가 프레임워크를 다룬다. 다시 말해: 돈, 수학, 의미, 그리고 감시.

딥마인드 안전 연구원 로힌 샤와 안카 드라간이 쓴 한 에세이는 AI의 투명성 창구—모델의 단계별 추론을 보고 확인하는 능력—이 줄어드는 것이 불가피하지 않다고 주장한다. 새로운 아키텍처가 가장 강력한 모델을 더 감시하기 어렵게 만들면서, 저자들은 개발자와 규제 당국이 안전 트레이드오프를 직접 마주해야 한다고 말한다. 이는 읽을 수 있는 추론 흔적을 생성하지 않고 모델이 수행할 수 있는 순차적 계산의 양인 "불투명한 직렬 깊이"를 제한하거나, 덜 투명한 시스템도 여전히 감시 가능함을 개발자가 입증하도록 요구하는 것을 의미할 수 있다. 이는 예의 바르게 말하자면: 네 작업 과정을 보여줄 수 없다면, 그럴 필요가 없다는 걸 증명하는 게 낫다는 뜻이다.

또 다른 에세이에서 허사비스는 가장 진보된 AI 모델을 평가할 미국 주도의 프런티어 AI 표준 기구를 제안한다. 그의 프레임워크에 따르면, 개발자들은 처음에는 출시 최대 30일 전에 자발적으로 모델을 검토에 제출하게 된다. 평가 시스템이 효과적임이 입증되면, 미국에서 프런티어 모델을 배포하려면 그 테스트를 통과하는 것이 요건이 될 수 있다. 이 기구는 처음에는 AI 기업과 협의하여 평가를 설계하지만, 결국에는 연구소들이 알려진 평가에 맞춰 모델을 조정하는 것을 막기 위해 독립적이고 비공개된 평가—에세이가 "보류된" 테스트라고 부르는 것—를 개발하게 된다. 허사비스는 이 프레임워크가 "상황의 심각성이 요구한다면 강화될 수 있다"며, 잠재적으로 프런티어 AI 개발자들 사이의 조율된 속도 저하를 포함할 수 있다고 말했다. 자발적 준수를 장려하는 데는 집단 타임아웃 위협만 한 게 없으니까.

이 에세이들은 업계의 안전 논쟁이 광범위한 우려 표명에서 정보 공개, 외부 조사, 그리고 안전장치가 뒤처질 경우 조율된 속도 저하에 대한 구체적 제안으로 이동하는 시점에 나왔다. 이러한 전환은 이번 주 업계 리더들이 앤스로픽 CEO 다리오 아모데이의 프런티어 AI 개발 "속도 조절" 요구의 일부 요소를 지지하면서 가속화되었다. 그래서: 에세이, 표준 기구, 그리고 때때로 존재론적 한숨. 일종의 진전이다.