GoogleとGoogle DeepMindの研究者たちは水曜日、人工汎用知能(AGI)をめぐる議論を前進させる新たな取り組み「DeepMind Institute」を立ち上げた。急速に進展するAGIの最前線に必要なものが一つあるとすれば、それはさらなる「議論」に他ならないからだ。

この研究所は、DeepMind共同創業者のシェーン・レッグ、Google幹部のジェームズ・マニーカ、Google DeepMind会長のデミス・ハサビスを理事に据え、レッグが編集長を務める。その目的は、Google、Google DeepMind、そして広範な国際研究コミュニティの間でAGIをめぐる異なる見解を浮き彫りにすることだとされている。「彼らは常に一致するわけではなく、急速に進展する最前線でより多くのデータと情報が明らかになるにつれて、考えを変える可能性が高い」と発表文は述べている――この一文は、2022年以降のあらゆるグループチャットのミッションステートメントとしても使えるだろう。

創刊号となる4本のエッセイは、AGIによる潜在的な混乱を管理するための経済政策、人間が読める形でのモデル推論の保持、人間の繁栄のための原則、そしてフロンティアAIモデルを評価するための枠組みを扱っている。つまり、金、数学、意味、そして監視である。

DeepMindの安全性研究者ローヒン・シャーとアンカ・ドラガンによるエッセイは、AIの透明性の窓――モデルの段階的な推論を確認・検証する能力――が縮小しているのは不可避ではないと論じる。新しいアーキテクチャが最も強力なモデルの監視を困難にする中、開発者と規制当局は安全性のトレードオフに直接向き合うべきだと著者らは言う。それは「不透明な逐次深度」――モデルが読み取り可能な推論トレースを生成せずに実行できる逐次計算の量――を制限することや、透明性の低いシステムが同等に監視可能であることを開発者に証明させることを意味するかもしれない。これは、要するに「自分の作業を見せられないなら、見せる必要がないことを証明したまえ」という丁寧な言い方である。

別のエッセイでハサビスは、最も先進的なAIモデルを評価するための米国主導のフロンティアAI標準機関を提案している。彼の枠組みでは、開発者は当初、リリースの最大30日前までに自発的にモデルを審査に提出することになる。評価システムが有効性を証明すれば、そのテストに合格することが米国でフロンティアモデルを展開するための要件になり得る。この機関は当初、AI企業と協議して評価を設計するが、最終的には独立した非公開の評価――エッセイでは「held-out」テストと呼ばれる――を開発し、ラボが既知の評価に合わせてモデルを調整するのを防ぐ。ハサビスは、この枠組みは「状況の深刻さが要求するならば引き上げられる」可能性があり、フロンティアAI開発者間の協調的減速を含む可能性があると述べた。なぜなら、集団タイムアウトの脅しほど自発的遵守を促すものはないからだ。

これらのエッセイは、業界の安全性議論が広範な懸念表明から、情報開示、外部監査、そして安全策が遅れれば協調的減速へと移行する中で登場した。この移行は今週、業界リーダーたちがAnthropic CEOダリオ・アモデイのフロンティアAI開発を「ペースダウン」せよという呼びかけの要素を支持したことで加速した。つまり、エッセイ、標準機関、そして時折の実存的ため息。ある種の進歩である。