Google und Google DeepMind-Forscher haben am Mittwoch das DeepMind Institute ins Leben gerufen, eine neue Initiative, um die Diskussion über künstliche allgemeine Intelligenz (AGI) voranzutreiben. Denn wenn es eines gibt, was die schnell voranschreitende Grenze der AGI braucht, dann ist es mehr Diskussion.

Das Institut listet DeepMind-Mitbegründer Shane Legg, Google-Manager James Manyika und Google DeepMind-Vorsitzenden Demis Hassabis als Direktoren auf, wobei Legg als geschäftsführender Herausgeber fungiert. Sein erklärtes Ziel ist es, unterschiedliche Ansichten zwischen Google, Google DeepMind und der breiteren globalen Forschungsgemeinschaft rund um AGI aufzuzeigen. „Sie werden nicht immer einer Meinung sein, und sie werden wahrscheinlich ihre Meinung ändern, wenn an der schnell voranschreitenden Grenze mehr Daten und Informationen ans Licht kommen“, hieß es in der Ankündigung – ein Satz, der auch als Mission Statement für jeden Gruppenchat seit 2022 durchgehen könnte.

Die erste Sammlung von vier Essays behandelt Wirtschaftspolitiken zur Bewältigung potenzieller AGI-Störungen, die Bewahrung menschenlesbarer Modellbegründungen, Prinzipien für menschliches Gedeihen und einen Rahmen zur Bewertung von Frontier-KI-Modellen. Mit anderen Worten: Geld, Mathematik, Sinn und Überwachung.

Ein Essay von den DeepMind-Sicherheitsforschern Rohin Shah und Anca Dragan argumentiert, dass das schrumpfende Fenster der KI-Transparenz – die Fähigkeit, die schrittweise Begründung eines Modells zu sehen und zu überprüfen – nicht unvermeidlich ist. Da neue Architekturen die leistungsstärksten Modelle schwerer überwachbar machen, sagen die Autoren, sollten Entwickler und Regulierungsbehörden die Sicherheitsabwägungen direkt angehen. Das könnte bedeuten, die „opake serielle Tiefe“ zu begrenzen – die Menge an sequenzieller Berechnung, die ein Modell ohne lesbare Begründungsspur durchführen kann – oder Entwickler zu verpflichten, nachzuweisen, dass weniger transparente Systeme genauso überwachbar bleiben. Was eine höfliche Art ist zu sagen: Wenn du deine Arbeit nicht zeigen kannst, solltest du besser beweisen, dass du sie nicht brauchst.

In einem anderen Essay schlägt Hassabis eine US-geführte Standardisierungsstelle für Frontier-KI vor, um die fortschrittlichsten KI-Modelle zu bewerten. Nach seinem Rahmenwerk würden Entwickler Modelle zunächst freiwillig bis zu 30 Tage vor der Veröffentlichung zur Überprüfung einreichen. Sobald sich das Bewertungssystem als wirksam erwiesen hat, könnte das Bestehen seiner Tests zur Voraussetzung für den Einsatz von Frontier-Modellen in den Vereinigten Staaten werden. Die Stelle würde zunächst Bewertungen in Absprache mit KI-Unternehmen entwerfen, aber schließlich unabhängige, nicht offengelegte Bewertungen entwickeln – sogenannte „held-out“-Tests –, um zu verhindern, dass Labore ihre Modelle auf bekannte Bewertungen zuschneiden. Hassabis sagte, das Rahmenwerk könnte „verschärft werden, wenn die Ernsthaftigkeit der Situation es erfordert“, möglicherweise einschließlich einer koordinierten Verlangsamung unter Frontier-KI-Entwicklern. Denn nichts fördert die freiwillige Einhaltung so sehr wie die Drohung mit einer Gruppenauszeit.

Die Essays erscheinen, während sich die Sicherheitsdebatte der Branche von allgemeinen Besorgnisbekundungen hin zu konkreten Vorschlägen für Offenlegung, externe Prüfung und, falls Schutzmaßnahmen zurückbleiben, koordinierte Verlangsamungen verschiebt. Diese Verschiebung beschleunigte sich diese Woche, als Branchenführer Elemente von Anthropic-CEO Dario Amodeis Aufruf unterstützten, die Frontier-KI-Entwicklung zu „verlangsamen“. Also: Essays, Standardisierungsstellen und gelegentliche existenzielle Seufzer. Fortschritt, sozusagen.