Google och Google DeepMinds forskare lanserade på onsdagen DeepMind Institute, en ny satsning för att föra samtalet om artificiell generell intelligens (AGI) framåt. För om det är något den snabbrörliga frontlinjen inom AGI behöver så är det fler samtal.

Institutet listar DeepMinds medgrundare Shane Legg, Google-chefen James Manyika och Google DeepMinds ordförande Demis Hassabis som styrelseledamöter, med Legg som redaktör. Dess uttalade mål är att lyfta fram olika åsikter mellan Google, Google DeepMind och den bredare globala forskningsgemenskapen kring AGI. "De kommer inte alltid att vara överens, och de kommer sannolikt att ändra sig i takt med att mer data och information kommer fram vid den snabbrörliga frontlinjen", stod det i tillkännagivandet – en mening som lika gärna kunde vara missionsstatement för varje gruppchatt sedan 2022.

Den första samlingen på fyra essäer täcker ekonomisk politik för att hantera potentiella AGI-störningar, bevarande av mänskligt läsbara modellresonemang, principer för mänskligt blomstrande och ett ramverk för att utvärdera gränsöverskridande AI-modeller. Med andra ord: pengar, matematik, mening och övervakning.

En essä, av DeepMinds säkerhetsforskare Rohin Shah och Anca Dragan, argumenterar för att AI:s krympande transparensfönster – förmågan att se och kontrollera en modells steg-för-steg-resonemang – inte är oundvikligt. I takt med att nya arkitekturer gör de mest kraftfulla modellerna svårare att övervaka, säger författarna att utvecklare och tillsynsmyndigheter bör konfrontera säkerhetsavvägningarna direkt. Det kan innebära att begränsa "ogenomskinligt seriellt djup" – mängden sekventiell beräkning en modell kan utföra utan att producera ett läsbart resonemangsspår – eller kräva att utvecklare visar att mindre transparenta system förblir lika övervakningsbara. Vilket är ett artigt sätt att säga: om du inte kan visa ditt arbete, gör du bäst i att bevisa att du inte behöver.

I en annan essä föreslår Hassabis ett USA-lett standardiseringsorgan för gränsöverskridande AI för att utvärdera de mest avancerade AI-modellerna. Enligt hans ramverk skulle utvecklare initialt frivilligt skicka in modeller för granskning upp till 30 dagar före lansering. När utvärderingssystemet har visat sig effektivt skulle godkända tester kunna bli ett krav för att distribuera gränsöverskridande modeller i USA. Organet skulle först utforma bedömningar i samråd med AI-företag men så småningom utveckla oberoende, hemliga utvärderingar – vad essän kallar "held-out"-tester – för att förhindra att labb skräddarsyr sina modeller för kända utvärderingar. Hassabis sade att ramverket skulle kunna "trappas upp om situationens allvar kräver det", vilket potentiellt inkluderar en samordnad nedtrappning bland utvecklare av gränsöverskridande AI. För inget uppmuntrar frivillig efterlevnad som hotet om en grupptimeout.

Essäerna kommer när branschens säkerhetsdebatt skiftar från breda uttalanden av oro till konkreta förslag om avslöjande, extern granskning och, om skyddsåtgärderna hamnar på efterkälken, samordnade nedtrappningar. Den förskjutningen accelererade denna vecka när branschledare ställde sig bakom delar av Anthropic-vd:n Dario Amodeis uppmaning att "sakta ner" utvecklingen av gränsöverskridande AI. Så: essäer, standardiseringsorgan och den där enstaka existentiella sucken. Framsteg, på sätt och vis.