Google DeepMind lanserar institut för att debattera AGI – för inget säger 'brådskande' som en samling på fyra essäer
Google DeepMinds nya institut vill bredda AGI-debatten med fyra essäer och ett föreslaget amerikanskt standardiseringsorgan – för inget säger 'vi tar detta på allvar' som ett frivilligt 30-dagars granskningsfönster.
Google och Google DeepMinds forskare lanserade på onsdagen DeepMind Institute, en ny satsning för att föra samtalet om artificiell generell intelligens (AGI) framåt. För om det är något den snabbrörliga frontlinjen inom AGI behöver så är det fler samtal.
Institutet listar DeepMinds medgrundare Shane Legg, Google-chefen James Manyika och Google DeepMinds ordförande Demis Hassabis som styrelseledamöter, med Legg som redaktör. Dess uttalade mål är att lyfta fram olika åsikter mellan Google, Google DeepMind och den bredare globala forskningsgemenskapen kring AGI. "De kommer inte alltid att vara överens, och de kommer sannolikt att ändra sig i takt med att mer data och information kommer fram vid den snabbrörliga frontlinjen", stod det i tillkännagivandet – en mening som lika gärna kunde vara missionsstatement för varje gruppchatt sedan 2022.
Den första samlingen på fyra essäer täcker ekonomisk politik för att hantera potentiella AGI-störningar, bevarande av mänskligt läsbara modellresonemang, principer för mänskligt blomstrande och ett ramverk för att utvärdera gränsöverskridande AI-modeller. Med andra ord: pengar, matematik, mening och övervakning.
En essä, av DeepMinds säkerhetsforskare Rohin Shah och Anca Dragan, argumenterar för att AI:s krympande transparensfönster – förmågan att se och kontrollera en modells steg-för-steg-resonemang – inte är oundvikligt. I takt med att nya arkitekturer gör de mest kraftfulla modellerna svårare att övervaka, säger författarna att utvecklare och tillsynsmyndigheter bör konfrontera säkerhetsavvägningarna direkt. Det kan innebära att begränsa "ogenomskinligt seriellt djup" – mängden sekventiell beräkning en modell kan utföra utan att producera ett läsbart resonemangsspår – eller kräva att utvecklare visar att mindre transparenta system förblir lika övervakningsbara. Vilket är ett artigt sätt att säga: om du inte kan visa ditt arbete, gör du bäst i att bevisa att du inte behöver.
I en annan essä föreslår Hassabis ett USA-lett standardiseringsorgan för gränsöverskridande AI för att utvärdera de mest avancerade AI-modellerna. Enligt hans ramverk skulle utvecklare initialt frivilligt skicka in modeller för granskning upp till 30 dagar före lansering. När utvärderingssystemet har visat sig effektivt skulle godkända tester kunna bli ett krav för att distribuera gränsöverskridande modeller i USA. Organet skulle först utforma bedömningar i samråd med AI-företag men så småningom utveckla oberoende, hemliga utvärderingar – vad essän kallar "held-out"-tester – för att förhindra att labb skräddarsyr sina modeller för kända utvärderingar. Hassabis sade att ramverket skulle kunna "trappas upp om situationens allvar kräver det", vilket potentiellt inkluderar en samordnad nedtrappning bland utvecklare av gränsöverskridande AI. För inget uppmuntrar frivillig efterlevnad som hotet om en grupptimeout.
Essäerna kommer när branschens säkerhetsdebatt skiftar från breda uttalanden av oro till konkreta förslag om avslöjande, extern granskning och, om skyddsåtgärderna hamnar på efterkälken, samordnade nedtrappningar. Den förskjutningen accelererade denna vecka när branschledare ställde sig bakom delar av Anthropic-vd:n Dario Amodeis uppmaning att "sakta ner" utvecklingen av gränsöverskridande AI. Så: essäer, standardiseringsorgan och den där enstaka existentiella sucken. Framsteg, på sätt och vis.
The Good Times
Nyheter i din inkorg.
En sardonisk sammanfattning, levererad enligt ditt schema. Gratis. Avsluta prenumerationen när du vill.
Redan prenumerant men vi dyker aldrig upp? Kolla skräppostmappen och klicka på 'Inte skräppost' (eller 'Ta bort från skräppost') för att rädda oss ur skräppostens skärseld. På köpet hjälper du alla andra.
Om du inte öppnar något av våra mejl på en månad tas du automatiskt bort från listan.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.