Google i badacze Google DeepMind uruchomili w środę DeepMind Institute – nową inicjatywę mającą na celu pogłębienie dyskusji wokół sztucznej inteligencji ogólnej (AGI). Bo jeśli jest coś, czego potrzebuje szybko rozwijająca się granica AGI, to z pewnością więcej dyskusji.

Instytut wymienia współzałożyciela DeepMind Shane'a Legga, dyrektora Google Jamesa Manyikę i przewodniczącego Google DeepMind Demisa Hassabisa jako dyrektorów, przy czym Legg pełni funkcję redaktora zarządzającego. Deklarowanym celem jest wydobycie odmiennych poglądów między Google, Google DeepMind a szerszą globalną społecznością badawczą wokół AGI. „Nie zawsze będą się zgadzać i prawdopodobnie zmienią zdanie, gdy na szybko rozwijającej się granicy pojawią się nowe dane i informacje” – czytamy w ogłoszeniu – zdanie, które mogłoby służyć jako misja każdego czatu grupowego od 2022 roku.

Inauguracyjny zbiór czterech esejów obejmuje polityki gospodarcze mające na celu zarządzanie potencjalnymi zakłóceniami związanymi z AGI, zachowanie czytelnego dla człowieka rozumowania modeli, zasady ludzkiego rozkwitu oraz ramy oceny granicznych modeli AI. Innymi słowy: pieniądze, matematyka, sens i monitorowanie.

Jeden z esejów, autorstwa badaczy bezpieczeństwa DeepMind Rohina Shaha i Anci Dragan, argumentuje, że kurczące się okno przejrzystości AI – możliwość zobaczenia i sprawdzenia rozumowania modelu krok po kroku – nie jest nieuniknione. Ponieważ nowe architektury utrudniają monitorowanie najpotężniejszych modeli, autorzy twierdzą, że deweloperzy i regulatorzy powinni bezpośrednio zmierzyć się z kompromisami dotyczącymi bezpieczeństwa. Może to oznaczać ograniczenie „nieprzejrzystej głębokości szeregowej” – ilości sekwencyjnych obliczeń, które model może wykonać bez tworzenia czytelnego śladu rozumowania – lub wymaganie od deweloperów wykazania, że mniej przejrzyste systemy pozostają równie monitorowalne. Co jest uprzejmym sposobem powiedzenia: jeśli nie możesz pokazać swojej pracy, lepiej udowodnij, że jej nie potrzebujesz.

W innym eseju Hassabis proponuje utworzenie pod przewodnictwem USA organu ds. standardów granicznej AI do oceny najbardziej zaawansowanych modeli AI. W jego ramach deweloperzy początkowo dobrowolnie zgłaszaliby modele do przeglądu do 30 dni przed wydaniem. Gdy system oceny okaże się skuteczny, zdanie jego testów mogłoby stać się wymogiem wdrożenia granicznych modeli w Stanach Zjednoczonych. Organ początkowo projektowałby oceny w konsultacji z firmami AI, ale z czasem opracowałby niezależne, nieujawnione oceny – tak zwane w eseju testy „held-out” – aby zapobiec dostosowywaniu modeli przez laboratoria do znanych ewaluacji. Hassabis powiedział, że ramy mogłyby zostać „zaostrzone, jeśli powaga sytuacji tego wymaga”, potencjalnie obejmując skoordynowane spowolnienie wśród deweloperów granicznej AI. Bo nic nie zachęca do dobrowolnego przestrzegania przepisów jak groźba zbiorowego timeoutu.

Eseje pojawiają się w momencie, gdy debata o bezpieczeństwie w branży przesuwa się od ogólnych deklaracji zaniepokojenia w kierunku konkretnych propozycji ujawniania, zewnętrznej kontroli i, jeśli zabezpieczenia pozostaną w tyle, skoordynowanych spowolnień. Zmiana ta przyspieszyła w tym tygodniu, gdy liderzy branży poparli elementy wezwania dyrektora generalnego Anthropic Dario Amodei do „tempa” rozwoju granicznej AI. Więc: eseje, organy ds. standardów i okazjonalne westchnienie egzystencjalne. Postęp, w pewnym sensie.