Cercetătorii de la Google și Google DeepMind au lansat miercuri Institutul DeepMind, un nou efort de a avansa conversația despre inteligența artificială generală (AGI). Pentru că dacă e un lucru de care frontiera în mișcare rapidă a AGI are nevoie, acela este mai multă conversație.

Institutul îi listează ca directori pe co-fondatorul DeepMind Shane Legg, pe executivul Google James Manyika și pe președintele Google DeepMind, Demis Hassabis, cu Legg în funcția de editor managing. Scopul declarat este de a scoate la iveală puncte de vedere diferite între Google, Google DeepMind și comunitatea globală de cercetare în jurul AGI. „Nu vor fi întotdeauna de acord și probabil se vor răzgândi, pe măsură ce mai multe date și informații ies la iveală pe frontiera în mișcare rapidă”, se arăta în anunț – o frază care ar putea servi drept declarație de misiune pentru fiecare chat de grup din 2022 încoace.

Colecția inaugurală de patru eseuri acoperă politici economice pentru gestionarea potențialelor perturbări cauzate de AGI, păstrarea raționamentului modelelor într-un format lizibil pentru oameni, principii pentru înflorirea umană și un cadru pentru evaluarea modelelor AI de frontieră. Cu alte cuvinte: bani, matematică, sens și monitorizare.

Un eseu, scris de cercetătorii în siguranță de la DeepMind Rohin Shah și Anca Dragan, susține că fereastra în scădere a transparenței AI – capacitatea de a vedea și verifica raționamentul pas cu pas al unui model – nu este inevitabilă. Pe măsură ce noile arhitecturi fac cele mai puternice modele mai greu de monitorizat, autorii spun că dezvoltatorii și autoritățile de reglementare ar trebui să confrunte direct compromisurile de siguranță. Aceasta ar putea însemna limitarea „adâncimii seriale opace” – cantitatea de calcul secvențial pe care un model o poate efectua fără a produce o urmă de raționament lizibilă – sau solicitarea ca dezvoltatorii să demonstreze că sistemele mai puțin transparente rămân la fel de monitorizabile. Ceea ce este o modalitate politicoasă de a spune: dacă nu-ți poți arăta munca, mai bine ai demonstra că nu ai nevoie.

Într-un alt eseu, Hassabis propune un organism de standarde pentru AI de frontieră condus de SUA, care să evalueze cele mai avansate modele AI. Conform cadrului său, dezvoltatorii ar trimite inițial modelele voluntar pentru revizuire cu până la 30 de zile înainte de lansare. Odată ce sistemul de evaluare s-a dovedit eficient, trecerea testelor sale ar putea deveni o cerință pentru implementarea modelelor de frontieră în Statele Unite. Organismul ar proiecta la început evaluări în consultare cu companiile de AI, dar în cele din urmă ar dezvolta evaluări independente, nedivulgate – ceea ce eseul numește teste „păstrate ascunse” – pentru a împiedica laboratoarele să-și adapteze modelele la evaluările cunoscute. Hassabis a spus că cadrul ar putea fi „intensificat dacă gravitatea situației o cere”, incluzând potențial o încetinire coordonată între dezvoltatorii de AI de frontieră. Pentru că nimic nu încurajează conformarea voluntară ca amenințarea cu o pauză de grup.

Eseurile apar în momentul în care dezbaterea despre siguranță din industrie se mută de la declarații largi de îngrijorare către propuneri concrete pentru divulgare, control extern și, dacă măsurile de protecție rămân în urmă, încetiniri coordonate. Această schimbare s-a accelerat săptămâna aceasta, pe măsură ce liderii din industrie au susținut elemente din apelul CEO-ului Anthropic, Dario Amodei, de a „încetini” dezvoltarea AI de frontieră. Deci: eseuri, organisme de standarde și ocazionalul oftat existențial. Progres, într-un fel.