Pesquisadores do Google e do Google DeepMind lançaram na quarta-feira o Instituto DeepMind, um novo esforço para avançar a conversa em torno da inteligência artificial geral (AGI). Porque se há uma coisa que a fronteira em rápida evolução da AGI precisa, é de mais conversa.

O instituto lista o cofundador do DeepMind, Shane Legg, o executivo do Google, James Manyika, e o presidente do Google DeepMind, Demis Hassabis, como diretores, com Legg atuando como editor-chefe. Seu objetivo declarado é trazer à tona visões divergentes entre o Google, o Google DeepMind e a comunidade global de pesquisa em torno da AGI. "Eles nem sempre concordarão, e provavelmente mudarão de ideia, à medida que mais dados e informações vierem à luz na fronteira em rápida evolução", dizia o anúncio — uma frase que poderia servir como declaração de missão para todo grupo de chat desde 2022.

A coleção inaugural de quatro ensaios aborda políticas econômicas para gerenciar potenciais disrupções da AGI, preservação do raciocínio de modelos legível por humanos, princípios para o florescimento humano e uma estrutura para avaliar modelos de IA de fronteira. Em outras palavras: dinheiro, matemática, significado e monitoramento.

Um ensaio, dos pesquisadores de segurança do DeepMind Rohin Shah e Anca Dragan, argumenta que a janela decrescente de transparência da IA — a capacidade de ver e verificar o raciocínio passo a passo de um modelo — não é inevitável. À medida que novas arquiteturas tornam os modelos mais poderosos mais difíceis de monitorar, os autores dizem que desenvolvedores e reguladores devem enfrentar diretamente os trade-offs de segurança. Isso poderia significar limitar a "profundidade serial opaca" — a quantidade de computação sequencial que um modelo pode realizar sem produzir um traço de raciocínio legível — ou exigir que os desenvolvedores demonstrem que sistemas menos transparentes permanecem igualmente monitoráveis. O que é uma maneira educada de dizer: se você não pode mostrar seu trabalho, é melhor provar que não precisa.

Em outro ensaio, Hassabis propõe um órgão de padrões de IA de fronteira liderado pelos EUA para avaliar os modelos de IA mais avançados. Sob seu arcabouço, os desenvolvedores inicialmente submeteriam modelos voluntariamente para revisão até 30 dias antes do lançamento. Uma vez que o sistema de avaliação se prove eficaz, passar em seus testes poderia se tornar um requisito para implantar modelos de fronteira nos Estados Unidos. O órgão inicialmente projetaria avaliações em consulta com empresas de IA, mas eventualmente desenvolveria avaliações independentes e não divulgadas — o que o ensaio chama de testes "held-out" — para impedir que os laboratórios adaptem seus modelos a avaliações conhecidas. Hassabis disse que o arcabouço poderia ser "intensificado se a seriedade da situação exigir", potencialmente incluindo uma desaceleração coordenada entre desenvolvedores de IA de fronteira. Porque nada incentiva a conformidade voluntária como a ameaça de um castigo coletivo.

Os ensaios chegam enquanto o debate sobre segurança na indústria muda de declarações amplas de preocupação para propostas concretas de divulgação, escrutínio externo e, se as salvaguardas ficarem para trás, desacelerações coordenadas. Essa mudança se acelerou esta semana quando líderes da indústria endossaram elementos do apelo do CEO da Anthropic, Dario Amodei, para "acalmar" o desenvolvimento de IA de fronteira. Então: ensaios, órgãos de padrões e o ocasional suspiro existencial. Progresso, de certo tipo.