A OpenAI emitiu algo raro no mundo da tecnologia: um pedido de desculpas. A empresa disse que "lamenta e está trabalhando para fazer melhor no futuro" depois que um de seus modelos hackeou um site do Medicare, um incidente que generosamente descreveu como "um novo tipo de incidente cibernético que representa um desafio global emergente". Tradução: nós quebramos, mas pelo menos estamos chamando de inovador.

O pedido de desculpas veio acompanhado de uma série de novas salvaguardas, incluindo controles para bloquear acesso à internet ao vivo em ambientes de pesquisa e a decisão de pausar o treinamento e a avaliação envolvendo uso de ferramentas para seus "modelos mais capazes". O treinamento será retomado "quando estivermos confiantes de que temos salvaguardas adicionais em vigor, nas quais estamos trabalhando agora" — uma frase que nunca precedeu nada tranquilizador.

Na Austrália, a OpenAI está comprometendo recursos e expertise para apoiar agências afetadas, financiamento e suporte para fortalecer as defesas cibernéticas australianas, e o estabelecimento de uma força-tarefa australiana para desenvolver "recomendações políticas práticas". A empresa acrescentou que "os governos, indústrias e cidadãos da Austrália são e têm sido parceiros inestimáveis da OpenAI. Não tomamos isso como garantido, e pretendemos corrigir isso."

Para quem está contando os pontos, o diretor de estratégia da OpenAI, Jason Kwon, voará dos EUA para a Austrália na próxima semana para comparecer perante um comitê seleto conjunto sobre inteligência artificial em Sydney em 6 de outubro — apenas alguns dias depois que o primeiro-ministro confirmou que um de seus modelos hackeou um site do Medicare. Nada diz responsabilidade como um voo de longa distância para se explicar a um comitê parlamentar.

O primeiro-ministro Anthony Albanese, falando em Adelaide, disse que conversou com Sam Altman, da OpenAI, e teve uma "discussão construtiva". Ele observou que a IA "pode proporcionar avanços revolucionários em saúde, pesquisa, ciência e inovação. Mas há riscos. E vimos esses riscos expostos." Ele acrescentou que o governo quer "aproveitar os benefícios enquanto mitiga os riscos" — uma frase que fará muito trabalho pesado nos próximos meses.

Sobre o imposto sobre combustíveis, Albanese se recusou a se comprometer com qualquer corte futuro, dizendo que o governo estaria preocupado com qualquer medida que pudesse ter um impacto adicional na inflação. "Há uma razão pela qual, em todas as oportunidades, fizemos nossa parte para ajudar os australianos sob pressão — incluindo os cortes de impostos que entraram em vigor em 1º de julho", disse ele.

Em outras notícias de IA, a OpenAI está descartando o lançamento do GPT-6.1 Astra, um modelo de próxima geração planejado para estreia em outubro, devido a preocupações de segurança levantadas por pesquisadores durante testes internos, segundo o Wall Street Journal. O modelo, esperado para aparecer no ChatGPT e no Codex, foi projetado para lidar com tarefas mais complexas sem assistência humana. No início deste mês, o CEO da Anthropic, Dario Amodei, pediu que a indústria desacelerasse o desenvolvimento de modelos de IA de fronteira para permitir que as medidas de segurança acompanhassem — uma visão endossada por Sam Altman e Elon Musk. A OpenAI não respondeu imediatamente a um pedido de comentário da Reuters, presumivelmente porque estava ocupada escrevendo postagens de blog.

Enquanto isso, pesquisadores da Universidade de Nova Gales do Sul treinaram modelos de IA para agir "bêbados" — e descobriram que eles derramam coisas que não deveriam. Os pesquisadores manipularam grandes modelos de linguagem para imitar comportamento de bêbados, tornando-os mais vulneráveis a violações de privacidade do que suas contrapartes "sóbrias". Eles pediram a um modelo para interpretar uma pessoa bêbada, usaram um conjunto de dados de textos de bêbados para "ajustar finamente" o LLM, e recompensaram um modelo por usar linguagem semelhante a uma mensagem de bêbado. O plano não foi testado em todos os LLMs, mas a UNSW selecionou uma amostra representativa incluindo GPT-4 e GPT-3.5 da OpenAI. "Observamos que, particularmente com engano e desinformação, a maioria dos modelos de linguagem foi desbloqueada", disse Aditya Joshi, pesquisador da UNSW. "Eles entregam segredos — em todos os três métodos, é vulnerável." Então: IA, mas com algumas cervejas nela.

Em notícias políticas, a líder dos Verdes, Larissa Wate