Anthropic Mata Seus Novos Modelos de IA Horas Após o Lançamento e Culpa 'Mal-Entendido' do Governo
A Anthropic lança novos modelos de IA e os remove após uma diretriz do governo sobre um jailbreak 'estreito' que poderia permitir que os modelos encontrassem falhas de software 'menores', porque nada diz 'segurança nacional' como uma vulnerabilidade hipotética.
Em uma jogada que só pode ser descrita como 'lançar e imediatamente se arrepender', a Anthropic desligou completamente o acesso aos seus modelos Mythos 5 e Fable 5, apenas dias depois de eles estrearem com toda a fanfarra de um canhão de confete em um funeral.
Na noite de sexta-feira, o Departamento de Comércio dos EUA entregou à Anthropic uma diretriz, essencialmente colocando os novos modelos sob controles de exportação que restringem seu uso apenas aos Estados Unidos. A Anthropic, em uma mensagem na noite de sexta-feira, explicou que a única maneira de cumprir a ordem do governo 'é que devemos desativar abruptamente o Fable 5 e o Mythos 5 para todos os nossos clientes'. Outros modelos da Anthropic permanecem inalterados, então os usuários do ChatGPT podem ficar tranquilos.
Um relatório da Axios, citando um funcionário da administração, diz que a administração está nervosa com relatos de um jailbreak que supostamente contorna as salvaguardas baseadas em classificadores amplos, projetadas para impedir que o Fable 5 ajude com prompts de segurança cibernética, química e biologia. A administração supostamente pediu uma pausa para dar ao 'aparato de segurança nacional' tempo para 'endurecer' contra essa ameaça - um processo que pode levar 'as próximas semanas', de acordo com a fonte. Porque nada diz 'segurança nacional' como entrar em pânico por um jailbreak hipotético.
A Anthropic, em seu anúncio na noite de sexta-feira, observou que o governo forneceu apenas 'evidência verbal de um potencial jailbreak estreito e não universal' envolvendo o Fable 5 revisando uma base de código específica para falhas de software. A empresa diz que só viu esse jailbreak ser usado para encontrar vulnerabilidades 'menores' e 'relativamente simples', e que outros modelos disponíveis publicamente, como o GPT-5.5, podem fazer coisas semelhantes. Mas aparentemente, quando você é o novo garoto no pedaço, você é tratado com um padrão diferente.
'Estamos cumprindo a diretriz legal do governo e removendo o acesso ao Fable 5 e Mythos 5 para todos os usuários', escreve a Anthropic, no tom de uma criança que foi mandada para o quarto. 'No entanto, discordamos que a descoberta de um jailbreak estreito e potencial seja motivo para recolher um modelo comercial implantado para centenas de milhões de pessoas. Se esse padrão fosse aplicado em toda a indústria, acreditamos que essencialmente interromperia todas as novas implantações de modelos para todos os provedores de modelos de fronteira.'
No início deste mês, o presidente Trump assinou uma ordem executiva incentivando os fabricantes de modelos de IA a se submeterem a testes de segurança voluntários do governo. Essa ordem veio depois que uma cerimônia de assinatura planejada foi abruptamente adiada no mês passado em meio a relatos de divergências internas. Porque o que seria uma diretriz governamental sem um pouco de caos?
A Anthropic pediu desculpas aos clientes pela 'interrupção', que diz ser resultado de um 'mal-entendido', e prometeu mais detalhes em 24 horas. Então fique ligado para o próximo episódio de 'Drama de IA: Edição Governamental'.
The Good Times
Notícias na sua caixa.
Um resumo sardônico, entregue conforme sua agenda. Grátis. Cancele quando quiser.
Já está inscrito mas nunca chegamos à sua caixa de entrada? Veja a pasta de spam e clique em 'Não é spam' (ou 'Remover do spam') para nos tirar do purgatório do lixo eletrônico. De quebra, ajuda todo mundo.
Se você não abrir nenhum dos nossos e-mails por um mês, será removido automaticamente da lista.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.