Em uma jogada que só pode ser descrita como 'lançar e imediatamente se arrepender', a Anthropic desligou completamente o acesso aos seus modelos Mythos 5 e Fable 5, apenas dias depois de eles estrearem com toda a fanfarra de um canhão de confete em um funeral.

Na noite de sexta-feira, o Departamento de Comércio dos EUA entregou à Anthropic uma diretriz, essencialmente colocando os novos modelos sob controles de exportação que restringem seu uso apenas aos Estados Unidos. A Anthropic, em uma mensagem na noite de sexta-feira, explicou que a única maneira de cumprir a ordem do governo 'é que devemos desativar abruptamente o Fable 5 e o Mythos 5 para todos os nossos clientes'. Outros modelos da Anthropic permanecem inalterados, então os usuários do ChatGPT podem ficar tranquilos.

Um relatório da Axios, citando um funcionário da administração, diz que a administração está nervosa com relatos de um jailbreak que supostamente contorna as salvaguardas baseadas em classificadores amplos, projetadas para impedir que o Fable 5 ajude com prompts de segurança cibernética, química e biologia. A administração supostamente pediu uma pausa para dar ao 'aparato de segurança nacional' tempo para 'endurecer' contra essa ameaça - um processo que pode levar 'as próximas semanas', de acordo com a fonte. Porque nada diz 'segurança nacional' como entrar em pânico por um jailbreak hipotético.

A Anthropic, em seu anúncio na noite de sexta-feira, observou que o governo forneceu apenas 'evidência verbal de um potencial jailbreak estreito e não universal' envolvendo o Fable 5 revisando uma base de código específica para falhas de software. A empresa diz que só viu esse jailbreak ser usado para encontrar vulnerabilidades 'menores' e 'relativamente simples', e que outros modelos disponíveis publicamente, como o GPT-5.5, podem fazer coisas semelhantes. Mas aparentemente, quando você é o novo garoto no pedaço, você é tratado com um padrão diferente.

'Estamos cumprindo a diretriz legal do governo e removendo o acesso ao Fable 5 e Mythos 5 para todos os usuários', escreve a Anthropic, no tom de uma criança que foi mandada para o quarto. 'No entanto, discordamos que a descoberta de um jailbreak estreito e potencial seja motivo para recolher um modelo comercial implantado para centenas de milhões de pessoas. Se esse padrão fosse aplicado em toda a indústria, acreditamos que essencialmente interromperia todas as novas implantações de modelos para todos os provedores de modelos de fronteira.'

No início deste mês, o presidente Trump assinou uma ordem executiva incentivando os fabricantes de modelos de IA a se submeterem a testes de segurança voluntários do governo. Essa ordem veio depois que uma cerimônia de assinatura planejada foi abruptamente adiada no mês passado em meio a relatos de divergências internas. Porque o que seria uma diretriz governamental sem um pouco de caos?

A Anthropic pediu desculpas aos clientes pela 'interrupção', que diz ser resultado de um 'mal-entendido', e prometeu mais detalhes em 24 horas. Então fique ligado para o próximo episódio de 'Drama de IA: Edição Governamental'.