In een zet die alleen omschreven kan worden als 'lanceren en dan direct spijt krijgen', heeft Anthropic de toegang tot zijn Mythos 5- en Fable 5-modellen volledig afgesloten, slechts dagen nadat ze op het toneel verschenen met al het vertoon van een confettikanon op een begrafenis.

Vrijdagavond overhandigde het Amerikaanse ministerie van Handel Anthropic een richtlijn, die de nieuwe modellen in feite onder exportcontroles plaatste die het gebruik ervan beperken tot binnen de Verenigde Staten. Anthropic legde in een bericht op vrijdagavond uit dat de enige manier om aan het overheidsbevel te voldoen 'is dat we Fable 5 en Mythos 5 abrupt moeten uitschakelen voor al onze klanten.' Andere Anthropic-modellen blijven onaangetast, dus ChatGPT-gebruikers kunnen gerust zijn.

Een Axios-rapport, dat een functionaris van de regering aanhaalt, zegt dat de regering zenuwachtig is over berichten over een jailbreak die naar verluidt de brede, op classificatie gebaseerde beveiligingsmaatregelen omzeilt die Fable 5 ervan moeten weerhouden om te helpen bij prompts over cybersecurity, chemie en biologie. De regering zou om een pauze hebben gevraagd om het 'nationale veiligheidsapparaat' de tijd te geven om zich tegen deze dreiging te 'wapenen' - een proces dat volgens de bron 'de komende weken' kan duren. Want niets zegt 'nationale veiligheid' als in paniek raken over een hypothetische jailbreak.

Anthropic merkte in zijn aankondiging op vrijdagavond op dat de overheid alleen 'mondeling bewijs heeft geleverd van een potentiële nauwe, niet-universele jailbreak' waarbij Fable 5 een specifieke codebase beoordeelt op softwarefouten. Het bedrijf zegt dat het deze jailbreak alleen heeft zien gebruiken om 'kleine' en 'relatief eenvoudige' kwetsbaarheden te vinden, en dat andere openbaar beschikbare modellen zoals GPT-5.5 soortgelijke dingen kunnen doen. Maar blijkbaar, als je de nieuwkomer bent, word je aan een andere norm gehouden.

'Wij voldoen aan het wettelijke bevel van de overheid en verwijderen de toegang tot Fable 5 en Mythos 5 voor alle gebruikers', schrijft Anthropic, in de toon van een kind dat naar zijn kamer is gestuurd. 'We zijn het er echter niet mee eens dat de bevinding van een nauwe potentiële jailbreak reden zou moeten zijn om een commercieel model terug te roepen dat bij honderden miljoenen mensen is ingezet. Als deze norm op de hele industrie zou worden toegepast, denken we dat dit in wezen alle nieuwe modelimplementaties voor alle grensverleggende modelproviders zou stoppen.'

Eerder deze maand ondertekende president Trump een uitvoeringsbevel dat AI-modelfabrikanten aanmoedigt om zich vrijwillig te onderwerpen aan veiligheidstests van de overheid. Dat bevel kwam nadat een geplande ondertekeningsceremonie vorige maand abrupt was uitgesteld vanwege berichten over interne meningsverschillen. Want wat is een overheidsrichtlijn zonder een beetje chaos?

Anthropic bood zijn excuses aan aan klanten voor de 'verstoring', die volgens het bedrijf het gevolg is van een 'misverstand', en beloofde binnen 24 uur meer details te geven. Dus blijf op de hoogte voor de volgende aflevering van 'AI-drama: Overheidseditie'.