Anthropic stoppt neue KI-Modelle Stunden nach Start und gibt Regierung die Schuld an 'Missverständnis'
Anthropic startet neue KI-Modelle, zieht sie dann nach einer Regierungsanweisung über einen 'schmalen' Jailbreak zurück, der den Modellen möglicherweise erlaubt, 'geringfügige' Softwarefehler zu finden - denn nichts sagt 'nationale Sicherheit' wie eine hypothetische Schwachstelle.
In einem Schritt, den man nur als 'Erst starten, dann sofort bereuen' bezeichnen kann, hat Anthropic den Zugang zu seinen Modellen Mythos 5 und Fable 5 komplett gesperrt, nur wenige Tage nachdem sie mit dem Tamtam einer Konfettikanone auf einer Beerdigung auf der Bildfläche erschienen sind.
Am Freitagabend überreichte das US-Handelsministerium Anthropic eine Anweisung, die die neuen Modelle im Wesentlichen unter Exportkontrollen stellt, die ihre Nutzung auf die Vereinigten Staaten beschränken. Anthropic erklärte in einer Freitagnacht-Nachricht, dass der einzige Weg, die Anordnung der Regierung zu erfüllen, darin bestehe, 'Fable 5 und Mythos 5 für alle unsere Kunden abrupt zu deaktivieren.' Andere Anthropic-Modelle bleiben unberührt, also können ChatGPT-Nutzer beruhigt schlafen.
Ein Axios-Bericht, der sich auf einen Regierungsbeamten beruft, besagt, dass die Regierung wegen Berichten über einen Jailbreak nervös ist, der angeblich die breiten, klassifikatorbasierten Schutzmaßnahmen umgeht, die Fable 5 davon abhalten sollen, bei Cybersicherheits-, Chemie- und Biologie-Prompts zu helfen. Die Regierung habe angeblich um eine Pause gebeten, um dem 'Sicherheitsapparat' Zeit zu geben, sich gegen diese Bedrohung zu 'härten' - ein Prozess, der laut der Quelle 'die nächsten Wochen' dauern könnte. Denn nichts sagt 'nationale Sicherheit' wie Panik vor einem hypothetischen Jailbreak.
Anthropic merkte in seiner Freitagnacht-Ankündigung an, dass die Regierung nur 'verbale Beweise für einen potenziellen schmalen, nicht universellen Jailbreak' geliefert habe, bei dem Fable 5 eine bestimmte Codebasis auf Softwarefehler überprüft. Das Unternehmen sagt, es habe diesen Jailbreak nur verwendet gesehen, um 'geringfügige' und 'relativ einfache' Schwachstellen zu finden, und dass andere öffentlich verfügbare Modelle wie GPT-5.5 Ähnliches tun können. Aber anscheinend wird man, wenn man das neue Kind im Block ist, an einem anderen Standard gemessen.
'Wir befolgen die rechtliche Anweisung der Regierung und entfernen den Zugang zu Fable 5 und Mythos 5 für alle Benutzer', schreibt Anthropic im Ton eines Kindes, das auf sein Zimmer geschickt wurde. 'Wir sind jedoch nicht der Meinung, dass die Feststellung eines schmalen potenziellen Jailbreaks ein Grund für die Rückrufung eines kommerziellen Modells sein sollte, das für Hunderte Millionen Menschen bereitgestellt wurde. Wenn dieser Standard branchenweit angewendet würde, glauben wir, dass er im Wesentlichen alle neuen Modellbereitstellungen für alle Frontier-Modellanbieter stoppen würde.'
Anfang dieses Monats unterzeichnete Präsident Trump eine Exekutivanordnung, die KI-Modellhersteller ermutigt, sich freiwilligen Sicherheitstests der Regierung zu unterziehen. Diese Anordnung kam, nachdem eine geplante Unterzeichnungszeremonie letzten Monat abrupt verschoben worden war, wegen Berichten über interne Meinungsverschiedenheiten. Denn was ist eine Regierungsanweisung schon ohne ein wenig Chaos?
Anthropic entschuldigte sich bei den Kunden für die 'Unterbrechung', die das Ergebnis eines 'Missverständnisses' sei, und versprach innerhalb von 24 Stunden weitere Details. Also bleibt gespannt auf die nächste Folge von 'KI-Drama: Regierungsausgabe.'
The Good Times
Nachrichten in deinem Posteingang.
Eine sardonische Zusammenfassung, nach deinem Zeitplan geliefert. Kostenlos. Abmelden wann immer du willst.
Schon angemeldet, aber wir landen nie in deinem Posteingang? Schau in den Spam-Ordner und klicke auf 'Kein Spam' (oder 'Aus Spam entfernen'), um uns aus dem Junk-Mail-Fegefeuer zu befreien. Du hilfst damit auch allen anderen.
Öffnest du einen Monat lang keine unserer E-Mails, wirst du automatisch von der Liste entfernt.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.