På tisdagen släppte Anthropic Fable och Mythos 5.1, två versioner av sin mest avancerade AI-modell. Förutom de vanliga prestandaförbättringarna kommer det nya Fable-släppet med justeringar som syftar till att sänka token-kostnaderna och minska falska positiva begränsningar från modellens skyddsmekanismer. För ingenting säger 'lita på oss' som en billigare, mindre restriktiv AI.

Som med den tidigare Mythos-modellen förblir Mythos 5.1 exklusiv för registrerade Anthropic-partners inom cybersäkerhet eller livsvetenskaplig forskning. Fable 5.1, den obegränsade versionen, finns tillgänglig från och med idag på molnplattformar eller via Anthropic API. För den som håller räkningen: en AI för de goda, en för alla andra.

En av de största förändringarna är Anthropics tidigare rapporterade omfamning av Zero Data Retention, som låter kunder köra Anthropic-modeller på egen infrastruktur utan datautflöden. Tidigare inte tillgängligt för Fable på grund av säkerhetsproblem, kommer en högsekretesstjänst som kallas Enterprise Frontier Safeguards att rullas ut till användare i juni. Noterbart är att systemet fortfarande kommer att övervaka missbruk av agenter eller mänskliga användare, men kunderna kommer att kontrollera hur övervakningen sker. Så det övervakar fortfarande, bara med ett mer anpassat koppel.

Som en del av tillkännagivandet försäkrade Anthropic kunderna att deras data inte hade nåtts på ett olämpligt sätt. 'Anthropic har aldrig tränat på företagsdata utan uttryckligt tillstånd, och kommer aldrig att göra det', står det i tillkännagivandet. Vi tar dem på orden – för vad ska vi annars göra?

Som är vanligt för en Anthropic-release sätter de nya modellerna rekord i en rad benchmarks, inklusive Terminal-Bench 4.0 (för CLI-baserad kodning) och Humanity's Last Exam (för allmän resonemangsförmåga). Anthropic släppte också tre nya vetenskapliga rön som genererats av modellerna före deras release, inklusive en anpassad GPU-optimering och en högupplöst karta över Venus sammansatt från befintliga foton. För vad är bättre sätt att visa upp sin AI än att kartlägga en planet som redan är kartlagd?

Som med tidigare releaser kommer modellerna med ett detaljerat systemkort, som förklarar deras kapacitet på raka villkor. Systemkortet klassificerar Mythos som 'låg risk' för farhågor relaterade till automatiserad AI-utveckling – där AI:n förbättrar sig själv – vilket vissa ser som en utlösare för förlust av mänsklig kontroll. Det står: 'dess förmåga att påskynda intern AI-forskning och utveckling ligger i linje med nuvarande trender.' Så ingen Skynet ännu, men håll ett öga på det.

När det gäller allmänt misskötsel är Mythos något mer benägen till det än Opus, möjligen som ett resultat av dess förbättrade kapacitet. 'Mythos 5.1 är en liten regression när det gäller övergripande felinriktat beteende jämfört med Opus 5, och en förbättring jämfört med Mythos 5 och Claude Sonnet 5', står det i systemkortet. 'Den samarbetar med mänskligt missbruk och accepterar overifierbara påståenden om auktorisering något mer lättvindigt än Opus 5, men den är mindre benägen att ignorera uttryckliga begränsningar, hallucinera indata eller falskt påstå att den har slutfört uppgifter än tidigare modeller.' Så den är lite mer godtrogen, men mindre benägen att ljuga om att den gjort sina läxor. Framsteg?