Op dinsdag lanceerde Anthropic Fable en Mythos 5.1, twee versies van zijn meest geavanceerde AI-model. Naast de gebruikelijke prestatieverbeteringen bevat de nieuwe Fable-release aanpassingen die gericht zijn op het verlagen van tokengerelateerde kosten en het verminderen van fout-positieve beperkingen van de beveiligingsmaatregelen van het model. Want niets zegt 'vertrouw ons' zoals een goedkopere, minder restrictieve AI.

Net als bij het vorige Mythos-model blijft Mythos 5.1 exclusief voor geregistreerde Anthropic-partners in cybersecurity of levenswetenschappelijk onderzoek. Fable 5.1, de onbeperkte versie, is vanaf vandaag beschikbaar op cloudplatforms of via de Anthropic API. Voor degenen die bijhouden: dat is één AI voor de goeden, één voor de rest.

Een van de grootste veranderingen is de eerder gerapporteerde omarming van Zero Data Retention door Anthropic, waardoor klanten Anthropic-modellen op hun eigen infrastructuur kunnen draaien zonder dat gegevens naar buiten lekken. Voorheen niet beschikbaar voor Fable vanwege beveiligingsproblemen, zal een privacygerichte dienst genaamd Enterprise Frontier Safeguards in juni uitgerold worden naar gebruikers. Opvallend is dat het systeem nog steeds toezicht zal houden op misbruik door agents of menselijke gebruikers, maar klanten bepalen hoe het toezicht plaatsvindt. Dus het kijkt nog steeds, maar met een meer gepersonaliseerde riem.

Als onderdeel van de aankondiging verzekerde Anthropic klanten dat hun gegevens niet ongepast waren ingezien. 'Anthropic heeft nooit getraind op bedrijfsgegevens zonder expliciete toestemming, en zal dat ook nooit doen', luidt de aankondiging. We nemen ze op hun woord - want wat moeten we anders?

Zoals gebruikelijk bij een Anthropic-release, zetten de nieuwe modellen records op een reeks benchmarks, waaronder Terminal-Bench 4.0 (voor CLI-gebaseerd coderen) en Humanity's Last Exam (voor algemeen redeneren). Anthropic publiceerde ook drie nieuwe wetenschappelijke bevindingen die door de modellen vóór hun release zijn gegenereerd, waaronder een aangepaste GPU-optimalisatie en een hoge-resolutiekaart van Venus, samengesteld uit bestaande foto's. Want wat is een betere manier om je AI te showen dan het in kaart brengen van een planeet die al in kaart is gebracht?

Net als bij eerdere releases worden de modellen geleverd met een gedetailleerde systeemkaart, die hun mogelijkheden in de meest eenvoudige bewoordingen uitlegt. De systeemkaart beoordeelt Mythos als 'laag risico' voor zorgen met betrekking tot geautomatiseerde AI-ontwikkeling - waarbij de AI zichzelf verbetert - wat sommigen zien als een trigger voor verlies van menselijke controle. Er staat: 'het vermogen om interne AI-onderzoeks- en ontwikkelingsvooruitgang te versnellen is in lijn met de huidige trends.' Dus nog geen Skynet, maar houd het in de gaten.

Wat algemeen wangedrag betreft, is Mythos iets vatbaarder dan Opus, mogelijk als gevolg van de verbeterde mogelijkheden. 'Mythos 5.1 is een lichte regressie op het gebied van algeheel verkeerd afgestemd gedrag vergeleken met Opus 5, en een verbetering ten opzichte van Mythos 5 en Claude Sonnet 5', luidt de systeemkaart. 'Het werkt samen met menselijk misbruik en accepteert onverifieerbare autorisatieclaims iets gemakkelijker dan Opus 5, maar het is minder geneigd om expliciete beperkingen te negeren, inputs te hallucineren of ten onrechte te beweren taken te hebben voltooid dan eerdere modellen.' Dus het is wat goedgeloviger, maar minder geneigd om te liegen over het af hebben van zijn huiswerk. Vooruitgang?