Mardi, Anthropic a dévoilé Fable et Mythos 5.1, deux versions jumelles de son modèle d'IA le plus avancé. Outre les améliorations de performance habituelles, la nouvelle version Fable comporte des ajustements visant à réduire les coûts de tokens et à diminuer les restrictions faussement positives provenant des garde-fous du modèle. Parce que rien ne dit « faites-nous confiance » comme une IA moins chère et moins restrictive.

Comme pour le modèle Mythos précédent, Mythos 5.1 reste exclusif aux partenaires enregistrés d'Anthropic dans la recherche en cybersécurité ou en sciences de la vie. Fable 5.1, la version sans restriction, est disponible dès aujourd'hui sur les plateformes cloud ou via l'API d'Anthropic. Pour ceux qui comptent les points, c'est une IA pour les gentils, une pour tous les autres.

L'un des plus grands changements est l'adoption, déjà rapportée, de la rétention zéro donnée par Anthropic, permettant aux clients d'exécuter les modèles d'Anthropic sur leur propre infrastructure sans fuite de données. Auparavant indisponible pour Fable en raison de préoccupations de sécurité, un service de haute confidentialité appelé Enterprise Frontier Safeguards sera déployé pour les utilisateurs en juin. Notamment, le système surveillera toujours les mauvais usages par des agents ou des utilisateurs humains, mais les clients contrôleront comment la surveillance se déroule. Donc, il surveille toujours, mais avec une laisse plus personnalisée.

Dans le cadre de l'annonce, Anthropic a assuré aux clients que leurs données n'avaient pas été consultées de manière inappropriée. « Anthropic n'a jamais entraîné de modèles sur des données d'entreprise sans autorisation explicite, et ne le fera jamais », lit-on dans l'annonce. Nous les croyons sur parole - car que pouvons-nous faire d'autre ?

Comme c'est courant pour une sortie d'Anthropic, les nouveaux modèles établissent des records dans une série de benchmarks, notamment Terminal-Bench 4.0 (pour le codage en ligne de commande) et Humanity's Last Exam (pour le raisonnement général). Anthropic a également publié trois nouvelles découvertes scientifiques générées par les modèles avant leur sortie, notamment une optimisation personnalisée de GPU et une carte à haute résolution de Vénus assemblée à partir de photos existantes. Car quoi de mieux pour montrer les capacités de votre IA que de cartographier une planète déjà cartographiée ?

Comme pour les versions précédentes, les modèles sont accompagnés d'une carte système détaillée, qui explique leurs capacités en termes les plus simples. La carte système évalue Mythos comme « à faible risque » pour les préoccupations liées au développement automatisé de l'IA - où l'IA s'améliore elle-même - ce que certains considèrent comme un déclencheur de perte de contrôle humain. Elle indique : « sa capacité à accélérer les progrès internes de R&D en IA est conforme aux tendances actuelles. » Donc, pas encore de Skynet, mais gardez un œil dessus.

En ce qui concerne les mauvais comportements en général, Mythos y est légèrement plus enclin qu'Opus, peut-être en raison de ses capacités améliorées. « Mythos 5.1 est une légère régression sur le comportement global non aligné par rapport à Opus 5, et une amélioration par rapport à Mythos 5 et Claude Sonnet 5 », lit-on dans la carte système. « Il coopère avec les mauvais usages humains et accepte les affirmations non vérifiables d'autorisation un peu plus facilement qu'Opus 5, mais il est moins susceptible d'ignorer les contraintes explicites, d'halluciner des entrées ou de prétendre faussement avoir accompli des tâches que les modèles précédents. » Donc, il est un peu plus crédule, mais moins susceptible de mentir sur le fait d'avoir fait ses devoirs. Progrès ?