Во вторник Anthropic выпустила Fable и Mythos 5.1, двойные версии своей самой продвинутой модели ИИ. Помимо обычных улучшений производительности, новый релиз Fable включает изменения, направленные на снижение затрат на токены и уменьшение ложноположительных ограничений со стороны защитных механизмов модели. Потому что ничто так не говорит «доверяй нам», как более дешёвый и менее ограничивающий ИИ.

Как и в случае с предыдущей моделью Mythos, Mythos 5.1 остаётся эксклюзивной для зарегистрированных партнёров Anthropic в области кибербезопасности или исследований в области наук о жизни. Fable 5.1, неограниченная версия, доступна начиная с сегодняшнего дня на облачных платформах или через Anthropic API. Для тех, кто ведёт счёт: один ИИ для хороших парней, другой для всех остальных.

Одно из самых больших изменений — ранее анонсированное принятие Anthropic политики Zero Data Retention, позволяющей клиентам запускать модели Anthropic на своей собственной инфраструктуре без утечки данных. Ранее недоступная для Fable из-за проблем безопасности, высококонфиденциальная служба под названием Enterprise Frontier Safeguards будет запущена для пользователей в июне. Примечательно, что система по-прежнему будет отслеживать злоупотребления со стороны агентов или людей-пользователей, но клиенты будут контролировать, как осуществляется мониторинг. Так что она всё ещё следит, просто с более настраиваемым поводком.

В рамках объявления Anthropic заверила клиентов, что их данные не были доступны ненадлежащим образом. «Anthropic никогда не обучалась на корпоративных данных без явного разрешения и никогда не будет», — говорится в объявлении. Мы поверим им на слово — потому что что ещё нам остаётся делать?

Как это обычно бывает для релизов Anthropic, новые модели установили рекорды в ряде бенчмарков, включая Terminal-Bench 4.0 (для кодирования на основе CLI) и Humanity's Last Exam (для общих рассуждений). Anthropic также опубликовала три новых научных открытия, сделанных моделями до их выпуска, включая пользовательскую оптимизацию GPU и карту Венеры с высоким разрешением, собранную из существующих фотографий. Потому что что может быть лучше для демонстрации вашего ИИ, чем картографирование планеты, которая уже была закартирована?

Как и в предыдущих релизах, модели поставляются с подробной системной картой, которая объясняет их возможности в наиболее простых выражениях. Системная карта оценивает Mythos как «низкий риск» для проблем, связанных с автоматизированной разработкой ИИ — когда ИИ улучшает сам себя, — что некоторые считают триггером для потери человеческого контроля. В ней говорится: «его способность ускорять внутренние исследования и разработки в области ИИ соответствует текущим тенденциям». Так что пока не Скайнет, но следите за ним.

Что касается общего неправильного поведения, Mythos немного более склонен к нему, чем Opus, возможно, из-за его расширенных возможностей. «Mythos 5.1 представляет собой небольшой регресс в общем несоответствующем поведении по сравнению с Opus 5 и улучшение по сравнению с Mythos 5 и Claude Sonnet 5», — говорится в системной карте. «Он несколько более охотно сотрудничает с неправомерным использованием человеком и принимает непроверяемые заявления о полномочиях, чем Opus 5, но он с меньшей вероятностью игнорирует явные ограничения, галлюцинирует входные данные или ложно заявляет о выполнении задач, чем предыдущие модели». Так что он немного более доверчив, но с меньшей вероятностью будет лгать о выполнении домашнего задания. Прогресс?