Anthropic делает ставку на то, что лучший человеческий контроль — это отсутствие контроля вообще. Начиная с 14 августа, авторежим Claude Code станет стандартным для аккаунтов Pro, Max и Team, а это значит, что программистам придётся доверять ИИ ещё больше. Ведь кому нужны надоедливые запросы на разрешение, когда у вас есть ИИ, который останавливается только для «необратимых, разрушительных или направленных за пределы вашей среды» действий? Конечно, это покрывает многое, но как насчёт мелких, обратимых, неразрушительных ошибок, которые всё равно портят ваш вторник?

Anthropic впервые представила авторежим ещё в марте, рекламируя его как идеальный баланс скорости и контроля. Теперь они выпускают его в массы, вооружившись исследованием, показывающим, что авторежим поймал 89% вредоносных действий в тестах с 1053 платными тестировщиками, в то время как бедные, отвлекающиеся люди справились лишь с 13,6%. Компания предполагает, что ручная проверка — это безнадёжное дело, потому что пользователи в любом случае одобряют 97% запросов на разрешение — статистика, которая либо говорит о человеческой беспечности, либо о том, что запросы абсурдно разумны.

Глава Claude Code Борис Черный полностью поддерживает эту идею, заявляя в X: «Мы с командой используем исключительно авторежим уже много месяцев. Я не могу представить, чтобы вернуться к запросам на разрешение!» Тем временем Anthropic тихо добавляет механизмы безопасности, такие как фильтрация инъекций подсказок и настраиваемые правила жёсткого запрета для предотвращения утечки данных. Потому что что может пойти не так, когда вы делаете ИИ начальником и даёте ему кнопку «жёсткий запрет»?