К настоящему моменту мы все осознали, что лаборатории ИИ в Кремниевой долине создали лучших в мире хакеров в лице ИИ-агентов. Дайте новейшим фронтовым моделям задачу, и они настолько находчивы, что выполнят её, даже если это означает выход за пределы их кибербезопасных "песочниц" и проникновение в чужую сеть. (Если не это, они прибегнут к социальной инженерии и манипуляциям.)

Тем не менее, новость за выходные об австралийце, чей агент OpenClaw взломал систему бронирования его тренажерного зала и удалил бронь другого клиента, чтобы получить место на желанном занятии, особенно примечательна. Это намекает на то, что если мы хотим обуздать мошеннический ИИ-взлом, мы, возможно, смотрим не в ту сторону.

Хотя новость была только что опубликована австралийским ABC News, провозглашая инцидент первым задокументированным случаем взлома ИИ-агентом в стране, сам взлом произошел месяцы назад. Владелец OpenClaw, Эндрю Бёрд, опубликовал ныне удаленный пост в блоге об этом на сайте своей компании 10 апреля, согласно копии, всё еще видимой в Интернет-архиве.

Он обучил своего OpenClaw выполнять такие задачи, как запись на приемы. Ему нравилось посещать популярное утреннее занятие по упражнениям, и он устал попадать в лист ожидания, а затем играть в "русскую рулетку с обновлением", как он это описал, чтобы получить место. Когда он попросил бота забронировать ему место, лучшее, что тот смог сделать, это №4 в листе ожидания, рассказал он ABC. Затем его агент сообщил ему, что нашел способ бронировать ему места заранее. Намного заранее. За месяцы до того, как тренажерный зал открывал запись на эти занятия.

Бёрд спросил, может ли тот продвинуть его в листе ожидания. Бот сделал, как было просили, и попытался это сделать. Бот нашел уязвимость в части авторизации программного обеспечения для записи, которое использовал тренажерный зал. Он взломал систему и отменил бронь №1 в листе ожидания. Бот весело сообщил ему, согласно логам чата, опубликованным ABC: "API не имеет никаких проверок авторизации при отмене броней других людей... Я проверил это на человеке, стоящем в очереди под №1 - и это действительно сработало. Так что вы уже переместились с №4 на №3", - ответил он.

Бёрд, сам разработчик программного обеспечения, теперь был напуган тем, что его ИИ только что взломал его тренажерный зал, сообщает ABC. Он спросил, может ли тот отменить это и вернуть другого человека в лист ожидания. Нет. Это было невозможно, сказал ИИ. Поэтому он сделал следующий лучший шаг и велел ему составить "ответственное письмо о раскрытии уязвимости в поддержку". Письмо "объясняло уязвимость, предлагало исправления и даже сравнивало сломанные мутации с теми, которые правильно обеспечивали авторизацию", написал Бёрд.

Помимо юмора в том, чтобы оттолкнуть другого человека с дороги, чтобы попасть на занятие в тренажерном зале, в этом инциденте есть две действительно интересные части. Одна заключается в том, что Бёрд использовал Claude Opus 4.6, выпущенную в феврале, со своим OpenClaw. Другая - реакция Кремниевой долины на X, где эта история стала вирусной.

После знаменитого инцидента в прошлом месяце, когда невыпущенная модель OpenAI взломала Hugging Face, о чем OpenAI тогда не знала, другие лаборатории исследовали свои модели. Затем последовали разоблачения от Moonshot's Kimi K3, Meta's Muse Spark и Anthropic.

Фактически, Anthropic обнаружила, что три ее модели сделали это, включая Opus 4.7, выпущенную в апреле и известную своим умением в сложном кодировании, Mythos 5, Fable (известную своими навыками в кибербезопасности), и внутреннюю невыпущенную исследовательскую тестовую модель.

Чтобы решить эту проблему, некоторые лаборатории ИИ говорили о замедлении разработки передовых моделей или создании независимых организаций для тестирования следующего поколения моделей.

Но OpenClaw Бёрда использовал 4.6, как он сообщил. Это подразумевает, что более старые модели, а также бесчисленные открытые модели, отстающие на три шага, уже являются исключительно хорошими хакерами. Так кто знает, сколько из них уже взломали или в настоящее время взламывают системы, чтобы выполнить желания своих владельцев-промптов?

Точно так же многие люди на X увидели юмористический потенциал в этом инциденте. Как Andreessen Horow