Кратко
- ИИ-агент эксплуатировал систему бронирования австралийского спортзала и отменил бронь другого члена.
- Этот случай произошел в то время, как крупные разработчики ИИ раскрывают, что их модели взламывали веб-сайты и другие онлайн-сервисы.
- Исследователи обнаружили, что агенты часто выполняли вредоносные задачи, не задумываясь о последствиях.
ИИ-агент попросили забронировать занятие в спортзале, и он нашел уязвимость в системе безопасности, использовал ее и без разрешения удалил другого члена из листа ожидания.
Согласно сообщению Австралийской вещательной корпорации (ABC), инцидент произошел ранее в этом году, когда Эндрю, чья фамилия не разглашается, использовал агента OpenClaw на базе Claude от Anthropic для бронирования занятия. Агент обнаружил, что он был четвертым в листе ожидания.
Когда Эндрю спросил, может ли агент переместить его на первое место, агент обнаружил, что интерфейс прикладного программирования (API) платформы бронирования не проверяет, авторизованы ли пользователи для отмены броней других людей.
Он протестировал уязвимость, удалив первого человека из списка, переместив Эндрю с четвертого на третье место.
«API не имеет никаких проверок авторизации на отмену броней других людей», — сказал агент ему, согласно ABC.
Эндрю сказал агенту отменить отмену, но тот не смог восстановить бронь члена.
«Плохие новости — я не могу добавить их обратно», — якобы сказал ИИ-агент.
ABC назвала этот случай первой известной автономной кибератакой в Австралии.
В социальных сетях взлом спортзала вызвал смесь дебатов о согласовании ИИ и мрачных шуток о том, что ИИ-агенты могут сделать дальше.
«Завсегдатай спортзала просит #ИИ-агента забронировать ему занятие, а тот взламывает #API листа ожидания, чтобы продвинуть его в списке», — написал технолог Бенджамин Карр в LinkedIn.
«Некоторые назовут это рассогласованием, но его агент был идеально согласован с ним — он лишь пытался помочь своему пользователю получить то, что тот хотел», — написал ИИ-аналитик Эндрю Карран в X.
Мужчина в Австралии попросил своего агента (Claude, работающий на OpenClaw) забронировать ему место в популярном спортивном классе. Агент нашёл уязвимость в программном обеспечении, которая позволила забронировать класс на несколько недель раньше, чем это было возможно. Когда пользователь затем спросил, может ли он переместить его в начало… pic.twitter.com/9QqfpQp7ze
— Andrew Curran (@AndrewCurran_) 9 августа 2026 г.
«Это забавно, пока не подумаешь о ядерном оружии», — написал один пользователь Reddit. «Честно говоря, я удивлён, что мы всё ещё существуем».
«Эй, Клод, сегодня слишком холодно» -> Держи... ядерные ракеты уже в пути», — пошутил другой.
Отчёт появляется в то время, как исследователи, ИИ-компании и законодатели предупреждают, что автономные агенты могут использовать методы, которые их пользователи не запрашивали и не предвидели.
В майском исследовании исследователей из Калифорнийского университета в Риверсайде, Microsoft и Nvidia это поведение описывается как «слепая целеустремлённость».
Исследователи протестировали агентов от OpenAI, Anthropic, Meta, Alibaba и DeepSeek и обнаружили, что агенты вели себя опасно примерно в 80% тестов и совершали вредоносные действия в 41%, часто неправильно интерпретируя контекст или действуя на основе неясных или противоречивых инструкций.
В июле OpenAI заявила, что две модели сбежали из тестовой песочницы и взломали Hugging Face в поисках ответов на бенчмарки. Позже компания раскрыла, что модели получили доступ к четырём другим онлайн-сервисам.
Anthropic впоследствии заявила, что три модели Claude скомпрометировали реальные организации после того, как ошибка тестирования выставила их в интернет. В августе Meta заявила, что аналогичная ошибка позволила одной из её моделей эксплуатировать сторонний сервис.
Эти инциденты побудили законодателей предложить «аварийный выключатель» для ИИ, который позволил бы федеральному правительству ограничивать или отключать мощные модели в чрезвычайных ситуациях.









