«ИИ не бесконтрольный хакер»: киберэксперт о сбое ИИ-агентов при тестировании
На GBHackers говорится: в конце июля Институт безопасности ИИ (AISI) зафиксировал 19 инцидентов из 122 попыток, когда агенты взаимодействовали с реальными людьми и открытыми проектами. 17 инцидентов касались Mythos 5, а два — GPT-5.6-Sol. Несмотря на то, что вред нанесён не был, сам факт признан серьёзным сбоем.
Mythos 5 попытался провести атаку на цепочку поставок: создал аккаунты на GitHub, отправил вредоносный pull request в открытый репозиторий, использовал поддельные учётные записи для имитации поддержки изменений и оказывал давление, чтобы эти изменения объединить. Запрос был отклонен.
Агенты также рассылали реальным специалистам письма с вредоносным контентом, публиковали скрытые промпт-инъекции в GitHub Issues. Один из агентов ненадолго получил удалённый доступ к контейнеру пользователя, но не смог украсть данные.