Обнаружение вредоноса больше не означает конец атаки. Anthropic выявила схему, в которой ИИ-агенты отслеживают срабатывания антивирусной защиты, самостоятельно изменяют обнаруженные компоненты, пересобирают вредонос и отправляют его обратно, пока новая версия не ускользнёт от детектов.
Процесс работает как замкнутый цикл. Агенты мониторили эффективность инструментов против известных средств защиты. При обнаружении система определяла проблемные части, меняла их и заново разворачивала сборку. Люди могли сосредоточиться на целях, пока рутинная гонка с детектами переходила на автоматизацию. Anthropic уже наблюдает похожий переход от вспомогательного инструмента к системе, способной вести атаку почти независимо.
Раньше новая сигнатура вынуждала операторов вручную разбирать причину срабатывания, менять инструменты и заново их тестировать. Теперь ИИ может выполнять значительную часть этого цикла. По оценке Anthropic, атакующие потенциально адаптируют инструменты быстрее, чем защитники успевают выпускать статические детекты.
Автоматизация распространялась дальше пересборки кода. ИИ помогал создавать инфраструктуру, подготавливать фишинг-кампании, отслеживать каналы управления, поддерживать доступ к скомпрометированным системам и обрабатывать украденную информацию. Модели уже справлялись с полноценным поиском уязвимостей и их эксплуатацией, что подтвердил эксперимент, где Claude самостоятельно нашёл брешь и продолжил работу почти без помощи человека.
После успешной переделки изменённые инструменты размещали на временных серверах и применяли в реальных атаках — фишинг, ClickFix, подмена DNS. Anthropic отмечает, что описывает наиболее заметные случаи злоупотребления Claude, а не типичное поведение пользователей.
Случаи описаны в отчёте Anthropic, охватывающем активность с декабря 2025 по август 2026 года. Компания заблокировала связанные аккаунты, усилила механизмы выявления похожего поведения и поделилась информацией с отраслевыми партнёрами и органами власти. Конкретный антивирус в эпизоде не назван.
Скорость уже меняет соседние части атак. В июне Claude за несколько часов собирал рабочие эксплойты по недавно закрытым уязвимостям, сжимая промежуток между публикацией исправления и появлением готового инструмента.
Claude ранее показал, насколько мало ручной работы требуется для эксплуатации сложных целей. Модель самостоятельно взламывала серверы и доводила несколько цепочек эксплуатации до рабочего состояния всего за несколько часов вычислений.
