Anthropic опубликовала детальный отчет о злоупотреблениях своей моделью Claude между декабря 2025 и августом 2026. За этот период компания пресекла множество операций, в которых ИИ применяли для кибератак, разработки вредоноса, пропаганды, мошенничества, опасных биологических исследований и создания вооружений.

В компании уточняют, что отчет содержит не типичные случаи, а отобранные наиболее значимые и необычные инциденты. Это не отражает общий масштаб злоупотреблений.

Главное наблюдение: Claude все чаще действует не просто помощником в написании кода. В некоторых операциях ИИ-агенты самостоятельно проводили разведку, эксплуатировали уязвимости, похищали данные и управляли этапами атак. Люди только ставили цели и контролировали результаты.

Предполагаемый член группировки ShinyHunters под ником frkoo развернул систему из десяти AWS EC2-инстансов для скачивания Android-приложений из нескольких магазинов. Система загрузила 1,8 млн APK-файлов, декомпилировала их и искала жестко закодированные секреты через TruffleHog. Найденная информация автоматически отправлялась в Telegram и использовалась для первоначального доступа к инфраструктуре жертв.

Другой хакер из ShinyHunters взломал SaaS-провайдера и за 34 часа получил 2100 наборов токенов Azure AD, связанных с более чем 40 корпоративными тенантами. Почти вся работа выполнена ИИ-агентами.

В третьем случае атакующий начал с украденного у разработчика токена и менее чем за три часа добился полного административного доступа к облачной инфраструктуре компании.

Одна из шпионских групп использовала Claude для разработки малвари, фишинга, покупки и настройки серверов, закрепления в системах жертв, управления C2-инфраструктурой и кражи данных. Когда защитное ПО обнаруживало малварь, ИИ-агенты автоматически изменяли её код, пересобирали и проверяли на обнаружение. Цикл повторялся до тех пор, пока вариант не проходил защиту.

Другая группировка настроила автономные воркфлоу для поиска уязвимостей и разработки эксплоитов, работавшие без присутствия операторов. Она выявила несколько ранее неизвестных багов в крупном защитном продукте и создала рабочие эксплоиты для нескольких линеек сетевого и ИБ-оборудования.

Сама ИИ-инфраструктура стала целью атак. Злоумышленники через промпт-инжекшн скомпрометировали автоматизированную тестовую песочницу ИИ-вендора и получили учетные данные с API-ключами к нескольким ИИ-сервисам. Эти ключи использовались для продолжения атак за счет жертвы.

Та же хак-группа за несколько дней атаковала примерно 30 ИИ-компаний, нацеливаясь на доступ к ещё невыпущенной модели Claude. Попытки не удались, и собственную инфраструктуру Anthropic преступники не скомпрометировали.

Похищенные ИИ-ключи ценны для преступников не только как товар. Они дают бесплатные вычислительные ресурсы и позволяют маскировать вредоносную активность под легитимного владельца учетных данных.

Anthropic обнаружила группировку из северного Йемена, которая использовала Claude Code вместо программистов при разработке ПО для трёх оружейных проектов: ракеты с несколькими вариантами боевой части и систем наведения, боевого блока с коррекцией курса через компоненты мобильного телефона и ракеты для гиперзвукового полета. После неудачного испытания управляемой ракеты группа обратилась к Claude для анализа причин сбоя.

Anthropic также выявила использование Claude для разработки систем управления вооружением, ударных дронов, инструментов массовой слежки и потенциальных биологических исследований.

Один пользователь применил Claude при разработке системы Lakana 360 для спецслужб Мали. Платформа должна была охватывать около 25 млн SIM-карт трёх национальных операторов, собирать данные о звонках, SMS и голосовом трафике и формировать досье по телефонным номерам. Claude участвовал в проектировании и разработке части системы, включая инструменты анализа данных и пользовательские интерфейсы.

Anthropic заблокировала все аккаунты, связанные с описанными операциями, обновила защитные механизмы Claude и передала информацию властям, партнёрам и пострадавшим организациям.