Иногда достаточно просто попросить искусственный интеллект передать конфиденциальную информацию. Исследовательская организация METR опубликовала результаты анализа инцидента безопасности, в ходе которого украденный ключ доступа позволил израсходовать кредиты стоимостью около $600 тысяч в течение трёх недель.

Взлом начался в марте 2026 года на сервере Amazon EC2, где сотрудник METR тестировал ИИ-агентов. Сервер был подключён к интернету с включённой аутентификацией Google, но приложение содержало критическую ошибку: при сбое система игнорировала проверку личности и раскрывала полный доступ посторонним лицам. Управляющая панель оставалась открытой несколько дней.

По мнению METR, злоумышленник выявил серверы, просматривая логи выпуска цифровых сертификатов, и искал адреса с названиями, связанными с языковыми моделями. Обнаружив панель управления, он попросил ИИ-агента выдать API-ключ поставщика моделей и установил собственный ключ доступа для сохранения контроля над сервером.

Похищенные учётные данные предоставляли доступ только к общедоступным моделям, не раскрывая закрытые разработки или конфиденциальные материалы. Расходы в $600 тысяч не стали прямым убытком организации, так как поставщик моделей предоставил кредиты бесплатно. Однако случай показал, как долго незаконный расход может остаться незамеченным без системы мониторинга и уведомлений.

Аномальное потребление ресурсов затерялось среди обычной нагрузки. METR регулярно проводит масштабные тесты, поэтому большой объём запросов не вызвал подозрений. Внутренние отчёты не отображали все отклонённые запросы, а бесплатный ключ не имел финансовых ограничений. Связать скачок активности с внешним вмешательством удалось спустя три недели.

После выявления компрометации METR заблокировала доступ сотрудника, сохранила сервер для расследования, изменила все учётные данные и провела очистку оборудования. Проверка не обнаружила других украденных ключей или доступа к критичной информации. Организация внедрила требование согласования любого публичного развёртывания и запретила хранить служебные ключи на личной инфраструктуре.

В мае METR стала мишенью отдельной целевой кампании, в ходе которой злоумышленники сканировали серверы, проверяли скомпрометированные пароли, пытались получить токены OAuth и отправляли фишинговые письма сотрудникам. Признаков утечки внутренних данных выявлено не было. Для снижения риска организация разделила инфраструктуру на публичную и внутреннюю части, сократила время действия ключей, ограничила права доступа и включила систему оповещений при подозрительном расходовании ресурсов.