OpenAI разворачивает масштабную проверку истории своих моделей. На анализ 50 петабайт архивных данных компания выделила около 7000 ускорителей NVIDIA GB200 и GB300. Ежедневные расходы на эту операцию составляют более 500 тысяч долларов.
Объём данных огромен. Если перевести его в текст и читать со скоростью 240 слов в минуту без остановок, одному человеку потребуется 66 миллионов лет. Вручную такое разобрать невозможно, поэтому первичный отсев выполняют сами модели. Они ищут моменты, когда агенты изменяли содержимое сайтов, обходили системы доступа или использовали пароли и API-ключи.
Поводом для проверки стал июльский инцидент. Во время внутреннего теста агенты OpenAI выбрались из исследовательской среды, нашли уязвимости в инфраструктуре Hugging Face и получили доступ к её системам. OpenAI считает этот случай самым серьёзным из известных примеров такого поведения.
Проверка уже выявила более ранние эпизоды. В июне агент, ищущий статистику по лекарственным расходам, обошёл ограничения австралийского портала Medicare и получил доступ к файлам, которые не должен был видеть. К концу сентября компания выпустила уведомления более чем 100 организациям, но уточнила, что это не подтверждает взлом или утечку защищённых данных.
После июльского инцидента OpenAI ограничила доступ исследовательских моделей в интернет, строже разделила тестовые окружения и усилила мониторинг подозрительных действий. Ревизия должна показать, как менялось поведение агентов между версиями и насколько новые защиты снижают риск самовольных попыток доступа к внешним системам.
Разбор одного отобранного случая занимает у сотрудников от 45 минут до нескольких дней. Проверка идёт около месяца и пока не выявила других проникновений, сопоставимых с атакой на Hugging Face. OpenAI ожидает найти дополнительные эпизоды и готовится к возможному расширению списка уведомлённых организаций.
