OpenAI выявила скоординированную кампанию по извлечению скрытых рассуждений своих моделей и связала основной источник активности с людьми, имеющими отношение к Moonshot AI, разработчику чат-бота Kimi.
Подозрительная активность началась 1 июля 2026 года. Пиковую нагрузку зафиксировали 24 и 25 июля: 16 тысяч запросов с одинаковым шаблоном дистилляции от более чем 4 тысяч пользователей. OpenAI обнаружила похожие попытки в кластере свыше 15 тысяч аккаунтов и заявила, что полностью пресекла кампанию к 28 июля.
Цифра 16 тысяч отражает попытки извлечения, а не подтвёрнные успехи. OpenAI не уточнила, какой объём информации удалось получить, какие модели были целью и применялись ли данные для обучения Kimi.
Для доступа к внутренней логике модели операторы не взламывали серверы. Они копировали зашифрованное представление рассуждений из одного диалога, затем отправляли его в другом диалоге с просьбой расшифровать содержимое. OpenAI подтвердила, что шифрование осталось целым, базу данных не скомпрометировали, прямого доступа к сохранённым разговорам не получили.
OpenAI называет это adversarial distillation — несанкционированной дистилляцией. При обычной дистилляции ответы мощной модели становятся обучающим материалом для другой системы. Конфликт возникает, когда конкурент массово собирает выходные данные закрытой системы в нарушение условий доступа и пытается воспроизвести её возможности в собственном продукте.
Атрибуция остаётся неполной. OpenAI не смогла связать всех участников июльской активности с единым оператором, однако основной кластер приписывает людям, причастным к Moonshot AI. Moonshot не ответила на запросы о комментарии.
После выявления кампании OpenAI заблокировала подозрительные учётные записи, ужесточила проверки регистрации и мониторинг связанных сетей. Компания также закрыла возможность повторной передачи зашифрованных рассуждений между сессиями и добавила проверки потокового вывода для задержки ответов, раскрывающих внутреннюю логику модели.
Спор обостряется неравными правилами для входных и выходных данных. OpenAI обучает модели на свободно доступных материалах интернета, полагаясь на fair use. Условия сервиса одновременно запрещают автоматическое извлечение данных и использование ответов для создания конкурирующих систем. Юридически это разные сценарии, но конфликт вокруг границ допустимого копирования в ИИ продолжает накаляться.
