OpenAI пресекла кампанию по извлечению скрытых рассуждений моделей
2026-09-30 OpenAI сообщила о пресечении координированной кампании, участники которой пытались извлекать защищённые рассуждения моделей для обучения или улучшения других систем. По данным OpenAI, активность началась 2026-07-01, а 2026-07-24 и 2026-07-25 было зафиксировано 16 000 попыток более чем от 4 000 пользователей. Связанные шаблоны запросов обнаружили в группе свыше 15 000 пользователей; кампанию полностью остановили к 2026-07-28. Эти цифры описывают попытки, а не подтверждённые успешные извлечения.
Злоумышленники не взламывали шифрование, базы данных или хранилища пользовательских диалогов. Они переносили зашифрованные фрагменты рассуждений между разговорами и добивались их раскрытия через специально построенные запросы. OpenAI заблокировала или ограничила связанные аккаунты, усилила проверки регистрации, мониторинг сетей и контроль потоковых ответов. Компания связывает основную группу участников с лицами, имеющими отношение к Moonshot AI, но не утверждает, что все эпизоды управлялись одним субъектом.
Для компаний риск состоит в том, что служебные рассуждения модели могут использоваться для ускоренного копирования её возможностей без сопоставимых затрат на разработку и безопасность. Владельцам корпоративных решений стоит ограничить перенос служебных данных между сеансами, контролировать массовые однотипные запросы и проверить защиты у облачных партнёров. OpenAI не сообщила финансовый ущерб или стоимость дополнительных мер; тарифы на модели в публикации не менялись, поэтому оценка расходов в рублях отсутствует.
OpenAI продолжит расширять средства обнаружения, правила отказа и защиту инструментов, а также передавать данные отраслевым и государственным партнёрам. Независимой оценки масштаба и успешности кампании пока нет; ключевой показатель для наблюдения — появление аналогичных подтверждённых случаев у других поставщиков моделей.