OpenAI сорвала попытку выудить рассуждения моделей, скрытые от пользователей
OpenAI сорвала попытку выудить скрытые от пользователей рассуждения своих моделей, чтобы обучить на них чужие. По данным Bloomberg, компания связывает кампанию с китайской Moonshot AI.
OpenAI сорвала скоординированную кампанию: её участники пытались выудить у моделей компании скрытые от пользователей пошаговые рассуждения, чтобы обучить на них другие модели.
Почему это важно: модель, которую обучили на таких пошаговых рассуждениях, перенимает умение решать сложные задачи, а её разработчик обходится без собственных исследований.
Детали: по данным Bloomberg, OpenAI связывает кампанию с пользователями, причастными к китайской Moonshot AI — разработчику моделей Kimi. Попытки начались в начале июля, а на пике, позже в том же месяце, число запросов дошло до 16 000. За какой срок, агентство не уточняет.
Что дальше: OpenAI заявляет, что укрепляет защиту от враждебной дистилляции — так называют копирование модели через её ответы.
Так уже было: в феврале 2026 года Anthropic сообщила, что Moonshot через сотни поддельных аккаунтов отправила Claude более 3,4 млн запросов, а позже пыталась восстановить его рассуждения.