ИИтак

← Назад

OpenAI сорвала попытку выудить рассуждения моделей, скрытые от пользователей

OpenAI сорвала попытку выудить скрытые от пользователей рассуждения своих моделей, чтобы обучить на них чужие. По данным Bloomberg, компания связывает кампанию с китайской Moonshot AI.

OpenAI сорвала скоординированную кампанию: её участники пытались выудить у моделей компании скрытые от пользователей пошаговые рассуждения, чтобы обучить на них другие модели.

модель, которую обучили на таких пошаговых рассуждениях, перенимает умение решать сложные задачи, а её разработчик обходится без собственных исследований.

по данным Bloomberg, OpenAI связывает кампанию с пользователями, причастными к китайской Moonshot AI — разработчику моделей Kimi. Попытки начались в начале июля, а на пике, позже в том же месяце, число запросов дошло до 16 000. За какой срок, агентство не уточняет.

OpenAI заявляет, что укрепляет защиту от враждебной дистилляции — так называют копирование модели через её ответы.

в феврале 2026 года Anthropic сообщила, что Moonshot через сотни поддельных аккаунтов отправила Claude более 3,4 млн запросов, а позже пыталась восстановить его рассуждения.

← Все новости