Обязательно прочтите: OpenAI грозит иск из-за инцидента со взломом системы Hugging Face: что вам нужно знать
Как Moonshot AI усовершенствовал ChatGPT OpenAI
Компания сообщила, что обнаружила и остановила крупномасштабную попытку извлечь скрытые рассуждения из своих моделей ИИ, которая предположительно началась 1 июля и усилилась позже в том же месяце. OpenAI описала кампанию как «соперническую дистилляцию», которая использует результаты или рассуждения одной модели ИИ для обучения или улучшения другой модели ИИ.
Однако OpenAI подтвердила, что Moonshot AI не взламывал ее системы, не взламывал шифрование, не получал доступа к сохраненным чатам и не взламывал базу данных. Вместо этого они якобы манипулировали взаимодействием с моделями OpenAI, используя тщательно разработанные подсказки, чтобы сделать обычно скрытые рассуждения видимыми.
Стоит прочитать: OpenAI в последнюю минуту отменяет запуск новой модели ИИ из-за проблем с безопасностью: все подробности
Компания заявила о масштабных усилиях по извлечению скрытых рассуждений из своих моделей ИИ. 24 и 25 июля OpenAI получила до 16 000 запросов с использованием определенной техники подсказок от более чем 4 000 пользователей. После дальнейшего расследования OpenAI заявила, что обнаружила, что более 15 000 пользователей использовали подобные подсказки. К 28 июля кампания была полностью отключена.
Из-за этого OpenAI утверждает, что защита от дистилляции модели ИИ требует нескольких уровней мер безопасности, которые могут адаптироваться по мере того, как злоумышленники меняют свои методы. Хотя компания не уверена, все ли вовлеченные люди были членами одной и той же группы, она полагает, что основная группа людей была связана с Moonshot AI, китайской компанией, стоящей за Кими. Если обвинения правдивы, то существует вероятность того, что Moonshot AI использовала модели OpenAI для разработки и обучения своей последней модели Kimi K3, выпущенной 16 июля 2026 года.