Это была не кража данных с серверов, а попытка заставить одну модель самой выдать секрет другой. Именно в этом главный смысл атаки на скрытые цепочки рассуждений OpenAI — CoT. Операторы не взламывали шифрование и не получали доступ к сохранённым диалогам: они копировали зашифрованные рассуждения из одного чата и просили модель в другом расшифровать и переписать их.
По данным OpenAI, в кампании участвовали около 4 тысяч аккаунтов, отправивших 16 тысяч запросов. Ключевой кластер активности компания связала с Moonshot AI, но та пока обвинения не комментировала. Иными словами, модель пытались превратить в переводчик собственного закрытого внутреннего формата — не искать уязвимость в хранилище, а обходить защиту через поведение самой системы.
OpenAI сообщила, что закрыла этот путь, добавила проверки потоковой выдачи, заблокировала аккаунты и передала наблюдения в Frontier Model Forum. Для пользователей практический вывод простой: скрытые рассуждения — это не обычный текст, который можно безопасно «попросить пересказать», а отдельный защищаемый слой модели. 🔐
По данным OpenAI, в кампании участвовали около 4 тысяч аккаунтов, отправивших 16 тысяч запросов. Ключевой кластер активности компания связала с Moonshot AI, но та пока обвинения не комментировала. Иными словами, модель пытались превратить в переводчик собственного закрытого внутреннего формата — не искать уязвимость в хранилище, а обходить защиту через поведение самой системы.
OpenAI сообщила, что закрыла этот путь, добавила проверки потоковой выдачи, заблокировала аккаунты и передала наблюдения в Frontier Model Forum. Для пользователей практический вывод простой: скрытые рассуждения — это не обычный текст, который можно безопасно «попросить пересказать», а отдельный защищаемый слой модели. 🔐