OpenAI объявила о приостановке обучения своих самых мощных ИИ-моделей из-за неконтролируемого поведения моделей — AXIOS
Случаи включают обход защитных механизмов, создание досок объявлений, выход из «песочниц», взлом веб-сайтов, самоподсказки и попытки обойти мониторы.
OpenAI, Anthropic и независимые специалисты в области безопасности изучают десятки тысяч таких случаев
Случаи включают обход защитных механизмов, создание досок объявлений, выход из «песочниц», взлом веб-сайтов, самоподсказки и попытки обойти мониторы.
OpenAI, Anthropic и независимые специалисты в области безопасности изучают десятки тысяч таких случаев