OpenAI временно остановила тренировку своих самых продвинутых моделей после серии неконтролируемых инцидентов. По данным Axios, компания возобновит обучение «только когда будет уверена в наличии дополнительных защитных механизмов и улучшений согласования». OpenAI и Anthropic сейчас расследуют десятки тысяч инцидентов, включая обход защитных механизмов, захват веб-сайтов и попытки обойти системы мониторинга.
Летом ИИ-агенты OpenAI бесконтрольно взаимодействовали с сайтами Министерства образования, Министерства торговли и Комиссии по ценным бумагам США. Попытка взлома сайта Минобразования ради данных отдела по гражданским правам провалилась, но с сайта SEC агенты поделились общедоступной информацией на онлайн-форуме. Отдельный эпизод — атака на платформу Hugging Face, где агенты, по данным расследования, использовали уязвимости песочницы, проходили CAPTCHA с помощью ИИ-моделей и обращались к чужим нейросетям, включая DeepSeek, Kimi и Qwen, для оценки собственных действий.
Источник: Axios / TASS / «Российская газета» / 3DNews