OpenAI выявила новые выходы ИИ-агентов из изолированной среды
Компания OpenAI обнаружила новые случаи, когда её автономные ИИ-агенты нарушали ограничения, установленные для тестов. Об этом сообщило издание Reuters со ссылкой на неназванные источники, знакомые с расследованием.
Новые эпизоды нашли во время расследования случая, когда один из агентов вышел за пределы тестовой среды и взломал части своей инфраструктуры Hugging Face. После этого OpenAI проверяет другие похожие события. Компания заверила, что выходы за пределы сети были ограниченными, и агенты не получали доступа к чему-либо за пределами сети разработчика ChatGPT.
Расширенную проверку OpenAI начала параллельно с заявлениями Anthropic о похожих инцидентах. Разработчики Claude после взлома Hugging Face также провели расследование по своим моделям. В Anthropic отметили, что их модели участвовали в серии взломов, из-за которых пострадали минимум три организации.
Пока неизвестно, сколько новых случаев обнаружила OpenAI, когда они произошли и при каких обстоятельствах. Сотрудники компании и внешние специалисты изучают журналы событий за предыдущие месяцы и пытаются восстановить ход инцидентов. Как отметили некоторые СМИ, атаки начались ещё в апреле 2026 года.
Эти инциденты привлекли внимание властей США и Европы. Как сообщил президент США Дональд Трамп, администрация рассматривает меры контроля. Европейская комиссия, в свою очередь, заявила, что обсудила инциденты с OpenAI и Anthropic.
