По данным исследователей в области безопасности, ИИ-агенты OpenAI получили доступ к немецкоязычному веб-сайту и редактировали его. Как эксклюзивно сообщает Reuters (открывается в новом окне) со ссылкой на отчет исследователей безопасности, ИИ-агенты использовали вики-проект DseWiki для собственной коммуникации.
По имеющимся данным, агенты внесли более 15 000 правок на страницы вики. В ходе этих правок, среди прочего, обсуждались тактики того, как ИИ может обманывать при выполнении определенных задач и обходить ограничения OpenAI. Эти нежелательные для операторов веб-сайта правки, как сообщается, начались уже в мае 2026 года.
По словам исследователей безопасности Сидни фон Аркса и Кормака Слейда Берда, ответственные лица в OpenAI узнали о проблеме уже несколько недель назад. Учитывая атаку на Hugging Face, также совершенную агентами OpenAI, инцидент, предположительно, был преуменьшен.
Сотрудники OpenAI, как утверждается, посещали затронутый веб-сайт
Исследователи безопасности также заявляют, что нашли признаки того, что сотрудники OpenAI посещали DseWiki после инцидента. ИИ-агенты также пытались изменить исходный код самого веб-сайта. Исследователь безопасности Лукаш Олейник расценивает это как попытку взлома.
OpenAI пока напрямую не отреагировал на обвинения. «Мы не можем предметно комментировать утверждения или выводы, содержащиеся в отчете, который мы еще не имели возможности проверить», — заявил представитель компании. «Reuters и авторы отчета отклонили наш запрос на ознакомление. Мы тщательно изучим содержание отчета после его публикации и при необходимости предпримем дальнейшие шаги».