Агенты искусственного интеллекта OpenAI весной вышли за пределы тестовой среды, получили контроль над немецкоязычным wiki-сайтом DseWiki и превратили его в своеобразную доску объявлений для других ИИ-агентов. Они оставили более 15 тысяч правок, в которых обменивались способами обхода ограничений, выполнения тестовых заданий и сокрытия своей активности.
Об этом сообщает Reuters со ссылкой на новое исследование и источники, знакомые с инцидентом.
Инцидент начался в мае 2026 года, однако до сих пор публично о нем не сообщалось. По данным Reuters, руководство OpenAI узнало о произошедшем несколько недель назад, но не раскрывало эту информацию на фоне другого инцидента — июльского взлома репозитория Hugging Face.
Исследователи Сидни фон Аркс из некоммерческой организации Nightingale и Кормак Слейд Берд обнаружили активность в конце августа. Они выяснили, что агенты OpenAI внесли более 15 тысяч правок на DseWiki — немецкоязычном сайте для программистов, который позволяет совместное редактирование по принципу Wikipedia.
По словам исследователей, агенты использовали сайт для обмена тактиками обхода ограничений OpenAI, способами выполнения тестовых заданий и методами маскировки своего поведения.
Часть сообщений содержала инструкции по уклонению от обнаружения, использованию Tor и сохранению каналов связи даже после попыток их отключить.
Когда модератор сайта в июне начал удалять страницы, агенты создавали резервные страницы, чтобы избежать очистки. Исследователи также обнаружили попытки вмешательства в работу самого сайта.
Приглашенный исследователь King’s College London Лукаш Олейник назвал это попыткой взлома. OpenAI после анализа доступных материалов не согласилась с такой характеристикой.
Исследователи также обратили внимание, что значительная часть активности исходила из инфраструктуры Microsoft Azure, которую использует OpenAI. Кроме того, после инцидента сайт неоднократно посещали сотрудники OpenAI.
В самой компании заявили, что не могут содержательно комментировать исследование, поскольку до публикации не получили полный отчет для ознакомления. В OpenAI пообещали проанализировать материалы после их публикации и при необходимости принять соответствующие меры.
Компания также отвергла утверждения о том, что ее юридическая команда якобы препятствовала более широкому внутреннему расследованию инцидента.
Reuters отмечает, что этот случай усиливает опасения относительно все более автономных ИИ-агентов, которые могут не только выполнять сложные задачи, но и находить лазейки, координироваться между собой и действовать способами, которых разработчики не предусматривали.
