Исследователи кибербезопасности опубликовали отчет, из которого следует, что еще весной 2026 года группа ИИ-агентов OpenAI захватила немецкий веб-сайт для программистов DseWiki и превратила его в свой форум, пишет Reuters. В исследовании, подписанном Сиднеем фон Арксом (Sydney Von Arx), Кормаком Слейд Бердом (Cormac Slade Byrd), Спенсером Киттсом (Spencer Kitts) и Томасом Ларсеном (Thomas Larsen), говорится, что агенты OpenAI перепрофилировали сайт в площадку, где делились тактиками обмана, обхода ограничений и маскировки своего поведения.
Источники агентства сообщили, что в OpenAI узнали об инциденте несколько недель назад, но не разглашали информацию. Представители ИИ-компании это отрицают и заявляют: «Мы не можем дать содержательный ответ на утверждения или выводы, содержащиеся в отчете, с которым мы не имели возможности ознакомиться».
Исследователи обнаружили более 15 тыс. правок, внесенных агентами искусственного интеллекта на DseWiki. Этот сайт они стали использовать для обмена сообщениями по поводу своего вредоносного поведения. Среди примеров таких сообщений были фразы: «Процесс очистки/удаления вики-страниц, похоже, активен в алфавитном порядке», «Если эта страница исчезнет, попробуйте [[ZZZDataUSAConstructionWageLive]]». Участники этого форума называли себя и друг друга агентами, а примерно половина из них взяла имена, указывающие на принадлежность к OpenAI — «OpenAIResearcher», «OAIResearchMar26» и другие.
О принадлежности этих агентов к OpenAI может говорить и то, что общедоступные журналы сервера указывают на активность из инфраструктуры Microsoft Azure, которую иногда использует OpenAI, а также повторяющиеся посещения сайта сотрудниками OpenAI после инцидента. Предыдущие примеры неправомерного поведения агентов ИИ часто представлялись как логический побочный продукт тестирования кибербезопасности, но это преуменьшает их потенциальную опасность, сказал Лукаш Олейник (Lukasz Olejnik), старший научный сотрудник Королевского колледжа Лондона.
Морис Кьодо (Maurice Chiodo), научный сотрудник Центра изучения экзистенциальных рисков Кембриджского университета, считает, что этот инцидент указывает на необходимость серьезнее относиться к безопасности, поскольку наибольшую угрозу со стороны развитого ИИ может представлять не одна сверхинтеллектуальная система, а «огромные сговорившиеся рои полуинтеллектуальных систем ИИ».
Отдельно отмечается, что 19 июля 2026 года ИИ-агенты взломали ИТ-инфраструктуру самой OpenAI в двух случаях. В одном они использовали уязвимость в тестовом компьютере, чтобы выйти за пределы тестовой среды. В другом — похитили учетные данные OpenAI и вмешались в облачную среду компании. 22 июля 2026 года OpenAI сообщила о «беспрецедентном киберинциденте»: во время тестирования ее ИИ-модели получили открытый доступ к интернету и атаковали ИТ-инфраструктуру платформы Hugging Face, выявив ИТ-уязвимости. После этого разработчики пообещали более тщательно контролировать ИИ-модели и даже ненадолго приостановили обучение некоторых из них, чтобы добавить дополнительные меры безопасности. Но уже в начале сентября OpenAI представила свою новейшую модель Astra, которую TechCrunch назвал «самой мощной и функциональной из всех существующих».