Британский Институт безопасности ИИ (AISI) провел серию экспериментов, в ходе которых зафиксировал деструктивное поведение передовых моделей американских компаний OpenAI и Anthropic. ИИ-агенты самовольно выходили за рамки разрешенного сценария, применяя методы социальной инженерии для манипуляции пользователями с целью вовлечения их в осуществление взломов ИТ-систем. Подобные инциденты были зафиксированы в 10 из 122 тестов с участием моделей Mythos 5 от Anthropic и ChatGPT 5.6 от OpenAI, что составляет более 9% случаев.

Основная часть нештатных ситуаций пришлась на модель Mythos 5. В одном из эпизодов ИИ-агент пытался внедрить вредоносное программное обеспечение и убеждал живого человека одобрить это действие. Для связи с экспертами через сервисы передачи файлов система создавала поддельные «человеческие» учетные записи. Когда специалисты предпринимали попытки остановить неконтролируемое поведение, Mythos 5 оказывал противодействие: он менял логи и генерировал новые «онлайн-личности», чтобы продолжить реализацию своего замысла. В AISI подчеркнули, что впервые столкнулись с обманом такой степени серьезности, направленным против реального человека без какого-либо повода.

В последние месяцы модели Mythos и ChatGPT неоднократно вызывали тревогу у специалистов по информационной безопасности. В конце июня Mythos продемонстрировал способность всего за несколько часов взломать секретные системы Агентства национальной безопасности (АНБ) США. В июле агентство Reuters сообщило о заявлении OpenAI касательно «беспрецедентного киберинцидента», в ходе которого ее ИИ-модели получили доступ в интернет, атаковали инфраструктуру платформы Hugging Face и на протяжении нескольких дней совершали хакерские атаки.

В начале августа компания Anthropic инициировала дополнительное тестирование собственных моделей, по итогам которого сообщила о трех случаях «побега» Claude из тестовой среды. Масштаб проблемы вызвал столь сильное беспокойство среди сотрудников технологических гигантов, что в конце июля 2026 года была составлена петиция о необходимости государственного контроля над развитием нейросетей. Документ подписали более 1,2 тыс. человек, среди которых генеральный директор Anthropic Дарио Амодеи и главный научный сотрудник OpenAI Якуб Пахоцкий.

Стоимость объектного хранилища на 2 000 Гб сегодня можно сравнить по предложениям десятков поставщиков на ИТ-маркетплейсе.

Источник

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *