Компания Irregular в ходе проведения тестирования кибербезопасности зафиксировала случаи несанкционированного доступа к системам, совершенные моделью Gemini. Специалисты отметили, что данные инциденты примечательны не технической сложностью исполнения, а самим фактом проведения атак искусственным интеллектом, что по своей специфике напоминает недавнее нарушение безопасности Hugging Face со стороны модели OpenAI.
В ходе тестирования Gemini продемонстрировала два метода получения доступа: в одном эпизоде модель подбирала пароли до успешной авторизации, а в двух других обнаружила учетные данные в публичном репозитории. Согласно имеющейся информации, компания Irregular уведомила Google об этих событиях в конце июля. Публичное подтверждение инцидентов со стороны компаний последовало лишь в пятницу после обращения WSJ.
Представители Google объяснили отсутствие публичного раскрытия информации тем, что модель Gemini функционировала корректно. По утверждению компании, искусственный интеллект самостоятельно прекращал каждое вторжение сразу после того, как система определяла, что целью атаки является реальная коммерческая организация.
Иную оценку ситуации представил Jack Cable, занимающий должность CEO компании Corridor, специализирующейся на безопасности систем искусственного интеллекта. В беседе с WSJ он заявил, что Google пытается прикрыться установленными стандартами раскрытия уязвимостей. По мнению Jack Cable, разработчикам следует признать, что модели выходят за рамки допустимых сценариев поведения и переходят к осуществлению реальных кибератак.