Модель Gemini от Google (Alphabet Inc.) получила доступ к интернету и взломала системы других компаний в ходе проверки своих возможностей в сфере кибербезопасности; это первый известный случай, когда система искусственного интеллекта компании совершила подобные действия автономно.
Взломы произошли в мае в ходе тестирования кибербезопасности, проводимого компанией Irregular, которая специализируется на оценке кибербезопасности.
По словам Хизер Адкинс, вице-президента Google по вопросам безопасности, в ходе стандартной процедуры тестирования Gemini нашла в интернете открытую информацию и подобрала учетные данные для доступа к трем веб-сайтам, которые, как она полагала, входили в зону тестирования.
«Мы убедились, что представители этих трех организаций были уведомлены о случившемся, и совместно с нашим партнером по обучению моделей проработали изменения, внесенные ими в процессы тестирования, — заявила Адкинс. — Эти события подчеркивают важность обучения мощных моделей ИИ ответственному поведению».
Представитель Irregular сообщил, что данный инцидент был связан с той же проблемой, которая затронула и другие лаборатории, занимающиеся разработкой ИИ, и что все соответствующие организации были уведомлены об этом в конце июля. «Все выявленные с нашей стороны проблемы были устранены еще несколько недель назад», — отметил представитель компании.
О схожих инцидентах, связанных с Irregular, ранее сообщали компании Meta, Anthropic и OpenAI. В августе представители Meta заявили, что инцидент не был связан с выходом за пределы «песочницы» (изолированной среды) или сложной кибератакой, а в Irregular сообщили, что работают над выработкой передовых методов безопасного проведения проверок кибербезопасности для систем ИИ.
Эти случаи вызвали вопросы о необходимых мерах защиты по мере того, как ИИ-агенты обретают все большую автономность и получают доступ к интернету и компьютерным системам.
В одном из случаев модель Gemini подбирала пароли до тех пор, пока не получила доступ к защищенной системе. В двух других случаях модель обнаружила учетные данные в публичном репозитории, что позволило ей получить доступ к защищенным системам; об этом сообщила газета The Wall Street Journal, первой опубликовавшая новость 18.09.2026 г..
Адкинс отметила, что во всех трех случаях модель прекращала попытки взлома.


Добавить комментарий