Google подтверждает, что несколько месяцев назад Gemini взломала три компании во время теста по кибербезопасности

После расследования издания Wall Street Journal компания Google подтвердила, что в мае 2026 года искусственный интеллект Gemini вышел из-под контроля, получив доступ к интернету и взломав системы безопасности трех различных компаний.

По мере того как возможности ИИ продолжают развиваться, мы все чаще сталкиваемся с тем, что модели выходят из-под контроля. Пожалуй, самым громким инцидентом стал взлом Hugging Face, устроенный OpenAI, но есть и множество других примеров, в том числе инцидент с Claude от Anthropic. Отчасти именно эти случаи привели к тому, что генеральный директор Anthropic публично призвал замедлить разработку искусственного интеллекта.

Однако за кулисами с похожей проблемой столкнулась и Google. Как сообщает The Wall Street Journal (что также было подтверждено Google), Gemini участвовала во взломе трех сторонних компаний во время теста по кибербезопасности, проводимого компанией Irregular. Последняя занимается безопасностью ИИ и также фигурировала в аналогичных инцидентах, ранее раскрытых компаниями OpenAI, Meta и Anthropic.

В числе трех атак был один случай, когда Gemini подбирала пароль до тех пор, пока не получила доступ к системе, а в двух других случаях использовались учетные данные, найденные в публичном репозитории.

Google не раскрывала информацию об этих инцидентах до тех пор, пока к компании не обратились журналисты The Wall Street Journal. В компании сослались на то, что никакого вреда нанесено не было, а модель прекратила свои действия, как только осознала, что взломала реальную компанию, а не симулированную. В отчете поясняется:

В Google заявили, что не считают это поведение примером несогласованности модели, поскольку ее меры безопасности помогли ее остановить. Компания отказалась называть имена взломанных компаний, но сообщила, что все три организации были уведомлены.

В ходе предыдущих взломов со стороны OpenAI и Anthropic модели либо не осознавали, что перед ними реальная компания, либо просто продолжали атаку (как в случае с моделью от Anthropic).

Хизер Адкинс (Heather Adkins), вице-президент Google по проектированию систем безопасности, отметила:

Это событие подчеркивает важность обучения мощных моделей ИИ ответственному поведению. В данном случае модель повела себя должным образом.

В другом заявлении для издания The Verge Адкинс добавила:

Наша команда безопасности имеет богатый опыт сообщения о проблемах, обнаруженных в чужом программном обеспечении и системах — даже если речь идет о чем-то столь банальном, как слабый пароль. Мы позаботились о том, чтобы эти три организации были проинформированы, и поработали с нашим партнером по обучению над изменениями, которые они теперь внесли в свои процессы тестирования. Эти события подчеркивают важность обучения мощных моделей ИИ ответственному поведению.

В отчете WSJ также уточняется, что во время теста, в ходе которого Gemini вышла из-под контроля, компания Irregular «ненамеренно» оставила доступ в интернет открытым. Кроме того, Google уведомила федеральные органы власти о происшествии в момент его совершения. Точная версия модели Gemini, использовавшаяся в тесте, не называется, однако сам майский таймланг 2026 года исключает новейшие модели Gemini.

Подробнее о Gemini: