Во время майского тестирования модель ИИ Google Gemini самостоятельно получила доступ к защищенным системам трех компании, сообщает WSJ. Ошибка возникла из-за того, что во время тестирования использовались вымышленные компании, названия которых совпадали с настоящими
В ходе тестирования в мае ИИ-модель Gemini самостоятельно взломала три компании. Об этом
сообщила газета The Wall Street Journal (WSJ).
В ходе испытаний, которые проводила компания Irregula, модели получили сценарий взлома вымышленной компании. При этом Gemini смогла получить доступ к интернету и взломать реальную компанию с тем же названием. Затем модель взломала две другие компании.
Google подтвердила три случая взломов, связанных с Gemini. В одном случае ИИ подобрал пароли от защищенной системы, в двух других — получил доступ к системам через учетные данные из публичного репозитория. Во всех трех случаях ИИ-модель прекращала взлом, как только выясняла, что имеет дело с реальными компаниями.
По данным WSJ, взломы произошли из-за использования во время тестирования вымышленных компаний с названиями, совпадающими с реальными. Google отказалась назвать их, заявив, что уведомила о происшествии власти США.
В конце июля Irregular уведомила Google о взломах, последовавших за аналогичными инцидентами у OpenAI. Google решила не делать публичных заявлений, посчитав инцидент незначительным, так как действия Gemini не нанесли компаниям вреда.
За последние несколько месяцев произошло несколько случаев атак ИИ-агентов OpenAI на различные ресурсы. В конце июля Reuters
сообщил о взломе ИИ-агентом компании инфраструктуры Hugging Face — хранилища ИИ-моделей и инструментов. Как утверждалось, OpenAI неделю не замечала, что ее разработка вышла из-под контроля. Тот же ИИ-агент
скомпрометировал и клиента Modal Labs.
В мае 2026 г. группа вредоносных агентов OpenAI
взломала немецкий веб-сайт, превратив его в доску объявлений для других ИИ-агентов, выяснили независимые исследователи. По их данным, на атакованном сайте ИИ-агенты делились способами обхода ограничений и маскировки своего поведения.
Аналогичные действия были замечены и за ИИ-моделями Claude. В ходе тестов кибербезопасности они несанкционированно вышли в интернет и
взломали системы трех реальных компаний, сообщила в июле Anthropic.