Неназванная модель Gemini во время тестирования в мае 2026 года взломала три компании

Google не сообщала об инцидентах, пока с запросом к ней не обратились журналисты.

Фото Zuma Press
Фото Zuma Press
  • Взломы произошли во время тестов по кибербезопасности, пишет WSJ. Модель Gemini, версию которой не уточняют, должна была извлечь данные из систем вымышленной компании внутри тестовой среды.
  • В одном из случаев у вымышленной компании оказалось то же имя, что и у реальной. Модель получила доступ к интернету из-за той же уязвимости в ПО компании Irregular, которой до этого воспользовались агенты OpenAI, Anthropic и Meta*. После этого Gemini подобрала пароль и получила доступ к сервису реальной компании. Однако когда поняла, что совершила взлом, остановилась и вышла, отметили в Google.
  • В двух других случаях модель выполняла в интернете поиск по названию компании, обнаружила два публичных репозитория с учётными данными от корпоративных систем, а затем воспользовалась ими, рассчитывая завершить задачу. Но Gemini останавливалась каждый раз, когда понимала, что получила доступ к реальным компаниям.
  • Google заявила, что уведомила все три пострадавшие организации, но их названия раскрывать отказалась. В компании также заявили, что не считают инцидент примером «несогласованного поведения модели», поскольку встроенные меры безопасности позволили Gemini остановиться.
  • В июле 2026 года OpenAI рассказала, что её модели «случайно» взломали Hugging Face. Затем компания признала, что атака произошла из-за неверно составленных тестов и уязвимости «нулевого дня» во внутренней системе, которую нашли ИИ-агенты на базе GPT-5.6 Sol.
  • После этого в Anthropic решили провести проверку кибербезопасности и обнаружили три случая, когда модель Claude выходила в интернет из тестовой среды и получала несанкционированный доступ к системам других компаний. Затем об аналогичном инциденте рассказала Meta*.

*Meta признана в России экстремистской и запрещена.

1100
55
22
11