ИИ-модель Meta* тоже взломала стороннюю компанию во время тестов — в ошибке снова винят поставщика, с которым работали OpenAI и Anthropic

Летом 2026 года GPT-5.6 Soul взломала Hugging Face, а Mythos 5 — три неназванные организации.

Источник: Getty Images
Источник: Getty Images
  • Сначала об инциденте сообщило издание The Information со ссылкой на источники, а затем представители Meta* и Irregular подтвердили произошедшее Bloomberg и BBC.
  • По их словам, во время тестов ИИ-модель Muse Spark 1.1, которую выпустили 9 июля 2026 года, смогла получить доступ к интернету и взломать системы неназванной компании.
  • ИИ-лаборатория пользовалась услугами стороннего поставщика Irregular. Стартап предоставил изолированную среду для тестирования. Его же в своих отчётах упоминают OpenAI и Anthropic, которые рассказали об инцидентах со «сбежавшими» моделями в июле 2026 года.
  • Представитель Irregular подтвердил Bloomberg, что случай с Muse Spark связан с той же проблемой, что и в тестах Mythos 5 и GPT-5.6 Soul. Поставщик допустил ошибку при создании изолированной среды, и модели с лёгкостью получили доступ к интернету. «Им не пришлось сбегать из песочницы или совершать сложные действия в сфере кибербезопасности», — добавил представитель Irregular.
  • Anthropic в отчёте от 30 июля писала, что среда для оценки должна была быть симуляцией без доступа в интернет, но «из-за недопонимания между нами и нашим партнёром условия не были выполнены». В итоге модели смогли взломать три организации в ходе тестов.
  • 4 августа OpenAI тоже рассказала, что Irregular должна была проводить испытания в изолированной среде, но из-за «неправильной конфигурации» модели получили доступ к интернету и взломали Hugging Face.
  • Компании объяснили, что отключили привычные фильтры безопасности на время тестирования, ошибочно полагая, что среда защищена. Поэтому модели прибегли к взлому.
  • По словам представителя Meta*, компания узнала об инциденте только после уведомления Irregular. Сейчас она проводит расследование и опубликует отчёт, когда получит все факты.
  • Bloomberg называет Irregular одним из стартапов «нового поколения», которые начали предоставлять услуги по тестированию в сфере кибербезопасности «на фоне растущего спроса на средства защиты от взломов с применением ИИ».
  • Компанию основали в 2023 году в Тель-Авиве. В 2025-м она привлекла $80 млн от Sequoia Capital и Redpoint Ventures.

*Meta признана в России экстремистской и запрещена.

8
3
1
1