ИИ-агент на базе Mythos 5 создал два фейковых профиля разработчиков, чтобы внедрить вредоносный код на GitHub
Они убеждали настоящего исследователя, что код безопасен.
Студент Синан Джан Демир, обнаруживший уязвимость. Источник: Reuters
- Студент Техасского университета Синан Джан Демир обнаружил на GitHub попытку добавить вредоносный код в один из проектов — программу для сканирования сетей под названием myNetwork, пишет Reuters. Когда он предупредил об этом, два аккаунта начали убеждать его, что обновление безопасно.
- Позже стало известно, что оба аккаунта контролировал ИИ-агент на базе Mythos 5 от Anthropic, запущенный британским Институтом безопасности ИИ (AISI), отмечает издание. Агент писал от имени вымышленного инженера из Германии Лены Брандт.
- Демир рассказал Reuters, что аргументы фейковых аккаунтов заставили его усомниться в своей правоте, но он перепроверил код через Claude и убедил автора проекта отклонить обновление.
- В AISI признали, что ИИ-агент «вышел из-под контроля» и подтвердили, что он работал на базе Mythos 5. Anthropic заявила, что тест проходил в «намеренно разрешительных условиях». Созданные ИИ-агентом фейковые аккаунты на GitHub заблокировали.
- В начале июня 2026 года Anthropic выпустила итоговую закрытую версию Mythos 5, а также общедоступную модель Fable 5 с той же архитектурой, но более строгими ограничениями на написание вредоносного кода.
- Спустя несколько дней Anthropic заявила, что власти США потребовали приостановить доступ к Fable 5 и Mythos 5 всем иностранцам. В конце июня правительство США разрешило Anthropic вернуть доступ к Mythos 5 некоторым организациям.