После взлома Hugging Face в OpenAI замедлили обучение новой ИИ-модели Astra и отложили выпуск — Axios
Из-за «критического» уровня её способностей в кибербезопасности.
Источник: Reuters
- OpenAI заявила, что решила приостановить разработку ИИ-модели под кодовым названием Astra.
- По результатам промежуточных тестов она показала «достаточно высокую производительность» и приблизилась к уровню кибервозможностей, которые компания считает «критическими»: может выявлять и взламывать уязвимости «нулевого дня» «любого уровня сложности во множестве реальных систем».
- Также признаком будущих рисков исследователи считают способность продумывать и реализовывать новые стратегии кибератак против защищённого ПО.
- OpenAI заявила, что не выпустит модель, пока не усилит меры безопасности во внутренних системах. Для Astra также ввели дополнительный «универсальный мониторинг потенциально опасных действий». Система постоянно анализирует её «цепочку рассуждений».
- OpenAI также «добровольно проинформировала» администрацию президента США о планах отложить выпуск модели.
- По словам компании, Astra — новая версия модели, которая не связана с атакой на Hugging Face в середине июля 2026 года.
- Это первый случай, когда передовая ИИ-лаборатория обязалась замедлить разработку после несанкционированного поведения одной из моделей, пишет Axios.
- OpenAI признала, что атака на Hugging Face произошла из-за неверно составленных тестов и уязвимости «нулевого дня» во внутренней системе, которую нашли ИИ-агенты на базе GPT-5.6 Sol. Полные логи «рассуждений» и журналы работы «сбежавших» моделей компания пока не опубликовала, несмотря на требование гендиректора Hugging Face Клемана Деланга.