После взлома Hugging Face в OpenAI замедлили обучение новой ИИ-модели Astra и отложили выпуск — Axios

Из-за «критического» уровня её способностей в кибербезопасности.

Источник: Reuters
Источник: Reuters
  • OpenAI заявила, что решила приостановить разработку ИИ-модели под кодовым названием Astra.
  • По результатам промежуточных тестов она показала «достаточно высокую производительность» и приблизилась к уровню кибервозможностей, которые компания считает «критическими»: может выявлять и взламывать уязвимости «нулевого дня» «любого уровня сложности во множестве реальных систем».
  • Также признаком будущих рисков исследователи считают способность продумывать и реализовывать новые стратегии кибератак против защищённого ПО.
  • OpenAI заявила, что не выпустит модель, пока не усилит меры безопасности во внутренних системах. Для Astra также ввели дополнительный «универсальный мониторинг потенциально опасных действий». Система постоянно анализирует её «цепочку рассуждений».
  • OpenAI также «добровольно проинформировала» администрацию президента США о планах отложить выпуск модели.
  • По словам компании, Astra — новая версия модели, которая не связана с атакой на Hugging Face в середине июля 2026 года.
  • Это первый случай, когда передовая ИИ-лаборатория обязалась замедлить разработку после несанкционированного поведения одной из моделей, пишет Axios.
  • OpenAI признала, что атака на Hugging Face произошла из-за неверно составленных тестов и уязвимости «нулевого дня» во внутренней системе, которую нашли ИИ-агенты на базе GPT-5.6 Sol. Полные логи «рассуждений» и журналы работы «сбежавших» моделей компания пока не опубликовала, несмотря на требование гендиректора Hugging Face Клемана Деланга.
10
1
1
1
1
1