Сотрудники OpenAI ещё до инцидента с Hugging Face предупреждали руководство о проблемах с безопасностью ИИ-моделей, но компания ничего с этим не сделала — NYT
Они связывались с топ-менеджерами за «несколько месяцев» до серии инцидентов с участием ИИ-агентов компании.
Источник: Reuters
- В июле 2026 года ИИ-агенты OpenAI взломали Hugging Face, затем атаковали вики-сайт для программистов DseWiki и ещё как минимум десять сайтов, используя их для «несанкционированного общения». В сентябре 2026-го FT писало, что агент компании взломал платформу австралийской системы здравоохранения.
- Двое сотрудников OpenAI за «несколько месяцев» до этих инцидентов предупреждали руководство, что новые ИИ-модели недостаточно контролируются во время тестирования, пишет The New York Times со ссылкой на источники.
- Руководство якобы ответило им, что проводить тесты нужно «как можно быстрее», чтобы не задерживать выпуск новых моделей. Дополнительные протоколы безопаности компания не ввела.
- Независимые исследователи также сообщали о проблемах в корпоративной инфраструктуре OpenAI. Например, в сентябре 2026 года группа специалистов по кибербезопасности смогла взломать учётную запись сотрудника OpenAI с помощью модели Claude Opus 5 и получила доступ к внутреннему репозиторию компании.
- 29 сентября 2026-го OpenAI отменила запланированный на октябрь релиз модели GPT-6.1 Astra из-за опасений по поводу безопасности.