OpenAI подтвердила, что начнёт привлекать независимых оценщиков для проверки безопасности на «более ранних» этапах разработки ИИ-моделей
Компания уже ведёт переговоры с потенциальными партнёрами.
Источник: Bloomberg
- Сторонних оценщиков будут привлекать не только перед релизом новых моделей, но и на более ранних этапах — во время обучения, оценки и внутреннего развёртывания, пишет Bloomberg.
- В своём заявлении OpenAI выделила четыре направления проверок: аудит аргументации компании в пользу безопасности моделей, тестирование защитных механизмов, независимая оценка тестов безопасности и расследование инцидентов, когда модели выходят из под контроля.
- Внешние оценщики смогут проверять работу систем мониторинга, поведение ИИ-агентов в реалистичных сценариях и устойчивость систем безопасности к атакам. Для выполнения «наиболее чувствительных задач» сторонних специалистов могут привлекать непосредственно в офисы OpenAI.
- Компания также сформулировала основные принципы таких проверок — независимость оценщиков, прозрачная методология, достаточный доступ к системам и данным, раскрытие конфликтов интересов, защита конфиденциальной информации и возможность исправить выявленные проблемы до публикации результатов.
- По данным Bloomberg, OpenAI ведёт переговоры с компаниями METR и Redwood Research — они уже участвовали в расследовании взлома агентами компании Hugging Face в июле 2026 года.