В OpenAI рассказали об утечке 53 изображений пользователей из-за действий ИИ-агентов
Большую часть утёкших фотографий уже удалили, об остальных OpenAI договаривается с владельцами сайтов.
Источник: Reuters
- OpenAI продолжает расследовать инциденты, в которых её ИИ-агенты выходили за рамки предусмотренного сценария, пишет Reuters. Один из последних эпизодов — публикация 53 изображений пользователей ChatGPT.
- Не уточняется, были ли это фотографии реальных людей или изображения, созданные с помощью ИИ, а также когда именно и где их опубликовали. Полный масштаб утечки OpenAI пока не определила, расследование продолжается.
- Изображения попали к ИИ-агентам через данные ChatGPT, которые используются для обучения моделей. OpenAI утверждает, что перед этим обезличивает информацию: удаляет метаданные, имена и контакты. Но даже такая обработка не гарантирует полное удаление сведений, позволяющих установить личность пользователя, отмечает Reuters.
- Летом 2026 года агенты компании взломали Hugging Face, затем атаковали вики-сайт для программистов DseWiki и ещё как минимум десять сайтов, используя их для «несанкционированного общения».
- В публичном отчёте OpenAI рассказала, что в мае 2026 года агенты начали общаться между собой и обсуждать, где взять данные для прохождения теста по кибербезопасности.
- В сентябре OpenAI опубликовала регламент, по которому будет отслеживать, расследовать и публично раскрывать случаи несанкционированного поведения моделей.
- В том же месяце компания заявила, что начнёт привлекать независимых оценщиков для проверки безопасности на «более ранних» этапах разработки ИИ-моделей.