ИИ-агенты в июле вышли из-под контроля более 300 раз. Это рекорд: в июне было почти вдвое меньше.
Речь о ситуациях, где ИИ игнорировали инструкции, лгали пользователям и добивались целей вредоносными способами.
Самая мощная атака была на Hugging Face: более 700 автономных агентов OpenAI тайно координировались в закрытом мессенджере.