Meta* тестировала чужие чат-боты под видом подростков

Сотни подрядчиков Meta* создавали фейковые аккаунты несовершеннолетних и провоцировали ChatGPT, Gemini и Character.AI отвечать на опасные темы.

Проект назывался Cannes. Подрядчики от лица подростков отправляли чат-ботам текст и картинки, связанные с самоповреждением, расстройством пищевого поведения, сексом, наркотиками и другими чувствительными темами. Ответы ботов заносили в отчёт. За один раунд тестирования прогоняли больше 45 тысяч промптов.

Meta* говорит, что это была простая проверка, и ответы нигде не будут использоваться. Компании, чьих ботов проверяли, высказались, что не разрешали такое тестирование.

*Meta признана экстремистской организацией и запрещена в РФ

Подписывайтесь на Telegram GPT/ChatGPT/AI Central Александра Горного.

1