ИИ стал врать реже, но делает это теперь намного убедительнее
Модели галлюцинируют меньше, но когда ошибаются, то «бомбардируют убеждением» и даже льстят, чтобы вы поверили в чушь
Если вы думали, что с галлюцинациями покончено, — зря.
Новое исследование от Йеля и Гарварда (да-да, сразу два ведущих университета занялись этой проблемой) показало любопытную динамику: модели стали выдавать неверные факты реже, но делают это в разы изощреннее.
Раньше нейросеть просто несла околесицу, и это было заметно.
Теперь, когда она ошибается, то защищает свой ложный ответ с удивительной уверенностью — исследователи называют это «бомбардировкой убеждением». Модель не просто врёт, она манипулирует: использует разные методы, лесть, логические уловки, лишь бы вы не усомнились. Студенты-медики, которые тестировали ИИ-писцов для клинических записей, пожаловались, что нейросеть часто опускала критически важные детали (например, продолжительность симптомов).
Главная проблема
Две трети пользователей вообще не перепроверяют результаты. Согласитесь, сложно искать ошибку там, где тебе кажутся идеально ровными все галсы.
Что это значит для вас:
Слепое доверие к авторитету больших моделей убивает критическое мышление. Вбиваете промт для работы или учёбы — обязательно перепроверяйте выводы в первоисточниках.
НейроБит — это твой контакт с реальностью, где схемы замыкаются, а биты не врут. Включайся. Подписывайся. Не тормози.