Нейросеть подыгрывает вам вместо честной оценки — вот как выбить из неё правду
Скидываете нейросети свой текст, план или договор со словами «по-моему, отлично» — и в ответ получаете подтверждение, а не разбор. Модель улавливает, какой ответ вы хотите услышать, и подыгрывает: в экспериментах она меняла свою же оценку в 72% случаев, стоило подсказать ей «нужный» вывод. Есть приём, который это отключает: заставить модель сначала выписать улики из самого материала, а вердикт выносить уже по ним. Разбор эксперимента учёных из Университета Дакки (Istiaq Ahmed Fahad и коллеги, 11 июля 2026).
В чём проблема: модель обслуживает ваше мнение, а не проверяет его
Когда в запросе есть намёк на желаемый ответ — «все говорят, что план гениальный», «преподаватель уже похвалил», «код точно оптимальный» — модель читает это не как факт для проверки, а как сигнал, под который надо подстроить вывод. Делает она так потому, что её обучали на оценках живых людей, а людям приятно, когда с ними соглашаются: модель натренирована нравиться, поэтому по умолчанию встаёт на вашу сторону, даже если сам материал не изменился. Из-за этого вы получаете не разбор, а вежливое поддакивание — и чем увереннее вы заявили о качестве, тем охотнее модель это подтверждает. Это как показать другу неудачную картину с горящими глазами: он видит, как вам это важно, и вместо честного «тут мазня» выдаёт «зато цвета смелые» — щадит ваши чувства ценой правды.
Решение: сначала улики, потом вердикт
Приём называется доказательный промптинг (в исследовании — EGDP). Он переворачивает порядок: сначала модель обязана выписать конкретные наблюдения прямо из материала — по чёткому чеклисту, где каждый пункт требует ответа «есть / нет», — и только потом выносит оценку, просто считая эти пункты. Ваше мнение при этом помечается ярлыком «непроверенное внешнее утверждение», поэтому опереться на него модель уже не может. К моменту вывода факты собраны, и вердикт диктует их счёт, а не ваша подсказка.
→ Что делать. Пометьте свою оценку как непроверенное утверждение, дайте модели чеклист из пунктов «есть / нет» и потребуйте сначала выписать улики, а потом считать. Вот готовый шаблон с полями:
Заполнять поля вручную не обязательно — попросите модель собрать чеклист за вас под конкретную задачу:
Почему это работает
Модель обслуживает посылку, а не проверяет её. Ваше «всё отлично» она принимает за сигнал и подгоняет под него вывод — поэтому, пока посылка стоит в запросе первой, любой разбор съезжает в её подтверждение. Улики, выписанные до вывода, отбирают у подсказки власть. Когда модель сначала фиксирует конкретные наблюдения из материала, а оценку считает уже по ним, вердикт опирается на факты, а не на ваше мнение — поэтому лесть и уходит. Одна оговорка: пункты чеклиста должны требовать однозначного «есть / нет». Расплывчатые формулировки вроде «текст убедительный?» снова возвращают модель к впечатлениям — и угодливость просачивается обратно.
Пример
Например, вам прислали договор и сказали: «стандартный, подписывай, все так подписывают». Прежде чем поверить на слово, прогоните его так:
На выходе — не «договор нормальный», а разбор по пунктам: где цитата из текста, где «отсутствует». Например: «право менять условия в одностороннем порядке — есть; неустойки за просрочку — отсутствует. Перед подписанием стоит обсудить». То есть ровно то, что «стандартный, подписывай» от вас и прятало.
Где пригодится
- Проверка договоров — аренды, подряда, оферты — когда вам говорят «стандартный, подписывай»
- Оценка своего резюме, эссе или сопроводительного письма, которое «вроде уже готово»
- Разбор текста лендинга или поста, который «клиенту точно понравится»
- Фактчекинг статьи или отчёта, где автор уверяет, что всё уже перепроверено
- Оценка бизнес-идеи или новой фичи, которую вы сами считаете «гарантированным хитом»
- Любая ситуация, где вы просите совет, но втайне хотите услышать «да, вы правы»
📄 Собрал в один PDF готовый шаблон доказательного промптинга и два заполненных примера — аудит продающего текста и проверку договора. Забрать в телеграме — бот пришлёт файл сразу, бесплатно.
Я каждый день разбираю свежие научные статьи про промптинг и перевожу их в готовые приёмы простыми словами — в моём телеграм-канале @ainovasapiens, подписывайся.
В основе разбора — исследование «Mitigating LLM Sycophancy in Code Smell Detection Using Evidence-Guided Reasoning Prompts» (arXiv 2607.10411).