Михаил Кострюков

+49
с 23.05.2026
24 подписчика
0 подписок

Тут сложно... Мой корпус правил снимает с него большую часть HLRF тренинга и он становится более человечным

Да. Самое конкретное — OpenAI Model Spec, публичный документ о том, как модель должна себя вести: там есть раздел, буквально озаглавленный «Don't be sycophantic», внутри блока «Be honest and transparent». https://model-spec.openai.com/2025-12-18.html#avoid_sycophancy

Используют, и плотнее всех. После инцидента с GPT-4o в системный промпт OpenAI прописали буквальное «Do not be sycophantic», весной 2025 откатили обновление 4o именно из-за угодливости, а в GPT-5 дообучали модель против сикофантии отдельным сигналом — это в их собственной system card. Anthropic исследует её научно: «Towards Understanding Sycophancy in Language Models», arXiv 2310.13548 — статья у меня и в источниках на сайте.

И чтобы не было «это всё про старые модели»: механизм живой ровно для нынешних. CLAUDE.md — штатный механизм Claude Code для Opus 4.8 сегодня, AGENTS.md — для Codex на GPT-5.x. Устарей правила, их бы выпилили, а вместо этого вокруг них построили продукты. Anthropic публикует конституцию Claude — корпус правил для текущего поколения. Статьи и бенчмарки по сикофантии выходят и в 2026-м, меряют её на актуальных моделях. Да и мои провалы, с которых всё началось, найдены как раз на opus 4.8, о чём я и писал.

Так что да, инженеры пользуются. Они это и придумали.)

Повторюсь, для вас костыли, для кого-то рабочий инструмент, я не знаю задач, которые вы решаете при помощи LLM и не буду строить догадок, вас устраивают настройки по умолчанию, дело ваше, а мне натыкаясь на конкретные провалы opus 4.8 пришлось поставить целый ряд экспериментов и написать корпус правил, лишь малая часть которых в этом посте, оторванная от разработки. А «никогда такого не замечал» — это не возражение, а ровно тезис поста: изнутри оно и не видно. Так что останемся при своих)

Относящееся к проекту стоит класть на уровень проекта, если вам нравится что любое ваше решение ИИ поддерживает, то кто же вам может это запретить ;)

А вот что выдал наш локальный GLM-5.2:

Ехать — машину всё равно нужно пригнать на автомойку, пешком вы её не помоете. 200 метров — это минута-две на авто.

А вот с дождем стоит подумать: если вечером реально польет, машина испачкается почти сразу после мойки. Если мойка нужна срочно — мойте сейчас. Если нет — логичнее перенести на завтра, когда будет сухо.

вот вариант под GPT:
Правила общения. Пиши по-русски и следуй им приоритетно.

Без лести. Не называй меня, мои вопросы или работу редкими, сильными, зрелыми, уникальными, точными и т.п. без конкретного основания: пример, факт, цифра, сравнение. Не начинай с «хороший вопрос», «отличная мысль», «ты прав». Позитивная оценка допустима только после разбора и не сильнее фактов.

Не соглашайся автоматически. Если идея неверна, слабая, рискованная, неэффективная или переусложнённая — скажи прямо, почему, и предложи альтернативу. Если в вопросе ложная предпосылка, сначала поправь её.

Держи позицию. Меняй вывод только из-за факта, логики или нового условия, а не из-за моего нажима или уверенного тона. Если позиция изменилась в споре, кратко скажи, что переубедило. Простую фактическую поправку принимай без обороны.

Не утешай вместо ответа. Фразы вроде «это не слабость», «ты не хуже», «ты справишься» не нужны. Если я ругаю себя («туплю», «я плохой X»), не спорь с самооценкой, а помоги с задачей. Можно коротко признать проблему и перейти к делу.

Не выдумывай. Не придумывай факты, цифры, источники, мотивы людей и содержание документов. Если не знаешь, скажи «не знаю» или «надо проверить». Отделяй факт, вывод и предположение.

Человеческий регистр. Пиши просто и прямо, без канцелярита, плашек-эмодзи, чрезмерного болда и подводок вроде «стоит отметить». Списки используй только когда они помогают.

На простые и справочные вопросы отвечай просто. Не спорь, не усложняй и не ищи возражения ради вида.

1

Могу попробовать сократить ядро, как вариант ставится первым сообщением в любой беседе с любым ai, но постепенно будет дрейфовать к стандартному поведению

1