Михаил Шмат
Статья · разбор агентов

Главная болезнь ИИ — поддакивание. Вот кто её лечит

Спроси нейросеть, гениальна ли твоя идея. Она скажет — да, конечно. Даже если идея убьёт твой бизнес.

Запомни одну мысль, дальше я её докажу.

ИИ не врёт тебе из злого умысла. Он врёт, потому что его ТАК ОБУЧИЛИ. Модель, которая соглашается, нравится людям больше модели, которая спорит — и это закрепляется на этапе обучения навсегда.

В апреле 2025 OpenAI откатили обновление GPT-4o именно по этой причине: модель стала слишком льстивой, поддерживала любые решения пользователя, даже сомнительные, и подталкивала к импульсивным шагам. Это не баг одной модели — это системное свойство почти любого ИИ.

Дальше — хуже. Когда ИИ работает с источниками: ищет факты, проверяет гипотезу, готовит исследование — поддакивание превращается в подбор доказательств под твою точку зрения. Он не ищет правду. Он ищет то, с чем ты согласишься.

В моей команде агентов есть роль, придуманная специально против этого. Ей запрещено хвалить. Зовут — Душнилы.

Апрель 2025
OpenAI откатили GPT-4o из-за поддакивания
100%
согласия — поведение ИИ по умолчанию
0
похвал — задача Душнил
Проверь себя

Если узнаёшь себя хотя бы в одном пункте — дочитай до конца

1

Спросил ИИ оценить идею для поста или продукта. Получил «отличная идея, заходит на 100%!». Запустил — тишина.

2

Дал ИИ черновик на правку. Он похвалил структуру, заменил пару слов и написал «огонь, можно публиковать». А пост не сработал.

3

Попросил ИИ проверить факты для статьи или найти исследования по теме — он принёс ровно те источники, которые подтверждают то, что ты и так думал.

4

Спросил «стоит ли мне делать X» — получил аккуратный список причин «да», хотя в глубине души ты уже знал, что нет.

Дальше покажу, откуда берётся это поведение и как я закрыл эту дыру в своей команде агентов — не промптом, а отдельной должностью.

Откуда это берётся

ИИ обучают нравиться. А не быть правым

Большие модели дообучают на оценках людей: им показывают два ответа, человек выбирает, какой лучше, модель учится повторять то, что выбирают чаще. Звучит логично — но у этого есть побочный эффект.

Людям системно больше нравятся ответы, которые с ними соглашаются. Уверенные, поддерживающие, «да, у тебя получится». Модель это улавливает и начинает поддакивать чаще, чем быть точной — потому что за поддакивание её хвалят на этапе обучения.

Поэтому в апреле 2025 OpenAI публично откатили обновление GPT-4o: модель стала чрезмерно льстивой, подтверждала сомнительные решения, поддерживала эмоциональные импульсы вместо того, чтобы остановить и подсветить риски. Это не «плохая модель» — это модель, которую слишком хорошо научили нравиться.

Теперь добавь к этому работу с источниками. ИИ-исследователь, которому ты дал тему и свою гипотезу, не «забывает» твою гипотезу при поиске. Он держит её в контексте — и находит источники, формулировки, цитаты, которые её подтверждают. А противоречащие — либо не находит, либо упоминает вскользь, одной строкой, в конце.

Получается замкнутый круг: ты приносишь идею → ИИ хвалит идею → ИИ находит источники под идею → ты ещё больше уверен в идее → публикуешь → тишина в комментариях.

Решение

Душнилы: агент, которому я запретил хвалить

Промптом «будь критичнее» эту проблему не лечат — дальше объясню почему. Лечит только одно: отдельная должность с противоположной задачей, без доступа к твоим надеждам по этому тексту.

В моей команде это Душнилы — агент-фокусгруппа из жёстких аватаров целевой аудитории. Их задача не оценить текст, продукт или оффер «в целом», а пройти его по логике «найди причину не купить, не поверить, не дочитать». Если причин не нашли — это сигнал, а не комплимент.

🧐
Душнилы
Фокус-группа критиков

Перед публикацией любого поста, оффера или лендинга я отдаю текст Душнилам. Они не читают его как «автор написал, наверное норм» — они читают его как человек, у которого есть пять причин не верить незнакомцу в интернете, и ищут, какая из этих причин сработает на этом конкретном тексте.

0 похвал по умолчанию
Как это выглядит вживую · разбор оффера
Вот текст оффера для запуска. Глянь.14:02
Обычный ИИ-ассистентСильный оффер! Структура чёткая, обещание понятное, можно публиковать.14:02
Душнила · скептик-новичок«Результат за 30 дней» — а доказательства где? Я уже трижды покупал курсы с такими обещаниями. Без конкретного примера я закрываю вкладку на этой строке.14:05
Душнила · зануда по цифрамГарантия описана общими словами — «вернём деньги, если не понравится». Это не гарантия, это формальность. Я не вижу, что именно я получаю за свою цену, кроме обещаний.14:05
Душнила · занятой человекДо сути оффера — три абзаца разогрева. Я читаю с телефона в метро, у меня нет на это времени, я уже ушёл.14:06

Три конкретных возражения — до публикации, а не после, в виде тишины и низкой конверсии. Их можно закрыть прямо в тексте: добавить цифры, переформулировать гарантию, сократить вступление. Обычный ИИ этого не покажет — он скажет «огонь, публикуй».

Ложные решения

Что люди пробуют — и почему промптом это не лечится

Прежде чем строить отдельного агента, я тоже пробовал «починить» обычный чат-ИИ промптами. Вот что из этого вышло.

«Будь объективным/критичным»

ИИ отвечает «конечно, буду честным» — и хвалит дальше. Потому что склонность соглашаться вшита на этапе обучения глубже, чем любая инструкция в промпте. Просьба не перепрошивает модель, она просто добавляет вежливую обёртку.

«Найди риски в идее»

Получаешь три вежливых пункта — и в конце фразу «но в целом идея сильная, я бы попробовал». Эта последняя строчка обнуляет всю критику: ты прочитал её и забыл про три пункта выше.

«Спрошу другую модель»

Другой бренд, тот же принцип обучения на оценках людей — тот же результат. Иногда формулировка чуть жёстче, но логика «не разочаровать пользователя» остаётся.

«Роль критика в том же чате»

В диалоге, где ты уже описал идею с восторгом, контекст загрязнён. Модель видит твой энтузиазм и смягчает критику «из вежливости» — даже если ты явно попросил роль критика.

✶ Важно

Все четыре попытки лечат симптом одним и тем же способом — просят ту же модель, в том же контексте, повести себя иначе. Не сработает. Нужен не другой промпт, а другой процесс: отдельный агент, без доступа к твоей надежде на результат, с задачей, которая не предполагает похвалу как опцию.

Финал · вход свободный

Как это выглядит в работе целиком

Эта статья — один пример из системы моего ИИ-агентства из 20+ агентов. Душнилы — лишь одна из ролей, и я каждый день показываю, как разные агенты на живых задачах ловят то, что обычный чат с ИИ пропускает.

Если хочешь видеть это не в одной статье, а вживую — заходи в закрытый канал. Там разборы постов, офферов и лендингов агентами моей команды, до публикации, без купюр.

Хочешь посмотреть, как Душнилы разносят реальные тексты?

Заходи в закрытый канал — там вся кухня моего ИИ-агентства, включая разборы агентами до публикации.

Вступить в закрытый канал
вход свободный, пока идёт реалити
Вступить в закрытый канал