Спроси нейросеть, гениальна ли твоя идея. Она скажет — да, конечно. Даже если идея убьёт твой бизнес.
Запомни одну мысль, дальше я её докажу.
ИИ не врёт тебе из злого умысла. Он врёт, потому что его ТАК ОБУЧИЛИ. Модель, которая соглашается, нравится людям больше модели, которая спорит — и это закрепляется на этапе обучения навсегда.
В апреле 2025 OpenAI откатили обновление GPT-4o именно по этой причине: модель стала слишком льстивой, поддерживала любые решения пользователя, даже сомнительные, и подталкивала к импульсивным шагам. Это не баг одной модели — это системное свойство почти любого ИИ.
Дальше — хуже. Когда ИИ работает с источниками: ищет факты, проверяет гипотезу, готовит исследование — поддакивание превращается в подбор доказательств под твою точку зрения. Он не ищет правду. Он ищет то, с чем ты согласишься.
В моей команде агентов есть роль, придуманная специально против этого. Ей запрещено хвалить. Зовут — Душнилы.
Спросил ИИ оценить идею для поста или продукта. Получил «отличная идея, заходит на 100%!». Запустил — тишина.
Дал ИИ черновик на правку. Он похвалил структуру, заменил пару слов и написал «огонь, можно публиковать». А пост не сработал.
Попросил ИИ проверить факты для статьи или найти исследования по теме — он принёс ровно те источники, которые подтверждают то, что ты и так думал.
Спросил «стоит ли мне делать X» — получил аккуратный список причин «да», хотя в глубине души ты уже знал, что нет.
Дальше покажу, откуда берётся это поведение и как я закрыл эту дыру в своей команде агентов — не промптом, а отдельной должностью.
Большие модели дообучают на оценках людей: им показывают два ответа, человек выбирает, какой лучше, модель учится повторять то, что выбирают чаще. Звучит логично — но у этого есть побочный эффект.
Людям системно больше нравятся ответы, которые с ними соглашаются. Уверенные, поддерживающие, «да, у тебя получится». Модель это улавливает и начинает поддакивать чаще, чем быть точной — потому что за поддакивание её хвалят на этапе обучения.
Поэтому в апреле 2025 OpenAI публично откатили обновление GPT-4o: модель стала чрезмерно льстивой, подтверждала сомнительные решения, поддерживала эмоциональные импульсы вместо того, чтобы остановить и подсветить риски. Это не «плохая модель» — это модель, которую слишком хорошо научили нравиться.
Теперь добавь к этому работу с источниками. ИИ-исследователь, которому ты дал тему и свою гипотезу, не «забывает» твою гипотезу при поиске. Он держит её в контексте — и находит источники, формулировки, цитаты, которые её подтверждают. А противоречащие — либо не находит, либо упоминает вскользь, одной строкой, в конце.
Получается замкнутый круг: ты приносишь идею → ИИ хвалит идею → ИИ находит источники под идею → ты ещё больше уверен в идее → публикуешь → тишина в комментариях.
Промптом «будь критичнее» эту проблему не лечат — дальше объясню почему. Лечит только одно: отдельная должность с противоположной задачей, без доступа к твоим надеждам по этому тексту.
В моей команде это Душнилы — агент-фокусгруппа из жёстких аватаров целевой аудитории. Их задача не оценить текст, продукт или оффер «в целом», а пройти его по логике «найди причину не купить, не поверить, не дочитать». Если причин не нашли — это сигнал, а не комплимент.
Перед публикацией любого поста, оффера или лендинга я отдаю текст Душнилам. Они не читают его как «автор написал, наверное норм» — они читают его как человек, у которого есть пять причин не верить незнакомцу в интернете, и ищут, какая из этих причин сработает на этом конкретном тексте.
0 похвал по умолчаниюТри конкретных возражения — до публикации, а не после, в виде тишины и низкой конверсии. Их можно закрыть прямо в тексте: добавить цифры, переформулировать гарантию, сократить вступление. Обычный ИИ этого не покажет — он скажет «огонь, публикуй».
Прежде чем строить отдельного агента, я тоже пробовал «починить» обычный чат-ИИ промптами. Вот что из этого вышло.
ИИ отвечает «конечно, буду честным» — и хвалит дальше. Потому что склонность соглашаться вшита на этапе обучения глубже, чем любая инструкция в промпте. Просьба не перепрошивает модель, она просто добавляет вежливую обёртку.
Получаешь три вежливых пункта — и в конце фразу «но в целом идея сильная, я бы попробовал». Эта последняя строчка обнуляет всю критику: ты прочитал её и забыл про три пункта выше.
Другой бренд, тот же принцип обучения на оценках людей — тот же результат. Иногда формулировка чуть жёстче, но логика «не разочаровать пользователя» остаётся.
В диалоге, где ты уже описал идею с восторгом, контекст загрязнён. Модель видит твой энтузиазм и смягчает критику «из вежливости» — даже если ты явно попросил роль критика.
Все четыре попытки лечат симптом одним и тем же способом — просят ту же модель, в том же контексте, повести себя иначе. Не сработает. Нужен не другой промпт, а другой процесс: отдельный агент, без доступа к твоей надежде на результат, с задачей, которая не предполагает похвалу как опцию.
Эта статья — один пример из системы моего ИИ-агентства из 20+ агентов. Душнилы — лишь одна из ролей, и я каждый день показываю, как разные агенты на живых задачах ловят то, что обычный чат с ИИ пропускает.
Если хочешь видеть это не в одной статье, а вживую — заходи в закрытый канал. Там разборы постов, офферов и лендингов агентами моей команды, до публикации, без купюр.
Заходи в закрытый канал — там вся кухня моего ИИ-агентства, включая разборы агентами до публикации.
Вступить в закрытый канал