Data и ИИДругой язык

Как заставить ИИ не соглашаться с вами во всём

Настраиваем полезную критику: критерии, контраргументы, проверяемые тесты, адвокат дьявола и правило, которое не даёт ИИ спорить ради спора.

Кодик

Автор

5 мин чтения

Просьба «будь критичнее» слабая. Дайте ИИ объект проверки, критерии и обязанность назвать доказательство. Тогда ассистент перестаёт хвалить идею по инерции и превращается в рецензента, который ищет конкретные точки отказа.

Согласие звучит приятно, но плохо проверяет гипотезу. При этом простая команда «спорь со мной» создаёт другую проблему: модель начинает возражать ради роли и придумывает слабые риски. Полезная критика работает как тест. Сначала фиксируется тезис, затем условия его провала, данные за и против, цена ошибки и следующий эксперимент.

1Тезис

Запишите утверждение так, чтобы его можно было опровергнуть.

2Критерий

Назовите факты, при которых идея считается слабой.

3Тест

Попросите минимальную проверку, а не окончательный приговор.

Почему ассистент поддерживает исходную рамку

Модель продолжает рамку запроса. Если вы пишете «помоги доказать, что идея отличная», ответ будет искать подтверждения. Если просите оценить без критериев, ассистент компенсирует неопределённость мягким универсальным текстом. Разверните задачу: отделите автора от гипотезы и заранее разрешите ответ «данных недостаточно». Не просите угадать истину. Просите найти допущения, альтернативные объяснения и наблюдение, которое изменит решение.

РежимКогда применятьРезультат
Красная командаПеред запуском или публикациейСписок способов провала и защита
Адвокат дьяволаКогда команда слишком быстро согласиласьСильнейший контраргумент
РецензентДля текста, анализа, планаЗамечания по критериям с цитатами
Проверка гипотезыДля продукта и исследованияЧто подтвердит или опровергнет тезис
ПремортемДля проекта с последствиямиПричины воображаемого провала через месяц

Режим задаёт тип работы. Слово «критик» без критерия производит настроение, а не проверку.

Тезис → Критерий → Тест
Почему ассистент поддерживает исходную рамку. Сначала рамка, затем действие и проверка

Проверяйте критерий на собственном материале. Чужой рейтинг, готовый промпт или красивый пример полезны только как старт. Возьмите реальную задачу, сохраните исходник и сравнивайте результат по заранее записанным признакам.

Четыре режима полезного несогласия

Красная команда атакует систему, а не автора. Адвокат дьявола строит лучший возможный контраргумент, даже если сам вывод пока не доказан. Рецензент сверяет материал с рубрикой. Премортем переносит нас в будущее: «проект провалился, какие три причины наиболее вероятны?». Эти режимы нельзя смешивать. Для выбора идеи сначала нужен рецензент, затем маленький тест. Премортем не заменяет реальные данные.

ПЛОХО
Не соглашайся со мной и найди минусы идеи приложения.

ЛУЧШЕ
Гипотеза: ежедневное уведомление повысит возвращаемость учебного приложения. Выступи рецензентом. 1) выпиши скрытые допущения, 2) предложи три альтернативные причины низкой возвращаемости, 3) назови метрики риска, 4) придумай тест на 7 дней с минимальным вмешательством. Не спорь с фактами из контекста. Для каждого вывода укажи, на каком допущении он держится.
Почему второй запрос проверяемее

В нём есть конкретная цель, наблюдаемый формат и границы. Ответ можно принять, отклонить или вернуть на одну адресную правку, не начиная разговор заново.

Общий запрос и рабочая постановка
Чем меньше угадывания, тем дешевле проверка. Формат ответа является частью задачи

Как отличить критику от театра возражений

Хорошее замечание указывает механизм, доказательство и действие. Если убрать название вашей идеи и фраза подходит к любому проекту, это декоративная критика.

Слабая критикаПолезная критика
«Идея может не понравиться людям»«Новички отключат ежедневные уведомления, если первые три не связаны с их текущим уроком»
«Есть риски приватности»«План требует загрузки переписки без согласия участников»
«Нужно больше исследований»«Неизвестна доля пользователей с включёнными уведомлениями, без неё эффект нельзя оценить»
«Конкуренты уже есть»«Пользователь решает задачу встроенной функцией за два шага, а наш путь занимает семь»

Таблица не является универсальным рейтингом. Она превращает тему статьи в рабочее решение: вы выбираете строку, подставляете собственный материал и сразу видите, какой результат нужно проверить.

Отделяйте текст модели от внешнего доказательства. Актуальные возможности и правила сверяйте по первичным страницам: Google: Prompt design strategies, NIST Generative AI Profile. Если функция, тариф или интерфейс изменились, свежая документация важнее любого скриншота и обзора.

Практика: разнесите собственную гипотезу

Не пытайтесь внедрить весь метод сразу. Возьмите один небольшой материал без лишних персональных данных и выполните последовательность ниже. Засеките полное время до проверенного результата. Именно оно показывает пользу, а не скорость появления первого ответа.

Проверка своими руками
  1. Запишите гипотезу одним предложением без рекламных слов.
  2. Перечислите три факта, которые нельзя оспаривать в этом упражнении.
  3. Задайте критерии: ценность, риск, стоимость и проверяемость.
  4. Попросите сильнейший контраргумент и альтернативное объяснение.
  5. Потребуйте для каждого замечания минимальный тест или источник данных.
  6. Отдельным проходом попросите защитить идею и сравните обе стороны.
Готово, если выполняются все пункты
  • Критика содержит проверяемое допущение, а не общий страх.
  • Есть хотя бы одна причина изменить решение.
  • Предложен дешёвый тест до большого запуска.
  • Ассистент признаёт, где данных недостаточно.

Четыре контрольные точки
Соберите двухпроходный процесс решения. Если один пункт не проходит, результат остаётся черновиком

Соберите двухпроходный процесс решения

Используйте два прохода. Первый строит предложение в лучшей версии. Второй получает тот же контекст, рубрику оценки и обязанность искать провал. После этого вы решаете, какие замечания подтверждаются данными. Если спор касается фактов, переходите к проверке ответов ИИ. Если ассистент слишком многое додумывает, добавьте рамку из статьи о контексте.

Спор ради спора

Без критерия модель генерирует возражения независимо от их силы.

Атака на человека

Оценивайте гипотезу, доказательства и процесс, а не характер автора.

Один проход

После критики полезно попросить лучшую защиту и найти точки, где нужны данные.

Фальшивый приговор

Текстовый ассистент не заменяет пользовательский тест, измерение или экспертизу.

Сделайте контрольный проход без ассистента. Перескажите вывод своими словами, откройте ключевой источник и повторите главное действие самостоятельно. Если без чата результат рассыпается, вы получили удобный черновик, но ещё не закончили работу.
Короткие ответы
Можно ли доверять контраргументам?

Нет автоматически. Они являются списком для проверки, а не доказательством.

Что такое премортем?

Упражнение, где вы считаете проект уже провалившимся и ищете наиболее вероятные причины.

Сколько замечаний просить?

Три-пять сильных лучше двадцати общих. Попросите ранжировать по риску и проверяемости.

Как не получить токсичный тон?

Задайте спокойную форму: тезис, доказательство, риск, тест. Запретите оценку автора.

Когда остановить спор?

Когда новые ответы повторяют прежние аргументы и следующий шаг уже можно проверить данными.

Проверьте гипотезу, а не самооценку

В курсе по генеративному ИИ возьмите собственную идею и прогоните два прохода: сильная защита, затем рецензия по четырём критериям. Завершите одним тестом, который можно выполнить сегодня.