Colay / Руководства
Когда нейросеть поддакивает: зачем второе мнение и честное возражение
Ответ «вы всё правильно понимаете» может быть приятным и совершенно бесполезным для решения. Поддакивание особенно трудно заметить, когда нейросеть подтверждает уже готовую позицию. Разберём, как организовать обсуждение так, чтобы в нём оставалось место для неудобных фактов и изменения собственного мнения.
Результаты сторонних исследований и учебные расчёты не являются замером качества Colay.
Данные Science: согласие — отдельный риск
В Science 26 марта 2026 года Cheng и коллеги описали 11 моделей: в исследованных сценариях они одобряли действия пользователя в среднем на 49% чаще людей. Три зарегистрированных заранее эксперимента с 2 405 участниками связали поддакивающее взаимодействие со снижением готовности исправлять межличностный конфликт. Исследование не измеряло рабочие решения в Colay. Cheng et al., Science, 2026
Ранее Anthropic, 23 октября 2023 года, продемонстрировала поддакивание у пяти ассистентов в четырёх задачах свободной генерации. Авторы связывают его в том числе с предпочтением ответов, совпадающих со взглядами пользователя. Anthropic, 2023
Наш вывод для рабочего процесса: приятность ответа нельзя использовать как критерий его надёжности. При этом жёсткий тон тоже ничего не доказывает. Полезное возражение должно назвать проверяемое основание, возможное альтернативное объяснение и условие, при котором критик сам изменит позицию. Просто попросить модель быть суровой недостаточно: она может заменить поддакивание столь же уверенной придирчивостью.
sycophantic models were trusted and preferred
Cheng et al., Science, 2026
Из аннотации Science: пользователи предпочитали поддакивающие модели.
Как формулировка заранее выбирает победителя
Сравните два запроса. «Помоги объяснить, почему наш подрядчик провалил запуск» уже назначает виновника. «Вот план, переписка и сроки: какие причины могли привести к задержке?» оставляет пространство для нескольких гипотез. Если задача состоит в анализе, полезно убрать из первого сообщения оценочные слова и отдельно перечислить наблюдения, интерпретации и то, чего пока нет.
Не нужно прятать собственную позицию навсегда. Запишите её в отдельный абзац после фактов и попросите проверить, какие данные поддерживают её, а какие ей противоречат. Так второй взгляд получает конкретную работу. Он должен исследовать аргумент, а не угадывать, насколько сильно вы хотите услышать согласие. Этот приём подходит и для обсуждения продукта, и для оценки собственного письма.
Условный кейс: три задержки не объясняют их причину
Представим менеджера, который хочет заменить подрядчика после трёх сорванных сроков. Это вымышленный учебный пример. В запросе он пишет, что подрядчик очевидно некомпетентен. Единственная модель может быстро составить убедительное обоснование расторжения отношений. Однако в предоставленной хронологии также есть два изменения требований после согласования и одна задержка доступа со стороны заказчика.
Полезное обсуждение разделяет качество выполнения и качество постановки задачи. Один разбор проверяет обязательства подрядчика, другой — изменения входных условий, третий — стоимость вариантов дальнейшей работы. В финале нужен не компромисс ради компромисса, а таблица эпизодов: обещание, изменение, ответственный, влияние на срок, недостающий документ. Если факты подтверждают нарушение подрядчика, критическая проверка не обязана его оправдывать.
Цифры «три», «два» и «одна» здесь не оценка вероятности чьей-либо вины. Они показывают, как одинаковый набор событий допускает разные объяснения, пока причинная цепочка не восстановлена. Следующее действие менеджера — сверить даты в договорённостях и поговорить с участниками проекта. Решение после этого может совпасть с исходным, но его основание станет проверяемым.
Постановка задачи для Consensus
В Colay Consensus обсуждение участников собирается координатором в общий результат. Пользователь может попросить: «Проверьте мою интерпретацию. Отделите факты от оценок. Сформулируйте сильнейшее альтернативное объяснение. Укажите, какое свидетельство изменило бы каждый вывод. Сохраните существенные разногласия». Это рекомендуемый способ использования режима, а не доказанный рецепт устранения поддакивания.
Не называйте участника независимым экспертом только потому, что у него другая роль или другая модель. Участники могут видеть одинаковую формулировку, опираться на похожие предположения и соглашаться с первым уверенным аргументом. Чтобы проверить пользу обсуждения, смотрите, появился ли новый факт для проверки. Число согласившихся ответов само по себе не должно повышать доверие.
Что считать содержательной критикой
Содержательная критика может оказаться короткой: «В письме отсутствует согласованная дата; без неё нельзя оценить просрочку». Она связывает вывод с недостающим свидетельством. Слабая критика, наоборот, выдаёт длинный список универсальных рисков, применимый к любой ситуации. Такой список создаёт видимость глубины и отнимает время, но не помогает решить конкретный вопрос.
Попросите участников расположить возражения по влиянию на решение. Для каждого сохраните конкретное действие: открыть документ, уточнить условие, проверить число или предложить небольшой обратимый эксперимент. Если возражение не меняет выбора и не ведёт к проверке, его можно убрать из итоговой записки. Это уменьшает шум, сохраняя действительно неудобные вопросы.
Согласие можно принять — после проверки
Цель второго мнения не состоит в обязательном споре. Иногда исходная позиция хорошо подтверждена, а альтернативы слабее. Тогда разумно сохранить решение и записать, какие аргументы выдержали проверку. Дискуссия становится полезной именно потому, что допускает разные исходы: подтверждение, уточнение, отказ или временную паузу до получения новых сведений.
Начните с решения, к которому вы уже эмоционально привязаны, но которое ещё можно пересмотреть. Сначала запишите собственную причину выбора, затем дайте Consensus факты и задачу найти опровергающие условия. Прочитайте итог вместе с исходными документами. Для конфликтов с людьми оставьте место их объяснению: модель обсуждает ваше описание, а не наблюдает ситуацию непосредственно.
Источники и методология
- Cheng et al., Science, 2026
26 марта 2026 года; аннотация и описание исследования.
- Anthropic, 2023
Исследование от 23 октября 2023 года.
Задайте следующий вопрос в Colay
Выберите модель, используйте Auto или объедините несколько точек зрения с Consensus.