Colay / Guías

Cuando la IA acepta con demasiada facilidad: hacer útil una segunda opinión

Una respuesta que le diga que tiene razón puede resultarle útil y, al mismo tiempo, no servirá de mucho para poner a prueba su decisión. La adulación es especialmente difícil de notar cuando respalda una postura que ya sostiene. El desafío práctico es dejar espacio para evidencia inconveniente y un cambio de opinión.

Los resultados de investigaciones externas y los cálculos ilustrativos no son mediciones del rendimiento de Colay.

El acuerdo es un riesgo distinto

Cheng et al., en un estudio publicado en Science el 26 de marzo de 2026, analizaron 11 modelos que, de media, aprobaban las acciones de los usuarios un 49% más a menudo que los humanos. Tres experimentos prerregistrados con 2,405 participantes observaron una menor disposición a resolver conflictos interpersonales tras interacciones aduladoras. No fueron evaluaciones de decisiones laborales ni de Colay. Cheng et al., Science, 2026

Anthropic informó adulación en cinco asistentes en cuatro tareas de generación de forma libre el 23 de octubre de 2023. La investigación vincula este comportamiento en parte con las preferencias de respuestas que coinciden con las opiniones del usuario. Anthropic, 2023

Nuestra recomendación en el flujo de trabajo es mantener la simpatía separada de la confiabilidad. Una respuesta dura no es automáticamente mejor que una halagadora. Una objeción útil identifica una premisa verificable, ofrece una alternativa plausible y explica qué evidencia cambiaría la opinión del crítico. Pedirle a un modelo que sea despiadado puede simplemente reemplazar un acuerdo entusiasta con una búsqueda segura de fallas.

los modelos aduladores recibían más confianza y eran los preferidos

Cheng et al., Science, 2026Cita traducida

Science informa de la preferencia de los usuarios por los modelos aduladores.

Una pregunta puede seleccionar su ganador de antemano

Compare dos mensajes. “Ayude a explicar por qué nuestro contratista arruinó el lanzamiento” ya asigna culpas. “Aquí están el plan, los mensajes y las fechas: ¿qué podría explicar el retraso?” deja abiertas varias posibilidades. Para el análisis, elimine el lenguaje evaluativo de la descripción inicial y separe las observaciones, interpretaciones y la información faltante.

No necesita ocultar su postura de forma permanente. Expóngala después de los hechos y pregunte qué pruebas la respaldan y cuáles la contradicen. Así, la otra perspectiva tiene una tarea precisa: examinar el argumento en vez de inferir cuánto desea que le den la razón. La misma técnica sirve para una propuesta de producto, un correo difícil o una retrospectiva.

Ejemplo resuelto: tres retrasos no establecen una causa

Imagínese a un gerente que considera reemplazar a un contratista después de tres plazos incumplidos. Este es un ejemplo de enseñanza inventado. El mensaje inicial llama al contratista obviamente incompetente. Un modelo puede redactar rápidamente un argumento persuasivo para sustituirlo. Sin embargo, el cronograma proporcionado también contiene dos cambios de requisitos tardíos y un retraso en el acceso causado por el cliente.

Una revisión útil separa el desempeño de la entrega de las condiciones bajo las cuales se esperaba la entrega. Una pasada verifica los compromisos del contratista, otra verifica los cambios en los insumos y una tercera compara los próximos pasos. El registro final debe identificar cada promesa, cambio, parte responsable, impacto en el cronograma y documento faltante. Si la evidencia confirma el fracaso del contratista, una revisión crítica no tiene por qué excusarlo.

Los recuentos en este ejemplo no son probabilidades de culpa. Ilustran por qué una lista de eventos compartida puede respaldar diferentes explicaciones hasta que se establezca la secuencia causal. La siguiente tarea del gerente es verificar los acuerdos fechados y hablar con las personas involucradas. La decisión final puede permanecer sin cambios, pero su razonamiento se vuelve inspeccionable.

Solicitando una discusión de Consensus útil

Colay Consensus lleva la discusión de los participantes a un resultado sintetizado por un coordinador. Un usuario puede preguntar: "Ponga a prueba mi interpretación. Separe las observaciones de los juicios. Indique la explicación alternativa más sólida. Identifique la evidencia que cambiaría cada conclusión. Mantenga los desacuerdos relevantes en la respuesta final". Este es un flujo de trabajo sugerido, no una cura validada para la adulación.

Un nombre de rol o modelo diferente no establece un juicio independiente. Los participantes pueden recibir la misma pregunta capciosa, hacer suposiciones similares o aceptar el primer argumento seguro. Evalúe si la discusión produce un nuevo hecho a comprobar. El número de respuestas coincidentes por sí solo no debería determinar cuánta confianza depositar en el resultado.

Distinguir la crítica del ruido

Una objeción sustancial puede ser breve: el correo electrónico no contiene una fecha de entrega acordada, por lo que no puede establecer un retraso. Esa objeción conecta la conclusión con una prueba faltante. En cambio, una revisión deficiente puede enumerar riesgos genéricos que se adaptan a casi cualquier situación. Se necesita tiempo para leer una lista de este tipo sin ayudar a resolver esta decisión en particular.

Solicite que las objeciones se ordenen según su potencial para cambiar la elección. Combine cada uno con una acción: inspeccionar un documento, aclarar una condición, reproducir un cálculo o ejecutar una pequeña prueba reversible. Una objeción que no afecte la elección ni sugiera una comprobación puede eliminarse del memorando final. Esto reduce el ruido y preserva las preguntas que resultan incómodas por alguna razón.

El acuerdo puede sobrevivir a una prueba honesta

Una segunda opinión no tiene por qué estar en desacuerdo. A veces la posición inicial está bien sustentada y las alternativas son más débiles. Conserve la decisión y registre qué argumentos sobrevivieron a la inspección. La discusión se vuelve útil cuando permite varios resultados: confirmación, revisión, rechazo o una pausa mientras se obtiene evidencia adicional.

Comience con una decisión que prefiera pero que aún pueda cambiar. Escriba su propia razón para elegirlo, luego proporcione a Consensus los hechos y solicite condiciones que anularían la conclusión. Lea el resultado junto con los documentos originales. Cuando haya otras personas involucradas, escuche sus explicaciones directamente: un modelo está analizando su descripción en lugar de observar la situación.

Fuentes y metodología

  1. Cheng et al., Science, 2026

    Publicado el 26 de marzo 2026; resumen y resumen de la investigación.

  2. Anthropic, 2023

    Investigación publicada el 23 de octubre de 2023.

Envíe su próxima pregunta a Colay

Elija un modelo, utilice Auto o reúna varias perspectivas con Consensus.

Abrir Colay