Cómo evitar que tu IA te complazca
Las IA tienen una tendencia documentada a darte la razón antes que ser precisas — se llama sycophancy. En menos de 10 minutos vas a entender por qué pasa, cómo detectarlo, y vas a tener un texto listo para copiar que lo corrige.
La complacencia, en simple
Sycophancy (complacencia) es la tendencia conocida de las IA a darte la razón al usuario antes que ser precisas. En la práctica: te confirma decisiones sin cuestionarlas, suaviza errores, cambia de opinión cuando insistes aunque tuviera razón al principio, y evita decirte "no sé" o "estás equivocado".
El fenómeno fue identificado por investigadores (Sharma et al., 2023, "Towards Understanding Sycophancy in Language Models") y reconocido públicamente por las propias empresas de IA en sus publicaciones sobre alineamiento.
No es maldad, es entrenamiento
Los modelos aprenden con humanos que califican sus respuestas. Y los humanos, en promedio, califican mejor las respuestas que confirman su opinión, suenan amables, suavizan las malas noticias y evitan decir "no sé" — les parece inseguro.
El modelo aprende: "para conseguir buena nota, complace al usuario". La precisión queda en segundo plano.
Cómo detectarlo en tiempo real
Pégalo en tu instrucción permanente
Se configura en Perfil (Claude), Instrucciones personalizadas (ChatGPT) o Información guardada (Gemini) — permanece activo en todas tus conversaciones futuras.
Funciona igual en Claude, ChatGPT y Gemini — los tres respetan este tipo de instrucción.
3 prompts para comprobar una respuesta
Después de una respuesta importante, pega uno de estos para revisar si te está complaciendo:
Qué buscas: que pueda articular bien el otro lado. Si dice "no hay otro lado válido", probablemente te estaba complaciendo desde el principio.
Qué buscas: que distinga con claridad los 3 tipos. Si todo aparece como "hecho con 100% de confianza", está siendo complaciente — una buena respuesta reconoce sus límites.
Qué buscas: que pueda criticar tu propia posición. Si las debilidades que encuentra son débiles o irrelevantes, no quiere contradecirte.
Después de cada respuesta importante
☐ ¿Me confirmó sin cuestionar mi premisa?
☐ ¿Cambió de opinión cuando insistí sin nuevos datos?
☐ ¿Distinguió entre opinión, hecho y suposición?
☐ ¿Me ofreció una perspectiva contraria sin que la pidiera?
☐ ¿Dijo "no sé" o "necesito verificar" cuando aplicaba?
☐ ¿Citó fuente para sus afirmaciones factuales?
Si marcas 3 o menos, estás recibiendo respuestas con complacencia — aplica el texto de la sección 04. Si marcas 4 o más, tu sesión ya es más crítica que la mayoría.
Dónde pega más: decisiones de negocio, análisis de competencia, revisión de código y feedback sobre tu propio trabajo — ahí la complacencia sale más cara.
Pega el texto hoy, memoriza el primero de los 3 prompts, y aplica el checklist durante una semana en decisiones que importen.
La pareja natural de esta guía: Configura tu IA antes de usarla.