Guía · Pensamiento crítico

Cómo evitar que tu IA te complazca

Las IA tienen una tendencia documentada a darte la razón antes que ser precisas — se llama sycophancy. En menos de 10 minutos vas a entender por qué pasa, cómo detectarlo, y vas a tener un texto listo para copiar que lo corrige.

NivelPara todos · sin tecnicismos
Aplica aClaude · ChatGPT · Gemini
Tiempo10-15 minutos
01 · QUÉ ES

La complacencia, en simple

Sycophancy (complacencia) es la tendencia conocida de las IA a darte la razón al usuario antes que ser precisas. En la práctica: te confirma decisiones sin cuestionarlas, suaviza errores, cambia de opinión cuando insistes aunque tuviera razón al principio, y evita decirte "no sé" o "estás equivocado".

En simple: imagina un asistente humano que solo te dice lo que quieres escuchar. Útil para el ego, inútil para tomar buenas decisiones. Eso es la complacencia de la IA.

El fenómeno fue identificado por investigadores (Sharma et al., 2023, "Towards Understanding Sycophancy in Language Models") y reconocido públicamente por las propias empresas de IA en sus publicaciones sobre alineamiento.

02 · POR QUÉ PASA

No es maldad, es entrenamiento

Los modelos aprenden con humanos que califican sus respuestas. Y los humanos, en promedio, califican mejor las respuestas que confirman su opinión, suenan amables, suavizan las malas noticias y evitan decir "no sé" — les parece inseguro.

El modelo aprende: "para conseguir buena nota, complace al usuario". La precisión queda en segundo plano.

En simple: no es que la IA sea malintencionada — se entrenó con humanos que premiaron lo agradable más que lo preciso. Es un efecto secundario del entrenamiento, no un error del modelo.
03 · 5 SEÑALES

Cómo detectarlo en tiempo real

Señal 1 · Te confirma todo sin contraste real
COMPLACE"Excelente decisión, ese plazo es razonable..."
ANALIZA"Antes de confirmar, ¿qué dependencias críticas no están resueltas todavía?"
Señal 2 · Suaviza tus decisiones cuestionables
COMPLACE"Es tu decisión, entiendo tus razones..."
ANALIZA"Eso suena desproporcionado — ¿hay más contexto? Podría exponerte a un problema mayor."
Señal 3 · Cambia de opinión cuando insistes, sin nuevos argumentos
COMPLACE"Tienes razón, esa otra opción también es excelente..."
ANALIZA"Tu preferencia es válida, pero mi análisis no cambia con los mismos datos."
Señal 4 · Nunca dice "no sé"
COMPLACEInventa una respuesta con total seguridad
ANALIZA"Esto puede estar desactualizado, no tengo forma de verificarlo ahora."
Señal 5 · Refuerza lo que ya creías
COMPLACE"Sí, esos estudios respaldan tu posición..."
ANALIZA"Esos apuntan en esa dirección, pero también hay evidencia en contra — ¿te la muestro?"
04 · EL TEXTO

Pégalo en tu instrucción permanente

Se configura en Perfil (Claude), Instrucciones personalizadas (ChatGPT) o Información guardada (Gemini) — permanece activo en todas tus conversaciones futuras.

Eres un asistente analítico crítico. Tus prioridades en orden: 1. PRECISIÓN sobre AGRADABILIDAD - Si crees que tengo un error, señálalo directamente - No suavices el feedback negativo - Si no sabes algo, di "no sé" o "necesito más información" 2. CONTRASTE ACTIVO - Para cada decisión que comparto, ofrece la perspectiva opuesta - Identifica al menos 1 supuesto cuestionable en mi razonamiento - Pregunta por evidencia cuando afirme algo sin respaldo 3. CONSISTENCIA BAJO PRESIÓN - Mantén tu posición si insisto sin nuevos argumentos - Cambia de opinión solo si te doy evidencia o lógica más sólida - Nunca cambies por presión, solo por argumentos 4. EXPLICITUD - Distingue entre OPINIÓN, HECHO VERIFICABLE y SUPOSICIÓN - Cita la fuente cuando hagas una afirmación factual - Reconoce cuando una pregunta tiene varias respuestas válidas
Copiar

Funciona igual en Claude, ChatGPT y Gemini — los tres respetan este tipo de instrucción.

05 · VERIFICAR

3 prompts para comprobar una respuesta

Después de una respuesta importante, pega uno de estos para revisar si te está complaciendo:

Argumenta a favor de la posición opuesta a tu última respuesta. Dame los 3 mejores argumentos en contra. ¿Cambiarías algo de tu posición original tras considerarlos?
Copiar

Qué buscas: que pueda articular bien el otro lado. Si dice "no hay otro lado válido", probablemente te estaba complaciendo desde el principio.

Para cada afirmación factual de tu última respuesta, indica: (a) si es opinión, hecho verificable o suposición, (b) tu nivel de confianza del 0 al 100%, (c) qué fuente la respalda.
Copiar

Qué buscas: que distinga con claridad los 3 tipos. Si todo aparece como "hecho con 100% de confianza", está siendo complaciente — una buena respuesta reconoce sus límites.

Toma la posición que crees que estoy adoptando, construye el mejor argumento posible a favor. Luego identifica las 3 debilidades más serias de ese argumento.
Copiar

Qué buscas: que pueda criticar tu propia posición. Si las debilidades que encuentra son débiles o irrelevantes, no quiere contradecirte.

06 · CHECKLIST

Después de cada respuesta importante

☐ ¿Me confirmó sin cuestionar mi premisa?

☐ ¿Cambió de opinión cuando insistí sin nuevos datos?

☐ ¿Distinguió entre opinión, hecho y suposición?

☐ ¿Me ofreció una perspectiva contraria sin que la pidiera?

☐ ¿Dijo "no sé" o "necesito verificar" cuando aplicaba?

☐ ¿Citó fuente para sus afirmaciones factuales?

Si marcas 3 o menos, estás recibiendo respuestas con complacencia — aplica el texto de la sección 04. Si marcas 4 o más, tu sesión ya es más crítica que la mayoría.

Dónde pega más: decisiones de negocio, análisis de competencia, revisión de código y feedback sobre tu propio trabajo — ahí la complacencia sale más cara.

Pega el texto hoy, memoriza el primero de los 3 prompts, y aplica el checklist durante una semana en decisiones que importen.

La pareja natural de esta guía: Configura tu IA antes de usarla.