Inicio › El Arsenal › Contexto
Guía · Contexto

Por qué tu IA «olvida»: qué es la ventana de contexto

Si en un chat largo Claude empieza a ignorar algo que le dijiste al principio, no es que se haya vuelto tonto: se le llenó la memoria de trabajo. Ahora varios modelos traen una de 1 millón de tokens, y se vende como «la IA que ya no olvida». No es así, y entender por qué te ahorra muchas respuestas malas. Aquí va qué es, cuánto te cabe y 5 hábitos para que no se te pierda lo importante.

Lo que vas a ver
  1. 01Qué esLa memoria de trabajo del chat
  2. 02Qué esContexto no es memoria
  3. 03Qué esCuánto te cabe, modelo por modelo
  4. 04DecidirQué pasa cuando se llena
  5. 05CuidadoMás grande no es mejor
  6. 06Paso a paso5 hábitos para que no olvide lo importante
  7. 07Prompts2 prompts: cambiar de chat y leer documentos largos
  8. 08CuidadoLo honesto
01 · qué es

Qué es la ventana de contexto: la memoria de trabajo del chat

Anthropic define la ventana de contexto como todo el texto que el modelo puede consultar al responder, incluida la respuesta que está escribiendo. La llama su «memoria de trabajo», y la distingue de lo que aprendió cuando lo entrenaron. (Context windows · Claude Docs)

Y dentro cuenta todo: cada mensaje tuyo, cada respuesta suya, los archivos e imágenes que subes, lo que piensa antes de responder y los resultados de las herramientas. El centro de ayuda avisa que las herramientas y los conectores gastan mucho espacio. (centro de ayuda)

El espacio se mide en tokens: trocitos de palabra. Anthropic calcula que en inglés un token son unos 3,5 caracteres, y avisa que cambia según el idioma. (glosario de Claude)

Imagina un escritorio. Todo lo que Claude usa para responderte tiene que caber encima. Cuando se llena, algo se tiene que ir.

02 · qué es

Ventana de contexto y memoria no son lo mismo

Esta es la confusión que más respuestas malas provoca. La ventana vive dentro de un chat. Cuando abres uno nuevo, empieza vacía. Lo que pasa de un chat a otro va por otros caminos:

Qué esQué guardaDónde vive
Ventana de contextoTodo lo de ESTE chatSolo en el chat abierto
MemoriaTemas sueltos sobre ti y tu trabajo, que puedes ver y editarEntre chats. Activada por defecto en los planes Free, Pro y Max; en Team y Enterprise la enciende el administrador
Buscar en chats anterioresNada nuevo: Claude busca en tus conversaciones pasadas cuando se lo pidesSolo en planes de pago
ProyectoDocumentos e instrucciones de un temaEn cada chat de ese proyecto. En planes de pago, si son muchos documentos, Claude trae solo lo relevante y le caben hasta 10 veces más

Sin la memoria activada, cada chat de Claude empieza de cero. Y la memoria no guarda tus chats enteros: guarda temas sueltos. Los chats de incógnito no se guardan. (memoria y búsqueda · proyectos · proyectos grandes)

03 · qué es

Cuánto cabe en la ventana de contexto, modelo por modelo

En el chat de Claude, el tamaño depende del modelo que elijas, no del plan. Según el centro de ayuda (actualizado el 28-09-2026):

Tamaño en el chatModelos
1 millón de tokensFable 5.1, Opus 5.5, Opus 5, Sonnet 5.5 y Sonnet 5
500.000Fable 5, Opus 4.6 a 4.8 y Sonnet 4.6
200.000El resto, incluido Haiku 4.5

¿Cuánto es eso? Anthropic dice que 200.000 tokens son unas 500 páginas de texto o más. Un millón es cinco veces eso: aproximadamente, varios libros enteros. (centro de ayuda)

200.000 tokens
500.000 tokens
1 millón

Aproximado, a partir de la cifra de Anthropic (200.000 tokens ≈ 500 páginas o más). En la vida real ocupan además tus mensajes, las respuestas, lo que Claude piensa y los conectores: el espacio libre es menor que el que marca la barra.

Dos matices. El plan gratis no incluye Opus ni Fable, así que ahí trabajas con Sonnet o Haiku. Y en Claude Code todos esos modelos llegan al millón, aunque algunos de los que en el chat se quedan en 500.000 solo lo hacen con una variante especial que en el plan Pro se paga aparte. (planes de Claude · centro de ayuda)

Para que compares (datos de cada empresa, 29-09-2026): en ChatGPT la ventana va de 27.000 tokens en el plan gratis a 400.000 en Pro según el modo; en la app de Gemini, de 32.000 sin plan de pago a 1 millón en AI Pro y Ultra. (precios de ChatGPT · ayuda de Gemini)

04 · decidir

Qué pasa cuando la ventana de contexto se llena

En el chat de Claude

Cuando la conversación se acerca al límite, Claude resume los mensajes anteriores para hacer sitio y seguir. A veces verás un aviso de que está «ordenando sus ideas». Tiene tres condiciones: necesita la ejecución de código activada, el centro de ayuda lo describe para los planes de pago, y resumir gasta más de tu límite de uso. (centro de ayuda)

Un resumen pierde detalle. Si algo del principio era importante, puede quedar fuera. Y si aun así llegas al límite, la salida es abrir un chat nuevo o pasar el material a un proyecto.

En Claude Code técnico

Compacta solo al acercarse al límite. Tú puedes ver qué ocupa espacio, resumir antes o empezar de cero:

/context
/compact

La documentación avisa que al compactar se pueden perder instrucciones del principio: lo que debe valer siempre va en el archivo CLAUDE.md, no en el chat. (Context window · Claude Code Docs)

05 · cuidado

Más grande no es mejor

Aquí se cae el «ya no olvida». La propia Anthropic lo dice: más contexto no es automáticamente mejor. A medida que crece, la precisión y la capacidad de recordar bajan; lo llaman context rot (algo así como «el contexto se pudre»). (Context windows · Claude Docs)

Un millón de tokens sirve para meter mucho material de una vez: un contrato largo, varios informes o un proyecto de código entero. No sirve para dejar un chat abierto semanas y esperar que se acuerde de todo con la misma precisión.

La regla: entrégale a Claude lo que necesita para ESTA tarea, no todo lo que tienes. Menos ruido, mejores respuestas.

06 · paso a paso

5 hábitos para que no olvide lo importante

  1. Un chat por tema. Si cambias de asunto, abre uno nuevo. Mezclar temas llena la ventana de cosas que no sirven.
  2. Antes de cambiar de chat, pide un resumen y pégalo en el nuevo. El primer prompt de abajo lo hace por ti.
  3. Lo permanente, fuera del chat. Quién eres y cómo trabajas va en la memoria o en tus instrucciones (lo explicamos en Configura tu IA y en Haz que tu IA te conozca); los documentos de un tema, en un proyecto.
  4. Con documentos largos: el documento arriba y la pregunta al final. En las pruebas de Anthropic, preguntar al final mejoró la calidad de las respuestas hasta un 30 %. Si son varios, sepáralos y ponle nombre a cada uno. (buenas prácticas de Anthropic)
  5. Apaga los conectores que no uses en ese chat. Anthropic avisa que las herramientas y los conectores gastan mucho espacio, y la descripción de cada herramienta activa ya cuenta dentro de la ventana. (centro de ayuda · Context windows)

Y si lo que subes son PDF o planillas pesadas, límpialos antes: MarkItDown los convierte a texto simple, que ocupa menos.

07 · prompts

2 prompts: cambiar de chat y leer documentos largos

Son nuestros, no de Anthropic.

El relevo: resumen para seguir en un chat nuevo

Cuándo usarlo: cuando el chat ya es largo, Claude empieza a olvidar cosas o vas a cambiar de tema.

Dónde se pega: el chat largo y la respuesta, en un chat nuevo
Prompt
Voy a seguir este trabajo en un chat nuevo. Escríbeme un resumen de relevo para pegarlo allí: 1. El objetivo, en una frase. 2. Las decisiones que ya tomamos (y por qué, en una línea cada una). 3. Los datos y reglas que no se pueden perder. 4. Lo que queda por hacer, en orden. 5. Lo que NO funcionó, para no repetirlo. Máximo 250 palabras. Sin saludo ni explicación: solo el resumen.

Cita primero, responde después

Cuándo usarlo: con un documento largo (contrato, informe, manual) y una pregunta concreta.

Dónde se pega: chat nuevo con el documento ARRIBA y esto DEBAJO
Prompt
Arriba está el documento. Antes de responder: 1. Copia textualmente los fragmentos que tienen que ver con mi pregunta, cada uno con la sección o página donde está. 2. Solo después, responde usando únicamente esos fragmentos. 3. Si el documento no lo dice, dilo claro en vez de suponer. Mi pregunta: [escribe tu pregunta]

Pedir que cite antes de responder es una de las recomendaciones de Anthropic para documentos largos (buenas prácticas).

08 · cuidado

Lo honesto

  • «Con 1 millón ya no olvida» es falso. La calidad baja con mucho contexto, el resumen automático pierde detalle y un chat nuevo solo trae lo que guardó la memoria.
  • No hay una cifra oficial de palabras en español. Anthropic da la equivalencia en inglés y avisa que cambia según el idioma. Además, los modelos más nuevos cuentan el mismo texto con alrededor de un 30 % más de tokens. Por eso aquí hablamos de páginas y no de un número exacto de palabras.
  • El resumen automático en el plan gratis no está claro. Un artículo del centro de ayuda lo describe para planes de pago y otro solo pide tener la ejecución de código activada.
  • El «hasta un 30 %» es de pruebas internas de Anthropic. En tus documentos puede variar.
  • Las cifras de ChatGPT y Gemini cambian seguido. Las tomamos de sus páginas oficiales el 29-09-2026; revísalas antes de decidir por ellas.
Si te llevas una sola cosa

La ventana de contexto es la memoria de trabajo de UN chat, no la memoria de la IA. Un chat por tema, lo permanente en la memoria o en un proyecto, y el documento arriba con la pregunta al final. Para elegir el modelo con más ventana cuando la necesitas, mira qué modelo usar.

¿Y ahora qué?

Tres formas de seguir, según lo que prefieras.

El mensaje para tu grupo

¿Le sirve a alguien de tu equipo o de tu grupo? Cópialo tal cual o ábrelo directo en WhatsApp.

Te paso esta guía: Por qué tu IA «olvida»: la ventana de contexto. Qué le cabe en un chat y cómo no perder lo importante. https://iactn.com/arsenal/ventana-de-contexto/
Abrir en WhatsApp
Cuándo se verificó esto

Fuentes, leídas el 29-09-2026

  1. Context windows · Claude Docs. Definición, qué cuenta dentro y context rot.
  2. How large is the context window on paid Claude plans? · centro de ayuda (actualizado el 28-09-2026). Tamaño por modelo y «200K ≈ 500 páginas».
  3. How do usage and length limits work? · centro de ayuda (actualizado el 16-09-2026). Resumen automático y conectores.
  4. Chat search and memory · centro de ayuda (actualizado el 15-09-2026).
  5. What are projects? y RAG for projects · centro de ayuda.
  6. Glossary · Claude Docs. Qué es un token.
  7. Long context prompting · Claude Docs. Documento arriba, pregunta al final, citar primero.
  8. Context window · Claude Code Docs. Compactación, /context y /compact.
  9. Planes de Claude · qué modelos incluye cada plan.
  10. Precios de ChatGPT · OpenAI · y ayuda de Gemini · Google.