Por qué tu IA «olvida»: qué es la ventana de contexto
Si en un chat largo Claude empieza a ignorar algo que le dijiste al principio, no es que se haya vuelto tonto: se le llenó la memoria de trabajo. Ahora varios modelos traen una de 1 millón de tokens, y se vende como «la IA que ya no olvida». No es así, y entender por qué te ahorra muchas respuestas malas. Aquí va qué es, cuánto te cabe y 5 hábitos para que no se te pierda lo importante.
- 01Qué esLa memoria de trabajo del chat
- 02Qué esContexto no es memoria
- 03Qué esCuánto te cabe, modelo por modelo
- 04DecidirQué pasa cuando se llena
- 05CuidadoMás grande no es mejor
- 06Paso a paso5 hábitos para que no olvide lo importante
- 07Prompts2 prompts: cambiar de chat y leer documentos largos
- 08CuidadoLo honesto
Qué es la ventana de contexto: la memoria de trabajo del chat
Anthropic define la ventana de contexto como todo el texto que el modelo puede consultar al responder, incluida la respuesta que está escribiendo. La llama su «memoria de trabajo», y la distingue de lo que aprendió cuando lo entrenaron. (Context windows · Claude Docs)
Y dentro cuenta todo: cada mensaje tuyo, cada respuesta suya, los archivos e imágenes que subes, lo que piensa antes de responder y los resultados de las herramientas. El centro de ayuda avisa que las herramientas y los conectores gastan mucho espacio. (centro de ayuda)
El espacio se mide en tokens: trocitos de palabra. Anthropic calcula que en inglés un token son unos 3,5 caracteres, y avisa que cambia según el idioma. (glosario de Claude)
Imagina un escritorio. Todo lo que Claude usa para responderte tiene que caber encima. Cuando se llena, algo se tiene que ir.
Ventana de contexto y memoria no son lo mismo
Esta es la confusión que más respuestas malas provoca. La ventana vive dentro de un chat. Cuando abres uno nuevo, empieza vacía. Lo que pasa de un chat a otro va por otros caminos:
| Qué es | Qué guarda | Dónde vive |
|---|---|---|
| Ventana de contexto | Todo lo de ESTE chat | Solo en el chat abierto |
| Memoria | Temas sueltos sobre ti y tu trabajo, que puedes ver y editar | Entre chats. Activada por defecto en los planes Free, Pro y Max; en Team y Enterprise la enciende el administrador |
| Buscar en chats anteriores | Nada nuevo: Claude busca en tus conversaciones pasadas cuando se lo pides | Solo en planes de pago |
| Proyecto | Documentos e instrucciones de un tema | En cada chat de ese proyecto. En planes de pago, si son muchos documentos, Claude trae solo lo relevante y le caben hasta 10 veces más |
Sin la memoria activada, cada chat de Claude empieza de cero. Y la memoria no guarda tus chats enteros: guarda temas sueltos. Los chats de incógnito no se guardan. (memoria y búsqueda · proyectos · proyectos grandes)
Cuánto cabe en la ventana de contexto, modelo por modelo
En el chat de Claude, el tamaño depende del modelo que elijas, no del plan. Según el centro de ayuda (actualizado el 28-09-2026):
| Tamaño en el chat | Modelos |
|---|---|
| 1 millón de tokens | Fable 5.1, Opus 5.5, Opus 5, Sonnet 5.5 y Sonnet 5 |
| 500.000 | Fable 5, Opus 4.6 a 4.8 y Sonnet 4.6 |
| 200.000 | El resto, incluido Haiku 4.5 |
¿Cuánto es eso? Anthropic dice que 200.000 tokens son unas 500 páginas de texto o más. Un millón es cinco veces eso: aproximadamente, varios libros enteros. (centro de ayuda)
Aproximado, a partir de la cifra de Anthropic (200.000 tokens ≈ 500 páginas o más). En la vida real ocupan además tus mensajes, las respuestas, lo que Claude piensa y los conectores: el espacio libre es menor que el que marca la barra.
Dos matices. El plan gratis no incluye Opus ni Fable, así que ahí trabajas con Sonnet o Haiku. Y en Claude Code todos esos modelos llegan al millón, aunque algunos de los que en el chat se quedan en 500.000 solo lo hacen con una variante especial que en el plan Pro se paga aparte. (planes de Claude · centro de ayuda)
Para que compares (datos de cada empresa, 29-09-2026): en ChatGPT la ventana va de 27.000 tokens en el plan gratis a 400.000 en Pro según el modo; en la app de Gemini, de 32.000 sin plan de pago a 1 millón en AI Pro y Ultra. (precios de ChatGPT · ayuda de Gemini)
Qué pasa cuando la ventana de contexto se llena
En el chat de Claude
Cuando la conversación se acerca al límite, Claude resume los mensajes anteriores para hacer sitio y seguir. A veces verás un aviso de que está «ordenando sus ideas». Tiene tres condiciones: necesita la ejecución de código activada, el centro de ayuda lo describe para los planes de pago, y resumir gasta más de tu límite de uso. (centro de ayuda)
Un resumen pierde detalle. Si algo del principio era importante, puede quedar fuera. Y si aun así llegas al límite, la salida es abrir un chat nuevo o pasar el material a un proyecto.
En Claude Code técnico
Compacta solo al acercarse al límite. Tú puedes ver qué ocupa espacio, resumir antes o empezar de cero:
/context/compactLa documentación avisa que al compactar se pueden perder instrucciones del principio: lo que debe valer siempre va en el archivo CLAUDE.md, no en el chat. (Context window · Claude Code Docs)
Más grande no es mejor
Aquí se cae el «ya no olvida». La propia Anthropic lo dice: más contexto no es automáticamente mejor. A medida que crece, la precisión y la capacidad de recordar bajan; lo llaman context rot (algo así como «el contexto se pudre»). (Context windows · Claude Docs)
Un millón de tokens sirve para meter mucho material de una vez: un contrato largo, varios informes o un proyecto de código entero. No sirve para dejar un chat abierto semanas y esperar que se acuerde de todo con la misma precisión.
La regla: entrégale a Claude lo que necesita para ESTA tarea, no todo lo que tienes. Menos ruido, mejores respuestas.
5 hábitos para que no olvide lo importante
- Un chat por tema. Si cambias de asunto, abre uno nuevo. Mezclar temas llena la ventana de cosas que no sirven.
- Antes de cambiar de chat, pide un resumen y pégalo en el nuevo. El primer prompt de abajo lo hace por ti.
- Lo permanente, fuera del chat. Quién eres y cómo trabajas va en la memoria o en tus instrucciones (lo explicamos en Configura tu IA y en Haz que tu IA te conozca); los documentos de un tema, en un proyecto.
- Con documentos largos: el documento arriba y la pregunta al final. En las pruebas de Anthropic, preguntar al final mejoró la calidad de las respuestas hasta un 30 %. Si son varios, sepáralos y ponle nombre a cada uno. (buenas prácticas de Anthropic)
- Apaga los conectores que no uses en ese chat. Anthropic avisa que las herramientas y los conectores gastan mucho espacio, y la descripción de cada herramienta activa ya cuenta dentro de la ventana. (centro de ayuda · Context windows)
Y si lo que subes son PDF o planillas pesadas, límpialos antes: MarkItDown los convierte a texto simple, que ocupa menos.
2 prompts: cambiar de chat y leer documentos largos
Son nuestros, no de Anthropic.
El relevo: resumen para seguir en un chat nuevo
Cuándo usarlo: cuando el chat ya es largo, Claude empieza a olvidar cosas o vas a cambiar de tema.
Cita primero, responde después
Cuándo usarlo: con un documento largo (contrato, informe, manual) y una pregunta concreta.
Pedir que cite antes de responder es una de las recomendaciones de Anthropic para documentos largos (buenas prácticas).
Lo honesto
- «Con 1 millón ya no olvida» es falso. La calidad baja con mucho contexto, el resumen automático pierde detalle y un chat nuevo solo trae lo que guardó la memoria.
- No hay una cifra oficial de palabras en español. Anthropic da la equivalencia en inglés y avisa que cambia según el idioma. Además, los modelos más nuevos cuentan el mismo texto con alrededor de un 30 % más de tokens. Por eso aquí hablamos de páginas y no de un número exacto de palabras.
- El resumen automático en el plan gratis no está claro. Un artículo del centro de ayuda lo describe para planes de pago y otro solo pide tener la ejecución de código activada.
- El «hasta un 30 %» es de pruebas internas de Anthropic. En tus documentos puede variar.
- Las cifras de ChatGPT y Gemini cambian seguido. Las tomamos de sus páginas oficiales el 29-09-2026; revísalas antes de decidir por ellas.
La ventana de contexto es la memoria de trabajo de UN chat, no la memoria de la IA. Un chat por tema, lo permanente en la memoria o en un proyecto, y el documento arriba con la pregunta al final. Para elegir el modelo con más ventana cuando la necesitas, mira qué modelo usar.
¿Y ahora qué?
Tres formas de seguir, según lo que prefieras.
El mensaje para tu grupo
¿Le sirve a alguien de tu equipo o de tu grupo? Cópialo tal cual o ábrelo directo en WhatsApp.
Te paso esta guía: Por qué tu IA «olvida»: la ventana de contexto. Qué le cabe en un chat y cómo no perder lo importante. https://iactn.com/arsenal/ventana-de-contexto/Fuentes, leídas el 29-09-2026
- Context windows · Claude Docs. Definición, qué cuenta dentro y context rot.
- How large is the context window on paid Claude plans? · centro de ayuda (actualizado el 28-09-2026). Tamaño por modelo y «200K ≈ 500 páginas».
- How do usage and length limits work? · centro de ayuda (actualizado el 16-09-2026). Resumen automático y conectores.
- Chat search and memory · centro de ayuda (actualizado el 15-09-2026).
- What are projects? y RAG for projects · centro de ayuda.
- Glossary · Claude Docs. Qué es un token.
- Long context prompting · Claude Docs. Documento arriba, pregunta al final, citar primero.
- Context window · Claude Code Docs. Compactación,
/contexty/compact. - Planes de Claude · qué modelos incluye cada plan.
- Precios de ChatGPT · OpenAI · y ayuda de Gemini · Google.