La ventana de contexto es la memoria de trabajo de un modelo de IA dentro de una conversación. Es todo lo que Claude o ChatGPT pueden tener presente a la vez: tu primer mensaje, los archivos que le pasaste, cada respuesta que te ha dado y lo último que le acabas de escribir. Se mide en tokens, y cuando se llena, el modelo empieza a rendir peor. Aquí te explico qué es y cómo la gestiono yo, que gasto unos 120 millones de tokens al mes.
Qué es la ventana de contexto
Piensa en una mesa de trabajo. Cabe una cantidad de papeles encima. Mientras hay sitio, tienes todo a la vista y trabajas rápido. Cuando la mesa se llena, para poner un papel nuevo tienes que empezar a amontonar, y algunos quedan tapados.
La ventana de contexto es esa mesa. El modelo no recuerda una conversación como la recuerdas tú. En cada respuesta vuelve a leer todo lo que hay en la ventana para decidir qué contestar. Cuanto más metes dentro (mensajes largos, archivos, ida y vuelta), más ocupada está esa mesa.
Cada modelo tiene un tamaño de ventana distinto, y se cuenta en tokens. Un token es un trozo de palabra, la unidad con la que la IA lee y escribe. Una ventana grande deja tener más cosas a la vez, pero no es infinita, y ese es el punto que casi nadie te cuenta.
Por qué importa: el contexto se degrada antes de llenarse
Lo que mucha gente no sabe es que no hace falta llenar la ventana del todo para notar la caída. Bastante antes del límite, el modelo empieza a dar respuestas más pobres, más vagas, y tardas más en llegar a donde quieres.
Es lógico si vuelves a la mesa. Con pocos papeles, encuentras lo que buscas al instante. Con la mesa a rebosar, tardas más y a veces coges el papel equivocado. Al modelo le pasa igual: cuanta más información compite por su atención, más se diluye lo importante.
Yo trabajo muchísimo con Claude, intercambio del orden de 100.000 mensajes al mes, así que este momento lo conozco de memoria. Y lo noto siempre en el mismo sitio: alrededor del 60 a 65% de la ventana. Ahí es cuando las respuestas empiezan a perder filo.
Cómo la gestiono yo: cortar y traspasar
Cuando llego a ese punto no intento estirar la sesión. Hago lo contrario: la cierro a propósito y arranco una nueva. Este es el proceso exacto que sigo.
Le pido a Claude que me prepare un prompt de traspaso con todo lo que queda pendiente y un resumen de la sesión. Le pido también que guarde en un documento un checkpoint, el punto de estado donde estamos, para incluirlo en ese prompt. Hago commit y git de absolutamente todo, para no perder nada del trabajo. Y abro una sesión nueva pegando ese prompt para seguir desde donde lo dejé.
Sí, pierdo un poco de contexto en el corte, y a veces tengo que darle a la sesión nueva algún detalle extra. Esa es la única fricción. Pero es mínima comparada con lo pobres que se vuelven los resultados si te empeñas en seguir en una sesión ya saturada. Un buen documento de traspaso te cuesta un minuto y te devuelve una sesión fresca que vuelve a rendir al cien por cien.
No hace falta que hagas nada raro. La clave es tener el hábito de cortar cuando notas que baja el rendimiento, en vez de arrastrar una sesión pesada hasta que te desespera.
Qué llena la ventana más rápido
Vale la pena saber qué gasta sitio, para no llenar la mesa sin darte cuenta. Pegar archivos enteros muy largos ocupa muchísimo, aunque solo te interese un trozo. Las conversaciones con mucha ida y vuelta se acumulan solas. Y arrastrar contexto de una tarea vieja que ya no toca es peso muerto.
Dos hábitos me funcionan. El primero, arrancar cada sesión enfocada en una cosa concreta, no ir mezclando tres proyectos en la misma conversación. El segundo, pasarle solo la parte del archivo que hace falta, no el documento completo por comodidad. Con eso llegas mucho más lejos antes de tocar techo.
Las señales de que toca cortar
No mires solo el porcentaje. Fíjate en el comportamiento. Cuando las respuestas se vuelven genéricas, cuando repite cosas que ya habíais resuelto, cuando das tres vueltas para algo que antes salía a la primera, esa es la señal. La ventana te está pidiendo un relevo.
Con el tiempo lo detectas sin pensar. Es como conducir: al principio miras el cuentakilómetros, luego notas por el motor cuándo toca cambiar de marcha.
Cuándo tiene sentido esto y cuándo no
Si usas la IA para preguntas sueltas y sesiones cortas, no vas a rozar el límite y no tienes que preocuparte. Esto importa cuando trabajas en sesiones largas: construir una herramienta, un proyecto con muchos archivos, una conversación que se alarga horas. Ahí gestionar la ventana es la diferencia entre avanzar rápido o pelearte con un modelo que ya no rinde.
La idea de fondo es sencilla. La ventana de contexto es un recurso, no una papelera donde meter todo sin control. Cuídala y la IA te responde mejor.
Cada día te resumo lo que de verdad importa en IA en digitalbrain.email, sin ruido.
Relacionado


