Ventana de contextoContext Window
La cantidad máxima de texto que el modelo ve a la vez
- La ventana de contexto es el tamaño del lugar que el modelo puede desplegar de una vez.
- Lo que ocupa lugar no son las letras, sino el número de trozos. Con el mismo significado, algunos idiomas ocupan más lugar que otros.
- La instrucción, la conversación anterior, la pregunta de ahora y la futura respuesta comparten un mismo lugar.
- Si el lugar se llena, se empuja primero lo más viejo. Lo empujado ya no lo ve el modelo.
- Ampliar el lugar permite meter más, pero se vuelve más lento y sube el costo.
Contenido
1La analogía
Un tendedero de ropa tiene un lugar fijo para colgar. Cuántas varillas tiene y cuánto miden ya está definido de antemano. Por más ropa que haya, no se puede colgar más de lo que entra.
Para colgar ropa nueva hay una sola manera: descolgar lo que ya estaba puesto. Si se descuelga y se guarda en un cajón, desaparece del tendedero. Solo se ve lo que está colgado ahí en ese momento.
El lugar que ocupa cada prenda también es distinto. Un par de medias entra en un palmo, pero una toalla grande ocupa un tramo entero. No es la cantidad de prendas lo que define el lugar, sino el volumen. El rango que el modelo puede ver a la vez es igual a este tendedero.
2En detalle
La unidad con la que se mide el lugar es el trozo
Así como las medias y las toallas ocupan lugares distintos en el tendedero, con el texto tampoco alcanza medir solo la longitud para saber cuánto lugar ocupa. El modelo corta el texto en trozos y trabaja con ellos, y ese número de trozos es justo el lugar que ocupa.
Con el mismo significado, el español entra en más trozos que otros idiomas más económicos en ese sentido. Por eso, un documento que parece del mismo tamaño puede ocupar un lugar bastante distinto según el idioma. Documentos con muchas tablas o listas, o con cantidades llenas de números, también suelen comer más trozos de lo que parece a simple vista.
De ahí viene que el límite se muestre como "tantos miles de trozos". Contando letras no se puede saber con exactitud.
El mismo lugar lo comparten varios
Lo que se cuelga en el tendedero no es solo la ropa de hoy. En el lugar que se abre delante del modelo entran juntos la instrucción que el servicio dejó puesta de antemano, la conversación de hasta ese momento, la pregunta de este turno, y el documento que se pegó.
También hay que dejar reservado, de antemano, el lugar donde va a ir la respuesta que se va a escribir. Si la pregunta llena todo el lugar, no queda dónde meter la respuesta. Por eso pasa que, al pegar un documento largo entero, la respuesta sale de golpe más corta o se corta a mitad de camino.
Si se desborda, se descuelga desde el principio
Si la conversación se alarga y falta lugar, se empuja primero la parte más vieja. Si al principio se pidió "no uses un tono formal" y bastante después vuelve a aparecer un tono formal, es porque ese pedido ya se descolgó del tendedero.
No es que el modelo se haya olvidado: es que directamente ya no lo ve. No es que tenga una función de rebuscar en la memoria; es que cada vez vuelve a leer desde cero solo lo que está colgado en ese momento.
La manera de descolgar cambia según el servicio. A veces se corta directamente la parte de adelante, a veces se resume la conversación anterior en pocas líneas para ahorrar lugar. Al resumir, queda el hilo general, pero se pierden los detalles exactos.
Un lugar más ancho, ¿es siempre mejor?
Si se cambia a un tendedero más grande, se puede colgar más de una vez. A cambio, ocupa más espacio en el cuarto. Con la ventana de contexto pasa lo mismo. Cuanto más ancho es el lugar, más documento entra, pero como cada vez hay que releer todo ese contenido desde cero, la respuesta se vuelve más lenta y el costo sube también.
También existe el problema de que el medio se desdibuje. Cuando hay mucho colgado en el tendedero, aparece la tendencia a cuidar bien el principio y el final, pero pasar por alto lo que está en el medio. Que el lugar sea ancho no significa que todo lo que hay adentro se mire con el mismo cuidado.
Cómo usar el lugar con cuidado
El método más seguro es colgar solo lo necesario. En vez de empujar un documento grueso entero, buscar y meter solo la parte relacionada con la pregunta ahorra lugar y hace que la respuesta salga más precisa.
Si la conversación es larga, también ayuda ordenarla una vez en el medio. Escribir en pocas líneas lo esencial hasta ese punto y empezar una conversación nueva tiene el mismo efecto que doblar la ropa que se descolgó y guardarla en el cajón. Las condiciones que sí o sí deben respetarse es más seguro no dejarlas solo al principio de la conversación, sino repetirlas cuando hace falta.
3Con más precisión
La ventana de contexto es el techo de la cantidad de tokens que el modelo puede manejar en un solo procesamiento. Muchas veces se cuenta sumando la entrada y la salida, y algunos servicios ponen techos separados para cada una. Este techo queda fijado por la estructura y el entrenamiento del modelo, así que no es una configuración que el usuario pueda cambiar. Tampoco hay garantía de que la calidad se mantenga con solo llenar hasta el techo: en la práctica, la longitud que el modelo maneja bien suele ser más corta que el número que figura.
También hay puntos donde la analogía no encaja. La ropa colgada en el tendedero se queda tal cual si nadie la toca, pero el modelo vuelve a leer todo desde el principio cada vez que se intercambia un mensaje. No es que algo quede colgado ahí de forma continua: cada vez se vuelve a tender todo de nuevo. Además, en el tendedero, mientras haya lugar, todo se seca igual de bien; en cambio, cuanto más contenido hay en el lugar del modelo, más se diluye la atención que le dedica a cada parte.
4Pruébalo
5Malentendidos comunes
Es fácil pensar que la ventana de contexto es la memoria del modelo, pero en realidad es solo el rango que se vuelve a leer cada vez, así que lo que queda afuera es como si nunca hubiera existido.
Es fácil creer que contando letras se sabe cuánto lugar queda, pero en realidad se cuenta por número de trozos, así que varía mucho según qué palabras se usen.
Es fácil pensar que un modelo con un lugar amplio ve todo el contenido igual de bien, pero en realidad se observa seguido que pasa por alto lo que está más o menos en el medio.
7Resumen en una línea
En resumenLa ventana de contexto es el tamaño del lugar que el modelo puede desplegar de una vez, y lo que queda más allá de ese lugar, el modelo no lo ve desde el principio.
¿Has visto un error o tienes una analogía mejor? Sugerir una corrección · Última actualización2026-09-02