Ventana de contexto

Pegar un documento de cincuenta páginas en una conversación con una IA y esperar que recuerde con precisión un detalle mencionado al principio, después de haber hablado de otras diez cosas, depende de un límite técnico muy concreto. La ventana de contexto es precisamente ese límite: la cantidad máxima de texto (medida en tokens) que un modelo de lenguaje puede tener en cuenta a la vez en una misma conversación o tarea, incluyendo tanto lo que se le ha enviado como lo que él mismo ha generado previamente.

Por qué se comporta como una especie de memoria a corto plazo

Todo lo que queda dentro de la ventana de contexto, el modelo puede «verlo» y usarlo para construir su siguiente respuesta. Todo lo que queda fuera de ese límite, ya sea porque la conversación se ha alargado demasiado o porque un documento excede ese tamaño, simplemente deja de estar disponible para el modelo, como si nunca se hubiera mencionado, aunque la persona sepa que sí lo hizo antes.

Cómo ha evolucionado este límite con el tiempo

  • Los primeros modelos de lenguaje comerciales manejaban ventanas de contexto bastante reducidas, apenas suficientes para unas pocas páginas de texto.
  • Los modelos actuales han ampliado considerablemente esta capacidad, permitiendo procesar documentos extensos o conversaciones mucho más largas sin perder el hilo.
  • Aun así, sigue existiendo un límite concreto en cualquier modelo, y superarlo obliga a que la información más antigua empiece a «caerse» fuera de lo que el modelo puede tener en cuenta.

Un matiz que sorprende a muchos usuarios: tener espacio no significa usarlo igual de bien

Que un modelo técnicamente admita una ventana de contexto muy grande no garantiza que preste la misma atención a toda la información dentro de ella: en la práctica, muchos modelos tienden a prestar más atención al principio y al final del contexto proporcionado, con cierto riesgo de que información relevante situada justo en medio de un documento muy largo reciba menos peso real en la respuesta final generada.

Implicaciones prácticas para quien trabaja con estas herramientas

En conversaciones muy largas, conviene resumir periódicamente los puntos clave ya tratados, en lugar de asumir que el modelo recuerda con precisión absoluta todo lo dicho desde el principio. Al trabajar con documentos extensos, situar la información más crítica al principio o al final del texto enviado, en lugar de enterrarla en medio de un bloque enorme, suele mejorar la probabilidad de que el modelo la tenga realmente en cuenta al generar su respuesta.

Términos relacionados.

0%