Qué es exactamente
El contexto es todo lo que el modelo “ve” cuando genera una respuesta: tu pregunta actual, las preguntas previas de la conversación, los documentos que has adjuntado, las instrucciones del sistema. Todo eso compone la ventana de contexto.
La ventana de contexto se mide en tokens (un token equivale aproximadamente a 0.75 palabras en español).
Tamaños habituales en 2026
| Modelo | Ventana de contexto |
|---|---|
| ChatGPT (GPT-4.1) | 128.000 tokens |
| Claude Sonnet 4.6 | 200.000 tokens |
| Claude Opus 4.7 | 200.000 tokens (1M en beta) |
| Gemini 2.5 Pro | 2.000.000 tokens |
Para que te hagas una idea: 200.000 tokens son aproximadamente 150.000 palabras o un libro entero. 2 millones de tokens son una biblioteca pequeña.
Por qué importa el tamaño
Cuanto mayor la ventana de contexto, más información puede procesar el modelo en una sola petición:
- Analizar contratos largos sin dividirlos en trozos.
- Resumir libros enteros o transcripciones de reuniones largas.
- Mantener conversaciones extensas sin perder el hilo.
- Procesar bases de código completas.
- Comparar varios documentos simultáneamente.
Pero no es gratis
- Coste: la mayoría de APIs cobra por token procesado. Una pregunta con 100.000 tokens de contexto puede costar 1-3€.
- Latencia: cuanto más contexto, más tarda la respuesta.
- Calidad: aunque el modelo soporte 1M tokens, su precisión puede degradarse con contextos muy largos (es el fenómeno needle in a haystack).
Por qué importa en empresa
Conocer el tamaño de la ventana ayuda a elegir modelo: para tareas con documentos largos, Claude o Gemini. Para conversación interactiva ligera, ChatGPT es perfectamente capaz. Para procesar miles de tickets por lote, el coste por token es la métrica clave.