¿Qué es una ventana de contexto y qué tamaño tiene la tuya?
Una ventana de contexto es la cantidad máxima de tokens que un modelo de IA puede procesar en una sola solicitud. Incluye tus instrucciones, la conversación, los documentos y la respuesta del modelo. Los modelos actuales van de 200.000 a cerca de 1.050.000 tokens.
Qué cabe realmente
| Tamaño de contexto | Palabras (inglés) | Qué es |
|---|---|---|
| 2,000 | ≈ 1,500 | un hilo de correos largo o notas de reunión |
| 8,192 | ≈ 6,100 | una guía técnica extensa |
| 32,000 | ≈ 24,000 | un informe técnico con anexos |
| 131,072 (128K) | ≈ 98,000 | una novela completa |
| 200,000 | ≈ 150,000 | un libro de 300–500 páginas — ventana tipo Claude Haiku |
| 500,000 | ≈ 375,000 | la revisión de un código base grande — ventana tipo Grok |
| 1,000,000 | ≈ 750,000 | unas diez novelas — ventanas actuales de gama alta |
Los equivalentes en palabras usan el ratio de planificación 1 token ≈ 0,75 palabras. La ventana es compartida: instrucciones, historial, evidencia y respuesta salen del mismo presupuesto.
La ventana de contexto de cada modelo
| Modelo | Proveedor | Ventana de contexto | Salida máxima | Precios de contexto largo |
|---|---|---|---|---|
| GPT-5.6 Sol | OpenAI | 1,050,000 (1.05M) | 128,000 | Tramos desde 272K |
| GPT-5.6 Terra | OpenAI | 1,050,000 (1.05M) | 128,000 | Tramos desde 272K |
| GPT-5.6 Luna | OpenAI | 1,050,000 (1.05M) | 128,000 | Tramos desde 272K |
| Gemini 3.1 Pro Preview | 1,048,576 (1.05M) | 65,536 | Tramos desde 200K | |
| Gemini 3.6 Flash | 1,048,576 (1.05M) | 65,536 | Tarifas estándar | |
| Gemini 3.7 Flash | 1,048,576 (1.05M) | 65,536 | Tarifas estándar | |
| Gemini 3.5 Flash-Lite | 1,048,576 (1.05M) | 65,536 | Tarifas estándar | |
| Kimi K3 | Moonshot | 1,048,576 (1.05M) | — | Tarifas estándar |
| DeepSeek V4 Pro | DeepSeek | 1,048,576 (1.05M) | 384,000 | Tarifas estándar |
| DeepSeek V4 Flash | DeepSeek | 1,048,576 (1.05M) | 390,000 | Tarifas estándar |
| Claude Fable 5 | Anthropic | 1,000,000 (1M) | 128,000 | Tarifas estándar |
| Claude Mythos 5 | Anthropic | 1,000,000 (1M) | 128,000 | Tarifas estándar |
| Claude Opus 5 | Anthropic | 1,000,000 (1M) | 128,000 | Tarifas estándar |
| Claude Sonnet 5 | Anthropic | 1,000,000 (1M) | 128,000 | Tarifas estándar |
| Qwen 3.8 Max | Alibaba | 1,000,000 (1M) | 131,000 | Tarifas estándar |
| Llama 4 Maverick | Meta | 1,000,000 (1M) | — | Tarifas estándar |
| Grok 4.6 | xAI | 500,000 (500K) | 128,000 | Tramos desde 200K |
| Grok 4.5 | xAI | 500,000 (500K) | 128,000 | Tramos desde 200K |
| Kimi K2.7 Code | Moonshot | 262,144 (262K) | — | Tarifas estándar |
| Mistral Large 3 | Mistral | 262,144 (262K) | — | Tarifas estándar |
| Command A | Cohere | 256,000 (256K) | 64,000 | Tarifas estándar |
| Claude Haiku 4.5 | Anthropic | 200,000 (200K) | 64,000 | Tarifas estándar |
| Sonar Pro | Perplexity | 200,000 (200K) | — | Tarifas estándar |
Preguntas sobre ventanas de contexto
¿Qué es una ventana de contexto?
La cantidad máxima de tokens que un modelo puede procesar en una solicitud, cubriendo instrucciones, conversación, documentos, herramientas y la respuesta. Los modelos principales ofrecen hoy de 200K a ~1,05M tokens.
¿Qué cabe en una ventana de 200K tokens?
Aproximadamente 150.000 palabras en inglés — un libro de 300 a 500 páginas o un código base mediano. La ventana se comparte con la respuesta, así que la capacidad efectiva es algo menor.
¿Todos los modelos tienen 1 millón de tokens de contexto?
No. Fable/Opus/Sonnet de Anthropic, GPT-5.6 de OpenAI, Gemini de Google, Kimi K3 y DeepSeek V4 ofrecen ~1M; Grok llega a 500K y varios modelos se quedan en 200–262K.
¿Una ventana de contexto más grande cuesta más?
A menudo sí. OpenAI duplica la entrada por encima de 272K tokens, xAI duplica las tarifas desde 200K y Gemini 3.1 Pro cobra 4/18 USD por encima de 200K en vez de 2/12 USD.