Ventanas de contexto, explicadas

¿Qué es una ventana de contexto y qué tamaño tiene la tuya?

Una ventana de contexto es la cantidad máxima de tokens que un modelo de IA puede procesar en una sola solicitud. Incluye tus instrucciones, la conversación, los documentos y la respuesta del modelo. Los modelos actuales van de 200.000 a cerca de 1.050.000 tokens.

Gratis · sin registroDatos de precios y modelos verificados en agosto de 2026.23 models · Aug 16, 2026
Qué cabe realmente

Qué cabe realmente

Tamaño de contextoPalabras (inglés)Qué es
2,0001,500un hilo de correos largo o notas de reunión
8,1926,100una guía técnica extensa
32,00024,000un informe técnico con anexos
131,072 (128K)98,000una novela completa
200,000150,000un libro de 300–500 páginas — ventana tipo Claude Haiku
500,000375,000la revisión de un código base grande — ventana tipo Grok
1,000,000750,000unas diez novelas — ventanas actuales de gama alta

Los equivalentes en palabras usan el ratio de planificación 1 token ≈ 0,75 palabras. La ventana es compartida: instrucciones, historial, evidencia y respuesta salen del mismo presupuesto.

La ventana de contexto de cada modelo

La ventana de contexto de cada modelo

ModeloProveedorVentana de contextoSalida máximaPrecios de contexto largo
GPT-5.6 SolOpenAI1,050,000 (1.05M)128,000Tramos desde 272K
GPT-5.6 TerraOpenAI1,050,000 (1.05M)128,000Tramos desde 272K
GPT-5.6 LunaOpenAI1,050,000 (1.05M)128,000Tramos desde 272K
Gemini 3.1 Pro PreviewGoogle1,048,576 (1.05M)65,536Tramos desde 200K
Gemini 3.6 FlashGoogle1,048,576 (1.05M)65,536Tarifas estándar
Gemini 3.7 FlashGoogle1,048,576 (1.05M)65,536Tarifas estándar
Gemini 3.5 Flash-LiteGoogle1,048,576 (1.05M)65,536Tarifas estándar
Kimi K3Moonshot1,048,576 (1.05M)Tarifas estándar
DeepSeek V4 ProDeepSeek1,048,576 (1.05M)384,000Tarifas estándar
DeepSeek V4 FlashDeepSeek1,048,576 (1.05M)390,000Tarifas estándar
Claude Fable 5Anthropic1,000,000 (1M)128,000Tarifas estándar
Claude Mythos 5Anthropic1,000,000 (1M)128,000Tarifas estándar
Claude Opus 5Anthropic1,000,000 (1M)128,000Tarifas estándar
Claude Sonnet 5Anthropic1,000,000 (1M)128,000Tarifas estándar
Qwen 3.8 MaxAlibaba1,000,000 (1M)131,000Tarifas estándar
Llama 4 MaverickMeta1,000,000 (1M)Tarifas estándar
Grok 4.6xAI500,000 (500K)128,000Tramos desde 200K
Grok 4.5xAI500,000 (500K)128,000Tramos desde 200K
Kimi K2.7 CodeMoonshot262,144 (262K)Tarifas estándar
Mistral Large 3Mistral262,144 (262K)Tarifas estándar
Command ACohere256,000 (256K)64,000Tarifas estándar
Claude Haiku 4.5Anthropic200,000 (200K)64,000Tarifas estándar
Sonar ProPerplexity200,000 (200K)Tarifas estándar
Preguntas sobre ventanas de contexto

Preguntas sobre ventanas de contexto

¿Qué es una ventana de contexto?

La cantidad máxima de tokens que un modelo puede procesar en una solicitud, cubriendo instrucciones, conversación, documentos, herramientas y la respuesta. Los modelos principales ofrecen hoy de 200K a ~1,05M tokens.

¿Qué cabe en una ventana de 200K tokens?

Aproximadamente 150.000 palabras en inglés — un libro de 300 a 500 páginas o un código base mediano. La ventana se comparte con la respuesta, así que la capacidad efectiva es algo menor.

¿Todos los modelos tienen 1 millón de tokens de contexto?

No. Fable/Opus/Sonnet de Anthropic, GPT-5.6 de OpenAI, Gemini de Google, Kimi K3 y DeepSeek V4 ofrecen ~1M; Grok llega a 500K y varios modelos se quedan en 200–262K.

¿Una ventana de contexto más grande cuesta más?

A menudo sí. OpenAI duplica la entrada por encima de 272K tokens, xAI duplica las tarifas desde 200K y Gemini 3.1 Pro cobra 4/18 USD por encima de 200K en vez de 2/12 USD.