O que é uma janela de contexto — e qual o tamanho da sua?
Uma janela de contexto é a quantidade máxima de tokens que um modelo de IA pode processar em uma única solicitação. Inclui suas instruções, a conversa, os documentos e a resposta do modelo. Os modelos atuais variam de 200.000 a cerca de 1.050.000 tokens.
O que realmente cabe
| Tamanho de contexto | Palavras (inglês) | O que é |
|---|---|---|
| 2,000 | ≈ 1,500 | um thread de e-mails longo ou notas de reunião |
| 8,192 | ≈ 6,100 | um guia técnico extenso |
| 32,000 | ≈ 24,000 | um whitepaper com anexos |
| 131,072 (128K) | ≈ 98,000 | um romance completo |
| 200,000 | ≈ 150,000 | um livro de 300–500 páginas — janela tipo Claude Haiku |
| 500,000 | ≈ 375,000 | a revisão de uma base de código grande — janela tipo Grok |
| 1,000,000 | ≈ 750,000 | cerca de dez romances — janelas atuais de topo |
Os equivalentes em palavras usam a proporção de planejamento 1 token ≈ 0,75 palavras. A janela é compartilhada: instruções, histórico, evidências e resposta saem do mesmo orçamento.
A janela de contexto de cada modelo
| Modelo | Provedor | Janela de contexto | Saída máxima | Preços de contexto longo |
|---|---|---|---|---|
| GPT-5.6 Sol | OpenAI | 1,050,000 (1.05M) | 128,000 | Faixas acima de 272K |
| GPT-5.6 Terra | OpenAI | 1,050,000 (1.05M) | 128,000 | Faixas acima de 272K |
| GPT-5.6 Luna | OpenAI | 1,050,000 (1.05M) | 128,000 | Faixas acima de 272K |
| Gemini 3.1 Pro Preview | 1,048,576 (1.05M) | 65,536 | Faixas acima de 200K | |
| Gemini 3.6 Flash | 1,048,576 (1.05M) | 65,536 | Tarifas padrão | |
| Gemini 3.7 Flash | 1,048,576 (1.05M) | 65,536 | Tarifas padrão | |
| Gemini 3.5 Flash-Lite | 1,048,576 (1.05M) | 65,536 | Tarifas padrão | |
| Kimi K3 | Moonshot | 1,048,576 (1.05M) | — | Tarifas padrão |
| DeepSeek V4 Pro | DeepSeek | 1,048,576 (1.05M) | 384,000 | Tarifas padrão |
| DeepSeek V4 Flash | DeepSeek | 1,048,576 (1.05M) | 390,000 | Tarifas padrão |
| Claude Fable 5 | Anthropic | 1,000,000 (1M) | 128,000 | Tarifas padrão |
| Claude Mythos 5 | Anthropic | 1,000,000 (1M) | 128,000 | Tarifas padrão |
| Claude Opus 5 | Anthropic | 1,000,000 (1M) | 128,000 | Tarifas padrão |
| Claude Sonnet 5 | Anthropic | 1,000,000 (1M) | 128,000 | Tarifas padrão |
| Qwen 3.8 Max | Alibaba | 1,000,000 (1M) | 131,000 | Tarifas padrão |
| Llama 4 Maverick | Meta | 1,000,000 (1M) | — | Tarifas padrão |
| Grok 4.6 | xAI | 500,000 (500K) | 128,000 | Faixas acima de 200K |
| Grok 4.5 | xAI | 500,000 (500K) | 128,000 | Faixas acima de 200K |
| Kimi K2.7 Code | Moonshot | 262,144 (262K) | — | Tarifas padrão |
| Mistral Large 3 | Mistral | 262,144 (262K) | — | Tarifas padrão |
| Command A | Cohere | 256,000 (256K) | 64,000 | Tarifas padrão |
| Claude Haiku 4.5 | Anthropic | 200,000 (200K) | 64,000 | Tarifas padrão |
| Sonar Pro | Perplexity | 200,000 (200K) | — | Tarifas padrão |
Perguntas sobre janelas de contexto
O que é uma janela de contexto?
A quantidade máxima de tokens que um modelo pode processar em uma solicitação, cobrindo instruções, conversa, documentos, ferramentas e a resposta. Os modelos principais oferecem hoje de 200K a ~1,05M de tokens.
O que cabe em uma janela de 200K tokens?
Aproximadamente 150.000 palavras em inglês — um livro de 300 a 500 páginas ou uma base de código média. A janela é compartilhada com a resposta, então a capacidade efetiva é um pouco menor.
Todos os modelos têm 1 milhão de tokens de contexto?
Não. Fable/Opus/Sonnet da Anthropic, GPT-5.6 da OpenAI, Gemini do Google, Kimi K3 e DeepSeek V4 oferecem ~1M; Grok chega a 500K e vários modelos ficam em 200–262K.
Uma janela de contexto maior custa mais?
Muitas vezes sim. A OpenAI dobra a entrada acima de 272K tokens, a xAI dobra as tarifas a partir de 200K e o Gemini 3.1 Pro cobra US$ 4/18 acima de 200K em vez de US$ 2/12.