Janelas de contexto, explicadas

O que é uma janela de contexto — e qual o tamanho da sua?

Uma janela de contexto é a quantidade máxima de tokens que um modelo de IA pode processar em uma única solicitação. Inclui suas instruções, a conversa, os documentos e a resposta do modelo. Os modelos atuais variam de 200.000 a cerca de 1.050.000 tokens.

Grátis · sem cadastroDados de preços e modelos verificados em agosto de 2026.23 models · Aug 16, 2026
O que realmente cabe

O que realmente cabe

Tamanho de contextoPalavras (inglês)O que é
2,0001,500um thread de e-mails longo ou notas de reunião
8,1926,100um guia técnico extenso
32,00024,000um whitepaper com anexos
131,072 (128K)98,000um romance completo
200,000150,000um livro de 300–500 páginas — janela tipo Claude Haiku
500,000375,000a revisão de uma base de código grande — janela tipo Grok
1,000,000750,000cerca de dez romances — janelas atuais de topo

Os equivalentes em palavras usam a proporção de planejamento 1 token ≈ 0,75 palavras. A janela é compartilhada: instruções, histórico, evidências e resposta saem do mesmo orçamento.

A janela de contexto de cada modelo

A janela de contexto de cada modelo

ModeloProvedorJanela de contextoSaída máximaPreços de contexto longo
GPT-5.6 SolOpenAI1,050,000 (1.05M)128,000Faixas acima de 272K
GPT-5.6 TerraOpenAI1,050,000 (1.05M)128,000Faixas acima de 272K
GPT-5.6 LunaOpenAI1,050,000 (1.05M)128,000Faixas acima de 272K
Gemini 3.1 Pro PreviewGoogle1,048,576 (1.05M)65,536Faixas acima de 200K
Gemini 3.6 FlashGoogle1,048,576 (1.05M)65,536Tarifas padrão
Gemini 3.7 FlashGoogle1,048,576 (1.05M)65,536Tarifas padrão
Gemini 3.5 Flash-LiteGoogle1,048,576 (1.05M)65,536Tarifas padrão
Kimi K3Moonshot1,048,576 (1.05M)Tarifas padrão
DeepSeek V4 ProDeepSeek1,048,576 (1.05M)384,000Tarifas padrão
DeepSeek V4 FlashDeepSeek1,048,576 (1.05M)390,000Tarifas padrão
Claude Fable 5Anthropic1,000,000 (1M)128,000Tarifas padrão
Claude Mythos 5Anthropic1,000,000 (1M)128,000Tarifas padrão
Claude Opus 5Anthropic1,000,000 (1M)128,000Tarifas padrão
Claude Sonnet 5Anthropic1,000,000 (1M)128,000Tarifas padrão
Qwen 3.8 MaxAlibaba1,000,000 (1M)131,000Tarifas padrão
Llama 4 MaverickMeta1,000,000 (1M)Tarifas padrão
Grok 4.6xAI500,000 (500K)128,000Faixas acima de 200K
Grok 4.5xAI500,000 (500K)128,000Faixas acima de 200K
Kimi K2.7 CodeMoonshot262,144 (262K)Tarifas padrão
Mistral Large 3Mistral262,144 (262K)Tarifas padrão
Command ACohere256,000 (256K)64,000Tarifas padrão
Claude Haiku 4.5Anthropic200,000 (200K)64,000Tarifas padrão
Sonar ProPerplexity200,000 (200K)Tarifas padrão
Perguntas sobre janelas de contexto

Perguntas sobre janelas de contexto

O que é uma janela de contexto?

A quantidade máxima de tokens que um modelo pode processar em uma solicitação, cobrindo instruções, conversa, documentos, ferramentas e a resposta. Os modelos principais oferecem hoje de 200K a ~1,05M de tokens.

O que cabe em uma janela de 200K tokens?

Aproximadamente 150.000 palavras em inglês — um livro de 300 a 500 páginas ou uma base de código média. A janela é compartilhada com a resposta, então a capacidade efetiva é um pouco menor.

Todos os modelos têm 1 milhão de tokens de contexto?

Não. Fable/Opus/Sonnet da Anthropic, GPT-5.6 da OpenAI, Gemini do Google, Kimi K3 e DeepSeek V4 oferecem ~1M; Grok chega a 500K e vários modelos ficam em 200–262K.

Uma janela de contexto maior custa mais?

Muitas vezes sim. A OpenAI dobra a entrada acima de 272K tokens, a xAI dobra as tarifas a partir de 200K e o Gemini 3.1 Pro cobra US$ 4/18 acima de 200K em vez de US$ 2/12.