Apa itu jendela konteks — dan seberapa besar milik Anda?
Jendela konteks adalah jumlah token maksimum yang bisa diproses model AI dalam satu permintaan. Termasuk instruksi Anda, percakapan, dokumen, dan balasan model. Model saat ini berkisar 200.000 hingga sekitar 1.050.000 token.
Apa yang sebenarnya muat
| Ukuran konteks | Kata (Inggris) | Itu apa |
|---|---|---|
| 2,000 | ≈ 1,500 | utas email panjang atau catatan rapat |
| 8,192 | ≈ 6,100 | panduan teknis yang panjang |
| 32,000 | ≈ 24,000 | whitepaper dengan lampiran |
| 131,072 (128K) | ≈ 98,000 | satu novel utuh |
| 200,000 | ≈ 150,000 | buku 300–500 halaman — jendela kelas Claude Haiku |
| 500,000 | ≈ 375,000 | review basis kode besar — jendela kelas Grok |
| 1,000,000 | ≈ 750,000 | sekitar sepuluh novel — jendela flagship terkini |
Setara kata memakai rasio perencanaan 1 token ≈ 0,75 kata. Jendela dibagi: instruksi, riwayat, bukti, dan jawaban semuanya dari anggaran yang sama.
Jendela konteks setiap model
| Model | Penyedia | Jendela konteks | Output maks | Harga konteks panjang |
|---|---|---|---|---|
| GPT-5.6 Sol | OpenAI | 1,050,000 (1.05M) | 128,000 | Tingkat di atas 272K |
| GPT-5.6 Terra | OpenAI | 1,050,000 (1.05M) | 128,000 | Tingkat di atas 272K |
| GPT-5.6 Luna | OpenAI | 1,050,000 (1.05M) | 128,000 | Tingkat di atas 272K |
| Gemini 3.1 Pro Preview | 1,048,576 (1.05M) | 65,536 | Tingkat di atas 200K | |
| Gemini 3.6 Flash | 1,048,576 (1.05M) | 65,536 | Tarif standar | |
| Gemini 3.7 Flash | 1,048,576 (1.05M) | 65,536 | Tarif standar | |
| Gemini 3.5 Flash-Lite | 1,048,576 (1.05M) | 65,536 | Tarif standar | |
| Kimi K3 | Moonshot | 1,048,576 (1.05M) | — | Tarif standar |
| DeepSeek V4 Pro | DeepSeek | 1,048,576 (1.05M) | 384,000 | Tarif standar |
| DeepSeek V4 Flash | DeepSeek | 1,048,576 (1.05M) | 390,000 | Tarif standar |
| Claude Fable 5 | Anthropic | 1,000,000 (1M) | 128,000 | Tarif standar |
| Claude Mythos 5 | Anthropic | 1,000,000 (1M) | 128,000 | Tarif standar |
| Claude Opus 5 | Anthropic | 1,000,000 (1M) | 128,000 | Tarif standar |
| Claude Sonnet 5 | Anthropic | 1,000,000 (1M) | 128,000 | Tarif standar |
| Qwen 3.8 Max | Alibaba | 1,000,000 (1M) | 131,000 | Tarif standar |
| Llama 4 Maverick | Meta | 1,000,000 (1M) | — | Tarif standar |
| Grok 4.6 | xAI | 500,000 (500K) | 128,000 | Tingkat di atas 200K |
| Grok 4.5 | xAI | 500,000 (500K) | 128,000 | Tingkat di atas 200K |
| Kimi K2.7 Code | Moonshot | 262,144 (262K) | — | Tarif standar |
| Mistral Large 3 | Mistral | 262,144 (262K) | — | Tarif standar |
| Command A | Cohere | 256,000 (256K) | 64,000 | Tarif standar |
| Claude Haiku 4.5 | Anthropic | 200,000 (200K) | 64,000 | Tarif standar |
| Sonar Pro | Perplexity | 200,000 (200K) | — | Tarif standar |
Pertanyaan jendela konteks
Apa itu jendela konteks?
Jumlah token maksimum yang bisa diproses model dalam satu permintaan, mencakup instruksi, percakapan, dokumen, alat, dan jawaban. Model utama saat ini menawarkan 200K hingga ~1,05M token.
Apa yang muat dalam jendela konteks 200K?
Kira-kira 150.000 kata bahasa Inggris — buku 300–500 halaman atau basis kode menengah. Jendela dibagi dengan jawaban, jadi kapasitas efektif sedikit lebih kecil.
Apakah semua model punya konteks 1 juta token?
Tidak. Fable/Opus/Sonnet Anthropic, GPT-5.6 OpenAI, Gemini Google, Kimi K3, dan DeepSeek V4 menawarkan ~1M; Grok mentok 500K dan beberapa model di 200–262K.
Apakah jendela konteks lebih besar lebih mahal?
Sering ya. OpenAI menggandakan input di atas 272K token, xAI menggandakan tarif pada prompt 200K+, dan Gemini 3.1 Pro mengenakan $4/$18 di atas 200K alih-alih $2/$12.