AI Calculator Pro

Model Context Window Comparison

Compare context windows across all models.

Quick answer

With the default inputs, Context windows compared — 326 models ranked by context size. Enter your own numbers below to recompute instantly; the full step-by-step math is shown under the worked example.

Result
Context windows compared
326 models ranked by context size
Llama 4 ScoutMeta10,000,0008,192
Grok 4.20xAI2,000,0001,800,000
GPT-5.4OpenAI1,050,000128,000
GPT-5.4 ProOpenAI1,050,000128,000
GPT-5.5OpenAI1,050,000128,000
GPT-5.5 ProOpenAI1,050,000128,000
GPT-5.6OpenAI1,050,000128,000
GPT-5.6 LunaOpenAI1,050,000128,000
GPT-5.6 SolOpenAI1,050,000128,000
GPT-5.6 TerraOpenAI1,050,000128,000
GPT 5.6 Luna ProOpenAI1,050,000128,000
GPT 5.6 Sol ProOpenAI1,050,000128,000
GPT 5.6 Terra ProOpenAI1,050,000128,000
Gemini 2.5 ProGoogle1,048,57665,536
Kimi K3Moonshot AI1,048,576131,072
MiMo-V2.5-ProXiaomi1,048,576131,072
MiMo-V2.5Xiaomi1,048,576131,072
Gemini 2.0 FlashGoogle1,048,5768,192
Gemini 2.0 Flash-LiteGoogle1,048,5768,192
Gemini 3.1 Flash LiteGoogle1,048,57665,536
Gemini 3.5 FlashGoogle1,048,57665,536
MiMo-V2.5-Pro-UltraSpeedXiaomi1,048,576131,072
MiMo-V2-ProXiaomi1,048,576131,072
Qwen3 Coder PlusAlibaba1,048,57665,536
Gemini 3.5 Flash LiteGoogle1,048,57665,536
Gemini 3.6 FlashGoogle1,048,57665,536
Gemini 3.7 FlashGoogle1,048,57665,536
Muse Spark 1.2Meta1,048,576131,072
Muse Spark 1.2 ContributorMeta1,048,576131,072
Gemini 3.1 Pro PreviewGoogle1,048,57665,536
Gemini 3 FlashGoogle1,048,57665,536
Gemini 3 ProGoogle1,048,57665,536
GLM 5.2 FastZ.ai (Zhipu AI)1,048,5601,048,560
Kimi K3 FastMoonshot AI1,048,5601,048,560
MiniMax 01MiniMax1,000,19216,384
GPT-4.1OpenAI1,000,00032,768
GPT-4.1 MiniOpenAI1,000,00032,768
GPT-4.1 NanoOpenAI1,000,00032,768
Claude Opus 4.8Anthropic1,000,00064,000
Claude Opus 4.8 (Bedrock)AWS Bedrock1,000,000128,000
Claude Opus 4.6Anthropic1,000,00064,000
Claude Opus 4.6 (Bedrock)AWS Bedrock1,000,000128,000
Claude Sonnet 4.6Anthropic1,000,00064,000
Anthropic Claude Sonnet 4.6 (Bedrock)AWS Bedrock1,000,000128,000
Claude Sonnet 5Anthropic1,000,00064,000
Claude Sonnet 5 (Bedrock)AWS Bedrock1,000,000128,000
Claude Fable 5Anthropic1,000,00064,000
Claude Fable 5 (Bedrock)AWS Bedrock1,000,000128,000
Gemini 2.5 FlashGoogle1,000,00065,536
Gemini 2.5 Flash-LiteGoogle1,000,00065,536
Amazon Nova PremierAWS Bedrock1,000,00010,000
Llama 4 MaverickMeta1,000,0008,192
DeepSeek V4 FlashDeepSeek1,000,0008,192
DeepSeek V4 ProDeepSeek1,000,0008,192
Grok 4.3xAI1,000,000
Grok 4.3 (Bedrock)AWS Bedrock1,000,000131,072
Qwen3.6 PlusAlibaba1,000,00065,536
Qwen3.6 FlashAlibaba1,000,00065,536
GLM-5.2Z.ai (Zhipu AI)1,000,000131,072
MiniMax-M3MiniMax1,000,000128,000
Nemotron 3 Ultra 550B A55BNvidia1,000,000128,000
Claude Opus 4.7Anthropic1,000,000128,000
Claude Opus 4.7 (Bedrock)AWS Bedrock1,000,000128,000
Claude Sonnet 4.5 (latest)Anthropic1,000,00064,000
DeepSeek ChatDeepSeek1,000,000384,000
DeepSeek ReasonerDeepSeek1,000,000384,000
Muse Spark 1.1Meta1,000,00032,000
Qwen FlashAlibaba1,000,00032,768
Qwen PlusAlibaba1,000,00032,768
Qwen TurboAlibaba1,000,00016,384
Qwen3.5 PlusAlibaba1,000,00065,536
Qwen3.7 MaxAlibaba1,000,00065,536
Qwen3.7 PlusAlibaba1,000,00065,536
Qwen3 Coder FlashAlibaba1,000,00065,536
Claude Opus 5Anthropic1,000,000128,000
Claude Opus 5 (Bedrock)AWS Bedrock1,000,000128,000
GLM-5.3Z.ai (Zhipu AI)1,000,000131,072
GLM-5.3-FlashZ.ai (Zhipu AI)1,000,000131,072
Qwen3.8 MaxAlibaba1,000,000131,072
GLM-5.2Mistral AI1,000,000131,072
Claude Opus 4.8 FastAnthropic1,000,000128,000
Claude Opus 5 FastAnthropic1,000,000128,000
MiniMax M1MiniMax1,000,000128,000
MiniMax M1 80KMiniMax1,000,00040,000
Nova 2 Lite (Bedrock)AWS Bedrock1,000,00065,535
Qwen3.5 FlashAlibaba1,000,000250,000
Qwen3.7 FlashAlibaba1,000,00065,536
Qwen3.8 FlashAlibaba991,808131,072
Claude Sonnet 4Anthropic983,04064,000
Grok 4.5xAI500,000
Grok 4.6xAI500,000500,000
Grok 4.6 (Bedrock)AWS Bedrock500,000500,000
GPT-5.1OpenAI400,000128,000
GPT-5.1 CodexOpenAI400,000128,000
GPT-5.1 Codex MaxOpenAI400,000128,000
GPT-5.1 Codex miniOpenAI400,000128,000
GPT-5.2OpenAI400,000128,000
GPT-5.2 CodexOpenAI400,000128,000
GPT-5.2 ProOpenAI400,000128,000
GPT-5.3 CodexOpenAI400,000128,000
GPT-5.4 miniOpenAI400,000128,000
GPT-5.4 nanoOpenAI400,000128,000
GPT-5-CodexOpenAI400,000128,000
GPT-5 NanoOpenAI400,000128,000
GPT-5 ProOpenAI400,000272,000
glm-5-2-fp8Z.ai (Zhipu AI)393,216131,072
Llama 4 Scout 17B 16E InstructMeta327,68016,384
Amazon Nova ProAWS Bedrock300,0005,120
Amazon Nova LiteAWS Bedrock300,0005,120
Nemotron 3 Nano OmniNvidia300,000300,000
nova-lite-v1 (Bedrock)AWS Bedrock300,0005,120
Nova Pro 1.0 (Bedrock)AWS Bedrock300,00032,000
GPT-5.4 (Bedrock)AWS Bedrock272,000128,000
GPT-5.5 (Bedrock)AWS Bedrock272,000128,000
GPT-5.6 Luna (Bedrock)AWS Bedrock272,000128,000
GPT-5.6 Sol (Bedrock)AWS Bedrock272,000128,000
GPT-5.6 Terra (Bedrock)AWS Bedrock272,000128,000
Kimi K2.7 CodeMoonshot AI262,144262,144
Qwen3 MaxAlibaba262,14465,536
Nemotron 3 Super 120B A12BNvidia262,144262,144
Nemotron 3 Nano 30B A3BNvidia262,14465,536
Hunyuan Hy3Tencent262,14464,000
Kimi K2.5Moonshot AI262,144262,144
Kimi K2.6Moonshot AI262,144262,144
Kimi K2.7 Code HighSpeedMoonshot AI262,144262,144
Kimi K2 ThinkingMoonshot AI262,144262,144
Kimi K2 Thinking TurboMoonshot AI262,144262,144
MiMo-V2-FlashXiaomi262,14465,536
MiMo-V2-OmniXiaomi262,144131,072
NVIDIA Nemotron 3 Super 120B A12B (Bedrock)AWS Bedrock262,144131,072
qwen3-coder-nextAlibaba262,144262,144
Qwen3.5 122B-A10BAlibaba262,14465,536
Qwen3.5 27BAlibaba262,14465,536
Qwen3.5 35B-A3BAlibaba262,14465,536
Qwen3.5 397B-A17BAlibaba262,14465,536
Qwen3.6 27BAlibaba262,14465,536
Qwen3.6 35B-A3BAlibaba262,14465,536
Qwen3-Coder 30B-A3B InstructAlibaba262,14465,536
Qwen3-Coder 480B-A35B InstructAlibaba262,14465,536
Qwen3-VL PlusAlibaba262,14432,768
Gemma 4 26B A4B ITGoogle262,14416,384
Gemma 4 31B ITGoogle262,144131,072
Kimi K2Moonshot AI262,144262,144
Mistral Medium 3.5 128BMistral AI262,144131,072
Nemotron 3.5 Lightning 30BNvidia262,144131,072
Qwen3.5 9BAlibaba262,144262,144
Qwen3.8 2.4T A95BAlibaba262,144262,144
Qwen3.8 27BAlibaba262,14432,768
Qwen3 Max ThinkingAlibaba262,14465,536
Qwen3 VL 235B A22B InstructAlibaba262,14432,768
Qwen3 VL 30B A3B InstructAlibaba262,14432,768
Kimi K2.5 (Bedrock)AWS Bedrock262,14316,000
Kimi K2 Thinking (Bedrock)AWS Bedrock262,14316,000
Mistral Large 3Mistral AI262,0008,192
Devstral 2Mistral AI262,0008,192
Qwen/Qwen3-Next-80B-A3B-Instruct (Bedrock)AWS Bedrock262,000262,000
Qwen/Qwen3-VL-235B-A22B-Instruct (Bedrock)AWS Bedrock262,000262,000
Qwen3 CoderAlibaba262,00065,536
Mistral Large 3 (Bedrock)AWS Bedrock256,0008,192
Command ACohere256,0008,000
MAI-Code-1-FlashMicrosoft256,000128,000
Step 3.7 FlashStepFun256,000256,000
Devstral 2 123B (Bedrock)AWS Bedrock256,0008,192
Ministral 3 3B (Bedrock)AWS Bedrock256,0008,192
Step 3.5 FlashStepFun256,000256,000
Grok 4xAI256,000256,000
Grok Code Fast 1xAI256,000256,000
Kimi K2 InstructMoonshot AI256,0008,192
mistral-medium-3-5Mistral AI256,000256,000
nvidia-nemotron-3-nano-30b-a3bNvidia256,000256,000
GLM-5Z.ai (Zhipu AI)204,800131,072
MiniMax-M2.7MiniMax204,800131,072
GLM-4.6Z.ai (Zhipu AI)204,800131,072
GLM-4.7Z.ai (Zhipu AI)204,800131,072
GLM-4.7 (Bedrock)AWS Bedrock204,800131,072
MiniMax-M2.1MiniMax204,800131,072
MiniMax M2.1 (Bedrock)AWS Bedrock204,800131,072
MiniMax-M2.5MiniMax204,800131,072
MiniMax-M2.5-highspeedMiniMax204,800131,072
MiniMax-M2.7-highspeedMiniMax204,800131,072
MiniMax M2 (Bedrock)AWS Bedrock204,608128,000
NVIDIA Nemotron 3 UltraNvidia202,800202,800
GLM-5 (Bedrock)AWS Bedrock202,752101,376
Google Gemma 3 27B Instruct (Bedrock)AWS Bedrock202,7528,192
GLM-5.1 FP8Z.ai (Zhipu AI)202,752131,072
o3OpenAI200,000100,000
o4-miniOpenAI200,000100,000
Claude Haiku 4.5Anthropic200,0008,192
Sonar ProPerplexity200,000
Claude Opus 4.1 (latest)Anthropic200,00032,000
Claude Opus 4.5 (latest)Anthropic200,00064,000
GLM-4.7-FlashZ.ai (Zhipu AI)200,000131,072
GLM-4.7-Flash (Bedrock)AWS Bedrock200,000131,072
GLM-4.7-FlashXZ.ai (Zhipu AI)200,000131,072
GLM-5.1Z.ai (Zhipu AI)200,000131,072
GLM-5-TurboZ.ai (Zhipu AI)200,000131,072
GLM-5V-TurboZ.ai (Zhipu AI)200,000131,072
o1OpenAI200,000100,000
o1-proOpenAI200,000100,000
o3-deep-researchOpenAI200,000100,000
o3-miniOpenAI200,000100,000
o3-proOpenAI200,000100,000
o4-mini-deep-researchOpenAI200,000100,000
Claude 3.5 HaikuAnthropic200,00064,000
Claude 3 HaikuAnthropic200,0004,096
o3 Mini HighOpenAI200,000100,000
o4 Mini HighOpenAI200,000100,000
MiniMax-M2MiniMax196,608128,000
MiniMax M2.5 (Bedrock)AWS Bedrock196,60898,304
MiniMax-M2.1 LightningMiniMax196,608131,072
Claude Opus 4Anthropic192,51228,672
DeepSeek V3.2DeepSeek164,0008,192
DeepSeek Chat V3.1DeepSeek164,000163,840
DeepSeek V3DeepSeek164,000164,000
Hunyuan A13B InstructTencent131,0728,192
GLM-4.5Z.ai (Zhipu AI)131,07298,304
GLM-4.5-AirZ.ai (Zhipu AI)131,07298,304
Gemma 3 12B ITGoogle131,0728,192
Google Gemma 3 12B (Bedrock)AWS Bedrock131,0728,192
Gemma 3 27B ITGoogle131,072117,964
gemma-3-4b-itGoogle131,07216,384
GPT OSS 120BOpenAI131,07232,768
GPT OSS 20BOpenAI131,072117,964
QVQ MaxAlibaba131,0728,192
Qwen3 Coder Next (Bedrock)AWS Bedrock131,07265,536
Qwen3-VL 235B-A22BAlibaba131,07232,768
Qwen-VL MaxAlibaba131,0728,192
Qwen-VL PlusAlibaba131,0728,192
Qwen2.5 14B InstructAlibaba131,0728,192
Qwen2.5 32B InstructAlibaba131,0728,192
Qwen2.5 72B InstructAlibaba131,0728,192
Qwen2.5 7B InstructAlibaba131,0728,192
Qwen2.5-VL 72B InstructAlibaba131,0728,192
Qwen2.5-VL 7B InstructAlibaba131,0728,192
Qwen3 14BAlibaba131,0728,192
Qwen3 235B-A22BAlibaba131,07216,384
Qwen3 32BAlibaba131,07216,384
Qwen3 8BAlibaba131,0728,192
Qwen3-Next 80B-A3B InstructAlibaba131,07232,768
Qwen3-Next 80B-A3B (Thinking)Alibaba131,07232,768
Qwen3-VL 30B-A3BAlibaba131,07232,768
QwQ PlusAlibaba131,0728,192
Gemma 4 E4B ITGoogle131,0728,192
Llama 3.1 70B InstructMeta131,07216,384
Mistral Medium 3Mistral AI131,07232,768
Mistral Small 3.2 24B InstructMistral AI131,07216,384
Muse Glimmer 30BMeta131,07232,768
Qwen 2.5 72B InstructAlibaba131,0728,192
Qwen2.5 Coder 32B InstructAlibaba131,0728,192
Qwen3 VL 235B A22B ThinkingAlibaba131,07232,768
Qwen3 VL 30B A3B ThinkingAlibaba131,07232,768
Qwen3 VL 32B InstructAlibaba131,07232,768
Qwen3 VL 8B InstructAlibaba131,07232,768
Mistral Medium 3.1Mistral AI131,0008,192
Mistral Small 4Mistral AI131,0008,192
GPT-5OpenAI128,000128,000
GPT-5 MiniOpenAI128,00064,000
GPT-4oOpenAI128,00016,384
GPT-4o miniOpenAI128,00016,384
Amazon Nova MicroAWS Bedrock128,0005,120
Llama 3.3 70BMeta128,0008,192
Command R+Cohere128,0004,096
Command RCohere128,0004,096
Command R7BCohere128,0004,096
SonarPerplexity128,000
Sonar Reasoning ProPerplexity128,000
Sonar Deep ResearchPerplexity128,000
GLM-4.6VZ.ai (Zhipu AI)128,00032,768
Gemma 3 4B IT (Bedrock)AWS Bedrock128,0004,096
GPT-4 TurboOpenAI128,0004,096
GPT-5.3 Codex SparkOpenAI128,00032,000
Llama-3.3-70B-InstructMeta128,0004,096
Llama-4-Maverick-17B-128E-Instruct-FP8Meta128,0004,096
Magistral SmallMistral AI128,000128,000
Ministral 14B 3.0 (Bedrock)AWS Bedrock128,0004,096
Ministral 3 8B (Bedrock)AWS Bedrock128,0004,096
Mistral NemoMistral AI128,000128,000
NVIDIA Nemotron Nano 12B v2 VL BF16 (Bedrock)AWS Bedrock128,0004,096
NVIDIA Nemotron Nano 3 30B (Bedrock)AWS Bedrock128,0004,096
NVIDIA Nemotron Nano 9B v2 (Bedrock)AWS Bedrock128,0004,096
Open Mistral NemoMistral AI128,000128,000
gpt-oss-120b (Bedrock)AWS Bedrock128,00016,384
gpt-oss-20b (Bedrock)AWS Bedrock128,00016,384
Pixtral 12BMistral AI128,000128,000
DeepSeek R1DeepSeek128,0008,192
DeepSeek R1 Distill Llama 70BDeepSeek128,0004,096
DeepSeek V3.1DeepSeek128,00065,536
DeepSeek V3.1 TerminusDeepSeek128,00065,536
GLM-4.5 AirXZ.ai (Zhipu AI)128,00016,384
GLM-4.5 XZ.ai (Zhipu AI)128,00016,384
Ministral 3BMistral AI128,0008,192
Ministral 8BMistral AI128,000128,000
Mistral LargeMistral AI128,000102,400
Mistral Small 3.1 24B InstructMistral AI128,000128,000
nova-micro-v1 (Bedrock)AWS Bedrock128,0005,120
Qwen3-Omni FlashAlibaba65,53616,384
MiniMax M2-herMiniMax65,5362,048
Mistral 7B Instruct v0.3Mistral AI65,53665,536
WizardLM-2 8x22BMicrosoft65,5368,192
GLM-4.5VZ.ai (Zhipu AI)64,00016,384
Mixtral 8x22BMistral AI64,00064,000
Deepseek R1 Distill Qwen 32BDeepSeek64,00032,000
Qwen3 30B A3BAlibaba41,00041,000
Qwen3 235B A22B FP8Alibaba40,96020,000
Qwen MaxAlibaba32,7688,192
Qwen-Omni TurboAlibaba32,7682,048
Qwen2.5-Omni 7BAlibaba32,7682,048
Step 1 (32K)StepFun32,76832,768
Qwen3 30B A3b fp8Alibaba32,76832,768
Qwq 32BAlibaba32,76832,768
Mixtral 8x7BMistral AI32,00032,000
Mistral SabaMistral AI32,00032,768
GPT-3.5-turboOpenAI16,3854,096
Phi 4Microsoft16,38416,384
Qwen-MT PlusAlibaba16,3848,192
Qwen-MT TurboAlibaba16,3848,192
Step 2 (16K)StepFun16,3848,192
Llama 3.1 8b InstructMeta16,0004,096
Llama 3.2 11B Vision InstructMeta16,0004,096
Llama 3.2 1B InstructMeta16,0004,096
Llama 3.2 3B InstructMeta16,0004,096
GPT-4OpenAI8,1928,192
Qwen Plus Character (Japanese)Alibaba8,192512
Llama 3 70B InstructMeta8,1928,000
Mistral 7BMistral AI8,0008,000
GPT-3.5 Turbo InstructOpenAI3,5001,024

Compare the context window and max output of every model in one ranked table, from the largest windows to the smallest.

How this is calculated

We list every model's context window and maximum output in one table, ranked from largest window to smallest, so you can shortlist by how much you need to fit in a single call.

Is this a good result? What to do next

Bigger isn't automatically better: a huge window costs more to fill and can degrade answer quality when overloaded. Pick the smallest window that comfortably fits your longest realistic input plus output.

Typical planning ranges

Largest windows
open-weight Llama 4 Scout, then 1M-token models
1M-token tier
GPT-4.1, Gemini 2.5, Claude 4
Max output
separate from the input window

Ranges are typical planning figures to sanity-check your result, not authoritative benchmarks. Your numbers will vary with use case, volume, and vendor.

How to improve this number

  • Match the window to your longest realistic prompt + output.
  • Use RAG instead of a giant window for large corpora.
  • Reserve big windows for genuine long-document work.

Common mistakes

  • Choosing the biggest window by default.
  • Confusing context window with max output length.

When to use a different approach

To lay out a specific prompt, use the context window planner. For pricing, use the LLM pricing comparison.

Worked example (defaults)

With the default inputs above, here is the result:

Result
Context windows compared
326 models ranked by context size
Llama 4 ScoutMeta10,000,0008,192
Grok 4.20xAI2,000,0001,800,000
GPT-5.4OpenAI1,050,000128,000
GPT-5.4 ProOpenAI1,050,000128,000
GPT-5.5OpenAI1,050,000128,000
GPT-5.5 ProOpenAI1,050,000128,000
GPT-5.6OpenAI1,050,000128,000
GPT-5.6 LunaOpenAI1,050,000128,000
GPT-5.6 SolOpenAI1,050,000128,000
GPT-5.6 TerraOpenAI1,050,000128,000
GPT 5.6 Luna ProOpenAI1,050,000128,000
GPT 5.6 Sol ProOpenAI1,050,000128,000
GPT 5.6 Terra ProOpenAI1,050,000128,000
Gemini 2.5 ProGoogle1,048,57665,536
Kimi K3Moonshot AI1,048,576131,072
MiMo-V2.5-ProXiaomi1,048,576131,072
MiMo-V2.5Xiaomi1,048,576131,072
Gemini 2.0 FlashGoogle1,048,5768,192
Gemini 2.0 Flash-LiteGoogle1,048,5768,192
Gemini 3.1 Flash LiteGoogle1,048,57665,536
Gemini 3.5 FlashGoogle1,048,57665,536
MiMo-V2.5-Pro-UltraSpeedXiaomi1,048,576131,072
MiMo-V2-ProXiaomi1,048,576131,072
Qwen3 Coder PlusAlibaba1,048,57665,536
Gemini 3.5 Flash LiteGoogle1,048,57665,536
Gemini 3.6 FlashGoogle1,048,57665,536
Gemini 3.7 FlashGoogle1,048,57665,536
Muse Spark 1.2Meta1,048,576131,072
Muse Spark 1.2 ContributorMeta1,048,576131,072
Gemini 3.1 Pro PreviewGoogle1,048,57665,536
Gemini 3 FlashGoogle1,048,57665,536
Gemini 3 ProGoogle1,048,57665,536
GLM 5.2 FastZ.ai (Zhipu AI)1,048,5601,048,560
Kimi K3 FastMoonshot AI1,048,5601,048,560
MiniMax 01MiniMax1,000,19216,384
GPT-4.1OpenAI1,000,00032,768
GPT-4.1 MiniOpenAI1,000,00032,768
GPT-4.1 NanoOpenAI1,000,00032,768
Claude Opus 4.8Anthropic1,000,00064,000
Claude Opus 4.8 (Bedrock)AWS Bedrock1,000,000128,000
Claude Opus 4.6Anthropic1,000,00064,000
Claude Opus 4.6 (Bedrock)AWS Bedrock1,000,000128,000
Claude Sonnet 4.6Anthropic1,000,00064,000
Anthropic Claude Sonnet 4.6 (Bedrock)AWS Bedrock1,000,000128,000
Claude Sonnet 5Anthropic1,000,00064,000
Claude Sonnet 5 (Bedrock)AWS Bedrock1,000,000128,000
Claude Fable 5Anthropic1,000,00064,000
Claude Fable 5 (Bedrock)AWS Bedrock1,000,000128,000
Gemini 2.5 FlashGoogle1,000,00065,536
Gemini 2.5 Flash-LiteGoogle1,000,00065,536
Amazon Nova PremierAWS Bedrock1,000,00010,000
Llama 4 MaverickMeta1,000,0008,192
DeepSeek V4 FlashDeepSeek1,000,0008,192
DeepSeek V4 ProDeepSeek1,000,0008,192
Grok 4.3xAI1,000,000
Grok 4.3 (Bedrock)AWS Bedrock1,000,000131,072
Qwen3.6 PlusAlibaba1,000,00065,536
Qwen3.6 FlashAlibaba1,000,00065,536
GLM-5.2Z.ai (Zhipu AI)1,000,000131,072
MiniMax-M3MiniMax1,000,000128,000
Nemotron 3 Ultra 550B A55BNvidia1,000,000128,000
Claude Opus 4.7Anthropic1,000,000128,000
Claude Opus 4.7 (Bedrock)AWS Bedrock1,000,000128,000
Claude Sonnet 4.5 (latest)Anthropic1,000,00064,000
DeepSeek ChatDeepSeek1,000,000384,000
DeepSeek ReasonerDeepSeek1,000,000384,000
Muse Spark 1.1Meta1,000,00032,000
Qwen FlashAlibaba1,000,00032,768
Qwen PlusAlibaba1,000,00032,768
Qwen TurboAlibaba1,000,00016,384
Qwen3.5 PlusAlibaba1,000,00065,536
Qwen3.7 MaxAlibaba1,000,00065,536
Qwen3.7 PlusAlibaba1,000,00065,536
Qwen3 Coder FlashAlibaba1,000,00065,536
Claude Opus 5Anthropic1,000,000128,000
Claude Opus 5 (Bedrock)AWS Bedrock1,000,000128,000
GLM-5.3Z.ai (Zhipu AI)1,000,000131,072
GLM-5.3-FlashZ.ai (Zhipu AI)1,000,000131,072
Qwen3.8 MaxAlibaba1,000,000131,072
GLM-5.2Mistral AI1,000,000131,072
Claude Opus 4.8 FastAnthropic1,000,000128,000
Claude Opus 5 FastAnthropic1,000,000128,000
MiniMax M1MiniMax1,000,000128,000
MiniMax M1 80KMiniMax1,000,00040,000
Nova 2 Lite (Bedrock)AWS Bedrock1,000,00065,535
Qwen3.5 FlashAlibaba1,000,000250,000
Qwen3.7 FlashAlibaba1,000,00065,536
Qwen3.8 FlashAlibaba991,808131,072
Claude Sonnet 4Anthropic983,04064,000
Grok 4.5xAI500,000
Grok 4.6xAI500,000500,000
Grok 4.6 (Bedrock)AWS Bedrock500,000500,000
GPT-5.1OpenAI400,000128,000
GPT-5.1 CodexOpenAI400,000128,000
GPT-5.1 Codex MaxOpenAI400,000128,000
GPT-5.1 Codex miniOpenAI400,000128,000
GPT-5.2OpenAI400,000128,000
GPT-5.2 CodexOpenAI400,000128,000
GPT-5.2 ProOpenAI400,000128,000
GPT-5.3 CodexOpenAI400,000128,000
GPT-5.4 miniOpenAI400,000128,000
GPT-5.4 nanoOpenAI400,000128,000
GPT-5-CodexOpenAI400,000128,000
GPT-5 NanoOpenAI400,000128,000
GPT-5 ProOpenAI400,000272,000
glm-5-2-fp8Z.ai (Zhipu AI)393,216131,072
Llama 4 Scout 17B 16E InstructMeta327,68016,384
Amazon Nova ProAWS Bedrock300,0005,120
Amazon Nova LiteAWS Bedrock300,0005,120
Nemotron 3 Nano OmniNvidia300,000300,000
nova-lite-v1 (Bedrock)AWS Bedrock300,0005,120
Nova Pro 1.0 (Bedrock)AWS Bedrock300,00032,000
GPT-5.4 (Bedrock)AWS Bedrock272,000128,000
GPT-5.5 (Bedrock)AWS Bedrock272,000128,000
GPT-5.6 Luna (Bedrock)AWS Bedrock272,000128,000
GPT-5.6 Sol (Bedrock)AWS Bedrock272,000128,000
GPT-5.6 Terra (Bedrock)AWS Bedrock272,000128,000
Kimi K2.7 CodeMoonshot AI262,144262,144
Qwen3 MaxAlibaba262,14465,536
Nemotron 3 Super 120B A12BNvidia262,144262,144
Nemotron 3 Nano 30B A3BNvidia262,14465,536
Hunyuan Hy3Tencent262,14464,000
Kimi K2.5Moonshot AI262,144262,144
Kimi K2.6Moonshot AI262,144262,144
Kimi K2.7 Code HighSpeedMoonshot AI262,144262,144
Kimi K2 ThinkingMoonshot AI262,144262,144
Kimi K2 Thinking TurboMoonshot AI262,144262,144
MiMo-V2-FlashXiaomi262,14465,536
MiMo-V2-OmniXiaomi262,144131,072
NVIDIA Nemotron 3 Super 120B A12B (Bedrock)AWS Bedrock262,144131,072
qwen3-coder-nextAlibaba262,144262,144
Qwen3.5 122B-A10BAlibaba262,14465,536
Qwen3.5 27BAlibaba262,14465,536
Qwen3.5 35B-A3BAlibaba262,14465,536
Qwen3.5 397B-A17BAlibaba262,14465,536
Qwen3.6 27BAlibaba262,14465,536
Qwen3.6 35B-A3BAlibaba262,14465,536
Qwen3-Coder 30B-A3B InstructAlibaba262,14465,536
Qwen3-Coder 480B-A35B InstructAlibaba262,14465,536
Qwen3-VL PlusAlibaba262,14432,768
Gemma 4 26B A4B ITGoogle262,14416,384
Gemma 4 31B ITGoogle262,144131,072
Kimi K2Moonshot AI262,144262,144
Mistral Medium 3.5 128BMistral AI262,144131,072
Nemotron 3.5 Lightning 30BNvidia262,144131,072
Qwen3.5 9BAlibaba262,144262,144
Qwen3.8 2.4T A95BAlibaba262,144262,144
Qwen3.8 27BAlibaba262,14432,768
Qwen3 Max ThinkingAlibaba262,14465,536
Qwen3 VL 235B A22B InstructAlibaba262,14432,768
Qwen3 VL 30B A3B InstructAlibaba262,14432,768
Kimi K2.5 (Bedrock)AWS Bedrock262,14316,000
Kimi K2 Thinking (Bedrock)AWS Bedrock262,14316,000
Mistral Large 3Mistral AI262,0008,192
Devstral 2Mistral AI262,0008,192
Qwen/Qwen3-Next-80B-A3B-Instruct (Bedrock)AWS Bedrock262,000262,000
Qwen/Qwen3-VL-235B-A22B-Instruct (Bedrock)AWS Bedrock262,000262,000
Qwen3 CoderAlibaba262,00065,536
Mistral Large 3 (Bedrock)AWS Bedrock256,0008,192
Command ACohere256,0008,000
MAI-Code-1-FlashMicrosoft256,000128,000
Step 3.7 FlashStepFun256,000256,000
Devstral 2 123B (Bedrock)AWS Bedrock256,0008,192
Ministral 3 3B (Bedrock)AWS Bedrock256,0008,192
Step 3.5 FlashStepFun256,000256,000
Grok 4xAI256,000256,000
Grok Code Fast 1xAI256,000256,000
Kimi K2 InstructMoonshot AI256,0008,192
mistral-medium-3-5Mistral AI256,000256,000
nvidia-nemotron-3-nano-30b-a3bNvidia256,000256,000
GLM-5Z.ai (Zhipu AI)204,800131,072
MiniMax-M2.7MiniMax204,800131,072
GLM-4.6Z.ai (Zhipu AI)204,800131,072
GLM-4.7Z.ai (Zhipu AI)204,800131,072
GLM-4.7 (Bedrock)AWS Bedrock204,800131,072
MiniMax-M2.1MiniMax204,800131,072
MiniMax M2.1 (Bedrock)AWS Bedrock204,800131,072
MiniMax-M2.5MiniMax204,800131,072
MiniMax-M2.5-highspeedMiniMax204,800131,072
MiniMax-M2.7-highspeedMiniMax204,800131,072
MiniMax M2 (Bedrock)AWS Bedrock204,608128,000
NVIDIA Nemotron 3 UltraNvidia202,800202,800
GLM-5 (Bedrock)AWS Bedrock202,752101,376
Google Gemma 3 27B Instruct (Bedrock)AWS Bedrock202,7528,192
GLM-5.1 FP8Z.ai (Zhipu AI)202,752131,072
o3OpenAI200,000100,000
o4-miniOpenAI200,000100,000
Claude Haiku 4.5Anthropic200,0008,192
Sonar ProPerplexity200,000
Claude Opus 4.1 (latest)Anthropic200,00032,000
Claude Opus 4.5 (latest)Anthropic200,00064,000
GLM-4.7-FlashZ.ai (Zhipu AI)200,000131,072
GLM-4.7-Flash (Bedrock)AWS Bedrock200,000131,072
GLM-4.7-FlashXZ.ai (Zhipu AI)200,000131,072
GLM-5.1Z.ai (Zhipu AI)200,000131,072
GLM-5-TurboZ.ai (Zhipu AI)200,000131,072
GLM-5V-TurboZ.ai (Zhipu AI)200,000131,072
o1OpenAI200,000100,000
o1-proOpenAI200,000100,000
o3-deep-researchOpenAI200,000100,000
o3-miniOpenAI200,000100,000
o3-proOpenAI200,000100,000
o4-mini-deep-researchOpenAI200,000100,000
Claude 3.5 HaikuAnthropic200,00064,000
Claude 3 HaikuAnthropic200,0004,096
o3 Mini HighOpenAI200,000100,000
o4 Mini HighOpenAI200,000100,000
MiniMax-M2MiniMax196,608128,000
MiniMax M2.5 (Bedrock)AWS Bedrock196,60898,304
MiniMax-M2.1 LightningMiniMax196,608131,072
Claude Opus 4Anthropic192,51228,672
DeepSeek V3.2DeepSeek164,0008,192
DeepSeek Chat V3.1DeepSeek164,000163,840
DeepSeek V3DeepSeek164,000164,000
Hunyuan A13B InstructTencent131,0728,192
GLM-4.5Z.ai (Zhipu AI)131,07298,304
GLM-4.5-AirZ.ai (Zhipu AI)131,07298,304
Gemma 3 12B ITGoogle131,0728,192
Google Gemma 3 12B (Bedrock)AWS Bedrock131,0728,192
Gemma 3 27B ITGoogle131,072117,964
gemma-3-4b-itGoogle131,07216,384
GPT OSS 120BOpenAI131,07232,768
GPT OSS 20BOpenAI131,072117,964
QVQ MaxAlibaba131,0728,192
Qwen3 Coder Next (Bedrock)AWS Bedrock131,07265,536
Qwen3-VL 235B-A22BAlibaba131,07232,768
Qwen-VL MaxAlibaba131,0728,192
Qwen-VL PlusAlibaba131,0728,192
Qwen2.5 14B InstructAlibaba131,0728,192
Qwen2.5 32B InstructAlibaba131,0728,192
Qwen2.5 72B InstructAlibaba131,0728,192
Qwen2.5 7B InstructAlibaba131,0728,192
Qwen2.5-VL 72B InstructAlibaba131,0728,192
Qwen2.5-VL 7B InstructAlibaba131,0728,192
Qwen3 14BAlibaba131,0728,192
Qwen3 235B-A22BAlibaba131,07216,384
Qwen3 32BAlibaba131,07216,384
Qwen3 8BAlibaba131,0728,192
Qwen3-Next 80B-A3B InstructAlibaba131,07232,768
Qwen3-Next 80B-A3B (Thinking)Alibaba131,07232,768
Qwen3-VL 30B-A3BAlibaba131,07232,768
QwQ PlusAlibaba131,0728,192
Gemma 4 E4B ITGoogle131,0728,192
Llama 3.1 70B InstructMeta131,07216,384
Mistral Medium 3Mistral AI131,07232,768
Mistral Small 3.2 24B InstructMistral AI131,07216,384
Muse Glimmer 30BMeta131,07232,768
Qwen 2.5 72B InstructAlibaba131,0728,192
Qwen2.5 Coder 32B InstructAlibaba131,0728,192
Qwen3 VL 235B A22B ThinkingAlibaba131,07232,768
Qwen3 VL 30B A3B ThinkingAlibaba131,07232,768
Qwen3 VL 32B InstructAlibaba131,07232,768
Qwen3 VL 8B InstructAlibaba131,07232,768
Mistral Medium 3.1Mistral AI131,0008,192
Mistral Small 4Mistral AI131,0008,192
GPT-5OpenAI128,000128,000
GPT-5 MiniOpenAI128,00064,000
GPT-4oOpenAI128,00016,384
GPT-4o miniOpenAI128,00016,384
Amazon Nova MicroAWS Bedrock128,0005,120
Llama 3.3 70BMeta128,0008,192
Command R+Cohere128,0004,096
Command RCohere128,0004,096
Command R7BCohere128,0004,096
SonarPerplexity128,000
Sonar Reasoning ProPerplexity128,000
Sonar Deep ResearchPerplexity128,000
GLM-4.6VZ.ai (Zhipu AI)128,00032,768
Gemma 3 4B IT (Bedrock)AWS Bedrock128,0004,096
GPT-4 TurboOpenAI128,0004,096
GPT-5.3 Codex SparkOpenAI128,00032,000
Llama-3.3-70B-InstructMeta128,0004,096
Llama-4-Maverick-17B-128E-Instruct-FP8Meta128,0004,096
Magistral SmallMistral AI128,000128,000
Ministral 14B 3.0 (Bedrock)AWS Bedrock128,0004,096
Ministral 3 8B (Bedrock)AWS Bedrock128,0004,096
Mistral NemoMistral AI128,000128,000
NVIDIA Nemotron Nano 12B v2 VL BF16 (Bedrock)AWS Bedrock128,0004,096
NVIDIA Nemotron Nano 3 30B (Bedrock)AWS Bedrock128,0004,096
NVIDIA Nemotron Nano 9B v2 (Bedrock)AWS Bedrock128,0004,096
Open Mistral NemoMistral AI128,000128,000
gpt-oss-120b (Bedrock)AWS Bedrock128,00016,384
gpt-oss-20b (Bedrock)AWS Bedrock128,00016,384
Pixtral 12BMistral AI128,000128,000
DeepSeek R1DeepSeek128,0008,192
DeepSeek R1 Distill Llama 70BDeepSeek128,0004,096
DeepSeek V3.1DeepSeek128,00065,536
DeepSeek V3.1 TerminusDeepSeek128,00065,536
GLM-4.5 AirXZ.ai (Zhipu AI)128,00016,384
GLM-4.5 XZ.ai (Zhipu AI)128,00016,384
Ministral 3BMistral AI128,0008,192
Ministral 8BMistral AI128,000128,000
Mistral LargeMistral AI128,000102,400
Mistral Small 3.1 24B InstructMistral AI128,000128,000
nova-micro-v1 (Bedrock)AWS Bedrock128,0005,120
Qwen3-Omni FlashAlibaba65,53616,384
MiniMax M2-herMiniMax65,5362,048
Mistral 7B Instruct v0.3Mistral AI65,53665,536
WizardLM-2 8x22BMicrosoft65,5368,192
GLM-4.5VZ.ai (Zhipu AI)64,00016,384
Mixtral 8x22BMistral AI64,00064,000
Deepseek R1 Distill Qwen 32BDeepSeek64,00032,000
Qwen3 30B A3BAlibaba41,00041,000
Qwen3 235B A22B FP8Alibaba40,96020,000
Qwen MaxAlibaba32,7688,192
Qwen-Omni TurboAlibaba32,7682,048
Qwen2.5-Omni 7BAlibaba32,7682,048
Step 1 (32K)StepFun32,76832,768
Qwen3 30B A3b fp8Alibaba32,76832,768
Qwq 32BAlibaba32,76832,768
Mixtral 8x7BMistral AI32,00032,000
Mistral SabaMistral AI32,00032,768
GPT-3.5-turboOpenAI16,3854,096
Phi 4Microsoft16,38416,384
Qwen-MT PlusAlibaba16,3848,192
Qwen-MT TurboAlibaba16,3848,192
Step 2 (16K)StepFun16,3848,192
Llama 3.1 8b InstructMeta16,0004,096
Llama 3.2 11B Vision InstructMeta16,0004,096
Llama 3.2 1B InstructMeta16,0004,096
Llama 3.2 3B InstructMeta16,0004,096
GPT-4OpenAI8,1928,192
Qwen Plus Character (Japanese)Alibaba8,192512
Llama 3 70B InstructMeta8,1928,000
Mistral 7BMistral AI8,0008,000
GPT-3.5 Turbo InstructOpenAI3,5001,024

Frequently asked questions

Which model has the largest context window?+

Open-weight Llama 4 Scout leads with a very large window, followed by 1M-token models like GPT-4.1, Gemini 2.5 and Claude 4. See the table for the full ranking.

Related calculators

Answering a real question?

This calculator powers these problem-solving guides: