AI Calculator Pro

Cheapest model that fits a 200k-token context

Teams with very long prompts often need to find the cheapest model that fits a 200k-token context. Because providers price input and output tokens very differently, the "obvious" model is rarely the cheapest. This tool compares them on your own workload so the decision is data-driven.

Start here: Model Context Window Comparison

Result
Context windows compared
338 models ranked by context size
Llama 4 ScoutMeta10,000,0008,192
Grok 4.20xAI2,000,0001,800,000
GPT-5.4OpenAI1,050,000128,000
GPT-5.4 ProOpenAI1,050,000128,000
GPT-5.5OpenAI1,050,000128,000
GPT-5.5 ProOpenAI1,050,000128,000
GPT-5.6OpenAI1,050,000128,000
GPT-5.6 LunaOpenAI1,050,000128,000
GPT-5.6 SolOpenAI1,050,000128,000
GPT-5.6 TerraOpenAI1,050,000128,000
GPT-6 AstraOpenAI1,050,000128,000
GPT-6 Astra (Bedrock)AWS Bedrock1,050,000128,000
GPT-5.6 Luna (India) (Bedrock)AWS Bedrock1,050,000128,000
GPT-5.6 Terra (India) (Bedrock)AWS Bedrock1,050,000128,000
GPT 5.6 Luna ProOpenAI1,050,000128,000
GPT 5.6 Sol ProOpenAI1,050,000128,000
GPT 5.6 Terra ProOpenAI1,050,000128,000
GPT 6 Astra ProOpenAI1,050,000128,000
Gemini 2.5 ProGoogle1,048,57665,536
Kimi K3Moonshot AI1,048,576131,072
MiMo-V2.5-ProXiaomi1,048,576131,072
MiMo-V2.5Xiaomi1,048,576131,072
Gemini 2.0 FlashGoogle1,048,5768,192
Gemini 2.0 Flash-LiteGoogle1,048,5768,192
Gemini 3.1 Flash LiteGoogle1,048,57665,536
Gemini 3.5 FlashGoogle1,048,57665,536
MiMo-V2.5-Pro-UltraSpeedXiaomi1,048,576131,072
MiMo-V2-ProXiaomi1,048,576131,072
Qwen3 Coder PlusAlibaba1,048,57665,536
Gemini 3.5 Flash LiteGoogle1,048,57665,536
Gemini 3.6 FlashGoogle1,048,57665,536
Gemini 3.7 FlashGoogle1,048,57665,536
Gemini 3.8 FlashGoogle1,048,57665,536
Muse Spark 1.2Meta1,048,576131,072
Muse Spark 1.2 ContributorMeta1,048,576131,072
Muse Spark 1.3Meta1,048,576131,072
Muse Spark 1.3 ContributorMeta1,048,576131,072
Gemini 3.1 Pro PreviewGoogle1,048,57665,536
Gemini 3 FlashGoogle1,048,57665,536
GLM 5.2 FastZ.ai (Zhipu AI)1,048,5601,048,560
Kimi K3 FastMoonshot AI1,048,5601,048,560
MiniMax 01MiniMax1,000,19216,384
GPT-4.1OpenAI1,000,00032,768
GPT-4.1 MiniOpenAI1,000,00032,768
GPT-4.1 NanoOpenAI1,000,00032,768
Claude Opus 4.8Anthropic1,000,00064,000
Claude Opus 4.8 (Bedrock)AWS Bedrock1,000,000128,000
Claude Opus 4.6Anthropic1,000,00064,000
Claude Opus 4.6 (Bedrock)AWS Bedrock1,000,000128,000
Claude Sonnet 4.6Anthropic1,000,00064,000
Anthropic Claude Sonnet 4.6 (Bedrock)AWS Bedrock1,000,000128,000
Claude Sonnet 5Anthropic1,000,00064,000
Claude Sonnet 5 (Bedrock)AWS Bedrock1,000,000128,000
Claude Fable 5Anthropic1,000,00064,000
Claude Fable 5 (Bedrock)AWS Bedrock1,000,000128,000
Gemini 2.5 FlashGoogle1,000,00065,536
Gemini 2.5 Flash-LiteGoogle1,000,00065,536
Amazon Nova PremierAWS Bedrock1,000,00010,000
Llama 4 MaverickMeta1,000,0008,192
DeepSeek V4 FlashDeepSeek1,000,0008,192
DeepSeek V4 ProDeepSeek1,000,0008,192
Grok 4.3xAI1,000,000
Grok 4.3 (Bedrock)AWS Bedrock1,000,000131,072
Qwen3.6 PlusAlibaba1,000,00065,536
Qwen3.6 FlashAlibaba1,000,00065,536
GLM-5.2Z.ai (Zhipu AI)1,000,000131,072
MiniMax-M3MiniMax1,000,000128,000
Nemotron 3 Ultra 550B A55BNvidia1,000,000128,000
Claude Opus 4.7Anthropic1,000,000128,000
Claude Opus 4.7 (Bedrock)AWS Bedrock1,000,000128,000
Claude Sonnet 4.5 (latest)Anthropic1,000,00064,000
DeepSeek ChatDeepSeek1,000,000384,000
DeepSeek ReasonerDeepSeek1,000,000384,000
Muse Spark 1.1Meta1,000,00032,000
Qwen FlashAlibaba1,000,00032,768
Qwen PlusAlibaba1,000,00032,768
Qwen TurboAlibaba1,000,00016,384
Qwen3.5 PlusAlibaba1,000,00065,536
Qwen3.7 MaxAlibaba1,000,00065,536
Qwen3.7 PlusAlibaba1,000,00065,536
Qwen3 Coder FlashAlibaba1,000,00065,536
Claude Fable 5.1Anthropic1,000,000128,000
Claude Fable 5.1 (Bedrock)AWS Bedrock1,000,000128,000
Claude Opus 5Anthropic1,000,000128,000
Claude Opus 5 (Bedrock)AWS Bedrock1,000,000128,000
DeepSeek V4.1 FlashDeepSeek1,000,000384,000
GLM-5.3Z.ai (Zhipu AI)1,000,000131,072
GLM-5.3-FlashZ.ai (Zhipu AI)1,000,000131,072
Qwen3.8 FlashAlibaba1,000,000131,072
Qwen3.8 MaxAlibaba1,000,000131,072
GLM-5.2Mistral AI1,000,000131,072
GLM-5.3Mistral AI1,000,000131,072
Claude Opus 5 FastAnthropic1,000,000128,000
deepseek-v4-1-flashDeepSeek1,000,000384,000
MiniMax M1MiniMax1,000,000128,000
MiniMax M1 80KMiniMax1,000,00040,000
Nemotron 3.5 Lightning 30BNvidia1,000,00065,536
Nova 2 Lite (Bedrock)AWS Bedrock1,000,00065,535
Qwen3.5 FlashAlibaba1,000,000250,000
Qwen3.8 Omni FlashAlibaba991,808131,072
Qwen3.7 FlashAlibaba991,00064,000
Claude 4 SonnetAnthropic983,04064,000
Qwen3.8 2.4T A95BAlibaba970,000131,072
Grok 4.5xAI500,000
Grok 4.6xAI500,000500,000
Grok 4.6 (Bedrock)AWS Bedrock500,000500,000
GPT-5.1OpenAI400,000128,000
GPT-5.1 CodexOpenAI400,000128,000
GPT-5.1 Codex MaxOpenAI400,000128,000
GPT-5.1 Codex miniOpenAI400,000128,000
GPT-5.2OpenAI400,000128,000
GPT-5.2 CodexOpenAI400,000128,000
GPT-5.2 ProOpenAI400,000128,000
GPT-5.3 CodexOpenAI400,000128,000
GPT-5.4 miniOpenAI400,000128,000
GPT-5.4 nanoOpenAI400,000128,000
GPT-5-CodexOpenAI400,000128,000
GPT-5 NanoOpenAI400,000128,000
GPT-5 ProOpenAI400,000272,000
glm-5-2-fp8Z.ai (Zhipu AI)393,216131,072
Llama 4 Scout 17B 16E InstructMeta327,68016,384
Amazon Nova ProAWS Bedrock300,0005,120
Amazon Nova LiteAWS Bedrock300,0005,120
nova-lite-v1 (Bedrock)AWS Bedrock300,0005,120
Nova Pro 1.0 (Bedrock)AWS Bedrock300,00032,000
GPT-5.4 (Bedrock)AWS Bedrock272,000128,000
GPT-5.5 (Bedrock)AWS Bedrock272,000128,000
GPT-5.6 Luna (Bedrock)AWS Bedrock272,000128,000
GPT-5.6 Sol (Bedrock)AWS Bedrock272,000128,000
GPT-5.6 Terra (Bedrock)AWS Bedrock272,000128,000
Kimi K2.7 CodeMoonshot AI262,144262,144
Qwen3 MaxAlibaba262,14465,536
Nemotron 3 Super 120B A12BNvidia262,144262,144
Nemotron 3 Nano 30B A3BNvidia262,14465,536
Hunyuan Hy3Tencent262,14464,000
Kimi K2.5Moonshot AI262,144262,144
Kimi K2.6Moonshot AI262,144262,144
Kimi K2.7 Code HighSpeedMoonshot AI262,144262,144
Kimi K2 ThinkingMoonshot AI262,144262,144
Kimi K2 Thinking TurboMoonshot AI262,144262,144
MiMo-V2-FlashXiaomi262,14465,536
MiMo-V2-OmniXiaomi262,144131,072
NVIDIA Nemotron 3 Super 120B A12B (Bedrock)AWS Bedrock262,144131,072
qwen3-coder-nextAlibaba262,144262,144
Qwen3.5 122B-A10BAlibaba262,14465,536
Qwen3.5 27BAlibaba262,14465,536
Qwen3.5 35B-A3BAlibaba262,14465,536
Qwen3.5 397B-A17BAlibaba262,14465,536
Qwen3.6 27BAlibaba262,14465,536
Qwen3.6 35B-A3BAlibaba262,14465,536
Qwen3-Coder 30B-A3B InstructAlibaba262,14465,536
Qwen3-Coder 480B-A35B InstructAlibaba262,14465,536
Qwen3-VL PlusAlibaba262,14432,768
Gemma 4 26B A4B IT (Bedrock)AWS Bedrock262,14432,768
Gemma 4 31B IT (Bedrock)AWS Bedrock262,14432,768
gemma-4-26b-a4b-itGoogle262,144235,929
gemma-4-31b-itGoogle262,14432,768
Kimi K2Moonshot AI262,144262,144
nvidia-nemotron-3-nano-30b-a3bNvidia262,144262,144
NVIDIA Nemotron 3 UltraNvidia262,144262,144
Qwen3.5 9BAlibaba262,144262,144
Qwen3 Max ThinkingAlibaba262,14465,536
Qwen3 VL 235B A22B InstructAlibaba262,14432,768
Kimi K2.5 (Bedrock)AWS Bedrock262,14316,000
Kimi K2 Thinking (Bedrock)AWS Bedrock262,14316,000
Mistral Large 3Mistral AI262,0008,192
Devstral 2Mistral AI262,0008,192
Qwen/Qwen3-Next-80B-A3B-Instruct (Bedrock)AWS Bedrock262,000262,000
Qwen/Qwen3-VL-235B-A22B-Instruct (Bedrock)AWS Bedrock262,000262,000
Qwen3 CoderAlibaba262,00065,536
Mistral Large 3 (Bedrock)AWS Bedrock256,0008,192
Command ACohere256,0008,000
MAI-Code-1-FlashMicrosoft256,000128,000
Step 3.7 FlashStepFun256,000256,000
Devstral 2 123B (Bedrock)AWS Bedrock256,0008,192
Ministral 3 3B (Bedrock)AWS Bedrock256,0008,192
Step 3.5 FlashStepFun256,000256,000
Grok 4xAI256,000256,000
Grok Code Fast 1xAI256,000256,000
Kimi K2 InstructMoonshot AI256,0008,192
mistral-medium-3-5Mistral AI256,00032,768
Mistral Medium 3.5 128BMistral AI256,00016,384
Mistral Small 3.2 24B InstructMistral AI256,00016,384
GLM-5Z.ai (Zhipu AI)204,800131,072
MiniMax-M2.7MiniMax204,800131,072
GLM-4.6Z.ai (Zhipu AI)204,800131,072
GLM-4.7Z.ai (Zhipu AI)204,800131,072
GLM-4.7 (Bedrock)AWS Bedrock204,800131,072
MiniMax-M2.1MiniMax204,800131,072
MiniMax M2.1 (Bedrock)AWS Bedrock204,800131,072
MiniMax-M2.5MiniMax204,800131,072
MiniMax-M2.5-highspeedMiniMax204,800131,072
MiniMax-M2.7-highspeedMiniMax204,800131,072
MiniMax M2 (Bedrock)AWS Bedrock204,608128,000
GLM-5 (Bedrock)AWS Bedrock202,752101,376
Google Gemma 3 27B Instruct (Bedrock)AWS Bedrock202,7528,192
GLM-5.1 FP8Z.ai (Zhipu AI)202,752131,072
o3OpenAI200,000100,000
o4-miniOpenAI200,000100,000
Claude Haiku 4.5Anthropic200,0008,192
Sonar ProPerplexity200,000
Claude Opus 4.1 (latest)Anthropic200,00032,000
Claude Opus 4.5 (latest)Anthropic200,00064,000
GLM-4.7-FlashZ.ai (Zhipu AI)200,000131,072
GLM-4.7-Flash (Bedrock)AWS Bedrock200,000131,072
GLM-4.7-FlashXZ.ai (Zhipu AI)200,000131,072
GLM-5.1Z.ai (Zhipu AI)200,000131,072
GLM-5-TurboZ.ai (Zhipu AI)200,000131,072
GLM-5V-TurboZ.ai (Zhipu AI)200,000131,072
o1OpenAI200,000100,000
o1-proOpenAI200,000100,000
o3-deep-researchOpenAI200,000100,000
o3-miniOpenAI200,000100,000
o3-proOpenAI200,000100,000
o4-mini-deep-researchOpenAI200,000100,000
Claude 3.5 HaikuAnthropic200,0008,192
Claude Haiku 3Anthropic200,0004,096
o3 Mini HighOpenAI200,000100,000
o4 Mini HighOpenAI200,000100,000
MiniMax-M2MiniMax196,608128,000
MiniMax M2.5 (Bedrock)AWS Bedrock196,60898,304
MiniMax M2.1 LightningMiniMax196,608131,072
Claude 4 OpusAnthropic192,51228,672
DeepSeek V3.2DeepSeek164,0008,192
DeepSeek Chat V3.1DeepSeek164,000163,840
DeepSeek V3DeepSeek164,000164,000
Hunyuan A13B InstructTencent131,0728,192
GLM-4.5Z.ai (Zhipu AI)131,07298,304
GLM-4.5-AirZ.ai (Zhipu AI)131,07298,304
Gemma 3 12B ITGoogle131,0728,192
Google Gemma 3 12B (Bedrock)AWS Bedrock131,0728,192
Gemma 3 27B ITGoogle131,072131,072
GPT OSS 120BOpenAI131,07232,768
GPT OSS 20BOpenAI131,072117,964
QVQ MaxAlibaba131,0728,192
Qwen3 Coder Next (Bedrock)AWS Bedrock131,07265,536
Qwen3-VL 235B-A22BAlibaba131,07232,768
Qwen-VL MaxAlibaba131,0728,192
Qwen-VL PlusAlibaba131,0728,192
Qwen2.5 14B InstructAlibaba131,0728,192
Qwen2.5 32B InstructAlibaba131,0728,192
Qwen2.5 72B InstructAlibaba131,0728,192
Qwen2.5 7B InstructAlibaba131,0728,192
Qwen2.5-VL 72B InstructAlibaba131,0728,192
Qwen2.5-VL 7B InstructAlibaba131,0728,192
Qwen3 14BAlibaba131,0728,192
Qwen3 235B-A22BAlibaba131,07216,384
Qwen3 32BAlibaba131,07216,384
Qwen3 8BAlibaba131,0728,192
Qwen3-Next 80B-A3B InstructAlibaba131,07232,768
Qwen3-Next 80B-A3B (Thinking)Alibaba131,07232,768
Qwen3-VL 30B-A3BAlibaba131,07232,768
QwQ PlusAlibaba131,0728,192
Gemma 4 E2B IT (Bedrock)AWS Bedrock131,0728,192
DeepSeek V3.1DeepSeek131,0728,192
Llama 3.1 70B InstructMeta131,07216,384
Llama 3.1 8b InstructMeta131,072117,964
meta-llama-3-3-70b-instructMeta131,0728,192
Mistral Medium 3Mistral AI131,07232,768
Muse Glimmer 30BMeta131,07232,768
Qwen 2.5 72B InstructAlibaba131,0728,192
Qwen2.5-Coder 32B InstructAlibaba131,0728,192
Qwen3 VL 235B A22B ThinkingAlibaba131,07232,768
Qwen3 VL 30B A3B InstructAlibaba131,07232,768
Qwen3 VL 30B A3B ThinkingAlibaba131,07232,768
Qwen3 VL 32B InstructAlibaba131,07232,768
Qwen3 VL 8B InstructAlibaba131,07232,768
Mistral Medium 3.1Mistral AI131,0008,192
Mistral Small 4Mistral AI131,0008,192
GPT-5OpenAI128,000128,000
GPT-5 MiniOpenAI128,00064,000
GPT-4oOpenAI128,00016,384
GPT-4o miniOpenAI128,00016,384
Amazon Nova MicroAWS Bedrock128,0005,120
Llama 3.3 70BMeta128,0008,192
Command R+Cohere128,0004,096
Command RCohere128,0004,096
Command R7BCohere128,0004,096
SonarPerplexity128,000
Sonar Reasoning ProPerplexity128,000
Sonar Deep ResearchPerplexity128,000
GLM-4.6VZ.ai (Zhipu AI)128,00032,768
gemma-3-4b-itGoogle128,0008,192
Gemma 3 4B IT (Bedrock)AWS Bedrock128,0004,096
GPT-4 TurboOpenAI128,0004,096
GPT-5.3 Codex SparkOpenAI128,00032,000
Llama-3.3-70B-InstructMeta128,0004,096
Llama-4-Maverick-17B-128E-Instruct-FP8Meta128,0004,096
Magistral SmallMistral AI128,000128,000
Ministral 14B 3.0 (Bedrock)AWS Bedrock128,0004,096
Ministral 3 8B (Bedrock)AWS Bedrock128,0004,096
Mistral NemoMistral AI128,000128,000
NVIDIA Nemotron Nano 12B v2 VL BF16 (Bedrock)AWS Bedrock128,0004,096
NVIDIA Nemotron Nano 3 30B (Bedrock)AWS Bedrock128,0004,096
NVIDIA Nemotron Nano 9B v2 (Bedrock)AWS Bedrock128,0004,096
Open Mistral NemoMistral AI128,000128,000
gpt-oss-120b (Bedrock)AWS Bedrock128,00016,384
gpt-oss-20b (Bedrock)AWS Bedrock128,00016,384
Pixtral 12BMistral AI128,000128,000
DeepSeek R1DeepSeek128,0008,192
DeepSeek R1 Distill Llama 70BDeepSeek128,0004,096
DeepSeek V3.1 TerminusDeepSeek128,00065,536
Ministral 3BMistral AI128,0008,192
Mistral LargeMistral AI128,000102,400
Mistral Small 3.1 24B InstructMistral AI128,000102,400
nova-micro-v1 (Bedrock)AWS Bedrock128,0005,120
Qwen3-Omni FlashAlibaba65,53616,384
MiniMax M2-herMiniMax65,5362,048
Mistral 7B Instruct v0.3Mistral AI65,53665,536
WizardLM-2 8x22BMicrosoft65,5368,192
GLM-4.5VZ.ai (Zhipu AI)64,00016,384
Mixtral 8x22BMistral AI64,00064,000
DeepSeek R1 Distill Qwen 32BDeepSeek64,00032,000
Qwen3 30B A3BAlibaba41,00041,000
Qwen3 235B A22B FP8Alibaba40,96020,000
Qwen MaxAlibaba32,7688,192
Qwen-Omni TurboAlibaba32,7682,048
Qwen2.5-Omni 7BAlibaba32,7682,048
Step 1 (32K)StepFun32,76832,768
Mistral SabaMistral AI32,76826,214
Qwen3 30B A3b fp8Alibaba32,76832,768
Qwen3.8 27BAlibaba32,76832,768
QwQ 32BAlibaba32,76832,768
Mixtral 8x7BMistral AI32,00032,000
GPT-3.5-turboOpenAI16,3854,096
Phi 4Microsoft16,38416,384
Qwen-MT PlusAlibaba16,3848,192
Qwen-MT TurboAlibaba16,3848,192
Step 2 (16K)StepFun16,3848,192
Llama 3.2 11B Vision InstructMeta16,0004,096
Llama 3.2 1B InstructMeta16,0004,096
Llama 3.2 3b InstructMeta16,0004,096
GPT-4OpenAI8,1928,192
Qwen Plus Character (Japanese)Alibaba8,192512
Hy-MT2 PlusTencent8,1924,096
Llama 3 70B InstructMeta8,1928,000
Mistral 7BMistral AI8,0008,000
GPT-3.5 Turbo InstructOpenAI3,5001,024

Then: Will It Fit? Context Checker

Results update automatically as you type.

Result
Yes — it fits in one call
53,000 tokens needed vs 128,000 tokens window
Document
50,000 tokens
Prompt / instructions
1,000 tokens
Reserved for output
2,000 tokens
Total needed
53,000 tokens
Context window
128,000 tokens
Docs of this size per call
2

Why this isn't trivial

The part people underestimate: few models support 200k tokens, and among those the input rate dominates because you are filling a huge window. In practice the biggest savings come from compressing context or using RAG so you need a smaller, cheaper window, so it is worth modelling before you commit.

How it's calculated

We estimate this by filtering models by context window, then ranking the qualifying ones by input cost at 200k tokens. Every figure uses the current provider prices baked into the site (reviewed daily), and you can override any input to match your own assumptions.

Frequently asked questions

Do I really need 200k tokens?+

Often not — RAG can retrieve just the relevant parts far more cheaply.

Why is filling a big window costly?+

You pay per input token, so 200k tokens is a large input bill every call.

Are these prices up to date?+

Yes. The model prices behind this calculator are refreshed and reviewed daily, so your estimate reflects current provider rates rather than a stale snapshot.

Related

Estimates for planning. Pricing data last reviewed 18 September 2026.