AI Model API Pricing: What a Request Really Costs

259 models, 16 labs, prices synced every 6 hours. Set your prompt size below — we'll rank every model by what that request actually costs. No affiliate links on this page.

Token cost calculator

Rule of thumb: 1 token ≈ 4 characters ≈ ¾ of an English word. List prices; caching and batch discounts can lower real costs.

#ModelLabThis requestInput $/1MOutput $/1MContext
1Mistral NemoMistral$0.0010$0.019$0.03131k
2Llama 3.2 1B InstructMeta$0.0018$0.027$0.20160k
3Qwen3.7 FlashQwen$0.0018$0.03$0.131M
4gpt-oss-20bOpenAI$0.0018$0.03$0.13131k
5gpt-oss-120bOpenAI$0.0018$0.03$0.17131k
6Nova Micro 1.0Amazon$0.0020$0.035$0.14128k
7Command R7B (12-2024)Cohere$0.0022$0.0375$0.15128k
8Mistral Small 3Mistral$0.0027$0.05$0.0833k
9Llama 3.1 8B InstructMeta$0.0027$0.05$0.08131k
10Gemma 3 4BGoogle$0.0027$0.05$0.1131k
11Qwen3 30B A3B Instruct 2507Qwen$0.0028$0.0482$0.193262k
12Gemma 3 12BGoogle$0.0028$0.05$0.15131k
13Nemotron 3 Nano 30B A3BNVIDIA$0.0029$0.05$0.2262k
14Llama 3.2 3B InstructMeta$0.0032$0.05$0.33131k
15Gemma 3n 4BGoogle$0.0032$0.06$0.1233k
16GPT-5 NanoOpenAI$0.0033$0.05$0.4400k
17Nova Lite 1.0Amazon$0.0035$0.06$0.24300k
18Qwen3.5-FlashQwen$0.0038$0.065$0.261M
19Phi 4Microsoft$0.0038$0.07$0.1416k
20GLM 4.7 FlashZ.ai$0.0038$0.06$0.4203k
21Qwen3 Coder 30B A3B InstructQwen$0.0041$0.07$0.28262k
22Gemma 4 26B A4B Google$0.0042$0.07$0.34262k
23gpt-oss-safeguard-20bOpenAI$0.0043$0.075$0.3131k
24Nemotron 3.5 LightningNVIDIA$0.0044$0.08$0.2262k
25DeepSeek V4 Flash 0423DeepSeek$0.0045$0.0826$0.1651.0M
26Qwen3 32BQwen$0.0046$0.08$0.28131k
27Gemma 3 27BGoogle$0.0049$0.08$0.45262k
28Nemotron 3 SuperNVIDIA$0.0051$0.085$0.41M
29Mistral Small 3.2 24BMistral$0.0052$0.0938$0.25256k
30Ministral 3 3B 2512Mistral$0.0052$0.1$0.1131k
31Qwen3.5-9BQwen$0.0053$0.1$0.15262k
32Qwen2.5 7B InstructQwen$0.0054$0.1$0.233k
33Qwen3 235B A22B Instruct 2507Qwen$0.0056$0.09$0.55262k
34Voxtral Small 24B 2507Mistral$0.0056$0.1$0.332k
35Llama 4 ScoutMeta$0.0056$0.1$0.31.3M
36Llama 3.3 70B InstructMeta$0.0056$0.1$0.32131k
37Gemma 4 31BGoogle$0.0057$0.1$0.34262k
38Ministral 8BMistral$0.0057$0.11$0.11128k
39Gemini 2.5 Flash Lite Preview 09-2025Google$0.0058$0.1$0.41.0M
40Gemini 2.5 Flash LiteGoogle$0.0058$0.1$0.41.0M
41GPT-4.1 NanoOpenAI$0.0058$0.1$0.41.0M
42Qwen3 VL 32B InstructQwen$0.0060$0.104$0.416131k
43Qwen3 14BQwen$0.0065$0.12$0.24131k
44Qwen3 Next 80B A3B InstructQwen$0.0067$0.09$1.10262k
45Qwen3 VL 8B InstructQwen$0.0068$0.117$0.455262k
46Qwen3 8BQwen$0.0068$0.117$0.455131k
47Llama 3 8B InstructMeta$0.0073$0.14$0.148k
48Qwen3 VL 30B A3B InstructQwen$0.0075$0.13$0.52262k
49Qwen3 30B A3BQwen$0.0075$0.13$0.52131k
50DeepSeek V4 Flash 0731DeepSeek$0.0076$0.14$0.281.3M
51Qwen3 Coder NextQwen$0.0076$0.12$0.8262k
52Ministral 3 8B 2512Mistral$0.0078$0.15$0.15262k
53GLM 4.5 AirZ.ai$0.0082$0.13$0.85131k
54Mistral Small 4Mistral$0.0087$0.15$0.6262k
55GPT-4o-mini Search PreviewOpenAI$0.0087$0.15$0.6128k
56Command R (08-2024)Cohere$0.0087$0.15$0.6128k
57GPT-4o-miniOpenAI$0.0087$0.15$0.6128k
58GPT-4o-mini (2024-07-18)OpenAI$0.0087$0.15$0.6128k
59Qwen3.6 35B A3BQwen$0.0090$0.14$1.00262k
60Llama Guard 4 12BMeta$0.0094$0.18$0.181.0M
61Qwen3 Next 80B A3B ThinkingQwen$0.0099$0.15$1.20262k
62Ministral 3 14B 2512Mistral$0.010$0.2$0.2262k
63SabaMistral$0.011$0.2$0.633k
64Llama 4 MaverickMeta$0.012$0.2$0.81.0M
65Qwen3.6 FlashQwen$0.012$0.188$1.131M
66Qwen3 Coder FlashQwen$0.012$0.195$0.9751M
67MiniMax-01MiniMax$0.012$0.2$1.101.0M
68GPT-5.6 Luna ProOpenAI$0.012$0.2$1.201.1M
69GPT-5.6 LunaOpenAI$0.012$0.2$1.201.1M
70GPT-5.4 NanoOpenAI$0.013$0.2$1.25400k
71Qwen3.5-27BQwen$0.013$0.195$1.56262k
72MiniMax M2.5MiniMax$0.013$0.225$0.9205k
73Qwen3 VL 8B ThinkingQwen$0.013$0.18$2.10131k
74DeepSeek V3.2DeepSeek$0.014$0.269$0.4164k
75Qwen3 VL 235B A22B InstructQwen$0.014$0.21$1.90262k
76DeepSeek V3.2 ExpDeepSeek$0.014$0.27$0.41164k
77DeepSeek V3.1DeepSeek$0.014$0.25$0.95164k
78DeepSeek V3 0324DeepSeek$0.015$0.25$1.00164k
79Qwen Plus 0728Qwen$0.015$0.26$0.781M
80Qwen-PlusQwen$0.015$0.26$0.781M
81MiniMax M2MiniMax$0.015$0.255$1.02205k
82Qwen3 VL 30B A3B ThinkingQwen$0.015$0.2$2.40262k
83Qwen3 30B A3B Thinking 2507Qwen$0.015$0.2$2.4082k
84DeepSeek V3DeepSeek$0.015$0.257$1.03164k
85Qwen3.5-35B-A3BQwen$0.015$0.25$1.25262k
86Claude 3 HaikuAnthropic$0.015$0.25$1.25200k
87Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google$0.015$0.25$1.5066k
88Gemini 3.1 Flash LiteGoogle$0.015$0.25$1.501.0M
89Gemini 3.1 Flash Lite PreviewGoogle$0.015$0.25$1.501.0M
90DeepSeek V3.1 TerminusDeepSeek$0.016$0.27$1.00164k
91Qwen3 235B A22B Thinking 2507Qwen$0.016$0.23$2.30262k
92Qwen3.5 Plus 2026-02-15Qwen$0.016$0.26$1.561M
93GPT-5.1-Codex-MiniOpenAI$0.017$0.25$2.00400k
94GPT-5 MiniOpenAI$0.017$0.25$2.00400k
95GLM 4.6VZ.ai$0.017$0.3$0.9131k
96Codestral 2508Mistral$0.017$0.3$0.9256k
97Qwen3 Coder 480B A35BQwen$0.017$0.3$1.00262k
98Qwen3.5-122B-A10BQwen$0.017$0.26$2.08262k
99MiniMax M3MiniMax$0.017$0.3$1.201.0M
100MiniMax M2.7MiniMax$0.017$0.3$1.20205k
101MiniMax M2-herMiniMax$0.017$0.3$1.2066k
102MiniMax M2.1MiniMax$0.017$0.3$1.20205k
103Llama 3.2 11B Vision InstructMeta$0.018$0.345$0.345131k
104Qwen3.7 PlusQwen$0.019$0.32$1.281M
105Qwen3.5 Plus 2026-04-20Qwen$0.019$0.3$1.801M
106Mistral Small 3.1 24BMistral$0.019$0.351$0.555128k
107Qwen2.5 72B InstructQwen$0.019$0.36$0.433k
108Gemini 3.5 Flash LiteGoogle$0.020$0.3$2.501.0M
109Nova 2 LiteAmazon$0.020$0.3$2.501M
110Nano Banana (Gemini 2.5 Flash Image)Google$0.020$0.3$2.5033k
111Gemini 2.5 FlashGoogle$0.020$0.3$2.501.0M
112Qwen3.6 PlusQwen$0.020$0.325$1.951M
113Llama 3.3 Nemotron Super 49B V1.5NVIDIA$0.021$0.4$0.4131k
114Llama 3.1 70B InstructMeta$0.021$0.4$0.4131k
115Gemini 3.7 FlashGoogle$0.023$0.375$1.881.0M
116GPT-4.1 MiniOpenAI$0.023$0.4$1.601.0M
117GLM 4.7Z.ai$0.024$0.4$1.75205k
118Devstral 2 2512Mistral$0.024$0.4$2.00262k
119Mistral Medium 3.1Mistral$0.024$0.4$2.00131k
120Mistral Medium 3Mistral$0.024$0.4$2.00131k
121Qwen3.5 397B A17BQwen$0.024$0.39$2.34262k
122Qwen3 235B A22BQwen$0.026$0.455$1.82131k
123Kimi K2.5Moonshot AI$0.027$0.45$2.25262k
124Mistral Large 3 2512Mistral$0.028$0.5$1.50262k
125GPT-3.5 TurboOpenAI$0.028$0.5$1.5016k
126Qwen3 VL 235B A22B ThinkingQwen$0.028$0.4$4.00131k
127Qwen3.8 27BQwen$0.029$0.45$3.201M
128GLM 4.6Z.ai$0.029$0.5$2.00205k
129R1 0528DeepSeek$0.029$0.5$2.15164k
130Nano Banana 2 (Gemini 3.1 Flash Image)Google$0.031$0.5$3.00131k
131Nano Banana 2 (Gemini 3.1 Flash Image Preview)Google$0.031$0.5$3.0066k
132Gemini 3 Flash PreviewGoogle$0.031$0.5$3.001.0M
133MiniMax M1MiniMax$0.032$0.55$2.201M
134WizardLM-2 8x22BMicrosoft$0.032$0.62$0.6266k
135Kimi K2 0711Moonshot AI$0.033$0.57$2.30131k
136GLM 4.5VZ.ai$0.034$0.6$1.8066k
137Gemma 2 27BGoogle$0.034$0.65$0.658k
138GLM 5Z.ai$0.034$0.6$1.92205k
139GLM 4.5Z.ai$0.034$0.6$2.20131k
140GPT Audio MiniOpenAI$0.035$0.6$2.40128k
141Kimi K2 ThinkingMoonshot AI$0.035$0.6$2.50262k
142Kimi K2 0905Moonshot AI$0.035$0.6$2.50262k
143Qwen2.5 Coder 32B InstructQwen$0.035$0.66$1.0033k
144Nemotron 3 UltraNVIDIA$0.037$0.6$3.60512k
145Qwen3.6 27BQwen$0.037$0.6$3.60262k
146Qwen3 Coder PlusQwen$0.039$0.65$3.251M
147R1DeepSeek$0.040$0.7$2.5064k
148Kimi K2.7 CodeMoonshot AI$0.040$0.67$3.40262k
149R1 Distill Llama 70BDeepSeek$0.042$0.8$0.88k
150Qwen2.5 VL 72B InstructQwen$0.042$0.8$1.00128k
151Gemini 3.6 FlashGoogle$0.045$0.75$3.751.0M
152Nova Pro 1.0Amazon$0.046$0.8$3.20300k
153GPT-5.4 MiniOpenAI$0.047$0.75$4.50400k
154Qwen3 Max ThinkingQwen$0.047$0.78$3.90262k
155Qwen3 MaxQwen$0.047$0.78$3.90262k
156SonarPerplexity$0.052$1.00$1.00127k
157Grok Build 0.1xAI$0.054$1.00$2.00256k
158GPT-3.5 Turbo (older v0613)OpenAI$0.054$1.00$2.004k
159GLM 5.2Z.ai$0.054$0.966$3.041.0M
160GLM 5.1Z.ai$0.054$0.966$3.04205k
161Kimi K2.6Moonshot AI$0.056$0.95$4.00262k
162Claude Haiku 4.5Anthropic$0.060$1.00$5.00200k
163Qwen3.6 Max PreviewQwen$0.064$1.03$6.16262k
164o4 Mini HighOpenAI$0.064$1.10$4.40200k
165o4 MiniOpenAI$0.064$1.10$4.40200k
166o3 Mini HighOpenAI$0.064$1.10$4.40200k
167o3 MiniOpenAI$0.064$1.10$4.40200k
168DeepSeek V4 Pro 0813DeepSeek$0.067$1.19$3.561.0M
169Grok 4.3xAI$0.068$1.25$2.501M
170Grok 4.20 Multi-AgentxAI$0.068$1.25$2.502M
171Grok 4.20xAI$0.068$1.25$2.502M
172GLM 5V TurboZ.ai$0.068$1.20$4.00203k
173GLM 5 TurboZ.ai$0.068$1.20$4.00203k
174GLM 5.3Z.ai$0.079$1.40$4.401.0M
175GPT-3.5 Turbo InstructOpenAI$0.079$1.50$2.004k
176GPT-5.1-Codex-MaxOpenAI$0.083$1.25$10.00400k
177GPT-5.1OpenAI$0.083$1.25$10.00400k
178GPT-5.1 ChatOpenAI$0.083$1.25$10.00128k
179GPT-5.1-CodexOpenAI$0.083$1.25$10.00400k
180GPT-5 CodexOpenAI$0.083$1.25$10.00400k
181GPT-5 ChatOpenAI$0.083$1.25$10.00128k
182GPT-5OpenAI$0.083$1.25$10.00400k
183Gemini 2.5 ProGoogle$0.083$1.25$10.001.0M
184Gemini 2.5 Pro Preview 06-05Google$0.083$1.25$10.001.0M
185Gemini 2.5 Pro Preview 05-06Google$0.083$1.25$10.001.0M
186Qwen3.7 MaxQwen$0.083$1.48$4.421M
187DeepSeek V4 Pro 0423DeepSeek$0.086$1.60$3.201.0M
188Mistral Medium 3.5Mistral$0.090$1.50$7.50262k
189Gemini 3.5 FlashGoogle$0.093$1.50$9.001.0M
190Qwen3.8 2.4T A95BQwen$0.112$2.00$6.001.0M
191Grok 4.6xAI$0.112$2.00$6.00500k
192Qwen3.8 MaxQwen$0.112$2.00$6.001M
193Grok 4.5xAI$0.112$2.00$6.00500k
194Mistral Large 2407Mistral$0.112$2.00$6.00131k
195Mixtral 8x22B InstructMistral$0.112$2.00$6.0066k
196Mistral LargeMistral$0.112$2.00$6.00128k
197GPT-5.3 ChatOpenAI$0.116$1.75$14.00128k
198GPT-5.3-CodexOpenAI$0.116$1.75$14.00400k
199GPT-5.2-CodexOpenAI$0.116$1.75$14.00400k
200GPT-5.2 ChatOpenAI$0.116$1.75$14.00128k
201GPT-5.2OpenAI$0.116$1.75$14.00400k
202o4 Mini Deep ResearchOpenAI$0.116$2.00$8.00200k
203o3OpenAI$0.116$2.00$8.00200k
204GPT-4.1OpenAI$0.116$2.00$8.001.0M
205Sonar Reasoning ProPerplexity$0.116$2.00$8.00128k
206Sonar Deep ResearchPerplexity$0.116$2.00$8.00128k
207Claude Sonnet 5Anthropic$0.120$2.00$10.001M
208GPT-5.6 Terra ProOpenAI$0.124$2.00$12.001.1M
209GPT-5.6 TerraOpenAI$0.124$2.00$12.001.1M
210Nano Banana Pro (Gemini 3 Pro Image)Google$0.124$2.00$12.00131k
211Gemini 3.1 Pro Preview Custom ToolsGoogle$0.124$2.00$12.001.0M
212Gemini 3.1 Pro PreviewGoogle$0.124$2.00$12.001.0M
213Nano Banana Pro (Gemini 3 Pro Image Preview)Google$0.124$2.00$12.0066k
214GPT-5 Image MiniOpenAI$0.129$2.50$2.00400k
215GPT AudioOpenAI$0.145$2.50$10.00128k
216Command ACohere$0.145$2.50$10.00256k
217GPT-4o Search PreviewOpenAI$0.145$2.50$10.00128k
218GPT-4o (2024-11-20)OpenAI$0.145$2.50$10.00128k
219Command R+ (08-2024)Cohere$0.145$2.50$10.00128k
220GPT-4o (2024-08-06)OpenAI$0.145$2.50$10.00128k
221GPT-4oOpenAI$0.145$2.50$10.00128k
222Nova Premier 1.0Amazon$0.150$2.50$12.501M
223GPT-5.6 Sol ProOpenAI$0.155$2.50$15.001.1M
224GPT-5.6 SolOpenAI$0.155$2.50$15.001.1M
225GPT-5.4OpenAI$0.155$2.50$15.001.1M
226GPT-3.5 Turbo 16kOpenAI$0.158$3.00$4.0016k
227Kimi K3Moonshot AI$0.180$3.00$15.001.0M
228Claude Sonnet 4.6Anthropic$0.180$3.00$15.001M
229Sonar Pro SearchPerplexity$0.180$3.00$15.00200k
230Claude Sonnet 4.5Anthropic$0.180$3.00$15.001M
231Claude Sonnet 4Anthropic$0.180$3.00$15.001M
232Sonar ProPerplexity$0.180$3.00$15.00200k
233GPT-4o (2024-05-13)OpenAI$0.280$5.00$15.00128k
234Claude Opus 5Anthropic$0.300$5.00$25.001M
235Claude Opus 4.8Anthropic$0.300$5.00$25.001M
236Claude Opus 4.7Anthropic$0.300$5.00$25.001M
237Claude Opus 4.6Anthropic$0.300$5.00$25.001M
238Claude Opus 4.5Anthropic$0.300$5.00$25.00200k
239GPT Chat LatestOpenAI$0.310$5.00$30.00400k
240GPT-5.5OpenAI$0.310$5.00$30.001.1M
241GPT-5.4 Image 2OpenAI$0.430$8.00$15.00272k
242GPT-5 ImageOpenAI$0.520$10.00$10.00400k
243GPT-4 TurboOpenAI$0.560$10.00$30.00128k
244GPT-4 Turbo PreviewOpenAI$0.560$10.00$30.00128k
245o3 Deep ResearchOpenAI$0.580$10.00$40.00200k
246Claude Opus 5 (Fast)Anthropic$0.600$10.00$50.001M
247Claude Fable 5Anthropic$0.600$10.00$50.001M
248Claude Opus 4.8 (Fast)Anthropic$0.600$10.00$50.001M
249o1OpenAI$0.870$15.00$60.00200k
250Claude Opus 4.1Anthropic$0.900$15.00$75.00200k
251Claude Opus 4Anthropic$0.900$15.00$75.00200k
252GPT-5 ProOpenAI$0.990$15.00$120.00400k
253o3 ProOpenAI$1.16$20.00$80.00200k
254GPT-5.2 ProOpenAI$1.39$21.00$168.00400k
255GPT-4OpenAI$1.62$30.00$60.008k
256Claude Opus 4.7 (Fast)Anthropic$1.80$30.00$150.001M
257GPT-5.5 ProOpenAI$1.86$30.00$180.001.1M
258GPT-5.4 ProOpenAI$1.86$30.00$180.001.1M
259o1-proOpenAI$8.70$150.00$600.00200k

Methodology

List prices in USD per 1M tokens from live market data (OpenRouter public catalog), refreshed every 6 hours. The per-request cost = input tokens × input price + output tokens × output price. Provider-side discounts (caching, batch) can reduce real costs — check each model page for cache pricing.