| Llama 3.1 Instruct 8B |
Meta |
6.9 |
$0.03 |
128K |
0 |
| Gemma 4 E4B (Non-reasoning) |
Google |
7.5 |
$0.04 |
128K |
44 |
| Gemma 4 E4B (Reasoning) |
Google |
8.9 |
$0.04 |
128K |
41 |
| Sarvam 30B (high) |
Sarvam |
6.6 |
$0.05 |
64K |
0 |
| Granite 4.2 3B |
IBM |
9.1 |
$0.05 |
128K |
231 |
| Qwen3.5 4B (Reasoning) |
Alibaba |
13.1 |
$0.06 |
256K |
17 |
| Qwen3.5 4B (Non-reasoning) |
Alibaba |
10.8 |
$0.06 |
256K |
12 |
| Nova Micro |
Amazon |
5.9 |
$0.06 |
130K |
224 |
| Granite 4.1 8B |
IBM |
6.6 |
$0.06 |
128K |
0 |
| Llama 3 Instruct 8B |
Meta |
4.8 |
$0.07 |
8K |
0 |
| NVIDIA Nemotron Nano 9B V2 (Reasoning) |
NVIDIA |
7.4 |
$0.07 |
128K |
95 |
| Sarvam 105B (high) |
Sarvam |
8.8 |
$0.07 |
128K |
0 |
| Agnes 3.0 Flash |
— |
35.5 |
$0.07 |
1M |
0 |
| Granite 3.3 8B (Non-reasoning) |
IBM |
4.9 |
$0.09 |
128K |
0 |
| NVIDIA Nemotron Nano 9B V2 (Non-reasoning) |
NVIDIA |
6.8 |
$0.09 |
128K |
158 |
| Qwen2.5 Turbo |
Alibaba |
6.4 |
$0.09 |
1M |
0 |
| NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning) |
NVIDIA |
6.8 |
$0.09 |
1M |
170 |
| NVIDIA Nemotron 3 Nano 30B A3B (Reasoning) |
NVIDIA |
8.9 |
$0.09 |
1M |
129 |
| gpt-oss-20b (high) |
OpenAI |
9.0 |
$0.09 |
128K |
189 |
| Nemotron 3.5 Lightning |
NVIDIA |
12.9 |
$0.10 |
1M |
290 |
| Hy3-preview (Non-reasoning) |
Tencent |
17.0 |
$0.10 |
256K |
0 |
| Ministral 3 3B |
Mistral |
4.8 |
$0.10 |
256K |
235 |
| Llama 2 Chat 7B |
Meta |
5.7 |
$0.10 |
4K |
0 |
| Hy3-preview (Reasoning) |
Tencent |
22.7 |
$0.10 |
256K |
0 |
| gpt-oss-20b (low) |
OpenAI |
10.0 |
$0.10 |
128K |
238 |
| Nova Lite |
Amazon |
6.7 |
$0.10 |
300K |
0 |
| Granite 4.2 8B |
IBM |
11.1 |
$0.11 |
131K |
83 |
| Granite 4.0 H Small |
IBM |
6.0 |
$0.11 |
128K |
13 |
| Ling 3.0 Flash |
InclusionAI |
24.9 |
$0.11 |
256K |
372 |
| Ling-3.0-flash-VL |
InclusionAI |
24.6 |
$0.11 |
256K |
141 |
| Ling-3.0-flash-Fin |
InclusionAI |
22.6 |
$0.11 |
256K |
162 |
| DeepSeek V4 Flash (Non-reasoning) |
DeepSeek |
18.9 |
$0.12 |
1M |
0 |
| Apertus 8B Instruct |
Swiss AI Initiative |
4.8 |
$0.13 |
64K |
0 |
| Olmo 3 7B Instruct |
Allen Institute for AI |
5.2 |
$0.13 |
64K |
0 |
| GPT-5 nano (medium) |
OpenAI |
12.5 |
$0.14 |
400K |
0 |
| GPT-5 nano (minimal) |
OpenAI |
7.1 |
$0.14 |
400K |
0 |
| GPT-5 nano (high) |
OpenAI |
13.0 |
$0.14 |
400K |
0 |
| Step 3.5 Flash |
StepFun |
16.6 |
$0.15 |
256K |
0 |
| Solar Mini |
Upstage |
6.4 |
$0.15 |
4K |
0 |
| MiMo-V2-Flash (Reasoning) |
Xiaomi |
20.8 |
$0.15 |
256K |
0 |
| Ministral 3 8B |
Mistral |
5.5 |
$0.15 |
256K |
103 |
| Step 3.5 Flash 2603 |
StepFun |
17.0 |
$0.15 |
256K |
0 |
| Gemma 4 12B (Reasoning) |
Google |
14.2 |
$0.15 |
256K |
141 |
| Gemma 4 12B (Non-reasoning) |
Google |
9.4 |
$0.15 |
256K |
134 |
| Agnes 2.5 Pro Beta |
— |
35.2 |
$0.15 |
1M |
0 |
| Mistral Small 3.2 |
Mistral |
8.2 |
$0.15 |
128K |
0 |
| Mistral Small 3.1 |
Mistral |
7.1 |
$0.15 |
128K |
0 |
| Mistral Small 3 |
Mistral |
6.7 |
$0.15 |
32K |
0 |
| Qwen3.5 9B (Reasoning) |
Alibaba |
13.7 |
$0.15 |
256K |
70 |
| GLM-4.7-Flash (Reasoning) |
Z AI |
14.9 |
$0.15 |
200K |
0 |
| GLM-4.7-Flash (Non-reasoning) |
Z AI |
10.6 |
$0.15 |
200K |
0 |
| Nemotron 3 Nano Omni 30B A3B Reasoning |
NVIDIA |
10.3 |
$0.16 |
256K |
0 |
| DeepSeek V4 Flash (Reasoning, High Effort) |
DeepSeek |
26.0 |
$0.17 |
1M |
0 |
| DeepSeek V4 Flash 0731 (Reasoning, Max Effort) |
DeepSeek |
24.2 |
$0.17 |
1M |
0 |
| GPT-4.1 nano |
OpenAI |
7.8 |
$0.17 |
1M |
0 |
| Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning) |
Google |
10.4 |
$0.17 |
1M |
0 |
| Gemini 2.5 Flash-Lite (Non-reasoning) |
Google |
6.7 |
$0.17 |
1M |
0 |
| MiMo-V2.5 |
Xiaomi |
25.2 |
$0.17 |
1M |
32 |
| Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning) |
Google |
9.3 |
$0.17 |
1M |
0 |
| Gemini 2.5 Flash-Lite (Reasoning) |
Google |
8.5 |
$0.17 |
1M |
0 |
| Gemma 4 26B A4B (Reasoning) |
Google |
16.7 |
$0.18 |
256K |
0 |
| Qwen3.5 9B (Non-reasoning) |
Alibaba |
13.3 |
$0.19 |
256K |
94 |
| Gemma 4 26B A4B (Non-reasoning) |
Google |
13.1 |
$0.20 |
256K |
71 |
| Ministral 3 14B |
Mistral |
6.0 |
$0.20 |
256K |
91 |
| Gemma 4 31B (Non-reasoning) |
Google |
13.9 |
$0.20 |
256K |
36 |
| Phi-4 |
Microsoft |
5.9 |
$0.22 |
16K |
35 |
| Qwen3.8-Flash-Next |
Alibaba |
39.8 |
$0.23 |
256K |
54 |
| GLM-5.3-Flash |
Z AI |
41.8 |
$0.24 |
1M |
92 |
| Ling-flash-2.0 |
InclusionAI |
7.8 |
$0.25 |
128K |
0 |
| Ring-flash-2.0 |
InclusionAI |
7.2 |
$0.25 |
128K |
0 |
| gpt-oss-120b (low) |
OpenAI |
10.2 |
$0.25 |
128K |
198 |
| Hy3 |
Tencent |
25.3 |
$0.25 |
256K |
91 |
| Jamba 1.5 Mini |
AI21 Labs |
5.2 |
$0.25 |
256K |
0 |
| Mistral 7B Instruct |
Mistral |
5.0 |
$0.25 |
8K |
0 |
| gpt-oss-120b (high) |
OpenAI |
11.6 |
$0.26 |
128K |
220 |
| Solar Pro 3 |
Upstage |
7.8 |
$0.26 |
128K |
0 |
| Mistral Small 4 (Non-reasoning) |
Mistral |
9.0 |
$0.26 |
256K |
155 |
| Mistral Small 4 (Reasoning) |
Mistral |
11.3 |
$0.26 |
256K |
169 |
| GPT-4o mini |
OpenAI |
6.7 |
$0.26 |
128K |
0 |
| Mistral Small (Feb '24) |
Mistral |
5.5 |
$0.26 |
32K |
0 |
| Qwen3.5 Omni Flash |
Alibaba |
12.5 |
$0.28 |
256K |
231 |
| Grok 4 Fast (Non-reasoning) |
SpaceXAI |
11.1 |
$0.28 |
2M |
0 |
| Grok 4 Fast (Reasoning) |
SpaceXAI |
17.9 |
$0.28 |
2M |
0 |
| Qwen3 32B (Non-reasoning) |
Alibaba |
7.3 |
$0.28 |
32K |
0 |
| Qwen3 VL 32B (Reasoning) |
Alibaba |
11.9 |
$0.28 |
256K |
0 |
| Qwen3 32B (Reasoning) |
Alibaba |
8.6 |
$0.28 |
32K |
0 |
| Qwen3 VL 32B Instruct |
Alibaba |
8.4 |
$0.28 |
256K |
0 |
| Granite 4.2 30B |
IBM |
14.8 |
$0.28 |
131K |
77 |
| NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning) |
NVIDIA |
5.8 |
$0.30 |
128K |
196 |
| NVIDIA Nemotron Nano 12B v2 VL (Reasoning) |
NVIDIA |
7.5 |
$0.30 |
128K |
128 |
| Seed-OSS-36B-Instruct |
ByteDance Seed |
12.1 |
$0.30 |
512K |
0 |
| Mistral Small (Sep '24) |
Mistral |
5.8 |
$0.30 |
32K |
0 |
| Nemotron 3 Super 120B A12B (Reasoning) |
NVIDIA |
12.8 |
$0.31 |
1M |
212 |
| Qwen3 VL 8B Instruct |
Alibaba |
7.3 |
$0.31 |
256K |
0 |
| Qwen3 8B (Non-reasoning) |
Alibaba |
6.0 |
$0.31 |
32K |
0 |
| Llama 4 Scout |
Meta |
8.1 |
$0.31 |
10M |
105 |
| DeepSeek V3.2 (Reasoning) |
DeepSeek |
21.5 |
$0.32 |
128K |
0 |
| DeepSeek V3.2 Exp (Non-reasoning) |
DeepSeek |
13.9 |
$0.32 |
128K |
0 |
| DeepSeek V3.2 (Non-reasoning) |
DeepSeek |
16.0 |
$0.32 |
128K |
0 |
| DeepSeek V3.2 Exp (Reasoning) |
DeepSeek |
16.6 |
$0.32 |
128K |
0 |
| Celeris-1 |
— |
6.3 |
$0.33 |
131K |
2075 |
| Llama 3.2 Instruct 11B (Vision) |
Meta |
5.4 |
$0.34 |
128K |
16 |
| Qwen3 30B A3B 2507 Instruct |
Alibaba |
7.5 |
$0.35 |
256K |
0 |
| Grok 3 mini Reasoning (high) |
SpaceXAI |
14.6 |
$0.35 |
1M |
0 |
| Qwen3 VL 30B A3B Instruct |
Alibaba |
7.9 |
$0.35 |
256K |
0 |
| Reka Flash (Sep '24) |
Reka AI |
6.4 |
$0.35 |
128K |
0 |
| Qwen3 30B A3B (Non-reasoning) |
Alibaba |
6.6 |
$0.35 |
32K |
0 |
| Reka Flash 3 |
Reka AI |
5.6 |
$0.35 |
128K |
91 |
| GLM-4.5-Air |
Z AI |
11.1 |
$0.37 |
128K |
0 |
| Mercury 2 |
Inception |
13.8 |
$0.38 |
128K |
734 |
| Llama Nemotron Super 49B v1.5 (Non-reasoning) |
NVIDIA |
7.4 |
$0.40 |
128K |
123 |
| Llama Nemotron Super 49B v1.5 (Reasoning) |
NVIDIA |
9.0 |
$0.40 |
128K |
150 |
| Qwen3 235B A22B 2507 Instruct |
Alibaba |
12.0 |
$0.40 |
256K |
0 |
| Trinity Large Thinking |
Arcee AI |
10.8 |
$0.41 |
512K |
323 |
| Qwen3 Next 80B A3B (Reasoning) |
Alibaba |
11.2 |
$0.41 |
256K |
174 |
| Qwen3 Next 80B A3B Instruct |
Alibaba |
9.6 |
$0.41 |
256K |
175 |
| Llama 4 Maverick |
Meta |
10.0 |
$0.42 |
1M |
108 |
| Qwen3 Omni 30B A3B Instruct |
Alibaba |
6.0 |
$0.43 |
64K |
108 |
| Qwen3 Omni 30B A3B (Reasoning) |
Alibaba |
7.8 |
$0.43 |
64K |
108 |
| Step 3.7 Flash |
StepFun |
19.5 |
$0.44 |
256K |
199 |