| MiMo-V2-Flash (Feb 2026) |
Xiaomi |
22.4 |
$0.00 |
256K |
0 |
| MiMo-V2-Flash (Reasoning) |
Xiaomi |
20.8 |
$0.15 |
256K |
0 |
| Ling-2.6-1T |
InclusionAI |
17.0 |
$0.85 |
256K |
0 |
| Gemma 4 26B A4B (Reasoning) |
Google |
16.7 |
$0.18 |
256K |
0 |
| DeepSeek V3.2 Exp (Reasoning) |
DeepSeek |
16.6 |
$0.32 |
128K |
0 |
| DeepSeek V3.2 (Non-reasoning) |
DeepSeek |
16.0 |
$0.32 |
128K |
0 |
| DeepSeek V3.2 Speciale |
DeepSeek |
14.5 |
$0.00 |
128K |
0 |
| DeepSeek V3.2 Exp (Non-reasoning) |
DeepSeek |
13.9 |
$0.32 |
128K |
0 |
| DeepSeek V3.1 Terminus (Non-reasoning) |
DeepSeek |
13.9 |
$0.45 |
128K |
0 |
| Apriel-v1.5-15B-Thinker |
ServiceNow |
13.8 |
$0.00 |
128K |
0 |
| DeepSeek V3.1 (Non-reasoning) |
DeepSeek |
13.7 |
$0.85 |
128K |
0 |
| DeepSeek V3.1 (Reasoning) |
DeepSeek |
13.5 |
$0.86 |
128K |
0 |
| Apriel-v1.6-15B-Thinker |
ServiceNow |
13.4 |
$0.00 |
128K |
0 |
| EXAONE 4.5 33B |
LG AI Research |
13.2 |
$0.00 |
256K |
0 |
| DeepSeek R1 0528 (May '25) |
DeepSeek |
13.1 |
$1.76 |
128K |
0 |
| GLM-4.5 (Reasoning) |
Z AI |
12.8 |
$0.00 |
128K |
0 |
| MiniMax M1 80k |
MiniMax |
11.7 |
$0.96 |
1M |
0 |
| LongCat Flash Lite |
LongCat |
11.5 |
$0.00 |
256K |
0 |
| HyperCLOVA X SEED Think (32B) |
Naver |
11.4 |
$0.00 |
128K |
0 |
| DeepSeek R1 (Jan '25) |
DeepSeek |
11.4 |
$2.50 |
128K |
0 |
| K-EXAONE (Non-reasoning) |
LG AI Research |
11.2 |
$0.00 |
256K |
0 |
| Ring-1T |
InclusionAI |
10.9 |
$0.00 |
128K |
0 |
| INTELLECT-3 |
Prime Intellect |
10.6 |
$0.00 |
131K |
0 |
| Solar Open 100B (Reasoning) |
Upstage |
10.4 |
$0.00 |
128K |
0 |
| MiniMax M1 40k |
MiniMax |
10.0 |
$0.00 |
1M |
0 |
| K2-V2 (high) |
MBZUAI Institute of Foundation Models |
9.9 |
$0.00 |
512K |
0 |
| DeepSeek V3 0324 |
DeepSeek |
9.7 |
$0.93 |
128K |
0 |
| Tri-21B-think Preview |
Trillion Labs |
9.6 |
$0.00 |
32K |
0 |
| Ling-1T |
InclusionAI |
9.2 |
$0.00 |
128K |
0 |
| K2-V2 (medium) |
MBZUAI Institute of Foundation Models |
9.0 |
$0.00 |
512K |
0 |
| Tri-21B-Think |
Trillion Labs |
9.0 |
$0.00 |
32K |
0 |
| Llama 3.3 Nemotron Super 49B v1 (Reasoning) |
NVIDIA |
8.9 |
$0.00 |
128K |
0 |
| MiniCPM5-1B (Reasoning) |
OpenBMB |
8.8 |
$0.00 |
128K |
0 |
| Qwen3 4B 2507 (Reasoning) |
Alibaba |
8.8 |
$0.00 |
256K |
0 |
| Devstral Small (May '25) |
Mistral |
8.7 |
$0.00 |
256K |
0 |
| MiniCPM5-1B (Non-reasoning) |
OpenBMB |
8.7 |
$0.00 |
128K |
0 |
| DeepSeek V3 (Dec '24) |
DeepSeek |
8.5 |
$0.46 |
128K |
0 |
| DeepSeek R1 Distill Qwen 32B |
DeepSeek |
8.4 |
$0.00 |
128K |
0 |
| EXAONE 4.0 32B (Reasoning) |
LG AI Research |
8.2 |
$0.00 |
131K |
0 |
| Magistral Small 1 |
Mistral |
8.2 |
$0.00 |
40K |
0 |
| DeepSeek R1 0528 Qwen3 8B |
DeepSeek |
8.1 |
$0.00 |
32K |
0 |
| Falcon-H1R-7B |
TII UAE |
7.8 |
$0.00 |
256K |
0 |
| DeepSeek R1 Distill Qwen 14B |
DeepSeek |
7.8 |
$0.00 |
128K |
0 |
| Qwen2.5 Instruct 72B |
Alibaba |
7.7 |
$0.48 |
128K |
0 |
| Step3 VL 10B |
StepFun |
7.7 |
$0.00 |
64K |
0 |
| Devstral Small (Jul '25) |
Mistral |
7.6 |
$0.00 |
256K |
0 |
| Mistral Large 2 (Nov '24) |
Mistral |
7.6 |
$0.00 |
128K |
0 |
| ERNIE 4.5 300B A47B |
Baidu |
7.5 |
$0.48 |
128K |
0 |
| Llama 3.1 Nemotron Nano 4B v1.1 (Reasoning) |
NVIDIA |
7.3 |
$0.00 |
128K |
0 |
| K2-V2 (low) |
MBZUAI Institute of Foundation Models |
7.3 |
$0.00 |
512K |
0 |
| Kimi Linear 48B A3B Instruct |
Kimi |
7.3 |
$0.00 |
1M |
0 |
| Llama 3.3 Nemotron Super 49B v1 (Non-reasoning) |
NVIDIA |
7.3 |
$0.00 |
128K |
0 |
| Qwen3 4B (Reasoning) |
Alibaba |
7.2 |
$0.00 |
32K |
0 |
| Llama 3.1 Tulu3 405B |
Allen Institute for AI |
7.2 |
$0.00 |
128K |
0 |
| Ring-flash-2.0 |
InclusionAI |
7.2 |
$0.25 |
128K |
0 |
| Grok 2 (Dec '24) |
SpaceXAI |
7.1 |
$0.00 |
128K |
0 |
| Pixtral Large |
Mistral |
7.1 |
$0.00 |
128K |
0 |
| Olmo 3.1 32B Think |
Allen Institute for AI |
7.1 |
$0.00 |
66K |
0 |
| Qwen3 VL 4B (Reasoning) |
Alibaba |
7.0 |
$0.00 |
256K |
0 |
| Qwen2.5 Instruct 32B |
Alibaba |
6.9 |
$0.00 |
128K |
0 |
| Mistral Large 2 (Jul '24) |
Mistral |
6.8 |
$3.00 |
128K |
0 |
| Qwen2.5 Coder Instruct 32B |
Alibaba |
6.7 |
$0.00 |
128K |
0 |
| Qwen3 4B 2507 Instruct |
Alibaba |
6.7 |
$0.00 |
256K |
0 |
| DeepSeek-V2.5 |
DeepSeek |
6.6 |
$0.00 |
128K |
0 |
| Qwen3 4B (Non-reasoning) |
Alibaba |
6.6 |
$0.00 |
32K |
0 |
| DeepSeek-V2.5 (Dec '24) |
DeepSeek |
6.6 |
$0.00 |
128K |
0 |
| Olmo 3.1 32B Instruct |
Allen Institute for AI |
6.5 |
$0.00 |
64K |
0 |
| Gemma 4 E2B (Non-reasoning) |
Google |
6.5 |
$0.00 |
128K |
0 |
| Olmo 3 32B Think |
Allen Institute for AI |
6.5 |
$0.00 |
64K |
0 |
| DeepSeek R1 Distill Llama 8B |
DeepSeek |
6.5 |
$0.00 |
128K |
0 |
| R1 1776 |
Perplexity |
6.4 |
$0.00 |
128K |
0 |
| EXAONE 4.0 32B (Non-reasoning) |
LG AI Research |
6.3 |
$0.00 |
131K |
0 |
| Qwen2 Instruct 72B |
Alibaba |
6.3 |
$0.00 |
128K |
0 |
| Grok-1 |
SpaceXAI |
6.3 |
$0.00 |
8K |
0 |
| DeepHermes 3 - Mistral 24B Preview (Non-reasoning) |
Nous Research |
6.1 |
$0.00 |
32K |
0 |
| Jamba 1.5 Large |
AI21 Labs |
6.0 |
$3.50 |
256K |
0 |
| OLMo 2 32B |
Allen Institute for AI |
6.0 |
$0.00 |
4K |
0 |
| DeepSeek-Coder-V2 |
DeepSeek |
6.0 |
$0.00 |
128K |
0 |
| LFM2 24B A2B |
Liquid AI |
5.9 |
$0.00 |
32K |
0 |
| Gemma 3n E4B Instruct Preview (May '25) |
Google |
5.8 |
$0.00 |
32K |
0 |
| Qwen2.5 Coder Instruct 7B |
Alibaba |
5.8 |
$0.00 |
128K |
0 |
| Phi-3 Mini Instruct 3.8B |
Microsoft |
5.8 |
$0.00 |
4K |
0 |
| Qwen1.5 Chat 110B |
Alibaba |
5.7 |
$0.00 |
32K |
0 |
| Jamba Reasoning 3B |
AI21 Labs |
5.7 |
$0.00 |
262K |
0 |
| Mixtral 8x22B Instruct |
Mistral |
5.7 |
$0.00 |
65K |
0 |
| Qwen3 VL 4B Instruct |
Alibaba |
5.7 |
$0.00 |
256K |
0 |
| Molmo 7B-D |
Allen Institute for AI |
5.6 |
$0.00 |
4K |
0 |
| Olmo 3 7B Think |
Allen Institute for AI |
5.6 |
$0.00 |
64K |
0 |
| OLMo 2 7B |
Allen Institute for AI |
5.6 |
$0.00 |
4K |
0 |
| DeepSeek R1 Distill Qwen 1.5B |
DeepSeek |
5.5 |
$0.00 |
128K |
0 |
| DeepSeek-V2-Chat |
DeepSeek |
5.5 |
$0.00 |
128K |
0 |
| Ling-mini-2.0 |
InclusionAI |
5.5 |
$0.00 |
131K |
0 |
| Qwen Chat 72B |
Alibaba |
5.4 |
$0.00 |
33K |
0 |
| Arctic Instruct |
Snowflake |
5.4 |
$0.00 |
4K |
0 |
| Llama 2 Chat 13B |
Meta |
5.3 |
$0.00 |
4K |
0 |
| Llama 2 Chat 70B |
Meta |
5.3 |
$0.00 |
4K |
0 |
| DeepSeek Coder V2 Lite Instruct |
DeepSeek |
5.3 |
$0.00 |
128K |
0 |
| Sarvam M (Reasoning) |
Sarvam |
5.3 |
$0.00 |
32K |
0 |
| DeepSeek LLM 67B Chat (V1) |
DeepSeek |
5.3 |
$0.00 |
4K |
0 |
| Command-R+ (Apr '24) |
Cohere |
5.3 |
$0.00 |
128K |
0 |
| Exaone 4.0 1.2B (Reasoning) |
LG AI Research |
5.3 |
$0.00 |
64K |
0 |
| DBRX Instruct |
Databricks |
5.3 |
$0.00 |
32K |
0 |
| OpenChat 3.5 (1210) |
OpenChat |
5.3 |
$0.00 |
8K |
0 |
| Exaone 4.0 1.2B (Non-reasoning) |
LG AI Research |
5.2 |
$0.00 |
64K |
0 |
| Qwen3 1.7B (Reasoning) |
Alibaba |
5.2 |
$0.00 |
32K |
0 |
| Olmo 3 7B Instruct |
Allen Institute for AI |
5.2 |
$0.13 |
64K |
0 |
| Jamba 1.5 Mini |
AI21 Labs |
5.2 |
$0.25 |
256K |
0 |
| LFM2 2.6B |
Liquid AI |
5.2 |
$0.00 |
32K |
0 |
| Jamba 1.7 Mini |
AI21 Labs |
5.2 |
$0.00 |
258K |
0 |
| Granite 4.0 H 1B |
IBM |
5.2 |
$0.00 |
128K |
0 |
| LFM2.5-1.2B-Instruct |
Liquid AI |
5.2 |
$0.00 |
32K |
0 |
| LFM2.5-1.2B-Thinking |
Liquid AI |
5.2 |
$0.00 |
32K |
0 |
| Apertus 70B Instruct |
Swiss AI Initiative |
5.1 |
$1.34 |
64K |
0 |
| DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning) |
Nous Research |
5.1 |
$0.00 |
128K |
0 |
| Gemma 3 270M |
Google |
5.1 |
$0.00 |
32K |
0 |
| Mixtral 8x7B Instruct |
Mistral |
5.1 |
$0.51 |
32K |
0 |
| Granite 4.0 Micro |
IBM |
5.1 |
$0.00 |
128K |
0 |
| Qwen Chat 14B |
Alibaba |
5.0 |
$0.00 |
8K |
0 |
| Llama 65B |
Meta |
5.0 |
$0.00 |
2K |
0 |
| Command-R (Mar '24) |
Cohere |
5.0 |
$0.00 |
128K |
0 |