AI Model Cost Benchmarks

Cost efficiency rankings for 153 active and preview models across 18 providers. Last updated:

Budget Tier

77 models

Under $0.50/M input tokens

Mid Tier

64 models

$0.50 – $3.00/M input tokens

Premium Tier

12 models

$3.00+/M input tokens

Cost Ranking: Cheapest to Most Expensive

# Model Provider Input $/1M Cached $/1M Output $/1M Tier
1 Llama 3.1 8B Instruct novita $0.02 — $0.05 Budget
2 Qwen3.5 4B castform $0.03 — $0.15 Budget
3 DeepSeek-OCR 2 novita $0.03 — $0.03 Budget
4 AutoGLM-Phone-9B-Multilingual novita $0.04 — $0.14 Budget
5 Command R7B cohere $0.04 — $0.15 Budget
6 Mistral NeMo novita $0.04 — $0.17 Budget
7 Llama 3.1 8B Instant groq $0.05 — $0.08 Budget
8 GPT-OSS 20B together $0.05 — $0.20 Budget
9 Llama 3 8B Lunaris novita $0.05 — $0.05 Budget
10 Llama 3 8B Stheno V3.2 novita $0.05 — $0.05 Budget
11 Gemma 3n E4B Instruct together $0.06 — $0.12 Budget
12 Qwen3 Coder 30B A3B Instruct novita $0.07 — $0.27 Budget
13 GPT-OSS Safeguard 20B Preview groq $0.07 — $0.30 Budget
14 GPT-OSS 20B groq $0.07 $0.037 $0.30 Budget
15 Qwen3 235B A22B Instruct 2507 novita $0.09 — $0.58 Budget
16 Embed v3 English cohere $0.10 — $0.00 Budget
17 Embed v3 Multilingual cohere $0.10 — $0.00 Budget
18 Ministral 3 3B mistral $0.10 $0.010 $0.10 Budget
19 Llama 4 Scout together $0.10 — $0.30 Budget
20 GPT-6 Luna openai $0.10 $0.010 $0.50 Budget
21 Llama 3.3 70B Instruct novita $0.14 — $0.40 Budget
22 Llama 3 8B Instruct Lite together $0.14 — $0.14 Budget
23 DeepSeek V4 Flash novita $0.14 $0.028 $0.28 Budget
24 DeepSeek V4.1 Flash deepseek $0.15 $0.003 $0.60 Budget
25 GPT-OSS 120B groq $0.15 $0.075 $0.60 Budget
26 Ministral 3 8B mistral $0.15 $0.015 $0.15 Budget
27 Mistral Small 4 mistral $0.15 $0.015 $0.60 Budget
28 GPT-OSS 120B together $0.15 — $0.60 Budget
29 Llama 4 Maverick together $0.15 — $0.60 Budget
30 RNJ-1 Instruct together $0.15 — $0.15 Budget
31 Qwen3 Next 80B A3B Instruct novita $0.15 — $1.50 Budget
32 GLM 5.3 Flash novita $0.15 $0.030 $0.50 Budget
33 Qwen3.8 Flash novita $0.15 $0.016 $0.47 Budget
34 Qwen3.8-Flash Preview alibaba $0.16 — $0.47 Budget
35 Qwen3.5 9B together $0.17 — $0.25 Budget
36 Llama 4 Scout Instruct novita $0.18 — $0.59 Budget
37 Ministral 3 14B mistral $0.20 $0.020 $0.20 Budget
38 GPT-5.4 nano openai $0.20 $0.020 $1.25 Budget
39 Qwen3 235B A22B Instruct 2507 together $0.20 — $0.60 Budget
40 Qwen3 Coder Next novita $0.20 — $1.50 Budget
41 Qwen3 235B A22B novita $0.20 — $0.80 Budget
42 Qwen3 VL 30B A3B Instruct novita $0.20 — $0.70 Budget
43 Qwen3.6-35B-A3B novita $0.25 — $1.49 Budget
44 Qwen3.6-Flash alibaba $0.25 $0.025 $1.50 Budget
45 Gemini 3.1 Flash-Lite Preview google $0.25 $0.025 $1.50 Budget
46 Qwen3.5-35B-A3B novita $0.25 — $2.00 Budget
47 Qwen MT Plus novita $0.25 — $0.75 Budget
48 DeepSeek V3.2 novita $0.27 $0.135 $0.40 Budget
49 DeepSeek V3.2 Exp novita $0.27 — $0.41 Budget
50 DeepSeek V3.1 Terminus novita $0.27 $0.135 $1.00 Budget
51 DeepSeek V3.1 novita $0.27 $0.135 $1.00 Budget
52 DeepSeek V3 0324 novita $0.27 $0.135 $1.12 Budget
53 Llama 4 Maverick Instruct novita $0.27 — $0.85 Budget
54 Gemma 4 31B IT Pearl together $0.28 — $0.86 Budget
55 MiniMax M3 minimax $0.30 — $1.20 Budget
56 Codestral mistral $0.30 $0.030 $0.90 Budget
57 MiniMax M2.7 together $0.30 $0.060 $1.20 Budget
58 MiniMax M3 together $0.30 $0.060 $1.20 Budget
59 Qwen2.5 7B Instruct Turbo together $0.30 — $0.30 Budget
60 Qwen3.5-27B novita $0.30 — $2.40 Budget
61 Qwen3 VL 235B A22B Instruct novita $0.30 — $1.50 Budget
62 Qwen3 235B A22B Thinking 2507 novita $0.30 — $3.00 Budget
63 MiniMax M2.7 novita $0.30 $0.060 $1.20 Budget
64 MiniMax M2.5 novita $0.30 $0.030 $1.20 Budget
65 MiniMax M2.1 novita $0.30 $0.030 $1.20 Budget
66 MiniMax M2 novita $0.30 $0.030 $1.20 Budget
67 DeepSeek V4.1 Flash novita $0.30 $0.006 $1.20 Budget
68 DeepSeek V4.1 Flash novita $0.30 $0.006 $1.20 Budget
69 Qwen3.7-Plus alibaba $0.32 $0.032 $1.28 Budget
70 Qwen3 Coder 480B A35B Instruct novita $0.38 — $1.55 Budget
71 Qwen 2.5 72B Instruct novita $0.38 — $0.40 Budget
72 Gemma 4 31B IT together $0.39 — $0.97 Budget
73 DeepSeek V3 (Turbo) novita $0.40 — $1.30 Budget
74 Qwen3.5-122B-A10B novita $0.40 — $3.20 Budget
75 Qwen3.8 27B novita $0.42 $0.085 $3.00 Budget
76 DeepSeek V4 Flash 0731 novita $0.44 $0.028 $1.32 Budget
77 DeepSeek V4 Flash Vision Exp novita $0.44 $0.028 $1.32 Budget
78 Gemini 3 Flash Preview google $0.50 $0.050 $3.00 Mid
79 Mistral Large 3 mistral $0.50 $0.050 $1.50 Mid
80 MiniMax M1 novita $0.55 — $2.20 Mid
81 Kimi K2 Instruct novita $0.57 — $2.30 Mid
82 Llama 3.3 70B Versatile groq $0.59 — $0.79 Mid
83 Nemotron 3 Ultra 550B A55B together $0.60 $0.200 $3.60 Mid
84 Qwen3.5 397B A17B together $0.60 $0.350 $3.60 Mid
85 Qwen3.6-27B novita $0.60 — $3.60 Mid
86 Qwen3.5-397B-A17B novita $0.60 — $3.60 Mid
87 Kimi K2.5 novita $0.60 $0.100 $3.00 Mid
88 Kimi K2 Thinking novita $0.60 $0.150 $2.50 Mid
89 Kimi K2 0905 novita $0.60 — $2.50 Mid
90 MiniMax M2.5 Highspeed novita $0.60 $0.030 $2.40 Mid
91 DeepSeek V4 Pro 0813 deepseek $0.66 $0.022 $1.98 Mid
92 DeepSeek R1 0528 novita $0.70 $0.350 $2.50 Mid
93 DeepSeek R1 (Turbo) novita $0.70 — $2.50 Mid
94 GPT-5.4 mini openai $0.75 $0.075 $4.50 Mid
95 Gemini 3.8 Flash google $0.75 $0.075 $3.75 Mid
96 DeepSeek R1 Distill Llama 70B novita $0.80 — $0.80 Mid
97 Kimi K2.6 novita $0.80 $0.160 $3.40 Mid
98 Claude Haiku 3.5 anthropic $0.80 $1.600 $0.08 Mid
99 Kimi K2.7 Code together $0.95 $0.190 $4.00 Mid
100 Kimi K2.7 Code novita $0.95 $0.190 $4.00 Mid
101 Qwen3 VL 235B A22B Thinking novita $0.98 — $3.95 Mid
102 Qwen3.8 27B cerebras $0.99 — $1.49 Mid
103 Claude Haiku 4.5 anthropic $1.00 $0.100 $5.00 Mid
104 Sonar perplexity $1.00 — $1.00 Mid
105 Grok Build 0.1 xai $1.00 $0.200 $2.00 Mid
106 GLM-5 novita $1.00 $0.200 $3.20 Mid
107 Llama 3.3 70B together $1.04 — $1.04 Mid
108 Kimi K2.6 together $1.20 $0.200 $4.50 Mid
109 Qwen3.7-Max alibaba $1.25 $0.125 $3.75 Mid
110 Cogito v2.1 671B together $1.25 — $1.25 Mid
111 Grok 4.3 xai $1.25 $0.200 $2.50 Mid
112 Grok 4.20 0309 Non-Reasoning xai $1.25 $0.200 $2.50 Mid
113 Grok 4.20 0309 Reasoning xai $1.25 $0.200 $2.50 Mid
114 Grok 4.20 Multi-Agent 0309 xai $1.25 $0.200 $2.50 Mid
115 Qwen3.7-Max novita $1.25 $0.250 $3.75 Mid
116 DeepSeek V4 Pro 0813 novita $1.32 $0.044 $3.96 Mid
117 GLM-5.1 novita $1.38 $0.260 $4.40 Mid
118 GLM-5.1 together $1.40 $0.260 $4.40 Mid
119 GLM-5.2 together $1.40 $0.260 $4.40 Mid
120 GLM-5.3 zai $1.40 $0.260 $4.40 Mid
121 GLM-5.2 zai $1.40 $0.260 $4.40 Mid
122 GLM-5.2 novita $1.40 $0.260 $4.40 Mid
123 GLM 5.3 novita $1.40 $0.260 $4.40 Mid
124 Llama 3.1 70B Euryale V2.2 novita $1.48 — $1.48 Mid
125 Mistral Medium 3.5 mistral $1.50 $0.150 $7.50 Mid
126 DeepSeek V4 Pro novita $1.60 $0.135 $3.20 Mid
127 DeepSeek V4 Pro together $1.74 $0.200 $3.48 Mid
128 Claude Sonnet 5 anthropic $2.00 $0.200 $10.00 Mid
129 Rerank v3 cohere $2.00 — $0.00 Mid
130 Gemini 3.1 Pro Preview google $2.00 $0.200 $12.00 Mid
131 GPT-5.6 Terra openai $2.00 $0.200 $12.00 Mid
132 Sonar Deep Research perplexity $2.00 — $8.00 Mid
133 Sonar Reasoning Pro perplexity $2.00 — $8.00 Mid
134 Qwen3.8 Max novita $2.00 $0.250 $6.00 Mid
135 Grok 4.6 xai $2.00 $0.500 $6.00 Mid
136 Qwen3.8 2.4T A95B novita $2.00 $0.250 $6.00 Mid
137 Grok 4.7 xai $2.00 $0.500 $6.00 Mid
138 GPT-6 Sol openai $2.00 $0.200 $10.00 Mid
139 Command A cohere $2.50 — $10.00 Mid
140 GPT-5.4 openai $2.50 $0.250 $15.00 Mid
141 Kimi K3 telnyx $2.70 $0.270 $13.50 Mid
142 Kimi K3 moonshot $3.00 $0.300 $15.00 Premium
143 Sonar Pro perplexity $3.00 — $15.00 Premium
144 Kimi K3 novita $3.00 $0.300 $15.00 Premium
145 Claude Opus 5.5 anthropic $4.00 $0.200 $20.00 Premium
146 GPT-5.5 openai $5.00 $0.500 $30.00 Premium
147 Claude Fable 5.1 anthropic $10.00 $0.250 $50.00 Premium
148 Claude Mythos 5.1 Preview anthropic $10.00 $20.000 $0.25 Premium
149 GPT-6 Astra openai $10.00 $1.000 $50.00 Premium
150 GPT-5.5 Cyber openai $12.50 $1.250 $75.00 Premium
151 GPT-5.6 Cyber openai $12.50 $1.250 $75.00 Premium
152 GPT-5.4 Pro openai $30.00 — $180.00 Premium
153 GPT-5.5 Pro openai $30.00 — $180.00 Premium

Models per Provider

alibaba

4 models

anthropic

18 models

castform

1 model

cerebras

1 model

cohere

7 models

deepseek

2 models

google

15 models

groq

7 models

minimax

1 model

mistral

18 models

moonshot

1 model

novita

73 models

openai

38 models

perplexity

4 models

telnyx

1 model

together

33 models

xai

10 models

zai

2 models

Note: These are cost benchmarks based on per-token pricing. Performance benchmarks (speed, latency, quality scores) are coming soon. Pricing data is updated daily from official provider pages.