Benchmarks / Artificial Analysis

Reported by Artificial Analysis

Artificial Analysis

Artificial Analysis's blend of its reasoning, knowledge, coding and agent evaluations.

Last updated 8 Oct 2026

Results dated
8 Oct 2026
Results
407 configurations of 243 models
Unit
index score
Licence
Artificial Analysis commercial data licence

Artificial Analysis Intelligence Index: Claude Haiku 5.5

Top 15 of 407 results · index score, higher is better. Choose a model to highlight it.Clear highlight

  1. 1 Claude Opus 5.5 (max reasoning)Anthropic 57.6
  2. 2 Claude Opus 5.5 (extra-high reasoning)Anthropic 56.0
  3. 2 Claude Sonnet 5.5 (max reasoning)Anthropic 56.0
  4. 4 Claude Opus 5.5 (high reasoning)Anthropic 53.6
  5. 5 Claude Fable 5.1 (max reasoning)Anthropic 53.4
  6. 6 Claude Fable 5.1 (extra-high reasoning)Anthropic 53.2
  7. 7 GPT-6 Astra (max reasoning)OpenAI 52.7
  8. 8 Gemini 4 Argon (high reasoning)Google 52.6
  9. 9 GPT-6 Astra (extra-high reasoning)OpenAI 52.4
  10. 10 Claude Sonnet 5.5 (extra-high reasoning)Anthropic 51.9
  11. 11 GPT-6.1 Sol (max reasoning)OpenAI 51.8
  12. 12 Claude Fable 5.1 (high reasoning)Anthropic 51.2
  13. 12 Claude Opus 5.5 (medium reasoning)Anthropic 51.2
  14. 14 GPT-6.1 Sol (extra-high reasoning)OpenAI 51.0
  15. 15 GPT-6 Astra (high reasoning)OpenAI 50.9
  16. 42 Claude Haiku 5.5 (max reasoning)Anthropic 43.4
  17. 52 Claude Haiku 5.5 (extra-high reasoning)Anthropic 41.2
  18. 75 Claude Haiku 5.5 (high reasoning)Anthropic 37.8
  19. 85 Claude Haiku 5.5 (medium reasoning)Anthropic 34.5
  20. 117 Claude Haiku 5.5 (low reasoning)Anthropic 29.4

Full results

Artificial Analysis: Artificial Analysis Intelligence Index, index score, higher is better
#ModelArtificial Analysis Intelligence Index
index score, higher is better
Price
$ per million tokens, in / out
1 Claude Opus 5.5 (max reasoning)Anthropic
57.6
$4 / $20
2 Claude Opus 5.5 (extra-high reasoning)Anthropic
56.0
$4 / $20
2 Claude Sonnet 5.5 (max reasoning)Anthropic
56.0
$2 / $10
4 Claude Opus 5.5 (high reasoning)Anthropic
53.6
$4 / $20
5 Claude Fable 5.1 (max reasoning)Anthropic
53.4
$10 / $50
6 Claude Fable 5.1 (extra-high reasoning)Anthropic
53.2
$10 / $50
7 GPT-6 Astra (max reasoning)OpenAI
52.7
$10 / $50
8 Gemini 4 Argon (high reasoning)Google
52.6
–
9 GPT-6 Astra (extra-high reasoning)OpenAI
52.4
$10 / $50
10 Claude Sonnet 5.5 (extra-high reasoning)Anthropic
51.9
$2 / $10
11 GPT-6.1 Sol (max reasoning)OpenAI
51.8
$2 / $10
12 Claude Fable 5.1 (high reasoning)Anthropic
51.2
$10 / $50
12 Claude Opus 5.5 (medium reasoning)Anthropic
51.2
$4 / $20
14 GPT-6.1 Sol (extra-high reasoning)OpenAI
51.0
$2 / $10
15 GPT-6 Astra (high reasoning)OpenAI
50.9
$10 / $50
16 Claude Opus 5 (max reasoning)Anthropic
50.8
$5 / $25
17 GPT-6.1 Sol (high reasoning)OpenAI
50.2
$2 / $10
18 Claude Opus 5 (extra-high reasoning)Anthropic
49.7
$5 / $25
19 Claude Fable 5 (max reasoning)Anthropic
49.6
$10 / $50
19 GPT-6 Astra (medium reasoning)OpenAI
49.6
$10 / $50
21 Claude Fable 5.1 (medium reasoning)Anthropic
48.9
$10 / $50
22 Claude Opus 5 (high reasoning)Anthropic
48.1
$5 / $25
22 Muse Spark 1.3 (max reasoning)Meta
48.1
$1.25 / $4.25
24 GPT-6.1 Sol (medium reasoning)OpenAI
47.8
$2 / $10
25 GPT-6 Sol (max reasoning)OpenAI
47.6
$2 / $10
26 GPT-5.6 Sol (max reasoning)OpenAI
47.0
$4 / $20
27 Claude Fable 5.1 (low reasoning)Anthropic
46.8
$10 / $50
27 Claude Sonnet 5.5 (high reasoning)Anthropic
46.8
$2 / $10
29 Grok 4.7 (extra-high reasoning)xAI
46.4
$2 / $6
30 Grok 4.7 (high reasoning)xAI
46.3
$2 / $6
30 MiMo-V2.6-ProXiaomi
46.3
$0.43 / $0.87
32 GPT-6 Astra (low reasoning)OpenAI
45.8
$10 / $50
33 Qwen3.8-Max (0902)Alibaba
45.4
$2 / $6
34 Muse Spark 1.3 (extra-high reasoning)Meta
45.1
$1.25 / $4.25
35 Claude Opus 5 (medium reasoning)Anthropic
44.8
$5 / $25
35 GLM-5.3 (max reasoning)Z.ai
44.8
$1.40 / $4.40
37 Grok 4.6 (high reasoning)xAI
44.3
$2 / $6
38 GPT-6 Sol (extra-high reasoning)OpenAI
44.2
$2 / $10
38 Grok 4.6 (extra-high reasoning)xAI
44.2
$2 / $6
40 GPT-5.6 Sol (extra-high reasoning)OpenAI
44.0
$4 / $20
41 Kimi K3 (max reasoning)Moonshot AI
43.6
$3 / $15
42 Claude Haiku 5.5 (max reasoning)Anthropic
43.4
$0.10 / $0.50
43 Grok 4.6 (medium reasoning)xAI
42.8
$2 / $6
44 GPT-6 Sol (high reasoning)OpenAI
42.4
$2 / $10
45 Claude Opus 5.5 (low reasoning)Anthropic
42.3
$4 / $20
45 GPT-5.6 Sol (high reasoning)OpenAI
42.3
$4 / $20
47 Grok 4.7 (low reasoning)xAI
42.2
$2 / $6
48 GPT-5.6 Terra (max reasoning)OpenAI
42.1
$2 / $12
48 GPT-6.1 Sol (low reasoning)OpenAI
42.1
$2 / $10
50 Claude Opus 4.8 (max reasoning)Anthropic
41.8
$5 / $25
50 GLM-5.3-FlashZ.ai
41.8
$0.15 / $0.50
52 Claude Haiku 5.5 (extra-high reasoning)Anthropic
41.2
$0.10 / $0.50
53 Gemini 3.8 Flash (high reasoning)Google
40.9
$1.50 / $7.50
54 Claude Sonnet 5.5 (medium reasoning)Anthropic
40.8
$2 / $10
55 Claude Opus 4.7 (max reasoning)Anthropic
40.7
$5 / $25
56 Qwen3.8-Max (0803)Alibaba
40.2
–
57 Qwen3.8-2.4T-A95BAlibaba
39.9
$2 / $6
58 Qwen3.8-Flash-NextAlibaba
39.8
–
58 Gemini 3.8 Flash (medium reasoning)Google
39.8
$1.50 / $7.50
58 GPT-6 Sol (medium reasoning)OpenAI
39.8
$2 / $10
61 Gemini 3.7 Flash (medium reasoning)Google
39.6
$1.50 / $7.50
61 Muse Spark 1.2 (extra-high reasoning)Meta
39.6
$1.25 / $4.25
63 DeepSeek-V4.1-Flash (max reasoning)DeepSeek
39.5
$0.30 / $1.20
64 Claude Opus 5 (low reasoning)Anthropic
39.4
$5 / $25
65 GPT-5.6 Sol (medium reasoning)OpenAI
39.2
$4 / $20
66 Gemini 3.7 Flash (high reasoning)Google
39.1
$1.50 / $7.50
67 GPT-5.4 (extra-high reasoning)OpenAI
39.0
$2.50 / $15
68 Grok 4.5 (high reasoning)xAI
38.8
$2 / $6
69 Mistral Large 4Mistral AI
38.4
$1.36 / $4.18
69 GPT-5.5 (extra-high reasoning)OpenAI
38.4
$5 / $30
71 Claude Sonnet 5 (max reasoning)Anthropic
38.2
$2 / $10
72 GPT-6 Luna (max reasoning)OpenAI
38.1
$0.10 / $0.50
73 GPT-5.6 Terra (extra-high reasoning)OpenAI
38.0
$2 / $12
74 MiMo-V2.6-FlashXiaomi
37.9
$0.14 / $0.28
75 Claude Haiku 5.5 (high reasoning)Anthropic
37.8
$0.10 / $0.50
76 GPT-5.6 Luna (max reasoning)OpenAI
37.3
$0.20 / $1.20
77 GPT-5.5 (high reasoning)OpenAI
37.0
$5 / $30
78 Gemini 3.7 Flash (low reasoning)Google
36.9
$1.50 / $7.50
79 DeepSeek-V4-Pro (0813, max reasoning)DeepSeek
36.0
$1.32 / $3.96
80 Claude Sonnet 5.5 (low reasoning)Anthropic
35.9
$2 / $10
81 Grok 4.6 (low reasoning)xAI
35.1
$2 / $6
82 DeepSeek-V4-Flash-Vision-Exp (max reasoning)DeepSeek
34.8
$0.44 / $1.32
83 GPT-5.6 Luna (extra-high reasoning)OpenAI
34.6
$0.20 / $1.20
83 GPT-6 Luna (extra-high reasoning)OpenAI
34.6
$0.10 / $0.50
85 Claude Haiku 5.5 (medium reasoning)Anthropic
34.5
$0.10 / $0.50
86 Claude Sonnet 5 (extra-high reasoning)Anthropic
34.4
$2 / $10
87 DeepSeek-V4-Flash (0731, max reasoning)DeepSeek
34.3
$0.14 / $0.28
87 GLM-5.3 (low reasoning)Z.ai
34.3
$1.40 / $4.40
89 GPT-5.6 Terra (high reasoning)OpenAI
34.2
$2 / $12
89 GPT-6 Sol (low reasoning)OpenAI
34.2
$2 / $10
91 Gemini 3.6 Flash (high reasoning)Google
34.0
$1.50 / $7.50
92 GPT-5.5 (medium reasoning)OpenAI
33.8
$5 / $30
93 Qwen3.8-27B (extra-high reasoning)Alibaba
33.7
$0.50 / $3
93 Muse Spark 1.1 (extra-high reasoning)Meta
33.7
$1.25 / $4.25
93 GLM-5.2 (max reasoning)Z.ai
33.7
$1.40 / $4.40
96 Gemini 3.5 Flash (medium reasoning)Google
33.6
$1.50 / $9
97 Gemini 3.8 Flash (low reasoning)Google
33.5
$1.50 / $7.50
97 GPT-5.6 Sol (low reasoning)OpenAI
33.5
$4 / $20
99 GPT-6 Luna (high reasoning)OpenAI
32.9
$0.10 / $0.50
100 Gemini 3.5 Flash (high reasoning)Google
32.6
$1.50 / $9
101 GPT-5.3-Codex (extra-high reasoning)OpenAI
32.5
$1.75 / $14
102 GPT-5.6 Luna (high reasoning)OpenAI
32.1
$0.20 / $1.20
103 Claude Opus 4.6 (max reasoning)Anthropic
31.9
$5 / $25
104 Claude Sonnet 5 (high reasoning)Anthropic
31.7
$2 / $10
105 Muse SparkMeta
31.3
–
106 Claude Opus 4.7 (no reasoning)Anthropic
30.9
$5 / $25
107 GPT-5.5 (low reasoning)OpenAI
30.7
$5 / $30
108 DeepSeek-V4-Pro (0423, max reasoning)DeepSeek
30.4
$1.42 / $2.83
108 GPT-5.2 (extra-high reasoning)OpenAI
30.4
$1.75 / $14
110 Claude Sonnet 4.6 (max reasoning)Anthropic
30.1
$3 / $15
110 DeepSeek-V4-Pro (0423, high reasoning)DeepSeek
30.1
$1.42 / $2.83
110 Kimi K3 (low reasoning)Moonshot AI
30.1
$3 / $15
110 GPT-5.6 Terra (medium reasoning)OpenAI
30.1
$2 / $12
114 GPT-6 Luna (medium reasoning)OpenAI
29.9
$0.10 / $0.50
115 Gemini 3.1 Pro PreviewGoogle
29.7
$2 / $12
116 Qwen3.7-MaxAlibaba
29.5
$1.48 / $4.42
117 Claude Haiku 5.5 (low reasoning)Anthropic
29.4
$0.10 / $0.50
118 MiniMax-M3MiniMax
29.2
$0.30 / $1.20
119 Claude Opus 4.5 (reasoning on)Anthropic
29.1
$5 / $25
120 GPT-5.2-Codex (extra-high reasoning)OpenAI
28.5
$1.75 / $14
120 GPT-6 Sol (no reasoning)OpenAI
28.5
$2 / $10
122 Qwen3.6-Max-PreviewAlibaba
28.4
$1.03 / $6.16
123 GPT-5.6 Sol (no reasoning)OpenAI
28.3
$4 / $20
124 Solar Pro 4Upstage
28.2
$0.09 / $0.36
125 Claude Sonnet 5 (medium reasoning)Anthropic
28.1
$2 / $10
126 Gemini 3 Pro Preview (high reasoning)Google
28.0
–
127 GLM-5Z.ai
27.9
$0.95 / $2.55
128 Qwen3.8-27B (medium reasoning)Alibaba
27.6
$0.50 / $3
128 GPT-5.4 (low reasoning)OpenAI
27.6
$2.50 / $15
130 GPT-5.6 Terra (low reasoning)OpenAI
27.5
$2 / $12
131 Grok Build 0.1xAI
27.2
$1 / $2
132 Qwen3.6-PlusAlibaba
27.0
$0.33 / $1.95
132 Kimi K2.6Moonshot AI
27.0
$0.95 / $4
134 GLM-5-TurboZ.ai
26.6
$1.20 / $4
135 GPT-5.2 (medium reasoning)OpenAI
26.5
$1.75 / $14
136 Claude Opus 4.6 (no reasoning)Anthropic
26.4
$5 / $25
137 Gemini 3 Flash Preview (reasoning on)Google
26.3
$0.50 / $3
138 Qwen3.8-27B (low reasoning)Alibaba
26.2
$0.50 / $3
139 GLM-5.1Z.ai
26.1
$1.38 / $4.40
140 GPT-5.5 Instant (2026-06-26)OpenAI
26.0
–
140 MiMo-V2.5-Pro (reasoning on)Xiaomi
26.0
$0.43 / $0.87
142 Kimi K2.7 CodeMoonshot AI
25.8
$0.95 / $4
143 Inkling SmallThinking Machines
25.7
$0.45 / $1.20
143 Grok 4.20xAI
25.7
$1.25 / $2.50
145 Hy3Tencent
25.3
$0.14 / $0.58
146 Qwen3.7-PlusAlibaba
25.2
$0.32 / $1.28
146 Grok 4.20 (0309, reasoning)xAI
25.2
–
146 MiMo-V2.5Xiaomi
25.2
$0.17 / $0.34
149 GPT-5.6 Luna (medium reasoning)OpenAI
25.0
$0.20 / $1.20
149 Inkling (extra-high reasoning)Thinking Machines
25.0
$0.95 / $4.05
151 GPT-5-Codex (high reasoning)OpenAI
24.9
–
151 Grok 4.3 (high reasoning)xAI
24.9
$1.25 / $2.50
153 Grok 4.3 (medium reasoning)xAI
24.8
$1.25 / $2.50
154 Claude Sonnet 4.6 (no reasoning)Anthropic
24.7
$3 / $15
154 DeepSeek-V4.1-Flash (no reasoning)DeepSeek
24.7
$0.30 / $1.20
154 GPT-5.1 (high reasoning)OpenAI
24.7
$1.25 / $10
157 DeepSeek-V4-Flash (0423, high reasoning)DeepSeek
24.4
$0.14 / $0.28
158 Claude Sonnet 5 (low reasoning)Anthropic
24.3
$2 / $10
158 Grok 4.3 (low reasoning)xAI
24.3
$1.25 / $2.50
160 DeepSeek-V4-Flash (0423, max reasoning)DeepSeek
24.2
$0.14 / $0.28
160 GLM-5.1 (no reasoning)Z.ai
24.2
$1.38 / $4.40
162 GPT-5.4 mini (extra-high reasoning)OpenAI
24.1
$0.75 / $4.50
163 Gemini 3.5 Flash (minimal reasoning)Google
23.8
$1.50 / $9
164 Claude Opus 4.5 (no reasoning)Anthropic
23.7
$5 / $25
164 GPT-5.1-Codex (high reasoning)OpenAI
23.7
$1.25 / $10
166 Kimi K2.6 (no reasoning)Moonshot AI
23.6
$0.95 / $4
167 Kimi K2.5Moonshot AI
23.5
$0.57 / $2.85
167 GLM-5V-TurboZ.ai
23.5
$1.20 / $4
169 Claude Sonnet 5 (no reasoning)Anthropic
23.2
$2 / $10
169 GPT-5.5 (no reasoning)OpenAI
23.2
$5 / $30
171 GPT-5 (high reasoning)OpenAI
23.0
$1.25 / $10
172 Qwen3.5-27BAlibaba
22.9
$0.27 / $2.16
172 GPT-5 (medium reasoning)OpenAI
22.9
$1.25 / $10
174 Claude Opus 4.1 (reasoning on)Anthropic
22.8
$15 / $75
174 MiniMax-M2.5MiniMax
22.8
$0.30 / $1.20
174 MiniMax-M2.7MiniMax
22.8
$0.30 / $1.20
177 GPT-5.5 Instant (2026-05-26)OpenAI
22.7
–
177 Hy3 Preview (reasoning on)Tencent
22.7
$0.18 / $0.60
179 Grok 4xAI
22.5
–
180 GLM-5.2 (no reasoning)Z.ai
22.4
$1.40 / $4.40
181 Gemini 3 Pro Preview (low reasoning)Google
22.3
–
182 Gemini 3.5 Flash-LiteGoogle
22.2
$0.30 / $2.50
182 GLM-4.7Z.ai
22.2
$0.54 / $1.98
184 Kimi K2 ThinkingMoonshot AI
22.0
$0.60 / $2.50
185 o3-proOpenAI
21.9
$20 / $80
186 GLM-5 (no reasoning)Z.ai
21.8
$0.95 / $2.55
187 DeepSeek-V3.2 (reasoning on)DeepSeek
21.5
$0.30 / $0.96
187 GPT-6 Luna (low reasoning)OpenAI
21.5
$0.10 / $0.50
189 Qwen3.5-397B-A17B (no reasoning)Alibaba
21.4
$0.55 / $3.50
189 Qwen3.6-27BAlibaba
21.4
$0.30 / $3.20
191 Qwen3-Max-ThinkingAlibaba
21.3
$0.78 / $3.90
192 GPT-5.6 Luna (low reasoning)OpenAI
21.0
$0.20 / $1.20
193 MiniMax-M2.1MiniMax
20.9
$0.30 / $1.20
194 DeepSeek-V4-Pro (0423, no reasoning)DeepSeek
20.8
$1.42 / $2.83
194 GPT-5.6 Terra (no reasoning)OpenAI
20.8
$2 / $12
194 GPT-5 (low reasoning)OpenAI
20.8
$1.25 / $10
197 Claude Sonnet 4.5 (reasoning on)Anthropic
20.7
$3 / $15
197 GPT-5.4 nano (extra-high reasoning)OpenAI
20.7
$0.20 / $1.25
199 GPT-5 mini (medium reasoning)OpenAI
20.6
$0.25 / $2
200 Qwen3.5-Omni-PlusAlibaba
20.4
–
200 DeepSeek-V4-Pro (0813, no reasoning)DeepSeek
20.4
$1.32 / $3.96
200 GPT-5.1-Codex-Mini (high reasoning)OpenAI
20.4
$0.25 / $2
200 Grok 4.1 Fast (reasoning)xAI
20.4
–
204 Qwen3.8-27B (no reasoning)Alibaba
20.2
$0.50 / $3
204 o3OpenAI
20.2
$2 / $8
206 GPT-5.4 nano (medium reasoning)OpenAI
20.0
$0.20 / $1.25
207 Qwen3.6-27B (no reasoning)Alibaba
19.8
$0.30 / $3.20
208 GPT-5.4 mini (medium reasoning)OpenAI
19.7
$0.75 / $4.50
209 Qwen3.5-27B (no reasoning)Alibaba
19.4
$0.27 / $2.16
209 Kimi K2.5 (no reasoning)Moonshot AI
19.4
$0.57 / $2.85
211 Qwen3.5-35B-A3BAlibaba
19.3
$0.16 / $1.30
211 Claude Sonnet 4.5 (no reasoning)Anthropic
19.3
$3 / $15
213 Claude Sonnet 4 (reasoning on)Anthropic
18.9
$3 / $15
213 DeepSeek-V4-Flash (0423, no reasoning)DeepSeek
18.9
$0.14 / $0.28
215 Claude Opus 4.1 (no reasoning)Anthropic
18.6
$15 / $75
215 MiniMax-M2MiniMax
18.6
$0.30 / $1.20
217 GPT-6 Luna (no reasoning)OpenAI
18.5
$0.10 / $0.50
217 GLM-4.6 (reasoning on)Z.ai
18.5
$0.50 / $2
219 Qwen3.5-397B-A17BAlibaba
18.4
$0.55 / $3.50
220 MiMo-V2.5-Pro (no reasoning)Xiaomi
18.3
$0.43 / $0.87
221 Qwen3.6-35B-A3BAlibaba
18.2
$0.10 / $1
221 GPT-5.4 (no reasoning)OpenAI
18.2
$2.50 / $15
223 Gemini 3 Flash Preview (no reasoning)Google
17.9
$0.50 / $3
223 Grok 4 Fast (reasoning)xAI
17.9
–
225 Qwen3.5-122B-A10B (no reasoning)Alibaba
17.7
$0.26 / $2.08
226 Muse Glimmer (high reasoning)Meta
17.5
–
227 GLM-4.7 (no reasoning)Z.ai
17.4
$0.54 / $1.98
228 GPT-5.2 (no reasoning)OpenAI
17.0
$1.75 / $14
228 Hy3 Preview (no reasoning)Tencent
17.0
$0.18 / $0.60
230 Claude Haiku 4.5 (reasoning on)Anthropic
16.9
$1 / $5
231 GPT-5 mini (high reasoning)OpenAI
16.8
$0.25 / $2
232 Gemma 4 26B A4BGoogle
16.7
$0.10 / $0.30
232 o4-mini (high reasoning)OpenAI
16.7
$1.10 / $4.40
234 Claude Sonnet 4 (no reasoning)Anthropic
16.6
$3 / $15
234 DeepSeek-V3.2-Exp (reasoning on)DeepSeek
16.6
$0.27 / $0.41
234 Step 3.5 FlashStepFun
16.6
$0.10 / $0.30
237 Qwen3-Max-Thinking-PreviewAlibaba
16.3
–
238 Gemini 2.5 ProGoogle
16.1
$1.25 / $10
239 DeepSeek-V3.2 (no reasoning)DeepSeek
16.0
$0.30 / $0.96
240 Qwen3.5-122B-A10BAlibaba
15.6
$0.26 / $2.08
240 Qwen3-MaxAlibaba
15.6
$0.78 / $3.90
240 Gemini 3.1 Flash-Lite PreviewGoogle
15.6
$0.25 / $1.50
243 Gemini 2.5 Flash Preview (09-2025, reasoning on)Google
15.5
–
243 GPT-5.6 Luna (no reasoning)OpenAI
15.5
$0.20 / $1.20
245 Claude Haiku 4.5 (no reasoning)Anthropic
15.4
$1 / $5
246 Kimi K2 (0905)Moonshot AI
15.3
$0.60 / $2.50
247 Qwen3.6-35B-A3B (no reasoning)Alibaba
15.2
$0.10 / $1
247 o1OpenAI
15.2
$15 / $60
249 Qwen3.5-35B-A3B (no reasoning)Alibaba
15.1
$0.16 / $1.30
250 GLM-4.6 (no reasoning)Z.ai
14.9
$0.50 / $2
250 GLM-4.7-FlashZ.ai
14.9
$0.06 / $0.40
252 DeepSeek-V3.1-Terminus (reasoning on)DeepSeek
14.8
$0.27 / $1
253 Gemma 4 31BGoogle
14.7
$0.14 / $0.40
254 Grok 4.20 (0309, non-reasoning, no reasoning)xAI
14.6
–
255 DeepSeek-V3.2-SpecialeDeepSeek
14.5
–
256 Gemma 4 12BGoogle
14.2
–
256 Mistral Medium 3.5Mistral AI
14.2
$1.50 / $7.50
256 Grok 4.20 (no reasoning)xAI
14.2
$1.25 / $2.50
259 Grok Code Fast 1xAI
14.1
–
260 Grok 4.3 (no reasoning)xAI
14.0
$1.25 / $2.50
261 DeepSeek-V3.1-Terminus (no reasoning)DeepSeek
13.9
$0.27 / $1
261 DeepSeek-V3.2-Exp (no reasoning)DeepSeek
13.9
$0.27 / $0.41
261 Gemma 4 31B (no reasoning)Google
13.9
$0.14 / $0.40
264 Mercury 2Inception
13.8
$0.25 / $0.75
265 DeepSeek-V3.1 (no reasoning)DeepSeek
13.7
$0.55 / $1.65
266 DeepSeek-V3.1 (reasoning on)DeepSeek
13.5
$0.55 / $1.65
267 Qwen3-VL-235B-A22B-ThinkingAlibaba
13.4
$0.40 / $4
267 Nova 2 Lite (high reasoning)Amazon
13.4
$0.30 / $2.50
269 Qwen3.5-9B (no reasoning)Alibaba
13.3
$0.10 / $0.15
269 GPT-5.1 (no reasoning)OpenAI
13.3
$1.25 / $10
271 Qwen3.5-4B (reasoning on)Alibaba
13.1
–
271 DeepSeek-R1-0528DeepSeek
13.1
$0.50 / $2.18
271 Gemini 2.5 Flash (reasoning on)Google
13.1
$0.30 / $2.50
271 Gemma 4 26B A4B (no reasoning)Google
13.1
$0.10 / $0.30
275 GPT-5 nano (high reasoning)OpenAI
13.0
$0.05 / $0.40
276 Nemotron 3 Super 120B A12BNVIDIA
12.8
$0.085 / $0.40
276 GLM-4.5Z.ai
12.8
$0.60 / $2.20
278 Qwen3-235B-A22B-Thinking-2507Alibaba
12.7
$0.30 / $3
278 Kimi K2 (0711)Moonshot AI
12.7
$0.57 / $2.30
278 GPT-4.1OpenAI
12.7
$2 / $8
281 Qwen3-Max-PreviewAlibaba
12.6
–
282 Qwen3.5-Omni-FlashAlibaba
12.5
–
282 Nova 2 Lite (medium reasoning)Amazon
12.5
$0.30 / $2.50
282 GPT-5 nano (medium reasoning)OpenAI
12.5
$0.05 / $0.40
282 o3-miniOpenAI
12.5
$1.10 / $4.40
286 Gemini 2.5 Flash Preview (09-2025, no reasoning)Google
12.4
–
287 Qwen3-235B-A22B-Instruct-2507Alibaba
12.0
$0.15 / $0.75
288 Qwen3-Coder-480B-A35BAlibaba
11.9
$0.35 / $1.50
288 Qwen3-VL-32B-ThinkingAlibaba
11.9
–
290 Nova 2 Lite (low reasoning)Amazon
11.8
$0.30 / $2.50
290 Magistral Medium 1.2Mistral AI
11.8
–
292 GPT-5.4 nano (no reasoning)OpenAI
11.7
$0.20 / $1.25
293 gpt-oss-120b (high reasoning)OpenAI
11.6
$0.15 / $0.60
294 DeepSeek-R1DeepSeek
11.4
$0.70 / $2.50
294 GPT-5 (minimal reasoning)OpenAI
11.4
$1.25 / $10
296 Mistral Small 4Mistral AI
11.3
$0.15 / $0.60
296 Grok 4.1 Fast (non-reasoning, no reasoning)xAI
11.3
–
298 Qwen3.5-9BAlibaba
11.2
$0.10 / $0.15
298 Qwen3-Next-80B-A3B-ThinkingAlibaba
11.2
$0.15 / $1.20
298 GLM-4.6V (reasoning on)Z.ai
11.2
$0.30 / $0.90
301 Granite 4.2 8BIBM
11.1
$0.06 / $0.25
301 GPT-5.4 mini (no reasoning)OpenAI
11.1
$0.75 / $4.50
301 Grok 4 Fast (non-reasoning, no reasoning)xAI
11.1
–
301 GLM-4.5-AirZ.ai
11.1
$0.14 / $0.86
305 o3-mini (high reasoning)OpenAI
11.0
$1.10 / $4.40
306 Qwen3.5-4B (no reasoning)Alibaba
10.8
–
306 Trinity Large ThinkingArcee AI
10.8
$0.25 / $0.80
308 GLM-4.7-Flash (no reasoning)Z.ai
10.6
$0.06 / $0.40
309 Gemini 2.5 Flash-Lite Preview (09-2025, reasoning on)Google
10.4
–
309 GPT-5 ChatOpenAI
10.4
–
311 GPT-4.1 miniOpenAI
10.2
$0.40 / $1.60
311 gpt-oss-120b (low reasoning)OpenAI
10.2
$0.15 / $0.60
313 Llama 4 MaverickMeta
10.0
$0.27 / $0.85
313 gpt-oss-20b (low reasoning)OpenAI
10.0
$0.03 / $0.15
315 Qwen3-VL-235B-A22B-InstructAlibaba
9.9
$0.30 / $1.50
315 Gemini 2.5 Flash (no reasoning)Google
9.9
$0.30 / $2.50
315 GPT-5 mini (minimal reasoning)OpenAI
9.9
$0.25 / $2
318 Qwen3-30B-A3B-Thinking-2507Alibaba
9.8
$0.20 / $2.40
319 DeepSeek-V3-0324DeepSeek
9.7
$0.25 / $1
320 Qwen3-Coder-30B-A3B-InstructAlibaba
9.6
$0.07 / $0.28
320 Qwen3-Next-80B-A3B-InstructAlibaba
9.6
$0.10 / $1.10
322 Qwen3-235B-A22B (reasoning on)Alibaba
9.5
$0.46 / $1.82
322 Qwen3-VL-30B-A3B-ThinkingAlibaba
9.5
$0.29 / $1
322 DiffusionGemma 26B A4BGoogle
9.5
–
325 Gemma 4 12B (no reasoning)Google
9.4
–
326 Gemini 2.5 Flash-Lite Preview (09-2025, no reasoning)Google
9.3
–
326 Mistral Large 3Mistral AI
9.3
$0.50 / $1.50
328 Qwen3-Coder-NextAlibaba
9.2
$0.18 / $0.90
328 Mistral Medium 3.1Mistral AI
9.2
$0.40 / $2
330 Devstral MediumMistral AI
9.0
–
330 Mistral Medium 3Mistral AI
9.0
$0.40 / $2
330 Mistral Small 4 (no reasoning)Mistral AI
9.0
$0.15 / $0.60
330 gpt-oss-20b (high reasoning)OpenAI
9.0
$0.03 / $0.15
334 Gemma 4 E4BGoogle
8.9
–
334 Nemotron 3 Nano 30B A3B (reasoning on)NVIDIA
8.9
$0.05 / $0.20
336 Qwen3-4B-Thinking-2507Alibaba
8.8
–
337 Nova 2 Lite (no reasoning)Amazon
8.7
$0.30 / $2.50
338 Qwen3-32B (reasoning on)Alibaba
8.6
$0.14 / $0.40
338 Devstral 2Mistral AI
8.6
$0.40 / $2
338 Magistral Small 1.2Mistral AI
8.6
–
341 DeepSeek-V3DeepSeek
8.5
$0.26 / $1.03
341 Gemini 2.5 Flash-Lite (reasoning on)Google
8.5
$0.10 / $0.40
343 Qwen3-VL-32B-InstructAlibaba
8.4
$0.10 / $0.42
343 GLM-4.6V (no reasoning)Z.ai
8.4
$0.30 / $0.90
345 Qwen3-235B-A22B (no reasoning)Alibaba
8.3
$0.46 / $1.82
346 Qwen3-14B (reasoning on)Alibaba
8.2
$0.12 / $0.24
346 Qwen3-VL-8B-ThinkingAlibaba
8.2
$0.18 / $2.10
346 Mistral Small 3.2 24BMistral AI
8.2
$0.094 / $0.25
349 Llama 4 ScoutMeta
8.1
$0.18 / $0.59
350 Qwen3-VL-30B-A3B-InstructAlibaba
7.9
$0.15 / $0.60
351 Qwen3-Omni-30B-A3B-ThinkingAlibaba
7.8
–
351 Gemma 4 E2BGoogle
7.8
–
351 GPT-4.1 nanoOpenAI
7.8
$0.10 / $0.40
351 Solar Pro 3Upstage
7.8
$0.15 / $0.60
355 Qwen2.5-72B-InstructAlibaba
7.7
$0.36 / $0.40
355 Llama 3.3 70B InstructMeta
7.7
$0.59 / $0.79
355 GPT-4o (2024-08-06)OpenAI
7.7
$2.50 / $10
358 Qwen3-30B-A3B (reasoning on)Alibaba
7.6
$0.12 / $0.50
358 Devstral Small 1.1Mistral AI
7.6
–
358 GLM-4.5V (reasoning on)Z.ai
7.6
$0.60 / $1.80
361 Qwen3-30B-A3B-Instruct-2507Alibaba
7.5
$0.09 / $0.30
361 Gemma 4 E4B (no reasoning)Google
7.5
–
361 Devstral Small 2Mistral AI
7.5
–
364 Qwen3-32B (no reasoning)Alibaba
7.3
$0.14 / $0.40
364 Qwen3-8B (reasoning on)Alibaba
7.3
$0.12 / $0.46
364 Qwen3-VL-8B-InstructAlibaba
7.3
$0.12 / $0.46
364 Kimi Linear 48B A3B InstructMoonshot AI
7.3
–
364 GPT-4o (2024-05-13)OpenAI
7.3
$5 / $15
369 Mistral Small 3.1 24BMistral AI
7.1
$0.35 / $0.56
369 GPT-5 nano (minimal reasoning)OpenAI
7.1
$0.05 / $0.40
371 Qwen3-VL-4B-ThinkingAlibaba
7.0
–
371 Nova Pro 1.0Amazon
7.0
$0.80 / $3.20
371 Command ACohere
7.0
$2.50 / $10
374 Qwen3.5-2B (reasoning on)Alibaba
6.9
–
374 Llama 3.1 8B InstructMeta
6.9
$0.05 / $0.08
376 Mistral Large 2 (2407)Mistral AI
6.8
$2 / $6
376 Nemotron 3 Nano 30B A3B (no reasoning)NVIDIA
6.8
$0.05 / $0.20
378 Qwen2.5-Coder-32B-InstructAlibaba
6.7
$0.66 / $1
378 Qwen3-14B (no reasoning)Alibaba
6.7
$0.12 / $0.24
378 Qwen3-4B-Instruct-2507Alibaba
6.7
–
378 Nova Lite 1.0Amazon
6.7
$0.06 / $0.24
378 Gemini 2.5 Flash-Lite (no reasoning)Google
6.7
$0.10 / $0.40
378 Mistral Small 3Mistral AI
6.7
$0.05 / $0.08
378 GPT-4o mini (2024-07-18)OpenAI
6.7
$0.15 / $0.60
378 GLM-4.5V (no reasoning)Z.ai
6.7
$0.60 / $1.80
386 Qwen3-30B-A3B (no reasoning)Alibaba
6.6
$0.12 / $0.50
386 Llama 3.1 70B InstructMeta
6.6
$0.40 / $0.40
388 Gemma 4 E2B (no reasoning)Google
6.5
–
389 Qwen3.5-2B (no reasoning)Alibaba
6.2
–
390 Qwen3.5-0.8B (reasoning on)Alibaba
6.1
–
391 Qwen3-8B (no reasoning)Alibaba
6.0
$0.12 / $0.46
391 Qwen3-Omni-30B-A3B-InstructAlibaba
6.0
–
391 Ministral 3 14BMistral AI
6.0
$0.20 / $0.20
394 Nova Micro 1.0Amazon
5.9
$0.035 / $0.14
394 Phi-4Microsoft
5.9
$0.07 / $0.14
396 Qwen3-VL-4B-InstructAlibaba
5.7
–
396 Llama 3.2 3B InstructMeta
5.7
$0.05 / $0.33
396 Mixtral 8x22B InstructMistral AI
5.7
$2 / $6
399 Reka Flash 3Reka AI
5.6
$0.10 / $0.20
400 Ministral 3 8BMistral AI
5.5
$0.15 / $0.15
401 Qwen3.5-0.8B (no reasoning)Alibaba
5.4
–
402 Gemma 3 270MGoogle
5.1
–
403 Gemma 3 27BGoogle
4.9
$0.12 / $0.20
404 Gemma 3 4BGoogle
4.8
$0.05 / $0.10
404 Llama 3.2 1B InstructMeta
4.8
$0.027 / $0.20
404 Ministral 3 3BMistral AI
4.8
$0.10 / $0.10
407 Gemma 3 12BGoogle
3.8
$0.05 / $0.15

Swipe the table sideways for more columns.

Ranks follow the score as shown, so equal numbers share a rank. Results as published by Artificial Analysis; we do not re-run them.

What it measures

Artificial Analysis's blend of its reasoning, knowledge, coding and agent evaluations.

What it does not measure

Not business work, and a blend: read the parts for any one task.

282 results from Artificial Analysis not ranked here · show why

We rank a result only when we can tie it to a specific model you can use. These are left out:

  • Not on sale through the API providers we track: 268
  • A different snapshot or variant from the model we list: 13
  • An unusual combination of settings: 1

Data sourced from Artificial Analysis. Licence: Artificial Analysis commercial data licence.