Skip to main content
← Benchmark sources

artificialanalysis.ai · benchmark source

Artificial Analysis

Independent evaluations across composite intelligence, science reasoning, and agentic terminal tasks. Multiple boards live under one publisher.

Open artificialanalysis.ai3 boards on this publisher

General capability

Intelligence Index

A composite index aggregating several evaluations into a comparative model-quality signal.

Why it matters

It is useful as one broad reference point when a buyer needs an initial shortlist.

Use it when

You need an orienting signal, then plan to validate candidates on your own workload.

The limitation

Composite scores hide task-specific variance, version changes, and the trade-off between quality and cost.

Leaderboard snapshot

Intelligence Index results in a readable view

Use the tabs for the primary score and other published fields from this board. The source link remains authoritative for the live table.

Full Artificial Analysis Intelligence Index mirror — scores rounded to the nearest published integer for readability.

Local leader

Claude Opus 5 (Adaptive Reasoning, Max Effort)

63

Rows shown

586

Index score

Snapshot date

2026-08-14

1 day old · not a live API feed

Score profile

Index score by published row

Higher is better in this view

Claude Opus 5 (Adaptive Reasoning, Max Effort)
63
Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
63
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
62
Claude Opus 5 (Adaptive Reasoning, High Effort)
61
GPT-5.6 Sol (max)
61
Grok 4.6 (high)
61
Kimi K3 (max)
60
Claude Opus 5 (Adaptive Reasoning, Medium Effort)
59
GPT-5.6 Sol (xhigh)
59
Qwen3.8 Max
58
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
57
GPT-5.6 Sol (high)
57
GPT-5.6 Terra (max)
57
Muse Spark 1.2 (xhigh)
57
Gemini 3.7 Flash (high)
56
GPT-5.5 (xhigh)
56
GPT-5.6 Sol (medium)
56
Grok 4.5 (high)
56
Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
55
Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
55
GPT-5.5 (high)
55
DeepSeek V4 Pro 0813 (max)
53
GLM-5.2 (max)
53
GPT-5.4 (xhigh)
53
GPT-5.6 Terra (xhigh)
53
Muse Spark 1.1 (xhigh)
53
Claude Opus 5 (Adaptive Reasoning, Low Effort)
52
DeepSeek V4 Flash 0731 (Reasoning, Max Effort)
52
Gemini 3.5 Flash (high)
52
Gemini 3.6 Flash (high)
52
GPT-5.6 Luna (max)
52
GPT-5.5 (medium)
51
GPT-5.6 Sol (low)
51
GPT-5.6 Luna (xhigh)
50
GPT-5.6 Terra (high)
50
Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)
48
Gemini 3.1 Pro Preview
48
Kimi K3 (low)
48
Gemini 3.5 Flash (medium)
47
GPT-5.6 Luna (high)
47
GPT-5.6 Terra (medium)
47
Qwen3.7 Max
47
GPT-5.3 Codex (xhigh)
46
Claude Opus 4.6 (Adaptive Reasoning, Max Effort)
45
Kimi K2.6
45
MiniMax-M3
45
Motif 3 (Beta)
45
Claude Opus 4.7 (Non-reasoning, High Effort)
44
DeepSeek V4 Pro (Reasoning, High Effort)
44
GPT-5.5 (low)
44
Muse Spark
44
Claude Sonnet 5 (Non-reasoning, High Effort)
43
GPT-5.2 (xhigh)
43
Kimi K2.7 Code
43
MiMo-V2.5-Pro
43
Claude Opus 4.5 (Reasoning)
42
DeepSeek V4 Flash (Reasoning, Max Effort)
42
GPT-5.6 Sol (Non-reasoning)
42
Hy3
42
Inkling (xhigh)
42
Nex-N2-Pro
42
Gemini 3 Pro Preview (high)
41
GLM-5 (Reasoning)
41
GLM-5.1 (Reasoning)
41
GPT-5.2 Codex (xhigh)
41
GPT-5.4 mini (xhigh)
41
GPT-5.6 Terra (low)
41
Grok Build 0.1 0616
41
Inkling Small
41
MiMo-V2-Pro
41
Qwen3.6 Max Preview
41
Agnes 2.5 Pro Alpha
40
GPT-5.4 (low)
40
GPT-5.4 nano (xhigh)
40
JT-4.1 Flash 236B A21B
40
Qwen3.6 Plus
40
Claude Opus 4.6 (Non-reasoning, High Effort)
39
DeepSeek V4 Flash (Reasoning, High Effort)
39
Gemini 3 Flash Preview (Reasoning)
39
GLM-5-Turbo
39
GPT-5.2 (medium)
39
GPT-5.6 Luna (medium)
39
MiniMax-M2.7
39
Qwen3.7 Plus
39
Grok 4.20 0309 v2 (Reasoning)
38
Grok 4.3 (high)
38
Ling 3.0 Flash
38
MiMo-V2.5
38
Nemotron 3 Ultra 550B A55B (Reasoning)
38
Qwen3.6 27B (Reasoning)
38
Claude 4.5 Sonnet (Reasoning)
37
Claude Sonnet 4.6 (Non-reasoning, High Effort)
37
Gemini 3.5 Flash-Lite
37
GPT-5 Codex (high)
37
GPT-5.1 (high)
37
Grok 4.20 0309 (Reasoning)
37
Grok 4.3 (medium)
37
MiMo-V2-Omni-0327
37
Claude Opus 4.5 (Non-reasoning)
36
Gemini 3.5 Flash (minimal)
36
GLM-5.1 (Non-reasoning)
36
GPT-5.1 Codex (high)
36
GPT-5.5 (Non-reasoning)
36
Grok 4.3 (low)
36
Kimi K2.5 (Reasoning)
36
MiMo-V2-Omni
36
Claude 4.1 Opus (Reasoning)
35
Claude Sonnet 4.6 (Non-reasoning, Low Effort)
35
GLM 5V Turbo (Reasoning)
35
GLM-5.2 (Non-reasoning)
35
GPT-5 (high)
35
GPT-5 (medium)
35
GPT-5.6 Terra (Non-reasoning)
35
KAT Coder Pro V2
35
Kimi K2.6 (Non-reasoning)
35
Muse Glimmer (high)
35
Qwen3.5 27B (Reasoning)
35
Gemini 3 Pro Preview (low)
34
GLM-4.7 (Reasoning)
34
GPT-5.5 Instant (May 2026)
34
GPT-5.6 Luna (low)
34
Grok 4
34
Hy3-preview (Reasoning)
34
LongCat 2.0
34
MiMo-V2-Flash (Feb 2026)
34
MiniMax-M2.5
34
Qwen3.5 397B A17B (Reasoning)
34
DeepSeek V3.2 (Reasoning)
33
GLM-5 (Non-reasoning)
33
Kimi K2 Thinking
33
o3-pro
33
Qwen3.5 122B A10B (Reasoning)
33
Qwen3.5 397B A17B (Non-reasoning)
33
Claude 4 Opus (Reasoning)
32
DeepSeek V4 Pro (Non-reasoning)
32
G9v3-39A5B
32
GPT-5 (low)
32
GPT-5 mini (medium)
32
MiMo-V2-Flash (Reasoning)
32
MiniMax-M2.1
32
Qwen3 Max Thinking
32
Qwen3.6 35B A3B (Reasoning)
32
DeepSeek V3.1 Terminus (Reasoning)
31
GPT-5.1 Codex mini (high)
31
GPT-5.4 nano (medium)
31
Grok 4.1 Fast (Reasoning)
31
o3
31
Qwen3.5 Omni Plus
31
Qwen3.6 27B (Non-reasoning)
31
Ring-2.6-1T
31
Step 3.7 Flash
31
Claude 4 Sonnet (Reasoning)
30
Claude 4.5 Haiku (Reasoning)
30
Claude 4.5 Sonnet (Non-reasoning)
30
Gemma 4 31B (Reasoning)
30
GPT-5.4 mini (medium)
30
Kimi K2.5 (Non-reasoning)
30
Mistral Medium 3.5
30
Qwen3.5 27B (Non-reasoning)
30
Qwen3.5 35B A3B (Reasoning)
30
Claude 4.1 Opus (Non-reasoning)
29
DeepSeek V4 Flash (Non-reasoning)
29
GLM-4.6 (Reasoning)
29
GPT-5.5 Instant (June 2026)
29
JT-35B-Flash
29
KAT-Coder-Pro V1
29
MiniMax-M2
29
Claude 3.7 Sonnet (Reasoning)
28
Gemini 3 Flash Preview (Non-reasoning)
28
GPT-5.4 (Non-reasoning)
28
Grok 4 Fast (Reasoning)
28
MiMo-V2.5-Pro (Non-reasoning)
28
Qwen3.5 122B A10B (Non-reasoning)
28
GLM-4.7 (Non-reasoning)
27
GPT-5.2 (Non-reasoning)
27
GPT-5.6 Luna (Non-reasoning)
27
Hy3-preview (Non-reasoning)
27
Ling-2.6-1T
27
Step 3.5 Flash 2603
27
Claude 4 Opus (Non-reasoning)
26
Claude 4 Sonnet (Non-reasoning)
26
DeepSeek V3.2 Exp (Reasoning)
26
Doubao Seed Code
26
Gemini 2.5 Pro
26
Gemini 3.1 Flash-Lite
26
Gemma 4 26B A4B (Reasoning)
26
GPT-5 mini (high)
26
Nemotron 3 Super 120B A12B (Reasoning)
26
o4-mini (high)
26
Qwen3 Max Thinking (Preview)
26
Step 3.5 Flash
26
DeepSeek V3.2 (Non-reasoning)
25
Grok 4.3 (Non-reasoning)
25
Ling 3.0 Tiny
25
MiMo-V2-Flash (Non-reasoning)
25
Qwen3.6 35B A3B (Non-reasoning)
25
Claude 3.7 Sonnet (Non-reasoning)
24
Claude 4.5 Haiku (Non-reasoning)
24
Gemini 2.5 Flash Preview (Sep '25) (Reasoning)
24
gpt-oss-120b (high)
24
Kimi K2 0905
24
Nemotron 3.5 Lightning
24
o1
24
Qwen3 Max
24
Qwen3.5 35B A3B (Non-reasoning)
24
Command A+
23
DeepSeek V3.2 Speciale
23
Gemini 2.5 Pro Preview (Mar' 25)
23
Gemini 2.5 Pro Preview (May' 25)
23
GLM-4.6 (Non-reasoning)
23
GLM-4.7-Flash (Reasoning)
23
Grok 3 mini Reasoning (high)
23
Grok 4.20 0309 (Non-reasoning)
23
Apriel-v1.5-15B-Thinker
22
DeepSeek V3.1 Terminus (Non-reasoning)
22
DeepSeek V3.2 Exp (Non-reasoning)
22
ERNIE 5.0 Thinking Preview
22
Gemma 4 12B (Reasoning)
22
Gemma 4 31B (Non-reasoning)
22
Grok 4.20 0309 v2 (Non-reasoning)
22
Grok Code Fast 1
22
K-EXAONE (Reasoning)
22
Mercury 2
22
Nova 2.0 Pro Preview (medium)
22
Qwen3.5 9B (Reasoning)
22
Apriel-v1.6-15B-Thinker
21
DeepSeek V3.1 (Non-reasoning)
21
DeepSeek V3.1 (Reasoning)
21
EXAONE 4.5 33B
21
GPT-5.1 (Non-reasoning)
21
Nova 2.0 Lite (high)
21
Nova 2.0 Omni (medium)
21
Qwen3 Coder Next
21
Qwen3 VL 235B A22B (Reasoning)
21
Qwen3.5 9B (Non-reasoning)
21
DeepSeek R1 0528 (May '25)
20
Gemini 2.5 Flash (Reasoning)
20
Gemma 4 26B A4B (Non-reasoning)
20
GLM-4.5 (Reasoning)
20
GPT-4.1
20
GPT-5 nano (high)
20
Kimi K2
20
Mistral Small 4 (Reasoning)
20
North Mini Code
20
Nova 2.0 Pro Preview (low)
20
Qwen3 235B A22B 2507 (Reasoning)
20
Qwen3.5 4B (Reasoning)
20
DeepSeek R1 (Jan '25)
19
Devstral 2
19
Gemini 2.5 Flash Preview (Sep '25) (Non-reasoning)
19
GPT-5 nano (medium)
19
Grok 3
19
JT-MINI
19
Nova 2.0 Lite (medium)
19
o1-pro
19
o3-mini
19
Qwen3 Max (Preview)
19
Qwen3.5 Omni Flash
19
Seed-OSS-36B-Instruct
19
Devstral Small 2
18
Gemini 2.5 Flash Preview (Reasoning)
18
GPT-5.4 nano (Non-Reasoning)
18
HyperNova 60B 2605
18
Magistral Medium 1.2
18
MiniMax M1 80k
18
Nemotron Cascade 2 30B A3B
18
Nova 2.0 Lite (low)
18
Qwen3 235B A22B 2507 Instruct
18
Qwen3 Coder 480B A35B Instruct
18
Qwen3 VL 32B (Reasoning)
18
Sonar Reasoning Pro
18
Trinity Large Thinking
18
GLM-4.5-Air
17
GLM-4.6V (Reasoning)
17
GPT-5 (minimal)
17
GPT-5.4 mini (Non-Reasoning)
17
Grok 4 Fast (Non-reasoning)
17
Grok 4.1 Fast (Non-reasoning)
17
HyperCLOVA X SEED Think (32B)
17
K-EXAONE (Non-reasoning)
17
K2 Think V2
17
LongCat Flash Lite
17
Mi:dm K 2.5 Pro
17
Nova 2.0 Omni (low)
17
o1-preview
17
Qwen3 Next 80B A3B (Reasoning)
17
G9v3-3B
16
GLM-4.7-Flash (Non-reasoning)
16
INTELLECT-3
16
Mistral Large 3
16
o3-mini (high)
16
Qwen3.5 4B (Non-reasoning)
16
Ring-1T
16
DeepSeek V3 0324
15
Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)
15
GPT-4.1 mini
15
GPT-5 (ChatGPT)
15
gpt-oss-120b (low)
15
gpt-oss-20b (high)
15
Grok 3 Reasoning Beta
15
Mistral Medium 3.1
15
Mistral Small 3.1
15
Nemotron 3 Nano Omni 30B A3B Reasoning
15
NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)
15
Qwen3 30B A3B 2507 (Reasoning)
15
Solar Open 100B (Reasoning)
15
DeepSeek V3 (Dec '24)
14
Gemini 2.5 Flash (Non-reasoning)
14
GPT-4.5 (Preview)
14
GPT-5 mini (minimal)
14
gpt-oss-20b (low)
14
K2-V2 (high)
14
Ling 2.6 Flash
14
Llama 4 Maverick
14
MiniMax M1 40k
14
Nova 2.0 Pro Preview (Non-reasoning)
14
o1-mini
14
Qwen3 Coder 30B A3B Instruct
14
Qwen3 Next 80B A3B Instruct
14
Qwen3 VL 235B A22B Instruct
14
Solar Pro 3
14
Tri-21B-think Preview
14
DiffusionGemma 26B A4B
13
Gemini 2.0 Flash Thinking Experimental (Jan '25)
13
Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning)
13
Gemma 4 12B (Non-reasoning)
13
Ling-1T
13
Motif-2-12.7B-Reasoning
13
Nova Premier
13
Qwen3 235B A22B (Reasoning)
13
Qwen3 VL 30B A3B (Reasoning)
13
QwQ 32B
13
Solar Pro 2 (Preview) (Reasoning)
13
Celeris-1
12
Claude 3 Opus
12
Claude 3.5 Haiku
12
Devstral Medium
12
Devstral Small (May '25)
12
Gemini 2.0 Flash (Feb '25)
12
Gemini 2.0 Pro Experimental (Feb '25)
12
Gemini 2.5 Flash Preview (Non-reasoning)
12
Gemma 4 E4B (Reasoning)
12
GPT-4o (March 2025, chatgpt-4o-latest)
12
K2-V2 (medium)
12
Llama 3.3 Nemotron Super 49B v1 (Reasoning)
12
Llama Nemotron Super 49B v1.5 (Reasoning)
12
Magistral Medium 1
12
MiniCPM5-1B (Non-reasoning)
12
MiniCPM5-1B (Reasoning)
12
Mistral Medium 3
12
Mistral Small 4 (Non-reasoning)
12
Nova 2.0 Lite (Non-reasoning)
12
Qwen3 4B 2507 (Reasoning)
12
Sarvam 105B (high)
12
Sonar Reasoning
12
Tri-21B-Think
12
DeepSeek R1 Distill Qwen 32B
11
EXAONE 4.0 32B (Reasoning)
11
Gemini 2.0 Flash (experimental)
11
Gemini 2.5 Flash-Lite (Reasoning)
11
GLM-4.6V (Non-reasoning)
11
GPT-4o (Nov '24)
11
Magistral Small 1
11
Magistral Small 1.2
11
Ministral 3 14B
11
Mistral Small 3.2
11
Nanbeige4.1-3B
11
Qwen3 235B A22B (Non-reasoning)
11
Qwen3 32B (Reasoning)
11
Qwen3 VL 32B Instruct
11
Claude 3.5 Sonnet (Oct '24)
10
DeepSeek R1 0528 Qwen3 8B
10
DeepSeek R1 Distill Llama 70B
10
DeepSeek R1 Distill Qwen 14B
10
Falcon-H1R-7B
10
Gemini 1.5 Pro (Sep '24)
10
Gemma 4 E2B (Reasoning)
10
GPT-4.1 nano
10
Hermes 4 - Llama-3.1 70B (Reasoning)
10
Ling-flash-2.0
10
Llama 4 Scout
10
Nova 2.0 Omni (Non-reasoning)
10
Qwen2.5 Max
10
Qwen3 14B (Reasoning)
10
Qwen3 Omni 30B A3B (Reasoning)
10
Qwen3 VL 30B A3B Instruct
10
Qwen3 VL 8B (Reasoning)
10
Solar Pro 2 (Preview) (Non-reasoning)
10
Devstral Small (Jul '25)
9
ERNIE 4.5 300B A47B
9
Gemini 2.0 Flash-Lite (Feb '25)
9
Gemma 4 E4B (Non-reasoning)
9
GLM-4.5V (Reasoning)
9
GPT-4o (Aug '24)
9
Granite 4.1 30B
9
Hermes 4 - Llama-3.1 405B (Non-reasoning)
9
Hermes 4 - Llama-3.1 405B (Reasoning)
9
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)
9
Llama 3.3 Instruct 70B
9
Llama Nemotron Super 49B v1.5 (Non-reasoning)
9
Ministral 3 8B
9
Mistral Large 2 (Nov '24)
9
NVIDIA Nemotron 3 Nano 4B
9
NVIDIA Nemotron Nano 12B v2 VL (Reasoning)
9
NVIDIA Nemotron Nano 9B V2 (Reasoning)
9
Qwen2.5 Instruct 72B
9
Qwen3 30B A3B (Reasoning)
9
Qwen3 30B A3B 2507 Instruct
9
QwQ 32B-Preview
9
Solar Pro 2 (Reasoning)
9
Sonar
9
Sonar Pro
9
Step3 VL 10B
9
Claude 3.5 Sonnet (June '24)
8
Gemini 1.5 Flash (Sep '24)
8
Gemini 2.0 Flash-Lite (Preview)
8
GPT-4 Turbo
8
GPT-4o (ChatGPT)
8
GPT-4o (May '24)
8
GPT-5 nano (minimal)
8
Grok 2 (Dec '24)
8
K2-V2 (low)
8
Kimi Linear 48B A3B Instruct
8
LFM2.5-8B-A1B
8
Llama 3.1 Instruct 405B
8
Llama 3.1 Nemotron Nano 4B v1.1 (Reasoning)
8
Llama 3.1 Tulu3 405B
8
Llama 3.3 Nemotron Super 49B v1 (Non-reasoning)
8
Olmo 3.1 32B Think
8
Pixtral Large
8
Qwen3 32B (Non-reasoning)
8
Qwen3 4B (Reasoning)
8
Qwen3 8B (Reasoning)
8
Qwen3 VL 4B (Reasoning)
8
Qwen3 VL 8B Instruct
8
Ring-flash-2.0
8
Solar Pro 2 (Non-reasoning)
8
Command A
7
DeepSeek-V2.5 (Dec '24)
7
Gemini 2.5 Flash-Lite (Non-reasoning)
7
Gemma 3 27B Instruct
7
GLM-4.5V (Non-reasoning)
7
GPT-4
7
GPT-4o mini
7
Grok Beta
7
Hermes 4 - Llama-3.1 70B (Non-reasoning)
7
Llama 3.1 Instruct 70B
7
Llama 3.1 Instruct 8B
7
Llama 3.1 Nemotron Instruct 70B
7
Ministral 3 3B
7
Mistral Large 2 (Jul '24)
7
Mistral Small 3
7
Nova Lite
7
Nova Pro
7
NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning)
7
NVIDIA Nemotron Nano 9B V2 (Non-reasoning)
7
Qwen2.5 Coder Instruct 32B
7
Qwen2.5 Instruct 32B
7
Qwen3 14B (Non-reasoning)
7
Qwen3 30B A3B (Non-reasoning)
7
Qwen3 4B (Non-reasoning)
7
Qwen3 4B 2507 Instruct
7
Qwen3.5 2B (Reasoning)
7
DeepSeek R1 Distill Llama 8B
6
DeepSeek-V2.5
6
EXAONE 4.0 32B (Non-reasoning)
6
Gemini 1.5 Pro (May '24)
6
Gemini 2.0 Flash Thinking Experimental (Dec '24)
6
Gemma 3 12B Instruct
6
Gemma 4 E2B (Non-reasoning)
6
Granite 4.1 8B
6
Grok-1
6
Llama 3.2 Instruct 90B (Vision)
6
Mistral Saba
6
Olmo 3 32B Think
6
Olmo 3.1 32B Instruct
6
Phi-4 Mini Instruct
6
Qwen2 Instruct 72B
6
Qwen2.5 Turbo
6
R1 1776
6
Reka Flash (Sep '24)
6
Sarvam 30B (high)
6
Solar Mini
6
DeepHermes 3 - Mistral 24B Preview (Non-reasoning)
5
DeepSeek-Coder-V2
5
Gemini 1.5 Flash (May '24)
5
Gemini 1.5 Flash-8B
5
Granite 4.0 H Small
5
Hermes 3 - Llama-3.1 70B
5
Jamba 1.5 Large
5
Jamba 1.6 Large
5
Jamba 1.7 Large
5
LFM2 24B A2B
5
OLMo 2 32B
5
Phi-4
5
Qwen3 8B (Non-reasoning)
5
Qwen3 Omni 30B A3B Instruct
5
Qwen3.5 0.8B (Reasoning)
5
Qwen3.5 2B (Non-reasoning)
5
Claude 2.1
4
Claude 3 Sonnet
4
Gemini 1.0 Ultra
4
Gemma 3n E4B Instruct Preview (May '25)
4
Granite 4.1 3B
4
Jamba Reasoning 3B
4
Llama 2 Chat 7B
4
Llama 3.2 Instruct 3B
4
MiniCPM-V 4.6 1.3B
4
Mistral Large (Feb '24)
4
Mistral Small (Sep '24)
4
Mixtral 8x22B Instruct
4
Nova Micro
4
NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning)
4
Olmo 3 7B Think
4
Phi-3 Mini Instruct 3.8B
4
Phi-4 Multimodal Instruct
4
Qwen1.5 Chat 110B
4
Qwen2.5 Coder Instruct 7B
4
Qwen3 VL 4B Instruct
4
Reka Flash 3
4
Arctic Instruct
3
Claude 2.0
3
Claude 3 Haiku
3
Command-R+ (Apr '24)
3
DBRX Instruct
3
DeepSeek Coder V2 Lite Instruct
3
DeepSeek LLM 67B Chat (V1)
3
DeepSeek R1 Distill Qwen 1.5B
3
DeepSeek-V2-Chat
3
Exaone 4.0 1.2B (Reasoning)
3
Gemini 1.0 Pro
3
GPT-3.5 Turbo
3
LFM 40B
3
Ling-mini-2.0
3
Llama 2 Chat 13B
3
Llama 2 Chat 70B
3
Llama 3 Instruct 70B
3
Llama 3.2 Instruct 11B (Vision)
3
Mistral Medium
3
Mistral Small (Feb '24)
3
Molmo 7B-D
3
OLMo 2 7B
3
OpenChat 3.5 (1210)
3
PALM-2
3
Qwen Chat 72B
3
Qwen3.5 0.8B (Non-reasoning)
3
Sarvam M (Reasoning)
3
Apertus 70B Instruct
2
Claude Instant
2
Command-R (Mar '24)
2
DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning)
2
Exaone 4.0 1.2B (Non-reasoning)
2
Gemma 3 270M
2
Granite 4.0 1B
2
Granite 4.0 H 1B
2
Granite 4.0 Micro
2
Jamba 1.5 Mini
2
Jamba 1.6 Mini
2
Jamba 1.7 Mini
2
LFM2 2.6B
2
LFM2.5-1.2B-Instruct
2
LFM2.5-1.2B-Thinking
2
Llama 65B
2
Mistral 7B Instruct
2
Mixtral 8x7B Instruct
2
Molmo2-8B
2
Olmo 3 7B Instruct
2
Qwen Chat 14B
2
Qwen3 1.7B (Reasoning)
2
Apertus 8B Instruct
1
Gemma 3 1B Instruct
1
Gemma 3 4B Instruct
1
Gemma 3n E2B Instruct
1
Gemma 3n E4B Instruct
1
Granite 3.3 8B (Non-reasoning)
1
Granite 4.0 350M
1
Granite 4.0 H 350M
1
LFM2 1.2B
1
LFM2 8B A1B
1
LFM2.5-VL-1.6B
1
Llama 3 Instruct 8B
1
Llama 3.2 Instruct 1B
1
Qwen3 0.6B (Non-reasoning)
1
Qwen3 0.6B (Reasoning)
1
Qwen3 1.7B (Non-reasoning)
1
Tiny Aya Global
1

Full Artificial Analysis Intelligence Index mirror retrieved 2026-08-14 from artificialanalysis.ai/evaluations/artificial-analysis-intelligence-index. Gemini 3.7 Flash (high) was added from that live table; other rows remain the prior mirror plus this insertion. Effort / reasoning variants appear as separate rows when AA publishes them. Open the live source for estimated flags, confidence detail, and any rows added after this snapshot.

Open Artificial Analysis Intelligence Index

Evidence in this catalog

Where Intelligence Index fits

Closest verified examples we currently carry. A missing score is not a zero.

Model examples

  • Claude Opus 563 index (max)

    Intelligence Index v4.1.1 figure retrieved 2026-08-08.

  • GPT-5.6 Sol61 index (max)

    Intelligence Index v4.1.1 figure retrieved 2026-08-08.

  • DeepSeek V4-Flash52 index (max)

    Intelligence Index for V4-Flash-0731 at max effort; no separate standard AA row is published for this checkpoint.

Harness examples

No directly comparable harness score is verified here yet.

Open this board on Artificial Analysis Intelligence Index