llm.ing

AA Agentic Index

run by Artificial Analysisunit: indexDisplay with attribution; no redistribution68 modelssource ↗
AA Intelligence IndexAA Coding IndexAA Agentic IndexMedian output speedMedian time to first token
#ModelScoreObserved
1GPT-5.6 Sol
54.0
mirror
Jul 23, 2026
2Claude Fable 5
52.8
mirror
Jul 23, 2026
3Kimi K3
50.1
mirror
Jul 23, 2026
4GPT-5.6 Terra
47.4
mirror
Jul 23, 2026
5Claude Opus 4.8
47.2
mirror
Jul 23, 2026
6Claude Sonnet 5
46.7
independent
Jul 24, 2026
7Grok 4.5
45.7
mirror
Jul 23, 2026
8GPT-5.6 Luna
45.6
independent
Jul 24, 2026
9GPT-5.5
44.9
independent
Jul 24, 2026
10Claude Opus 4.7
44.4
mirror
Jul 23, 2026
11GLM-5.2
43.1
mirror
Jul 23, 2026
12GPT-5.4
41.1
mirror
Jul 23, 2026
13Claude Sonnet 4.6
40.8
mirror
Jul 23, 2026
14Gemini 3.6 Flash
38.7
mirror
Jul 23, 2026
15Muse Spark 1.1
37.5
mirror
Jul 23, 2026
16Gemini 3.5 Flash
37.4
independent
Jul 24, 2026
17DeepSeek V4 Pro
36.4
mirror
Jul 23, 2026
18MiniMax-M3
35.4
independent
Jul 24, 2026
19DeepSeek V4 Flash
31.1
mirror
Jul 23, 2026
20Qwen3.7 Max
30.6
mirror
Jul 23, 2026
21Kimi K2.6
30.3
mirror
Jul 23, 2026
22GPT-5.4 mini
30.2
mirror
Jul 23, 2026
23GLM-5.1
29.9
mirror
Jul 23, 2026
24Kimi K2.7 Code
29.6
mirror
Jul 23, 2026
25Grok Build 0.1
28.0
independent
Jul 24, 2026
26Qwen3.6 Plus
27.6
mirror
Jul 23, 2026
27GPT-5.4 nano
27.5
mirror
Jul 23, 2026
28Nemotron 3 Ultra 550B A55B
27.4
mirror
Jul 23, 2026
29Qwen3.6 27B
27.0
mirror
Jul 23, 2026
30Gemini 3.5 Flash Lite
26.8
independent
Jul 24, 2026
31GPT-5
25.7
independent
Jul 24, 2026
32MiniMax-M2.7
25.6
independent
Jul 24, 2026
33GLM-4.7
25.4
mirror
Jul 23, 2026
34Claude Sonnet 4.5 (latest)
24.6
mirror
Jul 23, 2026
35Grok 4.3
24.1
mirror
Jul 23, 2026
36Kimi K2.5
21.7
mirror
Jul 23, 2026
37Step 3.7 Flash
21.5
mirror
Jul 23, 2026
38Gemini 3.1 Pro Preview
21.4
mirror
Jul 23, 2026
38Qwen3.6 35B-A3B
21.4
mirror
Jul 23, 2026
40GPT-5.1
21.0
independent
Jul 24, 2026
41Qwen3.7 Plus
20.8
mirror
Jul 23, 2026
42Qwen3.5 122B-A10B
20.7
independent
Jul 24, 2026
43Qwen3.5 397B-A17B
19.8
independent
Jul 24, 2026
44GPT-5 Mini
19.4
independent
Jul 24, 2026
45DeepSeek V3.2
18.3
mirror
Jul 23, 2026
46GLM-4.6
17.7
mirror
Jul 23, 2026
47Claude Haiku 4.5 (latest)
16.4
mirror
Jul 23, 2026
48Gemma 4 31B IT
14.4
mirror
Jul 23, 2026
49Qwen3.5 35B-A3B
11.8
mirror
Jul 23, 2026
50Gemma 4 26B A4B IT
11.0
mirror
Jul 23, 2026
51Devstral 2
10.6
mirror
Jul 23, 2026
52Mercury 2
9.6
independent
Jul 24, 2026
53Nemotron 3 Super
8.7
mirror
Jul 23, 2026
54Gemini 2.5 Pro
7.1
independent
Jul 24, 2026
55Gemini 3.1 Flash Lite Preview
6.2
mirror
Jul 23, 2026
56Qwen3 235B-A22Bthinking
3.8
mirror
Jul 23, 2026
57DeepSeek R1
3.1
independent
Jul 24, 2026
58Qwen3-Next 80B-A3B (Thinking)thinking
2.1
mirror
Jul 23, 2026
59nemotron-3-nano-30b-a3b
2.0
mirror
Jul 23, 2026
60Qwen3 32B
1.8
mirror
Jul 23, 2026
60Qwen3 14B
1.8
mirror
Jul 23, 2026
60Kimi K2 Thinkingthinking
1.8
mirror
Jul 23, 2026
63GPT-4.1 mini
1.7
mirror
Jul 23, 2026
63o3-minihigh-effort
1.7
independent
Jul 24, 2026
65Qwen3 8B
1.5
mirror
Jul 23, 2026
66GPT-4.1 nano
1.2
mirror
Jul 23, 2026
67GPT-4o mini
1.0
mirror
Jul 23, 2026
68Llama-3.3-70B-Instruct
0.3
mirror
Jul 23, 2026

Bars on a 0–54 index scale. Scores link to model pages; every number keeps its source on the model page.