Skip to content

Artificial Analysis index

Ranked by the Artificial Analysis Intelligence Index, as published via OpenRouter. Covers many new models before Epoch evaluates them.

Ranked by the Artificial Analysis Intelligence Index, as published via OpenRouter. Covers many new models before Epoch evaluates them. Source: Artificial Analysis (via OpenRouter). Variants (reasoning effort, batch) are folded into one row.

#ModelCapabilityReasoningCodingContext$/M
1Claude Opus 5.5NEWAnthropic · +1 variant———1M$8.00
2Claude Sonnet 5.5NEWAnthropic · +1 variant———1M$4.00
3Claude Fable 5.1NEWAnthropic · +1 variant165.0——1M$20.00
4GPT-6 AstraNEWbatchOpenAI · +1 variant———1.05M$10.00
5Claude Opus 5Anthropic · +1 variant162.793.973.61M$10.00
6Claude Fable 5Anthropic · +1 variant163.685.969.71M$20.00
7GPT-6 SolNEWOpenAI · +1 variant———1.05M$4.00
8GPT-5.6 SolOpenAI · +1 variant162.093.572.71.05M$4.00
9Grok 4.7NEWxAI———500K$3.00
10MiMo-V2.6-ProNEWXiaomi———1.05M$0.54
11Qwen3.8 Max (0902)NEWAlibaba (Qwen)155.3——1M$3.00
12GLM 5.3batchZ.ai (Zhipu AI) · +1 variant———1.05M$0.84
13Grok 4.6xAI156.594.065.2500K$3.00
14Kimi K3Moonshot AI · +1 variant157.793.168.51.05M$6.00
15GPT-5.6 TerraOpenAI · +1 variant159.393.369.61.05M$4.50
16Claude Opus 4.8Anthropic · +1 variant158.391.059.01M$10.00
17GLM 5.3 FlashbatchZ.ai (Zhipu AI) · +1 variant———1.05M$0.095
18Gemini 3.8 FlashNEWGoogle · +1 variant157.195.473.81.05M$1.50
19Qwen3.8 2.4T A95BAlibaba (Qwen)———1.05M$3.00
20Muse Spark 1.2Meta155.2——1.05M$2.00
21DeepSeek V4.1 FlashNEWbatchDeepSeek · +1 variant———1.05M$0.17
22Gemini 3.7 FlashGoogle · +1 variant157.794.865.31.05M$1.50
23Grok 4.5xAI154.093.453.8500K$3.00
24GPT-5.5batchOpenAI · +1 variant———1.05M$5.63
25Claude Sonnet 5Anthropic · +1 variant156.380.353.81M$4.00
26MiMo-V2.6-FlashNEWXiaomi———1.05M$0.17
27GPT-5.6 LunaOpenAI · +1 variant156.391.667.21.05M$0.45
28GPT-6 LunaNEWOpenAI · +1 variant———1.05M$0.20
29DeepSeek V4 Pro 0813DeepSeek155.491.7—1.05M$1.41
30DeepSeek V4 Flash 0731DeepSeek154.591.0—1.31M$0.093
31Gemini 3.6 FlashGoogle · +1 variant154.494.146.71.05M$1.50
32Muse Spark 1.1Meta154.3—53.31.05M$2.00
33GLM 5.2Z.ai (Zhipu AI)151.891.943.81.05M$1.51
34Qwen3.8 27BAlibaba (Qwen)———1M$1.15
35Gemini 3.5 FlashGoogle · +1 variant154.692.837.41.05M$3.38
36DeepSeek V4 Pro 0423DeepSeek149.1——1.05M$1.19
37Claude Sonnet 4.6Anthropic · +1 variant152.383.329.91M$6.00
38Gemini 3.1 Pro PreviewGoogle · +1 variant—94.411.71.05M$4.50
39Qwen3.7 MaxAlibaba (Qwen)153.790.9—1M$2.21
40MiniMax M3MiniMax147.090.9—1.05M$0.53
41Kimi K2.6Moonshot AI151.090.8—262K$1.34
42GLM 5.1Z.ai (Zhipu AI)149.989.9—205K$2.15
43MiMo-V2.5-ProXiaomi———1.05M$0.54
44Kimi K2.7 CodeMoonshot AI150.087.930.5262K$1.32
45Hy3 previewTencent———262K$0.28
46Qwen3.7 PlusAlibaba (Qwen)147.487.9—1M$0.56
47InklingThinking Machines Lab148.6——524K$1.76
48Grok 4.3xAI · +1 variant———1M$1.56
49Ling 3.0 Flash VLNEWinclusionAI (Ant Group)———262K$0.031
50DeepSeek V4 Flash 0423DeepSeek146.1——1.05M$0.17
— means no published score from that source yet · click a model for every benchmark with its source

New - awaiting independent evaluation

All new models →

Not ranked until an independent evaluator (Epoch AI) publishes scores. We don't use vendor-reported benchmark claims for rankings.

Best AI for coding →
Models ranked on DeepSWE
Best AI for reasoning →
Ranked on GPQA Diamond
Best AI for math →
Ranked on competition math
Best open-weight models →
Weights you can run yourself
Cheapest capable models →
Lowest blended API price
Best AI coding tools →
Apps & agents by popularity
Best AI image generators →
Apps & models
Best AI for research →
Answer engines & deep research