Updated 45m ago
AI Leaderboard - 916 models ranked by capability, price & context
Independent benchmark results from Epoch AI and Artificial Analysis, live API prices and context windows from OpenRouter. Each ranking uses one named measure - we don't blend them into a made-up score.
Ranked by the Epoch Capabilities Index (ECI) - Epoch AI's statistical model over dozens of benchmarks. Source: Epoch AI. Variants (reasoning effort, batch) are folded into one row.
| # | Model | Capability | Reasoning | Coding | Context | $/M | Weights | Released |
|---|---|---|---|---|---|---|---|---|
| 101 | Gemma 4 26B A4BGoogle | 141.8 | 73.2 | — | 262K | $0.14 | Open | 2 Apr 2026 |
| 102 | Claude Sonnet 4Anthropic | 141.7 | 79.2 | — | 200K | $6.00 | Closed | 22 May 2025 |
| 103 | Gemini 2.5 Flash (May 2025)Google | 141.5 | — | — | — | — | Closed | 20 May 2025 |
| 104 | Mistral Medium 3.5Mistral AI | 141.4 | — | — | 262K | $3.00 | Open | 28 Apr 2026 |
| 105 | DeepSeek-R1 (May 2025)DeepSeek | 141.3 | 76.3 | — | — | — | Open | 28 May 2025 |
| 106 | Claude 3.7 SonnetAnthropic | 141.2 | 66.0 | — | — | — | Closed | 24 Feb 2025 |
| 107 | Gemini 2.5 Flash (Jun 2025)Google | 140.8 | — | — | — | — | Closed | 17 Jun 2025 |
| 108 | Grok-3 minixAI | 140.3 | 76.3 | — | — | — | Closed | 24 Jun 2025 |
| 109 | o3 MiniOpenAI | 140.3 | 77.0 | — | 200K | $1.93 | Closed | 31 Jan 2025 |
| 110 | Kimi K2 (Jul 2025)Moonshot AI | 140.1 | — | — | — | — | Open | 12 Jul 2025 |
| 111 | Gemini 2.5 Flash (Apr 2025)Google | 140.0 | — | — | — | — | Closed | 17 Apr 2025 |
| 112 | gpt-oss-120bOpenAI | 139.9 | 75.8 | — | 131K | $0.070 | Open | 5 Aug 2025 |
| 113 | DeepSeek V3.1DeepSeek | 139.9 | — | — | 164K | $0.42 | Open | 21 Aug 2025 |
| 114 | Qwen3-30B-A3B-Thinking (Jul 2025)Alibaba (Qwen) | 139.6 | 70.1 | — | — | — | Open | 30 Jul 2025 |
| 115 | Qwen3.5-9BAlibaba (Qwen) | 139.4 | 79.0 | — | 262K | $0.11 | Open | 24 Feb 2026 |
| 116 | GPT-5 NanoOpenAI | 139.4 | 69.4 | — | 400K | $0.14 | Closed | 7 Aug 2025 |
| 117 | Qwen3 235B A22BAlibaba (Qwen) | 139.4 | 70.7 | — | 131K | $0.80 | Open | 28 Apr 2025 |
| 118 | R1DeepSeek | 139.0 | 71.7 | — | 64K | $1.15 | Open | 20 Jan 2025 |
| 119 | Qwen3-235B-A22B-Instruct (Jul 2025)Alibaba (Qwen) | 138.9 | — | — | — | — | Open | 25 Jul 2025 |
| 120 | Qwen3 32BAlibaba (Qwen) | 138.5 | 65.7 | — | 131K | $0.13 | Open | 29 Apr 2025 |
| 121 | Grok 3xAI | 138.3 | 75.8 | — | — | — | Closed | 9 Apr 2025 |
| 122 | Qwen3 14BAlibaba (Qwen) | 138.2 | 63.8 | — | 131K | $0.15 | Open | 29 Apr 2025 |
| 123 | gpt-oss-20bOpenAI | 137.8 | 60.8 | — | 131K | $0.036 | Open | 5 Aug 2025 |
| 124 | QwQ-32BAlibaba (Qwen) | 137.6 | 65.3 | — | — | — | Open | 5 Mar 2025 |
| 125 | DeepSeek-R1-Distill-Qwen-32BDeepSeek | 137.4 | 64.1 | — | — | — | Open | 20 Jan 2025 |
| 126 | Qwen3-30B-A3B-Instruct (Jul 2025)Alibaba (Qwen) | 137.4 | 55.6 | — | — | — | Open | 29 Jul 2025 |
| 127 | GPT-4.1OpenAI | 136.8 | 66.9 | — | 1.05M | $3.50 | Closed | 14 Apr 2025 |
| 128 | GPT-4.5OpenAI | 136.7 | — | — | — | — | Closed | 27 Feb 2025 |
| 129 | Qwen3 30B A3BAlibaba (Qwen) | 136.2 | 61.7 | — | 131K | $0.23 | Open | 29 Apr 2025 |
| 130 | Qwen3 8BAlibaba (Qwen) | 136.2 | 56.8 | — | 131K | $0.20 | Open | 28 Apr 2025 |
| 131 | DeepSeek-V3 (Mar 2025)DeepSeek | 135.9 | 67.6 | — | — | — | Open | 24 Mar 2025 |
| 132 | o1-miniOpenAI | 135.8 | 62.4 | — | — | — | Closed | 12 Sep 2024 |
| 133 | DeepSeek-R1-Distill-Qwen-14BDeepSeek | 135.4 | 44.7 | — | — | — | Open | 20 Jan 2025 |
| 134 | Gemini 2.0 Flash Thinking (Jan 2025)Google | 135.4 | — | — | — | — | Closed | 21 Jan 2025 |
| 135 | Gemini 2.0 ProGoogle | 135.1 | — | — | — | — | Closed | 5 Feb 2025 |
| 136 | GPT-4.1 MiniOpenAI | 135.0 | 65.8 | — | 1.05M | $0.70 | Closed | 14 Apr 2025 |
| 137 | o1-previewOpenAI | 134.8 | 50.3 | — | — | — | Closed | 12 Sep 2024 |
| 138 | Gemini 2.0 Flash (Dec 2024)Google | 134.7 | — | — | — | — | Closed | 11 Dec 2024 |
| 139 | Gemini 2.0 Flash (Feb 2025)Google | 134.7 | 64.1 | — | — | — | Closed | 5 Feb 2025 |
| 140 | Mistral Medium 3Mistral AI | 134.1 | 59.5 | — | 131K | $0.80 | Closed | 7 May 2025 |
| 141 | Gemini 2.5 Flash-Lite (Jun 2025)Google | 133.9 | — | — | — | — | Closed | 17 Jun 2025 |
| 142 | Claude 3.5 Sonnet (October 2024)Anthropic | 133.6 | — | — | — | — | Closed | 22 Oct 2024 |
| 143 | Magistral Small 1.0Mistral AI | 133.2 | 56.1 | — | — | — | Open | 10 Jun 2025 |
| 144 | Qwen2.5-MaxAlibaba (Qwen) | 132.5 | 56.1 | — | — | — | Closed | 25 Jan 2025 |
| 145 | DeepSeek V3DeepSeek | 132.4 | 56.5 | — | 164K | $0.45 | Open | 26 Dec 2024 |
| 146 | Llama 4 MaverickMeta | 132.2 | — | — | 1.05M | $0.30 | Open | 6 Apr 2025 |
| 147 | Gemini 1.5 Pro (Sept 2024)Google | 131.7 | 57.2 | — | — | — | Closed | 24 Sep 2024 |
| 148 | Mistral Small 3.2Mistral AI | 131.7 | 49.1 | — | — | — | Open | 20 Jun 2025 |
| 149 | Magistral Small 1.2Mistral AI | 131.4 | 47.6 | — | — | — | Open | 18 Sep 2025 |
| 150 | Grok-2 (Dec 2024)xAI | 130.5 | 53.8 | — | — | — | Closed | 12 Dec 2024 |
— means no published score from that source yet · click a model for every benchmark with its source
New - awaiting independent evaluation
All new models →- Claude Sonnet 5.5Anthropic · 28 Sep 2026 · AA 56 · 1M · $4.00/M
- Qwen3.8 Max PrimeAlibaba (Qwen) · 23 Sep 2026 · 1M · $6.00/M
- GPT-6 SolOpenAI · 22 Sep 2026 · AA 47.5 · 1.05M · $4.00/M
- GPT-6 LunaOpenAI · 22 Sep 2026 · AA 37.3 · 1.05M · $0.20/M
- GPT-6 Sol ProOpenAI · 22 Sep 2026 · 1.05M · $4.00/M
- GPT-6 Luna ProOpenAI · 22 Sep 2026 · 1.05M · $0.20/M
- Claude Opus 5.5Anthropic · 22 Sep 2026 · AA 57.6 · 1M · $8.00/M
- Grok 4.7xAI · 21 Sep 2026 · AA 46.4 · 500K · $3.00/M
Not ranked until an independent evaluator (Epoch AI) publishes scores. We don't use vendor-reported benchmark claims for rankings.
Best AI for coding →
Models ranked on DeepSWE
Best AI for reasoning →
Ranked on GPQA Diamond
Best AI for math →
Ranked on competition math
Best open-weight models →
Weights you can run yourself
Cheapest capable models →
Lowest blended API price
Best AI coding tools →
Apps & agents by popularity
Best AI image generators →
Apps & models
Best AI for research →
Answer engines & deep research