Best for coding
Ranked by DeepSWE - agentic software-engineering tasks on real repositories.
Ranked by DeepSWE - agentic software-engineering tasks on real repositories. Source: Epoch AI. Variants (reasoning effort, batch) are folded into one row.
| # | Model | Capability | Reasoning | Coding | Context | $/M | Weights | Released |
|---|---|---|---|---|---|---|---|---|
| 1 | GPT-6 AstraNEWxhighOpenAI · +3 variants | — | — | 74.1 | — | — | Closed | 3 Sep 2026 |
| 2 | Gemini 3.8 FlashNEWGoogle · +1 variant | 157.1 | 95.4 | 73.8 | 1.05M | $1.50 | Closed | 2 Sep 2026 |
| 3 | Claude Opus 5Anthropic · +3 variants | 162.7 | 93.9 | 73.6 | 1M | $10.00 | Closed | 24 Jul 2026 |
| 4 | GPT-5.6 SolOpenAI · +3 variants | 162.0 | 93.5 | 72.7 | 1.05M | $4.00 | Closed | 9 Jul 2026 |
| 5 | Claude Fable 5xhighAnthropic · +3 variants | — | — | 69.9 | — | — | Closed | 9 Jun 2026 |
| 6 | GPT-5.6 TerraOpenAI · +3 variants | 159.3 | 93.3 | 69.6 | 1.05M | $4.50 | Closed | 9 Jul 2026 |
| 7 | GLM 5.3Z.ai (Zhipu AI) | 155.6 | 90.9 | 69.0 | 1.31M | $2.15 | Open | 14 Aug 2026 |
| 8 | Kimi K3Moonshot AI | 157.7 | 93.1 | 68.5 | 1.05M | $6.00 | Open | 16 Jul 2026 |
| 9 | Grok 4.6mediumxAI · +3 variants | — | — | 67.5 | — | — | Closed | 12 Aug 2026 |
| 10 | GPT-5.6 LunaOpenAI · +3 variants | 156.3 | 91.6 | 67.2 | 1.05M | $0.45 | Closed | 9 Jul 2026 |
| 11 | GPT-5.5xhighOpenAI · +3 variants | — | 94.0 | 67.0 | — | — | Closed | 23 Apr 2026 |
| 12 | Gemini 3.7 FlashmediumGoogle · +2 variants | — | — | 65.5 | — | — | Closed | 13 Aug 2026 |
| 13 | GLM 5.3 FlashZ.ai (Zhipu AI) | 151.9 | 90.2 | 63.4 | 1.31M | $0.24 | Open | 20 Aug 2026 |
| 14 | Claude Opus 4.8Anthropic | 158.3 | 91.0 | 59.0 | 1M | $10.00 | Closed | 28 May 2026 |
| 15 | Qwen3.8 MaxxhighAlibaba (Qwen) | — | 92.7 | 57.5 | — | — | Closed | 2 Aug 2026 |
| 16 | Muse Spark 1.2xhighMeta | — | — | 54.9 | — | — | Closed | 5 Aug 2026 |
| 17 | Claude Sonnet 5Anthropic · +3 variants | 156.3 | 80.3 | 53.8 | 1M | $4.00 | Closed | 30 Jun 2026 |
| 18 | Grok 4.5xAI | 154.0 | 93.4 | 53.8 | 500K | $3.00 | Closed | 8 Jul 2026 |
| 19 | Muse Spark 1.1Meta | 154.3 | — | 53.3 | 1.05M | $2.00 | Closed | 9 Jul 2026 |
| 20 | GPT-5.4xhighOpenAI | — | 93.3 | 51.8 | — | — | Closed | 5 Mar 2026 |
| 21 | Gemini 3.6 FlashGoogle | 154.4 | 94.1 | 46.7 | 1.05M | $1.50 | Closed | 21 Jul 2026 |
| 22 | GLM 5.2Z.ai (Zhipu AI) | 151.8 | 91.9 | 43.8 | 1.05M | $1.51 | Open | 16 Jun 2026 |
| 23 | Gemini 3.5 FlashGoogle | 154.6 | 92.8 | 37.4 | 1.05M | $3.38 | Closed | 19 May 2026 |
| 24 | Kimi K2.7 CodeMoonshot AI | 150.0 | 87.9 | 30.5 | 262K | $1.32 | Open | 12 Jun 2026 |
| 25 | Claude Sonnet 4.6Anthropic | 152.3 | 83.3 | 29.9 | 1M | $6.00 | Closed | 17 Feb 2026 |
| 26 | Gemini 3.1 Pro PreviewGoogle | — | 94.4 | 11.7 | 1.05M | $4.50 | — | 19 Feb 2026 |
— means no published score from that source yet · click a model for every benchmark with its source
New - awaiting independent evaluation
All new models →- Claude Sonnet 5.5Anthropic · 28 Sep 2026 · AA 56 · 1M · $4.00/M
- Qwen3.8 Max PrimeAlibaba (Qwen) · 23 Sep 2026 · 1M · $6.00/M
- GPT-6 SolOpenAI · 22 Sep 2026 · AA 47.5 · 1.05M · $4.00/M
- GPT-6 LunaOpenAI · 22 Sep 2026 · AA 37.3 · 1.05M · $0.20/M
- GPT-6 Sol ProOpenAI · 22 Sep 2026 · 1.05M · $4.00/M
- GPT-6 Luna ProOpenAI · 22 Sep 2026 · 1.05M · $0.20/M
- Claude Opus 5.5Anthropic · 22 Sep 2026 · AA 57.6 · 1M · $8.00/M
- Grok 4.7xAI · 21 Sep 2026 · AA 46.4 · 500K · $3.00/M
Not ranked until an independent evaluator (Epoch AI) publishes scores. We don't use vendor-reported benchmark claims for rankings.
Best AI for coding →
Models ranked on DeepSWE
Best AI for reasoning →
Ranked on GPQA Diamond
Best AI for math →
Ranked on competition math
Best open-weight models →
Weights you can run yourself
Cheapest capable models →
Lowest blended API price
Best AI coding tools →
Apps & agents by popularity
Best AI image generators →
Apps & models
Best AI for research →
Answer engines & deep research