Skip to content
Model intelligence

231 AI models

Capability (Epoch Capabilities Index and individual benchmarks from Epoch AI), API list prices and context windows (OpenRouter), release dates and open-weight status. Benchmarks are shown individually - never merged into one invented score.
Leads on ECI
GPT-6 Astra
ECI 166.6Epoch AI
Leads on GPQA Diamond
GPT-6 Astra
95.8%Epoch AI
Leads on SWE-bench Verified
Claude Opus 4.7
83.5%Epoch AI
Cheapest in ECI top 10
GPT-5.6 Sol
$2.00/M inputOpenRouter
Longest context
Grok 4.20 Multi-Agent
2M tokensOpenRouter
Best open-weight on ECI
Kimi K3
ECI 157.68Epoch AI
Epoch Capabilities Index by release date

Capability frontier

Source: Epoch AI (CC BY 4.0). ECI is Epoch's item-response model over many benchmarks; each model page shows its 90% confidence interval.

Blended $/1M tokens (3:1 input:output) vs ECI

Price vs capability

Only models with both an ECI score and an OpenRouter price. Normalisation: 75% input + 25% output price. Click a point to open the model.

#ModelECI ↑ContextIn $/MReleased
201Nova 2 Lite
Amazon· reasoning
—1M$0.302 Dec 2025
202Nano Banana Pro (Gemini 3 Pro Image Preview)
Google· reasoning
—66K$2.0020 Nov 2025
203GPT-5.1-Codex
OpenAI· reasoning
—400K$1.2513 Nov 2025
204GPT-5.1-Codex-Mini
OpenAI· reasoning
—400K$0.2513 Nov 2025
205Sonar Pro Search
Perplexity· reasoning
—200K$3.0030 Oct 2025
206gpt-oss-safeguard-20b
OpenAI· reasoning
—131K$0.07529 Oct 2025
207MiniMax M2
MiniMax· reasoning
—205K$0.3023 Oct 2025
208GPT-5 Image Mini
OpenAI· reasoning
—400K$2.5016 Oct 2025
209GPT-5 Image
OpenAI· reasoning
—400K$10.014 Oct 2025
210Qwen3 VL 8B Thinking
Alibaba (Qwen)· reasoning
—131K$0.1814 Oct 2025
211Qwen3 VL 30B A3B Thinking
Alibaba (Qwen)· reasoning
—262K$0.206 Oct 2025
212GLM 4.6
Z.ai (Zhipu AI)· reasoning
—205K$0.4330 Sep 2025
213Qwen3 VL 235B A22B Thinking
Alibaba (Qwen)· reasoning
—131K$0.4023 Sep 2025
214Qwen3 Next 80B A3B Thinking
Alibaba (Qwen)· reasoning
—262K$0.1511 Sep 2025
215Qwen Plus 0728
Alibaba (Qwen)· reasoning
—1M$0.268 Sep 2025
216Hermes 4 405B
Nous Research· reasoning
—131K$1.0026 Aug 2025
217GLM 4.5V
Z.ai (Zhipu AI)· reasoning
—66K$0.6011 Aug 2025
218GLM 4.5
Z.ai (Zhipu AI)· reasoning
—131K$0.6025 Jul 2025
219GLM 4.5 Air
Z.ai (Zhipu AI)· reasoning
—131K$0.1325 Jul 2025
220Gemini 2.5 Flash Lite
Google· reasoning
—1.05M$0.1022 Jul 2025
221Hunyuan A13B Instruct
Tencent· reasoning
—131K$0.148 Jul 2025
222ERNIE 4.5 VL 424B A47B
Baidu· reasoning
—123K$0.4230 Jun 2025
223MiniMax M1
MiniMax· reasoning
—1M$0.4017 Jun 2025
224Gemini 2.5 Flash
Google· reasoning
—1.05M$0.3017 Jun 2025
225Gemini 2.5 Pro Preview 06-05
Google· reasoning
—1.05M$1.255 Jun 2025
226R1 0528
DeepSeek· reasoning
—164K$0.5028 May 2025
227o4 Mini High
OpenAI· reasoning
—200K$1.1016 Apr 2025
228o1-pro
OpenAI· reasoning
—200K$150.019 Mar 2025
229Reka Flash 3
Reka AI· reasoning
—66K$0.1012 Mar 2025
230Sonar Reasoning Pro
Perplexity· reasoning
—128K$2.007 Mar 2025
231Sonar Deep Research
Perplexity· reasoning
—128K$2.007 Mar 2025
Showing 31 of 231. Benchmark cells are % (best reported setting). 3.8K benchmark results in total.← PrevExport CSV