Skip to content
Model intelligence

678 AI models

Capability (Epoch Capabilities Index and individual benchmarks from Epoch AI), API list prices and context windows (OpenRouter), release dates and open-weight status. Benchmarks are shown individually - never merged into one invented score.
Leads on ECI
GPT-6 Astra
ECI 166.6Epoch AI
Leads on GPQA Diamond
GPT-6 Astra
95.8%Epoch AI
Leads on SWE-bench Verified
Claude Opus 4.7
83.5%Epoch AI
Cheapest in ECI top 10
GPT-5.6 Sol
$2.00/M inputOpenRouter
Longest context
Grok 4.20 Multi-Agent
2M tokensOpenRouter
Best open-weight on ECI
Kimi K3
ECI 157.68Epoch AI
Epoch Capabilities Index by release date

Capability frontier

Source: Epoch AI (CC BY 4.0). ECI is Epoch's item-response model over many benchmarks; each model page shows its 90% confidence interval.

Blended $/1M tokens (3:1 input:output) vs ECI

Price vs capability

Only models with both an ECI score and an OpenRouter price. Normalisation: 75% input + 25% output price. Click a point to open the model.

#ModelECI ↓ContextIn $/MReleased
201Ministral 3B118.1——16 Oct 2024
202Yi-34B
01.AI
117.3——2 Nov 2023
203phi-3-mini 3.8B117.2——23 Apr 2024
204Gemini 1.0 Pro117.0——13 Dec 2023
205Stable Beluga 2117.0——20 Jul 2023
206Llama 3.1-8B116.5——23 Jul 2024
207Llama 3-8B116.3——18 Apr 2024
208Qwen2.5-Coder-14B
116.3——18 Sep 2024
209Gemma 3 4B116.0131K$0.05012 Mar 2025
210GPT-3.5 Turbo (Jan 2024)115.6——25 Jan 2024
211PaLM 2-L
114.8——17 May 2023
212Llama 2-70B113.6——18 Jul 2023
213GPT-3.5 Turbo (Jun 2023)113.1——13 Jun 2023
214Qwen2.5-Coder (7B)112.9——18 Sep 2024
215Qwen-14B112.8——24 Sep 2023
216Mistral 7B v0.1112.0——27 Sep 2023
217Falcon-180B111.9——6 Sep 2023
218internlm-20b
111.8——18 Sep 2023
219Gemma 7B111.7——21 Feb 2024
220DeepSeek LLM 67B110.5——29 Nov 2023
221LLaMA-65B109.9——24 Feb 2023
222Falcon 2 11B109.3——9 May 2024
223Mistral 7B v0.3108.7——27 May 2024
224DeepSeek-Coder-V2-Lite-Base
108.6——13 Jun 2024
225PaLM 2-M
108.0——17 May 2023
226Phi-2107.6——12 Dec 2023
227Qwen2.5-Coder-3B
107.4——18 Sep 2024
228Nemotron-4 15B107.4——26 Feb 2024
229Yi-9B
107.3——1 Mar 2024
230LLaMA-33B107.1——24 Feb 2023
231Qwen-7B106.5——28 Sep 2023
232Llama 2-13B105.8——18 Jul 2023
233PaLM 2-S
105.8——17 May 2023
234Llama 2-34B104.8——18 Jul 2023
235StarCoder 2 15B104.6——20 Feb 2024
236Yi 6B
01.AI
104.4——22 Nov 2023
237Falcon-40B104.0——25 May 2023
238Baichuan2-13B
Baichuan
102.8——6 Sep 2023
239Qwen2.5-Coder (1.5B)102.6——18 Sep 2024
240internlm-7b
102.4——5 Jul 2023
241Llama 3.2 1B102.0——24 Sep 2024
242INTELLECT-1
Prime Intellect,Hugging Face,Arcee AI
100.4——29 Nov 2024
243MPT-30B
MosaicML
100.2——22 Jun 2023
244LLaMA-13B100.1——24 Feb 2023
245Llama 2-7B98.5——18 Jul 2023
246chatglm2-6b
98.4——24 Jun 2023
247LLaMA-7B96.1——24 Feb 2023
248Baichuan 2-7B
Baichuan
95.8——20 Sep 2023
249DeepSeek Coder 33B95.7——2 Nov 2023
250Falcon-7B94.5——24 Apr 2023
251CodeQwen1.5-7B
94.2——15 Apr 2024
252vicuna-13b-v1.1
94.0——12 Apr 2023
253MPT-7B
MosaicML
94.0——5 May 2023
254Gemma 2B93.6——21 Feb 2024
255StarCoder 2 7B92.9——20 Feb 2024
256XGen-7B
Salesforce
92.8——27 Jun 2023
257Qwen-1_8B
92.3——30 Nov 2023
258open_llama_7b
91.0——7 Jun 2023
259Phi-1.590.8——11 Sep 2023
260Baichuan1-7B
Baichuan
89.8——1 Jun 2023
261RedPajama-INCITE-7B-Base
89.7——4 May 2023
262Dolly 2.0-12b
Databricks
88.9——11 Apr 2023
263DeepSeek Coder 6.7B88.9——2 Nov 2023
264StarCoder 2 3B88.0——22 Feb 2024
265Qwen2.5-Coder-0.5B
87.4——18 Sep 2024
266Cerebras-GPT-13B82.4——20 Mar 2023
267DeepSeek Coder 1.3B62.2——2 Nov 2023
268stablelm-tuned-alpha-7b
54.3——19 Apr 2023
269Claude Opus 5.5
Anthropic· reasoning
—1M$4.0022 Sep 2026
270Claude Sonnet 5.5
Anthropic· reasoning
—1M$2.0028 Sep 2026
271GPT-6.1 Sol
OpenAI· reasoning
—1.05M$2.0029 Sep 2026
272GPT-6 Sol
OpenAI· reasoning
—1.05M$2.0022 Sep 2026
273Grok 4.7
xAI· reasoning
—500K$2.0021 Sep 2026
274MiMo-V2.6-Pro
Xiaomi· reasoning
—1.05M$0.4321 Sep 2026
275Qwen3.8 2.4T A95B
Alibaba (Qwen)· reasoning
—1.05M$2.0012 Aug 2026
276MiMo-V2.6-Flash
Xiaomi· reasoning
—1.05M$0.1421 Sep 2026
277GPT-6 Luna
OpenAI· reasoning
—1.05M$0.1022 Sep 2026
278Qwen3.8 27B
Alibaba (Qwen)· reasoning
—1M$0.4214 Aug 2026
279Gemini 3.1 Pro Preview
Google· reasoning
—1.05M$2.0019 Feb 2026
280MiMo-V2.5-Pro
Xiaomi· reasoning
—1.05M$0.4322 Apr 2026
281Hy3 preview
Tencent· reasoning
—262K$0.1822 Apr 2026
282Grok 4.3
xAI· reasoning
—1M$1.2530 Apr 2026
283Ling 3.0 Flash VL—262K$0.02110 Sep 2026
284Ling 3.0 Flash Fin—262K$0.06027 Aug 2026
285Ling 3.0 Flash—262K$0.02123 Jul 2026
286LongCat 2.0
Meituan· reasoning
—1.05M$0.3020 Jul 2026
287Qwen3.6 35B A3B
Alibaba (Qwen)· reasoning
—262K$0.1527 Apr 2026
288Gemini 2.5 Pro
Google· reasoning
—1.05M$1.2517 Jun 2025
289Gemini 3.1 Flash Lite Preview
Google· reasoning
—1.05M$0.253 Mar 2026
290Qwen3.5-122B-A10B
Alibaba (Qwen)· reasoning
—262K$0.2625 Feb 2026
291DeepSeek V3.1 Terminus
DeepSeek· reasoning
—164K$0.3022 Sep 2025
292Command A—256K$2.5013 Mar 2025
293Nemotron 3.5 Lightning
NVIDIA· reasoning
—262K$0.06011 Aug 2026
294Nemotron 3 Super
NVIDIA· reasoning
—262K$0.08011 Mar 2026
295Qwen3 235B A22B Thinking 2507
Alibaba (Qwen)· reasoning
—131K$0.2325 Jul 2025
296Mercury 2.5
Inception Labs· reasoning
—260K$0.0408 Sep 2026
297Mistral Small 4
Mistral AI· reasoning
—262K$0.1516 Mar 2026
298Granite 4.2 8B
IBM· reasoning
—131K$0.06031 Aug 2026
299o3 Mini High
OpenAI· reasoning
—200K$1.1012 Feb 2025
300Trinity Large Thinking
Arcee AI· reasoning
—262K$0.251 Apr 2026
Showing 100 of 678. Benchmark cells are % (best reported setting). 3.8K benchmark results in total.← PrevNext →Export CSV