Skip to content

Newest models

Most recent releases, with whatever independent scores exist so far.

Most recent releases, with whatever independent scores exist so far. Source: OpenRouter / Epoch AI. Variants (reasoning effort, batch) are folded into one row.

#ModelCapabilityReasoningCodingContext$/M
351Magistral Small 1.0Mistral AI133.256.1———
352Magistral Medium 1.1Mistral AI—————
353Gemini 2.5 Pro (Jun 2025)Google145.385.3———
354Gemini 2.5 Pro Preview (Jun 2025)Google—84.8———
355Gemini 2.5 Pro Preview 06-05Google———1.05M$3.44
356DeepSeek-R1 (May 2025)DeepSeek141.376.3———
357deepseek-r1-0528-qwen3-8b—9.3———
358R1 0528DeepSeek———164K$0.91
359Claude Opus 4Anthropic142.776.3———
360Claude Sonnet 4Anthropic · +1 variant141.779.2—200K$6.00
361Gemini 2.5 Flash (May 2025)Google141.5————
362codex-mini-2025-05-16—————
363Mistral Medium 3Mistral AI134.159.5—131K$0.80
364Gemini 2.5 Pro (May 2025)Google142.5————
365Llama Guard 4 12BMeta———164K$0.18
366Qwen3 32BAlibaba (Qwen)138.565.7—131K$0.13
367Qwen3 14BAlibaba (Qwen)138.263.8—131K$0.15
368Qwen3 30B A3BAlibaba (Qwen)136.261.7—131K$0.23
369Qwen3-1.7BAlibaba (Qwen)—38.0———
370Qwen3-4BAlibaba (Qwen)—52.3———
371Qwen3 235B A22BAlibaba (Qwen)139.470.7—131K$0.80
372Qwen3 8BAlibaba (Qwen)136.256.8—131K$0.20
373Qwen Plus (Apr 2025)Alibaba (Qwen)—————
374Gemini 2.5 Flash (Apr 2025)Google140.0————
375Gemini 2.5 Flash Preview (Apr 2025)Google—————
376o3OpenAI · +4 variants146.981.8—200K$3.50
377o4 MiniOpenAI · +1 variant145.679.6—200K$1.93
378o4 Mini HighOpenAI———200K$1.93
379o4-minimediumOpenAI · +1 variant—77.8———
380GPT-4.1OpenAI · +1 variant136.866.9—1.05M$3.50
381GPT-4.1 MiniOpenAI · +1 variant135.065.8—1.05M$0.70
382GPT-4.1 NanoOpenAI · +1 variant129.648.9—1.05M$0.17
383Grok 3xAI138.375.8———
384QWQ-PlusAlibaba (Qwen)—65.4———
385Llama 4 MaverickMeta132.2——1.05M$0.30
386Llama 4 ScoutMeta129.651.8—1.31M$0.15
387Llama 4 Maverick (FP8)Meta—67.0———
388Gemini 2.5 Pro (Mar 2025)Google144.2————
389Gemini 2.5 Pro Preview (Mar 2025)Google—————
390GPT-4o (Mar 2025)OpenAI—————
391Gemini 2.5 Pro Exp (Mar 2025)Google—83.8———
392DeepSeek-V3 (Mar 2025)DeepSeek135.967.6———
393DeepSeek V3 0324DeepSeek———164K$0.50
394o1 ProlowOpenAI—————
395o1-proOpenAI———200K$262.50
396Mistral Small 3.1Mistral AI127.547.5———
397Mistral Small 3.1 24BMistral AI———128K$0.40
398Cohere Command ACohere—————
399Command ACohere———256K$4.38
400Gemma 3 27BGoogle130.047.7—131K$0.17
— means no published score from that source yet · click a model for every benchmark with its source
Best AI for coding →
Models ranked on DeepSWE
Best AI for reasoning →
Ranked on GPQA Diamond
Best AI for math →
Ranked on competition math
Best open-weight models →
Weights you can run yourself
Cheapest capable models →
Lowest blended API price
Best AI coding tools →
Apps & agents by popularity
Best AI image generators →
Apps & models
Best AI for research →
Answer engines & deep research