Skip to content

Newest models

Most recent releases, with whatever independent scores exist so far.

Most recent releases, with whatever independent scores exist so far. Source: OpenRouter / Epoch AI. Variants (reasoning effort, batch) are folded into one row.

#ModelCapabilityReasoningCodingContext$/M
401Gemma 3 1BGoogle—19.9———
402Reka Flash 3Reka AI———66K$0.13
403computer-use-preview-2025-03-11—————
404Skyfall 36B V2TheDrummer———33K$0.61
405Sonar Deep ResearchPerplexity———128K$3.50
406Sonar ProPerplexity———200K$6.00
407Sonar Reasoning ProPerplexity———128K$3.50
408QwQ-32BAlibaba (Qwen)137.665.3———
409GPT-4.5OpenAI136.7————
410GPT-4.5 Preview (Feb 2025)OpenAI—68.7———
411Claude 3.7 SonnetAnthropic · +9 variants141.266.0———
412SabaMistral AI———33K$0.30
413o3 Mini HighOpenAI———200K$1.93
414Gemini 2.0 ProGoogle135.1————
415Gemini 2.0 Flash (Feb 2025)Google134.764.1———
416Gemini 2.0 Flash-LiteGoogle—————
417Gemini 2.0 Pro Exp (Feb 2025)Google—65.7———
418Aion-RP 1.0 (8B)AionLabs———33K$1.00
419Qwen-PlusAlibaba (Qwen)———1M$0.39
420Qwen2.5 VL 72B InstructAlibaba (Qwen)———128K$0.85
421o3 MiniOpenAI · +1 variant140.377.0—200K$1.93
422o3-minimediumOpenAI—74.3———
423Mistral Small 3Mistral AI127.147.3—33K$0.058
424GPT-4o (Jan 2025)OpenAI—————
425SonarPerplexity———127K$1.00
426Qwen2.5-MaxAlibaba (Qwen)132.556.1———
427Qwen Plus (Jan 2025)Alibaba (Qwen)—48.1———
428Gemini 2.0 Flash Thinking (Jan 2025)Google135.4————
429Gemini 2.0 Flash Thinking ExpGoogle—57.1———
430R1DeepSeek139.071.7—64K$1.15
431DeepSeek-R1-Distill-Qwen-32BDeepSeek137.464.1———
432DeepSeek-R1-Distill-Qwen-14BDeepSeek135.444.7———
433DeepSeek-R1-Distill-Llama-70BDeepSeek—55.7———
434DeepSeek-R1-Distill-Qwen-1.5BDeepSeek—33.6———
435MiniMax-01MiniMax———1M$0.42
436CodestralMistral AI—————
437Eurus-2-7B-PRIMETsinghua University,University of Illinois Urbana-Champaign (UIUC),Shanghai AI Lab,Peking University,Shanghai Jiao Tong University,CUHK Shenzhen Research Institute—33.9———
438DeepSeek V3DeepSeek132.456.5—164K$0.45
439Llama 3.3 Euryale 70BSao10K———131K$0.68
440o1OpenAI · +3 variants141.976.8—200K$26.25
441Command R7B (12-2024)Cohere———128K$0.066
442Grok-2 (Dec 2024)xAI130.553.8———
443Phi 4Microsoft130.456.1—16K$0.087
444Gemini 2.0 Flash (Dec 2024)Google134.7————
445Llama 3.3 70BMeta127.347.4———
446Llama 3.3 70B InstructMeta———131K$0.15
447Nova Lite 1.0Amazon———300K$0.10
448Nova Micro 1.0Amazon———128K$0.061
449Nova Pro 1.0Amazon———300K$1.40
450Amazon Nova ProAmazon123.8————
— means no published score from that source yet · click a model for every benchmark with its source
Best AI for coding →
Models ranked on DeepSWE
Best AI for reasoning →
Ranked on GPQA Diamond
Best AI for math →
Ranked on competition math
Best open-weight models →
Weights you can run yourself
Cheapest capable models →
Lowest blended API price
Best AI coding tools →
Apps & agents by popularity
Best AI image generators →
Apps & models
Best AI for research →
Answer engines & deep research