Skip to content

Newest models

Most recent releases, with whatever independent scores exist so far.

Most recent releases, with whatever independent scores exist so far. Source: OpenRouter / Epoch AI. Variants (reasoning effort, batch) are folded into one row.

#ModelCapabilityReasoningCodingContext$/M
401Gemma 3 12BGoogle123.539.5—131K$0.075
402Gemma 3 4BGoogle116.023.2—131K$0.063
403Gemma 3 1BGoogle—19.9———
404Reka Flash 3Reka AI———66K$0.13
405computer-use-preview-2025-03-11—————
406Skyfall 36B V2TheDrummer———33K$0.61
407Sonar Deep ResearchPerplexity———128K$3.50
408Sonar ProPerplexity———200K$6.00
409Sonar Reasoning ProPerplexity———128K$3.50
410QwQ-32BAlibaba (Qwen)137.665.3———
411GPT-4.5OpenAI136.7————
412GPT-4.5 Preview (Feb 2025)OpenAI—68.7———
413Claude 3.7 SonnetAnthropic · +9 variants141.266.0———
414SabaMistral AI———33K$0.30
415o3 Mini HighOpenAI———200K$1.93
416Gemini 2.0 ProGoogle135.1————
417Gemini 2.0 Flash (Feb 2025)Google134.764.1———
418Gemini 2.0 Flash-LiteGoogle—————
419Gemini 2.0 Pro Exp (Feb 2025)Google—65.7———
420Aion-RP 1.0 (8B)AionLabs———33K$1.00
421Qwen-PlusAlibaba (Qwen)———1M$0.39
422Qwen2.5 VL 72B InstructAlibaba (Qwen)———128K$0.85
423o3 MiniOpenAI · +1 variant140.377.0—200K$1.93
424o3-minimediumOpenAI—74.3———
425Mistral Small 3Mistral AI127.147.3—33K$0.058
426GPT-4o (Jan 2025)OpenAI—————
427SonarPerplexity———127K$1.00
428Qwen2.5-MaxAlibaba (Qwen)132.556.1———
429Qwen Plus (Jan 2025)Alibaba (Qwen)—48.1———
430Gemini 2.0 Flash Thinking (Jan 2025)Google135.4————
431Gemini 2.0 Flash Thinking ExpGoogle—57.1———
432R1DeepSeek139.071.7—64K$1.15
433DeepSeek-R1-Distill-Qwen-32BDeepSeek137.464.1———
434DeepSeek-R1-Distill-Qwen-14BDeepSeek135.444.7———
435DeepSeek-R1-Distill-Llama-70BDeepSeek—55.7———
436DeepSeek-R1-Distill-Qwen-1.5BDeepSeek—33.6———
437MiniMax-01MiniMax———1M$0.42
438CodestralMistral AI—————
439Eurus-2-7B-PRIMETsinghua University,University of Illinois Urbana-Champaign (UIUC),Shanghai AI Lab,Peking University,Shanghai Jiao Tong University,CUHK Shenzhen Research Institute—33.9———
440DeepSeek V3DeepSeek132.456.5—164K$0.45
441Llama 3.3 Euryale 70BSao10K———131K$0.68
442o1OpenAI · +3 variants141.976.8—200K$26.25
443Command R7B (12-2024)Cohere———128K$0.066
444Grok-2 (Dec 2024)xAI130.553.8———
445Phi 4Microsoft130.456.1—16K$0.087
446Gemini 2.0 Flash (Dec 2024)Google134.7————
447Llama 3.3 70BMeta127.347.4———
448Llama 3.3 70B InstructMeta———131K$0.15
449Nova Lite 1.0Amazon———300K$0.10
450Nova Micro 1.0Amazon———128K$0.061
— means no published score from that source yet · click a model for every benchmark with its source
Best AI for coding →
Models ranked on DeepSWE
Best AI for reasoning →
Ranked on GPQA Diamond
Best AI for math →
Ranked on competition math
Best open-weight models →
Weights you can run yourself
Cheapest capable models →
Lowest blended API price
Best AI coding tools →
Apps & agents by popularity
Best AI image generators →
Apps & models
Best AI for research →
Answer engines & deep research