Updated 2h ago
AI Leaderboard - 916 models ranked by capability, price & context
Independent benchmark results from Epoch AI and Artificial Analysis, live API prices and context windows from OpenRouter. Each ranking uses one named measure - we don't blend them into a made-up score.
Ranked by the Epoch Capabilities Index (ECI) - Epoch AI's statistical model over dozens of benchmarks. Source: Epoch AI. Variants (reasoning effort, batch) are folded into one row.
| # | Model | Capability | Reasoning | Coding | Context | $/M | Weights | Released |
|---|---|---|---|---|---|---|---|---|
| 201 | Ministral 3BMistral AI | 118.1 | 25.3 | — | — | — | Closed | 16 Oct 2024 |
| 202 | Yi-34B01.AI | 117.3 | 14.7 | — | — | — | Open | 2 Nov 2023 |
| 203 | phi-3-mini 3.8BMicrosoft | 117.2 | — | — | — | — | Open | 23 Apr 2024 |
| 204 | Gemini 1.0 ProGoogle | 117.0 | 34.0 | — | — | — | Closed | 13 Dec 2023 |
| 205 | Stable Beluga 2Stability AI | 117.0 | — | — | — | — | Open | 20 Jul 2023 |
| 206 | Llama 3.1-8BMeta | 116.5 | 27.0 | — | — | — | Open | 23 Jul 2024 |
| 207 | Llama 3-8BMeta | 116.3 | 26.1 | — | — | — | Open | 18 Apr 2024 |
| 208 | Qwen2.5-Coder-14B | 116.3 | — | — | — | — | Closed | 18 Sep 2024 |
| 209 | Gemma 3 4BGoogle | 116.0 | 23.2 | — | 131K | $0.063 | Open | 12 Mar 2025 |
| 210 | GPT-3.5 Turbo (Jan 2024)OpenAI | 115.6 | 27.2 | — | — | — | Closed | 25 Jan 2024 |
| 211 | PaLM 2-L | 114.8 | — | — | — | — | Closed | 17 May 2023 |
| 212 | Llama 2-70BMeta | 113.6 | 26.3 | — | — | — | Open | 18 Jul 2023 |
| 213 | GPT-3.5 Turbo (Jun 2023)OpenAI | 113.1 | — | — | — | — | Closed | 13 Jun 2023 |
| 214 | Qwen2.5-Coder (7B)Alibaba (Qwen) | 112.9 | — | — | — | — | Open | 18 Sep 2024 |
| 215 | Qwen-14BAlibaba (Qwen) | 112.8 | — | — | — | — | Open | 24 Sep 2023 |
| 216 | Mistral 7B v0.1Mistral AI | 112.0 | — | — | — | — | Open | 27 Sep 2023 |
| 217 | Falcon-180BTechnology Innovation Institute | 111.9 | — | — | — | — | Open | 6 Sep 2023 |
| 218 | internlm-20b | 111.8 | — | — | — | — | Closed | 18 Sep 2023 |
| 219 | Gemma 7BGoogle | 111.7 | — | — | — | — | Open | 21 Feb 2024 |
| 220 | DeepSeek LLM 67BDeepSeek | 110.5 | 24.6 | — | — | — | Open | 29 Nov 2023 |
| 221 | LLaMA-65BMeta | 109.9 | — | — | — | — | Open | 24 Feb 2023 |
| 222 | Falcon 2 11BTechnology Innovation Institute | 109.3 | — | — | — | — | Open | 9 May 2024 |
| 223 | Mistral 7B v0.3Mistral AI | 108.7 | 15.2 | — | — | — | Open | 27 May 2024 |
| 224 | DeepSeek-Coder-V2-Lite-Base | 108.6 | — | — | — | — | Closed | 13 Jun 2024 |
| 225 | PaLM 2-M | 108.0 | — | — | — | — | Closed | 17 May 2023 |
| 226 | Phi-2Microsoft | 107.6 | — | — | — | — | Open | 12 Dec 2023 |
| 227 | Qwen2.5-Coder-3B | 107.4 | — | — | — | — | Closed | 18 Sep 2024 |
| 228 | Nemotron-4 15BNVIDIA | 107.4 | — | — | — | — | Closed | 26 Feb 2024 |
| 229 | Yi-9B | 107.3 | — | — | — | — | Closed | 1 Mar 2024 |
| 230 | LLaMA-33BMeta | 107.1 | — | — | — | — | Open | 24 Feb 2023 |
| 231 | Qwen-7BAlibaba (Qwen) | 106.5 | — | — | — | — | Open | 28 Sep 2023 |
| 232 | Llama 2-13BMeta | 105.8 | — | — | — | — | Open | 18 Jul 2023 |
| 233 | PaLM 2-S | 105.8 | — | — | — | — | Closed | 17 May 2023 |
| 234 | Llama 2-34BMeta | 104.8 | — | — | — | — | Closed | 18 Jul 2023 |
| 235 | StarCoder 2 15BHugging Face | 104.6 | — | — | — | — | Open | 20 Feb 2024 |
| 236 | Yi 6B01.AI | 104.4 | — | — | — | — | Open | 22 Nov 2023 |
| 237 | Falcon-40BTechnology Innovation Institute | 104.0 | — | — | — | — | Open | 25 May 2023 |
| 238 | Baichuan2-13BBaichuan | 102.8 | — | — | — | — | Open | 6 Sep 2023 |
| 239 | Qwen2.5-Coder (1.5B)Alibaba (Qwen) | 102.6 | — | — | — | — | Open | 18 Sep 2024 |
| 240 | internlm-7b | 102.4 | — | — | — | — | Closed | 5 Jul 2023 |
| 241 | Llama 3.2 1BMeta | 102.0 | 23.9 | — | — | — | Open | 24 Sep 2024 |
| 242 | INTELLECT-1Prime Intellect,Hugging Face,Arcee AI | 100.4 | — | — | — | — | Closed | 29 Nov 2024 |
| 243 | MPT-30BMosaicML | 100.2 | — | — | — | — | Open | 22 Jun 2023 |
| 244 | LLaMA-13BMeta | 100.1 | — | — | — | — | Open | 24 Feb 2023 |
| 245 | Llama 2-7BMeta | 98.5 | — | — | — | — | Open | 18 Jul 2023 |
| 246 | chatglm2-6b | 98.4 | — | — | — | — | Closed | 24 Jun 2023 |
| 247 | LLaMA-7BMeta | 96.1 | — | — | — | — | Open | 24 Feb 2023 |
| 248 | Baichuan 2-7BBaichuan | 95.8 | — | — | — | — | Open | 20 Sep 2023 |
| 249 | DeepSeek Coder 33BDeepSeek | 95.7 | — | — | — | — | Open | 2 Nov 2023 |
| 250 | Falcon-7BTechnology Innovation Institute | 94.5 | — | — | — | — | Open | 24 Apr 2023 |
— means no published score from that source yet · click a model for every benchmark with its source
New - awaiting independent evaluation
All new models →- Claude Sonnet 5.5Anthropic · 28 Sep 2026 · AA 56 · 1M · $4.00/M
- Qwen3.8 Max PrimeAlibaba (Qwen) · 23 Sep 2026 · 1M · $6.00/M
- GPT-6 SolOpenAI · 22 Sep 2026 · AA 47.5 · 1.05M · $4.00/M
- GPT-6 LunaOpenAI · 22 Sep 2026 · AA 37.3 · 1.05M · $0.20/M
- GPT-6 Sol ProOpenAI · 22 Sep 2026 · 1.05M · $4.00/M
- GPT-6 Luna ProOpenAI · 22 Sep 2026 · 1.05M · $0.20/M
- Claude Opus 5.5Anthropic · 22 Sep 2026 · AA 57.6 · 1M · $8.00/M
- Grok 4.7xAI · 21 Sep 2026 · AA 46.4 · 500K · $3.00/M
Not ranked until an independent evaluator (Epoch AI) publishes scores. We don't use vendor-reported benchmark claims for rankings.
Best AI for coding →
Models ranked on DeepSWE
Best AI for reasoning →
Ranked on GPQA Diamond
Best AI for math →
Ranked on competition math
Best open-weight models →
Weights you can run yourself
Cheapest capable models →
Lowest blended API price
Best AI coding tools →
Apps & agents by popularity
Best AI image generators →
Apps & models
Best AI for research →
Answer engines & deep research