Updated 2h ago
AI Leaderboard - 916 models ranked by capability, price & context
Independent benchmark results from Epoch AI and Artificial Analysis, live API prices and context windows from OpenRouter. Each ranking uses one named measure - we don't blend them into a made-up score.
Ranked by the Epoch Capabilities Index (ECI) - Epoch AI's statistical model over dozens of benchmarks. Source: Epoch AI. Variants (reasoning effort, batch) are folded into one row.
| # | Model | Capability | Reasoning | Coding | Context | $/M | Weights | Released |
|---|---|---|---|---|---|---|---|---|
| 151 | Phi 4Microsoft | 130.4 | 56.1 | — | 16K | $0.087 | Open | 12 Dec 2024 |
| 152 | Gemma 3 27BGoogle | 130.0 | 47.7 | — | 131K | $0.17 | Open | 12 Mar 2025 |
| 153 | Claude 3.5 SonnetAnthropic | 130.0 | — | — | — | — | Closed | 20 Jun 2024 |
| 154 | Llama 4 ScoutMeta | 129.6 | 51.8 | — | 1.31M | $0.15 | Open | 5 Apr 2025 |
| 155 | GPT-4.1 NanoOpenAI | 129.6 | 48.9 | — | 1.05M | $0.17 | Closed | 14 Apr 2025 |
| 156 | Gemini 1.5 Flash (Sep 2024)Google | 129.4 | 47.3 | — | — | — | Closed | 24 Sep 2024 |
| 157 | Qwen2.5-72BAlibaba (Qwen) | 129.0 | 49.1 | — | — | — | Open | 19 Sep 2024 |
| 158 | GPT-4o (May 2024)OpenAI | 129.0 | 48.9 | — | — | — | Closed | 13 May 2024 |
| 159 | GPT-4o (Nov 2024)OpenAI | 128.8 | 47.9 | — | — | — | Closed | 20 Nov 2024 |
| 160 | GPT-4o (Aug 2024)OpenAI | 128.8 | 49.2 | — | — | — | Closed | 6 Aug 2024 |
| 161 | Llama 3.1-405BMeta | 128.8 | 50.9 | — | — | — | Open | 23 Jul 2024 |
| 162 | Mistral Large 2 (Nov 2024)Mistral AI | 128.5 | 51.3 | — | — | — | Open | 18 Nov 2024 |
| 163 | Qwen2.5-32BAlibaba (Qwen) | 128.5 | 46.1 | — | — | — | Open | 17 Sep 2024 |
| 164 | Mistral Large 2 (Jul 2024)Mistral AI | 127.5 | 49.0 | — | — | — | Open | 24 Jul 2024 |
| 165 | Mistral Small 3.1Mistral AI | 127.5 | 47.5 | — | — | — | Open | 17 Mar 2025 |
| 166 | Llama 3.3 70BMeta | 127.3 | 47.4 | — | — | — | Open | 6 Dec 2024 |
| 167 | GPT-4 Turbo (Apr 2024)OpenAI | 127.3 | 46.6 | — | — | — | Closed | 9 Apr 2024 |
| 168 | Claude 3.5 HaikuAnthropic | 127.2 | — | — | — | — | Closed | 22 Oct 2024 |
| 169 | Mistral Small 3Mistral AI | 127.1 | 47.3 | — | 33K | $0.058 | Open | 30 Jan 2025 |
| 170 | Claude 3 OpusAnthropic | 126.9 | 47.2 | — | — | — | Closed | 29 Feb 2024 |
| 171 | Gemini 1.5 Pro (May 2024)Google | 126.9 | 45.9 | — | — | — | Closed | 14 May 2024 |
| 172 | GPT-4o-miniOpenAI | 126.6 | 37.7 | — | 128K | $0.26 | Closed | 18 Jul 2024 |
| 173 | GPT-4 Turbo (Nov 2023)OpenAI | 126.5 | — | — | — | — | Closed | 25 Jan 2024 |
| 174 | Llama 3.1-70BMeta | 125.9 | 44.2 | — | — | — | Open | 23 Jul 2024 |
| 175 | GPT-4 (Mar 2023)OpenAI | 125.9 | 35.7 | — | — | — | Closed | 14 Mar 2023 |
| 176 | Llama 3.2 90BMeta | 125.5 | 41.0 | — | — | — | Open | 24 Sep 2024 |
| 177 | Qwen2-72BAlibaba (Qwen) | 125.3 | 40.8 | — | — | — | Open | 7 Jun 2024 |
| 178 | DeepSeek-V2 (MoE-236B, May 2024)DeepSeek | 124.8 | — | — | — | — | Open | 7 May 2024 |
| 179 | Amazon Nova ProAmazon | 123.8 | — | — | — | — | Closed | 3 Dec 2024 |
| 180 | Gemma 3 12BGoogle | 123.5 | 39.5 | — | 131K | $0.075 | Open | 12 Mar 2025 |
| 181 | GPT-4 (Jun 2023)OpenAI | 123.1 | 30.7 | — | — | — | Closed | 13 Jun 2023 |
| 182 | Llama 3-70BMeta | 122.9 | 40.6 | — | — | — | Open | 18 Apr 2024 |
| 183 | Gemini 1.5 Flash (May 2024)Google | 122.6 | 40.4 | — | — | — | Closed | 23 May 2024 |
| 184 | Gemma 2 27BGoogle | 122.1 | 36.5 | — | 8K | $0.65 | Open | 24 Jun 2024 |
| 185 | Mistral LargeMistral AI | 122.0 | 38.8 | — | 128K | $3.00 | Closed | 26 Feb 2024 |
| 186 | Mixtral 8x22BMistral AI | 122.0 | 34.1 | — | — | — | Open | 17 Apr 2024 |
| 187 | phi-3-small 7.4BMicrosoft | 121.8 | — | — | — | — | Open | 23 Apr 2024 |
| 188 | phi-3-medium 14BMicrosoft | 121.2 | 27.6 | — | — | — | Open | 23 Apr 2024 |
| 189 | Claude 3 SonnetAnthropic | 120.7 | 40.6 | — | — | — | Closed | 29 Feb 2024 |
| 190 | Claude InstantAnthropic | 120.2 | — | — | — | — | Closed | 9 Aug 2023 |
| 191 | Claude 2Anthropic | 120.1 | 34.7 | — | — | — | Closed | 11 Jul 2023 |
| 192 | Gemma 2 9BGoogle | 119.8 | 27.5 | — | — | — | Open | 24 Jun 2024 |
| 193 | Qwen2.5-Coder-32BAlibaba (Qwen) | 119.4 | — | — | — | — | Open | 18 Sep 2024 |
| 194 | Command R+Cohere | 119.3 | — | — | — | — | Open | 30 Aug 2024 |
| 195 | Claude 2.1Anthropic | 119.2 | 33.0 | — | — | — | Closed | 21 Nov 2023 |
| 196 | Mistral NemoMistral AI | 118.6 | 29.9 | — | 131K | $0.022 | Open | 18 Jul 2024 |
| 197 | GPT-3.5 Turbo (Nov 2023)OpenAI | 118.5 | 28.0 | — | — | — | Closed | 6 Nov 2023 |
| 198 | Qwen2.5-7BAlibaba (Qwen) | 118.4 | 35.5 | — | — | — | Open | 19 Sep 2024 |
| 199 | Mixtral 8x7BMistral AI | 118.4 | 30.6 | — | — | — | Open | 11 Dec 2023 |
| 200 | Claude 3 HaikuAnthropic | 118.3 | 36.3 | — | — | — | Closed | 7 Mar 2024 |
— means no published score from that source yet · click a model for every benchmark with its source
New - awaiting independent evaluation
All new models →- Claude Sonnet 5.5Anthropic · 28 Sep 2026 · AA 56 · 1M · $4.00/M
- Qwen3.8 Max PrimeAlibaba (Qwen) · 23 Sep 2026 · 1M · $6.00/M
- GPT-6 SolOpenAI · 22 Sep 2026 · AA 47.5 · 1.05M · $4.00/M
- GPT-6 LunaOpenAI · 22 Sep 2026 · AA 37.3 · 1.05M · $0.20/M
- GPT-6 Sol ProOpenAI · 22 Sep 2026 · 1.05M · $4.00/M
- GPT-6 Luna ProOpenAI · 22 Sep 2026 · 1.05M · $0.20/M
- Claude Opus 5.5Anthropic · 22 Sep 2026 · AA 57.6 · 1M · $8.00/M
- Grok 4.7xAI · 21 Sep 2026 · AA 46.4 · 500K · $3.00/M
Not ranked until an independent evaluator (Epoch AI) publishes scores. We don't use vendor-reported benchmark claims for rankings.
Best AI for coding →
Models ranked on DeepSWE
Best AI for reasoning →
Ranked on GPQA Diamond
Best AI for math →
Ranked on competition math
Best open-weight models →
Weights you can run yourself
Cheapest capable models →
Lowest blended API price
Best AI coding tools →
Apps & agents by popularity
Best AI image generators →
Apps & models
Best AI for research →
Answer engines & deep research