Best for math
Ranked by Epoch's mock AIME 2024-2025 (competition mathematics).
Ranked by Epoch's mock AIME 2024-2025 (competition mathematics). Source: Epoch AI. Variants (reasoning effort, batch) are folded into one row.
| # | Model | Capability | Reasoning | Coding | Context | $/M | Weights | Released |
|---|---|---|---|---|---|---|---|---|
| 1 | DeepSeek V4 Pro 0813DeepSeek | 155.4 | 91.7 | — | 1.05M | $1.41 | Open | 13 Aug 2026 |
| 2 | Kimi K3Moonshot AI · +1 variant | 157.7 | 93.1 | 68.5 | 1.05M | $6.00 | Open | 16 Jul 2026 |
| 3 | DeepSeek v4 ProhighDeepSeek · +1 variant | — | 90.9 | — | — | — | Open | 24 Apr 2026 |
| 4 | Kimi K2.6Moonshot AI | 151.0 | 90.8 | — | 262K | $1.34 | Open | 20 Apr 2026 |
| 5 | Kimi K2.7 CodeMoonshot AI | 150.0 | 87.9 | 30.5 | 262K | $1.32 | Open | 12 Jun 2026 |
| 6 | DeepSeek V4 Flash 0731DeepSeek | 154.5 | 91.0 | — | 1.31M | $0.093 | Open | 31 Jul 2026 |
| 7 | GLM 5.3 FlashZ.ai (Zhipu AI) | 151.9 | 90.2 | 63.4 | 1.31M | $0.24 | Open | 20 Aug 2026 |
| 8 | GLM 5.1Z.ai (Zhipu AI) | 149.9 | 89.9 | — | 205K | $2.15 | Open | 7 Apr 2026 |
| 9 | Kimi K2.5 (Fireworks)Moonshot AI | — | 87.6 | — | — | — | Open | 27 Jan 2026 |
| 10 | GLM 5.3Z.ai (Zhipu AI) | 155.6 | 90.9 | 69.0 | 1.31M | $2.15 | Open | 14 Aug 2026 |
| 11 | Qwen3.6 27BAlibaba (Qwen) | 146.5 | 85.9 | — | 262K | $1.04 | Open | 22 Apr 2026 |
| 12 | Inkling SmallxhighThinking Machines Lab | — | 88.5 | — | — | — | Open | 15 Jul 2026 |
| 13 | Qwen3.5 397B A17BAlibaba (Qwen) | 146.6 | 86.4 | — | 262K | $1.29 | Open | 13 Feb 2026 |
| 14 | gpt-oss-120bOpenAI | 139.9 | 75.8 | — | 131K | $0.070 | Open | 5 Aug 2025 |
| 15 | InklingxhighThinking Machines Lab | — | 88.3 | — | — | — | Open | 15 Jul 2026 |
| 16 | DeepSeek V3.2DeepSeek | 146.3 | 83.4 | — | 164K | $0.32 | Open | 1 Dec 2025 |
| 17 | Nemotron 3 UltraNVIDIA | 146.2 | 85.4 | — | 262K | $1.05 | Open | 4 Jun 2026 |
| 18 | Qwen3-235B-A22B-Thinking (Jul 2025)Alibaba (Qwen) | 143.9 | 80.1 | — | — | — | Open | 25 Jul 2025 |
| 19 | Qwen3.6 35B A3BAlibaba (Qwen) | — | 84.8 | — | 262K | $0.36 | Open | 27 Apr 2026 |
| 20 | GLM 5.2Z.ai (Zhipu AI) | 151.8 | 91.9 | 43.8 | 1.05M | $1.39 | Open | 16 Jun 2026 |
| 21 | GLM 4.7Z.ai (Zhipu AI) | 143.5 | 83.3 | — | 205K | $1.00 | Open | 22 Dec 2025 |
| 22 | Kimi K2 Thinking TurboMoonshot AI | — | 84.2 | — | — | — | Open | 6 Nov 2025 |
| 23 | Gemma 4 26B A4BGoogle | 141.8 | 73.2 | — | 262K | $0.14 | Open | 2 Apr 2026 |
| 24 | GLM 5Z.ai (Zhipu AI) | 145.8 | 87.8 | — | 205K | $0.93 | Open | 11 Feb 2026 |
| 25 | Gemma 4 31BGoogle | 142.7 | 75.8 | — | 262K | $0.15 | Open | 2 Apr 2026 |
| 26 | MiniMax M3MiniMax | 147.0 | 90.9 | — | 1.05M | $0.53 | Open | 1 Jun 2026 |
| 27 | Qwen3-30B-A3B-Thinking (Jul 2025)Alibaba (Qwen) | 139.6 | 70.1 | — | — | — | Open | 30 Jul 2025 |
| 28 | Qwen3.5-35B-A3BAlibaba (Qwen) | 142.5 | 83.5 | — | 262K | $0.45 | Open | 24 Feb 2026 |
| 29 | Qwen3 32BAlibaba (Qwen) | 138.5 | 65.7 | — | 131K | $0.13 | Open | 29 Apr 2025 |
| 30 | DeepSeek-R1 (May 2025)DeepSeek | 141.3 | 76.3 | — | — | — | Open | 28 May 2025 |
| 31 | Qwen3 14BAlibaba (Qwen) | 138.2 | 63.8 | — | 131K | $0.15 | Open | 29 Apr 2025 |
| 32 | gpt-oss-20bOpenAI | 137.8 | 60.8 | — | 131K | $0.036 | Open | 5 Aug 2025 |
| 33 | Qwen3 30B A3BAlibaba (Qwen) | 136.2 | 61.7 | — | 131K | $0.23 | Open | 29 Apr 2025 |
| 34 | Qwen3-30B-A3B-Instruct (Jul 2025)Alibaba (Qwen) | 137.4 | 55.6 | — | — | — | Open | 29 Jul 2025 |
| 35 | Qwen3.5-9BAlibaba (Qwen) | 139.4 | 79.0 | — | 262K | $0.11 | Open | 24 Feb 2026 |
| 36 | QwQ-32BAlibaba (Qwen) | 137.6 | 65.3 | — | — | — | Open | 5 Mar 2025 |
| 37 | GLM 4.7 FlashZ.ai (Zhipu AI) | — | 60.5 | — | 200K | $0.15 | Open | 19 Jan 2026 |
| 38 | Qwen3 8BAlibaba (Qwen) | 136.2 | 56.8 | — | 131K | $0.20 | Open | 28 Apr 2025 |
| 39 | Qwen3.5-4BAlibaba (Qwen) | — | — | — | — | — | Open | 24 Feb 2026 |
| 40 | DeepSeek-R1-Distill-Qwen-32BDeepSeek | 137.4 | 64.1 | — | — | — | Open | 20 Jan 2025 |
| 41 | R1DeepSeek | 139.0 | 71.7 | — | 64K | $1.15 | Open | 20 Jan 2025 |
| 42 | DeepSeek-R1-Distill-Llama-70BDeepSeek | — | 55.7 | — | — | — | Open | 20 Jan 2025 |
| 43 | DeepSeek-R1-Distill-Qwen-14BDeepSeek | 135.4 | 44.7 | — | — | — | Open | 20 Jan 2025 |
| 44 | DeepSeek-V3 (Mar 2025)DeepSeek | 135.9 | 67.6 | — | — | — | Open | 24 Mar 2025 |
| 45 | Mistral Small 3.2Mistral AI | 131.7 | 49.1 | — | — | — | Open | 20 Jun 2025 |
| 46 | Magistral Small 1.0Mistral AI | 133.2 | 56.1 | — | — | — | Open | 10 Jun 2025 |
| 47 | Magistral Small 1.2Mistral AI | 131.4 | 47.6 | — | — | — | Open | 18 Sep 2025 |
| 48 | Gemma 3 27BGoogle | 130.0 | 47.7 | — | 131K | $0.17 | Open | 12 Mar 2025 |
| 49 | DeepSeek-R1-Distill-Qwen-1.5BDeepSeek | — | 33.6 | — | — | — | Open | 20 Jan 2025 |
| 50 | Llama 4 Maverick (FP8)Meta | — | 67.0 | — | — | — | Open | 5 Apr 2025 |
— means no published score from that source yet · click a model for every benchmark with its source
New - awaiting independent evaluation
All new models →- Claude Sonnet 5.5Anthropic · 28 Sep 2026 · AA 56 · 1M · $4.00/M
- Qwen3.8 Max PrimeAlibaba (Qwen) · 23 Sep 2026 · 1M · $6.00/M
- GPT-6 SolOpenAI · 22 Sep 2026 · AA 47.5 · 1.05M · $4.00/M
- GPT-6 LunaOpenAI · 22 Sep 2026 · AA 37.3 · 1.05M · $0.20/M
- GPT-6 Sol ProOpenAI · 22 Sep 2026 · 1.05M · $4.00/M
- GPT-6 Luna ProOpenAI · 22 Sep 2026 · 1.05M · $0.20/M
- Claude Opus 5.5Anthropic · 22 Sep 2026 · AA 57.6 · 1M · $8.00/M
- Grok 4.7xAI · 21 Sep 2026 · AA 46.4 · 500K · $3.00/M
Not ranked until an independent evaluator (Epoch AI) publishes scores. We don't use vendor-reported benchmark claims for rankings.
Best AI for coding →
Models ranked on DeepSWE
Best AI for reasoning →
Ranked on GPQA Diamond
Best AI for math →
Ranked on competition math
Best open-weight models →
Weights you can run yourself
Cheapest capable models →
Lowest blended API price
Best AI coding tools →
Apps & agents by popularity
Best AI image generators →
Apps & models
Best AI for research →
Answer engines & deep research