Model intelligence
34 AI models
Capability (Epoch Capabilities Index and individual benchmarks from Epoch AI), API list prices and context windows (OpenRouter), release dates and open-weight status. Benchmarks are shown individually - never merged into one invented score.
Epoch Capabilities Index by release date
Capability frontier
Source: Epoch AI (CC BY 4.0). ECI is Epoch's item-response model over many benchmarks; each model page shows its 90% confidence interval.
Blended $/1M tokens (3:1 input:output) vs ECI
Price vs capability
Only models with both an ECI score and an OpenRouter price. Normalisation: 75% input + 25% output price. Click a point to open the model.
| # | Model | ECI ↑ | Context | In $/M | Weights | Released |
|---|---|---|---|---|---|---|
| 1 | LLaMA-7B | 96.1 | — | — | Open source | 24 Feb 2023 |
| 2 | Llama 2-7B | 98.5 | — | — | Open source | 18 Jul 2023 |
| 3 | LLaMA-13B | 100.1 | — | — | Open source | 24 Feb 2023 |
| 4 | Llama 3.2 1B | 102.0 | — | — | Open source | 24 Sep 2024 |
| 5 | Llama 2-34B | 104.8 | — | — | Closed | 18 Jul 2023 |
| 6 | Llama 2-13B | 105.8 | — | — | Open source | 18 Jul 2023 |
| 7 | LLaMA-33B | 107.1 | — | — | Open source | 24 Feb 2023 |
| 8 | LLaMA-65B | 109.9 | — | — | Open source | 24 Feb 2023 |
| 9 | Llama 2-70B | 113.6 | — | — | Open source | 18 Jul 2023 |
| 10 | Llama 3-8B | 116.3 | — | — | Open source | 18 Apr 2024 |
| 11 | Llama 3.1-8B | 116.5 | — | — | Open source | 23 Jul 2024 |
| 12 | Llama 3-70B | 122.9 | — | — | Open source | 18 Apr 2024 |
| 13 | Llama 3.2 90B | 125.5 | — | — | Open source | 24 Sep 2024 |
| 14 | Llama 3.1-70B | 125.9 | — | — | Open source | 23 Jul 2024 |
| 15 | Llama 3.3 70B | 127.3 | — | — | Open source | 6 Dec 2024 |
| 16 | Llama 3.1-405B | 128.8 | — | — | Open source | 23 Jul 2024 |
| 17 | Llama 4 Scout | 129.6 | 1.31M | $0.10 | Open source | 5 Apr 2025 |
| 18 | Llama 4 Maverick | 132.2 | 1.05M | $0.19 | Open source | 6 Apr 2025 |
| 19 | Muse Spark | 152.1 | — | — | Closed | 8 Apr 2026 |
| 20 | Muse Spark 1.1 Meta· reasoning | 154.3 | 1.05M | $1.25 | Closed | 9 Jul 2026 |
| 21 | Muse Spark 1.2 Meta· reasoning | 155.2 | 1.05M | $1.25 | Closed | 5 Aug 2026 |
| 22 | Muse Spark 1.3 Meta· reasoning | 156.9 | 1.05M | $1.25 | Closed | 2 Sep 2026 |
| 23 | Muse Spark 1.3 Contributor Meta· reasoning | — | 1.05M | $0.10 | ? | 2 Sep 2026 |
| 24 | Muse Spark 1.2 Contributor Meta· reasoning | — | 1.05M | $0.10 | ? | 21 Aug 2026 |
| 25 | Muse Glimmer 30B Meta· reasoning | — | 131K | $0.30 | Open source | 9 Aug 2026 |
| 26 | Llama Guard 4 12B | — | 164K | $0.18 | Open source | 30 Apr 2025 |
| 27 | Llama 4 Maverick (FP8) | — | — | — | Open source | 5 Apr 2025 |
| 28 | Llama 3.3 70B Instruct | — | 131K | $0.10 | Open source | 6 Dec 2024 |
| 29 | Llama 3.2 1B Instruct | — | 60K | $0.027 | Open source | 25 Sep 2024 |
| 30 | Llama 3.2 3B Instruct | — | 131K | $0.050 | Open source | 25 Sep 2024 |
| 31 | Llama 3.2 11B | — | — | — | Open source | 24 Sep 2024 |
| 32 | Llama 3.2 3B | — | — | — | Open source | 24 Sep 2024 |
| 33 | Llama 3.1 8B Instruct | — | 131K | $0.050 | Open source | 23 Jul 2024 |
| 34 | Llama 3.1 70B Instruct | — | 131K | $0.40 | Open source | 23 Jul 2024 |
Showing 34 of 34. Benchmark cells are % (best reported setting). 3.8K benchmark results in total.Export CSV