Skip to content
Model intelligence

55 AI models

Capability (Epoch Capabilities Index and individual benchmarks from Epoch AI), API list prices and context windows (OpenRouter), release dates and open-weight status. Benchmarks are shown individually - never merged into one invented score.
Leads on ECI
GPT-6 Astra
ECI 166.6Epoch AI
Leads on GPQA Diamond
GPT-6 Astra
95.8%Epoch AI
Leads on SWE-bench Verified
Claude Opus 4.7
83.5%Epoch AI
Cheapest in ECI top 10
GPT-5.6 Sol
$2.00/M inputOpenRouter
Longest context
Grok 4.20 Multi-Agent
2M tokensOpenRouter
Best open-weight on ECI
Kimi K3
ECI 157.68Epoch AI
Epoch Capabilities Index by release date

Capability frontier

Source: Epoch AI (CC BY 4.0). ECI is Epoch's item-response model over many benchmarks; each model page shows its 90% confidence interval.

Blended $/1M tokens (3:1 input:output) vs ECI

Price vs capability

Only models with both an ECI score and an OpenRouter price. Normalisation: 75% input + 25% output price. Click a point to open the model.

#ModelECI ↓ContextIn $/MReleased
1GPT-6 Astra
OpenAI· reasoning
166.61.05M$10.03 Sep 2026
2Claude Fable 5.1
Anthropic· reasoning
165.01M$10.01 Sep 2026
3Claude Fable 5
Anthropic· reasoning
163.61M$10.09 Jun 2026
4Claude Opus 5
Anthropic· reasoning
162.71M$5.0024 Jul 2026
5GPT-5.5 Pro
OpenAI· reasoning
162.41.05M$30.023 Apr 2026
6GPT-5.6 Sol
OpenAI· reasoning
162.01.05M$2.009 Jul 2026
7GPT-5.6 Terra
OpenAI· reasoning
159.31.05M$2.009 Jul 2026
8GPT-5.5
OpenAI· reasoning
159.31.05M$5.0023 Apr 2026
9GPT-5.4 Pro
OpenAI· reasoning
159.11.05M$30.05 Mar 2026
10Claude Opus 4.8
Anthropic· reasoning
158.31M$5.0028 May 2026
11Gemini 3.7 Flash
Google· reasoning
157.71.05M$0.7513 Aug 2026
12Gemini 3.8 Flash
Google· reasoning
157.11.05M$0.752 Sep 2026
13GPT-5.4
OpenAI· reasoning
156.91.05M$2.505 Mar 2026
14Muse Spark 1.3
Meta· reasoning
156.91.05M$1.252 Sep 2026
15GPT-5.3-Codex
OpenAI· reasoning
156.8400K$1.755 Feb 2026
16Grok 4.6
xAI· reasoning
156.5500K$2.0012 Aug 2026
17Claude Opus 4.7
Anthropic· reasoning
156.41M$5.0016 Apr 2026
18Claude Sonnet 5
Anthropic· reasoning
156.31M$2.0030 Jun 2026
19GPT-5.6 Luna
OpenAI· reasoning
156.31.05M$0.209 Jul 2026
20GPT-5.2 Pro
OpenAI· reasoning
155.4400K$21.011 Dec 2025
21Claude Opus 4.6
Anthropic· reasoning
155.41M$5.005 Feb 2026
22Qwen3.8 Max (0902)
Alibaba (Qwen)· reasoning
155.31M$2.001 Sep 2026
23Muse Spark 1.2
Meta· reasoning
155.21.05M$1.255 Aug 2026
24Gemini 3.5 Flash
Google· reasoning
154.61.05M$1.5019 May 2026
25Gemini 3.6 Flash
Google· reasoning
154.41.05M$0.7521 Jul 2026
26Muse Spark 1.1
Meta· reasoning
154.31.05M$1.259 Jul 2026
27Grok 4.5
xAI· reasoning
154.0500K$2.008 Jul 2026
28GPT-5.2
OpenAI· reasoning
153.4400K$1.7511 Dec 2025
29Claude Sonnet 4.6
Anthropic· reasoning
152.31M$3.0017 Feb 2026
30Grok 4.20
xAI· reasoning
152.02M$1.2517 Feb 2026
31GPT-5 Pro
OpenAI· reasoning
150.3400K$15.07 Oct 2025
32Claude Opus 4.5
Anthropic· reasoning
150.1200K$5.0024 Nov 2025
33GPT-5
OpenAI· reasoning
150.0400K$1.257 Aug 2025
34GPT-5.1
OpenAI· reasoning
149.7400K$1.2513 Nov 2025
35GPT-5.4 Mini
OpenAI· reasoning
148.8400K$0.7517 Mar 2026
36o3 Pro
OpenAI· reasoning
147.4200K$20.010 Jun 2025
37Qwen3.7 Plus
Alibaba (Qwen)· reasoning
147.41M$0.322 Jun 2026
38o3
OpenAI· reasoning
146.9200K$2.0016 Apr 2025
39Claude Sonnet 4.5
Anthropic· reasoning
146.81M$3.0029 Sep 2025
40GPT-5.4 Nano
OpenAI· reasoning
145.8400K$0.2017 Mar 2026
41o4 Mini
OpenAI· reasoning
145.6200K$1.1016 Apr 2025
42GPT-5 Mini
OpenAI· reasoning
145.5400K$0.257 Aug 2025
43Gemini 3.5 Flash Lite
Google· reasoning
145.11.05M$0.3021 Jul 2026
44Qwen3.7 Flash
Alibaba (Qwen)· reasoning
144.61M$0.03027 Jul 2026
45Gemini 3.1 Flash Lite
Google· reasoning
144.41.05M$0.253 Mar 2026
46Claude Opus 4.1
Anthropic· reasoning
144.1200K$15.05 Aug 2025
47Claude Haiku 4.5
Anthropic· reasoning
142.4200K$1.0015 Oct 2025
48o1
OpenAI· reasoning
141.9200K$15.017 Dec 2024
49Claude Sonnet 4
Anthropic· reasoning
141.7200K$3.0022 May 2025
50GPT-5 Nano
OpenAI· reasoning
139.4400K$0.0507 Aug 2025
51GPT-4.1136.81.05M$2.0014 Apr 2025
52GPT-4.1 Mini135.01.05M$0.4014 Apr 2025
53Mistral Medium 3134.1131K$0.407 May 2025
54GPT-4.1 Nano129.61.05M$0.1014 Apr 2025
55GPT-4o-mini126.6128K$0.1518 Jul 2024
Showing 55 of 55. Benchmark cells are % (best reported setting). 3.8K benchmark results in total.Export CSV