Skip to content
Model intelligence

41 AI models

Capability (Epoch Capabilities Index and individual benchmarks from Epoch AI), API list prices and context windows (OpenRouter), release dates and open-weight status. Benchmarks are shown individually - never merged into one invented score.
Leads on ECI
GPT-6 Astra
ECI 166.6Epoch AI
Leads on GPQA Diamond
GPT-6 Astra
95.8%Epoch AI
Leads on SWE-bench Verified
Claude Opus 4.7
83.5%Epoch AI
Cheapest in ECI top 10
GPT-5.6 Sol
$2.00/M inputOpenRouter
Longest context
Grok 4.20 Multi-Agent
2M tokensOpenRouter
Best open-weight on ECI
Kimi K3
ECI 157.68Epoch AI
Epoch Capabilities Index by release date

Capability frontier

Source: Epoch AI (CC BY 4.0). ECI is Epoch's item-response model over many benchmarks; each model page shows its 90% confidence interval.

Blended $/1M tokens (3:1 input:output) vs ECI

Price vs capability

Only models with both an ECI score and an OpenRouter price. Normalisation: 75% input + 25% output price. Click a point to open the model.

#ModelECI ↑ContextIn $/MReleased
1DeepSeek V4.1 Flash
DeepSeek· reasoning
155.01.05M$0.309 Sep 2026
2Qwen3.8 Max (0902)
Alibaba (Qwen)· reasoning
155.31M$2.001 Sep 2026
3Muse Spark 1.3
Meta· reasoning
156.91.05M$1.252 Sep 2026
4Gemini 3.8 Flash
Google· reasoning
157.11.05M$0.752 Sep 2026
5Claude Fable 5.1
Anthropic· reasoning
165.01M$10.01 Sep 2026
6GPT-6 Astra
OpenAI· reasoning
166.61.05M$10.03 Sep 2026
7Claude Opus 5.5
Anthropic· reasoning
—1M$4.0022 Sep 2026
8Claude Sonnet 5.5
Anthropic· reasoning
—1M$2.0028 Sep 2026
9GPT-6 Sol
OpenAI· reasoning
—1.05M$2.0022 Sep 2026
10Grok 4.7
xAI· reasoning
—500K$2.0021 Sep 2026
11MiMo-V2.6-Pro
Xiaomi· reasoning
—1.05M$0.4321 Sep 2026
12MiMo-V2.6-Flash
Xiaomi· reasoning
—1.05M$0.1421 Sep 2026
13GPT-6 Luna
OpenAI· reasoning
—1.05M$0.1022 Sep 2026
14Ling 3.0 Flash VL—262K$0.02110 Sep 2026
15Mercury 2.5
Inception Labs· reasoning
—260K$0.0408 Sep 2026
16Granite 4.2 8B
IBM· reasoning
—131K$0.06031 Aug 2026
17Jev Router—1M—25 Sep 2026
18Perceptron Mk1.5
Perceptron· reasoning
—37K$0.1525 Sep 2026
19Ember-1
Fireworks AI· reasoning
—1.05M$3.0024 Sep 2026
20GLM 5.3 Prime
Z.ai (Zhipu AI)· reasoning
—1M$2.8023 Sep 2026
21Aion 3.5
AionLabs· reasoning
—262K$3.0023 Sep 2026
22Solar Mini 4
Upstage· reasoning
—524K$0.05023 Sep 2026
23Qwen3.8 Max Prime
Alibaba (Qwen)· reasoning
—1M$4.0023 Sep 2026
24Aion 3.5 Mini
AionLabs· reasoning
—262K$0.7023 Sep 2026
25GPT-6 Sol Pro
OpenAI· reasoning
—1.05M$2.0022 Sep 2026
26GPT-6 Luna Pro
OpenAI· reasoning
—1.05M$0.1022 Sep 2026
27Qwen3.8 Omni Flash
Alibaba (Qwen)· reasoning
—1M$0.1521 Sep 2026
28MiMo-V2.6-Pro-UltraSpeed
Xiaomi· reasoning
—1.05M$4.3521 Sep 2026
29GLM 5.3 FlashX
Z.ai (Zhipu AI)· reasoning
—1.05M$0.3718 Sep 2026
30Ternary Bonsai 2 27B
PrismML· reasoning
—262K$0.07518 Sep 2026
31Pareto—262K$2.5017 Sep 2026
32Schematron V2 Turbo—128K$0.03012 Sep 2026
33Schematron V2 Small—128K$0.05012 Sep 2026
34Fugu Max
Sakana AI· reasoning
—1M$2.0011 Sep 2026
35Fugu Ultra v2
Sakana AI· reasoning
—1M$5.0011 Sep 2026
36SWE-2 (max)———10 Sep 2026
37Nex-N2.5-Pro
Nex AGI· reasoning
—262K$0.0758 Sep 2026
38Nex-N2.5-Mini
Nex AGI· reasoning
—262K$0.0258 Sep 2026
39GPT-6 Astra Pro
OpenAI· reasoning
—1.05M$10.04 Sep 2026
40GPT-6 Astra (pro, max)———3 Sep 2026
41Muse Spark 1.3 Contributor
Meta· reasoning
—1.05M$0.102 Sep 2026
Showing 41 of 41. Benchmark cells are % (best reported setting). 3.8K benchmark results in total.Export CSV