Skip to content
Model intelligence

15 AI models

Capability (Epoch Capabilities Index and individual benchmarks from Epoch AI), API list prices and context windows (OpenRouter), release dates and open-weight status. Benchmarks are shown individually - never merged into one invented score.
Leads on ECI
GPT-6 Astra
ECI 166.6Epoch AI
Leads on GPQA Diamond
GPT-6 Astra
95.8%Epoch AI
Leads on SWE-bench Verified
Claude Opus 4.7
83.5%Epoch AI
Cheapest in ECI top 10
GPT-5.6 Sol
$2.00/M inputOpenRouter
Longest context
Grok 4.20 Multi-Agent
2M tokensOpenRouter
Best open-weight on ECI
Kimi K3
ECI 157.68Epoch AI
Epoch Capabilities Index by release date

Capability frontier

Source: Epoch AI (CC BY 4.0). ECI is Epoch's item-response model over many benchmarks; each model page shows its 90% confidence interval.

Blended $/1M tokens (3:1 input:output) vs ECI

Price vs capability

Only models with both an ECI score and an OpenRouter price. Normalisation: 75% input + 25% output price. Click a point to open the model.

#ModelECI ↑ContextIn $/MReleased
1Claude Sonnet 4
Anthropic· reasoning
141.7200K$3.0022 May 2025
2Claude Haiku 4.5
Anthropic· reasoning
142.4200K$1.0015 Oct 2025
3Claude Opus 4.1
Anthropic· reasoning
144.1200K$15.05 Aug 2025
4Claude Sonnet 4.5
Anthropic· reasoning
146.81M$3.0029 Sep 2025
5Claude Opus 4.5
Anthropic· reasoning
150.1200K$5.0024 Nov 2025
6Claude Sonnet 4.6
Anthropic· reasoning
152.31M$3.0017 Feb 2026
7Claude Opus 4.6
Anthropic· reasoning
155.41M$5.005 Feb 2026
8Claude Sonnet 5
Anthropic· reasoning
156.31M$2.0030 Jun 2026
9Claude Opus 4.7
Anthropic· reasoning
156.41M$5.0016 Apr 2026
10Claude Opus 4.8
Anthropic· reasoning
158.31M$5.0028 May 2026
11Claude Opus 5
Anthropic· reasoning
162.71M$5.0024 Jul 2026
12Claude Fable 5
Anthropic· reasoning
163.61M$10.09 Jun 2026
13Claude Fable 5.1
Anthropic· reasoning
165.01M$10.01 Sep 2026
14Claude Opus 5.5
Anthropic· reasoning
—1M$4.0022 Sep 2026
15Claude Sonnet 5.5
Anthropic· reasoning
—1M$2.0028 Sep 2026
Showing 15 of 15. Benchmark cells are % (best reported setting). 3.8K benchmark results in total.Export CSV