Skip to content
Model intelligence

236 AI models

Capability (Epoch Capabilities Index and individual benchmarks from Epoch AI), API list prices and context windows (OpenRouter), release dates and open-weight status. Benchmarks are shown individually - never merged into one invented score.
Leads on ECI
Claude Opus 5.5
ECI 167.35Epoch AI
Leads on GPQA Diamond
GPT-6 Astra
95.8%Epoch AI
Leads on SWE-bench Verified
Claude Opus 4.7
83.5%Epoch AI
Cheapest in ECI top 10
Claude Sonnet 5.5
$2.00/M inputOpenRouter
Longest context
Grok 4.20 Multi-Agent
2M tokensOpenRouter
Best open-weight on ECI
Kimi K3
ECI 157.61Epoch AI
Epoch Capabilities Index by release date

Capability frontier

Source: Epoch AI (CC BY 4.0). ECI is Epoch's item-response model over many benchmarks; each model page shows its 90% confidence interval.

Blended $/1M tokens (3:1 input:output) vs ECI

Price vs capability

Only models with both an ECI score and an OpenRouter price. Normalisation: 75% input + 25% output price. Click a point to open the model.

#ModelECI ↑ContextIn $/MReleased
101GPT-5.1
OpenAI· reasoning
149.7400K$1.2513 Nov 2025
102GPT-5
OpenAI· reasoning
150.0400K$1.257 Aug 2025
103Claude Opus 4.5
Anthropic· reasoning
150.1200K$5.0024 Nov 2025
104GPT-5 Pro
OpenAI· reasoning
150.3400K$15.07 Oct 2025
105Gemini 3 Flash151.8——17 Dec 2025
106Grok 4.20
xAI· reasoning
152.02M$1.2517 Feb 2026
107Muse Spark152.1——8 Apr 2026
108Claude Sonnet 4.6
Anthropic· reasoning
152.31M$3.0017 Feb 2026
109Gemini 3 Pro152.9——18 Nov 2025
110GPT-5.2
OpenAI· reasoning
153.5400K$1.7511 Dec 2025
111Qwen3.7 Max
Alibaba (Qwen)· reasoning
153.71M$1.4819 May 2026
112Grok 4.5
xAI· reasoning
154.0500K$2.008 Jul 2026
113Muse Spark 1.1
Meta· reasoning
154.31.05M$1.259 Jul 2026
114Gemini 3.6 Flash
Google· reasoning
154.31.05M$0.7521 Jul 2026
115Gemini 3.5 Flash
Google· reasoning
154.51.05M$1.5019 May 2026
116Gemini 3.1 Pro154.8——19 Feb 2026
117Muse Spark 1.2
Meta· reasoning
155.01.05M$1.255 Aug 2026
118Qwen3.8 Max (0902)
Alibaba (Qwen)· reasoning
155.21M$2.001 Sep 2026
119Claude Opus 4.6
Anthropic· reasoning
155.31M$5.005 Feb 2026
120GPT-5.2 Pro
OpenAI· reasoning
155.4400K$21.011 Dec 2025
121Claude Sonnet 5
Anthropic· reasoning
156.31M$2.0030 Jun 2026
122Claude Opus 4.7
Anthropic· reasoning
156.31M$5.0016 Apr 2026
123GPT-5.6 Luna
OpenAI· reasoning
156.41.05M$0.209 Jul 2026
124Qwen 3.8 Max156.6——2 Aug 2026
125Grok 4.6
xAI· reasoning
156.6500K$2.0012 Aug 2026
126GPT-5.3-Codex
OpenAI· reasoning
156.8400K$1.755 Feb 2026
127Muse Spark 1.3
Meta· reasoning
156.91.05M$1.252 Sep 2026
128GPT-5.4
OpenAI· reasoning
156.91.05M$2.505 Mar 2026
129Gemini 3.8 Flash
Google· reasoning
156.91.05M$0.752 Sep 2026
130Gemini 3.7 Flash
Google· reasoning
157.41.05M$0.7513 Aug 2026
131Claude Opus 4.8
Anthropic· reasoning
158.31M$5.0028 May 2026
132GPT-5.4 Pro
OpenAI· reasoning
159.11.05M$30.05 Mar 2026
133GPT-5.5
OpenAI· reasoning
159.21.05M$5.0023 Apr 2026
134GPT-5.6 Terra
OpenAI· reasoning
159.81.05M$2.009 Jul 2026
135GPT-5.6 Sol
OpenAI· reasoning
161.81.05M$2.009 Jul 2026
136Claude Fable 5
Anthropic· reasoning
162.21M$10.09 Jun 2026
137GPT-5.5 Pro
OpenAI· reasoning
162.41.05M$30.023 Apr 2026
138Claude Opus 5
Anthropic· reasoning
162.91M$5.0024 Jul 2026
139Claude Fable 5.1
Anthropic· reasoning
164.81M$10.01 Sep 2026
140Claude Sonnet 5.5
Anthropic· reasoning
165.21M$2.0028 Sep 2026
141GPT-6 Astra
OpenAI· reasoning
166.51.05M$10.03 Sep 2026
142Claude Opus 5.5
Anthropic· reasoning
167.31M$4.0022 Sep 2026
143GPT-6.1 Sol (unknown thinking)———29 Sep 2026
144GPT-6.1 Sol (medium)———29 Sep 2026
145GPT-6 Sol (xhigh)———22 Sep 2026
146GPT-6 Sol (medium)———22 Sep 2026
147GPT-6 Luna (xhigh)———22 Sep 2026
148GPT-6 Sol (low)———22 Sep 2026
149GPT-6 Luna (medium)———22 Sep 2026
150GPT-6 Luna (low)———22 Sep 2026
151GPT-6 Sol (none)———22 Sep 2026
152GPT-6 Luna (none)———22 Sep 2026
153GPT-6 Sol (unknown thinking)———22 Sep 2026
154GPT-6 Luna (unknown thinking)———22 Sep 2026
155Grok 4.7 (unknown)———21 Sep 2026
156Grok 4.7 (xhigh)———21 Sep 2026
157SWE-2 (max)———10 Sep 2026
158Mercury 2.5 (unknown)———8 Sep 2026
159GPT-6 Astra (pro, max)———3 Sep 2026
160GLM-5.3 (unknown thinking)———14 Aug 2026
161Qwen3.8 Max (xhigh)———2 Aug 2026
162Qwen3.8 Max (unknown)———2 Aug 2026
163Gemini 3.5 Flash-Lite (medium)———21 Jul 2026
164GPT-5.6 Sol (pro, max)———9 Jul 2026
165GPT-5.6 Sol (pro, xhigh)———9 Jul 2026
166GPT-5.6 Sol (pro, unknown thinking)———9 Jul 2026
167Composer 2.5———18 May 2026
168AI co-mathematician———8 May 2026
169Claude Mythos Preview (Early)———7 Apr 2026
170SWE-1.6———7 Apr 2026
171Qwen 3.6 Plus (2026-04-02)———31 Mar 2026
172GPT-5.4 mini (xhigh)———17 Mar 2026
173GPT-5.4 mini (none)———17 Mar 2026
174GPT-5.4 nano (no thinking)———17 Mar 2026
175GPT-5.4 nano (low)———17 Mar 2026
176GPT-5.4 mini (low)———17 Mar 2026
177GPT-5.4 mini (medium)———17 Mar 2026
178GPT-5.4 nano (medium)———17 Mar 2026
179GPT-5.4 nano (xhigh)———17 Mar 2026
180GPT-5.4 mini (unknown thinking)———17 Mar 2026
181GPT-5.4 Pro (web)———5 Mar 2026
182Gemini 3 Deep Think———12 Feb 2026
183GPT-5.3 Codex (xhigh)———5 Feb 2026
184GPT-5.2 Pro (web)———11 Dec 2025
185Grok 4.1 Fast———19 Nov 2025
186Gemini 3 Pro Preview———18 Nov 2025
187Grok 4.1———17 Nov 2025
188Gemini 2.5 Flash-Lite (Sep 2025)———25 Sep 2025
189Qwen3-Max-Instruct———24 Sep 2025
190GPT-5-codex———15 Sep 2025
191GPT-5 mini (minimal)———7 Aug 2025
192GPT-5 nano (low)———7 Aug 2025
193GPT-5 nano (minimal)———7 Aug 2025
194GPT-5 mini (medium)———7 Aug 2025
195GPT-5 nano (medium)———7 Aug 2025
196GPT-5 mini (low)———7 Aug 2025
197GPT-5 mini (unknown thinking)———7 Aug 2025
198GPT-5 nano (unknown thinking)———7 Aug 2025
199Gemini 2.5 Deep Think———1 Aug 2025
200Grok 4 Heavy (web app)———10 Jul 2025
Showing 100 of 236. Benchmark cells are % (best reported setting). 3.9K benchmark results in total.← PrevNext →Export CSV