Skip to content
Model intelligence

227 AI models

Capability (Epoch Capabilities Index and individual benchmarks from Epoch AI), API list prices and context windows (OpenRouter), release dates and open-weight status. Benchmarks are shown individually - never merged into one invented score.
Leads on ECI
GPT-6 Astra
ECI 166.6Epoch AI
Leads on GPQA Diamond
GPT-6 Astra
95.8%Epoch AI
Leads on SWE-bench Verified
Claude Opus 4.7
83.5%Epoch AI
Cheapest in ECI top 10
GPT-5.6 Sol
$2.00/M inputOpenRouter
Longest context
Grok 4.20 Multi-Agent
2M tokensOpenRouter
Best open-weight on ECI
Kimi K3
ECI 157.68Epoch AI
Epoch Capabilities Index by release date

Capability frontier

Source: Epoch AI (CC BY 4.0). ECI is Epoch's item-response model over many benchmarks; each model page shows its 90% confidence interval.

Blended $/1M tokens (3:1 input:output) vs ECI

Price vs capability

Only models with both an ECI score and an OpenRouter price. Normalisation: 75% input + 25% output price. Click a point to open the model.

#ModelECI ↑ContextIn $/MReleased
1stablelm-tuned-alpha-7b
54.3——19 Apr 2023
2Qwen2.5-Coder-0.5B
87.4——18 Sep 2024
3RedPajama-INCITE-7B-Base
89.7——4 May 2023
4open_llama_7b
91.0——7 Jun 2023
5Qwen-1_8B
92.3——30 Nov 2023
6vicuna-13b-v1.1
94.0——12 Apr 2023
7CodeQwen1.5-7B
94.2——15 Apr 2024
8chatglm2-6b
98.4——24 Jun 2023
9INTELLECT-1
Prime Intellect,Hugging Face,Arcee AI
100.4——29 Nov 2024
10internlm-7b
102.4——5 Jul 2023
11Llama 2-34B104.8——18 Jul 2023
12PaLM 2-S
105.8——17 May 2023
13Yi-9B
107.3——1 Mar 2024
14Nemotron-4 15B107.4——26 Feb 2024
15Qwen2.5-Coder-3B
107.4——18 Sep 2024
16PaLM 2-M
108.0——17 May 2023
17DeepSeek-Coder-V2-Lite-Base
108.6——13 Jun 2024
18internlm-20b
111.8——18 Sep 2023
19GPT-3.5 Turbo (Jun 2023)113.1——13 Jun 2023
20PaLM 2-L
114.8——17 May 2023
21GPT-3.5 Turbo (Jan 2024)115.6——25 Jan 2024
22Qwen2.5-Coder-14B
116.3——18 Sep 2024
23Gemini 1.0 Pro117.0——13 Dec 2023
24Ministral 3B118.1——16 Oct 2024
25Claude 3 Haiku118.3——7 Mar 2024
26GPT-3.5 Turbo (Nov 2023)118.5——6 Nov 2023
27Claude 2.1119.2——21 Nov 2023
28Claude 2120.1——11 Jul 2023
29Claude Instant120.2——9 Aug 2023
30Claude 3 Sonnet120.7——29 Feb 2024
31Mistral Large122.0128K$2.0026 Feb 2024
32Gemini 1.5 Flash (May 2024)122.6——23 May 2024
33GPT-4 (Jun 2023)123.1——13 Jun 2023
34Amazon Nova Pro123.8——3 Dec 2024
35GPT-4 (Mar 2023)125.9——14 Mar 2023
36GPT-4 Turbo (Nov 2023)126.5——25 Jan 2024
37GPT-4o-mini126.6128K$0.1518 Jul 2024
38Gemini 1.5 Pro (May 2024)126.9——14 May 2024
39Claude 3 Opus126.9——29 Feb 2024
40Claude 3.5 Haiku127.2——22 Oct 2024
41GPT-4 Turbo (Apr 2024)127.3——9 Apr 2024
42GPT-4o (Aug 2024)128.8——6 Aug 2024
43GPT-4o (Nov 2024)128.8——20 Nov 2024
44GPT-4o (May 2024)129.0——13 May 2024
45Gemini 1.5 Flash (Sep 2024)129.4——24 Sep 2024
46GPT-4.1 Nano129.61.05M$0.1014 Apr 2025
47Claude 3.5 Sonnet130.0——20 Jun 2024
48Grok-2 (Dec 2024)130.5——12 Dec 2024
49Gemini 1.5 Pro (Sept 2024)131.7——24 Sep 2024
50Qwen2.5-Max132.5——25 Jan 2025
51Claude 3.5 Sonnet (October 2024)133.6——22 Oct 2024
52Gemini 2.5 Flash-Lite (Jun 2025)133.9——17 Jun 2025
53Mistral Medium 3134.1131K$0.407 May 2025
54Gemini 2.0 Flash (Feb 2025)134.7——5 Feb 2025
55Gemini 2.0 Flash (Dec 2024)134.7——11 Dec 2024
56o1-preview134.8——12 Sep 2024
57GPT-4.1 Mini135.01.05M$0.4014 Apr 2025
58Gemini 2.0 Pro135.1——5 Feb 2025
59Gemini 2.0 Flash Thinking (Jan 2025)135.4——21 Jan 2025
60o1-mini135.8——12 Sep 2024
61GPT-4.5136.7——27 Feb 2025
62GPT-4.1136.81.05M$2.0014 Apr 2025
63Grok 3138.3——9 Apr 2025
64GPT-5 Nano
OpenAI· reasoning
139.4400K$0.0507 Aug 2025
65Gemini 2.5 Flash (Apr 2025)140.0——17 Apr 2025
66Grok-3 mini140.3——24 Jun 2025
67o3 Mini
OpenAI· reasoning
140.3200K$1.1031 Jan 2025
68Gemini 2.5 Flash (Jun 2025)140.8——17 Jun 2025
69Claude 3.7 Sonnet141.2——24 Feb 2025
70Gemini 2.5 Flash (May 2025)141.5——20 May 2025
71Claude Sonnet 4
Anthropic· reasoning
141.7200K$3.0022 May 2025
72o1
OpenAI· reasoning
141.9200K$15.017 Dec 2024
73Qwen3 Max
Alibaba (Qwen)· reasoning
142.4262K$0.7824 Sep 2025
74Claude Haiku 4.5
Anthropic· reasoning
142.4200K$1.0015 Oct 2025
75Gemini 2.5 Pro (May 2025)142.5——6 May 2025
76GPT-5.5 Instant142.5——5 May 2026
77Claude Opus 4142.7——22 May 2025
78Gemini 2.5 Flash (Sep 2025)143.0——25 Sep 2025
79Qwen 3.6 Flash143.3——27 Apr 2026
80Qwen 3.5 Flash (hosted 35B-A3B)144.0——25 Feb 2026
81Claude Opus 4.1
Anthropic· reasoning
144.1200K$15.05 Aug 2025
82Gemini 2.5 Pro (Mar 2025)144.2——31 Mar 2025
83Grok 4 Fast144.2——19 Sep 2025
84Gemini 3.1 Flash Lite
Google· reasoning
144.41.05M$0.253 Mar 2026
85Qwen3.7 Flash
Alibaba (Qwen)· reasoning
144.61M$0.03027 Jul 2026
86Gemini 3.5 Flash Lite
Google· reasoning
145.11.05M$0.3021 Jul 2026
87Gemini 2.5 Pro (Jun 2025)145.3——5 Jun 2025
88GPT-5 Mini
OpenAI· reasoning
145.5400K$0.257 Aug 2025
89o4 Mini
OpenAI· reasoning
145.6200K$1.1016 Apr 2025
90GPT-5.4 Nano
OpenAI· reasoning
145.8400K$0.2017 Mar 2026
91Grok 4146.5——9 Jul 2025
92Qwen 3.5 Plus (hosted 397B-A17B)146.8——16 Feb 2026
93Claude Sonnet 4.5
Anthropic· reasoning
146.81M$3.0029 Sep 2025
94o3
OpenAI· reasoning
146.9200K$2.0016 Apr 2025
95Qwen3.7 Plus
Alibaba (Qwen)· reasoning
147.41M$0.322 Jun 2026
96o3 Pro
OpenAI· reasoning
147.4200K$20.010 Jun 2025
97Qwen 3.6 Plus147.7——31 Mar 2026
98GPT-5.4 Mini
OpenAI· reasoning
148.8400K$0.7517 Mar 2026
99Grok 4.3 Beta149.1——17 Apr 2026
100Qwen 3.6 Max (Preview)149.3——20 Apr 2026
Showing 100 of 227. Benchmark cells are % (best reported setting). 3.8K benchmark results in total.Next →Export CSV