Skip to content
Model intelligence

236 AI models

Capability (Epoch Capabilities Index and individual benchmarks from Epoch AI), API list prices and context windows (OpenRouter), release dates and open-weight status. Benchmarks are shown individually - never merged into one invented score.
Leads on ECI
Claude Opus 5.5
ECI 167.35Epoch AI
Leads on GPQA Diamond
GPT-6 Astra
95.8%Epoch AI
Leads on SWE-bench Verified
Claude Opus 4.7
83.5%Epoch AI
Cheapest in ECI top 10
Claude Sonnet 5.5
$2.00/M inputOpenRouter
Longest context
Grok 4.20 Multi-Agent
2M tokensOpenRouter
Best open-weight on ECI
Kimi K3
ECI 157.61Epoch AI
Epoch Capabilities Index by release date

Capability frontier

Source: Epoch AI (CC BY 4.0). ECI is Epoch's item-response model over many benchmarks; each model page shows its 90% confidence interval.

Blended $/1M tokens (3:1 input:output) vs ECI

Price vs capability

Only models with both an ECI score and an OpenRouter price. Normalisation: 75% input + 25% output price. Click a point to open the model.

#ModelECI ↑ContextIn $/MReleased
201gemini-2.5-flash-lite-preview-06-17 (Default thinking length)———17 Jun 2025
202Magistral Medium 1.1———10 Jun 2025
203Gemini 2.5 Pro Preview (Jun 2025)———5 Jun 2025
204Qwen Plus (Apr 2025)———28 Apr 2025
205Gemini 2.5 Flash Preview (Apr 2025)———17 Apr 2025
206o4-mini (medium)———16 Apr 2025
207o4-mini (low)———16 Apr 2025
208QWQ-Plus———8 Apr 2025
209Gemini 2.5 Pro Preview (Mar 2025)———31 Mar 2025
210GPT-4o (Mar 2025)———27 Mar 2025
211Gemini 2.5 Pro Exp (Mar 2025)———25 Mar 2025
212o1 Pro (low)———19 Mar 2025
213GPT-4.5 Preview (Feb 2025)———27 Feb 2025
214Gemini 2.0 Pro Exp (Feb 2025)———5 Feb 2025
215Gemini 2.0 Flash-Lite———5 Feb 2025
216o3-mini (medium)———31 Jan 2025
217GPT-4o (Jan 2025)———29 Jan 2025
218Qwen Plus (Jan 2025)———25 Jan 2025
219Gemini 2.0 Flash Thinking Exp———21 Jan 2025
220Amazon Nova Lite———3 Dec 2024
221Amazon Nova Micro———3 Dec 2024
222Yi-Lightning
01.AI
———2 Dec 2024
223Qwen-Turbo———1 Nov 2024
224Claude 3.5 Haiku (Oct 2024)———22 Oct 2024
225Claude 3.5 Sonnet (Oct 2024)———22 Oct 2024
226Gemini 1.5 Flash 8B———3 Oct 2024
227Claude 3.5 Sonnet (Jun 2024)———20 Jun 2024
228Yi-Large
01.AI
———13 May 2024
229Gemini 1.5 Pro (Feb 2024)———15 Feb 2024
230GPT-4 Turbo Preview (January 2024)———25 Jan 2024
231Gemini 1.0 Pro Vision———4 Jan 2024
232Mistral Medium———11 Dec 2023
233GPT-4 Turbo Preview (Nov 2023)———6 Nov 2023
234Inflection-1———22 Jun 2023
235GPT-3.5 Turbo (June 2023)———13 Jun 2023
236Claude 1.3———18 Apr 2023
Showing 36 of 236. Benchmark cells are % (best reported setting). 3.9K benchmark results in total.← PrevExport CSV