Benchmark
Epoch AI evaluates Claude Fable 5.1
FrontierMath-Tiers-1-3-v2-Private 90.2% · FrontierMath-Tier-4-v2-Private 87.8% · OTIS Mock AIME 2024-2025 100.0% · SimpleQA Verified 70.8%
- Type
- BENCHMARK_RESULT
- Detection
- benchmark
- Confidence
- high
- Status
Related entities