Claude Opus 4.5 · Anthropic, released 2025-11-24
Qwen 3.6 Plus (2026-04-02) · Alibaba, released 2026-03-31
“Epoch AI, 'AI Benchmarking Hub'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks' [online resource].” · epoch.ai/benchmarks · Licensed CC BY 4.0 · data last verified 2026-07-26 · Methodology · Data Sources
Measured on 8 of 9 tracked benchmarks for both models — Claude Opus 4.5 leads on 2, Qwen 3.6 Plus (2026-04-02) leads on 6.
| Benchmark | Claude Opus 4.5 | Qwen 3.6 Plus (2026-04-02) | Leads |
|---|---|---|---|
| Epoch Capabilities Index (ECI) | 149.6 | 149.2 | Claude Opus 4.5 |
| SWE-bench Verified | 0.767 | 0.579 | Claude Opus 4.5 |
| GPQA Diamond | 0.860 (32k) | 0.874 | Qwen 3.6 Plus (2026-04-02) |
| MATH Level 5 | Not measured | Not measured | Not measured on both |
| OTIS Mock AIME 2024-2025 | 0.861 (32k) | 0.906 | Qwen 3.6 Plus (2026-04-02) |
| FrontierMath | 0.207 | 0.262 | Qwen 3.6 Plus (2026-04-02) |
| FrontierMath Tier 4 | 0.042 | 0.083 | Qwen 3.6 Plus (2026-04-02) |
| SimpleQA Verified | 0.418 (32k) | 0.491 | Qwen 3.6 Plus (2026-04-02) |
| Chess Puzzles | 0.120 (32k) | 0.162 | Qwen 3.6 Plus (2026-04-02) |
Claude Opus 4.5 → · Qwen 3.6 Plus (2026-04-02) → · the full AI Model Rankings table