Claude Opus 4.8 : benchmarks et classement
Claude Opus 4.8 (Anthropic) — rang global : #24 / 138, score global : 81.4 (Intervalle à 90 % 78.1–84.3), leaderboards : 9. Sortie: 2026-05-28 · Prix (entrée/sortie): $5 / $25
Rang sur chaque leaderboard
| Leaderboard | Rang | Valeur publiée |
|---|---|---|
| Artificial Analysis | #17 / 107 | 41.8 |
| LiveBench | #26 / 60 | 76.2 |
| Epoch AI | #10 / 239 | 158.3 |
| ARC Prize (ARC-AGI) | #17 / 79 | 72.1 |
| Scale AI SEAL | Non évalué | — |
| Vals AI | #10 / 63 | 60.9 |
| Terminal-Bench | #8 / 15 | 23.64 |
| EQ-Bench | #6 / 28 | 1281.4 |
| SimpleBench | #23 / 99 | 64.8 |
| BenchLM.ai | #10 / 74 | 70.46 |
Scores par domaine
- Code: 82.6
- Agents: 81.5
- Raisonnement: 82.0
- Mathématiques: 84.2
- Connaissances: 87.8
- Écriture: 71.1
- Consignes: 74.4
- Dialogue et IE: 81.0
- Entreprise: 87.0
- Japonais: 81.9
- Vision: 80.6
- Contexte long: 75.6