Claude Opus 4.6 : benchmarks et classement
Claude Opus 4.6 (Anthropic) — rang global : #32 / 138, score global : 74.8 (Intervalle à 90 % 70.2–78.9), leaderboards : 7. Sortie: 2025-12-17 · Prix (entrée/sortie): $5 / $25
Rang sur chaque leaderboard
| Leaderboard | Rang | Valeur publiée |
|---|---|---|
| Artificial Analysis | Non évalué | — |
| LiveBench | #37 / 60 | 74.5 |
| Epoch AI | #25 / 239 | 155.36 |
| ARC Prize (ARC-AGI) | #19 / 79 | 69.2 |
| Scale AI SEAL | #10 / 42 | 34.44 |
| Vals AI | Non évalué | — |
| Terminal-Bench | Non évalué | — |
| EQ-Bench | #13 / 28 | 1222.7 |
| SimpleBench | #20 / 99 | 67.6 |
| BenchLM.ai | #20 / 74 | 63.64 |
Scores par domaine
- Code: 71.9
- Agents: 60.8
- Raisonnement: 81.4
- Mathématiques: 76.0
- Connaissances: 84.1
- Écriture: 77.5
- Consignes: 48.5
- Dialogue et IE: 51.3
- Entreprise: 85.9
- Japonais: 86.7
- Vision: 44.8
- Contexte long: 86.1