Claude Opus 4.8: Benchmarks und Rangliste
Claude Opus 4.8 (Anthropic) — Gesamtrang: #24 / 138, Gesamtwert: 81.4 (90-%-Intervall 78.1–84.3), Leaderboards: 9. Veröffentlicht: 2026-05-28 · Preis (Ein/Aus): $5 / $25
Rang in jedem Leaderboard
| Leaderboard | Rang | Veröffentlichter Wert |
|---|---|---|
| Artificial Analysis | #17 / 107 | 41.8 |
| LiveBench | #26 / 60 | 76.2 |
| Epoch AI | #10 / 239 | 158.3 |
| ARC Prize (ARC-AGI) | #17 / 79 | 72.1 |
| Scale AI SEAL | Nicht bewertet | — |
| Vals AI | #10 / 63 | 60.9 |
| Terminal-Bench | #8 / 15 | 23.64 |
| EQ-Bench | #6 / 28 | 1281.4 |
| SimpleBench | #23 / 99 | 64.8 |
| BenchLM.ai | #10 / 74 | 70.46 |
Bereichswerte
- Programmierung: 82.6
- Agenten: 81.5
- Schlussfolgern: 82.0
- Mathematik: 84.2
- Wissen: 87.8
- Schreiben: 71.1
- Anweisungen: 74.4
- Chat & EQ: 81.0
- Business: 87.0
- Japanisch: 81.9
- Bildverständnis: 80.6
- Langer Kontext: 75.6