Claude Opus 4.6: Benchmarks und Rangliste
Claude Opus 4.6 (Anthropic) — Gesamtrang: #32 / 138, Gesamtwert: 74.8 (90-%-Intervall 70.2–78.9), Leaderboards: 7. Veröffentlicht: 2025-12-17 · Preis (Ein/Aus): $5 / $25
Rang in jedem Leaderboard
| Leaderboard | Rang | Veröffentlichter Wert |
|---|---|---|
| Artificial Analysis | Nicht bewertet | — |
| LiveBench | #37 / 60 | 74.5 |
| Epoch AI | #25 / 239 | 155.36 |
| ARC Prize (ARC-AGI) | #19 / 79 | 69.2 |
| Scale AI SEAL | #10 / 42 | 34.44 |
| Vals AI | Nicht bewertet | — |
| Terminal-Bench | Nicht bewertet | — |
| EQ-Bench | #13 / 28 | 1222.7 |
| SimpleBench | #20 / 99 | 67.6 |
| BenchLM.ai | #20 / 74 | 63.64 |
Bereichswerte
- Programmierung: 71.9
- Agenten: 60.8
- Schlussfolgern: 81.4
- Mathematik: 76.0
- Wissen: 84.1
- Schreiben: 77.5
- Anweisungen: 48.5
- Chat & EQ: 51.3
- Business: 85.9
- Japanisch: 86.7
- Bildverständnis: 44.8
- Langer Kontext: 86.1