Claude Opus 4.8: benchmarks y ranking
Claude Opus 4.8 (Anthropic) — puesto general: #24 / 138, puntuación general: 81.4 (Intervalo del 90 % 78.1–84.3), leaderboards: 9. Lanzamiento: 2026-05-28 · Precio (entrada/salida): $5 / $25
Puesto en cada leaderboard
| Leaderboard | Puesto | Valor publicado |
|---|---|---|
| Artificial Analysis | #17 / 107 | 41.8 |
| LiveBench | #26 / 60 | 76.2 |
| Epoch AI | #10 / 239 | 158.3 |
| ARC Prize (ARC-AGI) | #17 / 79 | 72.1 |
| Scale AI SEAL | Sin evaluar | — |
| Vals AI | #10 / 63 | 60.9 |
| Terminal-Bench | #8 / 15 | 23.64 |
| EQ-Bench | #6 / 28 | 1281.4 |
| SimpleBench | #23 / 99 | 64.8 |
| BenchLM.ai | #10 / 74 | 70.46 |
Puntuación por área
- Programación: 82.6
- Agentes: 81.5
- Razonamiento: 82.0
- Matemáticas: 84.2
- Conocimiento: 87.8
- Escritura: 71.1
- Instrucciones: 74.4
- Chat e IE: 81.0
- Negocios: 87.0
- Japonés: 81.9
- Visión: 80.6
- Contexto largo: 75.6