Claude Opus 4.5: benchmarks y ranking
Claude Opus 4.5 (Anthropic) — puesto general: #51 / 138, puntuación general: 62.2 (Intervalo del 90 % 56.5–67.7), leaderboards: 6. Lanzamiento: 2025-11-01 · Precio (entrada/salida): $5 / $25
Puesto en cada leaderboard
| Leaderboard | Puesto | Valor publicado |
|---|---|---|
| Artificial Analysis | Sin evaluar | — |
| LiveBench | #45 / 60 | 72.6 |
| Epoch AI | #47 / 239 | 150.1 |
| ARC Prize (ARC-AGI) | #34 / 79 | 37.6 |
| Scale AI SEAL | #14 / 42 | 25.2 |
| Vals AI | Sin evaluar | — |
| Terminal-Bench | Sin evaluar | — |
| EQ-Bench | Sin evaluar | — |
| SimpleBench | #29 / 99 | 62 |
| BenchLM.ai | #34 / 74 | 55.09 |
Puntuación por área
- Programación: 61.6
- Agentes: 38.0
- Razonamiento: 64.7
- Matemáticas: 74.0
- Conocimiento: 76.2
- Escritura: 72.2
- Instrucciones: 47.4
- Chat e IE: 41.5
- Negocios: 82.8
- Japonés: 80.3
- Visión: 6.0
- Contexto largo: 47.9