Claude Opus 4.6: benchmarks y ranking
Claude Opus 4.6 (Anthropic) — puesto general: #32 / 138, puntuación general: 74.8 (Intervalo del 90 % 70.2–78.9), leaderboards: 7. Lanzamiento: 2025-12-17 · Precio (entrada/salida): $5 / $25
Puesto en cada leaderboard
| Leaderboard | Puesto | Valor publicado |
|---|---|---|
| Artificial Analysis | Sin evaluar | — |
| LiveBench | #37 / 60 | 74.5 |
| Epoch AI | #25 / 239 | 155.36 |
| ARC Prize (ARC-AGI) | #19 / 79 | 69.2 |
| Scale AI SEAL | #10 / 42 | 34.44 |
| Vals AI | Sin evaluar | — |
| Terminal-Bench | Sin evaluar | — |
| EQ-Bench | #13 / 28 | 1222.7 |
| SimpleBench | #20 / 99 | 67.6 |
| BenchLM.ai | #20 / 74 | 63.64 |
Puntuación por área
- Programación: 71.9
- Agentes: 60.8
- Razonamiento: 81.4
- Matemáticas: 76.0
- Conocimiento: 84.1
- Escritura: 77.5
- Instrucciones: 48.5
- Chat e IE: 51.3
- Negocios: 85.9
- Japonés: 86.7
- Visión: 44.8
- Contexto largo: 86.1