Claude Opus 4.5: benchmarks e ranking
Claude Opus 4.5 (Anthropic) — posição geral: #51 / 138, pontuação geral: 62.2 (Intervalo de 90% 56.5–67.7), leaderboards: 6. Lançamento: 2025-11-01 · Preço (entrada/saída): $5 / $25
Posição em cada leaderboard
| Leaderboard | Posição | Valor publicado |
|---|---|---|
| Artificial Analysis | Não avaliado | — |
| LiveBench | #45 / 60 | 72.6 |
| Epoch AI | #47 / 239 | 150.1 |
| ARC Prize (ARC-AGI) | #34 / 79 | 37.6 |
| Scale AI SEAL | #14 / 42 | 25.2 |
| Vals AI | Não avaliado | — |
| Terminal-Bench | Não avaliado | — |
| EQ-Bench | Não avaliado | — |
| SimpleBench | #29 / 99 | 62 |
| BenchLM.ai | #34 / 74 | 55.09 |
Pontuação por área
- Programação: 61.6
- Agentes: 38.0
- Raciocínio: 64.7
- Matemática: 74.0
- Conhecimento: 76.2
- Escrita: 72.2
- Instruções: 47.4
- Conversa e IE: 41.5
- Negócios: 82.8
- Japonês: 80.3
- Visão: 6.0
- Contexto longo: 47.9