Claude Opus 4.6: benchmarks e ranking
Claude Opus 4.6 (Anthropic) — posição geral: #32 / 138, pontuação geral: 74.8 (Intervalo de 90% 70.2–78.9), leaderboards: 7. Lançamento: 2025-12-17 · Preço (entrada/saída): $5 / $25
Posição em cada leaderboard
| Leaderboard | Posição | Valor publicado |
|---|---|---|
| Artificial Analysis | Não avaliado | — |
| LiveBench | #37 / 60 | 74.5 |
| Epoch AI | #25 / 239 | 155.36 |
| ARC Prize (ARC-AGI) | #19 / 79 | 69.2 |
| Scale AI SEAL | #10 / 42 | 34.44 |
| Vals AI | Não avaliado | — |
| Terminal-Bench | Não avaliado | — |
| EQ-Bench | #13 / 28 | 1222.7 |
| SimpleBench | #20 / 99 | 67.6 |
| BenchLM.ai | #20 / 74 | 63.64 |
Pontuação por área
- Programação: 71.9
- Agentes: 60.8
- Raciocínio: 81.4
- Matemática: 76.0
- Conhecimento: 84.1
- Escrita: 77.5
- Instruções: 48.5
- Conversa e IE: 51.3
- Negócios: 85.9
- Japonês: 86.7
- Visão: 44.8
- Contexto longo: 86.1