Claude Sonnet 3.5: benchmarks y ranking
Claude Sonnet 3.5 (Anthropic) — puesto general: #118 / 138, puntuación general: 21.8 (Intervalo del 90 % 14.7–30.9), leaderboards: 2. Lanzamiento: 2024-06-01
Puesto en cada leaderboard
| Leaderboard | Puesto | Valor publicado |
|---|---|---|
| Artificial Analysis | Sin evaluar | — |
| LiveBench | Sin evaluar | — |
| Epoch AI | #125 / 239 | 133.55 |
| ARC Prize (ARC-AGI) | Sin evaluar | — |
| Scale AI SEAL | #40 / 42 | 4.08 |
| Vals AI | Sin evaluar | — |
| Terminal-Bench | Sin evaluar | — |
| EQ-Bench | Sin evaluar | — |
| SimpleBench | Sin evaluar | — |
| BenchLM.ai | Sin evaluar | — |
Puntuación por área
- Programación: 37.1
- Razonamiento: 24.0
- Matemáticas: 26.3
- Conocimiento: 45.2
- Escritura: 45.0
- Instrucciones: 28.0
- Chat e IE: 24.7
- Negocios: 54.6
- Japonés: 51.9
- Visión: 9.1