Llama 3.1 405B: benchmarks y ranking
Llama 3.1 405B (Meta) — puesto general: #127 / 138, puntuación general: 15.1 (Intervalo del 90 % 8.2–26.2), leaderboards: 2. Lanzamiento: 2024-07-23
Puesto en cada leaderboard
| Leaderboard | Puesto | Valor publicado |
|---|---|---|
| Artificial Analysis | Sin evaluar | — |
| LiveBench | Sin evaluar | — |
| Epoch AI | #140 / 239 | 128.76 |
| ARC Prize (ARC-AGI) | Sin evaluar | — |
| Scale AI SEAL | Sin evaluar | — |
| Vals AI | Sin evaluar | — |
| Terminal-Bench | Sin evaluar | — |
| EQ-Bench | Sin evaluar | — |
| SimpleBench | #86 / 99 | 23 |
| BenchLM.ai | Sin evaluar | — |
Puntuación por área
- Razonamiento: 15.5
- Matemáticas: 18.5
- Conocimiento: 32.9
- Escritura: 14.0