Llama 3.3 70B: benchmarks y ranking
Llama 3.3 70B (Meta) — puesto general: #132 / 138, puntuación general: 13.0 (Intervalo del 90 % 7.0–22.9), leaderboards: 2. Lanzamiento: 2024-12-06 · Precio (entrada/salida): $0.71 / $0.72
Puesto en cada leaderboard
| Leaderboard | Puesto | Valor publicado |
|---|---|---|
| Artificial Analysis | Sin evaluar | — |
| LiveBench | Sin evaluar | — |
| Epoch AI | #144 / 239 | 127.32 |
| ARC Prize (ARC-AGI) | Sin evaluar | — |
| Scale AI SEAL | Sin evaluar | — |
| Vals AI | Sin evaluar | — |
| Terminal-Bench | Sin evaluar | — |
| EQ-Bench | Sin evaluar | — |
| SimpleBench | #92 / 99 | 19.9 |
| BenchLM.ai | Sin evaluar | — |
Puntuación por área
- Programación: 16.5
- Razonamiento: 11.1
- Matemáticas: 17.6
- Conocimiento: 30.5
- Escritura: 20.2
- Instrucciones: 8.7
- Chat e IE: 8.9
- Negocios: 43.0
- Japonés: 29.7