性能と価格
左上ほど安くて高性能。点をクリックすると詳細を表示。
| 順位 | モデル | 総合スコア | Artificial Analysis | LiveBench | Epoch AI | ARC-AGI | Scale SEAL | Vals AI | Terminal-Bench | EQ-Bench | SimpleBench | BenchLM |
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 1 | Anthropic | 92.5 | 1位 | 2位 | — | 2位 | — | 1位 | — | — | 1位 | — |
| 2 | OpenAI | 92.2 | 3位 | 4位 | 1位 | 1位 | 1位 | 4位 | 1位 | — | 4位 | 1位 |
| 3 | Anthropic | 91.7 | 2位 | 1位 | 2位 | 5位 | 2位 | 2位 | 2位 | — | 2位 | 2位 |
| 4 | Anthropic | 90.6 | 5位 | 3位 | 3位 | 6位 | — | 5位 | 4位 | 2位 | — | 4位 |
| 5 | Anthropic | 90.3 | 4位 | 9位 | 4位 | 4位 | — | 3位 | 3位 | 1位 | 8位 | 3位 |
| 6 | Meta | 89.0 | 6位 | 5位 | 15位 | — | — | 6位 | — | — | 7位 | — |
| 7 | OpenAI | 88.0 | 8位 | 6位 | 6位 | 3位 | — | 7位 | 7位 | 9位 | 23位 | 5位 |
| 8 | OpenAI | 86.9 | — | — | 5位 | 9位 | — | — | — | — | 10位 | — |
| 9 | OpenAI | 86.5 | 7位 | 11位 | — | — | — | 8位 | — | — | 15位 | — |
| 10 | OpenAI | 85.2 | — | — | 9位 | 13位 | — | — | — | — | — | — |
| 11 | Xiaomi | 85.2 | 10位 | — | — | — | — | 16位 | — | — | — | — |
| 12 | DeepSeek | 84.7 | 22位 | 6位 | 28位 | — | — | 20位 | — | — | 21位 | — |
| 13 | xAI | 84.6 | 9位 | 19位 | — | — | — | 11位 | 6位 | — | — | — |
| 14 | OpenAI | 84.4 | 25位 | 8位 | 8位 | 8位 | — | 22位 | — | 4位 | 19位 | 12位 |
| 15 | Google | 83.3 | 19位 | 31位 | 13位 | 6位 | 4位 | 9位 | 11位 | — | 5位 | 6位 |
| 16 | Moonshot AI | 83.3 | 15位 | 11位 | 12位 | 24位 | — | 21位 | — | 3位 | 33位 | 8位 |
| 17 | Alibaba (Qwen) | 82.5 | 11位 | 14位 | 26位 | — | — | 33位 | — | — | — | 9位 |
| 18 | xAI | 82.4 | 13位 | 15位 | 18位 | 20位 | — | 18位 | 10位 | — | 13位 | 11位 |
| 19 | Google | 82.1 | 23位 | 13位 | 11位 | 9位 | — | 17位 | 15位 | — | — | 14位 |
| 19 | OpenAI | 82.1 | — | 15位 | 14位 | 16位 | — | — | — | 7位 | — | 13位 |
| 21 | OpenAI | 82.1 | 16位 | 18位 | 7位 | 12位 | — | 13位 | 9位 | 11位 | 53位 | 7位 |
| 22 | Meta | 82.0 | 21位 | 15位 | 27位 | — | — | 23位 | — | — | 14位 | — |
| 22 | Z.ai (Zhipu) | 82.0 | 12位 | 28位 | 22位 | — | — | 24位 | 5位 | — | 22位 | — |
| 24 | Anthropic | 81.4 | 17位 | 26位 | 10位 | 17位 | — | 10位 | 8位 | 6位 | 23位 | 10位 |
| 25 | Anthropic | 80.1 | — | 25位 | 19位 | 15位 | 9位 | 25位 | — | 5位 | 26位 | — |
| 26 | Alibaba (Qwen) | 78.7 | 20位 | 26位 | — | — | — | — | — | — | — | — |
| 27 | Anthropic | 77.8 | 26位 | 30位 | 20位 | — | — | 13位 | 13位 | 10位 | 34位 | 15位 |
| 28 | Google | 77.3 | 39位 | 22位 | 29位 | 14位 | 3位 | 41位 | — | 21位 | 9位 | — |
| 29 | DeepSeek | 76.1 | 29位 | 19位 | 24位 | 23位 | — | 32位 | — | 18位 | 51位 | — |
| 30 | Meta | 76.0 | 33位 | 33位 | 33位 | — | — | 28位 | — | 8位 | — | 16位 |
| 31 | xAI | 75.5 | 24位 | 31位 | 34位 | 32位 | — | 34位 | 13位 | — | 18位 | 18位 |
| 32 | Anthropic | 74.8 | — | 37位 | 25位 | 19位 | 10位 | — | — | 13位 | 20位 | 20位 |
| 33 | Meta | 74.2 | — | — | 39位 | — | 6位 | — | — | — | — | 27位 |
| 34 | Google | 74.0 | 36位 | 35位 | 30位 | 17位 | — | 30位 | — | 24位 | 11位 | 21位 |
| 35 | DeepSeek | 74.0 | 31位 | 38位 | 31位 | 22位 | — | 29位 | — | — | 31位 | — |
| 36 | OpenAI | 73.8 | 27位 | 40位 | 21位 | 28位 | — | 12位 | 12位 | 19位 | 55位 | 17位 |
| 37 | Google | 73.7 | 32位 | 40位 | 32位 | 24位 | — | 26位 | — | — | — | 19位 |
| 38 | Alibaba (Qwen) | 73.5 | 33位 | 33位 | — | — | — | 36位 | — | — | — | — |
| 39 | OpenAI | 73.5 | 27位 | 46位 | — | 29位 | — | 19位 | — | — | — | — |
| 40 | Google | 70.4 | — | — | 37位 | 37位 | 7位 | — | — | — | 12位 | 26位 |
| 41 | OpenAI | 70.0 | — | — | 16位 | — | — | — | — | — | — | 24位 |
| 42 | OpenAI | 69.9 | — | 35位 | — | — | 12位 | — | — | — | — | — |
| 43 | Z.ai (Zhipu) | 69.7 | 17位 | 48位 | 41位 | — | — | 37位 | — | — | — | — |
| 44 | OpenAI | 69.5 | — | — | 23位 | 30位 | — | — | — | — | 41位 | — |
| 45 | Anthropic | 68.8 | 38位 | 44位 | 38位 | 24位 | — | 35位 | — | 16位 | — | 30位 |
| 46 | Z.ai (Zhipu) | 68.6 | 33位 | 42位 | 43位 | 38位 | — | 30位 | — | 14位 | 38位 | 23位 |
| 47 | Alibaba (Qwen) | 66.2 | 40位 | 43位 | 35位 | — | — | 38位 | — | 23位 | — | 22位 |
| 48 | Alibaba (Qwen) | 65.8 | — | — | 53位 | — | — | — | — | — | 25位 | — |
| 49 | OpenAI | 65.2 | — | — | 36位 | 31位 | — | — | — | — | 58位 | 25位 |
| 50 | Alibaba (Qwen) | 63.4 | — | — | 52位 | — | — | — | — | — | 36位 | — |
11の権威あるAIリーダーボードを統計的に統合した、AIモデルとAI企業の総合ランキングです。
毎時です。どのリーダーボードに新しいモデルが載っても自動で追加されます。
各サイトの主指標を標準化し、因子モデルでサイト間の違いを補正して、各モデルに共通する能力を推定しています。
いいえ。未評価による減点はありません。代わりに不確かさを90%区間で表示します。
総合ランキング1位のモデルです。最適な選択は用途によって異なるため、分野別ランキングもご確認ください。