KI-Modell-Rangliste — 11 Leaderboards vereint

RangAnbieterGesamtwertBestes ModellModelle
186.7Claude Opus 5.527
285.2GPT-6 Astra54
377.7Muse Spark 1.323
474.4Gemini 3.8 Flash33
572.7Grok 4.713
670.1MiMo-V2.6-Pro4
769.8Kimi K35
868.1Qwen3.8 Max46
967.8DeepSeek V4.1 Flash22
1066.0GLM-5.310
1153.3—2
1242.0Inkling2
1340.3MiniMax-M35
1432.7—5
1529.6Nemotron 3 Ultra 550B A55B9
1617.6Mistral 3.526
1716.7Phi-46
1815.8—3
1913.3Mercury 2.51
2012.9Command R3

Das Ergebnis eines Anbieters auf jeder Seite ist das seines dort besten Modells.

Häufige Fragen

Was ist ARBITER?

Eine Gesamtrangliste von KI-Modellen und -Anbietern, die 11 maßgebliche KI-Leaderboards statistisch vereint.

Wie oft wird aktualisiert?

Stündlich. Neue Modelle aus jedem Leaderboard werden automatisch hinzugefügt.

Wie wird der Gesamtwert berechnet?

Die Hauptmetrik jeder Seite wird standardisiert; anschließend gleicht ein Faktormodell die Unterschiede zwischen den Seiten aus und schätzt die gemeinsame Fähigkeit jedes Modells.

Sind Modelle mit weniger Leaderboards benachteiligt?

Nein. Fehlende Bewertungen werden nie bestraft. Stattdessen wird die Unsicherheit als 90-%-Intervall angezeigt.

Welches KI-Modell ist derzeit das beste?

Das Modell auf Platz 1 der Gesamtrangliste. Die beste Wahl hängt vom Einsatzzweck ab – sehen Sie sich daher auch die Bereichsranglisten an.