KI-Modell-Rangliste — 11 Leaderboards vereint

Häufige Fragen

Was ist ARBITER?

Eine Gesamtrangliste von KI-Modellen und -Anbietern, die 11 maßgebliche KI-Leaderboards statistisch vereint.

Wie oft wird aktualisiert?

Stündlich. Neue Modelle aus jedem Leaderboard werden automatisch hinzugefügt.

Wie wird der Gesamtwert berechnet?

Die Hauptmetrik jeder Seite wird standardisiert; anschließend gleicht ein Faktormodell die Unterschiede zwischen den Seiten aus und schätzt die gemeinsame Fähigkeit jedes Modells.

Sind Modelle mit weniger Leaderboards benachteiligt?

Nein. Fehlende Bewertungen werden nie bestraft. Stattdessen wird die Unsicherheit als 90-%-Intervall angezeigt.

Welches KI-Modell ist derzeit das beste?

Das Modell auf Platz 1 der Gesamtrangliste. Die beste Wahl hängt vom Einsatzzweck ab – sehen Sie sich daher auch die Bereichsranglisten an.