AI मॉडल रैंकिंग — 11 लीडरबोर्ड एक साथ

रैंकिंग कैसे बनती है

  1. संग्रह — नीचे दिए 11 लीडरबोर्ड से हर घंटे आधिकारिक डेटा लिया जाता है। अनुमानित स्कोर उपयोग नहीं किए जाते।
  2. मिलान — एक ही मॉडल के अलग-अलग नाम मिलाए जाते हैं। रीज़निंग स्तर जैसे वेरिएंट के लिए हर साइट का सबसे अच्छा परिणाम लिया जाता है।
  3. मानकीकरण — हर साइट के मुख्य मेट्रिक को उसी साइट के भीतर मानकीकृत किया जाता है, ताकि केवल रैंक नहीं बल्कि स्कोर का अंतर भी बना रहे।
  4. समतुल्यता — कई साइटों पर मौजूद मॉडलों को पुल बनाकर एक फ़ैक्टर मॉडल हर साइट की कठिनाई और मॉडल संरचना को सुधारता है। ज़्यादा शोर वाली साइटों का भार कम होता है।
  5. न मिले डेटा पर कोई दंड नहीं — मॉडल को केवल उन्हीं साइटों से स्कोर मिलता है जिन्होंने उसे रेट किया। अनिश्चितता 90% अंतराल के रूप में दिखाई जाती है। 2+ साइटों पर रेट किए गए मॉडल रैंक होते हैं।
  6. Arena — Arena (पहले LMArena) केवल क्षेत्र रैंकिंग में उपयोग होता है, कुल स्कोर में नहीं। नए मॉडल अपने आप जुड़ते हैं।

अक्सर पूछे जाने वाले प्रश्न

ARBITER क्या है?

AI मॉडल और कंपनियों की एक कुल रैंकिंग, जो 11 प्रामाणिक AI लीडरबोर्ड को सांख्यिकीय रूप से मिलाती है।

यह कितनी बार अपडेट होती है?

हर घंटे। किसी भी लीडरबोर्ड पर आए नए मॉडल अपने आप जुड़ जाते हैं।

कुल स्कोर की गणना कैसे होती है?

हर साइट के मुख्य मेट्रिक को मानकीकृत किया जाता है, फिर एक फ़ैक्टर मॉडल साइटों के बीच के अंतर को सुधारकर हर मॉडल की साझा क्षमता का अनुमान लगाता है।

क्या कम लीडरबोर्ड पर रेट किए गए मॉडल को नुकसान होता है?

नहीं। न मिली रेटिंग पर कभी अंक नहीं कटते। इसके बजाय अनिश्चितता 90% अंतराल के रूप में दिखाई जाती है।

इस समय सबसे अच्छा AI मॉडल कौन सा है?

कुल रैंकिंग में #1 मॉडल। सबसे अच्छा विकल्प आपके उपयोग पर निर्भर करता है, इसलिए क्षेत्र रैंकिंग भी देखें।