تصنيف نماذج الذكاء الاصطناعي — 11 لوحات تقييم مجتمعة

المرتبةالشركةالدرجة الإجماليةأفضل نموذجالنماذج
186.7Claude Opus 5.527
285.2GPT-6 Astra54
377.7Muse Spark 1.323
474.4Gemini 3.8 Flash33
572.7Grok 4.713
670.1MiMo-V2.6-Pro4
769.8Kimi K35
868.1Qwen3.8 Max46
967.8DeepSeek V4.1 Flash22
1066.0GLM-5.310
1153.3—2
1242.0Inkling2
1340.3MiniMax-M35
1432.7—5
1529.6Nemotron 3 Ultra 550B A55B9
1617.6Mistral 3.526
1716.7Phi-46
1815.8—3
1913.3Mercury 2.51
2012.9Command R3

نتيجة الشركة في كل موقع هي نتيجة أفضل نماذجها فيه.

الأسئلة الشائعة

ما هو ARBITER؟

تصنيف شامل لنماذج وشركات الذكاء الاصطناعي يجمع إحصائيًا بين 11 من أبرز لوحات تقييم الذكاء الاصطناعي.

كم مرة يُحدَّث؟

كل ساعة. وتُضاف تلقائيًا النماذج الجديدة من أي لوحة تقييم.

كيف تُحسب الدرجة الإجمالية؟

يُوحَّد المقياس الرئيسي لكل موقع، ثم يصحح نموذج عاملي الفروق بين المواقع ويقدّر القدرة المشتركة لكل نموذج.

هل تتضرر النماذج المقيَّمة في عدد أقل من لوحات التقييم؟

لا. لا يُعاقَب النموذج أبدًا على التقييمات الناقصة، بل يُعرض عدم اليقين كفاصل 90%.

ما أفضل نموذج ذكاء اصطناعي حاليًا؟

النموذج الأول في التصنيف الإجمالي. يعتمد الخيار الأفضل على استخدامك، لذا راجع أيضًا تصنيف المجالات.