اختبارات الذكاء الاصطناعي: شرح

حُدِّث في أغسطس 2026.

نموذج اللغة الكبير هو نظام ذكاء اصطناعي دُرّب على كميات ضخمة من النصوص لفهم اللغة وتوليدها.

**كيف يعمل:** نموذج اللغة الكبير هو نظام ذكاء اصطناعي دُرّب على كميات ضخمة من النصوص لفهم اللغة وتوليدها. تحقق من القدرات الحالية عبر التصنيف المباشر وصفحة المنهجية.

**المفاهيم الأساسية:** - يقيس MMLU المعرفة الأكاديمية. - يقيس HumanEval توليد الشيفرة. - يقيس GPQA الاستدلال العلمي. - يقيس MATH حل المسائل الرياضية. - يقيس Arena Elo تفضيلات البشر.

**الاستخدامات العملية:** - مقارنة النماذج في المهام المناسبة - عدم الاعتماد على معيار واحد - فحص الأداء في الواقع

تحقق من القدرات الحالية عبر التصنيف المباشر وصفحة المنهجية.