مفتوح المصدر 🇺🇸 27.07.2026 09:06

جميع نتائج تقييم الذكاء الاصطناعي التي أُجريت على الإطلاق موجودة الآن على صفحات نماذج Hugging Face

Hugging FaceHugging Face MetaMeta
مشروع EEE (كل تقييم تم إجراؤه على الإطلاق) ومنصة Community Evals من Hugging Face تعاونا لتوحيد تقارير تقييم الذكاء الاصطناعي. يمكن للمطورين الآن إرسال النتائج بتنسيق JSON موحد، وتعرض صفحات النماذج بيانات موثقة مرتبطة ببروتوكول التقييم الكامل.
في فبراير 2026، انطلق مشروع EEE (Every Eval Ever) ضمن تحالف EvalEval، وهو أول مبادرة متعددة المنظمات لتحسين الإبلاغ عن تقييمات الذكاء الاصطناعي. بالتزامن، أطلقت Hugging Face خدمة Community Evals لعرض المعايير بشكل لامركزي على المنصة. سابقًا، كانت نتائج التقييمات متفرقة: تُنشر في المقالات، جداول المتصدرين، المدونات والسجلات، غالبًا بتنسيقات مختلفة، وقد تعطي نفس النموذج على نفس المعيار درجات مختلفة (مثل نموذج LLaMA 65B الذي حصل على 63.7 و48.8 في MMLU) بسبب إعدادات غير موثقة. يقدم EEE مخطط JSON موحد لتسجيل نتيجة التقييم، يتضمن بيانات عن من أجرى التقييم، أي نموذج، طريقة الوصول، إعدادات التوليد ووصف المقياس. يحتوي مستودع EEE على Hugging Face بالفعل على حوالي 229 ألف نتيجة لأكثر من 22 ألف نموذج و2.2 ألف معيار، مستخرجة من 31 تنسيق تقرير. الآن، يحول المحول تلقائيًا سجلات EEE إلى ملفات YAML المطلوبة من Hugging Face Community Evals ويرسلها. تحصل النتائج على صفحات النماذج على علامة تحقق (verified checkmark) من EvalEval إذا تم إرسال البيانات عبر حساب رسمي للمنظمة. يطابق المحول الحقول، ويتحقق من النتائج الموجودة، وينشئ طلب سحب (PR) فقط بعد تأكيد المستخدم. يتم دعم المعايير MMLU-Pro وGPQA وHLE وGSM8K.
المصدر: Hugging Face blog — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة