بحث جوجل: منهجية جديدة لتقييم 'المهارات المستقبلية' باستخدام الذكاء الاصطناعي التوليدي
Google/DeepMind
قدم فريق بحث جوجل، بالتعاون مع جامعة نيويورك، تجربة البحث Vantage التي تستخدم الذكاء الاصطناعي التوليدي لتقييم 'المهارات المستقبلية' مثل التفكير النقدي والتعاون. أظهرت النتائج أن تقييمات الذكاء الاصطناعي مماثلة لتقييمات الخبراء البشر. Vantage متاح على Google Labs.
قدمت جوجل ريسيرش (Google Research) نموذج فانتاج (Vantage)، وهو تجربة بحثية لتقييم "مهارات المستقبل" باستخدام الذكاء الاصطناعي التوليدي. تم تطويره بالشراكة مع معلمين وباحثين من جامعة نيويورك (New York University)، وهو مصمم لطلاب المدارس الثانوية والكليات. تحاكي المنصة محادثات مع شخصيات ذكاء اصطناعي في بيئة خاضعة للرقابة. يدخل المستخدمون في سيناريوهات مفتوحة، مثل التحضير لمناظرة أو تقديم فكرة إبداعية. يقوم نموذج اللغة التنفيذي (Executive Large Language Model) بتحليل سير المحادثة ديناميكيًا وإدخال تحديات معينة - مثل الاعتراضات والصراعات - للحصول على معلومات كافية للتقييم. عند الانتهاء من المهمة، يدرس محلل الذكاء الاصطناعي النص ويصدر درجات بناءً على معايير تربوية، مما يوفر للمستخدم مقياسًا بصريًا للمهارات وتغذية راجعة نوعية. في دراسة مشتركة مع 188 متطوعًا (تتراوح أعمارهم بين 18 و25 عامًا في الولايات المتحدة)، تمت مقارنة تقييمات محلل الذكاء الاصطناعي بتقييمات خبراء من جامعة نيويورك. اتساق النتائج بين الذكاء الاصطناعي والخبراء كان مماثلاً للاتساق بين خبيرين بشريين. كما أجريت دراسة مع شركة أوبن مايك (OpenMic) حيث قام محلل الذكاء الاصطناعي بتقييم الأعمال الإبداعية لـ 180 طالبًا (مقابلات مع شخصيات، مقالات) - وكان الارتباط مع تقييمات الخبراء مرتفعًا. أصبح فانتاج الآن متاحًا للتسجيل على جوجل لابز (Google Labs) ويعمل حاليًا باللغة الإنجليزية. يخطط المطورون لإجراء مزيد من الأبحاث حول قابلية نقل المهارات من المحاكاة إلى التفاعلات الواقعية، وكذلك تقييم فعالية الممارسة في البيئات المحاكاة.
المصدر: Google Research —
الأصلي
