الأبحاثتوليد الوسائط 🇷🇺 28.07.2026 08:04

مطوّرو نماذج الذكاء الاصطناعي: هل يقومون بتعظيم البجع؟

OpenAIOpenAI AnthropicAnthropic Google/DeepMindGoogle/DeepMind xAIxAI Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek
اختبر باحث سبعة نماذج حديثة للذكاء الاصطناعي باستخدام معيار غير رسمي شائع: توليد رسم SVG لبجعة على دراجة هوائية. تُظهر النتائج عدم وجود دليل على أن النماذج محسّنة لهذا المطلب المحدد، مما يعالج الشكوك حول تعظيم المعايير.
قام سايمون ويليسون باختبار إصدارات رئيسية من نماذج اللغة الكبيرة باستخدام المطالبة "قم بإنشاء SVG لطائر بجع على دراجة هوائية"، والتي أصبحت معيارًا غير رسمي معروفًا. وللتحقق مما إذا كانت مختبرات الذكاء الاصطناعي تشارك في "تعظيم البجع" (تحسين النماذج للمعايير الشائعة)، أجرى باحث تجربة. قاموا بتوليد 1008 صور SVG عبر سبعة نماذج: GPT-5.6 Terra، وClaude Sonnet 5، وGemini 3.5 Flash، وGrok 4.5، وQwen3.7-Max، وGLM-5.2، وDeepSeek V4 Pro، باستخدام 48 مطالبة (8 حيوانات × 6 مركبات). تم عرض كل SVG وتقييمه بواسطة حكم LLM. كشف التحليل عدم وجود دليل على أن صور البجع على دراجة هوائية حصلت على درجات أعلى من المتوقع، مما يشير إلى عدم وجود تحسين مستهدف لهذا المعيار.
المصدر: Habr — хаб ИИ — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة