الأبحاثالتطبيقات 🇷🇺 03.08.2026 12:01

نسخ طلبك مرتين: اختبرت خدعة '+76٪' واكتشفت الحقيقة

Google/DeepMindGoogle/DeepMind
تزعم خدعة فيروسية أن تكرار طلبك إلى نموذج اللغة الكبير يعزز الدقة بنسبة 76%. اختبار هذا على 3360 استعلامًا عبر عدة نماذج من Gemini كشف أن التأثير حقيقي لكنه محدود: فهو يصلح فشلًا محددًا للنماذج غير الاستدلالية مع القوائم الطويلة، وليس تعزيزًا عامًا للذكاء. النسبة الشهيرة +76٪ هي اختبار إجهاد واحد، والنماذج الاستدلالية الحديثة محصنة ضد هذه الخدعة.
اختبر المؤلف خدعة تكرار المطالبة الفيروسية المشار إليها في ورقة بحثية أولية من Google Research بعنوان 'تكرار المطالبة يحسن نماذج اللغات الكبيرة غير الاستدلالية'. في الأصل، ساعد تكرار المطالبة النماذج غير الاستدلالية في 47 من أصل 70 مقارنة، مع وصول نسبة التحسن البالغة +76% إلى اختبار إجهاد واحد على نموذج Gemini 2.0 Flash-Lite، الذي تم إيقافه منذ ذلك الحين. أجرى المؤلف تجربته الخاصة: 3360 استعلامًا، بتكلفة 1.48 دولارًا، على نموذجي gemini-2.5-flash-lite (مع إيقاف التفكير) وgemini-3.5-flash-lite (مع تفكير أدنى وتفكير عالٍ). في مجموعة اختبار الإجهاد (مهمتا NameIndex وMiddleMatch)، أدى تكرار المطالبة إلى تحسين الدقة بنسبة +38.8 نقطة مئوية على نموذج 2.5، مما يعيد إنتاج التأثير الأصلي، لكن لم يكن له أي تأثير على المهام اليومية. إضافة نسخة ثالثة أدت إلى زيادة بنسبة +5 نقاط مئوية فقط، ولم يحدث إضافة علامة مثل 'كرر:' أي فرق. على نموذج 3.5 مع تفكير أدنى، استمر التأثير (+36.3 نقطة مئوية)، لكن مع تفكير عالٍ، كانت الدقة بالفعل 100% مع كلتا المطالبتين. كما ساعدت الخدعة في تثبيت نموذج غير حتمي. ومع ذلك، يلاحظ المؤلف أن الخدعة تعالج تحديدًا أخطاء الانتباه على القوائم الطويلة، وليس الحساب أو العجز الاستدلالي الآخر، وينصح بالحذر: النتائج مقصورة على معرّفات نماذج وتواريخ محددة، ومجموعة البيانات ذاتية الصنع.
المصدر: Habr — хаб ИИ — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة