نصك فشل في كاشف الذكاء الاصطناعي: تجربة مع نصوص باللغة الروسية

AnthropicAnthropic Moonshot AIMoonshot AI OpenAIOpenAI DeepSeekDeepSeek СберСбер ЯндексЯндекс Text.ruText.ru GPTZeroGPTZero
اختبرت تجربة أربعة كاشفات للذكاء الاصطناعي ضد نصوص تم توليدها بواسطة ستة نماذج لغوية كبيرة ونصوص مكتوبة بواسطة بشر باللغة الروسية. أظهرت النتائج أن الكاشفات تواجه صعوبة في التعامل مع النصوص القصيرة ولديها 'نقاط عمياء' لبعض النماذج. يناقش المقال المبادئ الكامنة وراء كشف الذكاء الاصطناعي والجدل المحيط بدقته.
تتناول مقالة من محور الذكاء الاصطناعي في هبر صعود المحتوى المُولَّد بالذكاء الاصطناعي وانتشار أدوات كشف الذكاء الاصطناعي. وتشير إلى دراسة أجرتها جرافيت أظهرت أنه في نوفمبر 2024، فاقت النصوص المُولَّدة بالذكاء الاصطناعي تلك التي كتبها البشر، مع دراسة محدّثة في ربيع 2026 تدّعي التكافؤ. يصف المؤلف كيفية عمل أدوات الكشف النموذجية، مستشهدًا بنيوروديتيكتور من ياندكس وكاشف الذكاء الاصطناعي من تيكست.رو كأمثلة، ويذكر أن أوبن إيه آي أوقفت تشغيل مصنّفها في عام 2023 بسبب دقته المنخفضة. يدّعي جيغاتشيك من سبير، المبني على نموذج ميسترال مضبوط بدقة، دقة تبلغ 94.7٪. استخدمت التجربة أربعة أدوات كشف (نيوروديتيكتور من ياندكس، جيغاتشيك، كاشف الذكاء الاصطناعي من تيكست.رو، جي بي تي زيرو) وستة نماذج لغوية كبيرة (كلود أوبوس 5، كيمي كي 3، جي بي تي-5.6 سول، جي إل إم 5.2، دييب سيك في 4 برو، جيغاتشات 3.5 ألترا). وخدمت ثلاثة نصوص كتبها بشر حول البانغرامات، نُشرت قبل عام 2021، كمجموعة ضابطة. ولّدت النماذج نصوصًا ذات أطوال متشابهة، وفُحصت جميع النصوص مرة واحدة بواسطة كل كاشف. طُبّعت النتائج في فئتي ذكاء اصطناعي/بشري. يقرّ المؤلف بوجود قيود: عينة صغيرة، وتشغيل واحد، وتاريخ 27 يوليو 2026. تشير النتائج إلى أن النصوص الأطول تُصنَّف بدقة أكبر، بينما تسبب النصوص القصيرة مزيدًا من الأخطاء. ومن الجدير بالذكر أن نيوروديتيكتور من ياندكس صنّف ثلاثة نصوص من كلود أوبوس 5 خطأً على أنها بشرية، وأن تيكست.رو ميّزت نصوص جي بي تي-5.6 سول خطأً على أنها بشرية، مما يشير إلى وجود 'بقع عمياء'. تمتنع المقالة عن التوصية بأي كاشف.
المصدر: Habr — хаб ИИ — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة