النماذجالأعمال والسوق 🇷🇺 27.07.2026 04:03

توفير في النماذج اللغوية الكبيرة: نموذج صيني بدأ فجأة في كتابة الحروف الصينية

TencentTencent DeepSeekDeepSeek
قرر مطور بوت إخباري ثنائي اللغة التبديل إلى نموذج ذكاء اصطناعي أرخص: نموذج Ling 2.6 Flash من شركة Inclusion AI يكلف 8 مرات أقل من نموذج DeepSeek V4 Flash ويعمل أسرع 4 مرات. ومع ذلك، بعد ساعة من الاستخدام، ظهرت الحروف الصينية في الخلاصة: كان النموذج يعود بشكل دوري إلى لغته الأم الصينية، خاصة في التوليدات الطويلة. تم حل المشكلة بإضافة كاشف للحروف الصينية مع إعادة استعلام إلى النموذج النظيف.
مؤلف الخبر يدير خلاصة أخبار ثنائية اللغة، حيث تمر كل خبر عبر LLM (حوالي 936 استدعاءً يوميًا) للتصنيف والترجمة والتحليل اللغوي وتحليل النبرة. بهدف التوفير، جرب النماذج المجانية من OpenRouter، لكن معظمها كان غير متاح بسبب سياسات البيانات، بينما كانت النماذج العاملة بطيئة جدًا. ثم اختبر النموذج المدفوع الرخيص inclusionai/ling-2.6-flash (0.010 دولار لكل مليون رمز إدخال مقابل 0.098 دولار لنموذج deepseek-v4-flash). على الاستدعاءات الحقيقية، أظهر جودة مماثلة (4/4 في التصنيف، 6/6 في التحليل)، وسرعة 2.4 ثانية (مقابل 10 ثوانٍ)، وكان أرخص 8 مرات. لكن بعد ساعة، ظهر في الخلاصة عنوان يحتوي على حروف صينية وعلامات ترقيم. تبين أن النموذج صيني: في المخرجات القصيرة، ظهرت الحروف الصينية في 17% من الحالات، وفي التحليلات الطويلة بنسبة 57%، بينما لم يرتكب DeepSeek V4 Flash أي أخطاء. أضاف المؤلف كاشفًا للحروف الصينية (تعبيرًا منتظمًا لرموز CJK) وإعادة استدعاء للنموذج "النظيف" DeepSeek V4 Flash، مما قلل التسريبات إلى الصفر. الآن السلسلة كالتالي: Ling 2.6 Flash هو الأساسي، DeepSeek V4 Flash ينظف الحروف الصينية، وGemma:free كاحتياطي في حال فشل المزود. التوفير النهائي يبلغ حوالي 8.6 دولار شهريًا مقابل 14.8 دولار عند استخدام DeepSeek وحده، لكنه كان أقل من المتوقع بسبب الدفع المزدوج لـ57% من التحليلات الطويلة. الاستنتاج الرئيسي: نموذج رخيص قد يكون ممتازًا وفق المقاييس المقاسة، لكنه يفشل حيث لم يفكر المؤلف في التحقق - في هذه الحالة، لغة الرد.
المصدر: Habr — хаб ML — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة