ورقة بحثية سنوية في الذكاء الاصطناعي: آليات مكافحة التقطير لنماذج رائدة ثلاث انكسرت، ونماذج صغيرة تستخرج سلاسل الاستدلال الخفية، وشذوذ تكرار كيمي-كي3
Moonshot AI
تدعي ورقة بحثية أكاديمية جديدة أنها كسرت آليات مكافحة التقطير لأفضل ثلاثة نماذج ذكاء اصطناعي في العالم، مما يسمح لنماذج صغيرة باستخراج سلاسل الاستدلال الخفية. وقد تم إعادة إنتاج الشذوذ مع كيمي-كي3.
كشفت ورقة بحثية سنوية في مجال الذكاء الاصطناعي (AI) عن اختراق شامل لآليات الدفاع ضد تقطير النماذج في ثلاثة من النماذج الرائدة في مجال الذكاء الاصطناعي. وأظهر الباحثون أن النماذج الصغيرة قادرة على استخراج سلسلة الأفكار المخفية من النماذج الأكبر حجمًا بفاعلية، مما يقوّض وسائل الحماية المصممة لمنع مثل هذا الاستخراج. وقد أُعيد إنتاج هذه الظاهرة مع حدوث خلل احتمالي شمل نموذج Kimi-K3، وهو نموذج من تطوير Moonshot AI. ويثير هذا التطور مخاوف بشأن أمن أنظمة الذكاء الاصطناعي المتقدمة وملكيتها الفكرية.
المصدر: Moonshot Kimi (GNews) —
الأصلي
