نماذج الذكاء الاصطناعي مفتوحة الوزن تلحق بالرائدة، لكن فجوة السلامة لا تزال قائمة

OpenAIOpenAI AnthropicAnthropic xAIxAI Google DeepMindGoogle DeepMind
تقرير جديد من منظمة SaferAI غير الربحية للسلامة في الذكاء الاصطناعي يجد أن النموذج الصيني مفتوح الوزن GLM-5.2 يتخلف عن النماذج الرائدة ببضعة أشهر فقط في القدرات السيبرانية والبيولوجية، لكنه يفتقر إلى الحماية الأمنية. بينما ترفض النماذج الرائدة مثل Claude Opus 4.7 معظم المهام الضارة، لم يرفض GLM-5.2 أيًا منها، مما يسلط الضوء على فجوة السلامة المتزايدة في الذكاء الاصطناعي مفتوح الوزن.
أظهر تقييم شركة SaferAI لنموذج Z.ai مفتوح الأوزان GLM-5.2 أنه لم يرفض أيًا من المهام المتعلقة بالهجوم السيبراني أو علم الأحياء ثنائي الاستخدام، بينما رفض نموذج Claude Opus 4.7 من شركة Anthropic هذه المهام بشكل متسق لدرجة أن SaferAI لم تتمكن من إكمال معيار CyberGym. يعتمد مطورو النماذج الرائدة على إجراءات حماية مثل المصنفات والتدريب على الرفض، لكن هذه الإجراءات لا تنطبق على النماذج مفتوحة الأوزان التي يمكن للمستخدمين تعديلها بحرية. وأكد المدير التنفيذي لشركة SaferAI، هنري باباداتوس، أن القدرة ليست هي نفسها المخاطر، وأنه يجب النظر في إجراءات السلامة. واقترح أن تصفية بيانات ما قبل التدريب قد تساعد، على الرغم من أنها أقل عملية بالنسبة للأمن السيبراني. يقيّد نموذج Opus 5 من Anthropic بشكل انتقائي بعض المساعدة المتعلقة بالأمن السيبراني، مثل عدم البحث عن ثغرات في البرامج المترجمة. وأشارت SaferAI إلى أن Z.ai لم تنشر إطارًا للسلامة أو تقييمًا للمخاطر لنموذج GLM-5.2. تركز سياسة الذكاء الاصطناعي الصينية على المحتوى السياسي أكثر من المخاطر الكارثية، وفقًا لغراهام ويبستر من جامعة ستانفورد. يجادل المؤيدون بأن الأوزان المفتوحة تساعد في الدفاع، كما استخدمت Hugging Face نموذج GLM-5.2 ضد اختراق OpenAI، لكن باباداتوس يعتقد أن القدرات الخطيرة لا ينبغي أن تكون مفتوحة المصدر.
المصدر: TechCrunch AI — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة