سلامة الذكاء الاصطناعي RSS

جوجل ديبمايند تكشف عن Gemini 3.5 Flash Cyber — نموذج خفيف للأمن السيبراني

أعلنت جوجل ديبمايند عن Gemini 3.5 Flash Cyber، وهو نموذج متخصص مبني على 3.5 Flash، تم ضبطه بدقة للبحث عن الثغرات والتحقق منها وإصلاحها. سيتاح النموذج من خلال برنامج تجريبي محدود للحكومات والشركاء الموثوقين للتخفيف الاستباقي للثغرات الحرجة.

Google/DeepMindGoogle/DeepMind Google DeepMindGoogle DeepMind
Google DeepMind24.07 · 11:04

حقن الأوامر لا يمكن علاجه بواسطة المرشحات: كيفية عزل النص غير الموثوق باستخدام الأنماط المعمارية

حقن الأوامر هو عيب هيكلي في نماذج اللغة الكبيرة حيث يتم تنفيذ النص غير الموثوق كتعليمات. المرشحات وأوامر النظام غير فعالة: حتى أفضل الدفاعات يتم اختراقها في 90٪ من الحالات تحت الهجمات التكيفية. الأساليب العاملة - Dual-LLM و CaMeL وقاعدة Two Meta - تبني العزل بدلاً من محاولة التمييز بين الخير والشر.

OpenAIOpenAI AnthropicAnthropic Google DeepMindGoogle DeepMind MicrosoftMicrosoft
Habr — хаб ИИ24.07 · 11:01
أخبار جديدة