النماذجمفتوح المصدر 🇺🇸 27.07.2026 12:03

جوجل ديب مايند تطلق Gemma 4 12B: نموذج متعدد الوسائط موحد بدون مشفرات

Google/DeepMindGoogle/DeepMind Google DeepMindGoogle DeepMind
أعلنت جوجل ديب مايند عن Gemma 4 12B، وهو نموذج مضغوط متعدد الوسائط قادر على معالجة النصوص والصور والصوت بدون مشفرات منفصلة. يعمل النموذج على أجهزة كمبيوتر محمولة عادية بذاكرة وصول عشوائي (RAM) سعة 16 جيجابايت، ويتفوق على العديد من الحلول من حيث الأداء، وهو متاح بموجب ترخيص Apache 2.0.
أعلنت جوجل ديب مايند عن إصدار Gemma 4 12B، وهو نموذج جديد متوسط الحجم يجمع بين قدرات معالجة النصوص والصور والصوت دون استخدام مشفرات منفصلة. على عكس النماذج متعددة الوسائط التقليدية التي تعتمد على مشفرات منفصلة لترجمة الصور والصوت، يستخدم Gemma 4 12B وحدة تضمين خفيفة للرؤية ويعرض إشارات الصوت الخام مباشرة إلى فضاء رموز النصوص. يحقق النموذج أداءً قريبًا من النموذج الأكبر Gemma 4 26B MoE، لكنه يشغل أقل من نصف حجم الذاكرة ويمكن تشغيله محليًا على أجهزة الكمبيوتر المحمولة للمستهلكين التي تحتوي على 16 غيغابايت من ذاكرة الوصول العشوائي. يدعم Gemma 4 12B التنبؤ متعدد الرموز (MTP) لتقليل زمن الاستجابة، وتم إصداره بموجب ترخيص Apache 2.0. أوزان النموذج متاحة على Hugging Face وKaggle، ويمكن للمطورين استخدام أدوات شائعة مثل Hugging Face Transformers وllama.cpp وMLX وSGLang وvLLM. كما تم إصدار مجموعة مهارات Gemma Skills الرسمية لدعم الوكلاء الذين يعملون مع النموذج.
المصدر: Google DeepMind — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة