النماذجمفتوح المصدر 🇺🇸 27.07.2026 12:03

Google DeepMind تطلق Gemma 4 12B: نموذج متعدد الوسائط موحد بدون مشفرات

Google/DeepMindGoogle/DeepMind Google DeepMindGoogle DeepMind
كشفت Google DeepMind عن Gemma 4 12B، وهو نموذج ذكاء اصطناعي متعدد الوسائط متوسط الحجم يعالج الرؤية والصوت مباشرة بدون مشفرات منفصلة. صُمم ليعمل على أجهزة الكمبيوتر المحمولة المزودة بذاكرة وصول عشوائي (RAM) سعة 16 جيجابايت، ويوفر قدرات متقدمة في التفكير والوكالة. يُطرح النموذج بموجب ترخيص Apache 2.0 ويدعم أدوات المطورين مثل Hugging Face وOllama وGoogle Cloud.
أعلنت جوجل ديب مايند عن نموذج Gemma 4 12B، وهو نموذج متعدد الوسائط موحد لا يحتوي على مشفرات مخصصة لمدخلات الرؤية والصوت، مما يسمح بمعالجتها مباشرة بواسطة المحرك الأساسي للنموذج اللغوي الكبير (LLM). تم تصميمه للتنفيذ المحلي على أجهزة الكمبيوتر المحمولة الاستهلاكية التي تحتوي على 16 جيجابايت من ذاكرة الوصول العشوائي للفيديو (VRAM) أو ذاكرة موحدة، مما يوفر أداءً قريبًا من النموذج الأكبر 26B MoE ولكن مع بصمة ذاكرة أصغر. تشمل الميزات الرئيسية مدخلات صوتية أصلية، ومحررات تنبؤ متعددة الرموز (Multi-Token Prediction) لتقليل زمن الاستجابة، وترخيص Apache 2.0. النموذج متاح للتحميل على Hugging Face وKaggle، ويدعم التكامل مع أدوات مثل LM Studio وOllama وGoogle Cloud. تجاوزت نماذج Gemma 4 150 مليون عملية تحميل.
المصدر: Google DeepMind — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة