Google DeepMind представляет Gemma 4 12B: унифицированную мультимодальную модель без кодировщиков
Google/DeepMind
Google DeepMind
Компания Google DeepMind представила Gemma 4 12B — мультимодальную модель ИИ среднего размера, которая напрямую обрабатывает изображения и аудио без отдельных кодировщиков. Разработанная для работы на ноутбуках с 16 ГБ оперативной памяти, она обладает расширенными возможностями рассуждения и агентскими функциями. Модель выпущена под лицензией Apache 2.0 и поддерживает такие инструменты разработчика, как Hugging Face, Ollama и Google Cloud.
Google DeepMind анонсировала Gemma 4 12B — единую мультимодальную модель без выделенных кодировщиков для визуальных и аудиовходов, что позволяет обрабатывать их напрямую через основу большой языковой модели (LLM). Она предназначена для локального исполнения на потребительских ноутбуках с 16 ГБ видеопамяти (VRAM) или унифицированной памяти, обеспечивая производительность, близкую к более крупной
Показать ещё ↓
Источник: Google DeepMind —
оригинал
