МоделиOpen Source 🇺🇸 27.07.2026 12:03

Google DeepMind представляет Gemma 4 12B: унифицированную мультимодальную модель без кодировщиков

Google/DeepMindGoogle/DeepMind Google DeepMindGoogle DeepMind
Компания Google DeepMind представила Gemma 4 12B — мультимодальную модель ИИ среднего размера, которая напрямую обрабатывает изображения и аудио без отдельных кодировщиков. Разработанная для работы на ноутбуках с 16 ГБ оперативной памяти, она обладает расширенными возможностями рассуждения и агентскими функциями. Модель выпущена под лицензией Apache 2.0 и поддерживает такие инструменты разработчика, как Hugging Face, Ollama и Google Cloud.
Google DeepMind анонсировала Gemma 4 12B — единую мультимодальную модель без выделенных кодировщиков для визуальных и аудиовходов, что позволяет обрабатывать их напрямую через основу большой языковой модели (LLM). Она предназначена для локального исполнения на потребительских ноутбуках с 16 ГБ видеопамяти (VRAM) или унифицированной памяти, обеспечивая производительность, близкую к более крупной
Показать ещё ↓
Источник: Google DeepMind — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости