⚡ СРОЧНО
МоделиГенерация медиа 🇺🇸 27.07.2026 14:04

Google DeepMind представляет Gemini Omni: мультимодальная модель для создания и редактирования видео

Google/DeepMindGoogle/DeepMind DeepMindDeepMind
Google DeepMind представила Gemini Omni — мультимодальную модель искусственного интеллекта, способную генерировать и редактировать видео из любой комбинации изображений, аудио, видео и текста. Первая модель семейства, Gemini Omni Flash, становится доступной подписчикам Google AI Plus, Pro и Ultra через приложение Gemini и Google Flow, а также будет доступна пользователям YouTube Shorts бесплатно.
Google DeepMind анонсировала Gemini Omni — мультимодальную модель, которая объединяет способности Gemini к рассуждению с креативными возможностями для создания и редактирования видео на основе любого входного модального типа, включая изображения, аудио, видео и текст. Модель поддерживает редактирование видео на естественном языке, сохраняет согласованность персонажей и физику в рамках изменений,
Показать ещё ↓
Источник: Google DeepMind — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости