⚡ СРОЧНО
Google DeepMind представляет Gemini Omni: мультимодальная модель для создания и редактирования видео
Google/DeepMind
DeepMind
Google DeepMind представила Gemini Omni — мультимодальную модель искусственного интеллекта, способную генерировать и редактировать видео из любой комбинации изображений, аудио, видео и текста. Первая модель семейства, Gemini Omni Flash, становится доступной подписчикам Google AI Plus, Pro и Ultra через приложение Gemini и Google Flow, а также будет доступна пользователям YouTube Shorts бесплатно.
Google DeepMind анонсировала Gemini Omni — мультимодальную модель, которая объединяет способности Gemini к рассуждению с креативными возможностями для создания и редактирования видео на основе любого входного модального типа, включая изображения, аудио, видео и текст. Модель поддерживает редактирование видео на естественном языке, сохраняет согласованность персонажей и физику в рамках изменений,
Показать ещё ↓
Источник: Google DeepMind —
оригинал
