⚡ 突发新闻
模型媒体生成 🇺🇸 27.07.2026 14:04

谷歌DeepMind推出Gemini Omni:用于视频创建和编辑的多模态模型

Google/DeepMindGoogle/DeepMind DeepMindDeepMind
谷歌DeepMind发布了Gemini Omni,这是一个多模态AI模型,能够从图像、音频、视频和文本的任意组合中生成和编辑视频。该系列中的首个模型Gemini Omni Flash正在通过Gemini应用和Google Flow向Google AI Plus、Pro和Ultra订阅用户推出,并将免费提供给YouTube Shorts用户。
谷歌DeepMind宣布推出Gemini Omni,这是一款多模态模型,结合了Gemini的推理与创意能力,能够从任何输入模态(包括图像、音频、视频和文本)生成和编辑视频。该模型支持自然语言视频编辑,在编辑过程中保持角色一致性和物理规则,并能根据Gemini对物理、历史、科学和文化的真实世界知识生成视频。它提供通过对话编辑、场景转换、添加对象以及多轮优化等功能。首个模型Gemini Omni Flash正面向全球的Google AI Plus、Pro和Ultra订阅用户,通过Gemini应用和Google Flow推出,同时也可免费提供给YouTube Shorts和YouTube Create App用户。所有生成的视频均包含SynthID数字水印,以确保透明度。开发者和企业API访问计划在未来几周内推出。
来源: Google DeepMind — 原文
我们之前关于此话题的帖子 ↓
最新新闻