⚡ 속보
Google DeepMind, 비디오 생성 및 편집을 위한 멀티모달 모델 Gemini Omni 발표
Google/DeepMind
DeepMind
Google DeepMind가 이미지, 오디오, 비디오, 텍스트의 모든 조합으로 비디오를 생성하고 편집할 수 있는 멀티모달 인공지능 모델 Gemini Omni를 공개했습니다. 이 제품군의 첫 번째 모델인 Gemini Omni Flash는 Gemini 앱과 Google Flow를 통해 Google AI Plus, Pro 및 Ultra 구독자에게 제공되며, YouTube Shorts 사용자에게는 무료로 제공될 예정입니다.
Google DeepMind이 Gemini Omni를 발표했습니다. 이 멀티모달 모델은 Gemini의 추론 능력과 창의적 기능을 결합하여 이미지, 오디오, 비디오, 텍스트 등 모든 입력 양식에서 비디오를 생성하고 편집할 수 있습니다. 이 모델은 자연어 비디오 편집을 지원하며, 편집 과정에서 캐릭터 일관성과 물리 법칙을 유지하고, 물리학, 역사, 과학, 문화 등 Gemini의 실제 세계 지식에 기반한 비디오를 생성할 수 있습니다. 대화를 통한 편집, 장면 변환, 객체 추가, 여러 차례에 걸친 개선 등의 기능을 제공합니다. 첫 번째 모델인 Gemini Omni Flash는 Google AI Plus, Pro 및 Ultra 구독자에게 전 세계적으로 Gemini 앱과 Google Flow를 통해, 그리고 YouTube Shorts 및 YouTube Create 앱 사용자에게 무료로 순차 제공되고 있습니다. 생성된 모든 비디오에는 투명성을 위해 SynthID 디지털 워터마킹이 포함됩니다. 개발자 및 기업용 Application Programming Interface(API) 액세스는 앞으로 몇 주 내에 제공될 예정입니다.
출처: Google DeepMind —
원문
