ByteDanceの新ビデオモデルSeedance 2.5、音声統合で30秒クリップを生成
ByteDance
ByteDanceは、AIビデオモデルの改良版であるSeedance 2.5をリリースしました。これはビデオとオーディオを一度に生成し、最大30秒のクリップを作成します。ユーザーは複数の参照画像、ビデオ、オーディオファイルをアップロードして、複数のキャラクターやカメラアングルを含むシーンを制作できます。このモデルは、Jimeng AIとDoubao Proで利用可能で、BytePlus ModelArkを介したAPIアクセスが予定されています。
ByteDance(バイトダンス)は、AI動画モデルの新バージョンであるSeedance 2.5を発表しました。このモデルは、動画と音声を一度に生成し、最大30秒のクリップを作成でき、さらに複数回延長することが可能です。これは、現在一度に約10秒しか生成できないGoogleのGemini Omni Flashなどの競合他社を上回る性能です。ユーザーは最大30枚の画像、10本の動画クリップ、10個の音声ファイルを参照資料としてアップロードでき、複数のキャラクターやカメラアングルを備えたシーンをデザインできます。このモデルは、テクスチャ、照明、肌のディテールが改善されています。Artificial Analysisによると、前モデルのSeedance 2.0は、音声付きモデルの画像から動画へのリーダーボードで首位に立っています。ByteDanceは、Seedance 2.5を完全に使用して制作した短編映画でその機能を披露し、広告やビジュアルコンテンツ向けのシームレスな制作ワークフローを示しました。Seedance 2.5は、Jimeng AIとDoubao Proで利用可能で、その後APIアクセスはBytePlus ModelArkを通じて提供される予定です。以前、『第9地区』の監督ニール・ブロムカンプは、初期バージョンで何ができるかを、完全にAIで生成された13分の短編映画『Nightborne』で示しました。
出典: The Decoder (DE) —
原文
