模型媒体生成 🇩🇪 01.08.2026 17:03

字节跳动新视频模型 Seedance 2.5 生成带集成音频的 30 秒片段

ByteDanceByteDance
字节跳动发布了 Seedance 2.5,这是一款升级版的人工智能视频模型,可一次性生成视频和音频,制作长达 30 秒的片段。用户可上传多张参考图片、视频和音频文件,以构建包含多个角色和摄像机角度的场景。该模型已在即梦人工智能和豆包专业版上线,并计划通过字节加模型方舟提供应用程序编程接口访问。
字节跳动发布了Seedance 2.5,这是其AI视频模型的新版本,能够一次性生成视频和音频,创作出最长30秒的片段,且可多次扩展。这超越了谷歌的Gemini Omni Flash等竞争对手,后者目前一次只能处理约10秒。用户最多可上传30张图片、10个视频片段和10个音频文件作为参考素材,用以设计包含多个角色和多种摄像机角度的场景。该模型在纹理、光照和皮肤细节方面均有改进。根据Artificial Analysis的数据,其前身Seedance 2.0在含音频的模型图像转视频排行榜上领先。字节跳动在一部完全由Seedance 2.5制作的短片中展示了该模型的能力,证明了广告和视觉内容制作流程的无缝衔接。Seedance 2.5现已登陆即梦AI和豆包Pro,API访问随后将通过字节跳动火山方舟提供。此前,《第九区》导演尼尔·布洛姆坎普展示了早期版本的能力,他制作了一部13分钟完全由AI生成的短片《夜生者》。
来源: The Decoder (DE) — 原文
我们之前关于此话题的帖子 ↓
最新新闻