Black Forest Labs 发布 FLUX 3 Video,原生音频与对口型对话功能加持
Black Forest Labs 已发布其 FLUX 3 Video 模型,可通过 API 及合作伙伴获取。该模型支持生成最长 20 秒的高清/全高清视频片段,并配备原生音频,支持文本转视频及图像转视频功能,在 ELO 排行榜中名列第一。
Black Forest Labs已通过其API和选定合作伙伴全面推出FLUX 3视频模型。该模型可生成最长20秒的高清及全高清视频片段,包含原生音频,如对话、音效和环境声。它支持文生视频、图生视频、关键帧、视频续接,以及单片段中的多场景和多机位角度。FLUX 3可直接在场景中渲染文字,理解复杂提示,并运用世界知识制作纪录片。对话以唇形同步生成,支持超过14种语言。根据BFL自身的评估,FLUX 3在文生视频(1135)和图生视频(1051)的ELO排名中均居首位,领先于Gemini Omni Flash、Minimax H3和Seedance 2.0。定价按视频输出秒数计算。草稿模式仅限高清,价格为每秒0.06美元(文生/图生视频)或0.12美元(视频转视频)。全质量模式高清价格为每秒0.17或0.41美元,全高清为0.29或0.53美元。音频已包含在价格内。更多视频示例可在BFL博客中查看。
来源: The Decoder (DE) —
原文
