ByteDances neues Videomodell Seedance 2.5 erzeugt 30-Sekunden-Clips mit integriertem Audio
ByteDance
ByteDance hat Seedance 2.5 veröffentlicht, ein verbessertes KI-Videomodell, das Video und Audio in einem Durchgang generiert und Clips von bis zu 30 Sekunden Länge produziert. Nutzer können mehrere Referenzbilder, Videos und Audiodateien hochladen, um Szenen mit mehreren Charakteren und Kameraperspektiven zu gestalten. Das Modell ist über Jimeng AI und Doubao Pro verfügbar, ein API-Zugang über BytePlus ModelArk ist geplant.
ByteDance hat Seedance 2.5 veröffentlicht, eine neue Version seines KI-Videomodells, das in einem einzigen Durchgang sowohl Video als auch Audio generiert und Clips von bis zu 30 Sekunden erstellt, die mehrfach verlängert werden können. Damit übertrifft es Wettbewerber wie Googles Gemini Omni Flash, das derzeit nur etwa 10 Sekunden am Stück schafft. Nutzer können bis zu 30 Bilder, 10 Videoclips und 10 Audiodateien als Referenzmaterial hochladen, um Szenen mit mehreren Figuren und Kameraperspektiven zu gestalten. Das Modell bietet verbesserte Texturen, Beleuchtung und Hautdetails. Sein Vorgänger, Seedance 2.0, führt laut Artificial Analysis das Ranking für Bild-zu-Video-Modelle mit Audio an. ByteDance präsentierte die Fähigkeiten des Modells in einem Kurzfilm, der vollständig mit Seedance 2.5 produziert wurde, und demonstrierte damit einen nahtlosen Produktionsablauf für Werbung und visuelle Inhalte. Seedance 2.5 ist über Jimeng AI und Doubao Pro verfügbar, der API-Zugang über BytePlus ModelArk folgt. Zuvor hatte 'District 9'-Regisseur Neill Blomkamp mit seiner 13-minütigen, vollständig KI-generierten Kurzfilm 'Nightborne' gezeigt, was die frühere Version konnte.
Quelle: The Decoder (DE) —
Original
