Mô hình video mới Seedance 2.5 của ByteDance tạo clip 30 giây kèm âm thanh tích hợp
ByteDance
ByteDance đã phát hành Seedance 2.5, một mô hình video AI nâng cấp tạo video và âm thanh trong một lần, sản xuất các clip dài tới 30 giây. Người dùng có thể tải lên nhiều hình ảnh tham chiếu, video và tệp âm thanh để tạo cảnh có nhiều nhân vật và góc máy. Mô hình có sẵn trên Jimeng AI và Doubao Pro, với quyền truy cập API qua BytePlus ModelArk dự kiến.
ByteDance đã ra mắt Seedance 2.5, phiên bản mới của mô hình video AI tạo ra cả video và âm thanh trong một lần xử lý, tạo ra các clip dài tới 30 giây và có thể kéo dài nhiều lần. Điều này vượt trội so với các đối thủ như Gemini Omni Flash của Google, hiện chỉ tạo được khoảng 10 giây mỗi lần. Người dùng có thể tải lên tối đa 30 hình ảnh, 10 clip video và 10 tệp âm thanh làm tài liệu tham khảo để thiết kế các cảnh với nhiều nhân vật và góc máy. Mô hình có kết cấu, ánh sáng và chi tiết da được cải thiện. Phiên bản tiền nhiệm, Seedance 2.0, dẫn đầu bảng xếp hạng chuyển ảnh thành video cho các mô hình có âm thanh, theo Artificial Analysis. ByteDance đã giới thiệu khả năng của mô hình trong một bộ phim ngắn được sản xuất hoàn toàn bằng Seedance 2.5, minh họa quy trình sản xuất liền mạch cho quảng cáo và nội dung trực quan. Seedance 2.5 có sẵn trên Jimeng AI và Doubao Pro, với quyền truy cập API qua BytePlus ModelArk sẽ được cung cấp sau. Trước đó, đạo diễn 'District 9' Neill Blomkamp đã cho thấy phiên bản trước đó có thể làm gì với bộ phim ngắn 'Nightborne' dài 13 phút do AI tạo ra hoàn toàn.
Nguồn: The Decoder (DE) —
bản gốc
