Black Forest Labs lança FLUX 3: modelo multimodal para imagens, vídeo, áudio e previsão de ações robóticas
A Black Forest Labs (BFL) apresentou o FLUX 3, um modelo fundamental multimodal treinado em imagens, vídeo e áudio dentro de uma única arquitetura. O modelo gera vídeos de até 20 segundos com áudio sincronizado e alcança altos resultados de preferência do usuário, superando o Luma Ray 3.2 em 93% dos casos e o Runway Gen-4.5 em 77%.
Luma AI
Runway
xAI
Google/DeepMind


