Black Forest Labs dévoile FLUX 3 : un modèle multimodal pour images, vidéo, audio et prédiction d'actions robotiques
Black Forest Labs (BFL) a présenté FLUX 3, un modèle fondamental multimodal entraîné sur des images, des vidéos et de l'audio au sein d'une architecture unique. Le modèle génère des vidéos jusqu'à 20 secondes avec un son synchronisé et obtient des résultats élevés en matière de préférence des utilisateurs, surpassant Luma Ray 3.2 dans 93% des cas et Runway Gen-4.5 dans 77% des cas.
Luma AI
Runway
xAI
Google/DeepMind
MarkTechPost26.07 · 21:02
