⚡ СРОЧНО
Black Forest Labs выпускает FLUX 3: мультимодальная модель для изображений, видео, аудио и прогнозирования действий роботов
Luma AI
Runway
xAI
Google/DeepMind
Black Forest Labs (BFL) представляет FLUX 3, мультимодальную фундаментальную модель, обученную совместно на изображениях, видео, аудио и прогнозировании действий роботов. Модель использует архитектуру Self-Flow для согласования модальностей, и ранние тесты показывают сильное предпочтение по сравнению с конкурентами, такими как Luma Ray 3.2 и Runway Gen-4.5, в генерации видео по тексту.
Компания Black Forest Labs (BFL) выпустила FLUX 3 — мультимодальную фундаментальную модель, которая обучается на изображениях, видео и аудио в рамках единой архитектуры. Это первая модель FLUX, которая объединяет предсказание видео, аудио и действий из одного набора весов. Исследовательская группа утверждает, что ни одна отдельная модальность не дает полного описания мира, а обучение на всех
Показать ещё ↓
Источник: MarkTechPost —
оригинал
