Генерация медиаМодели 🇺🇸 01.08.2026 12:02

MiniMax представляет MiniMax H3: омнимодальная видеомодель, генерирующая 15-секундные ролики 2K со встроенным стереозвуком

MiniMax Google/DeepMind ByteDance
Компания MiniMax представила модель MiniMax H3 — универсальную мультимодальную генеративную модель, объединяющую обработку текста, изображений, видео и аудио, которая выводит видео разрешением 2K со встроенным стереозвуком. Модель доступна через API и в приложении Hailuo AI, а открытые веса обещаны в ближайшее время. Благодаря агрессивному ценообразованию H3 лидирует в редактировании видео, но отстает от конкурентов по другим бенчмаркам.
MiniMax выпустила MiniMax H3 — универсальную мультимодальную генеративную модель, которая принимает текст, изображения, видео и аудио как единый контекст и возвращает видео с нативным стереозвуком, поддерживая разрешение 2K и длительность от 4 до 15 секунд (только целые числа). В отличие от прежних стеков, требовавших отдельных моделей для генерации из текста, из изображения и других задач, H3
Показать ещё ↓
Источник: MarkTechPost — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости