ModelleOpen Source 🇩🇪 03.08.2026 17:02

MiniMax H3 ist das erste offene Videomodell an der Spitze des Video-Editing-Rankings

MiniMaxMiniMax ByteDanceByteDance
MiniMax hat die Gewichte seines Videomodells H3 veröffentlicht und ist damit das erste offene Modell, das die Spitze einer Video-Rangliste erreicht. Laut Artificial Analysis belegt H3 den ersten Platz beim Video-Editing, den zweiten bei Text-zu-Video und den dritten bei Bild-zu-Video. Das Modell mit 33 Milliarden Parametern verarbeitet Text, Bilder, Videos und Audio gemeinsam und erzeugt Clips mit Stereoton, jedoch bleiben einige Komponenten geschlossen.
MiniMax hat die Gewichte seines Videomodells H3 öffentlich zugänglich gemacht, was das erste Mal ist, dass ein offenes Modell eine Video-Rangliste anführt. Auf Artificial Analysis belegt H3 den ersten Platz bei der Videobearbeitung, den zweiten bei Text-zu-Video und den dritten bei Bild-zu-Video. Das 33-Milliarden-Parameter-Modell verarbeitet Text, Bilder, Videos und Audio gemeinsam und erzeugt einen Clip von vier bis fünfzehn Sekunden mit Stereo-Ton. Laut der Modellkarte kann es bis zu neun Referenzbilder, drei Videoclips und drei Audioclips pro Eingabeaufforderung verarbeiten. Zwei Komponenten bleiben jedoch geschlossen: das Modul für 2K-Auflösung und H3-Context-IR, das Eingabeaufforderungen und Referenzmaterial in eine strukturierte Zwischenform umwandelt. Lokal in ComfyUI führt dies zu 768p-Ausgabe, aber die Kontextverarbeitung kann mithilfe der veröffentlichten Eingabeaufforderungsleitfäden nachgebildet werden. Die offenen Gewichte ermöglichen auch Feintuning, zum Beispiel auf eigenem Filmmaterial, eigenen Charakteren oder einem konsistenten Look, obwohl die Lizenz die kommerzielle Nutzung nur für Unternehmen mit einem Umsatz unter zwanzig Millionen Dollar erlaubt. Gleichzeitig veröffentlichte ByteDance das geschlossene Seedance 2.5, das 30-Sekunden-Clips mit Audio liefert.
Quelle: The Decoder (DE) — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten