ModellenOpen Source 🇩🇪 03.08.2026 17:02

MiniMax H3 is het eerste open videomodel dat bovenaan de videobewerkingsranglijst staat

MiniMaxMiniMax ByteDanceByteDance
MiniMax heeft de gewichten van zijn videomodel H3 vrijgegeven, waardoor het het eerste open model is dat de top van een videoranglijst bereikt. Volgens Artificial Analysis staat H3 op de eerste plaats in videobewerking, op de tweede plaats in tekst-naar-video en op de derde plaats in beeld-naar-video. Het model met 33 miljard parameters verwerkt tekst, afbeeldingen, video's en audio gezamenlijk, en genereert clips met stereogeluid, maar sommige componenten blijven gesloten.
MiniMax heeft de gewichten van zijn videomodel H3 openbaar gemaakt, waarmee voor het eerst een open model een videoranglijst aanvoert. Op Artificial Analysis staat H3 op de eerste plaats voor videobewerking, op de tweede plaats voor tekst-naar-video en op de derde plaats voor beeld-naar-video. Het model met 33 miljard parameters verwerkt gezamenlijk tekst, afbeeldingen, video's en audio en produceert een clip van vier tot vijftien seconden met stereogeluid. Volgens de modelkaart kan het tot negen referentiebeelden, drie videoclips en drie audioclips per prompt aan. Twee componenten blijven echter gesloten: de module voor 2K-resolutie en H3-Context-IR, dat prompts en referentiemateriaal omzet in een gestructureerde tussenvorm. Lokaal in ComfyUI resulteert dit in 768p-uitvoer, maar de contextverwerking kan worden gerepliceerd met behulp van de gepubliceerde promptgidsen. De open gewichten maken ook fine-tuning mogelijk, bijvoorbeeld op eigen beeldmateriaal, personages of een consistente look, hoewel de licentie commercieel gebruik alleen toestaat voor bedrijven met een omzet onder de twintig miljoen dollar. Tegelijkertijd bracht ByteDance het gesloten Seedance 2.5 uit, dat clips van dertig seconden met audio levert.
Bron: The Decoder (DE) — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws