MallitAvoin lähdekoodi 🇩🇪 03.08.2026 17:02

MiniMax H3: ensimmäinen avoin videomalli, joka nousee videonmuokkauslistan kärkeen

MiniMaxMiniMax ByteDanceByteDance
MiniMax on julkaissut videomallinsa H3:n painot, mikä tekee siitä ensimmäisen avoimen mallin, joka on päässyt videolistan kärkeen. Artificial Analysis -palvelun mukaan H3 on ensimmäinen videonmuokkauksessa, toinen tekstistä videoksi -tehtävässä ja kolmas kuvasta videoksi -tehtävässä. 33 miljardin parametrin malli käsittelee tekstiä, kuvia, videoita ja ääntä yhdessä, tuottaen leikkeitä, joissa on stereofoninen ääni, mutta jotkut komponentit ovat edelleen suljettuja.
MiniMax on julkaissut videomallinsa H3:n painot julkisesti, mikä on ensimmäinen kerta, kun avoin malli on noussut videolistan kärkeen. Artificial Analysis -palvelussa H3 sijoittuu ensimmäiseksi videomuokkauksessa, toiseksi tekstistä videoksi -tehtävässä ja kolmanneksi kuvasta videoksi -tehtävässä. 33 miljardin parametrin malli käsittelee tekstiä, kuvia, videoita ja ääntä yhdessä, tuottaen neljästä 15 sekunnin videopätkän stereoäänellä. Mallikortin mukaan se pystyy käsittelemään jopa yhdeksän referenssikuvaa, kolme videoklippiä ja kolme ääniklippiä yhtä kehotetta kohden. Kaksi komponenttia on kuitenkin edelleen suljettu: 2K-resoluution moduuli ja H3-Context-IR, joka muuntaa kehotteet ja referenssimateriaalin jäsenneltyyn välimuotoon. Paikallisesti ComfyUI:ssa tämä tarkoittaa 768p-tulostetta, mutta kontekstinkäsittely voidaan toistaa julkaistujen kehoteoppaiden avulla. Avoimet painot mahdollistavat myös hienosäädön, esimerkiksi omalla kuvamateriaalilla, hahmoilla tai yhtenäisellä ilmeellä, vaikkakin lisenssi sallii kaupallisen käytön vain yrityksille, joiden liikevaihto on alle 20 miljoonaa dollaria. Samaan aikaan ByteDance julkaisi suljetun Seedance 2.5:n, joka tuottaa 30 sekunnin videoita äänellä.
Lähde: The Decoder (DE) — Alkuperäinen
Aiemmat aiheeseen liittyvät kirjoituksemme ↓
Tuoreet uutiset