← Kaikki artikkelit

MiniMax H3: mitä uusi AI-videomalli voi todella tehdä

MiniMax H3: mitä uusi AI-videomalli voi todella tehdä

On helppo tapa paljastaa tekoälyvideomalli: pyydä liikettä, älä kaunista muotokuvaa. Kierrä kangasta ilmassa, lähetä kamera kohteen ympärille, törmää vettä kiveen – ja heikot generaattorit alkavat sulattaa reunat sekunnissa. MiniMax H3 on mielenkiintoinen, koska sen sävelkorkeus on yhtenäistä liikettä, ei yhtä fotogeenista kehystä.

Katselimme julkaisun takana olevan käytännönläheisen arvion ja tarkistimme sen tekniset väitteet MiniMaxin dokumentaatiota vastaan. Tässä on hyödyllinen osa, miinus "elokuva on kuollut" -kohina.

Enemmän kuin kehote ja yksi kuva

H3 ymmärtää tekstiä, kuvia, videoita ja ääntä yhden pyynnön sisällä. Voit luoda tekstistä, animoida ensimmäisen kehyksen, lukita sekä alku- että loppukehyksen tai rakentaa leikkeen viittauksista. Viite voi sisältää hahmon, liikkeen, kamerapolun, visuaalisen tyylin, äänen tai editointirytmin.

Se muuttaa työpaikan. Sen sijaan, että kirjoittaisit kappaleen, jossa lukee "kamera liikkuu näin ja hahmo näyttää tältä", voit näyttää lyhyen videoleikkeen ja erillisen tyylikuvan. Mallissa on vähemmän väärin luettavaa.

Viralliset rajat ovat runsaat: enintään 9 viitekuvaa, 3 videoleikettä ja 3 äänileikettä, yhteensä 12 sekatiedostoa. Viitevideon ja -äänen pituus voi kumpikin olla enintään 15 sekuntia. Kehotteet voivat olla 7 000 merkkiä pitkät – paljon enemmän kuin järkevä lyhyt otos normaalisti tarvitsee.

Complex motion, fabric, water and camera movement in AI video generation

Kyllä, siinä lukee 2K. Lue pieni teksti

Tulos on 768p tai 2K, ja leikkeet kestävät 4-15 kokonaista sekuntia. Yleisiä kuvasuhteita ja mukautuvaa tilaa tuetaan. Viisitoista sekuntia riittää kompaktiin sosiaaliseen mainokseen: paljasta kohde, suorita yksi toiminto, näytä reaktio, laskeudu viimeiseen kuvaan.

Mutta resoluutio ei ole laatua. MiniMax dokumentoi myös erillisen regenerointipolun: kun 768p-tuloksella on oikea liike, se voidaan rakentaa uudelleen 2K:n tarkkuudella käyttämällä alkuperäisiä tuloja ja perusklipsiä. Se on järkevä työnkulku. Etsi ota ensin; kuluta resoluutioon toiseksi.

Missä H3 näyttää vahvimmalta

Katsauksen parhaita esimerkkejä ovat kameran nopeat liikkeet, neste, kangas ja valaistus, joiden on pysyttävä yhtenäisenä, kun kohtaus muuttuu. Ääniviitteet ovat vähemmän ilmeinen voitto. He voivat ohjata ääntä tai musiikillista rytmiä visuaalisen materiaalin rinnalla.

Kuvaa tuote, joka on otettu yhdellä still-kuvalla, kuuden sekunnin kameraliikeviittauksella ja lyhyellä äänikorostuksella. Still ankkuroi tuotteen, video toimittaa kiertoradan ja ääni asettaa sykkeen. Se on paljon tarkempaa kuin "tee premium-mainokset".

saalis

Hahmon johdonmukaisuus on parempi, ei taata. Lisää useita esineitä, jotka törmäävät, sulkevat toisensa ja palaavat kehykseen, niin harhaisia ​​yksityiskohtia tai muotohyppyjä voi silti näkyä. Pienet luettavat kirjaimet tulee lisätä editoriin jälkeenpäin.

Ja nämä ovat lyhyitä katkelmia, eivät valmiita kolmen minuutin elokuvia. Pidempi tarina tarvitsee vielä laukauslistan, vakaat referenssit ja editoinnin. Todellinen työ jää. H3 nopeuttaa pääasiassa raaka-shot-vaihetta.

Ensimmäinen kehotus, joka opettaa sinulle jotain

Ohita pino adjektiiveja. Määrittele kohde, toiminta, kamera ja valo: "Lasipullo seisoo märällä mustalla kivellä. Aalto iskee sen taakse; kamera kaaree hitaasti oikealta vasemmalle; kylmä aamuvalo; lopeta lähikuvassa." Liitä liikeviittaus, kun kameran tiellä on merkitystä. Lisää useita näkökulmia, kun henkilöllisyydellä on merkitystä.

Jos haluat testata ideaa omalla materiaalillasi, avaaTekoälyvideon luominen NeuralSpacessa. Tarvitsetko ensin puhtaan aloituskehyksen? Rakenna se sisäänkuvan generaattori. Aloita viidestä tai kuudesta sekunnista 768p:llä. Huono vie maksaa vähemmän; hyvä ansaitsee 2K-passin.