Gemini Omni (alias Google Omni och Veo Omni): videor med karaktärer, röst och 4K
Kort om det viktigaste (BLUF)
Gemini Omni, Google Omni och Veo Omni är tre namn på en videomodell: hon har en hjälte i alla videor, röstar ut dem och ger ut upp till 4K. Låt oss ta reda på vad som ligger bakom ordet "Omni", hur mycket produktion kostar och var vi ska börja.
Den här modellen har tre namn, och du har förmodligen stött på alla tre: Gemini Omni, Google Omni Och Veo Omni. Vissa kallar det av familjen Gemini, andra av videolinjen Veo, vissa helt enkelt "omni" - vi talar om samma neurala nätverk för att generera video. Hon jobbar för oss avsnittet "Video"., och du kan köra den utan prenumeration, med betalning för en specifik generation.
Vad ligger bakom ordet "Omni"
En vanlig videomodell accepterar text eller en bild. Här blandas input: en textbeskrivning plus upp till sju bilder, video eller ljud som ytterligare sammanhang. Du behöver en video i andan av en specifik ram och med stämningen i en specifik melodi - ta med allt på en gång, modellen kommer att ta hänsyn till varje källa.
Detta förändrar själva formuleringen av problemet. Istället för stycket "föreställ dig ett sådant här hus, ljuset så här", visar du ett fotografi av huset och beskriver bara handlingen i ord. Texten står för handlingen, bilagorna står för utseendet.
Karaktärer: en hjälte i alla videor
Det största problemet med konventionella generatorer är att hjälten byter från video till video. I Gemini Omni finns det en separat karaktärsflik för detta: en hjälte skapas en gång, han sparas i ditt bibliotek och kopplas sedan till valfri generation med ett klick. Utseendet förblir konsekvent från video till video.
Så här är serien sammansatt: en virtuell presentatör av en kolumn, en varumärkesmaskot, en karaktär för barns berättelser. Det finns ingen anledning att ladda upp referenser igen varje gång och hoppas att modellen kommer att "komma ihåg" ansiktet.

Röst: färdiga förinställningar och din egen
Videon kan direkt komma ut med ljud. Inställningarna har en uppsättning färdiga röster - manliga och kvinnliga, från mjuka höga till låga med heshet. Du väljer en röst, skriver en rad i beskrivningen – och karaktären talar precis i ramen. Om förinställningarna inte är lämpliga skapas din egen röst i ljudfliken baserat på basen: den hamnar också i ditt personliga bibliotek. Detta är ett sätt för varumärket att ha en igenkännbar röst bakom alla sina videor.
Upp till 4K, varaktighet och ramformat
Detta är en av få modeller på webbplatsen med 4K-utgång: 720p, 1080p och 4K är tillgängliga. Varaktighet - 4, 6, 8 eller 10 sekunder, horisontell ram 16:9 eller vertikal 9:16 för sociala nätverk. Den praktiska rutten är enkel: kör utkast vid 720p, och ett bra alternativ är att starta om vid 1080p eller 4K.
Hur mycket kostar det
Priset beror på varaktighet, kvalitet och om du skickar in en video som indata, och visas alltid i formuläret innan lansering - du ser beloppet innan du klickar på knappen. Det finns ingen prenumeration: du betalar för en specifik video från det allmänna saldot, du kan fylla på med ett ryskt kort. En fyra sekunders 720p draft kostar betydligt mindre än en tiosekunders 4K, så att testa en idé är billigare än att spela in finalen direkt.
Var ska man börja
- Öppna modellsida och gör den första videon från en text - så kommer du att känna hur hon läser beskrivningarna.
- Lägg till en referensbild: låt orden representera handlingen och bilden representera scenens utseende.
- Inkludera en röst och en replik om någon talar i ramen.
- Skaffa en permanent karaktär när du behöver en serie videor med en hjälte.
När du beskriver en scen, håll ordning: vem är i bilden, vad de gör, var det händer, hur kameran beter sig. Skicka ditt svar i en separat mening. Denna struktur producerar nästan alltid en sammanhängande video vid första eller andra försöket.
Du letar efter en modell vid namn Google Omni eller Veo Omni - detta är samma sak: Gemini Omni finns här. I närheten, i avsnittet "Video"., det finns andra videomodeller om du vill jämföra.


Vanliga frågor (FAQ)
Fråga: Hur får man det bästa resultatet från ett neuralt nätverk?
Svar: Använd detaljerade uppmaningar (beskrivningar) på engelska, ställ in stilen och detaljerna för scenen.
Fråga: Kan dessa material användas för kommersiella ändamål?
Svar: Ja, det genererade innehållet är helt och hållet ditt.