← Все статьи

Gemini Omni (alias Google Omni dan Veo Omni): video dengan karakter, suara, dan 4K

Gemini Omni (alias Google Omni dan Veo Omni): video dengan karakter, suara, dan 4K

Secara singkat tentang hal utama (BLUF)

Gemini Omni, Google Omni, dan Veo Omni adalah tiga nama dari satu model video: dia menyimpan satu pahlawan di semua video, menyuarakannya, dan memberikan hingga 4K. Mari kita cari tahu apa yang ada di balik kata “Omni”, berapa biaya pembangkitannya, dan dari mana memulainya.

Model ini memiliki tiga nama, dan Anda mungkin pernah menemukan ketiganya:Gemini Omni, Google OmniDanVeo Omni. Ada yang menyebutnya dengan keluarga Gemini, ada yang menyebutnya dengan jalur video Veo, ada pula yang menyebutnya “omni” - kita berbicara tentang jaringan saraf yang sama untuk menghasilkan video. Dia bekerja untuk kitaBagian "Video"., dan Anda dapat menjalankannya tanpa berlangganan, dengan pembayaran untuk generasi tertentu.

Apa yang ada di balik kata "Omni"

Model video biasa menerima teks atau satu gambar. Di sini masukannya dicampur: deskripsi teks ditambah hingga tujuh gambar, video atau audio sebagai konteks tambahan. Anda memerlukan video dengan semangat bingkai tertentu dan dengan suasana melodi tertentu - bawakan semuanya sekaligus, model akan mempertimbangkan setiap sumber.

Hal ini mengubah rumusan masalah. Daripada paragraf “bayangkan rumah seperti ini, cahayanya seperti ini”, Anda menunjukkan foto rumah tersebut, dan hanya mendeskripsikan tindakannya dengan kata-kata. Teks bertanggung jawab atas plot, lampiran bertanggung jawab atas penampilan.

Karakter: satu pahlawan di semua video

Masalah utama dengan generator konvensional adalah perubahan hero dari video ke video. Di Gemini Omni ada tab karakter terpisah untuk ini: pahlawan dibuat satu kali, dia disimpan ke perpustakaan Anda dan kemudian dihubungkan ke generasi mana pun dengan satu klik. Tampilannya tetap konsisten dari video ke video.

Beginilah rangkaian ini disusun: presenter virtual kolom, maskot merek, karakter cerita anak-anak. Tidak perlu mengunggah ulang referensi setiap saat dan berharap model akan “mengingat” wajahnya.

Mixed input: text, image and sound in one generation

Suara: preset yang sudah jadi dan milik Anda sendiri

Video bisa langsung keluar dengan suara. Pengaturannya memiliki serangkaian suara siap pakai - pria dan wanita, dari lembut tinggi hingga rendah dengan suara serak. Anda memilih suara, menulis satu baris dalam deskripsi - dan karakter berbicara tepat di bingkai. Jika presetnya tidak sesuai, suara Anda sendiri dibuat di tab audio berdasarkan yang dasar: suara itu juga masuk ke perpustakaan pribadi Anda. Ini adalah cara bagi merek untuk memiliki satu suara yang dapat dikenali di balik semua videonya.

Hingga 4K, durasi dan format bingkai

Ini adalah salah satu dari sedikit model di situs dengan output 4K: tersedia 720p, 1080p, dan 4K. Durasi - 4, 6, 8 atau 10 detik, bingkai horizontal 16:9 atau vertikal 9:16 untuk jejaring sosial. Cara praktisnya sederhana: jalankan draf pada 720p, dan opsi yang baik adalah memulai ulang pada 1080p atau 4K.

harganya berapa

Harga tergantung pada durasi, kualitas dan apakah Anda mengirimkan video sebagai masukan, dan selalu ditampilkan dalam formulir sebelum peluncuran - Anda melihat jumlahnya sebelum Anda mengklik tombol. Tidak ada langganan: Anda membayar video tertentu dari saldo umum, Anda dapat mengisinya dengan kartu Rusia. Draf 720p berdurasi empat detik jauh lebih murah daripada 4K berdurasi sepuluh detik, jadi menguji sebuah ide lebih murah daripada langsung merekam finalnya.

Di mana untuk memulai

  1. Membukahalaman modeldan buat video pertama dari satu teks - dengan cara ini Anda akan merasakan bagaimana dia membaca deskripsinya.
  2. Tambahkan gambar referensi: biarkan kata-kata mewakili tindakan, dan gambar mewakili tampilan adegan.
  3. Sertakan suara dan baris jika seseorang berbicara dalam bingkai.
  4. Dapatkan karakter permanen ketika Anda membutuhkan serangkaian video dengan satu pahlawan.

Saat mendeskripsikan sebuah adegan, jagalah urutannya: siapa yang ada di dalam bingkai, apa yang mereka lakukan, di mana kejadiannya, bagaimana perilaku kamera. Kirimkan tanggapan Anda dalam kalimat terpisah. Struktur ini hampir selalu menghasilkan video yang koheren pada percobaan pertama atau kedua.

Anda mencari model dengan nama Google Omni atau Veo Omni - ini sama:Gemini Omni tersedia di sini. Di dekatnya, diBagian "Video"., masih ada model video lain jika ingin membandingkan.

Mixed input: text, image and sound in a single generation
混合输入:在一次生成中使用文本、图像和声音

Pertanyaan yang sering diajukan (FAQ)

Pertanyaan: Bagaimana cara mendapatkan hasil terbaik dari jaringan saraf?
Jawaban: Gunakan petunjuk rinci (deskripsi) dalam bahasa Inggris, atur gaya dan detail adegan.

Pertanyaan: Apakah bahan-bahan ini dapat digunakan untuk tujuan komersial?
Jawaban: Ya, konten yang dihasilkan sepenuhnya milik Anda.