Gemini Omni (alias Google Omni et Veo Omni) : vidéos avec personnages, voix et 4K
En bref sur l'essentiel (BLUF)
Gemini Omni, Google Omni et Veo Omni sont trois noms d'un modèle vidéo : elle garde un héros dans toutes les vidéos, les exprime et donne jusqu'à 4K. Voyons ce qui se cache derrière le mot « Omni », combien coûte la production et par où commencer.
Ce modèle porte trois noms, et vous avez probablement déjà croisé les trois : Gemini Omni, Google Omni Et Veo Omni. Certains l'appellent par la famille Gemini, d'autres par la ligne vidéo Veo, d'autres simplement « omni » - nous parlons du même réseau neuronal pour générer de la vidéo. Elle travaille pour nous à Rubrique "Vidéo", et vous pouvez l'exécuter sans abonnement, avec paiement pour une génération spécifique.
Que se cache-t-il derrière le mot « Omni » ?
Un modèle vidéo standard accepte du texte ou une image. Ici, l'entrée est mixte : une description textuelle plus jusqu'à sept images, vidéo ou audio comme contexte supplémentaire. Vous avez besoin d'une vidéo dans l'esprit d'un cadre spécifique et avec l'ambiance d'une mélodie spécifique - apportez tout d'un coup, le modèle prendra en compte chaque source.
Cela change la formulation même du problème. Au lieu du paragraphe « imaginez une maison comme celle-ci, la lumière comme celle-ci », vous montrez une photographie de la maison et ne décrivez l'action qu'avec des mots. Le texte est responsable de l'intrigue, les pièces jointes sont responsables de l'apparence.
Personnages : un héros dans toutes les vidéos
Le principal problème des générateurs classiques est que le héros passe de vidéo en vidéo. Dans Gemini Omni, il y a un onglet de personnage séparé pour cela : un héros est créé une seule fois, il est enregistré dans votre bibliothèque puis connecté à n'importe quelle génération en un seul clic. L'apparence reste cohérente d'une vidéo à l'autre.
C’est ainsi que la série est assemblée : un présentateur virtuel de chronique, une mascotte de marque, un personnage de contes pour enfants. Il n'est pas nécessaire de télécharger à nouveau les références à chaque fois et d'espérer que le modèle se « souviendra » du visage.

Voix : des préréglages prêts à l'emploi et les vôtres
La vidéo peut immédiatement sortir avec du son. Les réglages disposent d'un ensemble de voix prêtes à l'emploi - masculines et féminines, des aigus doux aux graves avec enrouement. Vous choisissez une voix, écrivez une ligne dans la description - et le personnage parle directement dans le cadre. Si les préréglages ne conviennent pas, votre propre voix est créée dans l'onglet audio à partir de celui de base : elle se retrouve également dans votre bibliothèque personnelle. C'est une façon pour la marque d'avoir une voix reconnaissable derrière toutes ses vidéos.
Jusqu'à 4K, durée et format d'image
C'est l'un des rares modèles du site avec une sortie 4K : 720p, 1080p et 4K sont disponibles. Durée - 4, 6, 8 ou 10 secondes, cadre horizontal 16:9 ou vertical 9:16 pour les réseaux sociaux. La solution pratique est simple : exécutez des brouillons à 720p, et une bonne option consiste à redémarrer à 1080p ou 4K.
Combien ça coûte
Le prix dépend de la durée, de la qualité et du fait que vous soumettez une vidéo en entrée, et est toujours affiché dans le formulaire avant le lancement - vous voyez le montant avant de cliquer sur le bouton. Il n'y a pas d'abonnement : vous payez une vidéo spécifique sur le solde général, vous pouvez la recharger avec une carte russe. Un brouillon 720p de quatre secondes coûte nettement moins qu'un 4K de dix secondes, donc tester une idée coûte moins cher que de tourner la finale tout de suite.
Par où commencer
- Ouvrir page modèle et réalisez la première vidéo à partir d'un texte - de cette façon, vous ressentirez comment elle lit les descriptions.
- Ajoutez une image de référence : laissez les mots représenter l'action et l'image représente l'apparence de la scène.
- Incluez une voix et une ligne si quelqu'un parle dans le cadre.
- Obtenez un personnage permanent lorsque vous avez besoin d'une série de vidéos avec un seul héros.
Lorsque vous décrivez une scène, gardez l'ordre : qui est dans le cadre, ce qu'ils font, où cela se passe, comment la caméra se comporte. Soumettez votre réponse dans une phrase distincte. Cette structure produit presque toujours une vidéo cohérente dès le premier ou le deuxième essai.
Vous recherchez un modèle portant le nom Google Omni ou Veo Omni - c'est pareil : Gemini Omni disponible ici. A proximité, dans Rubrique "Vidéo", il existe d'autres modèles de vidéo si vous souhaitez comparer.


Questions fréquemment posées (FAQ)
Question : Comment obtenir le meilleur résultat d’un réseau de neurones ?
Réponse : Utilisez des invites détaillées (descriptions) en anglais, définissez le style et les détails de la scène.
Question : Ces matériaux peuvent-ils être utilisés à des fins commerciales ?
Réponse : Oui, le contenu généré vous appartient entièrement.