Carte de profondeur (gratuite) – une carte de profondeur à partir d'une vidéo ou d'une image directement dans votre navigateur

Bottom Line Up Front (BLUF): Une carte de profondeur est une copie en noir et blanc d'un cadre où la luminosité indique la distance à la caméra : les objets proches sont plus clairs, l'arrière-plan devient noir. Cet outil en crée une à partir de votre vidéo ou image gratuitement et entièrement sur votre propre appareil : le fichier n'est jamais téléchargé, aucun jeton n'est facturé et il n'y a aucun API payant derrière. Le modèle Depth Anything V2 Small s'exécute directement dans le navigateur, vous voyez donc le résultat tel qu'il est réalisé et la vidéo terminée est téléchargée au format MP4 ou WebM.

Qu'est-ce qu'une carte de profondeur et pourquoi vous en avez besoin

Une carte de profondeur est le même cadre redessiné en nuances de gris en fonction de la distance à la caméra. Plus un objet est proche, plus le pixel est clair ; le fond devient noir. Pas de textures, pas de peau, pas de visages – seulement la géométrie et le relief de la scène.

Vous en avez besoin dans deux cas. Premièrement, pour contourner les filtres de génération vidéo : des modèles comme Seedance refusent les visages et les images de film reconnaissables, tandis qu'une carte de profondeur n'a rien à vérifier : elle ne contient aucun visage. Deuxièmement, pour transférer le mouvement de la caméra : une carte de profondeur montre où la caméra s'est déplacée et comment les objets se tenaient, et le modèle dessine sa propre scène avec le même mouvement.

Tout fonctionne sur votre appareil

L'outil n'envoie jamais votre fichier à notre serveur ou à celui de quelqu'un d'autre. Le modèle Depth Anything V2 Small (licence Apache 2.0) se charge une fois dans le navigateur, puis est servi à partir du cache, et le calcul s'exécute sur votre carte graphique via WebGPU. Si WebGPU n'est pas disponible, une solution de secours du processeur intervient – ​​plus lentement, mais elle fonctionne partout.

Les images vidéo sont décodées avec des WebCodecs, chacune devient une carte de profondeur, puis tout est réassemblé en une vidéo avec la fréquence d'images d'origine et la résolution la plus élevée que votre navigateur peut gérer. La sortie est MP4 ou WebM, selon la prise en charge de votre système. Aucun token n'est facturé pour ce modèle : il n'y a aucune demande payante du tout.

Vidéo et images

Vous pouvez traiter à la fois une vidéo et une seule image. Choisissez un fichier avec le bouton ou faites-le glisser directement dans la fenêtre. Les formats inhabituels tels que HEIC, AVIF ou TIFF sont convertis automatiquement — comme ailleurs sur le site, rien n'est bloqué par format.

Pour une image, le résultat est un PNG à la résolution d'origine ; pour une vidéo, c'est un clip avec la même fréquence d'images. L'aperçu est visible pendant le traitement : les images apparaissent telles qu'elles sont prêtes, et pas seulement après l'assemblage du fichier. Une longue course peut être annulée.

Cartes de couleurs et commutateur proche clair/presque sombre

Par défaut, la carte de profondeur est en noir et blanc avec le premier plan clair. L’interrupteur presque sombre fait basculer l’échelle – parfois de petits détails se lisent mieux de cette façon. Pour plus de clarté, il existe des cartes de couleurs, Inferno et Viridis : elles peignent la distance sous forme de dégradé et vous aident à voir les plans où les gris se mélangent.

Vitesse et limites

La résolution affecte à peine la vitesse : le modèle calcule toujours une image à une résolution fixe de 518 × 518, et la résolution n'a d'importance que lorsque la vidéo terminée est assemblée. Le véritable levier est le nombre d'images, donc un clip long sur le CPU est lent : une minute de source peut prendre plusieurs minutes.

Vous avez besoin d'un navigateur moderne – Chrome ou Edge. Sur un ordinateur portable faible, ne commencez pas par 4K : commencez par un court clip, vérifiez le résultat, puis prenez un fichier plus gros.

Comment obtenir le meilleur résultat

Choisissez des cadres à la géométrie claire : une rue, un intérieur, une personne en pleine hauteur. Les changements brusques d’avions et le transfert des mouvements de caméra sont meilleurs. Si vous avez besoin de la carte pour la génération, créez-la d'abord, puis transmettez-la au modèle avec votre propre description de scène.

Questions fréquentes

Le fichier n'est-il vraiment pas téléchargé ?

Correct. Le modèle et ses poids sont chargés dans le navigateur et le calcul s'exécute sur votre appareil. Les vidéos et les images ne sont jamais envoyées nulle part et il n'y a pas de API payant dans ce modèle.

Combien ça coûte?

Rien. Aucun jeton n'est facturé pour une carte de profondeur : le travail s'effectue sur votre ordinateur, pas sur notre serveur.

Pourquoi le traitement est-il lent ?

La vitesse dépend du nombre d'images et de votre présence ou non de WebGPU. Sur le processeur, un long clip prend plusieurs fois plus de temps – essayez un court clip ou une seule image.

Puis-je créer une carte de profondeur à partir d’une photo ?

Oui, l'outil accepte également les images : la sortie est un PNG à la résolution d'origine.

Dans quel format la vidéo est-elle enregistrée ?

MP4 (H.264) ou WebM — selon celui pris en charge par votre navigateur. La fréquence d'images d'origine est conservée.

Modèles similaires