← Todos os artigos

Mapa de profundidade para Seedance 2.5: como contornar o bloqueio facial

O quadro é dividido ao meio: à esquerda está um vídeo normal, à direita está seu verdadeiro mapa de profundidade em preto e branco

Seedance 2.5 recusa-se a trabalhar se houver um rosto reconhecível ou um pedaço do filme de outra pessoa no quadro. É assim que a empresa luta contra falsificações de celebridades, mas se trata de pessoas comuns: uma modelo às vezes até rejeita sua própria selfie. Existe uma solução alternativa e não se trata de hackear. O modelo passa facilmente pelo mapa de profundidade - uma imagem em preto e branco onde o brilho mostra a distância até a câmera. Não há rostos nele, apenas a geometria da cena. Veja abaixo como fazer esse mapa a partir do seu vídeo gratuitamente, direto no navegador, e o que fazer se a geração ainda cair.

Por que uma modelo vê uma celebridade onde não existe nenhuma?

Os filtros Seedance são treinados em rostos. A tarefa deles é simples: evitar que a aparência de uma pessoa famosa seja falsificada. O problema é que definem “fama” pela geometria do rosto, e não pelo nome nos créditos. Um formato de olho semelhante, o mesmo formato de queixo - e é isso, recusa.

É ainda mais fácil com filmagens: a proteção de direitos autorais funciona aí. O modelo reconhece a cena e não a perde totalmente, mesmo que você queira apenas repetir o movimento da câmera.

Resultado: duas proibições diferentes, mas parece igual - um erro vermelho e uma perda de tempo.

Mapa de profundidade: geometria em vez de faces

Um mapa de profundidade é o mesmo vídeo, apenas redesenhado em escala de cinza. Quanto mais próximo o objeto estiver da câmera, mais brilhante será o pixel. O fundo fica preto e o fundo fica branco. Sem texturas, sem pele, sem olhos: resta apenas o relevo da cena.

Este é um ponto chave para o filtro. Não há nada para verificar - não há rostos. E para geração tem tudo que você precisa: onde estavam os objetos, para onde a câmera estava indo, como o plano mudou. Não copiamos a moldura de outra pessoa, tiramos dela o movimento e a disposição, e a modelo faz o seu próprio desenho, do zero.

Honestamente sobre a limitação: não é um botão “ignorar tudo”. Se você pedir diretamente o rosto de um ator específico, a recusa virá novamente. O mapa de profundidade resolve o problema da geometria e do movimento, não da substituição da personalidade.

À esquerda está o quadro de vídeo original, à direita está o mapa de profundidade: o brilho mostra a distância da câmera aos objetos

Como fazer um mapa de profundidade a partir de um vídeo - grátis e sem enviar para o servidor

Em nosso site, este é um modelo separado na seção de vídeos: Mapa de profundidade (grátis). Está na lista de modelos em MiniMax. Você seleciona um vídeo, aperta um botão e tudo é calculado no seu aparelho.

Conteúdo: o modelo Depth Anything V2 Small (licença Apache 2.0) é reproduzido diretamente no navegador via ONNX Runtime Web. Se você tiver WebGPU, a placa de vídeo conta, caso contrário, o caminho de backup no processador funciona. Os quadros são analisados ​​através de WebCodecs e depois montados novamente em vídeo com o FPS original e a resolução máxima que seu navegador pode suportar.

A saída é MP4 ou WebM - o que o navegador suporta. Há uma prévia do resultado, uma chave “Mais perto - mais claro / Mais perto - mais escuro” e paletas: tons de cinza, Inferno, Viridis. O progresso do processamento é visível quadro a quadro; o processamento longo pode ser cancelado.

Duas coisas que mais importam. Primeiro: o arquivo não vai a lugar nenhum - nem para o nosso servidor, nem para o de outra pessoa, todo o trabalho ocorre no dispositivo. Segundo: os tokens não são amortizados para isso; não há API paga neste modelo. Os pesos do modelo e os arquivos do mecanismo são armazenados em cache no navegador, para que a página seja inicializada mais rapidamente na segunda vez.

Onde será desconfortável. Você precisa de Chrome ou Edge - WebCodecs não está disponível em todos os lugares. Um vídeo longo em um processador não é considerado rápido: um minuto de material de origem pode levar vários minutos. E é melhor não executar 4K em um laptop fraco - comece com 720p, veja o resultado e aumente a resolução.

Desenvolvimento do personagem: dois erros que matam o resultado

A segunda técnica do mesmo vídeo é o correto desenvolvimento do personagem. Esta é uma foto onde o rosto e as roupas são mostrados separadamente. Depende de como é montado se a face flutuará na geração ou permanecerá no lugar.

O primeiro erro: o rosto e as roupas são desenhados em escalas diferentes. A modelo não entende que se trata de uma pessoa e começa ela mesma a completar as proporções. Erro dois: a varredura é montada a partir de pedaços de pessoas diferentes - então a saída é uma face alienígena média e o filtro funciona novamente.

A opção de trabalho é uma digitalização, uma pessoa, a mesma luz e ângulo em ambas as partes.

Se a geração ainda falhar com um erro sobre uma pessoa reconhecível

Acontece que o mapa de profundidade está no lugar, a varredura está montada corretamente, mas Seedance ainda recusa. Isso significa que o problema está em uma das fotos e precisamos encontrá-lo.

O método é simples - o método de eliminação. Você remove as referências uma por uma e começa de novo. Assim que a geração passa, a culpa é da última foto retirada. Então você o reconstrói ou substitui por um mapa de profundidade.

Por muito tempo? Sim. Mas sem adivinhar: em três ou quatro corridas você consegue ver o motivo exato.

E a segunda técnica do mesmo vídeo: uma grade regular é aplicada à imagem culpada - quadrados regulares sobre o rosto. O filtro deixa de ver todo o rosto, mas durante a geração os recursos permanecem legíveis. A grade é colocada em qualquer editor ou simplesmente é solicitado à rede neural que “coloque uma grade quadrada nesta foto”.

Transfira o movimento da câmera de qualquer filme

A mesma técnica funciona sem substituir o rosto. Você pega um quadro de um filme, faz um mapa de profundidade dele, entrega-o ao modelo junto com seu prompt - e você obtém sua cena com o mesmo movimento de câmera: a mesma abordagem, a mesma virada, o mesmo ritmo.

É assim que são filmados trailers, paródias e comerciais quando é necessário um passeio “cinematográfico”, mas não há orçamento para um cinegrafista com guindaste.

O que vem a seguir

A ordem é a seguinte: primeiro o mapa de profundidade - grátis no navegador, sem baixar um arquivo e sem descartar tokens. Então a própria geração - Seedance 2.5 em nosso site, há também um desenvolvimento de personagem e referências.

Se algo não funcionar na primeira vez, comece com um clipe curto de 3 a 5 segundos. Ele mostra o movimento da câmera e o comportamento facial e leva muito menos tempo e tokens.