Tendência: garota nas arquibancadas de uma partida coreana - como elas fazem
Resumidamente sobre o principal (BLUF)
Uma garota nas arquibancadas de uma partida coreana é uma tendência que já colecionou milhões de visualizações: a câmera encontra a heroína entre os fãs, mas ela parece não notar a filmagem. Vejamos dois modelos - fotos e vídeos, como funcionam nos bastidores e onde a tendência surge.
Observe qualquer um desses trilhos com atenção. Canal de TV coreano, logotipo SPOTV, placar com entradas. A câmera olha para o pódio - a garota está sentada, sem olhar para a lente, olhando para algum lugar na direção do campo. 5 segundos. Todos.
O vídeo tem um milhão de visualizações. Nos comentários: “onde você conseguiu esse vídeo”, “você realmente estava na Coreia”, “isso é uma rede neural ou ao vivo”. E a maioria das pessoas não consegue descobrir. Aqui está o porquê.
Dois modelos: foto e vídeo
"Garota no pódio - foto." Ele tira uma foto do seu rosto e monta uma moldura do zero no estilo de uma transmissão da SPOTV: arquibancadas, luzes do estádio, torcedores típicos coreanos ao fundo, um copo de plástico na mão, um leque ao lado. Sem uma aparência de IA polida - pelo contrário, com ruído de compressão, leve desfoque de movimento e pele real. O objetivo é fazer com que pareça uma cena de transmissão capturada aleatoriamente, e não uma sessão de fotos de moda. Nos bastidores - GPT Imagem 2. A partir de 6 tokens por geração.
"Garota no pódio - vídeo." O mesmo rosto, mas em movimento. Você carrega uma foto - o modelo de imagem para vídeo Kling 3.0 faz um clipe de 5 segundos “ao vivo do estádio”: o mesmo ângulo de câmera de transmissão, a multidão ao fundo, a mesma pose relaxada. 50 tokens no modo Padrão ou mais no modo Pro.

Como funciona nos bastidores
Foto. Não há frame, ele é gerado do zero. Mas com regras rígidas: nada de retoques, nada de “aumentar os olhos”, nada de brilho plástico. O pedido afirma explicitamente: deve parecer uma filmagem real de uma câmera de transmissão de baixa qualidade, com todas as suas deficiências - manchas leves, ruído digital, brilho causado pelo suor. É isso que dá a sensação de um “quadro real”, e não de um “neurônio”.
Vídeo. Kling 3.0 imagem para vídeo tira sua foto como o primeiro quadro e anima a cena sob demanda: um leve giro da cabeça, movimento da multidão ao fundo, piscadas, expressões faciais de um “olhar surpreendentemente focado no campo”. O prompt claramente requer um quadro horizontal 16:9 e qualidade de transmissão para que caiba no formato de rils cortados e não se pareça com I2V com alongamento vertical.
Como fazer isso manualmente
Se você não quiser usar o modelo:
Para fotos. Você vai seção de imagens, selecione GPT Image 2, anexe uma selfie como referência e escreva uma solicitação em coreano (a modelo entende melhor no contexto da TV coreana):
Para vídeo. Você vai seção de vídeo, selecione Kling 3.0, anexe a mesma foto (você pode primeiro tirá-la em um modelo de foto), 16:9, solicite:
Ou seja, um pipeline funcional: primeiro um modelo de foto (você obtém o quadro de “transmissão” perfeito), depois você joga esse quadro em um modelo de vídeo - e obtém 5 segundos de uma versão animada da mesma pessoa no pódio.
Onde quebra
Foto. A selfie de referência é muito clara e brilhante - a modelo tenta arrastar seu “brilho” para o quadro, e o resultado não é uma transmissão, mas um ensaio de moda. Uma selfie simples sem filtros funciona melhor. Se o resultado ficar muito bonito, regenere-o, o pedido já contém todas as proibições de retoque, mas às vezes o modelo ainda é atraído para o “influencer”.
Vídeo. Kling 3.0 oferece um bom movimento da cabeça e do fundo, mas se a foto for muito “de estúdio” (fundo branco liso, luz perfeita) - ele puxa essa luz para a cena do estádio e você obtém uma mistura estranha. Fotos de retrato funcionam melhor com luz média, sem sombras fortes.
Tentar
Dois modelos prontos em Seção de tendências. Se você quiser um quadro estático para uma postagem, use um cartão de foto no GPT Image 2. Se quiser um vídeo de 5 segundos para um rolo, use uma placa de vídeo no Kling 3.0. Você pode fazer isso aos poucos: primeiro uma foto, depois desta foto - um vídeo.




Perguntas frequentes (FAQ)
Pergunta: Como obter o melhor resultado de uma rede neural?
Resposta: Use instruções detalhadas (descrições) em inglês, defina o estilo e os detalhes da cena.
Question: Esses materiais podem ser usados para fins comerciais?
Resposta: Sim, o conteúdo gerado é inteiramente seu.