Português (Portugal)

Imagem-para-vídeo não é sobre criar uma nova imagem — é sobre dar tempo e movimento a uma imagem em que já confia. Carregue uma foto de produto, um retrato ou um frame conceptual, descreva o que deve mexer e como a câmara se deve comportar, e a ferramenta de imagem para vídeo gera um clip em movimento que mantém o seu sujeito intacto.

Isso torna-a a ferramenta certa sempre que a aparência é inegociável. Em comparação com texto-para-vídeo puro, a imagem inicial fixa a pessoa, o produto, o outfit, a cena e a composição; o papel do prompt é dizer o que pode mexer, como a câmara se move e que detalhes não podem mudar.

Passo 1: Escolha uma imagem inicial que aguente a animação

No Gerador de Vídeo com IA, mude para Imagem para Vídeo e carregue a sua imagem como o frame inicial. Prefira imagens com um sujeito completo, iluminação limpa e uma composição já próxima da proporção final. Uma foto de produto deve mostrar a forma completa e as partes principais; um retrato deve evitar mãos, cabelo ou roupa cortados; uma cena deve deixar espaço para a câmara se mover.

Este tutorial usa uma foto 16:9 de uma caixa de auriculares mate preta. O prompt pede que a tampa abra ligeiramente, que uma luz roxa varra a superfície e um avanço lento — mantendo a geometria do produto estável, sem novos objetos e sem texto.

A caixa dos auriculares mantém-se idêntica enquanto a tampa abre ligeiramente e uma luz roxa suave varre a superfície.
Avanço lento e cinematográfico da câmara, reflexos realistas, geometria do produto estável, sem novos objetos, sem texto.
Uploading a product photo to VisionStory Image to Video and writing a motion prompt
O frame inicial define o produto e a composição; o prompt apenas descreve a ação da tampa, a varredura de luz, o avanço e o que deve manter-se estável.

Passo 2: Decida um frame final e, depois, defina os parâmetros

Se a imagem só precisar de movimento natural, ignore o frame final. Carregue uma segunda imagem apenas quando o vídeo tiver de passar de uma imagem exata para outra — e mantenha ambos os frames com o mesmo sujeito, ponto de vista e cena, ou o modelo pode dar saltos ou distorcer pelo meio.

Depois escolha o modelo, a duração, a proporção e a resolução do resultado. Planos de detalhe de produto costumam funcionar melhor com movimento mais lento; um gancho para redes sociais pode ser mais rápido, desde que o produto continue legível. Confirme que a proporção corresponde à imagem de entrada, para que o sistema não corte o sujeito para preencher o enquadramento.

Resolution, duration, and aspect ratio settings for VisionStory image to video generation
Este exemplo usa apenas o frame inicial, com Seedance 2.0, 720p, 16:9 e 15 segundos para observar a geometria do produto num plano mais longo.

Passo 3: Gere e depois verifique primeiro a miniatura

Clique em gerar. O clip final aparece no topo da lista de Vídeos com a duração, resolução, título e hora de criação. Antes de reproduzir seja o que for, faça uma pergunta à miniatura: isto ainda é o mesmo produto ou a mesma pessoa?

Se o primeiro frame já estiver errado — cor, número de peças, identidade ou enquadramento — troque por uma imagem de entrada mais limpa. Se o primeiro frame estiver certo mas o plano se degradar a meio, reduza o movimento, encurte a duração ou reforce as restrições de aparência no prompt.

A completed image-to-video generation showing in the VisionStory Videos list
O primeiro cartão é o resultado desta execução — a miniatura continua a manter a caixa de auriculares preta como sujeito.

Passo 4: Reproduza o clip inteiro e audite a consistência do sujeito

Reproduza o resultado do início ao fim no Video Viewer. Para produtos, observe a forma, os materiais, botões, portas e o número de peças. Para pessoas, observe o rosto, mãos, cabelo, roupa e como se integram no fundo. Para cenas, observe a estrutura, a perspetiva e a continuidade da iluminação.

Detalhes da Geração mantém o prompt original, o modelo e a resolução. Transfira o clip quando passar no teste e use-o em anúncios de produto, vídeos de afiliados, clips para redes sociais, B-roll do canal ou numa edição de história mais longa. Se falhar, corrija o prompt ou a imagem de entrada — não tente esconder um erro óbvio do sujeito na edição.

Previewing an image-generated video in the VisionStory Video Viewer with its motion prompt
A pré-visualização completa serve para auditar a estrutura do produto, as mudanças de luz e o movimento da câmara ao longo de toda a timeline — não apenas o primeiro frame.

Passo 5: Leve o plano que funciona para um workflow de vídeo completo

Um clip de imagem-para-vídeo é normalmente um plano dentro de uma peça maior. Vendedores de produtos combinam-no com um porta-voz avatar ou um explicador de UGC com IA; criadores do YouTube usam-no como B-roll; equipas de marca e formação usam-no para mostrar produtos, processos ou cenas conceptuais.

Quando gerar vários planos sobre o mesmo tema, mantenha fixa a imagem de entrada, a versão do produto, a identidade da personagem e o estilo visual, e altere exatamente uma variável de movimento por execução. Comparar aberturas, transições e revelações torna-se muito mais fácil — e a deriva de aparência entre gerações torna-se mais rara.

Problemas comuns e como resolvê-los

  • O produto transforma-se noutro produto a meio do movimento. Use uma imagem de produto mais nítida e mais completa, reduza o número de ações e indique os materiais, cores, estrutura e peças que não podem mudar.
  • Rostos ou mãos tremem. Escolha uma imagem de entrada com um sujeito frontal e nítido e mãos desobstruídas, evite grandes rotações e gestos complexos, e comece com clips mais curtos.
  • O resultado é apenas um zoom lento. Descreva uma ação visível do sujeito ou uma mudança no ambiente e um movimento de câmara específico — não apenas “fazer a imagem mexer”.
  • A imagem de entrada é cortada. Ajuste a imagem de origem à proporção de destino e mantenha o sujeito na área segura; não confie no gerador para converter landscape em portrait.
  • O plano dá saltos entre os frames inicial e final. Mantenha ambos os frames no mesmo sujeito, ponto de vista e cena, alterando apenas o estado que quer que aconteça.

A fasquia para imagem-para-vídeo não é mais movimento — é um sujeito que se mantém credível enquanto ganha movimento que serve o conteúdo. Primeiro, fixe a aparência; depois, dirija o movimento. Se o que quer mesmo é um retrato que fala, esse é um workflow diferente: fazer uma foto falar. E quando não há nenhuma imagem utilizável, comece pelas palavras com texto para vídeo.

Perguntas frequentes

  • Uma imagem com o sujeito completo, iluminação clara, Resolução suficiente e uma composição já próxima da Proporção final. As margens essenciais do produto, da pessoa ou da cena não devem ficar cortadas.