Imagem-para-vídeo não é sobre criar uma nova imagem — é sobre dar tempo e movimento a uma imagem em que já confia. Carregue uma foto de produto, um retrato ou um frame conceptual, descreva o que deve mexer e como a câmara se deve comportar, e a ferramenta de imagem para vídeo gera um clip em movimento que mantém o seu sujeito intacto.
Isso torna-a a ferramenta certa sempre que a aparência é inegociável. Em comparação com texto-para-vídeo puro, a imagem inicial fixa a pessoa, o produto, o outfit, a cena e a composição; o papel do prompt é dizer o que pode mexer, como a câmara se move e que detalhes não podem mudar.
Passo 1: Escolha uma imagem inicial que aguente a animação
No Gerador de Vídeo com IA, mude para Imagem para Vídeo e carregue a sua imagem como o frame inicial. Prefira imagens com um sujeito completo, iluminação limpa e uma composição já próxima da proporção final. Uma foto de produto deve mostrar a forma completa e as partes principais; um retrato deve evitar mãos, cabelo ou roupa cortados; uma cena deve deixar espaço para a câmara se mover.
Este tutorial usa uma foto 16:9 de uma caixa de auriculares mate preta. O prompt pede que a tampa abra ligeiramente, que uma luz roxa varra a superfície e um avanço lento — mantendo a geometria do produto estável, sem novos objetos e sem texto.
A caixa dos auriculares mantém-se idêntica enquanto a tampa abre ligeiramente e uma luz roxa suave varre a superfície. Avanço lento e cinematográfico da câmara, reflexos realistas, geometria do produto estável, sem novos objetos, sem texto.

Passo 2: Decida um frame final e, depois, defina os parâmetros
Se a imagem só precisar de movimento natural, ignore o frame final. Carregue uma segunda imagem apenas quando o vídeo tiver de passar de uma imagem exata para outra — e mantenha ambos os frames com o mesmo sujeito, ponto de vista e cena, ou o modelo pode dar saltos ou distorcer pelo meio.
Depois escolha o modelo, a duração, a proporção e a resolução do resultado. Planos de detalhe de produto costumam funcionar melhor com movimento mais lento; um gancho para redes sociais pode ser mais rápido, desde que o produto continue legível. Confirme que a proporção corresponde à imagem de entrada, para que o sistema não corte o sujeito para preencher o enquadramento.

Passo 3: Gere e depois verifique primeiro a miniatura
Clique em gerar. O clip final aparece no topo da lista de Vídeos com a duração, resolução, título e hora de criação. Antes de reproduzir seja o que for, faça uma pergunta à miniatura: isto ainda é o mesmo produto ou a mesma pessoa?
Se o primeiro frame já estiver errado — cor, número de peças, identidade ou enquadramento — troque por uma imagem de entrada mais limpa. Se o primeiro frame estiver certo mas o plano se degradar a meio, reduza o movimento, encurte a duração ou reforce as restrições de aparência no prompt.

Passo 4: Reproduza o clip inteiro e audite a consistência do sujeito
Reproduza o resultado do início ao fim no Video Viewer. Para produtos, observe a forma, os materiais, botões, portas e o número de peças. Para pessoas, observe o rosto, mãos, cabelo, roupa e como se integram no fundo. Para cenas, observe a estrutura, a perspetiva e a continuidade da iluminação.
Detalhes da Geração mantém o prompt original, o modelo e a resolução. Transfira o clip quando passar no teste e use-o em anúncios de produto, vídeos de afiliados, clips para redes sociais, B-roll do canal ou numa edição de história mais longa. Se falhar, corrija o prompt ou a imagem de entrada — não tente esconder um erro óbvio do sujeito na edição.

Passo 5: Leve o plano que funciona para um workflow de vídeo completo
Um clip de imagem-para-vídeo é normalmente um plano dentro de uma peça maior. Vendedores de produtos combinam-no com um porta-voz avatar ou um explicador de UGC com IA; criadores do YouTube usam-no como B-roll; equipas de marca e formação usam-no para mostrar produtos, processos ou cenas conceptuais.
Quando gerar vários planos sobre o mesmo tema, mantenha fixa a imagem de entrada, a versão do produto, a identidade da personagem e o estilo visual, e altere exatamente uma variável de movimento por execução. Comparar aberturas, transições e revelações torna-se muito mais fácil — e a deriva de aparência entre gerações torna-se mais rara.
Problemas comuns e como resolvê-los
- O produto transforma-se noutro produto a meio do movimento. Use uma imagem de produto mais nítida e mais completa, reduza o número de ações e indique os materiais, cores, estrutura e peças que não podem mudar.
- Rostos ou mãos tremem. Escolha uma imagem de entrada com um sujeito frontal e nítido e mãos desobstruídas, evite grandes rotações e gestos complexos, e comece com clips mais curtos.
- O resultado é apenas um zoom lento. Descreva uma ação visível do sujeito ou uma mudança no ambiente e um movimento de câmara específico — não apenas “fazer a imagem mexer”.
- A imagem de entrada é cortada. Ajuste a imagem de origem à proporção de destino e mantenha o sujeito na área segura; não confie no gerador para converter landscape em portrait.
- O plano dá saltos entre os frames inicial e final. Mantenha ambos os frames no mesmo sujeito, ponto de vista e cena, alterando apenas o estado que quer que aconteça.
A fasquia para imagem-para-vídeo não é mais movimento — é um sujeito que se mantém credível enquanto ganha movimento que serve o conteúdo. Primeiro, fixe a aparência; depois, dirija o movimento. Se o que quer mesmo é um retrato que fala, esse é um workflow diferente: fazer uma foto falar. E quando não há nenhuma imagem utilizável, comece pelas palavras com texto para vídeo.
