Quer fazer uma foto parada falar—um retrato que abre a boca, pisca e diz o que você digitar? Com o VisionStory, você consegue fazer exatamente isso a partir de uma única imagem, direto no seu navegador, sem câmera e sem nenhuma experiência de edição. O vídeo acima mostra todo o fluxo, e o guia passo a passo abaixo cobre cada etapa em detalhes.
Ao longo do processo, você vai enviar um retrato e prepará-lo como seu próprio avatar reutilizável. Outros usuários não podem vê-lo, e você pode escolhê-lo novamente em vídeos futuros em vez de enviar a mesma imagem toda vez. Tudo funciona dentro da ferramenta de foto falante do VisionStory com uma conta gratuita.
Passo 1: Envie um retrato nítido
Abra Vídeo com IA. No painel de Personagens, escolha Enviar e selecione uma imagem do seu dispositivo, ou arraste a foto diretamente para a área de envio. Use uma pessoa nítida e de frente, com rosto e ombros visíveis, olhos e boca sem obstruções e um pouco de espaço ao redor do assunto para reenquadrar depois.
- Arquivos compatíveis: JPG, JPEG, PNG, WebP e HEIC.
- Tamanho máximo do arquivo: 30 MB.
- Tamanho inicial recomendado: pelo menos 512 x 768 pixels para um retrato.
- Comportamento de envio: uma imagem de origem por vez.

Combine a composição da imagem de origem com o destino do vídeo. Um retrato muito recortado pode funcionar em 9:16, mas virar um recorte de rosto desconfortavelmente apertado em 16:9, porque não há área de imagem à esquerda e à direita para preencher o quadro mais largo.
Passo 2: Deixe o VisionStory validar e preparar o avatar
Após o envio, o VisionStory verifica se a imagem contém uma pessoa utilizável e a prepara como personagem. Uma falha no envio quase sempre está ligada à foto de origem: o rosto pode estar pequeno demais, muito coberto, virado demais para o lado, borrado ou perto demais de outro rosto.
Se a preparação falhar, não continue tentando o mesmo recorte. Escolha uma fonte mais nítida, com um rosto maior, um ângulo mais direto, ombros visíveis, iluminação uniforme e menos obstrução.

Quando o processamento terminar, o avatar aparece acima da biblioteca pública de personagens e abre na prévia do avatar. Ele fica visível apenas para você.
Passo 3: Pré-visualize ou troque a voz atribuída
O VisionStory atribui automaticamente uma voz inicial adequada com base na idade e no gênero aparentes da pessoa. Você pode mantê-la, pré-visualizá-la ou trocar por outra.
- Selecione a voz atual para abrir a Biblioteca de Vozes.
- Use o botão de reprodução à direita de uma voz para ouvir um exemplo.
- Se não combinar, filtre por Idioma, Gênero, Idade e Caso de Uso.
- Pré-visualize algumas alternativas e escolha a voz que combine com o avatar e com o objetivo do vídeo.

Uma voz pode combinar com a idade e o gênero aparentes da pessoa, mas ainda assim soar errada para narração, educação, publicidade ou conteúdo conversacional. Combine a pessoa e o objetivo, não apenas os dados demográficos.
Passo 4: Reenquadre a foto para o destino
Use a prévia do avatar para decidir quanto da pessoa aparece no vídeo final. Arraste a foto para reposicionar o assunto e use os controles de zoom para aproximar ou afastar. Depois, escolha a proporção de aspecto que combina com onde você vai publicar:
- 9:16 (retrato) para TikTok, Instagram Reels, YouTube Shorts e outras colocações voltadas para mobile.
- 1:1 (quadrado) para posts quadrados, layouts centrados no perfil e incorporações flexíveis.
- 16:9 (paisagem) para YouTube, apresentações, sites e cursos em widescreen.

O zoom não consegue revelar pixels que não existem. Se a pessoa já encosta em todas as bordas da foto de origem, comece com uma imagem com mais fundo em vez de forçar um recorte mais largo.
Passo 5: Entenda o que Change Look e Generate Image fazem
Duas ferramentas de imagem com IA ficam ao lado do avatar, e ajuda saber a diferença antes de usá-las.
Change Look abre um chat de IA com seu avatar atual já anexado, para você descrever uma nova roupa, cenário ou estilo. É um fluxo de imagem para imagem, e o avatar original continua disponível. Já Generate Image começa a partir de uma descrição escrita do personagem, em vez de uma foto, então é um fluxo de texto para imagem. Em ambos, você pode continuar conversando para refinar o resultado.

Em resumo: use Change Look quando o personagem já existe e precisa de um novo visual, e use Generate Image quando você quer criar um personagem a partir de um prompt.
Passo 6: Adicione um roteiro curto e gere o vídeo falante
Com o avatar enviado selecionado, digite uma frase curta e conversacional na caixa de Roteiro. Uma linha curta renderiza mais rápido e facilita avaliar foto, recorte, voz, sincronização labial e movimento em conjunto.
Clique em Generate Talking Video. O VisionStory anima o rosto, sincroniza os lábios com a voz e adiciona piscadas e movimento de cabeça realistas usando o avatar, o enquadramento, o roteiro e a voz selecionados. A renderização leva alguns minutos.

Trate esse primeiro resultado como um teste prático da foto de origem. Revise quatro pontos:
- O rosto permanece nítido o suficiente no tamanho final.
- Os olhos e a boca permanecem sem obstruções durante o movimento.
- A cabeça e os ombros ficam confortavelmente dentro da proporção escolhida.
- O avatar em movimento ainda parece com a pessoa da foto de origem.
Se o recorte estiver apertado demais ou o rosto parecer sem nitidez em movimento, corrija primeiro a imagem de origem ou o enquadramento. Mudar o roteiro não vai resolver um problema de composição.
Passo 7: Reutilize ou remova seu avatar de foto falante
De volta à lista de Personagens, seu avatar enviado fica acima da biblioteca pública de personagens e pode ser selecionado sempre que você quiser o mesmo apresentador novamente. Outros usuários não podem vê-lo, e assinantes podem criar e manter avatares ilimitados.
- Reutilize: selecione o avatar em vez de enviar a foto de novo.
- Troque o visual: abra o avatar e escolha uma das miniaturas de visuais salvos.
- Remova: passe o mouse sobre o avatar para revelar o botão de excluir no canto superior direito e confirme antes de excluir o avatar e seus visuais.

Solução de problemas comuns com fotos
O VisionStory não encontra um rosto utilizável. Use uma imagem mais clara e mais nítida, com um rosto maior e de frente. Evite olhos ou bocas cobertos, ângulos fortes de perfil e fotos em que outro rosto fique muito perto do assunto principal.
O recorte em paisagem está muito fechado. Provavelmente o retrato de origem não tem área de imagem suficiente nas laterais. Use uma fonte mais ampla ou uma com mais espaço vazio ao redor da pessoa.
O avatar ainda está sendo preparado. Aguarde a preparação terminar antes de usar o personagem. Se travar, atualize a visualização de Personagens e verifique se o avatar já apareceu antes de enviar outra cópia.
O resultado parece sem nitidez. Comece com uma foto de maior resolução, em foco, e evite ampliar demais um rosto pequeno. A resolução de saída não consegue recuperar detalhes que faltavam na origem.
É só isso para fazer uma foto falar: envie um retrato, combine uma voz, enquadre e gere. Sua foto agora é um avatar falante reutilizável, que você pode usar sempre que precisar.
Quer o fluxo completo de roteiro, voz, configurações, créditos e geração? Siga How to Create an AI Talking Avatar ou transforme roteiros completos em vídeos com IA em escala. Ou comece agora mesmo: crie sua primeira foto falante grátis.
