Português (Portugal)

Um Alterador de Voz com IA serve para aquele momento em que a performance está certa, mas a voz não. Já tem uma gravação — uma narração de rascunho, uma leitura de personagem, uma faixa de porta-voz — e precisa de uma identidade vocal diferente sem voltar a gravar uma única frase. A VisionStory converte a performance para uma voz de destino e, no mesmo processo, alimenta com ela um avatar falante.

Este tutorial importa uma narração de produto em inglês de 10 segundos, converte-a para Anika – Sweet and Lively e renderiza um vídeo de porta-voz em 16:9, 1080p. Antes de começar, confirme que tem os direitos sobre a gravação, o vídeo, a imagem da personagem e a voz de destino que pretende usar.

Passo 1: Escolha o avatar e, depois, mude para Import

Abra o espaço de trabalho de Vídeo com IA e escolha um apresentador digital que combine com o vídeo final — a partir da biblioteca de personagens ou carregando uma foto sobre a qual tem direitos. Depois, mude para o separador Import à direita para trazer uma gravação ou a faixa de áudio de um vídeo.

Atualmente, a VisionStory importa AVI, MP3, MP4, M4A, WAV e MOV. Se o objetivo for apenas substituir uma voz de narração, um ficheiro de áudio limpo é a melhor fonte; se a voz estiver dentro de um vídeo já existente, importe o vídeo diretamente num formato suportado.

Choosing a digital presenter and opening the Import audio panel in the VisionStory AI Video workspace
Defina primeiro a personagem no ecrã e só depois use Import — a performance importada conduz o vídeo falado deste avatar.

Passo 2: Importe a gravação e verifique o segmento utilizável

Clique na área de carregamento e importe a gravação ou o vídeo de origem. O painel mostra a forma de onda, a duração total e o intervalo selecionado — aqui, os 00:00–00:10 completos de uma narração de 10 segundos.

Ouça o original uma vez e confirme que o início e o fim não estão cortados. Se houver ruído ambiente evidente, ative Remover Ruído — mas não persiga o silêncio absoluto; um excesso de remoção de ruído elimina respirações, sílabas suaves e detalhes emocionais que fazem a voz convertida soar humana.

The VisionStory Import panel showing the loaded audio waveform, duration, Remove Noise, and the Change Voice entry
Verifique o nome do ficheiro, a duração e o intervalo selecionado, decida sobre a remoção de ruído e, em seguida, clique em Change Voice para escolher a voz de destino.

Passo 3: Escolha a voz de destino na Voice Library

Clique em Change Voice para abrir a Voice Library. Filtre por Idioma, Género, Idade e Caso de Uso e faça a pré-visualização das opções com o botão de reprodução em cada cartão de voz.

No exemplo, escolhe-se a Anika para transformar uma narração de produto sem vida numa voz feminina mais luminosa e pronta para redes sociais. Anúncios, formação, histórias de personagens e explicadores valorizam de forma diferente a clareza, a energia e a idade — escolha em função do objetivo do conteúdo, e não apenas da amostra que soa mais agradável. O método completo de seleção está em how to choose an AI voice.

Filtering the VisionStory Voice Library by language, gender, age, and use case to pick a target AI voice
Pré-visualize e compare vários candidatos e, depois, escolha a voz que melhor se ajusta ao propósito do conteúdo, à personagem e ao público.

Passo 4: Confirme a voz de destino e as definições de saída

De volta à página de criação, o controlo Change Voice passa a mostrar a voz de destino selecionada. Percorra o resto da configuração: o avatar, a Proporção, o modelo de vídeo e a Resolução. No exemplo, muda-se para 16:9 com V-Character 4.0 a 1080p — ideal para um explicador de produto em formato horizontal ou para o YouTube.

Um Alterador de Voz troca a identidade vocal; não escolhe por si o apresentador certo nem o enquadramento. Antes de gerar, compare a voz de destino com a idade aparente do avatar, a expressão de género e o tom do conteúdo — se não combinarem, volte à Voice Library ou à biblioteca de personagens.

VisionStory showing the selected Anika target voice with 16:9, V-Character 4.0, and 1080p output settings
A página mostra claramente a voz escolhida — confirme já a proporção, o modelo e a resolução, em vez de voltar a renderizar mais tarde.

Passo 5: Gere e reveja o vídeo com a voz alterada

Clique em Generate Talking Video. A VisionStory converte a performance original para a voz de destino e utiliza-a para sincronizar os lábios e as expressões do avatar. Quando a renderização estiver pronta, reproduza o vídeo na íntegra.

Esteja atento a nomes próprios, sílabas suaves, pausas e emoção no final das frases, e observe a boca em passagens rápidas. Se a voz entrar em conflito com a personagem ou com o conteúdo, volte atrás e mude a voz de destino. Se o problema for ruído ou um corte mal feito, corrija o áudio de origem — a conversão de voz não consegue salvar material danificado.

Playing back a finished AI voice-changed avatar spokesperson video in VisionStory
A revisão final é do vídeo completo, não da amostra da biblioteca: identidade vocal, performance original, avatar e sincronização labial têm de funcionar em conjunto.

Problemas comuns e como corrigi-los

  • A voz convertida soa abafada ou com ruído. Verifique se a origem tem ruído de fundo, clipping e volume baixo; ative Remover Ruído ou volte a gravar com mais limpeza. A conversão não consegue reparar material muito distorcido.
  • A voz é natural, mas não serve para o avatar. Volte a escolher uma voz mais próxima da idade, da expressão de género e da energia da personagem — ou mude o avatar. Voz e personagem são avaliados como uma unidade.
  • A emoção difere da gravação original. A conversão mantém o ritmo e as pistas emocionais da performance, mas as vozes diferem no timbre e na gama expressiva. Compare vários candidatos; se necessário, volte a gravar uma performance mais clara.
  • A sincronização labial falha em frases rápidas. Verifique se a origem tem palavras apressadas, arrastadas ou “coladas”. Frases mais curtas e uma gravação mais limpa valem mais do que testar muitas vozes.

Um vídeo utilizável com voz alterada nunca é apenas a voz A trocada pela voz B. Resulta de uma performance de origem limpa, uma voz de destino adequada, um avatar compatível e uma revisão completa do vídeo final. Fixe primeiro a performance, escolha a voz em segundo lugar e, no fim, audite a sincronização labial e a personagem — esta ordem reduz ao máximo a necessidade de voltar a gravar. Para, em vez disso, criar uma voz reutilizável sua, consulte cloning your voice with AI.

Perguntas frequentes

  • Um Alterador de Voz com IA converte a voz numa gravação existente ou numa faixa de vídeo para uma voz de destino escolhida, mantendo o ritmo, as pausas e a emoção da performance original. O VisionStory usa a faixa convertida diretamente no vídeo falado do avatar.