Áudio & Voz
O VisionStory suporta 88 idiomas, incluindo inglês, chinês, espanhol, árabe, português, russo, japonês, punjabi, alemão, francês, coreano, turco, tâmil, vietnamita, hindi, bengali, urdu, persa, italiano, indonésio, tailandês, marathi, telugu, ucraniano, malaio, romeno, polonês, holandês, gujarati e canarês.
O VisionStory oferece 1.000+ vozes em sua biblioteca, que podem ser filtradas por gênero, idade e caso de uso. Se você não encontrar uma voz adequada, também pode criar uma voz personalizada de IA clonando uma voz ao enviar ou gravar um áudio.
As opções limitadas de vozes em certos idiomas são especialmente ajustadas para esses idiomas. No entanto, o suporte de linguagem da plataforma permite que vozes, como as em inglês, falem vários idiomas, oferecendo flexibilidade na escolha da voz.
A clonagem de voz permite criar uma voz de IA personalizada que imita uma voz específica, fazendo upload ou gravando um áudio. Para clonar uma voz, certifique-se de que o áudio seja gravado com clareza em um ambiente silencioso para obter os melhores resultados.
Para usar a clonagem de voz na geração de vídeos, é necessário assinar o plano Pro ou superior.
A clonagem de voz é suportada gratuitamente em mais de 32 idiomas. A lista de idiomas disponíveis pode mudar, então verifique a função de clonagem de voz para as opções mais atualizadas. Atenção: embora a clonagem seja gratuita, para usar a voz clonada na geração de vídeos é necessário ter uma assinatura.
O áudio de pré-visualização permite que você gere a fala do seu vídeo falante antes da criação final do vídeo. Esse recurso ajuda a verificar a voz, a pronúncia e as pausas para garantir que estejam de acordo com suas expectativas. Você pode ajustar a voz antes de gerar o vídeo. Para todos os assinantes, esse recurso é gratuito, com uma cota de pré-visualização que é renovada diariamente. Se atingir o limite diário de pré-visualizações, é possível adquirir mais cota utilizando créditos.
O ícone do cronômetro e a função +0,5s permitem inserir uma pausa de 0,5 segundo na voz gerada. Você pode adicionar vários ícones de cronômetro consecutivos para criar pausas mais longas conforme necessário no seu vídeo.
A importação por URL permite que você importe áudio a partir de um link, baixando e extraindo o áudio da URL especificada para usar na geração de vídeos. Atualmente, são suportados links do YouTube e TikTok. Se desejar suporte para outros sites, entre em contato conosco. Além disso, você pode usar o recurso de modificador de voz para alterar o áudio importado mantendo o conteúdo original.
O recurso de remoção de ruído ajuda a eliminar ruídos de fundo do áudio ao importar ou gravar, garantindo uma qualidade de áudio mais clara para seus vídeos. Este recurso requer um plano Pro ou superior para ser utilizado.
O recurso de modificador de voz permite alterar a voz em uma fala, possibilitando criar versões únicas do áudio enquanto mantém o conteúdo original. Este recurso requer um plano Pro ou superior para ser utilizado.
A emoção na voz é transmitida pelo texto que você fornece. Ao utilizar textos diferentes, o sistema de texto para fala (TTS) aplica automaticamente a emoção adequada, portanto, não é necessário nenhum controle adicional.
Ao usar o recurso de cronômetro, cada cronômetro representa uma pausa de 0,5 segundo, e você pode utilizá-los consecutivamente para criar pausas mais longas, até o máximo de 3 segundos. No entanto, evite usar mais de duas pausas consecutivas em um mesmo trecho de texto, pois isso pode fazer com que a IA produza sons ou artefatos inesperados.