Áudio e Voz
O VisionStory suporta 88 idiomas, incluindo inglês, chinês, espanhol, árabe, português, russo, japonês, punjabi, alemão, francês, coreano, turco, tâmil, vietnamita, hindi, bengali, urdu, persa, italiano, indonésio, tailandês, marathi, telugu, ucraniano, malaio, romeno, polonês, holandês, gujarati e kannada.
O VisionStory oferece 1.000+ vozes em sua biblioteca, que podem ser filtradas por gênero, idade e caso de uso. Se você não encontrar uma voz adequada, também pode criar um clone de voz de IA personalizado fazendo o upload ou gravando áudio.
As opções de voz limitadas em certos idiomas são especificamente ajustadas para esses idiomas. No entanto, o suporte subjacente ao idioma permite que vozes, como as em inglês, falem vários idiomas, proporcionando flexibilidade na seleção de vozes.
A clonagem de voz permite que você crie uma voz AI personalizada que imita uma voz específica ao fazer o upload ou gravar áudio. Para clonar uma voz, certifique-se de que o áudio seja gravado de forma clara em um ambiente silencioso para obter resultados ideais.
Para usar a clonagem de voz na geração de vídeos, é necessário assinar o plano Pro ou superior.
A clonagem de voz é suportada gratuitamente em mais de 32 idiomas. A lista de idiomas suportados pode mudar, então verifique a função de clonagem de voz para as opções mais atualizadas. Atenção: embora a clonagem seja gratuita, para usar a voz clonada na geração de vídeos é necessário ter uma assinatura.
O áudio de pré-visualização permite que você gere a fala do seu vídeo falante antes da criação final do vídeo. Essa funcionalidade ajuda a verificar a voz, a pronúncia e as pausas para garantir que estejam de acordo com suas expectativas. Você pode ajustar a voz antes de gerar o vídeo. Para todos os assinantes, esse recurso é gratuito, com uma cota de pré-visualização que é renovada diariamente. Caso atinja o limite diário, é possível adquirir mais cota utilizando créditos.
O ícone de cronômetro e o recurso +0,5s permitem que você insira uma pausa de 0,5 segundos na voz gerada. Você pode adicionar vários ícones de cronômetro consecutivamente para criar pausas mais longas conforme necessário em seu vídeo.
A importação de URL permite que você importe áudio de um link, fazendo o download e extraindo o áudio da URL especificada para usar na geração de vídeos. Atualmente, suporta links do YouTube e TikTok. Se você gostaria de ver suporte para mais sites, entre em contato conosco. Além disso, você pode usar o recurso de mudança de voz para modificar o áudio importado, mantendo o conteúdo original.
O recurso de remoção de ruído ajuda a eliminar o ruído de fundo do áudio quando você o importa ou grava, garantindo uma qualidade de áudio mais clara para seus vídeos. Este recurso requer um Plano Pro ou superior para ser utilizado.
O recurso de mudança de voz permite que você modifique a voz em um discurso, possibilitando criar versões únicas do áudio enquanto mantém o conteúdo original. Este recurso requer um Plano Pro ou superior para ser utilizado.
A emoção na voz é transmitida através do texto que você fornece. Quando você usa textos diferentes, o sistema de texto para fala (TTS) aplica naturalmente a emoção apropriada, portanto, nenhum controle adicional é necessário.
Ao usar o recurso de cronômetro, cada cronômetro representa uma pausa de 0,5 segundos, e você pode usá-los consecutivamente para criar pausas mais longas, até um máximo de 3 segundos. No entanto, evite usar mais de duas pausas consecutivas dentro de um único segmento de texto, pois isso pode fazer com que a IA produza sons ou artefatos inesperados.