Audio y voz
VisionStory admite 88 idiomas, incluyendo inglés, chino, español, árabe, portugués, ruso, japonés, punjabi, alemán, francés, coreano, turco, tamil, vietnamita, hindi, bengalí, urdu, persa, italiano, indonesio, tailandés, marathi, telugu, ucraniano, malayo, rumano, polaco, holandés, gujarati y kannada.
VisionStory ofrece 1,000+ voces en su biblioteca, que se pueden filtrar por género, edad y caso de uso. Si no encuentras una voz adecuada, también puedes crear un clon de voz personalizado con IA subiendo o grabando tu propio audio.
Las opciones de voz limitadas en ciertos idiomas están específicamente ajustadas para esos idiomas. Sin embargo, el soporte de idioma subyacente permite que voces, como las en inglés, hablen múltiples idiomas, proporcionando flexibilidad en la selección de voces.
La clonación de voz te permite crear una voz AI personalizada que imita una voz específica al subir o grabar audio. Para clonar una voz, asegúrate de que el audio esté grabado claramente en un entorno tranquilo para obtener los mejores resultados.
Para utilizar el clonado de voz en la generación de vídeos, necesitas suscribirte al plan Pro o superior.
La clonación de voz es compatible de forma gratuita con más de 32 idiomas. La lista de idiomas admitidos puede variar, así que consulta la función de clonación de voz para ver las opciones más actualizadas. Ten en cuenta que, aunque la clonación es gratuita, para utilizar la voz clonada en la generación de vídeos es necesario tener una suscripción.
La previsualización de audio te permite generar el discurso para tu vídeo animado antes de crear el vídeo final. Esta función te ayuda a comprobar la voz, la pronunciación y las pausas para asegurarte de que cumplen tus expectativas. Puedes ajustar la voz antes de generar el vídeo. Para todos los suscriptores, esta función es gratuita y la cuota de previsualización se restablece diariamente. Si alcanzas el límite diario de previsualizaciones, puedes adquirir más cuota utilizando créditos.
El ícono del cronómetro y la función +0.5s te permiten insertar una pausa de 0.5 segundos en la voz generada. Puedes agregar múltiples íconos de cronómetro de manera consecutiva para crear pausas más largas según sea necesario en tu video.
La importación de URL te permite importar audio desde un enlace al descargar y extraer el audio de la URL especificada para usarlo en la generación de videos. Actualmente, es compatible con enlaces de YouTube y TikTok. Si deseas ver soporte para más sitios, por favor contáctanos. Además, puedes usar la función de cambio de voz para modificar el audio importado mientras mantienes el contenido original.
La función de eliminación de ruido ayuda a eliminar el ruido de fondo del audio cuando lo importas o grabas, asegurando una calidad de audio más clara para tus videos. Esta función requiere un Plan Pro o superior para su uso.
La función de cambio de voz te permite modificar la voz en un discurso, lo que te permite crear versiones únicas del audio mientras mantienes el contenido original. Esta función requiere un Plan Pro o superior para su uso.
La emoción en la voz se transmite a través del texto que proporcionas. Cuando usas diferentes textos, el sistema de texto a voz (TTS) aplica naturalmente la emoción adecuada, por lo que no se necesita control adicional.
Al usar la función del cronómetro, cada cronómetro representa una pausa de 0.5 segundos, y puedes usarlos de manera consecutiva para crear pausas más largas, hasta un máximo de 3 segundos. Sin embargo, evita usar más de dos pausas consecutivas dentro de un solo segmento de texto, ya que esto puede hacer que la IA produzca sonidos o artefactos inesperados.