Audio y voz
VisionStory admite 88 idiomas, incluyendo: inglés, chino, español, árabe, portugués, ruso, japonés, punjabi, alemán, francés, coreano, turco, tamil, vietnamita, hindi, bengalí, urdu, persa, italiano, indonesio, tailandés, maratí, telugu, ucraniano, malayo, rumano, polaco, neerlandés, gujarati y canarés.
VisionStory ofrece 1,000+ voces en su biblioteca, las cuales se pueden filtrar por género, edad y caso de uso. Si no encuentras una voz adecuada, también puedes crear un clon de voz personalizado con IA subiendo o grabando tu propio audio.
Las opciones limitadas de voces en ciertos idiomas están especialmente ajustadas para esos idiomas. Sin embargo, la tecnología subyacente permite que voces, como las de inglés, hablen varios idiomas, lo que te brinda flexibilidad al seleccionar una voz.
La clonación de voz te permite crear una voz personalizada de IA que imita una voz específica al subir o grabar un audio. Para clonar una voz, asegúrate de que el audio esté grabado claramente en un ambiente silencioso para obtener los mejores resultados.
Para usar la clonación de voz en la generación de videos, necesitas suscribirte al plan Pro o superior.
La clonación de voz es compatible de forma gratuita con más de 32 idiomas. La lista de idiomas compatibles puede cambiar, así que revisa la función de clonación de voz para ver las opciones más actualizadas. Ten en cuenta: aunque la clonación es gratuita, para usar la voz clonada en un video necesitas una suscripción.
El audio de vista previa te permite generar el discurso para tu video hablado antes de crear el video final. Esta función te ayuda a revisar la voz, la pronunciación y las pausas para asegurarte de que cumplan con tus expectativas. Puedes hacer ajustes a la voz antes de generar el video. Para todos los suscriptores, esta función es gratuita y la cuota de vistas previas se restablece diariamente. Si alcanzas el límite diario de vistas previas, puedes comprar más cuota usando créditos.
El ícono de cronómetro y la función +0.5s te permiten insertar una pausa de 0.5 segundos en la voz generada. Puedes agregar varios íconos de cronómetro consecutivos para crear pausas más largas según lo necesites en tu video.
La importación por URL te permite importar audio desde un enlace descargando y extrayendo el audio de la URL especificada para usarlo en la generación de videos. Actualmente, es compatible con enlaces de YouTube y TikTok. Si deseas que se admitan más sitios, por favor contáctanos. Además, puedes usar la función de cambiador de voz para modificar el audio importado mientras mantienes el contenido original.
La función de eliminar ruido ayuda a eliminar el ruido de fondo del audio cuando lo importas o grabas, asegurando una calidad de audio más clara para tus videos. Esta función requiere una suscripción al Plan Pro o superior para poder usarla.
La función de cambiador de voz te permite modificar la voz en un discurso, lo que te permite crear versiones únicas del audio mientras mantienes el contenido original. Esta función requiere una suscripción al Plan Pro o superior.
La emoción en la voz se transmite a través del texto que proporcionas. Cuando usas diferentes textos, el sistema de texto a voz (TTS) aplica automáticamente la emoción adecuada, por lo que no se necesita control adicional.
Al usar la función de cronómetro, cada cronómetro representa una pausa de 0.5 segundos y puedes usarlos de manera consecutiva para crear pausas más largas, hasta un máximo de 3 segundos. Sin embargo, evita usar más de dos pausas consecutivas dentro de un mismo segmento de texto, ya que esto puede hacer que la IA produzca sonidos o efectos inesperados.