Audio & Suara
VisionStory mendukung 88 bahasa, termasuk: Inggris, Mandarin, Spanyol, Arab, Portugis, Rusia, Jepang, Punjabi, Jerman, Prancis, Korea, Turki, Tamil, Vietnam, Hindi, Bengali, Urdu, Persia, Italia, Indonesia, Thailand, Marathi, Telugu, Ukraina, Melayu, Rumania, Polandia, Belanda, Gujarati, dan Kannada.
VisionStory menyediakan 1.000+ suara di perpustakaannya, yang dapat difilter berdasarkan jenis kelamin, usia, dan kebutuhan penggunaan. Jika Anda tidak menemukan suara yang sesuai, Anda juga dapat membuat kloning suara AI khusus dengan mengunggah atau merekam audio sendiri.
Pilihan suara yang terbatas pada beberapa bahasa memang disesuaikan secara khusus untuk bahasa tersebut. Namun, sistem dasar VisionStory memungkinkan suara-suara, seperti suara berbahasa Inggris, untuk berbicara dalam berbagai bahasa lain, sehingga Anda tetap memiliki fleksibilitas dalam memilih suara.
Voice cloning memungkinkan Anda membuat suara AI khusus yang meniru suara tertentu dengan mengunggah atau merekam audio. Untuk melakukan cloning suara, pastikan audio direkam dengan jelas di lingkungan yang tenang agar hasilnya optimal.
Untuk menggunakan kloning suara dalam pembuatan video, Anda perlu berlangganan minimal Pro Plan atau yang lebih tinggi.
Kloning suara didukung secara gratis dalam lebih dari 32 bahasa. Daftar bahasa yang didukung dapat berubah sewaktu-waktu, jadi silakan cek fitur kloning suara untuk pilihan terbaru. Perlu dicatat: meskipun proses kloning gratis, untuk menggunakan suara hasil kloning dalam video diperlukan langganan.
Preview audio memungkinkan Anda menghasilkan suara untuk video berbicara Anda sebelum proses pembuatan video final. Fitur ini membantu Anda memeriksa suara, pelafalan, dan jeda agar sesuai dengan harapan Anda. Anda dapat melakukan penyesuaian pada suara sebelum membuat video. Untuk semua pelanggan, fitur ini dapat digunakan secara gratis dengan kuota preview yang direset setiap hari. Jika Anda mencapai batas kuota preview harian, Anda dapat membeli kuota tambahan menggunakan kredit.
Ikon stopwatch dan fitur +0,5s memungkinkan Anda menambahkan jeda selama 0,5 detik pada suara yang dihasilkan. Anda dapat menambahkan beberapa ikon stopwatch secara berurutan untuk membuat jeda yang lebih panjang sesuai kebutuhan dalam video Anda.
Impor URL memungkinkan Anda mengimpor audio dari sebuah tautan dengan cara mengunduh dan mengekstrak audio dari URL yang ditentukan untuk digunakan dalam pembuatan video. Saat ini, fitur ini mendukung tautan dari YouTube dan TikTok. Jika Anda ingin dukungan untuk situs lain, silakan hubungi kami. Selain itu, Anda dapat menggunakan fitur pengubah suara (voice changer) untuk memodifikasi audio yang diimpor sambil tetap mempertahankan konten aslinya.
Fitur remove noise membantu menghilangkan suara latar belakang dari audio saat Anda mengimpor atau merekamnya, sehingga kualitas audio pada video Anda menjadi lebih jernih. Fitur ini memerlukan langganan Pro Plan atau lebih tinggi untuk digunakan.
Fitur pengubah suara memungkinkan Anda memodifikasi suara dalam sebuah rekaman, sehingga Anda dapat menciptakan versi audio yang unik sambil tetap mempertahankan isi aslinya. Fitur ini memerlukan langganan Pro Plan atau lebih tinggi untuk digunakan.
Emosi pada suara disampaikan melalui teks yang Anda masukkan. Ketika Anda menggunakan teks yang berbeda, sistem text-to-speech (TTS) secara otomatis menerapkan emosi yang sesuai, sehingga tidak diperlukan kontrol tambahan.
Saat menggunakan fitur stopwatch, setiap stopwatch mewakili jeda selama 0,5 detik, dan Anda dapat menggunakannya secara berurutan untuk membuat jeda yang lebih panjang, hingga maksimal 3 detik. Namun, hindari menggunakan lebih dari dua jeda berturut-turut dalam satu segmen teks, karena hal ini dapat menyebabkan AI menghasilkan suara atau efek yang tidak diinginkan.