Аудио и голос
VisionStory поддерживает 88 языков, включая: английский, китайский, испанский, арабский, португальский, русский, японский, панджаби, немецкий, французский, корейский, турецкий, тамильский, вьетнамский, хинди, бенгальский, урду, персидский, итальянский, индонезийский, тайский, маратхи, телугу, украинский, малайский, румынский, польский, нидерландский, гуджарати и каннада.
В библиотеке VisionStory доступно 1,000+ голосов, которые можно фильтровать по полу, возрасту и назначению. Если вы не нашли подходящий голос, вы также можете создать собственный ИИ-клон голоса, загрузив или записав аудио.
Ограниченное количество голосов для некоторых языков связано с тем, что эти голоса специально оптимизированы для конкретных языков. Однако базовая поддержка языков позволяет использовать, например, английские голоса для озвучивания на других языках, что обеспечивает гибкость при выборе голоса.
Клонирование голоса позволяет создать индивидуальный AI-голос, который имитирует определённый голос на основе загруженной или записанной аудиозаписи. Для клонирования голоса убедитесь, что аудио записано чётко и в тихой обстановке для достижения наилучших результатов.
Для использования клонированного голоса при создании видео необходимо оформить подписку на тариф Pro или выше.
Клонирование голоса бесплатно поддерживается более чем на 32 языках. Список поддерживаемых языков может меняться, поэтому рекомендуем проверять актуальные варианты непосредственно в функции клонирования голоса. Обратите внимание: хотя само клонирование бесплатно, для использования клонированного голоса в видео требуется подписка.
Предварительный аудиопрослушивание позволяет сгенерировать речь для вашего говорящего видео до финального создания ролика. Эта функция помогает проверить голос, произношение и паузы, чтобы убедиться, что они соответствуют вашим ожиданиям. Вы можете внести изменения в голос до генерации видео. Для всех подписчиков эта функция бесплатна, при этом лимит предварительных прослушиваний обновляется ежедневно. Если вы достигли дневного лимита, можно приобрести дополнительную квоту за кредиты.
Значок секундомера и функция +0,5 с позволяют вставить паузу длительностью 0,5 секунды в сгенерированную речь. Вы можете добавить несколько значков секундомера подряд, чтобы создать более длинные паузы в вашем видео.
Импорт по URL позволяет загружать и извлекать аудио из указанной ссылки для использования в создании видео. В настоящее время поддерживаются ссылки с YouTube и TikTok. Если вы хотите видеть поддержку других сайтов, пожалуйста, свяжитесь с нами. Кроме того, вы можете воспользоваться функцией изменения голоса, чтобы модифицировать импортированное аудио, сохраняя оригинальное содержание.
Функция удаления шума помогает устранить фоновый шум из аудио при импорте или записи, обеспечивая более чистое качество звука для ваших видео. Для использования этой функции требуется подписка на тариф Pro или выше.
Функция изменения голоса позволяет модифицировать голос в аудиозаписи, создавая уникальные варианты озвучки при сохранении исходного содержания. Для использования этой функции требуется подписка на тариф Pro или выше.
Эмоции в голосе передаются через текст, который вы вводите. При использовании разного текста система синтеза речи (TTS) автоматически применяет соответствующую эмоцию, поэтому дополнительное управление не требуется.
При использовании функции секундомера каждая иконка секундомера добавляет паузу в 0,5 секунды. Их можно ставить подряд для создания более длинных пауз — максимум до 3 секунд. Однако не рекомендуется использовать более двух пауз подряд в одном текстовом сегменте, так как это может привести к появлению неожиданных звуков или артефактов в речи AI.