Audio & Stimme
VisionStory unterstützt 88 Sprachen, darunter: Englisch, Chinesisch, Spanisch, Arabisch, Portugiesisch, Russisch, Japanisch, Punjabi, Deutsch, Französisch, Koreanisch, Türkisch, Tamil, Vietnamesisch, Hindi, Bengalisch, Urdu, Persisch, Italienisch, Indonesisch, Thailändisch, Marathi, Telugu, Ukrainisch, Malaiisch, Rumänisch, Polnisch, Niederländisch, Gujarati und Kannada.
VisionStory bietet 1.000+ Stimmen in seiner Bibliothek, die nach Geschlecht, Alter und Anwendungsfall gefiltert werden können. Falls Sie keine passende Stimme finden, können Sie außerdem eine individuelle KI-Stimmenkopie erstellen, indem Sie eine Audiodatei hochladen oder direkt aufnehmen.
Die begrenzte Anzahl an Stimmen in bestimmten Sprachen ist speziell für diese Sprachen optimiert. Allerdings ermöglicht die zugrunde liegende Sprachunterstützung, dass Stimmen – zum Beispiel englische – auch mehrere Sprachen sprechen können, was Ihnen mehr Flexibilität bei der Auswahl bietet.
Voice Cloning ermöglicht es Ihnen, eine individuelle KI-Stimme zu erstellen, die eine bestimmte Stimme imitiert, indem Sie eine Audiodatei hochladen oder aufnehmen. Um eine Stimme zu klonen, stellen Sie sicher, dass die Aufnahme klar und in einer ruhigen Umgebung erfolgt, um optimale Ergebnisse zu erzielen.
Um die Sprachklon-Funktion bei der Videogenerierung zu nutzen, benötigen Sie ein Abonnement des Pro-Plans oder höher.
Voice Cloning wird in mehr als 32 Sprachen kostenlos unterstützt. Die Liste der unterstützten Sprachen kann sich ändern, daher empfehlen wir, die Voice Cloning-Funktion für die aktuellsten Optionen zu überprüfen. Bitte beachten Sie: Obwohl das Clonen kostenlos ist, benötigen Sie ein Abonnement, um die geklonte Stimme in Videos zu verwenden.
Vorschau-Audio ermöglicht es Ihnen, die Sprachausgabe für Ihr Talking-Video vor der endgültigen Videoproduktion zu generieren. Mit dieser Funktion können Sie Stimme, Aussprache und Pausen überprüfen, um sicherzustellen, dass alles Ihren Erwartungen entspricht. Sie können die Stimme vor der Videoerstellung anpassen. Für alle Abonnenten ist diese Funktion kostenlos nutzbar, wobei das Vorschau-Kontingent täglich zurückgesetzt wird. Wenn Sie das tägliche Vorschau-Kontingent erreichen, können Sie zusätzliches Kontingent mit Credits erwerben.
Das Stoppuhr-Symbol und die Funktion +0,5s ermöglichen es Ihnen, eine Pause von 0,5 Sekunden in die generierte Stimme einzufügen. Sie können mehrere Stoppuhr-Symbole hintereinander setzen, um bei Bedarf längere Pausen in Ihrem Video zu erzeugen.
Der URL-Import ermöglicht es Ihnen, Audio von einem Link zu importieren, indem das Audio von der angegebenen URL heruntergeladen und extrahiert wird, um es für die Videogenerierung zu verwenden. Aktuell werden Links von YouTube und TikTok unterstützt. Wenn Sie Unterstützung für weitere Seiten wünschen, kontaktieren Sie uns bitte. Zusätzlich können Sie die Voice Changer-Funktion nutzen, um das importierte Audio zu verändern, während der Originalinhalt erhalten bleibt.
Die Funktion „Rauschentfernung“ hilft dabei, Hintergrundgeräusche aus Audiodateien zu entfernen, wenn Sie diese importieren oder aufnehmen, sodass die Audioqualität Ihrer Videos klarer wird. Diese Funktion erfordert mindestens ein Pro-Abo oder höher.
Die Voice Changer-Funktion ermöglicht es Ihnen, die Stimme in einer Sprachaufnahme zu verändern, sodass Sie einzigartige Versionen des Audios erstellen können, während der ursprüngliche Inhalt erhalten bleibt. Für die Nutzung dieser Funktion ist mindestens ein Pro-Plan erforderlich.
Die Emotion in der Stimme wird durch den von Ihnen eingegebenen Text vermittelt. Wenn Sie unterschiedlichen Text verwenden, wendet das Text-zu-Sprache-System (TTS) automatisch die passende Emotion an, sodass keine zusätzliche Steuerung erforderlich ist.
Bei der Verwendung der Stoppuhr-Funktion steht jede Stoppuhr für eine Pause von 0,5 Sekunden. Sie können mehrere Stoppuhren hintereinander einsetzen, um längere Pausen zu erzeugen – bis zu maximal 3 Sekunden. Vermeiden Sie jedoch, mehr als zwei Pausen hintereinander in einem Textabschnitt zu verwenden, da dies dazu führen kann, dass die KI unerwartete Geräusche oder Artefakte erzeugt.