Bereit, ein Skript in einen lebensechten KI-Presenter zu verwandeln? Diese Schritt-für-Schritt-Anleitung zeigt Ihnen, wie Sie Ihr erstes KI-Sprechavatar-Video in VisionStory erstellen – Avatar auswählen, Text hinzufügen, Stimme wählen und in Minuten ein professionelles Talking-Video generieren. Sehen Sie sich oben den Walkthrough an und machen Sie unten direkt mit.
Schritt 1: Avatar auswählen oder erstellen
Öffnen Sie AI Video und entscheiden Sie, wer präsentiert. Sie haben drei Möglichkeiten, einen Avatar zu erhalten:
- Einen integrierten Avatar auswählen: Wählen Sie einen der fertigen öffentlichen Charaktere von VisionStory – der schnellste Einstieg.
- Ihr eigenes Foto hochladen: Fügen Sie ein klares, frontales Bild hinzu, um eine echte Person in einen Sprechavatar zu verwandeln.
- Einen Avatar generieren: Erstellen Sie einen komplett neuen Charakter aus einem Text-Prompt.
Mit Change Look können Sie den ausgewählten Avatar jederzeit anpassen.

Schritt 2: Skript hinzufügen
Sagen Sie Ihrem Avatar, was er sagen soll. Wählen Sie im rechten Panel aus, wie Sie das Audio bereitstellen möchten:
- Script: Tippen Sie den Text ein, den Ihr Avatar sprechen soll, und lassen Sie die KI die Sprachausgabe erzeugen.
- Import: Laden Sie eine vorab aufgenommene Audiodatei hoch, um das Video zu steuern — das KI-Lip-Sync des Avatars folgt Ihrer Aufnahme.
- Record: Nehmen Sie Ihre Stimme direkt in VisionStory auf.
Halten Sie Ihr erstes Skript kurz, damit Sie das Ergebnis schnell prüfen können.
Schritt 3: Stimme auswählen
Jeder Avatar hat eine Standardstimme – Sie können sie aber jederzeit ändern:
- Voice Library: Öffnen Sie die Bibliothek und entdecken Sie 1.000+ Stimmen in 88 Sprachen – und finden Sie per Suche schnell genau die Stimme, die Sie möchten.
- Eine Stimme klonen: Erstellen Sie eine individuelle KI-Stimme aus einer kurzen Probe Ihrer eigenen Aufnahme.
- Vorschau & verbessern: Nutzen Sie Preview Audio, um vorher reinzuhören, und Voice Enhance, um den Sound zu bereinigen.

Schritt 4: Videomodell, Auflösung & Optionen wählen
Bevor Sie generieren, legen Sie fest, wie das Video aussehen soll:
- Video Model: VisionStory nutzt sein neuestes Talking-Avatar-Modell, V-Character 4.0, für natürliches Lip-Sync und Mimik.
- Resolution: Wählen Sie 720P, 1080P oder 2K, je nachdem, wo Sie veröffentlichen.
- Aspect ratio: Wechseln Sie zwischen 9:16 (Hochformat), 16:9 (Querformat) und 1:1 (Quadrat), passend zu Ihrer Plattform.
- Green Screen Video: Aktivieren Sie dies nur, wenn Sie einen einfarbigen Hintergrund brauchen, den Sie später beim Bearbeiten ersetzen möchten.
- Motion: Passen Sie an, wie stark sich der Avatar bewegt – für eine dynamischere Darstellung.
Schritt 5: Credits prüfen und generieren
VisionStory zeigt Ihnen die Kosten, bevor Sie generieren:
- Credit Details: Klappen Sie Credit Details auf, um zu sehen, wie sich die Summe berechnet – die Kosten hängen von der gewählten Auflösung und Länge ab (z. B. kostet ein 60-Sekunden-720P-Video 15 Credits).
- Generate Talking Video: Wenn alles passt, klicken Sie auf Generate. VisionStory animiert Ihren Avatar und synchronisiert Lippen und Gesichtsausdrücke mit Ihrem Skript.
Schritt 6: Video prüfen, teilen und verwalten
Sobald die Verarbeitung abgeschlossen ist, erscheint Ihr Video in Assets. Dort können Sie:
- Das finale Ergebnis ansehen und zur besseren Übersicht umbenennen.
- Die MP4 herunterladen oder einen Freigabelink kopieren, um es überall zu posten.
- Direkt auf Social-Media-Plattformen wie X oder Facebook teilen.
- Ein Video löschen, das Sie nicht mehr benötigen.
Das war’s – Sie haben Ihr erstes KI-Sprechavatar-Video erstellt. Ab hier können Sie verschiedene Avatare ausprobieren, Ihre eigene Stimme klonen oder mit höherer Auflösung exportieren, wenn Ihre Projekte wachsen.
