Nézd meg ezt az oktatóvideót a YouTube-on

YouTube

Készen állsz arra, hogy egy szkriptből élethű AI műsorvezetőt készíts? Ez a lépésről lépésre útmutató megmutatja, hogyan készítheted el az első AI beszélő avatár videódat a VisionStory-ban — válassz egy avatárt, add hozzá a szövegedet, válassz hangot, és generálj egy igényes beszélő videót percek alatt. Nézd meg fent a bemutatót, majd haladj az alábbi lépésekkel.

1. lépés: Válaszd ki vagy készítsd el az avatárodat

Nyisd meg az AI videó eszközt, és döntsd el, ki legyen az előadó. Háromféleképpen szerezhetsz avatárt:

  • Válassz beépített avatárt: Válaszd ki a VisionStory egyik előre elkészített, nyilvános karakterét — ez a leggyorsabb kezdés.
  • Töltsd fel a saját fotódat: Adj hozzá egy tiszta, szemből készült képet, és alakíts egy valódi személyt beszélő avatárrá.
  • Generálj avatárt: Készíts teljesen új karaktert egy szöveges promptból.

A kiválasztott avatárt bármikor módosíthatod a Change Look segítségével.

Choosing a built-in avatar in VisionStory AI Video

2. lépés: Add hozzá a szövegedet

Mondd meg az avatárodnak, mit mondjon. A jobb oldali panelen válaszd ki, hogyan adod meg a hangot:

  • Script: Írd be a szöveget, amit az avatároddal el szeretnél mondatni, és hagyd, hogy az AI legenerálja a beszédet.
  • Import: Tölts fel egy előre rögzített hangfájlt, ami a videót vezérli — az avatár AI szájmozgás-szinkronja követi a felvételedet.
  • Record: Rögzítsd a hangodat közvetlenül a VisionStory-ban.

Az első szkripted legyen rövid, hogy gyorsan ellenőrizhesd az eredményt.

3. lépés: Válassz hangot

Minden avatárhoz tartozik egy alapértelmezett hang, de ezt bármikor lecserélheted:

  • Hangkönyvtár: Nyisd meg a könyvtárat, és fedezz fel 1.000+ hangot 88 nyelven, majd a keresővel gyorsan találd meg a pontos hangot, amit szeretnél.
  • Hang klónozása: Készíts egyedi AI hangot a saját felvételed egy rövid mintájából.
  • Előnézet és javítás: Használd a Preview Audio funkciót, hogy még a véglegesítés előtt meghallgasd, és a Voice Enhance opciót a hang megtisztításához.
Searching the VisionStory Voice Library with over 1,000 voices

4. lépés: Válaszd ki a videómodellt, a felbontást és az opciókat

Generálás előtt állítsd be, hogyan nézzen ki a videó:

  • Videómodell: A VisionStory a legújabb beszélő avatár modelljét, a V-Character 4.0-t használja a természetes lipszinkhez és arckifejezésekhez.
  • Felbontás: Válassz 720P, 1080P vagy 2K felbontást attól függően, hol fogod publikálni.
  • Képarány: Válts 9:16 (álló), 16:9 (fekvő) és 1:1 (négyzet) között, hogy illeszkedjen a platformodhoz.
  • Green Screen videó: Csak akkor kapcsold be, ha egyszínű hátteret szeretnél, amit később szerkesztéskor cserélsz le.
  • Mozgás: Állítsd be, mennyit mozogjon az avatár, hogy dinamikusabb legyen az előadás.
VisionStory video settings: model, resolution, and green screen

5. lépés: Ellenőrizd a Krediteket, majd generálj

A VisionStory generálás előtt megmutatja a költséget:

  • Credit Details: Nyisd le a Credit Details részt, hogy lásd, hogyan számolódik ki az összeg — a költség a választott felbontástól és hossztól függ (például egy 60 másodperces 720P videó 15 kreditbe kerül).
  • Generate Talking Video: Ha minden rendben van, kattints a Generate gombra. A VisionStory animálja az avatárt, és a szövegedhez szinkronizálja a szájmozgást és az arckifejezéseket.

6. lépés: Nézd át, oszd meg és kezeld a videódat

Amint a feldolgozás befejeződik, a videód megjelenik az Assets részben, ahol az alábbiakat teheted:

  • Előnézet megtekintése, majd átnevezés az egyszerűbb rendszerezéshez.
  • Az MP4 letöltése, vagy egy megosztási link másolása, hogy bárhol posztolhasd.
  • Közvetlen megosztás közösségi platformokra, például X-re vagy Facebookra.
  • Egy már nem szükséges videó törlése.

Ennyi — elkészítetted az első AI beszélő avatár videódat. Innentől kipróbálhatsz más avatárokat, klónozhatod a saját hangodat, vagy a projektjeid növekedésével magasabb felbontásban is exportálhatsz.

Gyakran ismételt kérdések

  • Nem. Választhatsz egy kész, beépített karaktert, feltölthetsz egy saját, tiszta, szemből készült fotót, vagy generálhatsz egy teljesen új avatárt egy szöveges prompt alapján.