Chcete, aby statická fotka mluvila—portrét, který otevírá pusu, mrká a říká cokoli, co napíšete? S VisionStory to zvládnete přesně takhle z jediného obrázku, přímo v prohlížeči, bez kamery a bez zkušeností se střihem. Video výše vás provede celým postupem a návod krok za krokem níže vysvětluje každou část do detailu.
Během postupu nahrajete jeden portrét a připravíte ho jako vlastního znovupoužitelného avatara. Ostatní uživatelé ho neuvidí a vy si ho můžete příště vybrat znovu pro další videa, místo abyste pokaždé nahrávali stejný obrázek. Vše běží v rámci nástroje VisionStory pro mluvící fotky na bezplatném účtu.
Krok 1: Nahrajte jeden ostrý portrét
Otevřete AI video. V panelu Postavy zvolte Nahrát a vyberte obrázek ze svého zařízení, nebo fotku rovnou přetáhněte do oblasti pro nahrání. Použijte jednu ostrou osobu zepředu, s viditelným obličejem a rameny, nezakrytýma očima i ústy a s trochou místa kolem postavy, abyste mohli později měnit výřez.
- Podporované soubory: JPG, JPEG, PNG, WebP a HEIC.
- Maximální velikost souboru: 30 MB.
- Doporučená počáteční velikost: alespoň 512 x 768 pixelů pro portrét.
- Chování při nahrávání: vždy jen 1 zdrojový obrázek.

Slaďte kompozici zdroje s tím, kde má video nakonec skončit. Těsně oříznutý portrét může fungovat v 9:16, ale v 16:9 se může změnit v nepříjemně těsný výřez obličeje, protože na levé a pravé straně není žádná plocha obrázku, která by vyplnila širší formát.
Krok 2: Nechte VisionStory fotku ověřit a avatara připravit
Po nahrání VisionStory zkontroluje, jestli obrázek obsahuje použitelnou osobu, a připraví ji jako postavu. Neúspěšné nahrání téměř vždy souvisí se zdrojovou fotkou: obličej může být příliš malý, výrazně zakrytý, příliš otočený do strany, rozmazaný nebo příliš blízko jiné tváři.
Pokud příprava selže, nezkoušejte pořád dokola stejný výřez. Zvolte ostřejší zdroj s jedním větším obličejem, přímějším úhlem, viditelnými rameny, rovnoměrným světlem a menším zakrytím.

Po dokončení zpracování se avatar zobrazí nad veřejnou knihovnou postav a otevře se v náhledu avatara. Je viditelný pouze pro vás.
Krok 3: Poslechněte si náhled hlasu nebo ho změňte
VisionStory automaticky přiřadí vhodný výchozí hlas podle odhadovaného věku a pohlaví osoby. Můžete si ho nechat, poslechnout si náhled nebo ho vyměnit za jiný.
- Klikněte na aktuální hlas a otevřete Knihovnu hlasů.
- Pomocí tlačítka přehrávání vpravo u hlasu si poslechněte ukázku.
- Pokud se nehodí, filtrujte podle jazyka, pohlaví, věku a použití.
- Poslechněte si pár alternativ a pak vyberte hlas, který odpovídá jak avatarovi, tak účelu videa.

Hlas může sedět odhadovanému věku a pohlaví, ale pořád může působit špatně pro vyprávění, vzdělávání, reklamu nebo konverzační obsah. Slaďte osobu i účel, ne jen demografii.
Krok 4: Upravte výřez fotky pro cílové použití
V náhledu avatara si určete, kolik osoby bude ve finálním videu vidět. Přetažením fotky změňte pozici postavy a pomocí ovládání zoomu se přibližte nebo oddalte. Pak vyberte poměr stran podle toho, kde budete publikovat:
- 9:16 na výšku pro TikTok, Instagram Reels, YouTube Shorts a další mobilní umístění.
- 1:1 čtverec pro čtvercové příspěvky na sociální sítě, rozvržení zaměřená na profil a flexibilní vložení.
- 16:9 na šířku pro YouTube, prezentace, weby a širokoúhlé kurzy.

Zoom neumí odhalit pixely, které neexistují. Pokud se osoba na zdrojové fotce už dotýká všech okrajů, začněte raději s obrázkem, který má více pozadí, než abyste se snažili vynutit širší výřez.
Krok 5: Pochopte rozdíl mezi Change Look a Generate Image
Vedle avatara jsou dva AI nástroje na obrázky a vyplatí se znát rozdíl, než je použijete.
Change Look otevře AI chat s vaším aktuálním avatarem už přiloženým, takže můžete popsat nové oblečení, prostředí nebo styl. Jde o postup image-to-image a původní avatar zůstane k dispozici. Generate Image naopak začíná z textového popisu postavy místo fotky, takže jde o postup text-to-image. V obou případech můžete pokračovat v chatu a výsledek dál ladit.

Stručně: Change Look použijte, když postava už existuje a potřebuje nový vizuální styl; Generate Image, když chcete postavu vytvořit z promptu.
Krok 6: Přidejte krátký scénář a vygenerujte mluvící video
S vybraným nahraným avatarem napište do pole Scénář jednu krátkou konverzační větu. Krátká věta se vyrenderuje rychleji a lépe se podle ní posoudí fotka, výřez, hlas, lip-sync i pohyb dohromady.
Klikněte na Generate Talking Video. VisionStory rozpohybuje obličej, synchronizuje rty s hlasem a přidá realistické mrkání i pohyb hlavy s použitím vybraného avatara, výřezu, scénáře a hlasu. Renderování trvá pár minut.

Berete tento první výsledek jako praktický test zdrojové fotky. Zkontrolujte 4 věci:
- Obličej zůstává dostatečně ostrý i ve finální velikosti.
- Oči a ústa zůstávají při pohybu nezakryté.
- Hlava a ramena se pohodlně vejdou do zvoleného poměru stran.
- Pohyblivý avatar stále vypadá jako původní osoba.
Pokud je výřez příliš těsný nebo obličej při pohybu působí měkce, nejdřív upravte zdrojový obrázek nebo výřez. Změna scénáře problém s kompozicí nevyřeší.
Krok 7: Znovu použijte nebo odeberte svého avatara z mluvící fotky
Zpět v seznamu Postavy bude váš nahraný avatar nad veřejnou knihovnou postav a můžete ho vybrat kdykoli budete chtít stejného moderátora znovu. Ostatní uživatelé ho neuvidí a předplatitelé mohou vytvářet a uchovávat neomezený počet avatarů.
- Znovu ho použijte: vyberte avatara místo toho, abyste fotku nahrávali znovu.
- Změňte vzhled: otevřete avatara a vyberte jeden z uložených náhledů vzhledu.
- Odeberte ho: najeďte myší na avatara, zobrazí se tlačítko smazání v pravém horním rohu, a pak smazání potvrďte (smaže se avatar i jeho vzhledy).

Řešení běžných problémů s fotkami
VisionStory nemůže najít použitelný obličej. Použijte světlejší a ostřejší fotku s jedním větším obličejem zepředu. Vyhněte se zakrytým očím nebo ústům, silným profilovým úhlům a fotkám, kde je jiný obličej blízko hlavního subjektu.
Výřez na šířku je příliš těsný. Zdrojový portrét nejspíš nemá dost místa po stranách. Použijte širší zdroj nebo takový, kde je kolem osoby více volného prostoru.
Avatar se stále připravuje. Než postavu použijete, počkejte, až se příprava dokončí. Pokud se zasekne, obnovte zobrazení Postavy a zkontrolujte, jestli se avatar už neobjevil, než nahrajete další kopii.
Výsledek vypadá měkce. Začněte s fotkou ve vyšším rozlišení, která je zaostřená, a vyhněte se přílišnému zvětšování malého obličeje. Výstupní rozlišení neobnoví detaily, které ve zdroji chyběly.
To je vše, co potřebujete, aby fotka mluvila: nahrajte jeden portrét, přiřaďte hlas, nastavte výřez a vygenerujte. Vaše fotka je teď znovupoužitelný mluvící avatar, kterého můžete kdykoli znovu použít.
Chcete kompletní workflow pro scénář, hlas, nastavení, kredity a generování? Postupujte podle How to Create an AI Talking Avatar nebo převádějte celé scénáře na AI videa ve velkém. Nebo rovnou začněte: vytvořte si svou první mluvící fotku zdarma.
