Open source
Open-source projekty pro AI video a avatary
Srozumitelné průvodce open-source AI modely a nástroji, které stojí za mluvícími avatary, generováním videa a hlasem — co umí, jak je spustit a kdy je rychlejší použít hostovaný nástroj.
Open source
Srozumitelné průvodce open-source AI modely a nástroji, které stojí za mluvícími avatary, generováním videa a hlasem — co umí, jak je spustit a kdy je rychlejší použít hostovaný nástroj.

Praktický průvodce OpenMontage, open-source AI video agentem, který promění vašeho AI asistenta pro programování v plnohodnotné video studio — co umí, jak ho nastavit, kolik stojí a kdy je hostovaný nástroj jako VisionStory rychlejší volbou.
Praktický rozbor LongCat-Video-Avatar 1.5 — open-source modelu od Meituanu s licencí MIT, který převádí fotografii a audio na video s mluvícím avatarem. Spustili jsme všechny tři úlohy na GPU A800, změřili reálnou rychlost i VRAM, narazili na pět nástrah při nastavení a otevřeně popisujeme, kdy dává smysl provozovat vše vlastními silami a kdy vítězí hostovaný nástroj.

Praktický rozbor Kokoro – open-source modelu Text na řeč s 82 miliony parametrů. Spustili jsme ho na CPU Apple M3 Pro, vygenerovali skutečné hlasové ukázky, které si můžete přehrát, narazili na balíčkovací bug v espeak-ng (a opravili ho) a upřímně vysvětlujeme, kdy Kokoro stačí a kdy už potřebujete hostovaný nástroj na mluvící videa.

Praktický průvodce LivePortrait — open-source AI modelem, který animuje statický portrét podle řídicího videa nebo audia: co umí, jak ho spustit a kdy je rychlejší volbou hostovaný nástroj pro mluvící avatary, jako je VisionStory.