Obejrzyj ten samouczek na YouTube

YouTube

Chcesz, aby nieruchome zdjęcie zaczęło mówić—portret, który otwiera usta, mruga i wypowiada wszystko, co wpiszesz? Z VisionStory możesz zrobić dokładnie to z jednego obrazu, prosto w przeglądarce, bez kamery i bez doświadczenia w montażu. Powyższe wideo pokazuje cały proces, a poradnik krok po kroku poniżej omawia każdy etap szczegółowo.

Po drodze prześlesz jeden portret i przygotujesz go jako własnego awatara wielokrotnego użytku. Inni użytkownicy nie mogą go zobaczyć, a Ty możesz wybrać go ponownie do przyszłych filmów, zamiast za każdym razem przesyłać to samo zdjęcie. Wszystko działa w ramach narzędzia VisionStory do mówiących zdjęć na darmowym koncie.

Krok 1: Prześlij jeden wyraźny portret

Otwórz Wideo AI. W panelu Postacie wybierz Prześlij i wskaż obraz ze swojego urządzenia albo przeciągnij zdjęcie bezpośrednio do pola przesyłania. Użyj jednego wyraźnego ujęcia osoby na wprost, z widoczną twarzą i ramionami, bez zasłoniętych oczu i ust, oraz z odrobiną miejsca wokół postaci, aby później móc zmienić kadr.

  • Obsługiwane pliki: JPG, JPEG, PNG, WebP i HEIC.
  • Maksymalny rozmiar pliku: 30 MB.
  • Zalecany rozmiar na start: co najmniej 512 x 768 pikseli dla portretu.
  • Sposób przesyłania: jedno zdjęcie źródłowe naraz.
Dragging a portrait onto the Upload control in the VisionStory Characters panel

Dopasuj kompozycję zdjęcia do tego, gdzie finalnie trafi wideo. Mocno przycięty portret może działać w 9:16, ale w 16:9 stanie się nieprzyjemnie ciasnym kadrem na twarz, bo po lewej i prawej stronie nie ma już obszaru obrazu, który wypełniłby szerszą ramkę.

Krok 2: Pozwól VisionStory zweryfikować i przygotować awatara

Po przesłaniu VisionStory sprawdza, czy obraz zawiera użyteczną postać, i przygotowuje go jako bohatera. Nieudane przesłanie prawie zawsze wynika ze zdjęcia źródłowego: twarz może być zbyt mała, mocno zasłonięta, zbyt mocno odwrócona na bok, rozmyta lub zbyt blisko innej twarzy.

Jeśli przygotowanie się nie powiedzie, nie próbuj w kółko tego samego kadru. Wybierz ostrzejsze zdjęcie źródłowe z jedną większą twarzą, bardziej bezpośrednim ujęciem, widocznymi ramionami, równym oświetleniem i mniejszą liczbą przeszkód.

VisionStory avatar preview beside a checklist for a clear, unobstructed source photo

Gdy przetwarzanie się zakończy, awatar pojawi się nad publiczną biblioteką postaci i otworzy się w podglądzie awatara. Jest widoczny tylko dla Ciebie.

Krok 3: Odsłuchaj lub zmień przypisany głos

VisionStory automatycznie przypisuje odpowiedni głos startowy na podstawie widocznego wieku i płci osoby. Możesz go zostawić, odsłuchać lub zmienić na inny.

  1. Wybierz aktualny głos, aby otworzyć Bibliotekę Głosów.
  2. Użyj przycisku odtwarzania po prawej stronie głosu, aby usłyszeć próbkę.
  3. Jeśli nie pasuje, filtruj według Języka, Płci, Wieku i Zastosowania.
  4. Odsłuchaj kilka alternatyw, a następnie wybierz głos, który pasuje zarówno do awatara, jak i celu wideo.
VisionStory Voice Library with Language, Gender, Age, and Use Case filters and a preview button

Głos może pasować do widocznego wieku i płci, a mimo to brzmieć źle w narracji, edukacji, reklamie czy treściach konwersacyjnych. Dopasuj osobę i cel, nie tylko demografię.

Krok 4: Dostosuj kadr zdjęcia do miejsca publikacji

W podglądzie awatara zdecyduj, ile postaci ma się pojawić w finalnym wideo. Przeciągnij zdjęcie, aby zmienić położenie bohatera, i użyj powiększenia, by przybliżyć lub oddalić kadr. Następnie wybierz proporcje pasujące do miejsca publikacji:

  • 9:16 pion dla TikToka, Instagram Reels, YouTube Shorts i innych formatów mobile-first.
  • 1:1 kwadrat dla kwadratowych postów w social media, układów opartych o profil i elastycznych osadzeń.
  • 16:9 poziom dla YouTube, prezentacji, stron internetowych i kursów w szerokim formacie.
The same VisionStory avatar shown in 9:16, 1:1, and 16:9 aspect ratios

Powiększenie nie pokaże pikseli, których nie ma. Jeśli postać już dotyka każdej krawędzi zdjęcia źródłowego, zacznij od obrazu z większą ilością tła, zamiast wymuszać szerszy kadr.

Krok 5: Zrozum, co robią Change Look i Generate Image

Obok awatara znajdują się dwa narzędzia do obrazów AI — warto znać różnicę, zanim ich użyjesz.

Change Look otwiera czat AI z dołączonym aktualnym awatarem, więc możesz opisać nowy strój, scenerię lub styl. To proces image-to-image, a oryginalny awatar pozostaje dostępny. Generate Image startuje od pisanego opisu postaci zamiast zdjęcia, więc to proces text-to-image. W obu przypadkach możesz kontynuować rozmowę, aby dopracować rezultat.

VisionStory Change Look chat opened with the current avatar attached as the starting image

W skrócie: użyj Change Look, gdy postać już istnieje i potrzebuje nowej oprawy wizualnej, a Generate Image, gdy chcesz stworzyć postać z promptu.

Krok 6: Dodaj krótki scenariusz i wygeneruj mówiące wideo

Mając zaznaczonego przesłanego awatara, wpisz jedno krótkie, konwersacyjne zdanie w polu Scenariusz. Krótka linia renderuje się szybciej i ułatwia ocenę zdjęcia, kadru, głosu, synchronizacji ust i ruchu razem.

Kliknij Generate Talking Video. VisionStory animuje twarz, synchronizuje usta z głosem i dodaje realistyczne mrugnięcia oraz ruch głowy, korzystając z wybranego awatara, kadru, scenariusza i głosu. Renderowanie trwa kilka minut.

A short VisionStory script generating a talking-avatar result from the uploaded portrait

Potraktuj ten pierwszy wynik jako praktyczny test zdjęcia źródłowego. Sprawdź cztery rzeczy:

  • Twarz pozostaje wystarczająco ostra w docelowym rozmiarze.
  • Oczy i usta pozostają niezasłonięte podczas ruchu.
  • Głowa i ramiona mieszczą się komfortowo w wybranych proporcjach.
  • Ruchomy awatar nadal wygląda jak osoba ze zdjęcia źródłowego.

Jeśli kadr jest zbyt ciasny albo twarz wygląda na miękką w ruchu, najpierw popraw zdjęcie źródłowe lub kadrowanie. Zmiana scenariusza nie naprawi problemu z kompozycją.

Krok 7: Używaj ponownie lub usuń awatara z mówiącego zdjęcia

Na liście Postacie przesłany awatar znajduje się nad publiczną biblioteką postaci i możesz go wybrać zawsze, gdy chcesz ponownie użyć tego samego prezentera. Inni użytkownicy nie mogą go zobaczyć, a subskrybenci mogą tworzyć i przechowywać nieograniczoną liczbę awatarów.

  • Użyj ponownie: wybierz awatara zamiast ponownie przesyłać zdjęcie.
  • Zmień wygląd: otwórz awatara i wybierz jedną z zapisanych miniatur wyglądu.
  • Usuń: najedź na awatara, aby pokazać przycisk usuwania w prawym górnym rogu, a następnie potwierdź usunięcie awatara i jego wyglądów.
A reusable uploaded avatar in VisionStory Characters with the delete control and confirmation dialog

Rozwiązywanie typowych problemów ze zdjęciami

VisionStory nie może znaleźć użytecznej twarzy. Użyj jaśniejszego, ostrzejszego obrazu z jedną większą twarzą na wprost. Unikaj zasłoniętych oczu lub ust, mocnych profili i zdjęć, na których inna twarz znajduje się blisko głównego bohatera.

Poziomy kadr jest zbyt ciasny. Portret źródłowy prawdopodobnie nie ma wystarczającej ilości obrazu po bokach. Użyj szerszego zdjęcia źródłowego albo takiego, na którym jest więcej wolnej przestrzeni wokół osoby.

Awatar nadal się przygotowuje. Poczekaj na zakończenie przygotowania, zanim użyjesz postaci. Jeśli proces się zawiesi, odśwież widok Postaci i sprawdź, czy awatar nie pojawił się już wcześniej, zanim prześlesz kolejną kopię.

Wynik wygląda miękko. Zacznij od zdjęcia o wyższej rozdzielczości, w ostrości, i unikaj zbyt agresywnego powiększania małej twarzy. Rozdzielczość wyjściowa nie przywróci detali, których nie było w źródle.

To wszystko, czego potrzeba, aby zdjęcie zaczęło mówić: prześlij jeden portret, dopasuj głos, ustaw kadr i wygeneruj. Twoje zdjęcie jest teraz awatarem mówiącym wielokrotnego użytku, którego możesz używać ponownie, kiedy tylko go potrzebujesz.

Chcesz przejść przez kompletny proces: scenariusz, głos, ustawienia, kredyty i generowanie? Zobacz How to Create an AI Talking Avatar albo zamieniaj pełne scenariusze w wideo AI na dużą skalę. Albo po prostu zacznij teraz: stwórz swoje pierwsze mówiące zdjęcie za darmo.

Najczęściej zadawane pytania

  • Prześlij wyraźne zdjęcie na wprost do narzędzia VisionStory do mówiących zdjęć, wpisz krótką linijkę, którą ma wypowiedzieć, wybierz albo zostaw przypisany głos i kliknij Generate Talking Video. W darmowym planie w kilka minut otrzymasz w przeglądarce mówiące wideo z synchronizacją ust — bez instalowania oprogramowania.