Obejrzyj ten samouczek na YouTube

YouTube

Klonowanie głosu tworzy wielokrotnego użytku syntetyczny głos na podstawie prawdziwego nagrania. VisionStory analizuje próbkę źródłową, przygotowuje dźwięk, wykrywa język i cechy głosu, tworzy klona oraz generuje podgląd, który możesz ocenić, zanim użyjesz go w wideo.

Przesłanie pliku to tylko część techniczna. Nagranie źródłowe decyduje o tym, jak bliski oryginałowi i jak stabilny będzie efekt. Czysta, spójna minuta jest zwykle bardziej przydatna niż kilka minut nagranych na różnych mikrofonach lub w różnych pomieszczeniach.

Korzystaj z głosów odpowiedzialnie. Klonuj wyłącznie swój głos albo głos, na którego użycie masz jednoznaczną zgodę. Nie używaj klonowania głosu do podszywania się pod kogoś, omijania zgody ani wprowadzania odbiorców w błąd.

  • Najlepsze źródło: 1–2 minuty czystego audio z jednym mówcą.
  • Szybkie nagranie: do 15 sekund w oknie Clone.
  • Dostępność: plan Pro i wyższe plany subskrypcji.

Krok 1: Otwórz Voice Clone w Wideo AI

Otwórz Wideo AI i wybierz awatar, którego chcesz użyć. W wierszu głosu pod polem Script kliknij Clone obok bieżącego głosu. Okno Clone otworzy się bez zmiany aktualnego głosu awatara.

VisionStory AI Video editor with the Clone control highlighted beside the current voice
Voice Clone uruchamiasz z poziomu ustawień głosu w edytorze Wideo AI.

Krok 2: Wybierz Prześlij lub Nagraj

Okno oferuje dwie metody źródła. Wybierz w zależności od tego, czy testujesz działanie, czy chcesz uzyskać możliwie najbliższe dopasowanie.

  • Prześlij audio: najlepsze dla jakości. Jeśli to możliwe, użyj czystej próbki trwającej od 1 do 2 minut.
  • Nagraj: przydatne do szybkiego testu. Wbudowany rejestrator aktualnie nagrywa do 15 sekund.

Przesłane pliki mogą mieć format .avi, .mp3, .mp4, .m4a, .wav lub .mov. Wybrany fragment audio musi trwać co najmniej 3 sekundy i może mieć maksymalnie 120 sekund.

VisionStory Clone dialog comparing audio upload with the built-in recorder
Przesyłanie daje dość czystego materiału, by uzyskać bliższe dopasowanie; Nagrywanie to najszybszy sposób na test.

Krok 3: Przygotuj dźwięk, który zapewni lepsze dopasowanie

Klon Głosu kopiuje nie tylko tożsamość wokalną. Potrafi też odtworzyć tempo, intonację, oddech, brzmienie pomieszczenia, charakter mikrofonu i niepożądane artefakty. Nagraj materiał źródłowy w stylu, którego chcesz używać później w klonie.

  • Użyj jednego mówcy. Usuń muzykę, nakładające się głosy i rozmowy w tle.
  • Nagraj 1–2 czyste minuty. Zapewnij dość naturalnej różnorodności, ale nie mieszaj niespójnych sesji.
  • Wybierz ciche pomieszczenie bez echa. Miękkie wyposażenie pomaga ograniczyć pogłos; unikaj wentylatorów, ruchu ulicznego i szumu klimatyzacji.
  • Utrzymaj mikrofon w stałej pozycji. Zachowaj ten sam dystans, kąt, poziom wejściowy i to samo pomieszczenie przez całą próbkę.
  • Mów naturalnie i konsekwentnie. Utrzymuj stały akcent, głośność, tempo i styl wykonania.
  • Unikaj długich przerw ciszy. Używaj ciągłej, wartościowej mowy zamiast wypełniać plik ciszą.
Voice clone recording checklist and current Pro, Advanced, and Ultra voice slot counts
Lepszy dźwięk źródłowy poprawia podobieństwo pewniej niż samo dodawanie kolejnych minut.

Wskazówka: jeśli pierwszy klon brzmi słabo, podmień źródło na czystsze, bardziej spójne nagranie, zanim spróbujesz znacznie dłuższej próbki. Materiał o mieszanej jakości często uczy klon właśnie tych niespójności, których chcesz się pozbyć.

Krok 4: Prześlij, sprawdź i nazwij próbkę

Przeciągnij plik do Import Audio lub kliknij obszar upuszczania, aby go wybrać. Gdy pojawi się przebieg fali, odtwórz wybrany fragment i nasłuchuj: innego mówcy, muzyki, przesterowania, echa, nagłych cięć lub długiej ciszy. Jeśli te problemy są wyraźne, podmień źródło.

Wpisz opisową nazwę o długości do 20 znaków. Sufiks języka/regionu ułatwia rozróżnianie wielu głosów z poradników lub kampanii; na przykład Tutorial Voice-en.

Audio moving from the VisionStory upload area to a visible waveform ready for review and naming
Sprawdź faktycznie wybrany fragment, a potem użyj krótkiej nazwy, którą rozpoznasz w Bibliotece Głosów.

Krok 5: Utwórz klona i pozwól VisionStory wykryć język

Kliknij Clone Now. VisionStory przetwarza próbkę asynchronicznie i otwiera kartę Cloned Voice. Pozycja odświeża się w trakcie przetwarzania i staje się dostępna do odsłuchu, gdy podgląd jest gotowy.

Nie musisz ręcznie wybierać języka źródłowego. VisionStory analizuje nagranie i automatycznie przypisuje wykryty język. W próbce źródłowej konsekwentnie używaj jednego języka, aby łatwiej ocenić wykryte ustawienia regionalne, akcent i podgląd.

A ready VisionStory cloned voice with English detected automatically and a preview button
Wykryty język jest wyświetlany przy gotowym klonie; podczas klonowania nie jest potrzebny wybór języka.

Krok 6: Obejrzyj podgląd, wybierz i przetestuj klona

Zanim go wybierzesz, użyj przycisku odtwarzania w wierszu klona. Zwróć uwagę na tożsamość głosu, akcent, tempo, wymowę, pogłos w pomieszczeniu, szumy oraz niestabilne zmiany tonu. Jeśli w podglądzie słychać wyraźne artefakty, popraw źródło już teraz — zamiast odkrywać problem dopiero w gotowym wideo.

Wybierz sklonowany głos, wpisz jedno krótkie zdanie w polu Script i kliknij Preview Audio. Krótki test ułatwia porównanie i pozwala potwierdzić, że klon pasuje do rodzaju treści, które planujesz tworzyć.

VisionStory AI Video editor previewing a selected cloned voice with a short script
Przetestuj klona krótkim skryptem, zanim użyjesz go w dłuższej produkcji.

Plany Voice Clone i limity slotów

Voice Clone jest dostępne w planie Pro i wyższych. Każdy zapisany sklonowany głos zajmuje jeden slot, aż do momentu usunięcia.

PlanAktualny limit klonów głosu
FreeNiedostępne
Pro10 slotów
Advanced20 slotów
Ultra50 slotów
EnterpriseDostosowany

Gdy nie potrzebujesz już klona, otwórz Cloned Voice, usuń ten głos i potwierdź działanie. Usunięcie klona zwalnia jego slot. Jeśli usunięty głos był wybrany w edytorze, VisionStory przełączy się na dostępny domyślny głos.

88 obsługiwanych języków

88 unikalnych języków. VisionStory automatycznie wykrywa język próbki do klonowania; dostępne opcje głosu i charakterystyka wyjścia mogą się różnić w zależności od języka. Poniższa lista liczy po jednej pozycji na język po scalenia wariantów regionalnych i nazw równoważnych.

  • 🇿🇦 afrikaans
  • 🇦🇱 albański
  • 🇪🇹 amharski
  • 🇸🇦 arabski
  • 🇦🇲 ormiański
  • 🇮🇳 asamski
  • 🇦🇿 azerski
  • 🇪🇸 baskijski
  • 🇧🇾 białoruski
  • 🇧🇩 bengalski (Bangla)
  • 🇧🇦 bośniacki
  • 🇧🇬 bułgarski
  • 🇲🇲 birmański
  • 🇭🇰 kantoński
  • 🇪🇸 kataloński
  • 🇵🇭 cebuano
  • 🇲🇼 chichewa
  • 🇨🇳 chiński (mandaryński)
  • 🇭🇷 chorwacki
  • 🇨🇿 czeski
  • 🇩🇰 duński
  • 🇳🇱 niderlandzki
  • 🇬🇧 angielski
  • 🇪🇪 estoński
  • 🇵🇭 filipiński
  • 🇫🇮 fiński
  • 🇫🇷 francuski
  • 🇪🇸 galicyjski
  • 🇬🇪 gruziński
  • 🇩🇪 niemiecki
  • 🇬🇷 grecki
  • 🇮🇳 gudżarati
  • 🇭🇹 kreolski haitański
  • 🇳🇬 hausa
  • 🇮🇱 hebrajski
  • 🇮🇳 hindi
  • 🇭🇺 węgierski
  • 🇮🇸 islandzki
  • 🇮🇩 indonezyjski
  • 🇮🇪 irlandzki
  • 🇮🇹 włoski
  • 🇯🇵 japoński
  • 🇮🇩 jawajski
  • 🇮🇳 kannada
  • 🇰🇿 kazachski
  • 🇮🇳 konkani
  • 🇰🇷 koreański
  • 🇰🇬 kirgiski
  • 🇱🇦 laotański
  • 🇻🇦 łacina
  • 🇱🇻 łotewski
  • 🇨🇩 lingala
  • 🇱🇹 litewski
  • 🇱🇺 luksemburski
  • 🇲🇰 macedoński
  • 🇮🇳 maithili
  • 🇲🇬 malgaski
  • 🇲🇾 malajski
  • 🇮🇳 malajalam
  • 🇮🇳 marathi
  • 🇲🇳 mongolski
  • 🇳🇵 nepalski
  • 🇳🇴 norweski
  • 🇮🇳 odia
  • 🇦🇫 paszto
  • 🇮🇷 perski
  • 🇵🇱 polski
  • 🇵🇹 portugalski
  • 🇮🇳 pendżabski
  • 🇷🇴 rumuński
  • 🇷🇺 rosyjski
  • 🇷🇸 serbski
  • 🇵🇰 sindhi
  • 🇱🇰 syngaleski
  • 🇸🇰 słowacki
  • 🇸🇮 słoweński
  • 🇸🇴 somalijski
  • 🇪🇸 hiszpański
  • 🇰🇪 suahili
  • 🇸🇪 szwedzki
  • 🇮🇳 tamilski
  • 🇮🇳 telugu
  • 🇹🇭 tajski
  • 🇹🇷 turecki
  • 🇺🇦 ukraiński
  • 🇵🇰 urdu
  • 🇻🇳 wietnamski
  • 🇬🇧 walijski

Sposób liczenia: jedna pozycja na język, a nie na lokalizację — np. regionalne warianty angielskiego liczą się raz, norweski bokmål i nynorsk liczą się raz, a bengalski/Bangla liczy się raz.

Rozwiązywanie problemów z klonem głosu, który nie brzmi wystarczająco podobnie

Tożsamość głosu wydaje się słaba

Zastąp źródło czystszą próbką 1–2 minuty z jednego, nieprzerwanego nagrania. Utrzymaj spójne: mikrofon, pomieszczenie, tempo i sposób wykonania.

Klon brzmi szumiąco lub metalicznie

Odsłuchaj źródło na słuchawkach. Usuń muzykę w tle, echo, wentylatory, ruch uliczny, agresywną redukcję szumów, przesterowania (clipping) oraz wielokrotne stratne eksporty. Czystszy oryginał zwykle pomaga bardziej niż dodatkowa obróbka.

Tempo lub emocje są nie takie

Klon nauczył się tych wyborów sposobu mówienia z próbki. Nagraj źródło w tonie, energii, tempie i stylu mówienia, które chcesz później usłyszeć.

Język lub akcent jest nieoczekiwany

Używaj jednego języka w całej próbce i unikaj przełączania języków podczas nagrania do klonowania. Aby uzyskać najlepsze dopasowanie wymowy i akcentu, klonuj i testuj w języku, w którym planujesz publikować.

Utwórz klona swojego głosu

Przygotuj jedno czyste nagranie źródłowe, otwórz Wideo AI i podejrzyj wynik, zanim użyjesz go w dłuższej produkcji. Zobacz funkcję klonowania głosu VisionStory, aby dowiedzieć się więcej o głosach niestandardowych i wielojęzycznych.

Najczęściej zadawane pytania

  • Gdy liczy się jakość, użyj 1–2 minut czystej, spójnej mowy. Produkt przyjmuje wybrany fragment od 3 do 120 sekund, a nagrywanie bezpośrednie jest ograniczone do 15 sekund na szybki test.