Tonton tutorial ini di YouTube

YouTube

Nak buat foto pegun bercakap—potret yang membuka mulut, berkelip, dan menyebut apa sahaja yang anda taip? Dengan VisionStory, anda boleh melakukannya daripada satu imej sahaja, terus dalam pelayar anda, tanpa kamera dan tanpa pengalaman suntingan. Video di atas menunjukkan keseluruhan aliran, dan panduan langkah demi langkah di bawah menerangkan setiap bahagian dengan terperinci.

Sambil anda meneruskan langkah-langkah ini, anda akan muat naik satu potret dan menyediakannya sebagai avatar anda sendiri yang boleh digunakan semula. Pengguna lain tidak boleh melihatnya, dan anda boleh memilihnya semula untuk video akan datang tanpa perlu muat naik imej yang sama setiap kali. Semuanya berjalan dalam alat foto bercakap VisionStory dengan akaun percuma.

Langkah 1: Muat naik satu potret yang jelas

Buka Video AI. Dalam panel Watak, pilih Upload dan pilih imej daripada peranti anda, atau seret foto terus ke kawasan drop. Gunakan seorang individu yang jelas menghadap ke hadapan dengan wajah dan bahu kelihatan, mata dan mulut tidak terhalang, serta ada sedikit ruang di sekeliling subjek untuk pembingkaian semula kemudian.

  • Fail yang disokong: JPG, JPEG, PNG, WebP, dan HEIC.
  • Saiz fail maksimum: 30 MB.
  • Saiz permulaan yang disyorkan: sekurang-kurangnya 512 x 768 piksel untuk potret.
  • Tingkah laku muat naik: satu imej sumber pada satu masa.
Dragging a portrait onto the Upload control in the VisionStory Characters panel

Padankan komposisi sumber dengan tempat video akan dipaparkan. Potret yang dipotong ketat boleh berfungsi dalam 9:16 tetapi boleh menjadi potongan wajah yang terlalu rapat dalam 16:9, kerana tiada kawasan imej di kiri dan kanan untuk mengisi bingkai yang lebih lebar.

Langkah 2: Biarkan VisionStory mengesahkan dan menyediakan avatar

Selepas muat naik, VisionStory menyemak sama ada imej mengandungi individu yang boleh digunakan dan menyediakannya sebagai watak. Muat naik yang gagal hampir selalu berpunca daripada foto sumber: wajah mungkin terlalu kecil, terlalu tertutup, terlalu menoleh ke sisi, kabur, atau terlalu dekat dengan wajah lain.

Jika penyediaan gagal, jangan asyik cuba semula potongan yang sama. Pilih sumber yang lebih tajam dengan satu wajah yang lebih besar, sudut yang lebih terus, bahu yang kelihatan, pencahayaan yang sekata, dan kurang halangan.

VisionStory avatar preview beside a checklist for a clear, unobstructed source photo

Apabila pemprosesan selesai, avatar akan muncul di atas pustaka watak umum dan dibuka dalam pratonton avatar. Ia hanya boleh dilihat oleh anda.

Langkah 3: Pratonton atau tukar suara yang ditetapkan

VisionStory secara automatik menetapkan suara permulaan yang sesuai berdasarkan anggaran umur dan jantina individu tersebut. Anda boleh mengekalkannya, pratonton, atau menukarnya kepada yang lain.

  1. Pilih suara semasa untuk membuka Pustaka Suara.
  2. Gunakan butang main di sebelah kanan sesuatu suara untuk mendengar sampel.
  3. Jika tidak sesuai, tapis mengikut Bahasa, Jantina, Umur, dan Kegunaan.
  4. Pratonton beberapa alternatif, kemudian pilih suara yang sepadan dengan avatar serta tujuan video.
VisionStory Voice Library with Language, Gender, Age, and Use Case filters and a preview button

Suara mungkin sepadan dengan anggaran umur dan jantina seseorang, tetapi masih terasa tidak sesuai untuk naratif, pendidikan, iklan, atau kandungan perbualan. Padankan individu dan tujuan, bukan sekadar demografi.

Langkah 4: Bingkaikan semula foto untuk destinasi penerbitan

Gunakan pratonton avatar untuk menentukan berapa banyak bahagian individu yang akan muncul dalam video akhir. Seret foto untuk mengubah kedudukan subjek, dan gunakan kawalan zum untuk mendekatkan atau menjauhkan. Kemudian pilih nisbah aspek yang sesuai dengan tempat anda akan menerbitkannya:

  • Potret 9:16 untuk TikTok, Instagram Reels, YouTube Shorts, dan penempatan mudah alih yang lain.
  • Segi empat 1:1 untuk siaran sosial segi empat, susun atur berfokus profil, dan embed yang fleksibel.
  • Landskap 16:9 untuk YouTube, pembentangan, laman web, dan kursus skrin lebar.
The same VisionStory avatar shown in 9:16, 1:1, and 16:9 aspect ratios

Zum tidak boleh menampilkan piksel yang tidak wujud. Jika individu sudah menyentuh setiap tepi foto sumber, mulakan dengan imej yang mempunyai lebih banyak latar belakang daripada memaksa potongan yang lebih lebar.

Langkah 5: Fahami fungsi Change Look dan Generate Image

Dua alat imej AI terletak di sebelah avatar, dan lebih baik anda tahu perbezaannya sebelum menggunakannya.

Change Look membuka sembang AI dengan avatar semasa anda sudah dilampirkan, jadi anda boleh menerangkan pakaian, latar, atau gaya baharu. Ia ialah aliran kerja imej-ke-imej, dan avatar asal masih tersedia. Generate Image bermula daripada penerangan watak bertulis dan bukannya foto, jadi ia ialah aliran kerja teks-ke-imej. Untuk kedua-duanya, anda boleh terus bersembang untuk memperhalusi hasilnya.

VisionStory Change Look chat opened with the current avatar attached as the starting image

Ringkasnya: gunakan Change Look apabila watak sudah wujud dan perlukan penampilan visual baharu, dan gunakan Generate Image apabila anda mahu mencipta watak daripada prompt.

Langkah 6: Tambah skrip pendek dan jana video bercakap

Dengan avatar yang anda muat naik dipilih, taip satu ayat pendek berbentuk perbualan dalam kotak Skrip. Baris yang pendek dirender lebih pantas dan memudahkan anda menilai foto, potongan, suara, lip-sync, dan pergerakan secara serentak.

Klik Generate Talking Video. VisionStory menghidupkan animasi wajah, menyegerakkan bibir dengan suara, dan menambah kelipan serta pergerakan kepala yang realistik menggunakan avatar, pembingkaian, skrip, dan suara yang dipilih. Proses render mengambil masa beberapa minit.

A short VisionStory script generating a talking-avatar result from the uploaded portrait

Anggap hasil pertama ini sebagai ujian praktikal untuk foto sumber. Semak 4 perkara ini:

  • Wajah kekal cukup tajam pada saiz akhir.
  • Mata dan mulut kekal tidak terhalang semasa bergerak.
  • Kepala dan bahu berada dengan selesa dalam nisbah yang dipilih.
  • Avatar yang bergerak masih kelihatan seperti individu dalam foto sumber.

Jika potongan terlalu ketat atau wajah kelihatan lembut semasa bergerak, betulkan imej sumber atau pembingkaian dahulu. Menukar skrip tidak akan menyelesaikan masalah komposisi.

Langkah 7: Guna semula atau buang avatar foto bercakap anda

Kembali ke senarai Watak, avatar yang anda muat naik berada di atas pustaka watak umum dan boleh dipilih pada bila-bila masa jika anda mahu penyampai yang sama lagi. Pengguna lain tidak boleh melihatnya, dan pelanggan boleh mencipta serta menyimpan avatar tanpa had.

  • Guna semula: pilih avatar tersebut dan bukannya muat naik foto sekali lagi.
  • Tukar penampilan: buka avatar dan pilih salah satu thumbnail penampilan yang disimpan.
  • Buang: halakan kursor pada avatar untuk memaparkan butang padam di penjuru kanan atas, kemudian sahkan sebelum memadam avatar dan penampilannya.
A reusable uploaded avatar in VisionStory Characters with the delete control and confirmation dialog

Menyelesaikan masalah foto biasa

VisionStory tidak dapat mencari wajah yang boleh digunakan. Gunakan imej yang lebih cerah dan tajam dengan satu wajah yang lebih besar serta menghadap ke hadapan. Elakkan mata atau mulut yang tertutup, sudut profil yang terlalu kuat, dan foto yang mempunyai wajah lain terlalu dekat dengan subjek utama.

Potongan landskap terlalu rapat. Potret sumber mungkin tidak mempunyai kawasan imej yang mencukupi di sisi. Gunakan sumber yang lebih lebar, atau yang mempunyai lebih banyak ruang kosong di sekeliling individu.

Avatar masih sedang disediakan. Tunggu sehingga penyediaan selesai sebelum menggunakan watak. Jika ia tersekat, segarkan paparan Watak dan semak sama ada avatar sudah pun muncul sebelum anda muat naik salinan lain.

Hasil kelihatan lembut. Mulakan dengan foto beresolusi lebih tinggi dan fokus yang jelas, serta elakkan membesarkan wajah kecil terlalu agresif. Resolusi output tidak boleh mengembalikan perincian yang tiada pada sumber.

Itu sahaja untuk membuat foto bercakap: muat naik satu potret, padankan suara, bingkaikan, dan jana. Foto anda kini menjadi avatar bercakap yang boleh digunakan semula bila-bila masa anda memerlukannya.

Sedia untuk skrip lengkap, suara, tetapan, kredit, dan aliran kerja penjanaan? Ikuti How to Create an AI Talking Avatar, atau tukar skrip penuh menjadi video AI pada skala besar. Atau terus mula sekarang: buat foto bercakap pertama anda secara percuma.

Soalan Lazim

  • Muat naik foto yang jelas menghadap ke hadapan ke alat foto bercakap VisionStory, taip satu baris pendek untuk ia sebut, pilih atau kekalkan suara yang ditetapkan, kemudian klik Generate Talking Video. Anda akan mendapat video bercakap dengan lip-sync dalam pelayar anda dalam beberapa minit melalui pelan percuma, tanpa perlu memasang sebarang perisian.