فارسی

این آموزش را در یوتیوب تماشا کنید

YouTube

آماده‌اید یک متن را به یک مجری هوش مصنوعی واقعی تبدیل کنید؟ این راهنمای مرحله‌به‌مرحله نشان می‌دهد چطور اولین ویدیوی آواتار سخنگوی هوش مصنوعی خود را در VisionStory بسازید—یک آواتار انتخاب کنید، متن‌تان را اضافه کنید، یک صدا بردارید و در چند دقیقه یک ویدیوی سخنگوی حرفه‌ای تولید کنید. ابتدا ویدیوی راهنمای بالا را ببینید، سپس مراحل زیر را دنبال کنید.

مرحله 1: آواتار خود را انتخاب یا ایجاد کنید

ویدیوی هوش مصنوعی را باز کنید و تصمیم بگیرید چه کسی ارائه می‌دهد. برای داشتن آواتار سه راه دارید:

  • انتخاب آواتارهای آماده: یکی از کاراکترهای عمومیِ آماده VisionStory را انتخاب کنید—سریع‌ترین راه برای شروع.
  • آپلود عکس خودتان: یک تصویر واضح و روبه‌رو اضافه کنید تا یک فرد واقعی را به آواتار سخنگو تبدیل کنید.
  • تولید آواتار: از روی یک پرامپت متنی، یک کاراکتر کاملاً جدید بسازید.

هر زمان خواستید، با Change Look ظاهر آواتار انتخاب‌شده را تنظیم کنید.

Choosing a built-in avatar in VisionStory AI Video

مرحله 2: متن خود را اضافه کنید

به آواتارتان بگویید چه چیزی را بگوید. در پنل سمت راست، روش تأمین صدا را انتخاب کنید:

  • Script: کلماتی را که می‌خواهید آواتارتان بگوید تایپ کنید تا هوش مصنوعی گفتار را تولید کند.
  • Import: یک فایل صوتی از پیش ضبط‌شده را آپلود کنید تا ویدیو بر اساس آن ساخته شود.
  • Record: صدای خودتان را مستقیم داخل VisionStory ضبط کنید.

برای شروع، متن اولتان را کوتاه نگه دارید تا سریع‌تر بتوانید نتیجه را بررسی کنید.

مرحله 3: یک صدا انتخاب کنید

هر آواتار یک صدای پیش‌فرض دارد، اما می‌توانید آن را تغییر دهید:

  • Voice Library: کتابخانه را باز کنید تا 1,000+ صدا در 88 زبان را ببینید و با جست‌وجو سریعاً دقیقاً همان صدایی را پیدا کنید که می‌خواهید.
  • Clone a voice: با یک نمونه کوتاه از ضبط صدای خودتان، یک صدای هوش مصنوعی اختصاصی بسازید.
  • Preview & enhance: قبل از نهایی‌کردن، با Preview Audio گوش کنید و با Voice Enhance صدا را تمیزتر کنید.
Searching the VisionStory Voice Library with over 1,000 voices

مرحله 4: مدل ویدیو، وضوح تصویر و گزینه‌ها را انتخاب کنید

قبل از تولید، ظاهر ویدیو را تنظیم کنید:

  • Video Model: VisionStory برای همگام‌سازی لب طبیعی و حالت‌های چهره، از جدیدترین مدل آواتار سخنگوی خود یعنی V-Character 3.0 استفاده می‌کند.
  • وضوح تصویر: بسته به اینکه کجا منتشر می‌کنید، 720P، 1080P یا 2K را انتخاب کنید.
  • نسبت تصویر: برای هماهنگی با پلتفرمتان بین 9:16 (عمودی)، 16:9 (افقی) و 1:1 (مربعی) جابه‌جا شوید.
  • ویدیوی پرده سبز: فقط وقتی روشنش کنید که به یک پس‌زمینه یک‌دست نیاز دارید تا بعداً در تدوین جایگزینش کنید.
  • Motion: میزان حرکت آواتار را تنظیم کنید تا اجرای پویاتری داشته باشد.
VisionStory video settings: model, resolution, and green screen

مرحله 5: اعتبارها را بررسی کنید و تولید بزنید

VisionStory قبل از تولید، هزینه را نشان می‌دهد:

  • Credit Details: بخش Credit Details را باز کنید تا ببینید جمع کل چطور محاسبه شده است—هزینه به وضوح تصویر و مدت‌زمانی که انتخاب کرده‌اید بستگی دارد (مثلاً ویدیوی کوتاه 720P در این آموزش 4 اعتبار هزینه دارد).
  • Generate Talking Video: وقتی همه‌چیز درست بود، روی Generate کلیک کنید. VisionStory آواتار شما را متحرک می‌کند و لب‌ها و حالات چهره را با متن شما همگام می‌سازد.

مرحله 6: ویدیوی خود را بررسی، اشتراک‌گذاری و مدیریت کنید

بعد از پایان پردازش، ویدیوی شما در Assets نمایش داده می‌شود و می‌توانید:

  • نتیجه نهایی را Preview کنید و برای نظم بهتر rename کنید.
  • فایل MP4 را دانلود کنید یا یک لینک اشتراک‌گذاری را کپی کنید تا هرجا خواستید منتشر کنید.
  • مستقیم در شبکه‌های اجتماعی مثل X یا Facebook به اشتراک بگذارید.
  • ویدیویی را که دیگر لازم ندارید حذف کنید.

تمام—اولین ویدیوی آواتار سخنگوی هوش مصنوعی شما آماده است. از اینجا به بعد می‌توانید آواتارهای مختلف را امتحان کنید، صدای خودتان را شبیه‌سازی کنید یا با رشد پروژه‌ها، خروجی با وضوح تصویر بالاتر بگیرید.

سوالات متداول

  • نه. می‌توانید یک کاراکتر آماده داخلی انتخاب کنید، عکسِ واضحِ تمام‌رخِ خودتان را آپلود کنید یا با یک پرامپت متنی، یک آواتار کاملاً جدید بسازید.