فارسی

تبدیل تصویر به ویدیو درباره طراحی یک تصویر جدید نیست — درباره این است که به عکسی که از قبل به آن اعتماد دارید، زمان و حرکت بدهید. یک عکس محصول، پرتره یا فریم مفهومی را آپلود کنید، توضیح دهید چه چیزی باید حرکت کند و دوربین چطور باید رفتار کند، و ابزار تبدیل تصویر به ویدیو یک کلیپ متحرک تولید می‌کند که سوژه را دست‌نخورده نگه می‌دارد.

به همین دلیل هر وقت ظاهر قابل مذاکره نیست، این ابزار انتخاب درست است. در مقایسه با تبدیل متن به ویدیوِ صرف، تصویر شروع، شخص/محصول، پوشش، صحنه و ترکیب‌بندی را قفل می‌کند؛ کار پرامپت این است که بگوید چه چیزی می‌تواند حرکت کند، دوربین چگونه حرکت می‌کند، و کدام جزئیات نباید تغییر کنند.

مرحله 1: یک تصویر شروع انتخاب کنید که از پس انیمیشن برمی‌آید

در تولیدکننده ویدیوی هوش مصنوعی، روی Image to Video بروید و تصویرتان را به‌عنوان فریم Start آپلود کنید. تصاویر با سوژه کامل، نورپردازی تمیز، و ترکیب‌بندی نزدیک به نسبت تصویر نهایی را ترجیح دهید. عکس محصول باید شکل کامل و بخش‌های کلیدی را نشان دهد؛ پرتره باید از بریدگی دست‌ها، مو یا لباس پرهیز کند؛ و صحنه باید برای حرکت دوربین فضا بگذارد.

این آموزش از یک شات 16:9 از کیس ایرباد مشکیِ مات استفاده می‌کند. پرامپت می‌خواهد درِ کیس کمی باز شود، یک نور بنفش روی سطح حرکت کند، و یک حرکت آرامِ نزدیک‌شدن دوربین (push-in) داشته باشیم — در حالی که هندسه محصول ثابت بماند، هیچ شیء جدیدی اضافه نشود و هیچ متنی هم نباشد.

کیس ایرباد کاملاً یکسان می‌ماند در حالی که درِ آن کمی باز می‌شود و یک نور بنفشِ ملایم روی سطح حرکت می‌کند.
حرکت سینماییِ آرامِ نزدیک‌شدن دوربین، بازتاب‌های واقعی، هندسه محصول ثابت، بدون شیء جدید، بدون متن.
Uploading a product photo to VisionStory Image to Video and writing a motion prompt
فریم Start محصول و ترکیب‌بندی را تعیین می‌کند؛ پرامپت فقط عملِ درِ کیس، حرکت نور، push-in، و چیزهایی که باید ثابت بمانند را توصیف می‌کند.

مرحله 2: درباره فریم پایان تصمیم بگیرید، سپس پارامترها را تنظیم کنید

اگر تصویر فقط به کمی حرکت طبیعی نیاز دارد، فریم End را رد کنید. فقط وقتی تصویر دوم را آپلود کنید که ویدیو باید دقیقاً از یک عکس مشخص به عکس مشخص دیگری برسد — و هر دو فریم را روی همان سوژه، همان زاویه دید، و همان صحنه نگه دارید؛ وگرنه مدل ممکن است بینشان پرش کند یا دچار اعوجاج شود.

سپس مدل، مدت‌زمان، نسبت تصویر و وضوح تصویر مقصد را انتخاب کنید. شات‌های جزئیات محصول معمولاً با حرکت آهسته‌تر بهتر دیده می‌شوند؛ یک هوکِ شبکه‌های اجتماعی می‌تواند سریع‌تر حرکت کند، به شرطی که محصول همچنان خوانا بماند. مطمئن شوید نسبت تصویر با تصویر ورودی هم‌خوان است تا سیستم برای پر کردن کادر، سوژه‌تان را کراپ نکند.

Resolution, duration, and aspect ratio settings for VisionStory image to video generation
این نمونه فقط از فریم شروع استفاده می‌کند، با Seedance 2.0، 720p، 16:9 و 15 ثانیه تا هندسه محصول را در یک برداشت طولانی‌تر بهتر بررسی کنید.

مرحله 3: تولید کنید، سپس اول از همه تامبنیل را چک کنید

روی Generate کلیک کنید. کلیپ نهایی با مدت‌زمان، وضوح تصویر، عنوان و زمان ساخت، بالای فهرست Videos قرار می‌گیرد. قبل از پخش هر چیزی، از تامبنیل یک سؤال بپرسید: آیا این هنوز همان محصول یا همان شخص است؟

اگر همان فریم اول اشتباه است — رنگ، تعداد قطعات، هویت یا کادربندی — یک تصویر ورودی تمیزتر جایگزین کنید. اگر فریم اول درست است اما شات در میانه خراب می‌شود، حرکت را کمتر کنید، مدت‌زمان را کوتاه‌تر کنید، یا محدودیت‌های ظاهری را در پرامپت قوی‌تر بنویسید.

A completed image-to-video generation showing in the VisionStory Videos list
کارت اول نتیجه این اجراست — تامبنیل هنوز کیس ایرباد مشکی را به‌عنوان سوژه نگه داشته است.

مرحله 4: کل کلیپ را پخش کنید و ثبات سوژه را بررسی کنید

نتیجه را از ابتدا تا انتها در Video Viewer پخش کنید. برای محصولات، به شکل، جنس، دکمه‌ها، پورت‌ها و تعداد قطعات دقت کنید. برای افراد، صورت، دست‌ها، مو، لباس و نحوه قرار گرفتنشان در پس‌زمینه را بررسی کنید. برای صحنه‌ها، ساختار، پرسپکتیو و تداوم نورپردازی را زیر نظر بگیرید.

بخش Generation Details پرامپت، مدل و وضوح تصویر اصلی را نگه می‌دارد. وقتی از آزمون سربلند بیرون آمد، کلیپ را دانلود کنید و در تبلیغات محصول، ویدیوهای افیلیت، کلیپ‌های اجتماعی، B-roll کانال، یا ادیت یک داستان طولانی‌تر استفاده کنید. اگر شکست خورد، پرامپت یا تصویر ورودی را اصلاح کنید — تلاش نکنید یک ایراد واضحِ سوژه را در ادیت پنهان کنید.

Previewing an image-generated video in the VisionStory Video Viewer with its motion prompt
پیش‌نمایش کامل برای بررسی ساختار محصول، تغییرات نور و حرکت دوربین در کل تایم‌لاین است — نه فقط فریم اول.

مرحله 5: شاتِ موفق را وارد یک گردش‌کار کامل ویدیویی کنید

یک کلیپ تبدیل تصویر به ویدیو معمولاً فقط یک شات داخل یک کار بزرگ‌تر است. فروشندگان محصولات آن را با یک سخنگوی آواتاری یا توضیح‌دهنده AI UGC جفت می‌کنند؛ سازندگان YouTube آن را به‌عنوان B-roll اجرا می‌کنند؛ و تیم‌های برند و آموزش از آن برای نمایش محصولات، فرایندها یا صحنه‌های مفهومی استفاده می‌کنند.

وقتی چند شات با یک موضوع واحد تولید می‌کنید، تصویر ورودی، نسخه محصول، هویت کاراکتر و سبک بصری را ثابت نگه دارید و در هر اجرا دقیقاً فقط یک متغیر حرکتی را تغییر دهید. مقایسه شروع‌ها، ترنزیشن‌ها و ریویل‌ها خیلی راحت‌تر می‌شود — و رانشِ ظاهر بین نسل‌های مختلف هم کمتر اتفاق می‌افتد.

مشکلات رایج و راه‌حل آن‌ها

  • محصول وسط حرکت تبدیل به یک محصول دیگر می‌شود. از تصویر محصول شارپ‌تر و کامل‌تر استفاده کنید، تعداد اکشن‌ها را کمتر کنید، و جنس، رنگ، ساختار و بخش‌هایی را که نباید تغییر کنند دقیق نام ببرید.
  • صورت یا دست‌ها می‌لرزند. ورودی‌ای انتخاب کنید که سوژه روبه‌رو و واضح باشد و دست‌ها پوشیده/مسدود نباشند، از چرخش‌های بزرگ و ژست‌های پیچیده دوری کنید، و با کلیپ‌های کوتاه‌تر شروع کنید.
  • نتیجه فقط یک زوم آهسته است. یک اکشن قابل‌دیدن برای سوژه یا یک تغییر محیطی و یک حرکت مشخص دوربین را توصیف کنید — نه اینکه فقط تصویر را به حرکت درآورید.
  • تصویر ورودی کراپ می‌شود. تصویر منبع را با نسبت تصویر هدف هماهنگ کنید و سوژه را داخل محدوده امن نگه دارید؛ روی این حساب نکنید که مولد بتواند افقی را به عمودی تبدیل کند.
  • شات بین فریم شروع و پایان پرش می‌کند. هر دو فریم را روی همان سوژه، همان زاویه دید و همان صحنه نگه دارید و فقط وضعیت/حالتی را تغییر دهید که می‌خواهید اتفاق بیفتد.

استاندارد تبدیل تصویر به ویدیو این نیست که حرکت بیشتر داشته باشید — این است که سوژه باورپذیر بماند و در عین حال حرکتی بگیرد که به محتوا خدمت کند. اول ظاهر را قفل کنید، بعد حرکت را هدایت کنید. اگر چیزی که واقعاً می‌خواهید یک پرتره سخنگو است، آن یک گردش‌کار متفاوت است: عکس را سخنگو کنید. و وقتی اصلاً هیچ تصویر قابل استفاده‌ای ندارید، از کلمات شروع کنید با تبدیل متن به ویدیو.

سوالات متداول

  • تصویری با سوژه کامل، نورپردازی واضح، وضوح کافی و ترکیب‌بندی‌ای که از قبل به نسبت تصویر نهایی نزدیک باشد. لبه‌های مهمِ محصول، شخص یا صحنه نباید بریده شده باشند.