شاهد هذا الدرس التعليمي على YouTube

YouTube

هل تريد جعل صورة ثابتة تتحدث—مثل بورتريه يفتح فمه ويطرف ويقول أي شيء تكتبه؟ مع VisionStory يمكنك فعل ذلك تمامًا من صورة واحدة، مباشرةً في متصفحك، دون كاميرا ودون أي خبرة في التحرير. يشرح الفيديو أعلاه العملية كاملة، ويغطي الدليل خطوة بخطوة أدناه كل جزء بالتفصيل.

وأثناء المتابعة، سترفع صورة بورتريه واحدة وتجهّزها لتصبح أفاتارك القابل لإعادة الاستخدام. لا يمكن للمستخدمين الآخرين رؤيتها، ويمكنك اختيارها مجددًا للفيديوهات المستقبلية بدلًا من رفع الصورة نفسها في كل مرة. كل شيء يعمل داخل أداة الصور الناطقة من VisionStory باستخدام حساب مجاني.

الخطوة 1: ارفع صورة بورتريه واحدة واضحة

افتح فيديو الذكاء الاصطناعي. في لوحة الشخصيات، اختر Upload وحدّد صورة من جهازك، أو اسحب الصورة مباشرةً إلى منطقة الإسقاط. استخدم شخصًا واحدًا واضحًا من الأمام بحيث يظهر الوجه والكتفان، مع عدم وجود أي عوائق أمام العينين والفم، واترك مساحة بسيطة حول الشخص لإعادة التأطير لاحقًا.

  • الملفات المدعومة: JPG وJPEG وPNG وWebP وHEIC.
  • الحد الأقصى لحجم الملف: 30 MB.
  • الحجم الموصى به للبدء: لا يقل عن 512 x 768 بكسل للبورتريه.
  • سلوك الرفع: صورة مصدر واحدة في كل مرة.
Dragging a portrait onto the Upload control in the VisionStory Characters panel

طابق تكوين الصورة الأصلية مع المكان الذي سيُعرَض فيه الفيديو في النهاية. يمكن أن ينجح بورتريه مقتطع بإحكام مع 9:16، لكنه قد يتحول إلى قصّ قريب مزعج للوجه في 16:9، لأنه لا توجد مساحة صورة على اليسار واليمين لملء الإطار الأعرض.

الخطوة 2: دع VisionStory يتحقق من الأفاتار ويجهّزه

بعد الرفع، يتحقق VisionStory مما إذا كانت الصورة تحتوي على شخص قابل للاستخدام ويجهّزها كشخصية. غالبًا ما يعود فشل الرفع إلى الصورة الأصلية: قد يكون الوجه صغيرًا جدًا، أو مغطّى بشكل كبير، أو ملتفتًا كثيرًا إلى الجانب، أو ضبابيًا، أو قريبًا جدًا من وجه آخر.

إذا فشلت عملية التجهيز، فلا تواصل إعادة محاولة القصّ نفسه. اختر صورة أكثر حدة بوجه واحد أكبر، وزاوية أكثر مباشرة، وكتفين ظاهرين، وإضاءة متوازنة، وعوائق أقل.

VisionStory avatar preview beside a checklist for a clear, unobstructed source photo

عند انتهاء المعالجة، يظهر الأفاتار فوق مكتبة الشخصيات العامة ويفتح في معاينة الأفاتار. وهو مرئي لك وحدك.

الخطوة 3: عاين الصوت المعيّن أو غيّره

يعيّن VisionStory تلقائيًا صوتًا مناسبًا للبدء بناءً على العمر الظاهر للشخص وجنسه. يمكنك الاحتفاظ به أو معاينته أو استبداله بآخر.

  1. حدّد الصوت الحالي لفتح مكتبة الصوت.
  2. استخدم زر التشغيل على يمين الصوت للاستماع إلى عيّنة.
  3. إذا لم يكن مناسبًا، صفِّ حسب اللغة والجنس والعمر وحالة الاستخدام.
  4. عاين عدة بدائل، ثم اختر الصوت الذي يطابق الأفاتار وهدف الفيديو معًا.
VisionStory Voice Library with Language, Gender, Age, and Use Case filters and a preview button

قد يطابق الصوت العمر الظاهر للشخص وجنسه، لكنه يظل غير مناسب للسرد أو التعليم أو الإعلان أو المحتوى الحواري. طابق بين الشخص والهدف، وليس الخصائص الديموغرافية فقط.

الخطوة 4: أعد تأطير الصورة حسب وجهتها

استخدم معاينة الأفاتار لتحديد مقدار ظهور الشخص في الفيديو النهائي. اسحب الصورة لإعادة تموضع الشخص، واستخدم أدوات التكبير/التصغير للاقتراب أو الابتعاد. ثم اختر نسبة العرض إلى الارتفاع المناسبة للمكان الذي ستنشر فيه:

  • 9:16 عمودي لـ TikTok وInstagram Reels وYouTube Shorts وغيرها من المواضع المخصصة للهواتف.
  • 1:1 مربع للمنشورات الاجتماعية المربعة وتخطيطات الملفات الشخصية والتضمينات المرنة.
  • 16:9 أفقي لـ YouTube والعروض التقديمية والمواقع والدورات ذات الشاشة العريضة.
The same VisionStory avatar shown in 9:16, 1:1, and 16:9 aspect ratios

التكبير لا يمكنه إظهار بكسلات غير موجودة. إذا كان الشخص يلامس بالفعل كل حواف الصورة الأصلية، فابدأ بصورة تحتوي على خلفية أكبر بدلًا من فرض قصّ أعرض.

الخطوة 5: افهم ما الذي يفعله Change Look وGenerate Image

توجد أداتان للصور بالذكاء الاصطناعي بجانب الأفاتار، ومن المفيد معرفة الفرق بينهما قبل الاستخدام.

تفتح Change Look محادثة ذكاء اصطناعي مع إرفاق أفاتارك الحالي مسبقًا، لتصف زيًا جديدًا أو خلفية أو أسلوبًا مختلفًا. هذا سير عمل image-to-image، ويبقى الأفاتار الأصلي متاحًا. أما Generate Image فتبدأ من وصف مكتوب للشخصية بدلًا من صورة، لذا فهي سير عمل text-to-image. وفي كلتا الحالتين، يمكنك متابعة الدردشة لتحسين النتيجة.

VisionStory Change Look chat opened with the current avatar attached as the starting image

باختصار: استخدم Change Look عندما تكون الشخصية موجودة بالفعل وتحتاج لمظهر بصري جديد، واستخدم Generate Image عندما تريد إنشاء شخصية من موجه.

الخطوة 6: أضف نصًا قصيرًا وأنشئ الفيديو الناطق

مع تحديد الأفاتار الذي رفعته، اكتب جملة واحدة قصيرة وبأسلوب محادثة في مربع النص. السطر القصير يُصيَّر أسرع ويجعل تقييم الصورة والقصّ والصوت ومزامنة الشفاه والحركة معًا أسهل.

انقر Generate Talking Video. يقوم VisionStory بتحريك الوجه ومزامنة الشفاه مع الصوت وإضافة طرفات وحركة رأس واقعية باستخدام الأفاتار والتأطير والنص والصوت المحددة. يستغرق التصيير بضع دقائق.

A short VisionStory script generating a talking-avatar result from the uploaded portrait

تعامل مع هذه النتيجة الأولى كاختبار عملي للصورة الأصلية. راجعها وفق أربعة أمور:

  • يبقى الوجه حادًا بما يكفي عند الحجم النهائي.
  • تبقى العينان والفم دون عوائق أثناء الحركة.
  • تستقر الرأس والكتفان بشكل مريح ضمن النسبة المختارة.
  • لا يزال الأفاتار المتحرك يشبه الشخص في الصورة الأصلية.

إذا كان القصّ ضيقًا جدًا أو بدا الوجه ناعمًا أثناء الحركة، فأصلح الصورة الأصلية أو التأطير أولًا. تغيير النص لن يحل مشكلة التكوين.

الخطوة 7: أعد استخدام أفاتار الصورة الناطقة أو احذفه

بالعودة إلى قائمة الشخصيات، يظهر الأفاتار الذي رفعته فوق مكتبة الشخصيات العامة، ويمكن تحديده في أي وقت تريد فيه المُقدّم نفسه مجددًا. لا يمكن للمستخدمين الآخرين رؤيته، ويمكن للمشتركين إنشاء أفاتارات غير محدودة والاحتفاظ بها.

  • أعد استخدامه: حدّد الأفاتار بدلًا من رفع الصورة مرة أخرى.
  • بدّل المظهر: افتح الأفاتار واختر إحدى صور المعاينة المصغّرة للمظاهر المحفوظة.
  • احذفه: مرّر المؤشر فوق الأفاتار لإظهار زر الحذف في الزاوية العلوية اليمنى، ثم أكّد قبل حذف الأفاتار ومظاهره.
A reusable uploaded avatar in VisionStory Characters with the delete control and confirmation dialog

استكشاف أخطاء الصور الشائعة وإصلاحها

لا يستطيع VisionStory العثور على وجه قابل للاستخدام. استخدم صورة أكثر سطوعًا وحدةً بوجه واحد أكبر من الأمام. تجنب العيون أو الأفواه المغطاة، وزوايا البروفايل القوية، والصور التي يظهر فيها وجه آخر قريبًا من الشخص الأساسي.

القصّ الأفقي قريب جدًا. غالبًا لا تحتوي صورة البورتريه الأصلية على مساحة كافية على الجانبين. استخدم صورة أعرض، أو صورة تحتوي على مساحة فارغة أكبر حول الشخص.

لا يزال الأفاتار قيد التجهيز. انتظر حتى يكتمل التجهيز قبل استخدام الشخصية. إذا علِق، حدّث عرض الشخصيات وتحقق مما إذا كان الأفاتار قد ظهر بالفعل قبل رفع نسخة أخرى.

تبدو النتيجة ناعمة. ابدأ بصورة أعلى دقة وفي بؤرة واضحة، وتجنب تكبير وجه صغير بشكل مبالغ فيه. الدقة الناتجة لا يمكنها استعادة التفاصيل التي كانت مفقودة في المصدر.

هذا كل ما يلزم لجعل الصورة تتحدث: ارفع بورتريه واحدًا، وطابق صوتًا، واضبط الإطار، ثم أنشئ الفيديو. أصبحت صورتك الآن أفاتارًا ناطقًا قابلًا لإعادة الاستخدام يمكنك الرجوع إليه كلما احتجت.

هل أنت مستعد لسير العمل الكامل للنص والصوت والإعدادات والنقاط والتوليد؟ اتبع How to Create an AI Talking Avatar، أو حوّل نصوصًا كاملة إلى فيديوهات الذكاء الاصطناعي على نطاق واسع. أو ابدأ الآن: اصنع أول صورة ناطقة مجانًا.

الأسئلة الشائعة

  • ارفع صورة واضحة للوجه من الأمام إلى أداة الصور الناطقة من VisionStory، ثم اكتب سطرًا قصيرًا لتقوله، واختر الصوت المعيّن أو احتفظ به، ثم انقر Generate Talking Video. ستحصل على فيديو ناطق مع مزامنة شفاه داخل متصفحك خلال دقائق ضمن الخطة المجانية، دون الحاجة لتثبيت أي برنامج.