LivePortrait هو أحد أكثر مشاريع تحريك البورتريه مفتوحة المصدر استخدامًا — نموذج بحثي يأخذ صورة بورتريه ثابتة واحدة ويمنحها الحياة، عبر نقل تعابير الوجه وحركة الرأس من فيديو مُحرِّك إلى الوجه. إذا كنت تراه يُذكر كثيرًا وتريد إجابة واضحة وبسيطة عن ما هو LivePortrait، وكيف تشغّله، وهل يمكنه أن يحل محل أدوات الأفاتار الناطق المستضافة، فهذا الدليل يغطي ذلك. مشروع المصدر: github.com/KwaiVGI/LivePortrait.
ما هو LivePortrait؟
LivePortrait هو إطار عمل فعّال لتحريك البورتريه. عند تزويده بصورة مصدر واحدة لوجه وإشارة تحريك — غالبًا فيديو قصير لشخص يتحرك ويتحدث — فإنه يُنتج فيديو جديدًا تعكس فيه صورة البورتريه الأصلية تلك الحركة، بما في ذلك التعابير الدقيقة وحركة العينين والشفاه. وهو معروف بسرعته وسهولة التحكم به مقارنة بالأساليب الأثقل المعتمدة على الانتشار (diffusion).
النقطة الأهم التي يجب فهمها: LivePortrait أداة للمطورين وليست موقعًا مستضافًا. لا توجد صفحة تسجيل ولا تطبيق متصفح. تقوم بتثبيته محليًا باستخدام Python وتشغّله من سطر الأوامر أو عبر واجهة تجريبية. هذا يجعله مرنًا ومجانيًا للتشغيل، لكنه يعني أيضًا أنك ستحتاج إلى إعداد فعلي وGPU قوي.
كيفية تشغيل LivePortrait
يعمل LivePortrait محليًا، لذا تحتاج إلى بعض المتطلبات قبل أول عملية تحريك.
المتطلبات
- جهاز مزود بـ NVIDIA GPU (التشغيل على CPU فقط ممكن لكنه بطيء).
- Python ومدير حزم مثل conda.
- Git، لنسخ المستودع وتنزيل أوزان النموذج.
الإعداد
- انسخ المستودع من مشروع GitHub الرسمي وثبّت تبعيات Python.
- نزّل الأوزان المُدرَّبة مسبقًا كما هو موصوف في ملف README الخاص بالمشروع.
- شغّل الاستدلال باستخدام بورتريه المصدر وفيديو التحريك لتوليد النتيجة المتحركة، أو شغّل واجهة العرض التجريبية المضمنة.
لأنه مشروع بحثي، توقّع أن تقرأ ملف README وقسم issues في المرة الأولى، وأن تدير بيئتك وتحديثاتك بنفسك.
LivePortrait مقابل أداة أفاتار ناطق مستضافة
LivePortrait وأدوات الأفاتار المستضافة تحل مشكلات مختلفة.
- اختر LivePortrait إذا كنت مرتاحًا للعمل مع Python وGPU، وتريد تحكمًا بمستوى بحثي في التحريك، وتفضّل مسارًا مجانيًا مستضافًا ذاتيًا على السرعة.
- اختر أداة مستضافة إذا كنت تريد فيديو ناطقًا جاهزًا بسرعة، دون أي إعداد. يحوّل VisionStory صورة واحدة مع نص إلى فيديو أفاتار ناطق بمزامنة الشفاه مباشرة في متصفحك خلال دقائق — بدون Python، وبدون GPU، وبدون تسجيل فيديو مُحرِّك.
إذا كان هدفك مقدّمًا يتحدث انطلاقًا من صورة واحدة ونص، فعادةً ما تكون أداة الأفاتار المستضافة هي الطريق الأسرع. شاهد كيف يعمل ذلك في إنشاء فيديو الذكاء الاصطناعي، أو أنشئ بسرعة صورة ناطقة للمقارنة.
تريد فيديو ناطقًا دون تثبيت أي شيء؟ جرّب VisionStory مجانًا — ارفع صورة، واكتب نصًا، واحصل على فيديو أفاتار ناطق قابل للمشاركة خلال دقائق.
