المصدر المفتوح

مشاريع فيديو الذكاء الاصطناعي والأفاتار مفتوحة المصدر

أدلة مبسّطة تشرح نماذج وأدوات الذكاء الاصطناعي مفتوحة المصدر التي تقف خلف الأفاتارات الناطقة وتوليد الفيديو والصوت — ما الذي تفعله، وكيف تشغّلها، ومتى تكون الأداة المستضافة أسرع.

OpenMontage: شرح وكيل فيديو الذكاء الاصطناعي مفتوح المصدر

OpenMontage: شرح وكيل فيديو الذكاء الاصطناعي مفتوح المصدر

دليل عملي إلى OpenMontage، وكيل فيديو الذكاء الاصطناعي مفتوح المصدر الذي يحوّل مساعدك للبرمجة بالذكاء الاصطناعي إلى استوديو فيديو متكامل — ماذا يفعل، وكيف تُعدّه، وما تكلفته، ومتى تكون أداة مستضافة مثل VisionStory هي الخيار الأسرع.

LongCat-Video-Avatar 1.5: قمنا بتشغيل نموذج فيديو الأفاتار المتحدث مفتوح المصدر

LongCat-Video-Avatar 1.5: قمنا بتشغيل نموذج فيديو الأفاتار المتحدث مفتوح المصدر

تفكيك عملي ومفصّل لـ LongCat-Video-Avatar 1.5، وهو نموذج Meituan مفتوح المصدر بترخيص MIT يحوّل صورة مع صوت إلى فيديو أفاتار متحدث. شغّلنا المهام الثلاث كلها على معالج رسومي A800، وقسنا السرعة الفعلية وذاكرة VRAM، وواجهنا 5 عوائق في الإعداد، ونوضح بصراحة متى تكون الاستضافة الذاتية خيارًا منطقيًا ومتى تتفوق الأدوات المستضافة.

Kokoro TTS: شغّلنا نموذج الصوت مفتوح المصدر بحجم 82M على معالج لابتوب

Kokoro TTS: شغّلنا نموذج الصوت مفتوح المصدر بحجم 82M على معالج لابتوب

تفكيك عملي لنموذج Kokoro مفتوح المصدر لتحويل النص إلى كلام، والمكوّن من 82 مليون مُعلَمة. شغّلناه على معالج Apple M3 Pro، وأنشأنا عينات صوتية حقيقية يمكنك تشغيلها، وواجهنا خطأ حزم espeak-ng (وقمنا بإصلاحه)، ونوضح بصراحة متى يكون Kokoro كافيًا ومتى تحتاج إلى أداة فيديو متحدث مستضافة.

LivePortrait: شرح نموذج تحريك الصور الشخصية مفتوح المصدر

LivePortrait: شرح نموذج تحريك الصور الشخصية مفتوح المصدر

دليل عملي إلى LivePortrait، نموذج الذكاء الاصطناعي مفتوح المصدر الذي يحرّك صورة شخصية ثابتة اعتمادًا على فيديو أو صوت مُوجِّه — ماذا يفعل، وكيف تشغّله، ومتى تكون أداة أفاتار ناطق مستضافة مثل VisionStory الخيار الأسرع.