التفاصيل والشرح
شرح وتجربة الاستخدام
إنشاء وتعديل الفيديو بالذكاء الاصطناعي واستبدال الشخصيات داخل المشاهد
تغيرت صناعة المحتوى المرئي بصورة كبيرة خلال فترة قصيرة. فلم يعد الذكاء الاصطناعي مقتصرًا على إنشاء صورة من وصف مكتوب، بل أصبح قادرًا على التعامل مع الفيديو نفسه؛ بدءًا من تحريك صورة ثابتة، ووصولًا إلى إنشاء مشهد جديد أو إعادة تصميم شخصية موجودة داخل فيديو مسجل بالفعل.
ومن أكثر التقنيات إثارة للاهتمام حاليًا ما يعرف باسم AI Character Replacement، حيث يستطيع النظام استخدام صورة لشخصية جديدة مع فيديو مرجعي، ثم محاولة إدخال الشخصية الجديدة داخل المشهد مع المحافظة قدر الإمكان على الحركة والتوقيت وزاوية الكاميرا والإضاءة والخلفية.
هذه الإمكانيات تفتح أبوابًا جديدة أمام صناع المحتوى والمسوقين والمصممين، لكنها في الوقت نفسه تحتاج إلى وعي بالخصوصية وحقوق الأشخاص ومخاطر إنشاء محتوى مضلل.
وفي هذا الدليل من التقنية للعرب نتعرف على طريقة عمل هذه التقنيات، والفرق بين Face Swap واستبدال الشخصية بالكامل، وأفضل طرق إعداد الصور والفيديو للحصول على نتيجة أكثر استقرارًا.
أبرز النقاط
- يمكن للذكاء الاصطناعي إنشاء فيديو انطلاقًا من النص أو الصورة.
- ظهرت نماذج قادرة على نقل حركة فيديو إلى شخصية جديدة.
- Character Replacement أوسع من مجرد تبديل الوجه.
- جودة الصورة المرجعية تؤثر بصورة كبيرة في النتيجة.
- الحركة السريعة والإضاءة الضعيفة قد تسبب أخطاء بصرية.
- الذكاء الاصطناعي لا يحافظ دائمًا على الشخصية بصورة مثالية عبر كل إطار.
- الاستخدام المسؤول وحقوق الأشخاص من أهم الجوانب التي يجب مراعاتها.
- من الأفضل تجربة مقطع قصير قبل معالجة فيديو طويل.
كيف تطورت صناعة الفيديو بالذكاء الاصطناعي؟
بدأت الموجة الحديثة بصورة واضحة مع مولدات الصور.
كان المستخدم يكتب وصفًا مثل:
مدينة مستقبلية ليلًا تحت المطر.
ثم يحصل على صورة جديدة.
بعد ذلك انتقلت التقنية إلى Image to Video، حيث يتم تحويل صورة ثابتة إلى مشهد قصير يحتوي على حركة.
ثم ظهرت Text to Video، وأصبحت النماذج تحاول إنشاء المشهد كاملًا انطلاقًا من وصف نصي.
أما المرحلة الأحدث فتتجه نحو تحرير الفيديو الموجود نفسه.
بدل إنشاء كل شيء من الصفر، يستطيع المستخدم تقديم فيديو مرجعي ثم مطالبة النموذج بالحفاظ على المشهد مع تغيير جزء محدد منه.
وهذا تطور مهم، لأنه يجعل الذكاء الاصطناعي أقرب إلى أداة مونتاج توليدية وليس مجرد مولد للمحتوى.
ما المقصود باستبدال الشخصية داخل الفيديو؟
Character Replacement يعني تغيير الشخص أو الشخصية الرئيسية الموجودة في مقطع مع محاولة الحفاظ على بقية الفيديو.
يمكن مثلًا أن يحتوي الفيديو الأصلي على شخص:
- يمشي.
- يرقص.
- يتحدث.
- يدور حول نفسه.
- يلتقط شيئًا.
ثم يقدم المستخدم صورة لشخصية مختلفة.
يحاول النظام عندها إعادة إنشاء الشخصية الجديدة وهي تؤدي الحركة نفسها تقريبًا داخل المشهد الأصلي.
الهدف هنا هو الاحتفاظ قدر الإمكان بـ:
- توقيت الحركة.
- وضعية الجسم.
- حركة الكاميرا.
- زاوية التصوير.
- الخلفية.
- الإضاءة.
- تسلسل المشهد.
وهذا يختلف عن إنشاء فيديو جديد بالكامل من Prompt.
الفرق بين Face Swap وCharacter Replacement
يتم الخلط بينهما كثيرًا.
Face Swap
يركز بصورة أساسية على الوجه.
الجسم والملابس والشعر وبقية الشخصية الأصلية قد تظل كما هي.
Character Replacement
يحاول تغيير الشخصية بدرجة أكبر.
قد يشمل:
- الوجه.
- الشعر.
- الملابس.
- شكل الجسم.
- الهوية البصرية الكاملة للشخصية.
لذلك Character Replacement أصعب تقنيًا.
النموذج يحتاج إلى جعل الشخصية الجديدة تتوافق مع كل حركة وإطار بدل تغيير منطقة الوجه فقط.
ما هو Motion Transfer؟
هناك تقنية قريبة تسمى Motion Transfer.
في هذه الحالة يكون لديك:
صورة شخصية + فيديو مرجعي للحركة.
يحاول AI استخراج طريقة الحركة من الفيديو ثم تطبيقها على الشخصية الموجودة في الصورة.
مثلًا يمكنك تقديم صورة لشخصية كرتونية وفيديو لشخص يرقص.
ثم يقوم النظام بمحاولة جعل الشخصية الكرتونية تؤدي الحركة نفسها.
وهذه الفكرة تستخدم في:
- الشخصيات الرقمية.
- الرسوم.
- محتوى السوشيال.
- الشخصيات الافتراضية.
- التجارب الفنية.
لماذا الفيديو أصعب من الصور؟
الصورة عبارة عن إطار واحد.
أما الفيديو فقد يحتوي على عشرات الإطارات كل ثانية.
إذا كانت الشخصية تبدو صحيحة في الإطار الأول ثم تغير شكل وجهها أو ملابسها في الإطار التالي، سيلاحظ المشاهد الخطأ فورًا.
ولهذا تواجه نماذج الفيديو تحديًا يعرف باسم:
Temporal Consistency
أي الحفاظ على استقرار العناصر عبر الزمن.
يجب أن تظل الشخصية نفسها متماسكة أثناء:
- الدوران.
- المشي.
- تحريك اليدين.
- تغيير زاوية الوجه.
- تغير الإضاءة.
وهذا أصعب بكثير من توليد صورة ثابتة واحدة.
لماذا تحدث تشوهات في الشخصية؟
يمكن أن تظهر أخطاء عند وجود:
- حركة سريعة جدًا.
- Motion Blur.
- يد تغطي الوجه.
- جسم يمر أمام الشخصية.
- إضاءة ضعيفة.
- أكثر من شخص في المشهد.
- Cut سريع بين اللقطات.
النظام يحتاج إلى فهم مكان الشخصية باستمرار.
وعندما تختفي أجزاء مهمة منها مؤقتًا، قد يضطر إلى تخمين شكلها.
ولهذا يمكن أن ترى أحيانًا:
- تغيرًا في الوجه.
- اختلافًا في الملابس.
- أصابع غير طبيعية.
- Flickering.
- تغيرًا في الشعر.
هذه المشكلات تتحسن باستمرار لكنها لم تختف تمامًا.
أهمية الصورة المرجعية
إذا كنت تريد وضع شخصية جديدة داخل الفيديو، فالصورة التي تستخدمها كمرجع تلعب دورًا أساسيًا.
يفضل أن تكون:
- واضحة.
- جيدة الإضاءة.
- عالية الدقة نسبيًا.
- الشخصية ظاهرة فيها بوضوح.
- غير مغطاة بعناصر أخرى.
إذا كنت تريد استبدال الجسم بالكامل، فمن المفيد أن تظهر الشخصية بصورة تسمح للنموذج بفهم الملابس وبنية الجسم.
أما صورة الوجه المقربة فقط فقد تكون أقل مناسبة لبعض أدوات Full Character Replacement.
تحسين الصورة قبل استخدامها
إذا كانت الصورة المرجعية منخفضة الجودة، فقد تنتقل مشكلاتها إلى الفيديو الناتج.
يمكن قبل البدء تحسين وضوح الصورة وتقليل التشويش.
ويوجد على التقنية للعرب مقال فعلي تم التحقق منه عن **تحسين جودة الصور بالذكاء الاصطناعي ورفع الدقة** يشرح Image Enhancement وUpscaling والفرق بين زيادة حجم الصورة واستعادة أو توليد التفاصيل.
لكن تجنب المبالغة في تحسين الوجه.
إذا أصبحت الصورة شديدة التنعيم أو تغيرت ملامح الشخص، فقد يحصل نموذج الفيديو على مرجع غير دقيق.
تحريك الصور الثابتة
لا تحتاج دائمًا إلى فيديو يحتوي على شخصية تريد استبدالها.
يمكن بدء العمل من صورة واحدة.
قد يطلب المستخدم من النظام:
- جعل الشخصية تمشي.
- تحريك الرأس.
- جعل الشعر يتحرك.
- تغيير تعبير الوجه.
- تحريك الكاميرا.
ثم يقوم AI بإنشاء إطارات جديدة لبناء الحركة.
هذه الطريقة مفيدة لإنشاء فيديو قصير من:
- صورة شخصية.
- تصميم.
- شخصية لعبة.
- Artwork.
- صورة منتج.
لكن كلما زادت الحركة المطلوبة، زادت احتمالية ظهور اختلافات عن الصورة الأصلية.
إنشاء فيديو من النص
Text to Video لا يحتاج إلى فيديو أو صورة بالضرورة.
يمكن كتابة Prompt يصف:
- الشخصية.
- المكان.
- الحدث.
- حركة الكاميرا.
- الإضاءة.
- الجو العام.
مثل:
شاب يسير في شارع مستقبلي ليلًا تحت أضواء النيون بينما تتحرك الكاميرا خلفه ببطء.
يحاول النظام بعدها إنشاء المشهد.
لكن كتابة Prompt جيد لا تعني إضافة أكبر عدد ممكن من الكلمات.
الأفضل تحديد العناصر التي تؤثر فعلًا في المشهد.
كتابة Prompt أفضل للفيديو
Prompt الفيديو يحتاج إلى شيء لا يحتاجه Prompt الصورة بنفس الدرجة:
الحركة.
بدل:
رجل في الصحراء.
يمكن أن تقول:
رجل يسير ببطء فوق كثبان رملية عند الغروب، الرياح تحرك ملابسه، والكاميرا تتراجع أمامه في لقطة سينمائية واسعة.
أضفت هنا:
- حركة الشخصية.
- حركة البيئة.
- حركة الكاميرا.
- الإضاءة.
- نوع اللقطة.
وهذا يعطي النموذج سياقًا أفضل.
ويمكنك الاستفادة كذلك من مقال **100 كود في ChatGPT** على التقنية للعرب لتعلم كيفية بناء تعليمات أوضح للذكاء الاصطناعي في الكتابة وصناعة المحتوى وتحسين الـPrompts.
الحفاظ على حركة الكاميرا
إحدى مزايا تحرير فيديو موجود بدل إنشائه من الصفر أن المصدر يحتوي بالفعل على Camera Motion.
قد يحتوي الفيديو على:
- Zoom.
- Pan.
- Dolly.
- Tracking Shot.
- Handheld Motion.
عندما يعمل نموذج Character Replacement بصورة جيدة، فإنه يحاول الاحتفاظ بهذه الحركة بدل بناء كاميرا جديدة.
وهذا يساعد على بقاء إحساس المشهد الأصلي.
مطابقة الإضاءة
إذا كانت الشخصية الجديدة مضاءة من اتجاه بينما يأتي الضوء في الفيديو الأصلي من اتجاه آخر، سيبدو الدمج غير طبيعي.
لذلك تحاول النماذج الحديثة تقدير:
- اتجاه الضوء.
- شدته.
- لون الإضاءة.
- الظلال.
- انعكاسات البيئة.
ثم تعيد Rendering للشخصية بطريقة أقرب إلى المشهد.
لكن اللقطات ذات الإضاءة المعقدة أو المتغيرة بسرعة لا تزال أكثر صعوبة.
استبدال الشخصيات في الإعلانات
يمكن لهذه التقنية أن تكون مفيدة في إنتاج نسخ مختلفة من إعلان واحد.
مثلًا قد تقوم علامة تجارية بإنشاء مشهد أساسي، ثم إنتاج نسخ مختلفة منه بشخصيات أو Avatars متنوعة.
لكن يجب امتلاك الحقوق والموافقات اللازمة للصور والفيديوهات.
ولا ينبغي استخدام صورة شخص حقيقي لإدخاله في إعلان دون إذنه.
وجود القدرة التقنية على تنفيذ التعديل لا يعني امتلاك الحق القانوني في استخدام الصورة.
استخدام التقنية في السينما
من الناحية الإبداعية، تفتح هذه الأدوات فرصًا كبيرة في مرحلة Previsualization.
يمكن لصانع الفيلم تجربة:
- شخصية مختلفة.
- Costume مختلف.
- تصور أولي للمشهد.
- شخصية رقمية.
قبل تنفيذ تصوير مكلف.
لكن الحديث عن أنها تلغي إعادة التصوير أو المؤثرات الاحترافية بالكامل مبالغ فيه.
في الإنتاجات الكبيرة قد تظل الحاجة موجودة إلى:
- VFX.
- Rotoscoping.
- Compositing.
- Color Grading.
- مراجعة بشرية دقيقة.
AI يسرع بعض الخطوات لكنه لا يحل كل الحالات.
محتوى السوشيال ميديا
صناع المحتوى من أكثر الفئات التي يمكنها الاستفادة من هذه الأدوات.
يمكن إنشاء:
- فيديوهات خيالية.
- شخصيات افتراضية.
- مقاطع فنية.
- Memes مرئية.
- مشاهد قصيرة.
لكن من المهم عدم تقديم محتوى مولد يوحي بأن شخصًا حقيقيًا فعل أو قال شيئًا لم يحدث.
الشفافية مهمة خصوصًا في المحتوى الواقعي.
Deepfake والاستخدام المسؤول
تقنية تغيير الأشخاص في الفيديو يمكن استخدامها بطريقة إبداعية، لكنها أيضًا يمكن أن تدخل في مجال Deepfake.
الخطر يظهر عندما يستخدم الفيديو في:
- انتحال شخص.
- الاحتيال.
- التشهير.
- إنشاء محتوى جنسي أو مسيء دون موافقة.
- الادعاء أن شخصية عامة قالت شيئًا لم تقله.
ولهذا يجب استخدام هذه الأدوات بموافقة أصحاب الصور، وتوضيح أن المشهد مولد أو معدل عندما يكون ذلك ضروريًا لمنع التضليل.
لا تستخدم صورة شخص دون إذنه
إذا أردت تجربة Character Replacement، فإن أفضل الخيارات هي:
- صورتك أنت.
- شخصية صممتها.
- Avatar تملك حقوقه.
- شخص منحك موافقة واضحة.
خصوصًا إذا كان الناتج سيتم نشره علنًا أو استخدامه تجاريًا.
جودة التصدير تختلف حسب المنصة
لا تفترض أن كل أداة تدعم 4K.
بعض الخدمات تنتج:
- 480p.
- 720p.
- 1080p.
بينما قد توفر خدمات أخرى دقات أعلى أو أدوات Upscaling بعد عملية التوليد.
وغالبًا ترتبط الجودة الأعلى بعدد أكبر من Credits أو بخطة مدفوعة.
راجع إعدادات الخدمة التي تستخدمها قبل بدء مشروع كبير.
ابدأ بمقطع قصير
هذه من أهم النصائح العملية.
قبل معالجة فيديو مدته دقيقة كاملة، جرّب لقطة من عدة ثوانٍ.
ستعرف سريعًا:
- هل الشخصية مستقرة؟
- هل الوجه مناسب؟
- هل الحركة جيدة؟
- هل الملابس تتغير؟
- هل الخلفية سليمة؟
إذا كانت النتيجة سيئة في مقطع قصير فلن يفيد إهدار Credits على فيديو طويل.
اختر فيديو مرجعيًا واضحًا
للحصول على نتيجة أفضل، حاول استخدام فيديو:
- الشخصية واضحة فيه.
- الإضاءة جيدة.
- لا يحتوي على Cuts كثيرة.
- الحركة ليست عنيفة جدًا.
- لا يوجد أشخاص يعبرون أمام الشخصية باستمرار.
كلما كان المشهد أبسط، أصبحت مهمة النموذج أسهل.
لا ترفع فيديوهات حساسة بلا مراجعة الخصوصية
منصات AI تعمل غالبًا عبر خوادم سحابية.
عندما ترفع صورة وجه أو فيديو شخصي، يتم إرسال الملف للخدمة لمعالجته.
لذلك راجع:
- مدة الاحتفاظ بالملفات.
- سياسة التدريب.
- إمكانية حذف البيانات.
- شروط مشاركة الملفات.
- الاستخدام التجاري.
ولا ترفع فيديوهات خاصة أو سرية إلى خدمة لا تعرف طريقة تعاملها مع البيانات.
هل يمكن الاعتماد عليها بدل المونتاج؟
ليس تمامًا.
AI Video Generation وCharacter Replacement أدوات إضافية في صندوق أدوات صانع المحتوى.
لكن عملية الإنتاج قد تظل تحتاج إلى:
- قص.
- موسيقى.
- Mix للصوت.
- Captions.
- Color Correction.
- Titles.
- ترتيب اللقطات.
الذكاء الاصطناعي يغير طريقة تنفيذ بعض الخطوات ولا يلغي مفهوم المونتاج نفسه.
Workflow عملي
يمكن اتباع سير عمل بسيط:
- حدد فكرة الفيديو.
- اختر الفيديو المرجعي.
- جهز صورة الشخصية.
- حسن الصورة إذا كانت منخفضة الجودة.
- جرّب مقطعًا قصيرًا.
- راجع الوجه والحركة.
- عدل المرجع أو الإعدادات عند الحاجة.
- عالج الفيديو النهائي.
- راجع الإطارات بحثًا عن أخطاء.
- نفذ المونتاج والصوت.
- وضح أن المحتوى معدل عندما يكون ذلك ضروريًا.
- احتفظ بالنسخ الأصلية.
لمن تناسب هذه التقنية؟
صانع المحتوى
لإنتاج فيديوهات إبداعية وتجارب بصرية جديدة.
المسوق
لإنشاء نسخ متعددة من المواد الإعلانية.
المصمم
لتحريك الشخصيات والتصميمات الثابتة.
صانع الأفلام
لإنشاء Concepts وPrevisualization.
صاحب مشروع
لإنتاج محتوى مرئي أسرع دون جلسة تصوير لكل فكرة.
الفنان الرقمي
لتحويل رسومات الشخصيات إلى مشاهد متحركة.
أسئلة شائعة
هل يمكن تغيير شخص كامل داخل الفيديو؟
نعم، توجد نماذج حديثة تحاول استبدال الشخصية كاملة بدل تغيير الوجه فقط، مع المحافظة على حركة المشهد قدر الإمكان.
هل تحافظ على الحركة الأصلية؟
يمكنها استخدام الحركة والتوقيت من الفيديو المرجعي، لكن الأخطاء ما زالت ممكنة في المشاهد الصعبة.
هل يمكن تحريك صورة واحدة؟
نعم، Image to Video وMotion Transfer يسمحان باستخدام صورة ثابتة كنقطة بداية للحركة.
هل النتيجة واقعية دائمًا؟
لا. تعتمد على جودة النموذج والصورة والفيديو والحركة والإضاءة.
هل يمكن استخدام أي صورة لشخص؟
تقنيًا قد تسمح الأداة بذلك، لكن يجب احترام الخصوصية وحقوق الشخص والحصول على الموافقة عند الحاجة.
هل تدعم جميع المنصات 4K؟
لا. الدقة المتاحة تختلف حسب الأداة والخطة والنموذج.
الخلاصة
انتقل الذكاء الاصطناعي في مجال الفيديو من مجرد إنشاء لقطات قصيرة إلى مرحلة أكثر تقدمًا تسمح بتحرير عناصر موجودة داخل المشهد نفسه.
ومن أبرز التطورات الحالية القدرة على استبدال الشخصية باستخدام صورة مرجعية مع محاولة المحافظة على الحركة والتوقيت والإضاءة وحركة الكاميرا والخلفية الأصلية.
هذه التقنية يمكن أن تختصر وقتًا كبيرًا في صناعة المحتوى والإعلانات والتجارب الفنية، لكنها لم تصل إلى درجة تجعل النتائج مثالية في كل مرة.
وتظل جودة الملفات الأصلية، واختيار المرجع المناسب، والمراجعة البشرية عوامل أساسية للحصول على نتيجة جيدة.
كما يؤكد التقنية للعرب أن استخدام أدوات تغيير الشخصيات يجب أن يكون مسؤولًا ويحترم موافقة الأشخاص وحقوق الصور، وألا يُستخدم لإنشاء محتوى مضلل أو انتحال هوية الآخرين.
أما اسم المنصة المقصودة في المسودة الأصلية فلم يُذكر، لذلك تعمدنا عدم نسب هذه الخصائص إلى خدمة بعينها دون مصدر واضح.

سيب تقييمك عن التطبيق
اكتب رأيك واختار تقييم من نجمة إلى خمس نجوم، وهيتسجل كتقييم على تدوينة WordPress دي.
التقييمات مغلقة حاليًا لهذه التدوينة.