SceneMixer
العربية
سجّل مجاناً

مشاهد الذكاء الاصطناعي متعددة الشخصيات

مولد مشاهد الذكاء الاصطناعي متعددة الشخصيات

تم التحديث في 20 سبتمبر 2026

إجابة سريعة: كل لقطة تحمل قائمة صريحة بمن يظهر داخل الإطار، وهذه القائمة هي الشيء الوحيد الذي يربط صور الشخصيات — لذا فإن أي شخص يُنظر إليه أو يُتحدث معه يُكتب كتوجيه بدلاً من اسم، ولا يظهر أبدًا على الشاشة بوجه مُختلق. فقط فم المتحدث المذكور اسمه يتحرك. الحشود الخلفية هي حالة معلنة للمشهد أو تكون غائبة. وعند تجاوز أربعة أشخاص مذكورين بالاسم في إطار واحد، تغطي القائمة المشهد بلقطات منفردة بدلاً من ذلك.
لقطة من “ضربة قاضية في مدينة الصدأ”، مسلسل قصير بالذكاء الاصطناعي أُنتج بالكامل بواسطة SceneMixer (6 شخصية، 1 حلقة)
عينة: “ضربة قاضية في مدينة الصدأ” — أنمي بأسلوب الرسم الزيتي، 1 حلقة، أُنتج بالكامل بواسطة SceneMixer من السيناريو · مشاهدة الحلقات

الجزء الصعب هو من يظهر في الإطار، ليس العدد

يعاني الفيديو المُولَّد من فشل محدد عند وجود أكثر من شخص في لقطة: سيضع وجهًا لا ينبغي أن يكون هناك. أي شخص مذكور في النص — يُنظر إليه، يُصرخ في اتجاهه، يُفكر فيه — يظهر على الشاشة بوجه مُختلق فورًا، لأن لا شيء يخبر النموذج بالفرق بين "موجود" و"مذكور فقط".

لذا تحدد قائمة اللقطات ذلك لكل لقطة. كل لقطة تحمل قائمة صريحة بالشخصيات الموجودة في الإطار، وهذه القائمة — وليس النص، وليس الحالة النهائية للقطة السابقة — هي الشيء الوحيد الذي يقرر أي صور مرجعية للشخصيات سيتم ربطها.

نظرة سريعة

كيف يتم تحديد لقطة متعددة الشخصيات
من يظهر في الإطارقائمة لكل لقطة. يحدد اتحاد اللقطات داخل المقطع أي الصفحات المرجعية يتم إرسالها معه.
من هو خارج الشاشةيُكتب كتوجيه — "باتجاه يسار الإطار"، "نظر نحو الكاميرا" — وليس كاسم. لا يتم ربط أي وجه به.
لقطات شخص واحديتم تمييزها صراحة، بحيث يُخبر المُصيِّر أن الإطار يحتوي على شخص واحد ولا يختلق شخصيات إضافية.
من يتحدثيُذكر بالاسم لكل سطر؛ ويتم تحديد باقي الأشخاص في الإطار على أن شفاههم مغلقة، بحيث يتحرك فم المتحدث فقط.
الحشد الخلفيحالة معلنة للمشهد، تُكتب مرة واحدة في رأس المقطع، أو تكون غائبة — ولا تُستنتج أبدًا من الصوت المحيط.
الحد العمليأربعة أشخاص مذكورين بالاسم في إطار واحد هي النقطة التي تبدأ بعدها الجودة في الانخفاض. تتعامل قائمة اللقطات مع هذا الأمر بالالتفاف حوله بدلاً من اختراقه.

لماذا تسمية شخص خارج الشاشة يفسد اللقطة

هذا أمر قابل للقياس، ليس نظريًا. اللقطات التي ذكرت اسم خصم خارج الشاشة أنتجت وجهًا خاطئًا أو شخصًا إضافيًا في خمسة من أصل ثمانية عمليات تصيير. نفس اللقطات بعد إعادة كتابتها لتقديم توجيه بدلاً من اسم أنتجت صفرًا من هذه الإخفاقات في اثني عشر عملية تصيير. لذا تعيد سير العمل كتابتها: في لقطة شخص واحد، أي شخصية موجودة فقط كاتجاه نظر أو اتجاه حركة تُحوَّل إلى عبارة مكانية وتُزال من قائمة الإطار.

ينطبق نفس المنطق على الموتى: أي شخصية يُشار إليها فقط كجثة في هذا المقطع تُكتب كاسم عادي، وليس كمرجع لشخصية، لذا لا يربط أحد صفحتها المرجعية ولا يقوم بإظهارها واقفة.

شخصان يواجهان بعضهما

هناك طريقتان فقط لتصوير ذلك، والقائمة مطلوبة لاختيار إحداهما: لقطة جانبية لشخصين، أو لقطة من فوق الكتف. ما لا يجوز كتابته هو "أ يواجه ب، مع وجود ب في الخلفية خارج نطاق التركيز" — لكي يكون ب في عمق مجال أ، يجب أن يكون أ ظهره تجاه ب، وموضع الكاميرا هذا غير موجود في لقطة متوسطة عادية. وإن طُلب ذلك على أي حال، سيضع المُصيِّر شخصًا مواجهًا للكاميرا والآخر واقفًا خلفه. يتم تحديد المحور في أول لقطة يظهر فيها كليهما معًا داخل الإطار فعليًا.

الحشود إما معلنة أو غائبة

غرفة بها ثلاثمائة ضيف هي حالة مرئية للمشهد، لذا تُكتب كذلك — سطر في رأس المقطع يذكر من هم الأشخاص في الخلفية، وأين هم، وماذا يفعلون. ويكون ذلك ثابتًا عبر جميع مقاطع هذا المشهد. وبدون هذا السطر، لا يجوز للقطة الإشارة إلى حشد على الإطلاق، لأن "همهمة الضيوف" في الصوت المحيط ليست تعليمًا بصريًا، والمُصيِّر الذي يُعطى هذه المعلومة فقط سيعطيك ضيوفًا في لقطة وقاعة فارغة في اللقطة التالية.

عند الإعلان عن حشد، يتغير تعليم الإطار معه: يبقى الحشد في عمق المجال، ولا تزال قائمة من في الإطار تحسب الشخصيات المسماة فقط.

ما لن يفعله

التكلفة

لا تكلفة إضافية — هذه خصائص قائمة اللقطات، التي تُحاسب حسب طول النص بواقع 1 credit لكل مائة حرف من نصيب الحلقة. الصفحات المرجعية تكلف 7 credits لكل صفحة بعد 15 صفحات مجانية في مشروعك الأول، ويبدأ التصيير من 10 credits لكل ثانية من المخرجات. راجع اتساق الشخصيات لمعرفة كيف تظل الوجوه متطابقة عبر اللقطات، وصفحة التسعير للأسعار.

اللغات

حوار أصلي بـ 15 لغة

كل مسلسل أدناه أُنتج بنفس سير العمل، ويتحدث طاقم الممثلين تلك اللغة بطلاقة أصلية: الواجهة، ومستندات العمل، والسطور المنطوقة كلها بلغة واحدة، ولا يوجد أي دبلجة. افتح أحدها للاستماع.

عرض جميع اللغات البالغ عددها 15

الأسئلة المتداولة

كم شخصية يمكن أن تشترك في لقطة واحدة؟

أربعة أشخاص مسمين هو الحد العملي قبل أن تبدأ الهوية في التدهور، وقائمة اللقطات مصممة للبقاء تحت هذا الحد — تُغطى مشاهد المجموعة بلقطات منفردة ولقطات من فوق الكتف بدلاً من الإطارات الواسعة للمجموعة.

لماذا ظهرت شخصية ذكرتها على الشاشة؟

هذا هو بالضبط الفشل الذي تمنعه قائمة الإطار لكل لقطة. أي شخصية يُنظر إليها أو يُتحدث معها فقط تُكتب كتوجيه، وليس كاسم، ولا تكون في قائمة الإطار — لذا لا يتم ربط أي صورة مرجعية بها ولا يتم اختلاق وجه لها.

هل يمكن لشخصين التحدث وجهاً لوجه؟

نعم، كلقطة جانبية لشخصين أو لقطة من فوق الكتف. ما لا يعمل هو أن يواجه أحدهما الآخر مع وجود الآخر ضبابيًا في الخلفية: هذا المزيج من التأطير والعمق غير متسق فيزيائيًا، وطلبه ينتج عنه شخص واقف خلف شخص آخر يتحدث إلى الكاميرا.

كيف تعمل الشخصيات الإضافية في الخلفية؟

يتم تعريفهم مرة واحدة في رأس المقطع — من هم، وأين، وماذا يفعلون — ويظلون متسقين طوال ذلك المشهد. إذا لم يتم تعريف أي شيء، فلن تشير اللقطة إلى وجود حشد. ضجيج الحشد المحيط وحده لا يُعامل كتعليمات بصرية.

من يحرك فمه؟

المتحدث المسمى لكل سطر فقط. يتم تمييز كل شخص آخر في الإطار صراحةً بشفاه مغلقة، وهذا ما يمنع المستمع من تحريك شفتيه بصمت مع الحوار.

لا أحد في الإطار لم تقم باختياره

أنشئ مشهدًا مزدحمًا واحدًا وعدّ الوجوه.

جرّب SceneMixer مجانًا

باقات الكريديت تبدأ من $1.49 · Pro $7.99/شهريًا · لا حاجة لبطاقة ائتمان للبدء

الأسعار·الأدلة·العينات·الدعم·الخصوصية·الشروط·معلومات قانونية·تواصل معنا·© 2026 SceneMixer