مشاهد الذكاء الاصطناعي متعددة الشخصيات
تم التحديث في 20 سبتمبر 2026

يعاني الفيديو المُولَّد من فشل محدد عند وجود أكثر من شخص في لقطة: سيضع وجهًا لا ينبغي أن يكون هناك. أي شخص مذكور في النص — يُنظر إليه، يُصرخ في اتجاهه، يُفكر فيه — يظهر على الشاشة بوجه مُختلق فورًا، لأن لا شيء يخبر النموذج بالفرق بين "موجود" و"مذكور فقط".
لذا تحدد قائمة اللقطات ذلك لكل لقطة. كل لقطة تحمل قائمة صريحة بالشخصيات الموجودة في الإطار، وهذه القائمة — وليس النص، وليس الحالة النهائية للقطة السابقة — هي الشيء الوحيد الذي يقرر أي صور مرجعية للشخصيات سيتم ربطها.
| من يظهر في الإطار | قائمة لكل لقطة. يحدد اتحاد اللقطات داخل المقطع أي الصفحات المرجعية يتم إرسالها معه. |
|---|---|
| من هو خارج الشاشة | يُكتب كتوجيه — "باتجاه يسار الإطار"، "نظر نحو الكاميرا" — وليس كاسم. لا يتم ربط أي وجه به. |
| لقطات شخص واحد | يتم تمييزها صراحة، بحيث يُخبر المُصيِّر أن الإطار يحتوي على شخص واحد ولا يختلق شخصيات إضافية. |
| من يتحدث | يُذكر بالاسم لكل سطر؛ ويتم تحديد باقي الأشخاص في الإطار على أن شفاههم مغلقة، بحيث يتحرك فم المتحدث فقط. |
| الحشد الخلفي | حالة معلنة للمشهد، تُكتب مرة واحدة في رأس المقطع، أو تكون غائبة — ولا تُستنتج أبدًا من الصوت المحيط. |
| الحد العملي | أربعة أشخاص مذكورين بالاسم في إطار واحد هي النقطة التي تبدأ بعدها الجودة في الانخفاض. تتعامل قائمة اللقطات مع هذا الأمر بالالتفاف حوله بدلاً من اختراقه. |
هذا أمر قابل للقياس، ليس نظريًا. اللقطات التي ذكرت اسم خصم خارج الشاشة أنتجت وجهًا خاطئًا أو شخصًا إضافيًا في خمسة من أصل ثمانية عمليات تصيير. نفس اللقطات بعد إعادة كتابتها لتقديم توجيه بدلاً من اسم أنتجت صفرًا من هذه الإخفاقات في اثني عشر عملية تصيير. لذا تعيد سير العمل كتابتها: في لقطة شخص واحد، أي شخصية موجودة فقط كاتجاه نظر أو اتجاه حركة تُحوَّل إلى عبارة مكانية وتُزال من قائمة الإطار.
ينطبق نفس المنطق على الموتى: أي شخصية يُشار إليها فقط كجثة في هذا المقطع تُكتب كاسم عادي، وليس كمرجع لشخصية، لذا لا يربط أحد صفحتها المرجعية ولا يقوم بإظهارها واقفة.
هناك طريقتان فقط لتصوير ذلك، والقائمة مطلوبة لاختيار إحداهما: لقطة جانبية لشخصين، أو لقطة من فوق الكتف. ما لا يجوز كتابته هو "أ يواجه ب، مع وجود ب في الخلفية خارج نطاق التركيز" — لكي يكون ب في عمق مجال أ، يجب أن يكون أ ظهره تجاه ب، وموضع الكاميرا هذا غير موجود في لقطة متوسطة عادية. وإن طُلب ذلك على أي حال، سيضع المُصيِّر شخصًا مواجهًا للكاميرا والآخر واقفًا خلفه. يتم تحديد المحور في أول لقطة يظهر فيها كليهما معًا داخل الإطار فعليًا.
غرفة بها ثلاثمائة ضيف هي حالة مرئية للمشهد، لذا تُكتب كذلك — سطر في رأس المقطع يذكر من هم الأشخاص في الخلفية، وأين هم، وماذا يفعلون. ويكون ذلك ثابتًا عبر جميع مقاطع هذا المشهد. وبدون هذا السطر، لا يجوز للقطة الإشارة إلى حشد على الإطلاق، لأن "همهمة الضيوف" في الصوت المحيط ليست تعليمًا بصريًا، والمُصيِّر الذي يُعطى هذه المعلومة فقط سيعطيك ضيوفًا في لقطة وقاعة فارغة في اللقطة التالية.
عند الإعلان عن حشد، يتغير تعليم الإطار معه: يبقى الحشد في عمق المجال، ولا تزال قائمة من في الإطار تحسب الشخصيات المسماة فقط.
لا تكلفة إضافية — هذه خصائص قائمة اللقطات، التي تُحاسب حسب طول النص بواقع 1 credit لكل مائة حرف من نصيب الحلقة. الصفحات المرجعية تكلف 7 credits لكل صفحة بعد 15 صفحات مجانية في مشروعك الأول، ويبدأ التصيير من 10 credits لكل ثانية من المخرجات. راجع اتساق الشخصيات لمعرفة كيف تظل الوجوه متطابقة عبر اللقطات، وصفحة التسعير للأسعار.
اللغات
كل مسلسل أدناه أُنتج بنفس سير العمل، ويتحدث طاقم الممثلين تلك اللغة بطلاقة أصلية: الواجهة، ومستندات العمل، والسطور المنطوقة كلها بلغة واحدة، ولا يوجد أي دبلجة. افتح أحدها للاستماع.
A Carta de LisboaPortuguêsحوار أصلي
윈터 프라미스한국어حوار أصلي
El Secreto de CostaEspañolحوار أصلي
浪人の誓い日本語حوار أصلي
Ikrar JakartaBahasa Indonesiaحوار أصلي
Зимняя коронаРусскийحوار أصلي
L’Héritier du DéfiléFrançaisحوار أصلي
Il Tavolo dell'OlivaItalianoحوار أصلي
De Vuurtoren van de FjordNederlandsحوار أصلي
العهد الصحراويالعربيةبلغتك
Çantasındaki SözleşmeTürkçeحوار أصلي
Die Istanbul-TäuschungDeutschحوار أصلي
Останній сигналУкраїнськаحوار أصلي
問劍青雲繁體中文حوار أصلي
The Last EnvelopeEnglishحوار أصليأربعة أشخاص مسمين هو الحد العملي قبل أن تبدأ الهوية في التدهور، وقائمة اللقطات مصممة للبقاء تحت هذا الحد — تُغطى مشاهد المجموعة بلقطات منفردة ولقطات من فوق الكتف بدلاً من الإطارات الواسعة للمجموعة.
هذا هو بالضبط الفشل الذي تمنعه قائمة الإطار لكل لقطة. أي شخصية يُنظر إليها أو يُتحدث معها فقط تُكتب كتوجيه، وليس كاسم، ولا تكون في قائمة الإطار — لذا لا يتم ربط أي صورة مرجعية بها ولا يتم اختلاق وجه لها.
نعم، كلقطة جانبية لشخصين أو لقطة من فوق الكتف. ما لا يعمل هو أن يواجه أحدهما الآخر مع وجود الآخر ضبابيًا في الخلفية: هذا المزيج من التأطير والعمق غير متسق فيزيائيًا، وطلبه ينتج عنه شخص واقف خلف شخص آخر يتحدث إلى الكاميرا.
يتم تعريفهم مرة واحدة في رأس المقطع — من هم، وأين، وماذا يفعلون — ويظلون متسقين طوال ذلك المشهد. إذا لم يتم تعريف أي شيء، فلن تشير اللقطة إلى وجود حشد. ضجيج الحشد المحيط وحده لا يُعامل كتعليمات بصرية.
المتحدث المسمى لكل سطر فقط. يتم تمييز كل شخص آخر في الإطار صراحةً بشفاه مغلقة، وهذا ما يمنع المستمع من تحريك شفتيه بصمت مع الحوار.
أنشئ مشهدًا مزدحمًا واحدًا وعدّ الوجوه.
جرّب SceneMixer مجانًاباقات الكريديت تبدأ من $1.49 · Pro $7.99/شهريًا · لا حاجة لبطاقة ائتمان للبدء
الأسعار·الأدلة·العينات·الدعم·الخصوصية·الشروط·معلومات قانونية·تواصل معنا·© 2026 SceneMixer