SceneMixer
العربية
سجّل مجاناً

شخصيات متسقة

مولد فيديو ذكاء اصطناعي بشخصيات متسقة

تم التحديث في 20 سبتمبر 2026

إجابة سريعة: انحراف مظهر الشخصيات هو ما يمنع معظم فيديوهات الذكاء الاصطناعي من أن تصبح مسلسلات: بحلول الحلقة الخامسة، يصبح للبطل فك مختلف ويتوقف الجمهور عن تصديق أنه نفس المسلسل. يعالج SceneMixer هذه المشكلة بأربع آليات — طاقم ممثلين يُولد مرة واحدة كأوراق مرجعية، ولقطات مقصوصة للوجه والجسم مرفقة بكل مقطع يظهر فيه الشخصية، وروابط مرجعية تُربط بالمعرف بدلاً من الاسم، وقاعدة صريحة تمنع ذكر أسماء الأشخاص غير الموجودين في الإطار. أما التغييرات المتعمدة، فتحصل على صورة مرجعية خاصة بها بدلاً من كتابتها في موجه النص.
لقطة من “الأرضية الزجاجية”، مسلسل قصير بالذكاء الاصطناعي أُنتج بالكامل بواسطة SceneMixer (5 شخصية، 1 حلقة)
عينة: “الأرضية الزجاجية” — واقعي عالي الدقة، 1 حلقة، أُنتج بالكامل بواسطة SceneMixer من السيناريو · مشاهدة الحلقات

لماذا تنحرف مظاهر الشخصيات أصلاً

ينشئ نموذج تحويل النص إلى فيديو كل مقطع بشكل مستقل. إذا وصفتَ امرأة في الثلاثينيات من عمرها لديها ندبة عبر أحد حاجبيها في اللقطة الأولى ثم مرة أخرى في اللقطة الثلاثين، ستحصل على امرأتين تطابقان الوصف ولا تتطابقان مع بعضهما — فالصفات لا تكفي لتحديد وجه بدقة. كل حل أدناه يطبق نفس الفكرة في مكان مختلف: توقف عن وصف الشخصية، وأعطِ النموذج صورة لها.

أربعة أقفال

ماذا تفعل كل آلية
الورقة المرجعيةتُولد كل شخصية مرة واحدة كورقة لكامل الجسم بنسبة عرض إلى ارتفاع 9:16 على خلفية بسيطة تحت إضاءة مفتاحية موجهة — إنها صورة اختيار ممثل، وليست لوحة فنية للتعبير عن المزاج، لأن أي إضاءة مدمجة في الورقة ستنتقل إلى كل لقطة تستخدمها.
لقطات مقصوصة مرفقةتُرسل لقطات مقصوصة للوجه والجسم مأخوذة من تلك الورقة مع كل مقطع يظهر فيه الشخصية. فيطابق النموذج الصورة بدلاً من تفسير الوصف.
روابط حسب المعرفتشير لوحات القصة المصورة إلى الأصول بالمعرف، وليس بالاسم. لذا فإن وجود شخصيتين بنفس الاسم، أو إعادة تسمية شخصية في منتصف المشروع، لن يكسر السلسلة بصمت بعد الآن.
قاعدة الشخصيات خارج الإطارالشخصية التي يُنظر إليها فقط، أو يُتحدث إليها، أو يُمد اليد نحوها — ولا تكون موجودة في الإطار — تُكتب كتوجيه إخراجي، ولا تُذكر بالاسم أبداً. لأن تسمية شخصية غائبة هو ما يجعل النموذج يلصق وجهها في لقطة لشخص واحد.

وهناك آلية خامسة أصغر: يحمل كل شخص في اللقطة ملاحظة وجه مميزة واحدة أو اثنتين مأخوذة من وصفه الخاص، مما يخفف من الخطأ الشائع حيث تتبادل شخصيتان يرتديان نفس الزي وجوههما في منتصف اللقطة.

عندما يكون من المفترض أن تتغير الشخصية

لا يمكن أن يعني الاتساق "عدم التغير أبداً" — فالشخصية التي تحترق في الحلقة السادسة يجب أن تبدو محترقة في الحلقة السابعة. يُرسم الخط الفاصل بناءً على كيفية تعامل نموذج الفيديو مع الصورة المرجعية: فهو ينسخ الوجه، والملابس، والشكل والهيكل بشكل شبه حرفي، ويطبق الإضاءة، والطقس، ووقت النهار كتأثيرات مُضافة فوقها.

عكس هذا الترتيب مكلف في كلا الاتجاهين: إنشاء نسخة حالة لـ"إمساك الكوب" هو صورة دفعت ثمنها ولن تراها أبداً، وكتابة موجه لـ"بعد الحريق" هو طلب سيتجاهله النموذج بأدب لصالح الغرفة النظيفة الموجودة في صورته المرجعية.

ما لم يُحل بعد

الشرح متعدد الطبقات، مع ما يمكن لكل طبقة التقاطه وما لا يمكنه، موجود في دليل اتساق الشخصيات.

ما هي التكلفة

الأوراق المرجعية هي بند تكلفة منفصل، منفصل عن تحليل النص (4 credits لكل 3,333 حرف من النص الإنجليزي): يحصل كل حساب على 15 صور مرجعية مجاناً، والصور الإضافية أو المعاد إنشاؤها بعد ذلك تكلف 7 credits لكل صورة على نموذج الصور الافتراضي. تحصل نسخ الحالات على حصة مجانية صغيرة خاصة بها في المشروع الأول، وتُحسب كصور بعد ذلك. يبدأ سعر الفيديو نفسه من 10 credits لكل ثانية من المخرجات (≈ $0.06/ثانية عند أقل سعر للرصيد) سواء كانت المراجع مرفقة أم لا — فالاتساق ليس رسماً إضافياً. التفاصيل في صفحة التسعير.

اختبرها بنفسك على طاقم ممثليك، مجاناً

الاتساق هو الادعاء الوحيد في هذا المجال الذي يجب ألا تصدقه دون تجربة، ولست مضطراً لذلك. يحصل الحساب الجديد على 50 credits، و15 صور مرجعية مجانية تشمل الشخصيات والمشاهد والدعامات، ولوحة قصة مصورة مجانية للحلقة 1 في مشروعك الأول، ومعاينة مجانية واحدة لمدة تصل إلى 5 ثوانٍ تعرض اللقطة الافتتاحية لحلقتك الخاصة بناءً على أوراقك المرجعية. هذا يكفي لإجراء اختبار حقيقي:

  1. الصق مشهداً يظهر فيه نفس الشخصين عدة مرات، بفارق دقائق بين كل ظهور.
  2. دع التحليل يبني طاقم الممثلين، ثم اقرأ أوصاف الشخصيات وأصلح أي خطأ قبل رسم الصور — فالأوراق تُولد من ذلك النص.
  3. ولد الأوراق المرجعية. تستغرق الصورة المرجعية حوالي 16 ثانية في المتوسط، وتنتهي 9 من كل 10 صور خلال 27 ثانية، لذا فإن طاقماً مكوناً من خمسة أشخاص يستغرق بضع دقائق.
  4. استخدم المعاينة المجانية على لقطة تقوم فيها الشخصية بفعل ما، لا تقف ساكناً، وقارن الوجه بالورقة المرجعية.

للمعايرة: يحتوي المشروع المتوسط على هذه المنصة على خمس شخصيات مسماة، وتسعة من كل عشرة مشاريع لديها أقل من عشر شخصيات. إذا احتاجت قصتك إلى ثلاثين شخصية، فستنطبق نفس الآلية — التكلفة هي في الأوراق المرجعية، وليس في الاتساق.

كل حلقة، بخمس عشرة لغة

يتم ضبط لغة الحوار مرة واحدة في الخطوة 1، ويتم تنفيذ عملية الإنشاء كاملة بهذه اللغة، بينما يقوم إعداد المنطقة المستهدفة بتكييف الأسماء والوجوه والشوارع لتناسب ذلك السوق في نفس الوقت. تم إنتاج كل عينة أدناه بهذه الطريقة، عينة واحدة لكل لغة.

اللغات

حوار أصلي بـ 15 لغة

كل مسلسل أدناه أُنتج بنفس سير العمل، ويتحدث طاقم الممثلين تلك اللغة بطلاقة أصلية: الواجهة، ومستندات العمل، والسطور المنطوقة كلها بلغة واحدة، ولا يوجد أي دبلجة. افتح أحدها للاستماع.

عرض جميع اللغات البالغ عددها 15

الأسئلة الشائعة

ما مدى ثبات المظهر حقًا؟

الهدف التصميمي هو الحفاظ على نفس الوجه عبر المسلسل بأكمله، وهذا ما توفره بنية أوراق المرجع للشخصيات الموجودة في مكتبة الأصول الخاصة بك. هذا ليس ضمانًا على كل إطار: فالشخصيات التي ترتدي ملابس متطابقة وتظهر في نفس اللقطة، والشخصيات التي يغطي المعطف معظم ورقة المرجع الخاصة بهم، تظل هي الحالات الصعبة. أما كل شيء آخر — عدد الحلقات، والوقت المنقضي، وعدد اللقطات التي يظهر فيها الشخصية — فلا يؤدي إلى تدهور الثبات، لأن كل لقطة تتم مطابقتها مع نفس الصورة.

هل يمكنني رفع صورة شخصية خاصة بي بدلاً من إنشاء واحدة؟

نعم. يمكن استبدال أي ورقة مرجع بصورة ترفعها أنت، وستتعامل معها بقية مسار العمل تمامًا مثل الصورة المُنشأة. هذا هو المسار الصحيح لشخصية قمت بتصميمها مسبقًا في مكان آخر.

هل يعمل هذا مع وجه شخص حقيقي؟

من الناحية التقنية، لا يهتم مسار الرفع بمحتوى الصورة، لكن نشر فيديو ذكاء اصطناعي يحاكي مظهر شخص حقيقي يعد مشكلة قانونية في معظم الأسواق، ويتعامل دليل الامتثال لدينا مع الأمر على هذا النحو. نحن لا نوفر أداة لتبديل الوجوه، ولا نوصي باستخدامها.

ماذا يحدث إذا قمت بإعادة تسمية شخصية في منتصف المشروع؟

لن يتعطل أي شيء. تشير القصص المصورة إلى الأصول بواسطة المعرف، ويتم نشر إعادة التسمية عبر النص المخزن في نفس الوقت. قبل سبتمبر 2026، كانت المراجع تتم مطابقتها بالاسم، وهذا هو بالضبط العطل الذي أزاله هذا التغيير.

هل الحفاظ على ثبات مظهر الشخصية يكلف رسومًا إضافية لكل لقطة؟

لا. إن إرفاق صور المرجع بالمقطع لا يغير السعر لكل ثانية — أنت تدفع مرة واحدة مقابل كل ورقة مرجع، ثم لا تدفع أي شيء إضافي بغض النظر عن عدد اللقطات التي تستخدمها. الثبات هنا هو جزء من البنية، وليس خدمة إضافية للبيع.

هل يجب علي إعادة وصف الشخصية في كل لقطة؟

لا، ولا ينبغي لك ذلك. يذكر نص اللقطة اسم الشخصية؛ وتحمل صورة المرجع مظهره. إن تكرار الوصف المادي في نص اللقطة يدفع النموذج للرجوع إلى الكلمات والابتعاد عن الصورة، وهذا هو بالضبط الانحراف الذي يزيله هذا التصميم.

هل يمكن لشخصية واحدة أن تمتلك مظهرين في نفس الحلقة؟

نعم — هذا هو الغرض من متغيرات الحالة. كل مظهر له صورة مرجع خاصة به، ويحدد القصص المصورة لكل مقطع أيهما ينطبق، وصولاً إلى المقطع الفردي بدلاً من الحلقة بأكملها.

نفس الوجه في الحلقة 1 والحلقة 40

أنشئ طاقم الشخصيات مرة واحدة؛ وكل لقطة بعد ذلك تطابق صورة، لا وصفًا نصيًا.

جرّب SceneMixer مجانًا

باقات الاعتمادات تبدأ من $1.49 · Pro $7.99/شهريًا · لا حاجة لبطاقة ائتمان للبدء

الأسعار·الأدلة·العينات·الدعم·الخصوصية·الشروط·معلومات قانونية·تواصل معنا·© 2026 SceneMixer