شخصيات متحدثة
تم التحديث في 20 سبتمبر 2026

هناك طريقتان لجعل الشخصية تتحدث على الشاشة. إحداهما هي عرض فيديو صامت ثم تحريك الفم باستخدام مسار صوتي — طريقة مزامنة الشفاه، التي تتطلب قصًا للوجه وملف صوتي محرك، وتنتج وجهًا يتحرك بشكل صحيح وجسدًا لا يؤدي الدور. والأخرى هي إنشاء الصورة والصوت معًا، بحيث يكون الأداء والفم قرارًا واحدًا.
هذا المسار يستخدم الطريقة الثانية. فئة الفيديو الافتراضية سمعية بصرية: يتم إعطاء النموذج السطر، ومن يقوله، وكيف يقال، ومرجع صوتي، فيعيد لقطة يتحدث فيها السطر. لا يتم خياطة أي شيء بعد ذلك.
| السطر | حرفيًا، مرة واحدة. يُنطق تمامًا كما هو مكتوب — لا إعادة صياغة، ولا إعادة توقيت. |
|---|---|
| من يقوله | محدد بالاسم، ومرتبط بمرجع صوت تلك الشخصية بحيث يبدو نفس الشخص بنفس الصوت عبر الحلقات. |
| كيف يقال | توجيه قصير بين قوسين — بهمس، مع استمرار الابتسام، بإلقاء مسطح مجبر. إنه توجيه، وليس ترجمة نصية. |
| من غيره في الإطار | يتم تحديدهم بشفاه مغلقة، حتى لا يحرك المستمعون أفواههم مع الكلام. |
| الكلام خارج الشاشة | يُحدد أولاً في القوس — تعليق صوتي، على الهاتف، عبر جهاز الاتصال الداخلي — ثم يُوصف كل من يظهر بفم مغلق. |
| التوقيت | لا تكون اللقطة التي تحمل حوارًا أقصر مما يحتاجه السطر: ثلاث كلمات في الثانية في الإنجليزية، وخمسة أحرف في الثانية في الصينية. |
يُخصص لكل شخصية صوت من مكتبة أصوات نظام مُنشأة مسبقًا — تستمع إلى عينة من ثلاث إلى ثماني ثوانٍ قبل الاختيار، ويمكنك إعادة المطابقة، أو اختيار صوت مختلف من المحدد، أو رفع تسجيلك الخاص. سبب كونها مطابقة بدلاً من تصميم صوت لكل شخصية هو التكلفة والاستقرار: الأصوات المصممة تنحرف بين عمليات الإنشاء وتكلف لكل شخصية، بينما صوت المكتبة هو نفس الصوت في الحلقة الأولى والحلقة الثانية عشرة.
إذا لم يكن للشخصية صوت مخصص، ترتد اللقطة إلى وصف مكتوب للصوت — العمر، الملمس، الطبقة الصوتية — يفسره النموذج. هذا هو الإعداد الافتراضي للمشاريع الجديدة؛ تخصيص الأصوات هو خطوة مقصودة، وليس شيئًا يحدث بصمت لكل شخصية.
لا يمكن للقطة مدتها أربع ثوانٍ أن تحمل ستة عشر كلمة إنجليزية. إما أن يُسرع الإلقاء حتى يصبح غير مفهوم أو يُقطع السطر. لذا فإن لقطات الحوار لها حد أدنى مشتق من السطر: عدد الكلمات مقسومًا على ثلاثة للإنجليزية، وعدد الأحرف مقسومًا على خمسة للصينية، والأسطر القصيرة تُضاف إليها وقفة بدلاً من ضغطها إلى الحد الأدنى النظري. اللقطات التي تعود أقصر من اللازم لسطرها يتم الإبلاغ عنها وتصحيحها قبل عرض أي شيء — وهو أرخص من اكتشاف ذلك في المخرجات.
لغة الحوار هي إعداد مشروع، تُختار مرة واحدة، وتُطبق حيث تُكتب الأسطر لأول مرة بدلاً من ترجمتها لاحقًا — لذا يُؤلف الأداء بتلك اللغة بدلاً من أن يكون دبلجة. تتوفر خمس عشرة لغة للواجهة والحوار مدعوم عبرها؛ لغتان أحيانًا تخطئان في نطق كلمات فردية على فئة النموذج الافتراضية، ويذكر المحدد ذلك حيث يكون صحيحًا. تغطي صفحة أصوات الشخصيات هذا بالتفصيل.
الكلام مشمول في سعر الفيديو — لا يوجد رسوم صوت منفصلة. يبدأ الفيديو من 10 credits لكل ثانية من المخرجات (≈ $0.06/ثانية على أقل سعر للرصيد) ويصل إلى $0.47/ثانية على الفئة الأعلى دقة؛ التجميع يكلف 1 credit لكل ثانية. مطابقة الصوت من المكتبة مجانية. تحصل الحسابات الجديدة على 50 credits ومعاينة مجانية واحدة تصل إلى 5 ثوانٍ — تكفي لسماع شخصية تتحدث قبل اتخاذ القرار. الأسعار في صفحة التسعير.
اللغات
كل مسلسل أدناه أُنتج بنفس سير العمل، ويتحدث طاقم الممثلين تلك اللغة بطلاقة أصلية: الواجهة، ومستندات العمل، والسطور المنطوقة كلها بلغة واحدة، ولا يوجد أي دبلجة. افتح أحدها للاستماع.
A Carta de LisboaPortuguêsحوار أصلي
윈터 프라미스한국어حوار أصلي
El Secreto de CostaEspañolحوار أصلي
浪人の誓い日本語حوار أصلي
Ikrar JakartaBahasa Indonesiaحوار أصلي
Зимняя коронаРусскийحوار أصلي
L’Héritier du DéfiléFrançaisحوار أصلي
Il Tavolo dell'OlivaItalianoحوار أصلي
De Vuurtoren van de FjordNederlandsحوار أصلي
العهد الصحراويالعربيةبلغتك
Çantasındaki SözleşmeTürkçeحوار أصلي
Die Istanbul-TäuschungDeutschحوار أصلي
Останній сигналУкраїнськаحوار أصلي
問劍青雲繁體中文حوار أصلي
The Last EnvelopeEnglishحوار أصليلا. يتم إنشاء الصورة والكلام معًا في مرحلة واحدة، لذا يكون الفم والأداء نفس القرار. لا يوجد مسار صوتي منفصل تتم مطابقته مع عرض صامت، ولا توجد طريقة لتحريك صورة أو فيديو مرفوع.
يمكنك رفع تسجيل كمرجع صوتي لشخصية. استنساخ صوت شخص آخر غير متوفر.
لا ينبغي لهم ذلك — كل شخصية غير متحدثة في الإطار يتم تحديدها صراحة بشفاه مغلقة، وهو التعليم الذي يمنع المستمع من تحريك فمه مع السطر.
يُكتب علامة خارج الشاشة أولاً في ملاحظة الإلقاء، ثم يُوصف كل من يظهر في اللقطة بفم مغلق — لذا يُسمع السطر دون أن يبدو أن أحدًا يقوله.
لأن السطر يحتاج إلى الوقت. اللقطات التي تحمل حوارًا لها حد أدنى يقارب ثلاث كلمات في الثانية في الإنجليزية، وخمسة أحرف في الثانية في الصينية، مع إضافة وقفة للأسطر القصيرة جدًا. اللقطة الأقصر من اللازم لسطرها تُصحح قبل العرض وليس بعده.
المعاينة المجانية طويلة بما يكفي لسطر واحد من الحوار.
جرّب SceneMixer مجانًاباقات الكريديت تبدأ من $1.49 · Pro $7.99/شهر · لا حاجة لبطاقة ائتمان للبدء
الأسعار·الأدلة·العينات·الدعم·الخصوصية·الشروط·معلومات قانونية·تواصل معنا·© 2026 SceneMixer