SceneMixer
العربية
سجّل مجاناً

أصوات الشخصيات بالذكاء الاصطناعي

أصوات الشخصيات بالذكاء الاصطناعي

تم التحديث في 16 سبتمبر 2026

إجابة سريعة: في SceneMixer لا تتم دبلجة الخط المنطوق لاحقًا — نموذج الفيديو يولد الصورة والكلام معًا، لذا فإن فم الشخصية وخطها يأتيان من نفس عملية التوليد. ما تتحكم فيه هو أي صوت: كل شخصية تحمل إما وصفًا مكتوبًا للنبرة وطريقة الإلقاء، أو عينة مطابقة من مكتبة أصوات مسبقة الضبط، أو عينة ترفعها بنفسك. ما لا نقدمه هو طريقة لاستنساخ صوت لا تملكه.
لقطة من “دين النيون”، مسلسل قصير بالذكاء الاصطناعي أُنتج بالكامل بواسطة SceneMixer (7 شخصية، 1 حلقة)
عينة: “دين النيون” — واقعية محرك الألعاب، 1 حلقة، أُنتج بالكامل بواسطة SceneMixer من السيناريو · مشاهدة الحلقات

من أين يأتي الصوت فعليًا

تتعامل معظم سير عمل فيديو الذكاء الاصطناعي مع الصوت كمهمة ثانية: توليد لقطات صامتة، ثم توليف الخطوط، ثم محاربة مشكلة مزامنة الشفاه. نماذج الفيديو هنا تولد الصوت والصورة في عملية واحدة، مما يزيل هذه المشكلة لكنه يغير معنى "إعداد الصوت". إنه ليس محرك نص إلى كلام تغذيه بالنص — بل هو مرجع تُبنى عليه عملية التوليد.

ثلاث طرق يمكن للشخصية أن تحمل بها صوتًا
وصف مكتوبالعمر، النبرة، الثقل، طريقة الإلقاء — تُولد من النص مع كل شيء آخر عن الشخصية، ويؤديها نموذج الفيديو.
صوت مسبق مطابقصوت يتم اختياره من مكتبة أصوات النظام، كل منها يحتوي على عينة صوتية قصيرة يمكنك الاستماع إليها. يقترح استدعاء نموذج واحد مطابقة لكل شخصية حسب الجنس واللغة والعمر؛ يمكنك إعادة المطابقة أو اختيار صوت آخر يدويًا.
عينتك الخاصةارفع صوتًا لشخصية ما فيصبح هذا الصوت هو المرجع لتلك الشخصية في كل مقطع تتحدث فيه.

أيًا كان الصوت المرفق يُستخدم بشكل ثابت: تتحدث نفس الشخصية بنفس الصوت عبر كل مقطع وكل حلقة، لنفس السبب الذي يجعل وجهها يبقى كما هو — المرجع ينتقل معها.

ما لن نفعله، ولماذا

لا توجد أداة هنا لاستنساخ صوت من تسجيل لشخص آخر. هذا نقص متعمد، وليس عنصرًا في خارطة الطريق: نشر أداء اصطناعي لصوت شخص حقيقي يمثل مشكلة تتعلق بالتشابه الشخصي في معظم الأسواق التي نخدمها، والمنتج الذي يجعل ذلك ممكنًا بنقرة واحدة هو منتج يجعله أمرًا روتينيًا. تعامل قائمة التحقق الخاصة بالامتثال لدينا التشابه الشخصي — سواء في الوجه أو الصوت — كشيء يجب أن تمتلك الحق في استخدامه قبل النشر.

شيئان ينتجان عن ذلك، يجدر ذكرهما بوضوح:

اللغة إعداد منفصل

يتم اختيار لغة الحوار في الخطوة 1 وتنطبق على المشروع بأكمله: تُكتب الخطوط بتلك اللغة في مرحلة التحليل، وتُنسخ حرفيًا إلى لوحة القصص، وتُؤدى بها. هذه ليست عملية دبلجة فوق أصل إنجليزي — لا يوجد أصل إنجليزي. يمكن لطاقم الممثلين والأسماء والإعدادات الانتقال إلى السوق المطابق في نفس الوقت من خلال إعداد المنطقة المستهدفة. يتم دعم خمس عشرة لغة، والحجة ضد الدبلجة توضح لماذا يتفوق توليد الخط على إعادة توقيته.

ما تكلفته

مطابقة الصوت هي استدعاء نموذج مجاني — لا تستهلك أرصدة ولا تُحسب ضمن حد المهام المتزامنة لديك. رفع عينتك الخاصة مجاني. الصوت نفسه جزء من توليد الفيديو، الذي يبدأ من 10 رصيد لكل ثانية من الإخراج (≈ $0.06/ثانية في باقة أقل سعر للرصيد)؛ لا توجد رسوم منفصلة لكل كلمة أو كل حرف للكلام. راجع صفحة التسعير، أو نظرة عامة على المولد لمعرفة مكان الصوت في عملية التشغيل.

ما لا يزال يتعذر عليك فعله

كل حلقة، بخمس عشرة لغة

يتم ضبط لغة الحوار مرة واحدة في الخطوة 1 ويتم تنفيذ عملية التشغيل بأكملها بها، مع قيام إعداد المنطقة المستهدفة بنقل الأسماء والوجوه والشوارع إلى ذلك السوق في نفس الوقت. تم إنتاج كل عينة أدناه بهذه الطريقة، عينة واحدة لكل لغة.

اللغات

حوار أصلي بـ 15 لغة

كل مسلسل أدناه أُنتج بنفس سير العمل، ويتحدث طاقم الممثلين تلك اللغة بطلاقة أصلية: الواجهة، ومستندات العمل، والسطور المنطوقة كلها بلغة واحدة، ولا يوجد أي دبلجة. افتح أحدها للاستماع.

عرض جميع اللغات البالغ عددها 15

الأسئلة المتداولة

هل يستطيع SceneMixer استنساخ صوت؟

لا. تتم مطابقة الأصوات من مكتبة أصوات معاينة مسبقة الضبط، أو تزويدها بك عن طريق رفع صوتك الخاص. لا يوجد مسار لإعادة إنتاج صوت من تسجيل لشخص آخر، وهذا أمر متعمد وليس غير مكتمل.

هل الكلام مدبلج بعد الفيديو؟

لا. نماذج الفيديو تولد الصورة والصوت في نفس العملية، لذا فإن الأداء وحركة الفم يأتيان من توليد واحد. لهذا السبب أيضًا يعني تغيير الخط إعادة توليد ذلك المقطع بدلاً من إعادة قص مسار صوتي.

هل يمكنني رفع صوتي الخاص؟

نعم. ارفع عينة لشخصية ما فتصبح المرجع الصوتي لتلك الشخصية في كل مقطع تتحدث فيه.

هل يجب أن تتحدث جميع الشخصيات بنفس اللغة؟

لغة الحوار هي إعداد على مستوى المشروع، لذا نعم داخل مشروع واحد — لكن اللغة تُختار بشكل مستقل عن اللغة التي كتبت بها النص، وبشكل مستقل عن لغة الواجهة لديك. يمكن إنتاج نص واحد لعدة أسواق عن طريق تشغيله بإعدادات مختلفة.

هل يبقى الصوت كما هو عبر الحلقات؟

نعم، لنفس السبب الذي يجعل الوجه يبقى كما هو: أي صوت مرفق بشخصية يكون مرفقًا على مستوى المشروع وينتقل إلى كل مقطع تتحدث فيه تلك الشخصية.

شخصيات تتحدث، لا مقاطع تدبلجها

صورة وأداء من عملية واحدة، باللغة التي يتحدث بها جمهورك.

جرّب SceneMixer مجانًا

باقات الأرصدة تبدأ من $1.49 · Pro $7.99/شهر · لا حاجة لبطاقة ائتمان للبدء

الأسعار·الأدلة·العينات·الدعم·الخصوصية·الشروط·معلومات قانونية·تواصل معنا·© 2026 SceneMixer