أصوات الشخصيات بالذكاء الاصطناعي
تم التحديث في 16 سبتمبر 2026

تتعامل معظم سير عمل فيديو الذكاء الاصطناعي مع الصوت كمهمة ثانية: توليد لقطات صامتة، ثم توليف الخطوط، ثم محاربة مشكلة مزامنة الشفاه. نماذج الفيديو هنا تولد الصوت والصورة في عملية واحدة، مما يزيل هذه المشكلة لكنه يغير معنى "إعداد الصوت". إنه ليس محرك نص إلى كلام تغذيه بالنص — بل هو مرجع تُبنى عليه عملية التوليد.
| وصف مكتوب | العمر، النبرة، الثقل، طريقة الإلقاء — تُولد من النص مع كل شيء آخر عن الشخصية، ويؤديها نموذج الفيديو. |
|---|---|
| صوت مسبق مطابق | صوت يتم اختياره من مكتبة أصوات النظام، كل منها يحتوي على عينة صوتية قصيرة يمكنك الاستماع إليها. يقترح استدعاء نموذج واحد مطابقة لكل شخصية حسب الجنس واللغة والعمر؛ يمكنك إعادة المطابقة أو اختيار صوت آخر يدويًا. |
| عينتك الخاصة | ارفع صوتًا لشخصية ما فيصبح هذا الصوت هو المرجع لتلك الشخصية في كل مقطع تتحدث فيه. |
أيًا كان الصوت المرفق يُستخدم بشكل ثابت: تتحدث نفس الشخصية بنفس الصوت عبر كل مقطع وكل حلقة، لنفس السبب الذي يجعل وجهها يبقى كما هو — المرجع ينتقل معها.
لا توجد أداة هنا لاستنساخ صوت من تسجيل لشخص آخر. هذا نقص متعمد، وليس عنصرًا في خارطة الطريق: نشر أداء اصطناعي لصوت شخص حقيقي يمثل مشكلة تتعلق بالتشابه الشخصي في معظم الأسواق التي نخدمها، والمنتج الذي يجعل ذلك ممكنًا بنقرة واحدة هو منتج يجعله أمرًا روتينيًا. تعامل قائمة التحقق الخاصة بالامتثال لدينا التشابه الشخصي — سواء في الوجه أو الصوت — كشيء يجب أن تمتلك الحق في استخدامه قبل النشر.
شيئان ينتجان عن ذلك، يجدر ذكرهما بوضوح:
يتم اختيار لغة الحوار في الخطوة 1 وتنطبق على المشروع بأكمله: تُكتب الخطوط بتلك اللغة في مرحلة التحليل، وتُنسخ حرفيًا إلى لوحة القصص، وتُؤدى بها. هذه ليست عملية دبلجة فوق أصل إنجليزي — لا يوجد أصل إنجليزي. يمكن لطاقم الممثلين والأسماء والإعدادات الانتقال إلى السوق المطابق في نفس الوقت من خلال إعداد المنطقة المستهدفة. يتم دعم خمس عشرة لغة، والحجة ضد الدبلجة توضح لماذا يتفوق توليد الخط على إعادة توقيته.
مطابقة الصوت هي استدعاء نموذج مجاني — لا تستهلك أرصدة ولا تُحسب ضمن حد المهام المتزامنة لديك. رفع عينتك الخاصة مجاني. الصوت نفسه جزء من توليد الفيديو، الذي يبدأ من 10 رصيد لكل ثانية من الإخراج (≈ $0.06/ثانية في باقة أقل سعر للرصيد)؛ لا توجد رسوم منفصلة لكل كلمة أو كل حرف للكلام. راجع صفحة التسعير، أو نظرة عامة على المولد لمعرفة مكان الصوت في عملية التشغيل.
يتم ضبط لغة الحوار مرة واحدة في الخطوة 1 ويتم تنفيذ عملية التشغيل بأكملها بها، مع قيام إعداد المنطقة المستهدفة بنقل الأسماء والوجوه والشوارع إلى ذلك السوق في نفس الوقت. تم إنتاج كل عينة أدناه بهذه الطريقة، عينة واحدة لكل لغة.
اللغات
كل مسلسل أدناه أُنتج بنفس سير العمل، ويتحدث طاقم الممثلين تلك اللغة بطلاقة أصلية: الواجهة، ومستندات العمل، والسطور المنطوقة كلها بلغة واحدة، ولا يوجد أي دبلجة. افتح أحدها للاستماع.
A Carta de LisboaPortuguêsحوار أصلي
윈터 프라미스한국어حوار أصلي
El Secreto de CostaEspañolحوار أصلي
浪人の誓い日本語حوار أصلي
Ikrar JakartaBahasa Indonesiaحوار أصلي
Зимняя коронаРусскийحوار أصلي
L’Héritier du DéfiléFrançaisحوار أصلي
Il Tavolo dell'OlivaItalianoحوار أصلي
De Vuurtoren van de FjordNederlandsحوار أصلي
العهد الصحراويالعربيةبلغتك
Çantasındaki SözleşmeTürkçeحوار أصلي
Die Istanbul-TäuschungDeutschحوار أصلي
Останній сигналУкраїнськаحوار أصلي
問劍青雲繁體中文حوار أصلي
The Last EnvelopeEnglishحوار أصليلا. تتم مطابقة الأصوات من مكتبة أصوات معاينة مسبقة الضبط، أو تزويدها بك عن طريق رفع صوتك الخاص. لا يوجد مسار لإعادة إنتاج صوت من تسجيل لشخص آخر، وهذا أمر متعمد وليس غير مكتمل.
لا. نماذج الفيديو تولد الصورة والصوت في نفس العملية، لذا فإن الأداء وحركة الفم يأتيان من توليد واحد. لهذا السبب أيضًا يعني تغيير الخط إعادة توليد ذلك المقطع بدلاً من إعادة قص مسار صوتي.
نعم. ارفع عينة لشخصية ما فتصبح المرجع الصوتي لتلك الشخصية في كل مقطع تتحدث فيه.
لغة الحوار هي إعداد على مستوى المشروع، لذا نعم داخل مشروع واحد — لكن اللغة تُختار بشكل مستقل عن اللغة التي كتبت بها النص، وبشكل مستقل عن لغة الواجهة لديك. يمكن إنتاج نص واحد لعدة أسواق عن طريق تشغيله بإعدادات مختلفة.
نعم، لنفس السبب الذي يجعل الوجه يبقى كما هو: أي صوت مرفق بشخصية يكون مرفقًا على مستوى المشروع وينتقل إلى كل مقطع تتحدث فيه تلك الشخصية.
صورة وأداء من عملية واحدة، باللغة التي يتحدث بها جمهورك.
جرّب SceneMixer مجانًاباقات الأرصدة تبدأ من $1.49 · Pro $7.99/شهر · لا حاجة لبطاقة ائتمان للبدء
الأسعار·الأدلة·العينات·الدعم·الخصوصية·الشروط·معلومات قانونية·تواصل معنا·© 2026 SceneMixer