
Abre un personaje en el paso 2 y el cuadro de Descripción de voz está en la parte inferior del diálogo, debajo de la descripción de apariencia. Ese único cuadro es donde vive el acento.
Nada de la voz se graba, dobla o une después. Cuando se genera un segmento, el modelo de vídeo renderiza la imagen y dice las líneas en el mismo proceso, y la descripción de cada personaje que habla se le entrega como guía para esa voz. Por eso las formas de la boca coinciden con las palabras: la voz es parte de la generación, no una capa añadida. Diálogo y sonido en una sola generación.
Las palabras del acento no se filtran, acortan ni eliminan: «suave y entrecortada, un mandarín taiwanés ligero, pausado» acompaña cada línea que dice ese personaje, en cada segmento — y nada pregunta si lo querías decir. Si quieres mandarín con acento de Hong Kong, dices mandarín con acento de Hong Kong.
Lo único que la biblioteca de voces no puede hacer son los acentos. Está organizada por idioma — chino, inglés, cantonés — y se elige una coincidencia por género, rango de edad y manera. No hay una entrada de acento taiwanés, ni de escocés, ni de Brooklyn, y las palabras de acento de tu descripción no influyen en la elección. Los acentos vienen de la descripción; la biblioteca sirve para mantener una voz estable. Cómo funcionan las voces de los personajes.
Dos lugares muestran en cuál de los dos modos está un personaje. En la tarjeta del personaje en el paso 2, hay un pequeño icono de altavoz junto al nombre cuando hay una voz de audio adjunta — sin icono significa que la descripción manda. En el editor de storyboard, el menú @ tiene una pestaña de Voz que lista el reparto: cada personaje tiene un icono de habla, y el que no tiene audio también lleva una pequeña etiqueta de Solo texto junto a él. Al pasar el cursor por el icono se indica cuál de las dos es — Voz asignada, o Solo descripción de voz (sin audio). El icono sin etiqueta es la luz verde; el altavoz significa que hay una muestra de audio adjunta y la descripción, incluido el acento, no es lo que se interpreta.
Si te encuentras en el estado equivocado, abre el personaje y usa Eliminar voz — la confirmación dice que el archivo remoto se conserva, así que no se destruye nada y puedes elegir una voz de nuevo más tarde. Es gratis y surte efecto en el siguiente segmento que generes. Entonces tus palabras de acento vuelven a estar en juego.
Di qué acento y cuánto de él. «Un acento» no es una descripción; «un mandarín taiwanés suave» sí lo es. Estos siguen el mismo formato de una línea que ya usa la descripción, con el acento añadido:
| Lo que escribes | Lo que estás pidiendo |
|---|---|
| Grave y cálida, pausada, un mandarín taiwanés suave | Mandarín con acento taiwanés, dicho con suavidad y sin prisas |
| Brillante y rápida, mandarín con acento de Hong Kong, finales cortados | El toque de Hong Kong en el mandarín, con el ritmo entrecortado que lo acompaña |
| Relajada y un poco ronca, acento de Sichuan, conversacional | Mandarín con toque de Sichuan, informal en lugar de interpretado |
| Mandarín estándar neutro con solo un rastro de sabor noreste | Mandarín estándar con el más mínimo matiz regional |
| Mesurada y ronca, un suave acento escocés, pausada | Inglés con un suave acento escocés |
| Cálida y lenta, un suave arrastre del sur de EE. UU. | Inglés con las vocales alargadas del sur de Estados Unidos |
| Plana y cansada, acento londinense, entrecortada | Inglés que suena a Londres, tenso y cansado |
| Ligera y rápida, inglés con un ligero acento francés | Inglés hablado por alguien cuya primera lengua es el francés |
Tres hábitos hacen que funcione.
Tres cosas distintas, tres lugares distintos para ponerlas. Mezclarlas es la razón habitual por la que un acento «no funciona».
| Lo que quieres | Dónde va |
|---|---|
| El reparto habla el idioma de diálogo del proyecto con un matiz regional: taiwanés, de Hong Kong, sichuanés, del noreste, de Shanghái, erhua al estilo de Pekín, un arrastre rural en inglés | En la Descripción de voz del personaje. Las líneas se mantienen en el idioma de diálogo del proyecto y se añade ese matiz regional encima |
| Las propias líneas están escritas con el lenguaje de esa región: expresiones regionales reales en lugar de las estándar | En el propio diálogo, en el guion o en la línea del storyboard. La redacción junto con el acento es lo que hace que un dialecto funcione |
| El reparto habla un idioma totalmente distinto: cantonés, inglés, japonés | En la configuración del idioma de diálogo del proyecto, no en la descripción. El cantonés está disponible ahí como opción solo de diálogo. Cómo configurar el idioma de diálogo |
| Esta línea en concreto es enfadada, susurrada, apresurada o con énfasis en una palabra | En la nota de interpretación entre paréntesis al principio de esa línea. No repitas el acento ahí: ya está aplicado al personaje. Diálogo en el storyboard |
La distinción que importa: un acento cambia cómo se habla el idioma, una configuración de dialecto cambia qué se habla. Pedir ambas cosas en un mismo lugar se contradice: escribir «habla cantonés» en una descripción en un proyecto cuyo idioma de diálogo es mandarín deja al modelo con dos instrucciones sobre la misma frase que se oponen entre sí. Si quieres cantonés, configura el cantonés como idioma de diálogo y añade cualquier matiz regional en la descripción encima.
| Lo que ves | De dónde viene | Qué hacer |
|---|---|---|
| No cambia nada después de guardar | El personaje tiene audio adjunto, así que la descripción no es lo que se interpreta | Comprueba la etiqueta; en la tarjeta usa Eliminar voz y luego genera el segmento de nuevo |
| El acento está ahí pero es muy tenue | La palabra de intensidad era vaga, o la región se nombró solo en términos generales | Nómbralo de forma más precisa y gradúalo: «un acento sichuanés claro e inconfundible», luego regenera ese segmento |
| Los episodios antiguos siguen sonando igual que siempre | Los segmentos terminados conservan la voz con la que se grabaron; eso es lo que hace que un episodio entregado sea estable | Regenera los segmentos donde quieras el acento. Cuesta lo mismo que generarlos la primera vez. Cuesta cada corrección de clip |
| El acento falta en un clip que corregiste después de grabarlo | El panel de voz de clip terminado sintetiza el habla con voces preestablecidas de la biblioteca, así que un acento escrito en la descripción no sale de ahí | Regenera el segmento en lugar de redoblarlo. Cambiar una voz en un clip que ya tienes |
| La voz es correcta pero varía entre segmentos | El modo de descripción cambia un poco de consistencia por libertad: cada generación interpreta las palabras de nuevo | Acéptalo, o pasa ese personaje a una voz preestablecida de la biblioteca y renuncia al acento escrito para ese personaje |
| La voz del personaje está bien, pero la línea de un desconocido es extraña | Las líneas dichas por alguien fuera del reparto no llevan la descripción de un personaje | Dale a ese hablante su propia tarjeta de personaje y escribe también su acento ahí, o déjalo como una línea puntual |
Una cosa que debes saber antes de recurrir a una voz subida para solucionar esto: una grabación adjunta y un acento escrito son alternativas, no complementos. Si adjuntas audio, la descripción deja de interpretarse, incluidas las palabras del acento. Los miembros que quieren una voz regional específica usan la subida de forma deliberada, en lugar de la descripción. Cómo funcionan las voces de los personajes.
Sí. La descripción de voz acompaña a cada línea que habla ese personaje y se interpreta tal como está escrita: el modelo de vídeo dice la línea y renderiza la toma en una sola pasada, así que no hay un paso de doblaje separado que pueda eliminarla. Lo que no tienes es un ajuste de intensidad: si un acento sale muy suave, indícalo de forma más explícita y genera ese segmento de nuevo.
Casi siempre porque el personaje tiene audio adjunto: una voz preestablecida que asignaste o una grabación que subiste. Con el audio activo, la descripción no es lo que interpreta el modelo. En la tarjeta del personaje usa Eliminar voz para volver a la descripción, luego genera el segmento de nuevo.
Sí puedes, y todo lo que generes a partir de entonces lo usará. Los segmentos que ya grabaste conservan la voz con la que se hicieron; regenera aquellos donde quieras oír el acento, al coste habitual de generar un segmento.
No. Ese panel sintetiza el habla con voces preestablecidas de la biblioteca, así que un acento escrito en la descripción no sale de ahí. Un acento solo aparece en un segmento que se genera de nuevo.
No. La biblioteca está organizada por idioma —chino, inglés, cantonés— y se elige una coincidencia por género, rango de edad y tono, no por las palabras de acento de tu descripción. La descripción es el único lugar del que procede un acento.
No. Un acento o dialecto mantiene el idioma de diálogo del proyecto y le aporta un matiz regional, por lo que se incluye en la descripción de voz. Para cambiar el idioma en sí, configura el idioma de diálogo del proyecto, donde el cantonés está disponible como opción solo de diálogo; escribir que habla cantonés en la descripción mientras el idioma de diálogo sigue siendo mandarín pide dos cosas a la vez, y se contradicen entre sí.
No. Es una propiedad del personaje, se escribe una vez en la descripción de voz y cubre todas las líneas que dice. Lo que cambia de una línea a otra —estado de ánimo, ritmo, una palabra con énfasis— va en la nota de interpretación entre paréntesis al principio de esa línea.
Ambas cosas. Cada personaje tiene su propia descripción de voz, así que los acentos nunca interfieren. Los personajes de solo voz —narradores, la persona al otro lado del teléfono— también tienen descripción de voz, y el acento funciona de la misma forma para las líneas que dicen.
Abre un personaje, comprueba la etiqueta y añade una frase de acento a la descripción de voz.
Actualizado el 10 de octubre de 2026
Precios·Guías·Ejemplos·Soporte·Privacidad·Términos·Aviso legal·Contacto·Programa de afiliados·© 2026 SceneMixer