Personajes consistentes
Actualizado el 20 de septiembre de 2026

Un modelo de texto a video procesa cada generación de forma independiente. Si describes a una mujer de unos treinta años con una cicatriz en una ceja en la toma 1 y vuelves a hacerlo en la toma 30, obtienes dos mujeres que coinciden con la descripción pero no entre sí: los adjetivos no definen un rostro con precisión. Todas las soluciones que aparecen a continuación comparten la misma idea aplicada en distintos puntos: deja de describir al personaje y entrégale al modelo una imagen de él.
| Hoja de referencia | Cada personaje se genera una sola vez como una hoja de cuerpo completo en formato 9:16, sobre fondo liso y con iluminación clave direccional: es una foto de reparto, no una pieza ambiental, porque cualquier iluminación integrada en la hoja se hereda en cada toma que la utilice. |
|---|---|
| Recortes adjuntos | Los recortes de rostro y cuerpo de esa hoja se envían con cada segmento en el que aparece el personaje. El modelo compara con una imagen en lugar de interpretar una descripción. |
| Vínculos por id | Los guiones de storyboard apuntan a los recursos por identificador, no por nombre. Que dos personajes tengan el mismo nombre, o que se cambie un nombre a mitad de un proyecto, ya no rompe la cadena sin que te des cuenta. |
| Regla de fuera de cuadro | Un personaje al que solo se mira, con el que solo se habla o al que solo se intenta alcanzar —y que no está en cuadro— se escribe como una indicación, nunca se nombra. Nombrar a un personaje ausente es lo que hace que el modelo pegue su rostro en una toma de una sola persona. |
Un quinto mecanismo, más pequeño: cada persona en una toma lleva una o dos notas faciales distintivas extraídas de su propia descripción, lo que suaviza el fallo clásico en el que dos personajes con el mismo uniforme intercambian rostros a mitad de la toma.
La consistencia no puede significar "nunca cambia": un personaje que es incendiado en el episodio 6 debe parecer quemado en el episodio 7. La línea divisoria la marca cómo trata un modelo de video a una imagen de referencia: copia el rostro, la ropa, la forma y la estructura de forma casi literal, y aplica la luz, el clima y la hora del día como efectos superpuestos.
Hacerlo al revés sale caro en ambos sentidos: una variante para "sostener la taza" es una imagen por la que pagaste y que nunca verás, y un prompt para "después del incendio" es una solicitud que el modelo ignorará amablemente para usar la habitación limpia de su referencia.
La explicación por capas, con lo que cada capa puede y no puede capturar, está en la guía de consistencia de personajes.
Las hojas de referencia son una línea de pedido propia, separada del análisis de guion (4 créditos por 3,333 caracteres de texto en inglés): cada cuenta recibe 15 imágenes de referencia gratis, y las imágenes adicionales o regeneradas después de eso cuestan 7 créditos cada una en el modelo de imagen predeterminado. Las variantes de estado tienen su propia pequeña asignación gratuita en el primer proyecto y se facturan como imágenes después de eso. El video en sí comienza en 10 créditos por segundo de salida (≈ $0.06/s en el plan precio más bajo por crédito) independientemente de si se adjuntan referencias o no: la consistencia no tiene recargo. Detalles en la página de precios.
La consistencia es la única afirmación en esta categoría que nunca deberías creer sin probarla, y no hace falta que lo hagas. Una cuenta nueva incluye 50 créditos, 15 imágenes de referencia gratuitas para personajes, escenas y accesorios, un storyboard gratuito del episodio 1 en tu primer proyecto y una vista previa gratuita de hasta 5 segundos que renderiza la toma inicial de tu propio episodio usando tus propias hojas. Eso es suficiente para una prueba real:
Como referencia: el proyecto mediano en esta plataforma tiene cinco personajes con nombre, y nueve de cada diez tienen menos de diez. Si tu historia necesita treinta, el mismo mecanismo sigue aplicando: el costo está en las hojas, no en la consistencia.
El idioma de los diálogos se configura una sola vez en el Paso 1 y toda la generación se realiza en ese idioma; al mismo tiempo, la configuración de región objetivo adapta los nombres, los rostros y las calles a ese mercado. Cada ejemplo a continuación se produjo de esa forma, uno por idioma.
Idiomas
Cada serie a continuación se ha producido con el mismo flujo de trabajo y el reparto habla ese idioma de forma nativa: la interfaz, los documentos de trabajo y las líneas habladas están en un mismo idioma, y no hay doblaje. Abre una para escucharlo.
A Carta de LisboaPortuguêsDiálogo nativo
윈터 프라미스한국어Diálogo nativo
El Secreto de CostaEspañolEn tu idioma
浪人の誓い日本語Diálogo nativo
Ikrar JakartaBahasa IndonesiaDiálogo nativo
Зимняя коронаРусскийDiálogo nativo
L’Héritier du DéfiléFrançaisDiálogo nativo
Il Tavolo dell'OlivaItalianoDiálogo nativo
De Vuurtoren van de FjordNederlandsDiálogo nativo
العهد الصحراويالعربيةDiálogo nativo
Çantasındaki SözleşmeTürkçeDiálogo nativo
Die Istanbul-TäuschungDeutschDiálogo nativo
Останній сигналУкраїнськаDiálogo nativo
問劍青雲繁體中文Diálogo nativo
The Last EnvelopeEnglishDiálogo nativoEl objetivo de diseño es mantener el mismo rostro a lo largo de toda la serie, y eso es lo que ofrece la arquitectura de hojas de referencia para el reparto de tu biblioteca de recursos. No es una garantía en cada fotograma: los personajes vestidos de forma idéntica que comparten plano, y los personajes cuya hoja de referencia muestra principalmente el abrigo, siguen siendo los casos difíciles. Todo lo demás —cantidad de episodios, tiempo transcurrido, número de planos en los que aparece un personaje— no reduce la calidad, porque cada plano se compara con la misma imagen.
Sí. Cualquier hoja de referencia se puede sustituir por una imagen que subas, y el resto del flujo de trabajo la trata exactamente igual que una generada. Esa es la forma de usar un personaje que ya hayas diseñado en otra herramienta.
Técnicamente, la opción de subida no distingue qué tipo de imagen es, pero publicar vídeos con IA que usen la apariencia de una persona real supone un problema legal en la mayoría de mercados, y nuestra guía de cumplimiento lo trata como tal. No ofrecemos una herramienta de intercambio de rostros, y no lo recomendamos.
No se rompe nada. Los guiones de storyboard hacen referencia a los recursos por identificador, y el cambio de nombre se propaga por todo el texto almacenado al mismo tiempo. Antes de septiembre de 2026, las referencias se asociaban por nombre, y ese era precisamente el error que este cambio eliminó.
No. Asociar arte de referencia a un segmento no cambia la tarifa por segundo: pagas una vez por cada hoja de referencia y no pagas nada más, sin importar cuántos planos la usen. Aquí la consistencia es parte de la arquitectura, no una venta adicional.
No, y no deberías hacerlo. El texto del plano nombra al personaje; el arte de referencia define su aspecto. Repetir la descripción física en el texto del plano hace que el modelo se base de nuevo en las palabras y se aleje de la imagen, que es precisamente la desviación que este diseño evita.
Sí: para eso sirven las variantes de estado. Cada aspecto tiene su propia imagen de referencia, y el storyboard decide por segmento cuál se aplica, a nivel de segmento individual y no de episodio completo.
Genera el reparto una sola vez; todos los planos posteriores se ajustan a una imagen, no a una descripción.
Prueba SceneMixer gratisPaquetes de créditos desde $1.49 · Pro $7.99/mes · No necesitas tarjeta de crédito para empezar
Precios·Guías·Ejemplos·Soporte·Privacidad·Términos·Aviso legal·Contacto·© 2026 SceneMixer