Personagens consistentes
Atualizado em 20 de setembro de 2026

Um modelo de texto para vídeo renderiza cada geração de forma independente. Descreva uma mulher de trinta e poucos anos com uma cicatriz em uma sobrancelha no plano 1 e novamente no plano 30, e você terá duas mulheres que correspondem à descrição, mas não uma à outra — adjetivos não definem um rosto por completo. Cada correção abaixo segue a mesma ideia em um ponto diferente: pare de descrever o personagem e entregue ao modelo uma foto dele.
| Folha de referência | Cada personagem é gerado uma vez como uma folha de corpo inteiro em 9:16 em um fundo liso sob iluminação principal direcional — uma foto de elenco, não uma peça de atmosfera, porque qualquer iluminação embutida na folha é herdada por cada plano que a usa. |
|---|---|
| Recortes anexados | Recortes de rosto e corpo dessa folha são enviados com cada segmento em que o personagem aparece. O modelo combina com uma imagem em vez de interpretar uma descrição. |
| Vínculos por id | Os storyboards apontam para os ativos por identificador, não por nome. Dois personagens com o mesmo nome, ou uma renomeação no meio de um projeto, não quebram mais a cadeia silenciosamente. |
| Regra de fora de quadro | Um personagem que só está sendo olhado, com quem se fala ou a quem se estende a mão — e não está em quadro — é escrito como uma direção, nunca nomeado. Nomear um personagem ausente é o que faz o modelo colar o rosto dele em um plano de uma única pessoa. |
Um quinto mecanismo, menor: cada pessoa em um plano carrega uma ou duas notas faciais distintivas extraídas de sua própria descrição, o que ameniza a falha clássica em que dois personagens com o mesmo uniforme trocam de rosto no meio do plano.
Consistência não pode significar "nunca muda" — um personagem que é incendiado no episódio 6 precisa parecer queimado no episódio 7. A linha divisória é traçada por como um modelo de vídeo trata uma imagem de referência: ele copia o rosto, a roupa, a forma e a estrutura quase literalmente, e aplica luz, clima e horário do dia como efeitos em camadas por cima.
Inverter isso sai caro em ambos os sentidos: uma variante para "segurando o copo" é uma imagem pela qual você pagou e nunca verá, e um prompt para "depois do incêndio" é um pedido que o modelo educadamente ignorará em favor do cômodo limpo em sua referência.
A explicação em camadas, com o que cada camada consegue e não consegue capturar, está no guia de consistência de personagem.
Folhas de referência são um item de cobrança separado da análise de roteiro (4 créditos por 3,333 caracteres de texto em inglês): cada conta recebe 15 imagens de referência grátis, e imagens extras ou regeneradas depois disso custam 7 créditos cada no modelo de imagem padrão. Variantes de estado têm uma pequena cota gratuita no primeiro projeto e são cobradas como imagens depois disso. O vídeo em si começa em 10 créditos por segundo de saída (≈ $0.06/s no menor preço por crédito) com ou sem referências anexadas — a consistência não é uma taxa adicional. Detalhes na página de preços.
Consistência é a única afirmação nesta categoria que você nunca deve aceitar na confiança, e você não precisa. Uma conta nova recebe 50 créditos, 15 imagens de referência grátis entre personagens, cenários e adereços, um storyboard de episódio 1 grátis no seu primeiro projeto e uma prévia gratuita de até 5 segundos que renderiza o plano de abertura do seu próprio episódio com base nas suas próprias folhas. Isso é suficiente para um teste real:
Para calibrar: o projeto mediano nesta plataforma tem cinco personagens nomeados, e nove em cada dez têm menos de dez. Se sua história precisa de trinta, o mesmo mecanismo ainda se aplica — o custo está nas folhas, não na consistência.
O idioma dos diálogos é definido uma vez na Etapa 1, e toda a geração é feita nele; a configuração de região-alvo ajusta nomes, rostos e ruas para esse mercado ao mesmo tempo. Cada amostra abaixo foi produzida dessa forma, uma por idioma.
Idiomas
Cada série abaixo foi produzida pelo mesmo fluxo, com o elenco falando o idioma de forma nativa: a interface, os documentos de trabalho e as falas estão todos no mesmo idioma, e nada é dublado. Abra uma para ouvir.
A Carta de LisboaPortuguêsNo seu idioma
윈터 프라미스한국어Diálogo nativo
El Secreto de CostaEspañolDiálogo nativo
浪人の誓い日本語Diálogo nativo
Ikrar JakartaBahasa IndonesiaDiálogo nativo
Зимняя коронаРусскийDiálogo nativo
L’Héritier du DéfiléFrançaisDiálogo nativo
Il Tavolo dell'OlivaItalianoDiálogo nativo
De Vuurtoren van de FjordNederlandsDiálogo nativo
العهد الصحراويالعربيةDiálogo nativo
Çantasındaki SözleşmeTürkçeDiálogo nativo
Die Istanbul-TäuschungDeutschDiálogo nativo
Останній сигналУкраїнськаDiálogo nativo
問劍青雲繁體中文Diálogo nativo
The Last EnvelopeEnglishDiálogo nativoO objetivo de projeto é manter o mesmo rosto ao longo de toda a série, e é isso que a arquitetura de folhas de referência entrega para o elenco da sua biblioteca de ativos. Não é uma garantia para todos os quadros: personagens com roupas idênticas na mesma cena e personagens cuja folha de referência é composta principalmente por casaco continuam sendo os casos difíceis. Todo o resto — quantidade de episódios, tempo decorrido, número de cenas em que um personagem aparece — não prejudica a consistência, porque cada cena é comparada com a mesma imagem.
Sim. Qualquer folha de referência pode ser substituída por uma imagem que você enviar, e o restante do fluxo de trabalho a trata exatamente como uma imagem gerada. Esse é o caminho para um personagem que você já criou em outra ferramenta.
Tecnicamente, o caminho de upload não se importa com o que a imagem mostra, mas publicar vídeos de IA com a aparência de uma pessoa real é um problema jurídico na maioria dos mercados, e nosso guia de conformidade trata isso como tal. Não oferecemos ferramenta de troca de rosto e não recomendamos essa prática.
Nada quebra. Os storyboards referenciam os ativos por identificador, e a renomeação é propagada por todos os textos armazenados ao mesmo tempo. Antes de setembro de 2026, as referências eram associadas por nome, e essa mudança resolve exatamente essa falha.
Não. Anexar arte de referência a um segmento não altera a tarifa por segundo — você paga uma vez por cada folha de referência e não paga mais nada, independentemente de quantas cenas a usem. Aqui, a consistência é uma escolha de arquitetura, não um upsell.
Não, e você não deve fazer isso. O texto da cena nomeia o personagem; a arte de referência carrega a aparência dele. Repetir a descrição física no texto da cena puxa o modelo de volta para as palavras e para longe da imagem, que é exatamente o desvio que esse projeto elimina.
Sim — é para isso que servem as variantes de estado. Cada aparência tem sua própria imagem de referência, e o storyboard define qual delas se aplica a cada segmento, com granularidade de segmento individual, não de episódio inteiro.
Gere o elenco uma vez; todas as cenas depois disso usam uma imagem como referência, não uma descrição.
Experimente o SceneMixer grátisPacotes de créditos a partir de $1.49 · Pro $7.99/mês · Não precisa de cartão de crédito para começar
Preços·Guias·Amostras·Suporte·Privacidade·Termos·Aviso legal·Contato·© 2026 SceneMixer