SceneMixer
Português
Cadastre-se grátis

Consistência de figurino

Consistência de roupas e figurinos com IA

Atualizado em 20 de setembro de 2026

Resposta rápida: a roupa é definida uma vez na ficha de referência do personagem e herdada por todos os planos que se referem a ele — os planos nunca repetem a descrição do figurino, porque isso disputa a atenção com o rosto e afasta a câmera até que a cabeça vire um pontinho. Uma troca real de roupa vira sua própria imagem de referência; chuva, sujeira e gola aberta são descritas em texto, porque os modelos condicionados por referência copiam o que está na imagem e aceitam efeitos aplicados por cima.
Frame de “A Carta de Lisboa”, um curta de drama com IA gerado de ponta a ponta pelo SceneMixer (6 personagens, 1 episódio)
Exemplo: “A Carta de Lisboa” — Live Action Cinematográfico, 1 episódio, produzido de ponta a ponta pelo SceneMixer a partir do roteiro · assistir aos episódios

O figurino é definido uma vez e depois referenciado

O instinto é descrever a roupa em cada plano. É a escolha errada, e cara: um parágrafo de figurino no prompt do plano disputa a atenção do modelo com o rosto e, em um quadro vertical, afasta a câmera o suficiente para reduzir a cabeça até que a identidade se perca. Um sobretudo claro ocupando setenta por cento do quadro com um rosto minúsculo em cima é um erro real, não uma hipótese.

Por isso, a roupa fica na ficha de referência do personagem, e os planos se referem à pessoa em vez de redescrever o figurino. O que a ficha define, cada plano herda.

Resumo rápido

Onde o figurino é decidido
A ficha de referênciaUm conjunto de roupa, descrito em termos concretos — corte, tecido, estrutura, fechos — e renderizado como uma foto de elenco em fundo branco.
O eixo do figurinoUm registro de projeto (época, tradição de alfaiataria, tecido e trabalho manual) injetado uma vez durante a análise, para que todo o elenco se vista no mesmo mundo.
Um segundo conjunto de roupaVira sua própria imagem de referência — um estado do personagem, não uma frase em um plano.
Pequenas alteraçõesChuva, poeira, gola afrouxada, algo na mão: escritas como texto no plano. Não precisa de uma segunda imagem.
Prompts de planoReferenciam o personagem. Não repetem a lista de roupas, nem afastam a câmera para exibi-las.

A linha entre um estado e uma frase

Essa distinção define se você precisa de uma segunda imagem, e ela vem de como os modelos de vídeo condicionados por referência se comportam: eles copiam o que está dentro da imagem — rosto, roupas, acessórios, estrutura — quase literalmente, e aceitam como texto qualquer coisa que fique por cima da imagem como efeito global — clima, horário do dia, luz, sujeira.

Errar essa linha criando imagens demais é o erro comum: no começo, a maioria dos “estados” detectados automaticamente eram coisas como segurar uma xícara ou uma lâmpada acesa. Isso é texto. O pipeline agora limita quantos estados ele propõe por personagem justamente porque gerar demais custa dinheiro e não traz ganho nenhum.

Dois conjuntos de roupa escritos em uma única descrição

Roteiros costumam tratar o figurino de um personagem como um arco — episódios iniciais com uma roupa, episódios posteriores com outra, além de um look de casamento. Se receber os três como uma única descrição, a renderização desenha uma figura vestindo metade de cada um. Por isso, a descrição é dividida estruturalmente antes de qualquer imagem ser gerada: o primeiro conjunto fica na ficha base, e os demais viram imagens de estado separadas. Rótulos de partes (calçados, acessórios, tecido) são reconhecidos como partes de um mesmo conjunto, não como um segundo.

Qual imagem cada plano usa

Por plano, em ordem de prioridade: um estado escolhido para aquele segmento específico, depois uma imagem de substituição por episódio, depois um estado atribuído àquele episódio, depois a ficha base. Apenas estados que foram realmente renderizados contam — se um estado existe no papel mas não tem imagem, o plano volta para a ficha base e carrega a diferença como texto, de forma que a mudança ainda é descrita mesmo sem uma foto dela.

A atribuição é automática: depois que a lista de planos é gerada, uma etapa decide quais segmentos usam qual estado e registra isso. Isso é feito por segmento, e não por episódio, de propósito — um figurino de flashback aplicado a um episódio inteiro deixaria o personagem com a roupa errada em todos os planos daquele episódio.

O que ele não faz

Quanto custa

Cada imagem de estado é uma imagem gerada: 7 credits. Seu primeiro projeto inclui 15 imagens de referência grátis entre personagens, locações e objetos, e imagens de estado têm sua própria cota gratuita separada naquele primeiro projeto — então testar uma não custa nada. Alterações apenas em texto não custam nada, e esse é o principal motivo para valer a pena aprender a linha entre estado e frase. Veja fichas de personagem para entender como a imagem base é construída, e a página de preços para as tarifas.

Idiomas

Diálogos nativos em 15 idiomas

Cada série abaixo foi produzida pelo mesmo fluxo, com o elenco falando o idioma de forma nativa: a interface, os documentos de trabalho e as falas estão todos no mesmo idioma, e nada é dublado. Abra uma para ouvir.

Ver todos os 15 idiomas

Perguntas frequentes

Por que o figurino não é descrito em todos os planos?

Porque redescrevê-lo disputa a atenção com o rosto e afasta a câmera para exibir as roupas, reduzindo a cabeça até que o personagem fique irreconhecível. O figurino é definido uma vez na ficha de referência e herdado por todos os planos que se referem àquele personagem.

Quando preciso de uma segunda imagem para um figurino?

Quando a própria peça muda — troca completa de roupa, armadura, uniforme, algo queimado ou rasgado além do reconhecimento. Se a mesma peça só estiver molhada, empoeirada, manchada de sangue ou desabotoada, descreva isso no texto da tomada; modelos condicionados por referência aceitam esses detalhes como efeitos aplicados sobre a imagem.

Meu roteiro descreve o guarda-roupa de um personagem mudando ao longo da temporada. O que acontece?

A descrição é dividida antes de qualquer imagem ser gerada: o primeiro traje fica na ficha base e os posteriores viram imagens de estado próprias. Se todas forem enviadas de uma vez, uma única renderização desenha uma figura vestindo partes de cada uma.

Qual imagem é usada em uma tomada específica?

Vence o estado escolhido para aquele segmento, depois uma substituição por episódio, depois um estado atribuído ao episódio, e por fim a ficha base. Estados sem imagem renderizada não contam — a tomada usa a ficha base e descreve a diferença em palavras.

Posso mudar o traje em uma tomada que já renderizei?

Não. O guarda-roupa é fixado quando a tomada é gerada, então uma mudança significa gerar esse segmento novamente pelo preço por segundo normal.

Vista o elenco uma vez só

Quinze imagens de referência grátis cobrem todo um elenco pequeno.

Experimente o SceneMixer grátis

Pacotes de créditos a partir de $1.49 · Pro $7.99/mês · Não precisa de cartão de crédito para começar

Preços·Guias·Amostras·Suporte·Privacidade·Termos·Aviso legal·Contato·© 2026 SceneMixer