Karakter yang konsisten
Diperbarui 20 September 2026

Model teks-ke-video merender setiap hasil pembuatan secara independen. Jika Anda mendeskripsikan wanita berusia tiga puluhan dengan bekas luka di alis pada bidikan 1 dan lagi pada bidikan 30, Anda akan mendapatkan dua wanita yang cocok dengan deskripsi tetapi tidak cocok satu sama lain — kata sifat tidak cukup untuk menentukan wajah secara spesifik. Setiap perbaikan di bawah ini memiliki ide yang sama di tempat yang berbeda: berhenti mendeskripsikan karakter, dan berikan model gambar mereka.
| Lembar referensi | Setiap karakter dibuat satu kali sebagai lembar penuh tubuh dalam rasio 9:16 di latar belakang polos dengan pencahayaan kunci terarah — ini adalah foto pemeran, bukan gambar suasana, karena pencahayaan yang tertanam di lembar referensi akan diwarisi oleh setiap bidikan yang menggunakannya. |
|---|---|
| Potongan yang dilampirkan | Potongan wajah dan tubuh dari lembar tersebut dikirimkan bersama setiap segmen tempat karakter muncul. Model akan mencocokkan gambar alih-alih menafsirkan deskripsi. |
| Tautan berdasarkan id | Storyboard merujuk ke aset dengan pengenal, bukan nama. Dua karakter dengan nama yang sama, atau perubahan nama di tengah proyek, tidak lagi merusak rantai referensi tanpa terdeteksi. |
| Aturan di luar bingkai | Karakter yang hanya sedang dilihat, diajak bicara, atau dijangkau — dan tidak ada dalam bingkai — ditulis sebagai arahan, tidak pernah disebut namanya. Menyebut nama karakter yang tidak ada dalam bingkai adalah hal yang membuat model menempelkan wajah mereka ke bidikan yang seharusnya hanya menampilkan satu orang. |
Mekanisme kelima yang lebih kecil: setiap orang dalam bidikan membawa satu atau dua catatan wajah pembeda yang diambil dari deskripsi mereka sendiri, yang mengurangi kegagalan klasik di mana dua karakter dengan seragam yang sama bertukar wajah di tengah bidikan.
Konsistensi tidak bisa berarti "tidak pernah berubah" — karakter yang terbakar di episode 6 harus terlihat terbakar di episode 7. Garis pemisahnya ditentukan oleh bagaimana model video memperlakukan gambar referensi: model menyalin wajah, pakaian, bentuk, dan struktur secara hampir harfiah, lalu menerapkan cahaya, cuaca, dan waktu hari sebagai efek yang dilapiskan di atasnya.
Membalik aturan ini akan memakan biaya di kedua sisi: varian untuk "memegang cangkir" adalah gambar yang Anda bayar tetapi tidak akan pernah terlihat, dan prompt untuk "setelah kebakaran" adalah permintaan yang akan diabaikan model demi ruangan bersih yang ada di referensi.
Penjelasan berlapis, dengan apa yang bisa dan tidak bisa ditangkap setiap lapisan, ada di panduan konsistensi karakter.
Lembar referensi adalah item biaya tersendiri, terpisah dari analisis naskah (4 kredit per 3,333 karakter teks bahasa Inggris): setiap akun mendapatkan 15 gambar referensi gratis, dan gambar tambahan atau yang dibuat ulang setelahnya dikenakan biaya 7 kredit per gambar pada model gambar default. Varian status memiliki jatah gratis kecil sendiri pada proyek pertama dan ditagih sebagai gambar setelahnya. Video itu sendiri mulai dari 10 kredit per detik hasil (≈ $0.06/s pada harga kredit terendah) baik dengan maupun tanpa lampiran referensi — konsistensi bukan biaya tambahan. Detail di halaman harga.
Konsistensi adalah satu klaim dalam kategori ini yang tidak boleh Anda percaya begitu saja, dan Anda tidak perlu melakukannya. Akun baru mendapatkan 50 kredit, 15 gambar referensi gratis untuk karakter, adegan, dan properti, storyboard episode-1 gratis pada proyek pertama Anda, dan satu pratinjau gratis hingga 5 detik yang merender bidikan pembuka episode Anda sendiri berdasarkan lembar referensi Anda sendiri. Itu cukup untuk pengujian nyata:
Sebagai kalibrasi: proyek rata-rata di platform ini memiliki lima karakter bernama, dan sembilan dari sepuluh memiliki kurang dari sepuluh. Jika cerita Anda membutuhkan tiga puluh karakter, mekanisme yang sama tetap berlaku — biayanya ada pada lembar referensi, bukan pada konsistensinya.
Bahasa dialog diatur sekali di Langkah 1 dan seluruh proses produksi berjalan dalam bahasa tersebut; pengaturan wilayah target juga menyesuaikan nama, wajah, dan tampilan jalan agar sesuai dengan pasar tersebut secara bersamaan. Setiap contoh di bawah dibuat dengan cara itu, satu per bahasa.
Bahasa
Setiap seri di bawah diproduksi dengan alur kerja yang sama, dengan pemeran berbicara bahasa tersebut secara asli: antarmuka, dokumen kerja, dan baris dialog semuanya dalam satu bahasa, tidak ada sulih suara. Buka salah satu untuk mendengarnya.
A Carta de LisboaPortuguêsDialog asli
윈터 프라미스한국어Dialog asli
El Secreto de CostaEspañolDialog asli
浪人の誓い日本語Dialog asli
Ikrar JakartaBahasa IndonesiaDalam bahasa Anda
Зимняя коронаРусскийDialog asli
L’Héritier du DéfiléFrançaisDialog asli
Il Tavolo dell'OlivaItalianoDialog asli
De Vuurtoren van de FjordNederlandsDialog asli
العهد الصحراويالعربيةDialog asli
Çantasındaki SözleşmeTürkçeDialog asli
Die Istanbul-TäuschungDeutschDialog asli
Останній сигналУкраїнськаDialog asli
問劍青雲繁體中文Dialog asli
The Last EnvelopeEnglishDialog asliWajah yang sama di seluruh seri adalah target desain dan apa yang dihadirkan oleh arsitektur lembar referensi untuk pemeran di pustaka aset Anda. Ini bukan jaminan di setiap bingkai: karakter dengan pakaian identik yang muncul dalam bidikan yang sama, dan karakter yang lembar referensinya didominasi oleh mantel, masih menjadi kasus yang sulit. Hal lain — jumlah episode, waktu yang berlalu, berapa banyak bidikan yang dimunculkan seorang karakter — tidak menurunkan kualitas konsistensi, karena setiap bidikan dicocokkan dengan gambar yang sama.
Ya. Lembar referensi apa pun dapat diganti dengan gambar yang Anda unggah, dan seluruh alur kerja memperlakukannya persis seperti lembar yang dihasilkan AI. Itulah cara untuk memasukkan karakter yang sudah Anda desain di tempat lain.
Secara teknis, jalur unggahan tidak mempedulikan isi gambar, tetapi mempublikasikan video AI yang menggunakan kemiripan wajah orang sungguhan merupakan masalah hukum di sebagian besar pasar, dan panduan kepatuhan kami memperlakukannya sebagai hal tersebut. Kami tidak menyediakan alat tukar wajah, dan kami tidak menyarankannya.
Tidak ada yang rusak. Papan cerita mereferensikan aset berdasarkan pengenal (identifier), dan perubahan nama akan disebarkan ke seluruh teks yang tersimpan secara bersamaan. Sebelum September 2026, referensi dicocokkan berdasarkan nama, dan kegagalan itulah yang dihilangkan oleh perubahan ini.
Tidak. Melampirkan gambar referensi ke sebuah segmen tidak mengubah tarif per detik — Anda membayar sekali untuk setiap lembar referensi, lalu tidak ada biaya lagi berapa pun jumlah bidikan yang menggunakannya. Konsistensi di sini adalah bagian dari arsitektur, bukan penjualan tambahan.
Tidak, dan Anda tidak seharusnya melakukannya. Teks bidikan menyebutkan nama karakter; gambar referensi yang membawa informasi tentang penampilan mereka. Mengulangi deskripsi fisik di teks bidikan akan menarik model kembali ke kata-kata dan menjauhkannya dari gambar, yang justru merupakan penyimpangan yang dihilangkan oleh desain ini.
Ya — itulah fungsi dari varian status (state variants). Setiap tampilan memiliki gambar referensinya sendiri, dan papan cerita menentukan tampilan mana yang berlaku untuk setiap segmen, hingga ke tingkat segmen individual, bukan seluruh episode.
Buat daftar pemeran sekali; setiap bidikan setelahnya dicocokkan dengan gambar, bukan deskripsi.
Coba SceneMixer gratisPaket kredit mulai dari $1.49 · Pro $7.99/bln · Tanpa kartu kredit untuk memulai
Harga·Panduan·Contoh·Dukungan·Privasi·Ketentuan·Informasi hukum·Hubungi kami·© 2026 SceneMixer