Generator video iklan AI
Diperbarui 20 September 2026

| Yang Anda unggah | Maksimal empat foto dari objek yang sama — bisa berupa produk, hidangan, pakaian, mobil, tampak depan toko, properti, atau tangkapan layar aplikasi/situs Anda. Gunakan sudut dan detail berbeda dari satu benda yang sama, bukan empat benda yang berbeda. |
|---|---|
| Yang Anda ketik | Opsional. Satu kalimat tentang produk yang Anda jual akan membantu, dan jika isi foto bertentangan dengan kalimat yang Anda tulis, kalimat tersebut yang akan diutamakan. |
| Durasi | 15, 30, atau 60 detik — setara dengan satu, dua, atau empat segmen yang dihasilkan. |
| Format bingkai dan resolusi | 16:9 atau 9:16; 480P, 720P, atau 1080P. |
| Nada | Delapan pilihan gaya: Epik, Lucu, Hangat, Minimalis, Twist, Close-up bikin ngiler, Tunjukkan cara kerjanya, Keseharian. |
| Yang dihasilkan sistem | Naskah kreatif dengan dua hingga empat baris dialog, daftar pemeran, lokasi, storyboard, video yang dihasilkan, dan kartu penutup yang memuat merek, nama produk, tagline, serta ajakan bertindak Anda. |
| Suara | Dialog, suara latar, dan musik dihasilkan bersamaan dengan gambar. Tidak ada trek dari pustaka yang dicampur setelah proses selesai. |
| Harga | Satu angka harga yang ditampilkan sebelum Anda mulai, dan angka ini adalah batas maksimum — Anda hanya dikenakan biaya untuk tahap yang benar-benar berjalan, tidak pernah lebih dari harga yang ditawarkan. |
Tekan tombol tanpa mengetik apa pun, dan langkah pertama yang terjadi adalah gratis: foto akan dibaca, dan Anda akan diberi tahu hasilnya — apakah objeknya dapat dikenali, masuk kategori apa, nama produknya, deskripsi, poin penjualan yang layak ditampilkan, saran nada, dan nama merek yang terbaca di kemasan atau papan nama, ditranskripsikan persis seperti yang tercetak bukan ditebak. Jika pembacaan gagal, Anda akan langsung tahu saat itu juga tanpa biaya, dengan tombol untuk mengganti foto.
Dua hal yang ditentukan oleh hasil pembacaan foto, dan ini adalah satu-satunya alasan mengapa kategori menjadi penting:
Foto toko dan restoran hampir selalu menampilkan pelanggan dan staf di dalamnya. Alih-alih menolak foto tersebut, alur kerja akan menghapus orang-orang di dalamnya terlebih dahulu dan mempertahankan papan nama, perlengkapan, serta pencahayaan — karena model video yang diberi gambar referensi akan meniru wajah di dalamnya hampir persis, dan Anda tidak memiliki izin untuk menampilkan wajah tersebut dalam iklan. Tangkapan layar adalah satu-satunya kasus yang ditolak: mengedit tangkapan layar akan membuat antarmuka menjadi buram.
| Serahkan ke AI | Satu harga yang ditawarkan mencakup seluruh proses — pembersihan foto, naskah, pemeran, storyboard, video, dan potongan akhir. Halaman progres akan menampilkan setiap tahap, dan Anda dapat membatalkan proses sebelum tahap video dimulai. Ini adalah opsi bawaan. |
|---|---|
| Pegang kendali | Anda membayar untuk pembersihan foto dan naskah tertulis, lalu akan masuk ke editor biasa dengan iklan yang sudah disiapkan: tulis ulang naskah, ganti pemeran, edit setiap bidikan, hasilkan ulang satu segmen, dan gabungkan jika sudah puas. Setiap langkah selanjutnya akan ditagih seperti proses generasi biasa. |
Pada dasarnya, sebuah iklan adalah proyek SceneMixer biasa dengan tipe konten yang diatur ke iklan — analisis naskah yang sama, referensi art yang sama, daftar bidikan yang sama, dan rendering per segmen yang sama seperti yang dijelaskan di halaman drama pendek. Hal yang khusus untuk iklan adalah ringkasan kreatif, struktur yang lebih pendek, kartu penutup, dan filter kepatuhan.
Model video yang digunakan untuk segmen iklan menghasilkan suara dan gambar dalam satu proses, jadi sistem sudah memberikan dialog, suara ruangan, dan sangat sering, musik yang cocok dengan apa yang ada di layar. Menumpuk trek stok di atasnya justru akan membuat dua musik bertabrakan. Sebagai gantinya, ringkasan iklan memuat deskripsi tertulis tentang musik — instrumen, tempo, ritme, di mana musik harus membangun ketegangan — dan deskripsi yang sama diterapkan ke setiap segmen di iklan yang sama, karena setiap segmen adalah hasil generasi mandiri yang tidak mengingat segmen lain. Kesamaan deskripsi adalah satu-satunya hal yang membuat musik tetap serasi di seluruh potongan video.
Kartu penutup didesain tanpa suara, dengan audio utama yang memudar masuk ke bagian tersebut. Hanya tiga hal yang ditambahkan setelah proses generasi: kartu penutup, penyesuaian kenyaringan, dan lencana AIGC.
Anda akan melihat satu angka sebelum memulai proses, dan angka ini dihitung menggunakan tarif yang sama dengan yang dikenakan di seluruh platform: membaca foto gratis, pembersihan atau gambar ulang dihitung sebagai satu gambar, skrip dihitung sebagai satu panggilan model, gambar referensi dikenakan biaya per gambar dengan 15 gratis per akun dan 7 kredit per gambar setelahnya, video dikenakan 10 kredit per detik hasil pada tingkat 480P (≈ $0.06/dtk pada harga kredit terendah) dan lebih mahal pada tingkat resolusi yang lebih tajam, serta perakitan dikenakan 1 kredit per detik. Angka estimasi ini adalah batas maksimum, bukan deposit: setiap tahap dikenakan biaya saat dijalankan, dan iklan 15 detik yang membutuhkan lebih sedikit gambar referensi dari perkiraan awal akan dikenakan biaya yang lebih murah. Jika satu tahap gagal, proses akan berhenti di sana tanpa menghabiskan sisa kuota estimasi, dan Anda bisa mengulang tahap tersebut tanpa harus mengulang tahap sebelumnya. Akun baru memulai dengan 50 kredit; paket kredit mulai dari $1.49. Halaman harga menyediakan tabel tarif lengkapnya.
Dialog lisan, kartu penutup, dan pemeran akan mengikuti bahasa antarmuka Anda, dan penyesuaian pasar akan menyesuaikannya — nama, wajah, dan jalanan akan disesuaikan dengan wilayah tempat iklan ditayangkan. Mesin dialog yang sama digunakan untuk memproduksi serial di bawah ini, satu untuk setiap bahasa.
Bahasa
Setiap seri di bawah diproduksi dengan alur kerja yang sama, dengan pemeran berbicara bahasa tersebut secara asli: antarmuka, dokumen kerja, dan baris dialog semuanya dalam satu bahasa, tidak ada sulih suara. Buka salah satu untuk mendengarnya.
A Carta de LisboaPortuguêsDialog asli
윈터 프라미스한국어Dialog asli
El Secreto de CostaEspañolDialog asli
浪人の誓い日本語Dialog asli
Ikrar JakartaBahasa IndonesiaDalam bahasa Anda
Зимняя коронаРусскийDialog asli
L’Héritier du DéfiléFrançaisDialog asli
Il Tavolo dell'OlivaItalianoDialog asli
De Vuurtoren van de FjordNederlandsDialog asli
العهد الصحراويالعربيةDialog asli
Çantasındaki SözleşmeTürkçeDialog asli
Die Istanbul-TäuschungDeutschDialog asli
Останній сигналУкраїнськаDialog asli
問劍青雲繁體中文Dialog asli
The Last EnvelopeEnglishDialog asliTidak. Minimal cukup satu foto. Satu kalimat tentang apa yang Anda jual akan meningkatkan hasil dan menjelaskan ambiguitas di foto — frasa “toko kami” di samping foto meja kasir bisa berarti iklan tentang tempat usaha atau iklan tentang mesin kopi. Semua elemen setelahnya, termasuk dialog lisan, akan dituliskan untuk Anda dan bisa ditulis ulang di mode lanjutan.
Maksimal empat, dan semuanya harus menampilkan subjek yang sama dari sudut pandang atau tingkat detail yang berbeda — foto pertama akan dianggap sebagai gambar utama dan menjadi dasar untuk gambar ulang serta kartu penutup. Foto tambahan tempat usaha akan menjadi pelat lokasi tambahan, sehingga iklan akan berlatar di ruang asli Anda, bukan hasil buatan AI yang mendekati.
Orang-orang tersebut akan dihapus sebelum foto dijadikan referensi, sementara papan nama, perlengkapan, dan pencahayaan akan dipertahankan. Ini bukan karena alasan sensitif: model video akan menyalin gambar referensi hampir secara harfiah, jadi jika ada pelanggan di foto toko Anda, mereka bisa ikut tampil di iklan Anda.
Di kartu penutup, ya, bersama dengan nama produk, slogan, dan ajakan bertindak, dalam bahasa iklan tersebut. Di dalam cuplikan video yang dihasilkan, tidak — model video AI belum bisa mengeja dengan andal, jadi iklan dibuat tanpa teks di layar daripada mengambil risiko hasil yang salah.
Dialog lisan dan kartu penutup akan mengikuti bahasa antarmuka Anda di lima belas bahasa dialog, dengan pemeran dan latar yang disesuaikan dengan pasar tersebut. Kartu penutup akan menggunakan bahasa yang bisa diatur tata letak hurufnya jika skrip membutuhkan penyesuaian atau tata letak kanan-ke-kiri.
Ya, sampai tahap video dimulai — di titik itulah panggilan model yang mahal dimulai, dan tombol batal tidak lagi berfungsi setelahnya. Jika satu tahap gagal, proses akan berhenti di sana, kredit untuk tahap tersebut akan dikembalikan, dan Anda bisa mengulang tahap itu tanpa mengulang tahap sebelumnya.
Baca foto secara gratis, lihat estimasi biaya, lalu putuskan.
Coba SceneMixer gratisPaket kredit mulai dari $1.49 · Pro $7.99/bln · Tanpa kartu kredit untuk memulai
Harga·Panduan·Contoh·Dukungan·Privasi·Ketentuan·Informasi hukum·Hubungi kami·© 2026 SceneMixer