Contoh Text to Video Lip Sync ini dimulai dari video bicara alami. Alih-alih mengunggah kalimat akhir sebagai audio, kami mengkloning suara dari sampel singkat lalu mengganti ucapan dengan teks.
Video sumber
Berikut video sumber untuk tutorial ini.
Syarat video sumber
- Video bicara alami bekerja paling baik dan tidak harus memuat kalimat akhir.
- Durasi sekitar 5 detik hingga beberapa menit cocok.
- Wajah sebaiknya terlihat pada sebagian besar adegan.
- Gerakan kecil dan wajar membantu.
- Hindari gestur berlebihan, putaran mendadak, atau aksi besar.
Jika merekam khusus untuk alur ini, buat sederhana dan alami. Mengucapkan “satu, dua, tiga” sudah cukup; Anda tidak perlu menghafal skrip akhir di depan kamera.
Referensi suara
Sampel singkat ini digunakan untuk mengkloning gaya bicara:
Input referensi suara
Skrip pengganti
Berikut skrip Inggris yang benar-benar digunakan dalam demo; teks asli dipertahankan agar sesuai dengan hasil:
That's it for today! Isn't this incredible? It's free, it's fast, it's u* — and you can even generate lip sync videos up to 60 minutes long.
Alur ini berguna saat:
- Ingin mengubah kalimat tanpa merekam audio baru.
- Perlu melokalkan atau memperbaiki satu kalimat dengan cepat.
- Ingin ucapan baru mempertahankan identitas suara yang dipilih.
Hasil generasi
Hasil ini menggabungkan video sumber, referensi suara, dan skrip baru:
Yang ditunjukkan tutorial ini
- Satu video alami dapat digunakan lagi untuk kalimat yang sepenuhnya baru.
- Referensi suara singkat cukup untuk menentukan identitas suara.
- Penulisan ulang paling baik saat gerakan sumber tenang dan wajar.
Cara membuat ulang alur ini
- Buka Text to Video Lip Sync.
- Unggah video bicara alami dengan satu wajah jelas.
- Unggah referensi suara singkat untuk kloning.
- Tempel skrip baru.
- Buat hasil dan periksa apakah ucapan baru terlihat wajar pada adegan asli.



