किसी मौजूदा वीडियो को दूसरी भाषा में डब करने के लिए पहले अनुवाद तैयार करके उसकी समीक्षा करें। फिर AI Video Dubbing में लक्ष्य भाषा की तैयार रिकॉर्डिंग अपलोड करें, या अनूदित पाठ के साथ उपयुक्त आवाज़ चुनें। FreeLipSync नए भाषण के अनुसार वीडियो में दिख रहे व्यक्ति के होंठ मिलाता है; यह चरण मूल भाषण का अपने आप अनुवाद नहीं करता।
इस उदाहरण में अंग्रेज़ी प्रस्तुतकर्ता के वीडियो को स्पेनिश में डब किया गया है। अनुवाद पहले से तैयार था और तैयार स्पेनिश ऑडियो Audio मोड में लगाया गया। Text मोड कब चुनना है, यह भी नीचे बताया गया है।
AI से वीडियो डब करने की ज़रूरत कब पड़ती है?
रिकॉर्ड हो चुकी जानकारी दूसरी भाषा के दर्शकों तक पहुँचाना
पाठ की भूमिका, उत्पाद का परिचय, सहायता वीडियो या क्षेत्रीय घोषणा देखने में ठीक हो सकती है, लेकिन दूसरे दर्शकों को अपनी भाषा चाहिए। डबिंग से व्यक्ति, स्थान, हावभाव और चेहरे की अभिव्यक्ति बनी रहती है; नया शूट करने की ज़रूरत घटती है। धाराप्रवाह बोलने वाले व्यक्ति से अर्थ, शब्दावली, नाम, अंक और लहजा जँचवाएँ। यदि प्रस्तुतकर्ता किसी चीज़ की ओर इशारा करता है, तो उस पल नया वाक्य भी उसके अनुरूप होना चाहिए।
एक शूट से कई भाषाओं के संस्करण बनाना
अनुमति प्राप्त एक ही वीडियो अलग-अलग भाषाओं के संस्करणों का आधार बन सकता है। हर भाषा के लिए जाँची हुई स्क्रिप्ट और उसकी आवाज़ चाहिए, पर कैमरा, रोशनी और प्रस्तुतकर्ता का शूट दोहराना नहीं पड़ता। परिणाम में असल में रिकॉर्ड हुए हावभाव और भाव-भंगिमाएँ बनी रहती हैं; पूरी शारीरिक प्रस्तुति फिर से नहीं बनती। इसलिए स्वाभाविक और कई संदेशों में उपयोगी लगने वाली गतिविधि चुनें। यहाँ सिर्फ़ अंग्रेज़ी से स्पेनिश का उदाहरण है, अपने आप कई भाषाओं में अनुवाद का नहीं।
होंठ मिलाने से पहले उच्चारण और गति तय करना
तैयार रिकॉर्डिंग से अनुवादक, वॉइस आर्टिस्ट या निर्माता विराम, ज़ोर और उच्चारण पहले ही तय कर सकते हैं। अंतिम ऑडियो न हो तो Text मोड में जाँचा हुआ अनुवाद डालकर संबंधित भाषा की प्रीसेट आवाज़ या अनुमति प्राप्त क्लोन आवाज़ चुनें। उसी भाषा में संवाद बदलने के लिए नई स्क्रिप्ट वाला ट्यूटोरियल देखें। ऑडियो पहले से हो और अनुवाद की प्रक्रिया न चाहिए तो अपलोड किए ऑडियो वाला ट्यूटोरियल देखें।
वास्तविक उदाहरण: अंग्रेज़ी स्रोत से स्पेनिश परिणाम
स्रोत इस प्रदर्शन के लिए बनाई गई काल्पनिक प्रस्तुतकर्ता की क्लिप है। अंग्रेज़ी वीडियो लगभग 7.96 सेकंड का है और इसमें कहा गया है:
Hello and welcome. In this short update, I will explain how our new workflow helps global teams share clear product messages.
होंठों का तालमेल बनाने से पहले यह स्पेनिश अनुवाद तैयार करके जाँचा गया:
Hola y bienvenidos. En esta breve actualización, explicaré cómo nuestro nuevo flujo de trabajo ayuda a los equipos globales a compartir mensajes de producto claros.
मौजूदा स्पेनिश प्रीसेट आवाज़ से लगभग 8.98 सेकंड की अंतिम रिकॉर्डिंग बनाई गई। यही डबिंग में दी गई ऑडियो फ़ाइल है; इसे अंग्रेज़ी वीडियो से नहीं निकाला गया:
उदाहरण का तैयार स्पेनिश ऑडियो
यह लगभग नौ सेकंड का बिना मैनुअल सुधार वाला परिणाम है। आवाज़ को स्पेनिश पाठ से और व्यक्ति की गतिविधि को अंग्रेज़ी स्रोत से मिलाकर देखें।
बिना मैनुअल सुधार वाला स्पेनिश परिणाम
स्पेनिश भाषण अंग्रेज़ी स्रोत से लगभग एक सेकंड लंबा है और परिणाम नई ऑडियो अवधि के अनुरूप है। केवल अवधि बराबर करने के लिए अनुवाद छोटा करना ज़रूरी नहीं है। सिस्टम रिकॉर्ड की गई प्रस्तुति के उपयुक्त हिस्से मिला सकता है। फिर भी जाँचें कि हावभाव और चेहरे के भाव नए अर्थ के साथ स्वाभाविक हैं।
तैयार ऑडियो से अपना डब कैसे बनाएँ
- उपयोग की अनुमति वाला वीडियो चुनें। वीडियो और दिखाई देने वाले व्यक्ति के अधिकार जाँचें। गतिविधि और अभिव्यक्ति अनुवाद से मेल खानी चाहिए; लंबी क्लिप या हर समय सामने दिखता मुँह अनिवार्य नहीं है।
- अनुवाद की समीक्षा करें। अर्थ, नाम, अंक, शब्दावली, लहजा और स्क्रीन पर दिख रही वस्तुओं या क्रियाओं से मेल जाँचें।
- अंतिम ऑडियो तैयार करें। अनुमति प्राप्त कलाकार को रिकॉर्ड करें या भाषा के अनुरूप प्रीसेट अथवा अनुमति प्राप्त क्लोन आवाज़ से पाठ पढ़वाएँ। अपलोड से पहले पूरा ऑडियो सुनें।
- अपलोड करके बनाएँ। AI Video Dubbing में स्रोत वीडियो डालें, Audio चुनें, तैयार रिकॉर्डिंग जोड़ें और परिणाम बनाएँ। इस उदाहरण में यही तरीका है।
- साझा करने से पहले जाँचें। शब्द, उच्चारण, हावभाव, स्क्रीन का पाठ, ध्वनि-मिश्रण और प्रकाशन की अनुमति जाँचें।
लंबे वीडियो का केवल एक हिस्सा बदलना हो तो वह हिस्सा अलग निकालें और परिणाम को फिर संपादन में जोड़ें। यह प्रक्रिया पूरी टाइमलाइन में अपने आप वाक्य नहीं ढूँढ़ती, स्क्रीन का पाठ नहीं बदलती और न ही उपशीर्षक या अंतिम संगीत-मिश्रण बनाती है।
अनूदित पाठ कब इस्तेमाल करें?
अनुवाद स्वीकृत है लेकिन अंतिम रिकॉर्डिंग नहीं है तो Text चुनें। पाठ चिपकाकर सही भाषा की प्रीसेट या अनुमति प्राप्त क्लोन आवाज़ चुनें; टूल भाषण बनाकर होंठ मिलाएगा। स्वीकृत रिकॉर्डिंग की गति और उच्चारण बनाए रखने हों तो Audio लें। दोनों तरीके मूल वीडियो की शारीरिक गतिविधि और अभिव्यक्ति रखते हैं। छोटा स्रोत भी लंबी बात के काम आ सकता है, पर किसी खास पल से जुड़े हावभाव परिणाम में जाँचें। मौजूदा सीमा मूल्य पृष्ठ पर देखें।
अक्सर पूछे जाने वाले प्रश्न
क्या FreeLipSync अंग्रेज़ी को अपने आप स्पेनिश में अनुवाद करता है?
नहीं। इस उदाहरण का स्पेनिश पाठ पहले तैयार और जाँचा गया था। टूल नई आवाज़ को वीडियो से मिलाता है।
उदाहरण Text में बना या Audio में?
Audio में। स्पेनिश प्रीसेट आवाज़ की तैयार रिकॉर्डिंग अपलोड की गई। Text जाँचे हुए अनुवाद से आवाज़ बनाता है।
क्या नई रिकॉर्डिंग स्रोत जितनी ही लंबी होनी चाहिए?
नहीं। अंग्रेज़ी स्रोत लगभग आठ सेकंड और स्पेनिश ऑडियो तथा परिणाम लगभग नौ सेकंड के हैं। हावभाव स्वाभाविक लग रहे हैं या नहीं, देखें।
क्या वॉइस आर्टिस्ट की रिकॉर्डिंग अपलोड कर सकते हैं?
हाँ, Audio मोड में। आवाज़ और वीडियो में दिख रहे व्यक्ति के उपयोग की आवश्यक अनुमति लें।
अंतिम अपडेट:



