आवाज़ की नकल (Voice Cloning)
उच्च गुणवत्ता वाली कस्टम आवाज़ बनाने के लिए, इनपुट ध्वनि (प्रशिक्षण डेटा) का अत्यंत स्पष्ट होना आवश्यक है।
- रिकॉर्डिंग का स्थान (Recording Location):
- कमरे में गूंज (echo) को कम करें। साउंड बूथ, कपड़ों की अलमारी या कंबल से 'किला' बनाकर कमरे की आवाज़ को नियंत्रित (dampen) करें।
- उपकरण (Equipment):
- माइक्रोफ़ोन: एक पेशेवर XLR माइक्रोफ़ोन (150-300 डॉलर की रेंज में, जैसे Audio-Technica AT2020 या Rode NT1) इस्तेमाल करने की सलाह दी जाती है।
- ऑडियो इंटरफ़ेस (Interface): USB इंटरफ़ेस (जैसे Focusrite) का उपयोग करें।
- पॉप-फ़िल्टर (Pop-Filter): विस्फोटक ध्वनियों (माइक्रोफ़ोन से हवा के टकराने) से बचने के लिए आवश्यक।
- सॉफ्टवेयर (Software/DAW):
- REAPER या Audacity जैसे प्रोग्राम का उपयोग करें।
- सेटिंग्स: WAV फ़ाइलों को 44.1kHz या 48kHz की सैम्पल रेट और 24-bit की डेप्थ पर रिकॉर्ड करें।
- लेवल्स: ऑडियो पीक्स (Peaks) को -6 dB से -3 dB के बीच और औसत वॉल्यूम को -18 dB रखने का लक्ष्य रखें।
- स्थिति-निर्धारण (Positioning):
- माइक्रोफ़ोन से लगभग 20 सेमी (दो मुट्ठियों के बराबर) की दूरी बनाए रखें।
- माइक्रोफ़ोन में सीधे सांस जाने से बचने के लिए तिरछे कोण से बात करें।
- प्रदर्शन (Performance):
- निरंतरता: पूरी प्रक्रिया के दौरान एक जैसी ऊर्जा/स्वर बनाए रखें। प्रशिक्षण फ़ाइल में फुसफुसाहट और चिल्लाने को आपस में न मिलाएं।
आर्टिफिशियल इंटेलिजेंस हर चीज़ की नकल करता है, जिसमें सांसें, हकलाहट और हिचकिचाहट वाली आवाज़ें (जैसे 'अम्ममम') भी शामिल हैं। सुनिश्चित करें कि परफॉर्मेंस बिल्कुल वैसी ही हो जैसी आप हूबहू नकल करना चाहते हैं।
'मकना' (Makna) गाइड में अगले लेख पर जाएँ।
خ