ऑडियो फ़ाइल कैसे बनाएँ
निर्माण की प्रक्रिया सरल है:
- टेक्स्ट दर्ज करना : इनपुट बॉक्स में अपना टेक्स्ट लिखें या पेस्ट करें।
नोट : टेक्स्ट इनपुट (text input) अत्यंत महत्वपूर्ण है। अच्छा और उच्च-गुणवत्ता वाला इनपुट ही अच्छे आउटपुट (output) का परिणाम देता है।
- आवाज़ का चयन : अपनी आवाज़ों की सूची में से उस आवाज़ को चुनें जिसका आप उपयोग करना चाहते हैं।
सलाह : यदि आप खुशमिजाज आवाज़ चाहते हैं, तो खुशमिजाज नमूनों (samples) से तैयार की गई आवाज़ चुनें; यदि आप कोई विशिष्ट लहजा चाहते हैं, तो उस लहजे के लिए प्रशिक्षित आवाज़ चुनें।
- सेटिंग्स को समायोजित करना : गति या रचनात्मकता गुणांक (creativity factor) जैसी सेटिंग्स को कॉन्फ़िगर करें (इनका विवरण 'ध्वनि और प्रदर्शन नियंत्रण' में दिया गया है)।
- बनाएं : अपनी ऑडियो फ़ाइल बनाने के लिए 'जनरेट' ( Generate ) बटन पर क्लिक करें।
ध्वनि उत्पन्न करने के मोड और परिदृश्य
सबसे महत्वपूर्ण कदम यह तय करना है कि क्या आप 'भावनाओं और लहजों' (emotions and accents) वाले मोड को सक्षम करने का विकल्प चुनना चाहते हैं, क्योंकि इससे आपके टेक्स्ट को समझने का आर्टिफिशियल इंटेलिजेंस का तरीका बदल जाएगा।
परिदृश्य A: अभिव्यक्तात्मक और व्यक्तिगत सामग्री (भावनाओं को सक्षम करने के साथ)
यह गेम्स, एनिमेशन और ऑडियोबुक्स के लिए आदर्श है, जहाँ पात्रों के बीच भावनात्मक दायरे और आपसी संवाद की आवश्यकता होती है।
- क्षमताएँ : व्यापक भावनात्मक दायरे (हँसी, फुसफुसाहट आदि) के साथ स्वाभाविक और यथार्थवादी संवाद उत्पन्न करना।
- भाषाएँ : यह 70 से अधिक भाषाओं का समर्थन करता है, जिनमें शामिल हैं: अफ़्रीकी, अरबी, अर्मेनियाई, असमिया, अज़ेरी, बेलारूसी, बंगाली, बोस्नियाई, बल्गेरियाई, कैटलन, सेबुअनो, चिचेवा, क्रोएशियाई, चेक, डेनिश, डच, अंग्रेज़ी, एस्टोनियाई, फ़िलिपिनो, फ़िनिश, फ़्रेंच, गैलिशियन्, जॉर्जियाई, जर्मन, ग्रीक, गुजराती, हौसा, हिब्रू, हिंदी, हंगेरियन, आइसलैंडिक, इंडोनेशियाई, आयरिश, इतालवी, जापानी, जावानीस, कन्नड़, कज़ाख, किर्गिज़, कोरियाई, लातवियाई, लिंगाला, लिथुआनियाई, लक्ज़मबर्गिश, मैसेडोनियन, मलय, मलयालम, मंदारिन चीनी, मराठी, नेपाली, नार्वेजियन, पश्तो, फ़ारसी, पोलिश, पुर्तगाली, पंजाबी, रोमानियाई, रूसी, सर्बियाई, सिंधी, स्लोवाक, स्लोवेनियाई, सोमाली, स्पेनिश, स्वाहिली, स्वीडिश, तमिल, तेलुगु, थाई, तुर्की, यूक्रेनी, उर्दू, वियतनामी, वेल्श।
- सीमाएँ :
- प्रति अनुरोध अक्षरों की अधिकतम संख्या: 3000
- अनुमानित समय: 3 मिनट
परिदृश्य B: पेशेवर और स्थिर सामग्री (भावनाएँ निष्क्रिय)
यह कॉर्पोरेट वीडियो, ई-लर्निंग सामग्री और ऐसे परिदृश्यों के लिए बिल्कुल उपयुक्त है जिनमें एकसमान ध्वनि गुणवत्ता की आवश्यकता होती है।
- क्षमताएँ : यह वक्ता की विशिष्ट विशेषताओं को बनाए रखते हुए सुसंगत ध्वनि गुणवत्ता और व्यक्तित्व प्रदान करती है।
- भाषाएँ : यह 29 भाषाओं का समर्थन करता है: अंग्रेज़ी (संयुक्त राज्य अमेरिका, यूनाइटेड किंगडम, ऑस्ट्रेलिया, कनाडा), जापानी, चीनी, जर्मन, हिंदी, फ़्रेंच (फ़्रांस, कनाडा), कोरियाई, पुर्तगाली (ब्राज़ील, पुर्तगाल), इतालवी, स्पेनिश (स्पेन, मैक्सिको), इन्डोनेशियाई, डच, तुर्की, फ़िलिपिनो, पोलिश, स्वीडिश, बल्गेरियाई, रोमानियाई, अरबी (सऊदी अरब, संयुक्त अरब अमीरात), चेक, ग्रीक, फ़िनिश, क्रोएशियाई, मलय, स्लोवाक, डेनिश, तमिल, यूक्रेनी, रूसी।
- सीमाएँ :
- प्रति अनुरोध अधिकतम अक्षर: 1500
- अनुमानित समय: ~डेढ़ मिनट
'मकना' (Makna) गाइड में अगले लेख पर जाएँ।