वॉइस चेंजर

भावना और डिलीवरी बनाए रखते हुए आवाज़ों के बीच ऑडियो बदलने की गाइड।

जानकारी

वॉइस चेंजर (पहले स्पीच टू स्पीच) आपको मूल आवाज़ की टोन और डिलीवरी बनाए रखते हुए एक आवाज़ (सोर्स वॉइस) को दूसरी आवाज़ (क्लोन की गई वॉइस) में बदलने देता है।

वॉइस चेंजर का उपयोग टेक्स्ट टू स्पीच (TTS) के साथ किया जा सकता है। इससे उच्चारण की गलतियां ठीक की जा सकती हैं या वह खास प्रदर्शन जो आप चाहते हैं, जोड़ा जा सकता है। वॉइस चेंजर खास तौर पर आवाज़ की उन सूक्ष्म, अनोखी विशेषताओं को दोहराने में उपयोगी है जो उसे अधिक भावपूर्ण और मानवीय बनाती हैं। इसकी कुछ मुख्य सुविधाएं हैं:

  • फुसफुसाहट के साथ अधिक सटीकता
  • सुनाई देने वाली आहें, हंसी या रोने की आवाज़ें बनाने की क्षमता
  • टोन और भावनाओं की बेहतर पहचान
  • इनपुट की बोलने की लय का सटीक रूप से पालन
  • भाषा/ऐक्सेंट बनाए रखना

गाइड

वॉइस चेंजर डेमो

आप ऑडियो फ़ाइल सीधे अपलोड कर सकते हैं या माइक्रोफ़ोन से लाइव बोल सकते हैं। ऑडियो फ़ाइल का आकार 50mb से कम होना चाहिए और ऑडियो फ़ाइल या लाइव रिकॉर्डिंग की लंबाई 5 मिनट से ज़्यादा नहीं हो सकती।

अगर आपका मटीरियल 5 मिनट से लंबा है, तो हम उसे छोटे हिस्सों में बांटकर अलग-अलग जनरेट करने की सलाह देते हैं। इसके अलावा, अगर आपकी फ़ाइल का आकार बहुत बड़ा है, तो आपको उसे mp3 में कंप्रेस/कन्वर्ट करना पड़ सकता है।

मौजूदा ऑडियो फ़ाइल

मौजूदा ऑडियो फ़ाइल अपलोड करने के लिए, ऑडियो बॉक्स पर क्लिक करें या अपनी ऑडियो फ़ाइल को सीधे उस पर ड्रैग और ड्रॉप करें।

लाइव रिकॉर्ड करें

ऑडियो बॉक्स में रिकॉर्ड ऑडियो बटन दबाएं। फिर रिकॉर्डिंग शुरू करने के लिए तैयार होने पर माइक्रोफ़ोन बटन दबाएं। रिकॉर्डिंग पूरी होने पर स्टॉप बटन दबाएं।

इसके बाद आपको रिकॉर्डिंग की ऑडियो फ़ाइल दिखाई देगी, जिसे सुनने के लिए आप प्लेबैक कर सकते हैं। इससे आपको पता चलेगा कि आप अपने प्रदर्शन/रिकॉर्डिंग से खुश हैं या नहीं। कैरेक्टर की लागत नीचे-बाएं कोने में दिखाई देगी और सिर्फ़ रिकॉर्ड करने पर आपका कोटा खर्च नहीं होगा—केवल “जनरेट” दबाने पर होगा।

वॉइस चेंजर जनरेशन की लागत केवल अवधि के आधार पर है: 1000 कैरेक्टर प्रति मिनट।

सेटिंग्स

वॉइस चेंजर सेटिंग्स

अलग-अलग वॉइस सेटिंग्स के बारे में यहां और जानें।

वॉइस चेंजर आपकी रिकॉर्डिंग से बैकग्राउंड नॉइज़ को अपने-आप हटाने के लिए एक अतिरिक्त सेटिंग जोड़ता है।

समर्थित भाषाएं

eleven_english_sts_v2

हमारे multilingual v2 मॉडल्स 29 भाषाओं को support करते हैं:

अंग्रेज़ी (USA, UK, ऑस्ट्रेलिया, कनाडा), जापानी, चीनी, जर्मन, हिंदी, फ़्रेंच (फ़्रांस, कनाडा), कोरियाई, पुर्तगाली (ब्राज़ील, पुर्तगाल), इतालवी, स्पेनिश (स्पेन, मेक्सिको), इंडोनेशियाई, डच, तुर्की, फ़िलिपीनो, पोलिश, स्वीडिश, बल्गेरियाई, रोमानियाई, अरबी (सऊदी अरब, UAE), चेक, यूनानी, फ़िनिश, क्रोएशियाई, मलय, स्लोवाक, डेनिश, तमिल, यूक्रेनी और रूसी।

eleven_english_sts_v2 मॉडल केवल अंग्रेज़ी को सपोर्ट करता है।

मॉडल के बारे में और जानें

सर्वोत्तम तरीके

वॉइस चेंजर अलग-अलग आउटपुट वॉइस में ऐक्सेंट और बोलने की स्वाभाविक लय बनाए रखने में बेहतरीन है। उदाहरण के लिए, अगर आप पुर्तगाली ऐक्सेंट वाला ऑडियो सैंपल अपलोड करते हैं, तो आउटपुट उस भाषा और ऐक्सेंट को बनाए रखेगा। इनपुट सैंपल अहम है, क्योंकि वही आउटपुट की विशेषताएं तय करता है। अगर आप “George” जैसी ब्रिटिश वॉइस चुनते हैं, लेकिन अमेरिकी ऐक्सेंट में रिकॉर्ड करते हैं, तो नतीजा अमेरिकी ऐक्सेंट में George की आवाज़ होगा।

  • अभिव्यक्ति: अपनी रिकॉर्डिंग में भावपूर्ण रहें। चाहे चिल्लाना हो, रोना हो या हंसना, वॉइस चेंजर आपके प्रदर्शन को सटीक रूप से दोहराएगा। यह टूल AI को अधिक वास्तविक बनाने और रचनात्मक अभिव्यक्ति के लिए बनाया गया है।
  • माइक्रोफ़ोन गेन: इनपुट गेन सही रखें। धीमी रिकॉर्डिंग AI की पहचान में बाधा डाल सकती है, जबकि बहुत तेज़ रिकॉर्डिंग से ऑडियो क्लिपिंग हो सकती है।
  • बैकग्राउंड नॉइज़: अपनी रिकॉर्डिंग से बैकग्राउंड नॉइज़ अपने-आप हटाने के लिए रिमूव बैकग्राउंड नॉइज़ विकल्प चालू करें।

अक्सर पूछे जाने वाले सवाल

वॉइस चेंजर, जिसे पहले स्पीच टू स्पीच कहा जाता था, आपको मूल वॉइस के टोन और डिलीवरी को बरकरार रखते हुए एक वॉइस (सोर्स वॉइस) को दूसरी वॉइस (क्लोन की गई वॉइस) में बदलने देता है।

संभावनाएँ अनंत हैं। उच्चारण ठीक करके या अपनी मनचाही खास परफ़ॉर्मेंस जोड़कर इसका इस्तेमाल टेक्स्ट टू स्पीच को बेहतर बनाने के लिए किया जा सकता है। इसका इस्तेमाल वॉइस ऐक्टर को अलग-अलग वॉइस और टोन का विस्तृत चयन देकर उनकी रेंज बढ़ाने में भी किया जा सकता है। हम डबिंग के लिए एंड-टू-एंड समाधान देते हैं, लेकिन अगर आप फिर भी पारंपरिक तरीके से डब करना चाहते हैं, तो अपने प्रोजेक्ट के लिए सही वॉइस पाने में वॉइस चेंजर का फ़ायदा उठा सकते हैं।

बदले जा सकने वाले ऑडियो की अधिकतम लंबाई 5 मिनट है। मौजूदा कीमतों के लिए ElevenCreative और ElevenAPI देखें।

ज़्यादा जानकारी के लिए, हमारी गाइड देखें।

वॉइस चेंजर, जिसे पहले स्पीच टू स्पीच कहा जाता था, की कीमत इस बात पर निर्भर करती है कि आप वेबसाइट से जनरेट करते हैं या API से।

मौजूदा दरों के लिए ElevenCreative और ElevenAPI देखें।

वॉइस चेंजर, जिसे पहले स्पीच टू स्पीच कहा जाता था, इस्तेमाल करते समय मौजूदा अधिकतम इनपुट लंबाई 300 सेकंड या 5 मिनट का ऑडियो है। यह सभी सब्सक्रिप्शन में समान है।

वॉइस चेंजर के लिए इनपुट ऑडियो के तौर पर इन फ़ाइल फ़ॉर्मैट का इस्तेमाल किया जा सकता है।

ऑडियो:

  • MP3
  • M4A
  • FLAC
  • OGA
  • OGG
  • WAV

वीडियो:

  • MKV
  • WEBM
  • MP4
  • MOV

आप जनरेट की गई फ़ाइलों को दो तरीकों से डाउनलोड कर सकते हैं:

कंटेंट जनरेट करने के बाद नीचे दाईं ओर मौजूद डाउनलोड बटन पर क्लिक करके आप जनरेट की गई फ़ाइल को तुरंत डाउनलोड कर सकते हैं।

पहले जनरेट की गई फ़ाइलें आपकी हिस्ट्री से डाउनलोड की जा सकती हैं। हिस्ट्री देखने के लिए अपने अकाउंट में लॉग इन करें और साइडबार में वॉइस चेंजर चुनें, फिर स्क्रीन के दाईं ओर के पैनल में History टैब पर क्लिक करें।

आप डाउनलोड बटन पर क्लिक करके अपनी हिस्ट्री से किसी भी फ़ाइल को MP3 या WAV फ़ाइल के रूप में डाउनलोड कर सकते हैं। डाउनलोड के अतिरिक्त विकल्पों के लिए Advanced पर क्लिक करें।

No results