वॉइस चेंजर

भावना और डिलीवरी को बनाए रखते हुए वॉइस के बीच ऑडियो बदलना सीखें।

ओवरव्यू

ElevenLabs वॉइस चेंजर API आपको किसी भी सोर्स ऑडियो (रिकॉर्ड किए गए या अपलोड किए गए) को मूल परफ़ॉर्मेंस की बारीकियां खोए बिना, एक अलग और पूरी तरह क्लोन की गई वॉइस में बदलने देता है। यह फुसफुसाहट, हंसी, रोने, एक्सेंट और भावनाओं के सूक्ष्म संकेतों को कैप्चर कर सकता है, ताकि बेहद वास्तविक और मानवीय एहसास मिले। आप इसका इस्तेमाल इन कामों के लिए कर सकते हैं:

  • भावनात्मक डिलीवरी और बारीकियां बनाए रखते हुए किसी भी वॉइस को बदलें
  • कई भाषाओं और रिकॉर्डिंग सेशन में एक जैसे कैरेक्टर वॉइस बनाएं
  • मौजूदा रिकॉर्डिंग में खास शब्दों और वाक्यांशों को ठीक करें या बदलें

अपने प्रोजेक्ट के लिए सही वॉइस खोजने के लिए हमारी वॉइस लाइब्रेरी देखें।

समर्थित भाषाएं

हमारे multilingual v2 मॉडल्स 29 भाषाओं को support करते हैं:

अंग्रेज़ी (USA, UK, ऑस्ट्रेलिया, कनाडा), जापानी, चीनी, जर्मन, हिंदी, फ़्रेंच (फ़्रांस, कनाडा), कोरियाई, पुर्तगाली (ब्राज़ील, पुर्तगाल), इतालवी, स्पेनिश (स्पेन, मेक्सिको), इंडोनेशियाई, डच, तुर्की, फ़िलिपीनो, पोलिश, स्वीडिश, बल्गेरियाई, रोमानियाई, अरबी (सऊदी अरब, UAE), चेक, यूनानी, फ़िनिश, क्रोएशियाई, मलय, स्लोवाक, डेनिश, तमिल, यूक्रेनी और रूसी।

eleven_english_sts_v2 मॉडल सिर्फ़ अंग्रेज़ी सपोर्ट करता है।

मुख्य बातें

  • अधिकतम सेगमेंट लंबाई: 5 मिनट — लंबी रिकॉर्डिंग को हिस्सों में बांटें
  • बिलिंग: प्रोसेस किए गए ऑडियो के प्रति मिनट 1,000 कैरेक्टर
  • बैकग्राउंड शोर: आउटपुट में परिवेश की आवाज़ कम करने के लिए remove_background_noise=true इस्तेमाल करें
  • मॉडल सुझाव: eleven_multilingual_sts_v2, अंग्रेज़ी कॉन्टेंट के लिए भी, अक्सर eleven_english_sts_v2 से बेहतर परफ़ॉर्म करता है
  • कस्टम वॉइस: आपकी लाइब्रेरी में किसी भी क्लोन या डिज़ाइन की गई वॉइस को आउटपुट वॉइस के रूप में इस्तेमाल किया जा सकता है; उसका voice_id दें