Eleven v4 Audio Tags सूची: इन्हें आज़माएं, फिर अपने टैग लिखें
- लेखक
- Jack Limebear
- प्रकाशित
सुनेंइस आर्टिकल को सुनें
Eleven v4 एक बेहतरीन टेक्स्ट टू स्पीच मॉडल है, जो टेक्स्ट को एक परफ़ॉर्मेंस में बदल देता है। Audio Tags से आप उसके भावनात्मक आउटपुट पर बारीकी से नियंत्रण रखते हुए परफ़ॉर्मेंस को निर्देशित कर सकते हैं। [whispers] या [excited] जैसे ब्रैकेट वाले प्राकृतिक-भाषा संकेत डालें और सुनें कि v4 उसी हिसाब से डिलीवरी कैसे बदलता है।
यह ElevenLabs Audio Tags सूची पूरे Eleven v4 इमोशनल रेंज की हर भावना के साथ-साथ डिलीवरी, गति, प्रतिक्रियाओं, ऐक्सेंट और साउंड इफेक्ट्स के टैग भी कवर करती है। बुनियादी बातें जानने के बाद, हम आपको सादे शब्दों में अपने टैग लिखना भी दिखाएंगे।
Eleven v4 की भावनाएं जानें
रेंज सुनेंसारांश
- Audio Tags, स्क्वेयर ब्रैकेट में लिखे प्राकृतिक-भाषा संकेत हैं जिन्हें Eleven v4 परफ़ॉर्मेंस निर्देश के रूप में पढ़ता है और उनके बाद आने वाले शब्दों की डिलीवरी बदल देता है।
- Eleven v4, Artificial Analysis Speech Arena [September 2026] में सबसे उच्च रैंक वाला मॉडल है और Audio Tags से आप उस परफ़ॉर्मेंस को लाइन दर लाइन निर्देशित कर सकते हैं।
- Eleven v4 इमोशनल रेंज व्हील आपको मॉडल की क्षमताओं का तुरंत अंदाज़ा पाने के लिए अलग-अलग भावनाएं सुनने देता है।
- टैग किसी तय सूची तक सीमित नहीं हैं। यानी आप [whispering, fearful] जैसे गुणों को मिलाकर या किसी लाइन के पीछे की स्थिति या किरदार बताकर अपने टैग लिख सकते हैं।
- Audio Tags, ElevenAPI के ज़रिए Eleven v4, Eleven v4 Turbo और Eleven v3 पर काम करते हैं।
ElevenLabs Audio Tags क्या हैं?
Audio Tags प्राकृतिक-भाषा संकेत हैं जिन्हें आप स्क्वेयर ब्रैकेट में अपनी लिखी सामग्री में जोड़ सकते हैं। Eleven v4 इन्हें परफ़ॉर्मेंस मार्कर की तरह पढ़ता है और निर्देश के तौर पर इस्तेमाल करके कुछ शब्दों या वाक्यांशों को बोलने का तरीका बदल देता है। आप इन्हें अपनी स्क्रिप्ट के साथ ElevenLabs टेक्स्ट टू स्पीच ऐप में इनलाइन लिखते हैं और देखते हैं कि हमारे मॉडल इन्हें कैसे जीवंत बनाते हैं।
Eleven v4 Artificial Analysis Speech Arena में सबसे उच्च रैंक वाला TTS मॉडल है, जहां श्रोता सबसे स्वाभाविक लगने वाले टेक्स्ट टू स्पीच के लिए वोट देते हैं।1 Audio Tags से आप हर लाइन की डिलीवरी को ठीक-ठीक निर्देश देकर उस परफ़ॉर्मेंस को और आगे ले जा सकते हैं।
स्क्रिप्ट में Audio Tags इस्तेमाल करने का तरीका:
- जिस शब्द पर असर डालना हो, उसके पहले टैग लगाएं: जब आप लिखते हैं, “[shouts] मुझे यकीन नहीं हो रहा कि तुमने मुझसे ऐसा कहा,” तो पूरी लाइन चिल्लाकर बोली जाती है।
- भावना आगे तक बनी रहती है: जब आप टैग जोड़ते हैं, तो उसकी भावना पूरी लाइन में आगे तक रहती है। इसलिए आपको दूसरा टैग केवल तभी जोड़ना होता है जब आप डिलीवरी बदलना चाहते हैं। उदाहरण के लिए, “[proud] मैं एक दशक से खाना बना रहा हूं। मुझे अंडा उबालना आता है। [startled] यह जलने की कैसी गंध है?"
- निर्देशों की परतें बनाने के लिए टैग मिलाएं: अपनी TTS परफ़ॉर्मेंस में बारीकी जोड़ने के लिए एक ही ब्रैकेट के अंदर Audio Tags को कॉमा से अलग करें, जैसे [whispering, playful]।
- टैग को विराम चिह्नों के साथ इस्तेमाल करें: Audio Tags मूड और डिलीवरी तय करते हैं, जबकि स्क्रिप्ट में विराम चिह्नों से आप स्वाभाविक रूप से गति नियंत्रित कर सकते हैं। किसी लाइन की प्रोसोडी को आकार देने के लिए इलिप्सिस, डैश या कैपिटल अक्षर जोड़ें।
टैग कैसे काम करते हैं और वे SSML की जगह कैसे लेते हैं, इसकी गहरी जानकारी के लिए हमने Audio Tags पर पूरी गाइड लिखी है।

इमोशन Audio Tags सूची
Eleven v4 इमोशन व्हील में दर्जनों भावनाएं हैं, जिन्हें v4 ने परफ़ॉर्म किया है ताकि आप एक भी टैग लिखने से पहले अंतर सुन सकें।
व्हील पर सुनने के लिए नीचे किसी भी भावना पर क्लिक करें, या Eleven v4 को इमोशनल Audio Tags के साथ जीवंत होते सुनने के लिए वाक्य और भावना के साथ सीधे प्रयोग करें।
भावनात्मक श्रेणी | इमोशन Audio Tags |
उच्च ऊर्जा | [excited], [playful], [amazed], [powerful], [proud], [optimistic], [startled] |
उत्तेजित | |
तनावपूर्ण | [anxious], [stressed], [scared], [threatened], [vulnerable], [confused], [busy] |
कम ऊर्जा | |
शांत और विचारशील |
हालांकि यहां हमने कुछ ही भावनाएं दिखाई हैं, आप अपनी पसंद की किसी भी भावना को प्राकृतिक भाषा से इस्तेमाल कर सकते हैं। नीचे के उदाहरण में हमने ऊपर न दिए गए कई Audio Tags का इस्तेमाल किया है, ताकि दिखा सकें कि प्राकृतिक-भाषा प्रॉम्प्टिंग से आप क्या कर सकते हैं।
इस सैंपल को Jonathan Livingston ने जीवंत बनाया।
डिलीवरी और वॉल्यूम Audio Tags सूची
डिलीवरी और वॉल्यूम टैग यह नियंत्रित करते हैं कि कोई लाइन कितनी तेज़ या तीव्र सुनाई दे, चाहे आपने उसके साथ कोई भी भावना जोड़ी हो। अगर आप v4 से अपने अधिक खास विज़न के अनुसार काम करवाना चाहते हैं, तो बारीक नियंत्रण के लिए डिलीवरी और इमोशन टैग की परतें जोड़ें।
यहां कुछ उदाहरण दिए गए हैं:
- [whispers] हिलना मत, वह तुम्हारे ठीक पीछे है।
- [shouts] सब लोग अभी इमारत खाली करें!
- [softly] आपने अपनी तरफ़ से सब कुछ किया।
- [quietly] मुझे लगता है वे चले गए हैं।
- [low, threatening] आपको यहां सच में नहीं आना चाहिए था।
आइए, वॉल्यूम और डिलीवरी कंट्रोल को काम करते हुए देखें।
ऊपर के सैंपल को Rod ने जीवंत बनाया।
पेसिंग Audio Tags सूची
पेसिंग Audio Tags किसी लाइन की गति बदलते हैं। सस्पेंस बनाने या बेहतरीन कॉमिक पल तैयार करने के लिए इन्हें जोड़ें। जब टाइमिंग शब्दों जितनी ही ज़रूरी हो, तो पेसिंग टैग इस्तेमाल करें।
एक अतिरिक्त सुझाव: विराम चिह्न स्वाभाविक रूप से टेक्स्ट टू स्पीच परफ़ॉर्मेंस में मदद करते हैं, इसलिए वाक्य पर पूरा नियंत्रण रखने के लिए दोनों का साथ में इस्तेमाल करें:
- [slowly] और विजेता है...
- [rushed] माफ़ कीजिए, मुझे देर हो गई, ट्रेन खराब हो गई थी, मैं पूरे रास्ते दौड़ा।
- [pause] फिर फ़ोन बजा।
- [drawn out] नहींईई, ऐसा नहीं हो सकता।
Adam वह आवाज़ थे जिसने इस सैंपल को जीवंत बनाया।
मानव-जैसी प्रतिक्रिया Audio Tags सूची
रिएक्शन टैग आपके वाक्यों में हंसी, हांफने, रोने, खांसने और आह भरने जैसी आवाज़ें जोड़ते हैं। ये आपके टेक्स्ट को सच में जीवंत बनाते हैं और TTS ऑडियो सैंपल को स्क्रिप्ट पढ़ने के बजाय किसी व्यक्ति के सहज बोलने जैसा स्वाभाविक बनाते हैं।
यहां कुछ रिएक्शन Audio Tags दिए गए हैं:
- [laughs] तुम सच में इसके झांसे में आ गए?
- [sighs] ठीक है। मैं बर्तन धो दूंगा।
- [gasps] क्या वह असली हीरा है?
- [clears throat] अगर मैं सबका ध्यान चाह सकूं।
- [crying] मैंने नहीं सोचा था कि तुम वापस आओगे।
जब भावना की ज़रूरत होती है, Eleven v4 अपने-आप छोटे मानवीय स्पर्श भी जोड़ता है। इमोशन व्हील सुनें और आपको “त- तुम वापस आ गए?” और “उफ़, यह सच है?” जैसी लाइनें सुनाई देंगी, जहां v4 ने खुद ही हकलाहट या कराह जोड़ी है।
अपनी प्रोडक्शंस में इस आवाज़ का इस्तेमाल करने के लिए Jack John खोजें।
ऐक्सेंट और किरदार Audio Tags सूची
Eleven v4 के साथ अलग-अलग ऐक्सेंट या किरदारों की आवाज़ों वाले समृद्ध दृश्य बनाना पहले से आसान है। कुछ Audio Tags की मदद से, आवाज़ की मूल खूबियां बरकरार रखते हुए आप उसे एक नए व्यक्तित्व में बदल सकते हैं। एक ही आवाज़ एक जनरेशन में पूरे कलाकारों का किरदार निभा सकती है।
- [British accent] एक कप चाय लेंगे?
- [French accent] मेरे छोटे कैफ़े में आपका स्वागत है।
- [Australian accent] कोई बात नहीं, दोस्त, हम इसे संभाल लेंगे।
- [pirate voice] पाल चढ़ाओ और रम पास करो।
Lauren ने इस सैंपल को जीवंत बनाने में मदद की।
साउंड इफेक्ट्स Audio Tags सूची
साउंड इफेक्ट Audio Tags आपकी जनरेशन में सीधे बिना-बोली वाली घटनाएं जोड़ते हैं। उदाहरण के लिए, अगर आप कोई कहानी का दृश्य या वीडियो गेम ट्रैक बना रहे हों, तो अलग SFX ट्रैक के बिना उसे नाटकीय बनाने के लिए इनका इस्तेमाल कर सकते हैं। हालांकि, अगर आपको कुछ खास चाहिए, तो आप हमेशा AI साउंड इफेक्ट जनरेटर इस्तेमाल कर सकते हैं।
- [thunder rumbling] वह करीब आ रहा है।
- [footsteps] कोई सीढ़ियां चढ़कर आ रहा है।
- [door creaking] हैलो? कोई घर पर है?
- [clapping] धन्यवाद, धन्यवाद, आप बहुत मेहरबान हैं।
ऊपर की क्लिप में आवाज़ Siren की है।
प्राकृतिक भाषा से अपने Audio Tags लिखें
ऊपर दिखाए गए किसी भी Audio Tag से शुरुआत करना अच्छा रहेगा। लेकिन ElevenLabs TTS की खासियत यह है कि मॉडल के काम आने वाला अतिरिक्त संदर्भ देने के लिए आप प्राकृतिक भाषा में कोई भी नया Audio Tag लिख सकते हैं।
या अगर एक शब्द वाला कोई टैग आपकी ज़रूरत पूरी नहीं करता, तो अधिक विस्तृत निर्देश लिखें।
- भावनाएं और गुण मिलाएं: [tense, cautious] या [whispering, fearful]
- तरीका बताएं: [like a sports commentator, speeding up]
- स्थिति बताएं: [out of breath after running up the stairs]
- किरदार बताएं: [a tired detective who has heard it all before]
- बदलाव बताएं: [starting calm, then losing patience]
अपने दृश्य को Spuds Oxley के साथ जीवंत बनाएं।
Audio Tags चुनने के सुझाव
प्राकृतिक भाषा में लिखने से टेक्स्ट टू स्पीच ऑडियो सैंपल बनाते समय आपको काफ़ी लचीलापन मिलता है, लेकिन सही आउटपुट पाने में थोड़ा प्रयोग भी लग सकता है।
Eleven v4 के साथ अपना TTS अनुभव जितना संभव हो उतना सहज बनाने के लिए, Audio Tags के साथ काम करने के कुछ सुझाव यहां हैं:
- लिखने से पहले सुनें: कुछ भावनाओं को इमोशन व्हील पर चलाकर सुनें कि v4 उन्हें कैसे समझता है (या प्रेरणा के लिए इस्तेमाल करें), फिर अपनी लाइन के लिए सबसे नज़दीकी विकल्प चुनें।
- लाइन दोबारा लिखने से पहले टैग बदलें: अगर डिलीवरी सही न लगे, तो [despair] की जगह [let down] जैसी पास की भावना आज़माएं और फिर से जनरेट करें।
- हर क्लॉज़ के लिए एक टैग इस्तेमाल करें: एक ही शब्दों पर विरोधी टैग परफ़ॉर्मेंस को धुंधला कर सकते हैं। जिस जगह आप भावना बदलना चाहते हैं, वहां नया टैग जोड़ें।
- मॉडल को पूरा दृश्य दें: Eleven v4 संदर्भ के साथ बेहतर परफ़ॉर्म करता है। टेक्स्ट टू स्पीच ऐप में हर जनरेशन के लिए 10,000 कैरेक्टर तक की विंडो मिलती है, इसलिए आपके पास दृश्य में जादू रचने के लिए कई परतों वाले निर्देश लिखने की जगह है।
- प्रीसेट से शुरू करें, फिर उसे खास बनाएं। अगर [nervous] करीब है लेकिन बिल्कुल सही नहीं, तो लिखें कि क्या कमी है: [nervous, trying to sound confident]।
लेकिन सबसे बढ़कर, ElevenLabs TTS ऐप में जाकर प्रयोग करना, तेज़ी से सीखने और उच्च-गुणवत्ता वाला TTS ऑडियो बनाना शुरू करने का सबसे अच्छा तरीका है।

Eleven v4 पर इमर्सिव ऑडियो के साथ शुरुआत करें
ElevenLabs Audio Tags की कोई अंतिम सूची नहीं है, क्योंकि आप प्राकृतिक भाषा में लिखकर अपनी पसंद का कोई भी संयोजन बना सकते हैं। इस सूची का हर टैग Eleven v4 पर काम करता है, और वे टैग भी काम करेंगे जो आपके दृश्य को लिखते समय आपके मन में आएं।
वॉइस लाइब्रेरी से 17,500+ आवाज़ों में से एक चुनें,वॉइस लाइब्रेरी में से अपनी स्क्रिप्ट पेस्ट करें और शुरुआत के लिए अपना पहला Audio Tag जोड़ें।
इसके बारे में और जानें Eleven v4 या साइन अप करें और शानदार ऑडियो परफ़ॉर्मेंस बनाएं।
ElevenLabs Audio Tags के बारे में अक्सर पूछे जाने वाले सवाल
- Artificial Analysis, Provider Voice Arena Preference Elo, 30 सितंबर, 2026


