भावनाएं कैसे जनरेट करें?

मॉडल हर कथन के व्यापक संदर्भ के प्रति संवेदनशील है — यह देखता है कि कोई बात पिछले और अगले टेक्स्ट से कैसे जुड़ती है और क्या वह समझ में आती है। यह व्यापक दृष्टिकोण इसे कई वाक्यों तक फैले विचारों को एक समान भावनात्मक पैटर्न के साथ जोड़कर, लंबे अंशों में सही स्वराघात देने में मदद करता है।

भावनाएं जनरेट करने के सुझाव:

  • खास भावनाएं जनरेट करने के लिए संदर्भ अहम है। अगर आप हंसने वाला या मज़ेदार टेक्स्ट इनपुट करते हैं, तो आपको खुशमिज़ाज आउटपुट मिल सकता है। यही बात गुस्से, उदासी और अन्य भावनाओं पर भी लागू होती है — सही संदर्भ देना ज़रूरी है।
  • आउटपुट की डिलीवरी में विराम चिह्न और वॉइस सेटिंग्स की सबसे अहम भूमिका होती है।
  • संबंधित शब्दों या वाक्यांशों को उद्धरण चिह्नों में रखकर उन पर ज़ोर दें।
  • क्लोन की गई वॉइस से जनरेट की गई स्पीच में, क्लोनिंग के लिए अपलोड किए गए सैंपल की बोलने की शैली आउटपुट में दोहराई जाती है। अगर अपलोड किए गए सैंपल की स्पीच एकरस है, तो मॉडल के लिए अभिव्यक्तिपूर्ण आउटपुट जनरेट करना मुश्किल होगा।

Eleven v3 के साथ, आप भावनाओं और डिलीवरी को ज़्यादा सीधे नियंत्रित करने के लिए ऑडियो टैग भी इस्तेमाल कर सकते हैं, जैसे [happy], [sad], [angry], [whispers], और [laughs]। ज़्यादा जानकारी के लिए Eleven v3 प्रॉम्प्टिंग गाइड देखें।

ये सुझाव भावनात्मक डिलीवरी को दिशा देते हैं, लेकिन किसी खास नतीजे की गारंटी नहीं देते।