स्पीच स्ट्रीम करें
स्पीच स्ट्रीम करें
अपनी पसंद की वॉइस का इस्तेमाल करके टेक्स्ट को स्पीच में बदलता है और ऑडियो स्ट्रीम के रूप में ऑडियो लौटाता है।
Path parameters
Headers
Query parameters
Request
वह टेक्स्ट जिसे स्पीच में बदला जाएगा।
इस्तेमाल किए जाने वाले मॉडल का पहचानकर्ता। आप GET /v1/models से इनके बारे में क्वेरी कर सकते हैं। मॉडल में टेक्स्ट टू स्पीच का समर्थन होना चाहिए, जिसे आप can_do_text_to_speech प्रॉपर्टी से जांच सकते हैं।
मॉडल और टेक्स्ट नॉर्मलाइज़ेशन के लिए भाषा लागू करने में इस्तेमाल होने वाला भाषा कोड (ISO 639-1)। अगर मॉडल दिए गए भाषा कोड को सपोर्ट नहीं करता, तो उसे अनदेखा कर दिया जाएगा। यह पैरामीटर multilingual_v2 मॉडल के लिए समर्थित नहीं है।
दी गई वॉइस की सेव की गई सेटिंग्स को ओवरराइड करने वाली वॉइस सेटिंग्स। ये सिर्फ़ दिए गए अनुरोध पर लागू होती हैं।
टेक्स्ट पर लागू किए जाने वाले उच्चारण शब्दकोश लोकेटर्स (id, version_id) की सूची। इन्हें क्रम से लागू किया जाएगा। हर अनुरोध में अधिकतम 3 लोकेटर्स हो सकते हैं।
निर्दिष्ट होने पर, हमारा सिस्टम नियतात्मक रूप से सैंपल करने का सर्वोत्तम प्रयास करेगा, ताकि एक ही seed और पैरामीटर्स वाली बार-बार की गई रिक्वेस्ट से एक ही परिणाम मिले। नियतात्मकता की गारंटी नहीं है। यह 0 से 4294967295 के बीच एक पूर्णांक होना चाहिए।
वह टेक्स्ट जो मौजूदा अनुरोध के टेक्स्ट से पहले आया था। कई जनरेशन को जोड़ते समय स्पीच की निरंतरता बेहतर करने या मौजूदा जनरेशन में स्पीच की निरंतरता को प्रभावित करने के लिए इस्तेमाल किया जा सकता है।
वह टेक्स्ट जो मौजूदा अनुरोध के टेक्स्ट के बाद आता है। कई जनरेशन को जोड़ते समय स्पीच की निरंतरता बेहतर करने या मौजूदा जनरेशन में स्पीच की निरंतरता को प्रभावित करने के लिए इस्तेमाल किया जा सकता है।
इस जनरेशन से पहले जनरेट किए गए सैंपल के request_id की सूची। किसी बड़े कार्य को कई अनुरोधों में बाँटते समय स्पीच की निरंतरता बेहतर करने के लिए इसका उपयोग किया जा सकता है। सभी जनरेशन्स में एक ही मॉडल इस्तेमाल करने पर परिणाम सबसे अच्छे होंगे। previous_text और previous_request_ids दोनों भेजने पर previous_text को अनदेखा किया जाएगा। अधिकतम 3 request_ids भेजे जा सकते हैं।
इस जनरेशन के बाद आने वाले सैंपल के request_id की सूची। ऑडियो क्वालिटी संबंधी समस्या वाले सैंपल को फिर से जनरेट करते समय स्पीच की निरंतरता बनाए रखने के लिए next_request_ids खास तौर पर उपयोगी हैं। उदाहरण के लिए, अगर आपने 3 स्पीच क्लिप जनरेट किए हैं और क्लिप 2 को बेहतर बनाना चाहते हैं, तो क्लिप 3 का request id next_request_id के रूप में (और क्लिप 1 का previous_request_id के रूप में) देने से संयुक्त स्पीच में प्राकृतिक प्रवाह बनाए रखने में मदद मिलेगी। सभी जनरेशन्स में एक ही मॉडल इस्तेमाल करने पर परिणाम सबसे अच्छे होंगे। next_text और next_request_ids दोनों भेजने पर next_text को अनदेखा किया जाएगा। अधिकतम 3 request_ids भेजे जा सकते हैं।
प्रोफेशनल वॉइस का IVC वर्शन इस्तेमाल करना है या नहीं। इससे अभिव्यक्तिशीलता बेहतर हो सकती है और लेटेंसी कम हो सकती है।
यह पैरामीटर तीन मोड के साथ टेक्स्ट नॉर्मलाइज़ेशन नियंत्रित करता है: ‘auto’, ‘on’ और ‘off’। ‘auto’ पर सेट होने पर, सिस्टम अपने-आप तय करेगा कि टेक्स्ट नॉर्मलाइज़ेशन लागू करना है या नहीं, जैसे संख्याओं को शब्दों में लिखना। ‘on’ के साथ टेक्स्ट नॉर्मलाइज़ेशन हमेशा लागू होगा, जबकि ‘off’ के साथ इसे छोड़ दिया जाएगा।
यह पैरामीटर भाषा टेक्स्ट नॉर्मलाइज़ेशन नियंत्रित करता है। इससे कुछ समर्थित भाषाओं में टेक्स्ट के सही उच्चारण में मदद मिलती है। चेतावनी: यह पैरामीटर अनुरोध की लेटेंसी को काफी बढ़ा सकता है। फ़िलहाल यह केवल जापानी के लिए समर्थित है।
Response
स्ट्रीमिंग ऑडियो डेटा