सही मॉडल कैसे चुनें

यह गाइड आपको अपने उपयोग के मामले के लिए सही ElevenLabs मॉडल चुनने का तरीका बताती है।

ElevenLabs अलग-अलग आवश्यकताओं के लिए ऑप्टिमाइज़ किए गए कई मॉडल देता है। सही चुनाव आपके उपयोग के मामले, लेटेंसी आवश्यकताओं और क्वालिटी अपेक्षाओं पर निर्भर करता है। पूरी स्पेसिफ़िकेशन के लिए मॉडल रेफरेंस देखें।

आवश्यकता के अनुसार

क्वालिटी

eleven_v3 इस्तेमाल करें

सबसे उच्च विश्वसनीयता, सबसे समृद्ध भावनात्मक अभिव्यक्ति और सबसे व्यापक भाषा सपोर्ट वाला फ्लैगशिप मॉडल।

कम लेटेंसी

Flash मॉडल इस्तेमाल करें (eleven_flash_v2_5 या eleven_flash_v2)

~75ms लेटेंसी वाले रियल-टाइम एप्लिकेशन के लिए ऑप्टिमाइज़ किया गया।

अभिव्यक्तिपूर्ण रियलटाइम

eleven_v3_conversational इस्तेमाल करें

~280ms लेटेंसी और बारीक नियंत्रण के लिए ऑडियो टैग्स के साथ रियलटाइम स्पीच सिंथेसिस का हमारा सबसे अभिव्यक्तिपूर्ण मॉडल।

बहुभाषी

eleven_v3 या eleven_v3_conversational इस्तेमाल करें

दोनों 70+ भाषाओं को सपोर्ट करते हैं।

संतुलित

eleven_flash_v2_5 या eleven_v3_conversational इस्तेमाल करें

कम लेटेंसी के साथ उच्च-क्वालिटी आउटपुट — सबसे अच्छा ऑल-राउंड विकल्प।

उपयोग के मामले के अनुसार

कंटेंट क्रिएशन

eleven_v3 इस्तेमाल करें

प्रोफेशनल कंटेंट, ऑडियोबुक और वीडियो नैरेशन के लिए आदर्श।

कन्वर्सेशनल एजेंट्स

सबसे अभिव्यक्तिपूर्ण डिलीवरी के लिए eleven_v3_conversational, या सबसे कम लेटेंसी के लिए eleven_flash_v2_5 और eleven_flash_v2 इस्तेमाल करें।

अंग्रेज़ी के अलावा अन्य भाषाओं के सपोर्ट के लिए 2.5 मॉडल इस्तेमाल करें।

रियल-टाइम कन्वर्सेशनल एप्लिकेशन के लिए ऑप्टिमाइज़ किया गया।

ट्रांसक्रिप्शन

बैच ट्रांसक्रिप्शन के लिए scribe_v2, मेडिकल और क्लिनिकल ऑडियो के लिए scribe_v2_medical, या रियल-टाइम ट्रांसक्रिप्शन के लिए scribe_v2_realtime इस्तेमाल करें।

स्पीकर डायरीकरण और शब्द-स्तर टाइमस्टैम्प के साथ 90+ भाषाओं में अत्याधुनिक सटीकता।

वॉइस चेंजर

eleven_multilingual_sts_v2 इस्तेमाल करें

स्पीच-टू-स्पीच कन्वर्ज़न के लिए विशेषीकृत।

अगले चरण