Scribe v2 पेश है
- प्रकाशित
सुनेंइस आर्टिकल को सुनें
Scribe v2 को बैच ट्रांसक्रिप्शन, बड़े पैमाने पर सबटाइटलिंग और कैप्शनिंग के लिए बनाया गया है। यह लंबे ऑडियो, विराम, टोन में बदलाव और लंबे सन्नाटों को बेहतर ढंग से संभालते हुए Scribe v1 की स्थिरता और सटीकता को बेहतर बनाता है।

जहाँ Scribe v2 Realtime को बेहद कम लेटेंसी और एजेंट्स के उपयोग मामलों के लिए ऑप्टिमाइज़ किया गया है, वहीं Scribe v2 को लंबी और जटिल रिकॉर्डिंग के लिए ऑप्टिमाइज़ किया गया है। यह अलग-अलग स्पीकर्स, एक्सेंट्स और बोलने के अंदाज़ में सटीकता बनाए रखता है। नतीजतन, वास्तविक दुनिया की कई तरह की ऑडियो स्थितियों में लगातार भरोसेमंद ट्रांसक्रिप्ट मिलते हैं।
Scribe v2 ने इंडस्ट्री-स्टैंडर्ड बेंचमार्क्स पर दर्ज सबसे कम वर्ड एरर रेट हासिल की है।

संदर्भ के अनुसार ट्रांसक्रिप्शन के लिए कीटर्म प्रॉम्प्टिंग
कीटर्म प्रॉम्प्टिंग, ट्रांसक्रिप्ट के संदर्भ का उपयोग करके सामान्य Custom Vocabulary से आगे बढ़ती है। अधिकतम 100 शब्द या वाक्यांश चुनें और Scribe v2 सटीक रूप से तय करेगा कि उन शब्दों को कब ट्रांसक्राइब करना है। इसलिए यह तकनीकी क्षेत्रों, ब्रांड नामों और इंडस्ट्री-विशिष्ट भाषा के लिए उपयुक्त है।

सटीक टाइमस्टैम्प्स के साथ बिल्ट-इन एंटिटी डिटेक्शन
Scribe v2 में संरचित ऑडियो विश्लेषण के लिए नेटिव एंटिटी डिटेक्शन शामिल है।
आप व्यक्तिगत पहचान योग्य जानकारी, स्वास्थ्य डेटा या भुगतान विवरण की अधिकतम 56 श्रेणियाँ चुन सकते हैं। Scribe v2 इन मामलों और आपके ट्रांसक्रिप्ट में उनके सटीक टाइमस्टैम्प्स को अपने आप पहचान लेगा, जिससे संवेदनशील जानकारी की समीक्षा करना, उसे हटाना या बड़े पैमाने पर प्रोसेस करना आसान हो जाता है।
API डॉक्यूमेंटेशन में और जानें: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection
ऑटोमैटिक मल्टी-लैंग्वेज ट्रांसक्रिप्शन
Scribe v2 शुरू से ही स्मार्ट मल्टी-लैंग्वेज वर्कफ़्लो को सपोर्ट करता है।
आप एक ही फ़ाइल में कई भाषाओं वाला ऑडियो भेज सकते हैं। मॉडल हर भाषा को अपने आप पहचानता है और बिना मैन्युअल सेगमेंटेशन या कॉन्फ़िगरेशन के उसे सही ढंग से ट्रांसक्राइब करता है।
प्रोडक्शन वर्कफ़्लो के लिए अतिरिक्त सुविधाएँ
Scribe v2 में एंटरप्राइज़ और डेवलपर उपयोग मामलों के लिए बनाई गई सुविधाओं का एक सेट शामिल है:
- स्पष्ट और सहज स्पीकर लेबलिंग के लिए स्मार्ट स्पीकर डायराइज़ेशन
- सटीक सबटाइटल अलाइनमेंट और इंटरैक्टिव अनुभवों के लिए शब्द-स्तर के सटीक टाइमस्टैम्प्स
- हँसी या कदमों की आहट जैसी गैर-वाणी घटनाओं को पहचानने वाली डायनामिक ऑडियो टैगिंग
- SOC 2, ISO 27001, PCI DSS L1, HIPAA और GDPR अनुपालन, EU और भारत में डेटा रेज़िडेंसी, और ज़ीरो रिटेंशन मोड सपोर्ट के साथ एंटरप्राइज़ के लिए तैयार
Scribe v2, अब ElevenLabs Studio में
Scribe v2 का इस्तेमाल अब ElevenLabs Studio में अधिक सटीक सबटाइटल्स, कैप्शंस और ट्रांसक्रिप्शन के लिए किया जाता है। यह मार्केटिंग, मीडिया, रिसर्च, ट्रेनिंग और कंप्लायंस के लिए ऑडियो और वीडियो की बड़ी लाइब्रेरी संभालने वाली टीम्स को सपोर्ट करता है।

अभी आज़माएं: https://elevenlabs.io/app/studio
API के साथ बनाएं
Scribe v2 के साथ डेवलपर्स और एंटरप्राइज़ जटिल ऑडियो पाइपलाइनों को ऑटोमेट कर सकते हैं, ग्लोबल कंटेंट वर्कफ़्लो में सटीकता बढ़ा सकते हैं और पूरे कंप्लायंस व डेटा रेज़िडेंसी कंट्रोल्स के साथ सुरक्षित रूप से स्केल कर सकते हैं।

Scribe v2 आज हमारे API और Creative प्लैटफ़ॉर्म के ज़रिए उपलब्ध है।
अभी आज़माएं: https://elevenlabs.io/app/speech-to-text
डॉक्स पढ़ें: https://elevenlabs.io/docs/capabilities/speech-to-text
यहाँ साइन अप करें: https://elevenlabs.io/speech-to-text




