Scribe v2 पेश है
- प्रकाशित
सुनेंइस आर्टिकल को सुनें
Scribe v2 को बड़े पैमाने पर बैच ट्रांसक्रिप्शन, सबटाइटलिंग और कैप्शनिंग के लिए बनाया गया है। यह लंबे ऑडियो, विराम, आवाज़ के उतार-चढ़ाव और लंबे सन्नाटों को बेहतर ढंग से संभालते हुए Scribe v1 की स्थिरता और सटीकता को बेहतर बनाता है।

जहाँ Scribe v2 Realtime को बेहद कम लेटेंसी और एजेंट्स के उपयोग मामलों के लिए ऑप्टिमाइज़ किया गया है, वहीं Scribe v2 लंबे और जटिल रिकॉर्डिंग्स के लिए ऑप्टिमाइज़ है। यह अलग-अलग वक्ताओं, लहजों और बोलने के तरीकों में सटीकता बनाए रखता है। नतीजा है—वास्तविक दुनिया की कई तरह की ऑडियो स्थितियों में लगातार भरोसेमंद ट्रांसक्रिप्ट्स।
Scribe v2 ने इंडस्ट्री-स्टैंडर्ड बेंचमार्क्स पर दर्ज सबसे कम शब्द-त्रुटि दर हासिल की है।

संदर्भ के अनुसार ट्रांसक्रिप्शन के लिए Keyterm Prompting
Keyterm prompting, ट्रांसक्रिप्ट के संदर्भ का इस्तेमाल करके, सामान्य Custom Vocabulary से आगे जाता है। अधिकतम 100 शब्द या वाक्यांश चुनें, और Scribe v2 सटीक रूप से तय करेगा कि उन शब्दों को कब ट्रांसक्राइब करना है। इसलिए यह तकनीकी क्षेत्रों, ब्रांड नामों और इंडस्ट्री-विशिष्ट भाषा के लिए बहुत उपयुक्त है।

सटीक टाइमस्टैम्प के साथ बिल्ट-इन एंटिटी डिटेक्शन
Scribe v2 में संरचित ऑडियो विश्लेषण के लिए नेटिव एंटिटी डिटेक्शन शामिल है।
आप व्यक्तिगत पहचान योग्य जानकारी, स्वास्थ्य डेटा या भुगतान विवरण की 56 तक श्रेणियाँ चुन सकते हैं। Scribe v2 आपके ट्रांसक्रिप्ट में इन उदाहरणों और उनके सटीक टाइमस्टैम्प को अपने-आप पहचान लेगा, जिससे संवेदनशील जानकारी की बड़े पैमाने पर समीक्षा, उसे हटाना या प्रोसेस करना आसान हो जाता है।
API दस्तावेज़ में और जानें: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection
ऑटोमैटिक मल्टी-लैंग्वेज ट्रांसक्रिप्शन
Scribe v2 में स्मार्ट मल्टी-लैंग्वेज वर्कफ़्लो की सुविधा शुरू से ही मौजूद है।
आप एक ही फ़ाइल में कई भाषाओं वाला ऑडियो भेज सकते हैं। मॉडल हर भाषा को अपने-आप पहचानता है और मैन्युअल सेगमेंटेशन या कॉन्फ़िगरेशन के बिना सही तरीके से ट्रांसक्राइब करता है।
प्रोडक्शन वर्कफ़्लो के लिए अतिरिक्त सुविधाएँ
Scribe v2 में एंटरप्राइज़ और डेवलपर उपयोग मामलों के लिए बनाई गई कई सुविधाएँ शामिल हैं:
- स्पष्ट और सहज स्पीकर लेबलिंग के लिए स्मार्ट स्पीकर डायरीकरण
- सटीक सबटाइटल अलाइनमेंट और इंटरैक्टिव अनुभवों के लिए शब्द-स्तरीय सटीक टाइमस्टैम्प
- हँसी या कदमों की आहट जैसी गैर-वाक् घटनाओं को पहचानने वाला डायनेमिक ऑडियो टैगिंग
- SOC 2, ISO 27001, PCI DSS L1, HIPAA और GDPR अनुपालन, EU और भारत में डेटा रेज़िडेंसी, और ज़ीरो रिटेंशन मोड सपोर्ट के साथ एंटरप्राइज़ के लिए तैयार
Scribe v2, अब ElevenLabs Studio में
Scribe v2 का इस्तेमाल अब ElevenLabs Studio में अधिक सटीक सबटाइटल, कैप्शन और ट्रांसक्रिप्शन के लिए किया जाता है। यह मार्केटिंग, मीडिया, रिसर्च, ट्रेनिंग और अनुपालन के लिए ऑडियो व वीडियो की बड़ी लाइब्रेरी मैनेज करने वाली टीम्स को सपोर्ट करता है।

अभी आज़माएं: https://elevenlabs.io/app/studio
API के साथ बनाएं
Scribe v2 के साथ डेवलपर और एंटरप्राइज़ जटिल ऑडियो पाइपलाइन को ऑटोमेट कर सकते हैं, ग्लोबल कंटेंट वर्कफ़्लो में सटीकता बढ़ा सकते हैं और पूरे अनुपालन व डेटा रेज़िडेंसी कंट्रोल्स के साथ सुरक्षित रूप से स्केल कर सकते हैं।

Scribe v2 आज हमारे API और Creative प्लेटफ़ॉर्म के ज़रिए उपलब्ध है।
अभी आज़माएं: https://elevenlabs.io/app/speech-to-text
डॉक्स पढ़ें: https://elevenlabs.io/docs/capabilities/speech-to-text
यहाँ साइन अप करें: https://elevenlabs.io/speech-to-text




