कंटेंट पर जाएं

Scribe v2 पेश है

प्रकाशित

सुनेंइस आर्टिकल को सुनें

Scribe v2 को बड़े पैमाने पर बैच ट्रांसक्रिप्शन, सबटाइटलिंग और कैप्शनिंग के लिए बनाया गया है। यह लंबे ऑडियो, विराम, आवाज़ के उतार-चढ़ाव और लंबे सन्नाटों को बेहतर ढंग से संभालते हुए Scribe v1 की स्थिरता और सटीकता को बेहतर बनाता है।

Introducing Scribe v2

जहाँ Scribe v2 Realtime को बेहद कम लेटेंसी और एजेंट्स के उपयोग मामलों के लिए ऑप्टिमाइज़ किया गया है, वहीं Scribe v2 लंबे और जटिल रिकॉर्डिंग्स के लिए ऑप्टिमाइज़ है। यह अलग-अलग वक्ताओं, लहजों और बोलने के तरीकों में सटीकता बनाए रखता है। नतीजा है—वास्तविक दुनिया की कई तरह की ऑडियो स्थितियों में लगातार भरोसेमंद ट्रांसक्रिप्ट्स।


Scribe v2 ने इंडस्ट्री-स्टैंडर्ड बेंचमार्क्स पर दर्ज सबसे कम शब्द-त्रुटि दर हासिल की है।

Scribe v2 FLEURS benchmark

संदर्भ के अनुसार ट्रांसक्रिप्शन के लिए Keyterm Prompting

Keyterm prompting, ट्रांसक्रिप्ट के संदर्भ का इस्तेमाल करके, सामान्य Custom Vocabulary से आगे जाता है। अधिकतम 100 शब्द या वाक्यांश चुनें, और Scribe v2 सटीक रूप से तय करेगा कि उन शब्दों को कब ट्रांसक्राइब करना है। इसलिए यह तकनीकी क्षेत्रों, ब्रांड नामों और इंडस्ट्री-विशिष्ट भाषा के लिए बहुत उपयुक्त है।

Scribe v2 keyterm prompting

सटीक टाइमस्टैम्प के साथ बिल्ट-इन एंटिटी डिटेक्शन

Scribe v2 में संरचित ऑडियो विश्लेषण के लिए नेटिव एंटिटी डिटेक्शन शामिल है।

आप व्यक्तिगत पहचान योग्य जानकारी, स्वास्थ्य डेटा या भुगतान विवरण की 56 तक श्रेणियाँ चुन सकते हैं। Scribe v2 आपके ट्रांसक्रिप्ट में इन उदाहरणों और उनके सटीक टाइमस्टैम्प को अपने-आप पहचान लेगा, जिससे संवेदनशील जानकारी की बड़े पैमाने पर समीक्षा, उसे हटाना या प्रोसेस करना आसान हो जाता है।

API दस्तावेज़ में और जानें: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection

ऑटोमैटिक मल्टी-लैंग्वेज ट्रांसक्रिप्शन

Scribe v2 में स्मार्ट मल्टी-लैंग्वेज वर्कफ़्लो की सुविधा शुरू से ही मौजूद है।

आप एक ही फ़ाइल में कई भाषाओं वाला ऑडियो भेज सकते हैं। मॉडल हर भाषा को अपने-आप पहचानता है और मैन्युअल सेगमेंटेशन या कॉन्फ़िगरेशन के बिना सही तरीके से ट्रांसक्राइब करता है।

प्रोडक्शन वर्कफ़्लो के लिए अतिरिक्त सुविधाएँ

Scribe v2 में एंटरप्राइज़ और डेवलपर उपयोग मामलों के लिए बनाई गई कई सुविधाएँ शामिल हैं:

  • स्पष्ट और सहज स्पीकर लेबलिंग के लिए स्मार्ट स्पीकर डायरीकरण
  • सटीक सबटाइटल अलाइनमेंट और इंटरैक्टिव अनुभवों के लिए शब्द-स्तरीय सटीक टाइमस्टैम्प
  • हँसी या कदमों की आहट जैसी गैर-वाक् घटनाओं को पहचानने वाला डायनेमिक ऑडियो टैगिंग
  • SOC 2, ISO 27001, PCI DSS L1, HIPAA और GDPR अनुपालन, EU और भारत में डेटा रेज़िडेंसी, और ज़ीरो रिटेंशन मोड सपोर्ट के साथ एंटरप्राइज़ के लिए तैयार

Scribe v2, अब ElevenLabs Studio में

Scribe v2 का इस्तेमाल अब ElevenLabs Studio में अधिक सटीक सबटाइटल, कैप्शन और ट्रांसक्रिप्शन के लिए किया जाता है। यह मार्केटिंग, मीडिया, रिसर्च, ट्रेनिंग और अनुपालन के लिए ऑडियो व वीडियो की बड़ी लाइब्रेरी मैनेज करने वाली टीम्स को सपोर्ट करता है।

Scribe v2 in Studio

अभी आज़माएं: https://elevenlabs.io/app/studio

API के साथ बनाएं

Scribe v2 के साथ डेवलपर और एंटरप्राइज़ जटिल ऑडियो पाइपलाइन को ऑटोमेट कर सकते हैं, ग्लोबल कंटेंट वर्कफ़्लो में सटीकता बढ़ा सकते हैं और पूरे अनुपालन व डेटा रेज़िडेंसी कंट्रोल्स के साथ सुरक्षित रूप से स्केल कर सकते हैं।

Scribe v2 Keyterm prompting code snippet

Scribe v2 आज हमारे API और Creative प्लेटफ़ॉर्म के ज़रिए उपलब्ध है।

अभी आज़माएं: https://elevenlabs.io/app/speech-to-text

डॉक्स पढ़ें: https://elevenlabs.io/docs/capabilities/speech-to-text

यहाँ साइन अप करें: https://elevenlabs.io/speech-to-text

संबंधित लेख

उच्चतम गुणवत्ता वाले AI ऑडियो के साथ बनाएं