पेश है Eleven v4पेश है Eleven v4, हमारा अब तक का सबसे भावपूर्ण मॉडल। 12 अक्टूबर तक Creator+ के साथ 3 गुना क्रेडिट शामिल हैं

कंटेंट पर जाएं

Scribe v2 को मिला नया अपग्रेड

लेखक
Joe Reeve
प्रकाशित

सुनेंइस आर्टिकल को सुनें

हम बिल्ट-इन एंटिटी रिडैक्शन, बेहतर इंडिक-इंग्लिश ट्रांसक्रिप्शन, नया No Verbatim मोड और 1,000 टर्म्स तक के लिए विस्तृत कीटर्म प्रॉम्प्टिंग पेश कर रहे हैं।

इन सुधारों से डेवलपर्स को प्राइवेसी, बहुभाषी सटीकता, ट्रांसक्रिप्ट क्वालिटी और डोमेन-विशिष्ट सटीकता पर ज़्यादा नियंत्रण मिलता है।

Scribe v2 में नया एंटिटी रिडैक्शन

Scribe v2 अब ट्रांसक्रिप्ट से संवेदनशील एंटिटीज़ को अपने-आप पहचान और रिडैक्ट कर सकता है—इनमें नाम, क्रेडिट कार्ड नंबर, सोशल सिक्योरिटी नंबर और अन्य व्यक्तिगत पहचान योग्य जानकारी शामिल हैं।

रिडैक्शन ट्रांसक्रिप्शन के दौरान होता है। संवेदनशील डेटा आपके स्टोरेज या डाउनस्ट्रीम सिस्टम तक पहुंचने से पहले हटा दिया जाता है।

  • पूरा रिडैक्शन: एंटिटीज़ को [REDACTED] से बदलता है;
  • वर्गीकृत: एंटिटी टाइप से बदलता है, जैसे [CREDIT_CARD];
  • क्रमांकित: वर्गीकृत और क्रमांकित लेबल से बदलता है, जैसे [CREDIT_CARD_1]।

इससे टीम्स हेल्थकेयर, फाइनेंस और कस्टमर सपोर्ट जैसे क्षेत्रों के डेटा हैंडलिंग वर्कफ़्लो को सपोर्ट करते हुए ट्रांसक्रिप्ट आसानी से शेयर कर सकती हैं।

नोट: रिडैक्शन ऑटोमेटेड है और हो सकता है कि यह सभी संवेदनशील जानकारी को पहचान या हटा न पाए। आउटपुट पर भरोसा करने से पहले उनकी समीक्षा करें।

सटीक इंडिक-इंग्लिश कोड-स्विचिंग

भारत भर में लोग अक्सर हिंदी, तेलुगु, कन्नड़ और अन्य इंडिक भाषाओं के साथ इंग्लिश मिलाकर बोलते हैं। कई ट्रांसक्रिप्शन सिस्टम इंग्लिश शब्दों को इंडिक लिपियों में लिप्यंतरित कर देते हैं, जिससे ऐसे ट्रांसक्रिप्ट बनते हैं जो लोगों के वास्तविक संवाद के तरीके को नहीं दर्शाते।

Scribe v2 आसपास की भाषा चाहे जो भी हो, इंग्लिश शब्दों को इंग्लिश में ट्रांसक्राइब करता है। यह बिना किसी भाषा कॉन्फ़िगरेशन के अपने-आप काम करता है। आप इंग्लिश, हिंदी या कोई भी भाषा कोड न भेजें, इंग्लिश शब्द लैटिन लिपि में ही रहते हैं।

यह सिर्फ हिंदी-इंग्लिश नहीं, सभी इंडिक भाषाओं पर लागू होता है। अगर कोई वक्ता तेलुगु और इंग्लिश या कन्नड़ और इंग्लिश के बीच स्विच करता है, तो इंग्लिश हिस्से सही तरीके से ट्रांसक्राइब होते हैं।

साफ़ ट्रांसक्रिप्ट के लिए No Verbatim मोड

हम No Verbatim मोड पेश कर रहे हैं, एक ट्रांसक्रिप्शन सेटिंग जो "um" और "uh" जैसे फिलर शब्दों के साथ-साथ दोहराए गए वाक्यांशों और हकलाने को अपने-आप हटा देती है।

नतीजा है बिना मैन्युअल एडिटिंग या पोस्ट-प्रोसेसिंग के एक साफ़, पढ़ने में आसान ट्रांसक्रिप्ट।

No Verbatim मोड मीटिंग नोट्स, सबटाइटल्स और उन सभी वर्कफ़्लो के लिए उपयुक्त है, जहां लक्ष्य हर आवाज़ को हूबहू कैप्चर करने के बजाय एक पॉलिश्ड लिखित रिकॉर्ड बनाना है।

कीटर्म प्रॉम्प्टिंग अब 1,000 तक

कीटर्म प्रॉम्प्टिंग अब हर ट्रांसक्रिप्ट के लिए 1,000 शब्दों और वाक्यांशों तक सपोर्ट करती है, जो पहले 100 की सीमा थी।

इससे बड़े तकनीकी शब्दकोशों, प्रोडक्ट कैटलॉग या डोमेन-विशिष्ट शब्दावली के साथ काम करने वाली टीम्स को मॉडल को सटीक ट्रांसक्रिप्शन की ओर गाइड करने के लिए ज़्यादा जगह मिलती है।

कीटर्म प्रॉम्प्टिंग कॉन्टेक्स्ट-अवेयर बनी रहती है। मॉडल टर्म्स को बिना सोचे जोड़ने के बजाय, आसपास के ऑडियो का इस्तेमाल करके तय करता है कि कोई कीटर्म लागू होता है या नहीं। 1,000 टर्म्स के साथ, यह पिछली क्षमता का 10 गुना है।

नोट: 100 से ज़्यादा कीटर्म्स वाले अनुरोधों के लिए न्यूनतम बिल योग्य यूनिट 20 सेकंड है।

अब उपलब्ध

ये सुविधाएं आज से Scribe v2 API और UI में उपलब्ध हैं।

डॉक्यूमेंटेशन पढ़ें:
https://elevenlabs.io/docs/cookbooks/speech-to-text/quickstart

ऐप में आजमाएं:
https://elevenlabs.io/app/speech-to-text

संबंधित लेख

उच्चतम गुणवत्ता वाले AI ऑडियो के साथ बनाएं