स्पीच टू टेक्स्ट API
ElevenLabs Scribe v2 के साथ स्पीच ट्रांसक्राइब करें
बड़ी मात्रा में इस्तेमाल के लिए सबसे सटीक स्पीच टू टेक्स्ट। ज़ोर, साउंड इफेक्ट्स पहचानें और कीवर्ड प्रॉम्प्टिंग से ट्रांसक्रिप्शन को गाइड करें।
- Lovable
- Veed model
- Synthesia
- Stripe
- Perplexity
- Twilio
बैच वर्कलोड्स के लिए सबसे सटीक स्पीच टू टेक्स्ट API
पॉडकास्ट, वीडियो, इंटरव्यू और दूसरी रिकॉर्डेड सामग्री के लिए कैप्शन, सबटाइटल्स और एडिटेबल ट्रांसक्रिप्ट्स बनाएं – ये सब API के ज़रिए इंडस्ट्री-लीडिंग सटीकता के साथ।
बेमिसाल ट्रांसक्रिप्शन सटीकता
Scribe v2 चुनौतीपूर्ण ऑडियो स्थितियों और अलग-अलग एक्सेंट्स में भी साफ़, एडिट करने योग्य टेक्स्ट देता है और उद्योग-अग्रणी ट्रांसक्रिप्शन सटीकता हासिल करता है।
हर स्थिति के लिए डिज़ाइन किया गया
शोर वाले माहौल, बैकग्राउंड म्यूज़िक, गहरे एक्सेंट्स और कम-गुणवत्ता वाले ऑडियो में भी काम करने वाला ट्रांसक्रिप्शन।
टाइमिंग, स्पीकर्स और गैर-वाक् घटनाओं पर बारीक नियंत्रण।
ElevenLabs Transcription API हँसी, भावनाओं और साउंड इफेक्ट्स को पहचान सकता है। डोमेन-विशिष्ट शब्दों के साथ ट्रांसक्रिप्शन को गाइड करने के लिए कीटर्म प्रॉम्प्टिंग इस्तेमाल करें।
ऑडियो और वीडियो ट्रांसक्राइब करें
.webp&w=3840&q=95)
साफ़, एडिट करने योग्य ट्रांसक्रिप्ट
.webp&w=3840&q=95)
कीटर्म प्रॉम्प्टिंग

डायनेमिक ऑडियो टैगिंग
हँसी, तालियाँ, संगीत और बैकग्राउंड शोर जैसी गैर-वाक् घटनाएँ कैप्चर करें। ट्रांसक्रिप्ट में सिर्फ़ शब्द नहीं, आपके ऑडियो का पूरा संदर्भ शामिल होता है।
स्मार्ट स्पीकर डायराइज़ेशन
48 तक स्पीकर्स को अपने-आप पहचानें और लेबल करें। किसने क्या कहा, इसका साफ़ विवरण पढ़ने में आसान ट्रांसक्रिप्ट में व्यवस्थित मिलता है।
एंटिटी डिटेक्शन
अपने ट्रांसक्रिप्ट में नाम, तारीखें, स्थान और संगठनों समेत 56 प्रकार की एंटिटीज़ को अपने-आप पहचानें और टैग करें।
Scribe v2 Medical के साथ क्लिनिकल ऑडियो ट्रांसक्राइब करें
मेडिकल ट्रांसक्रिप्शन और क्लिनिकल वर्कफ़्लो के लिए ऑप्टिमाइज़ किया गया स्पीच टू टेक्स्ट मॉडल, जो दवाओं के नाम, शरीर रचना और पैथोलॉजी के शब्दों को बेहतर ढंग से पहचानता है।

क्लिनिकल स्पीच ट्रांसक्राइब करें
क्लिनिशियन-मरीज़ बातचीत, डॉक्टर की डिक्टेशन और मरीज़ की शुरुआती जानकारी को सटीक टेक्स्ट में बदलें, जो क्लिनिशियन रिव्यू, नोट्स, कोडिंग और आगे के डॉक्यूमेंटेशन वर्कफ़्लो के लिए तैयार हो।

चिकित्सकीय शब्दों में कम गलतियां
टर्म-WER पर, Scribe v2 Medical, Eka Medical ASR टेस्ट स्प्लिट में Scribe v2 की तुलना में 15% कम गलतियाँ करता है और क्लिनिकल शब्दावली में बेहतर मेडिकल वॉइस रिकग्निशन देता है।

Scribe v2
सबसे अधिक सटीकता, बैच वर्कलोड्स के लिए डिज़ाइन किया गया।
- >95% सटीकता
- 90+ भाषाएँ
- गैर-वाक् इवेंट डिटेक्शन
- एंटिटी डिटेक्शन
- कीटर्म प्रॉम्प्टिंग

Scribe v2 Realtime
सबसे कम लेटेंसी, रियलटाइम वर्कलोड्स के लिए।
- 150ms से कम लेटेंसी
- 90+ भाषाएँ
- ट्रांसक्रिप्शन स्ट्रीमिंग
- वॉइस एक्टिविटी डिटेक्शन
- ऑटोमैटिक भाषा पहचान

Scribe v2 Medical
क्लिनिकल ट्रांसक्रिप्शन के लिए मेडिकल फाइन-ट्यून।
- मेडिकल शब्दावली ट्यूनिंग
- 90+ भाषाओं में ट्रांसक्रिप्शन
- रोज़मर्रा की स्पीच पर Scribe v2 जितना सटीक
- दवाओं के नामों की बेहतर पहचान
- एंटरप्राइज़ ग्राहकों के लिए HIPAA-योग्य
90+ भाषाओं और कई तरह के एक्सेंट्स में स्पीच ट्रांसक्राइब करें
अलग-अलग एक्सेंट्स, बोलियों और रिकॉर्डिंग स्थितियों में बेहतरीन सटीकता।
भाषाओं का प्रीव्यू देखने के लिए languageCode बदलें
import { ElevenLabsClient } from "@elevenlabs/elevenlabs-js";
const elevenlabs = new ElevenLabsClient({
apiKey: "<your_api_key>"
});
const response = await fetch(
"https://storage.googleapis.com/eleven-public-cdn/audio/marketing/nicole.mp3"
);
const audioBlob = new Blob([await response.arrayBuffer()], { type: "audio/mp3" });
const transcription = await elevenlabs
.speechToText.convert({
file: audioBlob,
modelId: "scribe_v2",
tagAudioEvents: true,
languageCode: , // भाषा सेट करें
diarize: true
});
console.log(transcription);

