फोर्स्ड अलाइनमेंट
फोर्स्ड अलाइनमेंट
जानें कि ElevenLabs के साथ बोले गए ऑडियो और टेक्स्ट को समय के अनुसार अलाइन किए गए ट्रांसक्रिप्ट में कैसे बदलें।
परिचय
ElevenLabs फोर्स्ड अलाइनमेंट API बोले गए ऑडियो और टेक्स्ट को समय के अनुसार अलाइन किए गए ट्रांसक्रिप्ट में बदलती है। यह उन मामलों में उपयोगी है जहां आपके पास ऑडियो रिकॉर्डिंग और ट्रांसक्रिप्ट है, लेकिन ट्रांसक्रिप्ट में हर शब्द या वाक्यांश के सटीक टाइमस्टैंप चाहिए। इसका इस्तेमाल इन कामों के लिए किया जा सकता है:
- वीडियो रिकॉर्डिंग के साथ सबटाइटल मैच करना
- ईबुक की ऑडियोबुक रिकॉर्डिंग के लिए टाइमिंग जनरेट करना
उपयोग
फोर्स्ड अलाइनमेंट API का इस्तेमाल सीधे ElevenLabs API से इंटरैक्ट करके किया जा सकता है।
समर्थित भाषाएं
हमारे multilingual v2 मॉडल्स 29 भाषाओं को support करते हैं:
अंग्रेज़ी (USA, UK, ऑस्ट्रेलिया, कनाडा), जापानी, चीनी, जर्मन, हिंदी, फ़्रेंच (फ़्रांस, कनाडा), कोरियाई, पुर्तगाली (ब्राज़ील, पुर्तगाल), इतालवी, स्पेनिश (स्पेन, मेक्सिको), इंडोनेशियाई, डच, तुर्की, फ़िलिपीनो, पोलिश, स्वीडिश, बल्गेरियाई, रोमानियाई, अरबी (सऊदी अरब, UAE), चेक, यूनानी, फ़िनिश, क्रोएशियाई, मलय, स्लोवाक, डेनिश, तमिल, यूक्रेनी और रूसी।
मुख्य बातें
- इनपुट टेक्स्ट फ़ॉर्मेट: सिर्फ़ प्लेन स्ट्रिंग — इनपुट टेक्स्ट को JSON या किसी अन्य स्ट्रक्चर में रैप न करें
- डायराइज़ेशन: समर्थित नहीं; डायराइज़्ड टेक्स्ट देने पर अनपेक्षित परिणाम मिलेंगे
- कीमत: स्पीच टू टेक्स्ट API के समान दर
- अधिकतम फ़ाइल साइज़: 3 GB
- अधिकतम ऑडियो अवधि: 10 घंटे
- अधिकतम टेक्स्ट लंबाई: 675,000 वर्ण