पेश है Eleven v4पेश है Eleven v4, हमारा अब तक का सबसे भावपूर्ण मॉडल। 12 अक्टूबर तक Creator+ के साथ 3 गुना क्रेडिट शामिल हैं

कंटेंट पर जाएं

ElevenLabs ने नए वॉइस AI प्रोडक्ट्स लॉन्च किए और $80M सीरीज B जुटाई

प्रकाशित

सुनेंइस आर्टिकल को सुनें

  • ElevenLabs ने $80m की सीरीज़ B फंडिंग जुटाई है, जिसका सह-नेतृत्व Andreessen Horowitz, Nat Friedman, Daniel Gross, ने किया और जिसमें Sequoia Capital, Smash Capital, SV Angel, BroadLight Capital और Credo Ventures शामिल हुए, ताकि वॉइस AI में अपनी अग्रणी स्थिति और मज़बूत कर सके।
  • कंपनी आज नए प्रोडक्ट्स का एक सेट भी पेश कर रही है, जिनमें डबिंग स्टूडियो, वॉइस लाइब्रेरी मार्केटप्लेस, मोबाइल रीडर ऐप का शुरुआती प्रीव्यू और नए मॉडल शामिल हैं, जिनमें बेहतर स्पीड और ज़्यादा भाषाओं का समर्थन है।
  • लॉन्च के बाद से, ElevenLabs टेक्नोलॉजी ने क्रिएटर इकोनॉमी, पब्लिशिंग, कन्वर्सेशनल AI, मनोरंजन, शिक्षा और एक्सेसिबिलिटी जैसे क्षेत्रों में दुनिया भर में कंटेंट की पहुंच बेहतर की है। लाखों लोगों द्वारा अपनाए जाने से कंपनी को यूनिकॉर्न का दर्जा मिला है।

22 जनवरी / ग्लोबल - ElevenLabs, एक वॉइस टेक्नोलॉजी रिसर्च कंपनी, ने $80m की सीरीज़ B फंडिंग जुटाई है, जिसका सह-नेतृत्व Andreessen Horowitz, Nat Friedman, Daniel Gross ने किया और जिसमें Sequoia Capital, SV Angel, Smash Capital, BroadLight Capital और Credo Ventures शामिल हुए, ताकि वॉइस AI रिसर्च और प्रोडक्ट डिप्लॉयमेंट में ग्लोबल लीडर के रूप में अपनी स्थिति मज़बूत कर सके।

अपने सार्वजनिक लॉन्च के बाद से ElevenLabs ने नेचुरल स्पीच सिंथेसिस में इंडस्ट्री का नेतृत्व किया है। इससे यूज़र कई भाषाओं और एक्सेंट्स में AI वॉइस बना और डिज़ाइन कर सकते हैं, जो कई तरह की भावनाएं और उतार-चढ़ाव व्यक्त कर सकती हैं। लॉन्च के बाद से ElevenLabs के यूज़र्स ने 100 साल से ज़्यादा का ऑडियो जनरेट किया है, जबकि कंपनी 5 से बढ़कर 40 कर्मचारियों तक पहुंच गई। आज ElevenLabs टेक्नोलॉजी का इस्तेमाल Fortune 500 की 41% कंपनियों के कर्मचारी कर रहे हैं। 

ElevenLabs की टेक्नोलॉजी को कई क्षेत्रों में अपनाया गया है। इसने क्रिएटर्स को वॉइसओवर और AI डबिंग से दर्शकों के अनुभव बेहतर बनाने, शिक्षा तक पहुंच बढ़ाने और ऑडियोबुक पब्लिशिंग, मनोरंजन और व्यक्तिगत इस्तेमाल में नए समाधान देने में सक्षम बनाया है, जिनमें एक्सेसिबिलिटी बेहतर करना भी शामिल है। इस फंडिंग का इस्तेमाल AI टेक्नोलॉजी की सुरक्षित तैनाती सुनिश्चित करते हुए कंपनी के प्रोडक्ट्स को और बेहतर बनाने में किया जाएगा।

आज की सीरीज़ B घोषणा के अलावा, ElevenLabs कई नए प्रोडक्ट अपडेट्स भी पेश कर रही है, जो आने वाले हफ्तों में लाइव होंगे:

  • एक नया डबिंग स्टूडियो वर्कफ़्लो यूज़र्स को पूरी फिल्मों की डबिंग करने, साथ ही उनके ट्रांसक्रिप्ट, अनुवाद और टाइमकोड जनरेट व एडिट करने देता है, जिससे कंटेंट प्रोडक्शन पर ज्यादा नियंत्रण मिलता है। ये सुविधाएं मौजूदा AI डबिंग फीचर का विस्तार हैं, जो 29 भाषाओं में ऑटोमेटेड, एंड-टू-एंड वीडियो लोकलाइज़ेशन देता है।
  • एक वॉइस लाइब्रेरी मार्केटप्लेस, जो यूज़र्स को उनकी खुद की आवाज़ के AI वर्ज़न से कमाई करने के लिए एक सुरक्षित प्लेटफ़ॉर्म देगा। यूज़र्स अपनी प्रोफेशनल AI वॉइस रेप्लिका बना, वेरिफ़ाई और वॉइस लाइब्रेरी के ज़रिए शेयर कर सकते हैं। जब दूसरे लोग इन वेरिफ़ाइड वॉइसेज़ का इस्तेमाल करते हैं, तो मूल क्रिएटर्स को भुगतान मिलता है। यूज़र्स हमेशा अपनी आवाज़ की उपलब्धता और भुगतान की शर्तों पर नियंत्रण रखते हैं। मार्केटप्लेस पहले ही अल्फा यूज़र्स के एक छोटे समूह के लिए आय पैदा कर रहा है।
  • इसका शुरुआती प्रीव्यू मोबाइल ऐप रीडर जो टेक्स्ट और URLs को तुरंत ऑडियो में बदल देता है, जिससे यूज़र्स चलते-फिरते किसी दूसरे माध्यम में कंटेंट आसानी से एक्सेस कर सकते हैं। शुरुआती ट्रायल के तहत, ऐप पहले तीन महीनों के लिए मुफ़्त उपलब्ध होगा और यूज़र्स वेटिंग लिस्ट के ज़रिए अर्ली ऐक्सेस के लिए रजिस्टर कर सकेंगे।

2023 के दौरान, ElevenLabs ने पब्लिशिंग, गेमिंग, मीडिया और कन्वर्सेशनल क्षेत्रों समेत कई सेक्टर्स में अपनी मौजूदगी बढ़ाई है, साथ ही प्रमुख मीडिया हाउसेज़ के साथ B2B पार्टनरशिप की हैं, जिनमें ये शामिल हैं:

  • पब्लिशिंग: Storytel, The Washington Post, Rheinische Post, Curio
  • कन्वर्सेशनल AI: FlowGPT, SimpleTalk AI, Ollang, VoiceDrop, Vana
  • मीडिया और मनोरंजन: Wondershare Filmora, Futuri Media, TheSoul Publishing
  • गेमिंग: Paradox Interactive, NetEase, Inworld AI

इन नए प्रोडक्ट लॉन्च और पार्टनरशिप से पहले ElevenLabs लगातार अपने टूल्स का सेट बढ़ा रही थी, जो सभी इन-हाउस रिसर्च से विकसित किए गए हैं। इनमें शामिल हैं: स्पीच सिंथेसिस जैसा प्राकृतिक टेक्स्ट टू स्पीच कन्वर्ज़न और लेटेंसी के लिए ऑप्टिमाइज़्ड Turbo मॉडल; वॉइस डिज़ाइन और वॉइस क्लोनिंग से कस्टम वॉइस बनाने की सुविधा; स्पीच टू स्पीच से एक आवाज़ को दूसरी में बदलना। कंपनी ने अपना इंडस्ट्री-लीडिंग AI डबिंग टूल भी लॉन्च किया, जो मूल स्पीकर की आवाज़ और भावनाओं को बनाए रखते हुए ऑडियो और वीडियो का 29 भाषाओं में अपने-आप अनुवाद कर सकता है। कंपनी जल्द ही Turbo और स्पीच टू स्पीच मॉडल्स का भी अधिक भाषाओं में विस्तार करेगी, जो फिलहाल अंग्रेज़ी में उपलब्ध हैं। 

इन सुविधाओं को संभव बनाने वाली रिसर्च के आधार पर, ElevenLabs ने अधिक जटिल वर्कफ़्लो के लिए एडवांस्ड टूल्स भी विकसित किए हैं, जैसे पब्लिशिंग के लिए स्टूडियो और वीडियो लोकलाइज़ेशन के लिए डबिंग स्टूडियो। स्टूडियो पब्लिशर्स के लिए लंबे कंटेंट को एडिट, स्ट्रक्चर, नेविगेट और जनरेट करना आसान बनाता है, और डबिंग स्टूडियो ट्रांसक्रिप्ट, अनुवाद और सीक्वेंस टाइमिंग पर सीधे नियंत्रण देकर दुनिया भर के दर्शकों के लिए कंटेंट तैयार करने में मदद करता है।

कंपनी ने कम्युनिटी-केंद्रित प्रोडक्ट्स भी विकसित किए हैं, जैसे वॉइस लाइब्रेरी - AI-जनरेटेड वॉइसेज़ को शेयर करने का एक स्थान। पहले यह वॉइस डिज़ाइन टूल से बनी कृत्रिम वॉइसेज़ शेयर करने तक सीमित था, लेकिन अब वॉइस लाइब्रेरी यूज़र्स को प्रोफेशनल वॉइस क्लोनिंग से बनाई गई अपनी वेरिफ़ाइड वॉइस रेप्लिकाज़ को नए वॉइस लाइब्रेरी मार्केटप्लेस के हिस्से के रूप में शेयर करने और दूसरों के इस्तेमाल पर कमाई करने देती है। मार्केटप्लेस की सुरक्षा और विश्वसनीयता सुनिश्चित करने के लिए, ElevenLabs हाई-फिडेलिटी वॉइस रेप्लिकाज़ बनाने में अपनी प्रोफेशनल वॉइस क्लोनिंग टेक्नोलॉजी का इस्तेमाल करती है। आवाज़ शेयर करने से पहले, यूज़र्स को एक तय समय-सीमा में टेक्स्ट प्रॉम्प्ट पढ़कर वॉइस कैप्चा वेरिफ़िकेशन पास करना होता है, ताकि यह पुष्टि हो सके कि उनकी आवाज़ ट्रेनिंग सैंपल्स से मेल खाती है। यह प्रक्रिया, ElevenLabs टीम के मॉडरेशन और मैनुअल अप्रूवल के साथ मिलकर, असली और यूज़र-वेरिफ़ाइड वॉइसेज़ को शेयर और मोनेटाइज़ होना सुनिश्चित करती है, जिससे अधिक सुरक्षित और भरोसेमंद माहौल बनता है।

ElevenLabs की एक मुख्य प्राथमिकता AI का सुरक्षित और ज़िम्मेदार विकास है। हमारा ध्यान डिटेक्शन को सक्षम बनाने पर है, ताकि AI से जनरेट किया गया हर कंटेंट साफ़ तौर पर पहचाना जा सके। कंपनी ने पिछले साल एक AI स्पीच क्लासिफ़ायर लॉन्च किया था; यह एक टूल है जो पुष्टि कर सकता है कि किसी ऑडियो सैंपल में ElevenLabs द्वारा जनरेट किया गया कंटेंट है या नहीं। इस साल कंपनी ज़्यादा वॉइस AI मॉडल्स को कवर करने के लिए क्लासिफ़ायर की क्षमताएं बेहतर करने और व्यापक उपयोग के लिए अन्य डिस्ट्रीब्यूशन प्लेटफ़ॉर्म्स के साथ पार्टनरशिप करने पर काम करेगी। ElevenLabs सार्वजनिक क्षेत्र में सुरक्षा बढ़ाने के लिए अतिरिक्त सुरक्षा उपाय सक्रिय रूप से विकसित कर रही है।

इस सीरीज़ B निवेश के साथ, ElevenLabs वॉइस AI रिसर्च और प्रोडक्ट डिप्लॉयमेंट में ग्लोबल लीडर के रूप में अपनी स्थिति और मज़बूत करना चाहती है। इस पूंजी का इस्तेमाल रिसर्च आगे बढ़ाने, इंफ्रास्ट्रक्चर का विस्तार करने, खास क्षेत्रों के लिए नए प्रोडक्ट्स विकसित करने और AI टेक्नोलॉजी का ज़िम्मेदार व नैतिक विकास सुनिश्चित करने के लिए सुरक्षा उपाय बेहतर बनाने में किया जाएगा।

ElevenLabs के CTO, Piotr Dąbkowski, कहते हैं:

“हमारी टीम के समर्पण ने वॉइस AI पर पहले ही स्थायी प्रभाव डाला है। यह नई फंडिंग हमें और भी बड़ी चुनौतियां लेने और रिसर्च व प्रोडक्ट डेवलपमेंट में अपनी बढ़त बनाए रखने पर ध्यान देने में सक्षम बनाती है।”

Mati Staniszewski ने निष्कर्ष में कहा:

“हमारी महत्वाकांक्षा वही है – भाषा और संचार की बाधाएं हटाकर कंटेंट के साथ हमारे जुड़ने का तरीका बदलना। हम अत्याधुनिक टेक्नोलॉजी बना रहे हैं, ताकि भाषाओं और आवाज़ों के पार कंटेंट को सुलभ बनाया जा सके और हर कोई उस जानकारी व कहानियों से जुड़ सके जो मायने रखती हैं। अब तक की हमारी प्रगति हमारी समर्पित टीम और निवेशकों का प्रमाण है, और भले ही हमारी यात्रा अभी शुरू ही हुई है, हम मिलकर एक्सेसिबिलिटी और संचार का भविष्य आकार देने में मदद कर रहे हैं।”

संबंधित लेख

उच्चतम गुणवत्ता वाले AI ऑडियो के साथ बनाएं