ElevenLabs が新しい音声 AI 製品をリリースし、シリーズ B で 8,000 万ドルを調達
- 公開日
聴くこの記事を聴く
- ElevenLabsは、8,000万ドルのシリーズBラウンドを共同主導したのは Andreessen Horowitz、Nat Friedman、Daniel Grossで、参加したのは Sequoia Capital、 Smash Capital、SV Angel、BroadLight Capital、およびCredo Venturesです。この資金調達により、音声AIのリーダーとしての地位を強化します。
- 本日、新たなプロダクト群も発表します。これにはダビングスタジオ、ボイスライブラリマーケットプレイス、モバイルReader Appの早期プレビュー、そして新モデルが含まれ、速度と言語対応が向上しています。
- 公開開始以来、ElevenLabsのテクノロジーはクリエイターエコノミー、出版、会話型AI、エンターテインメント、教育、アクセシビリティなど幅広い分野で、世界中のコンテンツへのアクセスを改善してきました。数百万人に利用されたことで、ElevenLabsはユニコーン企業となりました。
1月22日/グローバル - ElevenLabsは音声技術の研究企業として、Andreessen Horowitz、Nat Friedman、Daniel Grossが共同主導し、Sequoia Capital、 SV Angel、Smash Capital、BroadLight Capital、およびCredo Venturesが参加する8,000万ドルのシリーズBラウンドを調達しました。音声AIの研究とプロダクト展開におけるグローバルリーダーとしての地位を確固たるものにします。
公開開始以来、ElevenLabsは自然な音声合成で業界をリードし、ユーザーがAI音声を多種多様な言語・アクセントで作成・デザインできるようにしてきました。幅広い感情やイントネーションも表現できます。公開開始以降、ElevenLabsのユーザーは100年分以上のオーディオを生成し、従業員数は5人から40人へと増加しました。現在、ElevenLabsのテクノロジーはFortune 500企業の41%の従業員に利用されています。
ElevenLabsのテクノロジーは数多くの業界で採用されています。クリエイターがボイスオーバーやAI吹き替えで視聴者体験を高められるようにし、教育へのアクセスを広げるとともに、アクセシビリティの向上を含むオーディオブック出版、エンターテインメント、個人利用のための革新的なソリューションを提供してきました。この資金は、AIテクノロジーの安全な展開を確保しながら、プロダクト群をさらに磨き上げるために活用します。
本日のシリーズB発表に加え、ElevenLabsは今後数週間にわたり提供開始予定の複数の新たなプロダクト開発も発表します。
- 新しいダビングスタジオワークフローでは、映画全編の吹き替えに加え、文字起こし、翻訳、タイムコードの生成・編集も可能になり、コンテンツ制作をより細かく管理できます。既存のAI吹き替え機能を補完し、29言語に対応したエンドツーエンドの自動ビデオローカライズを実現します。
- ボイスライブラリマーケットプレイスは、ユーザー自身の声をAI化したバージョンから収益を得られる安全なプラットフォームです。ユーザーはプロフェッショナルなAI音声レプリカを作成・検証し、ボイスライブラリで共有できます。ほかのユーザーが検証済みの音声を使用すると、元のクリエイターに報酬が支払われます。音声を利用可能にするかどうかや報酬条件は、常にユーザーが管理できます。このマーケットプレイスでは、すでに少数のアルファユーザーが収益を得ています。
- モバイルアプリリーダーの早期プレビューでは、テキストやURLを瞬時にオーディオへ変換でき、外出先でも別の形式でコンテンツに簡単にアクセスできます。導入トライアルとして、最初の3か月間は無料で利用でき、ウェイティングリストから早期アクセスに登録できます。
2023年を通じて、ElevenLabsは出版、ゲーム、メディア、会話型分野を含む複数の領域で展開を拡大し、大手メディア企業とのB2Bパートナーシップも構築しました。主なパートナーは以下のとおりです。
- 出版:Storytel、The Washington Post、Rheinische Post、Curio
- 会話型AI:FlowGPT、SimpleTalk AI、Ollang、VoiceDrop、Vana
- メディア&エンターテインメント:Wondershare Filmora、Futuri Media、TheSoul Publishing
- ゲーム:Paradox Interactive、NetEase、Inworld AI
これらの最新プロダクトのローンチとパートナーシップは、すべて自社研究から開発されたツール群をElevenLabsが継続的に拡充してきた流れに続くものです。これまでにリリースしたものには、音声合成による自然なテキスト読み上げ変換や、レイテンシーに最適化したTurboモデル、ボイスデザインとボイスクローンによるカスタム音声の作成、スピーチtoスピーチによる音声変換があります。また、元の話者の声や感情を保ちながら、オーディオとビデオをAI吹き替えで自動翻訳できる業界最高水準のツールもリリースしました。対応言語は29言語です。 現在英語で提供しているTurboモデルとスピーチtoスピーチモデルも、まもなく対応言語をさらに拡大します。
これらの機能を支える研究を基盤に、ElevenLabsはより複雑なワークフロー向けの高度なツールも開発してきました。たとえば、出版向けのStudioや、ビデオローカライズ向けのダビングスタジオがあります。Studioは、出版社向けに長尺コンテンツの編集、構成、ナビゲーション、生成を効率化します。ダビングスタジオは、文字起こし、翻訳、シーケンスのタイミングを直接管理できるようにし、世界中の視聴者に向けたコンテンツの準備を支援します。
また、AI生成音声を共有する場であるボイスライブラリのような、コミュニティ志向のプロダクトも開発しています。以前はボイスデザインツールで作成した人工音声の共有に限定されていましたが、ボイスライブラリでは現在、プロフェッショナルボイスクローンで作成した検証済みの自身の音声レプリカを、新たに導入したボイスライブラリマーケットプレイスの一環として共有し、他者に利用された際に収益を得られます。マーケットプレイスの安全性と信頼性を確保するため、ElevenLabsはプロフェッショナルボイスクローン技術を使用して高忠実度の音声レプリカを作成しています。音声を共有する前に、ユーザーは所定の時間内にテキストプロンプトを読み上げるVoice Captcha検証を通過し、トレーニングサンプルと自身の声が一致することを確認する必要があります。このプロセスとElevenLabsチームによるモデレーションおよび手動承認により、本物でユーザー検証済みの音声だけが共有・収益化され、より安全で信頼できる環境を実現します。
ElevenLabsの最優先事項の一つは、安全かつ責任あるAI開発です。すべてのAI生成コンテンツを明確に識別できるよう、検出機能の実現に重点を置いています。昨年、AI Speech Classifierを公開しました。これは、オーディオサンプルにElevenLabsが生成したコンテンツが含まれているかを確認できるツールです。今年は、より多くの音声AIモデルを対象にClassifierの機能を強化するとともに、他の配信プラットフォームとも連携して幅広い導入を目指します。ElevenLabsは、公開領域での安全性を高める追加の保護策を積極的に開発しています。
今回のシリーズB投資により、ElevenLabsは音声AIの研究とプロダクト展開におけるグローバルリーダーとしての地位を確固たるものにする考えです。資金は研究の推進、インフラの拡大、特定分野向けの新プロダクト開発、そしてAIテクノロジーを責任を持って倫理的に開発するための安全対策の強化に充てられます。
ElevenLabsのCTO、Piotr Dąbkowskiは次のように述べています。
「チームの献身は、すでに音声AIに永続的な影響をもたらしています。今回の新たな資金調達により、さらに大きな課題に取り組み、研究とプロダクト開発での競争優位性を維持することに集中できます。」
Mati Staniszewskiは次のように締めくくっています。
「私たちの志は変わりません。言語とコミュニケーションの壁を取り除き、コンテンツとの関わり方を変革することです。言語だけでなく、声の壁も越えてコンテンツにアクセスできる最先端のテクノロジーを構築し、誰もが大切な情報や物語とつながれるようにします。これまでの進歩は、献身的なチームと投資家の力の証です。まだ旅の始まりにすぎませんが、ともにアクセシビリティとコミュニケーションの未来を形づくっています。」


.jpg&w=3840&q=80)

