音声

ElevenLabsで音声を作成、カスタマイズ、管理する方法を学びます。

概要

ElevenLabsは、音声作成とカスタマイズのためのモデルを提供しています。プラットフォームでは、豊富なボイスライブラリの音声、ボイスクローン、テキストプロンプトで作成した生成音声など、幅広い音声オプションを利用できます。

音声の種類

  • コミュニティ:ElevenLabsのボイスライブラリでコミュニティが共有している音声。
  • クローン:インスタントボイスクローンまたはプロフェッショナルボイスクローンで作成したカスタム音声。
  • Voice Design:Voice Designツールで作成した生成音声。

デフォルト音声は、継続的に使用できる新しい音声に置き換えられます。 すべてのデフォルト音声は2026年12月31日に期限切れとなり、それ以降は利用できなくなります。

コミュニティ

ボイスライブラリには、ElevenLabsコミュニティが共有した10,000以上の音声が収録されています。次のことができます:

  • ElevenLabsコミュニティが共有したユニークな音声を見つける。
  • 音声を個人コレクションに追加する。
  • 有料加入者が自分のボイスクローンを使用すると、報酬を受け取れるよう共有する。

音声をコミュニティで共有し、利用条件を設定しましょう。他のユーザーに使われるたびに報酬を受け取れます。 すでに1,400万ドル以上をお支払いしています。

無料プランのユーザーは、API経由でボイスライブラリの音声を利用できません。

クローン

インスタントボイスクローンなら短いオーディオサンプルから自分の声をクローンでき、プロフェッショナルボイスクローンならリアルな音声を作成できます。

  • インスタントボイスクローン:短いオーディオサンプルからすばやく音声をクローンします。
  • プロフェッショナルボイスクローン:より長いトレーニング用オーディオで、プロ品質のボイスクローンを生成します。

プロフェッショナルボイスクローンが自分の音声サンプルから作成されていることを確認するために、ボイスキャプチャ技術を使用しています。

プロフェッショナルボイスクローンを作成するには、クリエイタープラン以上が必要です。

Voice Design

Voice Designでは、年齢、性別、アクセント、トーンなどの属性を指定して、まったく新しい音声を作成できます。生成音声は次の用途に最適です:

  • 細かな特徴を持つリアルな音声。
  • ゲームやストーリーテリング向けのクリエイティブなキャラクター音声。

Voice Designでは3つの音声プレビューを作成します。必要なのは次の情報だけです:

  • 20~1,000文字の音声の説明。
  • 音声をプレビューするための、100~1,000文字の任意のテキスト。
Eleven v3でのVoice Design

Eleven v3モデルを使用すると、幅広い感情表現が可能な音声をプロンプトでデザインできます。

v3には次のメリットがあります:

  • より自然で多用途な音声生成。
  • 音声特性をより細かくコントロール。
  • プレビュー生成でオーディオタグをサポート。
  • v2モデルとの後方互換性。

ボイスリミックス

ボイスリミックスでは、認識可能な特徴を維持したまま主要な属性を変更して、自分が所有する音声を変換できます。自然言語プロンプトを通じて、性別、アクセント、話し方、話す速さ、オーディオ品質を調整できます。この機能は、さまざまなコンテキストへの音声の適応、キャラクターのバリエーション作成、既存の音声プロファイルのオーディオ品質改善に特に役立ちます。ボイスリミックスは、自分が所有する任意のクローン音声(インスタントボイスクローンまたはプロフェッショナルボイスクローン)またはVoice Designで作成した音声で利用できます。

音声の管理

すべての音声はマイボイスで管理でき、次のことができます:

  • 音声を検索、フィルタリング、分類
  • 説明とカスタムタグを追加
  • すばやくアクセスできるように音声を整理

音声コレクションの管理方法については、マイボイスのドキュメントをご覧ください。

  • 検索とフィルタリング:キーワードまたはタグを使用して音声を見つけます。
  • サンプルのプレビュー:使用前に音声デモを聴けます。
  • コレクションに追加:プロジェクトで簡単にアクセスできるよう音声を保存します。

ヒント:「オーストラリア英語のナレーション」など、特定のアクセントやジャンルで検索してみましょう。

対応言語

すべてのElevenLabs音声は複数の言語に対応しています。ElevenLabsは32言語での音声作成に対応しています。最も自然な結果を得るには、対象地域に合わせて音声を選択してください。

  • 生成音声とクローン音声:アクセントの忠実度は、入力サンプルまたは選択した属性によって異なります。

Multilingual v2モデルは、29言語に対応しています。

英語(米国、英国、オーストラリア、カナダ)、日本語、中国語、ドイツ語、ヒンディー語、フランス語(フランス、カナダ)、韓国語、ポルトガル語(ブラジル、ポルトガル)、イタリア語、スペイン語(スペイン、メキシコ)、インドネシア語、オランダ語、トルコ語、フィリピン語、ポーランド語、スウェーデン語、ブルガリア語、ルーマニア語、アラビア語(サウジアラビア、アラブ首長国連邦)、チェコ語、ギリシャ語、フィンランド語、クロアチア語、マレー語、スロバキア語、デンマーク語、タミル語、ウクライナ語、ロシア語。

Flash v2.5は、v2モデルのすべての言語に加え、以下を含む32言語に対応しています。

ハンガリー語、ノルウェー語、ベトナム語

モデルの詳細

主なポイント

  • インスタントボイスクローン:短いオーディオサンプル(2分未満)から作成され、ほとんどのプランで利用可能
  • プロフェッショナルボイスクローン:最高の忠実度を実現するには長時間のトレーニング用オーディオが必要で、クリエイタープラン以上が必要
  • 音声の共有:プロフェッショナルボイスクローンはボイスライブラリで公開共有できますが、インスタントボイスクローンと生成音声は共有できません
  • 生成音声:Voice Designでテキストによる説明から作成され、ゲーム、アニメーション、クリエイティブなストーリーテリングのユニークなキャラクターに適しています