オーディオブック

エンドツーエンドのワークフローで、文章をスタジオ品質のオーディオに変換

オーディオブック

概要

オーディオブックは、文章をスタジオ品質のオーディオに変換するためのエンドツーエンドのワークフローを提供します。

原稿を貼り付けるかアップロードし、ElevenLabsの声を使ってリアルなナレーションを生成し、チャプターでプロジェクトを構成できます。オーディオブックに音楽やサウンドエフェクトを加え、エディター上でナレーションを直接編集・調整できます。

キャラクターキャスティングは原稿内の登場人物を検出し、それぞれに声を提案します。実際の本の会話で声をプレビューすることもできます。登場人物の声を変更すると、その人物が話すすべてのセリフが本全体で更新されます。

完成後は、オーディオブックを書き出すか、ElevenReaderやパートナーのマーケットプレイスなどのリスニングプラットフォームに直接公開できます。

オーディオブックは、再生中にリスナーが好みの声を選べるダイナミックナレーションにも対応しています。

ガイド

オーディオブック - 新しい本を作成
1

ファイルをアップロードして基本設定を選択

オーディオブックページでオーディオブックを作成を選択し、新しいプロジェクトを開始します。

原稿をアップロード

原稿をアップロードエリアにドラッグ&ドロップするか、デバイスを参照してファイルを選択します。現在、オーディオブックでは以下をサポートしています:

  • EPUB
  • PDF

ナレーションスタイルを選択

オーディオブックのナレーションスタイル選択

オーディオブックのナレーション方法を選択します:

  • シングルキャスト — 1人のナレーター音声が本全体を読み上げます
  • マルチキャスト — ナレーターと、原稿内で検出された登場人物にそれぞれ異なる音声を割り当てます

1つの音声で本全体をナレーションする場合はシングルキャストを選択します。ナレーターと登場人物に別々の音声を使った、より演劇的な作品にしたい場合はマルチキャストを選択します。

モデルを選択

オーディオブックに使用するAIモデルを選択します。自然で感情豊かな仕上がりを求める場合、長編ボイスオーバーやオーディオブックには**Eleven Multilingual v2(Studio Quality)**がおすすめです。29言語に対応しています。

続行を選択して、原稿の処理を開始します。

2

原稿を解析してフォーマット

続行を選択すると、ElevenLabsがファイルを自動的に解析します。システムが文書を分析し、メタデータ、章、書式を抽出します。

解析が完了すると、フォーマット画面が表示されます。

表紙画像を確認

EPUBまたはPDFに表紙が含まれている場合、システムが自動的に抽出し、オーディオブックのアートワークとして表示します。以下の操作が可能です:

  • 表紙を差し替える
  • 表紙を削除する
  • 抽出された表紙をそのまま使用する

検出されたセクションを確認

ElevenLabsは、原稿内の以下のような構造的なセクションを識別します:

  • 著作権表示
  • 献辞
  • 序章
  • 章
  • 終章
  • その他の書式設定されたセクション

チェックボックスを使用して、オーディオブックに含めるセクションを選択または選択解除します。

続行する前に、検出された構造を慎重に確認してください。原稿の書式はさまざまであり、システムが常に意図どおりにセクションを識別できるとは限りません。

3

音声を選択して登場人物をキャスティング

登場人物ステップでは、オーディオブックの音声を選択します。

オーディオブックの登場人物キャスティング

マルチキャストのオーディオブックをキャスティング

マルチキャストを選択した場合、ElevenLabsが原稿を分析し、物語内で発話していると判断した登場人物を検出します。その後、以下に固有の音声を割り当てられます:

  • メインナレーター
  • 検出された各登場人物
  • 原稿内で識別されたその他の話者

登場人物の検出はAIによって生成されるため、出発点として扱ってください。特に脇役、名前のない登場人物、周囲のナレーションと区別しにくい話者などは、システムがすべての登場人物を識別できない場合があります。

現在、1冊あたり検出できる音声は最大150件です。

検出された登場人物リストを確認し、必要に応じてキャストを調整します。最終的なキャストが原稿に合うよう、音声の割り当てを追加、変更、削除してください。

カスタムオーディオで音声をプレビューするとクレジットを使用します。

ボイスライブラリを探す

利用可能なスタジオ品質の音声を閲覧するか、検索とフィルターで適切な音声を見つけます。フィルターには以下があります:

  • 言語
  • アクセント
  • カテゴリー
  • 性別
  • 年齢

割り当てる前に音声をプレビューできます。

カスタムオーディオで音声をプレビューするとクレジットを使用します。
4

発音ルールを確認して追加

発音ステップでは、名前、場所、造語、その他の珍しい用語の読み方を調整できます。

オーディオブックの発音エディター

自動検出された用語を確認

ElevenLabsが原稿をスキャンし、発音ルールが必要と思われる用語を提案します。登場人物名、地名、架空の用語などが含まれる場合があります。

提案は自動生成されるため、本で重要なすべての単語が含まれるとは限りません。リストを確認し、特別な扱いが必要な重要な用語にルールを追加してください。

発音ルールを追加

各用語には、エイリアスなどのルールを作成し、希望する出力を入力できます。出力は、その用語をどのように発音するかをモデルに指示します。

右上のルールを追加を選択すると、単語を手動で検索して発音を定義することもできます。

文脈内で発音をプレビュー

ルールの横にある再生アイコンを選択すると、その用語が登場する原稿内の文章を、選択した音声で読み上げます。

文脈の中で聞くことで、以下を確認できます:

  • 発音
  • リズム
  • 前後の文章
  • 割り当てた音声でルールが機能するかどうか

空のルールはスキップされ、それらの用語にはモデルのデフォルトの発音が使用されます。

5

オーディオブックを作成

フォーマット、音声キャスティング、発音ルールに満足したら、右下のオーディオブックを作成を選択します。

ElevenLabsがオーディオブックの作成を開始します。完了後は、プロジェクトの管理、結果の確認、オーディオファイルのエクスポート、または完成したプロジェクトをElevenReaderに公開してリスナーに楽しんでもらうことができます。

編集と再生

オーディオブックの作成後、エディターで内容を調整・強化できます。

ナレーションの生成とプレビュー

コンテンツを追加したら、エディター内でナレーションを直接生成・プレビューできます。

  • 再生ボタンを使用して、ナレーションを生成するか、すでに生成されたオーディオを再生します
  • 生成は各章内の段落単位で行われます

各段落のステータスは、テキスト左側のバーで表示されます:

  • 濃いバー — ナレーションが生成済み
  • 薄いグレーのバー — ナレーションがまだ生成されていない

再生モード

再生ボタンの左側にあるモードセレクターで、再生と生成の動作を選択できます:

  • 選択範囲 — 選択した段落のオーディオのみを再生または生成します
  • 最後まで(一度に1つずつ生成) — 選択した段落から章の最後まで再生し、段落を1つずつ生成します
  • 最後まで(先読みでクリップを生成) — 選択した段落から章の最後まで再生し、よりスムーズに再生できるよう、先の複数の段落を生成します

すでに生成されたオーディオの再生ではクレジットを消費しません。クレジットを使用するのは、 新しいナレーションを生成するときだけです。

オーディオブックを編集

テキストの編集、音声設定の調整、タイミングの変更を行い、必要に応じて特定のセクションを再生成できます。

タイムラインでは、ナレーション、音楽、サウンドエフェクトがどのように一緒に再生されるかを確認し、エクスポート前に調整できます。

オーディオブックを強化

追加のオーディオレイヤーでオーディオブックを充実させられます:

  • 音声 — ナレーション音声を選択または更新します
  • サウンドエフェクト(SFX) — ライブラリからエフェクトを追加するか、カスタムサウンドを生成します
  • 音楽 — Music Marketplaceから選択するか、新しいトラックを生成します

音楽またはサウンドエフェクトを追加するには:

  • **+**アイコンをクリックしてプロジェクトにインポートします
  • これらはタイムライン上で別のトラックとして表示され、ナレーションと同時に再生されます

音声とモデルの設定

エディターのサイドバーとプロジェクト設定にある音声とモデルの設定で、オーディオブックの音声をカスタマイズできます。

  • 音声 — オーディオブックに使用するナレーターを選択します
  • モデル — 音声品質、表現力、対応言語を決定します

以下の2か所で変更できます:

  • エディターのサイドバー — 選択した段落またはセクションに設定を適用します
  • プロジェクト設定 — プロジェクト全体のデフォルト音声とモデルを設定します

プロジェクトレベルの設定にアクセスするには、左上のメニューを開き、プロジェクト設定を選択します。

ElevenLabsは、特長の異なる複数の音声モデルをサポートしています:

  • Eleven v3 — 幅広い言語に対応する、最も表現力豊かなモデル(より細かなプロンプト制御が必要)
  • Eleven Multilingual v2 — 高品質で自然なナレーション(ほとんどのオーディオブック用途のデフォルト)
  • Eleven Flashモデル — 速度と低レイテンシーに最適化

モデルはいつでも切り替えられます。ただし:

モデルを変更しても、すでに生成されたオーディオは更新されません。影響を受ける段落を再生成する必要があり、クレジットを使用します。

新しいオーディオブックを作成する際:

  • デフォルトモデルはEleven Multilingual v2です
  • デフォルトの音声は自動的に選択されます(いつでも変更可能)
  • デフォルトの言語は自動検出に設定されます

エディター内で作業する際は、特定の段落の音声設定を上書きできます。サイドバーで設定を上書きを有効にすると、プロジェクト全体に影響させずに話し方を調整できます

コンテキストサイドバーには、ナレーションを微調整するための再生コントロールがあります:

  • 音量 — 音量を調整します
  • フェードイン/フェードアウト — オーディオの開始と終了の仕方を調整します

これらの設定は選択した段落に適用されます。

サイドバーには、オーディオブックを改善するAI搭載ツールもあります:

  • テキストを強化 — 話し方と明瞭さを改善するようテキストを調整します
  • バックグラウンドオーディオを削除 — 音声分離を使用してオーディオをクリーンアップします
  • ボイスチェンジャーを使用 — 既存オーディオの音声を変更します
  • 自分の音声で話し方を指示 — 参考オーディオを録音して話し方をガイドします(Actor Mode)

オーディオ品質はサブスクリプションプランとプロジェクト設定によって自動的に決まり、クレジット使用量には影響しません。

プロジェクトの正確な出力品質を確認するには、右上の公開をクリックし、エクスポートタブを開いて、オーディオ形式フィールドにカーソルを合わせます。ビットレートやサンプルレートなどの詳細を確認できます。

オーディオブックを公開

重要な動作

オーディオの生成後に音声またはモデルの設定を変更した場合:

  • 既存の段落は自動では更新されません
  • 変更を反映するにはオーディオを再生成する必要があり、クレジットを使用します

コンテキストサイドバー

コンテキストサイドバーは、プロジェクトで選択した内容に応じて更新されます。

ナレーションでは、以下が提供されます:

  • 再生コントロール
  • 音声とモデルの選択
  • 設定の上書き
  • 生成履歴
  • AIツール

これにより、非常に細かいレベルでナレーションを調整・改善できます。

発音辞書

オーディオブック - 発音辞書

発音辞書を使用すると、特定の単語の読み方を調整できます。

これは以下の場合に便利です:

  • 登場人物名
  • ブランド名
  • 頭字語
  • 珍しい単語や曖昧な単語

発音辞書では、次の方法で単語の読み方を定義できます:

  • 音素ルール — 音声表記を使用して発音を指定します
  • エイリアス — 目的の発音になる別の表記に単語を置き換えます

テキスト内の単語が接続された辞書内のルールと一致すると、システムは定義した発音を使用します。

発音辞書の使い方

  1. ツールバーから発音エディターを開きます
  2. 新しい辞書を作成するか、既存の辞書を選択します
  3. 調整したい単語のエントリーを追加します
  4. 接続をクリックして、辞書をプロジェクトに適用します

辞書ファイルをアップロードしたり、発音エディターからすべての辞書を管理したりすることもできます。

重要事項

  • 辞書は順番に適用されます — 最初に一致したルールが使用されます
  • 変更は新しく生成されるオーディオにのみ適用されます。更新内容を聞くには、段落を再生成する必要があります
  • 音素ルールは、Flash v2などの英語モデルでのみサポートされます

発音辞書は、長編オーディオブック全体で一貫性を保つのに特に役立ちます。

登場人物のキャスティング

登場人物のキャスティングでは、本の登場人物に音声を割り当てられます。原稿をアップロードすると、オーディオブックが登場人物を検出し、それぞれに音声を提案します。本に含まれる実際のセリフでプレビューすることもできます。

生成後に登場人物を更新

オーディオ生成後に登場人物の音声を変更すると、その登場人物の以前のオーディオは消去されます。新しい音声でオーディオを再生成する必要があり、クレジットを使用します。続行前に変更の確認が求められます。

その登場人物が話すすべてのセリフが、本全体で更新されます。個々の段落や章を手動で再割り当てする必要はありません。影響を受けるすべての段落のオーディオを自動的に再生成するには、オーディオブックの新しいバージョンをエクスポートします。再生成が必要な段落に対してのみクレジットが請求されます。

ボイスライブラリ

オーディオブックは、10,000種類以上の音声を含むライブラリで90以上の言語のナレーションに対応しています。自分でナレーションしたり登場人物の声を提供したりしたい場合は、数秒で自分の声をクローンすることもできます。

ベストプラクティス

解析ステップから先に進む前に、フォーマットを確認してください。セクションが誤って検出されると、最終的なオーディオブックに影響する可能性があります。

マルチキャストプロジェクトでは、検出されたすべての登場人物と音声の割り当てを確認してください。特に、システムが正しく識別しにくい可能性のある名前のない登場人物や脇役には注意してください。

記述されたルールだけに頼らず、文脈の中で発音プレビューを聞いてください。単独では正しく聞こえる発音でも、文章全体の中では調整が必要になることがあります。

エクスポートまたは公開する前に、生成されたオーディオブックを確認してください。オーディオブックは制作プロセスの多くを自動化できますが、洗練された仕上がりには編集と品質チェックが不可欠です。

章

オーディオブックは章で構成されます。章は手動で作成することも、文書のインポート時に自動検出することもできます。

以下を行えます:

  • **+**ボタンを使用して新しい章を追加する
  • 章の名前変更または並べ替えを行う
  • 章ごとにナレーションを生成する

章を使うと、長いコンテンツを整理しやすくなり、エクスポートの柔軟性も高まります。

ナレーションモード

オーディオブックでは、目的に応じて2つの異なるナレーション方法をサポートしています。

オリジナルオーディオ

選択した音声でオーディオが事前に生成され、すべてのリスナーに対して固定されます。

このモードは、以下を完全にコントロールしたい場合に最適です:

  • 音声の選択
  • タイミングと話し方
  • 音楽とサウンドデザイン

ダイナミックナレーション

固定された音声を使用する代わりに、ダイナミックナレーションでは、リスナーが再生中に好みの音声を選択できます。

このモードは以下に最適です:

  • アクセシビリティ
  • パーソナライズ
  • リスナーの好み

ダイナミックナレーションの再生には、音楽、サウンドエフェクト、外部オーディオは含まれません。

エクスポートと公開

エクスポートオプション

オーディオブックをエクスポートするには、右上の公開をクリックし、エクスポートタブを開きます。

オーディオブックでは、コンテンツの使用方法に応じて柔軟なエクスポートオプションを利用できます。

  • プロジェクト全体
  • 個別の章
  • オーディオ
  • タイムラインデータ(AAF)
  • 字幕
  • 単一ファイル
  • 章ごとのZIP
  • MP3
  • WAV

一部のセクションがまだ生成されていない場合、エクスポート中に自動的に完了します。その際、クレジットを使用します。

公開と配信

オーディオブックを配信するには、右上の公開をクリックし、公開タブを表示したままにします。

以下に直接公開できます:

  • ElevenReader — アプリ内での試聴と配信用
  • SpotifyやInAudioなどのパートナープラットフォーム
  • 追加の形式に対応するElevenLabs Videoまたはオーディオネイティブ

公開すると、オーディオブックをリスナーと共有でき、ElevenReaderなどの対応プラットフォームでは配信による収益化を始められます。

ElevenReaderへの公開

ElevenReaderに公開する際は、オーディオブックを配信向けに準備するための申請フローを進めます。

これには以下が含まれます:

  • 著者プロフィールの作成または選択
  • 本のメタデータ(タイトル、サブタイトル、表紙画像)の追加
  • 配信詳細の提供
  • 支払い設定と契約の設定
  • オーディオブックの確認と申請

申請後、オーディオブックはElevenReaderアプリで利用可能になる前に審査されます。

シリーズでオーディオブックを整理

複数のオーディオブックをシリーズとしてグループ化し、関連コンテンツを整理して見つけやすくできます。

シリーズを作成するには:

  1. 本棚に移動します
  2. シリーズを作成ボタン(右上)をクリックします
  3. 以下を入力します:
    • シリーズ名
    • 説明
    • 著者プロフィール
    • 言語
  4. 必要に応じて既存の本をシリーズに追加します
  5. シリーズを作成をクリックします

よくある質問

いいえ。オーディオブックでは、まだ生成されていないセクションがある場合、書き出し時に自動的に生成され、クレジットが消費されます。

オーディオブックでは、生成されたナレーション(オリジナルオーディオ)により、選択した音声を使用した固定のオーディオファイルが作成されます。

ダイナミックナレーションでは、リスナーが再生中に好みのナレーター音声を選択できます。

はい。ElevenReaderや対応するパートナーマーケットプレイスを含む複数のプラットフォームで、オーディオブックを配信できます。

キャラクターキャスティングは原稿内の登場人物を検出し、検出された各キャラクターに音声を提案します。書籍内の実際のセリフで音声をプレビューすることもできます。

キャラクター検出はAIによって生成されるため、出発点として扱ってください。すべてのキャラクターを特定できるとは限らず、特に脇役、名前のないキャラクター、周囲のナレーションと区別しにくい話者は検出されない場合があります。

キャラクターの音声を変更すると、そのキャラクターのすべてのセリフが書籍全体で更新されます。

オーディオブックには必要な数だけ音声を使用できます。ボイスライブラリには90以上の言語で10,000種類以上の音声があり、ナレーションやキャラクター音声用に自分の声をクローンすることもできます。

キャラクターキャスティングでは、現在、1冊あたり最大150の検出された音声まで対応しています。

オーディオブックはEPUBおよびPDF形式に対応しています。ファイルをアップロードすると、システムが原稿を自動的に解析し、メタデータ、章、書式を抽出します。ファイルに表紙画像が含まれている場合は、自動的に抽出されます。

非常に大きな原稿や複雑なオーディオブックプロジェクトでは、処理中に失敗することがあります。この場合は、原稿の構造を確認してから、もう一度お試しください。

問題を報告する際は、ファイルの詳細、サイズと形式、処理が失敗した段階を含めてください。

No results