ボイスチェンジャー
ボイスチェンジャー
感情や話し方を保ちながら、音声を別の声に変換する方法を学びます。
概要
ElevenLabsのボイスチェンジャーAPIを使うと、元のパフォーマンスのニュアンスを失わずに、あらゆるソースオーディオ(録音またはアップロード済み)を、完全にクローンされた別の声へ変換できます。ささやき声、笑い声、泣き声、アクセント、繊細な感情の手がかりを捉え、非常にリアルで人間らしい表現を実現できます。用途は次のとおりです:
- 感情的な話し方やニュアンスを維持したまま、あらゆる声を変更
- 複数の言語や録音セッションで一貫したキャラクターボイスを作成
- 既存の録音内の特定の単語やフレーズを修正または置換
ボイスライブラリで、プロジェクトに最適な音声を見つけてください。
対応言語
Multilingual v2モデルは、29言語に対応しています。
英語(米国、英国、オーストラリア、カナダ)、日本語、中国語、ドイツ語、ヒンディー語、フランス語(フランス、カナダ)、韓国語、ポルトガル語(ブラジル、ポルトガル)、イタリア語、スペイン語(スペイン、メキシコ)、インドネシア語、オランダ語、トルコ語、フィリピン語、ポーランド語、スウェーデン語、ブルガリア語、ルーマニア語、アラビア語(サウジアラビア、アラブ首長国連邦)、チェコ語、ギリシャ語、フィンランド語、クロアチア語、マレー語、スロバキア語、デンマーク語、タミル語、ウクライナ語、ロシア語。
eleven_english_sts_v2モデルは英語のみに対応しています。
主な仕様
- 最大セグメント長:5分 — 長い録音はチャンクに分割してください
- 課金:処理するオーディオ1分あたり1,000文字
- バックグラウンドノイズ:出力内の環境音を最小限に抑えるには、
remove_background_noise=trueを使用します - 推奨モデル:英語コンテンツでも、
eleven_multilingual_sts_v2のほうがeleven_english_sts_v2より優れた結果になることがよくあります - カスタム音声:ライブラリ内のクローンまたはデザインされた音声は、どれでも出力音声として使用できます。
voice_idを指定してください