ボイスリミックスのクイックスタート

このガイドでは、既存の音声をリミックスして新しい音声を作成する方法を説明します。

このガイドでは、既存の音声をリミックスしてまったく新しい音声を作成する方法を紹介します。

Voice Design APIの使用

このガイドでは、APIキーとSDKの設定が完了していることを前提としています。まだの場合は、まず クイックスタートを完了してください。スピーカーからオーディオを再生するには、 MPVやffmpegも必要になる場合があります。

1

APIリクエストを作成

音声のリミックスは、次の2ステップで行います。

  1. 音声IDとプロンプトを指定して、新しい音声のプレビューを生成します。
  2. プレビューから新しい音声を作成します。

まず、新しい音声のプレビューを生成します。

使用する言語に応じて、example.pyまたはexample.mtsという新しいファイルを作成し、次のコードを追加します。

リミックスできるのは、以前にデザインした音声、IVCまたはPVCの音声、無期限の通知期間が設定されたボイスライブラリ内の音声のみです。

# example.py
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
from elevenlabs.play import play
import base64
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
voices = elevenlabs.text_to_voice.remix(
voice_id="JBFqnCBsd6RMkjVDRZzb"
voice_description="Use a higher pitch and change to a Boston accent.",
text="Of course I'm a Bostonian, I've lived here all my life!",
)
for preview in voices.previews:
# Convert base64 to audio buffer
audio_buffer = base64.b64decode(preview.audio_base_64)
print(f"Playing preview: {preview.generated_voice_id}")
play(audio_buffer)
2

コードを実行

python example.py

生成された音声プレビューが、1つずつスピーカーから再生されます。

3

生成した音声をライブラリに追加

プレビューを生成してお気に入りを選んだら、生成された音声IDを使ってボイスライブラリに追加できます。これにより、他のAPIでも使用できるようになります。

voice = elevenlabs.text_to_voice.create(
voice_name="Bostonian",
voice_description="A high pitched Bostonian accent.",
# The generated voice ID of the preview you want to use,
# using the first in the list for this example
generated_voice_id=voices.previews[0].generated_voice_id
)
print(voice.voice_id)

次のステップ