음성 리믹싱 빠른 시작

이 가이드에서는 기존 음성을 리믹스하여 새 음성을 만드는 방법을 알아봅니다.

이 가이드에서는 기존 음성을 리믹스하여 완전히 새로운 음성을 만드는 방법을 알려드립니다.

Voice Design API 사용하기

이 가이드는 API 키와 SDK를 설정했다고 가정합니다. 아직 설정하지 않았다면 먼저 빠른 시작 가이드를 완료하세요. 스피커로 오디오를 재생하려면 MPV 및/또는 ffmpeg가 필요할 수도 있습니다.

1

API 요청 보내기

음성 리믹스는 2단계로 진행됩니다.

  1. 음성 ID와 프롬프트를 제공하여 새 음성의 미리보기를 생성합니다.
  2. 미리보기에서 새 음성을 만듭니다.

먼저 새 음성의 미리보기를 생성하겠습니다.

사용할 언어에 따라 example.py 또는 example.mts라는 새 파일을 만들고 다음 코드를 추가하세요.

이전에 디자인한 음성, IVC 또는 PVC 음성, 그리고 무기한 고지 기간이 적용되는 보이스 라이브러리의 음성만 리믹스할 수 있습니다.

# example.py
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
from elevenlabs.play import play
import base64
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
voices = elevenlabs.text_to_voice.remix(
voice_id="JBFqnCBsd6RMkjVDRZzb"
voice_description="Use a higher pitch and change to a Boston accent.",
text="Of course I'm a Bostonian, I've lived here all my life!",
)
for preview in voices.previews:
# Convert base64 to audio buffer
audio_buffer = base64.b64decode(preview.audio_base_64)
print(f"Playing preview: {preview.generated_voice_id}")
play(audio_buffer)
2

코드 실행하기

python example.py

생성된 음성 미리보기가 스피커를 통해 한 번에 하나씩 재생됩니다.

3

생성한 음성을 라이브러리에 추가하기

미리보기를 생성하고 가장 마음에 드는 음성을 선택했다면 생성된 음성 ID를 통해 보이스 라이브러리에 추가하여 다른 API에서 사용할 수 있습니다.

voice = elevenlabs.text_to_voice.create(
voice_name="Bostonian",
voice_description="A high pitched Bostonian accent.",
# The generated voice ID of the preview you want to use,
# using the first in the list for this example
generated_voice_id=voices.previews[0].generated_voice_id
)
print(voice.voice_id)

다음 단계