텍스트 대화 빠른 시작

텍스트로 몰입감 있는 대화를 생성하는 방법을 알아보세요.

이 가이드에서는 텍스트 대화 API를 사용하여 텍스트에서 몰입감 있고 자연스러운 대화를 생성하는 방법을 안내합니다.

안정적인 생성을 위해 요청당 모든 inputs[].text 값의 총 길이를 2,000자 이하로 유지하세요. 더 긴 스크립트는 청크로 나누고 클라이언트 측에서 오디오를 이어 붙이세요.

텍스트 대화 API 사용하기

1

API 키 만들기

대시보드에서 API 키를 생성하세요. 이 키로 API에 안전하게 액세스할 수 있습니다.

키는 관리형 시크릿으로 저장하고, .env 파일을 통한 환경 변수 또는 앱 구성에서 직접 SDK에 전달하세요.

.env
ELEVENLABS_API_KEY=<your_api_key_here>
2

SDK 설치하기

환경 변수에서 API 키를 불러오기 위해 dotenv 라이브러리도 사용합니다.

pip install elevenlabs
pip install python-dotenv
3

API 요청 보내기

선택한 언어에 따라 example.py 또는 example.mts라는 새 파일을 만들고 다음 코드를 추가하세요. 각 text 값 안에 오디오 태그를 추가하여 해당 화자의 전달 방식을 지정하세요. voice_id는 같은 입력 항목에 사용할 화자 음성을 선택합니다.

# example.py
import os
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
from elevenlabs.play import play
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
audio = elevenlabs.text_to_dialogue.convert(
inputs=[
{
"text": "[cheerfully] Hello, how are you?",
"voice_id": "9BWtsMINqrJLrRacOk9x",
},
{
"text": "[stuttering] I'm... I'm doing well, thank you.",
"voice_id": "IKne3meq5aSn9XLyUdCD",
}
]
)
play(audio)

그런 다음 실행하세요.

python example.py

대화 오디오가 재생되는 것을 들을 수 있습니다.

WebSocket 스트리밍

Eleven v3 모델을 사용해 장기 연결에서 점진적으로 대화를 생성하려면 실시간 텍스트 대화를 참조하세요. 이 WebSocket과 표준 TTS WebSocket을 비교하려면 텍스트 음성 변환과 텍스트 대화 WebSocket 비교를 참조하세요.

다음 단계