Szybki start z Text to Dialogue

Dowiedz się, jak generować wciągający dialog z tekstu.

Ten przewodnik pokaże ci, jak generować wciągający, naturalnie brzmiący dialog z tekstu za pomocą API Text to Dialogue.

Aby generowanie działało niezawodnie, łączna długość wszystkich wartości inputs[].text w jednym żądaniu nie może przekraczać 2000 znaków. Dłuższe skrypty podziel na fragmenty i połącz audio po stronie klienta.

Korzystanie z API Text to Dialogue

1

Utwórz klucz API

Utwórz klucz API w panelu tutaj, aby bezpiecznie uzyskać dostęp do API.

Przechowuj klucz jako zarządzany sekret i przekaż go do SDK jako zmienną środowiskową przez plik .env lub bezpośrednio w konfiguracji aplikacji — zależnie od preferencji.

.env
ELEVENLABS_API_KEY=<your_api_key_here>
2

Zainstaluj SDK

Użyjemy też biblioteki dotenv, aby wczytać klucz API ze zmiennej środowiskowej.

pip install elevenlabs
pip install python-dotenv
3

Wyślij żądanie API

Utwórz nowy plik o nazwie example.py lub example.mts, zależnie od wybranego języka, i dodaj poniższy kod. Dodaj tagi audio do każdej wartości text, aby określić sposób wypowiedzi danego mówcy. voice_id wybiera głos mówcy dla tego samego elementu wejściowego.

# example.py
import os
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
from elevenlabs.play import play
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
audio = elevenlabs.text_to_dialogue.convert(
inputs=[
{
"text": "[cheerfully] Hello, how are you?",
"voice_id": "9BWtsMINqrJLrRacOk9x",
},
{
"text": "[stuttering] I'm... I'm doing well, thank you.",
"voice_id": "IKne3meq5aSn9XLyUdCD",
}
]
)
play(audio)

Następnie uruchom:

python example.py

Usłyszysz odtwarzany dialog.

Strumieniowanie przez WebSocket

Aby przesyłać dialog stopniowo przez długotrwałe połączenie z modelami Eleven v3, skorzystaj z Realtime Text to Dialogue. Porównanie tego WebSocket ze standardowym WebSocket TTS znajdziesz w Text to Speech vs Text to Dialogue WebSockets.

Kolejne kroki