Text to Dialogue Schnellstart

Erfahren Sie, wie Sie aus Text immersive Dialoge erstellen.

Diese Anleitung zeigt Ihnen, wie Sie mit der Text-to-Dialogue-API aus Text immersive, natürlich klingende Dialoge erstellen.

Halten Sie die Gesamtlänge aller inputs[].text-Werte für eine zuverlässige Generierung pro Anfrage bei höchstens 2.000 Zeichen. Teilen Sie längere Skripte in Abschnitte auf und fügen Sie das Audio clientseitig zusammen.

Text-to-Dialogue-API verwenden

1

API-Schlüssel erstellen

Erstellen Sie hier im Dashboard einen API-Schlüssel, den Sie für den sicheren Zugriff auf die API verwenden.

Speichern Sie den Schlüssel als verwaltetes Secret und übergeben Sie ihn je nach Präferenz an die SDKs entweder als Umgebungsvariable über eine .env-Datei oder direkt in der Konfiguration Ihrer App.

.env
ELEVENLABS_API_KEY=<your_api_key_here>
2

SDK installieren

Wir verwenden außerdem die Bibliothek dotenv, um unseren API-Schlüssel aus einer Umgebungsvariable zu laden.

pip install elevenlabs
pip install python-dotenv
3

API-Anfrage ausführen

Erstellen Sie je nach bevorzugter Sprache eine neue Datei namens example.py oder example.mts und fügen Sie den folgenden Code hinzu. Fügen Sie Audio-Tags in jeden text-Wert ein, um die Sprechweise des jeweiligen Sprechers zu steuern. Die voice_id wählt die Stimme für denselben Eingabeeintrag aus.

# example.py
import os
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
from elevenlabs.play import play
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
audio = elevenlabs.text_to_dialogue.convert(
inputs=[
{
"text": "[cheerfully] Hello, how are you?",
"voice_id": "9BWtsMINqrJLrRacOk9x",
},
{
"text": "[stuttering] I'm... I'm doing well, thank you.",
"voice_id": "IKne3meq5aSn9XLyUdCD",
}
]
)
play(audio)

Führen Sie den Code anschließend aus:

python example.py

Sie sollten die Audiowiedergabe des Dialogs hören.

WebSocket-Streaming

Für schrittweise generierte Dialoge über eine langlebige Verbindung mit Eleven v3-Modellen folgen Sie Realtime Text to Dialogue. Einen Vergleich dieses WebSockets mit dem Standard-TTS-WebSocket finden Sie unter Text to Speech vs Text to Dialogue WebSockets.

Nächste Schritte