Vai alla navigazione

Guida rapida di Text to Dialogue

Scopri come generare dialoghi coinvolgenti dal testo.

Questa guida ti mostrerà come generare dialoghi coinvolgenti e dal suono naturale a partire dal testo utilizzando l’API Text to Dialogue.

Per una generazione affidabile, mantieni la lunghezza totale di tutti i valori inputs[].text pari o inferiore a 2.000 caratteri per richiesta. Dividi gli script più lunghi in blocchi e unisci l’audio lato client.

Utilizzare l’API Text to Dialogue

1

Crea una chiave API

Crea qui una chiave API nella dashboard, che userai per accedere all’API in modo sicuro.

Archivia la chiave come secret gestito e passala agli SDK come variabile d’ambiente tramite un file .env oppure direttamente nella configurazione della tua app, a seconda delle tue preferenze.

.env
ELEVENLABS_API_KEY=<your_api_key_here>
2

Installa l'SDK

Useremo anche la libreria dotenv per caricare la nostra chiave API da una variabile d’ambiente.

pip install elevenlabs
pip install python-dotenv
3

Effettua la richiesta API

Crea un nuovo file denominato example.py o example.mts, a seconda del linguaggio scelto, e aggiungi il seguente codice. Aggiungi tag audio all’interno di ogni valore text per guidare l’interpretazione di quel parlante. Il parametro voice_id seleziona la voce del parlante per lo stesso elemento di input.

# example.py
import os
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
from elevenlabs.play import play
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
audio = elevenlabs.text_to_dialogue.convert(
inputs=[
{
"text": "[cheerfully] Hello, how are you?",
"voice_id": "9BWtsMINqrJLrRacOk9x",
},
{
"text": "[stuttering] I'm... I'm doing well, thank you.",
"voice_id": "IKne3meq5aSn9XLyUdCD",
}
]
)
play(audio)

Quindi eseguilo:

python example.py

Dovresti sentire la riproduzione dell’audio del dialogo.

Streaming WebSocket

Per dialoghi incrementali su una connessione di lunga durata con i modelli Eleven v3, segui Text to Dialogue in tempo reale. Per confrontare questo WebSocket con il WebSocket TTS standard, consulta WebSocket Text to Speech e Text to Dialogue.

Passaggi successivi