Guide de démarrage rapide de Text to Dialogue
Guide de démarrage rapide de Text to Dialogue
Découvrez comment générer des dialogues immersifs à partir de texte.
Ce guide explique comment générer des dialogues immersifs au son naturel à partir de texte avec l’API Text to Dialogue.
Pour une génération fiable, maintenez la longueur totale de toutes les valeurs inputs[].text à 2 000 caractères
ou moins par requête. Divisez les scripts plus longs en segments et assemblez l’audio côté client.
Utiliser l’API Text to Dialogue
Créer une clé API
Créez une clé API dans le Dashboard ici, que vous utiliserez pour accéder à l’API de manière sécurisée.
Stockez la clé comme secret géré et transmettez-la aux SDK soit en tant que variable d’environnement via un fichier .env, soit directement dans la configuration de votre application, selon vos préférences.
Installer le SDK
SDK
CLI
Nous utiliserons également la bibliothèque dotenv pour charger notre clé API depuis une variable d’environnement.
Effectuer la requête API
SDK
CLI
Créez un fichier nommé example.py ou example.mts, selon le langage choisi, puis ajoutez le code suivant.
Ajoutez des balises audio dans chaque valeur text pour guider l’interprétation de ce locuteur. Le voice_id
sélectionne la voix du locuteur pour le même élément d’entrée.
Exécutez ensuite le programme :
Vous devriez entendre le dialogue audio.
Streaming WebSocket
Pour un dialogue incrémentiel via une connexion persistante avec les modèles Eleven v3, consultez Text to Dialogue en temps réel. Pour comparer ce WebSocket au WebSocket TTS standard, consultez WebSockets Text to Speech et Text to Dialogue.