Guía de inicio rápido de Texto a Diálogo
Guía de inicio rápido de Texto a Diálogo
Aprende a generar diálogos inmersivos a partir de texto.
Esta guía te mostrará cómo generar diálogos inmersivos y naturales a partir de texto con la API de Texto a Diálogo.
Mantén la longitud total de todos los valores de inputs[].text en 2000 caracteres o menos por solicitud para
obtener una generación fiable. Divide los guiones más largos en fragmentos y une el audio en el cliente.
Uso de la API de Texto a Diálogo
Crear una clave de API
Crea una clave de API aquí, en el panel, que usarás para acceder a la API de forma segura.
Guarda la clave como un secreto gestionado y pásala a los SDK como variable de entorno mediante un archivo .env, o directamente en la configuración de tu aplicación, según prefieras.
Instalar el SDK
SDK
CLI
También usaremos la biblioteca dotenv para cargar nuestra clave de API desde una variable de entorno.
Hacer la solicitud a la API
SDK
CLI
Crea un archivo llamado example.py o example.mts, según el lenguaje que prefieras, y añade el siguiente código.
Añade etiquetas de audio dentro de cada valor de text para guiar la entonación de ese hablante. El voice_id
selecciona la voz del hablante para el mismo elemento de entrada.
Después, ejecútalo:
Deberías oír cómo se reproduce el audio del diálogo.
Streaming con WebSocket
Para diálogos incrementales mediante una conexión de larga duración con modelos Eleven v3, sigue la guía de Texto a Diálogo en Tiempo Real. Para comparar este WebSocket con el WebSocket TTS estándar, consulta WebSockets de Texto a Voz y Texto a Diálogo.