Guía de inicio rápido de Voz a Texto
Guía de inicio rápido de Voz a Texto
Descubre cómo convertir audio hablado en texto.
Esta guía te mostrará cómo convertir audio hablado en texto con la API de Voz a Texto.
Usa la skill de voz a texto de ElevenLabs para transcribir audio desde tu asistente de programación con IA:
Este tutorial mostrará cómo usar la API de Voz a Texto por Lotes. Para ver una guía sobre cómo usar la API de Voz a Texto en Tiempo Real, consulta las guías de streaming del lado del cliente o streaming del lado del servidor.
Uso de la API de Voz a Texto
Crea una clave de API
Crea una clave de API aquí, en el panel, que usarás para acceder a la API de forma segura.
Guarda la clave como un secreto gestionado y pásala a los SDK como variable de entorno mediante un archivo .env, o directamente en la configuración de tu aplicación, según prefieras.
Instala el SDK
SDK
CLI
También usaremos la biblioteca dotenv para cargar nuestra clave de API desde una variable de entorno.
Haz la solicitud a la API
SDK
CLI
Crea un archivo llamado example.py o example.mts, según el lenguaje que elijas, y añade el siguiente código:
Después, ejecútalo:
Verás la transcripción del archivo de audio en la consola.
Para audio médico y clínico, establece model_id en scribe_v2_medical. La estructura de la solicitud
es la misma que para scribe_v2 y se factura a la misma tarifa. Consulta Scribe v2
Medical.