Guide de démarrage rapide de Speech to Text
Guide de démarrage rapide de Speech to Text
Découvrez comment convertir l’audio parlé en texte.
Ce guide vous explique comment convertir l’audio parlé en texte avec l’API Speech to Text.
Utilisez la compétence Speech to Text d’ElevenLabs pour transcrire de l’audio depuis votre assistant de programmation IA :
Ce tutoriel explique comment utiliser l’API Speech to Text par lot. Pour apprendre à utiliser l’API Realtime Speech to Text, consultez les guides sur le streaming côté client ou le streaming côté serveur.
Utiliser l’API Speech to Text
Créez une clé API
Créez une clé API dans le Dashboard ici, que vous utiliserez pour accéder à l’API de manière sécurisée.
Stockez la clé comme secret géré et transmettez-la aux SDK soit en tant que variable d’environnement via un fichier .env, soit directement dans la configuration de votre application, selon vos préférences.
Installez le SDK
SDK
CLI
Nous utiliserons également la bibliothèque dotenv pour charger notre clé API depuis une variable d’environnement.
Effectuez la requête API
SDK
CLI
Créez un fichier nommé example.py ou example.mts, selon le langage de votre choix, puis ajoutez le code suivant :
Exécutez-le ensuite :
La transcription du fichier audio devrait s’afficher dans la console.
Pour l’audio médical et clinique, définissez model_id sur scribe_v2_medical. Le format de la requête
est le même que pour scribe_v2 et la tarification est identique. Consultez Scribe v2
Medical.