Démarrage rapide de Forced Alignment

Découvrez comment utiliser l’API Forced Alignment pour aligner du texte sur de l’audio.

Ce guide vous montre comment utiliser l’API Forced Alignment pour aligner du texte sur de l’audio.

Utiliser l’API Forced Alignment

1

Créer une clé API

Créez une clé API dans le Dashboard ici, que vous utiliserez pour accéder à l’API de manière sécurisée.

Stockez la clé comme secret géré et transmettez-la aux SDK soit en tant que variable d’environnement via un fichier .env, soit directement dans la configuration de votre application, selon vos préférences.

.env
ELEVENLABS_API_KEY=<your_api_key_here>
2

Installer le SDK

Nous utiliserons également la bibliothèque dotenv pour charger notre clé API depuis une variable d’environnement.

pip install elevenlabs
pip install python-dotenv
3

Effectuer la requête API

Créez un fichier nommé example.py ou example.mts, selon le langage choisi, puis ajoutez le code suivant :

# example.py
import os
from io import BytesIO
from elevenlabs.client import ElevenLabs
import requests
from dotenv import load_dotenv
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
audio_url = (
"https://storage.googleapis.com/eleven-public-cdn/audio/marketing/nicole.mp3"
)
response = requests.get(audio_url)
audio_data = BytesIO(response.content)
# Perform the text-to-speech conversion
transcription = elevenlabs.forced_alignment.create(
file=audio_data,
text="With a soft and whispery American accent, I'm the ideal choice for creating ASMR content, meditative guides, or adding an intimate feel to your narrative projects."
)
print(transcription)

Exécutez-le ensuite :

python example.py

La transcription du fichier audio, avec des horodatages précis, doit s’afficher dans la console.

Étapes suivantes