Vai alla navigazione

Guida rapida a Forced Alignment

Scopri come usare l'API Forced Alignment per allineare il testo all'audio.

Questa guida ti mostrerà come usare l’API Forced Alignment per allineare il testo all’audio.

Uso dell’API Forced Alignment

1

Crea una chiave API

Crea qui una chiave API nella dashboard, che userai per accedere all’API in modo sicuro.

Archivia la chiave come secret gestito e passala agli SDK come variabile d’ambiente tramite un file .env oppure direttamente nella configurazione della tua app, a seconda delle tue preferenze.

.env
ELEVENLABS_API_KEY=<your_api_key_here>
2

Installa l'SDK

Useremo anche la libreria dotenv per caricare la nostra chiave API da una variabile d’ambiente.

pip install elevenlabs
pip install python-dotenv
3

Effettua la richiesta API

Crea un nuovo file denominato example.py o example.mts, in base al linguaggio che preferisci, e aggiungi il codice seguente:

# example.py
import os
from io import BytesIO
from elevenlabs.client import ElevenLabs
import requests
from dotenv import load_dotenv
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
audio_url = (
"https://storage.googleapis.com/eleven-public-cdn/audio/marketing/nicole.mp3"
)
response = requests.get(audio_url)
audio_data = BytesIO(response.content)
# Perform the text-to-speech conversion
transcription = elevenlabs.forced_alignment.create(
file=audio_data,
text="With a soft and whispery American accent, I'm the ideal choice for creating ASMR content, meditative guides, or adding an intimate feel to your narrative projects."
)
print(transcription)

Quindi eseguilo:

python example.py

Dovresti vedere nella console la trascrizione del file audio con timestamp precisi.

Passaggi successivi