Vai alla navigazione

Quickstart del remix vocale

Questa guida mostra come remixare una voce esistente per crearne una nuova.

Questa guida mostra come creare una voce completamente nuova remixando una voce esistente.

Uso dell’API Voice Design

Questa guida presuppone che tu abbia configurato la chiave API e l’SDK. Completa prima la guida rapida, se non l’hai già fatto. Per riprodurre l’audio dagli altoparlanti, potresti anche aver bisogno di MPV e/o ffmpeg.

1

Effettua la richiesta API

Il remix di una voce è un processo in due passaggi:

  1. Genera un’anteprima della nuova voce fornendo un ID voce e un prompt.
  2. Crea la nuova voce dall’anteprima.

Inizieremo generando un’anteprima della nuova voce.

Crea un nuovo file denominato example.py o example.mts, a seconda del linguaggio che preferisci, e aggiungi il codice seguente:

Puoi remixare solo voci progettate in precedenza, voci IVC o PVC e le voci della Voice Library con periodi di preavviso infiniti.

# example.py
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
from elevenlabs.play import play
import base64
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
voices = elevenlabs.text_to_voice.remix(
voice_id="JBFqnCBsd6RMkjVDRZzb"
voice_description="Use a higher pitch and change to a Boston accent.",
text="Of course I'm a Bostonian, I've lived here all my life!",
)
for preview in voices.previews:
# Convert base64 to audio buffer
audio_buffer = base64.b64decode(preview.audio_base_64)
print(f"Playing preview: {preview.generated_voice_id}")
play(audio_buffer)
2

Esegui il codice

python example.py

Dovresti sentire le anteprime delle voci generate riprodotte dagli altoparlanti, una alla volta.

3

Aggiungi la voce generata alla libreria

Dopo aver generato le anteprime e scelto la tua preferita, puoi aggiungerla alla libreria vocale tramite l’ID della voce generata, così potrai usarla con altre API.

voice = elevenlabs.text_to_voice.create(
voice_name="Bostonian",
voice_description="A high pitched Bostonian accent.",
# The generated voice ID of the preview you want to use,
# using the first in the list for this example
generated_voice_id=voices.previews[0].generated_voice_id
)
print(voice.voice_id)

Passaggi successivi