Démarrage rapide de Voice Remixing

Ce guide vous explique comment remixer une voix existante pour en créer une nouvelle.

Ce guide vous explique comment créer une voix entièrement nouvelle en remixant une voix existante.

Utiliser l’API Voice Design

Ce guide suppose que vous avez configuré votre clé API et votre SDK. Terminez d’abord le démarrage rapide si ce n’est pas déjà fait. Pour lire l’audio sur vos haut-parleurs, vous aurez peut-être aussi besoin de MPV et/ou de ffmpeg.

1

Effectuer la requête API

Le remixage d’une voix se déroule en deux étapes :

  1. Générez un aperçu de la nouvelle voix en fournissant un ID de voix et un prompt.
  2. Créez la nouvelle voix à partir de l’aperçu.

Commencez par générer un aperçu de la nouvelle voix.

Créez un fichier nommé example.py ou example.mts, selon le langage de votre choix, puis ajoutez le code suivant :

Vous pouvez uniquement remixer des voix précédemment conçues, des voix IVC ou PVC, ainsi que les voix de la Voice Library dont les délais de préavis sont illimités.

# example.py
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
from elevenlabs.play import play
import base64
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
voices = elevenlabs.text_to_voice.remix(
voice_id="JBFqnCBsd6RMkjVDRZzb"
voice_description="Use a higher pitch and change to a Boston accent.",
text="Of course I'm a Bostonian, I've lived here all my life!",
)
for preview in voices.previews:
# Convert base64 to audio buffer
audio_buffer = base64.b64decode(preview.audio_base_64)
print(f"Playing preview: {preview.generated_voice_id}")
play(audio_buffer)
2

Exécuter le code

python example.py

Vous devriez entendre les aperçus des voix générées sur vos haut-parleurs, un à la fois.

3

Ajouter la voix générée à votre bibliothèque

Après avoir généré les aperçus et choisi votre favori, vous pouvez l’ajouter à votre bibliothèque de voix à l’aide de l’ID de voix généré afin de l’utiliser avec d’autres API.

voice = elevenlabs.text_to_voice.create(
voice_name="Bostonian",
voice_description="A high pitched Bostonian accent.",
# The generated voice ID of the preview you want to use,
# using the first in the list for this example
generated_voice_id=voices.previews[0].generated_voice_id
)
print(voice.voice_id)

Étapes suivantes