Guía de inicio rápido de remezcla de voz

Esta guía te muestra cómo remezclar una voz existente para crear una nueva.

Esta guía te mostrará cómo crear una voz completamente nueva mezclando una existente.

Uso de la API de Diseño de Voz

Esta guía presupone que ya has configurado tu clave de API y SDK. Completa primero la guía de inicio rápido si aún no lo has hecho. Para reproducir audio por los altavoces, puede que también necesites MPV o ffmpeg.

1

Haz la solicitud a la API

Mezclar una voz es un proceso de dos pasos:

  1. Genera una vista previa de la nueva voz proporcionando un ID de voz y un prompt.
  2. Crea la nueva voz a partir de la vista previa.

Empezaremos generando una vista previa de la nueva voz.

Crea un archivo llamado example.py o example.mts, según el lenguaje que prefieras, y añade el siguiente código:

Solo puedes mezclar voces diseñadas previamente, voces IVC o PVC, y voces de la Biblioteca de Voces que tengan períodos de aviso infinitos.

# example.py
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
from elevenlabs.play import play
import base64
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
voices = elevenlabs.text_to_voice.remix(
voice_id="JBFqnCBsd6RMkjVDRZzb"
voice_description="Use a higher pitch and change to a Boston accent.",
text="Of course I'm a Bostonian, I've lived here all my life!",
)
for preview in voices.previews:
# Convert base64 to audio buffer
audio_buffer = base64.b64decode(preview.audio_base_64)
print(f"Playing preview: {preview.generated_voice_id}")
play(audio_buffer)
2

Ejecuta el código

python example.py

Deberías oír las vistas previas de voz generadas por los altavoces, una a una.

3

Añade la voz generada a tu biblioteca

Cuando hayas generado las vistas previas y elegido tu favorita, puedes añadirla a tu biblioteca de voces mediante el ID de voz generado para usarla con otras API.

voice = elevenlabs.text_to_voice.create(
voice_name="Bostonian",
voice_description="A high pitched Bostonian accent.",
# The generated voice ID of the preview you want to use,
# using the first in the list for this example
generated_voice_id=voices.previews[0].generated_voice_id
)
print(voice.voice_id)

Siguientes pasos