Voice Design – Schnellstart

Dieser Leitfaden zeigt Ihnen, wie Sie mit der Voice Design API eine Stimme über einen Text-Prompt designen.

Dieser Leitfaden zeigt Ihnen, wie Sie mit der Voice Design API eine Stimme über einen Prompt designen.

Voice Design API verwenden

Dieser Leitfaden setzt voraus, dass Sie Ihren API-Schlüssel und Ihr SDK eingerichtet haben. Schließen Sie zuerst die Schnellstartanleitung ab, falls Sie dies noch nicht getan haben. Um Audio über Ihre Lautsprecher wiederzugeben, benötigen Sie möglicherweise auch MPV und/oder ffmpeg.

1

API-Anfrage stellen

Das Designen einer Stimme über einen Prompt erfolgt in zwei Schritten:

  1. Erstellen Sie Vorschauen basierend auf einem Prompt.
  2. Wählen Sie die beste Vorschau aus und verwenden Sie sie, um eine neue Stimme zu erstellen.

Beginnen wir mit der Erstellung von Vorschauen basierend auf einem Prompt.

Erstellen Sie je nach bevorzugter Sprache eine neue Datei namens example.py oder example.mts und fügen Sie den folgenden Code hinzu:

# example.py
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs
from elevenlabs.play import play
import base64
load_dotenv()
elevenlabs = ElevenLabs(
api_key=os.getenv("ELEVENLABS_API_KEY"),
)
voices = elevenlabs.text_to_voice.design(
model_id="eleven_multilingual_ttv_v2",
voice_description="A massive evil ogre speaking at a quick pace. He has a silly and resonant tone.",
text="Your weapons are but toothpicks to me. Surrender now and I may grant you a swift end. I've toppled kingdoms and devoured armies. What hope do you have against me?",
)
for preview in voices.previews:
# Convert base64 to audio buffer
audio_buffer = base64.b64decode(preview.audio_base_64)
print(f"Playing preview: {preview.generated_voice_id}")
play(audio_buffer)
2

Code ausführen

python example.py

Sie sollten die generierten Stimmvorschauen nacheinander über Ihre Lautsprecher hören.

3

Generierte Stimme zu Ihrer Bibliothek hinzufügen

Sobald Sie die Vorschauen erstellt und Ihren Favoriten ausgewählt haben, können Sie ihn über die generierte Stimmen-ID zu Ihrer Stimmbibliothek hinzufügen, damit er mit anderen APIs verwendet werden kann.

voice = elevenlabs.text_to_voice.create(
voice_name="Jolly giant",
voice_description="A huge giant, at least as tall as a building. A deep booming voice, loud and jolly.",
# The generated voice ID of the preview you want to use,
# using the first in the list for this example
generated_voice_id=voices.previews[0].generated_voice_id
)
print(voice.voice_id)

Nächste Schritte