Kurzanleitung für professionelles Voice Cloning
Kurzanleitung für professionelles Voice Cloning
Dieser Leitfaden zeigt Ihnen, wie Sie mit der PVC API einen professionellen Stimmklon (PVC) erstellen. Informationen zum Erstellen eines PVC über das Dashboard finden Sie im Produktleitfaden Professioneller Stimmklon.
Zum Erstellen eines PVC benötigen Sie mindestens den Creator-Tarif.
Eine ausführliche Erklärung, wie IVC und PVC technisch funktionieren und wann Sie welche Option wählen sollten, finden Sie unter Stimmklonen: So funktioniert es.
Wenn Sie sich nicht sicher sind, was rechtlich zulässig ist, lesen Sie bitte die Nutzungsbedingungen und unsere Informationen zur KI-Sicherheit .
Das Erstellen eines PVC über die API umfasst deutlich mehr Schritte als das Erstellen eines Instant Voice Clone. PVCs sind komplexer und benötigen mehr Daten sowie Finetuning, um einen hochwertigen Klon zu erstellen.
Die Professional Voice Clone API verwenden
Dieser Leitfaden setzt voraus, dass Sie Ihren API-Schlüssel und das SDK eingerichtet haben. Falls noch nicht geschehen, schließen Sie zuerst den Quickstart ab.
PVC-Stimme erstellen
Erstellen Sie je nach bevorzugter Sprache eine neue Datei mit dem Namen example.py oder example.mts und fügen Sie folgenden Code ein, um eine PVC-Stimme zu erstellen:
Audiodateien hochladen
Als Nächstes laden wir die Audiodateien hoch, die zum Trainieren des PVC verwendet werden. Weitere Informationen dazu, wie Sie mit Ihren Audiodateien die besten Ergebnisse erzielen, finden Sie im Abschnitt Tipps und Vorschläge des PVC-Produktleitfadens.
Sprechertrennung starten
In diesem Schritt wird versucht, die Audiodateien in einzelne Sprecher zu trennen. Dies ist erforderlich, wenn Sie Audio mit mehreren Sprechern hochladen.
Sprecher-Audio abrufen
Da der vorherige Schritt einige Zeit benötigt, sollten Sie den folgenden Schritt nach Abschluss des vorherigen Schritts in einem separaten Prozess ausführen.
Nach Abschluss der Sprechertrennung erhalten Sie für jedes Sample eine Liste von Sprechern. Bei Samples mit mehreren Sprechern müssen Sie den Sprecher auswählen, den Sie für den PVC verwenden möchten. Um den Sprecher zu identifizieren, können Sie das Audio für jeden Sprecher abrufen und anhören.
Samples mit Sprecher-IDs aktualisieren
Nach Abschluss der Sprechertrennung können Sie die Samples aktualisieren, um auszuwählen, welchen Sprecher Sie für den PVC verwenden möchten.
PVC verifizieren
Bevor das Training beginnen kann, ist ein Verifizierungsschritt erforderlich, um sicherzustellen, dass Sie die Berechtigung haben, die Stimme zu verwenden. Fordern Sie zuerst das Verifizierungs-CAPTCHA an.
Das Bild enthält mehrere Textzeilen, die der Eigentümer der Stimme laut vorlesen und aufnehmen muss. Reichen Sie die Aufnahme anschließend ein, um die Identität des Stimmeigentümers zu verifizieren.
(Optional) Manuelle Verifizierung anfordern
Wenn Sie das CAPTCHA nicht verifizieren können, können Sie eine manuelle Verifizierung anfordern. Beachten Sie, dass die Bearbeitung länger dauert.
Verwenden Sie dies nur, wenn die vorherigen Verifizierungsschritte fehlgeschlagen sind oder nicht möglich sind, beispielsweise wenn der Eigentümer der Stimme sehbehindert ist.
Bitte kontaktieren Sie den Support, um eine Liste der für die manuelle Verifizierung erforderlichen Dateien zu erhalten, da jeder Fall individuell sein kann.
PVC trainieren
Starten Sie als Nächstes den Trainingsprozess. Die Dauer hängt von der Länge und Anzahl der bereitgestellten Samples ab.
Neu erstellte Stimme verwenden
Sobald der PVC verifiziert ist, können Sie ihn wie jede andere Stimme verwenden. Weitere Informationen zur Verwendung einer Stimme finden Sie im Text to Speech-Quickstart.