Professional Voice Cloning

Erfahren Sie, wie Sie Ihre Stimme mit unseren führenden Modellen professionell klonen.

Funktion für professionelle Stimmklone

Professionellen Stimmklon erstellen

Beim Klonen einer Stimme ist wichtig, worauf die KI trainiert wurde: welche Sprachen und welcher Datensatztyp. Auf der Seite Modelle erfahren Sie mehr über die einzelnen Modelle und ihre Stärken.

Anleitung

Wenn Sie unsicher sind, was rechtlich zulässig ist, lesen Sie bitte die Nutzungsbedingungen und unsere Informationen zur KI-Sicherheit .

1

Zur Seite für Professional Voice Cloning navigieren

Wählen Sie im ElevenLabs-Dashboard links den Bereich Stimmen und klicken Sie dann auf Stimme erstellen.

Wählen Sie im Pop-up Professioneller Stimmklon aus.

2

Audio hochladen

Professionelle Stimmklone unterstützen derzeit keinen Gesang. Audioaufnahmen dürfen nur gesprochene Sprache enthalten.

Neuen professionellen Stimmklon erstellen

Laden Sie Ihre Audiobeispiele hoch, indem Sie auf Beispiele hochladen klicken.

Wenn Sie noch keine vorab aufgezeichneten Trainingsaudios haben, können Sie direkt in der Oberfläche aufnehmen, indem Sie Selbst aufnehmen wählen. Wir stellen Beispielskripte für erzählerische, dialogorientierte und werbliche Zwecke bereit. Sie können auch Ihr eigenes Skript hochladen.

3

Feedback zur Länge der Beispiele prüfen

Nach dem Upload Ihrer Audiodateien erhalten Sie Feedback zur Länge Ihrer Beispiele. Für beste Ergebnisse empfehlen wir mindestens eine Stunde Trainingsaudio, idealerweise möglichst nahe an drei Stunden.

Neuen professionellen Stimmklon erstellen

4

Audio bearbeiten

Nach dem Upload Ihrer Audiobeispiele können Sie sie bearbeiten, um die Qualität zu verbessern. Sie können Hintergrundgeräusche entfernen und verschiedene Sprecher trennen, falls Ihr Audio mehr als einen Sprecher enthält. Klicken Sie auf die Schaltfläche Audioeinstellungen neben dem Clip, den Sie bearbeiten möchten.

Neuen professionellen Stimmklon erstellen

5

Stimme verifizieren

Sobald alles aufgenommen und hochgeladen wurde, werden Sie aufgefordert, Ihre Stimme zu verifizieren. Für einen reibungslosen Ablauf sollten Sie dieselbe oder ähnliche Ausrüstung wie für die Beispielaufnahmen verwenden sowie einen ähnlichen Tonfall und Vortrag. Wenn Sie nicht auf dieselbe Ausrüstung zugreifen können, verifizieren Sie Ihre Stimme so gut wie möglich. Falls die Verifizierung fehlschlägt, können Sie entweder 24 Stunden warten und es erneut versuchen oder sich an den Support wenden.

6

Warten, bis das Finetuning Ihrer Stimme abgeschlossen ist

Bevor Sie Ihre Stimme verwenden können, muss der Finetuning-Prozess abgeschlossen sein. Während der Verarbeitung können Sie den Status Ihrer Stimme unter „Meine Stimmen“ prüfen. Sie werden benachrichtigt, sobald sie einsatzbereit ist.

7

Stimmklon verwenden

Wählen Sie im Bereich Stimmen des Dashboards den Tab Persönlich und klicken Sie neben Ihrem Stimmklon auf Verwenden, um ihn zu nutzen.

Bevor Sie Ihre Beispiele hochladen, sollten Sie einige Punkte beachten und einige Schritte durchführen, um bestmögliche Ergebnisse zu erzielen.

1

Hochwertiges Audio aufnehmen

Professional Voice Cloning klont die für das Training verwendeten Beispiele sehr präzise. Es erstellt einen nahezu perfekten Klon dessen, was es hört, einschließlich aller Feinheiten und Merkmale dieser Stimme, aber auch aller Artefakte und unerwünschten Geräusche in den Beispielen. Wenn Sie also Beispiele mit geringer Qualität, Hintergrundgeräuschen, Raumhall/Echo oder anderen unerwünschten Geräuschen wie Musik oder mehreren sprechenden Personen hochladen, versucht die KI, auch diese Elemente im Klon nachzubilden.

2

Nur eine einzelne sprechende Stimme sicherstellen

Stellen Sie sicher, dass im gesamten Audio nur eine Person spricht. Mehrere Sprecher, starke Geräusche oder einer der oben genannten Faktoren können die KI verwirren. Dadurch kann die KI möglicherweise nicht erkennen, welche Stimme geklont werden soll, oder den Klang der Stimme falsch interpretieren, weil sie von anderen Geräuschen überlagert wird. Das führt zu einem weniger optimalen Klon.

3

Ausreichend Material bereitstellen

Stellen Sie sicher, dass genügend Material vorhanden ist, um die Stimme korrekt zu klonen. Das absolute Minimum, das wir empfehlen, sind 30 Minuten Audio. Für ein optimales und möglichst präzises Ergebnis empfehlen wir jedoch eher 2–3 Stunden Audio. Je mehr Audio Sie bereitstellen, desto besser ist die Qualität des resultierenden Klons.

4

Stil konsistent halten

Der Sprechstil Ihrer Beispiele wird in der Ausgabe nachgebildet. Je nachdem, welche Sprechweise Sie wünschen, sollten die Trainingsdaten diesem Stil entsprechen. Wenn Sie beispielsweise ein Hörbuch mit einem Klon Ihrer Stimme vertonen möchten, sollte das für das Training eingereichte Audio eine Aufnahme sein, in der Sie ein Buch mit dem gewünschten Tonfall vorlesen. Für konsistente Ergebnisse sollten die hochgeladenen Beispiele nur einen Stil enthalten.

5

Beispiele in der Sprache verwenden, für die der PVC eingesetzt werden soll

Verwenden Sie am besten Beispiele, in denen Sie die Sprache sprechen, für die der PVC hauptsächlich verwendet werden soll. Natürlich kann die KI jede Sprache sprechen, die wir derzeit unterstützen. Beachten Sie jedoch: Wenn die Stimme selbst nicht in der Sprache muttersprachlich ist, die die KI sprechen soll – also wenn Sie eine Stimme geklont haben, die eine andere Sprache spricht –, kann sie einen Akzent aus der Originalsprache haben und Wörter oder Betonungen falsch aussprechen. Wenn Sie beispielsweise eine englischsprachige Stimme klonen und sie anschließend Spanisch sprechen lassen möchten, wird sie beim Spanischsprechen sehr wahrscheinlich einen englischen Akzent haben. Wir unterstützen nur das Klonen von Beispielen, die in einer unserer unterstützten Sprachen aufgenommen wurden. Die Anwendung lehnt Ihr Beispiel ab, wenn es in einer nicht unterstützten Sprache aufgenommen wurde.

In den folgenden Beispielen sehen Sie, was Sie von einer guten bzw. schlechten Aufnahme erwarten können.

Derzeit können Sie nur Ihre eigene Stimme klonen. Bevor Sie Ihre Anfrage zum Finetuning einreichen, müssen Sie einen Verifizierungsprozess durchlaufen.

Tipps und Empfehlungen

Professionelle Aufnahmeausrüstung

Verwenden Sie für optimale Ergebnisse hochwertige Aufnahmeausrüstung, da die KI alles im Audio klont. Hochwertige Eingabe = hochwertige Ausgabe. Jedes Mikrofon funktioniert, aber wir empfehlen ein XLR-Mikrofon mit einem dedizierten Audiointerface. Günstige Optionen wären beispielsweise ein Audio Technica AT2020 oder ein Rode NT1 mit einem Focusrite-Interface oder Ähnlichem.

Popfilter verwenden

Verwenden Sie beim Aufnehmen einen Popfilter. Dadurch werden Plosivlaute minimiert.

Mikrofonabstand

Positionieren Sie sich im richtigen Abstand zum Mikrofon – empfohlen werden etwa zwei Faustbreiten, dies hängt aber auch von der gewünschten Art der Aufnahme ab.

Störungsfreie Aufnahme

Stellen Sie sicher, dass das Audiosignal keine Störungen wie Hintergrundmusik oder Rauschen enthält. Das Klonen durch die KI funktioniert am besten mit sauberem, übersichtlichem Audio.

Raumakustik

Nehmen Sie möglichst in einem akustisch behandelten Raum auf. Das reduziert unerwünschte Echos und Hintergrundgeräusche und liefert der KI klareres Audio. Sie können den Aufnahmebereich auch vorübergehend mit einer dicken Decke oder Steppdecke dämpfen.

Audio-Vorverarbeitung

Bearbeiten Sie Ihr Audio gegebenenfalls vorab, wenn die KI einen bestimmten Klang ausgeben soll. Wenn Sie beispielsweise eine ausgefeilte Podcast-ähnliche Ausgabe wünschen, verarbeiten Sie Ihr Audio entsprechend vor. Dasselbe gilt für lange Pausen oder viele „Ähms“ und „Ahms“ zwischen Wörtern, da die KI diese ebenfalls nachahmt.

Lautstärkeregelung

Halten Sie eine gleichmäßige Lautstärke, die klar hörbar ist, aber keine Verzerrungen verursacht. Ziel ist ein ausgewogener und stabiler Audiopegel. Ideal sind -23 dB bis -18 dB RMS bei einem True Peak von -3 dB.

Ausreichende Audiolänge

Stellen Sie für beste Ergebnisse mindestens 30 Minuten hochwertiges Audio bereit, das den obigen Richtlinien entspricht – vorzugsweise eher 2+ Stunden. Je mehr hochwertige Daten Sie der KI zuführen, desto besser wird der Stimmklon. Die Anzahl der Beispiele spielt keine Rolle; entscheidend ist die Gesamtlaufzeit. Wenn Sie mehrere Stunden Audio hochladen möchten, teilen Sie es jedoch besser in mehrere Beispiele von jeweils etwa 30 Minuten auf. Das erleichtert den Upload.

FAQ

Mit Professional Voice Cloning können Sie im Gegensatz zu Instant Voice Cloning, mit dem Sie Stimmen mit weniger als 2 Minuten Audio schnell klonen können, ein realistischeres Modell Ihrer Stimme trainieren. Dazu wird ein eigenes Modell mit einem großen Satz an Sprachdaten trainiert, um ein Modell zu erzeugen, das von Ihrer Originalstimme praktisch nicht zu unterscheiden ist.

Da Professional Voice Clones Finetuning und Training erfordern, dauert es etwas, bevor Sie Ihren Stimmklon verwenden können. Eine genaue Schätzung ist schwierig, da sie von der Anzahl der Personen vor Ihnen in der Warteschlange und einigen weiteren Faktoren abhängt. In der Regel dauert das Finetuning jedoch 3–6 Stunden.

Sobald Ihr Professional Voice Clone bereit ist, erhalten Sie eine E-Mail-Benachrichtigung.

Nein. Sie können einen Professional Voice Clone nur von Ihrer eigenen Stimme erstellen. Auch mit Zustimmung dürfen Sie die Stimme einer anderen Person nicht klonen. Alle Professional Voice Clones erfordern einen Verifizierungsprozess, der bestätigt, dass die Stimme Ihnen gehört.

Wenn jemand seine Stimme mit Ihnen teilen möchte, kann die Person in ihrem eigenen Konto einen Professional Voice Clone erstellen und verifizieren und ihn dann über einen Freigabelink privat mit Ihnen teilen. Weitere Informationen finden Sie in unserem Artikel: Wie teile ich eine Stimme?

Die Anzahl der verfügbaren Professional Voice Clone (PVC)-Plätze variiert je nach Abonnementstufe:


Basis-PVC-Plätze
  • Free- und Starter-Plan: Keine PVC-Plätze verfügbar
  • Creator-, Pro- und früherer Scale-Plan: 1 PVC-Platz
  • Scale- und früherer Business-Plan: 3 PVC-Plätze
  • Business-Plan: 10 PVC-Plätze
  • Enterprise-Plan: Individuelle Anzahl an PVC-Plätzen

Zusätzliche PVC-Plätze

Sie können zusätzliche PVC-Plätze erhalten, wenn ein Professional Voice Clone, den Sie mit der Voice Library geteilt haben, als Studio Quality eingestuft wird.

  • Die Studio-Quality-Prüfung gilt nur für Stimmen, die Sie mit der Voice Library geteilt haben
  • Nachdem Ihre Stimme in die Voice Library aufgenommen wurde, erfolgt die Studio-Quality-Prüfung automatisch. Sie erfolgt nicht sofort
  • Wenn Ihr geteilter PVC als Studio Quality eingestuft wird, erhalten Sie automatisch einen zusätzlichen PVC-Platz
  • Dies kann mehrfach passieren, wenn mehrere geteilte Stimmen als Studio Quality eingestuft werden
  • Sie können keine weiteren PVCs erstellen, es sei denn, Sie:
    • erhalten zusätzliche Plätze durch die Studio-Quality-Prüfung von Stimmen, die mit der Voice Library geteilt wurden
    • führen ein Upgrade auf Scale oder höher durch
Wichtige Hinweise
  • Professional Voice Clones können nur zum Klonen Ihrer eigenen Stimme verwendet werden
  • Wenn Sie auf eine Stufe unter Creator herabstufen, bleibt Ihr PVC in Ihrem Konto, aber Sie können ihn erst wieder nutzen, wenn Sie ein Upgrade auf Creator oder höher durchführen
  • Die Gesamtzahl der eigenen Stimmen, die Sie haben können, einschließlich PVCs, hängt von Ihrer Abonnementstufe ab

Alle Professional Voice Clones (PVCs) werden automatisch mit den Modellen Flash v2.5, Turbo v2.5 und Multilingual v2 trainiert. PVCs, die mit englischem Audio trainiert wurden, werden außerdem automatisch mit den Modellen Flash v2 und Turbo v2 trainiert.

Wenn Sie bereits einen PVC haben, können Sie ihn jetzt für zusätzliche Modelle feinabstimmen. Wenn künftig neue Modelle veröffentlicht werden, die Fine-Tuning unterstützen, erhalten Sie eine Benachrichtigung. Diese wird durch ein Ausrufezeichen angezeigt, das rechts neben Ihrer Stimme in der Stimmenliste unter My Voices. erscheint. Wenn Sie mit der Maus über dieses Symbol fahren, wird die Benachrichtigung angezeigt.

Um den Fine-Tuning-Prozess zu starten, fahren Sie in der Liste unter My Voices, mit der Maus über den Namen Ihrer Stimme. Dann werden alle verfügbaren Modelle angezeigt. Modelle, für die die Stimme bereits feinabgestimmt wurde, sind mit einem Häkchen markiert. Modelle, die für Fine-Tuning verfügbar sind, werden mit einem Plus-Symbol angezeigt. Klicken Sie einfach auf das Modell, um das Fine-Tuning zu starten. 

Während die Stimme feinabgestimmt wird, können Sie mit der Maus über den Modellnamen fahren, um den Fortschritt zu sehen. Beachten Sie, dass Sie die Seite aufgrund des Stimme-Cachings möglicherweise aktualisieren müssen, um den neuesten Fortschritt zu sehen. Sobald das Fine-Tuning abgeschlossen ist, werden Sie sowohl in der App als auch per E-Mail benachrichtigt.

Ihr Professional Voice Clone durchläuft während der Verarbeitung verschiedene Phasen. Diese Phasen werden im Status angezeigt, den Sie für Ihren Professional Voice Clone unter My Voices sehen.

Um den aktuellen Status anzuzeigen, suchen Sie Ihre Stimme in der Liste und sehen Sie sich die rechts angezeigten Symbole an.

Entwurf: Dieser Status bedeutet, dass Ihre Stimme unvollständig ist. In der Regel liegt das daran, dass Sie die Erstellung der Stimme noch nicht abgeschlossen oder die Stimme noch nicht verifiziert haben.

Um den Verifizierungsprozess zu durchlaufen, klicken Sie auf das Häkchen-Symbol.

Um zum Prozess der Stimmerstellung zurückzukehren, klicken Sie auf Weitere Aktionen (drei Punkte) und wählen Sie Stimme bearbeiten.

Nachdem Sie Ihre Stimme verifiziert haben, muss sie für unsere Modelle einem Finetuning unterzogen werden, bevor Sie sie verwenden können. Sie können diesen Prozess verfolgen, indem Sie unter My Voices mit dem Mauszeiger über den Namen Ihrer Stimme fahren. Hier sehen Sie alle verfügbaren Modelle sowie ein Symbol für den Status jedes Modells. 

Fahren Sie für weitere Informationen mit dem Mauszeiger über den Namen des Modells. Sie sehen dann einen der folgenden Status:

Der Trainingslauf wurde geplant: Das bedeutet, dass Ihre Stimme auf einen freien Platz für das Training wartet. Wie lange Ihre Stimme in der Warteschlange bleibt, hängt davon ab, wie viele andere Stimmen ebenfalls in der Warteschlange stehen.

Datensatz wird erstellt und Finetuning wird ausgeführt: Sobald ein Platz frei wird, beginnt der Finetuning-Prozess. Dies kann 6–24 Stunden dauern. Der Fortschritt jedes Schritts im Trainingsprozess Ihrer Stimme wird als Prozentsatz angezeigt.

Leider gab es beim Trainingslauf Probleme und er wurde erneut gestartet. Sie müssen nichts weiter tun

Das bedeutet, dass etwas schiefgelaufen ist, Ihre Stimme jedoch automatisch in die Warteschlange gestellt wurde, um den Finetuning-Prozess erneut zu starten. Beim nächsten Versuch sollte das Finetuning Ihrer Stimme erfolgreich abgeschlossen werden. Falls mehrere Fehler auftreten, wenden Sie sich bitte per E-Mail an support@elevenlabs.io an den Support.

Die Stimme kann mit dem Modell verwendet werden: Das bedeutet, dass der Finetuning-Prozess für dieses Modell abgeschlossen ist und Sie Ihre Stimme nun mit diesem Modell verwenden können.

Klicken, um das Finetuning zu starten: Einige Modelle werden nicht automatisch trainiert. Sie müssen auf den Modellnamen klicken, um das Finetuning zu starten. Falls zusätzliche Modelle für das Finetuning Ihrer Stimme verfügbar wurden, sehen Sie neben Ihrer Stimme ein Ausrufezeichen-Symbol. 

Um das Finetuning zu starten, fahren Sie einfach mit dem Mauszeiger über den Namen Ihrer Stimme und klicken Sie auf den Namen des Modells.

Bei der professionellen Stimmklonung wird das Modell mit großen Mengen der Stimme einer bestimmten Person trainiert (feinabgestimmt), um ein individuelles Modell zu erstellen.

Nachdem Sie Ihre Samples hochgeladen und Ihre Stimme verifiziert haben, wird Ihre professionelle Stimmklonung in die Warteschlange aufgenommen. Die geschätzte Trainingszeit beträgt etwa 3–6 Stunden. Sie hängt von einigen Faktoren ab, daher ist keine genaue Schätzung möglich. Leider kann es manchmal länger dauern.

Den aktuellen Status Ihrer Stimme können Sie unter Meine Stimmen. prüfen. Weitere Informationen finden Sie unter Was bedeutet der Status meiner professionellen Stimmklonung?

Sobald für Ihre PVC die Feinabstimmung abgeschlossen ist, erhalten Sie in der App und per E-Mail Benachrichtigungen, dass Ihre Stimme nun einsatzbereit ist.

Nachdem Sie Ihre Stimme verifiziert haben, muss sie für unsere Modelle einem Finetuning unterzogen werden, bevor Sie sie verwenden können. Währenddessen können Sie den Status Ihrer Stimme unter My Voices prüfen, indem Sie mit dem Mauszeiger über den Namen Ihrer Stimme fahren. Dort werden alle verfügbaren Modelle für Ihre Stimme angezeigt. Um den Status eines Modells zu prüfen, fahren Sie mit dem Mauszeiger über dessen Namen. 

Falls etwas schiefgelaufen ist, wird möglicherweise folgender Status angezeigt:

Leider gab es beim Trainingslauf Probleme und er wurde erneut gestartet. Sie müssen nichts weiter tun. Das bedeutet, dass etwas schiefgelaufen ist. Ihre Stimme wurde jedoch automatisch in die Warteschlange gestellt, um den Finetuning-Prozess erneut zu starten. Beim nächsten Versuch sollte das Finetuning Ihrer Stimme erfolgreich abgeschlossen werden. Falls jedoch mehrere Fehler auftreten, könnte ein Problem mit dem Datensatz vorliegen, das die KI nicht beheben kann.

Sie können versuchen, das Problem zu beheben, indem Sie die Stimme löschen und die Daten von Anfang an erneut hochladen. Das hat einigen Nutzern geholfen.

Falls das Problem dadurch nicht behoben wird, sollten Sie Ihre Trainingsaudios überprüfen und gegebenenfalls andere Trainingsaudios verwenden.

Bei Fehlern während des Finetuning-Prozesses können Sie sich jederzeit per E-Mail an support@elevenlabs.io wenden.

Wenn alle Ihre Verifizierungsversuche bei der Erstellung Ihres Professional Voice Clone fehlschlagen, können Sie 24 Stunden warten und den Prozess anschließend erneut versuchen.

Sie können sich auch per E-Mail an support@elevenlabs.io wenden, damit unser Support das Problem prüft. Wenn alles korrekt aussieht, werden Ihre Verifizierungsversuche zurückgesetzt, damit Sie den Prozess erneut versuchen können.

Hier sind einige Empfehlungen, damit Sie Ihren Professional Voice Clone erfolgreich verifizieren können:

  • Stellen Sie sicher, dass Ihr Webbrowser Ihr Mikrofon verwenden darf und dass Ihr Mikrofon nicht stummgeschaltet ist.
  • Stellen Sie sicher, dass die mit Ihrem Computermikrofon aufgezeichnete Audiodatei der für das Klonen hochgeladenen Audiodatei ähnelt und keine Hintergrundgeräusche oder andere externe Audio-Störungen enthält.
  • Versuchen Sie, ähnlich zu sprechen wie in der Audioaufnahme, mit der Sie die Stimme trainiert haben.
  • Lesen Sie jede Verifizierungszeile nur einmal vor und drücken Sie dann Stopp, um die Aufnahme zu beenden. Wenn Sie die Zeile mehrmals vorlesen, kann die Verifizierung fehlschlagen.

Leider ist das nicht möglich. Wie während der Einrichtung Ihres Professional Voice Clone (PVC) erwähnt, sind Sie nach dem Übergang zur Verifizierungsphase daran gebunden, bis Sie Ihre Stimme verifiziert haben.

Wenn Sie Hilfe mit Ihrem Professional Voice Clone benötigen, kontaktieren Sie bitte den Support per E-Mail an support@elevenlabs.io.

Wir unterstützen Professional Voice Cloning für alle Sprachen, die vom Modell Flash v2.5 unterstützt werden.

Aktuell unterstützen wir mit Professional Voice Cloning folgende Sprachen:

  • 🇺🇸 Englisch (USA)
  • 🇬🇧 Englisch (UK)
  • 🇦🇺 Englisch (Australien)
  • 🇨🇦 Englisch (Kanada)
  • 🇯🇵 Japanisch
  • 🇨🇳 Chinesisch
  • 🇩🇪 Deutsch
  • 🇮🇳 Hindi
  • 🇫🇷 Französisch (Frankreich)
  • 🇨🇦 Französisch (Kanada)
  • 🇰🇷 Koreanisch
  • 🇧🇷 Portugiesisch (Brasilien)
  • 🇵🇹 Portugiesisch (Portugal)
  • 🇮🇹 Italienisch
  • 🇪🇸 Spanisch (Spanien)
  • 🇲🇽 Spanisch (Mexiko)
  • 🇮🇩 Indonesisch
  • 🇳🇱 Niederländisch
  • 🇹🇷 Türkisch
  • 🇵🇭 Filipino
  • 🇵🇱 Polnisch
  • 🇸🇪 Schwedisch
  • 🇧🇬 Bulgarisch
  • 🇷🇴 Rumänisch
  • 🇸🇦 Arabisch (Saudi-Arabien)
  • 🇦🇪 Arabisch (VAE)
  • 🇨🇿 Tschechisch
  • 🇬🇷 Griechisch
  • 🇫🇮 Finnisch
  • 🇭🇷 Kroatisch
  • 🇲🇾 Malaiisch
  • 🇸🇰 Slowakisch
  • 🇩🇰 Dänisch
  • 🇮🇳 Tamil
  • 🇺🇦 Ukrainisch
  • 🇷🇺 Russisch
  • 🇭🇺 Ungarisch
  • 🇳🇴 Norwegisch
  • 🇻🇳 Vietnamesisch

Für Instant Voice Cloning und Professional Voice Cloning akzeptieren wir verschiedene Dateitypen. Wir empfehlen dringend MP3 mit 192 kbps oder höher.

Empfohlenes Format

  • MP3, 192 kbps oder höher

Empfohlene Länge

  • Instant Voice Cloning: 1–2 Minuten gutes Audio
  • Professional Voice Cloning: 30–180 Minuten gutes Audio

Unkomprimierte Formate wie WAV verbessern die Qualität des Klons in der Regel nicht und können Probleme beim Upload verursachen. Konzentrieren Sie sich stattdessen auf die Aufnahmequalität: Verwenden Sie eine saubere Aufnahme ohne Hintergrundgeräusche, Raumhall oder mehrere Sprecher, mit gleichbleibender Lautstärke und Stimmfarbe sowie ohne lange Sprechpausen.

Weitere Informationen finden Sie unter Instant Voice Cloning (IVC) und Professional Voice Cloning (PVC).

Bei ElevenLabs setzen wir uns uneingeschränkt dafür ein, sowohl geistige Eigentumsrechte zu respektieren als auch Schutzmaßnahmen gegen den möglichen Missbrauch unserer Technologie umzusetzen:

  • Wir arbeiten nur mit Kunden zusammen, die unsere Nutzungsbedingungen und Richtlinie zur verbotenen Nutzung einhalten. Diese untersagen die böswillige Nutzung unserer Technologie für Zwecke, die als illegal oder schädlich gelten können;
  • Wir unterstützen Stimmeninhaber und ihre Lizenzgeber dabei, ihre Rechte geltend zu machen. Alle bekannten Verstöße werden geprüft und bearbeitet;
  • Alle von unseren Modellen generierten Audios können sofort bis zum für die Generierung verantwortlichen Nutzer zurückverfolgt werden.

Die von uns entwickelte Technologie ist neu, und klare Regulierungen müssen erst noch eingeführt werden. Als KI-Forschungslabor wollen wir auch das Bewusstsein für diese Technologie, ihr Potenzial und ihre Grenzen stärken.

Eine vollständige Anleitung finden Sie in unserer Dokumentation zu Instant Voice Cloning und Professional Voice Cloning.

Kurz gesagt: Gute, konsistente Eingaben = gute, konsistente Ausgaben.

Länge

  • Instant Voice Cloning: 1–2 Minuten gutes Audio
  • Professional Voice Cloning: 30–180 Minuten gutes Audio

Verwenden Sie die besten und klarsten Audio-Clips, die Sie finden können. Es sollte nur ein Sprecher ohne Hintergrundgeräusche oder Störungen zu hören sein. Die Stimme sollte laut und deutlich sein.

Statt viele Clips unterschiedlicher Qualität nur zur Verlängerung zu verwenden, sollten Sie Clips mit offensichtlich sehr hoher Mikrofonqualität priorisieren, deren Qualität und Klang durchgehend konsistent sind. Konzentrieren Sie sich nicht nur darauf, die Gesamtdauer zu erhöhen.

Stellen Sie sicher, dass die meisten Dialoge in Ihren Clips dem von Ihnen bevorzugten Sprechstil und der gewünschten Intonation des Sprechers entsprechen. Es sollten nicht zu viele Dialogabschnitte enthalten sein, in denen der Sprecher von den gewünschten Sprachmustern abweicht.

Verwenden Sie bei Bedarf eine Rauschunterdrückung, um Hintergrundgeräusche zu reduzieren.

Weitere Informationen finden Sie hier in unserer Dokumentation.

Ja. Sie können Ihre Stimme in jeder von Flash v2.5 und Multilingual v2 unterstützten Sprache klonen. Die vollständige Liste der unterstützten Sprachen finden Sie hier.

Sie können auch eine Stimme klonen, die eine Sprache spricht, die die KI nicht unterstützt. Der Klon kann den Klang des Sprechers erfassen, wird diese Sprache jedoch nicht sprechen können. Die Ergebnisse können unvorhersehbar sein. Davon raten wir ab.

Sie können Ihre Stimmklone nicht als eigenständige Dateien herunterladen oder exportieren. Stimmklone bleiben in Ihrem ElevenLabs-Konto.

Sie können Ihre ElevenLabs-Stimmen dennoch außerhalb der ElevenLabs-Website nutzen. Mit Ihrem API-Schlüssel können Drittanbieterdienste die ElevenLabs API aufrufen und mit den Stimmen in Ihrem Konto Sprache generieren.

Wenn Sie einen Klon später erneut erstellen möchten, bewahren Sie die ursprünglichen Audio-Beispiele auf, die Sie dafür verwendet haben. Jeder Klon klingt etwas anders, auch wenn Sie dasselbe Audio verwenden.

ElevenLabs bietet zwei Optionen zum Klonen:

  • Sofortige Stimmklonung: Schnelle Ergebnisse mit etwa 1–3 Minuten Audiomaterial. Funktioniert gut für die meisten Stimmen, kann aber bei ungewöhnlichen Akzenten oder einzigartigen Stimmen Schwierigkeiten haben.
  • Professionelle Stimmklonung: Höhere Wiedergabetreue mit 30 Minuten bis etwa 3 Stunden Audiomaterial. Die Feinabstimmung dauert in der Regel 3–6 Stunden und kann länger dauern, wenn viele Stimmen in der Warteschlange sind.

Wenn die sofortige Stimmklonung Ihre Stimme oder Ihren Akzent nicht gut erfasst, versuchen Sie es mit der professionellen Stimmklonung.

Sie können den Akzent oder Ton einer geklonten Stimme nach ihrer Erstellung nicht ändern. Um das Ergebnis zu verbessern, ändern Sie die verwendeten Audiosamples. Kleine Änderungen an den Samples können einen großen Unterschied machen.

Dieser Fehler wird angezeigt, wenn Sie Ihren Professional Voice Clone (PVC) verwenden möchten, bevor das Finetuning abgeschlossen ist und er zur Verwendung bereitsteht.

Wenn Sie einen PVC erstellen, durchläuft er mehrere Prozesse, bevor er verwendet werden kann.  Nachdem Sie Ihre Stimme verifiziert haben, wird sie verarbeitet und für das Finetuning in die Warteschlange gestellt.   Je nachdem, wie viele andere Stimmen aktuell für das Finetuning in der Warteschlange stehen, dauert dieser Prozess in der Regel schätzungsweise 3–6 Stunden, kann aber bis zu 24 Stunden dauern.

Sie können den Fortschritt Ihres PVC unter My Voices prüfen: Suchen Sie die Stimme in Ihrer Stimmenliste und klicken Sie dann auf Anzeigen, um weitere Details zu sehen.  Wenn Sie mit dem Mauszeiger über ein Modell fahren, sehen Sie den aktuellen Status.  

Weitere Informationen zur Bedeutung der einzelnen Status finden Sie unter Was bedeutet der Status meines Professional Voice Clone?

Wenn das Finetuning Ihres PVC abgeschlossen ist und er verwendet werden kann, erhalten Sie eine Pop-up-Benachrichtigung sowie eine E-Mail.

No results