For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
Erfahren Sie, wie Sie Ihre Stimme mit unseren führenden Modellen professionell klonen.
Professionellen Stimmklon erstellen
Beim Klonen einer Stimme ist wichtig, worauf die KI trainiert wurde: welche Sprachen und welcher Datensatztyp. Auf der Seite Modelle erfahren Sie mehr über die einzelnen Modelle und ihre Stärken.
Professionelle Stimmklone unterstützen derzeit keinen Gesang. Audioaufnahmen dürfen nur
gesprochene Sprache enthalten.
Laden Sie Ihre Audiobeispiele hoch, indem Sie auf Beispiele hochladen klicken.
Wenn Sie noch keine vorab aufgezeichneten Trainingsaudios haben, können Sie direkt in der Oberfläche aufnehmen, indem Sie Selbst aufnehmen wählen. Wir stellen Beispielskripte für erzählerische, dialogorientierte und werbliche Zwecke bereit. Sie können auch Ihr eigenes Skript hochladen.
Nach dem Upload Ihrer Audiodateien erhalten Sie Feedback zur Länge Ihrer Beispiele. Für beste Ergebnisse empfehlen wir mindestens eine Stunde Trainingsaudio, idealerweise möglichst nahe an drei Stunden.
Nach dem Upload Ihrer Audiobeispiele können Sie sie bearbeiten, um die Qualität zu verbessern. Sie können Hintergrundgeräusche entfernen und verschiedene Sprecher trennen, falls Ihr Audio mehr als einen Sprecher enthält. Klicken Sie auf die Schaltfläche Audioeinstellungen neben dem Clip, den Sie bearbeiten möchten.
Sobald alles aufgenommen und hochgeladen wurde, werden Sie aufgefordert, Ihre Stimme zu verifizieren. Für einen reibungslosen Ablauf sollten Sie dieselbe oder ähnliche Ausrüstung wie für die Beispielaufnahmen verwenden sowie einen ähnlichen Tonfall und Vortrag. Wenn Sie nicht auf dieselbe Ausrüstung zugreifen können, verifizieren Sie Ihre Stimme so gut wie möglich. Falls die Verifizierung fehlschlägt, können Sie entweder 24 Stunden warten und es erneut versuchen oder sich an den Support wenden.
Warten, bis das Finetuning Ihrer Stimme abgeschlossen ist
Bevor Sie Ihre Stimme verwenden können, muss der Finetuning-Prozess abgeschlossen sein. Während der Verarbeitung können Sie den Status Ihrer Stimme unter „Meine Stimmen“ prüfen. Sie werden benachrichtigt, sobald sie einsatzbereit ist.
Professional Voice Cloning klont die für das Training verwendeten Beispiele sehr präzise. Es erstellt einen nahezu perfekten Klon dessen, was es hört, einschließlich aller Feinheiten und Merkmale dieser Stimme, aber auch aller Artefakte und unerwünschten Geräusche in den Beispielen. Wenn Sie also Beispiele mit geringer Qualität, Hintergrundgeräuschen, Raumhall/Echo oder anderen unerwünschten Geräuschen wie Musik oder mehreren sprechenden Personen hochladen, versucht die KI, auch diese Elemente im Klon nachzubilden.
Stellen Sie sicher, dass im gesamten Audio nur eine Person spricht. Mehrere Sprecher, starke Geräusche oder einer der oben genannten Faktoren können die KI verwirren. Dadurch kann die KI möglicherweise nicht erkennen, welche Stimme geklont werden soll, oder den Klang der Stimme falsch interpretieren, weil sie von anderen Geräuschen überlagert wird. Das führt zu einem weniger optimalen Klon.
Stellen Sie sicher, dass genügend Material vorhanden ist, um die Stimme korrekt zu klonen. Das absolute Minimum, das wir empfehlen, sind 30 Minuten Audio. Für ein optimales und möglichst präzises Ergebnis empfehlen wir jedoch eher 2–3 Stunden Audio. Je mehr Audio Sie bereitstellen, desto besser ist die Qualität des resultierenden Klons.
Der Sprechstil Ihrer Beispiele wird in der Ausgabe nachgebildet. Je nachdem, welche Sprechweise Sie wünschen, sollten die Trainingsdaten diesem Stil entsprechen. Wenn Sie beispielsweise ein Hörbuch mit einem Klon Ihrer Stimme vertonen möchten, sollte das für das Training eingereichte Audio eine Aufnahme sein, in der Sie ein Buch mit dem gewünschten Tonfall vorlesen. Für konsistente Ergebnisse sollten die hochgeladenen Beispiele nur einen Stil enthalten.
Beispiele in der Sprache verwenden, für die der PVC eingesetzt werden soll
Verwenden Sie am besten Beispiele, in denen Sie die Sprache sprechen, für die der PVC hauptsächlich verwendet werden soll. Natürlich kann die KI jede Sprache sprechen, die wir derzeit unterstützen. Beachten Sie jedoch: Wenn die Stimme selbst nicht in der Sprache muttersprachlich ist, die die KI sprechen soll – also wenn Sie eine Stimme geklont haben, die eine andere Sprache spricht –, kann sie einen Akzent aus der Originalsprache haben und Wörter oder Betonungen falsch aussprechen. Wenn Sie beispielsweise eine englischsprachige Stimme klonen und sie anschließend Spanisch sprechen lassen möchten, wird sie beim Spanischsprechen sehr wahrscheinlich einen englischen Akzent haben. Wir unterstützen nur das Klonen von Beispielen, die in einer unserer unterstützten Sprachen aufgenommen wurden. Die Anwendung lehnt Ihr Beispiel ab, wenn es in einer nicht unterstützten Sprache aufgenommen wurde.
In den folgenden Beispielen sehen Sie, was Sie von einer guten bzw. schlechten Aufnahme erwarten können.
Derzeit können Sie nur Ihre eigene Stimme klonen. Bevor Sie Ihre Anfrage zum Finetuning einreichen, müssen Sie einen Verifizierungsprozess durchlaufen.
Tipps und Empfehlungen
Professionelle Aufnahmeausrüstung
Professionelle Aufnahmeausrüstung
Verwenden Sie für optimale Ergebnisse hochwertige Aufnahmeausrüstung, da die KI alles im Audio klont. Hochwertige Eingabe = hochwertige Ausgabe. Jedes Mikrofon funktioniert, aber wir empfehlen ein XLR-Mikrofon mit einem dedizierten Audiointerface. Günstige Optionen wären beispielsweise ein Audio Technica AT2020 oder ein Rode NT1 mit einem Focusrite-Interface oder Ähnlichem.
Popfilter verwenden
Popfilter verwenden
Verwenden Sie beim Aufnehmen einen Popfilter. Dadurch werden Plosivlaute minimiert.
Mikrofonabstand
Mikrofonabstand
Positionieren Sie sich im richtigen Abstand zum Mikrofon – empfohlen werden etwa zwei Faustbreiten, dies hängt aber auch von der gewünschten Art der Aufnahme ab.
Störungsfreie Aufnahme
Störungsfreie Aufnahme
Stellen Sie sicher, dass das Audiosignal keine Störungen wie Hintergrundmusik oder Rauschen enthält. Das Klonen durch die KI funktioniert am besten mit sauberem, übersichtlichem Audio.
Raumakustik
Raumakustik
Nehmen Sie möglichst in einem akustisch behandelten Raum auf. Das reduziert unerwünschte Echos und Hintergrundgeräusche und liefert der KI klareres Audio. Sie können den Aufnahmebereich auch vorübergehend mit einer dicken Decke oder Steppdecke dämpfen.
Audio-Vorverarbeitung
Audio-Vorverarbeitung
Bearbeiten Sie Ihr Audio gegebenenfalls vorab, wenn die KI einen bestimmten Klang ausgeben soll. Wenn Sie beispielsweise eine ausgefeilte Podcast-ähnliche Ausgabe wünschen, verarbeiten Sie Ihr Audio entsprechend vor. Dasselbe gilt für lange Pausen oder viele „Ähms“ und „Ahms“ zwischen Wörtern, da die KI diese ebenfalls nachahmt.
Lautstärkeregelung
Lautstärkeregelung
Halten Sie eine gleichmäßige Lautstärke, die klar hörbar ist, aber keine Verzerrungen verursacht. Ziel ist ein ausgewogener und stabiler Audiopegel. Ideal sind -23 dB bis -18 dB RMS bei einem True Peak von -3 dB.
Ausreichende Audiolänge
Ausreichende Audiolänge
Stellen Sie für beste Ergebnisse mindestens 30 Minuten hochwertiges Audio bereit, das den obigen Richtlinien entspricht – vorzugsweise eher 2+ Stunden. Je mehr hochwertige Daten Sie der KI zuführen, desto besser wird der Stimmklon. Die Anzahl der Beispiele spielt keine Rolle; entscheidend ist die Gesamtlaufzeit. Wenn Sie mehrere Stunden Audio hochladen möchten, teilen Sie es jedoch besser in mehrere Beispiele von jeweils etwa 30 Minuten auf. Das erleichtert den Upload.
FAQ
Was ist der Unterschied zwischen Instant Voice Cloning und Professional Voice Cloning?
Mit Professional Voice Cloning können Sie im Gegensatz zu Instant Voice Cloning, mit dem Sie Stimmen mit weniger als 2 Minuten Audio schnell klonen können, ein realistischeres Modell Ihrer Stimme trainieren. Dazu wird ein eigenes Modell mit einem großen Satz an Sprachdaten trainiert, um ein Modell zu erzeugen, das von Ihrer Originalstimme praktisch nicht zu unterscheiden ist.
Da Professional Voice Clones Finetuning und Training erfordern, dauert es etwas, bevor Sie Ihren Stimmklon verwenden können. Eine genaue Schätzung ist schwierig, da sie von der Anzahl der Personen vor Ihnen in der Warteschlange und einigen weiteren Faktoren abhängt. In der Regel dauert das Finetuning jedoch 3–6 Stunden.
Sobald Ihr Professional Voice Clone bereit ist, erhalten Sie eine E-Mail-Benachrichtigung.
Kann ich einen professionellen Stimmklon der Stimme einer anderen Person erstellen?
Nein. Sie können einen Professional Voice Clone nur von Ihrer eigenen Stimme erstellen. Auch mit Zustimmung dürfen Sie die Stimme einer anderen Person nicht klonen. Alle Professional Voice Clones erfordern einen Verifizierungsprozess, der bestätigt, dass die Stimme Ihnen gehört.
Wenn jemand seine Stimme mit Ihnen teilen möchte, kann die Person in ihrem eigenen Konto einen Professional Voice Clone erstellen und verifizieren und ihn dann über einen Freigabelink privat mit Ihnen teilen. Weitere Informationen finden Sie in unserem Artikel: Wie teile ich eine Stimme?
Wie viele professionelle Stimmklone (PVCs) kann ich haben?
Die Anzahl der verfügbaren Professional Voice Clone (PVC)-Plätze variiert je nach Abonnementstufe:
Basis-PVC-Plätze
Free- und Starter-Plan: Keine PVC-Plätze verfügbar
Creator-, Pro- und früherer Scale-Plan: 1 PVC-Platz
Scale- und früherer Business-Plan: 3 PVC-Plätze
Business-Plan: 10 PVC-Plätze
Enterprise-Plan: Individuelle Anzahl an PVC-Plätzen
Zusätzliche PVC-Plätze
Sie können zusätzliche PVC-Plätze erhalten, wenn ein Professional Voice Clone, den Sie mit der Voice Library geteilt haben, als Studio Quality eingestuft wird.
Die Studio-Quality-Prüfung gilt nur für Stimmen, die Sie mit der Voice Library geteilt haben
Nachdem Ihre Stimme in die Voice Library aufgenommen wurde, erfolgt die Studio-Quality-Prüfung automatisch. Sie erfolgt nicht sofort
Wenn Ihr geteilter PVC als Studio Quality eingestuft wird, erhalten Sie automatisch einen zusätzlichen PVC-Platz
Dies kann mehrfach passieren, wenn mehrere geteilte Stimmen als Studio Quality eingestuft werden
Sie können keine weiteren PVCs erstellen, es sei denn, Sie:
erhalten zusätzliche Plätze durch die Studio-Quality-Prüfung von Stimmen, die mit der Voice Library geteilt wurden
führen ein Upgrade auf Scale oder höher durch
Wichtige Hinweise
Professional Voice Clones können nur zum Klonen Ihrer eigenen Stimme verwendet werden
Wenn Sie auf eine Stufe unter Creator herabstufen, bleibt Ihr PVC in Ihrem Konto, aber Sie können ihn erst wieder nutzen, wenn Sie ein Upgrade auf Creator oder höher durchführen
Die Gesamtzahl der eigenen Stimmen, die Sie haben können, einschließlich PVCs, hängt von Ihrer Abonnementstufe ab
Wie füge ich Modelle hinzu oder aktualisiere Modelle, die zum Training meines professionellen Stimmklons verwendet werden?
Alle Professional Voice Clones (PVCs) werden automatisch mit den Modellen Flash v2.5, Turbo v2.5 und Multilingual v2 trainiert. PVCs, die mit englischem Audio trainiert wurden, werden außerdem automatisch mit den Modellen Flash v2 und Turbo v2 trainiert.
Wenn Sie bereits einen PVC haben, können Sie ihn jetzt für zusätzliche Modelle feinabstimmen. Wenn künftig neue Modelle veröffentlicht werden, die Fine-Tuning unterstützen, erhalten Sie eine Benachrichtigung. Diese wird durch ein Ausrufezeichen angezeigt, das rechts neben Ihrer Stimme in der Stimmenliste unter My Voices. erscheint. Wenn Sie mit der Maus über dieses Symbol fahren, wird die Benachrichtigung angezeigt.
Um den Fine-Tuning-Prozess zu starten, fahren Sie in der Liste unter My Voices, mit der Maus über den Namen Ihrer Stimme. Dann werden alle verfügbaren Modelle angezeigt. Modelle, für die die Stimme bereits feinabgestimmt wurde, sind mit einem Häkchen markiert. Modelle, die für Fine-Tuning verfügbar sind, werden mit einem Plus-Symbol angezeigt. Klicken Sie einfach auf das Modell, um das Fine-Tuning zu starten.
Während die Stimme feinabgestimmt wird, können Sie mit der Maus über den Modellnamen fahren, um den Fortschritt zu sehen. Beachten Sie, dass Sie die Seite aufgrund des Stimme-Cachings möglicherweise aktualisieren müssen, um den neuesten Fortschritt zu sehen. Sobald das Fine-Tuning abgeschlossen ist, werden Sie sowohl in der App als auch per E-Mail benachrichtigt.
Was bedeutet der Status meines professionellen Stimmklons?
Ihr Professional Voice Clone durchläuft während der Verarbeitung verschiedene Phasen. Diese Phasen werden im Status angezeigt, den Sie für Ihren Professional Voice Clone unter My Voices sehen.
Um den aktuellen Status anzuzeigen, suchen Sie Ihre Stimme in der Liste und sehen Sie sich die rechts angezeigten Symbole an.
Entwurf: Dieser Status bedeutet, dass Ihre Stimme unvollständig ist. In der Regel liegt das daran,
dass Sie die Erstellung der Stimme noch nicht abgeschlossen oder die Stimme noch nicht verifiziert haben.
Um den Verifizierungsprozess zu durchlaufen, klicken Sie auf das Häkchen-Symbol.
Um zum Prozess der Stimmerstellung zurückzukehren, klicken Sie auf Weitere Aktionen (drei Punkte) und wählen Sie Stimme bearbeiten.
Nachdem Sie Ihre Stimme verifiziert haben, muss sie für unsere Modelle einem Finetuning unterzogen werden, bevor Sie sie verwenden können. Sie können diesen Prozess verfolgen, indem Sie unter My Voices mit dem Mauszeiger über den Namen Ihrer Stimme fahren. Hier sehen Sie alle verfügbaren Modelle sowie ein Symbol für den Status jedes Modells.
Fahren Sie für weitere Informationen mit dem Mauszeiger über den Namen des Modells. Sie sehen dann einen der folgenden Status:
Der Trainingslauf wurde geplant: Das bedeutet, dass Ihre Stimme auf einen freien
Platz für das Training wartet. Wie lange Ihre Stimme in der Warteschlange bleibt, hängt davon ab,
wie viele andere Stimmen ebenfalls in der Warteschlange stehen.
Datensatz wird erstellt und Finetuning wird ausgeführt: Sobald ein Platz frei wird,
beginnt der Finetuning-Prozess. Dies kann 6–24 Stunden dauern. Der Fortschritt
jedes Schritts im Trainingsprozess Ihrer Stimme wird als Prozentsatz angezeigt.
Leider gab es beim Trainingslauf Probleme und er wurde erneut gestartet. Sie müssen nichts weiter
tun
Das bedeutet, dass etwas schiefgelaufen ist, Ihre Stimme jedoch automatisch in die Warteschlange gestellt wurde, um den
Finetuning-Prozess erneut zu starten. Beim nächsten
Versuch sollte das Finetuning Ihrer Stimme erfolgreich abgeschlossen werden. Falls mehrere Fehler auftreten, wenden Sie sich bitte per E-Mail an
support@elevenlabs.io an den Support.
Die Stimme kann mit dem Modell verwendet werden: Das bedeutet, dass der Finetuning-Prozess
für dieses Modell abgeschlossen ist und Sie Ihre Stimme nun mit diesem Modell verwenden können.
Klicken, um das Finetuning zu starten: Einige Modelle werden nicht automatisch trainiert. Sie
müssen auf den Modellnamen klicken, um das Finetuning zu starten. Falls zusätzliche Modelle für das
Finetuning Ihrer Stimme verfügbar wurden, sehen Sie neben Ihrer Stimme ein Ausrufezeichen-Symbol.
Um das Finetuning zu starten, fahren Sie einfach mit dem Mauszeiger über den Namen Ihrer Stimme und klicken Sie auf den Namen des Modells.
Wann ist mein professioneller Stimmklon (PVC) bereit?
Bei der professionellen Stimmklonung wird das Modell mit großen Mengen der Stimme einer bestimmten Person trainiert (feinabgestimmt), um ein individuelles Modell zu erstellen.
Nachdem Sie Ihre Samples hochgeladen und Ihre Stimme verifiziert haben, wird Ihre professionelle Stimmklonung in die Warteschlange aufgenommen. Die geschätzte Trainingszeit beträgt etwa 3–6 Stunden. Sie hängt von einigen Faktoren ab, daher ist keine genaue Schätzung möglich. Leider kann es manchmal länger dauern.
Sobald für Ihre PVC die Feinabstimmung abgeschlossen ist, erhalten Sie in der App und per E-Mail Benachrichtigungen, dass Ihre Stimme nun einsatzbereit ist.
Mein professioneller Stimmklon ist fehlgeschlagen oder verzögert sich. Was kann ich tun?
Nachdem Sie Ihre Stimme verifiziert haben, muss sie für unsere Modelle einem Finetuning unterzogen werden, bevor Sie sie verwenden können. Währenddessen können Sie den Status Ihrer Stimme unter My Voices prüfen, indem Sie mit dem Mauszeiger über den Namen Ihrer Stimme fahren. Dort werden alle verfügbaren Modelle für Ihre Stimme angezeigt. Um den Status eines Modells zu prüfen, fahren Sie mit dem Mauszeiger über dessen Namen.
Falls etwas schiefgelaufen ist, wird möglicherweise folgender Status angezeigt:
Leider gab es beim Trainingslauf Probleme und er wurde erneut gestartet. Sie müssen nichts weiter tun. Das bedeutet, dass etwas schiefgelaufen ist. Ihre Stimme wurde jedoch automatisch in die Warteschlange gestellt, um den
Finetuning-Prozess erneut zu starten. Beim nächsten Versuch sollte das Finetuning Ihrer Stimme erfolgreich abgeschlossen werden. Falls jedoch mehrere Fehler auftreten, könnte ein Problem mit dem Datensatz vorliegen, das die
KI nicht beheben kann.
Sie können versuchen, das Problem zu beheben, indem Sie die Stimme löschen und die Daten von Anfang an erneut hochladen. Das hat einigen Nutzern geholfen.
Falls das Problem dadurch nicht behoben wird, sollten Sie Ihre Trainingsaudios überprüfen und gegebenenfalls andere Trainingsaudios verwenden.
Bei Fehlern während des Finetuning-Prozesses können Sie sich jederzeit per E-Mail an support@elevenlabs.io wenden.
Was kann ich tun, wenn die Verifizierung meines professionellen Stimmklons (PVC) fehlgeschlagen ist?
Wenn alle Ihre Verifizierungsversuche bei der Erstellung Ihres Professional Voice Clone fehlschlagen, können Sie 24 Stunden warten und den Prozess anschließend erneut versuchen.
Sie können sich auch per E-Mail an support@elevenlabs.io wenden, damit unser Support das Problem prüft. Wenn alles korrekt aussieht, werden Ihre Verifizierungsversuche zurückgesetzt, damit Sie den Prozess erneut versuchen können.
Hier sind einige Empfehlungen, damit Sie Ihren Professional Voice Clone erfolgreich verifizieren können:
Stellen Sie sicher, dass Ihr Webbrowser Ihr Mikrofon verwenden darf und dass Ihr Mikrofon nicht stummgeschaltet ist.
Stellen Sie sicher, dass die mit Ihrem Computermikrofon aufgezeichnete Audiodatei der für das Klonen hochgeladenen Audiodatei ähnelt und keine Hintergrundgeräusche oder andere externe Audio-Störungen enthält.
Versuchen Sie, ähnlich zu sprechen wie in der Audioaufnahme, mit der Sie die Stimme trainiert haben.
Lesen Sie jede Verifizierungszeile nur einmal vor und drücken Sie dann Stopp, um die Aufnahme zu beenden. Wenn Sie die Zeile mehrmals vorlesen, kann die Verifizierung fehlschlagen.
Wie kann ich meinen nicht verifizierten professionellen Stimmklon (PVC) löschen?
Leider ist das nicht möglich. Wie während der Einrichtung Ihres Professional Voice Clone (PVC) erwähnt, sind Sie nach dem Übergang zur Verifizierungsphase daran gebunden, bis Sie Ihre Stimme verifiziert haben.
Wenn Sie Hilfe mit Ihrem Professional Voice Clone benötigen, kontaktieren Sie bitte den Support per E-Mail an support@elevenlabs.io.
Welche Sprachen werden mit Professional Voice Cloning unterstützt?
Wir unterstützen Professional Voice Cloning für alle Sprachen, die vom Modell Flash v2.5 unterstützt werden.
Aktuell unterstützen wir mit Professional Voice Cloning folgende Sprachen:
🇺🇸 Englisch (USA)
🇬🇧 Englisch (UK)
🇦🇺 Englisch (Australien)
🇨🇦 Englisch (Kanada)
🇯🇵 Japanisch
🇨🇳 Chinesisch
🇩🇪 Deutsch
🇮🇳 Hindi
🇫🇷 Französisch (Frankreich)
🇨🇦 Französisch (Kanada)
🇰🇷 Koreanisch
🇧🇷 Portugiesisch (Brasilien)
🇵🇹 Portugiesisch (Portugal)
🇮🇹 Italienisch
🇪🇸 Spanisch (Spanien)
🇲🇽 Spanisch (Mexiko)
🇮🇩 Indonesisch
🇳🇱 Niederländisch
🇹🇷 Türkisch
🇵🇭 Filipino
🇵🇱 Polnisch
🇸🇪 Schwedisch
🇧🇬 Bulgarisch
🇷🇴 Rumänisch
🇸🇦 Arabisch (Saudi-Arabien)
🇦🇪 Arabisch (VAE)
🇨🇿 Tschechisch
🇬🇷 Griechisch
🇫🇮 Finnisch
🇭🇷 Kroatisch
🇲🇾 Malaiisch
🇸🇰 Slowakisch
🇩🇰 Dänisch
🇮🇳 Tamil
🇺🇦 Ukrainisch
🇷🇺 Russisch
🇭🇺 Ungarisch
🇳🇴 Norwegisch
🇻🇳 Vietnamesisch
Welche Dateien akzeptieren Sie für das Klonen von Stimmen?
Für Instant Voice Cloning und Professional Voice Cloning akzeptieren wir verschiedene Dateitypen. Wir empfehlen dringend MP3 mit 192 kbps oder höher.
Empfohlenes Format
MP3, 192 kbps oder höher
Empfohlene Länge
Instant Voice Cloning: 1–2 Minuten gutes Audio
Professional Voice Cloning: 30–180 Minuten gutes Audio
Unkomprimierte Formate wie WAV verbessern die Qualität des Klons in der Regel nicht und können Probleme beim Upload verursachen. Konzentrieren Sie sich stattdessen auf die Aufnahmequalität: Verwenden Sie eine saubere Aufnahme ohne Hintergrundgeräusche, Raumhall oder mehrere Sprecher, mit gleichbleibender Lautstärke und Stimmfarbe sowie ohne lange Sprechpausen.
Gibt es Einschränkungen für Stimmen, die ich zum Klonen hochladen kann?
Bei ElevenLabs setzen wir uns uneingeschränkt dafür ein, sowohl geistige Eigentumsrechte zu respektieren als auch Schutzmaßnahmen gegen den möglichen Missbrauch unserer Technologie umzusetzen:
Wir arbeiten nur mit Kunden zusammen, die unsere Nutzungsbedingungen und Richtlinie zur verbotenen Nutzung einhalten. Diese untersagen die böswillige Nutzung unserer Technologie für Zwecke, die als illegal oder schädlich gelten können;
Wir unterstützen Stimmeninhaber und ihre Lizenzgeber dabei, ihre Rechte geltend zu machen. Alle bekannten Verstöße werden geprüft und bearbeitet;
Alle von unseren Modellen generierten Audios können sofort bis zum für die Generierung verantwortlichen Nutzer zurückverfolgt werden.
Die von uns entwickelte Technologie ist neu, und klare Regulierungen müssen erst noch eingeführt werden. Als KI-Forschungslabor wollen wir auch das Bewusstsein für diese Technologie, ihr Potenzial und ihre Grenzen stärken.
Kurz gesagt: Gute, konsistente Eingaben = gute, konsistente Ausgaben.
Länge
Instant Voice Cloning: 1–2 Minuten gutes Audio
Professional Voice Cloning: 30–180 Minuten gutes Audio
Verwenden Sie die besten und klarsten Audio-Clips, die Sie finden können. Es sollte nur ein Sprecher ohne Hintergrundgeräusche oder Störungen zu hören sein. Die Stimme sollte laut und deutlich sein.
Statt viele Clips unterschiedlicher Qualität nur zur Verlängerung zu verwenden, sollten Sie Clips mit offensichtlich sehr hoher Mikrofonqualität priorisieren, deren Qualität und Klang durchgehend konsistent sind. Konzentrieren Sie sich nicht nur darauf, die Gesamtdauer zu erhöhen.
Stellen Sie sicher, dass die meisten Dialoge in Ihren Clips dem von Ihnen bevorzugten Sprechstil und der gewünschten Intonation des Sprechers entsprechen. Es sollten nicht zu viele Dialogabschnitte enthalten sein, in denen der Sprecher von den gewünschten Sprachmustern abweicht.
Verwenden Sie bei Bedarf eine Rauschunterdrückung, um Hintergrundgeräusche zu reduzieren.
Weitere Informationen finden Sie hier in unserer Dokumentation.
Kann ich meine Stimme in einer anderen Sprache als Englisch klonen?
Ja. Sie können Ihre Stimme in jeder von Flash v2.5 und Multilingual v2 unterstützten Sprache klonen. Die vollständige Liste der unterstützten Sprachen finden Sie hier.
Sie können auch eine Stimme klonen, die eine Sprache spricht, die die KI nicht unterstützt. Der Klon kann den Klang des Sprechers erfassen, wird diese Sprache jedoch nicht sprechen können. Die Ergebnisse können unvorhersehbar sein. Davon raten wir ab.
Kann ich meine Stimmklone exportieren?
Sie können Ihre Stimmklone nicht als eigenständige Dateien herunterladen oder exportieren. Stimmklone bleiben in Ihrem ElevenLabs-Konto.
Sie können Ihre ElevenLabs-Stimmen dennoch außerhalb der ElevenLabs-Website nutzen. Mit Ihrem API-Schlüssel können Drittanbieterdienste die ElevenLabs API aufrufen und mit den Stimmen in Ihrem Konto Sprache generieren.
Wenn Sie einen Klon später erneut erstellen möchten, bewahren Sie die ursprünglichen Audio-Beispiele auf, die Sie dafür verwendet haben. Jeder Klon klingt etwas anders, auch wenn Sie dasselbe Audio verwenden.
Warum klingt meine Stimme oder mein Akzent nach dem Klonen nicht richtig?
ElevenLabs bietet zwei Optionen zum Klonen:
Sofortige Stimmklonung: Schnelle Ergebnisse mit etwa 1–3 Minuten Audiomaterial. Funktioniert gut für die meisten Stimmen, kann aber bei ungewöhnlichen Akzenten oder einzigartigen Stimmen Schwierigkeiten haben.
Professionelle Stimmklonung: Höhere Wiedergabetreue mit 30 Minuten bis etwa 3 Stunden Audiomaterial. Die Feinabstimmung dauert in der Regel 3–6 Stunden und kann länger dauern, wenn viele Stimmen in der Warteschlange sind.
Wenn die sofortige Stimmklonung Ihre Stimme oder Ihren Akzent nicht gut erfasst, versuchen Sie es mit der professionellen Stimmklonung.
Sie können den Akzent oder Ton einer geklonten Stimme nach ihrer Erstellung nicht ändern. Um das Ergebnis zu verbessern, ändern Sie die verwendeten Audiosamples. Kleine Änderungen an den Samples können einen großen Unterschied machen.
Was bedeutet der Fehler „No model found for this voice. Please select another voice“?
Dieser Fehler wird angezeigt, wenn Sie Ihren Professional Voice Clone (PVC) verwenden möchten, bevor das Finetuning abgeschlossen ist und er zur Verwendung bereitsteht.
Wenn Sie einen PVC erstellen, durchläuft er mehrere Prozesse, bevor er verwendet werden kann. Nachdem Sie Ihre Stimme verifiziert haben, wird sie verarbeitet und für das Finetuning in die Warteschlange gestellt. Je nachdem, wie viele andere Stimmen aktuell für das Finetuning in der Warteschlange stehen, dauert dieser Prozess in der Regel schätzungsweise 3–6 Stunden, kann aber bis zu 24 Stunden dauern.
Sie können den Fortschritt Ihres PVC unter My Voices prüfen: Suchen Sie die Stimme in Ihrer Stimmenliste und klicken Sie dann auf Anzeigen, um weitere Details zu sehen. Wenn Sie mit dem Mauszeiger über ein Modell fahren, sehen Sie den aktuellen Status.