So klonen Sie Ihre Stimme mit ElevenLabs: Ein umfassender Leitfaden
- Verfasst von
- Jack Limebear
- Veröffentlicht
- Zuletzt aktualisiert
AnhörenArtikel anhören
Keine zwei Stimmen sind gleich. Ihre Stimme wird von Ihrer Biologie und Ihrem Umfeld geprägt und über Jahre des Ausdrucks verfeinert. Sie ist persönlich.
Bis vor Kurzem ließ sich diese Art von Individualität nicht nachbilden. Fortschritte in der KI ermöglichen es jedoch, Stimmen mit beeindruckender Präzision zu klonen. Mit nur wenigen Minuten Audiomaterial können KI-Systeme Sprache erzeugen, die dem Original bemerkenswert ähnlich klingt.
In diesem Leitfaden zeigen wir Ihnen genau, wie Sie Ihre Stimme mit ElevenLabs klonen. Wir behandeln, was Sie aufnehmen sollten, wie Sie zwischen Instant und Professional Voice Cloning wählen und wie Sie Ihren Klon einsetzen, sobald er bereit ist. Für beide Wege finden Sie eine detaillierte Schritt-für-Schritt-Anleitung.
Zusammenfassung
- ElevenLabs bietet Instant Voice Cloning und Professional Voice Cloning.
- Für Instant Voice Cloning benötigen Sie einige Minuten sauberes, gleichmäßiges Audiomaterial.
- Für Professional Voice Cloning benötigen Sie bis zu 3 Stunden Sprachdaten.
- Nach der Erstellung Ihres Klons können Sie ihn mit weiteren Produkten von ElevenLabs verbinden.
- Zum Klonen einer Stimme benötigen Sie eine ausdrückliche Einwilligung. ElevenLabs verlangt eine Einwilligungsbestätigung, bevor Sie diese Dienste nutzen können.
Instant Cloning vs. Professional Voice Cloning: Was benötigen Sie?
ElevenLabs bietet zwei verschiedene Methoden für das Klonen von Stimmen zur Auswahl.
Instant Cloning liefert in wenigen Minuten eine nutzbare Stimme, sodass Sie Ihren Stimmklon schnell praktisch einsetzen können. Professional Voice Cloning dauert länger, erzeugt aber ein Modell mit extrem hoher Wiedergabetreue.
Diese Kurzübersicht hilft Ihnen, die passende Option zu wählen:
Wenn Sie die Unterschiede zwischen diesen Ansätzen kennen, sparen Sie von Anfang an Zeit und können schneller loslegen.
Was Sie brauchen, bevor Sie Ihre Stimme mit ElevenLabs klonen
Unabhängig davon, ob Sie sich für Professional oder Instant Voice Cloning von ElevenLabs entscheiden, gibt es einige Grundlagen, die hilfreich sind. Sie sind nicht zwingend erforderlich, insbesondere beim Instant-Verfahren, können die Qualität des Klons aber deutlich verbessern.
Beachten Sie Folgendes, bevor Sie mit der Aufnahme beginnen:
- Anforderungen an die Audioqualität: Ein professionelles Aufnahmemikrofon macht einen großen Unterschied. Die Mindestanforderungen sind jedoch WAV-Aufnahmen mit 44,1 kHz oder 48 kHz und einer Bittiefe von mindestens 24 Bit. Nehmen Sie möglichst an einem ruhigen Ort mit einer Digital Audio Workstation (DAW) auf, die WAV-Dateien unterstützt. Audacity ist eine gute kostenlose Option.
- Mindestlänge der Samples: Prüfen Sie, wie viele Audiodaten Sie bereitstellen sollten. Entscheidend ist die gesamte Laufzeit, nicht die Anzahl der Dateien. Laden Sie für Professional Voice Cloning eine Datei hoch, die möglichst nah an 3 Stunden liegt.
- Was Sie sagen sollten: Der Stimmklon von ElevenCreative soll die von Ihnen bereitgestellte Stimme nachbilden. Wenn Sie langsam und monoton sprechen, wird Ihre Aufnahme diese Eigenschaften widerspiegeln. Sprechen Sie natürlich und mit unterschiedlicher Emotion und Sprechtempo. ElevenLabs bietet integrierte Skripte für Professional Voice Cloning.
Wenn Sie sich ein paar zusätzliche Minuten nehmen, um diese Aspekte vorab vorzubereiten, erhalten Sie einen Stimmklon in höherer Qualität.
So erstellen Sie mit ElevenLabs einen Instant-Stimmklon
Wenn Sie ein paar Minuten Zeit haben und sich an einem ruhigen Ort befinden, können Sie Ihre Stimme klonen. ElevenCreative erstellt eine digitale Nachbildung Ihrer Stimme, die Sie in mehr als 32 Sprachen einsetzen können. Dabei werden emotionales Register und Prosodie Ihrer natürlichen Sprache übernommen.
So nutzen Sie ElevenLabs Instant Voice Cloning:
- Voices öffnen
- Samples hochladen
- Stimme benennen und speichern
- Mit einem Skript testen
- Einstellungen für Stabilität und Ähnlichkeit anpassen
Sehen wir uns diese Schritte genauer an.
Schritt 1: Zur Seite für Instant Voice Cloning in Voices navigieren
Melden Sie sich zunächst in Ihrem ElevenLabs-Dashboard an. Wählen Sie in der linken Seitenleiste Voices und klicken Sie dann auf das Plus-Symbol.
Auf Ihrem Bildschirm erscheint ein Pop-up-Fenster (siehe unten) mit mehreren Optionen:
- Voice Design
- Instant Voice Clone
- Professional Voice Clone
- Voice Remixing
Wählen Sie im Modul Instant Voice Clone aus. Sie gelangen dann zur richtigen Seite.

Schritt 2: Ihre Samples hochladen
Folgen Sie den Anweisungen auf dem Bildschirm, um entweder vorab aufgenommene Audiodateien hochzuladen oder direkt im Browser aufzunehmen. In diesem Schritt können Sie mehrere Dateien hochladen. Für das Klonen von Stimmen verwendet ElevenLabs die gesamte kombinierte Laufzeit, nicht die Länge einzelner Dateien.

Stellen Sie mindestens 1–2 Minuten sauberes, gleichmäßiges Audiomaterial bereit.
Hier sehen Sie auch Best Practices, etwa das Vermeiden lauter Umgebungen, die Prüfung Ihrer Mikrofonqualität und die Verwendung derselben Ausrüstung für alle Aufnahmen.
Schritt 3: Ihre Stimme benennen und speichern
Nach der Aufnahme Ihrer Stimme beginnt ElevenLabs mit der Synthese Ihres Stimmklons. In diesem Schritt können Sie eine Vorschau anhören und der Stimme einen Namen geben.
Sie können dem Klon weitere Informationen hinzufügen, etwa Labels für Sprache, Akzent, Geschlecht und Alter. In einem Beschreibungsfeld können Sie weitere Details eintragen, die für die Katalogisierung dieser Stimme oder als Erinnerung für Sie nützlich sind.

Abschließend müssen Sie das Einwilligungsfeld anklicken, um zu bestätigen, dass Sie es gelesen haben und akzeptieren. Sie benötigen zwingend die Einwilligung, um einen Klon der Stimme zu erstellen, mit der Sie arbeiten – unabhängig davon, ob es Ihre eigene oder die einer anderen Person ist.
Schritt 4: Ihren Instant-Stimmklon testen
Nach der Erstellung Ihrer Stimme navigieren Sie zu My Voices und klicken auf Use voice, um Ihren Klon im Text to Speech Playground zu verwenden. Schreiben Sie ein kurzes Skript, das Ihr Stimmklon sprechen soll. Um ihn wirklich zu testen, schreiben Sie etwas, das nicht in Ihrem Trainingsaudiomaterial enthalten war.
Sobald Sie Ihren Stimmklon ausgewählt und den Text geschrieben haben, klicken Sie unten auf der Seite auf Generate speech, um ihn zum Leben zu erwecken.

Schritt 5: Modell anpassen und iterieren
Wenn Sie Ihren Stimmklon anhören und etwas nicht ganz richtig klingt, müssen Sie nicht von vorn beginnen. ElevenLabs bietet verschiedene Einstellungsregler, mit denen Sie das finale Audioprodukt konfigurieren können.
Probieren Sie die folgenden Regler auf der rechten Bildschirmseite aus und sehen Sie, wie sie Ihren Stimmklon beeinflussen:
- Stabilität: Eine höhere Stabilität erzeugt gleichmäßige, vorhersehbare Stimmen. Niedrigere Werte können mehr Ausdruck ermöglichen, aber auch zu Inkonsistenzen führen. Für die meisten Anwendungsfälle eignet sich eine mittlere Einstellung.
- Ähnlichkeit: Legt fest, wie stark der Stimmklon an den von Ihnen bereitgestellten Sprachsamples orientiert bleibt. Wenn Sie diesen Regler erhöhen, klingt die Stimme mehr nach Ihrer eigenen. Bei Verzerrungen sollten Sie den Regler verringern.
- Stil: Möchten Sie die ausdrucksstarken Eigenschaften Ihres Trainingsaudiomaterials verstärken? Erhöhen Sie diesen Regler. Hohe Werte können jedoch zu einem verzerrten finalen Sample führen.
Nachdem Sie die Werte dieser Regler angepasst haben, klicken Sie erneut auf Generate speech und beobachten Sie, wie sich das Modell verändert.
Nach diesen 5 Schritten ist Ihr ElevenLabs-Stimmklon einsatzbereit.
So erstellen Sie mit ElevenLabs einen professionellen Stimmklon
Das professionelle Klonen Ihrer Stimme mit ElevenLabs dauert länger als die Instant-Option, liefert aber ein hochpräzises Modell, das Ihre Stimme sehr genau nachbildet.
Mit dem Creator-Plan oder höher können Sie mit diesen Schritten einen professionellen Stimmklon mit ElevenLabs erstellen:
- Voices öffnen
- Audio hochladen
- Feedback zur Sample-Länge prüfen
- Audiosamples zur Qualitätsverbesserung bearbeiten
- Eigene Stimme zur Sicherheit verifizieren
- Auf das Fine-Tuning der Stimme warten
- Stimmklon verwenden
Sehen wir uns diese Schritte genauer an.
Schritt 1: Zur Seite für Professional Voice Cloning in Voices navigieren
Melden Sie sich in Ihrem ElevenLabs-Dashboard an, wählen Sie Voices in der linken Seitenleiste und klicken Sie dann auf Create Voice. Im Pop-up sehen Sie dieselben Optionen wie zuvor.
Wählen Sie diesmal Professional Voice Clone. Daraufhin sehen Sie zahlreiche Empfehlungen, darunter:
- Einen Popfilter verwenden
- Die Aufnahme rauschfrei halten
- In einem akustisch behandelten Raum aufnehmen
- Audio vorverarbeiten
- Durchgehend gleichbleibende Lautstärke beibehalten
- Mindestens 30 Minuten Audiomaterial bereitstellen, idealerweise nahe 3 Stunden
Schritt 2: Ihr Audio hochladen
Klicken Sie auf Upload samples und fügen Sie Ihre vorab aufgenommenen Audiodateien hinzu. Sie können auch direkt in der Software aufnehmen und die Aufnahme hochladen. Wir stellen verschiedene Skripte für unterschiedliche Zwecke bereit, etwa Werbung, Erzählungen oder Konversationsmodelle.

Diese Audiodateien sollten ausschließlich gesprochene Sprache enthalten. Gesang wird derzeit weder als Eingabe noch als Ausgabe unterstützt.
Schritt 3: Feedback zur Sample-Länge prüfen
Prüfen Sie nach dem erfolgreichen Hochladen Ihres Audios das Feedback zur Länge. Während 1–2 Minuten für einen Instant-Stimmklon ausreichen, empfehlen wir für diesen Dienst zwischen einer und drei Stunden Audiomaterial.
Denken Sie daran, Audiodateien mit unterschiedlichen emotionalen Inhalten einzubeziehen. Eine vielfältige Auswahl an studiofertigem Material liefert unseren Modellen die bestmöglichen Informationen.

Schritt 4: Audiosamples zur Qualitätsverbesserung bearbeiten
Innerhalb der Plattform für Professional Voice Cloning können Sie die Qualität Ihrer Audiosamples direkt verbessern. Von der Entfernung von Hintergrundgeräuschen bis zur Trennung verschiedener Sprecher hilft Ihnen ElevenLabs, hochwertige Audioeingaben zu erstellen.
Dieser Schritt ist nicht zwingend erforderlich, aber hilfreich, da er die Qualität Ihres finalen Stimmklon-Modells verbessert.

Schritt 5: Eigene Stimme zur Sicherheit verifizieren
ElevenLabs verlangt beim Erstellen eines professionellen Stimmklons eine Verifizierung. Nachdem Sie alles hochgeladen haben, bitten wir Sie, direkt in der Benutzeroberfläche einen kurzen Clip aufzunehmen. Verwenden Sie dabei möglichst dasselbe Mikrofon und dieselbe Raumumgebung wie für Ihre Trainingsaufnahmen und stimmen Sie Ton und Sprechstil so genau wie möglich darauf ab.
Wenn die Verifizierung fehlschlägt, können Sie es nach 24 Stunden erneut versuchen. Wenn Sie vorher loslegen müssen, können Sie sich direkt an den ElevenLabs-Support wenden.
Schritt 6: Auf das Fine-Tuning der Stimme warten
Nachdem Sie Ihre Stimme verifiziert haben, beginnt ElevenLabs mit dem Fine-Tuning Ihres Modells. Normalerweise dauert dies zwischen 3 und 6 Stunden, kann aber länger dauern, wenn sich viele andere Professional Voice Clones vor Ihrem in der Warteschlange befinden.
Um den Status Ihres Klons zu verfolgen, navigieren Sie zu My Voices. Wir senden Ihnen auch eine Benachrichtigung, sobald Ihr Stimmenmodell einsatzbereit ist.
Schritt 7: Ihren Stimmklon verwenden
Herzlichen Glückwunsch, Sie haben jetzt einen voll funktionsfähigen Stimmklon in professioneller Qualität. Das fertige Modell erscheint in My Voices und kann in allen anderen ElevenLabs-Produkten verwendet werden, etwa Text to Speech, Studio, Synchronisation und API sowie Sprachagenten.
Wählen Sie zum Start Ihre Stimme im Voice-Picker-Dashboard aus. Verwenden Sie dabei den Namen, den Sie ihr im Erstellungsprozess gegeben haben.
Best Practices für das Klonen von Stimmen mit ElevenLabs
Mit den oben beschriebenen Schritten für Instant oder Professional Voice Cloning können Sie einen Klon erstellen. Darüber hinaus gibt es einige Maßnahmen, die Sie vorher treffen können. Mit diesen kleinen Anpassungen an Ihren Aufnahme-Tools oder Ihrer Strategie verbessern Sie die Qualität Ihres Stimmklons.
Die folgenden Best Practices für das KI-Stimmenklonen gelten für Instant- und professionelle Klone:
- Raumakustik und Hintergrundgeräusche: Wie sauber Ihr Audiomaterial ist, beeinflusst direkt die finale Qualität. Nehmen Sie an einem Ort ohne Hintergrundgeräusche oder Hall auf. Für professionelle Aufnahmen eignet sich eine Aufnahmekabine. Wenn Sie diese Qualität ohne ein Studio buchen zu müssen erreichen möchten, prüfen Sie, ob ein lokaler Coworking-Space schallisolierte Kabinen bietet.
- Mikrofonabstand: Beim Sprechen sollten Sie etwa zwei Faustbreiten vom Mikrofon entfernt sein. Das ist eine gute Faustregel, prüfen Sie aber für weitere Details die Spezifikationen Ihres Mikrofons.
- Emotionale Bandbreite in Ihren Samples: Ein KI-Modell nutzt die natürliche Prosodie und sprachlichen Merkmale Ihrer Stimme. Wenn Ihr Vortrag flach wirkt, könnte Ihr Modell dieselbe wenig ausdrucksstarke Darbietung übernehmen. Geben Sie Ihr Bestes und fügen Sie emotionale Samples hinzu, die Ihren natürlichen Sprechstil in verschiedenen Kontexten zeigen.
- Satzvielfalt vs. ein Skript vorlesen: Ein Skript laut vorzulesen ist ein guter Ausgangspunkt für ein längeres Sample, kann aber einstudiert oder unnatürlich wirken. Besonders wenn Sie es zum ersten Mal lesen, treffen Sie die erwartete emotionale Nuance eines Satzes möglicherweise nicht genau. Für die richtige Balance stellen Sie verschiedene Skriptpassagen in einem eher gesprächigen Vortragsstil bereit.
Wenn Sie diese Best Practices befolgen, stellen Sie ElevenLabs hochwertigere Eingaben bereit. So können wir einen Stimmklon erstellen, der Ihrer stimmlichen Identität besser entspricht.
Wie können Sie einen ElevenLabs-Stimmklon verwenden?
Nachdem Sie mit ElevenLabs einen professionellen oder Instant-Stimmklon erstellt haben, erscheint Ihre Stimme in My Voices. Von dort können Sie in jedem anderen ElevenLabs-Produkt darauf zugreifen.
Hier können Sie Ihren ElevenLabs-Stimmklon verwenden:
- Text to Speech in der App: Im ElevenLabs Text to Speech Playground können Sie Ihre Stimme auswählen und alles vorlesen lassen, was Sie eingeben. Dies nutzen Sie für einzelne Sprachgenerierungen wie Voiceovers oder Podcast-Intros. Passen Sie Stil, Ähnlichkeit und Stabilität in den Echtzeit-Einstellungen an, damit die Stimme möglichst passend klingt.
- Über die API: Sie können den List Voices API-Endpunkt verwenden, um eine Liste aller für Ihre API-Aufrufe verfügbaren Stimmen abzurufen. Jede Stimme hat eine eindeutige Voice-ID, die Sie überall dort implementieren können, wo Sie ElevenAPI anbinden.
- In einem Sprachagenten: Verbinden Sie Ihren ElevenLabs-Stimmklon mit einem Agenten, damit er beim Sprechen Ihre Stimme verwendet. Besonders für Unternehmen, die plattformübergreifend eine einheitliche Stimmpräsenz wünschen, schafft dies einen konsistenten Markenauftritt für Agenten.
- Sprachübergreifend: Ihr Stimmklon funktioniert in 32 Sprachen. So können Sie Inhalte übersetzen und mit Ihrer Stimme produzieren. Auch ohne Sprachsamples in der jeweiligen Sprache übernimmt ElevenCreative die Prosodie und emotionalen Eigenschaften Ihrer Sprache über verschiedene Sprachen hinweg präzise.
In allen unseren Produkten eingesetzt, können Sie Ihre Stimme zum Leben erwecken und hochwertige Inhalte im großen Umfang produzieren.
Klonen Sie Ihre Stimme mit ElevenCreative
Ob Sie als Content Creator die Videoproduktion beschleunigen oder einfach Ihre Stimme bewahren möchten: Das Klonen von Stimmen mit ElevenLabs ist einfach, schnell und effektiv.
Instant Voice Cloning ist im kostenlosen Plan verfügbar und dauert nur wenige Minuten. Mit dem Creator-Plan können Sie Professional Voice Cloning nutzen. Erfahren Sie mehr über Voice Cloning bei ElevenLabs oder registrieren Sie sich noch heute, um Ihre Stimme zu klonen.




