Stimmenverzerrer

Erfahren Sie, wie Sie Audio zwischen Stimmen umwandeln und dabei Emotionen und Sprechweise bewahren.

Überblick

Mit der ElevenLabs-Stimmenverzerrer-API können Sie jedes Quellaudio (aufgenommen oder hochgeladen) in eine andere, vollständig geklonte Stimme umwandeln, ohne die Nuancen der ursprünglichen Darbietung zu verlieren. Sie kann Flüstern, Lachen, Weinen, Akzente und subtile emotionale Hinweise erfassen, um einen äußerst realistischen, menschlichen Klang zu erzielen. Sie können damit:

  • Jede Stimme ändern und dabei emotionale Sprechweise und Nuancen bewahren
  • Konsistente Charakterstimmen über mehrere Sprachen und Aufnahmesitzungen hinweg erstellen
  • Bestimmte Wörter und Phrasen in bestehenden Aufnahmen korrigieren oder ersetzen

Entdecken Sie unsere Stimmbibliothek, um die passende Stimme für Ihr Projekt zu finden.

Unterstützte Sprachen

Unsere mehrsprachigen v2-Modelle unterstützen 29 Sprachen:

Englisch (USA, UK, Australien, Kanada), Japanisch, Chinesisch, Deutsch, Hindi, Französisch (Frankreich, Kanada), Koreanisch, Portugiesisch (Brasilien, Portugal), Italienisch, Spanisch (Spanien, Mexiko), Indonesisch, Niederländisch, Türkisch, Filipino, Polnisch, Schwedisch, Bulgarisch, Rumänisch, Arabisch (Saudi-Arabien, VAE), Tschechisch, Griechisch, Finnisch, Kroatisch, Malaiisch, Slowakisch, Dänisch, Tamil, Ukrainisch & Russisch.

Das Modell eleven_english_sts_v2 unterstützt nur Englisch.

Wichtige Fakten

  • Maximale Segmentlänge: 5 Minuten – teilen Sie längere Aufnahmen in Abschnitte auf
  • Abrechnung: 1.000 Zeichen pro Minute verarbeitetem Audio
  • Hintergrundgeräusche: Verwenden Sie remove_background_noise=true, um Umgebungsgeräusche in der Ausgabe zu minimieren
  • Modellempfehlung: eleven_multilingual_sts_v2 übertrifft eleven_english_sts_v2 oft selbst bei englischen Inhalten
  • Benutzerdefinierte Stimmen: Jede geklonte oder erstellte Stimme in Ihrer Bibliothek kann als Ausgabestimme verwendet werden; geben Sie ihre voice_id an