Voice Changer

Dowiedz się, jak zmieniać głosy w audio, zachowując emocje i sposób mówienia.

Omówienie

API ElevenLabs Voice Changer pozwala przekształcić dowolne audio źródłowe (nagrane lub przesłane) w inny, w pełni sklonowany głos bez utraty niuansów wykonania oryginału. Potrafi uchwycić szepty, śmiech, płacz, akcenty i subtelne sygnały emocjonalne, aby uzyskać bardzo realistyczne, ludzkie brzmienie. Możesz go użyć, aby:

  • Zmienić dowolny głos, zachowując emocje i niuanse wypowiedzi
  • Tworzyć spójne głosy postaci w wielu językach i sesjach nagraniowych
  • Poprawiać lub zastępować konkretne słowa i frazy w istniejących nagraniach

Odkryj naszą Voice Library, aby znaleźć idealny głos do swojego projektu.

Obsługiwane języki

Nasze wielojęzyczne modele v2 obsługują 29 języków:

angielski (USA, Wielka Brytania, Australia, Kanada), japoński, chiński, niemiecki, hindi, francuski (Francja, Kanada), koreański, portugalski (Brazylia, Portugalia), włoski, hiszpański (Hiszpania, Meksyk), indonezyjski, niderlandzki, turecki, filipiński, polski, szwedzki, bułgarski, rumuński, arabski (Arabia Saudyjska, ZEA), czeski, grecki, fiński, chorwacki, malajski, słowacki, duński, tamilski, ukraiński i rosyjski.

Model eleven_english_sts_v2 obsługuje tylko język angielski.

Najważniejsze informacje

  • Maksymalna długość segmentu: 5 minut — dłuższe nagrania podziel na fragmenty
  • Rozliczanie: 1000 znaków za minutę przetworzonego audio
  • Szum tła: użyj remove_background_noise=true, aby ograniczyć dźwięki otoczenia w wyniku
  • Rekomendowany model: eleven_multilingual_sts_v2 często przewyższa eleven_english_sts_v2 nawet w przypadku treści po angielsku
  • Własne głosy: jako głosu wyjściowego możesz użyć dowolnego sklonowanego lub zaprojektowanego głosu z biblioteki; podaj jego voice_id