Głosy

Dowiedz się, jak tworzyć, dostosowywać i zarządzać głosami w ElevenLabs.

Omówienie

ElevenLabs oferuje modele do tworzenia i dostosowywania głosów. Platforma obsługuje szeroki wybór głosów, w tym głosy z naszej rozbudowanej Voice Library, klonowanie głosu oraz głosy generowane na podstawie promptów tekstowych.

Typy głosów

  • Społeczność: Głosy udostępnione przez społeczność w Voice Library ElevenLabs.
  • Sklonowane: Własne głosy utworzone za pomocą Instant Voice Cloning lub Professional Voice Cloning.
  • Voice Design: Wygenerowane głosy utworzone narzędziem Voice Design.

Nasze domyślne głosy są zastępowane nowymi głosami, których będzie można używać bezterminowo. Wszystkie nasze domyślne głosy wygasną 31 grudnia 2026 r. i po tej dacie nie będą już dostępne.

Społeczność

Voice Library zawiera ponad 10 000 głosów udostępnionych przez społeczność ElevenLabs. Możesz jej używać, aby:

  • Odkrywać unikalne głosy udostępnione przez społeczność ElevenLabs.
  • Dodawać głosy do swojej osobistej kolekcji.
  • Udostępniać własne klony głosu i otrzymywać nagrody pieniężne, gdy korzystają z nich inni płatni subskrybenci.

Udostępnij swój głos społeczności, ustal warunki i otrzymuj nagrody pieniężne, gdy inni z niego korzystają. Wypłaciliśmy już ponad 14 mln USD.

Głosy z Voice Library nie są dostępne przez API dla użytkowników planu darmowego.

Sklonowane

Sklonuj własny głos na podstawie krótkich próbek audio za pomocą Instant Voice Cloning albo twórz realistyczne głosy z Professional Voice Cloning.

  • Instant Voice Cloning: Szybko sklonuj głos na podstawie krótkich próbek audio.
  • Professional Voice Cloning: Twórz profesjonalne klony głosu na podstawie dłuższego materiału treningowego.

Technologia voice-captcha weryfikuje, że Professional Voice Clones powstają na podstawie twoich własnych próbek głosu.

Do tworzenia Professional Voice Clones potrzebny jest plan Creator lub wyższy.

Voice Design

Dzięki Voice Design możesz tworzyć całkiem nowe głosy, określając cechy takie jak wiek, płeć, akcent i ton. Wygenerowane głosy idealnie sprawdzą się jako:

  • Realistyczne głosy o niuansowych cechach.
  • Kreatywne głosy postaci do gier i opowieści.

Voice Design tworzy 3 podglądy głosu. Wystarczy podać:

  • Opis głosu o długości od 20 do 1000 znaków.
  • Opcjonalny tekst do podglądu głosu, od 100 do 1000 znaków.
Voice Design z Eleven v4

Eleven v4 to model, którego warto użyć. Głosy Voice Design działają z nim, choć mogą brzmieć mniej wyraziście niż we wcześniejszych modelach. Eleven v3 także może projektować głosy o szerokiej gamie emocji.

Te modele oferują następujące korzyści:

  • Bardziej naturalne i wszechstronne generowanie głosu.
  • Lepsza kontrola nad cechami głosu.
  • Obsługa tagów audio w generacjach podglądowych.
  • Kompatybilność wsteczna z modelami v2.

Voice Remixing

Voice Remixing pozwala przekształcać głosy, które należą do ciebie, zmieniając ich główne cechy przy zachowaniu rozpoznawalnych właściwości. Za pomocą promptów w języku naturalnym możesz dostosować płeć, akcent, styl mówienia, tempo i jakość audio. Ta funkcja przydaje się szczególnie do dopasowywania głosów do różnych kontekstów, tworzenia wariantów postaci lub poprawiania jakości audio istniejących profili głosowych. Voice Remixing działa z każdym sklonowanym głosem, który należy do ciebie (Instant Voice Cloning lub Professional Voice Cloning), oraz z głosami utworzonymi w Voice Design.

Zarządzanie głosami

Wszystkimi głosami możesz zarządzać w My Voices, gdzie możesz:

  • Wyszukiwać, filtrować i kategoryzować głosy
  • Dodawać opisy i własne tagi
  • Organizować głosy, by mieć do nich szybki dostęp

Dowiedz się, jak zarządzać kolekcją głosów w dokumentacji My Voices.

  • Wyszukiwanie i filtrowanie: Znajduj głosy za pomocą słów kluczowych lub tagów.
  • Próbki podglądowe: Posłuchaj demonstracji głosu przed użyciem.
  • Dodawanie do kolekcji: Zapisuj głosy, aby łatwo korzystać z nich w projektach.

Wskazówka: Spróbuj wyszukiwać według konkretnych akcentów lub gatunków, np. „australijska narracja”.

Obsługiwane języki

Wszystkie głosy ElevenLabs obsługują wiele języków. ElevenLabs obsługuje tworzenie głosów w 32 językach. Dopasuj wybór głosu do regionu docelowego, aby uzyskać najbardziej naturalny efekt.

  • Wygenerowane i sklonowane głosy: Wierność akcentu zależy od próbek wejściowych lub wybranych cech.

Nasze wielojęzyczne modele v2 obsługują 29 języków:

angielski (USA, Wielka Brytania, Australia, Kanada), japoński, chiński, niemiecki, hindi, francuski (Francja, Kanada), koreański, portugalski (Brazylia, Portugalia), włoski, hiszpański (Hiszpania, Meksyk), indonezyjski, niderlandzki, turecki, filipiński, polski, szwedzki, bułgarski, rumuński, arabski (Arabia Saudyjska, ZEA), czeski, grecki, fiński, chorwacki, malajski, słowacki, duński, tamilski, ukraiński i rosyjski.

Flash v2.5 obsługuje 32 języki — wszystkie języki z modeli v2 oraz:

węgierski, norweski i wietnamski

Dowiedz się więcej o naszych modelach

Kluczowe informacje

  • Instant Voice Cloning: Tworzone na podstawie krótkich próbek audio (poniżej dwóch minut); dostępne w większości planów
  • Professional Voice Cloning: Wymaga dłuższego materiału treningowego dla najwyższej wierności; wymaga planu Creator lub wyższego
  • Udostępnianie głosu: Professional Voice Clones można udostępniać publicznie w Voice Library; Instant Voice Clones i Generated Voices nie
  • Generated Voices: Tworzone z opisów tekstowych przez Voice Design — odpowiednie dla unikalnych postaci w grach, animacjach i kreatywnych opowieściach