Dubbing
Dowiedz się, jak tłumaczyć audio i wideo, zachowując emocje, synchronizację i ton mówców.
Przegląd
dubbing ElevenLabs tłumaczy audio i wideo na ponad 90 języków, zachowując emocje, rytm, ton i unikalne cechy każdego mówcy. Oryginalne dźwięki w tle pozostają bez zmian, więc możesz odtworzyć sposób mówienia każdej osoby w innym języku bez ponownego miksowania ścieżki dźwiękowej. Możesz go użyć, aby:
- Zwiększyć potencjalny zasięg odbiorców 4-krotnie i dotrzeć do międzynarodowej publiczności
- Dostosować istniejące materiały do nowych rynków, zachowując emocjonalne niuanse
- Oferować treści w wielu językach bez ponownego nagrywania aktorów głosowych
Oferujemy też w pełni zarządzaną usługę dubbingu dla twórców wideo i podcastów.
Użycie
- Automatyczny dubbing — Twórz dubbing treści z jednego języka na drugi kilkoma kliknięciami dzięki najnowszemu modelowi Dubbing v2 Alpha.
- Limity przesyłania: Do 1 GB i 180 minut w aplikacji albo 3 GB na plik źródłowy przez API
- Dubbing Studio — Precyzyjna kontrola nad dubbingiem, w tym edycja transkrypcji, zmiana przypisania mówców i ponowne generowanie poszczególnych klipów. Dostępne tylko w modelu v1.
- Limity przesyłania: Do 1 GB i 45 minut
- Uwaga: Dubbing Studio jest w trybie utrzymania i otrzymuje tylko poprawki krytycznych błędów
- Dubbing zweryfikowany przez ludzi przez ElevenLabs Productions — Aby uzyskać więcej informacji, napisz na productions@elevenlabs.io.
Siła klonowania
Siła klonowania to ustawienie konfigurowalne w Automatic Dubbing w modelu Dubbing v2 Alpha, w skali od 0 do 10. W aplikacji kliknij Speaker similarity, aby ją dostosować. Domyślna wartość 7 sprawdza się przy większości treści. Wyższe wartości bardziej stawiają na podobieństwo głosu do oryginalnego mówcy, co może brzmieć mniej naturalnie w językach o bardzo różnych cechach fonetycznych. Wyższe ustawienie może też przenieść więcej oryginalnego akcentu do zdubbingowanego materiału. Niższe wartości dają modelowi więcej swobody, by brzmieć naturalnie w języku docelowym, kosztem podobieństwa do oryginalnego głosu.
Kluczowe funkcje
- Wielu mówców: Automatycznie wykrywaj wielu mówców, nawet gdy mówią jednocześnie.
- Wynik w wielu językach: Generuj zlokalizowane ścieżki w ponad 90 językach.
- Zachowanie oryginalnych głosów: Zachowaj tożsamość mówcy i jego emocjonalny ton.
- Zachowanie dźwięków w tle: Unikaj ponownego miksowania muzyki, efektów i dźwięków otoczenia.
- Obsługiwane typy plików: Możesz tworzyć dubbing wideo i audio z różnych źródeł, m.in. YouTube, TikTok, bezpośrednich adresów URL i przesłanych plików.
Dubbing v2 nie ma przełącznika znaku wodnego. Dubbing w planie Free automatycznie zawiera znak wodny; dubbing w płatnych planach go nie zawiera. W Dubbing v2 nie ma opcji znaku wodnego w zamian za zniżkę na kredyty. Starszy proces dubbingu v1 i Dubbing Studio były jedynymi miejscami, gdzie taka zniżka była dostępna.
W przypadku Dubbing v2 edycja transkrypcji i ponowne generowanie audio przez API są dostępne tylko w planach Enterprise.
Koszt
Szczegółowe koszty w kredytach znajdziesz na naszej stronie z cenami.
Obsługiwane języki
Dubbing obsługuje ponad 90 języków, w tym angielski, hiszpański, francuski, niemiecki, japoński, chiński, arabski i inne. API przyjmuje tag językowy BCP-47 w parametrach source_language i target_language, na przykład fr lub es-MX. W Dubbing v2 tag z regionem, taki jak es-MX, musi być jednym z obsługiwanych dialektów wymienionych poniżej; dla wszystkich pozostałych języków używaj podstawowego tagu językowego. Dubbing v1 nie obsługuje dialektów.
Języki i dialekty Dubbing v2
Języki Dubbing v1
Dubbing v1 obsługuje te same języki co model Eleven v3. Tagi dialektów z regionem nie są obsługiwane; używaj podstawowego tagu językowego.
Najważniejsze informacje
- Dubbing v2 Alpha — Dubbing v2 jest obecnie w fazie alfa. W miarę dalszego ulepszania modelu możesz napotkać drobne niedoskonałości.
- Typy treści: Obsługiwane są wszystkie typy treści audio i wideo, z maksymalnie 32 unikalnymi mówcami na plik.
- Zachowanie mówców: Ton, tempo i styl każdego mówcy są zachowane w języku docelowym.
- Równoległość: Wszystkie plany samoobsługowe (Free, Starter, Creator, Pro, Scale, Business) pozwalają na maksymalnie 3 równoczesne zadania dubbingu, a plany Enterprise domyślnie na 10. Limity obowiązują dla każdego workspace i są liczone osobno dla modelu, więc zadania v1 i v2 nie korzystają ze wspólnej puli. Jeśli osiągniesz limit, otrzymasz błąd
too_many_concurrent_requestsi przed rozpoczęciem nowych zadań poczekaj na zakończenie istniejących.
FAQ
Czy dubbing w czasie rzeczywistym lub na żywo jest dostępny?
Dubbing w czasie rzeczywistym ani na żywo nie jest obecnie dostępny.
Co się stanie, jeśli mój dubbing nie powiedzie się lub utknie?
Jeśli zadanie Dubbing Studio nie powiedzie się albo je anulujesz, kredyty są automatycznie zwracane na twoje konto. Dubbing v2 (wyceniany za minutę w dolarach amerykańskich w Automatycznym dubbingu) nie jest naliczany za nieudane zadania. Jeśli dubbing utknie na dłużej w stanie Queued lub Loading, anuluj go i prześlij ponownie. Nie stracisz przez to kredytów.
Czy Dubbing v2 jest dostępny przez API?
Tak. Tworzenie i pobieranie dubbingu jest dostępne we wszystkich planach. Edycja transkrypcji i ponowne generowanie przez API są dostępne tylko w planach Enterprise. Zobacz krótki przewodnik po dubbingu i doprecyzowywanie oraz ponowne generowanie dubbingu.
Czy mogę edytować lub ponownie wygenerować projekt Dubbing v2?
W aplikacji Dubbing v2 działa automatycznie i nie ma edytora w aplikacji. Edycja transkrypcji i ponowne generowanie audio przez API są dostępne tylko w planach Enterprise. Zobacz doprecyzowywanie oraz ponowne generowanie dubbingu. Aby edytować w interfejsie, użyj starszego modelu v1 z Dubbing Studio.
Jak używać starszego modelu dubbingu v1?
Automatyczny dubbing na głównej stronie Dubbing domyślnie używa Dubbing v2. Aby użyć starszego modelu v1, wybierz jako model Dubbing v1. Aby utworzyć projekt Dubbing Studio, wybierz Dubbing v1, a potem Projekt dubbingu. Użycie v1 to jedyny sposób, aby utworzyć projekt Dubbing Studio.