Avatary
Twórz trwałe tożsamości wizualne z zsynchronizowanym ruchem ust do filmów z mówiącą postacią.
Omówienie
Avatary to trwałe tożsamości wizualne, które łączą osobę, postać lub zwierzę z dowolnym głosem ElevenLabs, aby tworzyć filmy z mówiącą postacią i zsynchronizowanym ruchem ust. Stwórz tożsamość raz, a potem łącz ją z dowolnym głosem lub skryptem, aby tworzyć spójne treści wideo na dużą skalę.
Niektóre modele Avatar oraz możliwości przesyłania obrazów referencyjnych są ograniczone w Stanach Zjednoczonych ze względu na wymogi prawne lub dostawców.

Najważniejsze możliwości
- Trwałe tożsamości: Twórz avatary raz i wykorzystuj je w nieograniczonej liczbie filmów
- Elastyczność głosu: Łącz dowolny avatar z dowolnym głosem z biblioteki, w tym sklonowanymi głosami
- Warianty stylu: Generuj wiele stylów jednego avatara z różnymi ujęciami, strojami, tłami lub oświetleniem
- Zintegrowana zamiana tekstu na mowę: Zamieniaj tekst bezpośrednio na mowę w interfejsie avatara
- Integracja z Flows: Automatyzuj generowanie filmów z avatarami na dużą skalę za pomocą węzła Avatar
- Wiele modeli synchronizacji ruchu ust: Platforma automatycznie wybiera optymalny model na podstawie formatu wejściowego i wymagań jakościowych
Tworzenie avatara
Wygeneruj nowy avatar na podstawie obrazów referencyjnych lub promptu tekstowego:
Prześlij obrazy referencyjne lub opisz avatar
Prześlij kilka obrazów referencyjnych tej samej osoby lub postaci z różnych perspektyw. Lepszej jakości obrazy referencyjne z różnorodnych ujęć dają lepsze rezultaty.

Możesz też opisać avatar za pomocą promptu tekstowego.
Po utworzeniu avatar pojawi się w bibliotece i będzie można używać go w projektach.
Style
Style to warianty istniejącego avatara, które przedstawiają różne konteksty wizualne:
- Kąty kamery i kadrowanie
- Stroje i akcesoria
- Tła i otoczenie
- Warunki oświetleniowe
Tworzenie stylu
Aby utworzyć styl dla istniejącego avatara, kliknij View Avatar, a następnie „New Style”.

Style możesz tworzyć na dwa sposoby:
Prompt: Opisz nowy styl za pomocą promptu tekstowego.
Prześlij: Prześlij obraz referencyjny, aby nadać kierunek nowemu stylowi przy zachowaniu głównej tożsamości.
Style pozwalają zachować spójność marki w różnych kontekstach bez ponownego generowania całego avatara.
Generowanie filmów
Generuj filmy z mówiącą postacią, łącząc dowolny avatar z głosem i skryptem:
Wybierz avatar
Wybierz avatar z biblioteki i kliknij Create Lip Sync. Wybierz styl, którego chcesz użyć.
Wybierz głos
Jeśli dla avatara ustawiono domyślny głos, będzie on wybrany automatycznie. Możesz też użyć dowolnego głosu z biblioteki, w tym głosów społeczności, sklonowanych lub zaprojektowanych.

Dodaj skrypt
Wpisz tekst, który ma wypowiedzieć avatar, a następnie kliknij Generate speech. Możesz odsłuchać wygenerowaną mowę przed przejściem do następnego kroku i w razie potrzeby wygenerować ją ponownie.
Możesz też wybrać wcześniejszą generację Text to Speech z Historii.
Gdy wybór będzie gotowy, kliknij Use Speech.
Generuj
W następnym kroku możesz dodać opcjonalny prompt, który określi wygląd synchronizacji ruchu ust. Platforma wybiera optymalny model synchronizacji na podstawie danych wejściowych i wymagań jakościowych, ale przed wygenerowaniem filmu możesz też zmienić model. Gdy wszystko będzie gotowe, kliknij Generate, aby utworzyć synchronizację ruchu ust.
Integracja z Flows
Węzeł Avatar w Flows umożliwia automatyczne generowanie filmów z avatarami na dużą skalę.
Przykładowe zastosowania:
- Spersonalizowane kampanie wideo z dynamicznymi skryptami
- Wsadowe generowanie filmów ze spójnym brandingiem
- Zautomatyzowane procesy tworzenia treści z podmianą głosu i obrazu

Dowiedz się więcej o Flows.
Koszty w kredytach
Generowanie avatarów korzysta z obecnej struktury cen Image & Video. Koszty zależą od:
- Wybranego modelu synchronizacji ruchu ust
- Rozdzielczości wyjściowej
- Długości filmu
Kredyty są odliczane za każdą generację. Sprawdź wykorzystanie w analityce użycia.
Najważniejsze informacje
- Dostępność: Wszystkie płatne plany
- Modele synchronizacji ruchu ust: Platforma automatycznie wybiera optymalny model
- Zgodność głosów: Działa ze wszystkimi głosami ElevenLabs, w tym sklonowanymi
- Możliwość ponownego użycia: Avatary i style pozostają dostępne w nieograniczonej liczbie generacji
- Obsługa Flows: Dostępne jako węzeł Avatar do automatyzacji
- Dostęp przez API: Niedostępne przy premierze; planowane w przyszłej wersji