Avatarer
Skapa beständiga visuella identiteter med synkroniserade läpprörelser för videor med pratande personer.
Översikt
Avatarer är beständiga visuella identiteter som kombinerar en person, karaktär eller ett djur med valfri ElevenLabs-röst för att skapa videor med pratande personer och synkroniserade läpprörelser. Skapa återanvändbara identiteter en gång och para ihop dem med valfri röst eller något manus för att producera konsekvent videoinnehåll i stor skala.
Vissa Avatar-modeller och funktioner för uppladdning av referensbilder är begränsade i USA på grund av myndighetskrav eller krav från leverantörer.

Viktiga funktioner
- Beständiga identiteter: Skapa avatarer en gång och återanvänd dem i obegränsat antal videor
- Flexibla röster: Para ihop valfri avatar med valfri röst från ditt bibliotek, inklusive klonade röster
- Stilvariationer: Skapa flera stilar från en enda avatar med olika vinklar, kläder, bakgrunder eller ljussättning
- Integrerad Text to Speech: Omvandla text direkt till tal i avatargränssnittet
- Flows-integrering: Automatisera generering av avatarvideor i stor skala med Avatar-noden
- Flera läppsynkmodeller: Plattformen väljer automatiskt den optimala modellen utifrån indataformat och kvalitetskrav
Skapa en avatar
Skapa en ny avatar från referensbilder eller en textprompt:
Ladda upp referensbilder eller beskriv din avatar
Ladda upp flera referensbilder av samma person eller karaktär från olika vinklar. Referensbilder av högre kvalitet med varierade perspektiv ger bättre resultat.

Du kan också beskriva din avatar med en textprompt.
När den har skapats visas avataren i ditt bibliotek och kan användas i olika projekt.
Stilar
Stilar är variationer av en befintlig avatar som representerar olika visuella sammanhang:
- Kameravinklar och beskärning
- Kläder och accessoarer
- Bakgrunder och miljöer
- Ljussättningsförhållanden
Skapa en stil
För att skapa en stil för en befintlig avatar klickar du på View Avatar och sedan på “New Style”.

Du kan skapa stilar på två sätt:
Prompta den: Beskriv den nya stilen med en textprompt.
Ladda upp: Ladda upp en referensbild för att styra den nya stilen samtidigt som kärnidentiteten behålls.
Med stilar kan du behålla en konsekvent varumärkesprofil i olika sammanhang utan att skapa om hela avataren.
Skapa videor
Skapa videor med pratande personer genom att para ihop valfri avatar med en röst och ett manus:
Välj en avatar
Välj en avatar från ditt bibliotek och välj Create Lip Sync. Välj den stil du vill använda.
Välj en röst
Om du har angett en standardröst för din avatar väljs den i förväg. Du kan också använda valfri röst från ditt bibliotek, inklusive community-röster, klonade röster eller designade röster.

Lägg till ditt manus
Skriv in texten som avataren ska säga och klicka sedan på Generate speech. Du kan lyssna på det genererade talet innan du går vidare till nästa steg och generera om vid behov.
Du kan också välja en tidigare Text to Speech-generering från din historik.
När du är nöjd med ditt val klickar du på Use Speech.
Generera
I nästa steg kan du lägga till en valfri prompt för att styra det visuella i läppsynken. Plattformen väljer den optimala läppsynkmodellen utifrån dina indata och kvalitetskrav, men du kan också ändra modell innan du skapar videon. När du är redo klickar du på Generate för att skapa din läppsynk.
Flows-integrering
Avatar-noden i Flows möjliggör automatiserad generering av avatarvideor i stor skala.
Användningsfall omfattar:
- Personliga videokampanjer med dynamiska manus
- Batchgenerering av videor med konsekvent varumärkesprofil
- Automatiserade innehållsflöden med byte av röster och visuellt innehåll

Läs mer om Flows.
Kreditkostnader
Generering av avatarer följer den befintliga prisstrukturen för Image & Video. Kostnaderna varierar beroende på:
- Vald läppsynkmodell
- Utdatans upplösning
- Videons längd
Krediter dras för varje generering. Kontrollera din användning i din användningsanalys.
Viktiga fakta
- Tillgänglighet: Alla betalplaner
- Läppsynkmodeller: Plattformen väljer automatiskt den optimala modellen
- Röstkompatibilitet: Fungerar med alla ElevenLabs-röster, inklusive klonade röster
- Återanvändbarhet: Avatarer och stilar består mellan obegränsat antal genereringar
- Flows-stöd: Tillgänglig som en Avatar-nod för automatisering
- API-åtkomst: Inte tillgänglig vid lansering; planeras för en framtida version