Avatar
Crea identità visive persistenti con movimenti delle labbra sincronizzati per video con soggetti parlanti.
Panoramica
Gli avatar sono identità visive persistenti che combinano una persona, un personaggio o un animale con qualsiasi voce di ElevenLabs per generare video con soggetti parlanti e movimenti delle labbra sincronizzati. Crea identità riutilizzabili una sola volta e abbinale a qualsiasi voce o script per produrre contenuti video coerenti su larga scala.
Alcuni modelli Avatar e le funzionalità di caricamento delle immagini di riferimento sono soggetti a restrizioni negli Stati Uniti per requisiti normativi o dei provider.

Funzionalità principali
- Identità persistenti: crea avatar una volta e riutilizzali in un numero illimitato di video
- Flessibilità della voce: abbina qualsiasi avatar a qualsiasi voce della tua libreria, comprese le voci clonate
- Variazioni di stile: genera più stili da un singolo avatar con angolazioni, abiti, sfondi o illuminazione diversi
- Text to Speech integrato: converti direttamente il testo in parlato nell’interfaccia dell’avatar
- Integrazione con Flows: automatizza la generazione di video con avatar su larga scala usando il nodo Avatar
- Più modelli di lip-sync: la piattaforma seleziona automaticamente il modello ottimale in base al formato di input e ai requisiti di qualità
Creare un avatar
Genera un nuovo avatar da immagini di riferimento o da un prompt testuale:
Carica immagini di riferimento o descrivi il tuo avatar
Carica più immagini di riferimento della stessa persona o dello stesso personaggio da diverse angolazioni. Immagini di riferimento di qualità superiore e con prospettive varie producono risultati migliori.

In alternativa, puoi descrivere il tuo avatar usando un prompt testuale.
Una volta creato, l’avatar appare nella tua libreria e può essere usato in tutti i progetti.
Stili
Gli stili sono variazioni di un avatar esistente che rappresentano diversi contesti visivi:
- Angolazioni e inquadrature della telecamera
- Abiti e accessori
- Sfondi e ambienti
- Condizioni di illuminazione
Creare uno stile
Per creare uno stile per un avatar esistente, fai clic su Visualizza avatar, quindi su “Nuovo stile”.

Puoi creare stili in due modi:
Descrivilo con un prompt: descrivi il nuovo stile usando un prompt testuale.
Carica: carica un’immagine di riferimento per guidare il nuovo stile mantenendo l’identità principale.
Gli stili ti consentono di mantenere la coerenza del brand in contesti diversi senza rigenerare l’intero avatar.
Generare video
Genera video con soggetti parlanti abbinando un avatar a una voce e a uno script:
Seleziona un avatar
Scegli un avatar dalla tua libreria e seleziona Crea lip-sync. Scegli lo stile che vuoi usare.
Scegli una voce
Se hai impostato una voce predefinita per il tuo avatar, verrà preselezionata. Puoi anche usare qualsiasi voce della tua libreria, comprese le voci della community, le voci clonate o le voci progettate.

Aggiungi il tuo script
Inserisci il testo che vuoi far pronunciare all’avatar, quindi fai clic su Genera parlato. Puoi ascoltare il parlato generato prima di passare al passaggio successivo e rigenerarlo se necessario.
Puoi anche selezionare una precedente generazione di Text to Speech dalla Cronologia.
Quando sei soddisfatto della selezione, fai clic su Usa parlato.
Genera
Nel passaggio successivo puoi aggiungere un prompt facoltativo per guidare l’aspetto visivo del lip-sync. La piattaforma seleziona il modello di lip-sync ottimale in base al tuo input e ai requisiti di qualità, ma puoi anche cambiare modello prima di generare il video. Quando sei pronto, fai clic su Genera per creare il lip-sync.
Integrazione con Flows
Il nodo Avatar in Flows consente di automatizzare la generazione di video con avatar su larga scala.
I casi d’uso includono:
- Campagne video personalizzate con script dinamici
- Generazione in batch di video con branding coerente
- Pipeline di contenuti automatizzate con sostituzione di voci e immagini

Scopri di più su Flows.
Costi in crediti
La generazione di avatar segue l’attuale struttura dei prezzi di Immagini e Video. I costi variano in base a:
- Modello di lip-sync selezionato
- Risoluzione dell’output
- Durata del video
L’uso dei crediti viene detratto per ogni generazione. Consulta il tuo utilizzo nelle analisi di utilizzo.
Informazioni principali
- Disponibilità: tutti i piani a pagamento
- Modelli di lip-sync: la piattaforma seleziona automaticamente il modello ottimale
- Compatibilità vocale: funziona con tutte le voci di ElevenLabs, comprese le voci clonate
- Riutilizzabilità: gli avatar e gli stili persistono tra un numero illimitato di generazioni
- Supporto Flows: disponibile come nodo Avatar per l’automazione
- Accesso API: non disponibile al lancio; previsto per una versione futura