Avatars

Créez des identités visuelles persistantes avec des mouvements des lèvres synchronisés pour des vidéos face caméra.

Vue d’ensemble

Les avatars sont des identités visuelles persistantes qui associent une personne, un personnage ou un animal à n’importe quelle voix ElevenLabs pour générer des vidéos face caméra avec des mouvements des lèvres synchronisés. Créez des identités réutilisables une seule fois et associez-les à n’importe quelle voix ou script pour produire du contenu vidéo cohérent à grande échelle.

Les avatars sont disponibles avec tous les forfaits payants.

Certains modèles Avatar et certaines capacités d’importation d’images de référence sont restreints aux États-Unis en raison d’exigences réglementaires ou de fournisseurs.

Vue d’ensemble des avatars

Fonctionnalités clés

  • Identités persistantes : créez des avatars une fois et réutilisez-les dans un nombre illimité de vidéos
  • Flexibilité vocale : associez n’importe quel avatar à toute voix de votre bibliothèque, y compris les voix clonées
  • Variations de style : générez plusieurs styles à partir d’un même avatar avec différents angles, tenues, arrière-plans ou éclairages
  • Text to Speech intégré : convertissez directement du texte en parole dans l’interface Avatar
  • Intégration Flows : automatisez à grande échelle la génération de vidéos d’avatars avec le nœud Avatar
  • Plusieurs modèles de synchronisation labiale : la plateforme sélectionne automatiquement le modèle optimal selon le format d’entrée et les exigences de qualité

Créer un avatar

Générez un nouvel avatar à partir d’images de référence ou d’un prompt textuel :

1

Accéder à la création d’avatar

Accédez à Image & Vidéo, puis dans la section Avatar, cliquez sur Nouveau.

2

Importer des images de référence ou décrire votre avatar

Importez plusieurs images de référence de la même personne ou du même personnage sous différents angles. Des images de référence de meilleure qualité, présentant des perspectives variées, produisent de meilleurs résultats.

Interface de création d’avatar
Importez 3 à 5 images sous différents angles pour une qualité d’avatar optimale.

Vous pouvez également décrire votre avatar à l’aide d’un prompt textuel.

3

Configurer et créer

Nommez votre avatar et définissez éventuellement une voix par défaut. Cliquez sur Créer un avatar pour générer l’identité de base.

Une fois créé, l’avatar apparaît dans votre bibliothèque et peut être utilisé dans tous vos projets.

Styles

Les styles sont des variations d’un avatar existant qui représentent différents contextes visuels :

  • Angles et cadrages de caméra
  • Tenues et accessoires
  • Arrière-plans et environnements
  • Conditions d’éclairage

Créer un style

Pour créer un style pour un avatar existant, cliquez sur Voir l’avatar, puis sur « Nouveau style ».

Options de création de style dans l’interface Avatar

Vous pouvez créer des styles de deux façons :

Prompt : décrivez le nouveau style à l’aide d’un prompt textuel.

Importer : importez une image de référence pour guider le nouveau style tout en préservant l’identité principale.

Les styles vous permettent de préserver la cohérence de votre marque dans différents contextes, sans régénérer l’avatar entier.

Générer des vidéos

Générez des vidéos face caméra en associant n’importe quel avatar à une voix et à un script :

1

Sélectionner un avatar

Choisissez un avatar dans votre bibliothèque et sélectionnez Créer une synchronisation labiale. Choisissez le style que vous souhaitez utiliser.

2

Choisir une voix

Si vous avez défini une voix par défaut pour votre avatar, elle sera présélectionnée. Vous pouvez aussi utiliser n’importe quelle voix de votre bibliothèque, y compris des voix de la communauté, clonées ou créées.

Interface de sélection de voix et de Text to Speech
3

Ajouter votre script

Saisissez le texte que vous souhaitez faire prononcer à l’avatar, puis cliquez sur Générer la parole. Vous pouvez écouter la parole générée avant de passer à l’étape suivante et la régénérer si nécessaire.

Vous pouvez également sélectionner une génération Text to Speech précédente dans votre historique.

Lorsque votre sélection vous convient, cliquez sur Utiliser la parole.

4

Générer

À l’étape suivante, vous pouvez ajouter un prompt facultatif pour guider les éléments visuels de la synchronisation labiale. La plateforme sélectionne le modèle de synchronisation labiale optimal selon votre entrée et vos exigences de qualité, mais vous pouvez également modifier le modèle avant de générer la vidéo. Lorsque vous êtes prêt, cliquez sur Générer pour créer votre synchronisation labiale.

Intégration Flows

Le nœud Avatar dans Flows permet d’automatiser à grande échelle la génération de vidéos d’avatars.

Cas d’utilisation :

  • Campagnes vidéo personnalisées avec scripts dynamiques
  • Génération de vidéos par lots avec une identité de marque cohérente
  • Pipelines de contenu automatisés avec remplacement de voix et d’éléments visuels
Nœud Avatar dans l’interface Flows

En savoir plus sur Flows.

Coût en crédits

La génération d’avatars suit la structure tarifaire Image & Vidéo existante. Les coûts varient selon :

  • Le modèle de synchronisation labiale sélectionné
  • La résolution de sortie
  • La durée de la vidéo

Les crédits sont déduits à chaque génération. Consultez votre consommation dans vos analyses d’utilisation.

Informations clés

  • Disponibilité : tous les forfaits payants
  • Modèles de synchronisation labiale : la plateforme sélectionne automatiquement le modèle optimal
  • Compatibilité vocale : fonctionne avec toutes les voix ElevenLabs, y compris les voix clonées
  • Réutilisabilité : les avatars et les styles persistent pour un nombre illimité de générations
  • Prise en charge de Flows : disponible comme nœud Avatar pour l’automatisation
  • Accès API : non disponible au lancement, prévu dans une future version