Avatares
Crea identidades visuales persistentes con movimiento labial sincronizado para vídeos de personas hablando.
Resumen
Los avatares son identidades visuales persistentes que combinan a una persona, personaje o animal con cualquier voz de ElevenLabs para generar vídeos de personas hablando con movimiento labial sincronizado. Crea identidades reutilizables una vez y combínalas con cualquier voz o guion para producir contenido de vídeo coherente a escala.
Algunos modelos de Avatar y las capacidades de carga de imágenes de referencia están restringidos en Estados Unidos debido a requisitos normativos o de los proveedores.

Funciones principales
- Identidades persistentes: Crea avatares una vez y reutilízalos en vídeos ilimitados
- Flexibilidad de voz: Combina cualquier avatar con cualquier voz de tu biblioteca, incluidas las voces clonadas
- Variaciones de estilo: Genera varios estilos a partir de un único avatar con distintos ángulos, conjuntos, fondos o iluminación
- Texto a voz integrado: Convierte texto directamente en voz desde la interfaz de avatares
- Integración con Flows: Automatiza la generación de vídeos con avatares a escala mediante el nodo Avatar
- Varios modelos de sincronización labial: La plataforma selecciona automáticamente el modelo óptimo según el formato de entrada y los requisitos de calidad
Crear un avatar
Genera un avatar nuevo a partir de imágenes de referencia o de un prompt de texto:
Sube imágenes de referencia o describe tu avatar
Sube varias imágenes de referencia de la misma persona o personaje desde distintos ángulos. Las imágenes de referencia de mayor calidad y con perspectivas variadas dan mejores resultados.

También puedes describir tu avatar con un prompt de texto.
Una vez creado, el avatar aparece en tu biblioteca y puedes usarlo en todos tus proyectos.
Estilos
Los estilos son variaciones de un avatar existente que representan distintos contextos visuales:
- Ángulos de cámara y encuadre
- Conjuntos y accesorios
- Fondos y entornos
- Condiciones de iluminación
Crear un estilo
Para crear un estilo para un avatar existente, haz clic en Ver avatar y luego en “Nuevo estilo”.

Puedes crear estilos de dos formas:
Con un prompt: Describe el nuevo estilo mediante un prompt de texto.
Subir: Sube una imagen de referencia para guiar el nuevo estilo manteniendo la identidad principal.
Los estilos te permiten mantener la coherencia de marca en diferentes contextos sin regenerar el avatar completo.
Generar vídeos
Genera vídeos de personas hablando combinando cualquier avatar con una voz y un guion:
Selecciona un avatar
Elige un avatar de tu biblioteca y selecciona Crear sincronización labial. Elige el estilo que quieres usar.
Elige una voz
Si estableciste una voz predeterminada para tu avatar, se seleccionará previamente. También puedes usar cualquier voz de tu biblioteca, incluidas voces de la comunidad, voces clonadas o voces diseñadas.

Añade tu guion
Introduce el texto que quieres que diga el avatar y haz clic en Generar voz. Puedes escuchar la voz generada antes de pasar al siguiente paso y regenerarla si es necesario.
También puedes seleccionar una generación anterior de Texto a Voz desde tu Historial.
Cuando estés satisfecho con tu selección, haz clic en Usar voz.
Genera
En el siguiente paso, puedes añadir un prompt opcional para guiar los elementos visuales de la sincronización labial. La plataforma selecciona el modelo de sincronización labial óptimo según tu entrada y tus requisitos de calidad, pero también puedes cambiar el modelo antes de generar el vídeo. Cuando estés listo, haz clic en Generar para crear tu sincronización labial.
Integración con Flows
El nodo Avatar de Flows permite generar vídeos con avatares a escala de forma automatizada.
Los casos de uso incluyen:
- Campañas de vídeo personalizadas con guiones dinámicos
- Generación de vídeos por lotes con una imagen de marca coherente
- Flujos de contenido automatizados con intercambio de voz y elementos visuales

Descubre más sobre Flows.
Coste en créditos
La generación de avatares sigue la estructura de precios de Imagen y Video actual. Los costes varían según:
- El modelo de sincronización labial seleccionado
- La resolución de salida
- La duración del vídeo
El uso de créditos se descuenta por generación. Consulta tu uso en tus analíticas de uso.
Datos clave
- Disponibilidad: Todos los planes de pago
- Modelos de sincronización labial: La plataforma selecciona automáticamente el modelo óptimo
- Compatibilidad de voz: Funciona con todas las voces de ElevenLabs, incluidas las voces clonadas
- Reutilización: Los avatares y estilos se mantienen en generaciones ilimitadas
- Compatibilidad con Flows: Disponible como nodo Avatar para automatización
- Acceso a la API: No disponible en el lanzamiento; previsto para una futura versión