Remezcla de voces

Aprende a transformar y mejorar voces existentes modificando atributos como el género, el acento, el estilo, el ritmo, la calidad de audio y mucho más.

Descripción general

La remezcla de voces de ElevenLabs está disponible en la plataforma principal y a través de la API. Esta función transforma voces existentes permitiéndote modificar sus atributos principales mientras mantiene las características únicas que las hacen reconocibles. Resulta especialmente útil para adaptar voces a distintos contextos, crear variaciones para diferentes personajes o mejorar y/o cambiar la calidad de audio de perfiles de voz existentes.

Por ejemplo, esta es una voz original:

Y esta es una versión remezclada, con acento de San Francisco:

Uso

El modelo de remezcla de voces te permite transformar voces que te pertenecen o voces de la Biblioteca de voces con un periodo de aviso infinito, ajustando varios atributos mediante prompts en lenguaje natural y ajustes personalizables.

Funciones principales

  • Modificación de atributos: Cambia el género, el acento, el estilo de habla, el ritmo y la calidad de audio de cualquier voz que te pertenezca o de voces de la Biblioteca de voces con un periodo de aviso infinito
  • Edición iterativa: Sigue perfeccionando voces a partir de versiones remezcladas previamente
  • Flexibilidad de guion: Usa guiones predeterminados o introduce guiones personalizados con etiquetas de audio del modelo v3 como [laughs] o [whispers]
  • Control de intensidad del prompt: Ajusta la intensidad de la remezcla de baja a alta para controlar con precisión las transformaciones

Parámetros de remezcla

Intensidad del prompt

La remezcla de voces ofrece distintos niveles de intensidad del prompt para controlar cuánto se transforma tu voz:

  • Baja: Cambios sutiles que mantienen la mayoría de las características de la voz original
  • Media: Transformación equilibrada que modifica atributos clave mientras conserva la identidad de la voz
  • Alta: Gran fidelidad al prompt de remezcla; puede cambiar significativamente la tonalidad de la voz original
  • Máxima: Una transformación completa de la voz, pero a costa de cambiarla por completo

Opciones de guion

  • Guiones predeterminados: Guiones preconfigurados optimizados para la remezcla de voces
  • Guiones personalizados: Introduce tu propio texto compatible con etiquetas de audio del modelo v3 como:
    • [laughs] - Añade risas
    • [whispers] - Convierte la voz en un susurro
    • [sighs] - Añade suspiros
    • Se admiten etiquetas adicionales de emoción y estilo que pueden ayudar a crear la voz

Formatos de voz compatibles

Entrada

  • Cualquier voz clonada que te pertenezca (Clonar Voz IA Instantáneo o Clonar Voz IA Profesional)
  • Voces creadas con nuestro producto Diseño de voz
  • Cualquier voz con un periodo de aviso infinito añadida desde la Biblioteca de voces

Salida

  • Modelo de voz de máxima calidad en v3 (con compatibilidad retroactiva con todos los demás modelos)
  • Voz editable de forma iterativa que se puede seguir remezclando

Datos clave

  • Precios: Se basan en la longitud del guion de prueba utilizado durante el proceso de remezcla
  • Voces aptas: Puedes remezclar voces que te pertenecen, voces para las que tienes permisos explícitos y cualquier voz con un periodo de aviso infinito
  • Voz original: La remezcla crea una nueva variante de voz; la voz original no se modifica
  • Límite de iteraciones: No hay límite para la remezcla iterativa; cada remezcla puede servir de base para la siguiente