Cambiador de Voz
Aprende a transformar audio entre voces conservando la emoción y la entonación.
Descripción general
La API de cambiador de voz de ElevenLabs te permite transformar cualquier audio de origen (grabado o subido) en una voz diferente y totalmente clonada sin perder los matices de la interpretación original. Puede captar susurros, risas, llantos, acentos y sutiles señales emocionales para lograr un resultado muy realista y humano, y puedes usarla para:
- Cambiar cualquier voz conservando la entonación emocional y los matices
- Crear voces de personaje consistentes en varios idiomas y sesiones de grabación
- Corregir o sustituir palabras y frases concretas en grabaciones existentes
Explora nuestra biblioteca de voces para encontrar la voz perfecta para tu proyecto.
Idiomas compatibles
Nuestros modelos multilingües v2 son compatibles con 29 idiomas:
Inglés (EE. UU., Reino Unido, Australia, Canadá), japonés, chino, alemán, hindi, francés (Francia, Canadá), coreano, portugués (Brasil, Portugal), italiano, español (España, México), indonesio, neerlandés, turco, filipino, polaco, sueco, búlgaro, rumano, árabe (Arabia Saudí, EAU), checo, griego, finés, croata, malayo, eslovaco, danés, tamil, ucraniano y ruso.
El modelo eleven_english_sts_v2 solo admite inglés.
Datos clave
- Duración máxima del segmento: 5 minutos; divide las grabaciones más largas en fragmentos
- Facturación: 1000 caracteres por minuto de audio procesado
- Ruido de fondo: Usa
remove_background_noise=truepara minimizar los sonidos ambientales en el resultado - Recomendación de modelo:
eleven_multilingual_sts_v2suele superar aeleven_english_sts_v2incluso para contenido en inglés - Voces personalizadas: Puedes usar como voz de salida cualquier voz clonada o diseñada de tu biblioteca; proporciona su
voice_id