Cambiador de Voz
Una guía para transformar audio entre voces conservando la emoción y la entonación.
Información general
El Cambiador de Voz (anteriormente, Voz a Voz) te permite convertir una voz (voz de origen) en otra (voz clonada) conservando el tono y la entonación de la voz original.
El Cambiador de Voz puede complementar Texto a Voz (TTS), corrigiendo errores de pronunciación o aportando esa interpretación especial que quieres transmitir. El Cambiador de Voz es especialmente útil para emular esas características sutiles e idiosincráticas de la voz que aportan un toque más emotivo y humano. Algunas de sus funciones principales son:
- Mayor precisión con susurros
- Capacidad para crear suspiros, risas o llantos audibles
- Detección del tono y la emoción muy mejorada
- Sigue con precisión la cadencia del habla de entrada
- Conservación del idioma/acento
Ve un vídeo del Cambiador de Voz en acción
Guía

Puedes subir audio directamente desde un archivo de audio o grabarlo en directo con un micrófono. El archivo de audio debe tener un tamaño inferior a 50 MB y ni el archivo de audio ni tu grabación en directo pueden superar los 5 minutos de duración.
Si tienes material de más de 5 minutos, te recomendamos dividirlo en secciones más pequeñas y generarlas por separado. Además, si el tamaño de tu archivo es demasiado grande, puede que necesites comprimirlo o convertirlo a MP3.
Archivo de audio existente
Para subir un archivo de audio existente, haz clic en el cuadro de audio o arrastra y suelta el archivo directamente sobre él.
Grabar en directo
Pulsa el botón Grabar audio en el cuadro de audio y, cuando estés listo para empezar a grabar, pulsa el botón Micrófono. Cuando termines de grabar, pulsa el botón Detener.
A continuación, verás el archivo de audio de la grabación, que podrás reproducir para escucharlo; esto te ayudará a determinar si estás satisfecho con tu interpretación o grabación. El coste en caracteres se mostrará en la esquina inferior izquierda y no se te cobrará cuota por grabar nada, solo cuando pulses «Generar».
El coste de una generación con el Cambiador de Voz se basa únicamente en la duración: 1000 caracteres por minuto.
Ajustes

Obtén más información sobre los distintos ajustes de voz aquí.
El Cambiador de Voz añade un ajuste adicional para eliminar automáticamente el ruido de fondo de tu grabación.
Idiomas compatibles
eleven_english_sts_v2
Nuestros modelos multilingües v2 son compatibles con 29 idiomas:
Inglés (EE. UU., Reino Unido, Australia, Canadá), japonés, chino, alemán, hindi, francés (Francia, Canadá), coreano, portugués (Brasil, Portugal), italiano, español (España, México), indonesio, neerlandés, turco, filipino, polaco, sueco, búlgaro, rumano, árabe (Arabia Saudí, EAU), checo, griego, finés, croata, malayo, eslovaco, danés, tamil, ucraniano y ruso.
El modelo eleven_english_sts_v2 solo es compatible con inglés.
Más información sobre los modelos
Buenas prácticas
El Cambiador de Voz destaca por conservar los acentos y las cadencias naturales del habla entre distintas voces de salida. Por ejemplo, si subes una muestra de audio con acento portugués, el resultado conservará ese idioma y acento. La muestra de entrada es crucial, ya que determina las características del resultado. Si seleccionas una voz británica como «George», pero grabas con acento estadounidense, el resultado será la voz de George con acento estadounidense.
- Expresión: Sé expresivo en tus grabaciones. Ya sea gritando, llorando o riendo, el Cambiador de Voz reproducirá tu interpretación con precisión. Esta herramienta está diseñada para mejorar el realismo de la IA y permitir la expresión creativa.
- Ganancia del micrófono: Asegúrate de que la ganancia de entrada sea adecuada. Una grabación con poco volumen puede dificultar el reconocimiento de la IA, mientras que una demasiado alta podría provocar recortes de audio.
- Ruido de fondo: Activa la opción Eliminar ruido de fondo para eliminar automáticamente el ruido de fondo de tu grabación.