Presentamos Voice Design v3
- Publicado
EscucharEscucha este artículo
Nos alegra anunciar Voice Design v3. Esta nueva versión hace que crear voces sea más rápido, fácil e intuitivo que nunca.
Voice Design v3 es ideal para creadores, empresas y desarrolladores que necesitan voces específicas para su proyecto. Solo tienes que describir la voz, obtener tres opciones al instante, elegir tu favorita y empezar a usarla de inmediato.
Pruébalo y descubre lo fácil que puede ser crear voces.
Por qué Voice Design es importante

Cuando lanzamos Voice Design, el objetivo era sencillo: permitir que cualquier creador generase una voz a medida, sin reservar un estudio ni buscar a fondo en bibliotecas de audio. La versión 3 va más allá, con mayor control, iteraciones más rápidas y un proceso más fluido desde la idea hasta el audio final.
Los proyectos suelen necesitar decenas de voces: un narrador tranquilo, un personaje secundario nervioso, varios NPC de un videojuego o incluso un mapache que habla. Buscar «algo que se parezca» ralentiza a los equipos.
Voice Design v3 elimina esa fricción. Escribe una descripción, genera tres opciones, elige una y sigue adelante, pagando solo por los caracteres de tu prompt, no por muestra.
Novedades de v3
- Calidad de audio precisa: Añade términos como «calidad de audio perfecta» (o cualquier otro nivel) a tu prompt: v3 los respetará. ¿Prefieres un efecto de radio de lata? Solo tienes que decirlo. Tú controlas el acabado.
- Motor de prompting más inteligente: v3 interpreta indicaciones sutiles como «neoyorquino de mediana edad, con entonación ascendente y media sonrisa» sin introducir artefactos ni perder claridad. Entre bastidores, hemos ampliado el espacio latente y reentrenado el modelo con datos de acentos más variados para que las combinaciones poco habituales suenen naturales.
Dos modos de diseño
- Realistic Voice Design para interpretaciones realistas. Ejemplo: «Una mujer india con una entonación suave y tranquila».
- Character Voice Design para todo tipo de personajes, desde elfos hasta dioses ancestrales.
Un clic, tres voces
Haz clic en Generar y v3 te devolverá tres voces diferentes. Conserva la que más te guste —ocupará un espacio de voz— y descarta las demás. Sin colas. Sin coste adicional.
Diseña una voz en tres pasos
- Elige un concepto: ¿Qué papel desempeña la voz? Crea una personalidad breve.
- Escribe el prompt con intención: Describe la edad, el acento, el tono, el ritmo y la calidad de audio en una sola frase. Ejemplo: «Calidad de audio perfecta. Hombre mayor, marcado acento escocés, lento y reflexivo, timbre grave y áspero».
- Guarda y utiliza: Elige una de las tres previsualizaciones: podrás usarla al instante en la API de ElevenLabs o en Studio web.
Sin interminables menús desplegables. Sin ajustes ocultos. Solo resultados.
Consejos avanzados de prompting
A continuación encontrarás los atributos que nuestro equipo de investigación observa con más frecuencia en resultados de máxima calidad:
| Attribute | Why it matters | Example keywords |
|---|---|---|
| Age | Sets vocal texture and pitch | child, teen, middle-aged, elderly |
| Accent/nationality | Grounds the character in place | thick Australian, light French, neutral American |
| Gender | Guides resonance | male, female, gender-neutral |
| Tone & emotion | Drives delivery | warm, assertive, anxious, joyful |
| Speed | Controls pacing without editing | fast, measured, languid |
| Guidance scale | Balances creativity vs. prompt fidelity | “guidance scale 10” (try 8–12 for accuracy, 3–5 for exploration) |
Para ver una matriz completa, consulta la guía de prompting en la documentación.
Una nota sobre la claridad
Los mejores prompts suenan como el habla cotidiana: breves, específicos y sin jerga. Este principio también define nuestro estilo de escritura: si puedes eliminar una palabra, elimínala.
Aplicaciones reales

- Desarrollo de videojuegos: Crea hoy prototipos de misiones secundarias con voces provisionales. Sustitúyelas mañana por las interpretaciones finales, sin volver a hacer casting.
- Audiolibros y pódcasts: Da a cada personaje un sonido propio. Después, ajusta la entonación escena a escena.
- Localización: Mantén el ritmo de los diálogos traducidos mientras generas acentos culturalmente precisos.
- Accesibilidad: Crea voces que se ajusten al tono de una marca para lectores de pantalla y sistemas de IVR que mejoren la comodidad del usuario.
Ya disponible
Voice Design v3 ya está disponible en el panel de ElevenLabs: Voces → Mis voces → Crear una voz → Voice Design
Inicia sesión, escribe un prompt y haz clic en Generar. En poco tiempo tendrás tres voces nuevas, aunque solo una existía en tu imaginación.
Nos vemos en Studio.





