Introducing Eleven v4Introducing Eleven v4, our fastest and most emotive voice model

Ir al contenido

Texto a Voz

Texto a Voz con voces IA de alta calidad y sonido humano

Más de 1 millón de usuarios confían en nosotros · Empieza gratis

Seleccionado para tu caso de uso

Seleccionado para tu caso de uso

Elige una voz

Generar voz

Último lanzamiento de modelo

Eleven v4

Crea voz expresiva y controlable con emoción, eventos de audio y paisajes sonoros envolventes.

Voces IA para Texto a Voz conscientes de la emoción y el contexto

Nuestra IA de voz responde a las señales emocionales del texto y adapta su entonación tanto al contenido inmediato como al contexto general. Así, nuestras voces IA pueden expresar un amplio rango emocional y evitar errores lógicos al leer tu contenido en voz alta.

Controla la emoción, la entonación y la dirección

Crea voz expresiva y controlable con emoción, eventos de audio y paisajes sonoros envolventes.

Accede a una biblioteca de más de 10.000 voces naturales

Explora una colección en constante crecimiento de voces expresivas y realistas para cualquier caso de uso, desde narración hasta creación de personajes.

Compatibilidad con diálogos

Crea conversaciones de audio en las que quienes hablan comparten contexto y emoción.

Clona o diseña una voz

Replica tu propia voz al instante o crea voces IA únicas con control total.

Voz multilingüe

Da vida a historias en más de 70 idiomas, con emoción y claridad propias de hablantes nativos.

Diseñado para una amplia variedad de usos, desde agentes de IA hasta audiolibros o locuciones

Agentes conversacionales

Usa Texto a Voz con IA para crear voces naturales para chatbots y asistentes virtuales, y mejora la interacción con usuarios mediante respuestas realistas.
TTS used for Conversational Agents

Videojuegos

Genera locuciones para personajes de videojuegos con la API de Texto a Voz, con voces conscientes del contexto y emocionalmente precisas que se adaptan a cada situación del juego.
Text to Speech for narration in video games

Audiolibros

Convierte texto escrito en voces IA naturales para audiolibros y produce contenido rápidamente en varios idiomas.
Use TTS to generate audiobooks

Locuciones para vídeo

Crea locuciones de alta calidad para vídeos, programas de televisión y animaciones con Texto a Voz con IA, agilizando la producción.
Add voiceovers to videos with TTS

Pódcasts

Usa Texto a Voz con IA para crear pódcasts con una narración coherente y profesional, y reduce el tiempo de grabación manual.
Generate podcasts in Studio

Accesibilidad

Integra Texto a Voz en sitios web y apps para ofrecer versiones de audio del contenido y facilitar el acceso a la información a personas con dificultades visuales o de lectura.
Use text to speech for screen readers

Millones de palabras generadas cada minuto

Genera voz en más de 70 idiomas y con una amplia variedad de acentos

  • English
  • Afrikaans
  • Arabic
  • Armenian
  • Assamese
  • Azerbaijani
  • Belarusian
  • Bengali
  • Bosnian
  • Bulgarian
  • Catalan
  • Cebuano
  • Chichewa
  • Chinese
  • Croatian
  • Czech
  • Danish
  • Dutch
  • Estonian
  • Filipino
  • Finnish
  • French
  • Galician
  • Georgian
  • German
  • Greek
  • Gujarati
  • Hausa
  • Hebrew
  • Hindi
  • Hungarian
  • Icelandic
  • Igbo
  • Indonesian
  • Irish
  • Italian
  • Japanese
  • Javanese
  • Kannada
  • Kazakh
  • Kirghiz
  • Korean
  • Latvian
  • Lingala
  • Lithuanian
  • Luxembourgish
  • Macedonian
  • Malay
  • Malayalam
  • Mandarin Chinese
  • Marathi
  • Nepali
  • Norwegian
  • Pashto
  • Persian
  • Polish
  • Portuguese
  • Punjabi
  • Romanian
  • Russian
  • Serbian
  • Sindhi
  • Slovak
  • Slovenian
  • Somali
  • Spanish
  • Swahili
  • Swedish
  • Tamil
  • Telugu
  • Thai
  • Turkish
  • Ukrainian
  • Urdu
  • Vietnamese
  • Welsh
  • African
  • American
  • Argentine
  • Australian
  • British
  • Californian
  • Canadian
  • Cockney
  • Country
  • Czech Moravian
  • Desi
  • Filipino
  • French Swiss
  • German
  • German Bavarian
  • Indian
  • Irish
  • Italian
  • Jamaican
  • Latin American
  • Latino
  • Mexican
  • New York
  • Pakistani
  • Portuguese
  • Russian
  • Scandinavian
  • Scottish
  • Southern USA
  • Spanish
  • Spanish Castilian
  • Texas
  • Turkish Istanbul

Basado en los modelos de Texto a Voz más potentes

Abstract blurred gradient in warm coral, orange, green, and brown tones.

Eleven v4

Nuestro modelo de voz más rápido y expresivo, que combina emoción, eventos de audio y paisajes sonoros.

  • Voz expresiva y controlable
  • Compatible con más de 90 idiomas
  • Límite de 5.000 caracteres
  • Diálogo con varios hablantes
Abstract red, orange, and pink gradient background.

Eleven v3

Nuestro avanzado y expresivo modelo con etiquetas de audio para un control emocional preciso. Ideal para narración, videojuegos y producción audiovisual en más de 70 idiomas.

  • Entonación e interpretación dramáticas
  • Compatible con más de 70 idiomas
  • Límite de 5000 caracteres
  • Diálogo con varios hablantes
Abstract blurred gradient blending blue, orange, red, and purple tones.

Multilingual v2

Nuestro modelo de Texto a Voz realista y lleno de emoción, compatible con 29 idiomas. Ideal para locuciones, audiolibros, posproducción y creación de contenido.

  • Resultado de sonido natural
  • Compatible con 29 idiomas
  • Límite de 10.000 caracteres
  • Diseñado para generar contenidos extensos
Abstract pink and purple gradient background with soft diagonal color bands.

Flash / Turbo v2.5

Nuestro modelo de síntesis de voz rápido y asequible. Ideal para casos de uso de desarrolladores en los que la velocidad importa y necesitas idiomas distintos del inglés.

  • Latencia ultrabaja (~75 ms*)
  • Compatible con 32 idiomas
  • Límite de 40.000 caracteres
  • Modelo más rápido, con un precio por carácter un 50 % menor

Creadores líderes de todo el mundo y sus comunidades confían en nosotros

Precios de Texto a Voz

0 $ por mes

10k créditos por mes

Gratis
0 $ por mes
Starter
6 $ por mes
Creator
22 $ por mes, primer mes 11 $
Pro
99 $ por mes

10k créditos por mes

30k créditos por mes

121k créditos por mes

600k créditos por mes

Texto a Voz (UI)

Minutos incluidos

Minuto extra

Uso comercial

Modelo Eleven v3

Idiomas

Espacios para voces personalizadas

Clonación de voz instantánea

Clonación de voz profesional

Calidad de audio

WAV / PCM 44,1 kHz

Solicitudes simultáneas

~10

~0,36 $

74

3

128 kbps, 44.1kHz

2

~30

~0,20 $

74

10

128 kbps, 44.1kHz

3

~121

~0,18 $

74

30

1

128 y 192 kbps, 44.1kHz

5

~600

~0,17 $

74

160

1

128 y 192 kbps, 44.1kHz

10

Los precios no incluyen impuestos, tasas ni aranceles. Ver todos los planes de precios.

Seguridad e infraestructura de nivel empresarial a escala

Data Protection graphics

Los datos se cifran tanto en tránsito como en reposo, con compatibilidad para el cumplimiento de SOC 2, HIPAA y RGPD. Los modos de residencia de datos en la UE y retención cero están disponibles para un control de datos más estricto.

Los datos se cifran tanto en tránsito como en reposo, con compatibilidad para el cumplimiento de SOC 2, HIPAA y RGPD. Los modos de residencia de datos en la UE y retención cero están disponibles para un control de datos más estricto.

Permissions

Configura permisos de equipo granulares y colabora en toda la empresa compartiendo voces, recursos y materiales entre tus agentes y tu proceso de producción de contenido.

Nuestro equipo garantiza un lanzamiento fluido y mantiene tus operaciones funcionando de forma fiable, con rendimiento constante y tranquilidad.

Disponible en la web, móvil y mediante API o SDK

Studio de ElevenLabs

Los mejores modelos de audio con IA en un potente editor.

Use TTS in the ElevenLabs Studio

App móvil de ElevenLabs

Genera audio expresivo en segundos con nuestras apps para iOS y Android.

ElevenLabs Mobile app

API y SDK de Texto a Voz

Integra Texto a Voz (TTS) de ElevenLabs en tu producto mediante API o SDK.

TTS API

Mostramos el impacto global de la investigación en audio con IA

Preguntas frecuentes

Últimas novedades

Crea con el audio IA de la más alta calidad