API de Texto a Voz: hasta un 40 % más rápida en todo el mundo
- Escrito por
- Joe Reeve
- Publicado
EscucharEscucha este artículo
Hemos implementado el servicio multirregional para nuestra API de Texto a Voz. Ahora las solicitudes se dirigen automáticamente al backend más cercano (EE. UU., Países Bajos o Singapur), lo que reduce el tiempo hasta el primer byte (TTFB) sin necesidad de cambiar el código.
Qué ha cambiado
Cuando llamas a api.elevenlabs.io, nuestra infraestructura dirige la solicitud al backend óptimo según tu ubicación:
- América: Centro de EE. UU.
- Europa, Oriente Medio y África: Países Bajos
- Asia-Pacífico: Singapur
Puedes comprobar la región desde la que se atiende tu solicitud mediante la cabecera x-region en la respuesta de la API.
Rendimiento
Con GPU mejoradas y una pila de inferencia optimizada, Flash v2.5 logra un tiempo de modelo hasta el primer byte de 50 ms. Junto con las mejoras en el enrutamiento de red, esto reduce considerablemente la latencia percibida.
Mejoras de TTFB medidas en 11 ubicaciones de todo el mundo:
Para la mayoría de desarrolladores internacionales, esto supone una reducción del 20-40 % en la latencia percibida.
Por qué es importante
Para agentes de voz y aplicaciones en tiempo real, 150 ms menos de latencia se traducen en conversaciones más naturales, mayor capacidad de respuesta y una experiencia uniforme para usuarios, independientemente de su ubicación. Combinado con la velocidad de inferencia de Flash v2.5, este es el Texto a Voz para agentes más rápido disponible.
Empieza ahora
No necesitas realizar ninguna migración. Si llamas a api.elevenlabs.io, el enrutamiento global ya está activo.
Para desactivar el enrutamiento global y usar siempre servidores de EE. UU., utiliza la URL base api.us.elevenlabs.io para tus solicitudes a la API.
Consulta nuestra guía de optimización de la latencia para conocer más prácticas recomendadas. Clientes Enterprise que necesiten residencia regional de datos pueden contactar con ventas.



