API Text to Speech : jusqu’à 40 % plus rapide dans le monde
- Rédigé par
- Joe Reeve
- Publié
ÉcouterÉcouter cet article
Nous avons déployé la prise en charge multirégion pour notre API Text to Speech. Les requêtes sont désormais automatiquement acheminées vers le serveur le plus proche (États-Unis, Pays-Bas ou Singapour), pour un délai avant le premier octet (TTFB) réduit, sans modification du code.
Ce qui change
Lorsque vous appelez api.elevenlabs.io, notre infrastructure achemine votre requête vers le serveur optimal selon votre localisation :
- Amériques : États-Unis Centre
- Europe, Moyen-Orient, Afrique : Pays-Bas
- Asie-Pacifique : Singapour
Vous pouvez vérifier votre région de service grâce à l’en-tête x-region dans la réponse de l’API.
Performances
Grâce à des GPU améliorés et à une pile d’inférence optimisée, Flash v2.5 atteint un délai avant le premier octet du modèle de 50 ms. Les améliorations du routage réseau réduisent encore fortement la latence perçue.
Améliorations mesurées du TTFB dans 11 sites à travers le monde :
Pour la plupart des développeurs internationaux, cela représente une réduction de 20 à 40 % de la latence perçue.
Pourquoi c’est important
Pour les agents vocaux et les applications en temps réel, 150 ms de latence en moins permettent des conversations plus naturelles, une meilleure réactivité et une expérience cohérente pour les utilisateurs, où qu’ils se trouvent. Associée à la vitesse d’inférence de Flash v2.5, cette amélioration permet de proposer une solution Text to Speech agentique à très faible latence.
Premiers pas
Aucune migration n’est nécessaire. Si vous appelez api.elevenlabs.io, le routage global est déjà actif.
Pour désactiver le routage global et utiliser systématiquement les serveurs américains, utilisez l’URL de base api.us.elevenlabs.io pour vos requêtes API.
Consultez notre guide d’optimisation de la latence pour découvrir d’autres bonnes pratiques. Les entreprises nécessitant une résidence des données européenne peuvent contacter notre équipe commerciale.



