Text to Speech API – weltweit bis zu 40 % schneller
- Verfasst von
- Joe Reeve
- Veröffentlicht
AnhörenArtikel anhören
Wir haben Multi-Region-Serving für unsere Text to Speech API eingeführt. Anfragen werden nun automatisch an das nächstgelegene Backend (USA, Niederlande oder Singapur) geleitet. Das ermöglicht eine schnellere Time to First Byte (TTFB) – ohne erforderliche Codeänderungen.
Was sich geändert hat
Wenn Sie api.elevenlabs.io aufrufen, leitet unsere Infrastruktur Sie abhängig von Ihrem Standort an das optimale Backend weiter:
- Amerika: USA-Zentral
- Europa, Naher Osten, Afrika: Niederlande
- Asien-Pazifik: Singapur
Ihre Serving-Region können Sie über den x-region-Header in der API-Antwort prüfen.
Leistung
Mit aufgerüsteten GPUs und einem optimierten Inference-Stack erreicht Flash v2.5 eine Model Time to First Byte von 50 ms. Verbesserungen beim Netzwerk-Routing reduzieren die wahrgenommene Latenz zusätzlich deutlich.
Gemessene TTFB-Verbesserungen an 11 Standorten weltweit:
Für die meisten internationalen Entwickler bedeutet das eine Reduzierung der wahrgenommenen Latenz um 20–40 %.
Warum das wichtig ist
Für Sprachagenten und Echtzeitanwendungen bedeuten 150 ms weniger Latenz natürlichere Gespräche, schnellere Reaktionen und ein konsistentes Erlebnis für Nutzer – unabhängig von ihrem Standort. Kombiniert mit der Inference-Geschwindigkeit von Flash v2.5 ist dies das schnellste verfügbare agentische Text to Speech.
Erste Schritte
Keine Migration erforderlich. Wenn Sie api.elevenlabs.io aufrufen, ist globales Routing bereits aktiv.
Um globales Routing zu deaktivieren und stets Server in den USA zu verwenden, nutzen Sie api.us.elevenlabs.io als Basis-URL für Ihre API-Anfragen.
Weitere Best Practices finden Sie in unserem Leitfaden zur Latenzoptimierung. Enterprise-Kunden, die regionale Datenresidenz benötigen, können sich an den Vertrieb wenden.



