Text to Speech API — nawet o 40% szybciej na całym świecie
- Autor
- Joe Reeve
- Opublikowano
PosłuchajPosłuchaj tego artykułu
Wprowadziliśmy obsługę wielu regionów dla naszego Text to Speech API. Żądania są teraz automatycznie kierowane do najbliższego backendu (USA, Niderlandy lub Singapur), co skraca czas do pierwszego bajtu (TTFB) bez zmian w kodzie.
Co się zmieniło
Gdy wywołujesz api.elevenlabs.io, nasza infrastruktura kieruje żądanie do optymalnego backendu zależnie od twojej lokalizacji:
- Ameryki: USA-Central
- Europa, Bliski Wschód, Afryka: Niderlandy
- Azja i Pacyfik: Singapur
Region obsługujący żądanie sprawdzisz w nagłówku x-region w odpowiedzi API.
Wydajność
Dzięki wydajniejszym GPU i zoptymalizowanemu stosowi inferencji Flash v2.5 osiąga 50 ms czasu modelu do pierwszego bajtu. Ulepszone trasowanie sieciowe dodatkowo znacznie skraca odczuwalne opóźnienia.
Zmierzona poprawa TTFB w 11 lokalizacjach na świecie:
Dla większości deweloperów spoza USA oznacza to o 20–40% mniejsze odczuwalne opóźnienia.
Dlaczego to ważne
Dla agentów głosowych i aplikacji czasu rzeczywistego 150 ms mniej opóźnienia oznacza bardziej naturalne rozmowy, szybsze reakcje i spójne doświadczenie użytkowników niezależnie od lokalizacji. W połączeniu z szybkością inferencji Flash v2.5 to najszybsza dostępna agentowa zamiana tekstu na mowę.
Zacznij
Nie musisz nic migrować. Jeśli wywołujesz api.elevenlabs.io, globalne trasowanie jest już aktywne.
Aby zrezygnować z globalnego trasowania i zawsze korzystać z serwerów w USA, użyj bazowego adresu URL api.us.elevenlabs.io w żądaniach API.
Więcej wskazówek znajdziesz w naszym przewodniku po optymalizacji opóźnień. Klienci Enterprise, którzy potrzebują regionalnego przechowywania danych, mogą skontaktować się z działem sprzedaży.



