Poznaj Eleven v4Poznaj Eleven v4, nasz najbardziej emocjonalny model. 3× więcej kredytów w planie Creator+ do 12 października

Przejdź do treści

Text to Speech API — nawet o 40% szybciej na całym świecie

Opublikowano

PosłuchajPosłuchaj tego artykułu

Wprowadziliśmy obsługę wielu regionów dla naszego Text to Speech API. Żądania są teraz automatycznie kierowane do najbliższego backendu (USA, Niderlandy lub Singapur), co skraca czas do pierwszego bajtu (TTFB) bez zmian w kodzie.

Co się zmieniło

Gdy wywołujesz api.elevenlabs.io, nasza infrastruktura kieruje żądanie do optymalnego backendu zależnie od twojej lokalizacji:

  • Ameryki: USA-Central
  • Europa, Bliski Wschód, Afryka: Niderlandy
  • Azja i Pacyfik: Singapur

Region obsługujący żądanie sprawdzisz w nagłówku x-region w odpowiedzi API.

Wydajność

Dzięki wydajniejszym GPU i zoptymalizowanemu stosowi inferencji Flash v2.5 osiąga 50 ms czasu modelu do pierwszego bajtu. Ulepszone trasowanie sieciowe dodatkowo znacznie skraca odczuwalne opóźnienia.

Zmierzona poprawa TTFB w 11 lokalizacjach na świecie:

Skrócenie TTFB
Europa
~100–150 ms
Azja Południowo-Wschodnia
~150–200 ms
Indie
~100–150 ms
Japonia
~50–80 ms
Australia
~80–120 ms

Dla większości deweloperów spoza USA oznacza to o 20–40% mniejsze odczuwalne opóźnienia.

Dlaczego to ważne

Dla agentów głosowych i aplikacji czasu rzeczywistego 150 ms mniej opóźnienia oznacza bardziej naturalne rozmowy, szybsze reakcje i spójne doświadczenie użytkowników niezależnie od lokalizacji. W połączeniu z szybkością inferencji Flash v2.5 to najszybsza dostępna agentowa zamiana tekstu na mowę.

Zacznij

Nie musisz nic migrować. Jeśli wywołujesz api.elevenlabs.io, globalne trasowanie jest już aktywne.

Aby zrezygnować z globalnego trasowania i zawsze korzystać z serwerów w USA, użyj bazowego adresu URL api.us.elevenlabs.io w żądaniach API.

Więcej wskazówek znajdziesz w naszym przewodniku po optymalizacji opóźnień. Klienci Enterprise, którzy potrzebują regionalnego przechowywania danych, mogą skontaktować się z działem sprzedaży.


Podobne artykuły

Twórz z najwyższej jakości audio AI