API de Text to Speech – até 40% mais rápida globalmente
- Escrito por
- Joe Reeve
- Publicado
OuvirOuça este artigo
Implementamos atendimento em várias regiões para nossa API de Text to Speech. Agora, as solicitações são encaminhadas automaticamente para o backend mais próximo (EUA, Países Baixos ou Singapura), proporcionando um tempo até o primeiro byte (TTFB) menor, sem precisar alterar o código.
O que mudou
Quando você chama api.elevenlabs.io, nossa infraestrutura direciona a solicitação ao backend ideal com base na sua localização:
- Américas: Centro dos EUA
- Europa, Oriente Médio e África: Países Baixos
- Ásia-Pacífico: Singapura
Você pode verificar a região de atendimento pelo cabeçalho x-region na resposta da API.
Desempenho
Com GPUs atualizadas e uma infraestrutura de inferência otimizada, o Flash v2.5 alcança 50 ms de tempo de modelo até o primeiro byte. Somado às melhorias no roteamento de rede, isso reduz significativamente a latência percebida.
Melhorias de TTFB medidas em 11 localidades globais:
Para a maioria dos desenvolvedores internacionais, isso representa uma redução de 20% a 40% na latência percebida.
Por que isso importa
Para agentes de voz e aplicações em tempo real, 150 ms a menos de latência significam conversas mais naturais, melhor capacidade de resposta e uma experiência consistente para os usuários, independentemente da localização. Combinado à velocidade de inferência do Flash v2.5, este é o Text to Speech para agentes mais rápido disponível.
Comece agora
Não é preciso fazer migração. Se você usa api.elevenlabs.io, o roteamento global já está ativo.
Para desativar o roteamento global e sempre usar servidores nos EUA, use a URL base api.us.elevenlabs.io nas suas solicitações de API.
Consulte nosso guia de otimização de latência para conhecer outras práticas recomendadas. Clientes Enterprise que precisam de residência regional de dados podem entrar em contato com vendas.



