Apresentamos o Eleven v4Conheça o Eleven v4, nosso modelo mais expressivo até agora. Com 3x mais créditos incluídos no Creator+ até 12 de outubro

Pular para o conteúdo

API de Text to Speech – até 40% mais rápida globalmente

Escrito por
Joe Reeve
Publicado

OuvirOuça este artigo

Implementamos atendimento em várias regiões para nossa API de Text to Speech. Agora, as solicitações são encaminhadas automaticamente para o backend mais próximo (EUA, Países Baixos ou Singapura), proporcionando um tempo até o primeiro byte (TTFB) menor, sem precisar alterar o código.

O que mudou

Quando você chama api.elevenlabs.io, nossa infraestrutura direciona a solicitação ao backend ideal com base na sua localização:

  • Américas: Centro dos EUA
  • Europa, Oriente Médio e África: Países Baixos
  • Ásia-Pacífico: Singapura

Você pode verificar a região de atendimento pelo cabeçalho x-region na resposta da API.

Desempenho

Com GPUs atualizadas e uma infraestrutura de inferência otimizada, o Flash v2.5 alcança 50 ms de tempo de modelo até o primeiro byte. Somado às melhorias no roteamento de rede, isso reduz significativamente a latência percebida.

Melhorias de TTFB medidas em 11 localidades globais:

Redução de TTFB
Europa
~100–150 ms
Sudeste Asiático
~150–200 ms
Índia
~100–150 ms
Japão
~50–80 ms
Austrália
~80–120 ms

Para a maioria dos desenvolvedores internacionais, isso representa uma redução de 20% a 40% na latência percebida.

Por que isso importa

Para agentes de voz e aplicações em tempo real, 150 ms a menos de latência significam conversas mais naturais, melhor capacidade de resposta e uma experiência consistente para os usuários, independentemente da localização. Combinado à velocidade de inferência do Flash v2.5, este é o Text to Speech para agentes mais rápido disponível.

Comece agora

Não é preciso fazer migração. Se você usa api.elevenlabs.io, o roteamento global já está ativo.

Para desativar o roteamento global e sempre usar servidores nos EUA, use a URL base api.us.elevenlabs.io nas suas solicitações de API.

Consulte nosso guia de otimização de latência para conhecer outras práticas recomendadas. Clientes Enterprise que precisam de residência regional de dados podem entrar em contato com vendas.


Artigos relacionados

Crie com o áudio de IA da mais alta qualidade