Pular para o conteúdo

API de Text to Speech

Geração de fala ultrarrealista e com baixa latência

Crie com TTS de alta qualidade e controlável para aplicações em tempo real e em lote. Modelos otimizados para latência, fidelidade e consistência em conteúdos longos.

Na antiga terra de Eldoria, onde os céus brilhavam e as florestas sussurravam segredos ao vento, vivia um dragão chamado Zephyros. [sarcastically] Não do tipo que “queima tudo... [giggles] mas ele era gentil, sábio, com olhos como estrelas antigas. [whispers] Até os pássaros ficavam em silêncio quando ele passava.
  • Lovable
  • Synthesia
  • Stripe
  • Perplexity
  • Twilio

Desenvolvido com os mais avançados modelos de voz IA

Escolha o modelo ideal para seu caso de uso: de agentes com latência ultrabaixa a narrações expressivas em formato longo.

Translate media step 5 background

Eleven v3

Nosso modelo mais expressivo e rico em emoções

  • Interpretação e performance dramáticas
  • Compatível com mais de 70 idiomas
  • Limite de 3.000 caracteres
  • Diálogo com vários interlocutores
  • ~US$ 0,10 por minuto
Blurred background

v3 Conversational

Nosso modelo mais expressivo para fala em tempo real.

  • Baixa latência (~280 ms)
  • Alta qualidade e interpretação expressiva
  • Compatível com mais de 70 idiomas
  • Tags de áudio personalizadas
  • ~US$ 0,05 por minuto
Scribe 1

Flash v2.5

Nosso modelo de síntese de fala com menor latência

  • Latência ultrabaixa (~75 ms)
  • Compatível com 32 idiomas
  • Limite de 40.000 caracteres
  • ~US$ 0,05 por minuto
Scribe background 4

Multilingual v2

Modelo de síntese de fala realista e com qualidade consistente

  • Resultado com som natural
  • Compatível com 29 idiomas
  • Limite de 10.000 caracteres
  • Desenvolvido para gerações de conteúdo longo
  • ~US$ 0,10 por minuto

Tudo o que você precisa para criar fala pronta para produção

Gere fala expressiva e controlável com modelos desenvolvidos para uso em tempo real, conteúdos longos e produção.

Controle a emoção e a interpretação

Crie falas expressivas e controláveis, com camadas de emoção, eventos de áudio e paisagens sonoras imersivas.
Control emotion and delivery

Acesse mais de 11.000 vozes

Explore uma coleção em constante crescimento de vozes expressivas e realistas para qualquer caso de uso.
10,000+ voices

Criação e clonagem de voz

Crie em mais de 30 idiomas com vozes naturais, sotaques expressivos e áudio localizado para seu público.
Voice design and cloning

Diálogo com vários interlocutores

Crie conversas naturais com vários interlocutores em mais de 70 idiomas, com vozes expressivas e controláveis.
Multi-speaker dialogue

Eventos de áudio e direção

Controle a interpretação com tags de áudio, indicações de tempo e direção narrativa integradas à fala.
Audio events and direction

Dicionários de pronúncia

Defina pronúncias personalizadas para garantir uma fala consistente e precisa para nomes e terminologias.
Pronunciation dictionary

Impulsionando as principais empresas e marcas do mundo

  • Da dublagem de Reels em idiomas locais à geração de música e vozes de personagens no Horizon, a plataforma da ElevenLabs permite que criadores, empresas e grandes organizações do mundo todo criem com voz, música e som em escala.
    Meta Color Logo
  • Milhões de pessoas aprendem xadrez todos os dias com criadores como Hikaru, Levy e Magnus no YouTube e na Twitch. Agora, você pode aprender com eles dentro do Chess.com de uma forma imersiva, pessoal e cheia de personalidade. Nossa missão é criar um treinador de xadrez que ensine no nível certo, acolha jogadores de todos os níveis e desmistifique o xadrez sem deixar de ser divertido e cheio de personalidade. Com a ElevenLabs e essas novas vozes incríveis, demos um grande passo para tornar essa visão realidade.
    Chess.com logo
  • A ElevenLabs facilitou a rápida incorporação de recursos avançados de conversão de texto em fala ao nosso SDK, permitindo que os Agents respondam em tempo real, com vozes expressivas, às perguntas dos usuários ou forneçam feedback sobre o que estão vendo.
    Stream Color Logo
  • A Twilio integrou a tecnologia de voz com IA generativa da ElevenLabs à sua CPaaS, aprimorando o ConversationRelay. Essa integração permite que empresas e desenvolvedores criem interações de voz com IA conversacional que soam humanas, são expressivas e respondem em tempo real diretamente pela plataforma CPaaS da Twilio. Na ElevenLabs, estamos animados que a Twilio tenha escolhido a ElevenLabs para aprimorar o ConversationRelay com as vozes mais expressivas e naturais disponíveis.
    Twilio logo

APIs prontas para produção

Enterprise data protection developers

Os dados são criptografados em trânsito e em repouso, com suporte à conformidade com SOC 2, HIPAA e LGPD. Os modos de residência de dados na UE e retenção zero estão disponíveis para um controle de dados mais rigoroso.

Os dados são criptografados em trânsito e em repouso, com suporte à conformidade com SOC 2, HIPAA e LGPD. Os modos de residência de dados na UE e retenção zero estão disponíveis para um controle de dados mais rigoroso.

SDKs

SDKs oficiais para Python e TypeScript com segurança de tipos, suporte a streaming e exemplos claros.

Nossa equipe garante um lançamento tranquilo e mantém suas operações funcionando com confiabilidade, entregando desempenho consistente e tranquilidade.

Perguntas frequentes

A plataforma de áudio com IA mais realista