Text to Speech

  • Suporte ao formato Opus: Adicionado suporte ao formato Opus com taxa de amostragem de 48 kHz em várias taxas de bits (32–192 kbps).
  • Melhor tratamento de erros de websocket: Atualizamos a API de websocket de TTS para retornar códigos de erro mais precisos (1011 para erros internos em vez de 1008), facilitando a identificação de erros e o monitoramento de SLA.

Plataforma de Agentes

  • Chamadas de saída com Twilio: Adicionada a capacidade de realizar chamadas de saída nativamente.
  • Substituição do webhook pós-chamada: Adicionada a capacidade de substituir as configurações do webhook pós-chamada no nível do agente, oferecendo configurações mais flexíveis.
  • Visualização de documentos grandes da base de conhecimento: Aprimoramos a interface da base de conhecimento para permitir a visualização de todo o conteúdo de documentos RAG grandes.
  • Adicionada variável dinâmica de SID da chamada: Adicionamos system__call_sid como uma variável dinâmica do sistema para permitir a referência ao ID da chamada em prompts e ferramentas.

ElevenCreative Studio

  • Modo Ator: Adicionado o Modo Ator no ElevenCreative Studio, permitindo usar suas próprias gravações de voz para direcionar como a fala deve soar em projetos do ElevenCreative Studio.
  • Atalhos de teclado aprimorados: Atualizamos os atalhos de teclado para visualizar configurações e os atalhos do editor para evitar conflitos, além de simplificar os atalhos para bloquear parágrafos.

Dublagem

  • Duplicação de dublagem: Disponibilizamos o recurso de duplicação de dublagem para todos os usuários.
  • Geração de primeiro plano no modo manual: Adicionada a capacidade de gerar áudio em primeiro plano ao usar o modo manual com um arquivo e CSV.

Vozes

  • Coleções de vozes aprimoradas: Melhoramos as coleções de vozes com atualizações visuais, filtragem por idioma, trilhas de navegação, imagens de coleções e arrastar com o mouse para navegar pelo carrossel.
  • Filtragem por localidade: Adicionado o parâmetro de localidade ao endpoint de vozes compartilhadas para uma filtragem de vozes mais precisa.

API

Endpoints atualizados

Text to Speech

Formato de áudio

Plataforma de Agentes

Vozes

  • Endpoints de Vozes atualizados:

Dublagem

  • Endpoint de Dublagem atualizado: