Texto para Voz

  • Voice Design: Lançado o novo Text to Voice Design com Eleven v3 para criar vozes personalizadas a partir de descrições em texto.

Speech to Text

  • Diarização aprimorada: Adicionado o parâmetro diarization_threshold ao endpoint de Speech to Text. Ajuste o equilíbrio entre a precisão dos falantes e o número total de falantes alterando o limite entre 0,1 e 0,4.

Clonagem de voz profissional

ElevenCreative Studio

Workspaces

  • Grupos de contas de serviço: Agora é possível adicionar contas de serviço aos grupos do workspace para melhorar o gerenciamento de permissões e o controle de acesso.

  • Autenticação de workspace: Adicionado suporte a conexões de autenticação de workspace, permitindo integrações seguras de ferramentas de webhook com serviços externos.

SDKs

  • SDK Python: Lançada a v2.6.0 com suporte à API mais recente e correções de bugs.
  • SDK JavaScript: Lançada a v2.5.0 com suporte à API mais recente e correções de bugs.
  • SDK React da Plataforma de Agentes: Adicionado suporte a WebRTC na 0.2.0

API

Novos endpoints

Endpoints atualizados

Speech to Text

Gerenciamento de voz

  • Obter áudio de amostra de voz - Adicionado o parâmetro de consulta remove_background_noise e movido do corpo da solicitação para os parâmetros de consulta