Texto para Voz
- Voice Design: Lançado o novo Text to Voice Design com Eleven v3 para criar vozes personalizadas a partir de descrições em texto.
Speech to Text
- Diarização aprimorada: Adicionado o parâmetro
diarization_thresholdao endpoint de Speech to Text. Ajuste o equilíbrio entre a precisão dos falantes e o número total de falantes alterando o limite entre 0,1 e 0,4.
Clonagem de voz profissional
- Remoção de ruído de fundo: Adicionado
remove_background_noisepara limpar amostras de voz usando modelos de isolamento de áudio e obter dados de treinamento de melhor qualidade.
ElevenCreative Studio
- Detecção de suporte a vídeo: Adicionada a propriedade
has_videoàs respostas de capítulos para indicar se os capítulos contêm conteúdo em vídeo.
Workspaces
-
Grupos de contas de serviço: Agora é possível adicionar contas de serviço aos grupos do workspace para melhorar o gerenciamento de permissões e o controle de acesso.
-
Autenticação de workspace: Adicionado suporte a conexões de autenticação de workspace, permitindo integrações seguras de ferramentas de webhook com serviços externos.
SDKs
- SDK Python: Lançada a v2.6.0 com suporte à API mais recente e correções de bugs.
- SDK JavaScript: Lançada a v2.5.0 com suporte à API mais recente e correções de bugs.
- SDK React da Plataforma de Agentes: Adicionado suporte a WebRTC na 0.2.0
API
Ver alterações da API
Novos endpoints
- Adicionados 2 novos endpoints:
- Criar uma voz - Crie prévias de voz a partir de descrições em texto
- Criar voz a partir de prévia - Converta prévias de voz em vozes permanentes
Endpoints atualizados
Speech to Text
- Converter fala em texto - Adicionado o parâmetro
diarization_thresholdpara ajustar a separação de falantes
Gerenciamento de voz
- Obter áudio de amostra de voz - Adicionado o parâmetro de consulta
remove_background_noisee movido do corpo da solicitação para os parâmetros de consulta