Vozes
- Listar Vozes V2: Adicionamos um novo endpoint de busca de vozes V2, com busca melhor e opções adicionais de filtragem
Plataforma de Agentes
- Chamadas de saída nativas: Adicionamos chamadas de saída nativas para números configurados com Twilio, eliminando a necessidade de configurações complexas. As chamadas de saída agora estão visíveis na página Histórico de chamadas.
- Detecção automática de idioma: Adicionamos uma nova ferramenta de sistema para detecção automática de idioma que permite que os agentes alternem de idioma com base em solicitações explícitas do usuário (“Vamos falar em espanhol”) e no idioma implícito no áudio do usuário.
- Melhorias no dicionário de pronúncia: Corrigimos as tags de fonemas nos dicionários de pronúncia para que funcionem corretamente com a Plataforma de Agentes.
- Visualização de documentos RAG grandes: Adicionamos a opção de visualizar todo o conteúdo de documentos RAG grandes na base de conhecimento.
- Controles de widget personalizáveis: Atualizamos a interface para incluir um botão opcional de silenciar o microfone e tornamos os ícones do widget personalizáveis por slots.
Efeitos Sonoros
- Suporte a duração fracionária: Corrigimos um problema que impedia os usuários de inserir valores fracionários, como 0,5 segundo, para a duração da geração de efeitos sonoros.
Speech to Text
- Tratamento de repetições: Melhoramos a detecção e o tratamento de repetições no processamento de fala para texto.
ElevenCreative Studio
- Correções na publicação para o Reader: Adicionamos suporte ao formato de saída mp3_44100_192 (alta qualidade) para que usuários abaixo do plano Publisher possam exportar áudio para o Reader.
Mobile
- Cadastro no app Core: Adicionamos endpoints de cadastro para o novo app móvel Core.
API
Ver alterações na API
Novos endpoints
- Adicionados 5 novos endpoints:
- Listar vozes (v2) - Recursos aprimorados de busca de voz com opções adicionais de filtragem
- Iniciar chamada de saída - Novo endpoint para fazer chamadas de saída pela integração com Twilio
- Adicionar dicionário de pronúncia a partir de regras - Crie dicionários de pronúncia diretamente a partir de regras, sem enviar arquivos
- Obter conteúdo de documento da base de conhecimento - Recupere o conteúdo completo de documentos da base de conhecimento
- Obter trecho de documento da base de conhecimento - Recupere trechos específicos de documentos da base de conhecimento
Endpoints atualizados
Plataforma de Agentes
- Atualizamos endpoints da Plataforma de Agentes:
- Criar agente - Adicionamos a propriedade
mic_muting_enabledpara controle da interface e a propriedadeworkspace_overridespara configurações específicas do workspace - Atualizar agente - Adicionamos a propriedade
workspace_overridespara personalizar o comportamento do agente por workspace - Obter agente - Adicionamos a propriedade
workspace_overridesà resposta - Obter widget - Adicionamos a propriedade
mic_muting_enabledpara controlar o silenciamento do microfone na interface do widget - Obter conversa - Adicionamos informações de RAG para visualizar o conteúdo da base de conhecimento usado durante as conversas
- Criar número de telefone - Substituímos a estrutura genérica por opções específicas de número de telefone Twilio e tronco SIP
- Calcular índice RAG - Removemos o parâmetro de consulta
force_reindexpara um controle maior da indexação - Listar documentos da base de conhecimento - Alteramos a estrutura de resposta para oferecer suporte a diferentes tipos de documento
- Obter documento da base de conhecimento - Modificamos para retornar diferentes modelos de resposta com base no tipo de documento
- Criar agente - Adicionamos a propriedade
Text to Speech
- Atualizamos endpoints de Text to Speech:
- Converter texto em fala - Tornamos propriedades opcionais, incluindo as configurações
stabilityesimilarity - Transmitir texto em fala - Tornamos as propriedades das configurações de voz opcionais para solicitações de streaming mais flexíveis
- Converter com timestamps - Tornamos as configurações opcionais e modificamos a propriedade
pronunciation_dictionary_locators - Transmitir com timestamps - Tornamos as propriedades das configurações de voz opcionais para solicitações mais flexíveis
- Converter texto em fala - Tornamos propriedades opcionais, incluindo as configurações
Speech to Text
- Atualizamos o endpoint de Speech to Text:
- Converter fala em texto - Removemos a propriedade
biased_keywordsdos dados do formulário e melhoramos o algoritmo interno de detecção de repetições
- Converter fala em texto - Removemos a propriedade
Gerenciamento de vozes
- Atualizamos endpoints de voz:
- Obter vozes - Atualizamos as propriedades de configurações de voz na resposta
- Obter configurações de voz padrão - Tornamos as propriedades
stabilityesimilarityopcionais - Obter configurações de voz - Tornamos as propriedades numéricas opcionais para uma configuração mais flexível
- Editar configurações de voz - Tornamos as configurações
stabilityesimilarityopcionais - Criar voz - Modificamos as propriedades de array para aceitar valores nulos
- Criar voz a partir de prévia - Atualizamos o modelo de configurações de voz com propriedades opcionais
ElevenCreative Studio
- Atualizamos endpoints do ElevenCreative Studio:
- Obter projeto - Adicionamos
version_rules_numaos metadados do projeto - Obter snapshot de projeto - Removemos a propriedade
status - Criar dicionários de pronúncia - Modificamos a propriedade
pronunciation_dictionary_locatorse as propriedades de string para aceitar valores nulos
- Obter projeto - Adicionamos
Dicionário de pronúncia
- Atualizamos endpoints de Dicionário de pronúncia:
- Obter todos os dicionários de pronúncia - Adicionamos os parâmetros de consulta
sortesort_direction, além das propriedadeslatest_version_rules_numeintegerà resposta - Obter dicionário de pronúncia - Adicionamos as propriedades
latest_version_rules_numeintegerà resposta - Adicionar a partir de arquivo - Adicionamos a propriedade
version_rules_numà resposta para acompanhar a quantidade de regras - Adicionar regras - Adicionamos
version_rules_numà resposta para acompanhar as regras - Remover regras - Adicionamos
version_rules_numà resposta para acompanhar as regras
- Obter todos os dicionários de pronúncia - Adicionamos os parâmetros de consulta