Speech to Text

  • scribe_v1_experimental: Lançamos uma nova prévia experimental do modelo Scribe v1, com melhorias que incluem melhor desempenho em arquivos de áudio com vários idiomas, menos alucinações quando o áudio é intercalado com silêncio e tags de áudio aprimoradas. O novo modelo está disponível pela API com o nome de modelo scribe_v1_experimental

Text to Speech

  • Suporte ao formato A-law: Adicionado o formato A-law com taxa de amostragem de 8 kHz para permitir a integração com sistemas de telefonia europeus.
  • Problemas de cota corrigidos: Corrigimos um bug no banco de dados que fazia algumas solicitações serem rejeitadas incorretamente por excederem a cota.

Plataforma de Agentes

  • Filtragem por tipo de documento: Adicionado suporte para filtrar documentos da base de conhecimento por tipo (arquivo, URL ou texto).
  • Agentes sem áudio: Adicionado suporte para agentes conversacionais que não geram áudio, mas ainda enviam transcrições de respostas e podem usar ferramentas. Agentes sem áudio podem ser ativados removendo o evento do cliente de áudio.
  • Modelos de agente aprimorados: Atualizamos todos os modelos de agente com configurações e prompts aprimorados. Saiba mais sobre como melhorar prompts de sistema aqui.
  • Exportações travadas corrigidas: Corrigimos um problema que fazia as exportações ficarem travadas por períodos prolongados.

ElevenCreative Studio

  • Normalização de volume corrigida: Corrigido um problema com snapshots de projetos transmitidos quando a normalização de volume está ativada.

Novos endpoints de API

  • Alinhamento forçado: Adicionado novo endpoint de alinhamento forçado para alinhar áudio com texto, ideal para gerar legendas.
  • Chamadas em lote: Adicionado endpoint de chamadas em lote para agendar chamadas para vários destinatários

API

Novos endpoints

Endpoints atualizados

Text to Speech

Vozes

  • Obter vozes - Adicionado o parâmetro collection_id para filtrar vozes por coleção

Base de conhecimento

  • Obter base de conhecimento - Adicionado o parâmetro types para filtrar documentos por tipo
  • Endpoint geral para criar documentos da base de conhecimento marcado como descontinuado em favor de endpoints especializados

Assinatura do usuário

  • Obter assinatura do usuário - Adicionada a propriedade professional_voice_slots_used para acompanhar o número de vozes profissionais usadas em um espaço de trabalho

Plataforma de Agentes

  • Adicionado o parâmetro silence_end_call_timeout para definir o tempo máximo de espera antes de encerrar uma chamada
  • Removido o endpoint /v1/convai/agents/{agent_id}/add-secret (agora gerenciado pelos endpoints de segredos do espaço de trabalho)