ElevenAgents

  • Novas opções de configuração do widget: Várias configurações novas já estão disponíveis para o widget de conversação do ElevenAgents no painel do agente:

    • Widget recolhível (widget.dismissible): Permite que os usuários minimizem ou fechem o widget durante uma conversa.
    • Indicador de ação (widget.show_agent_status): Exibe um indicador visual quando o agente está usando ferramentas ativamente, com estados distintos para em andamento, concluído e erro. Ativar essa configuração adiciona automaticamente agent_tool_request e agent_tool_response aos eventos de cliente do agente.
    • Exibição do ID da conversa (widget.show_conversation_id): Mostra o ID da conversa aos usuários após o fim de uma chamada. O padrão é true para agentes novos e existentes.
    • Visibilidade de tags de áudio (widget.strip_audio_tags): Oculta tags de áudio das transcrições de conversas. O padrão é true para agentes novos e existentes.
    • Tema de destaque de sintaxe (widget.syntax_highlight_theme): Configura o destaque de blocos de código nas transcrições. Aceita null (Automático), light ou dark.
  • Testes de agentes com reconhecimento de pastas: O endpoint Listar testes de agentes agora permite organizar testes em pastas. Adicionados os parâmetros de consulta parent_folder_id, include_folders e sort_mode para listagens filtradas. Os endpoints de criação e atualização de testes aceitam parent_folder_id para atribuir testes a pastas, e os resumos de testes agora incluem o tipo de entidade, o caminho da pasta pai e a contagem de itens filhos.

  • **Nó say de workflow **: Adicionado um novo tipo de nó say aos workflows de agentes (WorkflowSayNodeModel). Esse nó oferece suporte a substituições de conversation_config, additional_prompt, ferramentas e base de conhecimento. A carga da mensagem do nó usa uma união discriminada com duas variantes: literal (texto estático via text) e prompt (gerado por LLM via prompt).

  • Configuração da ferramenta SMB: Formalizado o esquema SMBToolConfig com um objeto params discriminado e obrigatório. Os tipos de operação compatíveis são create, list, search, update e delete, cada um aplicável a categorias de entidades SMB, incluindo clientes, equipe, serviços, produtos e ativos.

  • Idioma do resumo para agentes: Adicionado o campo summary_language à configuração do agente para especificar o idioma dos resumos pós-conversa.

  • Gravação de chamadas do Twilio: Adicionado o campo opcional call_recording_enabled ao corpo da solicitação de chamada de saída do Twilio para habilitar a gravação de chamadas de saída.

  • Sinalizador de mensagens do WhatsApp: Adicionado o sinalizador enable_messaging aos modelos de conta do WhatsApp e às solicitações de atualização para controlar se as mensagens estão habilitadas para determinado número de telefone.

Dicionários de pronúncia

  • Definir todas as regras de uma vez: O novo endpoint Definir regras (POST /v1/pronunciation-dictionaries/{pronunciation_dictionary_id}/set-rules) substitui todas as regras existentes em um dicionário de pronúncia em uma única chamada, como alternativa a adicionar ou remover regras individuais gradualmente.

  • Opções de correspondência de regras: Adicionados os campos case_sensitive (booleano) e word_boundaries (booleano) às definições de regras do dicionário de pronúncia para um controle mais preciso de como as regras correspondem ao texto.

Música

  • Enviar áudio: O novo endpoint Enviar música (POST /v1/music/upload) aceita uma solicitação multipart/form-data com um arquivo de áudio. Opcionalmente, extrai um plano de composição do áudio enviado e retorna um MusicUploadResponse com um song_id.

  • Suporte a nomes fonéticos: Adicionado o parâmetro use_phonetic_names aos endpoints Gerar música, Gerar música detalhada e Transmitir música.

  • ID da música nas respostas: As respostas de geração de música agora exibem o campo song_id, facilitando a referência a músicas geradas em chamadas de API posteriores.

Audio Native

  • Atualizar conteúdo do projeto a partir de URL: O novo endpoint Atualizar conteúdo (POST /v1/audio-native/content) permite atualizar um projeto AudioNative fornecendo uma URL. O endpoint extrai o conteúdo da URL e o coloca na fila para conversão e publicação automática.

Vozes

  • Favoritar vozes: Adicionado o campo bookmarked às solicitações de atualização de voz e is_bookmarked aos objetos de resposta de voz, permitindo que os usuários favoritem vozes para acessá-las facilmente.

Lançamentos de SDK

SDK JavaScript

  • v2.37.0 - Adicionado suporte para exibir song_id nas respostas de geração de música. Atualizado para incluir as alterações mais recentes do esquema da API geradas pelo Fern.

SDK Python

  • v2.37.0 - Adicionado suporte aos novos parâmetros de geração de música e para exibir song_id nas respostas de geração de música. Atualizado para incluir as alterações mais recentes do esquema da API geradas pelo Fern.

Pacotes

  • @elevenlabs/convai-widget-core@0.10.0 - Propagado event_id pelos callbacks de transcrição e streaming. Refatorado o acompanhamento de status de ferramentas, de uma estrutura baseada em Map para entradas de transcrição em linha com um utilitário display-transcript. Adicionada a opção de configuração show-conversation-id (booleano, padrão true) para controlar a visibilidade do ID da conversa em mensagens de desconexão.
  • @elevenlabs/convai-widget-embed@0.10.0 - Propagado event_id pelos callbacks de transcrição e streaming. Refatorado o acompanhamento de status de ferramentas para entradas de transcrição em linha.
  • @elevenlabs/types@0.6.0 - Propagado event_id pelos callbacks de transcrição e streaming.

API

Novos endpoints

  • Definir regras do dicionário de pronúncia - POST /v1/pronunciation-dictionaries/{pronunciation_dictionary_id}/set-rules - Substitui todas as regras de um dicionário de pronúncia em uma única chamada
  • Enviar música - POST /v1/music/upload - Envia um arquivo de áudio para criar ou referenciar uma música, com extração opcional de um plano de composição
  • Atualizar conteúdo do Audio Native a partir de URL - POST /v1/audio-native/content - Atualiza um projeto AudioNative extraindo conteúdo de uma URL fornecida e colocando-o na fila para conversão

Endpoints atualizados

ElevenAgents

  • Listar testes de agentes

    • Adicionado o parâmetro de consulta parent_folder_id (string, opcional) para filtrar testes por pasta
    • Adicionado o parâmetro de consulta include_folders (booleano, opcional) para incluir objetos de pasta nos resultados
    • Adicionado o parâmetro de consulta sort_mode (string, opcional) para controlar a ordenação dos resultados
    • A resposta agora inclui metadados de pasta: tipo de entidade, caminho pai e contagem de itens filhos em UnitTestSummaryResponseModel
  • Criar teste de agente, Atualizar teste de agente

    • Adicionado o campo parent_folder_id (string, opcional) para atribuir um teste a uma pasta
  • Criar agente, Atualizar agente, Obter agente

    • Adicionado o campo summary_language (string, opcional) à configuração do agente para o idioma do resumo pós-conversa
    • Adicionado widget.dismissible (booleano) - permite que os usuários recolham ou fechem o widget
    • Adicionado widget.show_agent_status (booleano) - exibe o indicador de status de uso de ferramentas no widget
    • Adicionado widget.show_conversation_id (booleano) - mostra o ID da conversa após o fim da chamada; o padrão é true
    • Adicionado widget.strip_audio_tags (booleano) - oculta tags de áudio das transcrições; o padrão é true
    • Adicionado widget.syntax_highlight_theme (string, anulável) - tema de destaque de blocos de código (null, light ou dark)
    • Adicionado o novo tipo de nó de workflow say com o esquema WorkflowSayNodeModel, incluindo substituições de conversation_config, additional_prompt, ferramentas/base de conhecimento; a carga da mensagem oferece suporte às variantes discriminadas literal e prompt
  • Chamada de saída do Twilio

    • Adicionado o campo call_recording_enabled (booleano, opcional) para habilitar a gravação de chamadas de saída do Twilio
  • Atualizar conta do WhatsApp

    • Adicionado o campo enable_messaging (booleano, opcional) para habilitar ou desabilitar mensagens para a conta
  • Atualizar webhook

    • Adicionado o campo schema_overrides (objeto, opcional) para personalizar o esquema da carga do webhook

Dicionários de pronúncia

Música

Vozes

Alterações de esquema

Novos esquemas

  • WorkflowSayNodeModel - Nó de workflow para operações say de agentes com configuração de conversa, prompts e substituições de ferramentas
  • WorkflowSayNodeMessageLiteral - Carga de mensagem literal (texto estático) para nós say
  • WorkflowSayNodeMessagePrompt - Carga de mensagem baseada em prompt (gerada por LLM) para nós say
  • MusicUploadResponse - Modelo de resposta para envio de música, incluindo song_id
  • SMBToolConfigCreateClientParams, SMBToolConfigListClientsParams, SMBToolConfigSearchClientsParams, SMBToolConfigUpdateClientParams, SMBToolConfigDeleteClientParams - Tipos de parâmetros discriminados para operações da ferramenta SMB

Esquemas modificados

  • AgentConfig - Adicionado o campo summary_language
  • WidgetConfigV2 - Adicionados os campos dismissible, show_agent_status, show_conversation_id, strip_audio_tags e syntax_highlight_theme
  • SMBToolConfig - O campo params agora é obrigatório e usa uma união discriminada
  • PronunciationDictionaryRule - Adicionados os campos case_sensitive e word_boundaries
  • CustomGuardrailConfig - O campo model agora é opcional, com um valor padrão
  • UnitTestSummaryResponseModel - Adicionados campos de metadados de pasta: tipo de entidade, caminho pai e contagem de itens filhos