Música

  • API de Music Finetunes: Adicionado suporte de API para gerenciar Music Finetunes. Cinco endpoints permitem criar um Finetune a partir de áudio enviado, listar os Finetunes acessíveis, consultar o status de treinamento, atualizar metadados e visibilidade ou excluir um Finetune. Todos os métodos de SDK de geração de música agora expõem finetune_id.

ElevenAgents

  • Resolver referências externas de conversas: Adicionado GET /v1/convai/conversations/resolve para resolver uma URL de mensagem do Slack ou uma URL de ticket do Zendesk para uma conversa. As solicitações exigem os parâmetros de consulta agent_id e reference (strings).
  • Consultar bases de conhecimento de agentes: Adicionado POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query para consultas RAG somente leitura na base de conhecimento de um agente. A solicitação exige query (string), aceita branch_id (string) opcional e retorna blocos classificados com metadados de documento, bloco, texto e distância vetorial. Este endpoint é excluído dos SDKs gerados.
  • Formatos de conteúdo da base de conhecimento: As respostas de arquivo, texto e URL da base de conhecimento adicionam content_format (html | markdown, padrão html) opcional.
  • Configuração de voz do agente: Os esquemas de substituição de TTS adicionam model_id (TTSConversationalModel) opcional que pode ser substituído pelo cliente. O padrão de enable_phoneme_tags muda de false para true.
  • Cascata de LLM de backup mais rápida: O padrão de cascade_timeout_seconds muda de 8 para 4 segundos. O intervalo permitido continua de 2 a 15 segundos.
  • Fontes de valores de parâmetros de ferramenta: Os parâmetros de ferramenta do tipo objeto agora podem usar dynamic_variable, constant_value ou is_omitted, correspondendo aos controles existentes de escalares e arrays. As substituições de esquema constante agora aceitam arrays e objetos arbitrários.
  • Guardrails de resposta completa: Guardrails personalizados adicionam evaluate_full_response_only (booleano, padrão false) opcional para avaliar uma vez a resposta completa sem TTS. Essa opção exige o modo de bloqueio.
  • Gravação de chamadas do Twilio: A configuração de chamadas de telefonia adiciona twilio_call_recording_enabled (booleano, padrão false) opcional. As gravações são armazenadas na conta Twilio conectada, e a configuração é ignorada por outros provedores.
  • Texto de upload de arquivos do widget: A configuração de texto do widget adiciona rótulos e mensagens de erro opcionais para anexar e remover arquivos, falhas de upload, tipos não compatíveis, arquivos grandes demais, limites de quantidade de arquivos e o indicador de digitação.
  • Status de sincronização da base de conhecimento: As respostas de arquivo da base de conhecimento adicionam auto_sync_info e refresh_status (FileRefreshStatus) opcionais. As respostas de pasta adicionam document_count (inteiro) obrigatório, uma contagem recursiva de documentos que não são pastas, limitada a 1000.
  • Filtros de busca textual de conversas: Buscar mensagens de conversa por texto adiciona os parâmetros de consulta de array exclude_statuses e termination_reasons opcionais.
  • Opções de LLM: A configuração de LLM do agente adiciona gpt-5.6-sol, gpt-5.6-terra e gpt-5.6-luna. LLMReasoningEffort adiciona max.
  • Indicadores de digitação do WhatsApp: Os esquemas de solicitação e resposta da conta do WhatsApp adicionam enable_typing_indicator (booleano) opcional.

Speech to Text

  • Autenticação em lote de uso único: Converter fala em texto adiciona token (string) opcional como alternativa à autenticação por chave de API ou bearer. Crie o token de uso único com POST /v1/single-use-token/batch_scribe; ele expira após 15 minutos.
  • Confiabilidade do cliente em tempo real: @elevenlabs/client agora informa erros de configuração do microfone e erros de servidor malformados por meio de RealtimeEvents.ERROR, libera recursos do microfone após falhas de configuração e encerramento de conexão, e descarta frames de microfone tardios após o encerramento do socket.

Text to Speech

Espaços de trabalho

  • Assinaturas de eventos de webhook: As solicitações de Atualizar webhook do espaço de trabalho adicionam events (WorkspaceWebhookEventType[]) opcional com voice_library_removal_notice, speech_to_text e agent_qa. As respostas de webhook podem retornar a lista de eventos assinados.
  • Dimensões de análise de uso: Obter uso do espaço de trabalho adiciona surface e actor aos valores de group_by.
  • Limpar limites de conta de serviço: Atualizar chave de API da conta de serviço aceita character_limit: "clear" para remover um limite mensal de caracteres, além de "no_update" e valores inteiros.
  • Referências de webhook de alertas: Os esquemas de notificador de webhook de alertas agora identificam um webhook do espaço de trabalho com webhook_id (string) obrigatório, em vez de incorporar url, method e headers.

Lançamentos de SDK

SDK JavaScript

  • v2.59.0 - Adicionados métodos music.finetunes para listar, criar, obter, atualizar e excluir Music Finetunes. Também foram adicionadas resolução de referência de conversa, filtragem de dicionários de pronúncia arquivados e tokens de Speech to Text de uso único.

SDK Python

  • v2.59.0 - Adicionados Music Finetunes e resolução de referências de conversa a partir do esquema de API mais recente. OnPremInitiationData também adiciona configurações tipadas de post_call_transcription_webhook e post_call_audio_webhook com hmac_secret opcional para webhooks pós-chamada assinados.

Pacotes

SDK Android

  • v0.11.1 - Impediu que R8 e ProGuard ofuscassem campos de eventos WebSocket e WebRTC enviados, como text e type.

CLI

  • @elevenlabs/cli@0.5.6 - Modelos de agente padrão atualizados para usar scribe_realtime em vez do provedor ASR elevenlabs removido. Os modelos mínimos continuam usando o padrão do servidor.

API

Novos endpoints

Música

  • Listar Music Finetunes - GET /v1/music/finetunes
    • Compatível com paginação por cursor, filtros de visibilidade e criador, e ordenação por hora de criação ou nome
  • Criar Music Finetune - POST /v1/music/finetunes
    • Exige name e primary_genre
    • Aceita até 50 arquivos de áudio, tags, visibilidade e model_id
  • Obter Music Finetune - GET /v1/music/finetunes/{finetune_id}
  • Atualizar Music Finetune - PATCH /v1/music/finetunes/{finetune_id}
    • Atualiza name, tags, primary_genre ou visibility
  • Excluir Music Finetune - DELETE /v1/music/finetunes/{finetune_id}

ElevenAgents

  • GET /v1/convai/conversations/resolve
    • Exige os parâmetros de consulta agent_id (string) e reference (string)
    • Retorna GetConversationResponseModel
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • Exige query (string) no corpo da solicitação
    • Aceita o parâmetro de consulta branch_id (string) opcional
    • Retorna AgentKnowledgeBaseRagQueryResponseModel
    • Excluído dos SDKs gerados

Endpoints atualizados

ElevenAgents

Speech to Text

  • Converter fala em texto - POST /v1/speech-to-text
    • Adicionado parâmetro de consulta token (string) opcional para um token Scribe em lote de uso único

Text to Speech

Espaços de trabalho

Alterações de esquema

ElevenAgents

  • Os esquemas de resposta da base de conhecimento do ElevenAgents adicionam content_format (html | markdown, padrão html) opcional
  • As respostas de arquivo da base de conhecimento adicionam auto_sync_info e refresh_status (FileRefreshStatus) opcionais
  • As respostas de pasta da base de conhecimento adicionam document_count (inteiro) obrigatório
  • Os esquemas de substituição de TTS do agente adicionam model_id (TTSConversationalModel) opcional
  • enable_phoneme_tags de TTS do agente agora tem como padrão true em vez de false
  • cascade_timeout_seconds da LLM de backup agora tem como padrão 4 em vez de 8 segundos
  • A configuração de LLM do agente adiciona gpt-5.6-sol, gpt-5.6-terra e gpt-5.6-luna; LLMReasoningEffort adiciona max
  • Guardrails personalizados adicionam evaluate_full_response_only (booleano, padrão false) opcional
  • A configuração de chamadas de telefonia adiciona twilio_call_recording_enabled (booleano, padrão false) opcional
  • Os parâmetros de ferramenta do tipo objeto adicionam dynamic_variable, constant_value e is_omitted; substituições constantes aceitam valores arbitrários de array e objeto
  • A configuração de texto do widget adiciona rótulos opcionais de upload de arquivos e indicador de digitação
  • Os esquemas de conta do WhatsApp adicionam enable_typing_indicator (booleano) opcional
  • Os esquemas de simulação e teste adicionam AutoGenerationMetadata e SimulationLibrarySettings

Música

  • Adicionados esquemas de solicitação, resposta, paginação, visibilidade, criador, status e motivo de falha de Music Finetune
  • Todos os esquemas de solicitação de geração de música expõem finetune_id aos SDKs gerados

Espaços de trabalho

  • Os esquemas de solicitação e resposta de webhook do espaço de trabalho adicionam events (WorkspaceWebhookEventType[]) opcional
  • Os esquemas de notificador de webhook de alertas usam webhook_id (string) obrigatório em vez de url, method e headers