Dublagem

  • Formato de transcrição JSON: Adicionamos suporte a transcrições em formato JSON no endpoint GET /v1/dubbing/{dubbing_id}/transcript/{language_code}, retornando dados detalhados de temporização em nível de palavra e caractere por meio de DubbingTranscriptResponseModel.

Plataforma de Agents

  • Suporte ao GPT-5.1: Adicionamos suporte aos modelos LLM gpt-5.1 e gpt-5.1-2025-11-13 nas configurações de agentes.
  • Controle de esforço de raciocínio: Adicionamos a opção none a LLMReasoningEffort para melhorar o controle sobre o comportamento de raciocínio do modelo.
  • Eventos de solicitação de ferramenta do agente: Adicionamos agent_tool_request a ClientEvent para melhorar o rastreamento de interações com ferramentas em conversas em tempo real.
  • DTMF fora de banda: Adicionamos a flag use_out_of_band_dtmf a PlayDTMFToolConfig para melhorar a integração com telefonia.
  • Adições de modelos LLM: Ampliamos o enum de LLM com gemini-3-pro-preview para aprimorar os recursos de IA conversacional.

Speech to Text

  • Eventos de cota excedida do Scribe: Adicionamos o evento quota_exceeded nos SDKs e o parâmetro include_timestamps para melhorar o gerenciamento de cotas e o controle de timestamps.

ElevenCreative Studio

  • Rastreamento de vozes por capítulo: Adicionamos o campo voice_ids aos modelos de resposta de capítulo para melhorar o gerenciamento de vozes em projetos com várias vozes.
  • Ativos de imagem do projeto: Introduzimos ProjectImageResponseModel para suporte a ativos de imagem, agora incluídos em ProjectResponseModel.assets.
  • Campo de vozes base: Adicionamos o campo base_voices a ProjectResponseModel para melhorar o gerenciamento de vozes.

Text to Speech

  • Controle de normalização de texto: Adicionamos o enum TextNormalisationType e o campo text_normalisation_type às configurações de voz de TTS para controle detalhado do processamento de texto.
  • Tokens WebSocket de TTS: Ampliamos SingleUseTokenType com tts_websocket para autenticação WebSocket segura.

Lançamentos de SDK

SDK JavaScript

  • v2.25.0 - Atualizado com as mudanças mais recentes no esquema da API, incluindo transcrições de dublagem em JSON e suporte ao GPT-5.1
  • v2.24.1 - Adicionado o parâmetro include_timestamps à API do Scribe para controle de timestamps nas transcrições

SDK Python

  • v2.24.0 - Atualizado com as mudanças mais recentes no esquema da API, incluindo transcrições de dublagem em JSON e suporte ao GPT-5.1
  • v2.23.0 - Adicionados o parâmetro include_timestamps e o evento quota_exceeded à API do Scribe para melhorar o gerenciamento de cotas

Pacotes

  • @elevenlabs/react@0.11.0 - Adicionados o evento quota_exceeded e o parâmetro include_timestamps para integração com o Scribe
  • @elevenlabs/client@0.11.0 - Adicionados o evento quota_exceeded e o parâmetro include_timestamps para integração com o Scribe

API

Endpoints atualizados

Dublagem

  • GET /v1/dubbing/{dubbing_id}/transcript/{language_code}
    • O parâmetro de caminho language agora aceita o valor 'original'
    • O parâmetro de consulta format_type agora oferece suporte a 'json' (além de srt e webvtt)
    • A resposta 200 agora inclui o tipo de mídia application/json, retornando DubbingTranscriptResponseModel com:
      • DubbingTranscriptUtterance - Dados em nível de enunciado
      • DubbingTranscriptWord - Temporização em nível de palavra
      • DubbingTranscriptCharacter - Temporização em nível de caractere
  • Adicionado o enum DubbingModel com os valores dubbing_v2 e dubbing_v3

Plataforma de Agents

  • Enviar chamadas em lote
    • Esquema do corpo da solicitação atualizado (compatível com versões anteriores)
    • Esquema de resposta atualizado (compatível com versões anteriores)
  • Obter status de chamadas em lote
    • Esquema de resposta atualizado (compatível com versões anteriores)
  • Cancelar chamadas em lote
    • Esquema de resposta atualizado (compatível com versões anteriores)
  • Tentar novamente chamadas em lote
    • Esquema de resposta atualizado (compatível com versões anteriores)
  • Obter configurações do agente
    • Esquema de resposta atualizado (compatível com versões anteriores)
  • Atualizar configurações do agente
    • Esquemas de solicitação e resposta atualizados (compatíveis com versões anteriores)
  • Criar agente
    • Esquema de solicitação atualizado com estrutura de guardrails aprimorada (mudança incompatível - guardrails foi simplificado para uma referência direta, removendo oneOf)
  • Obter agente
    • Esquema de resposta atualizado (mudança incompatível - campos version_id e branch_id controlados por feature flag foram removidos)
  • Atualizar agente
    • Esquema de resposta atualizado (mudança incompatível - campos version_id e branch_id controlados por feature flag foram removidos)
  • Simular conversa
    • Esquema de solicitação atualizado (compatível com versões anteriores)
  • Simular stream de conversa
    • Esquema de solicitação atualizado (compatível com versões anteriores)
  • Obter conversa
    • Esquema de resposta atualizado (compatível com versões anteriores)
  • Eventos de cliente atualizados:
    • Adicionado o tipo de evento agent_tool_request
  • Configurações de ferramentas atualizadas:
    • Adicionado use_out_of_band_dtmf a PlayDTMFToolConfig
    • Removidos os esquemas ApiIntegrationWebhookToolConfigExternal-* e seus mapeamentos de discriminador

Text to Speech

Gerenciamento de voz

  • Obter vozes
    • Esquema de resposta atualizado (compatível com versões anteriores)
  • Obter configurações de voz padrão
    • Esquema de resposta atualizado (compatível com versões anteriores)
  • Obter configurações de voz
    • Esquema de resposta atualizado (compatível com versões anteriores)
  • Obter voz
    • Esquema de resposta atualizado (compatível com versões anteriores)
  • Editar configurações de voz
    • Esquema de solicitação atualizado (compatível com versões anteriores)
  • Criar prévias de voz
    • Esquema de solicitação atualizado (compatível com versões anteriores)
  • Criar uma voz
    • Esquema de resposta atualizado (compatível com versões anteriores)
  • Criar uma voz
    • Esquema de resposta atualizado (compatível com versões anteriores)
  • Criar voz
    • Esquema de solicitação atualizado (compatível com versões anteriores)
  • Remixar voz
    • Esquema de solicitação atualizado (compatível com versões anteriores)

ElevenCreative Studio

  • Obter projeto
    • Esquema de resposta atualizado (compatível com versões anteriores)
    • Adicionado o campo assets com suporte a imagens
    • Adicionado o campo base_voices
  • Adicionar capítulo
    • Esquema de resposta atualizado (compatível com versões anteriores)
    • Adicionado o campo voice_ids
  • Obter capítulo
    • Esquema de resposta atualizado (compatível com versões anteriores)
    • Adicionado o campo voice_ids
  • Atualizar capítulo
    • Esquema de resposta atualizado (compatível com versões anteriores)
    • Adicionado o campo voice_ids

Música

Outras atualizações

Recursos removidos

  • Removidas as opções descontinuadas eleven_expressive e expressive dos enums de TTS