For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
LogoLogo
Connect
BlogHelp CenterAPI PricingSign up
Visão geralElevenCreativeElevenAgentsElevenAPIReception.aireferência da APIChangelogCentral de ajuda
Entrar
Visão geralElevenCreativeElevenAgentsElevenAPIReception.aireferência da APIChangelogCentral de ajuda
Connect
BlogHelp CenterAPI PricingSign up
Nesta página
  • 23 de setembro de 2026
  • Imagem e Vídeo
  • 21 de setembro de 2026
  • ElevenAgents
  • Imagem e vídeo
  • Speech Engine
  • Text to Speech
  • Lançamentos de SDKs
  • API
  • Novos endpoints
  • Endpoints atualizados
  • Alterações de esquema
  • 14 de setembro de 2026
  • ElevenAgents
  • Música
  • Lançamentos de SDKs
  • API
  • Novos endpoints
  • Endpoints atualizados
  • Alterações de esquema
  • 11 de setembro de 2026
  • Scribe v2 Medical
  • 7 de setembro de 2026
  • ElevenAgents
  • Espaços de trabalho
  • Lançamentos de SDKs
  • API
  • Novos endpoints
  • Endpoints atualizados
  • Alterações de esquema
  • 31 de agosto de 2026
  • ElevenAgents
  • Música
  • Dublagem
  • Lançamentos de SDKs
  • API
  • Endpoints atualizados
  • Alterações de esquema
  • 24 de agosto de 2026
  • CLI da ElevenLabs
  • Procedimentos
  • ElevenAgents
  • Lançamentos de SDKs
  • API
  • Novos endpoints
  • Endpoints atualizados
  • Alterações no esquema
  • 22 de agosto de 2026
  • Servidor MCP
  • 17 de agosto de 2026
  • ElevenCreative
  • ElevenAgents
  • Lançamentos de SDKs
  • API
  • Novos endpoints
  • Endpoints atualizados
  • Alterações de esquema
  • 10 de agosto de 2026
  • API de Dubbing v2
  • ElevenAgents
  • Vozes
  • Lançamentos de SDKs
  • API
  • Novos endpoints
  • Endpoints atualizados
  • Alterações de esquema

Changelog

September 23, 2026
September 23, 2026

September 21, 2026
September 21, 2026

September 14, 2026
September 14, 2026

September 11, 2026
September 11, 2026

September 7, 2026
September 7, 2026

August 31, 2026
August 31, 2026

August 24, 2026
August 24, 2026

August 22, 2026
August 22, 2026

August 17, 2026
August 17, 2026

August 10, 2026
August 10, 2026
Posts mais antigos
Próximo
Construído com
Entrar

Imagem e Vídeo

  • Sora 2 e Sora 2 Pro descontinuados: A OpenAI descontinuará a API Sora em 24 de setembro de 2026. Ambos os modelos foram removidos do seletor de modelos de Imagem e Vídeo e deixarão de gerar nessa data. As gerações existentes continuarão disponíveis no seu histórico. Flows e modelos que usam um nó do Sora precisam ser alterados para outro modelo de vídeo, como o Gemini Omni 1.1 Flash, antes de poderem ser executados novamente.
  • Seedance 1.5 Pro descontinuado: A ByteDance descontinuará o Seedance 1.5 Pro em 11 de novembro de 2026. O modelo não é mais oferecido para novas gerações e deixará de funcionar nessa data. Use um modelo Seedance 2.0 em vez disso.

ElevenAgents

  • Chamadas paralelas de ferramentas: A configuração de prompt do agente agora inclui enable_parallel_tool_calls (booleano, padrão true). Quando ativado, os modelos compatíveis podem executar várias ferramentas em um turno.
  • Modelos de agente: Adicionado gpt-6-astra às opções de LLM do agente.
  • Alertas: Os alertas do agente agora oferecem suporte a canais do Slack, além de notificadores do PagerDuty e webhooks.
  • Busca de números de telefone: Adicionado um endpoint de números de telefone com paginação por cursor e filtros de provedor, suporte a chamadas de saída, agente e ramificação atribuídos, rótulo e número de telefone.

Imagem e vídeo

  • Modelos GPT Image 2.5: A geração de imagens agora oferece suporte a gpt-image-2.5-flare e gpt-image-2.5-sunburst. Ambos os modelos aceitam até 10 imagens de referência, níveis de qualidade até max, 14 proporções fixas mais auto e saída em 1K, 2K ou 4K.

Speech Engine

  • Tempo limite de cascata: As solicitações de criação e atualização do Speech Engine agora aceitam cascade_timeout_seconds (número, 2–15, padrão 4) para controlar por quanto tempo a ElevenLabs aguarda um mecanismo de voz upstream antes de tentar novamente.

Text to Speech

  • Limites de turno em múltiplos contextos: O marcador is_final_audio_for_turn agora é emitido após cada byte armazenado em buffer para aquele turno, incluindo saídas MP3 e Opus. Os clientes podem usar o marcador como um limite exato de turno sem precisar mudar para PCM.

Lançamentos de SDKs

SDK JavaScript

  • v2.69.0 - Adicionado transcriptEdit ao wrapper de Speech to Text em tempo real, com texto editado entregue por eventos edited_transcript. Corrigida a verificação de JWT do Speech Engine para chaves de API com sufixos de residência de dados. Adicionados phoneNumbers.listV2 e métodos de modelos do Flows para listar e obter modelos, além de listar, criar e obter execuções. Clientes e tipos regenerados para GPT Image 2.5, alertas de agente no Slack, chamadas paralelas de ferramentas, gpt-6-astra, limites de simultaneidade de chaves de API de contas de serviço, retenção zero de Música, filtros de conversa e status de aprovação de ferramentas MCP.

SDK Python

  • v2.69.0 - Adicionado transcript_edit ao wrapper de Speech to Text em tempo real, com texto editado entregue por eventos edited_transcript. Corrigida a verificação de JWT do Speech Engine para chaves de API com sufixos de residência de dados, e play agora gera um erro quando ffplay falha. Adicionados phone_numbers.list_v2 e métodos de modelos do Flows para listar e obter modelos, além de listar, criar e obter execuções. Clientes e tipos regenerados para GPT Image 2.5, alertas de agente no Slack, chamadas paralelas de ferramentas, gpt-6-astra, limites de simultaneidade de chaves de API de contas de serviço, retenção zero de Música, filtros de conversa e status de aprovação de ferramentas MCP.

CLI da ElevenLabs

  • v1.3.2 - Adicionados metadados opcionais --intent para coletar feedback sobre o uso da CLI. Adicionado elevenlabs feedback missing-capability para relatar workflows que a CLI não oferece suporte.

API

Ver alterações da API

Novos endpoints

ElevenAgents

  • Listar página de números de telefone - GET /v1/convai/v2/phone-numbers
    • Adicionados parâmetros de paginação page_size (inteiro, 1–1.000, padrão 100) e cursor (string anulável) opcionais.
    • Adicionados filtros opcionais search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by e sort_direction. sort_by aceita label ou phone_number; sort_direction tem como padrão asc.
    • A resposta contém phone_numbers (array) obrigatório, next_cursor (string) anulável e opcional, e has_more (booleano, padrão false).

Endpoints atualizados

ElevenAgents

  • Criar agente, Obter agente e Atualizar agente
    • A configuração de prompt adiciona enable_parallel_tool_calls (booleano, padrão true). As substituições de workflow aceitam um booleano anulável.
    • A enumeração LLM adiciona gpt-6-astra, incluindo substituições de início de conversa.
    • Os notificadores de integração de alertas agora usam integration_type para selecionar pagerduty ou slack. Os notificadores do Slack exigem connection_id e channel_id (strings); channel_id aceita de 1 a 64 caracteres.
  • Listar conversas e Resolver referência de conversa
    • data_collection_params não aceita mais o operador missing. Use um valor vazio para encontrar conversas nas quais o campo não foi coletado.
    • Um valor vazio em dynamic_variable_params encontra conversas em que a variável não foi definida.
  • Criar Speech Engine, Obter Speech Engine e Atualizar Speech Engine
    • Adicionado cascade_timeout_seconds (número, 2–15). As solicitações de criação usam 4 como padrão, as solicitações de atualização aceitam um valor anulável e as respostas exigem o campo.

Imagem e vídeo

  • Criar geração de imagem - POST /v1/flows/image
    • Adicionadas variantes de solicitação para gpt-image-2.5-flare e gpt-image-2.5-sunburst.
    • Ambas as variantes exigem prompt e model_id, aceitam até 10 images e adicionam resolution (1K, 2K ou 4K, padrão 1K).
    • quality aceita low, medium, high, xhigh ou max e tem como padrão high. aspect_ratio aceita auto e 14 proporções fixas, e tem como padrão 16:9.

Dublagem

  • Criar projeto de dublagem - POST /v1/dubbing/project
    • O keyterms multipart aceita campos repetidos ou um único array JSON.
    • O webhook_ids multipart aceita campos repetidos, um único array JSON ou uma string separada por vírgulas.
  • Obter recurso do workspace, Compartilhar recurso do workspace e Remover compartilhamento de recurso do workspace
    • WorkspaceResourceType adiciona dubbing_project.

Base de conhecimento

  • Criar tarefa de rastreamento - POST /v1/convai/knowledge-base/crawl
    • max_depth (inteiro, padrão 3) foi descontinuado. O campo agora não tem efeito e não possui mais restrições mínimas ou máximas.
    • Os metadados da tarefa de rastreamento não exigem mais max_depth.

Usuário

  • Obter usuário e Obter assinatura
    • As enumerações de moeda adicionam gbp.

Alterações de esquema

Text to Speech

  • As mensagens WebSocket audio e final de múltiplos contextos agora definem is_final_audio_for_turn como ocorrendo após a entrega de todos os bytes armazenados em buffer para o turno.

ElevenAgents

  • Fila de chamadas e áudio de espera: Adicionamos fila de chamadas para agentes que atingiram o limite de simultaneidade. Quem liga e entra na fila ouve áudio de espera e recebe eventos queue_status até ser atendido ou o tempo se esgotar. Novos métodos da API permitem enviar ou excluir áudio de espera personalizado.
  • Metadados de versão de teste: Os resultados de teste do agente agora identificam a versão do agente usada e se incluíam alterações de rascunho. Os resumos de invocação também indicam quando reenvios parciais foram executados em versões diferentes.
  • Metadados de modelo e conta: A configuração de LLM do agente agora aceita gemini-3.8-flash. As respostas de contas do WhatsApp identificam se a conta usa a Cloud API ou o fluxo de cadastro coexistente.

Música

  • Suporte à API Music v2.5: Os endpoints e SDKs de Música agora aceitam music_v2_5. Os blocos de geração de planos de composição suportam até 6.132 caracteres, com até 30 linhas de 200 caracteres cada.

Lançamentos de SDKs

SDK JavaScript

  • v2.68.0 - Adicionados métodos para enviar e excluir áudio de espera do agente. Tipos regenerados para fila de chamadas, referências de procedimentos, criação de ramificação de rascunho, limites de consultas RAG, metadados de versão de teste, gemini-3.8-flash e music_v2_5.

SDK Python

  • v2.68.0 - Adicionados métodos síncronos e assíncronos para enviar e excluir áudio de espera do agente. Tipos regenerados para fila de chamadas, procedimentos, criação de ramificação de rascunho, limites de consultas RAG, metadados de versão de teste, gemini-3.8-flash e music_v2_5. O wrapper compose_detailed agora aceita todos os IDs de modelo de música gerados e planos de composição baseados em prompt e em blocos.

SDK iOS

  • v3.3.1 - Reconcilia mensagens do agente por response_id em vez de event_id, preservando várias respostas durante chamadas de ferramentas e evitando que partes transmitidas ou correções sejam associadas à mensagem errada.

CLI da ElevenLabs

  • v1.3.0 - Adicionados metadados opcionais --intent aos comandos de API gerados. Adicionado elevenlabs feedback missing-capability para relatar workflows que a CLI não oferece suporte.

Pacotes

  • @elevenlabs/convai-widget-core@0.18.2 e @elevenlabs/convai-widget-embed@0.18.2 - Corrigidas respostas duplicadas do agente após chamadas de ferramentas e procedimentos. As respostas de texto transmitidas mantêm a formatação Markdown, e conversas por voz não exibem mais partes de chat transmitidas que não foram faladas. O pacote embed também limita os eventos user_activity a uma vez por segundo e remove o limite quando uma sessão termina.

API

Ver alterações da API

Novos endpoints

ElevenAgents

  • Enviar áudio de espera do agente - POST /v1/convai/agents/{agent_id}/hold-audio
    • Aceita o campo obrigatório hold_audio_file (binário) como dados de formulário multipart. O arquivo deve ser MP3 ou WAV, de até 40 MB e 180 segundos.
    • Retorna agent_id (string) e hold_audio (AgentHoldAudioConfig) obrigatórios. O objeto de áudio de espera exige audio_path, audio_url, original_filename (strings), duration_secs (número) e size_bytes (inteiro).
  • Excluir áudio de espera do agente - DELETE /v1/convai/agents/{agent_id}/hold-audio
    • Remove o clipe personalizado para que quem está na fila ouça o tom de espera padrão.
    • Retorna agent_id (string) obrigatório.

Endpoints atualizados

ElevenAgents

  • Criar agente, Obter agente e Atualizar agente
    • Adicionado platform_settings.queueing_config (AgentQueueingConfig) opcional com enabled (booleano, padrão false) e wait_timeout_seconds (inteiro, 1–1.800, padrão 180).
    • As respostas de configuração de fila incluem hold_audio (AgentHoldAudioConfig) anulável e somente leitura. As respostas do agente também incluem default_hold_audio_url (string) opcional.
  • Obter conversa - GET /v1/convai/conversations/{conversation_id}
    • Os metadados adicionam queue_wait_secs (número) anulável e opcional. O tempo na fila não é incluído em call_duration_secs nem no tempo cobrado.
  • Criar ramificação do agente - POST /v1/convai/agents/{agent_id}/branches
    • Adicionado include_draft (booleano, padrão false) opcional. Quando true, uma ramificação criada a partir da ponta da ramificação inclui o conjunto de procedimentos em rascunho de quem fez a chamada.
  • Listar procedimentos e endpoints de criação, obtenção e rascunho de procedimentos
    • Os itens da lista adicionam referenced_tool_ids, referenced_kb_ids, referenced_procedure_ids e referenced_dynamic_variables (arrays de strings) opcionais.
    • As respostas do agente e da prévia de mesclagem adicionam procedures opcional, um mapa indexado por ID de procedimento.
  • Listar invocações de teste - GET /v1/convai/test-invocations
    • Adicionado search (string) anulável e opcional para filtrar testes e pastas por nome.
  • Executar testes no agente e Obter invocação de teste
    • As respostas de invocação de conjunto de testes e execução de teste unitário adicionam version_id (string) anulável e opcional, além de ran_against_draft (booleano, padrão false) opcional.
    • Os resumos de invocação também adicionam runs_diverged_from_version (booleano, padrão false) opcional.
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • O corpo da solicitação adiciona as substituições específicas da consulta max_documents_length (inteiro, 1–50.000) e max_retrieved_rag_chunks_count (inteiro, 1–20), opcionais e anuláveis.
  • Obter conta do WhatsApp - GET /v1/convai/whatsapp-accounts/{phone_number_id}
    • Adicionado account_type (WhatsAppAccountType, padrão cloud_api) opcional. Os valores são cloud_api e coexistence.
  • Calcular uso esperado de LLM - POST /v1/convai/agent/{agent_id}/llm-usage/calculate
    • LLMUsageCalculatorLLMResponseModel adiciona price_per_message (número) obrigatório.

Música

  • MusicModelID adiciona music_v2_5 para POST /v1/music/video-to-music, POST /v1/music/plan, Compor música, POST /v1/music/detailed, POST /v1/music/detailed/stream, POST /v1/music/stream, POST /v1/music/upload e POST /v1/music/finetunes.
  • GenerationChunk.text aumenta maxLength de 6.000 para 6.132 caracteres para POST /v1/music/plan, POST /v1/music, POST /v1/music/detailed, POST /v1/music/detailed/stream, POST /v1/music/stream e POST /v1/music/upload. Os nomes das seções podem conter de 1 a 100 caracteres, e os blocos podem conter até 30 linhas com 200 caracteres por linha.

Alterações de esquema

ElevenAgents

  • Os eventos do servidor em tempo real adicionam queue_status. O queue_status_event.status obrigatório aceita waiting, admitted ou timed_out; timed_out precede o código de encerramento WebSocket 4300. O áudio de espera continua chegando como eventos regulares de audio.
  • A enumeração LLM adiciona gemini-3.8-flash, incluindo substituições de início de conversa.
  • As uniões de resultados das ferramentas do sistema de conversa adicionam start_procedure_success, start_procedure_error, end_procedure_success e end_procedure_error.
  • FeaturesUsageCommonModel adiciona status de recurso opcionais freeform_procedure e structured_procedure.

Scribe v2 Medical

O Scribe v2 Medical agora está disponível para todos. É um modelo de reconhecimento de fala em lote especializado em áudio médico e clínico, cobrado na mesma tarifa do Scribe v2.

Passe scribe_v2_medical como model_id em Criar transcrição. Prompting de termos-chave, detecção de entidades, diarização de locutores e modo sem transcrição literal funcionam da mesma forma que no Scribe v2.

Modelos

ID do modelo, recursos e quando usar o Scribe v2 Medical.

Criar transcrição

Transcreva áudio com model_id definido como scribe_v2_medical.

ElevenAgents

  • Tickets de conversa em todo o espaço de trabalho: Adicionado Listar tickets do espaço de trabalho para recuperar tickets de triagem de conversas entre os agentes acessíveis. Filtre por status ou responsável e use paginação por cursor para recuperar até 100 tickets por página.
  • Filtros de conversa por variáveis dinâmicas: Listar conversas e Pesquisar mensagens de conversa por texto agora aceitam filtros dynamic_variable_params repetíveis. Use name:op:value com eq, gt, gte, lt ou lte; os operadores de comparação exigem valores numéricos.
  • Detecção de secretária eletrônica da Twilio: As configurações de telefonia de saída e de chamadas em lote agora oferecem suporte a twilio_machine_detection opcional. Escolha enable para uma identificação antecipada de pessoa ou máquina, ou detect_message_end para aguardar a conclusão da saudação da caixa postal. Os resultados chegam pelo novo evento de webhook answering_machine_detection.
  • Restrições de valores na coleta de dados: As propriedades de coleta de dados agora podem usar allowed_values para nomear uma variável dinâmica que contém os valores permitidos. O campo anterior allowed_values_dynamic_variable está obsoleto.
  • Metadados do agente: As respostas de Listar ramificações de agentes agora indicam quando um rascunho foi criado e se ele é anterior à ponta da ramificação. Os resumos de Agente e Speech Engine agora exigem voice_id.
  • URLs de origem da base de conhecimento: Os trechos de consulta RAG do agente agora incluem source_url anulável e obrigatório, contendo a URL rastreada para documentos de URL.
  • Anexos de resposta do agente: Os eventos WebSocket agent_response agora incluem attachments opcional. Cada anexo exige url e name e pode incluir mime_type.

Espaços de trabalho

  • Limites de plataforma para chaves de API: As respostas de chave de API da conta de serviço agora podem incluir platform_limits empresariais para créditos, Clones de Voz Profissionais e simultaneidade de TTS, Dublagem e Música.

Lançamentos de SDKs

SDK JavaScript

  • v2.67.0 - Adicionado dynamicVariableParams às solicitações de listagem e pesquisa de texto de conversas. Tipos regenerados para detecção de secretária eletrônica da Twilio, restrições de valores na coleta de dados, limites de plataforma de chaves de API, metadados de rascunho de ramificações de agentes e URLs de origem da base de conhecimento.

SDK Python

  • v2.67.0 - Adicionado dynamic_variable_params aos métodos síncronos e assíncronos de listagem de conversas e pesquisa de texto. Tipos regenerados para detecção de secretária eletrônica da Twilio, restrições de valores na coleta de dados, limites de plataforma de chaves de API, metadados de rascunho de ramificações de agentes e URLs de origem da base de conhecimento. O cliente de conversão de texto em fala em tempo real não envia mais o sentinela interno de omissão para a conexão.

CLI da ElevenLabs

  • v1.2.0 - Adicionado o comando elevenlabs say e sua habilidade de agente, regenerados os bindings de comandos da API e definido eleven_v3 como o modelo TTS padrão.

Pacotes

  • @elevenlabs/client@1.25.0, @elevenlabs/react@1.15.2, @elevenlabs/react-native@1.2.27, @elevenlabs/convai-widget-core@0.18.1 e @elevenlabs/convai-widget-embed@0.18.1 - MessageAttachment foi reexportado de @elevenlabs/client para que os consumidores possam importar o tipo diretamente.
  • @elevenlabs/client@1.24.0, @elevenlabs/types@0.23.0, @elevenlabs/react@1.15.1, @elevenlabs/react-native@1.2.26, @elevenlabs/convai-widget-core@0.18.0 e @elevenlabs/convai-widget-embed@0.18.0 - Encaminhados anexos de arquivos de respostas do agente para onMessage e adicionada a configuração de sessão opcional webRtc.singlePeerConnection. O widget também localiza botões de saudação e corrige respostas de chat de texto perdidas ou duplicadas.

API

Ver alterações da API

Novos endpoints

ElevenAgents

  • Listar tickets do espaço de trabalho - GET /v1/convai/triage-tickets
    • Lista tickets de triagem de conversas em todos os agentes aos quais o solicitante tem acesso, ordenados do mais recentemente criado para o mais antigo.
    • Adicionados os parâmetros de consulta opcionais page_size (inteiro, 1–100, padrão 100), status (AgentConversationTicketStatus), assignee_user_id (string ou unassigned) e cursor (string).
    • Retorna GetAgentConversationTicketsPageResponseModel.

Endpoints atualizados

ElevenAgents

  • Listar conversas - GET /v1/convai/conversations
    • Adicionado dynamic_variable_params opcional e anulável (array de strings repetível). Cada valor usa name:op:value, em que op é eq, gt, gte, lt ou lte.
  • Pesquisar mensagens de conversa por texto - GET /v1/convai/conversations/messages/text-search
    • Adicionado dynamic_variable_params opcional e anulável (array de strings repetível) com a mesma sintaxe.
  • Chamada de saída da Twilio, Chamada de saída via tronco SIP, Chamada de saída da Exotel e Enviar chamadas em lote
    • telephony_call_config agora usa esquemas separados de entrada e saída.
    • Adicionado twilio_machine_detection opcional e anulável (TwilioMachineDetectionConfig). Seu mode aceita enable ou detect_message_end e o padrão é enable. A configuração é ignorada para provedores que não são Twilio e chamadas recebidas.
  • Importar número de telefone - POST /v1/convai/phone-numbers
    • Adicionado account_auth_token opcional e anulável (string) para importações de chaves de API da Twilio validarem assinaturas de webhooks recebidos.

Alterações de esquema

ElevenAgents

  • WebhookEventType adiciona answering_machine_detection.
  • AgentBranchSummary adiciona draft_created_at opcional e anulável (inteiro) e draft_is_behind_tip opcional (booleano, padrão false).
  • AgentKnowledgeBaseRagChunkResponseModel adiciona source_url obrigatório e anulável (string).
  • AgentSummaryResponseModel e SpeechEngineSummaryResponse adicionam voice_id obrigatório (string).
  • AnalysisProperty adiciona name opcional e anulável (string) e allowed_values (AllowedValues). LiteralJsonSchemaProperty também adiciona allowed_values. Ambos tornam allowed_values_dynamic_variable obsoleto.
  • DataCollectionResultCommonModel adiciona name opcional e anulável (string).
  • WorkspaceApiKeyResponseModel adiciona platform_limits opcional e anulável (PlatformLimits).
  • A ferramenta MCP Icon adiciona theme opcional e anulável (light ou dark).
  • SMBToolConfig adiciona as variantes de parâmetro send_custom_email, create_service_quote_request e create_product_quote_request.
  • Os esquemas de parâmetros de consulta de webhook e a configuração de chamadas de telefonia agora usam modelos separados de entrada e saída.
  • Os eventos WebSocket agent_response adicionam attachments opcional (array). Cada item exige url e name (strings) e aceita mime_type opcional (string).

ElevenCreative

  • ReferenceVideo.studio_clip agora usa StudioClipLocator em vez de StudioClipReference. Os campos e o formato de transmissão permanecem inalterados.

ElevenAgents

  • Entrada pelo teclado do telefone: A configuração de conversa do agente agora oferece suporte a dtmf_input_settings opcional para entrada DTMF. Configure o tempo limite dos dígitos, use # como terminador e oculte as entradas do teclado em transcrições, logs e análises.
  • Histórico de anexos da conversa: As entradas de transcrição de Obter conversa agora incluem file_inputs, um array que contém o ID, o nome, o tipo MIME e a URL de cada arquivo anexado.
  • Filtragem por tags de agentes: Listar agentes agora aceita um parâmetro de consulta tags opcional. Repita o parâmetro para encontrar agentes com qualquer uma das tags fornecidas.
  • Contexto de campanha em lote: Obter conversa agora identifica chamadas em lote com metadados campaign anuláveis contendo os obrigatórios campaign_id e campaign_lead_id.

Música

  • Dados visuais de forma de onda: Gerar música detalhada, Transmitir música com detalhes e Enviar música agora aceitam with_waveform_visual opcional (booleano, padrão false). As respostas com essa opção ativada retornam um array de inteiros waveform_visual de baixa resolução, com quatro amostras por segundo.

Dublagem

  • Comportamento de paginação de projetos: Listar projetos de Dubbing e Listar idiomas de destino agora limitam page_size a 1–100. A filtragem de status do projeto inclui queued, e ambos os endpoints documentam o uso de next_cursor para buscar a próxima página.

Lançamentos de SDKs

SDK JavaScript

  • v2.66.0 - Adicionado fileIds a sendMultimodalMessage, permitindo que uma mensagem inclua vários anexos de arquivo.

SDK Python

  • v2.66.0 - Adicionado file_ids a send_multimodal_message, permitindo que uma mensagem inclua vários anexos de arquivo.

SDK Android

  • v0.12.2 - Preservado o callback onUnhandledClientToolCall ao conectar eventos de sessão. Chamadas não tratadas de ferramentas do cliente que esperam uma resposta agora recebem a resposta automática de erro, em vez de permanecerem sem resolução.

CLI da ElevenLabs

  • v1.1.0 - Regenerados os bindings de comandos da API e adicionada atribuição de solicitações por comando para workflows do ElevenAgents. Esses comandos acrescentam cmd/<command> ao User-Agent da CLI, permitindo distinguir solicitações de workflows como agents push e agents create.

Pacotes

  • @elevenlabs/client@1.23.0, @elevenlabs/react@1.15.0, @elevenlabs/types@0.22.1, @elevenlabs/react-native@1.2.25, @elevenlabs/convai-widget-core@0.17.1 e @elevenlabs/convai-widget-embed@0.17.1 - Adicionado fileIds a sendMultimodalMessage. O cliente envia os campos file e files para compatibilidade, e o React expõe a API de cliente atualizada.

API

Ver alterações da API

Endpoints atualizados

ElevenAgents

  • Listar agentes - GET /v1/convai/agents
    • Adicionado tags opcional e anulável (array de strings). Repita o parâmetro de consulta para encontrar qualquer tag fornecida.
  • Criar agente, Obter agente e Atualizar agente
    • Adicionado conversation_config.conversation.dtmf_input_settings opcional e anulável (DTMFInputConfig). Ele oferece suporte a dtmf_input_timeout (número, 0,5–10 segundos, padrão 2), hash_terminator (booleano, padrão true) e redact_input (booleano, padrão false).
    • Adicionado sip_refer_play_dialtone opcional (booleano, padrão true) à configuração de transferência de número de telefone. Defina como false para manter a etapa original da chamada silenciosa enquanto uma transferência SIP REFER é concluída.
    • As ferramentas de sistema de procedimento inicial e final agora aceitam um ProcedureVersionRef ou um ProcedureDraftRef. Referências de rascunho exigem procedure_id (string) e definem version_id como null.
  • Obter conversa - GET /v1/convai/conversations/{conversation_id}
    • Adicionado file_inputs (array de ConversationHistoryTranscriptFileInputResponseModel) às entradas de transcrição. Cada item exige file_id, original_filename, mime_type e file_url (strings).
    • Adicionado campaign opcional e anulável (BatchCallingCampaignInformation) aos metadados de chamadas em lote. O objeto exige campaign_id e campaign_lead_id (strings).
    • Adicionado dtmf a ChatSourceMedium.
  • Os tipos de problema dos tickets de triagem de conversas adicionam incorrect_information, documentation_gap, platform_bug e wrong_action.

Música

  • Gerar música detalhada (POST /v1/music/detailed) e Transmitir música com detalhes (POST /v1/music/detailed/stream)
    • Adicionado with_waveform_visual opcional (booleano, padrão false).
    • As respostas detalhadas adicionam waveform_visual anulável (array de inteiros), amostrado quatro vezes por segundo de -1000 a 1000.
  • Enviar música - POST /v1/music/upload
    • Adicionados with_waveform_visual opcional (booleano, padrão false) e waveform_visual anulável (array de inteiros) na resposta.

ElevenCreative

  • Criar projeto no Estúdio e Criar podcast
    • quality_preset agora aceita null, e o padrão do esquema standard foi removido.

Dublagem

  • Listar projetos de Dubbing - GET /v1/dubbing/project
    • page_size continua sendo um inteiro opcional com padrão 20, mas os valores agora são limitados a 1–100 em vez de rejeitados.
    • O filtro status agora documenta queued, preparing, ready e failed.
    • Passe o next_cursor da resposta anterior em cursor; omita-o na primeira página.
  • Listar idiomas de destino - GET /v1/dubbing/project/{project_id}/language
    • page_size continua sendo um inteiro opcional com padrão 20, mas os valores agora são limitados a 1–100 em vez de rejeitados.
    • O filtro status oferece suporte a queued, processing, completed, stale e failed.
    • Passe o next_cursor da resposta anterior em cursor; omita-o na primeira página.

Alterações de esquema

Espaço de trabalho

  • PendingSubscriptionSwitchResponseModel.next_tier adiciona grant.

CLI da ElevenLabs

A CLI da ElevenLabs v1.0.0 já está disponível. Todas as operações da API da ElevenLabs estão disponíveis como subcomandos, com saída em JSON, tabela, YAML e CSV, paginação automática e preenchimento de comandos no shell.

A CLI também oferece workflows de configuração local para o ElevenAgents. Armazene configurações de agentes, ferramentas e testes como arquivos, sincronize-as com comandos push e pull, gerencie branches, execute testes, instale componentes de interface da ElevenLabs e selecione uma região de residência de dados.

Documentação da CLI

Instale a CLI, autentique-se e gerencie agentes como código.

Procedimentos

Os procedimentos agora estão disponíveis de forma geral no ElevenAgents. Um procedimento contém instruções específicas para uma tarefa e um gatilho que determina quando elas se aplicam. Durante uma conversa, o agente carrega o procedimento relevante, permitindo que um agente execute tarefas distintas sem incluir todas as instruções no prompt de sistema.

Use procedimentos de formato livre quando o agente puder adaptar a redação ou a ordem das instruções. Use procedimentos estruturados quando as etapas precisarem ser executadas em uma ordem definida. Os dois tipos podem ser usados junto com workflows no mesmo agente.

Visão geral dos procedimentos

Saiba quando usar procedimentos e como eles se comparam a prompts e workflows.

Procedimentos de formato livre

Escreva instruções em linguagem natural que o agente pode adaptar à conversa.

Procedimentos estruturados

Defina etapas tipadas que o agente segue em uma ordem consistente.

ElevenAgents

  • Tickets de triagem de conversas: adicionamos APIs para criar tickets sobre o desempenho de agentes, criar tickets manuais de acompanhamento, listar tickets, atribuir membros do workspace, atualizar status e responsável, além de adicionar comentários no nível do ticket ou do turno.
  • Observabilidade de conversas: os clientes em tempo real podem receber um evento context_usage após cada turno concluído do agente. O evento informa o modelo, a contagem de tokens do prompt e o limite de contexto do modelo.

Lançamentos de SDKs

SDK JavaScript

  • v2.65.0 - Adicionados clientes e tipos para tickets de triagem de conversas e resumos leves de conversas. As APIs de conversa adicionam filtros de procedimento, chamada de ferramenta inválida e ordenação; as APIs de procedimento adicionam seleção de versão do agente; as APIs de tópicos adicionam controles de detalhes de avaliação e ordenação por frustração. O lançamento também adiciona campos de frequência de atualização da base de conhecimento, ambiente de teste e integração de alertas, além de tipos de mensagens de Dubbing em tempo real.

SDK Python

  • v2.65.0 - Adicionados clientes e tipos para tickets de triagem de conversas e resumos leves de conversas. As APIs de conversa adicionam filtros de procedimento, chamada de ferramenta inválida e ordenação; as APIs de procedimento adicionam seleção de versão do agente; as APIs de tópicos adicionam controles de detalhes de avaliação e ordenação por frustração. O lançamento também adiciona campos de frequência de atualização da base de conhecimento, ambiente de teste e integração de alertas, além de preservar campos multipart repetidos para keyterms do Speech to Text e webhook_ids do Dubbing.

SDK Swift

  • v3.3.0 - Adicionados parsing tipado de erros do cliente, tratamento de expects_response e resultados de ferramentas com segurança de tipos. A inicialização do WebRTC agora fica pronta quando o agente entra, em vez de aguardar a assinatura da faixa de áudio. O lançamento também reforça o tratamento de URLs, elimina o ruído de eventos desconhecidos e remove a alocação de threads em tempo real do processamento de silenciamento por software.

Pacotes

  • @elevenlabs/client@1.19.1, @elevenlabs/react@1.12.3, @elevenlabs/react-native@1.2.21, @elevenlabs/convai-widget-core@0.16.2 e @elevenlabs/convai-widget-embed@0.16.2 - A captura de saída do WebRTC agora usa caminhos AudioWorklet auto-hospedados sob políticas rígidas de segurança de conteúdo. O cache de worklets inclui a fonte solicitada, impedindo que uma URL inline anterior substitua um caminho auto-hospedado. Os erros de configuração do React Native agora apontam para @elevenlabs/react-native.
  • @elevenlabs/client@1.20.0, @elevenlabs/react@1.12.4, @elevenlabs/react-native@1.2.22, @elevenlabs/convai-widget-core@0.16.3 e @elevenlabs/convai-widget-embed@0.16.3 - Adicionada a opção webRtc.iceTransportPolicy. Defina-a como relay para restringir os candidatos ICE do WebRTC a retransmissores TURN em redes que bloqueiam tráfego UDP direto.
  • @elevenlabs/client@1.21.0, @elevenlabs/react@1.13.0, @elevenlabs/types@0.21.1, @elevenlabs/react-native@1.2.23, @elevenlabs/convai-widget-core@0.16.4 e @elevenlabs/convai-widget-embed@0.16.4 - Adicionados o callback onContextUsage e o tipo ContextUsageEvent. O React expõe o callback por meio de useConversation. O React Native agora é resolvido pela condição de exportação do pacote, em vez da detecção de variáveis globais do navegador.
  • @elevenlabs/client@1.22.0, @elevenlabs/react@1.14.0, @elevenlabs/types@0.22.0, @elevenlabs/react-native@1.2.24, @elevenlabs/convai-widget-core@0.17.0 e @elevenlabs/convai-widget-embed@0.17.0 - Adicionado conteúdo avançado na primeira mensagem com respostas de botões atribuídas, onExternalAgentDisconnected e onMCPToolApprovalRequest. O WebRTC agora usa o dispositivo de entrada selecionado, preserva o estado de silenciamento ao trocar de microfone e falha na configuração caso os dados de inicialização não possam ser enviados. O widget adiciona o status da fila de concorrência, seleção opcional de idioma no acionador recolhido e renderização da primeira mensagem para agentes compatíveis com texto e voz.

API

Ver alterações na API

Novos endpoints

ElevenAgents

  • Adicionados nove endpoints de tickets de triagem de conversas:
    • Criar ticket de conversa - POST /v1/convai/triage-tickets. A solicitação requer conversation_id (string) e aceita qa_comment (string anulável, de 1 a 10.000 caracteres) e até 200 comentários de turno.
    • Listar tickets - GET /v1/convai/agents/{agent_id}/triage-tickets, com paginação por cursor.
    • Criar ticket manual - POST /v1/convai/agents/{agent_id}/triage-tickets. A solicitação requer qa_comment (string, de 1 a 10.000 caracteres).
    • Listar usuários atribuíveis - GET /v1/convai/agents/{agent_id}/triage-tickets/assignable-users. A resposta lista membros do workspace que não são contas de serviço e indica se cada membro tem acesso ao agente.
    • Obter ticket - GET /v1/convai/triage-tickets/{agentqa_ticket_id}.
    • Atualizar ticket - PATCH /v1/convai/triage-tickets/{agentqa_ticket_id}. A solicitação aceita status opcional e assignee_user_id anulável.
    • Excluir ticket - DELETE /v1/convai/triage-tickets/{agentqa_ticket_id}.
    • Adicionar comentário - POST /v1/convai/triage-tickets/{agentqa_ticket_id}/comments. A solicitação requer comment (string, de 1 a 10.000 caracteres).
    • Adicionar comentário de turno - POST /v1/convai/triage-tickets/{agentqa_ticket_id}/turn-comments. A solicitação requer turn_index com base zero (inteiro) e comment (string, de 1 a 10.000 caracteres).

Endpoints atualizados

ElevenAgents

  • Obter URL assinada - GET /v1/convai/conversation/get-signed-url
    • Adicionado debug_events_request opcional (booleano, padrão false). Eventos de depuração exigem acesso de editor ao agente.
  • Obter token WebRTC - GET /v1/convai/conversation/token
    • Adicionado debug_events_request opcional (booleano, padrão false). A rota legada GET /v1/convai/conversation/get_signed_url aceita o mesmo parâmetro.
  • Listar conversas - GET /v1/convai/conversations
    • Adicionado triggered_procedure_ids opcional (array de strings anulável, máximo de 50) para corresponder a conversas em que qualquer procedimento especificado foi executado.
    • Adicionado include_invalid_tool_calls opcional (booleano, padrão false) para incluir chamadas de ferramentas que não foram executadas.
    • Adicionado sort_direction opcional (asc ou desc, padrão desc) para o horário de início da chamada.
  • Pesquisar mensagens de conversa por texto - GET /v1/convai/conversations/messages/text-search
    • Adicionado triggered_procedure_ids opcional (array de strings anulável, máximo de 50).
    • Adicionado include_invalid_tool_calls opcional (booleano, padrão false).
  • Obter tópicos de conversa do agente - GET /v1/convai/agents/{agent_id}/topics
    • Adicionado include_evaluation_criteria opcional (booleano, padrão true).
    • Adicionado frustration a sort_by.
    • As respostas de tópicos adicionam success_rate anulável (número), enquanto a resposta geral adiciona aggregated_run_count (inteiro, padrão 0).
    • from_unix_secs é arredondado para baixo até o início do dia UTC correspondente. Um intervalo limitado agrega execuções diárias de descoberta concluídas; omitir ambos os limites retorna a execução mais recente.
  • Listar procedimentos (GET /v1/convai/agents/{agent_id}/branches/{branch_id}/procedures) e Obter procedimento (GET /v1/convai/agents/{agent_id}/branches/{branch_id}/procedures/{procedure_id})
    • Adicionado agent_version_id opcional anulável (string) para recuperar procedimentos de uma versão específica do agente.
  • Criar teste e Atualizar teste
    • Adicionado environment opcional anulável (string) aos esquemas de teste unitário de resposta, simulação e chamada de ferramenta. O valor seleciona URLs, cabeçalhos e conexões de autenticação específicos do ambiente; o padrão é production.
  • Criar documento a partir de URL, Criar tarefa de rastreamento e Criar pasta
    • Adicionado minimum_frequency_days opcional anulável (inteiro, de 1 a 180) para sincronização automática. O padrão é 7, e uma frequência mais restritiva da pasta pai tem precedência.

Música

  • Listar Finetunes de música - GET /v1/music/finetunes
    • Aumentado o máximo de page_size de 100 para 150. O padrão permanece 50.

Alterações no esquema

ElevenAgents

  • As solicitações de atualização de agente adicionam procedures opcional anulável (object<string, ProcedureVersionRef>). Cada valor requer procedure_id e version_id (strings). Um objeto vazio remove todos os procedimentos.
  • A configuração de inicialização de conversa adiciona enable_procedure_ids_from_client (booleano, padrão false). Os dados de inicialização adicionam procedure_ids opcional anulável (array de strings); um array vazio desativa todos os procedimentos para o agente inicial.
  • ClientEvent adiciona context_usage.
  • As substituições de tempo limite flexível adicionam additional_soft_timeout_messages opcional anulável (array de strings).
  • Valores constantes nos modelos de análise e substituição de esquema agora aceitam null.
  • Os padrões da configuração do widget para mic_muting_enabled e transcript_enabled foram alterados de false para true. Defina-os explicitamente como false para preservar o comportamento anterior.

Workspace

  • As respostas de Obter usuário removeram xi_api_key de UserResponseModel.
  • ResourceMetadataResponseModel.role_to_group_ids agora aceita IDs de função personalizados como chaves, em vez de restringir as chaves a admin, editor, commenter e viewer.
  • As respostas de publicação direta adicionam restricted_to_user_email_domains opcional anulável (array de strings).
  • As respostas de alteração de assinatura pendente adicionam go a next_tier.

Servidor MCP

  • Servidor MCP local descontinuado: O servidor MCP da ElevenLabs local e o player MCP foram descontinuados em favor do servidor MCP hospedado. Ambos os repositórios foram arquivados e não receberão mais atualizações. O servidor hospedado está disponível em https://api.elevenlabs.io/v1/mcp, permite entrar com sua conta ElevenLabs via OAuth e não exige instalação local nem chave de API. Consulte a documentação do servidor MCP hospedado para ver instruções de configuração para Claude, Cursor e outros clientes MCP.

ElevenCreative

  • APIs de geração de imagem, vídeo e fala: As novas APIs assíncronas de Flows criam, listam e recuperam gerações de vídeo, imagem e fala. As respostas de geração expõem os estados pending, generating, completed e failed, e as solicitações podem incluir um destino de webhook para eventos de conclusão.
  • Ativos de mídia reutilizáveis: As novas APIs de ativos fazem upload, listam, recuperam e excluem mídias do espaço de trabalho. Referências de imagem, vídeo e áudio podem usar um ativo enviado, uma geração anterior ou dados base64 inline, permitindo encadear tarefas de geração. Consulte Referências e ativos.

ElevenAgents

  • Resumos leves de conversas: Obter resumo da conversa retorna o título gerado, o resumo da transcrição, o resultado da chamada e mensagens simples do usuário ou agente sem carregar a transcrição completa. O parâmetro de consulta opcional max_messages é um inteiro de 1 a 200 (padrão 40); conversas mais longas definem messages_omitted como true. Útil para agentes que precisam preservar o contexto.
  • Paginação e ordenação de tópicos de conversa: Obter tópicos de conversa do agente adiciona paginação e ordenação opcionais por cursor. Use page_size (inteiro, 1–100), cursor (string), sort_by (conversations, sentiment ou success_rate) e sort_direction (asc ou desc). As respostas adicionam has_more e next_cursor anulável.
  • Filas de espera por concorrência: As configurações da plataforma de agentes adicionam queueing opcional (AgentQueueingConfig). Defina enabled como true para manter as pessoas que ligam em espera quando o agente atingir o limite de concorrência; wait_timeout_seconds é um inteiro de até 1.800 (padrão 180).
  • Controles de turnos e workflows: A configuração de turnos adiciona merge_with_default_ignore_terms (booleano, padrão false) para combinar termos de interrupção personalizados com padrões selecionados. Os tempos limite flexíveis adicionam disable_until_first_user_message (booleano, padrão false), e os localizadores de ferramentas de workflow adicionam schema_overrides opcional para substituições de parâmetros por nó.
  • Padrões de áudio de fundo: BackgroundSoundConfig.volume agora tem como padrão 0.15, em vez de 0.6, e crossfade_loop agora tem como padrão true, em vez de false. Defina esses campos explicitamente para manter o comportamento anterior.

Lançamentos de SDKs

SDK JavaScript

  • v2.64.0 - Adicionados client.assets para enviar, listar, recuperar e excluir ativos, além de client.flows para geração assíncrona de vídeo, imagem e fala. A configuração de turnos adiciona mergeWithDefaultIgnoreTerms. Removidos CustomToolApiSchemaConfig e scimExternalId de WorkspaceGroupResponseModel.

SDK Python

  • v2.64.0 - Adicionados clientes de ativos e Flows para geração assíncrona de vídeo, imagem e fala, além de merge_with_default_ignore_terms na configuração de turnos. A configuração de sessão on-premise adiciona extra_setup_config para transmitir campos adicionais de mensagens de configuração.

Pacotes

  • @elevenlabs/client@1.18.0, @elevenlabs/react@1.12.1, @elevenlabs/types@0.20.0, @elevenlabs/react-native@1.2.19, @elevenlabs/convai-widget-core@0.16.0 e @elevenlabs/convai-widget-embed@0.16.0 - Adicionadas sessões experimentais de orquestrador hospedado pelo próprio usuário e eventos de conteúdo avançado. Os worklets de áudio do Scribe agora podem ser hospedados pelo próprio usuário para políticas rígidas de segurança de conteúdo. O tratamento de desconexão agora alcança disconnected de forma consistente e evita que callbacks tardios limpem uma sessão mais recente. O widget renderiza respostas rápidas e links inline, restaura Markdown em transcrições de voz e corrige o posicionamento do menu de idiomas em layouts com container queries.
  • @elevenlabs/client@1.19.0, @elevenlabs/react@1.12.2, @elevenlabs/types@0.21.0, @elevenlabs/react-native@1.2.20 e @elevenlabs/convai-widget-core@0.16.1 - Adicionadas opções de Speech to Text em tempo real para idiomas secundários, detecção de entidades e filtragem de áudio de fundo. Adicionados eventos de transcrição final, entidade detectada e solicitação inválida; alinhados os tipos de palavras com marcação de tempo ao esquema ao vivo; e corrigidas falhas de permissão do microfone que impediam a reconexão de useScribe.

API

Ver alterações da API

Novos endpoints

ElevenCreative

  • Criar geração de vídeo - POST /v1/flows/video
  • Listar gerações de vídeo - GET /v1/flows/video
  • Obter geração de vídeo - GET /v1/flows/video/{generation_id}
  • Criar geração de imagem - POST /v1/flows/image
  • Listar gerações de imagem - GET /v1/flows/image
  • Obter geração de imagem - GET /v1/flows/image/{generation_id}
  • Criar geração de fala - POST /v1/flows/text-to-speech
  • Listar gerações de fala - GET /v1/flows/text-to-speech
  • Obter geração de fala - GET /v1/flows/text-to-speech/{generation_id}
  • Enviar ativo - POST /v1/assets
  • Listar ativos - GET /v1/assets
  • Obter ativo - GET /v1/assets/{asset_id}
  • Excluir ativo - DELETE /v1/assets/{asset_id}

ElevenAgents

  • Obter resumo da conversa - GET /v1/convai/conversations/{conversation_id}/summary
    • Aceita max_messages opcional (inteiro, 1–200, padrão 40)
    • Retorna GetConversationSummaryResponseModel com conversation_id, agent_id, status, message_count e note obrigatórios
    • As messages simples contêm apenas role (user ou agent) e message; conversas acima do limite retornam messages_omitted: true

Endpoints atualizados

ElevenAgents

  • Obter contagem ao vivo - GET /v1/convai/analytics/live-count
    • Adicionado agent_ids opcional (matriz de strings, máximo de 25), que tem precedência sobre agent_id
  • Obter tópicos de conversa do agente - GET /v1/convai/agents/{agent_id}/topics
    • Adicionados page_size opcional (inteiro, 1–100), cursor (string), sort_by (conversations, sentiment ou success_rate) e sort_direction (asc ou desc)
    • As respostas adicionam has_more (booleano, padrão false) e next_cursor anulável (string)

Alterações de esquema

ElevenAgents

  • Adicionado queueing opcional (AgentQueueingConfig) às configurações da plataforma de agentes. Ele contém enabled (booleano, padrão false) e wait_timeout_seconds (inteiro maior que 0 e no máximo 1.800, padrão 180)
  • Adicionado schema_overrides opcional a WorkflowToolLocator; substituições por nó de constante, variável dinâmica, LLM ou omissão têm precedência sobre substituições no nível da ferramenta
  • Adicionado merge_with_default_ignore_terms (booleano, padrão false) à configuração de turnos e aos esquemas de substituição relacionados
  • Adicionado disable_until_first_user_message (booleano, padrão false) à configuração de tempo limite flexível e aos esquemas de substituição relacionados
  • Adicionado status obrigatório e somente leitura (success, error, blocked ou skipped) aos eventos de resposta de ferramentas de agentes em tempo real
  • Adicionado avaya às fontes de início de conversa e avaya_api_key aos métodos de autorização
  • Adicionados gemini-3.6-flash e gemini-3.7-flash aos valores de LLM de agente compatíveis
  • Alterado o padrão de BackgroundSoundConfig.volume de 0.6 para 0.15 e o padrão de crossfade_loop de false para true
  • Removido CustomToolApiSchemaConfig; usuários do SDK gerado que importam esse tipo devem remover a importação
  • Removido scim_external_id de WorkspaceGroupResponseModel

API de Dubbing v2

O Dubbing v2 já está disponível pela API. Ele traduz áudio e vídeo para mais de 90 idiomas, preservando a voz, o tom e o ritmo de cada pessoa que fala.

A nova API baseada em projetos mantém transcrições e traduções de origem como JSON editável. Crie um projeto a partir de um arquivo ou URL, adicione um ou mais idiomas de destino, edite segmentos individuais da transcrição ou traduções e, depois, gere novamente apenas as regiões que foram alteradas. Siga o guia rápido de Dubbing para criar sua primeira dublagem.

Guia rápido

Crie seu primeiro projeto de Dubbing v2 e gere uma faixa de áudio traduzida.

Refinar e gerar novamente

Edite transcrições e traduções de origem e, depois, gere novamente as regiões alteradas.

Referência da API

Explore os endpoints de projeto, idioma e transcrição do Dubbing.

ElevenAgents

  • Filtros de guardrails de conversa: Listar conversas adiciona os parâmetros de consulta opcionais guardrail_types (GuardrailType[]) e custom_guardrail_names (matriz de strings). A hierarquia de conversas existente agora pode ser filtrada com o parâmetro opcional parent_conversation_id (string).
  • Status de divergência de ramificação: Listar ramificações do agente adiciona o parâmetro opcional include_commit_status (booleano, padrão false). Quando ativado, os resumos das ramificações incluem os campos anuláveis commits_ahead, commits_behind e merged_into_branch_id.
  • Controles de conversa e ferramentas: As substituições de cliente agora oferecem suporte a max_duration_seconds e pronunciation_dictionary_locators. A configuração do servidor MCP adiciona request_meta para transmitir valores MCP _meta a chamadas de ferramentas, e os tempos limite das ferramentas de webhook agora aceitam até 300 segundos.
  • Uso de análise pós-chamada: A cobrança de conversas adiciona uma divisão de analysis com totais acumulados por recurso e snapshots de execução. As mensagens da transcrição adicionam triggered_guardrails, e os turnos de conversa adicionam producing_llm opcional.

Vozes

  • Filtros de busca de vozes: Obter todas as vozes v2 adiciona os parâmetros de consulta opcionais gender, age, language, accent, use_cases, min_notice_period_days, include_custom_rates, include_live_moderated e high_quality.

Lançamentos de SDKs

SDK JavaScript

  • v2.63.0 - Adicionadas opções de Speech to Text em tempo real para idiomas secundários, detecção de idioma e entidades, filtragem de áudio de fundo, registros e autenticação com token de uso único. Adicionados eventos de transcrição final, entidade e solicitação inválida; corrigidos o envio de termos não aceitos, parâmetros audio_format duplicados e limites VAD inclusivos.
  • v2.62.0 - Adicionados métodos de atualização em massa de transcrições de Dubbing e DubbingRegenerateResponse; adicionados filtros de guardrail de conversa, status de commit de ramificações de agente, alertas de agente e suporte a MCP requestMeta. A criação de idioma de destino não aceita mais modelId.
  • v2.61.0 - Adicionados filtragem de hierarquia de conversas, cobrança de análise pós-chamada, metadados de guardrails acionados, detalhes de conflitos de mesclagem de ramificações, ocultação de entrada DTMF e uploads de transcrições de Dubbing. Removidos os tipos exportados de sessão em tempo real da OpenAI e as variantes de resultado de ferramenta run_subagent_*.

SDK Python

  • v2.63.0 - Adicionadas opções de Speech to Text em tempo real para idiomas secundários, detecção de idioma e entidades, filtragem de áudio de fundo, registros e autenticação com token de uso único. Adicionados eventos de transcrição final, entidade e solicitação inválida; corrigido o envio de termos não aceitos e agora são rejeitadas conexões sem uma chave de API ou token.
  • v2.62.0 - Adicionados métodos update_segments de Dubbing e DubbingRegenerateResponse; adicionados suporte a guardrail_types, custom_guardrail_names, include_commit_status e MCP request_meta. As atualizações de segmentos de Dubbing agora usam modelos de corpo de solicitação, e a criação de idioma de destino não aceita mais model_id.
  • v2.61.0 - Adicionados parent_conversation_id, cobrança de análise, metadados de guardrails acionados, conflitos de mesclagem de ramificações, ocultação de entrada DTMF e uploads de transcrições de Dubbing. Removidos os tipos de sessão em tempo real da OpenAI e os modelos de resultado run_subagent_*.

SDK Android

  • v0.12.1 - Corrigido o relato de desconexões intencionais de sessões apenas de texto como ConversationStatus.ERROR.
  • v0.12.0 - Adicionado ConversationConfig.useMediaStream para rotear o áudio da conversa pelo fluxo de mídia do Android. Fechamentos normais remotos de WebSocket agora informam DisconnectionDetails.Agent, enquanto fechamentos iniciados localmente informam DisconnectionDetails.User.

Servidor MCP

  • v0.12.2 - Corrigido um problema de travessia de caminho.

API

Ver alterações da API

Novos endpoints

Dubbing

  • Atualizar segmentos de origem em lote - PATCH /v1/dubbing/project/{project_id}/transcript/segments
    • Requer DubbingBulkSegmentUpdateRequest
    • Atualiza atomicamente o texto, a pessoa que fala ou a temporização dos segmentos de origem
    • Retorna DubbingBulkSourceSegmentUpdateResponse com os segments e a revision atualizados
  • Atualizar segmentos de destino em lote - PATCH /v1/dubbing/project/{project_id}/language/{language_id}/transcript/segments
    • Requer DubbingBulkTargetSegmentUpdateRequest
    • Atualiza atomicamente as traduções de vários segmentos de destino
    • Retorna DubbingBulkTargetSegmentUpdateResponse com os segments e a revision atualizados

Endpoints atualizados

ElevenAgents

  • Listar conversas - GET /v1/convai/conversations
    • Adicionado parent_conversation_id opcional (string)
    • Adicionados guardrail_types repetível opcional (GuardrailType[]) e custom_guardrail_names opcional (matriz de strings)
  • Listar ramificações do agente - GET /v1/convai/agents/{agent_id}/branches
    • Adicionado include_commit_status opcional (booleano, padrão false)
    • Os resumos das ramificações adicionam commits_ahead (inteiro), commits_behind (inteiro) e merged_into_branch_id (string) anuláveis

Vozes

  • Obter todas as vozes v2 - GET /v2/voices
    • Adicionados filtros opcionais gender, age e accent (string)
    • Adicionados filtros opcionais language e use_cases (matriz de strings)
    • Adicionados filtros opcionais min_notice_period_days (inteiro), include_custom_rates, include_live_moderated e high_quality (booleano)

Alterações de esquema

ElevenAgents

  • Os esquemas de substituição do cliente adicionam max_duration_seconds (inteiro) e pronunciation_dictionary_locators (matriz)
  • Os esquemas de entrada e saída do servidor MCP adicionam mapas request_meta
  • As configurações da plataforma de agentes adicionam alerting; a detecção de idioma adiciona only_at_conversation_start (booleano)
  • AnalysisCharging.last_run agora é obrigatório e não anulável; os totais acumulados adicionam runs obrigatório (inteiro)
  • As respostas de blocos RAG agora exigem content_format e document_type