ElevenAgents

  • Evento WebSocket agent_response_complete: Um novo evento de cliente agent_response_complete é acionado exatamente uma vez quando a resposta de um agente é totalmente entregue — depois que toda a geração do LLM, as cadeias de chamadas de ferramentas e a reprodução de áudio forem concluídas. Após esse evento, o agente só produzirá mais conteúdo se o usuário fornecer uma nova entrada ou se o tempo limite de um turno acionar um novo turno. O evento permite que os clientes detectem com segurança o fim do turno para agrupar mensagens, ativar por palavra de ativação ou atualizar a interface após o turno. Adicionado um novo valor AGENT_RESPONSE_COMPLETE ao enum ClientEvent e um modelo de resposta AgentResponseCompleteClientEvent correspondente.

  • Modo de fala antes da ferramenta: Adicionado um novo campo pre_tool_speech (enum PreToolSpeechMode, padrão auto) à configuração do servidor MCP e às substituições por ferramenta. Substitui o booleano force_pre_tool_speech, agora descontinuado. Valores: auto decide se o agente fala antes da chamada da ferramenta com base na latência recente dela, force sempre solicita que o agente fale e off desativa totalmente esse comportamento.

  • O despacho de ferramentas respeita o modo de execução: Os nós de despacho de ferramentas do workflow agora respeitam corretamente o execution_mode de cada ferramenta aninhada. Se alguma ferramenta em um nó de despacho usar POST_TOOL_SPEECH, o workflow aguarda até que o áudio do turno atual seja totalmente exposto antes de executar o despacho.

  • Tempo limite de resposta do MCP: Adicionado um campo response_timeout_secs (inteiro, padrão 30, mínimo 5, máximo 120) à configuração do servidor MCP e às substituições por ferramenta, controlando o tempo máximo de espera pela conclusão de cada chamada de ferramenta MCP.

  • Contexto de confiança do agente: Adicionado um campo trust_context às configurações da plataforma do agente (enum AgentTrustContext: unknown | low | high, padrão unknown). low é destinado a agentes que atendem participantes externos não confiáveis, cujas saídas devem ser avaliadas e cujo acesso a ferramentas deve ser limitado; high é destinado a agentes que atendem o proprietário, quando o acesso completo a ferramentas é adequado; unknown abrange agentes criados antes desse recurso.

  • Alternância de atribuição de fontes: Adicionado um booleano source_attribution (padrão false) à configuração da conversa. Quando ativado e há conteúdo da base de conhecimento disponível, o LLM é instruído a informar quais fontes utilizou.

  • Filtro de modo de compartilhamento de testes: O endpoint listar testes agora aceita um parâmetro de consulta sharing_mode (all | shared_with_me, padrão all) para filtrar testes e pastas, mostrando apenas os que foram compartilhados com o usuário atual e não foram criados por ele.

  • Ícones de ferramentas e metadados de execução: Adicionados os campos icons (array de Icon) e execution (ToolExecution) ao esquema Tool. Icon inclui src, mimeType e sizes para exibição na interface, e ToolExecution.taskSupport (forbidden | optional | required) declara como a ferramenta participa das tarefas.

  • Padrão do compilador de procedimentos: O padrão de ProcedureCompilerMode mudou de deterministic para append, e o valor llm foi removido. Agentes existentes que definem explicitamente deterministic não são afetados.

  • Metadados de atribuição de RAG e base de conhecimento: Adicionados used_static_kb_document_ids (array de strings) a ConversationHistoryTranscriptCommonModel e ConversationHistoryTranscriptResponseModel, e used_chunk_ids a RagRetrievalInfo, mostrando exatamente quais documentos da base de conhecimento e chunks de RAG contribuíram para cada turno da transcrição.

  • Refatoração de variáveis dinâmicas: dynamic_variables e dynamic_variable_placeholders agora fazem referência aos esquemas unificados DynamicVariableValueType-Input / DynamicVariableValueType-Output (substituindo os esquemas anteriores DynamicVariableContainerValueType-*), com suporte ampliado a valores aninhados e listas. DynamicVariableAssignment recebeu um campo preserve_native_type para manter valores tipados em vez de convertê-los em strings.

Isolamento de Áudio

  • Endpoints de histórico: Dois novos endpoints expõem seu histórico de isolamento de áudio.

Speech to Text

  • Termos-chave em tempo real e modo literal: O WebSocket em tempo real do Scribe agora aceita um parâmetro keyterms (array de strings, no máximo 50 entradas de até 20 caracteres cada) para direcionar o modelo a termos específicos, e um booleano no_verbatim para remover palavras de preenchimento, falsos começos e disfluências das transcrições. Ambos os parâmetros são retornados no evento session_started. Disponível no SDK JavaScript, SDK Python e SDK de cliente para navegador/Node @elevenlabs/client.

Lançamentos de SDKs

SDK Python

  • v2.45.0 - Regeneração do Fern para o esquema da API de 27 de abril de 2026, incluindo endpoints de histórico de isolamento de áudio, execuções de ferramentas, pre_tool_speech e response_timeout_secs do MCP, além do evento de cliente agent_response_complete. Também inclui uma correção na dica de instalação em notebooks no README.
  • v2.44.0 - Regeneração do Fern para o esquema da API de 21 de abril de 2026, incluindo o campo trust_context, o modo pre_tool_speech, suporte à transcrição de ativos e a configuração de tempo limite de resposta do MCP.

SDK JavaScript

  • v2.45.0 - Adicionadas as opções keyterms (array de strings, no máximo 50 termos-chave de até 20 caracteres cada) e noVerbatim (booleano) ao cliente em tempo real do Scribe. keyterms é enviado como parâmetros de consulta repetidos na URL do WebSocket para direcionar a transcrição, e noVerbatim remove palavras de preenchimento e disfluências. Ambos os campos também foram adicionados à interface tipada Config para o retorno de session_started. Também inclui a regeneração do Fern de 27 de abril de 2026 (#376).
  • v2.44.0 - Regeneração do Fern para o esquema da API de 21 de abril de 2026, incluindo o campo trust_context, o modo pre_tool_speech e a configuração de tempo limite de resposta do MCP.

SDK Swift

  • v3.1.4 - Corrigido um problema em que o microfone local continuava transmitindo após a desconexão de um agente (tempo limite de silêncio ou ferramenta end_call). onAgentDisconnected agora desconecta a sala do LiveKit e encerra o estado da conversa, com onDisconnect acionando um motivo .agent. ConnectionManaging.onAgentDisconnected agora é async. Removido o wrapper ConversationConnectionManager, que não era usado.

Pacotes

API

Novos endpoints

Endpoints atualizados

ElevenAgents

  • Criar agente, Obter agente, Atualizar agente

    • Adicionado o campo trust_context (enum AgentTrustContext: unknown | low | high, padrão unknown) a AgentPlatformSettingsRequestModel
    • Adicionado o campo source_attribution (booleano, padrão false) a ConversationConfig
  • Atualizar configuração do servidor MCP, Criar servidor MCP

    • Adicionado o campo pre_tool_speech (enum PreToolSpeechMode: auto | force | off, padrão auto)
    • Adicionado o campo response_timeout_secs (inteiro, padrão 30, mínimo 5, máximo 120)
  • Criar substituição de configuração, Atualizar substituição de configuração

    • Adicionado o campo pre_tool_speech (enum PreToolSpeechMode, anulável, opcional)
    • Adicionado o campo response_timeout_secs (inteiro, anulável, opcional)
    • Adicionado o campo response_mocks a MCPToolConfigOverride-Input / MCPToolConfigOverride-Output
    • force_pre_tool_speech foi marcado como descontinuado; use pre_tool_speech em seu lugar
  • Listar testes

    • Adicionado o parâmetro de consulta opcional sharing_mode (enum TestSharingMode: all | shared_with_me, padrão all)
  • Simular conversa, Transmitir simulação de conversa

    • Refatoradas as cargas úteis de dynamic_variables e dynamic_variable_placeholders para fazer referência aos esquemas unificados DynamicVariableValueType-Input / DynamicVariableValueType-Output, com suporte ampliado a valores aninhados e listas
  • Esquema Tool

    • Adicionado o campo icons (array de Icon, anulável) para exibição na interface
    • Adicionado o campo execution (ToolExecution, anulável), incluindo taskSupport (forbidden | optional | required)
  • Enum ClientEvent

    • Adicionado o valor agent_response_complete com o novo modelo de resposta AgentResponseCompleteClientEvent
  • Enum ProcedureCompilerMode

    • O padrão mudou de deterministic para append
    • Removido o valor llm
  • ConversationHistoryTranscriptCommonModel, ConversationHistoryTranscriptResponseModel

    • Adicionado o campo used_static_kb_document_ids (array de strings)
  • RagRetrievalInfo

    • Adicionado o campo used_chunk_ids (array de strings)
  • DynamicVariableAssignment

    • Adicionado o campo preserve_native_type (booleano) para manter valores tipados em vez de convertê-los em strings
  • Nós de workflow

    • Adicionado o campo auto_advance_after_first_response aos esquemas relevantes de nós de workflow
  • Documentação de configuração de ferramentas

    • Adicionado o campo response_body_schema para documentar o formato esperado da resposta

Espaços de trabalho

  • GetUserSubscriptionResponseModel

    • Adicionado o campo max_credit_limit_extension
  • Obter uso do espaço de trabalho por produto ao longo do tempo

    • Validação da solicitação mais rigorosa: os mínimos de start_time e end_time foram elevados para 2020-01-01, com descrições adicionadas a ambos os campos. O resumo do endpoint foi renomeado para Get Workspace Usage.

Outros

  • Novo enum compartilhado Currency com os valores eur, inr, usd, substituindo strings de moeda embutidas em vários esquemas.
  • Novos esquemas AssetTranscription e AssetTranscriptionData estendem modelos de ativos com suporte à transcrição.
  • Novos PendingBlocksMetadataModel e PendingExternalAudiosMetadataModel fornecem metadados mais completos sobre tarefas pendentes.
  • Novo valor InVPC adicionado a enums relacionados a fontes.
  • keyterms de transcrição agora tem restrições explícitas de tamanho na especificação.
  • Adicionados os novos esquemas MemoryEntrySearchResult, ConversationSource e ManualSource.