ElevenAgents

  • Chamadas paralelas de ferramentas: A configuração de prompt do agente agora inclui enable_parallel_tool_calls (booleano, padrão true). Quando ativado, os modelos compatíveis podem executar várias ferramentas em um turno.
  • Modelos de agente: Adicionado gpt-6-astra às opções de LLM do agente.
  • Alertas: Os alertas do agente agora oferecem suporte a canais do Slack, além de notificadores do PagerDuty e webhooks.
  • Busca de números de telefone: Adicionado um endpoint de números de telefone com paginação por cursor e filtros de provedor, suporte a chamadas de saída, agente e ramificação atribuídos, rótulo e número de telefone.

Imagem e vídeo

  • Modelos GPT Image 2.5: A geração de imagens agora oferece suporte a gpt-image-2.5-flare e gpt-image-2.5-sunburst. Ambos os modelos aceitam até 10 imagens de referência, níveis de qualidade até max, 14 proporções fixas mais auto e saída em 1K, 2K ou 4K.

Speech Engine

  • Tempo limite de cascata: As solicitações de criação e atualização do Speech Engine agora aceitam cascade_timeout_seconds (número, 2–15, padrão 4) para controlar por quanto tempo a ElevenLabs aguarda um mecanismo de voz upstream antes de tentar novamente.

Text to Speech

  • Limites de turno em múltiplos contextos: O marcador is_final_audio_for_turn agora é emitido após cada byte armazenado em buffer para aquele turno, incluindo saídas MP3 e Opus. Os clientes podem usar o marcador como um limite exato de turno sem precisar mudar para PCM.

Lançamentos de SDKs

SDK JavaScript

  • v2.69.0 - Adicionado transcriptEdit ao wrapper de Speech to Text em tempo real, com texto editado entregue por eventos edited_transcript. Corrigida a verificação de JWT do Speech Engine para chaves de API com sufixos de residência de dados. Adicionados phoneNumbers.listV2 e métodos de modelos do Flows para listar e obter modelos, além de listar, criar e obter execuções. Clientes e tipos regenerados para GPT Image 2.5, alertas de agente no Slack, chamadas paralelas de ferramentas, gpt-6-astra, limites de simultaneidade de chaves de API de contas de serviço, retenção zero de Música, filtros de conversa e status de aprovação de ferramentas MCP.

SDK Python

  • v2.69.0 - Adicionado transcript_edit ao wrapper de Speech to Text em tempo real, com texto editado entregue por eventos edited_transcript. Corrigida a verificação de JWT do Speech Engine para chaves de API com sufixos de residência de dados, e play agora gera um erro quando ffplay falha. Adicionados phone_numbers.list_v2 e métodos de modelos do Flows para listar e obter modelos, além de listar, criar e obter execuções. Clientes e tipos regenerados para GPT Image 2.5, alertas de agente no Slack, chamadas paralelas de ferramentas, gpt-6-astra, limites de simultaneidade de chaves de API de contas de serviço, retenção zero de Música, filtros de conversa e status de aprovação de ferramentas MCP.

CLI da ElevenLabs

  • v1.3.2 - Adicionados metadados opcionais --intent para coletar feedback sobre o uso da CLI. Adicionado elevenlabs feedback missing-capability para relatar workflows que a CLI não oferece suporte.

API

Novos endpoints

ElevenAgents

  • Listar página de números de telefone - GET /v1/convai/v2/phone-numbers
    • Adicionados parâmetros de paginação page_size (inteiro, 1–1.000, padrão 100) e cursor (string anulável) opcionais.
    • Adicionados filtros opcionais search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by e sort_direction. sort_by aceita label ou phone_number; sort_direction tem como padrão asc.
    • A resposta contém phone_numbers (array) obrigatório, next_cursor (string) anulável e opcional, e has_more (booleano, padrão false).

Endpoints atualizados

ElevenAgents

  • Criar agente, Obter agente e Atualizar agente
    • A configuração de prompt adiciona enable_parallel_tool_calls (booleano, padrão true). As substituições de workflow aceitam um booleano anulável.
    • A enumeração LLM adiciona gpt-6-astra, incluindo substituições de início de conversa.
    • Os notificadores de integração de alertas agora usam integration_type para selecionar pagerduty ou slack. Os notificadores do Slack exigem connection_id e channel_id (strings); channel_id aceita de 1 a 64 caracteres.
  • Listar conversas e Resolver referência de conversa
    • data_collection_params não aceita mais o operador missing. Use um valor vazio para encontrar conversas nas quais o campo não foi coletado.
    • Um valor vazio em dynamic_variable_params encontra conversas em que a variável não foi definida.
  • Criar Speech Engine, Obter Speech Engine e Atualizar Speech Engine
    • Adicionado cascade_timeout_seconds (número, 2–15). As solicitações de criação usam 4 como padrão, as solicitações de atualização aceitam um valor anulável e as respostas exigem o campo.

Imagem e vídeo

  • Criar geração de imagem - POST /v1/flows/image
    • Adicionadas variantes de solicitação para gpt-image-2.5-flare e gpt-image-2.5-sunburst.
    • Ambas as variantes exigem prompt e model_id, aceitam até 10 images e adicionam resolution (1K, 2K ou 4K, padrão 1K).
    • quality aceita low, medium, high, xhigh ou max e tem como padrão high. aspect_ratio aceita auto e 14 proporções fixas, e tem como padrão 16:9.

Dublagem

Base de conhecimento

  • Criar tarefa de rastreamento - POST /v1/convai/knowledge-base/crawl
    • max_depth (inteiro, padrão 3) foi descontinuado. O campo agora não tem efeito e não possui mais restrições mínimas ou máximas.
    • Os metadados da tarefa de rastreamento não exigem mais max_depth.

Usuário

Alterações de esquema

Text to Speech

  • As mensagens WebSocket audio e final de múltiplos contextos agora definem is_final_audio_for_turn como ocorrendo após a entrega de todos os bytes armazenados em buffer para o turno.