Apresentando o Speech Engine
O ElevenLabs Speech Engine adiciona voz em tempo real ao seu próprio agente de chat ou LLM. A ElevenLabs cuida da conversão de fala em texto, alternância de turnos, conversão de texto em fala e reprodução no navegador, enquanto seu servidor controla a lógica do agente e transmite o texto de resposta por um WebSocket do Speech Engine. Use-o quando quiser adicionar voz a uma infraestrutura personalizada, em vez de uma configuração totalmente hospedada do ElevenAgents.
ElevenAgents
- Substituições de comportamento de texto: Adicionado
text_behavior_overrides, um mapa porConversationInitiationSourcede objetosBehaviorOverridecom campos opcionaisverbosity,output_formateinteraction_budgetpara o comportamento do agente específico de cada canal. - Fontes de integração: Adicionados Intercom, Telegram e Freshdesk.
- Rastreios de conversa OTLP: Obter detalhes da conversa agora aceita um parâmetro de consulta opcional
format. Definaformat=otlp_tracespara retornar dados de rastreio compatíveis com OTLP junto à carga padrão da conversa. - Substituições de palavras-chave do ASR: Adicionados os esquemas
ASRConversationalConfigOverrideeASRConversationalConfigOverrideConfigcom matrizes opcionaiskeywords, integrados aos modelos de substituição de cliente da configuração de conversa. - Metadados de autenticação de webhook: Os esquemas de configuração de ferramentas de webhook agora expõem
auth_resolved_paramsopcional (matriz de strings), documentando os marcadores de posição de URL resolvidos pela conexão de autenticação.
Música
- Modo de geração: Adicionado
MusicGenerationMode(track,loop,ambience) e um campo opcionalgeneration_modenos corpos de solicitação de prompt de música. - Modelo de vídeo para música: Vídeo para música (
POST /v1/music/video-to-music) agora aceitamodel_idopcional (string, padrãomusic_v1).
ElevenCreative Studio
- Créditos de conversão: Os modelos de resposta de estatísticas de conversão de capítulos e vozes agora incluem
credits_needed_to_convertopcional (inteiro), que indica os créditos necessários antes da conversão.
Espaços de trabalho
- Tipos de recurso: Adicionado
studio_projectsaWorkspaceResourceType.
Lançamentos de SDK
SDK Python
- v2.50.0 - SDK regenerado para o esquema da API de 25 de maio de 2026.
- v2.49.1 - Chamadas da API do Speech Engine atualizadas para retornar o objeto de resposta completo.
- v2.49.0 - SDK regenerado para o esquema da API de 18 a 25 de maio de 2026, incluindo substituições de comportamento de texto do ElevenAgents,
generation_modede música estudio_projectsde espaços de trabalho.
SDK JavaScript
- v2.50.0 - Adicionados métodos e testes ausentes da API de Música, e SDK regenerado para o esquema da API de 25 de maio de 2026.
- v2.49.1 - Chamadas da API do Speech Engine atualizadas para retornar o objeto de resposta completo.
- v2.49.0 - SDK regenerado para o esquema da API de 18 a 25 de maio de 2026, incluindo substituições de comportamento de texto do ElevenAgents,
generation_modede música estudio_projectsde espaços de trabalho.
Pacotes
- @elevenlabs/client@1.8.1 - Corrigido o Safari no iOS, que descartava a primeira mensagem do agente em sessões de voz por WebSocket, desbloqueando um
AudioContextno primeiro gesto do usuário e inicializando o grafo de reprodução após o carregamento do audio worklet. - @elevenlabs/convai-widget-core@0.12.8 e @elevenlabs/convai-widget-embed@0.12.8 - Estilizadas tags de emoção e áudio em transcrições de voz quando
strip_audio_tagsestá desativado, e tratadosterms_htmlouterms_textnulos no nível superior como um interruptor de desativação para o modal de termos e condições. - @elevenlabs/convai-widget-core@0.12.7 e @elevenlabs/convai-widget-embed@0.12.7 - Dependências do widget atualizadas para
@elevenlabs/client@1.8.1.
API
Ver alterações da API
Endpoints e esquemas atualizados
ElevenAgents
- Obter detalhes da conversa -
GET /v1/convai/conversations/{conversation_id}- Adicionado o parâmetro de consulta opcional
format;otlp_tracesretorna dados de rastreio compatíveis com OTLP
- Adicionado o parâmetro de consulta opcional
- Esquemas de configuração do agente
- Adicionado o mapa
text_behavior_overrides, indexado porConversationInitiationSource, com valoresBehaviorOverride(verbosity,output_format,interaction_budget)
- Adicionado o mapa
- Enum
ConversationInitiationSource- Adicionados
intercom_integration,telegram_integrationefreshdesk_integration
- Adicionados
- Esquemas de substituição do ASR
- Adicionados
ASRConversationalConfigOverrideeASRConversationalConfigOverrideConfigcomkeywordsopcional (matriz de strings)
- Adicionados
- Esquemas de ferramentas de webhook
- Adicionado
auth_resolved_paramsopcional (matriz de strings) aos modelos de configuração de webhook
- Adicionado
Música
- Vídeo para música -
POST /v1/music/video-to-music- Adicionado
model_idopcional (string, padrãomusic_v1)
- Adicionado
- Esquemas de solicitação de prompt de música
- Adicionado
generation_modeopcional que faz referência aMusicGenerationMode(track,loop,ambience)
- Adicionado
ElevenCreative Studio
- Esquemas de estatísticas de conversão de capítulos e vozes
- Adicionado
credits_needed_to_convertopcional (inteiro)
- Adicionado
Espaços de trabalho
- Enum
WorkspaceResourceType- Adicionado
studio_projects
- Adicionado