Apresentamos o Music v2
O Music v2 agora está disponível pela API da ElevenLabs. Defina model_id como music_v2 em Gerar música, Transmitir música, Gerar música detalhada e Fazer upload de música para usar o novo modelo. O Music v2 apresenta planos de composição baseados em chunks, criados a partir dos segmentos GenerationChunk e AudioRefChunk, proporcionando controle mais preciso sobre estrutura, ritmo e arranjo do que o fluxo music_v1 baseado em prompt.
Use planos de composição music_v2 em solicitações de geração e upload ou gere primeiro um plano pelo endpoint de plano de composição. Os corpos de solicitação e resposta aceitam formatos de plano v1 ou v2, para que você possa migrar endpoint por endpoint. MusicPrompt continua disponível apenas para music_v1.
- Timestamps no upload: Fazer upload de música aceita
with_timestampsopcional; as respostas podem incluirwords_timestamps.
ElevenAgents
- Executar avaliação de conversa: Adicionado o endpoint Executar avaliação de conversa (
POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run) para executar novamente um único critério de avaliação em uma conversa concluída usandoRunConversationEvaluationsRequest. - Comportamento de entrada no workflow: Os nós de agente substituto do workflow adicionam
entry_behavioropcional (generate_immediately,wait_for_user,auto) para controlar se o subagente fala primeiro ou aguarda a entrada do usuário. - Ferramenta de sistema para encerrar procedimento: Adicionada a configuração da ferramenta de sistema
end_procedurecom status de erro correspondentes. A ferramentastart_procedureadicionaalready_activeaos seus status de erro. - Substituições de TTS na transferência:
AgentTransfer, nós de agente independente do workflow e resultados bem-sucedidos da ferramentatransfer_to_agentadicionampreserve_client_tts_overridesopcional (booleano) para manter as substituições de TTS no cliente após uma transferência. - Enum de orçamento de interação:
InteractionBudgetremoveasynce adiciona5_minutes,10_minutese1_hour. Atualize configurações ou enums de SDK que ainda façam referência aasync. - Seleção de modelo de guardrail personalizado: A configuração de guardrail personalizado adiciona
modelopcional com variantes Gemini, Claude e GPT. A configuração de guardrail também adicionahistory_message_countopcional (inteiro). - Filtros de lista de números de telefone: Listar números de telefone adiciona os parâmetros de consulta
provider,agent_idebranch_idopcionais para filtrar números importados. - Filtragem de contas do WhatsApp: Listar contas do WhatsApp adiciona o parâmetro de consulta
agent_idopcional para filtrar contas por agente atribuído. - Filtros de intervalo de tempo de tópicos: Obter tópicos de conversa do agente adiciona os parâmetros de consulta
from_unix_secseto_unix_secsopcionais para delimitar os resultados de descoberta de tópicos. - Configuração de codec SIP: Os modelos de solicitação e resposta do tronco SIP de saída adicionam
enabled_codecsopcional (enumMediaCodec). - Tipos de ferramenta de memória: Adicionados os schemas
LoadableMemoryEntryeLoadMemoryEntryToolErrorStatuspara tratamento de erros da ferramenta de memória. - Limites de lote de testes de agente: Os schemas de solicitação para anexar, executar e reenviar testes de agente aumentam o máximo de testes anexados de 1000 para 5000.
- Suporte a tags de fonemas: As configurações de TTS do agente adicionam
enable_phoneme_tagsopcional (booleano) para ativar o tratamento de fonemas SSML do V3. - Substituições de omissão no schema de arrays: As propriedades do schema JSON de array adicionam
is_omittedopcional (mutuamente exclusivo com outras fontes de valor).ConstantSchemaOverridepode usar valores constantes de array. - Contexto de erro de transferência: As cargas úteis de erro de transferência para número podem incluir
agent_messageopcional (string).
Workspaces
- Atualizações de chave de API de conta de serviço: Atualizar chave de API de conta de serviço não exige mais um corpo de solicitação. Os campos de edição oferecem suporte a atualizações parciais por meio de
no_updateenameque aceita nulo, incluindopermissionsecharacter_limit. - Agrupamento por fuso horário de uso: As solicitações de uso do workspace por produto ao longo do tempo adicionam
time_zoneopcional (string de fuso horário IANA) com regras esclarecidas para os buckets deinterval_seconds. - Filtro de origem do histórico: Os filtros
sourcede lista e detalhes do histórico adicionamFlows.
ElevenCreative Studio
- Referências de voz do projeto: Modelos de projeto, nós de TTS de capítulo, listas de vozes e estatísticas de voz passam a usar
project_voice_ref_idcomo o campo de voz canônico. Os antigos camposvoice_idpermanecem nas respostas como espelhos obsoletos e somente leitura, para compatibilidade.
Speech to Text
- Diarização com biblioteca de locutores: Converter fala em texto adiciona
use_speaker_libraryopcional (booleano, padrãofalse) para diarização de transcrições em lote.
Vozes
- Ordenação de vozes compartilhadas: O parâmetro de consulta
sortde Listar vozes compartilhadas recebe um enum explícito, o padrãocreated_datee uma descrição atualizada.
Lançamentos de SDKs
SDK JavaScript
- v2.53.0 - Regenerado a partir do schema OpenAPI mais recente, com suporte para reexecução de avaliação de conversa, uniões de plano de composição do music v2,
entry_behaviorde workflow, filtros de lista de números de telefone e WhatsApp, parâmetros de intervalo de tempo de tópicos, atualizações de schema de alertas, camposproject_voice_ref_iddo Studio e limites expandidos de lotes de testes de agentes.
SDK Python
- v2.53.0 - Regenerado a partir do schema OpenAPI mais recente, com suporte para reexecução de avaliação de conversa, planos de composição do music v2, comportamento de entrada no workflow e ferramentas de encerramento de procedimento, parâmetros de filtro de telefonia, modelos de atualização parcial de alertas e contas de serviço e campos de referência de voz do Studio.
Pacotes
- @elevenlabs/client@1.11.0 - Adicionada a exportação de subcaminho
@elevenlabs/client/internal/unitypara a ponte WebGL do SDK Unity, expondoMediaDeviceInput,MediaDeviceOutput, auxiliares de anexação de conexão e tipos de adaptador WebRTC. - @elevenlabs/client@1.11.1, @elevenlabs/react@1.6.7, @elevenlabs/react-native@1.2.7, @elevenlabs/convai-widget-core@0.14.2 e @elevenlabs/convai-widget-embed@0.14.2 - Alinhamento de dependências com
@elevenlabs/client@1.11.1e@elevenlabs/types@0.14.1. - @elevenlabs/types@0.14.1 - Adicionado
"license": "MIT"aopackage.jsonpara compatibilidade com o license-checker.
SDK iOS
- v3.2.1 - Adicionado suporte à residência de dados em Singapura e ativado
singlePeerConnectionpara sessões WebRTC.
API
Ver alterações da API
Novos endpoints
ElevenAgents
- Executar avaliação de conversa -
POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run- O corpo da solicitação usa
RunConversationEvaluationsRequestpara executar novamente um único critério de avaliação
- O corpo da solicitação usa
Endpoints atualizados
ElevenAgents
- Listar números de telefone -
GET /v1/convai/phone-numbers- Adicionados os parâmetros de consulta
provider,agent_idebranch_idopcionais
- Adicionados os parâmetros de consulta
- Obter tópicos de conversa do agente -
GET /v1/convai/agents/{agent_id}/topics- Adicionados os parâmetros de consulta
from_unix_secseto_unix_secsopcionais
- Adicionados os parâmetros de consulta
- Listar contas do WhatsApp -
GET /v1/convai/whatsapp-accounts- Adicionado o parâmetro de consulta
agent_idopcional
- Adicionado o parâmetro de consulta
Música
- Gerar música, Gerar música detalhada, Transmitir música e Fazer upload de música
- Adicionado
music_v2aos valores compatíveis demodel_id - O upload adiciona
with_timestampsopcional; as respostas podem incluirwords_timestamps
- Adicionado
Speech to Text
- Converter fala em texto -
POST /v1/speech-to-text- Adicionado o parâmetro de consulta
use_speaker_libraryopcional (booleano, padrãofalse)
- Adicionado o parâmetro de consulta
Vozes
- Listar vozes compartilhadas -
GET /v1/shared-voices- O parâmetro de consulta
sortagora usa um enum explícito comcreated_datecomo padrão
- O parâmetro de consulta
Alterações no schema
ElevenAgents
- Nós de agente substituto do workflow
- Adicionado enum
entry_behavioropcional (generate_immediately,wait_for_user,auto)
- Adicionado enum
- Ferramentas de sistema
- Adicionada configuração da ferramenta
end_proceduree status de erro
- Adicionada configuração da ferramenta
- Schemas de transferência e interação
- Adicionado
preserve_client_tts_overridesopcional em transferências e resultados da ferramenta de transferência InteractionBudgetremoveasync; adiciona5_minutes,10_minutes,1_hour
- Adicionado
- Guardrails e TTS
- Guardrails personalizados adicionam
modelehistory_message_countopcionais - As configurações de TTS do agente adicionam
enable_phoneme_tagsopcional
- Guardrails personalizados adicionam
- Telefonia
- Os modelos de tronco SIP adicionam
enabled_codecsopcional (enumMediaCodec)
- Os modelos de tronco SIP adicionam
- Ferramentas de memória e código
- Adicionados
LoadableMemoryEntryeLoadMemoryEntryToolErrorStatus
- Adicionados
- Testes de agentes
- Aumentados os limites de testes anexados de 1000 para 5000 em solicitações de execução e reenvio
- Propriedades do schema JSON de ferramentas
- As propriedades de array adicionam
is_omittedopcional
- As propriedades de array adicionam
Workspaces
- Contas de serviço
- PATCH de chave de API oferece suporte a atualizações parciais com sentinelas
no_update
- PATCH de chave de API oferece suporte a atualizações parciais com sentinelas
- Uso e histórico
- Uso por produto ao longo do tempo adiciona
time_zoneopcional - Filtros
sourcedo histórico adicionamFlows
- Uso por produto ao longo do tempo adiciona
Música
- Planos de composição
- Adicionados
CompositionPlan,GenerationChunkeAudioRefChunkbaseados em chunks paramusic_v2 - Os corpos de solicitação e resposta aceitam formatos de plano v1 ou v2 via
anyOf
- Adicionados
ElevenCreative Studio
- Modelos de voz do projeto
- Adicionado
project_voice_ref_idcomo referência de voz canônica - Espelhos
voice_idobsoletos e somente leitura são mantidos nas respostas
- Adicionado