Presentamos Music v2
Music v2 ya está disponible a través de la API de ElevenLabs. Establece model_id en music_v2 en Generar música, Transmitir música, Generar música detallada y Subir música para usar el nuevo modelo. Music v2 introduce planes de composición basados en bloques creados a partir de segmentos GenerationChunk y AudioRefChunk, lo que te ofrece un control más preciso de la estructura, el ritmo y los arreglos que el flujo music_v1 basado en prompts.
Usa planes de composición music_v2 en solicitudes de generación y subida, o genera primero un plan mediante la ruta de planes de composición. Los cuerpos de solicitud y respuesta aceptan formatos de plan v1 y v2, así que puedes migrar ruta por ruta. MusicPrompt sigue disponible solo para music_v1.
- Marcas de tiempo de subida: Subir música acepta
with_timestampsopcional; las respuestas pueden incluirwords_timestamps.
ElevenAgents
- Ejecutar evaluación de conversación: Se añadió la ruta Ejecutar evaluación de conversación (
POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run) para volver a ejecutar un único criterio de evaluación en una conversación completada medianteRunConversationEvaluationsRequest. - Comportamiento de entrada del workflow: Los nodos de agente de anulación del workflow añaden
entry_behavioropcional (generate_immediately,wait_for_user,auto) para controlar si el subagente habla primero o espera la entrada del usuario. - Herramienta de sistema para finalizar procedimientos: Se añadió la configuración de herramienta de sistema
end_procedurecon los estados de error correspondientes. La herramientastart_procedureañadealready_activea sus estados de error. - Anulaciones de TTS en transferencias:
AgentTransfer, los nodos de agente independiente del workflow y los resultados correctos de la herramientatransfer_to_agentañadenpreserve_client_tts_overridesopcional (booleano) para conservar las anulaciones de TTS del cliente tras una transferencia. - Enumeración de presupuesto de interacción:
InteractionBudgeteliminaasyncy añade5_minutes,10_minutesy1_hour. Actualiza cualquier configuración o enumeración de SDK que siga haciendo referencia aasync. - Selección de modelo de medidas de seguridad personalizadas: La configuración de medidas de seguridad personalizadas añade
modelopcional con variantes de Gemini, Claude y GPT. La configuración también añadehistory_message_countopcional (entero). - Filtros de lista de números de teléfono: Listar números de teléfono añade los parámetros de consulta opcionales
provider,agent_idybranch_idpara filtrar números importados. - Filtrado de cuentas de WhatsApp: Listar cuentas de WhatsApp añade el parámetro de consulta opcional
agent_idpara filtrar cuentas por agente asignado. - Filtros de intervalo temporal de temas: Obtener temas de conversaciones del agente añade los parámetros de consulta opcionales
from_unix_secsyto_unix_secspara delimitar los resultados de descubrimiento de temas. - Configuración de códecs SIP: Los modelos de solicitud y respuesta de troncales SIP salientes añaden
enabled_codecsopcional (enumeraciónMediaCodec). - Tipos de herramienta de memoria: Se añadieron los esquemas
LoadableMemoryEntryyLoadMemoryEntryToolErrorStatuspara la gestión de errores de herramientas de memoria. - Límites de lotes de pruebas de agentes: Los esquemas de solicitud para adjuntar, ejecutar y reenviar pruebas de agentes elevan el máximo de pruebas adjuntas de 1000 a 5000.
- Compatibilidad con etiquetas de fonemas: La configuración de TTS de agentes añade
enable_phoneme_tagsopcional (booleano) para activar de forma opcional el manejo de fonemas SSML V3. - Anulaciones de omisión del esquema de matrices: Las propiedades del esquema JSON de matrices añaden
is_omittedopcional (mutuamente excluyente con otras fuentes de valores).ConstantSchemaOverridepuede usar valores constantes de matriz. - Contexto de error de transferencia: Las cargas útiles de error de transferencia a número pueden incluir
agent_messageopcional (cadena).
Espacios de trabajo
- Actualizaciones de claves de API de cuentas de servicio: Actualizar clave de API de cuenta de servicio ya no requiere un cuerpo de solicitud. Los campos editables admiten actualizaciones parciales mediante
no_updateynameque admite valores nulos, incluidospermissionsycharacter_limit. - Agrupación de uso por zona horaria: Las solicitudes de uso del espacio de trabajo por producto a lo largo del tiempo añaden
time_zoneopcional (cadena de zona horaria IANA) con reglas aclaradas para los bloques deinterval_seconds. - Filtro de origen del historial: Los filtros
sourcede lista y detalle del historial añadenFlows.
ElevenCreative Studio
- Referencias de voz del proyecto: Los modelos de proyecto, los nodos TTS de capítulos, las listas de voces y las estadísticas de voz pasan a usar
project_voice_ref_idcomo campo canónico de voz. Los anteriores camposvoice_idpermanecen en las respuestas como réplicas de solo lectura obsoletas por compatibilidad.
Voz a Texto
- Diarización con biblioteca de hablantes: Convertir voz a texto añade
use_speaker_libraryopcional (booleano,falsede forma predeterminada) para la diarización de transcripciones por lotes.
Voces
- Ordenación de voces compartidas: El parámetro de consulta
sortde Listar voces compartidas incorpora una enumeración explícita, el valor predeterminadocreated_datey una descripción actualizada.
Lanzamientos de SDK
SDK de JavaScript
- v2.53.0 - Regenerado a partir del esquema OpenAPI más reciente con compatibilidad para volver a ejecutar evaluaciones de conversación, uniones de planes de composición de music v2,
entry_behaviorde workflow, filtros de lista de números de teléfono y WhatsApp, parámetros de intervalo temporal de temas, actualizaciones del esquema de alertas, camposproject_voice_ref_idde Studio y límites ampliados para lotes de pruebas de agentes.
SDK de Python
- v2.53.0 - Regenerado a partir del esquema OpenAPI más reciente con compatibilidad para volver a ejecutar evaluaciones de conversación, planes de composición de music v2, comportamiento de entrada de workflow y herramientas para finalizar procedimientos, parámetros de filtrado de telefonía, modelos de actualización parcial de alertas y cuentas de servicio, y campos de referencia de voz de Studio.
Paquetes
- @elevenlabs/client@1.11.0 - Se añadió la exportación de subruta
@elevenlabs/client/internal/unitypara el puente WebGL del SDK de Unity, que exponeMediaDeviceInput,MediaDeviceOutput, asistentes para adjuntar conexiones y tipos de adaptador WebRTC. - @elevenlabs/client@1.11.1, @elevenlabs/react@1.6.7, @elevenlabs/react-native@1.2.7, @elevenlabs/convai-widget-core@0.14.2 y @elevenlabs/convai-widget-embed@0.14.2 - Alineación de dependencias con
@elevenlabs/client@1.11.1y@elevenlabs/types@0.14.1. - @elevenlabs/types@0.14.1 - Se añadió
"license": "MIT"apackage.jsonpara garantizar la compatibilidad con license-checker.
SDK de iOS
- v3.2.1 - Se añadió compatibilidad con residencia de datos en Singapur y se habilitó
singlePeerConnectionpara sesiones WebRTC.
API
Ver cambios en la API
Nuevas rutas
ElevenAgents
- Ejecutar evaluación de conversación -
POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run- El cuerpo de la solicitud usa
RunConversationEvaluationsRequestpara volver a ejecutar un único criterio de evaluación
- El cuerpo de la solicitud usa
Rutas actualizadas
ElevenAgents
- Listar números de teléfono -
GET /v1/convai/phone-numbers- Se añadieron los parámetros de consulta opcionales
provider,agent_idybranch_id
- Se añadieron los parámetros de consulta opcionales
- Obtener temas de conversaciones del agente -
GET /v1/convai/agents/{agent_id}/topics- Se añadieron los parámetros de consulta opcionales
from_unix_secsyto_unix_secs
- Se añadieron los parámetros de consulta opcionales
- Listar cuentas de WhatsApp -
GET /v1/convai/whatsapp-accounts- Se añadió el parámetro de consulta opcional
agent_id
- Se añadió el parámetro de consulta opcional
Música
- Generar música, Generar música detallada, Transmitir música y Subir música
- Se añadió
music_v2a los valores compatibles demodel_id - La subida añade
with_timestampsopcional; las respuestas pueden incluirwords_timestamps
- Se añadió
Voz a Texto
- Convertir voz a texto -
POST /v1/speech-to-text- Se añadió el parámetro de consulta opcional
use_speaker_library(booleano,falsede forma predeterminada)
- Se añadió el parámetro de consulta opcional
Voces
- Listar voces compartidas -
GET /v1/shared-voices- El parámetro de consulta
sortahora usa una enumeración explícita concreated_datecomo valor predeterminado
- El parámetro de consulta
Cambios en los esquemas
ElevenAgents
- Nodos de agente de anulación del workflow
- Se añadió la enumeración opcional
entry_behavior(generate_immediately,wait_for_user,auto)
- Se añadió la enumeración opcional
- Herramientas de sistema
- Se añadieron la configuración de herramienta
end_procedurey estados de error
- Se añadieron la configuración de herramienta
- Esquemas de transferencia e interacción
- Se añadió
preserve_client_tts_overridesopcional en las transferencias y resultados de herramientas de transferencia InteractionBudgeteliminaasync; añade5_minutes,10_minutes,1_hour
- Se añadió
- Medidas de seguridad y TTS
- Las medidas de seguridad personalizadas añaden
modelehistory_message_countopcionales - La configuración de TTS de agentes añade
enable_phoneme_tagsopcional
- Las medidas de seguridad personalizadas añaden
- Telefonía
- Los modelos de troncales SIP añaden
enabled_codecsopcional (enumeraciónMediaCodec)
- Los modelos de troncales SIP añaden
- Herramientas de memoria y código
- Se añadieron
LoadableMemoryEntryyLoadMemoryEntryToolErrorStatus
- Se añadieron
- Pruebas de agentes
- Se elevaron los límites de pruebas adjuntas de 1000 a 5000 en las solicitudes de ejecución y reenvío
- Propiedades del esquema JSON de herramientas
- Las propiedades de matriz añaden
is_omittedopcional
- Las propiedades de matriz añaden
Espacios de trabajo
- Cuentas de servicio
- PATCH de clave de API admite actualizaciones parciales con valores centinela
no_update
- PATCH de clave de API admite actualizaciones parciales con valores centinela
- Uso e historial
- El uso por producto a lo largo del tiempo añade
time_zoneopcional - Los filtros
sourcedel historial añadenFlows
- El uso por producto a lo largo del tiempo añade
Música
- Planes de composición
- Se añadieron
CompositionPlan,GenerationChunkyAudioRefChunkbasados en bloques paramusic_v2 - Los cuerpos de solicitud y respuesta aceptan formatos de plan v1 o v2 mediante
anyOf
- Se añadieron
ElevenCreative Studio
- Modelos de voz de proyecto
- Se añadió
project_voice_ref_idcomo referencia de voz canónica - Se conservan en las respuestas las réplicas
voice_idobsoletas de solo lectura
- Se añadió