Música

  • API de Music Finetunes: Se ha añadido compatibilidad de API para gestionar Music Finetunes. Cinco endpoints permiten crear un Finetune a partir de audio subido, listar los Finetunes accesibles, consultar el estado del entrenamiento, actualizar los metadatos y la visibilidad, o eliminar un Finetune. Todos los métodos de SDK de generación de música ahora exponen finetune_id.

ElevenAgents

  • Resolver referencias externas de conversaciones: Se ha añadido GET /v1/convai/conversations/resolve para resolver la URL de un mensaje de Slack o la URL de un ticket de Zendesk en una conversación. Las solicitudes requieren los parámetros de consulta agent_id y reference (cadenas).
  • Consultar las bases de conocimientos de agentes: Se ha añadido POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query para realizar consultas RAG de solo lectura en la base de conocimientos de un agente. La solicitud requiere query (cadena), acepta branch_id opcional (cadena) y devuelve fragmentos ordenados con metadatos de documento, fragmento, texto y distancia vectorial. Este endpoint queda excluido de los SDK generados.
  • Formatos de contenido de la base de conocimientos: Las respuestas de archivos, texto y URL de la base de conocimientos añaden content_format opcional (html | markdown, html de forma predeterminada).
  • Configuración de voz del agente: Los esquemas de anulación de TTS añaden model_id opcional que el cliente puede anular (TTSConversationalModel). El valor predeterminado de enable_phoneme_tags cambia de false a true.
  • Cascada de LLM de respaldo más rápida: El valor predeterminado de cascade_timeout_seconds cambia de 8 a 4 segundos. El rango permitido sigue siendo de 2 a 15 segundos.
  • Fuentes de valores de parámetros de herramientas: Los parámetros de herramientas de objeto ahora pueden usar dynamic_variable, constant_value o is_omitted, en línea con los controles existentes para escalares y matrices. Las anulaciones de esquema de constantes ahora aceptan matrices y objetos arbitrarios.
  • Protecciones para respuestas completas: Las protecciones personalizadas añaden evaluate_full_response_only opcional (booleano, false de forma predeterminada) para evaluar una vez la respuesta completa que no es TTS. Esta opción requiere el modo de bloqueo.
  • Grabación de llamadas de Twilio: La configuración de llamadas de telefonía añade twilio_call_recording_enabled opcional (booleano, false de forma predeterminada). Las grabaciones se almacenan en la cuenta de Twilio conectada y otros proveedores ignoran esta configuración.
  • Texto de carga de archivos del widget: La configuración de texto del widget añade etiquetas y mensajes de error opcionales para adjuntar y eliminar archivos, fallos de carga, tipos incompatibles, archivos demasiado grandes, límites de número de archivos e indicador de escritura.
  • Estado de sincronización de la base de conocimientos: Las respuestas de archivos de la base de conocimientos añaden auto_sync_info y refresh_status opcionales (FileRefreshStatus). Las respuestas de carpetas añaden document_count obligatorio (entero), un recuento recursivo de documentos que no son carpetas limitado a 1000.
  • Filtros de búsqueda de texto en conversaciones: Buscar texto en mensajes de conversación añade los parámetros de consulta de matriz exclude_statuses y termination_reasons opcionales.
  • Opciones de LLM: La configuración de LLM del agente añade gpt-5.6-sol, gpt-5.6-terra y gpt-5.6-luna. LLMReasoningEffort añade max.
  • Indicadores de escritura de WhatsApp: Los esquemas de solicitud y respuesta de cuentas de WhatsApp añaden enable_typing_indicator opcional (booleano).

Voz a Texto

  • Autenticación por lotes de un solo uso: Convertir voz a texto añade token opcional (cadena) como alternativa a la autenticación mediante clave de API o bearer. Crea el token de un solo uso con POST /v1/single-use-token/batch_scribe; caduca a los 15 minutos.
  • Fiabilidad del cliente en tiempo real: @elevenlabs/client ahora informa de errores de configuración del micrófono y errores de servidor malformados mediante RealtimeEvents.ERROR, libera los recursos del micrófono después de fallos de configuración y cierres de conexión, y descarta los fotogramas de micrófono tardíos tras el cierre del socket.

Texto a Voz

Espacios de trabajo

  • Suscripciones a eventos de webhooks: Las solicitudes de Actualizar webhook del espacio de trabajo añaden events opcional (WorkspaceWebhookEventType[]) con voice_library_removal_notice, speech_to_text y agent_qa. Las respuestas de webhooks pueden devolver la lista de eventos suscritos.
  • Dimensiones de analítica de uso: Obtener uso del espacio de trabajo añade surface y actor a los valores de group_by.
  • Eliminar límites de cuentas de servicio: Actualizar clave de API de cuenta de servicio acepta character_limit: "clear" para eliminar un límite mensual de caracteres, junto con "no_update" y valores enteros.
  • Referencias de webhook de alertas: Los esquemas de notificadores de webhook de alertas ahora identifican un webhook del espacio de trabajo con webhook_id obligatorio (cadena), en lugar de incorporar url, method y headers.

Lanzamientos de SDK

SDK de JavaScript

  • v2.59.0 - Se han añadido métodos music.finetunes para listar, crear, obtener, actualizar y eliminar Music Finetunes. También se han añadido resolución de referencias de conversaciones, filtrado de diccionarios de pronunciación archivados y tokens de Voz a Texto de un solo uso.

SDK de Python

  • v2.59.0 - Se han añadido Music Finetunes y resolución de referencias de conversaciones a partir del esquema de API más reciente. OnPremInitiationData también añade configuraciones tipadas de post_call_transcription_webhook y post_call_audio_webhook con hmac_secret opcional para webhooks firmados posteriores a la llamada.

Paquetes

SDK de Android

  • v0.11.1 - Se ha evitado que R8 y ProGuard ofusquen los campos de eventos salientes de WebSocket y WebRTC, como text y type.

CLI

  • @elevenlabs/cli@0.5.6 - Se han actualizado las plantillas de agentes predeterminadas para usar scribe_realtime en lugar del proveedor de ASR elevenlabs eliminado. Las plantillas mínimas siguen usando el valor predeterminado del servidor.

API

Nuevos endpoints

Música

ElevenAgents

  • GET /v1/convai/conversations/resolve
    • Requiere los parámetros de consulta agent_id (cadena) y reference (cadena)
    • Devuelve GetConversationResponseModel
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • Requiere query (cadena) en el cuerpo de la solicitud
    • Acepta el parámetro de consulta branch_id opcional (cadena)
    • Devuelve AgentKnowledgeBaseRagQueryResponseModel
    • Excluido de los SDK generados

Endpoints actualizados

ElevenAgents

Voz a Texto

  • Convertir voz a texto - POST /v1/speech-to-text
    • Se ha añadido el parámetro de consulta token opcional (cadena) para un token de Scribe por lotes de un solo uso

Texto a Voz

Espacios de trabajo

Cambios en los esquemas

ElevenAgents

  • Los esquemas de respuesta de la base de conocimientos de ElevenAgents añaden content_format opcional (html | markdown, html de forma predeterminada)
  • Las respuestas de archivos de la base de conocimientos añaden auto_sync_info y refresh_status opcionales (FileRefreshStatus)
  • Las respuestas de carpetas de la base de conocimientos añaden document_count obligatorio (entero)
  • Los esquemas de anulación de TTS del agente añaden model_id opcional (TTSConversationalModel)
  • enable_phoneme_tags de TTS del agente ahora tiene true como valor predeterminado en lugar de false
  • cascade_timeout_seconds de LLM de respaldo ahora tiene 4 como valor predeterminado en lugar de 8 segundos
  • La configuración de LLM del agente añade gpt-5.6-sol, gpt-5.6-terra y gpt-5.6-luna; LLMReasoningEffort añade max
  • Las protecciones personalizadas añaden evaluate_full_response_only opcional (booleano, false de forma predeterminada)
  • La configuración de llamadas de telefonía añade twilio_call_recording_enabled opcional (booleano, false de forma predeterminada)
  • Los parámetros de herramientas de objeto añaden dynamic_variable, constant_value e is_omitted; las anulaciones de constantes aceptan valores de matriz y objeto arbitrarios
  • La configuración de texto del widget añade etiquetas opcionales de carga de archivos e indicador de escritura
  • Los esquemas de cuentas de WhatsApp añaden enable_typing_indicator opcional (booleano)
  • Los esquemas de simulación y pruebas añaden AutoGenerationMetadata y SimulationLibrarySettings

Música

  • Se han añadido esquemas de Music Finetune para solicitudes, respuestas, paginación, visibilidad, creador, estado y motivo de error
  • Todos los esquemas de solicitud de generación de música exponen finetune_id a los SDK generados

Espacios de trabajo

  • Los esquemas de solicitud y respuesta de webhook del espacio de trabajo añaden events opcional (WorkspaceWebhookEventType[])
  • Los esquemas de notificadores de webhook de alertas usan webhook_id obligatorio (cadena) en lugar de url, method y headers