For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
API de Music Finetunes: Se ha añadido compatibilidad de API para gestionar Music Finetunes. Cinco endpoints permiten crear un Finetune a partir de audio subido, listar los Finetunes accesibles, consultar el estado del entrenamiento, actualizar los metadatos y la visibilidad, o eliminar un Finetune. Todos los métodos de SDK de generación de música ahora exponen finetune_id.
ElevenAgents
Resolver referencias externas de conversaciones: Se ha añadido GET /v1/convai/conversations/resolve para resolver la URL de un mensaje de Slack o la URL de un ticket de Zendesk en una conversación. Las solicitudes requieren los parámetros de consulta agent_id y reference (cadenas).
Consultar las bases de conocimientos de agentes: Se ha añadido POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query para realizar consultas RAG de solo lectura en la base de conocimientos de un agente. La solicitud requiere query (cadena), acepta branch_id opcional (cadena) y devuelve fragmentos ordenados con metadatos de documento, fragmento, texto y distancia vectorial. Este endpoint queda excluido de los SDK generados.
Formatos de contenido de la base de conocimientos: Las respuestas de archivos, texto y URL de la base de conocimientos añaden content_format opcional (html | markdown, html de forma predeterminada).
Configuración de voz del agente: Los esquemas de anulación de TTS añaden model_id opcional que el cliente puede anular (TTSConversationalModel). El valor predeterminado de enable_phoneme_tags cambia de false a true.
Cascada de LLM de respaldo más rápida: El valor predeterminado de cascade_timeout_seconds cambia de 8 a 4 segundos. El rango permitido sigue siendo de 2 a 15 segundos.
Fuentes de valores de parámetros de herramientas: Los parámetros de herramientas de objeto ahora pueden usar dynamic_variable, constant_value o is_omitted, en línea con los controles existentes para escalares y matrices. Las anulaciones de esquema de constantes ahora aceptan matrices y objetos arbitrarios.
Protecciones para respuestas completas: Las protecciones personalizadas añaden evaluate_full_response_only opcional (booleano, false de forma predeterminada) para evaluar una vez la respuesta completa que no es TTS. Esta opción requiere el modo de bloqueo.
Grabación de llamadas de Twilio: La configuración de llamadas de telefonía añade twilio_call_recording_enabled opcional (booleano, false de forma predeterminada). Las grabaciones se almacenan en la cuenta de Twilio conectada y otros proveedores ignoran esta configuración.
Texto de carga de archivos del widget: La configuración de texto del widget añade etiquetas y mensajes de error opcionales para adjuntar y eliminar archivos, fallos de carga, tipos incompatibles, archivos demasiado grandes, límites de número de archivos e indicador de escritura.
Estado de sincronización de la base de conocimientos: Las respuestas de archivos de la base de conocimientos añaden auto_sync_info y refresh_status opcionales (FileRefreshStatus). Las respuestas de carpetas añaden document_count obligatorio (entero), un recuento recursivo de documentos que no son carpetas limitado a 1000.
Filtros de búsqueda de texto en conversaciones: Buscar texto en mensajes de conversación añade los parámetros de consulta de matriz exclude_statuses y termination_reasons opcionales.
Opciones de LLM: La configuración de LLM del agente añade gpt-5.6-sol, gpt-5.6-terra y gpt-5.6-luna. LLMReasoningEffort añade max.
Indicadores de escritura de WhatsApp: Los esquemas de solicitud y respuesta de cuentas de WhatsApp añaden enable_typing_indicator opcional (booleano).
Voz a Texto
Autenticación por lotes de un solo uso: Convertir voz a texto añade token opcional (cadena) como alternativa a la autenticación mediante clave de API o bearer. Crea el token de un solo uso con POST /v1/single-use-token/batch_scribe; caduca a los 15 minutos.
Fiabilidad del cliente en tiempo real: @elevenlabs/client ahora informa de errores de configuración del micrófono y errores de servidor malformados mediante RealtimeEvents.ERROR, libera los recursos del micrófono después de fallos de configuración y cierres de conexión, y descarta los fotogramas de micrófono tardíos tras el cierre del socket.
Texto a Voz
Diccionarios de pronunciación archivados: Listar diccionarios de pronunciación añade include_archived opcional (booleano, true de forma predeterminada).
Espacios de trabajo
Suscripciones a eventos de webhooks: Las solicitudes de Actualizar webhook del espacio de trabajo añaden events opcional (WorkspaceWebhookEventType[]) con voice_library_removal_notice, speech_to_text y agent_qa. Las respuestas de webhooks pueden devolver la lista de eventos suscritos.
Eliminar límites de cuentas de servicio: Actualizar clave de API de cuenta de servicio acepta character_limit: "clear" para eliminar un límite mensual de caracteres, junto con "no_update" y valores enteros.
Referencias de webhook de alertas: Los esquemas de notificadores de webhook de alertas ahora identifican un webhook del espacio de trabajo con webhook_id obligatorio (cadena), en lugar de incorporar url, method y headers.
Lanzamientos de SDK
SDK de JavaScript
v2.59.0 - Se han añadido métodos music.finetunes para listar, crear, obtener, actualizar y eliminar Music Finetunes. También se han añadido resolución de referencias de conversaciones, filtrado de diccionarios de pronunciación archivados y tokens de Voz a Texto de un solo uso.
SDK de Python
v2.59.0 - Se han añadido Music Finetunes y resolución de referencias de conversaciones a partir del esquema de API más reciente. OnPremInitiationData también añade configuraciones tipadas de post_call_transcription_webhook y post_call_audio_webhook con hmac_secret opcional para webhooks firmados posteriores a la llamada.
Paquetes
@elevenlabs/client@1.15.1 - Se ha mejorado la entrega de errores de Scribe Realtime y la limpieza del micrófono durante fallos de configuración, cierres de cliente o servidor y fotogramas de audio tardíos.
v0.11.1 - Se ha evitado que R8 y ProGuard ofusquen los campos de eventos salientes de WebSocket y WebRTC, como text y type.
CLI
@elevenlabs/cli@0.5.6 - Se han actualizado las plantillas de agentes predeterminadas para usar scribe_realtime en lugar del proveedor de ASR elevenlabs eliminado. Las plantillas mínimas siguen usando el valor predeterminado del servidor.
Se ha añadido "clear" al campo character_limit opcional
Cambios en los esquemas
ElevenAgents
Los esquemas de respuesta de la base de conocimientos de ElevenAgents añaden content_format opcional (html | markdown, html de forma predeterminada)
Las respuestas de archivos de la base de conocimientos añaden auto_sync_info y refresh_status opcionales (FileRefreshStatus)
Las respuestas de carpetas de la base de conocimientos añaden document_count obligatorio (entero)
Los esquemas de anulación de TTS del agente añaden model_id opcional (TTSConversationalModel)
enable_phoneme_tags de TTS del agente ahora tiene true como valor predeterminado en lugar de false
cascade_timeout_seconds de LLM de respaldo ahora tiene 4 como valor predeterminado en lugar de 8 segundos
La configuración de LLM del agente añade gpt-5.6-sol, gpt-5.6-terra y gpt-5.6-luna; LLMReasoningEffort añade max
Las protecciones personalizadas añaden evaluate_full_response_only opcional (booleano, false de forma predeterminada)
La configuración de llamadas de telefonía añade twilio_call_recording_enabled opcional (booleano, false de forma predeterminada)
Los parámetros de herramientas de objeto añaden dynamic_variable, constant_value e is_omitted; las anulaciones de constantes aceptan valores de matriz y objeto arbitrarios
La configuración de texto del widget añade etiquetas opcionales de carga de archivos e indicador de escritura
Los esquemas de cuentas de WhatsApp añaden enable_typing_indicator opcional (booleano)
Los esquemas de simulación y pruebas añaden AutoGenerationMetadata y SimulationLibrarySettings
Música
Se han añadido esquemas de Music Finetune para solicitudes, respuestas, paginación, visibilidad, creador, estado y motivo de error
Todos los esquemas de solicitud de generación de música exponen finetune_id a los SDK generados
Espacios de trabajo
Los esquemas de solicitud y respuesta de webhook del espacio de trabajo añaden events opcional (WorkspaceWebhookEventType[])
Los esquemas de notificadores de webhook de alertas usan webhook_id obligatorio (cadena) en lugar de url, method y headers