Doblaje
- Formato de transcripción JSON: Hemos añadido compatibilidad con transcripciones en formato JSON en la ruta
GET /v1/dubbing/{dubbing_id}/transcript/{language_code}, que devuelve datos detallados de temporización a nivel de palabra y carácter medianteDubbingTranscriptResponseModel.
Plataforma Agents
- Compatibilidad con GPT-5.1: Hemos añadido compatibilidad con los modelos LLM
gpt-5.1ygpt-5.1-2025-11-13en las configuraciones de agentes. - Control del esfuerzo de razonamiento: Hemos añadido la opción
noneaLLMReasoningEffortpara mejorar el control sobre el comportamiento de razonamiento del modelo. - Eventos de solicitud de herramientas del agente: Hemos añadido
agent_tool_requestaClientEventpara mejorar el seguimiento de la interacción con herramientas en conversaciones en tiempo real. - DTMF fuera de banda: Hemos añadido la marca
use_out_of_band_dtmfaPlayDTMFToolConfigpara mejorar la integración de telefonía. - Nuevos modelos LLM: Hemos ampliado la enumeración LLM con
gemini-3-pro-previewpara mejorar las capacidades de IA conversacional.
Voz a Texto
- Eventos de cuota de Scribe superada: Hemos añadido el evento
quota_exceededen los SDK y el parámetroinclude_timestampspara mejorar la gestión de cuotas y el control de marcas de tiempo.
ElevenCreative Studio
- Seguimiento de voces por capítulo: Hemos añadido el campo
voice_idsa los modelos de respuesta de capítulos para mejorar la gestión de voces en proyectos con varias voces. - Recursos de imagen de proyecto: Hemos incorporado
ProjectImageResponseModelpara admitir recursos de imagen, que ahora se incluye enProjectResponseModel.assets. - Campo de voces base: Hemos añadido el campo
base_voicesaProjectResponseModelpara mejorar la gestión de voces.
Texto a Voz
- Control de normalización de texto: Hemos añadido la enumeración
TextNormalisationTypey el campotext_normalisation_typeen la configuración de voz de TTS para controlar de forma precisa el procesamiento de texto. - Tokens de WebSocket para TTS: Hemos ampliado
SingleUseTokenTypecontts_websocketpara una autenticación segura de WebSocket.
Lanzamientos de SDK
SDK de JavaScript
- v2.25.0 - Actualizado con los últimos cambios en el esquema de la API, incluidas las transcripciones de doblaje en JSON y la compatibilidad con GPT-5.1
- v2.24.1 - Hemos añadido el parámetro
include_timestampsa la API de Scribe para controlar las marcas de tiempo en las transcripciones
SDK de Python
- v2.24.0 - Actualizado con los últimos cambios en el esquema de la API, incluidas las transcripciones de doblaje en JSON y la compatibilidad con GPT-5.1
- v2.23.0 - Hemos añadido el parámetro
include_timestampsy el eventoquota_exceededa la API de Scribe para mejorar la gestión de cuotas
Paquetes
- @elevenlabs/react@0.11.0 - Hemos añadido el evento
quota_exceededy el parámetroinclude_timestampspara la integración con Scribe - @elevenlabs/client@0.11.0 - Hemos añadido el evento
quota_exceededy el parámetroinclude_timestampspara la integración con Scribe
API
Ver cambios de la API
Rutas actualizadas
Doblaje
GET /v1/dubbing/{dubbing_id}/transcript/{language_code}- El parámetro de ruta
languageahora acepta el valor'original' - El parámetro de consulta
format_typeahora admite'json'(además desrtywebvtt) - La respuesta 200 ahora incluye el tipo de medio
application/json, que devuelveDubbingTranscriptResponseModelcon:DubbingTranscriptUtterance- Datos a nivel de enunciadoDubbingTranscriptWord- Temporización a nivel de palabraDubbingTranscriptCharacter- Temporización a nivel de carácter
- El parámetro de ruta
- Hemos añadido la enumeración
DubbingModelcon los valoresdubbing_v2ydubbing_v3
Plataforma Agents
- Enviar llamadas por lotes
- Esquema del cuerpo de solicitud actualizado (compatible con versiones anteriores)
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Obtener estado de llamadas por lotes
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Cancelar llamadas por lotes
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Reintentar llamadas por lotes
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Obtener configuración de agente
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Actualizar configuración de agente
- Esquemas de solicitud y respuesta actualizados (compatibles con versiones anteriores)
- Crear agente
- Esquema de solicitud actualizado con una estructura de medidas de protección mejorada (cambio incompatible: se ha simplificado
guardrailscomo referencia directa y eliminadooneOf)
- Esquema de solicitud actualizado con una estructura de medidas de protección mejorada (cambio incompatible: se ha simplificado
- Obtener agente
- Esquema de respuesta actualizado (cambio incompatible: se han eliminado los campos
version_idybranch_idprotegidos por flags de función)
- Esquema de respuesta actualizado (cambio incompatible: se han eliminado los campos
- Actualizar agente
- Esquema de respuesta actualizado (cambio incompatible: se han eliminado los campos
version_idybranch_idprotegidos por flags de función)
- Esquema de respuesta actualizado (cambio incompatible: se han eliminado los campos
- Simular conversación
- Esquema de solicitud actualizado (compatible con versiones anteriores)
- Simular flujo de conversación
- Esquema de solicitud actualizado (compatible con versiones anteriores)
- Obtener conversación
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Eventos de cliente actualizados:
- Hemos añadido el tipo de evento
agent_tool_request
- Hemos añadido el tipo de evento
- Configuraciones de herramientas actualizadas:
- Hemos añadido
use_out_of_band_dtmfaPlayDTMFToolConfig - Hemos eliminado los esquemas
ApiIntegrationWebhookToolConfigExternal-*y sus asignaciones de discriminador
- Hemos añadido
Texto a Voz
- Convertir texto a voz
- Esquema de configuración de voz actualizado (compatible con versiones anteriores)
- Transmitir texto a voz
- Esquema de configuración de voz actualizado (compatible con versiones anteriores)
- Convertir con marcas de tiempo
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Transmitir con marcas de tiempo
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Convertir diálogo con marcas de tiempo
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Transmitir diálogo con marcas de tiempo
- Esquema de respuesta actualizado (compatible con versiones anteriores)
Gestión de voces
- Obtener voces
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Obtener configuración de voz predeterminada
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Obtener configuración de voz
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Obtener voz
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Editar configuración de voz
- Esquema de solicitud actualizado (compatible con versiones anteriores)
- Crear vistas previas de voz
- Esquema de solicitud actualizado (compatible con versiones anteriores)
- Crear una voz
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Crear una voz
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Diseñar voz
- Esquema de solicitud actualizado (compatible con versiones anteriores)
- Mezclar voz
- Esquema de solicitud actualizado (compatible con versiones anteriores)
ElevenCreative Studio
- Obtener proyecto
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Hemos añadido el campo
assetscon compatibilidad para imágenes - Hemos añadido el campo
base_voices
- Añadir capítulo
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Hemos añadido el campo
voice_ids
- Obtener capítulo
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Hemos añadido el campo
voice_ids
- Actualizar capítulo
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Hemos añadido el campo
voice_ids
Música
- Crear plan de composición
- Esquema de respuesta actualizado (compatible con versiones anteriores)
Otras actualizaciones
- Obtener audio de muestra de voz PVC
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Obtener audio de hablante separado
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Obtener suscripción de usuario
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Obtener doblaje
- Esquema de respuesta actualizado (compatible con versiones anteriores)
- Actualizar hablante
- Esquema de solicitud actualizado (compatible con versiones anteriores)
- Doblar un archivo de vídeo o audio
- Esquema de solicitud actualizado (compatible con versiones anteriores)
- Renderizar proyecto
- Parámetro de ruta
languageactualizado
- Parámetro de ruta
- Generar token de un solo uso
- Parámetro de ruta
token_typeampliado contts_websocket
- Parámetro de ruta
- Convertir voz a texto
- Esquema de respuesta actualizado (compatible con versiones anteriores)
Funciones eliminadas
- Hemos eliminado las opciones obsoletas
eleven_expressiveyexpressivede las enumeraciones de TTS