For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
Llamadas paralelas a herramientas: La configuración del prompt del agente ahora incluye enable_parallel_tool_calls (booleano, valor predeterminado true). Cuando está activado, los modelos compatibles pueden ejecutar varias herramientas en un mismo turno.
Modelos de agentes: Se ha añadido gpt-6-astra a las opciones de LLM de agentes.
Alertas: Las alertas de agentes ahora admiten canales de Slack junto con los notificadores de PagerDuty y webhook.
Búsqueda de números de teléfono: Se ha añadido una ruta de números de teléfono paginada por cursor con filtros por proveedor, compatibilidad con llamadas salientes, agente y rama asignados, etiqueta y número de teléfono.
Imagen y video
Modelos GPT Image 2.5: La generación de imágenes ahora admite gpt-image-2.5-flare y gpt-image-2.5-sunburst. Ambos modelos aceptan hasta 10 imágenes de referencia, niveles de calidad hasta max, 14 relaciones de aspecto fijas además de auto, y salida en 1K, 2K o 4K.
Motor de voz
Tiempo de espera de cascada: Las solicitudes de creación y actualización del Motor de voz ahora aceptan cascade_timeout_seconds (número, 2–15, valor predeterminado 4) para controlar cuánto tiempo espera ElevenLabs a un motor de voz ascendente antes de volver a intentarlo.
Texto a Voz
Límites de turno en multicontexto: El marcador is_final_audio_for_turn ahora se emite después de cada byte almacenado en búfer de ese turno, incluida la salida MP3 y Opus. Los clientes pueden usar el marcador como un límite exacto de turno sin cambiar a PCM.
Lanzamientos de SDK
SDK de JavaScript
v2.69.0 - Se ha añadido transcriptEdit al wrapper de Voz a Texto en tiempo real, con el texto editado enviado mediante eventos edited_transcript. Se ha corregido la verificación de JWT del Motor de voz para claves de API con sufijos de residencia de datos. Se han añadido phoneNumbers.listV2 y métodos de plantillas de Flows para listar y obtener plantillas, y listar, crear y obtener ejecuciones. Se han regenerado clientes y tipos para GPT Image 2.5, alertas de agentes de Slack, llamadas paralelas a herramientas, gpt-6-astra, límites de concurrencia de claves de API de cuentas de servicio, retención cero de Música, filtros de conversaciones y estados de aprobación de herramientas MCP.
SDK de Python
v2.69.0 - Se ha añadido transcript_edit al wrapper de Voz a Texto en tiempo real, con el texto editado enviado mediante eventos edited_transcript. Se ha corregido la verificación de JWT del Motor de voz para claves de API con sufijos de residencia de datos, y play ahora genera un error cuando falla ffplay. Se han añadido phone_numbers.list_v2 y métodos de plantillas de Flows para listar y obtener plantillas, y listar, crear y obtener ejecuciones. Se han regenerado clientes y tipos para GPT Image 2.5, alertas de agentes de Slack, llamadas paralelas a herramientas, gpt-6-astra, límites de concurrencia de claves de API de cuentas de servicio, retención cero de Música, filtros de conversaciones y estados de aprobación de herramientas MCP.
CLI de ElevenLabs
v1.3.2 - Se han añadido metadatos opcionales --intent para recopilar comentarios sobre el uso de la CLI. Se ha añadido elevenlabs feedback missing-capability para informar de flujos de trabajo que la CLI no admite.
Se han añadido los parámetros de paginación page_size opcional (entero, 1–1.000, valor predeterminado 100) y cursor opcional (cadena anulable).
Se han añadido los filtros opcionales search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by y sort_direction. sort_by acepta label o phone_number; sort_direction tiene como valor predeterminado asc.
La respuesta contiene phone_numbers obligatorio (matriz), next_cursor opcional y anulable (cadena) y has_more (booleano, valor predeterminado false).
La configuración del prompt añade enable_parallel_tool_calls (booleano, valor predeterminado true). Las anulaciones de flujos de trabajo aceptan un booleano anulable.
La enumeración LLM añade gpt-6-astra, incluidas las anulaciones de inicio de conversación.
Los notificadores de integración de alertas ahora usan integration_type para seleccionar pagerduty o slack. Los notificadores de Slack requieren connection_id y channel_id (cadenas); channel_id acepta entre 1 y 64 caracteres.
Se ha añadido cascade_timeout_seconds (número, 2–15). Las solicitudes de creación tienen como valor predeterminado 4, las solicitudes de actualización aceptan un valor anulable y las respuestas requieren el campo.
Se han añadido variantes de solicitud para gpt-image-2.5-flare y gpt-image-2.5-sunburst.
Ambas variantes requieren prompt y model_id, aceptan hasta 10 images y añaden resolution (1K, 2K o 4K, valor predeterminado 1K).
quality acepta low, medium, high, xhigh o max y tiene como valor predeterminado high. aspect_ratio acepta auto y 14 relaciones fijas, y tiene como valor predeterminado 16:9.
Se ha marcado como obsoleto max_depth (entero, valor predeterminado 3). El campo ahora no tiene efecto y ya no cuenta con restricciones mínimas ni máximas.
Los metadatos de trabajos de rastreo ya no requieren max_depth.
Los mensajes audio y final de WebSocket multicontexto ahora definen is_final_audio_for_turn como ocurrido después de que se hayan entregado todos los bytes almacenados en búfer del turno.