ElevenAgents

  • Llamadas paralelas a herramientas: La configuración del prompt del agente ahora incluye enable_parallel_tool_calls (booleano, valor predeterminado true). Cuando está activado, los modelos compatibles pueden ejecutar varias herramientas en un mismo turno.
  • Modelos de agentes: Se ha añadido gpt-6-astra a las opciones de LLM de agentes.
  • Alertas: Las alertas de agentes ahora admiten canales de Slack junto con los notificadores de PagerDuty y webhook.
  • Búsqueda de números de teléfono: Se ha añadido una ruta de números de teléfono paginada por cursor con filtros por proveedor, compatibilidad con llamadas salientes, agente y rama asignados, etiqueta y número de teléfono.

Imagen y video

  • Modelos GPT Image 2.5: La generación de imágenes ahora admite gpt-image-2.5-flare y gpt-image-2.5-sunburst. Ambos modelos aceptan hasta 10 imágenes de referencia, niveles de calidad hasta max, 14 relaciones de aspecto fijas además de auto, y salida en 1K, 2K o 4K.

Motor de voz

  • Tiempo de espera de cascada: Las solicitudes de creación y actualización del Motor de voz ahora aceptan cascade_timeout_seconds (número, 2–15, valor predeterminado 4) para controlar cuánto tiempo espera ElevenLabs a un motor de voz ascendente antes de volver a intentarlo.

Texto a Voz

  • Límites de turno en multicontexto: El marcador is_final_audio_for_turn ahora se emite después de cada byte almacenado en búfer de ese turno, incluida la salida MP3 y Opus. Los clientes pueden usar el marcador como un límite exacto de turno sin cambiar a PCM.

Lanzamientos de SDK

SDK de JavaScript

  • v2.69.0 - Se ha añadido transcriptEdit al wrapper de Voz a Texto en tiempo real, con el texto editado enviado mediante eventos edited_transcript. Se ha corregido la verificación de JWT del Motor de voz para claves de API con sufijos de residencia de datos. Se han añadido phoneNumbers.listV2 y métodos de plantillas de Flows para listar y obtener plantillas, y listar, crear y obtener ejecuciones. Se han regenerado clientes y tipos para GPT Image 2.5, alertas de agentes de Slack, llamadas paralelas a herramientas, gpt-6-astra, límites de concurrencia de claves de API de cuentas de servicio, retención cero de Música, filtros de conversaciones y estados de aprobación de herramientas MCP.

SDK de Python

  • v2.69.0 - Se ha añadido transcript_edit al wrapper de Voz a Texto en tiempo real, con el texto editado enviado mediante eventos edited_transcript. Se ha corregido la verificación de JWT del Motor de voz para claves de API con sufijos de residencia de datos, y play ahora genera un error cuando falla ffplay. Se han añadido phone_numbers.list_v2 y métodos de plantillas de Flows para listar y obtener plantillas, y listar, crear y obtener ejecuciones. Se han regenerado clientes y tipos para GPT Image 2.5, alertas de agentes de Slack, llamadas paralelas a herramientas, gpt-6-astra, límites de concurrencia de claves de API de cuentas de servicio, retención cero de Música, filtros de conversaciones y estados de aprobación de herramientas MCP.

CLI de ElevenLabs

  • v1.3.2 - Se han añadido metadatos opcionales --intent para recopilar comentarios sobre el uso de la CLI. Se ha añadido elevenlabs feedback missing-capability para informar de flujos de trabajo que la CLI no admite.

API

Nuevas rutas

ElevenAgents

  • Listar página de números de teléfono - GET /v1/convai/v2/phone-numbers
    • Se han añadido los parámetros de paginación page_size opcional (entero, 1–1.000, valor predeterminado 100) y cursor opcional (cadena anulable).
    • Se han añadido los filtros opcionales search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by y sort_direction. sort_by acepta label o phone_number; sort_direction tiene como valor predeterminado asc.
    • La respuesta contiene phone_numbers obligatorio (matriz), next_cursor opcional y anulable (cadena) y has_more (booleano, valor predeterminado false).

Rutas actualizadas

ElevenAgents

  • Crear agente, Obtener agente y Actualizar agente
    • La configuración del prompt añade enable_parallel_tool_calls (booleano, valor predeterminado true). Las anulaciones de flujos de trabajo aceptan un booleano anulable.
    • La enumeración LLM añade gpt-6-astra, incluidas las anulaciones de inicio de conversación.
    • Los notificadores de integración de alertas ahora usan integration_type para seleccionar pagerduty o slack. Los notificadores de Slack requieren connection_id y channel_id (cadenas); channel_id acepta entre 1 y 64 caracteres.
  • Listar conversaciones y Resolver referencia de conversación
    • data_collection_params ya no acepta el operador missing. Usa un valor vacío para encontrar conversaciones en las que no se recopiló el campo.
    • Un valor vacío en dynamic_variable_params encuentra conversaciones en las que no se estableció la variable.
  • Crear Motor de voz, Obtener Motor de voz y Actualizar Motor de voz
    • Se ha añadido cascade_timeout_seconds (número, 2–15). Las solicitudes de creación tienen como valor predeterminado 4, las solicitudes de actualización aceptan un valor anulable y las respuestas requieren el campo.

Imagen y video

  • Crear generación de imágenes - POST /v1/flows/image
    • Se han añadido variantes de solicitud para gpt-image-2.5-flare y gpt-image-2.5-sunburst.
    • Ambas variantes requieren prompt y model_id, aceptan hasta 10 images y añaden resolution (1K, 2K o 4K, valor predeterminado 1K).
    • quality acepta low, medium, high, xhigh o max y tiene como valor predeterminado high. aspect_ratio acepta auto y 14 relaciones fijas, y tiene como valor predeterminado 16:9.

Doblaje

Base de conocimientos

  • Crear trabajo de rastreo - POST /v1/convai/knowledge-base/crawl
    • Se ha marcado como obsoleto max_depth (entero, valor predeterminado 3). El campo ahora no tiene efecto y ya no cuenta con restricciones mínimas ni máximas.
    • Los metadatos de trabajos de rastreo ya no requieren max_depth.

Usuario

Cambios en esquemas

Texto a Voz

  • Los mensajes audio y final de WebSocket multicontexto ahora definen is_final_audio_for_turn como ocurrido después de que se hayan entregado todos los bytes almacenados en búfer del turno.