Scribe v2 Realtime

Scribe v2 Realtime, nuestro modelo de reconocimiento de voz en directo más rápido y preciso, ya se ha lanzado oficialmente. Ofrece una precisión de última generación en más de 92 idiomas con una latencia ultrabaja de 150 ms. Más información aquí.

Plataforma Agents

  • Feedback al finalizar la llamada en el widget: Los widgets ahora permiten recopilar feedback personalizable al finalizar la llamada, con campos opcionales de valoración y comentario, para que puedas obtener opiniones de usuarios directamente en las conversaciones con tus agentes.
  • Configuración de tiempo de espera flexible: Hemos añadido una configuración completa de tiempo de espera flexible para controlar cómo gestionan los agentes las pausas en la conversación, con prompts y comportamiento configurables a nivel de turno y conversación.
  • Filtrado avanzado de conversaciones: La ruta de conversaciones ahora permite filtrar por intervalo de duración de llamada, parámetros de evaluación, parámetros de recopilación de datos y nombres de herramientas específicos.
  • Feedback de conversaciones mejorado: Hemos actualizado el sistema de feedback de conversaciones con tipos de feedback estructurados, incluidas valoraciones y comentarios, para mejorar el seguimiento de la experiencia de usuario.

ElevenCreative Studio

  • Metadatos de proyecto ampliados: Los proyectos ahora incluyen un seguimiento completo de recursos con miniaturas de vídeo, referencias de audio externas e información de instantáneas mejorada, incluida la duración del audio.

Facturación

  • Detalles de factura mejorados: Las respuestas de factura ahora incluyen información detallada sobre descuentos con una nueva matriz discounts, que sustituye los campos obsoletos discount_percent_off y discount_amount_off. Los campos subtotal_cents y tax_cents ofrecen un desglose más claro de las facturas.

API de música

  • Mejoras en la latencia de separación de pistas: La ruta de separación de pistas se ha actualizado para gestionar mejor los archivos de audio y proporcionar una latencia más predecible para las solicitudes de procesamiento.

Lanzamientos de SDK

SDK de JavaScript

  • v2.23.0 - Hemos actualizado la ruta de Voz a Texto (Scribe) a scribe_realtime y exportado tipos adicionales de TypeScript para mejorar la experiencia de desarrollador.
  • v2.22.0 - Actualizado con los últimos cambios en el esquema de la API, incluidos el filtrado de conversaciones, la configuración de tiempo de espera flexible y las funciones de feedback del widget.

SDK de Python

  • v2.22.1 - Hemos actualizado la ruta de Voz a Texto (Scribe) a scribe_realtime y corregido problemas de importación circular para mejorar la estabilidad.
  • v2.22.0 - Actualizado con los últimos cambios en el esquema de la API, incluidos el filtrado de conversaciones, la configuración de tiempo de espera flexible y las funciones de feedback del widget.

Paquetes de Agents

SDK de Android

  • v0.5.0 - Hemos añadido las funciones setVolume y getVolume para controlar el audio mediante programación, con una implementación de ejemplo que incluye una barra de ajuste de volumen en la app de muestra.

API

Rutas actualizadas

Plataforma Agents

Gestión de conversaciones

  • Obtener conversaciones

    • Hemos añadido el parámetro de consulta call_duration_min_secs (entero) para filtrar conversaciones por duración mínima de llamada
    • Hemos añadido el parámetro de consulta call_duration_max_secs (entero) para filtrar conversaciones por duración máxima de llamada
    • Hemos añadido el parámetro de consulta evaluation_params (matriz de cadenas) para filtrar por criterios de evaluación
    • Hemos añadido el parámetro de consulta data_collection_params (matriz de cadenas) para filtrar por parámetros de recopilación de datos
    • Hemos añadido el parámetro de consulta tool_names (matriz de cadenas) para filtrar conversaciones que utilizaron herramientas específicas
  • Enviar feedback de conversación

    • Ahora utiliza ConversationFeedbackRequestModel con tipos de feedback estructurados
    • Hemos añadido el campo type para especificar la categoría de feedback
    • Hemos añadido el campo rating para feedback numérico
    • Hemos añadido el campo comment para feedback de texto

Configuración de agentes

  • Obtener widget de agente
    • Hemos añadido el campo end_feedback con WidgetEndFeedbackConfig para configurar la recopilación de feedback al finalizar la llamada
    • Admite campos opcionales de valoración y comentario en los formularios de feedback
  • Obtener agente & Actualizar agente
    • Esquema de respuesta actualizado para incluir nuevas opciones de configuración de la plataforma
    • Esquema de solicitud mejorado con campos de configuración adicionales

Configuración de turnos y conversaciones

  • Crear agente, Simular conversación, Simular flujo de conversación

    • Hemos añadido el campo soft_timeout_config para controlar el comportamiento durante las pausas en las conversaciones
    • Hemos añadido anulaciones de configuración de turn mediante TurnConfigOverride y TurnConfigOverrideConfig
    • Hemos añadido initial_wait_time a TurnConfig para controlar el tiempo de la respuesta inicial
    • Configuración disponible en los niveles de anulación de conversación y workflow

Pruebas

  • Ejecutar pruebas de agentes

    • Esquema de solicitud mejorado para admitir expresiones de workflow
    • Esquema de respuesta actualizado con campos adicionales de resultados de pruebas
  • Obtener invocación de prueba

    • La respuesta incluye datos de resultados de pruebas mejorados
    • Esquema actualizado para los resultados de expresiones de workflow

ElevenCreative Studio

  • Obtener proyecto

    • Hemos añadido el campo assets (obligatorio), que contiene vídeos y referencias de audio externas
    • Hemos incorporado ProjectVideoResponseModel para los metadatos de recursos de vídeo
    • Hemos incorporado ProjectExternalAudioResponseModel para el seguimiento de audio externo
    • Hemos incorporado ProjectVideoThumbnailSheetResponseModel para las miniaturas de vídeo
  • Obtener instantánea de proyecto

    • Respuesta reestructurada con el nuevo ProjectSnapshotExtendedResponseModel
    • Hemos añadido el campo audio_duration_secs (obligatorio) a los datos de la instantánea
    • Hemos eliminado character_alignments de ProjectSnapshotResponseModel
    • Hemos incorporado ProjectSnapshotsResponseModel para las colecciones de instantáneas

Facturación

  • Obtener suscripción
    • Hemos añadido la matriz discounts (obligatoria) con entradas de DiscountResponseModel
    • Hemos marcado como obsoleto el campo discount_percent_off (sigue disponible, pero está previsto eliminarlo)
    • Hemos marcado como obsoleto el campo discount_amount_off (sigue disponible, pero está previsto eliminarlo)
    • Hemos añadido el campo subtotal_cents (entero, anulable) para los totales de factura antes de impuestos
    • Hemos añadido el campo tax_cents (entero, anulable) para los importes de impuestos
    • Hemos actualizado los ejemplos de factura para incluir los nuevos campos de descuentos y totales

Voz a Texto

  • Transcribir audio
    • Esquema de respuesta actualizado con datos de transcripción mejorados

Texto a Voz

Gestión de voces

Clonación de Voz Profesional (PVC)

Ajustes preestablecidos de idioma

  • Los modelos de ajustes preestablecidos de idioma ahora incluyen el campo soft_timeout_translation para mensajes de tiempo de espera flexible localizados

Activadores de integración de la API

  • Hemos registrado una nueva colección de API: convai_api_integration_trigger_connections

Elementos obsoletos

  • Los campos de factura discount_percent_off y discount_amount_off están obsoletos; utiliza la matriz discounts en su lugar