Scribe v2 Realtime
Scribe v2 Realtime, nuestro modelo de reconocimiento de voz en directo más rápido y preciso, ya se ha lanzado oficialmente. Ofrece una precisión de última generación en más de 92 idiomas con una latencia ultrabaja de 150 ms. Más información aquí.
Plataforma Agents
- Feedback al finalizar la llamada en el widget: Los widgets ahora permiten recopilar feedback personalizable al finalizar la llamada, con campos opcionales de valoración y comentario, para que puedas obtener opiniones de usuarios directamente en las conversaciones con tus agentes.
- Configuración de tiempo de espera flexible: Hemos añadido una configuración completa de tiempo de espera flexible para controlar cómo gestionan los agentes las pausas en la conversación, con prompts y comportamiento configurables a nivel de turno y conversación.
- Filtrado avanzado de conversaciones: La ruta de conversaciones ahora permite filtrar por intervalo de duración de llamada, parámetros de evaluación, parámetros de recopilación de datos y nombres de herramientas específicos.
- Feedback de conversaciones mejorado: Hemos actualizado el sistema de feedback de conversaciones con tipos de feedback estructurados, incluidas valoraciones y comentarios, para mejorar el seguimiento de la experiencia de usuario.
ElevenCreative Studio
- Metadatos de proyecto ampliados: Los proyectos ahora incluyen un seguimiento completo de recursos con miniaturas de vídeo, referencias de audio externas e información de instantáneas mejorada, incluida la duración del audio.
Facturación
- Detalles de factura mejorados: Las respuestas de factura ahora incluyen información detallada sobre descuentos con una nueva matriz
discounts, que sustituye los campos obsoletosdiscount_percent_offydiscount_amount_off. Los campossubtotal_centsytax_centsofrecen un desglose más claro de las facturas.
API de música
- Mejoras en la latencia de separación de pistas: La ruta de separación de pistas se ha actualizado para gestionar mejor los archivos de audio y proporcionar una latencia más predecible para las solicitudes de procesamiento.
Lanzamientos de SDK
SDK de JavaScript
- v2.23.0 - Hemos actualizado la ruta de Voz a Texto (Scribe) a
scribe_realtimey exportado tipos adicionales de TypeScript para mejorar la experiencia de desarrollador. - v2.22.0 - Actualizado con los últimos cambios en el esquema de la API, incluidos el filtrado de conversaciones, la configuración de tiempo de espera flexible y las funciones de feedback del widget.
SDK de Python
- v2.22.1 - Hemos actualizado la ruta de Voz a Texto (Scribe) a
scribe_realtimey corregido problemas de importación circular para mejorar la estabilidad. - v2.22.0 - Actualizado con los últimos cambios en el esquema de la API, incluidos el filtrado de conversaciones, la configuración de tiempo de espera flexible y las funciones de feedback del widget.
Paquetes de Agents
- @elevenlabs/client@0.10.0 - Hemos actualizado la configuración de la ruta en tiempo real y mejorado la documentación.
- @elevenlabs/react@0.10.0 - Hemos actualizado la configuración de la ruta en tiempo real y mejorado la documentación.
- @elevenlabs/types@0.2.0 - Hemos actualizado las definiciones de tipos para que coincidan con los últimos cambios en el esquema de la API.
- @elevenlabs/react@0.9.2 - Correcciones menores de errores y mejoras de estabilidad.
- @elevenlabs/convai-widget-embed@0.5.1 - Hemos actualizado la funcionalidad de inserción del widget con compatibilidad para feedback al finalizar la llamada.
- @elevenlabs/convai-widget-core@0.5.1 - Hemos añadido la configuración de feedback al finalizar la llamada al núcleo del widget.
- @elevenlabs/convai-widget-embed@0.5.0 - Hemos añadido compatibilidad para recopilar feedback personalizable al finalizar la llamada.
- @elevenlabs/convai-widget-core@0.5.0 - Hemos incorporado
WidgetEndFeedbackConfigyWidgetEndFeedbackTypepara gestionar el feedback. - @elevenlabs/client@0.9.2 - Hemos actualizado la configuración del cliente con los últimos cambios de la API.
SDK de Android
- v0.5.0 - Hemos añadido las funciones
setVolumeygetVolumepara controlar el audio mediante programación, con una implementación de ejemplo que incluye una barra de ajuste de volumen en la app de muestra.
API
Ver cambios de la API
Rutas actualizadas
Plataforma Agents
Gestión de conversaciones
-
- Hemos añadido el parámetro de consulta
call_duration_min_secs(entero) para filtrar conversaciones por duración mínima de llamada - Hemos añadido el parámetro de consulta
call_duration_max_secs(entero) para filtrar conversaciones por duración máxima de llamada - Hemos añadido el parámetro de consulta
evaluation_params(matriz de cadenas) para filtrar por criterios de evaluación - Hemos añadido el parámetro de consulta
data_collection_params(matriz de cadenas) para filtrar por parámetros de recopilación de datos - Hemos añadido el parámetro de consulta
tool_names(matriz de cadenas) para filtrar conversaciones que utilizaron herramientas específicas
- Hemos añadido el parámetro de consulta
-
Enviar feedback de conversación
- Ahora utiliza
ConversationFeedbackRequestModelcon tipos de feedback estructurados - Hemos añadido el campo
typepara especificar la categoría de feedback - Hemos añadido el campo
ratingpara feedback numérico - Hemos añadido el campo
commentpara feedback de texto
- Ahora utiliza
Configuración de agentes
- Obtener widget de agente
- Hemos añadido el campo
end_feedbackconWidgetEndFeedbackConfigpara configurar la recopilación de feedback al finalizar la llamada - Admite campos opcionales de valoración y comentario en los formularios de feedback
- Hemos añadido el campo
- Obtener agente & Actualizar agente
- Esquema de respuesta actualizado para incluir nuevas opciones de configuración de la plataforma
- Esquema de solicitud mejorado con campos de configuración adicionales
Configuración de turnos y conversaciones
-
Crear agente, Simular conversación, Simular flujo de conversación
- Hemos añadido el campo
soft_timeout_configpara controlar el comportamiento durante las pausas en las conversaciones - Hemos añadido anulaciones de configuración de
turnmedianteTurnConfigOverrideyTurnConfigOverrideConfig - Hemos añadido
initial_wait_timeaTurnConfigpara controlar el tiempo de la respuesta inicial - Configuración disponible en los niveles de anulación de conversación y workflow
- Hemos añadido el campo
Pruebas
-
- Esquema de solicitud mejorado para admitir expresiones de workflow
- Esquema de respuesta actualizado con campos adicionales de resultados de pruebas
-
- La respuesta incluye datos de resultados de pruebas mejorados
- Esquema actualizado para los resultados de expresiones de workflow
ElevenCreative Studio
-
- Hemos añadido el campo
assets(obligatorio), que contiene vídeos y referencias de audio externas - Hemos incorporado
ProjectVideoResponseModelpara los metadatos de recursos de vídeo - Hemos incorporado
ProjectExternalAudioResponseModelpara el seguimiento de audio externo - Hemos incorporado
ProjectVideoThumbnailSheetResponseModelpara las miniaturas de vídeo
- Hemos añadido el campo
-
Obtener instantánea de proyecto
- Respuesta reestructurada con el nuevo
ProjectSnapshotExtendedResponseModel - Hemos añadido el campo
audio_duration_secs(obligatorio) a los datos de la instantánea - Hemos eliminado
character_alignmentsdeProjectSnapshotResponseModel - Hemos incorporado
ProjectSnapshotsResponseModelpara las colecciones de instantáneas
- Respuesta reestructurada con el nuevo
Facturación
- Obtener suscripción
- Hemos añadido la matriz
discounts(obligatoria) con entradas deDiscountResponseModel - Hemos marcado como obsoleto el campo
discount_percent_off(sigue disponible, pero está previsto eliminarlo) - Hemos marcado como obsoleto el campo
discount_amount_off(sigue disponible, pero está previsto eliminarlo) - Hemos añadido el campo
subtotal_cents(entero, anulable) para los totales de factura antes de impuestos - Hemos añadido el campo
tax_cents(entero, anulable) para los importes de impuestos - Hemos actualizado los ejemplos de factura para incluir los nuevos campos de descuentos y totales
- Hemos añadido la matriz
Voz a Texto
- Transcribir audio
- Esquema de respuesta actualizado con datos de transcripción mejorados
Texto a Voz
-
Texto a voz con marcas de tiempo & Transmitir texto a voz con marcas de tiempo
- Esquema de respuesta actualizado con datos de marcas de tiempo mejorados
-
Texto a diálogo con marcas de tiempo & Transmitir texto a diálogo con marcas de tiempo
- Esquema de respuesta actualizado con datos mejorados de marcas de tiempo y segmentos de voz
Gestión de voces
-
Obtener voz, Obtener configuración de voz, Obtener configuración de voz predeterminada
- Esquemas de respuesta actualizados con nuevos campos de metadatos y configuración de voz
-
- Esquema de solicitud actualizado para modificar la configuración de voz
-
- Esquema de respuesta actualizado con nuevos datos de generación de voz
Clonación de Voz Profesional (PVC)
- Obtener audio de muestra de PVC & Obtener audio de hablante separado de PVC
- Esquemas de respuesta actualizados para recuperar muestras de audio
Ajustes preestablecidos de idioma
- Los modelos de ajustes preestablecidos de idioma ahora incluyen el campo
soft_timeout_translationpara mensajes de tiempo de espera flexible localizados
Activadores de integración de la API
- Hemos registrado una nueva colección de API:
convai_api_integration_trigger_connections
Elementos obsoletos
- Los campos de factura
discount_percent_offydiscount_amount_offestán obsoletos; utiliza la matrizdiscountsen su lugar