Scribe v2
Hemos lanzado Scribe v2, el nuevo modelo de transcripción más avanzado. Más información sobre Scribe v2 en la documentación.
Plataforma de agentes
- Compatibilidad con zonas horarias para programar llamadas por lotes: Ahora puedes seleccionar una zona horaria al programar llamadas por lotes. La hora programada se convierte a UTC según la zona horaria elegida. De forma predeterminada, se selecciona automáticamente la zona horaria de tu navegador, y la validación evita programar llamadas para horas que ya han pasado en la zona horaria seleccionada. Esto facilita programar llamadas salientes a la hora adecuada en las zonas horarias de tus destinatarios.
- URL del archivo fuente de la base de conocimientos: Se ha añadido una nueva ruta para recuperar la URL del archivo fuente original de los documentos de la base de conocimientos, lo que permite acceder directamente a los archivos subidos.
- Tiempo de espera de la cascada de LLM de respaldo: Se ha añadido la opción de configuración
cascade_timeout_secondspara las configuraciones de LLM de respaldo de los agentes, que permite controlar cuánto esperar antes de pasar al siguiente LLM. El valor predeterminado es de 8 segundos y el intervalo permitido es de 2 a 15 segundos. - Mensajes generados por LLM para tiempos de espera suaves: Se ha añadido la opción
use_llm_generated_messagea la configuración de tiempo de espera suave. Al activarla, el agente generará un mensaje contextual mediante el LLM en lugar de usar un mensaje predefinido cuando se active el tiempo de espera suave. - Navegación por carpetas de la base de conocimientos: Las respuestas de documentos de la base de conocimientos ahora incluyen el campo
folder_path, que muestra los segmentos de la ruta desde la raíz hasta la carpeta principal, facilitando la comprensión de la jerarquía de documentos. - Filtrado de conversaciones por fuente de inicio: La ruta Obtener conversaciones ahora admite el filtrado mediante el parámetro de consulta
conversation_initiation_source.
Doblaje
- Nueva ruta de formato de transcripción: Se ha añadido la ruta
GET /v1/dubbing/{dubbing_id}/transcripts/{language_code}/format/{format_type}, que admite los formatos de salidasrt,webvttyjson. La ruta anteriorGET /v1/dubbing/{dubbing_id}/transcript/{language_code}ya está obsoleta. - Nombre de archivo obligatorio para archivos doblados: Los modelos de archivos de la base de conocimientos ahora requieren un campo
filename.
Voz a Texto
- Detección de entidades: Se ha añadido la opción
entity_detectiona las solicitudes de Voz a Texto. Acepta'all', cadenas de tipos de entidad específicos o una matriz de tipos de entidad. Las entidades detectadas se devuelven en un nuevo campo de respuestaentitiesmediante el esquemaDetectedEntity. - Prompting de términos clave: Se ha añadido el parámetro de matriz
keytermsa las solicitudes de Voz a Texto para orientar la transcripción hacia términos o frases específicos.
Lanzamientos de SDK
SDK de Python
- v2.29.0 - Se han añadido la detección de entidades y el prompting de términos clave para Voz a Texto, la configuración de tiempo de espera de la cascada de LLM, la generación de mensajes por LLM para tiempos de espera suaves y la compatibilidad con zonas horarias para llamadas por lotes
- v2.28.0 - Se han añadido campos de versionado de agentes, ID de colecciones de voz, mejoras en llamadas por lotes y etiquetas de números de teléfono
SDK de JavaScript
- v2.30.0 - Se han añadido la detección de entidades y el prompting de términos clave para Voz a Texto, la configuración de tiempo de espera de la cascada de LLM, la generación de mensajes por LLM para tiempos de espera suaves y la compatibilidad con zonas horarias para llamadas por lotes
- v2.29.0 - Se han añadido campos de versionado de agentes, ID de colecciones de voz, mejoras en llamadas por lotes y etiquetas de números de teléfono
Servidor MCP
- v0.9.1 - Se ha añadido compatibilidad con Gemini Extension, corregido el manejo de rutas para
output_directoryno absoluto y la ausencia debase_path
API
Ver cambios de la API
Nuevas rutas
- Obtener transcripción de doblaje con formato -
GET /v1/dubbing/{dubbing_id}/transcripts/{language_code}/format/{format_type}- Recupera transcripciones de doblaje en formato SRT, WebVTT o JSON - Obtener URL del archivo fuente de la base de conocimientos -
GET /v1/convai/knowledge-base/{documentation_id}/source-file-url- Obtén la URL del archivo fuente original de un documento de la base de conocimientos
Rutas obsoletas
GET /v1/dubbing/{dubbing_id}/transcript/{language_code}- Usa en su lugar la nueva ruta específica para cada formato
Rutas actualizadas
Plataforma de agentes
- Enviar llamada por lotes
- Se ha añadido
timezone(cadena, opcional) al cuerpo de la solicitud para programar según la zona horaria - Se ha añadido
scheduled_time(cadena, opcional) como alternativa de cadena ISO ascheduled_time_unix
- Se ha añadido
- Obtener llamada por lotes, Cancelar llamada por lotes, Reintentar llamada por lotes
- Se ha añadido
timezone(cadena, obligatorio) a los modelos de respuesta de llamadas por lotes
- Se ha añadido
- Crear agente, Actualizar agente, Obtener agente
- Se ha añadido
cascade_timeout_seconds(entero, valor predeterminado 8, intervalo de 2 a 15, admite valores nulos) a la configuración de LLM de respaldo - Se ha añadido
use_llm_generated_message(booleano, valor predeterminadofalse) a la configuración de tiempo de espera suave
- Se ha añadido
- Obtener conversaciones
- Se ha añadido el parámetro de consulta
conversation_initiation_source(cadena, opcional) para filtrar conversaciones por fuente de inicio
- Se ha añadido el parámetro de consulta
- Simular conversación, Simular stream de conversación
- Se ha actualizado
entity_detectionpara que acepte'all', cadenas o matrices de cadenas en lugar de valores booleanos
- Se ha actualizado
Base de conocimientos
- Listar documentos de la base de conocimientos
- Se ha eliminado el parámetro de consulta obsoleto
use_typesense - Se ha añadido
folder_path(matriz de segmentos de ruta) a los modelos de respuesta de documentos - Se ha añadido
filename(cadena, obligatorio) a los modelos de archivos de la base de conocimientos
- Se ha eliminado el parámetro de consulta obsoleto
Voz a Texto
- Transcribir voz
- Se ha añadido
keyterms(matriz de cadenas, opcional) para orientar la transcripción hacia términos específicos - Se ha añadido
entity_detection(cadena, matriz o'all', opcional) para detectar entidades en el texto transcrito - Se ha añadido
entities(matriz deDetectedEntity, opcional) al modelo de respuesta
- Se ha añadido
Doblaje
- Crear proyecto de doblaje
- Se ha actualizado la descripción de
modepara indicar que el modomanuales experimental y no se recomienda para uso en producción
- Se ha actualizado la descripción de