Scribe v2
Nous avons lancé Scribe v2, le nouveau modèle de transcription de pointe. En savoir plus sur Scribe v2 dans la documentation.
Plateforme Agents
- Prise en charge des fuseaux horaires pour la planification des appels par lot : vous pouvez désormais sélectionner un fuseau horaire lors de la planification d’appels par lot. L’heure planifiée est convertie en UTC selon le fuseau horaire choisi. Le fuseau horaire de votre navigateur est sélectionné automatiquement par défaut, et la validation empêche de planifier des appels à des heures déjà passées dans le fuseau horaire sélectionné. Il est ainsi plus simple de programmer les appels sortants au bon moment dans les fuseaux horaires de vos destinataires.
- URL du fichier source de la base de connaissances : ajout d’un nouvel endpoint permettant de récupérer l’URL du fichier source d’origine des documents de la base de connaissances, afin d’accéder directement aux fichiers importés.
- Délai d’attente de cascade de LLM : ajout de l’option de configuration
cascade_timeout_secondspour les configurations LLM de secours des agents, afin de contrôler le temps d’attente avant de passer au LLM suivant. La valeur par défaut est de 8 secondes, avec une plage autorisée de 2 à 15 secondes. - Messages générés par LLM lors d’un délai d’attente souple : ajout de l’option
use_llm_generated_messageà la configuration du délai d’attente souple. Lorsqu’elle est activée, l’agent génère un message contextuel à l’aide du LLM au lieu d’utiliser un message prédéfini lorsque le délai d’attente souple est atteint. - Navigation dans les dossiers de la base de connaissances : les réponses de document de la base de connaissances incluent désormais le champ
folder_path, qui affiche les segments du chemin depuis la racine jusqu’au dossier parent. Il est ainsi plus simple de comprendre la hiérarchie des documents. - Filtrage des conversations par source d’initiation : l’endpoint Obtenir les conversations prend désormais en charge le filtrage par le paramètre de requête
conversation_initiation_source.
Doublage
- Nouvel endpoint de format de transcription : ajout de l’endpoint
GET /v1/dubbing/{dubbing_id}/transcripts/{language_code}/format/{format_type}, prenant en charge les formats de sortiesrt,webvttetjson. L’ancien endpointGET /v1/dubbing/{dubbing_id}/transcript/{language_code}est désormais obsolète. - Nom de fichier requis pour les fichiers doublés : les modèles de fichiers de la base de connaissances exigent désormais un champ
filename.
Speech to Text
- Détection d’entités : ajout de l’option
entity_detectionaux requêtes Speech-to-Text. Accepte'all', des chaînes correspondant à des types d’entités spécifiques ou un tableau de types d’entités. Les entités détectées sont renvoyées dans un nouveau champ de réponseentitiesutilisant le schémaDetectedEntity. - Guidage par termes clés : ajout du paramètre de tableau
keytermsaux requêtes Speech-to-Text afin d’orienter la transcription vers des termes ou expressions spécifiques.
Versions des SDK
SDK Python
- v2.29.0 - Ajout de la détection d’entités et du guidage par termes clés pour Speech-to-Text, de la configuration du délai d’attente de cascade LLM, de la génération de messages LLM lors d’un délai d’attente souple et de la prise en charge des fuseaux horaires pour les appels par lot
- v2.28.0 - Ajout des champs de versionnage des agents, des ID de collections de voix, des améliorations des appels par lot et des libellés de numéros de téléphone
SDK JavaScript
- v2.30.0 - Ajout de la détection d’entités et du guidage par termes clés pour Speech-to-Text, de la configuration du délai d’attente de cascade LLM, de la génération de messages LLM lors d’un délai d’attente souple et de la prise en charge des fuseaux horaires pour les appels par lot
- v2.29.0 - Ajout des champs de versionnage des agents, des ID de collections de voix, des améliorations des appels par lot et des libellés de numéros de téléphone
Serveur MCP
- v0.9.1 - Ajout de la prise en charge de Gemini Extension, correction de la gestion des chemins pour
output_directorynon absolu etbase_pathmanquant
API
Afficher les modifications de l'API
Nouveaux endpoints
- Obtenir la transcription de doublage avec format -
GET /v1/dubbing/{dubbing_id}/transcripts/{language_code}/format/{format_type}- Récupérer des transcriptions de doublage au format SRT, WebVTT ou JSON - Obtenir l’URL du fichier source de la base de connaissances -
GET /v1/convai/knowledge-base/{documentation_id}/source-file-url- Obtenir l’URL du fichier source d’origine d’un document de la base de connaissances
Endpoints obsolètes
GET /v1/dubbing/{dubbing_id}/transcript/{language_code}- Utilisez plutôt le nouvel endpoint spécifique au format
Endpoints mis à jour
Plateforme Agents
- Envoyer un appel par lot
- Ajout de
timezone(chaîne, facultatif) au corps de la requête pour une planification tenant compte du fuseau horaire - Ajout de
scheduled_time(chaîne, facultatif) comme alternative au format ISO àscheduled_time_unix
- Ajout de
- Obtenir un appel par lot, Annuler un appel par lot, Relancer un appel par lot
- Ajout de
timezone(chaîne, obligatoire) aux modèles de réponse d’appel par lot
- Ajout de
- Créer un agent, Mettre à jour un agent, Obtenir un agent
- Ajout de
cascade_timeout_seconds(entier, valeur par défaut 8, plage de 2 à 15, nullable) à la configuration LLM de secours - Ajout de
use_llm_generated_message(booléen, valeur par défautfalse) à la configuration du délai d’attente souple
- Ajout de
- Obtenir les conversations
- Ajout du paramètre de requête
conversation_initiation_source(chaîne, facultatif) pour filtrer les conversations par source d’initiation
- Ajout du paramètre de requête
- Simuler une conversation, Simuler le flux d’une conversation
- Mise à jour de
entity_detectionpour accepter'all', des chaînes ou des tableaux de chaînes au lieu d’un booléen
- Mise à jour de
Base de connaissances
- Lister les documents de la base de connaissances
- Suppression du paramètre de requête obsolète
use_typesense - Ajout de
folder_path(tableau de segments de chemin) aux modèles de réponse de document - Ajout de
filename(chaîne, obligatoire) aux modèles de fichiers de la base de connaissances
- Suppression du paramètre de requête obsolète
Speech to Text
- Transcrire la parole
- Ajout de
keyterms(tableau de chaînes, facultatif) pour orienter la transcription vers des termes spécifiques - Ajout de
entity_detection(chaîne, tableau ou'all', facultatif) pour détecter les entités dans le texte transcrit - Ajout de
entities(tableau deDetectedEntity, facultatif) au modèle de réponse
- Ajout de
Doublage
- Créer un projet de doublage
- Mise à jour de la description de
modepour indiquer que le modemanualest expérimental et déconseillé en production
- Mise à jour de la description de