Scribe v2

Nous avons lancé Scribe v2, le nouveau modèle de transcription de pointe. En savoir plus sur Scribe v2 dans la documentation.

Plateforme Agents

  • Prise en charge des fuseaux horaires pour la planification des appels par lot : vous pouvez désormais sélectionner un fuseau horaire lors de la planification d’appels par lot. L’heure planifiée est convertie en UTC selon le fuseau horaire choisi. Le fuseau horaire de votre navigateur est sélectionné automatiquement par défaut, et la validation empêche de planifier des appels à des heures déjà passées dans le fuseau horaire sélectionné. Il est ainsi plus simple de programmer les appels sortants au bon moment dans les fuseaux horaires de vos destinataires.
  • URL du fichier source de la base de connaissances : ajout d’un nouvel endpoint permettant de récupérer l’URL du fichier source d’origine des documents de la base de connaissances, afin d’accéder directement aux fichiers importés.
  • Délai d’attente de cascade de LLM : ajout de l’option de configuration cascade_timeout_seconds pour les configurations LLM de secours des agents, afin de contrôler le temps d’attente avant de passer au LLM suivant. La valeur par défaut est de 8 secondes, avec une plage autorisée de 2 à 15 secondes.
  • Messages générés par LLM lors d’un délai d’attente souple : ajout de l’option use_llm_generated_message à la configuration du délai d’attente souple. Lorsqu’elle est activée, l’agent génère un message contextuel à l’aide du LLM au lieu d’utiliser un message prédéfini lorsque le délai d’attente souple est atteint.
  • Navigation dans les dossiers de la base de connaissances : les réponses de document de la base de connaissances incluent désormais le champ folder_path, qui affiche les segments du chemin depuis la racine jusqu’au dossier parent. Il est ainsi plus simple de comprendre la hiérarchie des documents.
  • Filtrage des conversations par source d’initiation : l’endpoint Obtenir les conversations prend désormais en charge le filtrage par le paramètre de requête conversation_initiation_source.

Doublage

  • Nouvel endpoint de format de transcription : ajout de l’endpoint GET /v1/dubbing/{dubbing_id}/transcripts/{language_code}/format/{format_type}, prenant en charge les formats de sortie srt, webvtt et json. L’ancien endpoint GET /v1/dubbing/{dubbing_id}/transcript/{language_code} est désormais obsolète.
  • Nom de fichier requis pour les fichiers doublés : les modèles de fichiers de la base de connaissances exigent désormais un champ filename.

Speech to Text

  • Détection d’entités : ajout de l’option entity_detection aux requêtes Speech-to-Text. Accepte 'all', des chaînes correspondant à des types d’entités spécifiques ou un tableau de types d’entités. Les entités détectées sont renvoyées dans un nouveau champ de réponse entities utilisant le schéma DetectedEntity.
  • Guidage par termes clés : ajout du paramètre de tableau keyterms aux requêtes Speech-to-Text afin d’orienter la transcription vers des termes ou expressions spécifiques.

Versions des SDK

SDK Python

  • v2.29.0 - Ajout de la détection d’entités et du guidage par termes clés pour Speech-to-Text, de la configuration du délai d’attente de cascade LLM, de la génération de messages LLM lors d’un délai d’attente souple et de la prise en charge des fuseaux horaires pour les appels par lot
  • v2.28.0 - Ajout des champs de versionnage des agents, des ID de collections de voix, des améliorations des appels par lot et des libellés de numéros de téléphone

SDK JavaScript

  • v2.30.0 - Ajout de la détection d’entités et du guidage par termes clés pour Speech-to-Text, de la configuration du délai d’attente de cascade LLM, de la génération de messages LLM lors d’un délai d’attente souple et de la prise en charge des fuseaux horaires pour les appels par lot
  • v2.29.0 - Ajout des champs de versionnage des agents, des ID de collections de voix, des améliorations des appels par lot et des libellés de numéros de téléphone

Serveur MCP

  • v0.9.1 - Ajout de la prise en charge de Gemini Extension, correction de la gestion des chemins pour output_directory non absolu et base_path manquant

API

Nouveaux endpoints

Endpoints obsolètes

  • GET /v1/dubbing/{dubbing_id}/transcript/{language_code} - Utilisez plutôt le nouvel endpoint spécifique au format

Endpoints mis à jour

Plateforme Agents

Base de connaissances

  • Lister les documents de la base de connaissances
    • Suppression du paramètre de requête obsolète use_typesense
    • Ajout de folder_path (tableau de segments de chemin) aux modèles de réponse de document
    • Ajout de filename (chaîne, obligatoire) aux modèles de fichiers de la base de connaissances

Speech to Text

  • Transcrire la parole
    • Ajout de keyterms (tableau de chaînes, facultatif) pour orienter la transcription vers des termes spécifiques
    • Ajout de entity_detection (chaîne, tableau ou 'all', facultatif) pour détecter les entités dans le texte transcrit
    • Ajout de entities (tableau de DetectedEntity, facultatif) au modèle de réponse

Doublage

  • Créer un projet de doublage
    • Mise à jour de la description de mode pour indiquer que le mode manual est expérimental et déconseillé en production