Parole en texte

  • scribe_v1_experimental : lancement d’un nouvel aperçu expérimental du modèle Scribe v1, avec notamment de meilleures performances sur les fichiers audio comportant plusieurs langues, moins d’hallucinations lorsque l’audio est entrecoupé de silences et une amélioration des balises audio. Le nouveau modèle est disponible via l’API sous le nom de modèle scribe_v1_experimental

Text to Speech

  • Prise en charge du format A-law : ajout du format A-law avec une fréquence d’échantillonnage de 8 kHz pour permettre l’intégration aux systèmes de téléphonie européens.
  • Correction de problèmes de quota : correction d’un bug de base de données qui entraînait le rejet erroné de certaines requêtes pour dépassement de quota.

Plateforme Agents

  • Filtrage par type de document : ajout de la prise en charge du filtrage des documents de la base de connaissances selon leur type (fichier, URL ou texte).
  • Agents sans audio : ajout de la prise en charge d’agents conversationnels qui ne produisent pas d’audio, mais envoient tout de même les transcriptions des réponses et peuvent utiliser des outils. Les agents sans audio peuvent être activés en supprimant l’événement client audio.
  • Amélioration des modèles d’agent : mise à jour de tous les modèles d’agent avec des configurations et prompts améliorés. Découvrez comment améliorer les prompts système ici.
  • Correction des exportations bloquées : correction d’un problème qui bloquait les exportations pendant de longues périodes.

ElevenCreative Studio

  • Correction de la normalisation du volume : correction d’un problème avec les instantanés de projet en streaming lorsque la normalisation du volume est activée.

Nouveaux points de terminaison d’API

  • Alignement forcé : ajout d’un nouveau point de terminaison d’alignement forcé pour aligner l’audio sur le texte, idéal pour la génération de sous-titres.
  • Appels par lots : ajout d’un point de terminaison d’appels par lots pour planifier des appels à plusieurs destinataires

API

Nouveaux points de terminaison

Points de terminaison mis à jour

Text to Speech

Voix

  • Obtenir des voix : ajout du paramètre collection_id pour filtrer les voix par collection

Base de connaissances

  • Obtenir la base de connaissances : ajout du paramètre types pour filtrer les documents par type
  • Le point de terminaison général de création de documents de la base de connaissances est désormais obsolète au profit de points de terminaison spécialisés

Abonnement utilisateur

Plateforme Agents

  • Ajout du paramètre silence_end_call_timeout pour définir le délai d’attente maximal avant de mettre fin à un appel
  • Suppression du point de terminaison /v1/convai/agents/{agent_id}/add-secret (désormais géré par les points de terminaison des secrets du Workspace)