Scribe v2 Realtime

Scribe v2 Realtime, notre modèle de reconnaissance vocale en direct le plus rapide et le plus précis, est officiellement disponible. Il offre une précision de pointe dans plus de 92 langues, avec une latence ultra-faible de 150 ms. En savoir plus.

Plateforme Agents

  • Commentaires de fin d’appel dans les widgets : les widgets prennent désormais en charge la collecte personnalisable de commentaires de fin d’appel, avec des champs d’évaluation et de commentaire facultatifs, afin de recueillir directement les avis des utilisateurs au sein des conversations avec vos agents.
  • Configuration du délai d’expiration souple : ajout de paramètres complets de délai d’expiration souple pour contrôler la manière dont les agents gèrent les pauses dans une conversation, avec des invites et un comportement configurables aux niveaux du tour de parole et de la conversation.
  • Filtrage avancé des conversations : le point de terminaison des conversations permet désormais de filtrer par plage de durée d’appel, paramètres d’évaluation, paramètres de collecte de données et noms d’outils spécifiques.
  • Commentaires enrichis sur les conversations : mise à jour du système de commentaires sur les conversations avec des types structurés, notamment des évaluations et des commentaires, pour mieux suivre l’expérience utilisateur.

ElevenCreative Studio

  • Métadonnées de projet étendues : les Projects incluent désormais un suivi complet des ressources, avec des miniatures vidéo, des références audio externes et des informations d’instantané enrichies, dont la durée audio.

Facturation

  • Détails de facture enrichis : les réponses de facture incluent désormais des informations détaillées sur les remises grâce à un nouveau tableau discounts, remplaçant les champs obsolètes discount_percent_off et discount_amount_off. Les champs subtotal_cents et tax_cents fournissent une ventilation plus claire des factures.

API Music

  • Amélioration de la latence pour la séparation des pistes : le point de terminaison de séparation des pistes a été mis à jour pour mieux gérer les fichiers audio et offrir une latence plus prévisible pour les requêtes de traitement.

Versions des SDK

SDK JavaScript

  • v2.23.0 - Mise à jour du point de terminaison Speech to Text (Scribe) vers scribe_realtime et export de types TypeScript supplémentaires pour améliorer l’expérience des développeurs.
  • v2.22.0 - Mise à jour avec les dernières modifications du schéma d’API, notamment le filtrage des conversations, la configuration du délai d’expiration souple et les fonctionnalités de commentaires des widgets.

SDK Python

  • v2.22.1 - Mise à jour du point de terminaison Speech to Text (Scribe) vers scribe_realtime et correction des problèmes d’importations circulaires pour améliorer la stabilité.
  • v2.22.0 - Mise à jour avec les dernières modifications du schéma d’API, notamment le filtrage des conversations, la configuration du délai d’expiration souple et les fonctionnalités de commentaires des widgets.

Packages Agents

SDK Android

  • v0.5.0 - Ajout des fonctions setVolume et getVolume pour le contrôle programmatique de l’audio, avec un exemple d’implémentation incluant une barre de réglage du volume dans l’application exemple.

API

Points de terminaison mis à jour

Plateforme Agents

Gestion des conversations

  • Obtenir les conversations

    • Ajout du paramètre de requête call_duration_min_secs (entier) pour filtrer les conversations selon la durée minimale d’appel
    • Ajout du paramètre de requête call_duration_max_secs (entier) pour filtrer les conversations selon la durée maximale d’appel
    • Ajout du paramètre de requête evaluation_params (tableau de chaînes) pour filtrer selon les critères d’évaluation
    • Ajout du paramètre de requête data_collection_params (tableau de chaînes) pour filtrer selon les paramètres de collecte de données
    • Ajout du paramètre de requête tool_names (tableau de chaînes) pour filtrer les conversations ayant utilisé des outils spécifiques
  • Fournir un commentaire sur une conversation

    • Utilise désormais ConversationFeedbackRequestModel avec des types de commentaires structurés
    • Ajout du champ type pour spécifier la catégorie de commentaire
    • Ajout du champ rating pour les commentaires numériques
    • Ajout du champ comment pour les commentaires textuels

Configuration des agents

  • Obtenir le widget de l’agent
    • Ajout du champ end_feedback avec WidgetEndFeedbackConfig pour configurer la collecte de commentaires de fin d’appel
    • Prise en charge de champs facultatifs d’évaluation et de commentaire dans les formulaires de commentaires
  • Obtenir l’agent et Mettre à jour l’agent
    • Schéma de réponse mis à jour pour inclure les nouvelles options de configuration de la plateforme
    • Schéma de requête enrichi de champs de paramètres supplémentaires

Configuration des tours de parole et des conversations

  • Créer un agent, Simuler une conversation, Simuler un flux de conversation

    • Ajout du champ soft_timeout_config pour contrôler le comportement lors des pauses pendant les conversations
    • Ajout de remplacements de configuration turn via TurnConfigOverride et TurnConfigOverrideConfig
    • Ajout de initial_wait_time à TurnConfig pour contrôler le délai de réponse initial
    • Configuration disponible aux niveaux de remplacement des conversations et des workflows

Tests

  • Exécuter des tests d’agent

    • Schéma de requête enrichi pour prendre en charge les expressions de workflow
    • Schéma de réponse mis à jour avec des champs de résultats de test supplémentaires
  • Obtenir une invocation de test

    • La réponse inclut des données de résultats de test enrichies
    • Schéma mis à jour pour les résultats d’expressions de workflow

ElevenCreative Studio

  • Obtenir un projet

    • Ajout du champ assets (obligatoire) contenant des vidéos et des références audio externes
    • Introduction de ProjectVideoResponseModel pour les métadonnées des ressources vidéo
    • Introduction de ProjectExternalAudioResponseModel pour le suivi des fichiers audio externes
    • Introduction de ProjectVideoThumbnailSheetResponseModel pour les miniatures vidéo
  • Obtenir un instantané de projet

    • Réponse restructurée avec le nouveau ProjectSnapshotExtendedResponseModel
    • Ajout du champ audio_duration_secs (obligatoire) aux données d’instantané
    • Suppression de character_alignments de ProjectSnapshotResponseModel
    • Introduction de ProjectSnapshotsResponseModel pour les collections d’instantanés

Facturation

  • Obtenir l’abonnement
    • Ajout du tableau discounts (obligatoire) avec des entrées DiscountResponseModel
    • Champ discount_percent_off obsolète (toujours disponible, mais marqué pour suppression)
    • Champ discount_amount_off obsolète (toujours disponible, mais marqué pour suppression)
    • Ajout du champ subtotal_cents (entier, nullable) pour les totaux de facture avant taxes
    • Ajout du champ tax_cents (entier, nullable) pour les montants de taxe
    • Mise à jour des exemples de facture pour inclure les nouveaux champs de remise et de total

Speech to Text

Text to Speech

Gestion des voix

Clonage de voix professionnel (PVC)

Préréglages de langue

  • Les modèles de préréglages de langue incluent désormais le champ soft_timeout_translation pour les messages localisés de délai d’expiration souple

Déclencheurs d’intégration d’API

  • Enregistrement d’une nouvelle collection d’API : convai_api_integration_trigger_connections

Éléments obsolètes

  • Les champs de facture discount_percent_off et discount_amount_off sont obsolètes ; utilisez plutôt le tableau discounts