Scribe v2 Realtime
Scribe v2 Realtime, notre modèle de reconnaissance vocale en direct le plus rapide et le plus précis, est officiellement disponible. Il offre une précision de pointe dans plus de 92 langues, avec une latence ultra-faible de 150 ms. En savoir plus.
Plateforme Agents
- Commentaires de fin d’appel dans les widgets : les widgets prennent désormais en charge la collecte personnalisable de commentaires de fin d’appel, avec des champs d’évaluation et de commentaire facultatifs, afin de recueillir directement les avis des utilisateurs au sein des conversations avec vos agents.
- Configuration du délai d’expiration souple : ajout de paramètres complets de délai d’expiration souple pour contrôler la manière dont les agents gèrent les pauses dans une conversation, avec des invites et un comportement configurables aux niveaux du tour de parole et de la conversation.
- Filtrage avancé des conversations : le point de terminaison des conversations permet désormais de filtrer par plage de durée d’appel, paramètres d’évaluation, paramètres de collecte de données et noms d’outils spécifiques.
- Commentaires enrichis sur les conversations : mise à jour du système de commentaires sur les conversations avec des types structurés, notamment des évaluations et des commentaires, pour mieux suivre l’expérience utilisateur.
ElevenCreative Studio
- Métadonnées de projet étendues : les Projects incluent désormais un suivi complet des ressources, avec des miniatures vidéo, des références audio externes et des informations d’instantané enrichies, dont la durée audio.
Facturation
- Détails de facture enrichis : les réponses de facture incluent désormais des informations détaillées sur les remises grâce à un nouveau tableau
discounts, remplaçant les champs obsolètesdiscount_percent_offetdiscount_amount_off. Les champssubtotal_centsettax_centsfournissent une ventilation plus claire des factures.
API Music
- Amélioration de la latence pour la séparation des pistes : le point de terminaison de séparation des pistes a été mis à jour pour mieux gérer les fichiers audio et offrir une latence plus prévisible pour les requêtes de traitement.
Versions des SDK
SDK JavaScript
- v2.23.0 - Mise à jour du point de terminaison Speech to Text (Scribe) vers
scribe_realtimeet export de types TypeScript supplémentaires pour améliorer l’expérience des développeurs. - v2.22.0 - Mise à jour avec les dernières modifications du schéma d’API, notamment le filtrage des conversations, la configuration du délai d’expiration souple et les fonctionnalités de commentaires des widgets.
SDK Python
- v2.22.1 - Mise à jour du point de terminaison Speech to Text (Scribe) vers
scribe_realtimeet correction des problèmes d’importations circulaires pour améliorer la stabilité. - v2.22.0 - Mise à jour avec les dernières modifications du schéma d’API, notamment le filtrage des conversations, la configuration du délai d’expiration souple et les fonctionnalités de commentaires des widgets.
Packages Agents
- @elevenlabs/client@0.10.0 - Mise à jour de la configuration du point de terminaison en temps réel et amélioration de la documentation.
- @elevenlabs/react@0.10.0 - Mise à jour de la configuration du point de terminaison en temps réel et amélioration de la documentation.
- @elevenlabs/types@0.2.0 - Mise à jour des définitions de types pour correspondre aux dernières modifications du schéma d’API.
- @elevenlabs/react@0.9.2 - Corrections mineures de bugs et améliorations de la stabilité.
- @elevenlabs/convai-widget-embed@0.5.1 - Mise à jour de la fonctionnalité d’intégration des widgets avec prise en charge des commentaires de fin d’appel.
- @elevenlabs/convai-widget-core@0.5.1 - Ajout de la configuration des commentaires de fin d’appel au noyau du widget.
- @elevenlabs/convai-widget-embed@0.5.0 - Ajout de la prise en charge de la collecte personnalisable de commentaires de fin d’appel.
- @elevenlabs/convai-widget-core@0.5.0 - Introduction de
WidgetEndFeedbackConfigetWidgetEndFeedbackTypepour la gestion des commentaires. - @elevenlabs/client@0.9.2 - Mise à jour de la configuration du client avec les dernières modifications de l’API.
SDK Android
- v0.5.0 - Ajout des fonctions
setVolumeetgetVolumepour le contrôle programmatique de l’audio, avec un exemple d’implémentation incluant une barre de réglage du volume dans l’application exemple.
API
Voir les modifications de l'API
Points de terminaison mis à jour
Plateforme Agents
Gestion des conversations
-
- Ajout du paramètre de requête
call_duration_min_secs(entier) pour filtrer les conversations selon la durée minimale d’appel - Ajout du paramètre de requête
call_duration_max_secs(entier) pour filtrer les conversations selon la durée maximale d’appel - Ajout du paramètre de requête
evaluation_params(tableau de chaînes) pour filtrer selon les critères d’évaluation - Ajout du paramètre de requête
data_collection_params(tableau de chaînes) pour filtrer selon les paramètres de collecte de données - Ajout du paramètre de requête
tool_names(tableau de chaînes) pour filtrer les conversations ayant utilisé des outils spécifiques
- Ajout du paramètre de requête
-
Fournir un commentaire sur une conversation
- Utilise désormais
ConversationFeedbackRequestModelavec des types de commentaires structurés - Ajout du champ
typepour spécifier la catégorie de commentaire - Ajout du champ
ratingpour les commentaires numériques - Ajout du champ
commentpour les commentaires textuels
- Utilise désormais
Configuration des agents
- Obtenir le widget de l’agent
- Ajout du champ
end_feedbackavecWidgetEndFeedbackConfigpour configurer la collecte de commentaires de fin d’appel - Prise en charge de champs facultatifs d’évaluation et de commentaire dans les formulaires de commentaires
- Ajout du champ
- Obtenir l’agent et Mettre à jour l’agent
- Schéma de réponse mis à jour pour inclure les nouvelles options de configuration de la plateforme
- Schéma de requête enrichi de champs de paramètres supplémentaires
Configuration des tours de parole et des conversations
-
Créer un agent, Simuler une conversation, Simuler un flux de conversation
- Ajout du champ
soft_timeout_configpour contrôler le comportement lors des pauses pendant les conversations - Ajout de remplacements de configuration
turnviaTurnConfigOverrideetTurnConfigOverrideConfig - Ajout de
initial_wait_timeàTurnConfigpour contrôler le délai de réponse initial - Configuration disponible aux niveaux de remplacement des conversations et des workflows
- Ajout du champ
Tests
-
- Schéma de requête enrichi pour prendre en charge les expressions de workflow
- Schéma de réponse mis à jour avec des champs de résultats de test supplémentaires
-
Obtenir une invocation de test
- La réponse inclut des données de résultats de test enrichies
- Schéma mis à jour pour les résultats d’expressions de workflow
ElevenCreative Studio
-
- Ajout du champ
assets(obligatoire) contenant des vidéos et des références audio externes - Introduction de
ProjectVideoResponseModelpour les métadonnées des ressources vidéo - Introduction de
ProjectExternalAudioResponseModelpour le suivi des fichiers audio externes - Introduction de
ProjectVideoThumbnailSheetResponseModelpour les miniatures vidéo
- Ajout du champ
-
Obtenir un instantané de projet
- Réponse restructurée avec le nouveau
ProjectSnapshotExtendedResponseModel - Ajout du champ
audio_duration_secs(obligatoire) aux données d’instantané - Suppression de
character_alignmentsdeProjectSnapshotResponseModel - Introduction de
ProjectSnapshotsResponseModelpour les collections d’instantanés
- Réponse restructurée avec le nouveau
Facturation
- Obtenir l’abonnement
- Ajout du tableau
discounts(obligatoire) avec des entréesDiscountResponseModel - Champ
discount_percent_offobsolète (toujours disponible, mais marqué pour suppression) - Champ
discount_amount_offobsolète (toujours disponible, mais marqué pour suppression) - Ajout du champ
subtotal_cents(entier, nullable) pour les totaux de facture avant taxes - Ajout du champ
tax_cents(entier, nullable) pour les montants de taxe - Mise à jour des exemples de facture pour inclure les nouveaux champs de remise et de total
- Ajout du tableau
Speech to Text
- Transcrire l’audio
- Schéma de réponse mis à jour avec des données de transcription enrichies
Text to Speech
-
Synthétiser du texte avec horodatages et Diffuser du texte synthétisé avec horodatages
- Schéma de réponse mis à jour avec des données d’horodatage enrichies
-
Convertir un dialogue avec horodatages et Diffuser un dialogue avec horodatages
- Schéma de réponse mis à jour avec des données enrichies sur les horodatages et les segments vocaux
Gestion des voix
-
Obtenir une voix, Obtenir les paramètres de voix, Obtenir les paramètres de voix par défaut
- Schémas de réponse mis à jour avec de nouveaux champs de métadonnées et de configuration des voix
-
Modifier les paramètres de voix
- Schéma de requête mis à jour pour la modification des paramètres de voix
-
- Schéma de réponse mis à jour avec de nouvelles données de génération de voix
Clonage de voix professionnel (PVC)
- Obtenir un échantillon audio PVC et Obtenir l’audio séparé d’un locuteur PVC
- Schémas de réponse mis à jour pour la récupération d’échantillons audio
Préréglages de langue
- Les modèles de préréglages de langue incluent désormais le champ
soft_timeout_translationpour les messages localisés de délai d’expiration souple
Déclencheurs d’intégration d’API
- Enregistrement d’une nouvelle collection d’API :
convai_api_integration_trigger_connections
Éléments obsolètes
- Les champs de facture
discount_percent_offetdiscount_amount_offsont obsolètes ; utilisez plutôt le tableaudiscounts