Text to Voice
- Voice Design : lancement du nouveau Text to Voice Design avec Eleven v3 pour créer des voix personnalisées à partir de descriptions textuelles.
Speech to Text
- Diarisation améliorée : ajout du paramètre
diarization_thresholdau point de terminaison Speech to Text. Ajustez précisément l’équilibre entre la précision de l’identification des locuteurs et le nombre total de locuteurs en réglant le seuil entre 0,1 et 0,4.
Clonage de voix professionnel
- Suppression du bruit de fond : ajout de
remove_background_noisepour nettoyer les échantillons vocaux à l’aide de modèles d’isolation audio afin d’obtenir des données d’entraînement de meilleure qualité.
ElevenCreative Studio
- Détection de la prise en charge vidéo : ajout de la propriété
has_videoaux réponses de chapitre pour indiquer si les chapitres contiennent du contenu vidéo.
Workspaces
-
Groupes de comptes de service : les comptes de service peuvent désormais être ajoutés à des groupes du Workspace pour une meilleure gestion des autorisations et du contrôle d’accès.
-
Authentification du Workspace : ajout de la prise en charge des connexions d’authentification du Workspace, permettant des intégrations sécurisées d’outils webhook avec des services externes.
SDK
- SDK Python : sortie de la v2.6.0 avec la prise en charge de la dernière API et des corrections de bugs.
- SDK JavaScript : sortie de la v2.5.0 avec la prise en charge de la dernière API et des corrections de bugs.
- SDK React de la plateforme Agents : ajout de la prise en charge de WebRTC dans la 0.2.0
API
Voir les modifications de l’API
Nouveaux points de terminaison
- Ajout de 2 nouveaux points de terminaison :
- Concevoir une voix - Crée des aperçus vocaux à partir de descriptions textuelles
- Créer une voix à partir d’un aperçu - Convertit des aperçus vocaux en voix permanentes
Points de terminaison mis à jour
Speech to Text
- Convertir la parole en texte - Ajout du paramètre
diarization_thresholdpour ajuster précisément la séparation des locuteurs
Gestion des voix
- Obtenir l’audio d’un échantillon vocal - Ajout du paramètre de requête
remove_background_noiseet déplacement du corps de la requête vers les paramètres de requête