Clonage de voix professionnel (PVC)
- API PVC : Introduction d’une suite complète de points de terminaison API pour gérer les clones de voix professionnels (PVC). Vous pouvez désormais créer des voix par programmation, ajouter/gérer/supprimer des échantillons audio, récupérer des données audio et des formes d’onde, gérer la séparation des locuteurs, effectuer la vérification et lancer l’entraînement. Pour consulter la liste complète des nouveaux points de terminaison, consultez le récapitulatif des modifications d’API ci-dessous ou le Guide de l’API PVC ici.
Speech to Text
- Options d’export améliorées : Ajout d’options permettant d’inclure ou d’exclure les horodatages et les ID de locuteur lors de l’exportation des résultats Speech to Text au format JSON segmenté via l’API.
Plateforme Agents
- Nouveaux modèles LLM : Ajout de la prise en charge des nouveaux modèles GPT-4.1 :
gpt-4.1,gpt-4.1-minietgpt-4.1-nanoici - Score VAD : Ajout d’un nouvel événement client qui envoie les scores VAD au client, voir la référence ici
API
Voir les modifications de l'API
Nouveaux points de terminaison
- Ajout de 16 nouveaux points de terminaison :
- Créer une voix PVC - Crée une nouvelle voix PVC.
- Modifier une voix PVC - Modifie les métadonnées d’une voix PVC.
- Ajouter des échantillons à une voix PVC - Ajoute des échantillons audio à une voix PVC.
- Mettre à jour un échantillon de voix PVC - Met à jour un échantillon de voix PVC (suppression du bruit, sélection du locuteur, découpage).
- Supprimer un échantillon de voix PVC - Supprime un échantillon d’une voix PVC.
- Récupérer l’audio d’un échantillon de voix - Récupère l’audio d’un échantillon de voix PVC.
- Récupérer la forme d’onde visuelle d’un échantillon de voix - Récupère la forme d’onde visuelle d’un échantillon de voix PVC.
- Récupérer l’état de la séparation des locuteurs - Obtient l’état de la séparation des locuteurs pour un échantillon.
- Démarrer la séparation des locuteurs - Lance la séparation des locuteurs pour un échantillon.
- Récupérer l’audio d’un locuteur séparé - Récupère l’audio d’un locuteur séparé spécifique.
- Obtenir le captcha d’une voix PVC - Obtient le captcha pour la vérification d’une voix PVC.
- Vérifier le captcha d’une voix PVC - Soumet la vérification par captcha pour une voix PVC.
- Lancer l’entraînement PVC - Démarre le processus d’entraînement d’une voix PVC.
- Demander une vérification manuelle - Demande une vérification manuelle pour une voix PVC.
Points de terminaison mis à jour
Speech to Text
- Point de terminaison mis à jour :
- Créer une tâche d’alignement forcé - Ajout du paramètre
enabled_spooled_filepour permettre le streaming de fichiers volumineux (POST /v1/forced-alignment).
- Créer une tâche d’alignement forcé - Ajout du paramètre
Modifications de schéma
Plateforme Agents
GET conversation details: ajout des champs booléenshas_audio,has_user_audio,has_response_audioici
Doublage
GET dubbing resource: ajout du champstatusà chaque rendu ici