Présentation de Music v2
Music v2 est désormais disponible via l’API ElevenLabs. Définissez model_id sur music_v2 dans Generate music, Stream music, Generate music detailed et Upload music pour utiliser le nouveau modèle. Music v2 introduit des plans de composition basés sur des segments, construits à partir de segments GenerationChunk et AudioRefChunk, et vous offre un contrôle plus précis de la structure, du rythme et de l’arrangement que le flux music_v1 basé sur les prompts.
Utilisez les plans de composition music_v2 dans les requêtes de génération et d’importation, ou générez d’abord un plan via le point de terminaison des plans de composition. Les corps de requête et de réponse acceptent les formats de plan v1 et v2, ce qui vous permet de migrer point de terminaison par point de terminaison. MusicPrompt reste disponible uniquement pour music_v1.
- Horodatages à l’importation : Upload music accepte
with_timestampsfacultatif ; les réponses peuvent inclurewords_timestamps.
ElevenAgents
- Exécuter une évaluation de conversation : ajout du point de terminaison Run conversation evaluation (
POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run) pour réexécuter un critère d’évaluation unique sur une conversation terminée à l’aide deRunConversationEvaluationsRequest. - Comportement à l’entrée du workflow : les nœuds de workflow de remplacement d’agent ajoutent
entry_behaviorfacultatif (generate_immediately,wait_for_user,auto) afin de contrôler si le sous-agent parle en premier ou attend une saisie de l’utilisateur. - Outil système de fin de procédure : ajout de la configuration de l’outil système
end_procedureavec les statuts d’erreur correspondants. L’outilstart_procedureajoutealready_activeà ses statuts d’erreur. - Remplacements TTS lors des transferts :
AgentTransfer, les nœuds d’agent autonome du workflow et les résultats réussis de l’outiltransfer_to_agentajoutentpreserve_client_tts_overridesfacultatif (booléen) pour conserver les remplacements TTS côté client après un transfert. - Énumération du budget d’interaction :
InteractionBudgetsupprimeasyncet ajoute5_minutes,10_minuteset1_hour. Mettez à jour les configurations ou énumérations SDK qui font encore référence àasync. - Sélection du modèle de garde-fou personnalisé : la configuration des garde-fous personnalisés ajoute
modelfacultatif avec des variantes Gemini, Claude et GPT. La configuration de garde-fou ajoute égalementhistory_message_countfacultatif (entier). - Filtres de liste des numéros de téléphone : List phone numbers ajoute les paramètres de requête facultatifs
provider,agent_idetbranch_idpour filtrer les numéros importés. - Filtrage des comptes WhatsApp : List WhatsApp accounts ajoute le paramètre de requête facultatif
agent_idpour filtrer les comptes par agent attribué. - Filtres de plage temporelle des sujets : Get agent conversation topics ajoute les paramètres de requête facultatifs
from_unix_secsetto_unix_secspour délimiter les résultats de découverte des sujets. - Configuration des codecs SIP : les modèles de requête et de réponse des trunks SIP sortants ajoutent
enabled_codecsfacultatif (énumérationMediaCodec). - Types d’outil de mémoire : ajout des schémas
LoadableMemoryEntryetLoadMemoryEntryToolErrorStatuspour la gestion des erreurs des outils de mémoire. - Limites des lots de tests d’agents : les schémas de requête d’association, d’exécution et de soumission à nouveau des tests d’agents portent le nombre maximal de tests associés de 1 000 à 5 000.
- Prise en charge des balises de phonèmes : les paramètres TTS de l’agent ajoutent
enable_phoneme_tagsfacultatif (booléen) pour activer la gestion des phonèmes SSML V3. - Remplacements d’omission du schéma de tableau : les propriétés de schéma JSON de tableau ajoutent
is_omittedfacultatif, mutuellement exclusif avec les autres sources de valeurs.ConstantSchemaOverridepeut utiliser des valeurs constantes de tableau. - Contexte d’erreur de transfert : les charges utiles d’erreur de transfert vers un numéro peuvent inclure
agent_messagefacultatif (chaîne).
Workspaces
- Mises à jour des clés API de comptes de service : Update service account API key ne nécessite plus de corps de requête. Les champs modifiables prennent en charge les mises à jour partielles via
no_updateetnamenullable, y comprispermissionsetcharacter_limit. - Regroupement de l’utilisation par fuseau horaire : les requêtes d’utilisation du Workspace par produit dans le temps ajoutent
time_zonefacultatif (chaîne de fuseau horaire IANA), avec des règles de regroupementinterval_secondsclarifiées. - Filtre de source de l’historique : les filtres
sourcede liste et de détail de l’historique ajoutentFlows.
ElevenCreative Studio
- Références vocales des projets : les modèles de projet, les nœuds TTS de chapitre, les listes de voix et les statistiques vocales passent à
project_voice_ref_idcomme champ vocal de référence. Les anciens champsvoice_idrestent présents dans les réponses en tant que miroirs obsolètes en lecture seule, à des fins de compatibilité.
Speech to Text
- Diarisation avec la bibliothèque de locuteurs : Convert speech to text ajoute
use_speaker_libraryfacultatif (booléen,falsepar défaut) pour la diarisation des transcriptions par lot.
Voix
- Tri des voix partagées : le paramètre de requête
sortde List shared voices reçoit une énumération explicite,created_datecomme valeur par défaut et une description mise à jour.
Versions des SDK
SDK JavaScript
- v2.53.0 - Régénéré à partir du dernier schéma OpenAPI avec la prise en charge de la réexécution des évaluations de conversation, les unions de plans de composition Music v2,
entry_behaviordu workflow, les filtres de liste des numéros de téléphone et de WhatsApp, les paramètres de plage temporelle des sujets, les mises à jour du schéma d’alertes, les champsproject_voice_ref_idde Studio et les limites élargies des lots de tests d’agents.
SDK Python
- v2.53.0 - Régénéré à partir du dernier schéma OpenAPI avec la prise en charge de la réexécution des évaluations de conversation, les plans de composition Music v2, le comportement d’entrée du workflow et les outils de fin de procédure, les paramètres de filtre de téléphonie, les modèles de mise à jour partielle d’alertes et de comptes de service, ainsi que les champs de référence vocale de Studio.
Packages
- @elevenlabs/client@1.11.0 - Ajout de l’exportation de sous-chemin
@elevenlabs/client/internal/unitypour le pont WebGL du SDK Unity, exposantMediaDeviceInput,MediaDeviceOutput, des assistants d’association de connexion et des types d’adaptateur WebRTC. - @elevenlabs/client@1.11.1, @elevenlabs/react@1.6.7, @elevenlabs/react-native@1.2.7, @elevenlabs/convai-widget-core@0.14.2 et @elevenlabs/convai-widget-embed@0.14.2 - Alignement des dépendances sur
@elevenlabs/client@1.11.1et@elevenlabs/types@0.14.1. - @elevenlabs/types@0.14.1 - Ajout de
"license": "MIT"àpackage.jsonpour la compatibilité avec license-checker.
SDK iOS
- v3.2.1 - Ajout de la prise en charge de la résidence des données à Singapour et activation de
singlePeerConnectionpour les sessions WebRTC.
API
Voir les modifications de l’API
Nouveaux points de terminaison
ElevenAgents
- Run conversation evaluation -
POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run- Le corps de la requête utilise
RunConversationEvaluationsRequestpour réexécuter un critère d’évaluation unique
- Le corps de la requête utilise
Points de terminaison mis à jour
ElevenAgents
- List phone numbers -
GET /v1/convai/phone-numbers- Ajout des paramètres de requête facultatifs
provider,agent_idetbranch_id
- Ajout des paramètres de requête facultatifs
- Get agent conversation topics -
GET /v1/convai/agents/{agent_id}/topics- Ajout des paramètres de requête facultatifs
from_unix_secsetto_unix_secs
- Ajout des paramètres de requête facultatifs
- List WhatsApp accounts -
GET /v1/convai/whatsapp-accounts- Ajout du paramètre de requête facultatif
agent_id
- Ajout du paramètre de requête facultatif
Music
- Generate music, Generate music detailed, Stream music et Upload music
- Ajout de
music_v2aux valeursmodel_idprises en charge - L’importation ajoute
with_timestampsfacultatif ; les réponses peuvent inclurewords_timestamps
- Ajout de
Speech to Text
- Convert speech to text -
POST /v1/speech-to-text- Ajout du paramètre de requête facultatif
use_speaker_library(booléen,falsepar défaut)
- Ajout du paramètre de requête facultatif
Voix
- List shared voices -
GET /v1/shared-voices- Le paramètre de requête
sortutilise désormais une énumération explicite aveccreated_datepar défaut
- Le paramètre de requête
Modifications des schémas
ElevenAgents
- Nœuds de workflow de remplacement d’agent
- Ajout de l’énumération facultative
entry_behavior(generate_immediately,wait_for_user,auto)
- Ajout de l’énumération facultative
- Outils système
- Ajout de la configuration d’outil
end_procedureet des statuts d’erreur
- Ajout de la configuration d’outil
- Schémas de transfert et d’interaction
- Ajout de
preserve_client_tts_overridesfacultatif sur les transferts et les résultats d’outils de transfert InteractionBudgetsupprimeasync; ajoute5_minutes,10_minutes,1_hour
- Ajout de
- Garde-fous et TTS
- Les garde-fous personnalisés ajoutent
modelethistory_message_countfacultatifs - Les paramètres TTS de l’agent ajoutent
enable_phoneme_tagsfacultatif
- Les garde-fous personnalisés ajoutent
- Téléphonie
- Les modèles de trunks SIP ajoutent
enabled_codecsfacultatif (énumérationMediaCodec)
- Les modèles de trunks SIP ajoutent
- Outils de mémoire et de code
- Ajout de
LoadableMemoryEntryetLoadMemoryEntryToolErrorStatus
- Ajout de
- Tests d’agents
- Augmentation des limites de tests associés de 1 000 à 5 000 dans les requêtes d’exécution et de soumission à nouveau
- Propriétés de schéma JSON des outils
- Les propriétés de tableau ajoutent
is_omittedfacultatif
- Les propriétés de tableau ajoutent
Workspaces
- Comptes de service
- PATCH de clé API prend en charge les mises à jour partielles avec des sentinelles
no_update
- PATCH de clé API prend en charge les mises à jour partielles avec des sentinelles
- Utilisation et historique
- L’utilisation par produit dans le temps ajoute
time_zonefacultatif - Les filtres
sourcede l’historique ajoutentFlows
- L’utilisation par produit dans le temps ajoute
Music
- Plans de composition
- Ajout de
CompositionPlan,GenerationChunketAudioRefChunkbasés sur des segments pourmusic_v2 - Les corps de requête et de réponse acceptent les formats de plan v1 ou v2 avec
anyOf
- Ajout de
ElevenCreative Studio
- Modèles de voix de projet
- Ajout de
project_voice_ref_idcomme référence vocale canonique - Les miroirs
voice_idobsolètes en lecture seule sont conservés dans les réponses
- Ajout de