Présentation de Music v2

Music v2 est désormais disponible via l’API ElevenLabs. Définissez model_id sur music_v2 dans Generate music, Stream music, Generate music detailed et Upload music pour utiliser le nouveau modèle. Music v2 introduit des plans de composition basés sur des segments, construits à partir de segments GenerationChunk et AudioRefChunk, et vous offre un contrôle plus précis de la structure, du rythme et de l’arrangement que le flux music_v1 basé sur les prompts.

Utilisez les plans de composition music_v2 dans les requêtes de génération et d’importation, ou générez d’abord un plan via le point de terminaison des plans de composition. Les corps de requête et de réponse acceptent les formats de plan v1 et v2, ce qui vous permet de migrer point de terminaison par point de terminaison. MusicPrompt reste disponible uniquement pour music_v1.

  • Horodatages à l’importation : Upload music accepte with_timestamps facultatif ; les réponses peuvent inclure words_timestamps.

ElevenAgents

  • Exécuter une évaluation de conversation : ajout du point de terminaison Run conversation evaluation (POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run) pour réexécuter un critère d’évaluation unique sur une conversation terminée à l’aide de RunConversationEvaluationsRequest.
  • Comportement à l’entrée du workflow : les nœuds de workflow de remplacement d’agent ajoutent entry_behavior facultatif (generate_immediately, wait_for_user, auto) afin de contrôler si le sous-agent parle en premier ou attend une saisie de l’utilisateur.
  • Outil système de fin de procédure : ajout de la configuration de l’outil système end_procedure avec les statuts d’erreur correspondants. L’outil start_procedure ajoute already_active à ses statuts d’erreur.
  • Remplacements TTS lors des transferts : AgentTransfer, les nœuds d’agent autonome du workflow et les résultats réussis de l’outil transfer_to_agent ajoutent preserve_client_tts_overrides facultatif (booléen) pour conserver les remplacements TTS côté client après un transfert.
  • Énumération du budget d’interaction : InteractionBudget supprime async et ajoute 5_minutes, 10_minutes et 1_hour. Mettez à jour les configurations ou énumérations SDK qui font encore référence à async.
  • Sélection du modèle de garde-fou personnalisé : la configuration des garde-fous personnalisés ajoute model facultatif avec des variantes Gemini, Claude et GPT. La configuration de garde-fou ajoute également history_message_count facultatif (entier).
  • Filtres de liste des numéros de téléphone : List phone numbers ajoute les paramètres de requête facultatifs provider, agent_id et branch_id pour filtrer les numéros importés.
  • Filtrage des comptes WhatsApp : List WhatsApp accounts ajoute le paramètre de requête facultatif agent_id pour filtrer les comptes par agent attribué.
  • Filtres de plage temporelle des sujets : Get agent conversation topics ajoute les paramètres de requête facultatifs from_unix_secs et to_unix_secs pour délimiter les résultats de découverte des sujets.
  • Configuration des codecs SIP : les modèles de requête et de réponse des trunks SIP sortants ajoutent enabled_codecs facultatif (énumération MediaCodec).
  • Types d’outil de mémoire : ajout des schémas LoadableMemoryEntry et LoadMemoryEntryToolErrorStatus pour la gestion des erreurs des outils de mémoire.
  • Limites des lots de tests d’agents : les schémas de requête d’association, d’exécution et de soumission à nouveau des tests d’agents portent le nombre maximal de tests associés de 1 000 à 5 000.
  • Prise en charge des balises de phonèmes : les paramètres TTS de l’agent ajoutent enable_phoneme_tags facultatif (booléen) pour activer la gestion des phonèmes SSML V3.
  • Remplacements d’omission du schéma de tableau : les propriétés de schéma JSON de tableau ajoutent is_omitted facultatif, mutuellement exclusif avec les autres sources de valeurs. ConstantSchemaOverride peut utiliser des valeurs constantes de tableau.
  • Contexte d’erreur de transfert : les charges utiles d’erreur de transfert vers un numéro peuvent inclure agent_message facultatif (chaîne).

Workspaces

  • Mises à jour des clés API de comptes de service : Update service account API key ne nécessite plus de corps de requête. Les champs modifiables prennent en charge les mises à jour partielles via no_update et name nullable, y compris permissions et character_limit.
  • Regroupement de l’utilisation par fuseau horaire : les requêtes d’utilisation du Workspace par produit dans le temps ajoutent time_zone facultatif (chaîne de fuseau horaire IANA), avec des règles de regroupement interval_seconds clarifiées.
  • Filtre de source de l’historique : les filtres source de liste et de détail de l’historique ajoutent Flows.

ElevenCreative Studio

  • Références vocales des projets : les modèles de projet, les nœuds TTS de chapitre, les listes de voix et les statistiques vocales passent à project_voice_ref_id comme champ vocal de référence. Les anciens champs voice_id restent présents dans les réponses en tant que miroirs obsolètes en lecture seule, à des fins de compatibilité.

Speech to Text

  • Diarisation avec la bibliothèque de locuteurs : Convert speech to text ajoute use_speaker_library facultatif (booléen, false par défaut) pour la diarisation des transcriptions par lot.

Voix

  • Tri des voix partagées : le paramètre de requête sort de List shared voices reçoit une énumération explicite, created_date comme valeur par défaut et une description mise à jour.

Versions des SDK

SDK JavaScript

  • v2.53.0 - Régénéré à partir du dernier schéma OpenAPI avec la prise en charge de la réexécution des évaluations de conversation, les unions de plans de composition Music v2, entry_behavior du workflow, les filtres de liste des numéros de téléphone et de WhatsApp, les paramètres de plage temporelle des sujets, les mises à jour du schéma d’alertes, les champs project_voice_ref_id de Studio et les limites élargies des lots de tests d’agents.

SDK Python

  • v2.53.0 - Régénéré à partir du dernier schéma OpenAPI avec la prise en charge de la réexécution des évaluations de conversation, les plans de composition Music v2, le comportement d’entrée du workflow et les outils de fin de procédure, les paramètres de filtre de téléphonie, les modèles de mise à jour partielle d’alertes et de comptes de service, ainsi que les champs de référence vocale de Studio.

Packages

SDK iOS

  • v3.2.1 - Ajout de la prise en charge de la résidence des données à Singapour et activation de singlePeerConnection pour les sessions WebRTC.

API

Nouveaux points de terminaison

ElevenAgents

  • Run conversation evaluation - POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run
    • Le corps de la requête utilise RunConversationEvaluationsRequest pour réexécuter un critère d’évaluation unique

Points de terminaison mis à jour

ElevenAgents

  • List phone numbers - GET /v1/convai/phone-numbers
    • Ajout des paramètres de requête facultatifs provider, agent_id et branch_id
  • Get agent conversation topics - GET /v1/convai/agents/{agent_id}/topics
    • Ajout des paramètres de requête facultatifs from_unix_secs et to_unix_secs
  • List WhatsApp accounts - GET /v1/convai/whatsapp-accounts
    • Ajout du paramètre de requête facultatif agent_id

Music

Speech to Text

  • Convert speech to text - POST /v1/speech-to-text
    • Ajout du paramètre de requête facultatif use_speaker_library (booléen, false par défaut)

Voix

  • List shared voices - GET /v1/shared-voices
    • Le paramètre de requête sort utilise désormais une énumération explicite avec created_date par défaut

Modifications des schémas

ElevenAgents

  • Nœuds de workflow de remplacement d’agent
    • Ajout de l’énumération facultative entry_behavior (generate_immediately, wait_for_user, auto)
  • Outils système
    • Ajout de la configuration d’outil end_procedure et des statuts d’erreur
  • Schémas de transfert et d’interaction
    • Ajout de preserve_client_tts_overrides facultatif sur les transferts et les résultats d’outils de transfert
    • InteractionBudget supprime async ; ajoute 5_minutes, 10_minutes, 1_hour
  • Garde-fous et TTS
    • Les garde-fous personnalisés ajoutent model et history_message_count facultatifs
    • Les paramètres TTS de l’agent ajoutent enable_phoneme_tags facultatif
  • Téléphonie
    • Les modèles de trunks SIP ajoutent enabled_codecs facultatif (énumération MediaCodec)
  • Outils de mémoire et de code
    • Ajout de LoadableMemoryEntry et LoadMemoryEntryToolErrorStatus
  • Tests d’agents
    • Augmentation des limites de tests associés de 1 000 à 5 000 dans les requêtes d’exécution et de soumission à nouveau
  • Propriétés de schéma JSON des outils
    • Les propriétés de tableau ajoutent is_omitted facultatif

Workspaces

  • Comptes de service
    • PATCH de clé API prend en charge les mises à jour partielles avec des sentinelles no_update
  • Utilisation et historique
    • L’utilisation par produit dans le temps ajoute time_zone facultatif
    • Les filtres source de l’historique ajoutent Flows

Music

  • Plans de composition
    • Ajout de CompositionPlan, GenerationChunk et AudioRefChunk basés sur des segments pour music_v2
    • Les corps de requête et de réponse acceptent les formats de plan v1 ou v2 avec anyOf

ElevenCreative Studio

  • Modèles de voix de projet
    • Ajout de project_voice_ref_id comme référence vocale canonique
    • Les miroirs voice_id obsolètes en lecture seule sont conservés dans les réponses