Présentation de Speech Engine

ElevenLabs Speech Engine ajoute la voix en temps réel à votre propre agent conversationnel ou LLM. ElevenLabs gère la conversion de la parole en texte, la gestion des tours de parole, la synthèse vocale et la lecture dans le navigateur, tandis que votre serveur contrôle la logique de l’agent et transmet le texte de réponse via un WebSocket Speech Engine. Utilisez-le pour ajouter la voix à un environnement d’exécution personnalisé plutôt qu’à une configuration ElevenAgents entièrement hébergée.

ElevenAgents

  • Remplacements du comportement textuel : ajout de text_behavior_overrides, une carte par ConversationInitiationSource d’objets BehaviorOverride avec des champs facultatifs verbosity, output_format et interaction_budget pour adapter le comportement de l’agent à chaque canal.
  • Sources d’intégration : ajout d’Intercom, Telegram et Freshdesk.
  • Traces de conversation OTLP : Obtenir les détails d’une conversation accepte désormais un paramètre de requête facultatif format. Définissez format=otlp_traces pour renvoyer des données de trace compatibles OTLP en plus de la charge utile de conversation standard.
  • Remplacements de mots-clés ASR : ajout des schémas ASRConversationalConfigOverride et ASRConversationalConfigOverrideConfig, avec des tableaux keywords facultatifs, intégrés aux modèles de remplacement client de la configuration des conversations.
  • Métadonnées d’authentification des webhooks : les schémas de configuration des outils webhook exposent désormais auth_resolved_params facultatif (tableau de chaînes), qui documente les espaces réservés d’URL résolus à partir de la connexion d’authentification.

Musique

  • Mode de génération : ajout de MusicGenerationMode (track, loop, ambience) et d’un champ facultatif generation_mode dans les corps de requête de prompt musical.
  • Modèle vidéo vers musique : Vidéo vers musique (POST /v1/music/video-to-music) accepte désormais model_id facultatif (chaîne, music_v1 par défaut).

ElevenCreative Studio

  • Crédits de conversion : les modèles de réponse des statistiques de conversion de chapitre et de voix incluent désormais credits_needed_to_convert facultatif (entier), indiquant les crédits requis avant la conversion.

Workspaces

  • Types de ressources : ajout de studio_projects à WorkspaceResourceType.

Versions des SDK

SDK Python

  • v2.50.0 - SDK régénéré pour le schéma d’API du 25 mai 2026.
  • v2.49.1 - Mise à jour des appels d’API Speech Engine afin de renvoyer l’objet de réponse complet.
  • v2.49.0 - SDK régénéré pour le schéma d’API du 18 au 25 mai 2026, avec les remplacements du comportement textuel d’ElevenAgents, generation_mode pour la musique et studio_projects pour les Workspaces.

SDK JavaScript

  • v2.50.0 - Ajout des méthodes et tests manquants de l’API Music, et régénération du SDK pour le schéma d’API du 25 mai 2026.
  • v2.49.1 - Mise à jour des appels d’API Speech Engine afin de renvoyer l’objet de réponse complet.
  • v2.49.0 - SDK régénéré pour le schéma d’API du 18 au 25 mai 2026, avec les remplacements du comportement textuel d’ElevenAgents, generation_mode pour la musique et studio_projects pour les Workspaces.

Packages

API

Points de terminaison et schémas mis à jour

ElevenAgents

  • Obtenir les détails d’une conversation - GET /v1/convai/conversations/{conversation_id}
    • Ajout du paramètre de requête facultatif format ; otlp_traces renvoie des données de trace compatibles OTLP
  • Schémas de configuration des agents
    • Ajout de la carte text_behavior_overrides, indexée par ConversationInitiationSource, avec des valeurs BehaviorOverride (verbosity, output_format, interaction_budget)
  • Énumération ConversationInitiationSource
    • Ajout de intercom_integration, telegram_integration et freshdesk_integration
  • Schémas de remplacement ASR
    • Ajout de ASRConversationalConfigOverride et ASRConversationalConfigOverrideConfig avec keywords facultatif (tableau de chaînes)
  • Schémas d’outils webhook
    • Ajout de auth_resolved_params facultatif (tableau de chaînes) dans les modèles de configuration des webhooks

Musique

  • Vidéo vers musique - POST /v1/music/video-to-music
    • Ajout de model_id facultatif (chaîne, music_v1 par défaut)
  • Schémas de requête de prompt musical
    • Ajout de generation_mode facultatif faisant référence à MusicGenerationMode (track, loop, ambience)

ElevenCreative Studio

  • Schémas de statistiques de conversion de chapitre et de voix
    • Ajout de credits_needed_to_convert facultatif (entier)

Workspaces

  • Énumération WorkspaceResourceType
    • Ajout de studio_projects