Présentation de Speech Engine
ElevenLabs Speech Engine ajoute la voix en temps réel à votre propre agent conversationnel ou LLM. ElevenLabs gère la conversion de la parole en texte, la gestion des tours de parole, la synthèse vocale et la lecture dans le navigateur, tandis que votre serveur contrôle la logique de l’agent et transmet le texte de réponse via un WebSocket Speech Engine. Utilisez-le pour ajouter la voix à un environnement d’exécution personnalisé plutôt qu’à une configuration ElevenAgents entièrement hébergée.
ElevenAgents
- Remplacements du comportement textuel : ajout de
text_behavior_overrides, une carte parConversationInitiationSourced’objetsBehaviorOverrideavec des champs facultatifsverbosity,output_formatetinteraction_budgetpour adapter le comportement de l’agent à chaque canal. - Sources d’intégration : ajout d’Intercom, Telegram et Freshdesk.
- Traces de conversation OTLP : Obtenir les détails d’une conversation accepte désormais un paramètre de requête facultatif
format. Définissezformat=otlp_tracespour renvoyer des données de trace compatibles OTLP en plus de la charge utile de conversation standard. - Remplacements de mots-clés ASR : ajout des schémas
ASRConversationalConfigOverrideetASRConversationalConfigOverrideConfig, avec des tableauxkeywordsfacultatifs, intégrés aux modèles de remplacement client de la configuration des conversations. - Métadonnées d’authentification des webhooks : les schémas de configuration des outils webhook exposent désormais
auth_resolved_paramsfacultatif (tableau de chaînes), qui documente les espaces réservés d’URL résolus à partir de la connexion d’authentification.
Musique
- Mode de génération : ajout de
MusicGenerationMode(track,loop,ambience) et d’un champ facultatifgeneration_modedans les corps de requête de prompt musical. - Modèle vidéo vers musique : Vidéo vers musique (
POST /v1/music/video-to-music) accepte désormaismodel_idfacultatif (chaîne,music_v1par défaut).
ElevenCreative Studio
- Crédits de conversion : les modèles de réponse des statistiques de conversion de chapitre et de voix incluent désormais
credits_needed_to_convertfacultatif (entier), indiquant les crédits requis avant la conversion.
Workspaces
- Types de ressources : ajout de
studio_projectsàWorkspaceResourceType.
Versions des SDK
SDK Python
- v2.50.0 - SDK régénéré pour le schéma d’API du 25 mai 2026.
- v2.49.1 - Mise à jour des appels d’API Speech Engine afin de renvoyer l’objet de réponse complet.
- v2.49.0 - SDK régénéré pour le schéma d’API du 18 au 25 mai 2026, avec les remplacements du comportement textuel d’ElevenAgents,
generation_modepour la musique etstudio_projectspour les Workspaces.
SDK JavaScript
- v2.50.0 - Ajout des méthodes et tests manquants de l’API Music, et régénération du SDK pour le schéma d’API du 25 mai 2026.
- v2.49.1 - Mise à jour des appels d’API Speech Engine afin de renvoyer l’objet de réponse complet.
- v2.49.0 - SDK régénéré pour le schéma d’API du 18 au 25 mai 2026, avec les remplacements du comportement textuel d’ElevenAgents,
generation_modepour la musique etstudio_projectspour les Workspaces.
Packages
- @elevenlabs/client@1.8.1 - Correction d’iOS Safari qui ignorait le premier message de l’agent lors des sessions vocales WebSocket, en déverrouillant un
AudioContextau premier geste de l’utilisateur et en initialisant le graphe de lecture après le chargement de l’audio worklet. - @elevenlabs/convai-widget-core@0.12.8 et @elevenlabs/convai-widget-embed@0.12.8 - Mise en forme des balises d’émotion et audio dans les transcriptions vocales lorsque
strip_audio_tagsest désactivé, et traitement determs_htmlouterms_textde niveau supérieur null comme mécanisme de désactivation de la fenêtre modale des conditions générales. - @elevenlabs/convai-widget-core@0.12.7 et @elevenlabs/convai-widget-embed@0.12.7 - Mise à jour des dépendances du widget vers
@elevenlabs/client@1.8.1.
API
Voir les modifications de l'API
Points de terminaison et schémas mis à jour
ElevenAgents
- Obtenir les détails d’une conversation -
GET /v1/convai/conversations/{conversation_id}- Ajout du paramètre de requête facultatif
format;otlp_tracesrenvoie des données de trace compatibles OTLP
- Ajout du paramètre de requête facultatif
- Schémas de configuration des agents
- Ajout de la carte
text_behavior_overrides, indexée parConversationInitiationSource, avec des valeursBehaviorOverride(verbosity,output_format,interaction_budget)
- Ajout de la carte
- Énumération
ConversationInitiationSource- Ajout de
intercom_integration,telegram_integrationetfreshdesk_integration
- Ajout de
- Schémas de remplacement ASR
- Ajout de
ASRConversationalConfigOverrideetASRConversationalConfigOverrideConfigaveckeywordsfacultatif (tableau de chaînes)
- Ajout de
- Schémas d’outils webhook
- Ajout de
auth_resolved_paramsfacultatif (tableau de chaînes) dans les modèles de configuration des webhooks
- Ajout de
Musique
- Vidéo vers musique -
POST /v1/music/video-to-music- Ajout de
model_idfacultatif (chaîne,music_v1par défaut)
- Ajout de
- Schémas de requête de prompt musical
- Ajout de
generation_modefacultatif faisant référence àMusicGenerationMode(track,loop,ambience)
- Ajout de
ElevenCreative Studio
- Schémas de statistiques de conversion de chapitre et de voix
- Ajout de
credits_needed_to_convertfacultatif (entier)
- Ajout de
Workspaces
- Énumération
WorkspaceResourceType- Ajout de
studio_projects
- Ajout de