ElevenAgents

  • Événement WebSocket agent_response_complete : un nouvel événement client agent_response_complete se déclenche exactement une fois lorsqu’une réponse d’agent est entièrement transmise, après la fin de toute génération LLM, de toutes les chaînes d’appels d’outils et de la lecture audio. Après cet événement, l’agent ne produira de nouvelle sortie que si l’utilisateur fournit une nouvelle entrée ou si un délai d’expiration de tour déclenche un nouveau tour. L’événement permet aux clients de détecter de manière fiable la fin d’un tour afin de regrouper les messages, d’activer un mot d’éveil ou de mettre à jour l’interface après le tour. Ajout d’une nouvelle valeur AGENT_RESPONSE_COMPLETE à l’énumération ClientEvent et d’un modèle de réponse AgentResponseCompleteClientEvent correspondant.

  • Mode de parole avant outil : ajout d’un nouveau champ pre_tool_speech (énumération PreToolSpeechMode, valeur par défaut auto) dans la configuration du serveur MCP et les remplacements par outil. Il remplace le booléen force_pre_tool_speech, désormais obsolète. Valeurs : auto décide si l’agent parle avant l’appel d’outil en fonction de la latence récente des outils, force demande toujours à l’agent de parler et off désactive entièrement cette fonctionnalité.

  • La répartition des outils respecte le mode d’exécution : les nœuds de répartition d’outils des workflows respectent désormais correctement le execution_mode de chaque outil imbriqué. Si un outil d’un nœud de répartition utilise POST_TOOL_SPEECH, le workflow attend que l’audio du tour en cours soit entièrement exposé avant d’exécuter la répartition.

  • Délai d’expiration des réponses MCP : ajout d’un champ response_timeout_secs (entier, valeur par défaut 30, minimum 5, maximum 120) dans la configuration du serveur MCP et les remplacements par outil, qui contrôle le délai d’attente maximal pour chaque appel d’outil MCP.

  • Contexte de confiance de l’agent : ajout d’un champ trust_context aux paramètres de plateforme de l’agent (énumération AgentTrustContext : unknown | low | high, valeur par défaut unknown). low est destiné aux agents au service de participants externes non fiables, dont les sorties doivent être vérifiées et l’accès aux outils limité ; high est destiné aux agents au service du propriétaire, pour lesquels un accès complet aux outils est approprié ; unknown couvre les agents créés avant cette fonctionnalité.

  • Option d’attribution des sources : ajout d’un booléen source_attribution (valeur par défaut false) dans la configuration de conversation. Lorsqu’il est activé et que du contenu de base de connaissances est présent, le LLM reçoit l’instruction d’indiquer les sources utilisées.

  • Filtre du mode de partage des tests : le point de terminaison répertorier les tests accepte désormais un paramètre de requête sharing_mode (all | shared_with_me, valeur par défaut all) afin de filtrer les tests et dossiers pour ne conserver que ceux partagés avec l’utilisateur actuel et qu’il n’a pas créés.

  • Icônes d’outils et métadonnées d’exécution : ajout des champs icons (tableau de Icon) et execution (ToolExecution) au schéma Tool. Icon inclut src, mimeType et sizes pour l’affichage dans l’interface, et ToolExecution.taskSupport (forbidden | optional | required) indique comment l’outil participe aux tâches.

  • Valeur par défaut du compilateur de procédures : la valeur par défaut de ProcedureCompilerMode est passée de deterministic à append, et la valeur llm a été supprimée. Les agents existants qui définissent explicitement deterministic ne sont pas concernés.

  • Métadonnées d’attribution RAG et de base de connaissances : ajout de used_static_kb_document_ids (tableau de chaînes) à ConversationHistoryTranscriptCommonModel et ConversationHistoryTranscriptResponseModel, ainsi que de used_chunk_ids à RagRetrievalInfo, afin d’indiquer précisément quels documents de base de connaissances et fragments RAG ont contribué à chaque tour de transcription.

  • Refonte des variables dynamiques : dynamic_variables et dynamic_variable_placeholders font désormais référence aux schémas unifiés DynamicVariableValueType-Input / DynamicVariableValueType-Output (qui remplacent les précédents schémas DynamicVariableContainerValueType-*), avec une prise en charge étendue des valeurs imbriquées et sous forme de listes. DynamicVariableAssignment a reçu un champ preserve_native_type pour conserver les valeurs typées plutôt que de les convertir en chaînes.

Isolation audio

  • Points de terminaison d’historique : deux nouveaux points de terminaison exposent votre historique d’isolation audio.

Speech to Text

  • Termes clés en temps réel et mode verbatim : le WebSocket Scribe en temps réel accepte désormais un paramètre keyterms (tableau de chaînes, 50 entrées maximum de 20 caractères chacune) pour orienter le modèle vers des termes spécifiques, ainsi qu’un booléen no_verbatim pour supprimer les mots de remplissage, faux départs et hésitations des transcriptions. Les deux paramètres sont renvoyés dans l’événement session_started. Disponibles dans le SDK JavaScript, le SDK Python et le SDK client navigateur/Node @elevenlabs/client.

Versions des SDK

SDK Python

  • v2.45.0 : régénération Fern pour le schéma d’API du 27 avril 2026, incluant les points de terminaison d’historique d’isolation audio, les exécutions d’outils, pre_tool_speech et response_timeout_secs de MCP, ainsi que l’événement client agent_response_complete. Comprend également une correction de l’indication d’installation dans un notebook du README.
  • v2.44.0 : régénération Fern pour le schéma d’API du 21 avril 2026, incluant le champ trust_context, le mode pre_tool_speech, la prise en charge de la transcription des ressources et la configuration du délai d’expiration des réponses MCP.

SDK JavaScript

  • v2.45.0 : ajout des options keyterms (tableau de chaînes, 50 termes clés maximum de 20 caractères chacun) et noVerbatim (booléen) au client Scribe en temps réel. Les keyterms sont envoyés comme paramètres de requête répétés dans l’URL WebSocket afin d’orienter la transcription, et noVerbatim supprime les mots de remplissage et les hésitations. Les deux champs sont également ajoutés à l’interface typée Config pour l’écho session_started. Comprend également la régénération Fern du 27 avril 2026 (#376).
  • v2.44.0 : régénération Fern pour le schéma d’API du 21 avril 2026, incluant le champ trust_context, le mode pre_tool_speech et la configuration du délai d’expiration des réponses MCP.

SDK Swift

  • v3.1.4 : correction d’un problème où le microphone local continuait à publier après la déconnexion d’un agent (délai d’expiration du silence ou outil end_call). onAgentDisconnected déconnecte désormais la salle LiveKit et supprime l’état de conversation, avec le déclenchement de onDisconnect pour une raison .agent. ConnectionManaging.onAgentDisconnected est désormais async. Suppression de l’enveloppe ConversationConnectionManager inutilisée.

Packages

API

Nouveaux points de terminaison

Points de terminaison mis à jour

ElevenAgents

  • Créer un agent, Obtenir un agent, Mettre à jour un agent

    • Ajout du champ trust_context (énumération AgentTrustContext : unknown | low | high, valeur par défaut unknown) à AgentPlatformSettingsRequestModel
    • Ajout du champ source_attribution (booléen, valeur par défaut false) à ConversationConfig
  • Mettre à jour la configuration du serveur MCP, Créer un serveur MCP

    • Ajout du champ pre_tool_speech (énumération PreToolSpeechMode : auto | force | off, valeur par défaut auto)
    • Ajout du champ response_timeout_secs (entier, valeur par défaut 30, minimum 5, maximum 120)
  • Créer un remplacement de configuration, Mettre à jour un remplacement de configuration

    • Ajout du champ pre_tool_speech (énumération PreToolSpeechMode, nullable, facultatif)
    • Ajout du champ response_timeout_secs (entier, nullable, facultatif)
    • Ajout du champ response_mocks à MCPToolConfigOverride-Input / MCPToolConfigOverride-Output
    • force_pre_tool_speech marqué comme obsolète ; utilisez plutôt pre_tool_speech
  • Répertorier les tests

    • Ajout du paramètre de requête facultatif sharing_mode (énumération TestSharingMode : all | shared_with_me, valeur par défaut all)
  • Simuler une conversation, Diffuser la simulation d’une conversation

    • Refonte des charges utiles dynamic_variables et dynamic_variable_placeholders afin de référencer les schémas unifiés DynamicVariableValueType-Input / DynamicVariableValueType-Output, avec une prise en charge étendue des valeurs imbriquées et sous forme de listes
  • Schéma Tool

    • Ajout du champ icons (tableau de Icon, nullable) pour l’affichage dans l’interface
    • Ajout du champ execution (ToolExecution, nullable), incluant taskSupport (forbidden | optional | required)
  • Énumération ClientEvent

    • Ajout de la valeur agent_response_complete avec le nouveau modèle de réponse AgentResponseCompleteClientEvent
  • Énumération ProcedureCompilerMode

    • Valeur par défaut passée de deterministic à append
    • Suppression de la valeur llm
  • ConversationHistoryTranscriptCommonModel, ConversationHistoryTranscriptResponseModel

    • Ajout du champ used_static_kb_document_ids (tableau de chaînes)
  • RagRetrievalInfo

    • Ajout du champ used_chunk_ids (tableau de chaînes)
  • DynamicVariableAssignment

    • Ajout du champ preserve_native_type (booléen) pour conserver les valeurs typées au lieu de les convertir en chaînes
  • Nœuds de workflow

    • Ajout du champ auto_advance_after_first_response aux schémas de nœuds de workflow concernés
  • Documentation de configuration des outils

    • Ajout du champ response_body_schema pour documenter la structure de réponse attendue

Workspaces

  • GetUserSubscriptionResponseModel

    • Ajout du champ max_credit_limit_extension
  • Obtenir l’utilisation du Workspace par produit au fil du temps

    • Validation des requêtes renforcée : les valeurs minimales de start_time et end_time sont relevées à 2020-01-01, et des descriptions sont ajoutées aux deux champs. Le résumé du point de terminaison a été renommé Get Workspace Usage.

Autres

  • Nouvelle énumération partagée Currency avec les valeurs eur, inr, usd, remplaçant les chaînes de devise en ligne dans plusieurs schémas.
  • Les nouveaux schémas AssetTranscription et AssetTranscriptionData étendent les modèles de ressources avec la prise en charge de la transcription.
  • Les nouveaux modèles PendingBlocksMetadataModel et PendingExternalAudiosMetadataModel fournissent des métadonnées plus riches sur les tâches en attente.
  • Nouvelle valeur InVPC ajoutée aux énumérations liées aux sources.
  • Les keyterms de transcription ont désormais des restrictions de longueur explicites dans la spécification.
  • Ajout des nouveaux schémas MemoryEntrySearchResult, ConversationSource et ManualSource.