ElevenAgents
-
**
agent_response_completeWebSocket 事件 **:当智能体的回复完全交付时,新的agent_response_complete客户端事件会准确触发一次——即所有 LLM 生成、工具调用链和音频播放完成后。此事件后,只有在用户提供新输入或轮次超时触发新轮次时,智能体才会继续输出。客户端可借此可靠检测轮次结束,以便批量处理消息、激活唤醒词或在轮次结束后更新 UI。ClientEvent枚举新增AGENT_RESPONSE_COMPLETE值,以及对应的AgentResponseCompleteClientEvent响应模型。 -
工具调用前语音模式:在 MCP 服务器配置和每个工具的覆盖配置中新增
pre_tool_speech字段(PreToolSpeechMode枚举,默认值为auto)。该字段取代现已弃用的force_pre_tool_speech布尔值。取值包括:auto根据近期工具延迟决定智能体是否在调用工具前说话;force始终要求智能体说话;off则完全禁用此行为。 -
工具分发遵循执行模式:workflow 工具分发节点现在能正确遵循每个嵌套工具的
execution_mode。如果分发节点中的任一工具使用POST_TOOL_SPEECH,workflow 会等待当前轮次的音频完全输出后再执行分发。 -
MCP 响应超时:在 MCP 服务器配置和每个工具的覆盖配置中新增
response_timeout_secs字段(整数,默认值30,最小值5,最大值120),用于控制等待每次 MCP 工具调用完成的最长时间。 -
智能体信任上下文:在智能体平台设置中新增
trust_context字段(AgentTrustContext枚举:unknown|low|high,默认值unknown)。low适用于服务不受信任外部参与者的智能体,此类智能体的输出应经过审核,工具访问权限也应受到限制;high适用于服务所有者的智能体,可获得完整工具访问权限;unknown则涵盖此功能推出前创建的智能体。 -
来源归因开关:在对话配置中新增
source_attribution布尔值(默认值false)。启用后,如果存在知识库内容,系统会指示 LLM 报告其使用了哪些来源。 -
测试共享模式筛选器:列出测试端点现在接受
sharing_mode查询参数(all|shared_with_me,默认值all),可将测试和文件夹筛选为仅显示当前用户未创建、但与其共享的内容。 -
工具图标和执行元数据:
Toolschema 新增icons(Icon数组)和execution(ToolExecution)字段。Icon包含用于 UI 显示的src、mimeType和sizes,而ToolExecution.taskSupport(forbidden|optional|required)声明该工具如何参与任务。 -
过程编译器默认值:
ProcedureCompilerMode的默认值已从deterministic更改为append,并移除了llm值。明确设置了deterministic的现有智能体不受影响。 -
RAG 和知识库归因元数据:在
ConversationHistoryTranscriptCommonModel和ConversationHistoryTranscriptResponseModel中新增used_static_kb_document_ids(字符串数组),并在RagRetrievalInfo中新增used_chunk_ids,用于准确显示哪些知识库文档和 RAG 分块参与了每个转录轮次。 -
动态变量重构:
dynamic_variables和dynamic_variable_placeholders现引用统一的DynamicVariableValueType-Input/DynamicVariableValueType-Outputschema(替换原有的DynamicVariableContainerValueType-*schema),并更广泛支持嵌套值和列表值。DynamicVariableAssignment新增preserve_native_type字段,用于保留类型化值而不是将其强制转换为字符串。
音频分离
- 历史记录端点:两个新端点可查看音频分离历史记录。
- 列出音频分离历史记录(
GET /v1/audio-isolation/history)返回所有音频分离生成记录的分页列表。支持page_size、page和search查询参数。 - 删除音频分离历史记录项(
DELETE /v1/audio-isolation/history/{history_item_id})删除指定项目及其关联媒体文件。
- 列出音频分离历史记录(
语音转文本
- 实时关键词和逐字转录模式:Scribe 实时 WebSocket现在接受
keyterms参数(字符串数组,最多 50 项,每项最多 20 个字符),用于让模型倾向识别特定术语;还接受no_verbatim布尔值,用于从转录文本中移除填充词、重复起句和不流畅表达。这两个参数都会在session_started事件中回显。已在 JavaScript SDK、Python SDK 和@elevenlabs/client浏览器/Node 客户端 SDK 中提供。
SDK 发布
Python SDK
- v2.45.0 - 针对 2026 年 4 月 27 日 API schema 的 Fern 重新生成,包括音频分离历史记录端点、工具执行、MCP
pre_tool_speech和response_timeout_secs,以及agent_response_complete客户端事件。还修复了 README 中的 notebook 安装提示。 - v2.44.0 - 针对 2026 年 4 月 21 日 API schema 的 Fern 重新生成,包含
trust_context字段、pre_tool_speech模式、资产转录支持和 MCP 响应超时配置。
JavaScript SDK
- v2.45.0 - 在 Scribe 实时客户端中新增
keyterms(字符串数组,最多 50 个关键词,每个最多 20 个字符)和noVerbatim(布尔值)选项。keyterms会作为 WebSocket URL 上的重复查询参数发送,以倾向特定转录结果;noVerbatim会移除填充词和不流畅表达。这两个字段也已添加到用于session_started回显的类型化Config接口中。还包括 2026 年 4 月 27 日的 Fern 重新生成(#376)。 - v2.44.0 - 针对 2026 年 4 月 21 日 API schema 的 Fern 重新生成,包含
trust_context字段、pre_tool_speech模式和 MCP 响应超时配置。
Swift SDK
- v3.1.4 - 修复了智能体断开连接后(静默超时或
end_call工具),本地麦克风仍持续发布的问题。onAgentDisconnected现在会断开 LiveKit 房间并清理对话状态,随后onDisconnect会触发.agent原因。ConnectionManaging.onAgentDisconnected现在为async。移除了未使用的ConversationConnectionManager包装器。
软件包
- @elevenlabs/client@1.3.1 - 修复了智能体工具调用声音被识别为用户语音,并在工具执行期间中断智能体的问题。
- @elevenlabs/client@1.3.0 - 新增对上传对话文件端点的支持,客户端可直接通过客户端 SDK 将文件附加到进行中的对话。
- @elevenlabs/react@1.2.1, @elevenlabs/react@1.2.0 - 更新至
@elevenlabs/client@1.3.1/@elevenlabs/client@1.3.0,包含工具调用声音修复和对话文件上传支持。 - @elevenlabs/react-native@1.1.3, @elevenlabs/react-native@1.1.2 - 更新至最新的
@elevenlabs/client,包含相同修复。 - @elevenlabs/convai-widget-core@0.11.6, @elevenlabs/convai-widget-embed@0.11.6 - 更新至
@elevenlabs/client@1.3.1,包含工具调用声音修复。 - @elevenlabs/convai-widget-core@0.11.5, @elevenlabs/convai-widget-embed@0.11.5 - 更新至
@elevenlabs/client@1.3.0,支持上传对话文件。
API
查看 API 变更
新端点
- 列出音频分离历史记录 -
GET /v1/audio-isolation/history - 删除音频分离历史记录项 -
DELETE /v1/audio-isolation/history/{history_item_id} - 获取工具执行记录 -
GET /v1/convai/tools/{tool_id}/executions返回指定工具的分页执行记录,支持可选的cursor、page_size、is_error、agent_id、branch_id、start_time和end_time筛选条件
更新的端点
ElevenAgents
-
- 在
AgentPlatformSettingsRequestModel中新增trust_context字段(AgentTrustContext枚举:unknown|low|high,默认值unknown) - 在
ConversationConfig中新增source_attribution字段(布尔值,默认值false)
- 在
-
- 新增
pre_tool_speech字段(PreToolSpeechMode枚举:auto|force|off,默认值auto) - 新增
response_timeout_secs字段(整数,默认值30,最小值5,最大值120)
- 新增
-
- 新增
pre_tool_speech字段(PreToolSpeechMode枚举,可为 null,可选) - 新增
response_timeout_secs字段(整数,可为 null,可选) - 在
MCPToolConfigOverride-Input/MCPToolConfigOverride-Output中新增response_mocks字段 - 将
force_pre_tool_speech标记为已弃用;请改用pre_tool_speech
- 新增
-
- 新增可选的
sharing_mode查询参数(TestSharingMode枚举:all|shared_with_me,默认值all)
- 新增可选的
-
- 重构
dynamic_variables和dynamic_variable_placeholders载荷,使其引用统一的DynamicVariableValueType-Input/DynamicVariableValueType-Outputschema,并提供更广泛的嵌套值和列表值支持
- 重构
-
Toolschema- 新增用于 UI 显示的
icons字段(Icon数组,可为 null) - 新增
execution字段(ToolExecution,可为 null),包含taskSupport(forbidden|optional|required)
- 新增用于 UI 显示的
-
ClientEvent枚举- 新增
agent_response_complete值,以及新的AgentResponseCompleteClientEvent响应模型
- 新增
-
ProcedureCompilerMode枚举- 默认值从
deterministic改为append - 移除
llm值
- 默认值从
-
ConversationHistoryTranscriptCommonModel、ConversationHistoryTranscriptResponseModel- 新增
used_static_kb_document_ids字段(字符串数组)
- 新增
-
RagRetrievalInfo- 新增
used_chunk_ids字段(字符串数组)
- 新增
-
DynamicVariableAssignment- 新增
preserve_native_type字段(布尔值),用于保留类型化值而不是将其强制转换为字符串
- 新增
-
Workflow 节点
- 在相关 workflow 节点 schema 中新增
auto_advance_after_first_response字段
- 在相关 workflow 节点 schema 中新增
-
工具配置文档
- 新增
response_body_schema字段,用于记录预期响应结构
- 新增
工作区
-
GetUserSubscriptionResponseModel- 新增
max_credit_limit_extension字段
- 新增
-
- 收紧请求验证:
start_time和end_time的最小值提高至2020-01-01,并为两个字段添加说明。端点摘要已重命名为Get Workspace Usage。
- 收紧请求验证:
其他
- 新增共享
Currency枚举,包含eur、inr、usd值,取代多个 schema 中的内联货币字符串。 - 新增
AssetTranscription和AssetTranscriptionDataschema,为资产模型扩展转录支持。 - 新增
PendingBlocksMetadataModel和PendingExternalAudiosMetadataModel,为待处理任务提供更丰富的元数据。 - 在与来源相关的枚举中新增
InVPC值。 - 转录
keyterms现在在规范中具有明确的长度限制。 - 新增
MemoryEntrySearchResult、ConversationSource和ManualSourceschema。