ElevenAgents

  • 并行工具调用:智能体提示词配置现包含 enable_parallel_tool_calls(布尔值,默认 true)。启用后,支持的模型可在一次轮次中执行多个工具。
  • 智能体模型:智能体 LLM 选项新增 gpt-6-astra。
  • 告警:智能体告警现支持 Slack 频道,以及 PagerDuty 和 webhook 通知器。
  • 电话号码搜索:新增基于游标分页的电话号码端点,可按提供商、外呼支持、已分配智能体和分支、标签及电话号码筛选。

图像和视频

  • GPT Image 2.5 模型:图像生成现支持 gpt-image-2.5-flare 和 gpt-image-2.5-sunburst。两个模型均最多支持 10 张参考图像,质量级别最高可选 max,支持 14 种固定宽高比及 auto,并可输出 1K、2K 或 4K。

语音引擎

  • 级联超时:语音引擎创建和更新请求现接受 cascade_timeout_seconds(数字,2–15,默认 4),用于控制 ElevenLabs 在重试前等待上游语音引擎的时长。

文本转语音

  • 多上下文轮次边界:现会在该轮次的每个缓冲字节后发送 is_final_audio_for_turn 标记,包括 MP3 和 Opus 输出。客户端无需切换到 PCM,即可将此标记用作精确的轮次边界。

SDK 发布

JavaScript SDK

  • v2.69.0 - 在实时文本转语音封装器中新增 transcriptEdit,编辑后的文本通过 edited_transcript 事件发送。修复带数据驻留后缀的 API 密钥的语音引擎 JWT 验证问题。新增 phoneNumbers.listV2 和 Flows 模板方法,可列出和获取模板,以及列出、创建和获取运行。重新生成了 GPT Image 2.5、Slack 智能体告警、并行工具调用、gpt-6-astra、服务账户 API 密钥并发限制、Music 零保留、对话筛选器和 MCP 工具审批状态的客户端和类型。

Python SDK

  • v2.69.0 - 在实时文本转语音封装器中新增 transcript_edit,编辑后的文本通过 edited_transcript 事件发送。修复带数据驻留后缀的 API 密钥的语音引擎 JWT 验证问题,并让 play 在 ffplay 失败时抛出错误。新增 phone_numbers.list_v2 和 Flows 模板方法,可列出和获取模板,以及列出、创建和获取运行。重新生成了 GPT Image 2.5、Slack 智能体告警、并行工具调用、gpt-6-astra、服务账户 API 密钥并发限制、Music 零保留、对话筛选器和 MCP 工具审批状态的客户端和类型。

ElevenLabs CLI

  • v1.3.2 - 新增可选 --intent 元数据,以收集 CLI 使用反馈。新增 elevenlabs feedback missing-capability,用于报告 CLI 不支持的工作流程。

API

新增端点

ElevenAgents

  • 列出电话号码页面 - GET /v1/convai/v2/phone-numbers
    • 新增可选 page_size(整数,1–1,000,默认 100)和 cursor(可为空的字符串)分页参数。
    • 新增可选 search、label、phone_number、provider、supports_outbound、agent_id、branch_id、sort_by 和 sort_direction 筛选器。sort_by 接受 label 或 phone_number;sort_direction 默认为 asc。
    • 响应包含必填 phone_numbers(数组)、可选且可为空的 next_cursor(字符串)和 has_more(布尔值,默认 false)。

更新的端点

ElevenAgents

  • 创建智能体、获取智能体 和 更新智能体
    • 提示词配置新增 enable_parallel_tool_calls(布尔值,默认 true)。工作流程覆盖项接受可为空的布尔值。
    • LLM 枚举新增 gpt-6-astra,包括对话发起覆盖项。
    • 告警集成通知器现使用 integration_type 选择 pagerduty 或 slack。Slack 通知器需要 connection_id 和 channel_id(字符串);channel_id 接受 1–64 个字符。
  • 列出对话和解析对话引用
    • data_collection_params 不再接受 missing 运算符。请使用空值来匹配未收集该字段的对话。
    • dynamic_variable_params 中的空值可匹配未设置该变量的对话。
  • 创建语音引擎、获取语音引擎 和 更新语音引擎
    • 新增 cascade_timeout_seconds(数字,2–15)。创建请求默认值为 4,更新请求接受可为空的值,响应要求包含该字段。

图像和视频

  • 创建图像生成 - POST /v1/flows/image
    • 为 gpt-image-2.5-flare 和 gpt-image-2.5-sunburst 新增请求变体。
    • 两种变体均需要 prompt 和 model_id,最多接受 10 个 images,并新增 resolution(1K、2K 或 4K,默认 1K)。
    • quality 接受 low、medium、high、xhigh 或 max,默认为 high。aspect_ratio 接受 auto 和 14 种固定比例,默认为 16:9。

配音

知识库

  • 创建爬取任务 - POST /v1/convai/knowledge-base/crawl
    • 已弃用 max_depth(整数,默认 3)。该字段现无实际作用,且不再有最小或最大限制。
    • 爬取任务元数据不再要求 max_depth。

用户

架构变更

文本转语音

  • 多上下文 WebSocket audio 和 final 消息现将 is_final_audio_for_turn 定义为:在该轮次的所有缓冲字节均已发送后发生。