Eleven v4 和 Eleven v4 Turbo

Eleven v4 和 Eleven v4 Turbo 现已推出。Eleven v4 可在超过 90 种语言中提供更高质量、更具表现力的语音,以及更出色的语音克隆。Eleven v4 Turbo 属于同一模型系列,适用于实时应用,中位推理延迟约为 100 ms。

内容创作和长音频可通过文本转对话 API 使用 eleven_v4。智能体和交互式应用可通过文本转对话 WebSocket 使用 eleven_v4_turbo。

语音转文字

  • 转录编辑:批量和实时转录现可接受最长 2,000 个字符的自然语言编辑指令。批量响应会在 edited_transcript 中返回结果,实时会话则会发出 edited_transcript 事件。有关不兼容项、响应处理和定价,请参阅批量和实时指南。

ElevenAgents

  • 智能体模型:在支持的智能体 LLM 选项中新增 gpt-6-sol、gpt-6-luna、glm-52、deepseek-v41-flash、claude-opus-5 和 claude-opus-5-5。
  • 智能体测试用量:测试调用摘要可包含总积分和美元价格。单次测试运行可包含积分和计费明细。

Flows

  • 模板 API:新增用于列出和获取已发布 Flows 模板、启动模板运行及获取运行结果的端点。运行可指定已发布版本,并将最终结果发送至配置的 webhook。

文本转对话

  • 生成连续性:文本转对话请求可使用前文或后文以及请求 ID,以保持多次生成之间的连续性。
  • 专业音色模式:文本转对话请求可使用专业语音克隆的即时语音克隆版本,以降低延迟或提升表现力。

SDK 发布

JavaScript SDK

  • v2.70.0 - 新增批量和实时语音转文字转录编辑类型、测试调用摘要的 branchId 筛选和费用字段、知识库自动发现、文本转对话 usePvcAsIvc 以及 deepseek-v41-flash 智能体模型。

Python SDK

  • v2.70.0 - 新增批量和实时语音转文字转录编辑类型、测试调用摘要的 branch_id 筛选和费用字段、知识库自动发现、文本转对话 use_pvc_as_ivc 以及 deepseek-v41-flash 智能体模型。

ElevenLabs CLI

  • v1.4.0 - 修复使用明确 API 密钥的请求同时发送已存储 OAuth 凭据的问题,该问题会导致身份验证失败。为反馈命令组添加说明,并为生成的智能体技能添加报告缺失功能的说明。使用 Flows 模板端点和当前架构类型重新生成 API 客户端。

API

新增端点

Flows

  • 列出模板 - GET /v1/flows/templates - 列出已发布模板及其可运行版本。
  • 获取模板 - GET /v1/flows/templates/{template_id} - 获取模板及其可运行版本。
  • 创建模板运行 - POST /v1/flows/templates/{template_id}/runs - 使用输入值、可选版本和可选 webhook 启动模板运行。
  • 列出模板运行 - GET /v1/flows/templates/{template_id}/runs - 使用游标分页和可选版本筛选列出模板运行。
  • 获取模板运行 - GET /v1/flows/templates/{template_id}/runs/{run_id} - 获取模板运行及其输出状态。

更新的端点

语音转文字

  • 将语音转换为文字 - POST /v1/speech-to-text
    • 新增可选可空 transcript_edit(字符串),可接受最长 2,000 个字符的自然语言编辑指令。
    • 响应新增可选可空 edited_transcript。编辑成功时包含必填 kind: "transcript" 和 text 字段。编辑失败时包含必填 kind: "error"、error_type: "edit_failed" 和 message 字段。
  • 实时语音转文字接受 transcript_edit(字符串),并发出包含必填 text 和 edited_text 字段的 edited_transcript 事件。

ElevenAgents

  • 创建智能体、获取智能体和更新智能体
    • 在 LLM 枚举中新增 gpt-6-sol、gpt-6-luna、glm-52、deepseek-v41-flash、claude-opus-5 和 claude-opus-5-5。
    • 告警监控项新增可选可空 enabled(布尔值),用于控制监控项是否可发送通知。
  • 列出对话和文本搜索
    • data_collection_params 和 dynamic_variable_params 新增 neq 和 in 运算符。in 的值使用竖线分隔。
    • evaluation_params 接受 success、failure 或 unknown 作为结果值。
  • 智能搜索 - GET /v1/convai/conversations/messages/smart-search
    • 新增可选可空 branch_id(字符串)。
  • 列出测试调用 - GET /v1/convai/test-invocations
    • 新增可选可空 branch_id(字符串)。
    • 测试调用摘要新增可选可空 credits_used(整数)和 total_price(数字)。
  • 获取测试调用 - GET /v1/convai/test-invocations/{test_invocation_id}
    • 单次测试运行新增可选可空 credits_used(整数)和 charging(ConversationChargingCommonModel)。
  • 模拟对话和模拟对话流
    • 将可选 new_turns_limit 的默认值从 10,000 改为 100,并将最大值设为 100。
  • 创建爬取任务和获取爬取任务
    • 新增可选 auto_discover(布尔值,默认 false),用于在自动同步期间跟踪链接并添加新发现的页面。这需要 enable_auto_sync: true。
  • 刷新知识库文档 - POST /v1/convai/knowledge-base/{documentation_id}/refresh
    • AutoSyncInfo 新增可选 auto_discover(布尔值,默认 false),用于指示刷新时是否爬取并添加新发现的页面。
  • 列出 MCP 服务器工具 - GET /v1/convai/mcp-servers/{mcp_server_id}/tools
    • 响应新增可选 tool_approval_statuses(数组)。每项包含必填 tool_id(字符串)和 state(up_to_date、needs_review 或 not_approved),以及可选的审批策略和已批准定义字段。

文本转对话

  • 将文本转换为对话、流式转换文本为对话、转换并附带时间戳和流式转换并附带时间戳
    • 新增可选 use_pvc_as_ivc(布尔值,默认 false),用于使用专业语音克隆的即时语音克隆版本。
    • 新增可选可空 previous_text 和 future_text(字符串,最长 100 个字符),以及 previous_request_ids 和 next_request_ids(字符串数组,最多 3 个 ID),用于保持生成连续性。
    • 可选 settings 对象新增可空 similarity(数字,0–1,默认 0.75)。

文本转语音

Flows

声音设计

工作区

  • 创建服务账户 API 密钥 - POST /v1/service-accounts/{service_account_user_id}/api-keys
    • 为企业版服务账户 API 密钥新增可选可空 tts_concurrency_limit、music_concurrency_limit 和 dubbing_concurrency_limit(整数)。
  • 更新服务账户 API 密钥 - PATCH /v1/service-accounts/{service_account_user_id}/api-keys/{api_key_id}
    • 新增可选 tts_concurrency_limit、music_concurrency_limit 和 dubbing_concurrency_limit。每个字段可接受整数、clear、no_update 或 null,默认值为 no_update。

模型

  • 列出模型 - GET /v1/models
    • 弃用必填 max_characters_request_free_user 和 max_characters_request_subscribed_user。这些字段不会强制执行;请改用 maximum_text_length_per_request。