Eleven v4 和 Eleven v4 Turbo
Eleven v4 和 Eleven v4 Turbo 现已推出。Eleven v4 可在超过 90 种语言中提供更高质量、更具表现力的语音,以及更出色的语音克隆。Eleven v4 Turbo 属于同一模型系列,适用于实时应用,中位推理延迟约为 100 ms。
内容创作和长音频可通过文本转对话 API 使用 eleven_v4。智能体和交互式应用可通过文本转对话 WebSocket 使用 eleven_v4_turbo。
语音转文字
- 转录编辑:批量和实时转录现可接受最长 2,000 个字符的自然语言编辑指令。批量响应会在
edited_transcript中返回结果,实时会话则会发出edited_transcript事件。有关不兼容项、响应处理和定价,请参阅批量和实时指南。
ElevenAgents
- 智能体模型:在支持的智能体 LLM 选项中新增
gpt-6-sol、gpt-6-luna、glm-52、deepseek-v41-flash、claude-opus-5和claude-opus-5-5。 - 智能体测试用量:测试调用摘要可包含总积分和美元价格。单次测试运行可包含积分和计费明细。
Flows
- 模板 API:新增用于列出和获取已发布 Flows 模板、启动模板运行及获取运行结果的端点。运行可指定已发布版本,并将最终结果发送至配置的 webhook。
文本转对话
- 生成连续性:文本转对话请求可使用前文或后文以及请求 ID,以保持多次生成之间的连续性。
- 专业音色模式:文本转对话请求可使用专业语音克隆的即时语音克隆版本,以降低延迟或提升表现力。
SDK 发布
JavaScript SDK
- v2.70.0 - 新增批量和实时语音转文字转录编辑类型、测试调用摘要的
branchId筛选和费用字段、知识库自动发现、文本转对话usePvcAsIvc以及deepseek-v41-flash智能体模型。
Python SDK
- v2.70.0 - 新增批量和实时语音转文字转录编辑类型、测试调用摘要的
branch_id筛选和费用字段、知识库自动发现、文本转对话use_pvc_as_ivc以及deepseek-v41-flash智能体模型。
ElevenLabs CLI
- v1.4.0 - 修复使用明确 API 密钥的请求同时发送已存储 OAuth 凭据的问题,该问题会导致身份验证失败。为反馈命令组添加说明,并为生成的智能体技能添加报告缺失功能的说明。使用 Flows 模板端点和当前架构类型重新生成 API 客户端。
API
查看 API 变更
新增端点
Flows
- 列出模板 -
GET /v1/flows/templates- 列出已发布模板及其可运行版本。 - 获取模板 -
GET /v1/flows/templates/{template_id}- 获取模板及其可运行版本。 - 创建模板运行 -
POST /v1/flows/templates/{template_id}/runs- 使用输入值、可选版本和可选 webhook 启动模板运行。 - 列出模板运行 -
GET /v1/flows/templates/{template_id}/runs- 使用游标分页和可选版本筛选列出模板运行。 - 获取模板运行 -
GET /v1/flows/templates/{template_id}/runs/{run_id}- 获取模板运行及其输出状态。
更新的端点
语音转文字
- 将语音转换为文字 -
POST /v1/speech-to-text- 新增可选可空
transcript_edit(字符串),可接受最长 2,000 个字符的自然语言编辑指令。 - 响应新增可选可空
edited_transcript。编辑成功时包含必填kind: "transcript"和text字段。编辑失败时包含必填kind: "error"、error_type: "edit_failed"和message字段。
- 新增可选可空
- 实时语音转文字接受
transcript_edit(字符串),并发出包含必填text和edited_text字段的edited_transcript事件。
ElevenAgents
- 创建智能体、获取智能体和更新智能体
- 在
LLM枚举中新增gpt-6-sol、gpt-6-luna、glm-52、deepseek-v41-flash、claude-opus-5和claude-opus-5-5。 - 告警监控项新增可选可空
enabled(布尔值),用于控制监控项是否可发送通知。
- 在
- 列出对话和文本搜索
data_collection_params和dynamic_variable_params新增neq和in运算符。in的值使用竖线分隔。evaluation_params接受success、failure或unknown作为结果值。
- 智能搜索 -
GET /v1/convai/conversations/messages/smart-search- 新增可选可空
branch_id(字符串)。
- 新增可选可空
- 列出测试调用 -
GET /v1/convai/test-invocations- 新增可选可空
branch_id(字符串)。 - 测试调用摘要新增可选可空
credits_used(整数)和total_price(数字)。
- 新增可选可空
- 获取测试调用 -
GET /v1/convai/test-invocations/{test_invocation_id}- 单次测试运行新增可选可空
credits_used(整数)和charging(ConversationChargingCommonModel)。
- 单次测试运行新增可选可空
- 模拟对话和模拟对话流
- 将可选
new_turns_limit的默认值从10,000改为100,并将最大值设为100。
- 将可选
- 创建爬取任务和获取爬取任务
- 新增可选
auto_discover(布尔值,默认false),用于在自动同步期间跟踪链接并添加新发现的页面。这需要enable_auto_sync: true。
- 新增可选
- 刷新知识库文档 -
POST /v1/convai/knowledge-base/{documentation_id}/refreshAutoSyncInfo新增可选auto_discover(布尔值,默认false),用于指示刷新时是否爬取并添加新发现的页面。
- 列出 MCP 服务器工具 -
GET /v1/convai/mcp-servers/{mcp_server_id}/tools- 响应新增可选
tool_approval_statuses(数组)。每项包含必填tool_id(字符串)和state(up_to_date、needs_review或not_approved),以及可选的审批策略和已批准定义字段。
- 响应新增可选
文本转对话
- 将文本转换为对话、流式转换文本为对话、转换并附带时间戳和流式转换并附带时间戳
- 新增可选
use_pvc_as_ivc(布尔值,默认false),用于使用专业语音克隆的即时语音克隆版本。 - 新增可选可空
previous_text和future_text(字符串,最长 100 个字符),以及previous_request_ids和next_request_ids(字符串数组,最多 3 个 ID),用于保持生成连续性。 - 可选
settings对象新增可空similarity(数字,0–1,默认0.75)。
- 新增可选
文本转语音
- 将文本转换为语音、流式转换文本为语音、转换并附带时间戳和流式转换并附带时间戳
- 现有的
use_pvc_as_ivc字段不再弃用。
- 现有的
Flows
声音设计
工作区
- 创建服务账户 API 密钥 -
POST /v1/service-accounts/{service_account_user_id}/api-keys- 为企业版服务账户 API 密钥新增可选可空
tts_concurrency_limit、music_concurrency_limit和dubbing_concurrency_limit(整数)。
- 为企业版服务账户 API 密钥新增可选可空
- 更新服务账户 API 密钥 -
PATCH /v1/service-accounts/{service_account_user_id}/api-keys/{api_key_id}- 新增可选
tts_concurrency_limit、music_concurrency_limit和dubbing_concurrency_limit。每个字段可接受整数、clear、no_update或null,默认值为no_update。
- 新增可选
模型
- 列出模型 -
GET /v1/models- 弃用必填
max_characters_request_free_user和max_characters_request_subscribed_user。这些字段不会强制执行;请改用maximum_text_length_per_request。
- 弃用必填