v1 TTS 模型弃用
eleven_monolingual_v1 和 eleven_multilingual_v1 模型已弃用,将于 2025 年 12 月 15 日移除。请迁移到更新的模型,以继续使用服务。
智能体平台
- 工作流表达式:工作流现已支持复杂表达式,可通过逻辑运算符、动态变量和 LLM 评估定义确定性条件。这让智能体逻辑和决策能力更加完善。
- MCP Server 中断控制:新增选项,可在 MCP Server 的所有工具调用期间禁用中断,从而更好地控制工具执行期间的智能体行为。
- 音频对齐数据:智能体现新增标记,可在音频事件中启用对齐数据,适用于唇形同步等音频与文本同步场景。
- 忽略默认人格设置:智能体平台配置页面现包含复选框,可设置智能体是否忽略默认的乐于助人人格,让开发者更好地控制智能体行为。
语音转文本
- 修复 Base64 编码标记:解决了 STT 响应中
is_base64_encoded标记的问题:即使内容实际采用 base64 编码,PDF 和 DOCX 格式的该标记仍会被错误设为 false。
SDK 发布
JavaScript SDK
- v2.16.0:已更新至 2025 年 9 月 19 日最新的 API 架构变更。
软件包
- @elevenlabs/types@0.0.1:全新的公共 TypeScript 类型软件包,为各项 ElevenLabs 集成提供共享类型定义。
- @elevenlabs/react@0.7.0 和 @elevenlabs/client@0.7.0:新增支持传入自定义脚本路径,避免使用 blob: 和 data: URL,提升安全性和灵活性。
- @elevenlabs/convai-widget-embed@0.3.0 和 @elevenlabs/convai-widget-core@0.3.0:新增用于小组件功能的
use_rtc属性,并新增展开事件支持,改善小组件交互处理。
API
查看 API 变更
已更新端点
智能体平台
- POST /v1/convai/agents/create:新增
ignore_default_personality布尔参数,用于控制智能体是否忽略默认的乐于助人人格行为 - PATCH /v1/convai/agents/{agent_id}:新增支持通过
ignore_default_personality字段更新智能体 - GET /v1/convai/agents/{agent_id}:响应现会在智能体配置中包含
ignore_default_personality字段 - POST /v1/convai/mcp-servers:新增中断控制配置参数,可在工具调用期间禁用中断
- PATCH /v1/convai/mcp-servers/{mcp_server_id}:新增 MCP server 配置的中断控制设置
- GET /v1/convai/mcp-servers/{mcp_server_id}:响应包含新的中断控制配置字段
- GET /v1/convai/conversations/{conversation_id}:响应新增对齐数据字段,支持音频与文本同步
- POST /v1/convai/agent-testing/create:增强以支持智能体测试中的工作流表达式功能
- GET /v1/convai/agent-testing/{test_id}:响应包含工作流表达式测试结果的附加字段
- PUT /v1/convai/agent-testing/{test_id}:请求和响应架构已更新,以支持工作流表达式
- POST /v1/convai/agents/{agent_id}/simulate-conversation:请求架构已更新,支持在对话模拟中使用工作流表达式
- POST /v1/convai/agents/{agent_id}/simulate-conversation/stream:支持工作流表达式的流式对话模拟
- GET /v1/convai/settings:响应包含新的平台配置选项
- PATCH /v1/convai/settings:请求架构已更新,包含新的平台设置
- POST /v1/convai/batch-calling/submit:批量呼叫功能的请求架构更新
- PATCH /v1/convai/mcp-servers/{mcp_server_id}/approval-policy:审批策略管理的响应架构更新
- POST /v1/convai/mcp-servers/{mcp_server_id}/tool-approvals:工具审批处理的响应架构增强
- DELETE /v1/convai/mcp-servers/{mcp_server_id}/tool-approvals/{tool_name}:工具审批移除的响应架构更新
语音转文本
- POST /v1/speech-to-text:修复
is_base64_encoded布尔标记,在 PDF 和 DOCX 文档内容采用 base64 编码时可正确返回true
文本转语音
- POST /v1/text-to-speech/{voice_id}/with-timestamps:请求和响应架构已更新,增强时间戳功能
- POST /v1/text-to-speech/{voice_id}/stream:请求架构已更新,改进流式传输参数
- POST /v1/text-to-speech/{voice_id}/stream/with-timestamps:请求和响应架构已更新,支持带时间戳的流式传输
- POST /v1/text-to-voice/create-previews:请求架构新增预览生成选项
- POST /v1/text-to-voice:响应架构已更新,包含额外的声音创建数据
- POST /v1/text-to-voice/{voice_id}/remix:请求架构已增强,支持声音混音参数
声音管理
- GET /v1/voices:响应架构已更新,包含新的声音元数据字段
- GET /v1/voices/{voice_id}:响应架构已增强,包含额外的声音属性
- GET /v1/voices/settings/default:默认声音设置的响应架构已更新
- GET /v1/voices/{voice_id}/settings:响应架构已增强,包含新的配置选项
- POST /v1/voices/{voice_id}/settings/edit:声音设置修改的请求架构已更新
- POST /v1/voices/pvc/{voice_id}/samples/{sample_id}:请求架构已增强,支持 PVC 样本管理
- GET /v1/voices/pvc/{voice_id}/samples/{sample_id}/audio:音频样本检索的响应架构已更新
- GET /v1/voices/pvc/{voice_id}/samples/{sample_id}/speakers/{speaker_id}/audio:响应架构已增强,支持特定说话人的音频
- POST /v1/voice-generation/create-voice:响应架构已更新,包含新的声音生成数据
ElevenCreative Studio
- POST /v1/studio/podcasts:请求架构新增播客创建参数
用户管理
- GET /v1/user:响应架构已更新,包含额外的用户资料数据
所有变更均向后兼容,开发者无需立即采取行动。