v1 TTS 模型弃用

eleven_monolingual_v1 和 eleven_multilingual_v1 模型已弃用,将于 2025 年 12 月 15 日移除。请迁移到更新的模型,以继续使用服务。

智能体平台

  • 工作流表达式:工作流现已支持复杂表达式,可通过逻辑运算符、动态变量和 LLM 评估定义确定性条件。这让智能体逻辑和决策能力更加完善。
  • MCP Server 中断控制:新增选项,可在 MCP Server 的所有工具调用期间禁用中断,从而更好地控制工具执行期间的智能体行为。
  • 音频对齐数据:智能体现新增标记,可在音频事件中启用对齐数据,适用于唇形同步等音频与文本同步场景。
  • 忽略默认人格设置:智能体平台配置页面现包含复选框,可设置智能体是否忽略默认的乐于助人人格,让开发者更好地控制智能体行为。

语音转文本

  • 修复 Base64 编码标记:解决了 STT 响应中 is_base64_encoded 标记的问题:即使内容实际采用 base64 编码,PDF 和 DOCX 格式的该标记仍会被错误设为 false。

SDK 发布

JavaScript SDK

  • v2.16.0:已更新至 2025 年 9 月 19 日最新的 API 架构变更。

软件包

  • @elevenlabs/types@0.0.1:全新的公共 TypeScript 类型软件包,为各项 ElevenLabs 集成提供共享类型定义。
  • @elevenlabs/react@0.7.0 和 @elevenlabs/client@0.7.0:新增支持传入自定义脚本路径,避免使用 blob: 和 data: URL,提升安全性和灵活性。
  • @elevenlabs/convai-widget-embed@0.3.0 和 @elevenlabs/convai-widget-core@0.3.0:新增用于小组件功能的 use_rtc 属性,并新增展开事件支持,改善小组件交互处理。

API

已更新端点

智能体平台

  • POST /v1/convai/agents/create:新增 ignore_default_personality 布尔参数,用于控制智能体是否忽略默认的乐于助人人格行为
  • PATCH /v1/convai/agents/{agent_id}:新增支持通过 ignore_default_personality 字段更新智能体
  • GET /v1/convai/agents/{agent_id}:响应现会在智能体配置中包含 ignore_default_personality 字段
  • POST /v1/convai/mcp-servers:新增中断控制配置参数,可在工具调用期间禁用中断
  • PATCH /v1/convai/mcp-servers/{mcp_server_id}:新增 MCP server 配置的中断控制设置
  • GET /v1/convai/mcp-servers/{mcp_server_id}:响应包含新的中断控制配置字段
  • GET /v1/convai/conversations/{conversation_id}:响应新增对齐数据字段,支持音频与文本同步
  • POST /v1/convai/agent-testing/create:增强以支持智能体测试中的工作流表达式功能
  • GET /v1/convai/agent-testing/{test_id}:响应包含工作流表达式测试结果的附加字段
  • PUT /v1/convai/agent-testing/{test_id}:请求和响应架构已更新,以支持工作流表达式
  • POST /v1/convai/agents/{agent_id}/simulate-conversation:请求架构已更新,支持在对话模拟中使用工作流表达式
  • POST /v1/convai/agents/{agent_id}/simulate-conversation/stream:支持工作流表达式的流式对话模拟
  • GET /v1/convai/settings:响应包含新的平台配置选项
  • PATCH /v1/convai/settings:请求架构已更新,包含新的平台设置
  • POST /v1/convai/batch-calling/submit:批量呼叫功能的请求架构更新
  • PATCH /v1/convai/mcp-servers/{mcp_server_id}/approval-policy:审批策略管理的响应架构更新
  • POST /v1/convai/mcp-servers/{mcp_server_id}/tool-approvals:工具审批处理的响应架构增强
  • DELETE /v1/convai/mcp-servers/{mcp_server_id}/tool-approvals/{tool_name}:工具审批移除的响应架构更新

语音转文本

  • POST /v1/speech-to-text:修复 is_base64_encoded 布尔标记,在 PDF 和 DOCX 文档内容采用 base64 编码时可正确返回 true

文本转语音

  • POST /v1/text-to-speech/{voice_id}/with-timestamps:请求和响应架构已更新,增强时间戳功能
  • POST /v1/text-to-speech/{voice_id}/stream:请求架构已更新,改进流式传输参数
  • POST /v1/text-to-speech/{voice_id}/stream/with-timestamps:请求和响应架构已更新,支持带时间戳的流式传输
  • POST /v1/text-to-voice/create-previews:请求架构新增预览生成选项
  • POST /v1/text-to-voice:响应架构已更新,包含额外的声音创建数据
  • POST /v1/text-to-voice/{voice_id}/remix:请求架构已增强,支持声音混音参数

声音管理

  • GET /v1/voices:响应架构已更新,包含新的声音元数据字段
  • GET /v1/voices/{voice_id}:响应架构已增强,包含额外的声音属性
  • GET /v1/voices/settings/default:默认声音设置的响应架构已更新
  • GET /v1/voices/{voice_id}/settings:响应架构已增强,包含新的配置选项
  • POST /v1/voices/{voice_id}/settings/edit:声音设置修改的请求架构已更新
  • POST /v1/voices/pvc/{voice_id}/samples/{sample_id}:请求架构已增强,支持 PVC 样本管理
  • GET /v1/voices/pvc/{voice_id}/samples/{sample_id}/audio:音频样本检索的响应架构已更新
  • GET /v1/voices/pvc/{voice_id}/samples/{sample_id}/speakers/{speaker_id}/audio:响应架构已增强,支持特定说话人的音频
  • POST /v1/voice-generation/create-voice:响应架构已更新,包含新的声音生成数据

ElevenCreative Studio

  • POST /v1/studio/podcasts:请求架构新增播客创建参数

用户管理

  • GET /v1/user:响应架构已更新,包含额外的用户资料数据

所有变更均向后兼容,开发者无需立即采取行动。