文本转音色

  • 声音设计:推出搭载 Eleven v3 的全新文本转音色设计,可根据文本描述创建自定义音色。

语音转文本

  • 增强说话人分离:在语音转文本端点新增 diarization_threshold 参数。通过在 0.1 至 0.4 之间调整阈值,微调说话人识别准确度与总说话人数之间的平衡。

专业语音克隆

  • 背景噪声移除:新增 remove_background_noise,可使用音频分离模型清理音色样本,获得更高质量的训练数据。

ElevenCreative Studio

工作区

  • 服务账号组:现在可将服务账号添加到工作区组,以便更好地管理权限和访问控制。

  • 工作区身份验证:新增支持工作区身份验证连接,实现与外部服务的安全 webhook 工具集成。

SDK

  • Python SDK:发布 v2.6.0,包含最新 API 支持和错误修复。
  • JavaScript SDK:发布 v2.5.0,包含最新 API 支持和错误修复。
  • React 智能体平台 SDK:在 0.2.0 中新增 WebRTC 支持

API

新增端点

更新端点

语音转文本

音色管理