文本转音色
- 声音设计:推出搭载 Eleven v3 的全新文本转音色设计,可根据文本描述创建自定义音色。
语音转文本
- 增强说话人分离:在语音转文本端点新增
diarization_threshold参数。通过在 0.1 至 0.4 之间调整阈值,微调说话人识别准确度与总说话人数之间的平衡。
专业语音克隆
- 背景噪声移除:新增
remove_background_noise,可使用音频分离模型清理音色样本,获得更高质量的训练数据。
ElevenCreative Studio
- 视频支持检测:在章节响应中新增
has_video属性,用于表示章节是否包含视频内容。
工作区
-
服务账号组:现在可将服务账号添加到工作区组,以便更好地管理权限和访问控制。
-
工作区身份验证:新增支持工作区身份验证连接,实现与外部服务的安全 webhook 工具集成。
SDK
- Python SDK:发布 v2.6.0,包含最新 API 支持和错误修复。
- JavaScript SDK:发布 v2.5.0,包含最新 API 支持和错误修复。
- React 智能体平台 SDK:在 0.2.0 中新增 WebRTC 支持