专业语音克隆(PVC)

  • PVC API:推出一套完整的 API 端点,用于管理专业语音克隆(PVC)。现在可通过编程创建音色、添加/管理/删除音频样本、获取音频/波形、管理说话人分离、处理验证及启动训练。完整的新端点列表请参阅下方 API 变更摘要,或查看 PVC API 参考文档此处。

语音转文本

  • 增强导出选项:通过 API 以分段 JSON 格式导出语音转文本结果时,新增可包含或排除时间戳和说话人 ID 的选项。

智能体平台

  • 新增 LLM 模型:新增支持 GPT-4.1 模型:gpt-4.1、gpt-4.1-mini 和 gpt-4.1-nano,详见此处
  • VAD 分数:新增客户端事件,用于向客户端发送 VAD 分数,参考文档见此处

API

新增端点

更新端点

语音转文本

  • 已更新端点:
    • 创建强制对齐任务 - 新增 enabled_spooled_file 参数,支持流式传输大型文件(POST /v1/forced-alignment)。

Schema 变更

智能体平台

  • GET conversation details:新增 has_audio、has_user_audio、has_response_audio 布尔字段,详见此处

配音

  • GET dubbing resource :为每个渲染结果新增 status 字段,详见此处