音色

  • 新的 PVC 流程:新增专业语音克隆创建流程,可在此处试用

智能体平台

  • 智能体间转接: 新增系统工具,支持智能体间转接,可实现更复杂的对话流程。详情请参阅智能体转接工具文档。
  • 增强工具调试: 改进对话历史中工具执行详情的显示方式,便于调试。
  • 修复语言检测: 解决强制调用语言检测工具的问题。

配音

  • 渲染端点: 推出新端点,可重新生成配音项目中特定语言的音频或视频渲染。该端点会自动处理缺失的转录文本或翻译。请参阅渲染配音端点。
  • 提高大小限制: 将配音项目允许的最大文件大小提高至 1 GiB。

API

新端点

更新的端点

发音词典

语音转文本

  • 更新语音转文本端点(POST /v1/speech-to-text):
    • 新增 cloud_storage_url 参数,可直接从公开的 S3 或 GCS URL 转录音频(最大 2GB)。
    • file 参数改为可选;现在必须且只能提供 file 或 cloud_storage_url 其中之一。

语音转语音

智能体平台

音色

AudioNative