模型

  • 稳定性改进:所有模型的音频稳定性显著提升,在以下场景使用 turbo_v2 和 turbo_v2.5 时尤为明显:
    • WebSocket
    • 项目
    • Reader App
    • 使用请求拼接的 TTS
    • ConvAI
  • 延迟改进:所有模型的首字节时间延迟缩短约 20-30ms。

API

  • 移除音色样本背景噪声:新增使用我们的音频分离模型移除音色样本背景噪声的功能,可免费提升 IVC 和 PVC 的质量。
  • 移除 STS 输入背景噪声:新增使用我们的音频分离模型移除 STS 音频输入背景噪声的功能,可免费提升质量。

功能

  • 智能体平台 Beta:智能体平台现已进入 Beta 测试。