变声器流式传输
变声器流式传输
将音频从一种音色流式转换为另一种音色。完全控制情感、时机和表达方式。
路径参数
要使用的音色 ID。使用 获取音色 端点列出所有可用音色。
请求头
查询参数
当 enable_logging 设为 false 时,此请求将使用零留存模式。这意味着该请求无法使用历史记录功能,包括请求拼接。零留存模式仅限企业版客户使用。
请求
包含内容和情绪、用于控制生成语音的音频文件。
要使用的模型标识符,可通过 GET /v1/models 查询。模型必须支持语音转语音,可通过 can_do_voice_conversion 属性确认。
覆盖指定音色已存储设置的音色设置,仅应用于当前请求。需以 JSON 编码字符串发送。
指定后,系统会尽力进行确定性采样,使使用相同种子和参数的重复请求返回相同结果。但不保证完全确定。必须是介于 0 和 4294967295 之间的整数。
设定后,将使用我们的人声分离模型去除音频输入中的背景噪音。仅适用于变声器。
输入音频的格式。可选值为 ‘pcm_s16le_16’ 或 ‘other’。对于 pcm_s16le_16,输入音频必须是采样率为 16kHz、单声道、采用小端字节序的 16 位 PCM。延迟将低于传入编码波形。
响应
流式音频数据