音频环境
音频环境
为智能体输出音频添加背景音并应用语音滤镜。
概述
音频环境控制智能体输出给来电者的音频效果。包含两项设置:
- 背景音在智能体说话时播放循环环境音。
- 语音滤镜会在混音前为智能体语音应用电话风格滤镜。
来电者会听到最终效果。智能体听不到背景音,背景音也不会传入语音识别。
这与工具调用音效不同,后者仅在工具运行时播放。
背景音
背景音会在整个对话期间,在智能体语音下混入内置预设音效。用户打断时,声音会继续循环,不会随智能体的轮次停止。
预设包括办公室、餐厅、城市、打字和电梯音乐。在控制台中,你可以在保存前预览预设。
使用 conversation_config.conversation.background_sound 配置背景音。
配置
通过控制台更新
通过 CLI 更新
通过 API 更新
在网络状况很差的 WebSocket 连接上,混入背景音可能会导致音频断续。
参数
有效的 source_id 值为 office1、office2、restaurant、city、typing,以及 elevator1 至 elevator4。
语音滤镜
语音滤镜会改变智能体生成的语音效果,不会均衡或降噪背景音。滤镜会先运行,然后在经过滤镜处理的语音下混入背景音。
语音滤镜仅限控制台使用。它不属于公开的智能体 API 或 CLI 架构,且可能并非所有工作区都可用。
在同一个 Audio environment 面板中,将 Voice filter 设为 Off 或某个电话预设,然后保存。
限制
- 仅支持内置预设。无法上传自定义文件或指定任意 URL。
- 智能体为纯文本时,音频环境控件会被隐藏。
- 背景音不会混入 WhatsApp 语音消息回复中。WhatsApp 通话仍会包含背景音。
- 无法通过客户端覆盖为每段对话设置背景音;
conversation_config_override不包含background_sound。不过,仍可在工作流节点上更改它。