音频环境

为智能体输出音频添加背景音并应用语音滤镜。

概述

音频环境控制智能体输出给来电者的音频效果。包含两项设置:

  • 背景音在智能体说话时播放循环环境音。
  • 语音滤镜会在混音前为智能体语音应用电话风格滤镜。

来电者会听到最终效果。智能体听不到背景音,背景音也不会传入语音识别。

这与工具调用音效不同,后者仅在工具运行时播放。

背景音

背景音会在整个对话期间,在智能体语音下混入内置预设音效。用户打断时,声音会继续循环,不会随智能体的轮次停止。

预设包括办公室、餐厅、城市、打字和电梯音乐。在控制台中,你可以在保存前预览预设。

使用 conversation_config.conversation.background_sound 配置背景音。

配置

1

打开音频环境

打开智能体。在 Agent 页面中,点击 Voices 旁的 Audio environment 按钮。

2

启用背景音

打开 Enable background sound。从 Background sound 中选择预设。使用下拉菜单旁的播放控件预览。

3

设置音量和循环

设置 Volume。保持启用 Crossfade loop,避免声音重复时出现可听见的咔嗒声。保存更改。

在网络状况很差的 WebSocket 连接上,混入背景音可能会导致音频断续。

参数

有效的 source_id 值为 office1、office2、restaurant、city、typing,以及 elevator1 至 elevator4。

字段类型默认值说明
source_typestring未设置启用声音时必须为 preset。需与 source_id 一同设置。
source_idstring未设置内置预设的标识符。
volumenumber0.15相对于智能体语音的音量。范围为 0.01–1.0。
crossfade_loopbooleantrue在循环边界处交叉淡化,避免声音重复时出现咔嗒声。

语音滤镜

语音滤镜会改变智能体生成的语音效果,不会均衡或降噪背景音。滤镜会先运行,然后在经过滤镜处理的语音下混入背景音。

语音滤镜仅限控制台使用。它不属于公开的智能体 API 或 CLI 架构,且可能并非所有工作区都可用。

在同一个 Audio environment 面板中,将 Voice filter 设为 Off 或某个电话预设,然后保存。

限制

  • 仅支持内置预设。无法上传自定义文件或指定任意 URL。
  • 智能体为纯文本时,音频环境控件会被隐藏。
  • 背景音不会混入 WhatsApp 语音消息回复中。WhatsApp 通话仍会包含背景音。
  • 无法通过客户端覆盖为每段对话设置背景音;conversation_config_override 不包含 background_sound。不过,仍可在工作流节点上更改它。

相关内容