强制对齐
- 强制对齐改进:修复了强制对齐处理中的罕见失败情况,提升可靠性。
音色
- 实时审核音色筛选:在共享音色端点中新增
include_live_moderated查询参数,可选择包含或排除正在接受实时审核的音色。
智能体平台
- 秘密动态变量:新增支持使用
secret__前缀将动态变量指定为机密。机密动态变量只能用于 webhook 工具标头,绝不会发送给 LLM,从而提升敏感数据的安全性。了解更多。 - 跳过轮次系统工具:新增名为 skip_turn 的系统工具。启用后,如果用户明确表示需要一点时间思考或执行操作(例如“稍等一下”“给我一分钟”),智能体将跳过当前轮次。这样可避免用户有意暂停时触发轮次超时。更多信息请参阅 跳过轮次工具文档。
- 文本输入支持:通过带有文本字段的“user_message”事件,为 websocket 连接新增文本输入支持。还新增“user_activity”事件支持,用于表示正在输入或其他 UI 活动,改善文本与音频输入交错时的智能体轮次处理。
- RAG 分块上限:新增配置 RAG 检索期间收集的最大分块数的功能,让用户更好地控制 上下文窗口使用量和成本。
- 增强 Widget 配置:扩展 Widget 自定义选项,新增文本输入和纯文本模式。
- LLM 用量计算器:新增工具,可计算智能体预期的 LLM token 用量和成本,帮助进行成本估算与规划。
Audio Native
- 无障碍功能改进:对 AudioNative 播放器进行了多项无障碍改进:
- 为所有按钮添加 aria-label
- 为所有交互元素启用键盘导航
- 使进度条控制柄可获得焦点并支持键盘操作
- 改善焦点指示器可见性,提升屏幕阅读器兼容性
API
查看 API 变更
新增端点
- 新增 3 个端点:
- 获取智能体知识库大小 - 返回智能体知识库中的页面数量。
- 计算智能体 LLM 用量 - 计算指定智能体所需的预期 LLM token 数量。
- 计算 LLM 用量 - 根据提供的值,返回 LLM 模型列表及使用这些模型的预期成本。
更新端点
音色
- 获取共享音色 - 为
GET /v1/shared-voices新增include_live_moderated查询参数,可按实时审核状态筛选音色。
智能体平台
-
智能体配置:
- 新增
skip_turn工具配置,增强系统工具 - 新增
max_retrieved_rag_chunks_count参数,改进 RAG 配置
- 新增
-
Widget 配置:
- 新增纯文本模式支持
-
批量呼叫:
- 批量呼叫响应现在包含
phone_provider字段,默认值为“twilio”
- 批量呼叫响应现在包含
文本转语音
- 音色设置:
- 为音色设置新增
quality参数,用于控制音频生成质量 - 更新模型响应架构,新增
can_use_quality字段
- 为音色设置新增