强制对齐

  • 强制对齐改进:修复了强制对齐处理中的罕见失败情况,提升可靠性。

音色

  • 实时审核音色筛选:在共享音色端点中新增 include_live_moderated 查询参数,可选择包含或排除正在接受实时审核的音色。

智能体平台

  • 秘密动态变量:新增支持使用 secret__ 前缀将动态变量指定为机密。机密动态变量只能用于 webhook 工具标头,绝不会发送给 LLM,从而提升敏感数据的安全性。了解更多。
  • 跳过轮次系统工具:新增名为 skip_turn 的系统工具。启用后,如果用户明确表示需要一点时间思考或执行操作(例如“稍等一下”“给我一分钟”),智能体将跳过当前轮次。这样可避免用户有意暂停时触发轮次超时。更多信息请参阅 跳过轮次工具文档。
  • 文本输入支持:通过带有文本字段的“user_message”事件,为 websocket 连接新增文本输入支持。还新增“user_activity”事件支持,用于表示正在输入或其他 UI 活动,改善文本与音频输入交错时的智能体轮次处理。
  • RAG 分块上限:新增配置 RAG 检索期间收集的最大分块数的功能,让用户更好地控制 上下文窗口使用量和成本。
  • 增强 Widget 配置:扩展 Widget 自定义选项,新增文本输入和纯文本模式。
  • LLM 用量计算器:新增工具,可计算智能体预期的 LLM token 用量和成本,帮助进行成本估算与规划。

Audio Native

  • 无障碍功能改进:对 AudioNative 播放器进行了多项无障碍改进:
    • 为所有按钮添加 aria-label
    • 为所有交互元素启用键盘导航
    • 使进度条控制柄可获得焦点并支持键盘操作
    • 改善焦点指示器可见性,提升屏幕阅读器兼容性

API

新增端点

更新端点

音色

  • 获取共享音色 - 为 GET /v1/shared-voices 新增 include_live_moderated 查询参数,可按实时审核状态筛选音色。

智能体平台

  • 智能体配置:

    • 新增 skip_turn 工具配置,增强系统工具
    • 新增 max_retrieved_rag_chunks_count 参数,改进 RAG 配置
  • Widget 配置:

    • 新增纯文本模式支持
  • 批量呼叫:

    • 批量呼叫响应现在包含 phone_provider 字段,默认值为“twilio”

文本转语音

  • 音色设置:
    • 为音色设置新增 quality 参数,用于控制音频生成质量
    • 更新模型响应架构,新增 can_use_quality 字段