语音转文本

  • scribe_v1_experimental:推出 Scribe v1 模型的新实验性预览版,改进包括提升多语言音频文件的表现、减少音频与静音交替时的幻觉,以及改进音频标签。新模型可通过 API 使用,模型名称为 scribe_v1_experimental

文本转语音

  • 支持 A-law 格式:新增 8 kHz 采样率的 A-law 格式,可集成欧洲电话系统。
  • 修复配额问题:修复数据库错误,该错误导致部分请求被误判为超出配额而遭拒绝。

智能体平台

  • 文档类型筛选:新增支持按类型(文件、URL 或文本)筛选知识库文档。
  • 非音频智能体:新增支持不输出音频、但仍会发送响应转录文本且可使用工具的对话式智能体。移除音频客户端事件即可启用非音频智能体。
  • 改进智能体模板:更新所有智能体模板,提供增强的配置和提示词。了解如何改进系统提示词,请参阅此处。
  • 修复导出卡住问题:修复导出长时间卡住的问题。

ElevenCreative Studio

  • 修复音量标准化:修复启用音量标准化时流式传输项目快照的问题。

新 API 端点

  • 强制对齐:新增强制对齐端点,可将音频与文本对齐,适合生成字幕。
  • 批量呼叫:新增批量呼叫端点,可为多个接收者安排呼叫。

API

新端点

更新的端点

文本转语音

音色

  • 获取音色 - 新增 collection_id 参数,可按合集筛选音色

知识库

  • 获取知识库 - 新增 types 参数,可按类型筛选文档
  • 用于创建知识库文档的通用端点已标记为弃用,建议改用专用端点

用户订阅

  • 获取用户订阅 - 新增 professional_voice_slots_used 属性,用于跟踪工作区已使用的专业音色数量

智能体平台

  • 新增 silence_end_call_timeout 参数,用于设置终止通话前的最长等待时间
  • 移除 /v1/convai/agents/{agent_id}/add-secret 端点(现由工作区密钥端点处理)