推出 Speech Engine
ElevenLabs Speech Engine 可为自有聊天智能体或 LLM 添加实时语音功能。ElevenLabs 负责语音转文本、轮次管理、文本转语音和浏览器播放,服务器则负责智能体逻辑,并通过 Speech Engine WebSocket 流式传输回复文本。若想在自定义运行环境中使用语音,而不是采用完全托管的 ElevenAgents 配置,可使用此功能。
ElevenAgents
- 文本行为覆盖:新增
text_behavior_overrides,这是一个按ConversationInitiationSource划分的BehaviorOverride对象映射,其中包含可选的verbosity、output_format和interaction_budget字段,用于针对不同渠道调整智能体行为。 - 集成来源:新增 Intercom、Telegram 和 Freshdesk。
- OTLP 对话追踪:获取对话详情 现接受可选的
format查询参数。将format=otlp_traces设为此值,可在标准对话载荷之外返回兼容 OTLP 的追踪数据。 - ASR 关键词覆盖:新增
ASRConversationalConfigOverride和ASRConversationalConfigOverrideConfig架构,包含可选的keywords数组,并已接入对话配置客户端覆盖模型。 - Webhook 身份验证元数据:Webhook 工具配置架构现提供可选的
auth_resolved_params(字符串数组),用于说明从身份验证连接解析的 URL 占位符。
音乐
- 生成模式:新增
MusicGenerationMode(track、loop、ambience),并在音乐提示词请求正文中新增可选的generation_mode字段。 - 视频转音乐模型:视频转音乐(
POST /v1/music/video-to-music)现接受可选的model_id(字符串,默认值为music_v1)。
ElevenCreative Studio
- 转换积分:章节和音色转换统计响应模型现包含可选的
credits_needed_to_convert(整数),表示转换前所需的积分。
工作区
- 资源类型:
WorkspaceResourceType新增studio_projects。
SDK 发布
Python SDK
- v2.50.0 - 已根据 2026 年 5 月 25 日的 API 架构重新生成 SDK。
- v2.49.1 - 已更新 Speech Engine API 调用,使其返回完整响应对象。
- v2.49.0 - 已根据 2026 年 5 月 18 日至 25 日的 API 架构重新生成 SDK,包括 ElevenAgents 文本行为覆盖、音乐
generation_mode和工作区studio_projects。
JavaScript SDK
- v2.50.0 - 新增缺失的音乐 API 方法和测试,并根据 2026 年 5 月 25 日的 API 架构重新生成 SDK。
- v2.49.1 - 已更新 Speech Engine API 调用,使其返回完整响应对象。
- v2.49.0 - 已根据 2026 年 5 月 18 日至 25 日的 API 架构重新生成 SDK,包括 ElevenAgents 文本行为覆盖、音乐
generation_mode和工作区studio_projects。
软件包
- @elevenlabs/client@1.8.1 - 修复了 iOS Safari 在 WebSocket 语音会话中丢失首条智能体消息的问题:首次用户操作时解锁
AudioContext,并在音频 worklet 加载后预热播放图。 - @elevenlabs/convai-widget-core@0.12.8 和 @elevenlabs/convai-widget-embed@0.12.8 - 在
strip_audio_tags关闭时,为语音转录中的情感和音频标签添加样式;并将顶层terms_html或terms_text为 null 视为关闭条款和条件弹窗的开关。 - @elevenlabs/convai-widget-core@0.12.7 和 @elevenlabs/convai-widget-embed@0.12.7 - 已将组件依赖更新为
@elevenlabs/client@1.8.1。
API
查看 API 变更
已更新的端点和架构
ElevenAgents
- 获取对话详情 -
GET /v1/convai/conversations/{conversation_id}- 新增可选的
format查询参数;otlp_traces返回兼容 OTLP 的追踪数据
- 新增可选的
- 智能体配置架构
- 新增以
ConversationInitiationSource为键、以BehaviorOverride为值(verbosity、output_format、interaction_budget)的text_behavior_overrides映射
- 新增以
ConversationInitiationSource枚举- 新增
intercom_integration、telegram_integration和freshdesk_integration
- 新增
- ASR 覆盖架构
- 新增
ASRConversationalConfigOverride和ASRConversationalConfigOverrideConfig,包含可选的keywords(字符串数组)
- 新增
- Webhook 工具架构
- Webhook 配置模型新增可选的
auth_resolved_params(字符串数组)
- Webhook 配置模型新增可选的
音乐
- 视频转音乐 -
POST /v1/music/video-to-music- 新增可选的
model_id(字符串,默认值为music_v1)
- 新增可选的
- 音乐提示词请求架构
- 新增可选的
generation_mode,引用MusicGenerationMode(track、loop、ambience)
- 新增可选的
ElevenCreative Studio
- 章节和音色转换统计架构
- 新增可选的
credits_needed_to_convert(整数)
- 新增可选的
工作区
WorkspaceResourceType枚举- 新增
studio_projects
- 新增