跳至内容

推出 ElevenAgents 表现力模式

发布时间

收听收听本文

今天,我们推出 ElevenAgents 表现力模式——语音智能体表现力更加出色,模糊了 AI 与真人对话之间的界限。

表现力模式让团队能够前所未有地掌控语气,让智能体即使在压力下也能缓和局面、安抚客户,并引导对话达成明确结果。

以下是一段未经剪辑的录音:航班取消后,智能体正与处于极度沮丧中的客户共情:

mark screenshot w caption space

驱动表现力模式的两项核心升级

它由两项升级驱动:

  • Eleven v3 Conversational——我们迄今情感理解最强、最具上下文感知能力的 文本转语音模型,基于 Eleven v3 构建,并针对实时对话优化。
  • 全新轮次交替系统——响应时机更精准,打断更少。

这两项功能同步开发,可在 ElevenAgents 中无缝协作。ElevenAgents 是我们垂直整合的对话式 ElevenAgents

Eleven v3 Conversational

Eleven v3 Conversational 是我们迄今情感理解最强、最具上下文感知能力的 TTS 模型。它能在多轮对话中保持上下文连贯,生成体现意图、情绪与强调重点的语音,听起来自然,不生硬也不夸张。

例如,用户听起来担忧时,可引导智能体采用更平静、更令人安心的语气;需要清晰和效率时,则采用更直接的语气。这些控制让团队能使表达方式与品牌声音和用户期待保持一致。

全新轮次交替系统

人际对话中,时机和措辞同样重要。过早打断会破坏信任,回应太晚则错失时机。

全新轮次交替系统利用行业领先的转录模型 Scribe v2 Realtime,提供的实时信号,从说话方式中推断情绪,更准确地判断智能体何时该说话、停顿或等待。这让智能体的回应更像真人,尤其是在情绪强烈的场景中。

语速突然加快,同时音量升高并反复表达,往往意味着强烈压力或恐慌:

相反,明亮上扬的语调配合简短感叹,通常表示愉快的惊喜或如释重负:

为全球客户运营打造

表现力模式支持超过 70 种语言中的细腻情绪表达,改善了印地语等过去在细微表达上较弱的语言和方言的语音呈现。

听听智能体如何说多种印度语言:

00:00
00:00

以及带阿根廷口音的西班牙语:

00:00
00:00

立即试用表现力模式

部署富有情感表达的智能体:保持品牌一致,在恰当时机回应,并适应客户真实情绪,让客户感到被帮助,而不是被流程化处理。

专为在 ElevenAgents 中投入生产而打造,具备大规模客户运营所需的可靠性、集成、测试和监控能力,支持从试点部署到全球推广。

立即体验:在线演示

阅读文档:文档

相关内容

用高质量 AI 音频创作