对话流程

配置助手在对话中如何处理超时、中断和轮次切换。

概述

对话流程设置决定助手如何处理用户沉默、说话时被打断以及轮次切换。这些设置有助于创建更自然的对话,并可根据使用场景进行自定义。

最长对话时长

最长对话时长 设置用于限制对话可保持活跃的总时间。 该全局限制从对话开始时计时,独立于单轮超时设置。默认值为 600 秒(10 分钟),可设置为 60 至 7,200 秒。

配置

在 CLI 和 API 中,使用 conversation_config.conversation.max_duration_seconds 字段配置此设置。

在控制台中打开智能体,前往 高级 标签页,在 通话限制 下调整 最长对话时长。保存更改。

WhatsApp 消息对话默认有 15 分钟的非活动超时,从智能体最近一次回复开始计算。该超时可能会在达到配置的最长时长前结束消息对话。需要不同超时时长的企业版客户,请通过 support@elevenlabs.io 联系支持团队。

沉默后接话

沉默后接话 设置决定用户沉默时,助手在接过下一轮并提示回复前等待多久。

配置

该值以秒为单位,必须在 1 至 30 秒之间。在 CLI 和 API 中,使用 conversation_config.turn.turn_timeout 字段配置此设置。

在控制台中打开智能体,前往 高级 标签页,调整 沉默后接话 的值。保存更改。

沉默后接话设置

请根据使用场景选择合适的超时时长。较短的超时可让对话响应更快,但可能会打断需要更多时间回复的用户,导致对话不够自然。

最佳实践

  • 对于需要快速互动的轻松对话,设置较短的超时(5-10 秒)
  • 当用户可能需要更多时间思考或组织复杂回复时,使用较长的超时(10-30 秒)
  • 考虑用户场景:客服可能适合较短超时,而技术支持可能需要较长超时

软超时

当 LLM 生成回复的时间超出预期时,软超时会立即提供音频反馈。无需在等待时出现尴尬的沉默,智能体会说一句简短的填充语,例如“嗯……”或“让我想想……”,以保持自然的对话节奏。

此功能适用于:

  • 需要较长 LLM 处理时间的复杂查询
  • 处理 LLM 提供商的可变延迟
  • 通过自然的思考停顿创建更接近真人的对话

工作原理

  1. 用户说完后,系统开始生成 LLM 回复
  2. 根据配置的超时时长启动计时器
  3. 如果 LLM 回复在超时 之前 到达,则不会播放填充语
  4. 如果在 LLM 回复 之前 达到超时时间:
    • 立即播放配置的填充消息
    • 智能体继续等待实际回复
    • 准备就绪后,智能体会说出完整的 LLM 回复

为避免连续播放多个填充语,软超时每轮只会触发一次。

配置

在控制台中打开智能体,前往 高级 标签页,调整 软超时 设置。保存更改。

软超时设置

超时时长

等待 LLM 回复期间,播放填充消息前的等待秒数。

设置说明
默认值-1(已禁用)
范围0.5 至 8.0 秒
推荐值3.0 秒

建议从 3.0 秒开始:足以避免在快速回复时不必要地播放填充语,也足够短以避免尴尬的沉默。

静态消息

触发软超时时播放的预设填充语。

设置说明
默认值"Hhmmmm...yeah."
长度1–200 个字符

此消息支持:

  • 语言覆盖:自动翻译为智能体配置的其他语言
  • 客户端覆盖:可通过 SDK 按通话自定义

LLM 生成的消息

启用后,会使用轻量级 LLM 动态生成符合上下文的填充语,而不是使用静态消息。

设置说明
默认值false
回退方案生成失败时使用静态消息

系统会使用最近的对话上下文(最多 4 条消息、1000 个字符),生成相关的填充语,例如“嗯……”“我明白了……”“了解……”“收到……”或“好的……”。

使用 LLM 生成的消息时,仍需设置静态回退消息。

最佳实践

  • 避免在填充消息中使用时间提示(例如“等一下……”),因为实际回复时间无法预测
  • 对于回复始终很快的 FAQ 机器人,禁用软超时

打断

打断处理决定用户能否在助手说话时打断它。

配置

可在智能体 高级 标签页的 客户端事件 下配置打断设置。

要启用打断,请确保已将打断选为客户端事件。

已启用打断

允许打断

已禁用打断

忽略打断

当完整传达信息至关重要时,请禁用打断,例如法律免责声明或安全说明。

打断最佳实践

  • 在需要自然来回对话的场景中启用打断
  • 当消息完整传达至关重要时禁用打断(例如条款与条件、安全信息)
  • 考虑使用场景:客服可能适合启用打断,而信息传达则未必适合

接话积极性

接话积极性控制助手在对话中响应用户输入的速度。此设置决定助手会多积极地根据检测到的语音模式接过话并开始说话。

工作原理

助手现已包含两项关键改进,可实现更自然的轮次切换:

  1. 更快生成回复:助手从语言模型收到足够的词语和一个逗号后就会开始说话,而无需等待完整句子。这可降低延迟,并让对话响应更快,尤其适合助手需要给出较长回复的情况。

  2. 可配置的接话积极性:控制助手将停顿或语音模式视为回复机会的速度。

配置

提供 3 种模式:

  • 积极:助手会快速响应用户输入,在最早的时机接话。最适合重视即时回复的快节奏对话。
  • 普通:适用于大多数对话场景的平衡轮次切换。助手会等待自然的对话停顿后再回复。
  • 耐心:助手会等待更久再接话,给用户更多时间表达完整想法。适合收集详细信息,或用户需要时间组织回复的情况。

在控制台中打开智能体,前往 智能体 设置,选择所需的接话积极性模式。保存更改。

接话积极性与 workflow 结合使用时尤其强大。你可以根据上下文动态调整助手的响应速度:在轻松对话中让它更快接话,或在收集电话号码、邮箱等敏感信息时让它等待更久。

接话积极性最佳实践

  • 在快速回复可改善用户体验的客服场景中使用 积极 模式
  • 收集电话号码、地址或邮箱等结构化信息时,使用 耐心 模式
  • 将 普通 模式作为一般对话流程的默认设置
  • 结合 workflow,根据对话上下文动态调整接话积极性
  • 针对具体使用场景测试不同设置,找到最佳平衡

推荐配置

  • 使用较短超时(5-10 秒)以实现快速互动 - 启用打断,让客户可以插话提问 - 使用 积极 接话积极性,实现快速响应的对话
  • 使用中等超时(10-15 秒),让用户有时间收集信息 - 启用打断,实现自然的对话流程 - 收集电话号码、地址或邮箱时使用 耐心 接话积极性
  • 使用较长超时(15-30 秒),以便处理复杂回复 - 禁用打断,确保完整传达法律信息 - 使用 普通 接话积极性,保持稳定节奏
  • 使用较长超时(10-30 秒),让用户有时间思考和组织回复 - 启用打断,让学生可以插话提问 - 使用 耐心 接话积极性,给学生充足的回复时间