如何生成情感?

模型会关注每句话所处的整体语境,通过与前后文本的关联判断内容是否合理。这种全局视角使模型能够以统一的情感模式贯穿多句话的思路,为较长片段添加恰当的语调。

生成情感的技巧:

  • 上下文是生成特定情感的关键。输入带有笑声或有趣的文本,可能会得到愉悦的输出。愤怒、悲伤和其他情感也是如此——设定上下文至关重要。
  • 标点和音色设置对输出的表达方式起主要作用。
  • 将相关词语或短语放在引号中,以加强强调效果。
  • 使用克隆音色生成语音时,上传用于克隆的样本中的说话风格会在输出中复现。如果上传样本中的语音单调,模型将难以生成富有表现力的输出。

使用 Eleven v4 和 Eleven v3 时,还可使用音频标签更直接地控制情感和表达方式,例如 [happy]、[sad]、[angry]、[whispers] 和 [laughs]。详情请参阅提示词指南。

这些技巧有助于引导情感表达,但不能保证得到特定结果。