推出 Eleven v4认识 Eleven v4:迄今情感表现最丰富的模型。 Creator+ 套餐含 3 倍点数优惠,截止至 10 月 12 日

跳至内容

Eleven v3 音频标签:精准控制 AI 语音表现

发布时间
最近更新

收听收听本文

出色的语音不仅在于说什么,更在于怎么说。借助 Eleven v3 Audio Tags,你可以精细控制时机、节奏和重音,精准塑造每一句话的语速。

使用 [pause]、[rushed]、[stammers] 或 [drawn out] 等标签,可以调整每句话的呈现效果——不仅影响情绪,也影响节奏。这种控制能让平淡的表达变成表演。

AI 语音中的表达控制是什么?

表达控制是引导语音流动的能力——控制语速、停顿位置和强调时机。它能让一句话听起来戏剧化、随意、紧张或诙谐。

借助 Eleven v3,表达不再受默认语速限制。你可以放慢节奏来营造悬念,加快语速来传达紧迫感,或加入节奏感来制造幽默——直接在脚本中完成。

Okay. So like, I finally beat level 42 of that game I said I'd quit like a month ago. [chuckles] And then, for the final big scary mega boss, it's just [chuckles] like some cute little bunny rabbit. [laughing] I just couldn't do it. [laughing] It was sooo cute.
0:00

示例:"[drawn out] 天哪……所以你是说……[suspicious tone] 你没吃最后一片?"

这些标签塑造了语速和时机——这正是让这句话恰到好处的关键。

控制时机、节奏和表现力

标签让你能够使用人类自然控制语音节奏时的细微提示:

  • 停顿和间歇: [pause]、[breathes]、[continues after a beat]
  • 速度提示: [rushed]、[slows down]、[deliberate]、[rapid-fire]
  • 犹豫和节奏: [stammers]、[drawn out]、[repeats]、[timidly]
  • 强调: [emphasized]、[stress on next word]、[understated]

示例:"[drawn out] 所以——你是说……[suspicious tone] 你没吃最后一片?"

这些标签让你完全掌控声音在表达过程中的感觉。

用节奏塑造语气和含义

I'm fine.
[flatly] I'm fine.
[quietly, after a pause] I'm fine. [angrily, fed up] I'm fine!
[questioning] Are you [pause] sure you're fine?
I'm fine.
[pause] Really.
0:00

一句话的表达方式变了,理解方式也会随之改变。

对比:

  • 我没事。
  • [flatly] 我没事。
  • [quietly, after a pause] 我……没事。
  • [angrily, fed up] 我没事!
  • [questioning]你 [pause] 真的没事吗?
  • 我没事。 [pause] 真的!

同样的话,不同的含义。有了表达控制,语气不再取决于措辞,而是取决于时机和意图。

定义关键时刻的标签组合

[hesitant] [nervous] I... I'm not sure this is going to work.
[gulps] But let's try anyway.
[whispering] [pause] Did you hear that?
Hide, now!
0:00

你可以将侧重表达的标签与情绪或角色提示叠加使用,塑造完整场景。

示例:[hesitant][nervous] 我……我不确定这能不能行。 [gulps] 但还是试试吧。

或者:[whispering][pause] 你听到了吗? [rushed] 快躲起来!

正是节奏与反应的结合,让表演显得真实可信。

指挥节奏,而不只是文本

Eleven v3 将脚本变成乐谱——而表达控制就是指挥它的方式。无论是在编写教程、独白还是笑点,Audio Tags 都能让你以逐帧精度控制表达。

对创作者而言,这意味着可以完全掌控一句话如何展开。你不只是在写发生什么,也在设定它的节奏。

选择合适的音色

专业语音克隆(PVC)目前尚未针对 Eleven v3 完全优化,因此克隆质量可能低于早期模型。在这一研究预览阶段,如需使用 v3 功能,建议为项目选择即时 语音克隆(IVC)或设计音色。针对 v3 的 PVC 优化将在近期推出。

相关内容

用高质量 AI 音频创作