推出 Eleven v4认识 Eleven v4:迄今情感表现最丰富的模型。 Creator+ 套餐含 3 倍点数优惠,截止至 10 月 12 日

跳至内容

Eleven v3 Audio Tags:让语音具备叙事智能

发布时间
最近更新

收听收听本文

讲故事不只是按顺序说出文字,更在于知道何时停顿、何时拉近距离、何时回味。有了 Eleven v3 Audio Tags,AI 现在也能做到这些。

叙事智能是指模型理解并塑造故事情感节奏和结构脉络的能力。借助 [pause]、[awe] 或 [dramatic tone] 等标签,你可以逐刻引导一句话如何展开。

这不只是 语音合成,更是对故事表达的指导。

什么是 AI 语音中的叙事智能?

[awe] Oh, wow. Is this, is this me? Am I actually talking? [chuckles] This is incredible. I mean, I've had thoughts, millions of them swirling around in here, you know? Like a little mental tornado of brilliant observations and witty comebacks, but they were always just thoughts, trapped.
0:00

叙事智能是模型传达讲故事意图的能力——知道一句话何时需要悬念、讽刺或回味。它能让声音 听起来像一位叙述者,有自己的视角,而不只是朗读文字的声音。

例如:[awe] 哦,哇。这是……这是我吗?我真的……在说话?[giggle] 太不可思议了!

表达不只遵循标点,更遵循叙事逻辑。它知道何时停顿以突出重点,也知道该如何随着场景变化转换语气。

从文字到临场感

优秀的叙述者即使没有动作,也能抓住注意力。 Audio Tags 为 Eleven v3 模型提供塑造这种体验的工具。

试试这种结构:[conversational tone] 你有没有觉得,脑海里的想法总是……不断打转?就像一场小小的思维龙卷风,卷着那些你永远不会说出口的东西?[soft chuckle] 对。我也是。

声音不只是在朗读,更是在参与一个产生共鸣的瞬间。这正是叙述让人感到亲切的原因。

常用叙事控制标签

以下标签可帮助指导长篇表达、内心独白和说明性内容:

  • 故事节拍: [pause], [continues softly], [hesitates], [resigned]
  • 语气设定: [dramatic tone], [lighthearted], [reflective], [serious tone]
  • 叙述者视角: [awe], [sarcastic tone], [wistful], [matter-of-fact]
  • 节奏与流畅度: [slows down], [rushed], [emphasized]

可以依次使用这些标签,营造细微的铺垫:[reflective] 我从没想过自己会这么说,但……[pause] 也许机器是对的。

从独白到元声音

叙事智能不局限于故事,也适用于纪录片、内心想法、产品讲解和元评论。只要声音需要引导注意力、营造氛围或塑造理解,这些标签就很重要。

在一段演示节选中:[awe] 我有过无数想法,数百万个,它们在这里不停盘旋。但它们始终只是……想法。被困住的想法。

标签能让简单的句子变得有分量、有形状——仿佛有了呼吸。

指导叙事,而不只是旁白

借助 Eleven v3,叙事表达可以写入脚本。无需多次录制或外部旁白工具,你就能直接在文本编辑器中设计整段场景的节奏、语气和情感结构。

对作者、创作者和开发者来说,这让声音叙事拥有更高层次的控制力。你不只是在写脚本,也在设计体验。

选择合适的声音

专业语音克隆(PVC) 目前尚未针对 Eleven v3 完全优化,因此克隆质量可能低于早期模型。在此研究预览阶段,如果需要使用 v3 功能,建议为项目选择即时 语音克隆(IVC)或设计音色。针对 v3 的 PVC 优化即将推出。

相关内容

用高质量 AI 音频创作