跳至内容

Eleven v3(alpha)全新发布

发布时间

收听收听本文

Eleven v3 is no longer in alpha, and is now generally available.


我们很高兴推出 Eleven v3(alpha)——表现力最强的文本转语音模型

这一研究预览版为语音生成带来前所未有的控制力和真实感,具备:

  • 70 多种语言
  • 多说话人对话
  • 音频标签,例如 [excited]、[whispers] 和 [sighs]

Eleven v3(alpha) 比以往模型需要更多提示词工程,但生成效果令人惊叹。

如果你正在制作视频、有声书或媒体工具,v3 将带来全新的表现力。对于实时和对话式应用场景,目前建议继续使用 v2.5 Turbo 或 Flash。v3 的实时版本正在开发中。

Eleven v3 现已在网站和API 中推出。

我们为何打造 v3

自 Multilingual v2 发布以来,我们看到语音 AI 已应用于专业影视、游戏开发、教育和无障碍领域。但一直以来的限制不在于音质,而在于表现力。更夸张的情绪、对话中的打断,以及可信的来回交流都难以实现。

Eleven v3 填补了这一空白。它从零打造,能呈现叹息、低语、笑声和反应,让生成的语音真正自然、生动。

Eleven v3(alpha)有哪些新功能

Feature What it unlocks
Audio tags Inline control of tone, emotion, and non-verbal reactions
Dialogue mode Multi-speaker conversations with natural pacing and interruptions
70+ languages Full coverage of high-demand global languages
Deeper text understanding Better stress, cadence, and expressivity from text input

亲耳体验 v3

Background
Background

使用音频标签

音频标签直接写在脚本中,格式为小写方括号。想了解更多,请查看文档中的v3 提示词指南

专业语音克隆(PVC)目前尚未针对 Eleven v3 完全优化,因此克隆质量可能低于早期模型。在这一研究预览阶段,如需使用 v3 功能,建议为项目选择即时语音克隆(IVC)或设计音色。针对 v3 的 PVC 优化即将推出。

例如,你可以这样写提示词:“[whispers] 有东西要来了……[sighs] 我能感觉到。”如需更丰富的表现力,也可以组合多个标签:

“[happily][shouts] We did it! [laughs].”

创作多说话人对话

现有的文本转语音端点支持 Eleven v3。此外,我们还推出了新的文本转对话 API 端点。提供由 JSON 对象构成的结构化数组,每个对象代表一轮发言,模型便会生成连贯且带有重叠效果的音频文件:

[
  {"speaker_id": "scarlett", "text": "(cheerfully) Perfect! And if that pop-up is bothering you, there’s a setting to turn it off under Notifications → Preferences."},
  {"speaker_id": "lex", "text": "You are a hero. An actual digital wizard. I was two seconds from sending a very passive-aggressive support email."},
  {"speaker_id": "scarlett", "text": "(laughs) Glad we could stop that in time. Anything else I can help with today?"}
]

该端点会自动处理说话人切换、情绪变化和打断。

了解更多详情

v3 是我们表现力最强的模型

Background
Background

定价与可用性

Plan Launch promo At the end of June
UI (self-serve) 80% off (~5× cheaper) Same as Multilingual V2
UI (enterprise) 80% off business plan pricing Business plan pricing

启用 v3:

  • 使用模型选择器,然后选择Eleven v3(alpha)

API 访问和 Studio 支持即将推出。如需抢先体验,请联系销售团队

何时不该使用 v3

Eleven v3(alpha)比以往模型需要更多提示词工程。效果出色时令人惊叹,但其可靠性和较高延迟使它不适合实时和对话式应用场景。这些场景建议使用 Eleven v2.5 Turbo/Flash。

更多信息请参阅完整的v3 文档和常见问题。

立即试用

Background
Background
  1. 登录ElevenLabs UI
  2. 在模型下拉菜单中选择 v3(alpha)
  3. 粘贴脚本,使用标签或对话
  4. 生成音频

期待看到你如何将 v3 应用于更多新场景,从沉浸式叙事到电影级制作流程。

相关内容

用高质量 AI 音频创作