Eleven v3(alpha)全新发布
- 发布时间
我们很高兴推出 Eleven v3(alpha)——表现力最强的文本转语音模型。
这一研究预览版为语音生成带来前所未有的控制力和真实感,具备:
- 70 多种语言
- 多说话人对话
- 音频标签,例如 [excited]、[whispers] 和 [sighs]
Eleven v3(alpha) 比以往模型需要更多提示词工程,但生成效果令人惊叹。
如果你正在制作视频、有声书或媒体工具,v3 将带来全新的表现力。对于实时和对话式应用场景,目前建议继续使用 v2.5 Turbo 或 Flash。v3 的实时版本正在开发中。
Eleven v3 现已在网站和API 中推出。
我们为何打造 v3
自 Multilingual v2 发布以来,我们看到语音 AI 已应用于专业影视、游戏开发、教育和无障碍领域。但一直以来的限制不在于音质,而在于表现力。更夸张的情绪、对话中的打断,以及可信的来回交流都难以实现。
Eleven v3 填补了这一空白。它从零打造,能呈现叹息、低语、笑声和反应,让生成的语音真正自然、生动。
Eleven v3(alpha)有哪些新功能
| Feature | What it unlocks |
|---|---|
| Audio tags | Inline control of tone, emotion, and non-verbal reactions |
| Dialogue mode | Multi-speaker conversations with natural pacing and interruptions |
| 70+ languages | Full coverage of high-demand global languages |
| Deeper text understanding | Better stress, cadence, and expressivity from text input |
使用音频标签
音频标签直接写在脚本中,格式为小写方括号。想了解更多,请查看文档中的v3 提示词指南。
专业语音克隆(PVC)目前尚未针对 Eleven v3 完全优化,因此克隆质量可能低于早期模型。在这一研究预览阶段,如需使用 v3 功能,建议为项目选择即时语音克隆(IVC)或设计音色。针对 v3 的 PVC 优化即将推出。
例如,你可以这样写提示词:“[whispers] 有东西要来了……[sighs] 我能感觉到。”如需更丰富的表现力,也可以组合多个标签:
创作多说话人对话
现有的文本转语音端点支持 Eleven v3。此外,我们还推出了新的文本转对话 API 端点。提供由 JSON 对象构成的结构化数组,每个对象代表一轮发言,模型便会生成连贯且带有重叠效果的音频文件:
该端点会自动处理说话人切换、情绪变化和打断。
了解更多详情。
定价与可用性
| Plan | Launch promo | At the end of June |
|---|---|---|
| UI (self-serve) | 80% off (~5× cheaper) | Same as Multilingual V2 |
| UI (enterprise) | 80% off business plan pricing | Business plan pricing |
启用 v3:
- 使用模型选择器,然后选择Eleven v3(alpha)
API 访问和 Studio 支持即将推出。如需抢先体验,请联系销售团队。
何时不该使用 v3
Eleven v3(alpha)比以往模型需要更多提示词工程。效果出色时令人惊叹,但其可靠性和较高延迟使它不适合实时和对话式应用场景。这些场景建议使用 Eleven v2.5 Turbo/Flash。
更多信息请参阅完整的v3 文档和常见问题。
- 登录ElevenLabs UI
- 在模型下拉菜单中选择 v3(alpha)
- 粘贴脚本,使用标签或对话
- 生成音频
期待看到你如何将 v3 应用于更多新场景,从沉浸式叙事到电影级制作流程。






.jpg&w=3840&q=80)
.png&w=3840&q=80)


