推出 Eleven v4认识 Eleven v4:迄今情感表现最丰富的模型。 Creator+ 套餐含 3 倍点数优惠,截止至 10 月 12 日

跳至内容

全新 Voice Design v3 上线

发布时间

收听收听本文

我们很高兴宣布推出 Voice Design v3。新版本让声音创建比以往更快速、更简单、更直观。

Voice Design v3 非常适合需要为项目定制特定声音的创作者、企业和开发者。只需描述想要的声音,即可立即获得 3 个选项,选中喜欢的版本后便能马上使用。

立即试用,体验声音创建有多简单。

Voice Design 为什么重要

Voice Design v3

推出 Voice Design 时,我们的目标很简单:让每位创作者都能生成专属声音,无需预订录音棚,也不用深入搜索音频库。第 3 版更进一步,提供更多控制、更快迭代,以及从概念到最终音频的流畅流程。

项目通常需要数十种声音:沉静的旁白、焦虑的配角、几个游戏 NPC,甚至一只会说话的浣熊。寻找“差不多就行”的声音会拖慢团队进度。

Voice Design v3 消除了这些阻碍。输入描述,生成 3 个候选声音,选一个后继续创作——只需为提示词中的字符付费,而不是按每个样本付费。

v3 有哪些新功能

  • 精准音频质量:在提示词中加入“perfect audio quality”或其他质量等级,v3 都会遵循。想要铁皮罐收音机效果?直接说明即可。音质细节由你掌控。
  • 更智能的提示词引擎:v3 能理解“带上扬语调和微笑感的中年纽约人”这类细微提示,不会引入伪影或损失清晰度。我们扩展了潜在空间,并使用更广泛的口音数据重新训练,让罕见组合也能听起来自然。

两种设计模式

  • 写实声音设计适用于逼真的演绎。例如:“一位说话轻柔、平静的印度女性。”
  • 角色声音设计适用于从精灵到远古神明等各种角色。

一键生成 3 种声音

点击生成,v3 就会返回 3 种不同的声音。保留喜欢的声音,它会占用一个音色槽位;其余可直接舍弃。无需排队,无额外费用。

3 步设计声音

使用 Voice Design v3 创建的声音示例

Aye, it's a bonny day outside, isn't it? [pause]
We used to sit by the loch when I was a lad, watch the sun dip below the hills.
[reflective] Those were the days, simpler times, ye ken. [chuckle] I remember my gran always had a wee tale or two. She'd say, "Ye mind, laddie, that the old stones have stories to tell." [gravelly] Ach, the wisdom in the old ways, there's something to that. I think I'll have a wee sit down on the porch now, take in the view. [quietly]
0:00
  1. 确定概念:声音要扮演什么角色?快速勾勒人物设定。
  2. 明确描述:用一句话描述年龄、口音、语气、语速和音频质量。例如:“完美音频质量。年长男性,浓重苏格兰口音,缓慢且富有沉思感,嗓音低沉沙哑。”
  3. 保存并部署:从 3 个预览中选择一个,即可立即在 ElevenLabs API 或网页工作室中使用。

没有层层下拉菜单,没有隐藏控制项,直接获得结果。

提示词实用技巧

以下是研究团队在高质量结果中最常见的属性:

Attribute Why it matters Example keywords
Age Sets vocal texture and pitch child, teen, middle-aged, elderly
Accent/nationality Grounds the character in place thick Australian, light French, neutral American
Gender Guides resonance male, female, gender-neutral
Tone & emotion Drives delivery warm, assertive, anxious, joyful
Speed Controls pacing without editing fast, measured, languid
Guidance scale Balances creativity vs. prompt fidelity “guidance scale 10” (try 8–12 for accuracy, 3–5 for exploration)

如需完整对照表,请查看文档中的提示词指南。

关于清晰度

最好的提示词读起来就像日常说话:简短、具体、不含术语。这也是我们的写作原则:能删的字就删。

实际应用

v3
  • 游戏开发:今天就用占位声音制作支线任务原型,明天再替换为最终录音——无需重新选角。
  • 有声书和播客:为每个角色赋予独特声音,再逐场景优化演绎。
  • 本地化:在生成符合当地文化的准确口音时,保持翻译后对白的时长。
  • 无障碍功能:为屏幕阅读器和IVR系统打造符合品牌调性的声音,提升用户使用舒适度。

现已上线

Voice Design v3 已在 ElevenLabs 控制台上线:音色 → 我的音色 → 添加新声音 → Voice Design

登录,输入提示词,然后点击生成。很快,你就会拥有 3 种新声音——其中只有一种原本存在于你的脑海中。

工作室见。

常见问题

相关内容

用高质量 AI 音频创作