全新 Voice Design v3 上线
- 发布时间
我们很高兴宣布推出 Voice Design v3。新版本让声音创建比以往更快速、更简单、更直观。
Voice Design v3 非常适合需要为项目定制特定声音的创作者、企业和开发者。只需描述想要的声音,即可立即获得 3 个选项,选中喜欢的版本后便能马上使用。
立即试用,体验声音创建有多简单。
Voice Design 为什么重要

推出 Voice Design 时,我们的目标很简单:让每位创作者都能生成专属声音,无需预订录音棚,也不用深入搜索音频库。第 3 版更进一步,提供更多控制、更快迭代,以及从概念到最终音频的流畅流程。
项目通常需要数十种声音:沉静的旁白、焦虑的配角、几个游戏 NPC,甚至一只会说话的浣熊。寻找“差不多就行”的声音会拖慢团队进度。
Voice Design v3 消除了这些阻碍。输入描述,生成 3 个候选声音,选一个后继续创作——只需为提示词中的字符付费,而不是按每个样本付费。
v3 有哪些新功能
- 精准音频质量:在提示词中加入“perfect audio quality”或其他质量等级,v3 都会遵循。想要铁皮罐收音机效果?直接说明即可。音质细节由你掌控。
- 更智能的提示词引擎:v3 能理解“带上扬语调和微笑感的中年纽约人”这类细微提示,不会引入伪影或损失清晰度。我们扩展了潜在空间,并使用更广泛的口音数据重新训练,让罕见组合也能听起来自然。
两种设计模式
- 写实声音设计适用于逼真的演绎。例如:“一位说话轻柔、平静的印度女性。”
- 角色声音设计适用于从精灵到远古神明等各种角色。
一键生成 3 种声音
点击生成,v3 就会返回 3 种不同的声音。保留喜欢的声音,它会占用一个音色槽位;其余可直接舍弃。无需排队,无额外费用。
3 步设计声音
使用 Voice Design v3 创建的声音示例
- 确定概念:声音要扮演什么角色?快速勾勒人物设定。
- 明确描述:用一句话描述年龄、口音、语气、语速和音频质量。例如:“完美音频质量。年长男性,浓重苏格兰口音,缓慢且富有沉思感,嗓音低沉沙哑。”
- 保存并部署:从 3 个预览中选择一个,即可立即在 ElevenLabs API 或网页工作室中使用。
没有层层下拉菜单,没有隐藏控制项,直接获得结果。
提示词实用技巧
以下是研究团队在高质量结果中最常见的属性:
| Attribute | Why it matters | Example keywords |
|---|---|---|
| Age | Sets vocal texture and pitch | child, teen, middle-aged, elderly |
| Accent/nationality | Grounds the character in place | thick Australian, light French, neutral American |
| Gender | Guides resonance | male, female, gender-neutral |
| Tone & emotion | Drives delivery | warm, assertive, anxious, joyful |
| Speed | Controls pacing without editing | fast, measured, languid |
| Guidance scale | Balances creativity vs. prompt fidelity | “guidance scale 10” (try 8–12 for accuracy, 3–5 for exploration) |
如需完整对照表,请查看文档中的提示词指南。
关于清晰度
最好的提示词读起来就像日常说话:简短、具体、不含术语。这也是我们的写作原则:能删的字就删。
实际应用

- 游戏开发:今天就用占位声音制作支线任务原型,明天再替换为最终录音——无需重新选角。
- 有声书和播客:为每个角色赋予独特声音,再逐场景优化演绎。
- 本地化:在生成符合当地文化的准确口音时,保持翻译后对白的时长。
- 无障碍功能:为屏幕阅读器和IVR系统打造符合品牌调性的声音,提升用户使用舒适度。
现已上线
Voice Design v3 已在 ElevenLabs 控制台上线:音色 → 我的音色 → 添加新声音 → Voice Design
登录,输入提示词,然后点击生成。很快,你就会拥有 3 种新声音——其中只有一种原本存在于你的脑海中。
工作室见。




