全新 Voice Design v3 上线
- 发布时间
我们很高兴宣布推出 Voice Design v3。此次更新让声音创建比以往更快速、更简单、更直观。
Voice Design v3 适合需要为项目定制特定音色的创作者、企业和开发者。只需描述想要的声音,即可立即获得 3 个选项,选中喜欢的一个便能立刻使用。
试试看,体验声音创建原来可以如此简单。
Voice Design 为何重要

推出 Voice Design 时,目标很简单:让每位创作者都能生成专属声音,无需预订录音室,也无需在音频库里反复搜寻。第 3 版进一步提升了控制力和迭代速度,让创意更顺畅地变为最终音频。
项目通常需要数十种声音:平静的旁白、焦虑的配角、几个游戏 NPC,甚至一只会说话的浣熊。寻找“差不多就行”的声音会拖慢团队进度。
Voice Design v3 消除了这些阻碍。输入描述,生成 3 个候选音色,选择一个后继续创作。只需为提示词中的字符付费,不按样本收费。
v3 有哪些新功能
- 精准的音频质量:在提示词中加入“perfect audio quality”(或其他质量等级),v3 都会遵循。想要罐头收音机效果?直接说明即可。音频精细度由你掌控。
- 更智能的提示词引擎:v3 能处理“带上扬语调、面带微笑的中年纽约人”等细腻描述,同时保持清晰、避免产生瑕疵。在底层,我们扩展了潜在空间,并基于更广泛的口音数据重新训练,让罕见组合也能自然呈现。
两种设计模式
- 真实音色设计,打造栩栩如生的演绎。例如:“一位说话轻柔平静的印度女性。”
- 角色音色设计,从精灵到远古之神,各类角色均可创建。
一键生成 3 种音色
点击生成,v3 即会返回 3 种不同音色。保留喜欢的音色,它将占用 1 个音色位;其余可直接丢弃。无需排队,无额外费用。
3 步设计音色
- 确定概念:声音扮演什么角色?快速勾勒角色设定。
- 明确提示词意图:用一句话描述年龄、口音、语气、节奏和音频质量。例如:“Perfect audio quality. 年长男性,浓重苏格兰口音,缓慢沉思,音色低沉沙哑。”
- 保存并部署:从 3 个预览中选择一个,即可立即在 ElevenLabs API 或网页工作室中使用。
没有层层下拉菜单,没有隐藏选项,只有结果。
提示词实用技巧
以下是研究团队在高质量结果中最常见的属性:
| Attribute | Why it matters | Example keywords |
|---|---|---|
| Age | Sets vocal texture and pitch | child, teen, middle-aged, elderly |
| Accent/nationality | Grounds the character in place | thick Australian, light French, neutral American |
| Gender | Guides resonance | male, female, gender-neutral |
| Tone & emotion | Drives delivery | warm, assertive, anxious, joyful |
| Speed | Controls pacing without editing | fast, measured, languid |
| Guidance scale | Balances creativity vs. prompt fidelity | “guidance scale 10” (try 8–12 for accuracy, 3–5 for exploration) |
如需查看完整对照表,请参阅文档中的提示词指南。
关于清晰度
最佳提示词就像日常说话:简短、具体、不含术语。这也符合我们的写作原则:能删的词就删掉。
实际应用场景

- 游戏开发:今天用占位音色制作支线任务原型,明天再替换为最终配音,无需重新选角。
- 有声书和播客:为每个角色赋予独特声音,再逐场打磨演绎方式。
- 本地化:在生成符合当地文化的准确口音时,保持译文对白的时间节奏。
- 无障碍:为屏幕阅读器和IVR系统创建契合品牌语调的声音,提升用户使用舒适度。
现已上线
Voice Design v3 已在 ElevenLabs 控制台上线:音色 → 我的音色 → 添加新音色 → Voice Design
登录,输入提示词,然后点击生成。很快,你就会拥有 3 种新音色,其中只有一种原本存在于你的脑海中。
工作室见。





