跳至内容

全新 Voice Design v3 上线

发布时间

收听收听本文

我们很高兴宣布推出 Voice Design v3。此次更新让声音创建比以往更快速、更简单、更直观。

Voice Design v3 适合需要为项目定制特定音色的创作者、企业和开发者。只需描述想要的声音,即可立即获得 3 个选项,选中喜欢的一个便能立刻使用。

试试看,体验声音创建原来可以如此简单。

Voice Design 为何重要

Voice Design v3

推出 Voice Design 时,目标很简单:让每位创作者都能生成专属声音,无需预订录音室,也无需在音频库里反复搜寻。第 3 版进一步提升了控制力和迭代速度,让创意更顺畅地变为最终音频。

项目通常需要数十种声音:平静的旁白、焦虑的配角、几个游戏 NPC,甚至一只会说话的浣熊。寻找“差不多就行”的声音会拖慢团队进度。

Voice Design v3 消除了这些阻碍。输入描述,生成 3 个候选音色,选择一个后继续创作。只需为提示词中的字符付费,不按样本收费。

v3 有哪些新功能

  • 精准的音频质量:在提示词中加入“perfect audio quality”(或其他质量等级),v3 都会遵循。想要罐头收音机效果?直接说明即可。音频精细度由你掌控。
  • 更智能的提示词引擎:v3 能处理“带上扬语调、面带微笑的中年纽约人”等细腻描述,同时保持清晰、避免产生瑕疵。在底层,我们扩展了潜在空间,并基于更广泛的口音数据重新训练,让罕见组合也能自然呈现。

两种设计模式

  • 真实音色设计,打造栩栩如生的演绎。例如:“一位说话轻柔平静的印度女性。”
  • 角色音色设计,从精灵到远古之神,各类角色均可创建。

一键生成 3 种音色

点击生成,v3 即会返回 3 种不同音色。保留喜欢的音色,它将占用 1 个音色位;其余可直接丢弃。无需排队,无额外费用。

3 步设计音色

Background
  1. 确定概念:声音扮演什么角色?快速勾勒角色设定。
  2. 明确提示词意图:用一句话描述年龄、口音、语气、节奏和音频质量。例如:“Perfect audio quality. 年长男性,浓重苏格兰口音,缓慢沉思,音色低沉沙哑。”
  3. 保存并部署:从 3 个预览中选择一个,即可立即在 ElevenLabs API 或网页工作室中使用。

没有层层下拉菜单,没有隐藏选项,只有结果。

提示词实用技巧

以下是研究团队在高质量结果中最常见的属性:

Attribute Why it matters Example keywords
Age Sets vocal texture and pitch child, teen, middle-aged, elderly
Accent/nationality Grounds the character in place thick Australian, light French, neutral American
Gender Guides resonance male, female, gender-neutral
Tone & emotion Drives delivery warm, assertive, anxious, joyful
Speed Controls pacing without editing fast, measured, languid
Guidance scale Balances creativity vs. prompt fidelity “guidance scale 10” (try 8–12 for accuracy, 3–5 for exploration)

如需查看完整对照表,请参阅文档中的提示词指南

关于清晰度

最佳提示词就像日常说话:简短、具体、不含术语。这也符合我们的写作原则:能删的词就删掉。

实际应用场景

v3
  • 游戏开发:今天用占位音色制作支线任务原型,明天再替换为最终配音,无需重新选角。
  • 有声书和播客:为每个角色赋予独特声音,再逐场打磨演绎方式。
  • 本地化:在生成符合当地文化的准确口音时,保持译文对白的时间节奏。
  • 无障碍:为屏幕阅读器和IVR系统创建契合品牌语调的声音,提升用户使用舒适度。

现已上线

Voice Design v3 已在 ElevenLabs 控制台上线:音色 → 我的音色 → 添加新音色 → Voice Design

登录,输入提示词,然后点击生成。很快,你就会拥有 3 种新音色,其中只有一种原本存在于你的脑海中。

工作室见。

常见问题

相关内容

用高质量 AI 音频创作