Music Finetunes

基于你的音色微调 ElevenLabs 音乐模型

Music Finetunes hero

Music Finetunes 可让你根据自己的声音微调 ElevenLabs 音乐模型。最终得到的 Finetune 能持续、大规模地生成符合你声音风格的新音乐。

本指南将介绍 Finetunes 的工作方式、如何准备数据集,以及如何评估结果。

什么是 Music Finetune

Music Finetune 是基于你上传的音频微调后的 ElevenLabs 音乐模型版本。无需仅依靠提示词描述风格,你可以使用基于自己声音构建的 Finetune。

这样可持续生成体现以下特点的音乐:

  • 乐器编配与编曲
  • 流派与制作风格
  • 速度与节奏感
  • 音色质感与音质
  • 人声风格(如包含人声)

每首生成的曲目都是原创,但以数据集中的风格模式为基础。

版权要求

为保护创作者和权利持有人,上传内容须遵守严格规定。除非你使用符合条件的企业版套餐,否则不得上传受版权保护的内容。

不得上传受版权保护的音乐,即使:

  • 你已购买该曲目
  • 你已获得该曲目授权
  • 你负责发行该曲目
  • 你是表演艺术家

对大多数用户而言,这意味着只能上传:

  • 由你创作并完全拥有的原创作品
  • 不受第三方版权主张约束的音频
  • 不含受版权保护的采样、伴奏或作品的内容

所有上传内容都会在开始微调前,由第三方版权合规系统自动审核。如果 Finetune 包含受版权保护的曲目,将被拒绝,且费用不予退还。

符合条件的企业版客户可基于其完全拥有和控制的专有知识产权进行微调,无需接受第三方版权审核。这项功能专为独家拥有内容库的组织设计。请联系客户经理启用此功能。

Music Finetunes 适用对象

独立音乐人和艺术家

使用原创且不受版权保护的作品创建 Finetune,生成贴合你声音风格的新曲目。探索不同变体、更快验证想法,或创作符合个人风格的伴奏。

品牌与代理商

上传品牌拥有的原创音频,例如声音标识或委托创作的作品,构建适用于营销活动、零售空间、社交内容和现场环境的 Finetune。

内容创作者

通过可复用的风格基础,在各项目中保持一致的音乐风格。

游戏和应用开发者

基于原创配乐素材创建 Finetune,在不同关卡、情绪和环境中生成协调一致的变体。

音乐技术平台和制作人

在权利完全可控的情况下,为用户提供基于其原创内容库或录音素材的生成服务。

如何创建 Finetune

1

上传曲目

在 ElevenCreative 中,前往 Finetunes 页面并选择 创建 Finetune。

上传一首或多首能代表你希望 Finetune 体现的风格的音频曲目。

Creating a new finetune

版权要求

  • 除非使用获批准的企业版套餐,否则不得上传受版权保护的音乐
  • 你必须完全拥有并控制上传的音频
  • 系统会自动审核音频是否符合版权要求

上传详情

  • 最多上传 50 首曲目
  • 每首曲目最短 10 秒、最长 600 秒,文件最大为 30MB
  • 每个 Finetune 最多可上传总计 250 分钟的音频

最佳实践

  • 避免上传几乎相同的录音或重复上传同一首曲目
  • 每首曲目应在统一的风格中提供一定的变化范围
2

创建 Finetune

上传内容通过合规审核后,将自动开始创建。

创建 Finetune 大约需要 5-10 分钟。

3

生成音乐

Finetune 准备就绪后,会显示在你的库中。

生成步骤:

  1. 在 ElevenCreative 中打开音乐生成提示词
  2. 在选择器中选择 Finetune
  3. 编写提示词并生成

Using a finetune

Finetune 控制风格特征。提示词控制内容、情绪、速度、语言和结构。

提示词示例:

“124 BPM 的欢快爵士乐,温暖的西班牙语女声。”

如果需要特定语言的人声,请始终明确指定语言。模型默认使用提示词的语言或英语。

最佳实践

构建优质数据集

Finetune 的质量取决于输入音频。

  • 优先确保风格范围内的多样性
  • 避免上传几乎相同的曲目
  • 小而精心筛选的数据集通常优于庞大且重复的数据集
  • 让数据集与你的预期使用场景相匹配
  • 仅上传完全符合版权要求的音频

如果输出与特定源曲目过于相似,请增加数据集的多样性。

有效使用提示词

Finetunes 决定风格,而非结构。

  • 始终编写清晰、描述具体的提示词
  • 指定速度、情绪、乐器编配和语言
  • 针对同一个 Finetune 测试多个提示词

评估 Finetune

优秀的 Finetune 会同时实现两个结果:

  1. 风格保真度:输出如同自然属于你的声音世界
  2. 原创性:输出不是可识别的复刻作品

评估问题:听起来是否属于同一位艺术家或品牌,同时又不像任何特定曲目的复制品?

如果输出感觉过于泛泛,请缩小数据集范围,使其更聚焦。

如果输出与特定曲目过于相似,请提高数据集多样性。

常见问题

每个 Finetune 通常需要 5-10 分钟。

可生成的音乐量取决于套餐提供的积分。

不需要。ElevenCreative 提供可立即使用的精选 Finetunes。

Finetune 将被拒绝,且费用不予退还。除非使用获批准的企业版套餐,否则不得上传受版权保护的内容。

Finetunes 专为学习风格而设计,不用于复现作品。不过,小型或重复的数据集会增加相似性风险。请使用多样、合规的训练数据,并仔细评估输出结果。

发布时,Finetunes 可在 ElevenCreative UI 中使用。企业版可按需申请 API 访问权限。

特定语言的数据能提升相应能力,但仍必须在生成提示词中明确指定所需语言。

No results