音色混音

了解如何通过修改性别、口音、风格、语速、音频质量等属性,转换和增强现有音色。

概览

ElevenLabs 音色混音可通过核心平台和 API 使用。此功能可在保留音色辨识度的独特特征的同时,修改其核心属性来转换现有音色。尤其适合让音色适应不同场景、为不同角色创建变体,或提升和/或更改现有音色档案的音频质量。

例如,以下是原始音色:

以下是混音版本,切换为旧金山口音:

使用方法

音色混音模型支持通过自然语言提示词和可自定义设置调整多项属性,转换你拥有的音色或拥有无限通知期的声音库音色。

主要功能

  • 属性修改:更改你拥有的任意音色或拥有无限通知期的声音库音色的性别、口音、说话风格、语速和音频质量
  • 迭代编辑:基于此前混音版本持续优化音色
  • 脚本灵活性:使用默认脚本,或输入带有 v3 模型音频标签(如 [laughs] 或 [whispers])的自定义脚本
  • 提示词强度控制:可将混音强度从低调整至高,精准控制转换效果

混音参数

提示词强度

音色混音提供不同级别的提示词强度,用于控制音色的转换程度:

  • 低:细微调整,保留大部分原始音色特征
  • 中:平衡转换,在保留音色身份的同时修改关键属性
  • 高:严格遵循混音提示词,可能显著改变原始音色的音调
  • 最高:彻底转换音色,但代价是音色会完全改变

脚本选项

  • 默认脚本:针对音色混音优化的预配置脚本
  • 自定义脚本:输入自己的文本,支持 v3 模型音频标签,例如:
    • [laughs] - 添加笑声
    • [whispers] - 转为耳语
    • [sighs] - 添加叹息声
    • 支持其他情感和风格标签,帮助塑造音色

支持的音色格式

输入

  • 你个人拥有的任何克隆音色(Instant Voice Clone 或 Professional Voice Clone)
  • 通过 Voice Design 产品创建的音色
  • 从声音库添加的任何拥有无限通知期的音色

输出

  • v3 的完整质量音色模型(同时向后兼容所有其他模型)
  • 可进一步混音的迭代可编辑音色

关键信息

  • 定价:根据混音过程中使用的测试脚本长度计费
  • 符合条件的音色:可混音你拥有的音色、你获得明确授权的音色,以及任何拥有无限通知期的音色
  • 原始音色:混音会创建新的音色变体——不会修改原始音色
  • 迭代限制:迭代混音没有次数限制;每次混音都可作为下一次的基础