配音
配音
了解如何翻译音频和视频,同时保留说话者的情感、时机和语气。
概述
ElevenLabs 配音可将音频和视频翻译成 90 多种语言,同时保留每位说话者的情感、时长、语调和独特特征。保留原始背景音频,因此无需重新混音,即可用另一种语言重现每位说话者的表达方式。可用于:
- 将可触达受众扩大 4 倍,覆盖国际受众
- 调整现有素材以适配新市场,同时保留情感细节
- 无需重新录制配音,即可提供多语言内容
我们还为视频和播客创作者提供全托管配音服务。
使用方式
- 自动配音 — 只需几次点击,即可将内容从一种语言配成另一种语言,采用最新的 Dubbing v2 Alpha 模型。
- 上传限制: 应用中最大 1 GB、180 分钟;通过 API 每个源文件最大 3 GB
- 配音工作室 — 精细控制配音,包括编辑转录文本、重新分配说话者,以及按片段重新生成。仅支持 v1 模型。
- 上传限制: 最大 1 GB、45 分钟
- 注意: 配音工作室现处于维护模式,仅接收关键错误修复
- 通过 ElevenLabs Productions 进行人工审核的配音 — 详情请联系 productions@elevenlabs.io。
克隆强度
克隆强度是配音 v2 Alpha 模型中自动配音的可调设置,范围为 0 到 10。在应用中,点击 说话人相似度 进行调整。默认值 7 适用于大多数内容。较高的值会优先保留与原说话人的声音相似度,但对于语音特征差异很大的语言,听起来可能不够自然。较高设置也可能将更多原始口音带入配音输出。较低的值则让模型能更自由地以目标语言自然表达,但与原始声音的相似度会降低。
主要功能
- 多说话者: 自动检测多位说话者,即使语音重叠也可以。
- 多语言输出: 生成 90 多种语言的本地化音轨。
- 保留原始音色: 保留说话者的身份特征和情感语调。
- 保留背景音频: 无需重新混音音乐、音效或环境声。
- 支持的文件类型: 可从多种来源为视频和音频配音,包括 YouTube、TikTok、直接 URL 或上传文件。
Dubbing v2 不提供水印开关。免费版配音会自动添加水印; 付费版配音则不会。Dubbing v2 不提供以水印换取积分折扣的选项。旧版 v1 配音流程和配音工作室是唯一提供水印折扣的地方。
对于 Dubbing v2,仅企业版方案可通过 API 编辑转录文本和重新生成音频。
费用
有关详细积分费用,请参阅我们的定价页面。
支持的语言
配音支持 90 多种语言,包括英语、西班牙语、法语、德语、日语、中文、阿拉伯语等。API 在 source_language 和 target_language 参数中接受 BCP-47 语言标签,例如 fr 或 es-MX。在 Dubbing v2 中,如 es-MX 这类带区域的标签必须是下方列出的受支持方言之一;其他所有语言均使用基础语言标签。Dubbing v1 不支持方言。
Dubbing v2 支持的语言和方言
Dubbing v1 支持的语言
Dubbing v1 支持与 Eleven v3 模型相同的语言。不支持带区域的方言标签;请使用基础语言标签。
重要说明
- Dubbing v2 Alpha — Dubbing v2 目前处于 Alpha 阶段。随着我们持续改进模型,偶尔可能会遇到一些不够完善之处。
- 内容类型: 支持所有音频和视频内容类型,每个文件最多可包含 32 位不同说话者。
- 说话者保留: 在目标语言中保留每位说话者的语调、语速和风格。
- 输出质量: 配音后的视频是高质量预览,并非制作母版。通常以 1080p 输出,可能与源文件分辨率不同。Dubbing v1 的音频为单声道,Dubbing v2 最多为立体声,因此无法保留 5.1 及其他多声道音频。用于制作时,请下载配音后的音频,并将其替换到原始视频的音轨中。
- 并发数: 所有自助方案(免费版、Starter、Creator、Pro、Scale、商业版)最多支持 3 个并发配音任务,企业版方案默认支持 10 个。限制按工作区和模型分别计算,因此 v1 与 v2 任务不共用额度池。达到限制时,会收到
too_many_concurrent_requests错误;请等待现有任务完成后再开始新任务。
常见问题
是否支持实时或直播配音?
目前不支持实时或直播配音。
配音失败或卡住时怎么办?
如果配音工作室任务失败或被取消,积分会自动退回到账户。Dubbing v2(在自动配音中按分钟以美元计费)不会对失败的任务收费。如果配音长时间卡在“已排队”或“加载中”状态,请取消后重新提交。 这样不会损失积分。
可通过 API 使用 Dubbing v2 吗?
可以。所有方案均可创建和下载配音。仅企业版方案可通过 API 编辑转录文本和 重新生成。请参阅配音快速入门和优化并重新生成 配音。
可以编辑或重新生成 Dubbing v2 项目吗?
在应用中,Dubbing v2 为自动模式,不提供应用内编辑器。仅企业版方案可通过 API 编辑转录文本和 重新生成音频。请参阅优化并重新生成 配音。如需在 UI 中编辑,请使用旧版 v1 模型和配音工作室。
如何使用旧版 v1 配音模型?
主配音页面的自动配音默认使用 Dubbing v2。 如需使用旧版 v1 模型,请选择 Dubbing v1 作为模型。要创建配音 工作室项目,请选择 Dubbing v1,然后选择 配音项目。只有使用 v1 才能 创建配音工作室项目。
配音支持哪些视频分辨率?
配音接受最高 4K 的源视频。输出分辨率有所不同,且不一定与源文件一致, 但最常见为 1080p。请将配音后的视频视为预览:用于制作时,请使用 配音后的音频替换原始视频的音轨。