变声器
变声器
了解如何在保留情感和表达方式的同时转换音频音色。
概览
ElevenLabs 变声器 API 可将任何源音频(录制或上传)转换为另一种完整克隆的音色,同时保留原始表演的细微之处。它能够捕捉耳语、笑声、哭声、口音和细微的情感线索,呈现高度真实、自然的效果,可用于:
- 在保留情感表达和细节的同时更改任意音色
- 为多种语言和多次录音创建一致的角色音色
- 修复或替换现有录音中的特定单词和短语
浏览我们的声音库,为项目找到理想音色。
支持的语言
多语言 v2 模型支持 29 种语言:
英语(美国、英国、澳大利亚、加拿大)、日语、中文、德语、印地语、法语(法国、加拿大)、韩语、葡萄牙语(巴西、葡萄牙)、意大利语、西班牙语(西班牙、墨西哥)、印尼语、荷兰语、土耳其语、菲律宾语、波兰语、瑞典语、保加利亚语、罗马尼亚语、阿拉伯语(沙特阿拉伯、阿联酋)、捷克语、希腊语、芬兰语、克罗地亚语、马来语、斯洛伐克语、丹麦语、泰米尔语、乌克兰语和俄语。
eleven_english_sts_v2 模型仅支持英语。
关键信息
- 单段最大时长:5 分钟——请将较长录音拆分为多个片段
- 计费:每处理 1 分钟音频消耗 1,000 个字符
- 背景噪声:使用
remove_background_noise=true,尽量减少输出中的环境声 - 模型建议:即使处理英文内容,
eleven_multilingual_sts_v2的表现也常优于eleven_english_sts_v2 - 自定义音色:声音库中任何克隆或设计的音色都可用作输出音色;请提供其
voice_id