有声书
有声书
通过端到端工作流程,将书面内容转换为录音室品质音频

概述
有声书提供端到端工作流程,可将书面内容转换为录音室品质音频。
你可以粘贴或上传书稿,使用 ElevenLabs 音色生成逼真的旁白,并通过章节组织项目。还可添加音乐和音效,并直接在编辑器中编辑和优化旁白。
角色选角会识别书稿中的角色,为每个角色推荐音色,并让你通过书中的真实对话进行试听。更改角色音色后,该角色在整本书中的所有台词都会更新。
完成后,你可以导出有声书,或直接发布到 ElevenReader 等收听平台及合作伙伴市场。
有声书还支持动态旁白模式,听众可在播放时选择喜欢的音色。
使用指南

上传文件并选择基本设置
在有声书页面选择 创建有声书,开始新项目。
上传书稿
将书稿拖放到上传区域,或浏览设备选择文件。有声书目前支持:
- EPUB
选择旁白风格

选择希望有声书采用的旁白方式:
- 单角色 — 由一位旁白音色朗读整本书
- 多角色 — 为旁白及书稿中检测到的角色分配不同音色
如果整本书只需一种声音朗读,请选择 单角色。如需由旁白和角色分别使用不同声音,制作更具戏剧感的作品,请选择 多角色。
选择模型
选择有声书使用的 AI 模型。如需逼真且情感丰富的效果,建议长篇旁白和有声书使用 Eleven Multilingual v2(录音室品质)。它支持 29 种语言。
选择 继续,开始处理书稿。
解析并格式化书稿
选择 继续 后,ElevenLabs 会自动解析文件。系统将分析文档以提取元数据、章节和格式。
解析完成后,你将进入 格式化 页面。
查看封面图片
如果 EPUB 或 PDF 包含封面,系统会自动提取并显示为有声书封面图。你可以:
- 替换封面
- 移除封面
- 保留提取的封面
查看检测到的部分
ElevenLabs 会识别书稿中的结构部分,例如:
- 版权声明
- 献词
- 序章
- 章节
- 尾声
- 其他已格式化部分
使用复选框选择或取消选择要包含在有声书中的部分。
继续前请仔细检查检测到的结构。书稿格式可能有所不同,系统不一定总能完全按预期识别各部分。
选择音色并为角色选角
在 角色 步骤中,为有声书选择音色。

为多角色有声书选角
如果选择了 多角色,ElevenLabs 会分析书稿并检测其认为在故事中有台词的角色。之后可为以下对象分配唯一音色:
- 主旁白
- 每个检测到的角色
- 书稿中识别出的其他说话者
角色检测由 AI 生成,应视为起点。系统可能无法识别每个角色,尤其是次要角色、未命名角色,或难以与周围旁白区分的说话者。
查看检测到的角色列表,并根据需要调整选角。添加、更改或移除音色分配,让最终角色阵容与书稿一致。
浏览声音库
浏览可用的录音室品质音色,或使用搜索和筛选功能查找合适的音色。筛选项包括:
- 语言
- 口音
- 类别
- 性别
- 年龄
分配前可以试听音色。
查看并添加发音规则
发音 步骤可帮助你控制姓名、地点、虚构词汇及其他不常见术语的读法。

查看自动检测到的术语
ElevenLabs 会扫描书稿,并推荐可能需要发音规则的术语,包括角色名称、地名或虚构术语。
这些推荐由系统自动生成,因此可能不会包含书中所有重要词语。请查看列表,并为需要特殊处理的重要术语添加规则。
添加发音规则
对于每个术语,你可以创建规则,例如 别名,并输入所需的 输出。输出会告诉模型该术语应如何发音。
也可以在右上角选择 添加规则,手动搜索词语并定义其发音。
在上下文中试听发音
选择规则旁的 播放 图标,聆听所选音色朗读书稿中出现该术语的句子。
在上下文中试听有助于检查:
- 发音
- 节奏
- 周围的句子
- 规则是否适用于分配的音色
空规则会被跳过,模型将对这些术语使用默认发音。
编辑与播放
创建有声书后,可以在编辑器中进一步优化和增强。
生成和试听旁白
添加内容后,可以直接在编辑器中生成和试听旁白。
- 使用 播放 按钮生成旁白或播放已生成的音频
- 每个章节内按段落生成
每个段落的状态会通过文本左侧的条形标识:
- 深色条 — 已生成旁白
- 浅灰色条 — 尚未生成旁白
播放模式
可通过播放按钮左侧的模式选择器,选择播放和生成方式:
- 所选内容 — 仅播放或生成所选段落的音频
- 至结尾(逐段生成) — 从所选段落播放至章节结尾,每次生成一个段落
- 至结尾(预先生成片段) — 从所选段落播放至章节结尾,并提前生成多个段落,以实现更流畅的播放
播放已生成的音频不消耗额度。仅在生成新旁白时消耗额度。
编辑有声书
可以编辑文本、调整声音设置或更改时间安排,然后按需重新生成特定部分。
时间轴可让你查看旁白、音乐和音效如何共同播放,并在导出前进行调整。
增强有声书
可通过添加更多音频层来丰富有声书:
- 音色 — 选择或更新旁白音色
- 音效(SFX) — 从库中添加音效或生成自定义声音
- 音乐 — 从音乐市场选择,或生成新曲目
添加音乐或音效:
- 点击 + 图标,将其导入项目
- 它们会作为独立轨道显示在时间轴上,并与旁白一同播放
音色和模型设置
你可以通过编辑器侧边栏和项目设置中的 音色和模型设置,自定义有声书的声音效果。
音色和模型选择
- 音色 — 选择用于有声书的旁白音色
- 模型 — 决定语音质量、表现力和支持的语言
可在两个位置更改:
- 编辑器侧边栏 — 将设置应用于所选段落或部分
- 项目设置 — 为整个项目设置默认音色和模型
要访问项目级设置,请打开左上角菜单并选择 项目设置。
可用模型
ElevenLabs 支持多种各具优势的语音模型:
- Eleven v4 — 最新模型,拥有最高品质和最广泛的语言支持
- Eleven v3 — 上一代富有表现力的模型(需要更多提示词控制)
- Eleven Multilingual v2 — 高品质、自然的旁白(大多数有声书使用场景的默认选择)
- Eleven Flash 模型 — 针对速度和更低延迟优化
可随时切换模型。但请注意:
更改模型不会更新已生成的音频 — 需要重新生成受影响的段落,这会消耗额度。
默认设置
创建新有声书时:
- 默认模型为 Eleven Multilingual v2
- 默认音色会自动选择(可随时更改)
- 默认语言设置为 自动检测
音色设置(按所选内容)
在编辑器中工作时,可为特定段落覆盖音色设置。在侧边栏中启用 覆盖设置,即可调整表达方式而不影响整个项目。
播放控制
上下文侧边栏提供旁白微调所需的播放控件:
- 音量 — 调整响度
- 淡入 / 淡出 — 控制音频的开始和结束方式
这些设置适用于所选段落。
AI 工具
侧边栏还提供 AI 驱动的工具,帮助改善有声书:
- 增强文本 — 优化文本,改善表达和清晰度
- 移除背景音频 — 使用人声分离清理音频
- 使用变声器 — 修改现有音频中的声音
- 用你的声音指导语音 — 录制参考音频来指导表达(演员模式)
质量和导出设置
音频质量由订阅套餐和项目设置自动决定,不影响额度使用。
要查看项目的确切输出质量,请点击右上角的 发布,打开 导出 标签页,并将鼠标悬停在 音频格式 字段上,查看比特率和采样率等详细信息。

重要行为
如果在生成音频后更改音色或模型设置:
- 现有段落不会自动更新
- 必须重新生成音频才能应用更改,这会消耗额度
上下文侧边栏
上下文侧边栏会根据你在项目中的选择更新。
对于旁白,它提供:
- 播放控制
- 音色和模型选择
- 覆盖设置
- 生成历史记录
- AI 工具
这样可以在非常精细的层级调整和优化旁白。
发音词典

可使用发音词典控制特定词语的读法。
适用于:
- 角色名称
- 品牌名称
- 首字母缩略词
- 不常见或有歧义的词语
发音词典可让你通过以下方式定义词语的读法:
- 音素规则 — 使用音标指定发音
- 别名 — 用另一种拼写替换词语,以获得所需发音
当文本中的词语匹配已连接词典中的规则时,系统会使用你定义的发音。
如何使用发音词典
- 从工具栏打开 发音编辑器
- 创建新词典或选择现有词典
- 为要控制的词语添加条目
- 点击 连接,将词典应用到项目
也可以上传词典文件,或在发音编辑器中管理所有词典。
重要说明
- 词典按顺序应用 — 使用 第一个匹配的规则
- 更改仅适用于新生成的音频。必须 重新生成段落 才能听到更新
- 音素规则仅支持英语模型,例如 Flash v2
发音词典尤其有助于保持长篇有声书的一致性。
角色配音
角色配音可帮助你为书中的角色分配音色。上传手稿后,Audiobooks 会识别角色,为每个角色推荐音色,并让你用书中的实际对话预览效果。
生成后更新角色
如果在生成音频后更改角色音色,该角色之前的音频将被清除。你需要使用新音色重新生成音频,这会消耗额度。继续前,系统会要求你确认更改。
该角色的每句台词都会在整本书中更新,无需手动重新分配各个段落或章节。要自动重新生成所有受影响段落的音频,请导出有声书的新版本。仅会为需要重新生成的段落消耗额度。
声音库
Audiobooks 支持用超过 10,000 种音色制作 90 多种语言的旁白。如果想亲自旁白或为角色配音,也可以在几秒内克隆自己的声音。
最佳实践
在解析步骤完成前,请检查格式。识别错误的部分可能影响最终有声书。
对于多角色项目,请检查每个已识别角色及其音色分配。尤其注意未命名或次要角色,系统可能较难正确识别。
请结合上下文试听发音预览,不要只依赖书面规则。单独听起来正确的发音,在完整句子中可能需要调整。
导出或发布前,请检查生成的有声书。Audiobooks 可以自动完成大部分制作流程,但编辑与质量检查仍是获得精良成品的关键。
章节
有声书按章节组织。导入文档时,可以手动创建章节,也可以自动识别章节。
你可以:
- 使用 + 按钮添加新章节
- 重命名或调整章节顺序
- 按章节生成旁白
章节有助于整理较长内容,并让导出更灵活。
旁白模式
Audiobooks 提供两种不同的旁白方式,可按目标选择。
原始音频
使用所选音色预先生成音频,所有听众听到的内容均保持不变。
适合需要完全控制以下内容时使用:
- 音色选择
- 节奏和表达
- 音乐和音效设计
动态旁白
动态旁白不使用固定音色,而是允许听众在播放时选择偏好的音色。
适合以下场景:
- 无障碍访问
- 个性化
- 满足听众偏好
动态旁白播放不包含音乐、音效和外部音频。
导出与发布
导出选项
要导出有声书,请点击右上角的 发布,然后打开 导出 标签页。
Audiobooks 提供灵活的导出选项,可按内容用途选择。
导出范围
- 完整项目
- 单个章节
媒体类型
- 音频
- 时间线数据(AAF)
- 字幕
文件结构
- 单个文件
- 按章节打包的 ZIP
音频格式
- MP3
- WAV
如果部分内容尚未生成,导出时会自动完成生成,这将消耗额度。
发布与分发
要分发有声书,请点击右上角的 发布,并停留在 发布 标签页。
你可以直接发布到:
- ElevenReader — 用于在应用内收听和分发
- Spotify 和 InAudio 等 合作平台
- ElevenLabs Video 或 Audio Native,以提供更多格式
发布后,你可以与听众分享有声书,并可在 ElevenReader 等支持的平台通过分发开始获得收益。
发布到 ElevenReader
发布到 ElevenReader 时,需要完成提交流程,为分发准备有声书。
包括:
- 创建或选择作者资料
- 添加图书元数据(书名、副标题、封面图)
- 提供分发详情
- 设置收款和协议
- 审核并提交有声书
提交后,有声书会先经过审核,随后才能在 ElevenReader 应用中上线。
使用系列整理有声书
你可以将多本有声书归入一个系列,整理相关内容并提升可发现性。
创建系列:
- 前往 书架
- 点击 创建系列 按钮(右上角)
- 输入:
- 系列名称
- 描述
- 作者资料
- 语言
- 可选择将现有图书加入系列
- 点击 创建系列