有声书

通过端到端工作流程,将书面内容转换为录音室品质音频

有声书

概述

有声书提供端到端工作流程,可将书面内容转换为录音室品质音频。

你可以粘贴或上传书稿,使用 ElevenLabs 音色生成逼真的旁白,并通过章节组织项目。还可添加音乐和音效,并直接在编辑器中编辑和优化旁白。

角色选角会识别书稿中的角色,为每个角色推荐音色,并让你通过书中的真实对话进行试听。更改角色音色后,该角色在整本书中的所有台词都会更新。

完成后,你可以导出有声书,或直接发布到 ElevenReader 等收听平台及合作伙伴市场。

有声书还支持动态旁白模式,听众可在播放时选择喜欢的音色。

使用指南

有声书 - 创建新书
1

上传文件并选择基本设置

在有声书页面选择 创建有声书,开始新项目。

上传书稿

将书稿拖放到上传区域,或浏览设备选择文件。有声书目前支持:

  • EPUB
  • PDF

选择旁白风格

有声书旁白风格选择

选择希望有声书采用的旁白方式:

  • 单角色 — 由一位旁白音色朗读整本书
  • 多角色 — 为旁白及书稿中检测到的角色分配不同音色

如果整本书只需一种声音朗读,请选择 单角色。如需由旁白和角色分别使用不同声音,制作更具戏剧感的作品,请选择 多角色。

选择模型

选择有声书使用的 AI 模型。如需逼真且情感丰富的效果,建议长篇旁白和有声书使用 Eleven Multilingual v2(录音室品质)。它支持 29 种语言。

选择 继续,开始处理书稿。

2

解析并格式化书稿

选择 继续 后,ElevenLabs 会自动解析文件。系统将分析文档以提取元数据、章节和格式。

解析完成后,你将进入 格式化 页面。

查看封面图片

如果 EPUB 或 PDF 包含封面,系统会自动提取并显示为有声书封面图。你可以:

  • 替换封面
  • 移除封面
  • 保留提取的封面

查看检测到的部分

ElevenLabs 会识别书稿中的结构部分,例如:

  • 版权声明
  • 献词
  • 序章
  • 章节
  • 尾声
  • 其他已格式化部分

使用复选框选择或取消选择要包含在有声书中的部分。

继续前请仔细检查检测到的结构。书稿格式可能有所不同,系统不一定总能完全按预期识别各部分。

3

选择音色并为角色选角

在 角色 步骤中,为有声书选择音色。

有声书角色选角

为多角色有声书选角

如果选择了 多角色,ElevenLabs 会分析书稿并检测其认为在故事中有台词的角色。之后可为以下对象分配唯一音色:

  • 主旁白
  • 每个检测到的角色
  • 书稿中识别出的其他说话者

角色检测由 AI 生成,应视为起点。系统可能无法识别每个角色,尤其是次要角色、未命名角色,或难以与周围旁白区分的说话者。

当前每本书最多可检测 150 个音色。

查看检测到的角色列表,并根据需要调整选角。添加、更改或移除音色分配,让最终角色阵容与书稿一致。

使用自定义音频试听音色会消耗额度。

浏览声音库

浏览可用的录音室品质音色,或使用搜索和筛选功能查找合适的音色。筛选项包括:

  • 语言
  • 口音
  • 类别
  • 性别
  • 年龄

分配前可以试听音色。

使用自定义音频试听音色会消耗额度。
4

查看并添加发音规则

发音 步骤可帮助你控制姓名、地点、虚构词汇及其他不常见术语的读法。

有声书发音编辑器

查看自动检测到的术语

ElevenLabs 会扫描书稿,并推荐可能需要发音规则的术语,包括角色名称、地名或虚构术语。

这些推荐由系统自动生成,因此可能不会包含书中所有重要词语。请查看列表,并为需要特殊处理的重要术语添加规则。

添加发音规则

对于每个术语,你可以创建规则,例如 别名,并输入所需的 输出。输出会告诉模型该术语应如何发音。

也可以在右上角选择 添加规则,手动搜索词语并定义其发音。

在上下文中试听发音

选择规则旁的 播放 图标,聆听所选音色朗读书稿中出现该术语的句子。

在上下文中试听有助于检查:

  • 发音
  • 节奏
  • 周围的句子
  • 规则是否适用于分配的音色

空规则会被跳过,模型将对这些术语使用默认发音。

5

创建有声书

对格式、音色选角和发音规则满意后,在右下角选择 创建有声书。

ElevenLabs 随后会开始创建有声书。完成后,你可以管理项目、查看结果、导出音频文件,或将完成的项目发布到 ElevenReader,供听众欣赏。

编辑与播放

创建有声书后,可以在编辑器中进一步优化和增强。

生成和试听旁白

添加内容后,可以直接在编辑器中生成和试听旁白。

  • 使用 播放 按钮生成旁白或播放已生成的音频
  • 每个章节内按段落生成

每个段落的状态会通过文本左侧的条形标识:

  • 深色条 — 已生成旁白
  • 浅灰色条 — 尚未生成旁白

播放模式

可通过播放按钮左侧的模式选择器,选择播放和生成方式:

  • 所选内容 — 仅播放或生成所选段落的音频
  • 至结尾(逐段生成) — 从所选段落播放至章节结尾,每次生成一个段落
  • 至结尾(预先生成片段) — 从所选段落播放至章节结尾,并提前生成多个段落,以实现更流畅的播放

播放已生成的音频不消耗额度。仅在生成新旁白时消耗额度。

编辑有声书

可以编辑文本、调整声音设置或更改时间安排,然后按需重新生成特定部分。

时间轴可让你查看旁白、音乐和音效如何共同播放,并在导出前进行调整。

增强有声书

可通过添加更多音频层来丰富有声书:

  • 音色 — 选择或更新旁白音色
  • 音效(SFX) — 从库中添加音效或生成自定义声音
  • 音乐 — 从音乐市场选择,或生成新曲目

添加音乐或音效:

  • 点击 + 图标,将其导入项目
  • 它们会作为独立轨道显示在时间轴上,并与旁白一同播放

音色和模型设置

你可以通过编辑器侧边栏和项目设置中的 音色和模型设置,自定义有声书的声音效果。

  • 音色 — 选择用于有声书的旁白音色
  • 模型 — 决定语音质量、表现力和支持的语言

可在两个位置更改:

  • 编辑器侧边栏 — 将设置应用于所选段落或部分
  • 项目设置 — 为整个项目设置默认音色和模型

要访问项目级设置,请打开左上角菜单并选择 项目设置。

ElevenLabs 支持多种各具优势的语音模型:

  • Eleven v4 — 最新模型,拥有最高品质和最广泛的语言支持
  • Eleven v3 — 上一代富有表现力的模型(需要更多提示词控制)
  • Eleven Multilingual v2 — 高品质、自然的旁白(大多数有声书使用场景的默认选择)
  • Eleven Flash 模型 — 针对速度和更低延迟优化

可随时切换模型。但请注意:

更改模型不会更新已生成的音频 — 需要重新生成受影响的段落,这会消耗额度。

创建新有声书时:

  • 默认模型为 Eleven Multilingual v2
  • 默认音色会自动选择(可随时更改)
  • 默认语言设置为 自动检测

在编辑器中工作时,可为特定段落覆盖音色设置。在侧边栏中启用 覆盖设置,即可调整表达方式而不影响整个项目。

上下文侧边栏提供旁白微调所需的播放控件:

  • 音量 — 调整响度
  • 淡入 / 淡出 — 控制音频的开始和结束方式

这些设置适用于所选段落。

侧边栏还提供 AI 驱动的工具,帮助改善有声书:

  • 增强文本 — 优化文本,改善表达和清晰度
  • 移除背景音频 — 使用人声分离清理音频
  • 使用变声器 — 修改现有音频中的声音
  • 用你的声音指导语音 — 录制参考音频来指导表达(演员模式)

音频质量由订阅套餐和项目设置自动决定,不影响额度使用。

要查看项目的确切输出质量,请点击右上角的 发布,打开 导出 标签页,并将鼠标悬停在 音频格式 字段上,查看比特率和采样率等详细信息。

发布有声书

重要行为

如果在生成音频后更改音色或模型设置:

  • 现有段落不会自动更新
  • 必须重新生成音频才能应用更改,这会消耗额度

上下文侧边栏

上下文侧边栏会根据你在项目中的选择更新。

对于旁白,它提供:

  • 播放控制
  • 音色和模型选择
  • 覆盖设置
  • 生成历史记录
  • AI 工具

这样可以在非常精细的层级调整和优化旁白。

发音词典

有声书 - 发音词典

可使用发音词典控制特定词语的读法。

适用于:

  • 角色名称
  • 品牌名称
  • 首字母缩略词
  • 不常见或有歧义的词语

发音词典可让你通过以下方式定义词语的读法:

  • 音素规则 — 使用音标指定发音
  • 别名 — 用另一种拼写替换词语,以获得所需发音

当文本中的词语匹配已连接词典中的规则时,系统会使用你定义的发音。

如何使用发音词典

  1. 从工具栏打开 发音编辑器
  2. 创建新词典或选择现有词典
  3. 为要控制的词语添加条目
  4. 点击 连接,将词典应用到项目

也可以上传词典文件,或在发音编辑器中管理所有词典。

重要说明

  • 词典按顺序应用 — 使用 第一个匹配的规则
  • 更改仅适用于新生成的音频。必须 重新生成段落 才能听到更新
  • 音素规则仅支持英语模型,例如 Flash v2

发音词典尤其有助于保持长篇有声书的一致性。

角色配音

角色配音可帮助你为书中的角色分配音色。上传手稿后,Audiobooks 会识别角色,为每个角色推荐音色,并让你用书中的实际对话预览效果。

生成后更新角色

如果在生成音频后更改角色音色,该角色之前的音频将被清除。你需要使用新音色重新生成音频,这会消耗额度。继续前,系统会要求你确认更改。

该角色的每句台词都会在整本书中更新,无需手动重新分配各个段落或章节。要自动重新生成所有受影响段落的音频,请导出有声书的新版本。仅会为需要重新生成的段落消耗额度。

声音库

Audiobooks 支持用超过 10,000 种音色制作 90 多种语言的旁白。如果想亲自旁白或为角色配音,也可以在几秒内克隆自己的声音。

最佳实践

在解析步骤完成前,请检查格式。识别错误的部分可能影响最终有声书。

对于多角色项目,请检查每个已识别角色及其音色分配。尤其注意未命名或次要角色,系统可能较难正确识别。

请结合上下文试听发音预览,不要只依赖书面规则。单独听起来正确的发音,在完整句子中可能需要调整。

导出或发布前,请检查生成的有声书。Audiobooks 可以自动完成大部分制作流程,但编辑与质量检查仍是获得精良成品的关键。

章节

有声书按章节组织。导入文档时,可以手动创建章节,也可以自动识别章节。

你可以:

  • 使用 + 按钮添加新章节
  • 重命名或调整章节顺序
  • 按章节生成旁白

章节有助于整理较长内容,并让导出更灵活。

旁白模式

Audiobooks 提供两种不同的旁白方式,可按目标选择。

原始音频

使用所选音色预先生成音频,所有听众听到的内容均保持不变。

适合需要完全控制以下内容时使用:

  • 音色选择
  • 节奏和表达
  • 音乐和音效设计

动态旁白

动态旁白不使用固定音色,而是允许听众在播放时选择偏好的音色。

适合以下场景:

  • 无障碍访问
  • 个性化
  • 满足听众偏好

动态旁白播放不包含音乐、音效和外部音频。

导出与发布

导出选项

要导出有声书,请点击右上角的 发布,然后打开 导出 标签页。

Audiobooks 提供灵活的导出选项,可按内容用途选择。

  • 完整项目
  • 单个章节
  • 音频
  • 时间线数据(AAF)
  • 字幕
  • 单个文件
  • 按章节打包的 ZIP
  • MP3
  • WAV

如果部分内容尚未生成,导出时会自动完成生成,这将消耗额度。

发布与分发

要分发有声书,请点击右上角的 发布,并停留在 发布 标签页。

你可以直接发布到:

  • ElevenReader — 用于在应用内收听和分发
  • Spotify 和 InAudio 等 合作平台
  • ElevenLabs Video 或 Audio Native,以提供更多格式

发布后,你可以与听众分享有声书,并可在 ElevenReader 等支持的平台通过分发开始获得收益。

发布到 ElevenReader

发布到 ElevenReader 时,需要完成提交流程,为分发准备有声书。

包括:

  • 创建或选择作者资料
  • 添加图书元数据(书名、副标题、封面图)
  • 提供分发详情
  • 设置收款和协议
  • 审核并提交有声书

提交后,有声书会先经过审核,随后才能在 ElevenReader 应用中上线。

使用系列整理有声书

你可以将多本有声书归入一个系列,整理相关内容并提升可发现性。

创建系列:

  1. 前往 书架
  2. 点击 创建系列 按钮(右上角)
  3. 输入:
    • 系列名称
    • 描述
    • 作者资料
    • 语言
  4. 可选择将现有图书加入系列
  5. 点击 创建系列

常见问题

不需要。在有声书中,如果部分内容尚未生成,导出时会自动完成,这将消耗额度。

在 Audiobooks 中,生成的旁白(原始音频)会使用选定音色生成固定的音频文件。

动态旁白允许听众在播放时选择偏好的旁白音色。

可以。你可以将有声书分发到多个平台,包括 ElevenReader 和支持的合作伙伴市场。

角色配音分配会检测书稿中的角色,为每个检测到的角色推荐音色,并让你通过书中的真实对话试听。

角色检测由 AI 生成,应将其视为起点。系统可能无法识别所有角色,尤其是次要角色、未命名角色,或难以与周围叙述区分的说话者。

更改角色音色后,该角色的所有台词都会在整本书中更新。

有声书可按需使用任意数量的音色。声音库提供超过 10,000 种音色,覆盖 90 多种语言;你还可以克隆自己的声音,用于旁白或角色音色。

对于角色选角,目前每本书最多支持检测 150 种音色。

Audiobooks 支持 EPUB 和 PDF 格式。上传文件后,系统会自动解析书稿,提取元数据、章节和格式信息。如果文件包含封面图片,也会自动提取。

非常大的书稿或复杂的 Audiobooks 项目偶尔可能会在处理过程中失败。如遇此情况,请检查书稿结构后重试。

报告问题时,请提供文件详情、文件大小和格式,以及处理失败的阶段。

No results