ElevenCreative Studio

使用 Studio 创建视频和音频项目。

ElevenCreative Studio 项目编辑器

概览

ElevenCreative Studio 4.0 使用提示词优先的工作流程创建视频和音频项目。描述想创建的项目,Studio Agent 会生成初稿。

视频项目使用包含可复用素材的 素材库,其中包括生成的视频片段、图片和语音。在多轨时间线上排列这些素材。使用 素材库、脚本 和 字幕 面板管理素材,并控制旁白、音乐和音效。

与团队共享项目,以收集评论和反馈。

ElevenCreative Studio 支持我们最新的语音模型,包括 Eleven v4。你可随时在 项目设置 中切换模型。

指南

1

创建新项目

在提示词栏中描述项目,或选择灵感卡片,从示例开始。若要使用自己的脚本或文档开始,请选择 上传。

2

选择设置

在对话框中配置项目设置,然后选择 创建。

3

完善项目

使用时间线编辑器添加视频、旁白、音乐和音效。

4

与他人协作

选择 共享,将项目发送给团队成员并收集反馈。

5

导出项目

选择 导出,将项目导出为音频或视频。

起始选项

创建项目时,Studio 会选择部分设置。

大多数新项目默认使用 Eleven Multilingual v2。你可在 项目设置 中选择其他模型,包括 Eleven v3。

Studio 会根据订阅套餐选择质量设置。质量设置不影响积分用量。

  • 免费版、入门版和创作者版:128 kbps MP3,或从 128 kbps 源生成的 WAV。
  • 专业版、扩展版、商业版和企业版:16-bit、44.1 kHz WAV,或 192 kbps MP3(Ultra Lossless)。

免费版导出的视频包含水印。付费套餐导出的视频不含水印。

快速开始

在 Studio 页面顶部,使用 你想创建什么? 提示词栏描述项目。Studio Agent 会根据描述创建初稿。你也可以上传现有媒体,或创建空白项目。

上传

选择 上传,从现有媒体开始。文本和音频文件会在音频布局中打开。视频文件会在视频布局中打开,并可使用字幕。

从头开始创建项目

选择 + 新建空白项目,打开项目类型选择器:

  • 视频项目(新) 会打开新版视频编辑器,其中包含 素材库、脚本、字幕 面板和 Studio Agent。
  • 音频项目 会创建空白音频项目,适用于长篇旁白、播客和有声书。
  • 视频项目 会打开 Studio 的旧版视频编辑器。

开始使用

灵感 部分包含示例项目。选择一张卡片,将其作为新项目的起点。选择 查看所有灵感,按类别搜索完整素材库。

可用灵感

灵感类型描述
电影预告片视频具有戏剧性节奏和音乐的电影感短视频
讲解视频视频清晰且结构化的视频,用于讲解概念或产品
产品视频视频通过视觉素材、旁白和音乐展示产品
音频纪录片视频 / 音频纪录片风格的长篇叙事音频或视频
操作教程视频分步教学视频格式
音频播客音频对话式或访谈式音频内容
字幕视频已准备好应用自动字幕的视频项目

随着灵感库更新,可用类别可能会变化。

Studio Agent

视频项目编辑器中的 Studio Agent

概览

Studio Agent 是直接内置于 ElevenCreative Studio 视频项目中的 AI 协作编辑助手。

Studio Agent 聊天会根据 token 用量消耗积分。媒体生成会消耗额外积分。

描述你想创建的内容、上传文件,或从过去生成的内容中选择素材。Studio Agent 会在时间线上创建初稿前,询问视频时长、基调、结构和转场。它会添加片段、旁白、音色、音效和字幕。你可随时编辑时间线,然后继续与 Studio Agent 协作。

主要功能

分析片段

Studio Agent 会构建视频的逐帧地图,以识别画面中发生的内容。例如,输入“徽标出现时添加呼啸声”,即可在该位置添加音频。

聊天内素材发现

无需打开声音库或音效目录,即可在聊天中搜索、预览和放置音色模型及音效。

模型选择和确认

Studio Agent 会根据请求从 5 个图像模型和 5 个视频模型中选择。确认生成时,你可以改选其他模型。

规划和创建模式

使用编辑器顶部的开关,在两种模式之间切换:

创建模式 允许 Studio Agent 编辑时间线、插入片段、生成媒体、应用文字叠加层和调整音频。

规划模式 允许 Studio Agent 在不更改时间线的情况下概述其方案。使用此模式审查建议的更改。

在规划模式下,Studio Agent 可以:

  • 分析素材并转录语音。
  • 搜索素材和音色模型。
  • 起草脚本和场景计划。
  • 规划时间线编辑并计算空隙管理。
  • 提供 TikTok、YouTube 和 Instagram 使用建议。

手动控制

你可随时编辑时间线,然后继续与 Studio Agent 协作。

限制和文件处理

文件大小

Studio Agent 不设额外的文件大小限制。

可用性

Studio Agent 可在网页应用中使用,无法通过 API 使用。

定价

Studio Agent 对所有套餐开放。聊天会根据 5 类 token 消耗积分:输入、输出、思考、缓存读取 和 缓存写入。费用取决于各类别的 token 消耗量。

语音、图片、音乐、音效和视频生成均按这些功能的标准费率计费。商业使用权由订阅套餐决定,与其他 ElevenLabs 产品一致。

标准订阅套餐使用积分。企业版套餐可能采用法定货币计费。详情请联系企业销售团队。

如需升级套餐,请访问订阅页面。

生成和编辑

选择 导出,渲染当前章节或项目。Studio 会生成所需的旁白,并根据项目轨道和设置创建音频或视频文件。

Export your project

导出后仍可继续编辑。再次选择 导出,即可创建包含更新媒体的版本。

音频项目

音频项目的上下文侧边栏

音频项目的上下文侧边栏

上下文侧边栏会显示所选项目的工具和详细信息。

对于旁白,侧边栏包含 播放控件、类型、模型、音色、覆盖设置和 生成历史记录。AI 工具部分提供以下操作:

  • 优化文本 可优化文本以引导语音表达。
  • 移除背景音频 使用人声分离移除背景音频。
  • 使用变声器 可修改现有音频中的声音。
  • 使用你的声音指导语音 可录制参考音频,通过 Actor Mode 引导语音表达。

对于媒体片段,侧边栏会显示相关片段属性和操作。

时间线和轨道

Studio 时间线编辑

时间线提供整个章节的项目视图,让你一眼查看旁白、音乐和 SFX。

可调整段落或单个句子之间的时间间隔,也可修剪、拆分和复制片段,或在较长章节中缩放和平移。波形可显示各轨道的相对响度。

章节侧边栏

创建新的音频项目后,即可使用章节侧边栏;如果导入文档,系统会自动检测章节。

选择 章节 标签页,可管理现有项目中的章节。

章节侧边栏

选择 + 可添加章节。使用 章节操作 重命名或删除章节。拖动章节可调整顺序。

生成/重新生成

生成

选择 生成 可为所选文本生成音频。生成音频会消耗积分。

更改文本或音色会取消段落的已生成状态。选择 生成 可再次生成。

段落状态(已转换或未转换)由段落左侧的竖条表示。未转换段落显示浅灰色竖条,已转换段落显示深灰色竖条。

按钮显示 重新生成 时,下一次生成不会消耗积分。如果不更改音色或文本,可免费重新生成 2 次。

此操作适用于旁白和其他生成的语音。视频、外部音频、音乐、SFX 和字幕等时间线项目会排列在时间线上,并在导出时渲染。

播放

播放

可使用 ElevenCreative Studio 界面底部播放器中的 播放 按钮,播放已生成的音频;如果段落尚未转换,也可生成音频。生成音频会消耗积分。如果已生成音频,播放 按钮会播放已生成的音频,不会扣除积分。使用 播放 按钮时有 3 种模式。播放至结尾(提前生成片段) 会播放现有音频,或从所选段落开始至当前章节结尾,为尚未生成的段落生成新音频,并提前生成多个片段。播放至结尾(逐个生成) 会播放现有音频,或从所选段落开始至当前章节结尾生成新音频,但每次只生成一个片段。所选内容 仅播放或生成所选段落的音频。存在视频轨道时,播放器也会同步播放头预览视频。播放现有音频或视频不会消耗积分;只有生成旁白才会消耗积分。

生成历史记录

选中段落后,其生成历史记录会显示在上下文侧边栏中。你可以查看该段落之前生成的所有音频,并收听和下载每个生成版本。

生成历史记录

如果更喜欢段落的早期版本,可使用 恢复生成版本 按钮返回所选版本。也可删除生成版本,但请注意:删除后将无法恢复。

生成历史记录 仅适用于旁白生成,不会追踪导入的媒体(外部音频、音乐、SFX)或视频片段。

撤销和重做

撤销 重做

如果误做了更改,可使用 撤销 按钮恢复上一版本,并使用 重做 按钮恢复该更改。

停顿

停顿

可使用 插入停顿 按钮添加停顿。这会插入停顿标签。默认时长为 1 秒,但可调整为最长 3 秒。

如需精确控制时间,建议使用时间线修剪和句子级控制。部分较新的 模型可能会为保持自然流畅而缩短或忽略停顿标签。

停顿只影响生成语音的表达方式,不会移动或暂停其他时间线轨道。请使用时间线在音乐、SFX 和视频之间创建精确停顿。

Actor Mode

Actor Mode

Actor Mode 可让你通过上传录音或直接录制自己的声音,精确指定一段文本的表达方式。你可以高亮要处理的文本选区,也可以选择整个段落。选中要使用 Actor Mode 的文本后,在侧边栏的 AI 工具 部分点击 使用你的声音指导语音,即可看到 Actor Mode 弹窗。

如需了解 Actor Mode 概览,请观看此视频。

Actor Mode 弹窗

上传或录制音频后,可选择回听或删除音频。还会显示使用所提供音频生成所选文本所需的积分数量。

Actor Mode 弹窗

如果音频符合预期,点击 生成,系统将使用该音频指导所选文本的表达方式。

Actor Mode 会复刻所提供音频的所有特征,包括口音。

文件

可为项目上传或录制音频文件。你可以将文件拖放到面板中,点击 上传文件,或使用 录制 按钮直接录制音频。切换 此项目 和 工作区 可浏览文件。上传的音频无法发布到分发平台。

插入音频

音乐

可在 ElevenCreative Studio 中生成音乐,并将其放在单独的时间线轨道上。可根据提示词创建音乐,或导入现有曲目。你可以修剪、复制、移动每个片段并调整音量。立体声源会保持立体声。

插入音乐

音效

插入音效

可将音效作为单独片段添加到时间线。你可以将其放置在任意位置,叠加多个效果,并通过修剪和复制精确调整时间。

可根据文本提示词创建效果,或从 SFX 库 中选择现有效果。

可重新生成预览以探索不同版本,然后将选定效果应用到时间线。删除和复制 SFX 片段的方式与其他时间线片段相同。

ElevenReader 导出或通过 ElevenCreative Studio API 流式传输项目时,不支持音效。

锁定段落

锁定段落按钮

选择 锁定段落 可防止更改段落。

已锁定段落

已锁定段落左侧会显示锁定图标。再次选择 锁定段落 可解锁段落。锁定仅适用于旁白内容;你仍可继续编辑视频、音乐和音效片段。

键盘快捷键

键盘快捷键

选择 项目选项 > 键盘快捷键,查看可用的键盘快捷键。

视频项目

视频项目的上下文侧边栏

新版视频项目编辑器包含 媒体库、脚本 和 字幕 面板。音频项目请参阅音频项目的上下文侧边栏。

媒体库

Studio 视频项目编辑器中的媒体库面板

媒体库 面板存储视频片段、图片和语音,可在时间线上重复使用。使用 项目 和 工作区 标签页在项目资源与工作区共享资源之间切换。可按 来源、状态 或是否存在于 时间线 中筛选资源。

选择 创建 + 可添加内容。

媒体

  • 视频 可生成视频片段。
  • 口型同步 可让虚拟形象与语音片段同步。
  • 图片 可生成静态图片。
  • 语音 可生成旁白片段。
  • SFX 可生成音效。
  • 音乐 可生成音乐轨道。
  • 上传 可从设备导入媒体文件。

元素

  • 文本 可添加文字叠层。

脚本

Studio 视频项目编辑器中的脚本面板

脚本 面板按音频轨道整理旁白:

  • 旁白 会显示每个段落及其分配的音色和模型。选择段落可编辑文本或更改音色。更改后需要重新生成。
  • 发音 会打开 Pronunciations Editor,你可以在其中添加别名或音素规则。

字幕

Studio 视频项目编辑器中的字幕面板

在 字幕 面板中,选择一个音频轨道作为字幕来源。使用两个标签页编辑转录文本和样式:

  • 转录文本 显示带时间戳的字幕文本。选择 编辑 可修正文本或时间。
  • 样式 可配置字体、颜色、大小和位置。更改会显示在视频预览中,并嵌入导出的视频。

视频轨道和旁白

在 媒体库 面板中创建和管理视频片段。可根据提示词生成片段,或选择 上传 添加现有素材。将片段从媒体库拖到时间线即可放置。使用 图片参考、参考视频、起始帧 和 结束帧 为生成提供视觉上下文。

添加视频轨道可将旁白与现有素材或 B-roll 搭配。导入视频文件或添加空白轨道,然后在时间线上将旁白与视频对齐。需要时可启用字幕并选择模板。

宽高比

使用顶部栏中的选择器设置输出宽高比:

  • 16:9 适用于 YouTube 广告和标准宽屏。
  • 9:16 适用于 TikTok、Reels 和 Shorts。
  • 4:5 适用于 LinkedIn 和 Facebook 广告。
  • 1:1 适用于 Instagram 帖子。

所选比例会应用于画布预览和导出的视频。

设置

音色

你可以使用即时语音克隆、专业语音克隆、通过声音库分享的音色,以及通过声音设计创建的合成音色。

音色表现取决于源音频质量、模型和语言。请测试多种音色,确定最适合项目的选择。

如果你不满意某个音色,但满意旁白的演绎方式,可以使用变声器功能更换音色,同时保留旁白。

详细了解音色

音色设置

Studio 音色设置

不同用户会采用适合自己的工作流程。最常见的设置是将稳定性设为约 50,相似度设为接近 75,之后仅做少量调整。当然,具体设置取决于原始音色以及你想要的演绎风格。

需要注意的是,AI 具有非确定性;将滑块设为特定值并不能保证每次都得到相同结果。滑块更像是一个范围,用于决定每次生成之间随机性的幅度。

启用 覆盖设置,即可更改所选文本或段落的音色设置。未启用覆盖时,所做更改会应用于项目中该音色的每一处使用,并需要重新生成。更改设置前,请先解锁所有受影响的已锁定段落。

别名

可通过此设置为音色指定仅在当前项目中生效的别名。例如,如果有声书中的每个角色使用不同音色,可以将角色名称作为别名。

音量

如果生成的音频太轻或太响,可以调整音量。默认值为 0.00,表示音频不会改变。最小值为 -30 dB,最大值为 +5 dB。

速度

速度 设置可加快或减慢生成语音的语速。默认值为 1.0,表示不调整语速。低于 1.0 的值会减慢音色,最低为 0.7。高于 1.0 的值会加快音色,最高为 1.2。极端值可能影响生成语音的质量。

稳定性

稳定性 滑块决定音色的稳定程度以及每次生成之间的随机性。降低此滑块可让音色呈现更丰富的情感范围。这会受到原始音色的显著影响。将滑块设得过低,可能导致演绎过于随机、不自然,并使角色说话过快。相反,设得过高则可能让音色单调、情感有限。

若想获得更生动、更具戏剧性的演绎,建议调低稳定性滑块并生成几次,直到找到满意的效果。

相反,如果想要更严肃的演绎,数值极高时甚至接近单调,建议调高稳定性滑块。由于结果更一致、更稳定,通常无需生成太多样本即可达到预期效果。请多加尝试,找到最适合你的设置!

相似度

相似度 滑块决定 AI 在尝试复现原始音色时应遵循原始音色的程度。如果原始音频质量较差且相似度滑块设得过高,AI 在模仿音色时可能会复现原始录音中存在的伪影或背景噪声。

风格夸张度

部分模型提供 风格夸张度 设置。该设置会尝试增强原始说话者的风格。它会消耗额外计算资源,设为非 0 值时可能增加延迟。需要注意的是,使用此设置可能会让模型略微降低稳定性,因为它会更努力地突出并模仿原始音色的风格。

通常建议始终将此设置保持为 0。

说话者增强

此设置可提高与原始说话者的相似度。不过,使用该设置需要略高的计算负载,从而增加延迟。此设置带来的差异通常较为细微。

发音词典

Studio 发音词典

有时你可能想指定特定词语的发音,例如角色或品牌名称,或指定缩写的读法。发音词典可实现这一功能:你可以上传包含指定词语发音规则的词汇表或词典文件,可使用音标字母(音素标签)或词语替换(别名标签)。

音素标签仅兼容 “Eleven Flash v2” 模型。

当项目中遇到这些词语时,AI 会按指定替换方式发音。在发音词典中查找替换词时,词典会从头到尾检查,并且仅使用第一个替换项。

可在发音编辑器中将现有发音词典关联到项目。你可以从工具栏打开编辑器。在下拉菜单中找到要关联的词典,然后选择 连接。

你可以在发音编辑器中创建条目,从项目创建新的发音词典;也可以在发音编辑器中通过 打开所有发音词典 上传或创建发音词典。然后选择 连接,将发音词典关联到当前项目。

如需了解更多发音词典信息,请参阅我们的提示词最佳实践指南。

导出设置

在 项目设置 下的 导出 标签页中,可为项目添加标题、作者、ISBN 和描述等额外元数据。这些信息会自动添加到下载的音频文件中。你还可以访问项目的历史版本,并启用音量标准化。这些设置适用于音频导出;视频外观由时间线和字幕模板控制。

导出和分享

当你对章节或项目满意后,使用 导出 按钮生成可下载版本。如果章节或项目中的每个段落都已生成音频,导出不会额外消耗积分。如果导出过程中有任何段落需要转换,你会看到导出所需积分的通知。

免费版导出的视频会带有水印。付费方案导出的视频不带水印。

导出选项

对于单章节项目,可将项目导出为 MP3 或 WAV。如果项目包含视频轨道或字幕,也可导出为视频。

如果项目有多个章节,可以选择分别导出每个章节,或导出完整项目。导出完整项目时,可以导出为单个文件,也可以导出为 ZIP 文件,其中包含每个章节的单独文件。纯音频导出还可选择下载为 MP3 或 WAV。

如需导出视频,请先启用字幕并添加视频轨道(或可分享的 TTS 视频)。视频将使用所选字幕模板渲染。

质量设置

导出质量取决于订阅方案。对于新建项目,质量如下:

  • 免费版、Starter 和 Creator:128 kbps MP3,或由 128 kbps 源文件转换的 WAV。
  • Pro、Scale、商业版和企业版:16-bit、44.1 kHz WAV,或 192 kbps MP3(Ultra Lossless)。

如果使用的是较早创建的项目,可能在创建时已设置质量,且无法更改。可在导出菜单中将鼠标悬停在 格式 上,查看项目的质量设置。

下载

导出准备就绪后会自动下载。对于可分享的 TTS 视频,还可以复制链接以便快速分享。

点击 项目选项 按钮并选择 导出记录,即可访问和下载所有章节及项目的历史导出文件。

分享

在编辑器中创建只读链接,其他人无需下载文件即可播放时间线并审核混音。你可以随时撤销访问权限。也支持评论,包括匿名评论。

Studio 分享项目

评论

邀请协作者或受众直接在时间线上留下反馈。评论会根据播放头添加时间戳,让反馈准确显示在相关位置。评论者无需 ElevenLabs 账户,可以填写名称或匿名发布。讨论通过串联回复和可选的协作者提及功能保持井然有序。

要添加评论,请打开共享项目链接(或已启用分享功能的编辑器),将播放头移到合适位置,然后点击 添加评论。输入消息后发布;使用 回复 继续该讨论串。当你发起或参与的讨论串有新评论或回复时,会收到电子邮件通知。

反馈处理完成后,将讨论串标记为 已解决;它会在列表中折叠,并可稍后重新打开。解决讨论串后,会暂停后续通知,直至重新打开。

常见问题

Studio 免费重新生成

在 ElevenCreative Studio 中,只要不更改文本或音色,就可以免费重新生成所选段落或文本部分 2 次。

如果所选段落或文本可免费重新生成,你会看到 重新生成。将鼠标悬停在 重新生成 按钮上时,会显示剩余的免费重新生成次数。

免费重新生成次数用完后,按钮会显示 生成,后续生成将消耗积分。

使用 导出 为整个章节或项目生成音频时,自动重新生成会自动检查输出中的多种问题,包括:

  • 音量失真
  • 音色相似度
  • 发音错误
  • 缺失或多余的词语

如果检测到任何问题,工具会自动重新生成音频,最多 2 次,且不额外收费。

此功能可能增加处理时间,但有助于确保批量转换获得更高质量的输出。

ElevenCreative Studio 是用于创建音频和视频项目的工作区。Studio 4.0 将提示词优先的 workflow 与时间线编辑、生成媒体、分享和评论结合在一起。

ElevenCreative Studio 项目编辑器

音频项目

使用音频项目创建长篇旁白、有声播客和有声书。上传脚本或文档,分配音色,并在时间线上排列旁白、音乐和音效。

音频项目编辑器包括:

  • 用于调整音色、模型、播放和生成设置的上下文边栏。
  • 用于整理长篇内容的章节边栏。
  • 生成历史和段落锁定。
  • 使用录音指导语音演绎的演员模式。
  • MP3 和 WAV 导出选项。

视频项目

使用视频项目组合视频、图片、语音、音乐、音效、文本和字幕。可以从提示词、灵感、上传内容或空白项目开始。

视频项目编辑器包括:

  • 用于存放项目和工作区素材的 素材库。
  • 用于设置旁白和发音规则的 脚本 面板。
  • 用于调整转录文本和样式的 字幕 面板。
  • 用于排列媒体的多轨时间线。
  • 宽屏、竖屏、纵向和方形视频的宽高比。
  • 用于规划和编辑视频项目的 Studio Agent。

分享和导出

分享项目以收集团队成员的评论。选择 导出,将当前章节或项目渲染为音频或视频。

详细说明请参阅 ElevenCreative Studio 指南。

Studio 是面向长篇内容的一站式专业解决方案,所有套餐均可使用,包括免费套餐。

但 创建播客(GenFM)功能除外,该功能需要付费订阅才能使用。

有关所有订阅套餐的更多信息,请查看定价页面。

章节 侧边栏适用于音频项目。导入包含章节的文档时,Studio 会自动检测章节。

选择 章节 标签页以打开侧边栏。

Studio 音频项目中的章节侧边栏

选择 + 添加章节。使用 章节操作 重命名或删除章节。拖动章节可调整顺序。

在 Studio 中,最多可免费重新生成 2 次,前提是未更改要重新生成的文本、未分配其他音色,也未更改音色设置。

要重新生成整个段落,请点击该段落;或者选中要重新生成的一个或多个词语。为获得最佳效果,建议重新生成完整短语或句子。

如果所选内容符合免费重新生成条件,工具栏中的“生成/重新生成”按钮会显示 重新生成。将鼠标悬停在按钮上,即可看到剩余免费重新生成次数的提示。

Studio 中的生成和重新生成控件

如果所选内容不符合免费重新生成条件,按钮会显示 生成,并会收取生成费用。

在 Studio 首页创建新视频项目。输入提示词、选择灵感,或依次选择 + 新建空白项目 > 视频项目(新)。

使用 素材库 面板添加视频和旁白配音:

1选择 创建 +。
2选择 上传 添加现有视频,或选择 视频 生成视频。
3选择 语音 生成旁白配音。
4将视频和语音片段从素材库拖到时间轴上。
5调整时间轴上的片段,使旁白配音与视频对齐。
Studio 视频项目中的素材库面板

使用 脚本 面板编辑旁白,或更改其音色和模型。更改文本或音色后需要重新生成。

要添加字幕,请打开 字幕 面板,并选择旁白配音轨道作为字幕来源。根据需要编辑转录文本和字幕样式。

选择 导出 渲染并下载完成的视频。

通常大多数人不会达到这些限制,但仍有一些限制需要注意。

  • 每个项目最多 500 个章节
  • 每个章节最多 400 个段落
  • 每个段落最多 5000 个字符

此外,每个订阅套餐对可拥有的项目总数设有上限。如果在降级或取消套餐前超出此限制,仍可访问现有项目。但在项目总数降至当前套餐限额以内前,无法创建新项目。

各套餐项目限额:

  • 免费版:5 个项目
  • 入门版:20 个项目
  • 创作者版:1,000 个项目
  • 专业版:3,000 个项目
  • Scale:20,000 个项目
  • 商业版:20,000 个项目

你可以在 Studio 中为单个段落分配多个音色。只需选中要分配给各音色的文本,然后在屏幕左侧“音色”侧边栏的音色选择下拉菜单中更改音色即可。

每个音色都会在段落左侧显示不同颜色的图标,对应文本也会以相应颜色高亮显示。

在 Studio 中,你可以重新生成整个选中段落;如果选中一个或多个词语,也可以只重新生成这些词语。为获得最佳效果,建议每次重新生成完整短语或句子。

必须先为整个段落生成音频,才会看到重新生成所选内容的选项。

更改特定章节或段落的音色

只需高亮要更改音色的章节、句子或段落,然后在左侧 编辑语音 侧边栏的音色选择下拉菜单中,选择适合角色或旁白的音色。更改音色后,需要生成新的音频。

完成后,段落左侧的音色圆点会改变,文本也会以相同颜色高亮显示,让你轻松查看每个句子使用的音色。要通过快捷键快速显示所有音色及其在每个段落中的彩色圆点,请按 Cmd+Opt+A 或 Ctrl+Alt+A

还可以调整稳定性、相似度、说话人增强等音色设置,以强化和自定义输出效果。你可以使用 覆盖设置 仅更改所选文本或段落的设置,或者使用 编辑语音 侧边栏中的 音色设置 按钮调整所有段落的设置。

更改所有段落的音色

如果想更改当前与某个特定音色关联的所有段落的音色,可以在要更改音色的 音色设置 中操作。在 音色设置 中,你会看到 在项目中替换音色 按钮。

点击后会看到 替换音色 弹窗,其中会显示进行此更改后需要重新生成的段落数量。

在 替换为 下拉菜单中选择新音色,然后点击 替换并清除受影响的音频 确认更改。

音色将更新,你需要为所有受影响的段落生成新的音频。

将有声书导出到 InAudio 前,需要先在 Studio 中创建有声书,包括选择要使用的音色、编排内容,并检查音频以确保效果符合预期。

项目完成后,即可导出并发行。

按以下步骤将 Studio 项目导出到 InAudio:

1

打开 Studio 项目,前往 导出 > 发布 > InAudio。

2

系统会显示一个说明流程的弹窗。点击 继续 即可继续。

3

在 音频预览 页面,选择要用于免费 音频预览的章节(将使用该章节的前 5 分钟)。请注意,无法在此弹窗中试听预览,但可以更换所用章节。

4

调整将在有声书制作人员名单中显示的旁白配音者名称。默认情况下,音色会标记为“数字音色”,后接所用音色的名称。

5

设置完成后,点击 导出,以 LPF 格式生成有声书。

6登录 InAudio,或创建账户。
7

在 InAudio 中选择 开始新项目。

8上传 LPF 文件,并按平台步骤发行有声书。

请注意,如果项目包含即时语音克隆,必须先验证该音色才能导出。出现提示时,点击 验证,然后前往 音色 > 我的音色,选择该音色并点击 点击验证。验证完成后,即可继续导出流程。

所有使用数字旁白配音的作品都会在元数据中明确标注,书籍简介也会告知听众该作品使用数字音色旁白配音制作。

通过 InAudio,你可以将有声书发行至 Barnes and Noble、Rakuten、Everand、Scribd 等众多平台。

将有声书导出到 Spotify 前,需要先在 Studio 中创建有声书,包括选择要使用的音色、编排内容,并检查音频以确保效果符合预期。

项目完成后,即可导出并发行。

按以下步骤将 Studio 项目导出到 Spotify:

1

打开 Studio 项目,前往 导出 > 发布 > Spotify。

2

系统会显示一个说明流程的弹窗。点击 继续 即可继续。

3

在 音频预览 页面,选择要用于免费 音频预览的章节(将使用该章节的前 5 分钟)。请注意,无法在此弹窗中试听预览,但可以更换所用章节。

4

调整将在有声书制作人员名单中显示的旁白配音者名称。默认情况下,音色会标记为“数字音色”,后接所用音色的名称。

5

设置完成后,点击 导出,以 MP3 格式生成有声书。

6登录 Spotify for Authors,或创建账户。
7

在 Spotify for Authors 中选择 新建有声书。

8上传 MP3 文件,并按平台步骤发行有声书。

请注意,如果项目包含即时语音克隆,必须先验证该音色才能导出。出现提示时,点击 验证,然后前往 音色 > 我的音色,选择该音色并点击 点击验证。验证完成后,即可继续导出流程。

所有使用数字旁白配音的作品都会在 Spotify 的元数据中明确标注。有声书简介开头将添加以下说明:“此有声书由数字音色旁白配音。”

有时可能需要指定某些词的发音,例如角色名或品牌名,或指定应如何读出首字母缩略词。可以使用 发音编辑器,通过音标字母表(音素标签)或词语替换(别名标签)添加指定词语的发音规则。

音素标签仅兼容 Eleven Flash v2。

这些规则会保存到一个与项目关联的发音词典中。项目中遇到这些词时,AI 会按指定的替换内容读出该词。

点击 打开发音编辑器 按钮,即可直接在 Studio 中添加别名和音素。

如果在选中某个词时进行此操作,该词会自动填入输入框。否则,可以自行输入该词。你可以使用输出中的播放按钮预览发音效果。

Studio 中的发音词典

添加新规则时,可以选择将规则添加到现有词典,或创建新词典。如果将规则添加到现有词典,系统会自动将其关联到项目。

在 Studio 中,段落左侧的灰线表示音频生成状态。浅灰线表示尚未生成音频,深灰线表示已成功生成音频。

下图中,高亮段落已生成音频,第二个段落则尚未生成。

在深色模式下,此配色会略有调整:浅灰线仍表示未生成音频,白线表示该段落已转换为音频。

下图展示了这一点:高亮段落已生成音频,第二个段落尚未生成。

在 Studio 中,满意某个段落后可以将其锁定,防止意外更改。已锁定的段落左侧会显示锁定图标。 

锁定按钮会锁定所选段落的当前版本。这意味着你无法再重新生成该段落、修改音色或设置,也无法访问该段落的生成历史。随时点击锁定按钮即可解锁段落。

Studio 中的段落锁定控件

只有为所选段落生成音频后,才能使用此功能。

所有订阅套餐(包括免费版)均包含 Studio。即使降级订阅,仍可继续使用 Studio。

但取消订阅后将失去部分付费功能,包括使用即时语音克隆和专业语音克隆生成音频,以及访问声音库中的部分音色(包括自定义费率音色)。

此外,可创建的新项目数量将受当前套餐限制。如果在降级前超出项目上限,仍可访问现有项目,但在项目数量回到允许范围前无法创建新项目。

各套餐的项目上限:
  • 免费版:5 个项目
  • Starter:20 个项目
  • Creator:1,000 个项目
  • Pro:3,000 个项目
  • Scale:20,000 个项目
  • 商业版:20,000 个项目

请注意,截至本文撰写时,我们不会删除数据。日后如再次升级,所有内容都将保持完整且可访问。

自动重新生成是 Studio 的一项功能,会自动检查生成的音频是否存在发音错误或不需要的音频瑕疵。如检测到问题,将免费自动重新生成音频,最多 2 次。  

此功能默认启用。当你通过导出对话框一步转换整个章节或项目时,系统会在后端执行此操作。

借助生成历史,你可以试听、下载和恢复每个段落之前生成的音频。  

Studio 中的生成历史

选择段落后,其生成历史会显示在左侧边栏中。你可以查看和试听所选段落此前生成的所有版本。 

如果更喜欢较早的生成版本,可点击 恢复之前的生成版本 将其恢复。该音频随后会显示为项目中该段落的当前版本。你可以使用锁定按钮锁定段落,防止进一步更改。 

每个生成版本都可以下载单独的音频文件。要下载,请点击 更多操作(三个点)> 下载。 

也可以删除生成版本,但请注意,删除后无法恢复。要删除生成版本,请点击 更多操作(三个点)> 删除。 

时间线是 Studio 项目中音频的可视化呈现,显示为界面底部的水平轨道。所有 Studio 项目默认启用时间线。

Studio 中的时间线和轨道

时间线能让你更清晰地查看和控制内容结构。输入文本时会自动显示片段,还可以通过拖放重新排列,调整音频流程。

点击时间线右上角的 展开/收起 按钮调整视图:

使用 放大 和 缩小 按钮,更改时间线的可见范围:

EPUB 是创建项目的最佳文件格式。如果 EPUB 结构清晰、格式正确,Studio 会自动将每个章节拆分为独立章节,方便浏览。

要让 Studio 识别 EPUB 中的章节,请确保每个章节标题均设置为“标题 1”格式。

其他支持的文件格式:

  • PDF
  • DOCX
  • TXT
  • HTML
  • URL

详情请参阅完整概览。

修改项目后,需要导出章节或项目的新版本。更新后的音频会保存到新版本,并反映在下载文件中。点击 导出,然后选择所需选项。

如果选择导出整个项目,Studio 会自动转换项目所有章节中尚未转换的段落,这会消耗点数。如有此情况,确认导出前会提示所需点数。

Studio 中的项目导出控件

如果所有段落均已生成音频,则无需付费,但仍需导出为新版本,下载文件才会显示更新。转换完成且下载文件准备就绪后,会收到通知。

点击 导出 按钮,然后选择 历史记录 标签页,即可访问和下载之前导出的版本。

请尝试使用其他浏览器,并关闭广告拦截器和弹窗拦截器。

在某些情况下,部分用户可能会遇到项目下载问题,似乎通常与浏览器有关。大多数遇到问题的用户使用名为 Brave 的浏览器,但也有用户在其他浏览器中遇到问题。大多数情况下,切换或尝试使用其他浏览器下载文件即可解决问题。还建议关闭所有广告拦截器或弹窗拦截器。

如果无法从 Studio 下载,请确认使用了正确的流程,因为 Studio 下载音频的方式与语音合成不同。

要创建并下载章节或项目的新版本,需要使用 导出 按钮。可以选择导出当前章节或整个项目的新版本。如果自上次导出后进行了更改,系统会确认创建新导出版本所需的点数。仅会对尚未转换的段落,或自上次导出后编辑过、因此需要重新转换的段落收取点数。

还可以访问所有之前导出的版本。点击 导出 按钮,然后选择 历史记录 标签页。

No results