ElevenCreative Studio
使用 Studio 创建视频和音频项目。

概览
ElevenCreative Studio 4.0 使用提示词优先的工作流程创建视频和音频项目。描述想创建的项目,Studio Agent 会生成初稿。
视频项目使用包含可复用素材的 素材库,其中包括生成的视频片段、图片和语音。在多轨时间线上排列这些素材。使用 素材库、脚本 和 字幕 面板管理素材,并控制旁白、音乐和音效。
与团队共享项目,以收集评论和反馈。
ElevenCreative Studio 支持我们最新的语音模型,包括 Eleven v4。你可随时在 项目设置 中切换模型。
指南
起始选项
创建项目时,Studio 会选择部分设置。
大多数新项目默认使用 Eleven Multilingual v2。你可在 项目设置 中选择其他模型,包括 Eleven v3。
Studio 会根据订阅套餐选择质量设置。质量设置不影响积分用量。
- 免费版、入门版和创作者版:128 kbps MP3,或从 128 kbps 源生成的 WAV。
- 专业版、扩展版、商业版和企业版:16-bit、44.1 kHz WAV,或 192 kbps MP3(Ultra Lossless)。
免费版导出的视频包含水印。付费套餐导出的视频不含水印。
快速开始
在 Studio 页面顶部,使用 你想创建什么? 提示词栏描述项目。Studio Agent 会根据描述创建初稿。你也可以上传现有媒体,或创建空白项目。
上传
上传
选择 上传,从现有媒体开始。文本和音频文件会在音频布局中打开。视频文件会在视频布局中打开,并可使用字幕。
新建空白项目
从头开始创建项目
选择 + 新建空白项目,打开项目类型选择器:
- 视频项目(新) 会打开新版视频编辑器,其中包含 素材库、脚本、字幕 面板和 Studio Agent。
- 音频项目 会创建空白音频项目,适用于长篇旁白、播客和有声书。
- 视频项目 会打开 Studio 的旧版视频编辑器。
开始使用
灵感 部分包含示例项目。选择一张卡片,将其作为新项目的起点。选择 查看所有灵感,按类别搜索完整素材库。
可用灵感
随着灵感库更新,可用类别可能会变化。
Studio Agent

概览
Studio Agent 是直接内置于 ElevenCreative Studio 视频项目中的 AI 协作编辑助手。
Studio Agent 聊天会根据 token 用量消耗积分。媒体生成会消耗额外积分。
描述你想创建的内容、上传文件,或从过去生成的内容中选择素材。Studio Agent 会在时间线上创建初稿前,询问视频时长、基调、结构和转场。它会添加片段、旁白、音色、音效和字幕。你可随时编辑时间线,然后继续与 Studio Agent 协作。
主要功能
分析片段
Studio Agent 会构建视频的逐帧地图,以识别画面中发生的内容。例如,输入“徽标出现时添加呼啸声”,即可在该位置添加音频。
聊天内素材发现
无需打开声音库或音效目录,即可在聊天中搜索、预览和放置音色模型及音效。
模型选择和确认
Studio Agent 会根据请求从 5 个图像模型和 5 个视频模型中选择。确认生成时,你可以改选其他模型。
规划和创建模式
使用编辑器顶部的开关,在两种模式之间切换:
创建模式 允许 Studio Agent 编辑时间线、插入片段、生成媒体、应用文字叠加层和调整音频。
规划模式 允许 Studio Agent 在不更改时间线的情况下概述其方案。使用此模式审查建议的更改。
在规划模式下,Studio Agent 可以:
- 分析素材并转录语音。
- 搜索素材和音色模型。
- 起草脚本和场景计划。
- 规划时间线编辑并计算空隙管理。
- 提供 TikTok、YouTube 和 Instagram 使用建议。
手动控制
你可随时编辑时间线,然后继续与 Studio Agent 协作。
限制和文件处理
文件大小
Studio Agent 不设额外的文件大小限制。
可用性
Studio Agent 可在网页应用中使用,无法通过 API 使用。
定价
Studio Agent 对所有套餐开放。聊天会根据 5 类 token 消耗积分:输入、输出、思考、缓存读取 和 缓存写入。费用取决于各类别的 token 消耗量。
语音、图片、音乐、音效和视频生成均按这些功能的标准费率计费。商业使用权由订阅套餐决定,与其他 ElevenLabs 产品一致。
标准订阅套餐使用积分。企业版套餐可能采用法定货币计费。详情请联系企业销售团队。
如需升级套餐,请访问订阅页面。
生成和编辑
选择 导出,渲染当前章节或项目。Studio 会生成所需的旁白,并根据项目轨道和设置创建音频或视频文件。

导出后仍可继续编辑。再次选择 导出,即可创建包含更新媒体的版本。
音频项目
音频项目的上下文侧边栏
音频项目的上下文侧边栏

上下文侧边栏会显示所选项目的工具和详细信息。
对于旁白,侧边栏包含 播放控件、类型、模型、音色、覆盖设置和 生成历史记录。AI 工具部分提供以下操作:
- 优化文本 可优化文本以引导语音表达。
- 移除背景音频 使用人声分离移除背景音频。
- 使用变声器 可修改现有音频中的声音。
- 使用你的声音指导语音 可录制参考音频,通过 Actor Mode 引导语音表达。
对于媒体片段,侧边栏会显示相关片段属性和操作。
时间线和轨道
时间线和轨道

时间线提供整个章节的项目视图,让你一眼查看旁白、音乐和 SFX。
可调整段落或单个句子之间的时间间隔,也可修剪、拆分和复制片段,或在较长章节中缩放和平移。波形可显示各轨道的相对响度。
章节侧边栏
章节侧边栏
创建新的音频项目后,即可使用章节侧边栏;如果导入文档,系统会自动检测章节。
选择 章节 标签页,可管理现有项目中的章节。

选择 + 可添加章节。使用 章节操作 重命名或删除章节。拖动章节可调整顺序。
生成/重新生成
生成/重新生成

选择 生成 可为所选文本生成音频。生成音频会消耗积分。
更改文本或音色会取消段落的已生成状态。选择 生成 可再次生成。
段落状态(已转换或未转换)由段落左侧的竖条表示。未转换段落显示浅灰色竖条,已转换段落显示深灰色竖条。
按钮显示 重新生成 时,下一次生成不会消耗积分。如果不更改音色或文本,可免费重新生成 2 次。
此操作适用于旁白和其他生成的语音。视频、外部音频、音乐、SFX 和字幕等时间线项目会排列在时间线上,并在导出时渲染。
播放
播放

可使用 ElevenCreative Studio 界面底部播放器中的 播放 按钮,播放已生成的音频;如果段落尚未转换,也可生成音频。生成音频会消耗积分。如果已生成音频,播放 按钮会播放已生成的音频,不会扣除积分。使用 播放 按钮时有 3 种模式。播放至结尾(提前生成片段) 会播放现有音频,或从所选段落开始至当前章节结尾,为尚未生成的段落生成新音频,并提前生成多个片段。播放至结尾(逐个生成) 会播放现有音频,或从所选段落开始至当前章节结尾生成新音频,但每次只生成一个片段。所选内容 仅播放或生成所选段落的音频。存在视频轨道时,播放器也会同步播放头预览视频。播放现有音频或视频不会消耗积分;只有生成旁白才会消耗积分。
生成历史记录
生成历史记录
选中段落后,其生成历史记录会显示在上下文侧边栏中。你可以查看该段落之前生成的所有音频,并收听和下载每个生成版本。

如果更喜欢段落的早期版本,可使用 恢复生成版本 按钮返回所选版本。也可删除生成版本,但请注意:删除后将无法恢复。
生成历史记录 仅适用于旁白生成,不会追踪导入的媒体(外部音频、音乐、SFX)或视频片段。
撤销和重做
撤销和重做

如果误做了更改,可使用 撤销 按钮恢复上一版本,并使用 重做 按钮恢复该更改。
停顿
停顿

可使用 插入停顿 按钮添加停顿。这会插入停顿标签。默认时长为 1 秒,但可调整为最长 3 秒。
如需精确控制时间,建议使用时间线修剪和句子级控制。部分较新的 模型可能会为保持自然流畅而缩短或忽略停顿标签。
停顿只影响生成语音的表达方式,不会移动或暂停其他时间线轨道。请使用时间线在音乐、SFX 和视频之间创建精确停顿。
Actor Mode
Actor Mode

Actor Mode 可让你通过上传录音或直接录制自己的声音,精确指定一段文本的表达方式。你可以高亮要处理的文本选区,也可以选择整个段落。选中要使用 Actor Mode 的文本后,在侧边栏的 AI 工具 部分点击 使用你的声音指导语音,即可看到 Actor Mode 弹窗。
如需了解 Actor Mode 概览,请观看此视频。

上传或录制音频后,可选择回听或删除音频。还会显示使用所提供音频生成所选文本所需的积分数量。

如果音频符合预期,点击 生成,系统将使用该音频指导所选文本的表达方式。
文件
文件
可为项目上传或录制音频文件。你可以将文件拖放到面板中,点击 上传文件,或使用 录制 按钮直接录制音频。切换 此项目 和 工作区 可浏览文件。上传的音频无法发布到分发平台。

音乐
音乐
可在 ElevenCreative Studio 中生成音乐,并将其放在单独的时间线轨道上。可根据提示词创建音乐,或导入现有曲目。你可以修剪、复制、移动每个片段并调整音量。立体声源会保持立体声。

音效
音效

可将音效作为单独片段添加到时间线。你可以将其放置在任意位置,叠加多个效果,并通过修剪和复制精确调整时间。
可根据文本提示词创建效果,或从 SFX 库 中选择现有效果。
可重新生成预览以探索不同版本,然后将选定效果应用到时间线。删除和复制 SFX 片段的方式与其他时间线片段相同。
ElevenReader 导出或通过 ElevenCreative Studio API 流式传输项目时,不支持音效。
锁定段落
锁定段落

选择 锁定段落 可防止更改段落。

已锁定段落左侧会显示锁定图标。再次选择 锁定段落 可解锁段落。锁定仅适用于旁白内容;你仍可继续编辑视频、音乐和音效片段。
键盘快捷键
键盘快捷键

选择 项目选项 > 键盘快捷键,查看可用的键盘快捷键。
视频项目
视频项目的上下文侧边栏
视频项目的上下文侧边栏
新版视频项目编辑器包含 媒体库、脚本 和 字幕 面板。音频项目请参阅音频项目的上下文侧边栏。
媒体库
媒体库

媒体库 面板存储视频片段、图片和语音,可在时间线上重复使用。使用 项目 和 工作区 标签页在项目资源与工作区共享资源之间切换。可按 来源、状态 或是否存在于 时间线 中筛选资源。
选择 创建 + 可添加内容。
媒体
- 视频 可生成视频片段。
- 口型同步 可让虚拟形象与语音片段同步。
- 图片 可生成静态图片。
- 语音 可生成旁白片段。
- SFX 可生成音效。
- 音乐 可生成音乐轨道。
- 上传 可从设备导入媒体文件。
元素
- 文本 可添加文字叠层。
脚本
脚本

脚本 面板按音频轨道整理旁白:
- 旁白 会显示每个段落及其分配的音色和模型。选择段落可编辑文本或更改音色。更改后需要重新生成。
- 发音 会打开 Pronunciations Editor,你可以在其中添加别名或音素规则。
字幕
字幕

在 字幕 面板中,选择一个音频轨道作为字幕来源。使用两个标签页编辑转录文本和样式:
- 转录文本 显示带时间戳的字幕文本。选择 编辑 可修正文本或时间。
- 样式 可配置字体、颜色、大小和位置。更改会显示在视频预览中,并嵌入导出的视频。
视频轨道和旁白
视频轨道和旁白
在 媒体库 面板中创建和管理视频片段。可根据提示词生成片段,或选择 上传 添加现有素材。将片段从媒体库拖到时间线即可放置。使用 图片参考、参考视频、起始帧 和 结束帧 为生成提供视觉上下文。
添加视频轨道可将旁白与现有素材或 B-roll 搭配。导入视频文件或添加空白轨道,然后在时间线上将旁白与视频对齐。需要时可启用字幕并选择模板。
视频项目的宽高比
宽高比
使用顶部栏中的选择器设置输出宽高比:
- 16:9 适用于 YouTube 广告和标准宽屏。
- 9:16 适用于 TikTok、Reels 和 Shorts。
- 4:5 适用于 LinkedIn 和 Facebook 广告。
- 1:1 适用于 Instagram 帖子。
所选比例会应用于画布预览和导出的视频。
设置
音色
音色
你可以使用即时语音克隆、专业语音克隆、通过声音库分享的音色,以及通过声音设计创建的合成音色。
音色表现取决于源音频质量、模型和语言。请测试多种音色,确定最适合项目的选择。
如果你不满意某个音色,但满意旁白的演绎方式,可以使用变声器功能更换音色,同时保留旁白。
音色设置
音色设置

不同用户会采用适合自己的工作流程。最常见的设置是将稳定性设为约 50,相似度设为接近 75,之后仅做少量调整。当然,具体设置取决于原始音色以及你想要的演绎风格。
需要注意的是,AI 具有非确定性;将滑块设为特定值并不能保证每次都得到相同结果。滑块更像是一个范围,用于决定每次生成之间随机性的幅度。
启用 覆盖设置,即可更改所选文本或段落的音色设置。未启用覆盖时,所做更改会应用于项目中该音色的每一处使用,并需要重新生成。更改设置前,请先解锁所有受影响的已锁定段落。
别名
可通过此设置为音色指定仅在当前项目中生效的别名。例如,如果有声书中的每个角色使用不同音色,可以将角色名称作为别名。
音量
如果生成的音频太轻或太响,可以调整音量。默认值为 0.00,表示音频不会改变。最小值为 -30 dB,最大值为 +5 dB。
速度
速度 设置可加快或减慢生成语音的语速。默认值为 1.0,表示不调整语速。低于 1.0 的值会减慢音色,最低为 0.7。高于 1.0 的值会加快音色,最高为 1.2。极端值可能影响生成语音的质量。
稳定性
稳定性 滑块决定音色的稳定程度以及每次生成之间的随机性。降低此滑块可让音色呈现更丰富的情感范围。这会受到原始音色的显著影响。将滑块设得过低,可能导致演绎过于随机、不自然,并使角色说话过快。相反,设得过高则可能让音色单调、情感有限。
若想获得更生动、更具戏剧性的演绎,建议调低稳定性滑块并生成几次,直到找到满意的效果。
相反,如果想要更严肃的演绎,数值极高时甚至接近单调,建议调高稳定性滑块。由于结果更一致、更稳定,通常无需生成太多样本即可达到预期效果。请多加尝试,找到最适合你的设置!
相似度
相似度 滑块决定 AI 在尝试复现原始音色时应遵循原始音色的程度。如果原始音频质量较差且相似度滑块设得过高,AI 在模仿音色时可能会复现原始录音中存在的伪影或背景噪声。
风格夸张度
部分模型提供 风格夸张度 设置。该设置会尝试增强原始说话者的风格。它会消耗额外计算资源,设为非 0 值时可能增加延迟。需要注意的是,使用此设置可能会让模型略微降低稳定性,因为它会更努力地突出并模仿原始音色的风格。
通常建议始终将此设置保持为 0。
说话者增强
此设置可提高与原始说话者的相似度。不过,使用该设置需要略高的计算负载,从而增加延迟。此设置带来的差异通常较为细微。
发音词典
发音词典

有时你可能想指定特定词语的发音,例如角色或品牌名称,或指定缩写的读法。发音词典可实现这一功能:你可以上传包含指定词语发音规则的词汇表或词典文件,可使用音标字母(音素标签)或词语替换(别名标签)。
音素标签仅兼容 “Eleven Flash v2” 模型。
当项目中遇到这些词语时,AI 会按指定替换方式发音。在发音词典中查找替换词时,词典会从头到尾检查,并且仅使用第一个替换项。
可在发音编辑器中将现有发音词典关联到项目。你可以从工具栏打开编辑器。在下拉菜单中找到要关联的词典,然后选择 连接。
你可以在发音编辑器中创建条目,从项目创建新的发音词典;也可以在发音编辑器中通过 打开所有发音词典 上传或创建发音词典。然后选择 连接,将发音词典关联到当前项目。
如需了解更多发音词典信息,请参阅我们的提示词最佳实践指南。
导出设置
导出设置
在 项目设置 下的 导出 标签页中,可为项目添加标题、作者、ISBN 和描述等额外元数据。这些信息会自动添加到下载的音频文件中。你还可以访问项目的历史版本,并启用音量标准化。这些设置适用于音频导出;视频外观由时间线和字幕模板控制。
导出和分享
当你对章节或项目满意后,使用 导出 按钮生成可下载版本。如果章节或项目中的每个段落都已生成音频,导出不会额外消耗积分。如果导出过程中有任何段落需要转换,你会看到导出所需积分的通知。
免费版导出的视频会带有水印。付费方案导出的视频不带水印。
导出选项
导出选项
对于单章节项目,可将项目导出为 MP3 或 WAV。如果项目包含视频轨道或字幕,也可导出为视频。
如果项目有多个章节,可以选择分别导出每个章节,或导出完整项目。导出完整项目时,可以导出为单个文件,也可以导出为 ZIP 文件,其中包含每个章节的单独文件。纯音频导出还可选择下载为 MP3 或 WAV。
如需导出视频,请先启用字幕并添加视频轨道(或可分享的 TTS 视频)。视频将使用所选字幕模板渲染。
质量设置
质量设置
导出质量取决于订阅方案。对于新建项目,质量如下:
- 免费版、Starter 和 Creator:128 kbps MP3,或由 128 kbps 源文件转换的 WAV。
- Pro、Scale、商业版和企业版:16-bit、44.1 kHz WAV,或 192 kbps MP3(Ultra Lossless)。
如果使用的是较早创建的项目,可能在创建时已设置质量,且无法更改。可在导出菜单中将鼠标悬停在 格式 上,查看项目的质量设置。
下载
下载
导出准备就绪后会自动下载。对于可分享的 TTS 视频,还可以复制链接以便快速分享。
点击 项目选项 按钮并选择 导出记录,即可访问和下载所有章节及项目的历史导出文件。
分享
分享
在编辑器中创建只读链接,其他人无需下载文件即可播放时间线并审核混音。你可以随时撤销访问权限。也支持评论,包括匿名评论。

评论
评论
邀请协作者或受众直接在时间线上留下反馈。评论会根据播放头添加时间戳,让反馈准确显示在相关位置。评论者无需 ElevenLabs 账户,可以填写名称或匿名发布。讨论通过串联回复和可选的协作者提及功能保持井然有序。
要添加评论,请打开共享项目链接(或已启用分享功能的编辑器),将播放头移到合适位置,然后点击 添加评论。输入消息后发布;使用 回复 继续该讨论串。当你发起或参与的讨论串有新评论或回复时,会收到电子邮件通知。
反馈处理完成后,将讨论串标记为 已解决;它会在列表中折叠,并可稍后重新打开。解决讨论串后,会暂停后续通知,直至重新打开。









