
播客转 TXT
上传访谈、单人节目或圆桌讨论,快速获得带说话人标签的转录文本,方便制作节目笔记、字幕和社交媒体短片。
上传访谈、单人节目或圆桌讨论,快速获得带说话人标签的转录文本,方便制作节目笔记、字幕和社交媒体短片。

访谈.pdf
4.7 星
超 5 万条评价
超 100 万用户
信赖 ElevenLabs
90+
语言
上传播客节目,剩下的交给 AI。获得准确、带说话人标注的文本,可随时编辑、发布或分享。
可从设备或云端上传导出的节目或原始录音。超过 8 分钟的文件可并行处理,完整节目也能快速返回。
Scribe 会自动标注主持人和每位嘉宾。可重命名说话人、修正听错的赞助商内容,并直接在转录文本中标记最佳引用。
下载 DOCX 用于节目笔记草稿,HTML 或 TXT 用于节目页面,SRT 或 VTT 用于社交短片字幕。
ElevenLabs 可自动识别嘉宾和主持人,依次标注时间,并添加笑声、掌声等音频事件标签,生成结构化、可直接发布的转录文本。
Scribe 提供行业最低的词错误率,提取的引用内容能真实还原嘉宾发言。
点击任意一句,可去除口头语、修正姓名、将错分配的句子调整到正确说话人,转录文本发布前即可完成所有编辑。


Scribe 可自动识别语音语言,支持转录 90 多种语言,无需额外设置,国际嘉宾和多语种节目都能轻松发布。
支持上传 MP3、WAV、M4A、FLAC、OGG 音频,或视频 MP4,导出格式包括 TXT、DOCX、PDF、JSON、SRT、VTT、HTML。
音频事件标签会保留在转录文本中,让读者也能感受到录音现场的精彩瞬间。
Scribe 最多可识别 32 个音色,并标注词级时间戳,圆桌节目内容清晰易读,还能精确定位每个话题的开始时间。

播客转 TXT

播客转 DOCX

播客转 PDF

播客转 JSON

播客转 HTML

播客转 SRT

播客转 AVID

播客转 VTT
“我主要用 ElevenLabs 转录音频消息,准确率非常突出。即使说话人是刚学会阅读的小学生,也能精准分析朗读流利度,这对了解学生进步很关键。”

Pedro A.
技术负责人
“非常适合转录访谈,准备演讲时语音质量也很棒。”

Izabela M.
客户体验研究员
“ElevenLabs Scribe v2 模型推理速度极快,转录几乎实时,比我们用过的其他模型都快很多。”

Vedaswaroop I.
创始人
支持上传 MP3、WAV、M4A、AAC、FLAC、OGG 音频,以及 MP4、MOV、AVI、MKV 视频播客。文件可直接上传,无需转换,超过 8 分钟的节目可并行处理,90 分钟圆桌讨论也能快速返回,无需实时等待。
ElevenLabs Scribe 模型在 90 多种语言中都具备高准确率,即使有噪音、音乐插曲或多语种播客,转录内容依然精准。每期节目都带有说话人标签、词级时间戳和音频事件标签,内置编辑器可在发布前修正嘉宾姓名或专业术语。提取的引用内容与嘉宾实际发言一致。
先在编辑器中打开转录文本,点击任意一句即可修正听错的词、嘉宾姓名或调整句子归属。之后可去除口头语、精简赞助商内容、标记节目笔记引用,导出时所有编辑都与音频时间戳同步。
单份转录文本可导出为 TXT、DOCX、PDF、JSON、SRT、VTT 或 HTML。播客主通常在节目页面发布 HTML 或 TXT 版本用于 SEO,用 DOCX 起草节目笔记,SRT 或 VTT 文件作为 YouTube 及社交短片字幕。
Scribe 支持转录 90 多种语言,并可自动检测语音语言,无论是印地语、葡萄牙语还是日语节目都无需更改设置。多语种节目同样适用,嘉宾中途切换语言时,转录内容也能准确跟随并标注说话人。
