推出 Eleven v4认识 Eleven v4:迄今情感表现最丰富的模型。 Creator+ 套餐含 3 倍点数优惠,截止至 10 月 12 日

跳至内容

迄今表现力最强的模型

认识 Eleven v4
和 v4 Turbo

创建可控、富有表现力的语音,融入情感、音频事件和沉浸式声景。

Eleven v4

最富情感表现力的语音模型

Eleven v4 基于全新架构打造,像配音演员一样理解脚本。它知道谁在说话、刚刚发生了什么,以及每句台词应如何呈现。

丰富的情感与音效

支持超过 90 种语言,以出色的情感表现生成语音,并内置多说话人和音效,为场景增添氛围。

第 1 个演示,共 4 个

基于全新架构打造

在脚本中直接添加指令

直接在脚本中加入 [laughs]、[whispers] 和 [door slams] 等指令。Eleven v4 对标签序列的遵循比 v3 更可靠,包括音效。

无缝衔接长篇音频

上下文拼接让任意长度脚本的节奏和表达保持稳定。整本有声书从第一页到最后一页,都像一次连续录制。

反复生成,音色依然稳定

一句话重做 1 次或 50 次,依然是同一个人在说话。无论对话、旁白还是其他内容,说话人特征都保持稳定。

使用专业语音克隆

v3 不支持专业语音克隆。Eleven v4 重新支持该功能,并能在所有支持的语言中展现模型完整的情感范围。

Eleven v4 Turbo

介绍 Eleven v4 Turbo专为实时应用和智能体打造

速度最快的实时语音模型,兼具 Eleven v4 的丰富表现力,可通过 API 和 ElevenAgents 使用。Eleven v4 Turbo 的中位推理延迟约为 100 ms,首句语音时间约为 150 ms,并能在长时间交互中保持一致。

来电者几乎察觉不到的响应速度

首句语音中位响应时间仅 150 ms,延迟几乎消失,对话自然流畅。

Eleven v4 Turbo
150ms101234567891501234567895001234567890ms
Cartesia Sonic 3.6
262ms201234567892601234567896201234567892ms
OpenAI GPT-4o mini TTS
814ms801234567898101234567891401234567894ms
首句语音中位响应时间

在真实通话中试听

与由 Eleven v4 Turbo 驱动的智能体通话,了解更多信息。

专为实时对话优化

文本流入,音频流出

LLM 生成文本时即可持续推送,句子尚未完成便开始返回音频。双向流式传输,专为智能体循环打造。

对话速度下的丰富表达

Turbo 具备 Eleven v4 完整的表现力。确认、升级处理和等待提示各有不同表达,不会千篇一律。

每一轮对话保持同一声音

专业语音克隆在两种模型中的表现完全一致,让同一品牌声音从通话第一轮到最后一轮始终如一。

像母语者一样说话

输入日语、西班牙语或葡萄牙语文本,声音便能以地道口音流畅朗读。

从超过 17,500 种声音中挑选

叙述声音 为讲故事的人而设。温暖、有权威感,在每个项目中都保持一致。

对话声音 日常对话需要自然、轻松的声音。我们的对话声音专为听起来自然即兴的对话和播客打造。

社交媒体声音 让短内容鲜活起来的声音。捕捉让用户从头看到尾所需的能量与个性,适合 TikTok 或 Reels。

角色声音 为虚构世界准备的丰富声音。选择充满活力的角色阵容,让游戏、有声书或动画栩栩如生。

教育声音 值得信赖、耐心的声音,帮助学生理解复杂主题。特别适合各类课程、教程、培训模拟和指南。

广告声音 精致且自信的声音,助力下一次产品销售。适合数字广告、电视和广播配音。

娱乐声音 从震撼的电影预告片到为表演而生的喜剧声音,个性十足。适合表达方式和内容同样重要的作品。

多语言声音 为全球内容打造的声音。自然的节奏、地道表达和贴近各地受众的口音。

我们通过确定性控制扩大了 Agentforce Voice 的应用。客户持续反馈,他们信赖它,是因为智能体的每项行动都有依据、受到治理,而不是即兴发挥。这项策略的关键,是在确定性与高品质、高情商语音模型之间取得平衡。Eleven v4 Turbo 正是在这里提高了标准:响应更快、更自然,达到客户期待的水平,让他们能将 Agentforce Voice 用于更多场景。

Ryan Peterson, Salesforce Agentforce Voice 产品高级副总裁

我们与数百家出版商合作,将新闻内容转为音频,深知语音质量有多重要。与 ElevenLabs 合作以来,许多出版商的互动率和收听时长均有提升。Eleven v4 为出版商提供更多方式,确保这些声音既引人入胜、又令人熟悉,并拥有鲜明的自身特色。

Patrick O'Flaherty, BeyondWords 联合创始人

ElevenLabs v4 为语音对话带来全新的自然感。声音不仅更具表现力,也更易于控制,让我们能够打造更丰富、更沉浸的语音体验。

Chrys Bader, Rosebud 联合创始人兼 CEO

我第一次使用它(Eleven v4)时,它干净又逼真,感觉就像在录音棚里与配音演员一起工作。

Kyle Gudmundson, Accenture Accelerate 音乐与音频负责人

我们一直在寻找一款既足够快速、能带来真实对话感,又不牺牲质量的语音模型。Eleven v4 Turbo 是首个同时做到这两点的模型。对于自动化销售 workflow 而言,这标志着开发不再像是一场实验。

Oscar Daniels, Spring Financial 信用建设产品负责人

决定声音风格在开口之前

每次生成都从声音开始。克隆已有声音、根据描述设计新声音,或借助 IPA 修正特定词语的读法。

Smiling person in an orange pleated garment and patterned scarf.
Glowing orange sphere with bright curved streaks against a textured orange background.

语音克隆

用 10 秒音频克隆声音,或训练专业语音克隆,实现近乎完美的匹配。

“一位接近 30 岁的女性,声音明亮自然,带美式口音。语气友好、俏皮且放松。”

声音设计

用一句话描述声音即可生成,无需录音或选角。

OAuthoh-auth
Hülkenberghool-ken-berg
Reykjavikrayk-yah-veek
YAMLyam-ul

发音词典

定义姓名、缩写和技术术语的发音。设置一次音标,之后每次生成都会使用。

免费开始创作需要更多时再升级

  • 开始使用

    $0/月

    免费开始

    免费套餐包含:

    • 每月 10,000 积分
    • 个人使用
    • 无需信用卡
  • 高级套餐

    $6/月

    查看套餐

    付费套餐包含:

    • 每月超过 30,000 积分
    • 专业语音克隆
    • 更高限额和更快生成速度
  • 企业版

    定制价格

    联系我们

    企业版套餐包含:

    • 更高用量
    • 自定义 SSO
    • 优先支持

可通过 API 使用将 Eleven v4 集成到应用

通过 ElevenAPI 使用 Eleven v4 Turbo,构建实时体验和语音智能体。

访问 Eleven v4 和 Eleven v4 Turbo API

通过 REST API、流式端点或 TypeScript 和 Python SDK,为任何产品添加富有表现力的语音。

  • 通过一个 model_id 切换模型
  • 实时流式输入文本并接收音频
  • 在长篇内容生成中保持连贯性
import { ElevenLabsClient, play } from '@elevenlabs/elevenlabs-js';
import 'dotenv/config';

const elevenlabs = new ElevenLabsClient({
  apiKey: process.env.ELEVENLABS_API_KEY
});
const audio = await elevenlabs.textToSpeech.convert(
  's3TPKV1kjDlVtZbl4Ksh', // "George" - browse voices at elevenlabs.io/app/voice-library
  {
    text: 'The first move is what sets everything in motion.',
    modelId: 'eleven_v4',
  }
);
play(audio);

常见问题

用高质量 AI 音频创作