推出 Eleven v4认识 Eleven v4:迄今情感表现最丰富的模型。 Creator+ 套餐含 3 倍点数优惠,截止至 10 月 12 日

跳至内容

文本转语音 API - 全球速度最高提升 40%

作者
Joe Reeve
发布时间

收听收听本文

我们已为 文本转语音 API 推出多区域服务。请求现会自动路由至最近的后端(美国、荷兰或新加坡),无需修改代码即可缩短首字节时间(TTFB)。

更新内容

调用 api.elevenlabs.io 时,基础设施会根据所在位置路由至最佳后端:

  • 美洲: 美国中部
  • 欧洲、中东、非洲: 荷兰
  • 亚太地区: 新加坡

可通过 API 响应中的 x-region 标头确认服务区域。

性能

借助升级后的 GPU 和优化的推理栈,Flash v2.5 的模型首字节时间达到 50ms;再结合网络路由优化,感知延迟大幅降低。

全球 11 个地点测得的 TTFB 改善:

TTFB 缩短幅度
欧洲
约 100-150ms
东南亚
约 150-200ms
印度
约 100-150ms
日本
约 50-80ms
澳大利亚
约 80-120ms

对大多数国际开发者而言,感知延迟可降低 20-40%。

重要性

对于 语音智能体 和实时应用,延迟减少 150ms 意味着对话更自然、响应更迅速,并且无论用户身处何地,都能获得一致体验。结合 Flash v2.5 的推理速度,这是目前最快的智能体 文本转语音 服务。

开始使用

无需迁移。只要调用 api.elevenlabs.io,全球路由便已启用。

如需退出全球路由并始终使用美国服务器,请在 API 请求中使用 api.us.elevenlabs.io 作为基础 URL。

更多最佳实践请参阅我们的 延迟优化指南。需要区域数据驻留的企业版客户可 联系销售团队。


相关内容

用高质量 AI 音频创作