文本转语音 API - 全球速度最高提升 40%
- 发布时间
收听收听本文
我们已为 文本转语音 API 推出多区域服务。请求现会自动路由至最近的后端(美国、荷兰或新加坡),无需修改代码即可缩短首字节时间(TTFB)。
更新内容
调用 api.elevenlabs.io 时,基础设施会根据所在位置路由至最佳后端:
- 美洲: 美国中部
- 欧洲、中东、非洲: 荷兰
- 亚太地区: 新加坡
可通过 API 响应中的 x-region 标头确认服务区域。
性能
借助升级后的 GPU 和优化的推理栈,Flash v2.5 的模型首字节时间达到 50ms;再结合网络路由优化,感知延迟大幅降低。
全球 11 个地点测得的 TTFB 改善:
TTFB 缩短幅度
欧洲
约 100-150ms
东南亚
约 150-200ms
印度
约 100-150ms
日本
约 50-80ms
澳大利亚
约 80-120ms
地区
TTFB 缩短幅度
欧洲
约 100-150ms
东南亚
约 150-200ms
印度
约 100-150ms
日本
约 50-80ms
澳大利亚
约 80-120ms
对大多数国际开发者而言,感知延迟可降低 20-40%。
重要性
对于 语音智能体 和实时应用,延迟减少 150ms 意味着对话更自然、响应更迅速,并且无论用户身处何地,都能获得一致体验。结合 Flash v2.5 的推理速度,这是目前最快的智能体 文本转语音 服务。
开始使用
无需迁移。只要调用 api.elevenlabs.io,全球路由便已启用。
如需退出全球路由并始终使用美国服务器,请在 API 请求中使用 api.us.elevenlabs.io 作为基础 URL。
更多最佳实践请参阅我们的 延迟优化指南。需要区域数据驻留的企业版客户可 联系销售团队。



