Eleven v4を発表これまでで最も感情豊かなモデル、Eleven v4をご紹介します。 10月12日まで、Creator+には3倍のクレジットが含まれます

コンテンツへ移動

テキスト読み上げAPI - 世界中で最大40%高速化

執筆者
Joe Reeve
公開日

聴くこの記事を聴く

マルチリージョン配信をテキスト読み上げAPIに導入しました。コードを変更しなくても、リクエストは最寄りのバックエンド(米国、オランダ、シンガポール)へ自動的にルーティングされ、最初のバイトが返るまでの時間(TTFB)が短縮されます。

変更点

api.elevenlabs.ioを呼び出すと、インフラストラクチャが所在地に応じて最適なバックエンドへルーティングします:

  • 南北アメリカ: 米国中部
  • ヨーロッパ、中東、アフリカ: オランダ
  • アジア太平洋: シンガポール

APIレスポンスのx-regionヘッダーで、配信リージョンを確認できます。

パフォーマンス

GPUのアップグレードと推論スタックの最適化により、Flash v2.5はモデルの最初のバイト生成まで50msを実現しました。さらにネットワークルーティングの改善により、体感レイテンシーを大幅に削減しています。

世界11拠点で測定したTTFBの改善:

TTFB短縮
ヨーロッパ
約100~150ms
東南アジア
約150~200ms
インド
約100~150ms
日本
約50~80ms
オーストラリア
約80~120ms

海外のデベロッパーの多くにとって、これは体感レイテンシーを20~40%削減できることを意味します。

重要な理由

音声エージェントやリアルタイムアプリケーションでは、レイテンシーが150ms短縮されることで、より自然な会話、優れた応答性、地域を問わない一貫したユーザー体験を実現できます。Flash v2.5の推論速度と組み合わせることで、最速のエージェント型テキスト読み上げを提供します。

始める

移行は不要です。api.elevenlabs.ioを呼び出している場合、グローバルルーティングはすでに有効です。

グローバルルーティングを無効にして常に米国のサーバーを使用するには、APIリクエストのベースURLにapi.us.elevenlabs.ioを使用してください。

その他のベストプラクティスについては、レイテンシー最適化ガイドをご覧ください。リージョンごとのデータ所在地要件があるエンタープライズのお客様は、営業にお問い合わせください。


関連記事

最高品質のAIオーディオで創造する