テキストtoボイス

  • ボイスデザイン:テキスト説明からカスタム音声を作成するため、Eleven v3対応の新しいテキストtoボイスデザインをリリースしました。

スピーチtoテキスト

  • 話者分離の強化:スピーチtoテキストエンドポイントにdiarization_thresholdパラメータを追加しました。しきい値を0.1から0.4の間で調整することで、話者精度と話者総数のバランスを微調整できます。

プロフェッショナルボイスクローン

  • バックグラウンドノイズ除去:オーディオ分離モデルを使用して音声サンプルをクリーンアップするremove_background_noiseを追加し、より高品質なトレーニングデータを実現しました。

ElevenCreative Studio

ワークスペース

  • サービスアカウントグループ:権限管理とアクセス制御を向上させるため、サービスアカウントをワークスペースグループに追加できるようになりました。

  • ワークスペース認証:ワークスペース認証接続をサポートし、外部サービスとの安全なWebhookツールインテグレーションを可能にしました。

SDK

  • Python SDK:最新APIのサポートとバグ修正を含むv2.6.0をリリースしました。
  • JavaScript SDK:最新APIのサポートとバグ修正を含むv2.5.0をリリースしました。
  • React Agents Platform SDK:0.2.0でWebRTCサポートを追加しました。

API

新しいエンドポイント

更新されたエンドポイント

スピーチtoテキスト

音声管理