テキストtoボイス
- ボイスデザイン:テキスト説明からカスタム音声を作成するため、Eleven v3対応の新しいテキストtoボイスデザインをリリースしました。
スピーチtoテキスト
- 話者分離の強化:スピーチtoテキストエンドポイントに
diarization_thresholdパラメータを追加しました。しきい値を0.1から0.4の間で調整することで、話者精度と話者総数のバランスを微調整できます。
プロフェッショナルボイスクローン
- バックグラウンドノイズ除去:オーディオ分離モデルを使用して音声サンプルをクリーンアップする
remove_background_noiseを追加し、より高品質なトレーニングデータを実現しました。
ElevenCreative Studio
- ビデオサポートの検出:チャプターにビデオコンテンツが含まれるかを示す
has_videoプロパティをチャプター応答に追加しました。
ワークスペース
-
サービスアカウントグループ:権限管理とアクセス制御を向上させるため、サービスアカウントをワークスペースグループに追加できるようになりました。
-
ワークスペース認証:ワークスペース認証接続をサポートし、外部サービスとの安全なWebhookツールインテグレーションを可能にしました。
SDK
- Python SDK:最新APIのサポートとバグ修正を含むv2.6.0をリリースしました。
- JavaScript SDK:最新APIのサポートとバグ修正を含むv2.5.0をリリースしました。
- React Agents Platform SDK:0.2.0でWebRTCサポートを追加しました。
API
APIの変更を表示
新しいエンドポイント
- 新たに2つのエンドポイントを追加しました:
- 音声をデザイン - テキスト説明から音声プレビューを作成
- プレビューから音声を作成 - 音声プレビューを永続的な音声に変換
更新されたエンドポイント
スピーチtoテキスト
- 音声をテキストに変換 - 話者分離を微調整する
diarization_thresholdパラメータを追加
音声管理
- 音声サンプルオーディオを取得 -
remove_background_noiseクエリパラメータを追加し、リクエスト本文からクエリパラメータに移動