ダビングv2 API
ダビングv2がAPIで利用可能になりました。各話者の声、トーン、話すペースを維持したまま、オーディオとビデオを90以上の言語に翻訳します。
新しいプロジェクトベースのAPIでは、元の文字起こしと翻訳を編集可能なJSONとして保持します。ファイルまたはURLからプロジェクトを作成し、1つ以上の対象言語を追加して、個々の文字起こしセグメントまたは翻訳を編集した後、変更された領域のみを再生成します。最初の吹き替えを作成するには、ダビングクイックスタートをご覧ください。
ElevenAgents
- 会話ガードレールフィルター:会話を一覧表示に、任意の
guardrail_types(GuardrailType[])およびcustom_guardrail_names(文字列配列)クエリパラメーターが追加されました。既存の会話階層は、任意のparent_conversation_id(文字列)でフィルタリングできるようになりました。 - ブランチ差分ステータス:エージェントブランチを一覧表示に、任意の
include_commit_status(ブール値、デフォルトはfalse)が追加されました。有効にすると、ブランチの概要にnull許容のcommits_ahead、commits_behind、merged_into_branch_idフィールドが含まれます。 - 会話とツールの制御:クライアントオーバーライドで
max_duration_secondsとpronunciation_dictionary_locatorsをサポートしました。MCPサーバー設定には、ツール呼び出しにMCPの_meta値を渡すためのrequest_metaが追加され、Webhookツールのタイムアウトは最大300秒まで対応しました。 - 通話後分析の使用量:会話の課金に、機能ごとの累積合計と実行スナップショットを含む
analysisの内訳が追加されました。文字起こしメッセージにはtriggered_guardrailsが、会話ターンには任意のproducing_llmが追加されました。
音声
- 音声検索フィルター:すべての音声v2を取得に、任意の
gender、age、language、accent、use_cases、min_notice_period_days、include_custom_rates、include_live_moderated、high_qualityクエリパラメーターが追加されました。
SDKリリース
JavaScript SDK
- v2.63.0 - 第2言語、言語・エンティティ検出、バックグラウンドオーディオフィルタリング、ロギング、使い捨てトークン認証に対応するリアルタイムのスピーチtoテキストオプションを追加しました。最終文字起こし、エンティティ、無効なリクエストのイベントを追加し、未承認の利用規約ディスパッチ、重複した
audio_formatパラメーター、包括的なVAD境界を修正しました。 - v2.62.0 - ダビングの一括文字起こし更新メソッドと
DubbingRegenerateResponseを追加し、会話ガードレールフィルター、エージェントブランチのコミットステータス、エージェントアラート、MCPのrequestMetaサポートを追加しました。言語ターゲットの作成ではmodelIdを受け付けなくなりました。 - v2.61.0 - 会話階層フィルタリング、通話後分析の課金、トリガーされたガードレールメタデータ、ブランチマージ競合の詳細、DTMF入力のマスキング、ダビング文字起こしのアップロードを追加しました。エクスポートされていたOpenAIリアルタイムセッション型と
run_subagent_*ツール結果バリアントを削除しました。
Python SDK
- v2.63.0 - 第2言語、言語・エンティティ検出、バックグラウンドオーディオフィルタリング、ロギング、使い捨てトークン認証に対応するリアルタイムのスピーチtoテキストオプションを追加しました。最終文字起こし、エンティティ、無効なリクエストのイベントを追加し、未承認の利用規約ディスパッチを修正するとともに、APIキーまたはトークンなしの接続を拒否するようになりました。
- v2.62.0 - ダビングの
update_segmentsメソッドとDubbingRegenerateResponseを追加し、guardrail_types、custom_guardrail_names、include_commit_status、MCPのrequest_metaサポートを追加しました。ダビングセグメントの更新でリクエストボディモデルを使用するようになり、言語ターゲットの作成ではmodel_idを受け付けなくなりました。 - v2.61.0 -
parent_conversation_id、分析課金、トリガーされたガードレールメタデータ、ブランチマージ競合、DTMF入力のマスキング、ダビング文字起こしのアップロードを追加しました。OpenAIリアルタイムセッション型とrun_subagent_*結果モデルを削除しました。
Android SDK
- v0.12.1 - 意図的なテキスト専用セッションの切断が
ConversationStatus.ERRORとして報告される問題を修正しました。 - v0.12.0 - 会話オーディオをAndroidメディアストリーム経由でルーティングする
ConversationConfig.useMediaStreamを追加しました。リモート側による通常のWebSocketクローズはDisconnectionDetails.Agentとして、ローカルで開始されたクローズはDisconnectionDetails.Userとして報告されるようになりました。
MCPサーバー
- v0.12.2 - パストラバーサルの問題を修正しました。
API
APIの変更を表示
新しいエンドポイント
ダビング
- 元セグメントを一括更新 -
PATCH /v1/dubbing/project/{project_id}/transcript/segmentsDubbingBulkSegmentUpdateRequestが必要です- 元セグメントのテキスト、話者、タイミングをアトミックに更新します
- 更新済みの
segmentsとrevisionを含むDubbingBulkSourceSegmentUpdateResponseを返します
- ターゲットセグメントを一括更新 -
PATCH /v1/dubbing/project/{project_id}/language/{language_id}/transcript/segmentsDubbingBulkTargetSegmentUpdateRequestが必要です- 複数のターゲットセグメントの翻訳をアトミックに更新します
- 更新済みの
segmentsとrevisionを含むDubbingBulkTargetSegmentUpdateResponseを返します
更新されたエンドポイント
ElevenAgents
- 会話を一覧表示 -
GET /v1/convai/conversations- 任意の
parent_conversation_id(文字列)を追加 - 任意で繰り返し指定可能な
guardrail_types(GuardrailType[])およびcustom_guardrail_names(文字列配列)を追加
- 任意の
- エージェントブランチを一覧表示 -
GET /v1/convai/agents/{agent_id}/branches- 任意の
include_commit_status(ブール値、デフォルトはfalse)を追加 - ブランチの概要にnull許容の
commits_ahead(整数)、commits_behind(整数)、merged_into_branch_id(文字列)を追加
- 任意の
音声
- すべての音声v2を取得 -
GET /v2/voices- 任意の
gender、age、accent(文字列)フィルターを追加 - 任意の
languageおよびuse_cases(文字列配列)フィルターを追加 - 任意の
min_notice_period_days(整数)、include_custom_rates、include_live_moderated、high_quality(ブール値)フィルターを追加
- 任意の
スキーマの変更
ElevenAgents
- クライアントオーバーライドスキーマに
max_duration_seconds(整数)とpronunciation_dictionary_locators(配列)を追加 - MCPサーバーの入力・出力スキーマに
request_metaマップを追加 - エージェントプラットフォーム設定に
alertingを追加し、言語検出にonly_at_conversation_start(ブール値)を追加 AnalysisCharging.last_runが必須かつnull非許容になり、累積合計に必須のruns(整数)を追加- RAGチャンクレスポンスで
content_formatとdocument_typeが必須に