For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
LogoLogo
Connect
BlogHelp CenterAPI PricingSign up
概要ElevenCreativeElevenAgentsElevenAPIReception.aiAPIリファレンスChangelogヘルプセンター
ログイン
概要ElevenCreativeElevenAgentsElevenAPIReception.aiAPIリファレンスChangelogヘルプセンター
Connect
BlogHelp CenterAPI PricingSign up
このページ内
  • 2026年9月23日
  • 画像&ビデオ
  • 2026年9月21日
  • ElevenAgents
  • 画像とビデオ
  • Speech Engine
  • テキスト読み上げ
  • SDKリリース
  • API
  • 新しいエンドポイント
  • 更新されたエンドポイント
  • スキーマの変更
  • 2026年9月14日
  • ElevenAgents
  • 音楽
  • SDKリリース
  • API
  • 新しいエンドポイント
  • 更新されたエンドポイント
  • スキーマの変更
  • 2026年9月11日
  • Scribe v2 Medical
  • 2026年9月7日
  • ElevenAgents
  • ワークスペース
  • SDKリリース
  • API
  • 新しいエンドポイント
  • 更新されたエンドポイント
  • スキーマの変更
  • 2026年8月31日
  • ElevenAgents
  • 音楽
  • 吹き替え
  • SDKリリース
  • API
  • 更新されたエンドポイント
  • スキーマの変更
  • 2026年8月24日
  • ElevenLabs CLI
  • プロシージャ
  • ElevenAgents
  • SDKリリース
  • API
  • 新しいエンドポイント
  • 更新されたエンドポイント
  • スキーマの変更
  • 2026年8月22日
  • MCPサーバー
  • 2026年8月17日
  • ElevenCreative
  • ElevenAgents
  • SDKリリース
  • API
  • 新しいエンドポイント
  • 更新されたエンドポイント
  • スキーマの変更
  • 2026年8月10日
  • ダビングv2 API
  • ElevenAgents
  • 音声
  • SDKリリース
  • API
  • 新しいエンドポイント
  • 更新されたエンドポイント
  • スキーマの変更

Changelog

September 23, 2026
September 23, 2026

September 21, 2026
September 21, 2026

September 14, 2026
September 14, 2026

September 11, 2026
September 11, 2026

September 7, 2026
September 7, 2026

August 31, 2026
August 31, 2026

August 24, 2026
August 24, 2026

August 22, 2026
August 22, 2026

August 17, 2026
August 17, 2026

August 10, 2026
August 10, 2026
過去の投稿
次へ
で構築済み
ログイン

画像&ビデオ

  • Sora 2およびSora 2 Proの提供終了:OpenAIは2026年9月24日にSora APIを終了します。両モデルは画像&ビデオのモデル選択画面から削除され、この日をもって生成を停止します。既存の生成結果は履歴で引き続き利用できます。Soraノードを使用するFlowsおよびテンプレートは、再度実行する前に、Gemini Omni 1.1 Flashなどの別のビデオモデルへ切り替える必要があります。
  • Seedance 1.5 Proの非推奨化:ByteDanceは2026年11月11日にSeedance 1.5 Proを終了します。このモデルは新規生成ではすでに提供されておらず、この日をもって動作しなくなります。代わりにSeedance 2.0モデルを使用してください。

ElevenAgents

  • 並列ツール呼び出し:エージェントのプロンプト設定にenable_parallel_tool_calls(ブール値、デフォルトtrue)が含まれるようになりました。有効にすると、対応モデルは1ターンで複数のツールを実行できます。
  • エージェントモデル:エージェントLLMの選択肢にgpt-6-astraを追加しました。
  • アラート:エージェントのアラート機能で、PagerDutyおよびwebhook通知に加えてSlackチャンネルをサポートするようになりました。
  • 電話番号検索:プロバイダー、発信サポート、割り当て済みエージェントとブランチ、ラベル、電話番号でフィルタリングできる、カーソルページネーション対応の電話番号エンドポイントを追加しました。

画像とビデオ

  • GPT Image 2.5モデル:画像生成でgpt-image-2.5-flareとgpt-image-2.5-sunburstをサポートするようになりました。どちらのモデルも最大10枚の参照画像、maxまでの品質レベル、autoを含む14種類の固定アスペクト比、1K、2K、4K出力に対応します。

Speech Engine

  • カスケードタイムアウト:Speech Engineの作成・更新リクエストでcascade_timeout_seconds(数値、2~15、デフォルト4)を受け付けるようになりました。これにより、再試行前にElevenLabsがアップストリームSpeech Engineを待機する時間を制御できます。

テキスト読み上げ

  • マルチコンテキストのターン境界:is_final_audio_for_turnマーカーが、そのターンのバッファリングされたすべてのバイトの後に、MP3およびOpus出力を含めて送信されるようになりました。クライアントはPCMに切り替えることなく、このマーカーを正確なターン境界として使用できます。

SDKリリース

JavaScript SDK

  • v2.69.0 - リアルタイムのスピーチtoテキストラッパーにtranscriptEditを追加し、編集済みテキストがedited_transcriptイベントで配信されるようになりました。データレジデンシーサフィックスを持つAPIキーのSpeech Engine JWT検証を修正しました。テンプレートの一覧取得・取得、実行の一覧取得・作成・取得を行うphoneNumbers.listV2およびFlowsテンプレートメソッドを追加しました。GPT Image 2.5、Slackエージェントアラート、並列ツール呼び出し、gpt-6-astra、サービスアカウントAPIキーの同時実行数制限、Musicゼロ保持、会話フィルター、MCPツール承認ステータス向けのクライアントと型を再生成しました。

Python SDK

  • v2.69.0 - リアルタイムのスピーチtoテキストラッパーにtranscript_editを追加し、編集済みテキストがedited_transcriptイベントで配信されるようになりました。データレジデンシーサフィックスを持つAPIキーのSpeech Engine JWT検証を修正し、ffplayが失敗した場合にplayがエラーを発生させるようにしました。テンプレートの一覧取得・取得、実行の一覧取得・作成・取得を行うphone_numbers.list_v2およびFlowsテンプレートメソッドを追加しました。GPT Image 2.5、Slackエージェントアラート、並列ツール呼び出し、gpt-6-astra、サービスアカウントAPIキーの同時実行数制限、Musicゼロ保持、会話フィルター、MCPツール承認ステータス向けのクライアントと型を再生成しました。

ElevenLabs CLI

  • v1.3.2 - CLIの利用に関するフィードバックを収集するため、オプションの--intentメタデータを追加しました。CLIがサポートしていないワークフローを報告するためのelevenlabs feedback missing-capabilityを追加しました。

API

APIの変更を表示

新しいエンドポイント

ElevenAgents

  • 電話番号ページを一覧表示 - GET /v1/convai/v2/phone-numbers
    • オプションのpage_size(整数、1~1,000、デフォルト100)およびcursor(null許容文字列)ページネーションパラメータを追加しました。
    • オプションのsearch、label、phone_number、provider、supports_outbound、agent_id、branch_id、sort_by、sort_directionフィルターを追加しました。sort_byはlabelまたはphone_numberを受け付けます。sort_directionのデフォルトはascです。
    • レスポンスには必須のphone_numbers(配列)、オプションでnull許容のnext_cursor(文字列)、has_more(ブール値、デフォルトfalse)が含まれます。

更新されたエンドポイント

ElevenAgents

  • エージェントを作成、エージェントを取得、エージェントを更新
    • プロンプト設定にenable_parallel_tool_calls(ブール値、デフォルトtrue)を追加しました。ワークフローのオーバーライドはnull許容のブール値を受け付けます。
    • LLM列挙型に、会話開始時のオーバーライドを含むgpt-6-astraを追加しました。
    • アラートインテグレーションの通知先で、integration_typeを使用してpagerdutyまたはslackを選択するようになりました。Slack通知先にはconnection_idとchannel_id(文字列)が必須です。channel_idは1~64文字を受け付けます。
  • 会話を一覧表示と会話参照を解決
    • data_collection_paramsではmissing演算子を受け付けなくなりました。フィールドが収集されなかった会話に一致させるには、空の値を使用してください。
    • dynamic_variable_paramsの空の値は、変数が設定されていない会話に一致します。
  • Speech Engineを作成、Speech Engineを取得、Speech Engineを更新
    • cascade_timeout_seconds(数値、2~15)を追加しました。作成リクエストのデフォルトは4で、更新リクエストではnull許容の値を受け付け、レスポンスではこのフィールドが必須です。

画像とビデオ

  • 画像生成を作成 - POST /v1/flows/image
    • gpt-image-2.5-flareおよびgpt-image-2.5-sunburst向けのリクエストバリアントを追加しました。
    • どちらのバリアントもpromptとmodel_idが必須で、最大10件のimagesを受け付け、resolution(1K、2K、4K、デフォルト1K)を追加します。
    • qualityはlow、medium、high、xhigh、maxを受け付け、デフォルトはhighです。aspect_ratioはautoと14種類の固定比率を受け付け、デフォルトは16:9です。

吹き替え

  • 吹き替えプロジェクトを作成 - POST /v1/dubbing/project
    • multipartのkeytermsは、繰り返しフィールドまたは単一のJSON配列を受け付けます。
    • multipartのwebhook_idsは、繰り返しフィールド、単一のJSON配列、またはカンマ区切り文字列を受け付けます。
  • ワークスペースリソースを取得、ワークスペースリソースを共有、ワークスペースリソースの共有を解除
    • WorkspaceResourceTypeにdubbing_projectを追加しました。

ナレッジベース

  • クロールジョブを作成 - POST /v1/convai/knowledge-base/crawl
    • max_depth(整数、デフォルト3)を非推奨にしました。このフィールドは現在何も実行せず、最小値・最大値の制約もなくなりました。
    • クロールジョブのメタデータでmax_depthが必須ではなくなりました。

ユーザー

  • ユーザーを取得とサブスクリプションを取得
    • 通貨列挙型にgbpを追加しました。

スキーマの変更

テキスト読み上げ

  • マルチコンテキストWebSocketのaudioおよびfinalメッセージでは、ターンのバッファリングされたすべてのバイトが配信された後にis_final_audio_for_turnが発生するよう定義されました。

ElevenAgents

  • 通話キューイングと保留音声:同時実行数の上限に達したエージェント向けに、通話キューイングを追加しました。キューに入った発信者には保留音声が流れ、接続が許可されるかタイムアウトするまでqueue_statusイベントを受け取ります。新しいAPIメソッドでカスタム保留音声をアップロードまたは削除できます。
  • テストバージョンのメタデータ:エージェントのテスト結果で、実行対象となったエージェントバージョンと、下書きの変更が含まれていたかどうかを確認できるようになりました。呼び出しサマリーでは、部分的な再送信が異なるバージョンに対して実行された場合も表示されます。
  • モデルとアカウントのメタデータ:エージェントのLLM設定でgemini-3.8-flashを受け付けるようになりました。WhatsAppアカウントのレスポンスでは、アカウントがCloud APIを使用しているか、共存サインアップフローを使用しているかを確認できます。

音楽

  • Music v2.5 APIのサポート:音楽エンドポイントとSDKでmusic_v2_5を受け付けるようになりました。構成プラン生成チャンクでは最大6,132文字、1行200文字で最大30行までサポートします。

SDKリリース

JavaScript SDK

  • v2.68.0 - エージェントの保留音声をアップロードおよび削除するメソッドを追加しました。通話キューイング、プロシージャ参照、下書きブランチ作成、RAGクエリ制限、テストバージョンのメタデータ、gemini-3.8-flash、music_v2_5の型を再生成しました。

Python SDK

  • v2.68.0 - エージェントの保留音声をアップロードおよび削除する同期・非同期メソッドを追加しました。通話キューイング、プロシージャ、下書きブランチ作成、RAGクエリ制限、テストバージョンのメタデータ、gemini-3.8-flash、music_v2_5のクライアントと型を再生成しました。compose_detailedラッパーは、生成されたすべての音楽モデルIDと、プロンプトベースおよびチャンクベースの両方の構成プランを受け付けるようになりました。

iOS SDK

  • v3.3.1 - エージェントメッセージをevent_idではなくresponse_idで照合するようになり、ツール呼び出し前後の複数レスポンスを保持し、ストリーミングされた部分や修正が誤ったメッセージに紐づくのを防ぎます。

ElevenLabs CLI

  • v1.3.0 - 生成されたAPIコマンドにオプションの--intentメタデータを追加しました。CLIがサポートしていないワークフローを報告するためのelevenlabs feedback missing-capabilityを追加しました。

パッケージ

  • @elevenlabs/convai-widget-core@0.18.2 と @elevenlabs/convai-widget-embed@0.18.2 - ツールおよびプロシージャ呼び出し後にエージェントの返信が重複する問題を修正しました。ストリーミングされたテキスト返信でMarkdown形式が維持され、音声会話で未発話のストリーミングチャット部分が表示されなくなりました。embedパッケージでは、user_activityイベントを1秒に1回までに制限し、セッション終了時にその制限を解除します。

API

APIの変更を表示

新しいエンドポイント

ElevenAgents

  • エージェント保留音声をアップロード - POST /v1/convai/agents/{agent_id}/hold-audio
    • 必須のhold_audio_file(バイナリ)をmultipartフォームデータとして受け付けます。ファイルはMP3またはWAV形式で、最大40MB、180秒までです。
    • 必須のagent_id(文字列)とhold_audio(AgentHoldAudioConfig)を返します。保留音声オブジェクトにはaudio_path、audio_url、original_filename(文字列)、duration_secs(数値)、size_bytes(整数)が必須です。
  • エージェント保留音声を削除 - DELETE /v1/convai/agents/{agent_id}/hold-audio
    • カスタムクリップを削除し、キューに入った発信者にはデフォルトの保留音が流れるようにします。
    • 必須のagent_id(文字列)を返します。

更新されたエンドポイント

ElevenAgents

  • エージェントを作成、エージェントを取得、エージェントを更新
    • enabled(ブール値、デフォルトfalse)とwait_timeout_seconds(整数、1~1,800、デフォルト180)を持つ、オプションのplatform_settings.queueing_config(AgentQueueingConfig)を追加しました。
    • キュー設定のレスポンスには、読み取り専用でnull許容のhold_audio(AgentHoldAudioConfig)が含まれます。エージェントレスポンスにはオプションのdefault_hold_audio_url(文字列)も含まれます。
  • 会話を取得 - GET /v1/convai/conversations/{conversation_id}
    • メタデータにオプションでnull許容のqueue_wait_secs(数値)を追加しました。キュー時間はcall_duration_secsおよび課金時間に含まれません。
  • エージェントブランチを作成 - POST /v1/convai/agents/{agent_id}/branches
    • オプションのinclude_draft(ブール値、デフォルトfalse)を追加しました。trueの場合、ブランチ先端から作成されたブランチには、呼び出し元の下書きプロシージャセットが含まれます。
  • プロシージャを一覧表示と、プロシージャの作成、取得、下書きエンドポイント
    • 一覧項目にオプションのreferenced_tool_ids、referenced_kb_ids、referenced_procedure_ids、referenced_dynamic_variables(文字列配列)を追加しました。
    • エージェントおよびマージプレビューレスポンスに、プロシージャIDをキーとするマップであるオプションのproceduresを追加しました。
  • テスト呼び出しを一覧表示 - GET /v1/convai/test-invocations
    • テストとフォルダーを名前でフィルタリングするための、オプションでnull許容のsearch(文字列)を追加しました。
  • エージェントでテストを実行とテスト呼び出しを取得
    • テストスイート呼び出しと単体テスト実行のレスポンスに、オプションでnull許容のversion_id(文字列)と、オプションのran_against_draft(ブール値、デフォルトfalse)を追加しました。
    • 呼び出しサマリーにも、オプションのruns_diverged_from_version(ブール値、デフォルトfalse)を追加しました。
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • リクエスト本文に、クエリ固有の上書き設定として、オプションでnull許容のmax_documents_length(整数、1~50,000)およびmax_retrieved_rag_chunks_count(整数、1~20)を追加しました。
  • WhatsAppアカウントを取得 - GET /v1/convai/whatsapp-accounts/{phone_number_id}
    • オプションのaccount_type(WhatsAppAccountType、デフォルトcloud_api)を追加しました。値はcloud_apiとcoexistenceです。
  • 想定LLM使用量を計算 - POST /v1/convai/agent/{agent_id}/llm-usage/calculate
    • LLMUsageCalculatorLLMResponseModelに必須のprice_per_message(数値)を追加しました。

音楽

  • MusicModelIDに、POST /v1/music/video-to-music、POST /v1/music/plan、音楽を作曲、POST /v1/music/detailed、POST /v1/music/detailed/stream、POST /v1/music/stream、POST /v1/music/upload、POST /v1/music/finetunes向けのmusic_v2_5を追加しました。
  • GenerationChunk.textのmaxLengthを、POST /v1/music/plan、POST /v1/music、POST /v1/music/detailed、POST /v1/music/detailed/stream、POST /v1/music/stream、POST /v1/music/uploadで6,000文字から6,132文字に増やしました。セクション名には1~100文字を使用でき、チャンクには1行200文字で最大30行を含められます。

スキーマの変更

ElevenAgents

  • リアルタイムサーバーイベントにqueue_statusを追加しました。必須のqueue_status_event.statusはwaiting、admitted、timed_outを受け付けます。timed_outはWebSocketクローズコード4300に先行します。保留音声は引き続き通常のaudioイベントとして届きます。
  • LLM列挙型に、会話開始時のオーバーライドを含むgemini-3.8-flashを追加しました。
  • 会話システムツール結果のユニオンに、start_procedure_success、start_procedure_error、end_procedure_success、end_procedure_errorを追加しました。
  • FeaturesUsageCommonModelに、オプションのfreeform_procedureおよびstructured_procedure機能ステータスを追加しました。

Scribe v2 Medical

Scribe v2 Medicalが一般提供開始となりました。医療・臨床オーディオに特化したバッチ音声認識モデルで、Scribe v2と同じ料金で利用できます。

文字起こしを作成で、model_idとしてscribe_v2_medicalを渡します。キータームプロンプティング、エンティティ検出、話者ダイアライゼーション、逐語録なしモードは、Scribe v2と同様に機能します。

モデル

モデルID、機能、Scribe v2 Medicalを使用するタイミング。

文字起こしを作成

model_idをscribe_v2_medicalに設定してオーディオを文字起こしします。

ElevenAgents

  • ワークスペース全体の会話チケット:アクセス可能なエージェント全体の会話トリアージチケットを取得するため、ワークスペースチケットを一覧表示を追加しました。ステータスまたは担当者でフィルタリングし、カーソルページネーションでページごとに最大100件のチケットを取得できます。
  • 動的変数の会話フィルター:会話を一覧表示と会話メッセージをテキスト検索で、繰り返し指定できるdynamic_variable_paramsフィルターを受け付けるようになりました。eq、gt、gte、lt、lteを使用してname:op:valueの形式で指定します。比較演算子には数値が必要です。
  • Twilio留守番電話検出:発信テレフォニーとバッチ通話の設定で、任意のtwilio_machine_detectionをサポートするようになりました。早期に人間か機械かを判定するにはenableを、留守番電話の挨拶が終わるまで待機するにはdetect_message_endを選択します。結果は新しいanswering_machine_detectionWebhookイベントで届きます。
  • データ収集値の制約:データ収集プロパティで、許可される値を含む動的変数を指定するためにallowed_valuesを使用できるようになりました。以前のallowed_values_dynamic_variableフィールドは非推奨です。
  • エージェントメタデータ:エージェントブランチを一覧表示のレスポンスで、ドラフトの作成時刻とブランチ先端より古いかどうかが示されるようになりました。エージェントとSpeech Engineのサマリーでvoice_idが必須になりました。
  • ナレッジベースのソースURL:エージェントRAGクエリチャンクに、URLドキュメントの追跡対象URLを含む必須のnull許容source_urlが追加されました。
  • エージェント応答の添付ファイル:agent_response WebSocketイベントに、任意のattachmentsが含まれるようになりました。各添付ファイルにはurlとnameが必要で、mime_typeを含めることができます。

ワークスペース

  • APIキープラットフォーム上限:サービスアカウントAPIキーのレスポンスに、クレジット、プロフェッショナルボイスクローン、TTS、吹き替え、音楽の同時実行数に関するエンタープライズplatform_limitsを含められるようになりました。

SDKリリース

JavaScript SDK

  • v2.67.0 - 会話一覧およびテキスト検索リクエストにdynamicVariableParamsを追加しました。Twilio留守番電話検出、データ収集値の制約、APIキープラットフォーム上限、エージェントブランチのドラフトメタデータ、ナレッジベースのソースURL用の型を再生成しました。

Python SDK

  • v2.67.0 - 同期・非同期の会話一覧およびテキスト検索メソッドにdynamic_variable_paramsを追加しました。Twilio留守番電話検出、データ収集値の制約、APIキープラットフォーム上限、エージェントブランチのドラフトメタデータ、ナレッジベースのソースURL用の型を再生成しました。リアルタイムテキスト読み上げクライアントが、内部のomitセンチネルを接続に渡さなくなりました。

ElevenLabs CLI

  • v1.2.0 - elevenlabs sayコマンドとそのエージェントスキルを追加し、APIコマンドバインディングを再生成して、eleven_v3をデフォルトのTTSモデルにしました。

パッケージ

  • @elevenlabs/client@1.25.0, @elevenlabs/react@1.15.2, @elevenlabs/react-native@1.2.27, @elevenlabs/convai-widget-core@0.18.1および@elevenlabs/convai-widget-embed@0.18.1 - 利用者が型を直接インポートできるよう、@elevenlabs/clientからMessageAttachmentを再エクスポートしました。
  • @elevenlabs/client@1.24.0, @elevenlabs/types@0.23.0, @elevenlabs/react@1.15.1, @elevenlabs/react-native@1.2.26, @elevenlabs/convai-widget-core@0.18.0および@elevenlabs/convai-widget-embed@0.18.0 - エージェント応答のファイル添付をonMessageに転送し、任意のwebRtc.singlePeerConnectionセッション設定を追加しました。ウィジェットでは挨拶ボタンもローカライズされ、テキストチャット応答の欠落や重複が修正されました。

API

APIの変更を表示

新しいエンドポイント

ElevenAgents

  • ワークスペースチケットを一覧表示 - GET /v1/convai/triage-tickets
    • 呼び出し元がアクセスできるすべてのエージェントの会話トリアージチケットを、作成日時の新しい順に一覧表示します。
    • 任意のpage_size(整数、1~100、デフォルト100)、status(AgentConversationTicketStatus)、assignee_user_id(文字列またはunassigned)、cursor(文字列)クエリパラメータを追加しました。
    • GetAgentConversationTicketsPageResponseModelを返します。

更新されたエンドポイント

ElevenAgents

  • 会話を一覧表示 - GET /v1/convai/conversations
    • 任意のnull許容dynamic_variable_params(繰り返し可能な文字列配列)を追加しました。各値はname:op:value形式で、opはeq、gt、gte、lt、lteです。
  • 会話メッセージをテキスト検索 - GET /v1/convai/conversations/messages/text-search
    • 同じ構文の任意のnull許容dynamic_variable_params(繰り返し可能な文字列配列)を追加しました。
  • Twilio発信通話、SIPトランク発信通話、Exotel発信通話、バッチ通話を送信
    • telephony_call_configで入力スキーマと出力スキーマを分けるようになりました。
    • 任意のnull許容twilio_machine_detection(TwilioMachineDetectionConfig)を追加しました。modeはenableまたはdetect_message_endを受け付け、デフォルトはenableです。この設定はTwilio以外のプロバイダーと着信通話では無視されます。
  • 電話番号をインポート - POST /v1/convai/phone-numbers
    • 着信Webhook署名を検証するため、Twilio APIキーのインポートに任意のnull許容account_auth_token(文字列)を追加しました。

スキーマの変更

ElevenAgents

  • WebhookEventTypeにanswering_machine_detectionを追加しました。
  • AgentBranchSummaryに、任意のnull許容draft_created_at(整数)と任意のdraft_is_behind_tip(boolean、デフォルトfalse)を追加しました。
  • AgentKnowledgeBaseRagChunkResponseModelに、必須のnull許容source_url(文字列)を追加しました。
  • AgentSummaryResponseModelとSpeechEngineSummaryResponseに必須のvoice_id(文字列)を追加しました。
  • AnalysisPropertyに、任意のnull許容name(文字列)とallowed_values(AllowedValues)を追加しました。LiteralJsonSchemaPropertyにもallowed_valuesを追加しました。どちらもallowed_values_dynamic_variableを非推奨としています。
  • DataCollectionResultCommonModelに任意のnull許容name(文字列)を追加しました。
  • WorkspaceApiKeyResponseModelに任意のnull許容platform_limits(PlatformLimits)を追加しました。
  • MCPツールのIconに、任意のnull許容theme(lightまたはdark)を追加しました。
  • SMBToolConfigにsend_custom_email、create_service_quote_request、create_product_quote_requestのパラメータバリアントを追加しました。
  • Webhookクエリパラメータスキーマとテレフォニー通話設定で、入力モデルと出力モデルを分けるようになりました。
  • agent_response WebSocketイベントに任意のattachments(配列)を追加しました。各項目にはurlとname(文字列)が必要で、任意のmime_type(文字列)を受け付けます。

ElevenCreative

  • ReferenceVideo.studio_clipで、StudioClipReferenceの代わりにStudioClipLocatorを使用するようになりました。フィールドとワイヤーフォーマットに変更はありません。

ElevenAgents

  • 電話キーパッド入力:エージェント会話設定で、DTMF入力用の任意のdtmf_input_settingsがサポートされるようになりました。数字入力のタイムアウトを設定し、#を終了記号として使用できるほか、文字起こし、ログ、分析からキーパッド入力をマスキングできます。
  • 会話添付ファイル履歴:会話を取得の文字起こしエントリに、添付されたすべてのファイルのID、名前、MIMEタイプ、URLを含む配列file_inputsが追加されました。
  • エージェントタグのフィルタリング:エージェントを一覧表示で、任意のtagsクエリパラメータを受け付けるようになりました。パラメータを繰り返すと、指定したタグのいずれかを持つエージェントに一致します。
  • バッチキャンペーンコンテキスト:会話を取得で、必須のcampaign_idとcampaign_lead_idを含むnull許容のcampaignメタデータにより、バッチ通話を識別できるようになりました。

音楽

  • 波形ビジュアルデータ:音楽を詳細に生成、詳細付きで音楽をストリーミング、音楽をアップロードで、任意のwith_waveform_visual(boolean、デフォルトはfalse)を受け付けるようになりました。オプトインしたレスポンスでは、1秒あたり4サンプルの低解像度waveform_visual整数配列が返されます。

吹き替え

  • プロジェクトのページネーション動作:吹き替えプロジェクトを一覧表示と言語ターゲットを一覧表示で、page_sizeが1~100に制限されるようになりました。プロジェクトステータスのフィルタリングにはqueuedが含まれ、両エンドポイントでは次のページを取得するためのnext_cursorの使用方法が記載されています。

SDKリリース

JavaScript SDK

  • v2.66.0 - sendMultimodalMessageにfileIdsを追加し、1つのメッセージに複数のファイル添付を含められるようになりました。

Python SDK

  • v2.66.0 - send_multimodal_messageにfile_idsを追加し、1つのメッセージに複数のファイル添付を含められるようになりました。

Android SDK

  • v0.12.2 - セッションイベントの接続時にonUnhandledClientToolCallコールバックを保持するようになりました。応答を想定する未処理のクライアントツール呼び出しは、未解決のままになるのではなく、自動エラー応答を受け取るようになりました。

ElevenLabs CLI

  • v1.1.0 - APIコマンドバインディングを再生成し、ElevenAgentsワークフロー向けにコマンド単位のリクエスト属性を追加しました。これらのコマンドはCLIのUser-Agentにcmd/<command>を追加するため、agents pushやagents createなどのワークフローからのリクエストを区別できます。

パッケージ

  • @elevenlabs/client@1.23.0, @elevenlabs/react@1.15.0, @elevenlabs/types@0.22.1, @elevenlabs/react-native@1.2.25, @elevenlabs/convai-widget-core@0.17.1および@elevenlabs/convai-widget-embed@0.17.1 - sendMultimodalMessageにfileIdsを追加しました。クライアントは互換性のためにfileとfilesの両フィールドを送信し、Reactでは更新されたクライアントAPIを公開しています。

API

APIの変更を表示

更新されたエンドポイント

ElevenAgents

  • エージェントを一覧表示 - GET /v1/convai/agents
    • 任意のnull許容tags(文字列配列)を追加しました。クエリパラメータを繰り返すと、指定したタグのいずれかに一致します。
  • エージェントを作成、エージェントを取得、エージェントを更新
    • 任意のnull許容conversation_config.conversation.dtmf_input_settings(DTMFInputConfig)を追加しました。dtmf_input_timeout(数値、0.5~10秒、デフォルト2)、hash_terminator(boolean、デフォルトtrue)、redact_input(boolean、デフォルトfalse)をサポートします。
    • 電話番号転送設定に、任意のsip_refer_play_dialtone(boolean、デフォルトtrue)を追加しました。SIP REFER転送の完了中に元の通話レッグを無音にするには、falseに設定してください。
    • 開始・終了プロシージャのシステムツールで、ProcedureVersionRefまたはProcedureDraftRefのいずれかを受け付けるようになりました。ドラフト参照にはprocedure_id(文字列)が必要で、version_idはnullに設定されます。
  • 会話を取得 - GET /v1/convai/conversations/{conversation_id}
    • 文字起こしエントリにfile_inputs(ConversationHistoryTranscriptFileInputResponseModelの配列)を追加しました。各項目にはfile_id、original_filename、mime_type、file_url(文字列)が必要です。
    • バッチ通話メタデータに、任意のnull許容campaign(BatchCallingCampaignInformation)を追加しました。オブジェクトにはcampaign_idとcampaign_lead_id(文字列)が必要です。
    • ChatSourceMediumにdtmfを追加しました。
  • 会話トリアージチケットの課題タイプにincorrect_information、documentation_gap、platform_bug、wrong_actionを追加しました。

音楽

  • 音楽を詳細に生成(POST /v1/music/detailed)と詳細付きで音楽をストリーミング(POST /v1/music/detailed/stream)
    • 任意のwith_waveform_visual(boolean、デフォルトfalse)を追加しました。
    • 詳細レスポンスに、-1000から1000までを1秒あたり4回サンプリングしたnull許容のwaveform_visual(整数配列)を追加しました。
  • 音楽をアップロード - POST /v1/music/upload
    • 任意のwith_waveform_visual(boolean、デフォルトfalse)と、レスポンス内のnull許容waveform_visual(整数配列)を追加しました。

ElevenCreative

  • Studioプロジェクトを作成とポッドキャストを作成
    • quality_presetがnullを受け付けるようになり、スキーマのデフォルト値standardを削除しました。

吹き替え

  • 吹き替えプロジェクトを一覧表示 - GET /v1/dubbing/project
    • page_sizeはデフォルト20の任意の整数のままですが、値は拒否される代わりに1~100に制限されるようになりました。
    • statusフィルタにqueued、preparing、ready、failedが記載されるようになりました。
    • 直前のレスポンスのnext_cursorをcursorに渡します。最初のページでは省略してください。
  • 言語ターゲットを一覧表示 - GET /v1/dubbing/project/{project_id}/language
    • page_sizeはデフォルト20の任意の整数のままですが、値は拒否される代わりに1~100に制限されるようになりました。
    • statusフィルタはqueued、processing、completed、stale、failedをサポートします。
    • 直前のレスポンスのnext_cursorをcursorに渡します。最初のページでは省略してください。

スキーマの変更

ワークスペース

  • PendingSubscriptionSwitchResponseModel.next_tierにgrantを追加しました。

ElevenLabs CLI

ElevenLabs CLI v1.0.0が利用可能になりました。すべてのElevenLabs API操作をサブコマンドとして実行でき、JSON、テーブル、YAML、CSVでの出力、自動ページネーション、シェル補完を利用できます。

CLIでは、ElevenAgents向けのローカル設定ワークフローも提供します。エージェント、ツール、テストの設定をファイルとして保存し、pushコマンドとpullコマンドで同期できます。ブランチの管理、テストの実行、ElevenLabs UIコンポーネントのインストール、データレジデンシーリージョンの選択も可能です。

CLIドキュメント

CLIをインストールし、認証して、エージェントをコードとして管理します。

プロシージャ

プロシージャがElevenAgentsで正式リリースされました。プロシージャには、タスク固有の指示と、その指示を適用するタイミングを決めるトリガーが含まれます。会話中にエージェントは関連するプロシージャを読み込むため、すべての指示をシステムプロンプトに入れなくても、1つのエージェントで異なるタスクを処理できます。

エージェントが指示の表現や順序を会話に合わせて調整できる場合は、自由形式のプロシージャを使用します。手順を定義された順序で実行する必要がある場合は、構造化プロシージャを使用します。どちらのタイプも、同じエージェントでワークフローと併用できます。

プロシージャの概要

プロシージャを使用する場面と、プロンプトやワークフローとの違いを確認します。

自由形式のプロシージャ

エージェントが会話に合わせて調整できる自然言語の指示を作成します。

構造化プロシージャ

エージェントが一貫した順序で従う、型付きの手順を定義します。

ElevenAgents

  • 会話トリアージチケット:エージェントのパフォーマンスに関するチケットの作成、手動フォローアップチケットの作成、チケットの一覧取得、ワークスペースメンバーの割り当て、ステータスと担当者の更新、チケットレベルまたはターンレベルのコメント追加を行うAPIを追加しました。
  • 会話のオブザーバビリティ:リアルタイムクライアントは、エージェントの各ターン完了後にcontext_usageイベントを受信できるようになりました。このイベントでは、モデル、プロンプトトークン数、モデルのコンテキスト上限を報告します。

SDKリリース

JavaScript SDK

  • v2.65.0 - 会話トリアージチケットと軽量な会話要約のクライアントおよび型を追加しました。会話APIにプロシージャ、無効なツール呼び出し、ソートのフィルターを追加し、プロシージャAPIにエージェントバージョン選択を、トピックAPIに評価詳細の制御とフラストレーション順のソートを追加しました。また、ナレッジベースの更新頻度、テスト環境、アラートインテグレーションのフィールドと、リアルタイムの吹き替えメッセージ型も追加しました。

Python SDK

  • v2.65.0 - 会話トリアージチケットと軽量な会話要約のクライアントおよび型を追加しました。会話APIにプロシージャ、無効なツール呼び出し、ソートのフィルターを追加し、プロシージャAPIにエージェントバージョン選択を、トピックAPIに評価詳細の制御とフラストレーション順のソートを追加しました。また、ナレッジベースの更新頻度、テスト環境、アラートインテグレーションのフィールドを追加し、スピーチtoテキストのkeytermsおよび吹き替えのwebhook_idsで繰り返されるmultipartフィールドを保持します。

Swift SDK

  • v3.3.0 - 型付きクライアントエラー解析、expects_response処理、型安全なツール結果を追加しました。WebRTCの起動は、オーディオトラックのサブスクリプションを待つ代わりに、エージェントが参加した時点で準備完了となります。また、URL処理を強化し、未知イベントのノイズを抑制し、ソフトウェアミュート処理からリアルタイムスレッドの割り当てを削除しました。

パッケージ

  • @elevenlabs/client@1.19.1, @elevenlabs/react@1.12.3, @elevenlabs/react-native@1.2.21, @elevenlabs/convai-widget-core@0.16.2および@elevenlabs/convai-widget-embed@0.16.2 - 厳格なコンテンツセキュリティポリシー下で、WebRTC出力キャプチャがセルフホストのAudioWorkletパスを使用するようになりました。Workletのキャッシュにはリクエストされたソースが含まれるため、以前のインラインURLがセルフホストのパスを置き換えることはありません。React Nativeのセットアップエラーは@elevenlabs/react-nativeを案内するようになりました。
  • @elevenlabs/client@1.20.0, @elevenlabs/react@1.12.4, @elevenlabs/react-native@1.2.22, @elevenlabs/convai-widget-core@0.16.3および@elevenlabs/convai-widget-embed@0.16.3 - オプションのwebRtc.iceTransportPolicyを追加しました。直接のUDPトラフィックをブロックするネットワークでWebRTC ICE候補をTURNリレーに制限するには、relayに設定します。
  • @elevenlabs/client@1.21.0, @elevenlabs/react@1.13.0, @elevenlabs/types@0.21.1, @elevenlabs/react-native@1.2.23, @elevenlabs/convai-widget-core@0.16.4および@elevenlabs/convai-widget-embed@0.16.4 - onContextUsageコールバックとContextUsageEvent型を追加しました。ReactではuseConversationを通じてコールバックを公開します。React Nativeは、ブラウザーグローバルの検出ではなく、パッケージのexport条件を通じて解決されるようになりました。
  • @elevenlabs/client@1.22.0, @elevenlabs/react@1.14.0, @elevenlabs/types@0.22.0, @elevenlabs/react-native@1.2.24, @elevenlabs/convai-widget-core@0.17.0および@elevenlabs/convai-widget-embed@0.17.0 - 属性付きボタン応答を備えた最初のメッセージのリッチコンテンツ、onExternalAgentDisconnected、onMCPToolApprovalRequestを追加しました。WebRTCは選択した入力デバイスを使用し、マイク切り替え時にもミュート状態を保持し、開始データを送信できない場合はセットアップに失敗します。ウィジェットには、同時実行キューのステータス、折りたたまれたトリガーでの任意の言語選択、テキストと音声の両方をサポートするエージェント向けの最初のメッセージレンダリングを追加しました。

API

APIの変更を表示

新しいエンドポイント

ElevenAgents

  • 会話トリアージチケット用の9つのエンドポイントを追加しました:
    • 会話チケットを作成 - POST /v1/convai/triage-tickets。リクエストにはconversation_id(文字列)が必要で、qa_comment(null許容の文字列、1~10,000文字)と最大200件のターンコメントを受け付けます。
    • チケットを一覧表示 - GET /v1/convai/agents/{agent_id}/triage-tickets。カーソルページネーションに対応しています。
    • 手動チケットを作成 - POST /v1/convai/agents/{agent_id}/triage-tickets。リクエストにはqa_comment(文字列、1~10,000文字)が必要です。
    • 割り当て可能なユーザーを一覧表示 - GET /v1/convai/agents/{agent_id}/triage-tickets/assignable-users。レスポンスには、サービスアカウント以外のワークスペースメンバーと、各メンバーがエージェントにアクセスできるかどうかが含まれます。
    • チケットを取得 - GET /v1/convai/triage-tickets/{agentqa_ticket_id}。
    • チケットを更新 - PATCH /v1/convai/triage-tickets/{agentqa_ticket_id}。リクエストでは、任意のstatusとnull許容のassignee_user_idを受け付けます。
    • チケットを削除 - DELETE /v1/convai/triage-tickets/{agentqa_ticket_id}。
    • コメントを追加 - POST /v1/convai/triage-tickets/{agentqa_ticket_id}/comments。リクエストにはcomment(文字列、1~10,000文字)が必要です。
    • ターンコメントを追加 - POST /v1/convai/triage-tickets/{agentqa_ticket_id}/turn-comments。リクエストには、0始まりのturn_index(整数)とcomment(文字列、1~10,000文字)が必要です。

更新されたエンドポイント

ElevenAgents

  • 署名付きURLを取得 - GET /v1/convai/conversation/get-signed-url
    • 任意のdebug_events_request(ブール値、デフォルトはfalse)を追加しました。デバッグイベントには、エージェントへの編集者アクセスが必要です。
  • WebRTCトークンを取得 - GET /v1/convai/conversation/token
    • 任意のdebug_events_request(ブール値、デフォルトはfalse)を追加しました。従来のGET /v1/convai/conversation/get_signed_urlルートも同じパラメーターを受け付けます。
  • 会話を一覧表示 - GET /v1/convai/conversations
    • 指定したプロシージャのいずれかが実行された会話に一致させる、任意のtriggered_procedure_ids(null許容の文字列配列、最大50件)を追加しました。
    • 実行されなかったツール呼び出しを含めるための、任意のinclude_invalid_tool_calls(ブール値、デフォルトはfalse)を追加しました。
    • 通話開始時刻用の、任意のsort_direction(ascまたはdesc、デフォルトはdesc)を追加しました。
  • 会話メッセージをテキスト検索 - GET /v1/convai/conversations/messages/text-search
    • 任意のtriggered_procedure_ids(null許容の文字列配列、最大50件)を追加しました。
    • 任意のinclude_invalid_tool_calls(ブール値、デフォルトはfalse)を追加しました。
  • エージェント会話トピックを取得 - GET /v1/convai/agents/{agent_id}/topics
    • 任意のinclude_evaluation_criteria(ブール値、デフォルトはtrue)を追加しました。
    • sort_byにfrustrationを追加しました。
    • トピックレスポンスにnull許容のsuccess_rate(数値)を追加し、全体レスポンスにaggregated_run_count(整数、デフォルトは0)を追加しました。
    • from_unix_secsはUTC日の開始時刻に切り捨てられます。範囲を指定すると、完了した日次ディスカバリー実行を集計します。両方の境界を省略した場合は、最新の実行を返します。
  • プロシージャを一覧表示(GET /v1/convai/agents/{agent_id}/branches/{branch_id}/procedures)およびプロシージャを取得(GET /v1/convai/agents/{agent_id}/branches/{branch_id}/procedures/{procedure_id})
    • 特定のエージェントバージョンからプロシージャを取得するための、任意のnull許容agent_version_id(文字列)を追加しました。
  • テストを作成およびテストを更新
    • レスポンス、シミュレーション、ツール呼び出しのユニットテストスキーマに、任意のnull許容environment(文字列)を追加しました。この値は環境固有のURL、ヘッダー、認証接続を選択し、デフォルトはproductionです。
  • URLドキュメントを作成、クロールジョブを作成、フォルダーを作成
    • 自動同期用に、任意のnull許容minimum_frequency_days(整数、1~180)を追加しました。デフォルトは7で、より厳しい親フォルダーの頻度が優先されます。

音楽

  • 音楽Finetuneを一覧表示 - GET /v1/music/finetunes
    • 最大page_sizeを100から150に増やしました。デフォルトは50のままです。

スキーマの変更

ElevenAgents

  • エージェント更新リクエストに、任意のnull許容procedures(object<string, ProcedureVersionRef>)を追加しました。各値にはprocedure_idとversion_id(文字列)が必要です。空のオブジェクトを指定すると、すべてのプロシージャを削除します。
  • 会話開始設定にenable_procedure_ids_from_client(ブール値、デフォルトはfalse)を追加しました。開始データには任意のnull許容procedure_ids(文字列配列)を追加しました。空の配列を指定すると、開始エージェントのすべてのプロシージャを無効にします。
  • ClientEventにcontext_usageを追加しました。
  • ソフトタイムアウトのオーバーライドに、任意のnull許容additional_soft_timeout_messages(文字列配列)を追加しました。
  • 分析およびスキーマオーバーライドモデルの定数値がnullを受け付けるようになりました。
  • ウィジェット設定のmic_muting_enabledとtranscript_enabledのデフォルトをfalseからtrueに変更しました。以前の動作を維持するには、明示的にfalseに設定してください。

ワークスペース

  • ユーザーを取得のレスポンスから、UserResponseModelのxi_api_keyを削除しました。
  • ResourceMetadataResponseModel.role_to_group_idsでは、キーをadmin、editor、commenter、viewerに限定せず、カスタムロールIDをキーとして受け付けるようになりました。
  • ダイレクトパブリッシングのレスポンスに、任意のnull許容restricted_to_user_email_domains(文字列配列)を追加しました。
  • 保留中のサブスクリプション切り替えレスポンスのnext_tierにgoを追加しました。

MCPサーバー

  • ローカルMCPサーバーを非推奨化:ローカルのElevenLabs MCPサーバーとMCPプレーヤーは、ホスト型MCPサーバーに移行するため非推奨となりました。両リポジトリはアーカイブされ、今後更新されません。ホスト型サーバーはhttps://api.elevenlabs.io/v1/mcpで利用でき、OAuthを通じてElevenLabsアカウントでサインインします。ローカルへのインストールやAPIキーは不要です。Claude、Cursor、その他のMCPクライアント向けのセットアップ手順については、ホスト型MCPサーバーのドキュメントをご覧ください。

ElevenCreative

  • 画像、ビデオ、音声生成API:新しい非同期Flows APIで、ビデオ、画像、音声の生成を作成、一覧表示、取得できます。生成レスポンスではpending、generating、completed、failedの状態を公開し、リクエストには完了イベント用のWebhookターゲットを含められます。
  • 再利用可能なメディアアセット:新しいアセットAPIで、ワークスペースのメディアをアップロード、一覧表示、取得、削除できます。画像、ビデオ、オーディオの参照には、アップロード済みアセット、以前の生成、インラインbase64データを使用できるため、生成ジョブを連結できます。参照とアセットをご覧ください。

ElevenAgents

  • 軽量な会話サマリー:会話サマリーを取得は、完全な文字起こしを読み込まずに、生成されたタイトル、文字起こしサマリー、通話結果、プレーンなユーザーまたはエージェントメッセージを返します。任意のmax_messagesクエリパラメーターは1~200の整数(デフォルトは40)です。より長い会話ではmessages_omittedがtrueに設定されます。コンテキストを維持する必要があるエージェントに便利です。
  • 会話トピックのページネーションと並べ替え:エージェントの会話トピックを取得に、任意のカーソルベースのページネーションと並べ替えが追加されました。page_size(整数、1~100)、cursor(文字列)、sort_by(conversations、sentiment、success_rate)、sort_direction(ascまたはdesc)を使用します。レスポンスにはhas_moreとnull許容のnext_cursorが追加されます。
  • 同時実行待機キュー:エージェントプラットフォーム設定に任意のqueueing(AgentQueueingConfig)が追加されました。エージェントが同時実行制限に達した際に発信者を待機させるには、enabledをtrueに設定します。wait_timeout_secondsは最大1,800の整数(デフォルトは180)です。
  • ターンとワークフローの制御:ターン設定に、カスタムの割り込み用語と厳選されたデフォルトを組み合わせるmerge_with_default_ignore_terms(ブール値、デフォルトはfalse)が追加されました。ソフトタイムアウトにはdisable_until_first_user_message(ブール値、デフォルトはfalse)が、ワークフローツールロケーターにはノードごとのパラメーターオーバーライド用の任意のschema_overridesが追加されました。
  • バックグラウンドオーディオのデフォルト:BackgroundSoundConfig.volumeのデフォルトが0.6から0.15に、crossfade_loopのデフォルトがfalseからtrueに変更されました。以前の動作を維持するには、これらのフィールドを明示的に設定してください。

SDKリリース

JavaScript SDK

  • v2.64.0 - アセットのアップロード、一覧表示、取得、削除を行うclient.assetsと、非同期のビデオ、画像、音声生成を行うclient.flowsを追加しました。ターン設定にmergeWithDefaultIgnoreTermsを追加しました。WorkspaceGroupResponseModelからCustomToolApiSchemaConfigとscimExternalIdを削除しました。

Python SDK

  • v2.64.0 - 非同期のビデオ、画像、音声生成用のアセットおよびFlowsクライアントと、ターン設定のmerge_with_default_ignore_termsを追加しました。オンプレミスセッションのセットアップに、追加のセットアップメッセージフィールドを渡すextra_setup_configを追加しました。

パッケージ

  • @elevenlabs/client@1.18.0, @elevenlabs/react@1.12.1, @elevenlabs/types@0.20.0, @elevenlabs/react-native@1.2.19, @elevenlabs/convai-widget-core@0.16.0 and @elevenlabs/convai-widget-embed@0.16.0 - 実験的なセルフホスト型オーケストレーターセッションとリッチコンテンツイベントを追加しました。Scribeオーディオワークレットを、厳格なコンテンツセキュリティポリシー向けにセルフホストできるようになりました。切断処理は一貫してdisconnectedに到達し、遅延コールバックによって新しいセッションが消去されないようになりました。ウィジェットではクイック返信とリンクをインライン表示し、音声文字起こし内のMarkdownを復元し、コンテナクエリレイアウト内での言語メニュー位置を修正しました。
  • @elevenlabs/client@1.19.0, @elevenlabs/react@1.12.2, @elevenlabs/types@0.21.0, @elevenlabs/react-native@1.2.20 and @elevenlabs/convai-widget-core@0.16.1 - 第2言語、エンティティ検出、バックグラウンドオーディオフィルタリングに対応するリアルタイムのスピーチtoテキストオプションを追加しました。最終文字起こし、検出されたエンティティ、無効なリクエストのイベントを追加し、タイムスタンプ付き単語の型をライブスキーマに合わせ、マイク権限の失敗によりuseScribeの再接続が妨げられる問題を修正しました。

API

APIの変更を表示

新しいエンドポイント

ElevenCreative

  • ビデオ生成を作成 - POST /v1/flows/video
  • ビデオ生成を一覧表示 - GET /v1/flows/video
  • ビデオ生成を取得 - GET /v1/flows/video/{generation_id}
  • 画像生成を作成 - POST /v1/flows/image
  • 画像生成を一覧表示 - GET /v1/flows/image
  • 画像生成を取得 - GET /v1/flows/image/{generation_id}
  • 音声生成を作成 - POST /v1/flows/text-to-speech
  • 音声生成を一覧表示 - GET /v1/flows/text-to-speech
  • 音声生成を取得 - GET /v1/flows/text-to-speech/{generation_id}
  • アセットをアップロード - POST /v1/assets
  • アセットを一覧表示 - GET /v1/assets
  • アセットを取得 - GET /v1/assets/{asset_id}
  • アセットを削除 - DELETE /v1/assets/{asset_id}

ElevenAgents

  • 会話サマリーを取得 - GET /v1/convai/conversations/{conversation_id}/summary
    • 任意のmax_messages(整数、1~200、デフォルトは40)を受け付けます
    • 必須のconversation_id、agent_id、status、message_count、noteを含むGetConversationSummaryResponseModelを返します
    • プレーンなmessagesにはrole(userまたはagent)とmessageのみが含まれ、上限を超える会話ではmessages_omitted: trueを返します

更新されたエンドポイント

ElevenAgents

  • ライブ数を取得 - GET /v1/convai/analytics/live-count
    • 任意のagent_ids(文字列配列、最大25)を追加。agent_idより優先されます
  • エージェントの会話トピックを取得 - GET /v1/convai/agents/{agent_id}/topics
    • 任意のpage_size(整数、1~100)、cursor(文字列)、sort_by(conversations、sentiment、success_rate)、sort_direction(ascまたはdesc)を追加
    • レスポンスにhas_more(ブール値、デフォルトはfalse)とnull許容のnext_cursor(文字列)を追加

スキーマの変更

ElevenAgents

  • エージェントプラットフォーム設定に任意のqueueing(AgentQueueingConfig)を追加。enabled(ブール値、デフォルトはfalse)とwait_timeout_seconds(0より大きく最大1,800の整数、デフォルトは180)を含みます
  • WorkflowToolLocatorに任意のschema_overridesを追加。ノードごとの定数、動的変数、LLM、または省略のオーバーライドは、ツールレベルのオーバーライドより優先されます
  • ターン設定および関連するオーバーライドスキーマにmerge_with_default_ignore_terms(ブール値、デフォルトはfalse)を追加
  • ソフトタイムアウト設定および関連するオーバーライドスキーマにdisable_until_first_user_message(ブール値、デフォルトはfalse)を追加
  • リアルタイムエージェントツールレスポンスイベントに、必須かつ読み取り専用のstatus(success、error、blocked、skipped)を追加
  • 会話開始ソースにavayaを、認可方法にavaya_api_keyを追加
  • サポートされるエージェントLLM値にgemini-3.6-flashとgemini-3.7-flashを追加
  • BackgroundSoundConfig.volumeのデフォルトを0.6から0.15へ、crossfade_loopのデフォルトをfalseからtrueへ変更
  • CustomToolApiSchemaConfigを削除。この型をインポートしている生成SDKユーザーは、インポートを削除する必要があります
  • WorkspaceGroupResponseModelからscim_external_idを削除

ダビングv2 API

ダビングv2がAPIで利用可能になりました。各話者の声、トーン、話すペースを維持したまま、オーディオとビデオを90以上の言語に翻訳します。

新しいプロジェクトベースのAPIでは、元の文字起こしと翻訳を編集可能なJSONとして保持します。ファイルまたはURLからプロジェクトを作成し、1つ以上の対象言語を追加して、個々の文字起こしセグメントまたは翻訳を編集した後、変更された領域のみを再生成します。最初の吹き替えを作成するには、ダビングクイックスタートをご覧ください。

クイックスタート

最初のダビングv2プロジェクトを作成し、翻訳済みオーディオトラックを生成します。

編集と再生成

元の文字起こしと翻訳を編集し、変更した領域を再生成します。

APIリファレンス

ダビングのプロジェクト、言語、文字起こしエンドポイントを確認します。

ElevenAgents

  • 会話ガードレールフィルター:会話を一覧表示に、任意のguardrail_types(GuardrailType[])およびcustom_guardrail_names(文字列配列)クエリパラメーターが追加されました。既存の会話階層は、任意のparent_conversation_id(文字列)でフィルタリングできるようになりました。
  • ブランチ差分ステータス:エージェントブランチを一覧表示に、任意のinclude_commit_status(ブール値、デフォルトはfalse)が追加されました。有効にすると、ブランチの概要にnull許容のcommits_ahead、commits_behind、merged_into_branch_idフィールドが含まれます。
  • 会話とツールの制御:クライアントオーバーライドでmax_duration_secondsとpronunciation_dictionary_locatorsをサポートしました。MCPサーバー設定には、ツール呼び出しにMCPの_meta値を渡すためのrequest_metaが追加され、Webhookツールのタイムアウトは最大300秒まで対応しました。
  • 通話後分析の使用量:会話の課金に、機能ごとの累積合計と実行スナップショットを含むanalysisの内訳が追加されました。文字起こしメッセージにはtriggered_guardrailsが、会話ターンには任意のproducing_llmが追加されました。

音声

  • 音声検索フィルター:すべての音声v2を取得に、任意のgender、age、language、accent、use_cases、min_notice_period_days、include_custom_rates、include_live_moderated、high_qualityクエリパラメーターが追加されました。

SDKリリース

JavaScript SDK

  • v2.63.0 - 第2言語、言語・エンティティ検出、バックグラウンドオーディオフィルタリング、ロギング、使い捨てトークン認証に対応するリアルタイムのスピーチtoテキストオプションを追加しました。最終文字起こし、エンティティ、無効なリクエストのイベントを追加し、未承認の利用規約ディスパッチ、重複したaudio_formatパラメーター、包括的なVAD境界を修正しました。
  • v2.62.0 - ダビングの一括文字起こし更新メソッドとDubbingRegenerateResponseを追加し、会話ガードレールフィルター、エージェントブランチのコミットステータス、エージェントアラート、MCPのrequestMetaサポートを追加しました。言語ターゲットの作成ではmodelIdを受け付けなくなりました。
  • v2.61.0 - 会話階層フィルタリング、通話後分析の課金、トリガーされたガードレールメタデータ、ブランチマージ競合の詳細、DTMF入力のマスキング、ダビング文字起こしのアップロードを追加しました。エクスポートされていたOpenAIリアルタイムセッション型とrun_subagent_*ツール結果バリアントを削除しました。

Python SDK

  • v2.63.0 - 第2言語、言語・エンティティ検出、バックグラウンドオーディオフィルタリング、ロギング、使い捨てトークン認証に対応するリアルタイムのスピーチtoテキストオプションを追加しました。最終文字起こし、エンティティ、無効なリクエストのイベントを追加し、未承認の利用規約ディスパッチを修正するとともに、APIキーまたはトークンなしの接続を拒否するようになりました。
  • v2.62.0 - ダビングのupdate_segmentsメソッドとDubbingRegenerateResponseを追加し、guardrail_types、custom_guardrail_names、include_commit_status、MCPのrequest_metaサポートを追加しました。ダビングセグメントの更新でリクエストボディモデルを使用するようになり、言語ターゲットの作成ではmodel_idを受け付けなくなりました。
  • v2.61.0 - parent_conversation_id、分析課金、トリガーされたガードレールメタデータ、ブランチマージ競合、DTMF入力のマスキング、ダビング文字起こしのアップロードを追加しました。OpenAIリアルタイムセッション型とrun_subagent_*結果モデルを削除しました。

Android SDK

  • v0.12.1 - 意図的なテキスト専用セッションの切断がConversationStatus.ERRORとして報告される問題を修正しました。
  • v0.12.0 - 会話オーディオをAndroidメディアストリーム経由でルーティングするConversationConfig.useMediaStreamを追加しました。リモート側による通常のWebSocketクローズはDisconnectionDetails.Agentとして、ローカルで開始されたクローズはDisconnectionDetails.Userとして報告されるようになりました。

MCPサーバー

  • v0.12.2 - パストラバーサルの問題を修正しました。

API

APIの変更を表示

新しいエンドポイント

ダビング

  • 元セグメントを一括更新 - PATCH /v1/dubbing/project/{project_id}/transcript/segments
    • DubbingBulkSegmentUpdateRequestが必要です
    • 元セグメントのテキスト、話者、タイミングをアトミックに更新します
    • 更新済みのsegmentsとrevisionを含むDubbingBulkSourceSegmentUpdateResponseを返します
  • ターゲットセグメントを一括更新 - PATCH /v1/dubbing/project/{project_id}/language/{language_id}/transcript/segments
    • DubbingBulkTargetSegmentUpdateRequestが必要です
    • 複数のターゲットセグメントの翻訳をアトミックに更新します
    • 更新済みのsegmentsとrevisionを含むDubbingBulkTargetSegmentUpdateResponseを返します

更新されたエンドポイント

ElevenAgents

  • 会話を一覧表示 - GET /v1/convai/conversations
    • 任意のparent_conversation_id(文字列)を追加
    • 任意で繰り返し指定可能なguardrail_types(GuardrailType[])およびcustom_guardrail_names(文字列配列)を追加
  • エージェントブランチを一覧表示 - GET /v1/convai/agents/{agent_id}/branches
    • 任意のinclude_commit_status(ブール値、デフォルトはfalse)を追加
    • ブランチの概要にnull許容のcommits_ahead(整数)、commits_behind(整数)、merged_into_branch_id(文字列)を追加

音声

  • すべての音声v2を取得 - GET /v2/voices
    • 任意のgender、age、accent(文字列)フィルターを追加
    • 任意のlanguageおよびuse_cases(文字列配列)フィルターを追加
    • 任意のmin_notice_period_days(整数)、include_custom_rates、include_live_moderated、high_quality(ブール値)フィルターを追加

スキーマの変更

ElevenAgents

  • クライアントオーバーライドスキーマにmax_duration_seconds(整数)とpronunciation_dictionary_locators(配列)を追加
  • MCPサーバーの入力・出力スキーマにrequest_metaマップを追加
  • エージェントプラットフォーム設定にalertingを追加し、言語検出にonly_at_conversation_start(ブール値)を追加
  • AnalysisCharging.last_runが必須かつnull非許容になり、累積合計に必須のruns(整数)を追加
  • RAGチャンクレスポンスでcontent_formatとdocument_typeが必須に