ElevenAgents
-
agent_response_completeWebSocketイベント:エージェントの応答が完全に配信された時点で、ちょうど1回だけ新しいagent_response_completeクライアントイベントが発火します。これは、すべてのLLM生成、ツール呼び出しチェーン、オーディオ再生が完了した後です。このイベント以降、ユーザーが新しい入力を提供するか、ターンタイムアウトによって新しいターンが開始されない限り、エージェントは追加の出力を生成しません。このイベントにより、クライアントはメッセージのバッチ処理、ウェイクワードの有効化、ターン後のUI更新に向けて、ターンの終了を確実に検出できます。ClientEvent列挙型に新しいAGENT_RESPONSE_COMPLETE値を追加し、対応するAgentResponseCompleteClientEventレスポンスモデルも追加しました。 -
ツール実行前の発話モード:MCPサーバー設定およびツールごとのオーバーライドに、新しい
pre_tool_speechフィールド(PreToolSpeechMode列挙型、デフォルトはauto)を追加しました。これにより、非推奨となったforce_pre_tool_speechブール値を置き換えます。値:autoは直近のツールレイテンシーに基づいてツール呼び出し前にエージェントが発話するかを決定し、forceは常にエージェントに発話を求め、offは完全に無効化します。 -
ツールディスパッチが実行モードを尊重:ワークフローツールのディスパッチノードが、ネストされた各ツールの
execution_modeを正しく尊重するようになりました。ディスパッチノード内のいずれかのツールがPOST_TOOL_SPEECHを使用している場合、ワークフローは現在のターンのオーディオが完全に公開されるまで待機してからディスパッチを実行します。 -
MCPレスポンスタイムアウト:MCPサーバー設定およびツールごとのオーバーライドに、各MCPツール呼び出しの完了を待機する最大時間を制御する
response_timeout_secsフィールド(整数、デフォルト30、最小5、最大120)を追加しました。 -
エージェント信頼コンテキスト:エージェントプラットフォーム設定に
trust_contextフィールド(AgentTrustContext列挙型:unknown|low|high、デフォルトunknown)を追加しました。lowは、出力を検証しツールアクセスを制限すべき、信頼できない外部参加者に対応するエージェント向けです。highは、完全なツールアクセスが適切なオーナーに対応するエージェント向けです。unknownは、この機能より前に作成されたエージェントを対象とします。 -
ソース帰属の切り替え:会話設定に
source_attributionブール値(デフォルトfalse)を追加しました。有効にすると、ナレッジベースのコンテンツが存在する場合、LLMは使用したソースを報告するよう指示されます。 -
テスト共有モードフィルター:テスト一覧エンドポイントが、
sharing_modeクエリパラメーター(all|shared_with_me、デフォルトall)を受け付けるようになりました。これにより、現在のユーザーと共有されていて、そのユーザー自身が作成していないテストとフォルダーだけに絞り込めます。 -
ツールアイコンと実行メタデータ:
Toolスキーマにicons(Iconの配列)およびexecution(ToolExecution)フィールドを追加しました。IconにはUI表示用のsrc、mimeType、sizesが含まれ、ToolExecution.taskSupport(forbidden|optional|required)はツールがタスクにどのように参加するかを宣言します。 -
プロシージャコンパイラーのデフォルト:
ProcedureCompilerModeのデフォルトをdeterministicからappendに変更し、llm値を削除しました。明示的にdeterministicを設定している既存のエージェントには影響ありません。 -
RAGおよびナレッジベースの帰属メタデータ:
ConversationHistoryTranscriptCommonModelおよびConversationHistoryTranscriptResponseModelにused_static_kb_document_ids(文字列配列)を、RagRetrievalInfoにused_chunk_idsを追加しました。これにより、各トランスクリプトターンに寄与したナレッジベースドキュメントとRAGチャンクを正確に確認できます。 -
動的変数のリファクタリング:
dynamic_variablesとdynamic_variable_placeholdersが、統合されたDynamicVariableValueType-Input/DynamicVariableValueType-Outputスキーマ(従来のDynamicVariableContainerValueType-*スキーマを置き換え)を参照するようになり、ネストされた値とリスト値をより幅広くサポートします。DynamicVariableAssignmentには、文字列への強制変換ではなく型付きの値を保持するためのpreserve_native_typeフィールドを追加しました。
オーディオ分離
- 履歴エンドポイント:オーディオ分離の履歴を公開する新しいエンドポイントを2つ追加しました。
- オーディオ分離履歴の一覧(
GET /v1/audio-isolation/history)は、すべてのオーディオ分離生成のページネーション付きリストを返します。page_size、page、searchクエリパラメーターをサポートします。 - オーディオ分離履歴アイテムの削除(
DELETE /v1/audio-isolation/history/{history_item_id})は、特定のアイテムと関連するメディアファイルを削除します。
- オーディオ分離履歴の一覧(
スピーチtoテキスト
- リアルタイムのキータームと逐語モード:ScribeリアルタイムWebSocketが、モデルを特定の用語に寄せるための
keytermsパラメーター(文字列配列、最大50件、各20文字まで)と、トランスクリプトからフィラーワード、言い直し、非流暢表現を除去するno_verbatimブール値を受け付けるようになりました。両パラメーターはsession_startedイベントでエコーバックされます。JavaScript SDK、Python SDK、および@elevenlabs/clientブラウザー/NodeクライアントSDKで利用できます。
SDKリリース
Python SDK
- v2.45.0 - 2026年4月27日のAPIスキーマ向けFern再生成。オーディオ分離履歴エンドポイント、ツール実行、MCPの
pre_tool_speechとresponse_timeout_secs、およびagent_response_completeクライアントイベントを含みます。READMEのノートブックインストールヒントの修正も含まれます。 - v2.44.0 - 2026年4月21日のAPIスキーマ向けFern再生成。
trust_contextフィールド、pre_tool_speechモード、アセット文字起こしサポート、MCPレスポンスタイムアウト設定を取り込みました。
JavaScript SDK
- v2.45.0 - Scribeリアルタイムクライアントに、
keyterms(文字列配列、最大50個のキーターム、各20文字まで)およびnoVerbatim(ブール値)オプションを追加しました。keytermsは文字起こしを誘導するため、WebSocket URL上の繰り返しクエリパラメーターとして送信され、noVerbatimはフィラーワードと非流暢表現を除去します。両フィールドは、session_startedエコー用の型付きConfigインターフェースにも追加されています。2026年4月27日のFern再生成(#376)も含まれます。 - v2.44.0 - 2026年4月21日のAPIスキーマ向けFern再生成。
trust_contextフィールド、pre_tool_speechモード、MCPレスポンスタイムアウト設定を取り込みました。
Swift SDK
- v3.1.4 - エージェント切断後もローカルマイクが公開を続ける問題(無音タイムアウトまたは
end_callツール)を修正しました。onAgentDisconnectedはLiveKitルームを切断して会話状態を破棄するようになり、onDisconnectは.agent理由で発火します。ConnectionManaging.onAgentDisconnectedはasyncになりました。未使用のConversationConnectionManagerラッパーを削除しました。
パッケージ
- @elevenlabs/client@1.3.1 - エージェントのツール呼び出し音がユーザーの発話として解釈され、ツール実行中にエージェントを中断してしまう問題を修正しました。
- @elevenlabs/client@1.3.0 - 会話ファイルアップロードエンドポイントのサポートを追加し、クライアントSDKから進行中の会話に直接ファイルを添付できるようにしました。
- @elevenlabs/react@1.2.1, @elevenlabs/react@1.2.0 -
@elevenlabs/client@1.3.1/@elevenlabs/client@1.3.0に更新し、ツール呼び出し音の修正と会話ファイルアップロードのサポートを取り込みました。 - @elevenlabs/react-native@1.1.3, @elevenlabs/react-native@1.1.2 - 同じ修正のため、最新の
@elevenlabs/clientに更新しました。 - @elevenlabs/convai-widget-core@0.11.6, @elevenlabs/convai-widget-embed@0.11.6 - ツール呼び出し音の修正のため、
@elevenlabs/client@1.3.1に更新しました。 - @elevenlabs/convai-widget-core@0.11.5, @elevenlabs/convai-widget-embed@0.11.5 - 会話ファイルアップロードのサポートのため、
@elevenlabs/client@1.3.0に更新しました。
API
API変更を表示
新しいエンドポイント
- オーディオ分離履歴の一覧 -
GET /v1/audio-isolation/history - オーディオ分離履歴アイテムの削除 -
DELETE /v1/audio-isolation/history/{history_item_id} - ツール実行の取得 -
GET /v1/convai/tools/{tool_id}/executionsは、オプションのcursor、page_size、is_error、agent_id、branch_id、start_time、end_timeフィルターを使用して、特定のツールのページネーション付きツール実行を返します
更新されたエンドポイント
ElevenAgents
-
AgentPlatformSettingsRequestModelにtrust_contextフィールド(AgentTrustContext列挙型:unknown|low|high、デフォルトunknown)を追加ConversationConfigにsource_attributionフィールド(ブール値、デフォルトfalse)を追加
-
pre_tool_speechフィールド(PreToolSpeechMode列挙型:auto|force|off、デフォルトauto)を追加response_timeout_secsフィールド(整数、デフォルト30、最小5、最大120)を追加
-
pre_tool_speechフィールド(PreToolSpeechMode列挙型、null許容、任意)を追加response_timeout_secsフィールド(整数、null許容、任意)を追加MCPToolConfigOverride-Input/MCPToolConfigOverride-Outputにresponse_mocksフィールドを追加force_pre_tool_speechを非推奨としてマーク。代わりにpre_tool_speechを使用してください
-
- オプションの
sharing_modeクエリパラメーター(TestSharingMode列挙型:all|shared_with_me、デフォルトall)を追加
- オプションの
-
dynamic_variablesおよびdynamic_variable_placeholdersペイロードをリファクタリングし、ネスト値とリスト値をより幅広くサポートする統合DynamicVariableValueType-Input/DynamicVariableValueType-Outputスキーマを参照するよう変更
-
Toolスキーマ- UI表示用に
iconsフィールド(Iconの配列、null許容)を追加 taskSupport(forbidden|optional|required)を含むexecutionフィールド(ToolExecution、null許容)を追加
- UI表示用に
-
ClientEvent列挙型- 新しい
AgentResponseCompleteClientEventレスポンスモデルとともにagent_response_complete値を追加
- 新しい
-
ProcedureCompilerMode列挙型- デフォルトを
deterministicからappendに変更 llm値を削除
- デフォルトを
-
ConversationHistoryTranscriptCommonModel、ConversationHistoryTranscriptResponseModelused_static_kb_document_idsフィールド(文字列配列)を追加
-
RagRetrievalInfoused_chunk_idsフィールド(文字列配列)を追加
-
DynamicVariableAssignment- 文字列への強制変換ではなく型付きの値を保持するための
preserve_native_typeフィールド(ブール値)を追加
- 文字列への強制変換ではなく型付きの値を保持するための
-
ワークフローノード
- 関連するワークフローノードスキーマに
auto_advance_after_first_responseフィールドを追加
- 関連するワークフローノードスキーマに
-
ツール設定ドキュメント
- 想定されるレスポンス形式を文書化するための
response_body_schemaフィールドを追加
- 想定されるレスポンス形式を文書化するための
ワークスペース
-
GetUserSubscriptionResponseModelmax_credit_limit_extensionフィールドを追加
-
- リクエスト検証を厳格化:
start_timeとend_timeの最小値を2020-01-01に引き上げ、両フィールドに説明を追加しました。エンドポイントの概要はGet Workspace Usageに改名されました。
- リクエスト検証を厳格化:
その他
- 新しい共有
Currency列挙型を追加。値はeur、inr、usdで、複数のスキーマにあるインライン通貨文字列を置き換えます。 - 新しい
AssetTranscriptionおよびAssetTranscriptionDataスキーマにより、アセットモデルに文字起こしサポートを拡張しました。 - 新しい
PendingBlocksMetadataModelおよびPendingExternalAudiosMetadataModelにより、保留中タスクに関するより豊富なメタデータを提供します。 - ソース関連の列挙型に新しい
InVPC値を追加しました。 - 文字起こしの
keytermsに、仕様上の明示的な長さ制限が追加されました。 - 新しい
MemoryEntrySearchResult、ConversationSource、ManualSourceスキーマを追加しました。