ElevenAgents

  • テスト固有のツールモック:エージェントシミュレーションとユニットテストで、ツールIDをキーとするtool_mock_overridesを定義し、1つのテストに限り共有モックを置き換えられるようになりました。ToolResponseMockConfigには任意のis_error(ブール値、デフォルトはfalse)も追加され、モックでツール失敗パスをテストできます。
  • 翻訳されたワークフローメッセージ:リテラルSayノードメッセージに、言語キーからTranslatedStringオブジェクトへのマップであるtext_translationsを追加しました。このフィールドは入力では任意、出力では必須のため、厳密なレスポンスバリデーターはこれを受け入れる必要があります。
  • 会話バージョンフィルター:会話を一覧表示と会話メッセージをテキスト検索に、エージェントバージョンで結果をフィルタリングする任意のversion_idクエリパラメーター(文字列)を追加しました。
  • ナレッジベースのシステムツール:エージェント設定に、設定可能なenabled_strategies(SearchStrategy[])を持つknowledge_baseシステムツールを追加しました。エージェントのナレッジベースRAGクエリに、任意のuse_agent_defaults(ブール値、デフォルトはtrue)を追加しました。falseに設定すると、エージェントの埋め込みモデルを維持したまま中立的な取得設定を使用します。
  • エージェントの音声アクティビティ検出:エージェントの作成、更新、レスポンス、ワークフローオーバーライドのスキーマにvad設定を追加しました。VADConfigは現在、background_voice_detection(ブール値、デフォルトはfalse)に対応しています。
  • WebSocketカスタムLLM:CustomLLMAPITypeにwebsocketを追加しました。
  • ファイルメモリ制御:ウィジェットのファイル入力設定にmax_files_in_memory(整数、1~30、デフォルトは10)を追加しました。上限を超えたファイルは要約され、メモリから解放されます。max_files_per_conversationは-1またはメモリ上限以上にする必要があります。
  • DTMF入力のマスキング:DTMFInputConfigに任意のredact_input(ブール値、デフォルトはfalse)を追加しました。これにより、通話者がキーパッドで入力した数字が文字起こし、会話ログ、分析で置き換えられます。エージェントが繰り返した数字やツールに渡された数字は変更されません。

スピーチtoテキスト

  • リアルタイムエンティティ検出:Scribe v2 Realtimeにentity_detectionクエリオプションを追加しました。all、1つのエンティティタイプまたはカテゴリー、あるいはタイプとカテゴリーの配列を受け付け、検出されたエンティティをcommitted_transcript_entitiesイベントで出力します。対応するカテゴリーについてはエンティティ検出ガイドをご覧ください。

Voices

  • データレジデンシー間の音声レプリケーション:同じ統合請求グループ内のワークスペースにInstant Voice CloneまたはVoice Designの音声をコピーするPOST /v1/voices/{voice_id}/replicate-to-isolated-environmentを追加しました。リクエストにはtarget_workspace_id(文字列)が必要で、preserve_voice_id(ブール値、デフォルトはtrue)を受け付けます。レスポンスでは対象のvoice_idが返されます。
  • キャラクターメタデータ:キャラクターレスポンスにrecommended_voice_ids(文字列配列、デフォルトは[])を追加し、メタデータにnull許容のrole(CharacterRole)を追加しました。また、CharacterAgeのmiddle-agedをmiddle_agedに置き換えました。

SDKリリース

パッケージ

MCPサーバー

  • v0.12.1 - v0.11のツール更新と、44件のセキュリティアラートを解消する依存関係の更新が含まれます。
  • v0.11.0 - シミュレートされたユーザーの挙動、評価基準、文字起こし出力、合格/不合格分析を設定できるsimulate_conversationを追加しました。speech_to_textツールのデフォルトはscribe_v2になり、voice_cloneはパス文字列ではなく音声ファイルの内容を送信するようになりました。

API

新しいエンドポイント

Voices

  • POST /v1/voices/{voice_id}/replicate-to-isolated-environment
    • Instant Voice CloneまたはVoice Designの音声を、別のワークスペースの隔離環境にレプリケートします
    • target_workspace_id(文字列)が必要です
    • 任意のpreserve_voice_id(ブール値、デフォルトはtrue)を受け付けます
    • 必須のvoice_id(文字列)を返します

更新されたエンドポイント

ElevenAgents

  • 会話を一覧表示 - GET /v1/convai/conversations
    • 任意のversion_id(文字列)クエリパラメーターを追加しました
  • 会話メッセージをテキスト検索 - GET /v1/convai/conversations/messages/text-search
    • 任意のversion_id(文字列)クエリパラメーターを追加しました
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • 任意のuse_agent_defaults(ブール値、デフォルトはtrue)リクエストフィールドを追加しました

スキーマの変更

ElevenAgents

  • シミュレーションおよびユニットテストのペイロードに任意のtool_mock_overridesマップを追加しました。ToolResponseMockConfigには任意のis_error(ブール値、デフォルトはfalse)を追加しました
  • SayNodeLiteralMessageにtext_translations(TranslatedStringのマップ)を追加しました。このフィールドは入力では任意、出力では必須です
  • エージェント設定にknowledge_base(KnowledgeBaseToolConfig)とvad(VADConfig)を追加しました
  • CustomLLMAPITypeにwebsocketを追加しました
  • FileInputConfigにmax_files_in_memory(整数、1~30、デフォルトは10)を追加しました
  • DTMFInputConfigに任意のredact_input(ブール値、デフォルトはfalse)を追加しました
  • リアルタイムエージェント設定のデフォルトがeleven_realtime_v1_miniになりました

Voices

  • キャラクターレスポンスにrecommended_voice_ids(文字列配列、デフォルトは[])を追加しました
  • キャラクターメタデータにnull許容のrole(CharacterRole)を追加しました
  • 破壊的変更:CharacterAgeのmiddle-agedをmiddle_agedに置き換えました。以前の値を送信しているクライアントは移行が必要です

テキスト読み上げ

  • 破壊的変更:ElevenAgentsのテキスト読み上げ設定スキーマからAudioFilterIdとaudio_filterを削除しました